Aller au contenu
Source

Tesseract — tessdata_best (Apache 2.0, fra.traineddata)

OCR CPU de référence, sans dépendance GPU, utilisable par Docling, OCRmyPDF, PyMuPDF.

Confirmée#ocr#licencePublié le 16 sept. 2026Mis à jour le 16 sept. 2026Vérifié le 16 sept. 2026À revérifier le 15 déc. 2026
Organisation
Tesseract OCR
Type
GitHub
Fiabilité
Fiabilité haute
Publié
lu le 16/09/2026
Consulté le
16 septembre 2026
Sujets
ocr, licence

Citée par 2 page(s)

Ce que dit la source : moteur Tesseract 5 (LSTM) et données tessdata_best sous Apache 2.0 ; fra.traineddata disponible ; variantes tessdata / tessdata_best / tessdata_fast.

Ce qu'on en retient : OCR CPU de référence, sans dépendance GPU, utilisable par Docling, OCRmyPDF, PyMuPDF.

Limites : précision sur les scans de mauvaise qualité à mesurer.

content/sources/tesseract-tessdata-best.md54 mots