Projet open source
PaddlePaddle/PaddleOCR avatar
PaddlePaddle/PaddleOCR

PaddleOCR : transformer images et PDF en données structurées

Transformez n'importe quel document PDF ou image en données structurées pour votre IA. Une boîte à outils OCR puissante et légère qui comble le fossé entre les images/PDF et les LLM. Prend en charge plus de 100 langues.

89 583 étoiles11 336 forksPythonApache-2.0

En bref

De quoi s’agit-il ?
PaddleOCR convertit les PDF et les images en JSON ou Markdown, prend en charge plus de 100 langues et propose des familles de modèles comme PP-OCR, PaddleOCR-VL et PP-StructureV3.
À qui s’adresse-t-il ?
PaddleOCR est publié sous licence Apache 2.0, et les métadonnées du dépôt indiquent 87 004 étoiles et 226 problèmes ouverts au moment de la rédaction. Le README ne décrit pas ce que la licence dit concernant la sécurité, le support ou la garantie.
Puis-je l’utiliser commercialement ?
Oui. Apache-2.0 est une licence permissive : vous pouvez utiliser, modifier et vendre un logiciel qui en dépend, à condition de conserver les mentions de droit d’auteur et de licence.
Est-il encore maintenu ?
Oui. Les derniers commits datent d’il y a 55 jours.
En quel langage est-il écrit ?
Principalement Python, d’après les statistiques de langage de GitHub.

Ces réponses reposent sur les données GitHub du projet (dernière synchronisation le 15 septembre 2026) et sur notre analyse. Elles ne constituent pas un avis juridique.

ANALYSE OPEN SOURCE APPROFONDIE

Ce que le dépôt dit faire

Le README de PaddleOCR positionne le projet comme un outil qui convertit les documents PDF et les images en données structurées prêtes pour les LLM, au format JSON ou Markdown. Les métadonnées du dépôt le décrivent comme une boîte à outils OCR légère prenant en charge plus de 100 langues. Le README cite également des projets comme Dify, RAGFlow et Cherry Studio comme utilisateurs, mais il n'explique pas comment ces projets intègrent PaddleOCR ni sur quelles capacités spécifiques ils s'appuient. Repère PaddleOCR, section 1, paragraphe 1.

Dans le dépôt PaddlePaddle/PaddleOCR, cette rubrique doit être rapprochée des fichiers et des entrées réellement cités par le README. Le texte source établit ce point, mais ne permet pas d'en déduire une garantie de compatibilité, de débit ou de support lorsqu'elle n'est pas explicitement donnée. Repère PaddleOCR, section 1, paragraphe 2.

Pour un contrôle ciblé de « Ce que le dépôt dit faire », relisez la branche main et comparez les sorties obtenues aux exemples du README de PaddleOCR. Toute différence doit être attribuée à une version, une configuration ou une dépendance identifiée, plutôt qu'à une promesse générale. Repère de contrôle 1 pour PaddleOCR. Repère PaddleOCR, section 1, paragraphe 3.

Familles de modèles et chemins d'analyse

Le README décrit trois principales familles de modèles. La série PP-OCR se concentre sur la reconnaissance générale de texte, avec PP-OCRv6 prenant en charge 50 langues dans un seul modèle unifié, couvrant le chinois, l'anglais, le japonais et 46 langues à écriture latine. PaddleOCR-VL est un modèle vision-langage pour l'analyse de documents ; le README mentionne les versions PaddleOCR-VL-1.6 (0.9B) et PaddleOCR-VL-1.5, avec un support de 109 à 111 langues selon la version. PP-StructureV3 offre une conversion sensible à la structure en Markdown ou JSON, incluant des informations de coordonnées fines telles que les coordonnées des cellules de tableau. Chaque famille a son propre lien de documentation dans le README. Repère PaddleOCR, section 2, paragraphe 1.

Dans le dépôt PaddlePaddle/PaddleOCR, cette rubrique doit être rapprochée des fichiers et des entrées réellement cités par le README. Le texte source établit ce point, mais ne permet pas d'en déduire une garantie de compatibilité, de débit ou de support lorsqu'elle n'est pas explicitement donnée. Repère PaddleOCR, section 2, paragraphe 2.

Pour un contrôle ciblé de « Familles de modèles et chemins d'analyse », relisez la branche main et comparez les sorties obtenues aux exemples du README de PaddleOCR. Toute différence doit être attribuée à une version, une configuration ou une dépendance identifiée, plutôt qu'à une promesse générale. Repère de contrôle 2 pour PaddleOCR. Repère PaddleOCR, section 2, paragraphe 3.

Affirmations de performance dans le journal des mises à jour

Le journal des modifications du README contient plusieurs affirmations de performance spécifiques. PaddleOCR-VL-1.6 atteindrait une précision de 96,3 % sur OmniDocBench v1.6. PP-OCRv6 améliorerait la détection de 4,6 % et la reconnaissance de 5,1 % par rapport à PP-OCRv5, avec un accélération CPU de 5,2 fois. HPD-Parsing est décrit comme atteignant un débit maximal de 4 752 tokens par seconde. Ces chiffres sont cités directement du README, qui ne fournit pas de méthodologie de benchmark ni de détails de vérification, ils doivent donc être traités comme les propres affirmations du projet. Repère PaddleOCR, section 3, paragraphe 1.

Dans le dépôt PaddlePaddle/PaddleOCR, cette rubrique doit être rapprochée des fichiers et des entrées réellement cités par le README. Le texte source établit ce point, mais ne permet pas d'en déduire une garantie de compatibilité, de débit ou de support lorsqu'elle n'est pas explicitement donnée. Repère PaddleOCR, section 3, paragraphe 2.

Pour un contrôle ciblé de « Affirmations de performance dans le journal des mises à jour », relisez la branche main et comparez les sorties obtenues aux exemples du README de PaddleOCR. Toute différence doit être attribuée à une version, une configuration ou une dépendance identifiée, plutôt qu'à une promesse générale. Repère de contrôle 3 pour PaddleOCR. Repère PaddleOCR, section 3, paragraphe 3.

Chemins de déploiement et d'intégration

Le README décrit un démarrage rapide : essayer le site officiel en ligne, puis choisir un chemin de documentation de déploiement local selon les besoins. Le déploiement local est divisé en série PP-OCR, série PaddleOCR-VL et série PP-StructureV3. En outre, le README mentionne la conversion de modèles au format ONNX, l'accélération de l'inférence avec des moteurs comme OpenVINO et TensorRT, l'inférence parallèle multi-GPU, et l'intégration de PaddleOCR dans des applications écrites en C++, C# ou Java via le service. Le README ne fournit pas de commandes d'installation spécifiques ni d'exemples de code. Repère PaddleOCR, section 4, paragraphe 1.

Dans le dépôt PaddlePaddle/PaddleOCR, cette rubrique doit être rapprochée des fichiers et des entrées réellement cités par le README. Le texte source établit ce point, mais ne permet pas d'en déduire une garantie de compatibilité, de débit ou de support lorsqu'elle n'est pas explicitement donnée. Repère PaddleOCR, section 4, paragraphe 2.

Pour un contrôle ciblé de « Chemins de déploiement et d'intégration », relisez la branche main et comparez les sorties obtenues aux exemples du README de PaddleOCR. Toute différence doit être attribuée à une version, une configuration ou une dépendance identifiée, plutôt qu'à une promesse générale. Repère de contrôle 4 pour PaddleOCR. Repère PaddleOCR, section 4, paragraphe 3.

Mises à jour récentes et capacités étendues

La version 3.7.0 a introduit PP-OCRv6 avec trois niveaux de modèles : tiny, small et medium. La version 3.6.0 a apporté PaddleOCR-VL-1.6. La version 3.5.0 a ajouté la conversion de documents Word, Excel et PowerPoint en Markdown, l'export DOCX des résultats analysés, et un SDK d'inférence navigateur appelé PaddleOCR.js. La version 3.4.0 a introduit PaddleOCR-VL-1.5, ajoutant la reconnaissance de sceaux, le repérage de texte et le support de 111 langues. Ces fonctionnalités sont enregistrées dans le README, mais le comportement de chaque version devrait être vérifié dans sa documentation correspondante. Repère PaddleOCR, section 5, paragraphe 1.

Dans le dépôt PaddlePaddle/PaddleOCR, cette rubrique doit être rapprochée des fichiers et des entrées réellement cités par le README. Le texte source établit ce point, mais ne permet pas d'en déduire une garantie de compatibilité, de débit ou de support lorsqu'elle n'est pas explicitement donnée. Repère PaddleOCR, section 5, paragraphe 2.

Pour un contrôle ciblé de « Mises à jour récentes et capacités étendues », relisez la branche main et comparez les sorties obtenues aux exemples du README de PaddleOCR. Toute différence doit être attribuée à une version, une configuration ou une dépendance identifiée, plutôt qu'à une promesse générale. Repère de contrôle 5 pour PaddleOCR. Repère PaddleOCR, section 5, paragraphe 3.

Communauté et projets externes

Le README liste un ensemble de projets externes utilisant PaddleOCR, notamment Dify, RAGFlow, Pathway, MinerU, Umi-OCR, Cherry Studio, Haystack, OmniParser et QAnything. La liste apparaît dans la section « Awesome Projects » du README, mais le README ne précise pas comment chaque projet utilise PaddleOCR. Le dépôt affiche également un graphique des contributeurs et un graphique de l'historique des étoiles, et fournit des codes QR pour rejoindre le compte WeChat de PaddlePaddle et un groupe de discussion technique. Les étapes exactes pour rejoindre ces groupes ne sont pas décrites dans le README. Repère PaddleOCR, section 6, paragraphe 1.

Dans le dépôt PaddlePaddle/PaddleOCR, cette rubrique doit être rapprochée des fichiers et des entrées réellement cités par le README. Le texte source établit ce point, mais ne permet pas d'en déduire une garantie de compatibilité, de débit ou de support lorsqu'elle n'est pas explicitement donnée. Repère PaddleOCR, section 6, paragraphe 2.

Pour un contrôle ciblé de « Communauté et projets externes », relisez la branche main et comparez les sorties obtenues aux exemples du README de PaddleOCR. Toute différence doit être attribuée à une version, une configuration ou une dépendance identifiée, plutôt qu'à une promesse générale. Repère de contrôle 6 pour PaddleOCR. Repère PaddleOCR, section 6, paragraphe 3.

Licence et sources citées

Le projet est publié sous la licence Apache 2.0. Le texte de la licence accorde des permissions de reproduction, de création d'œuvres dérivées, d'affichage public, de sous-licence et de distribution, mais il ne dit rien sur la posture de sécurité, le support ou la garantie. Le README cite plusieurs articles techniques, dont un rapport technique sur PaddleOCR 3.0 et des articles sur PaddleOCR-VL, avec des liens arXiv. Ces citations sont les seules sources spécifiques nommées dans le README. Repère PaddleOCR, section 7, paragraphe 1.

Dans le dépôt PaddlePaddle/PaddleOCR, cette rubrique doit être rapprochée des fichiers et des entrées réellement cités par le README. Le texte source établit ce point, mais ne permet pas d'en déduire une garantie de compatibilité, de débit ou de support lorsqu'elle n'est pas explicitement donnée. Repère PaddleOCR, section 7, paragraphe 2.

Pour un contrôle ciblé de « Licence et sources citées », relisez la branche main et comparez les sorties obtenues aux exemples du README de PaddleOCR. Toute différence doit être attribuée à une version, une configuration ou une dépendance identifiée, plutôt qu'à une promesse générale. Repère de contrôle 7 pour PaddleOCR. Repère PaddleOCR, section 7, paragraphe 3.

Conclusion éditoriale

PaddleOCR est publié sous licence Apache 2.0, et les métadonnées du dépôt indiquent 87 004 étoiles et 226 problèmes ouverts au moment de la rédaction. Le README ne décrit pas ce que la licence dit concernant la sécurité, le support ou la garantie. Pour décider de l'adopter, vérifiez le cas d'usage propre à PaddleOCR avec les fichiers et commandes cités dans son README, puis contrôlez les erreurs et sorties attendues dans votre environnement.

Sources officielles

  1. Official documentation
  2. Official README
  3. Project repository
  4. Release notes
Notes de la communauté

Notes de la communauté