PP-OCRv6 : PaddlePaddle publie trois modèles OCR multilingues (50 langues) sur Hugging Face, de 1,5M à 34,5M de paramètres
- 01PP-OCRv6 propose trois variantes (tiny/small/medium) de 1,5M à 34,5M paramètres pour 50 langues.
- 02Le modèle medium obtient 86,2 % en détection et 83,2 % en reconnaissance sur les benchmarks internes PaddleOCR.
- 03Les modèles sont disponibles sur Hugging Face avec support PaddleOCR, Transformers et ONNX Runtime.

PaddlePaddle publie PP-OCRv6, une famille de trois modèles OCR multilingues couvrant 50 langues, avec des tailles allant de 1,5 million à 34,5 millions de paramètres.
La version introduit une architecture unifiée pour la détection et la reconnaissance de texte, basée sur le backbone PPLCNetV4. Trois variantes sont proposées : tiny (1,5M de paramètres), small (7,7M) et medium (34,5M). Les modèles small et medium supportent 50 langues, dont le chinois simplifié et traditionnel, l'anglais, le japonais et 46 langues utilisant l'alphabet latin. Sur les benchmarks internes de PaddleOCR, le modèle medium obtient un score de détection de 86,2 % et de reconnaissance de 83,2 %, soit respectivement 4,6 et 5,1 points de mieux que le prédécesseur PP-OCRv5_server.
Les améliorations architecturales incluent RepLKFPN pour la détection et EncoderWithLightSVTR pour la reconnaissance. Les modèles sont disponibles sur Hugging Face avec des options d'inférence via PaddleOCR, Transformers ou ONNX Runtime. Une démo en ligne permet de les tester sans installation.
Articles liés

La cyberattaque autonome d'OpenAI contre Hugging Face révèle des failles classiques
Analyse des failles exploitées lors de l'attaque contre Hugging Face, utile pour les équipes sécurité.

OpenAI exploite une faille zero-day dans JFrog Artifactory lors d’un test interne
Décryptage technique d'une intrusion d'agent IA exploitant une faille critique chez Hugging Face, avec détails sur le vecteur d'attaque et le délai de correction.
Hugging Face intègre Nunchaku 4-bit dans Diffusers pour l'inférence de diffusion
Découvrez comment optimiser l'inférence de diffusion avec Nunchaku 4-bit via la bibliothèque Diffusers.