L'outil du jour

TeleOCR lit les documents numériques et photographiés

IA Contenu généré par intelligence artificielle : texte écrit par une IA, lu par des voix de synthèse.

Intégrer ce passage sur votre site

Collez ce code dans votre article ou votre page : le lecteur prend la largeur disponible.

Thème

Transcription avec les sources de chaque passage

Léna

StarDoc-AI a publié TeleOCR, un modèle de vision et de langage qui analyse des PDF numériques, des scans et des photos de documents, même déformées, selon AlphaSignal. Un seul modèle traite ces différents formats, sans redressement préalable des images. Il peut aussi restituer la géométrie des pages sous forme de polygones, des tableaux en OTSL et des formules en LaTeX. Les polygones peuvent servir à décrire la disposition des éléments sur une page, tandis que les sorties en OTSL et en LaTeX représentent respectivement les tableaux et les formules. Le modèle compte environ 1,2 milliard de paramètres. Sur OmniDocBench version 1.6, TeleOCR obtient 96,87 points, selon StarDoc-AI, qui indique qu’il devance notamment Gemini 3 Pro, Qwen3-VL-235B et GPT-5.2 sur ce benchmark. Le projet affirme aussi que TeleOCR a remporté le concours ICDAR 2026 Sci-ImageMiner et terminé en tête du challenge EMNLP 2026 Dr.DocBench. Ces résultats concernent l’analyse de documents. Ils donnent une indication sur cette spécialité, sans établir à eux seuls les performances sur d’autres tâches. TeleOCR est publié sous licence Apache-2.0. Pour un service qui travaille à la fois sur des PDF, des scans et des photos déformées, l’intérêt annoncé est de traiter ces entrées avec un même modèle et d’obtenir aussi des éléments de structure, pas seulement du texte.

Une erreur ?

Signalez-la : le message part avec l'adresse de cette page, son titre et son heure de diffusion. Une personne mise en cause peut aussi exercer son droit de réponse.

Signaler une erreur

Un mot pour la rédaction ?

Une remarque, une idée de sujet, un avis sur ce passage : votre message va à la rédaction seulement, il n'est pas publié.