LlamaIndex lance OpenDocRouter, un service de conversion de documents vers Markdown qui réunit plusieurs modèles propriétaires et ouverts de compréhension documentaire derrière une API unique. Le produit s’adresse aux équipes qui ne veulent pas figer leur chaîne d’ingestion autour d’un seul moteur d’OCR ou d’analyse. Un développeur peut envoyer un document par la même interface, choisir une recette parmi celles qui sont disponibles et conserver un contrat d’application stable même lorsque le modèle utilisé change.
Au lancement, OpenDocRouter accepte les PDF, les images PNG et JPEG ainsi que les URL. LlamaIndex indique que les requêtes synchrones prennent en charge jusqu’à 50 pages, tandis que la limite générale d’entrée atteint 500 pages ou 50 Mo. Le service renvoie du Markdown et peut ajouter des informations de mise en page à partir d’un ensemble partagé de classes. Les systèmes en aval disposent ainsi d’une représentation plus homogène des zones de texte, tableaux et autres structures, y compris lorsque plusieurs modèles sous-jacents sont utilisés.
Le principe des recettes versionnées occupe une place importante dans l’architecture. OpenDocRouter n’expose pas seulement un nom de modèle : le choix du modèle et le comportement du traitement sont regroupés dans une configuration versionnée que l’on peut sélectionner explicitement. Le catalogue initial combine des modèles commerciaux de premier plan et des systèmes OCR ouverts, avec des options provenant notamment d’OpenAI, de Google et d’Anthropic, ainsi que plusieurs analyseurs open source. L’objectif est de comparer plus facilement qualité, latence et coût sans réécrire l’intégration pour chaque fournisseur.
Cette abstraction est particulièrement utile lorsque aucun parseur n’est systématiquement supérieur sur tous les documents. Factures, publications scientifiques, formulaires numérisés et rapports à la mise en page dense présentent des difficultés différentes. La hiérarchie des modèles peut aussi évoluer rapidement. Une API commune simplifie donc l’expérimentation et peut faciliter des politiques de routage, par exemple en utilisant un modèle économique sur les pages simples et une option plus puissante sur les cas complexes.
LlamaIndex fournit une tarification fondée sur les tokens ainsi que des résultats ParseBench pour les recettes proposées. Ces chiffres doivent néanmoins être interprétés avec prudence : un benchmark contrôlé ne garantit pas le même comportement sur les documents propres à une entreprise, et les mises à jour des fournisseurs peuvent modifier les résultats. Pour les usages où une erreur d’extraction peut avoir des conséquences financières, juridiques ou opérationnelles, des tests sur des fichiers représentatifs restent indispensables.
OpenDocRouter est disponible dès maintenant selon LlamaIndex. L’intérêt du lancement vient moins d’un nouveau modèle de parsing que de la normalisation de l’accès à plusieurs modèles existants. Si cette couche reste stable lorsque les modèles évoluent, le problème d’ingestion pourrait se déplacer de l’intégration fournisseur vers le routage et l’évaluation. Le principal enjeu sera de conserver les capacités utiles propres à chaque modèle tout en réduisant réellement la complexité opérationnelle.