Cohere a publié Parse v5.0, un modèle de langage visuel à haut débit conçu pour traiter de grands volumes de documents d'entreprise en données Markdown structurées. Le modèle prend en charge neuf langues majeures et est disponible via l'API Cohere, Model Vault, Microsoft Foundry et AWS SageMaker.

  • Sur ParseBench, Parse obtient un score de 79,2, surpassant Mistral OCR 4 (74,5), Databricks AI Parse (72,4), LlamaParse (78,3) et les solutions des hyperscalers comme AWS Textract et Google Document AI de plus de 20 points.
  • Il traite 4,5 pages par seconde sur un seul GPU, atteignant environ 1,4x le débit de RedNote's dots.mocr et 2,2x celui de Chandra OCR 2.
  • Le déploiement via Model Vault offre des économies de coûts significatives, réduisant les coûts d'inférence jusqu'à 61 % par rapport à l'API standard à pleine utilisation.

Le modèle est positionné comme une solution rentable pour l'indexation de documents, RAG et la récupération agentic, préservant la structure des documents pour l'automatisation en aval.