Cohere ने Parse v5.0 जारी किया है, जो एक हाई-थ्रूपुट विज़न लैंग्वेज मॉडल है जिसे एंटरप्राइज़ दस्तावेज़ों के बड़े वॉल्यूम को स्ट्रक्चर्ड Markdown डेटा में प्रोसेस करने के लिए डिज़ाइन किया गया है। यह मॉडल नौ प्रमुख भाषाओं का समर्थन करता है और Cohere API, Model Vault, Microsoft Foundry, और AWS SageMaker के माध्यम से उपलब्ध है।
- ParseBench पर, Parse को 79.2 स्कोर प्राप्त हुआ है, जो Mistral OCR 4 (74.5), Databricks AI Parse (72.4), LlamaParse (78.3) और AWS Textract और Google Document AI जैसे हाइपरस्केलर समाधानों से 20 अंक से अधिक बेहतर प्रदर्शन करता है।
- यह एकल GPU पर प्रति सेकंड 4.5 पेज प्रोसेस करता है, जो RedNote के dots.mocr की थ्रूपुट का लगभग 1.4x और Chandra OCR 2 का 2.2x प्राप्त करता है।
- Model Vault के माध्यम से डिप्लॉयमेंट महत्वपूर्ण लागत बचत प्रदान करता है, पूर्ण उपयोगिता पर मानक API की तुलना में इनफरेंस लागत को 61% तक कम करता है।
इस मॉडल को दस्तावेज़ इंडेक्सिंग, RAG और एजेंटिक रिट्रीवल के लिए एक लागत-प्रभावी समाधान के रूप में स्थापित किया गया है, जो डाउनस्ट्रीम ऑटोमेशन के लिए दस्तावेज़ संरचना को बनाए रखता है।