Cohere ha lanzado Embed 5, una nueva familia de modelos de incrustación que comprende dos niveles: Embed 5 Pro para máxima calidad de recuperación y Embed 5 Fast para menor latencia y costo. Ambos modelos admiten texto, imágenes e entradas fusionadas en más de 100 idiomas con una ventana de contexto de 128K tokens.

  • La característica arquitectónica clave es que Pro y Fast comparten un único espacio de incrustación, lo que permite a los usuarios indexar con un modelo y consultar con el otro sin volver a indexar.
  • Embed 5 admite dimensiones de salida variables (de 2048 a 256) y salidas de menor precisión (float32, int8, binario), reduciendo significativamente los requisitos de almacenamiento para implementaciones a gran escala.
  • En las pruebas de referencia ViDoRe V3, Embed 5 Pro obtuvo un promedio de 85.8 y Fast un promedio de 84.5, superando a Voyage 4 Large (83.7) y Gemini Embedding 2 (83.2).
  • Los modelos están disponibles generalmente a través de la API de Cohere, Model Vault, Microsoft Foundry y Amazon SageMaker.

El diseño del espacio de incrustación compartido tiene como objetivo optimizar las cargas de trabajo agénticas al permitir una indexación de alta calidad con Pro mientras se mantienen velocidades de consulta rápidas con Fast, reduciendo la latencia para agentes que emiten múltiples búsquedas.