Un usuario pregunta cómo integrar Gemma 4 12B con capacidades de búsqueda utilizando modelos de IA autoalojados. Mencionan que han intentado usar openwebui, el cual tiene problemas con motores de búsqueda como DDG, y buscan alternativas que eviten el uso de claves API de Brave o Google.
Cómo configurar la búsqueda con modelos de IA
Cohere lanza el modelo de visión Parse v5.0
Cohere ha lanzado Parse v5.0, un modelo de lenguaje visual de alto rendimiento diseñado para procesar grandes volúmenes de documentos empresariales en datos Markdown estructurados. El modelo admite nueve idiomas principales y está disponible a través de la API de Cohere, Model Vault, Microsoft Foundry y AWS SageMaker.
OpenAI añade los modelos GPT-5.6 a Kiro para mejorar el rendimiento por precio
OpenAI ha integrado la familia de modelos GPT-5.6, incluidas las variantes Sol, Terra y Luna, en Kiro, un agente de desarrollo de software diseñado para aportar rigor de ingeniería a la codificación nativa de IA.
xAI lanza el modelo de codificación Grok 4.6 en GitHub Copilot
xAI ha puesto su último modelo de codificación, Grok 4.6, disponible dentro de GitHub Copilot para desarrolladores que usan VS Code y otras plataformas. Los usuarios pueden seleccionar el nuevo modelo a través del selector de modelos, mientras que los clientes empresariales pueden necesitar habilitarlo a través de la configuración de Copilot.
Google lanza Gemini 3.7 Flash con mejoras algorítmicas y precios más bajos
Google ha lanzado Gemini 3.7 Flash, un refinamiento del modelo 3.6 Flash que presenta mejoras algorítmicas en su base de razonamiento central en lugar de nuevo preentrenamiento. El modelo soporta texto, imágenes, audio y video dentro de una ventana de contexto de 1M de tokens y ofrece configuraciones de pensamiento personalizables para equilibrar la calidad frente al costo y la latencia.
SpaceXAI lanza Grok 4.6 con contexto de 500K y razonamiento agéntico mejorado
SpaceXAI ha lanzado Grok 4.6, una actualización post-entrenamiento de Grok 4.5 que cuenta con una ventana de contexto de 500.000 tokens y capacidades mejoradas para agentes de larga duración, codificación y trabajo de conocimiento.