Lemonade v10.8 introduce gestión dinámica de VRAM que descarga automáticamente los modelos inactivos y reduce el tamaño del KV-cache para recuperar memoria de GPU. Añade soporte de descarga a la nube para proveedores compatibles con OpenAI, permitiendo el servicio de modelos local-first con enrutamiento opcional a la nube. Una nueva puerta de enlace MCP expone los modelos locales como herramientas mediante POST /mcp, permitiendo que los modelos locales se utilicen como herramientas en aplicaciones compatibles con MCP.
Lemonade v10.8 lanza gestión automática de memoria, descarga a la nube y soporte para herramientas MCP
El arte ASCII permite a los LLM solo de texto controlar sistemas VLA
Un modelo de lenguaje grande solo de texto puede adaptarse en un controlador Visión--Lenguaje--Acción utilizando observaciones visuales renderizadas en ASCII. Este enfoque permite que los LLM interpreten estados visuales a través del texto, lo que les posibilita seguir instrucciones en lenguaje natural y generar acciones ejecutables tanto en simulación como en manipuladores físicos.
Qwen lanza MoE de 35B parámetros para simulación de entornos de agentes
Qwen ha lanzado Qwen-AgentWorld-35B-A3B, un modelo MoE de 35B parámetros con solo unos 3B parámetros activos por token. Está entrenado para simular respuestas de entornos MCP, terminal, ingeniería de software, Android, web y GUI del sistema operativo, prediciendo las siguientes observaciones después de las acciones del agente, lo que permite un entrenamiento eficiente del agente y la simulación del entorno sin ejecución real de herramientas.
Claude Code v2.1.229 añade la reanudación del control remoto y corrige fallos
La versión 2.1.229 de Claude Code introduce soporte para reanudar sesiones recientes de Control Remoto mediante el comando `claude remote-control --continue` y añade soporte para ganchos proporcionados por el servidor en ejecutores autoalojados. Esta actualización también implementa pings de keepalive SSE para evitar desconexiones por tiempo inactivo en los upstreams de Vertex y Bedrock durante pausas prolongadas de pensamiento.
xAI lanza Grok 4.6 con capacidades mejoradas para agentes de larga duración
xAI ha lanzado Grok 4.6, una actualización de su modelo centrada en agentes de larga duración y trabajo interactivo complejo. La nueva versión iguala a GPT-5.6 Sol en el Índice de Inteligencia de Artificial Analysis y está disponible en Cursor, Grok Build y a través de la API.
Google demuestra capacidades de consulta clínica por video en tiempo real con AMIE
Google Research y Google DeepMind han avanzado su sistema de IA médica de investigación, AMIE, para demostrar capacidades de consulta clínica por video en tiempo real en un estudio pionero. Construido sobre Gemini y Project Astra utilizando una arquitectura multiagente, el sistema interpreta señales visuales y auditivas, guía exámenes físicos virtuales y razona diagnósticamente en tiempo real.