Qwable-v1, un modelo de pesos abiertos destilado a partir de Fable-5 de Anthropic, ya está disponible públicamente en Hugging Face. Captura 4.659 rastros de codificación agéntica en texto claro del corpus público de Fable-5 y emite llamadas XML <tool_use> correctamente formateadas a herramientas al estilo de Claude, reflejando la superficie original de herramientas en sus pesos.
Qwable-v1 lanzado como destilación de Claude Fable-5
Benchmarks
| Benchmark | Modelo | Puntuación |
|---|---|---|
| SWE-bench Pro | Qwable-v1 | 80.3% |
¿Qué sucede cuando las suscripciones a LLM dejan de estar subvencionadas?
Los proveedores de LLM actualmente subvencian el costoso uso de la API para construir ecosistemas, planeando aumentar los precios más adelante. A medida que disminuyen las subvenciones, los usuarios pueden enfrentar aumentos de precios pronunciados—como $2k por mes—haciendo el acceso costoso y amenazando la adopción generalizada, especialmente para individuos que dependen de hardware asequible para ejecutar modelos.
Los modelos locales pasaron de ser mayormente inútiles a realmente útiles en un año
Los modelos locales evolucionaron de juguetes centrados principalmente en la privacidad a herramientas prácticas para programación, gestión privada de documentos y flujos de trabajo locales en un año. Aunque aún no logran reemplazar a los mejores modelos cerrados para tareas complejas que requieren planificación y corrección de errores, la mejora general en usabilidad y rendimiento es evidente.
Claude Code v2.1.286 corrige problemas de autenticación, MCP y subagentes
Anthropic lanzó Claude Code versión 2.1.286, abordando una amplia gama de errores relacionados con la autenticación, el manejo del Protocolo de Contexto del Modelo (MCP) y los subagentes en segundo plano.
Claude Code v2.1.283 añade sugerencias de puerta de enlace, ajustes de gestión de modelos y auditoría de prompts
Claude Code v2.1.283 introduce nuevas opciones de configuración para puertas de enlace LLM y control de acceso a modelos, junto con una herramienta para auditar patrones de prompting en archivos CLAUDE.md.
SkillGym internaliza habilidades humanas en LLMs para la resolución de problemas del mundo real
Los investigadores presentan SkillGym, un marco que transforma las habilidades de agentes escritas por humanos en entornos de entrenamiento ejecutables y verificables para agentes de modelos de lenguaje grandes. El sistema utiliza una canalización de habilidad a tarea para instanciar tareas concretas y verificar resultados con verificadores basados en código.