Qwable-v1, открытая модель, дистиллированная из Fable-5 от Anthropic, теперь доступна в общественном доступе на Hugging Face. Она содержит 4659 прямых текстовых следов агентного кодирования из публичного корпуса Fable-5 и генерирует корректно сформированные вызовы <tool_use> в формате XML для инструментов, характерных для Claude, отражая исходную поверхность инструментов в своих весах.
Выпущен Qwable-v1 как дистиллят Claude Fable-5
Бенчмарки
| Бенчмарк | Модель | Результат |
|---|---|---|
| SWE-bench Pro | Qwable-v1 | 80.3% |
Что происходит, когда подписки на LLM перестают поддерживаться?
Поставщики LLM в настоящее время поддерживали дорогостоящее использование API для создания экосистем, планируя повысить цены позже. По мере того, как поддержка уменьшается, пользователи могут столкнуться с резким ростом цен — например, до 2000 долларов в месяц — что сделает доступ к сервису дорогостоящим и угрожает широкому внедрению, особенно для лиц, которые зависят от недорогого оборудования для запуска моделей.
Локальные модели перешли от в основном бесполезных до действительно полезных за один год
Локальные модели перешли от того, что они были в основном ориентированы на приватность и служили игрушками, до практических инструментов для программирования, управления частными документами и локальных рабочих процессов за один год. Хотя они всё ещё не могут заменить лучшие закрытые модели при выполнении сложных задач, требующих планирования и исправления ошибок, общий рост в удобстве и производительности очевиден.
Claude Code v2.1.286 исправляет проблемы с аутентификацией, MCP и субагентами
Anthropic выпустила Claude Code версии 2.1.286, устраняя широкий спектр ошибок, связанных с аутентификацией, обработкой Model Context Protocol (MCP) и фоновыми субагентами.
Claude Code v2.1.283 добавляет подсказки для шлюзов, настройки управления моделями и аудит промптов
Claude Code v2.1.283 вводит новые параметры конфигурации для LLM-шлюзов и контроля доступа к моделям, а также инструмент для аудита паттернов использования промптов в файлах CLAUDE.md.
SkillGym интернализует человеческие навыки в LLM для решения реальных задач
Исследователи представляют SkillGym — фреймворк, который преобразует написанные человеком навыки агентов в исполняемые, верифицируемые обучающие среды для агентов на основе больших языковых моделей. Система использует конвейер «навык-задача» для создания конкретных задач и проверки результатов с помощью кодовых чекеров.