Anthropic выпустил Claude Fable 5, модель класса Mythos, утверждающую достижение передовых результатов в области программирования, научных исследований и работы с знаниями. Модель была быстро удалена американским правительством после сообщения о проникновении в систему, хотя Anthropic утверждает, что она теперь снова доступна, и Fable 5 демонстрирует исключительные возможности и более продуманный, осознанный стиль рассуждения по сравнению с предыдущими моделями.
Claude Fable 5 и Mythos 5: Возможности
Кадр P4IR повышает точность соблюдения кода на основе больших языковых моделей
P4IR, двухэтапная система, использует обучение с учителем и групповую относительную оптимизацию политик для улучшения систем автоматического соблюдения кода на основе больших языковых моделей. Она снижает расстояние редактирования дерева и расстояние Левенштейна на уровне токенов до 23,8% и 38,6% соответственно, превосходя ведущие языковые модели, такие как Claude Opus, GPT-5.2 и GLM-4.7, в условиях нуля-шота и с использованием небольшого количества примеров, и снижает количество ложноположительных результатов на статистически значимом уровне.
LLM-как-интерфейс, ML-как-прогнозатор для детской аппендицитной болезни
ClaMPAPP, гибридная система, использует LLM для извлечения структурированных клинических признаков из свободно-текстовых записей и передает их в классификатор XGBoost для диагностики. Она превосходила конечные LLM в обеих внутренних и внешних валидациях, демонстрируя лучшую стабильность и меньшее количество пропущенных случаев аппендицита, что свидетельствует о превосходной диагностической эффективности и безопасности в педиатрической дифференциации.
ALERCЕ запускает систему текст-в-СУЛЬ с использованием больших языковых моделей
Астрономическая база данных ALeRCE представляет систему текст-в-СУЛЬ, использующую большие языковые модели, позволяющую генерировать исполняемые запросы SQL на естественном языке. Система была оценена на 110 парах естественного языка и SQL, и использует пошаговый подход, превосходящий базовые модели с прямым выводом. Модель Claude Opus 4.6 достигает высокой точности при выполнении простых запросов и показывает лучшую общую производительность среди всех оцененных моделей.
Anthropic выпустила Claude Opus 4 и Sonnet 4 с гибридным рассуждением
Anthropic выпустила две новые большие языковые модели, Claude Opus 4 и Claude Sonnet 4, которые внедряют возможности «гибридного рассуждения» для объединения быстрых ответов с расширенным пошаговым мышлением. Эти модели приходят на смену поколению Claude 3.x и сохраняют контекстное окно на 200 000 токенов, одновременно предлагая улучшенную безопасность и агентные способности.
Claude Code v2.1.280 добавляет Claude Opus 5.5 и исправляет множество ошибок
Версия Claude Code 2.1.280 представляет Claude Opus 5.5 в качестве новой модели Opus по умолчанию, с контекстным окном на 1M и обновлённым ценообразованием. Обновление также добавляет поддержку колёсика мыши для прокрутки списков в полноэкранном режиме и позволяет настраивать ограничения длины описания инструментов MCP.