Anthropic обновил биологические механизмы защиты Claude Fable 5, чтобы существенно снизить ложные срабатывания, что привело к примерно 85% снижению количества биологических отказов во всех продуктах компании. Это изменение позволяет модели помогать в более широком спектре повседневных медицинских и образовательных запросов, при этом продолжая блокировать исследования двойного назначения.
- Обновление переписывает конституцию классификатора безопасности для лучшего различения безвредного использования и вредоносного контента двойного назначения, такого как вирусология или токсикология.
- Количество отказов снизилось примерно на 67% в Claude.ai, на 55% в Cowork, на 17% в Claude Code и на 7% в Claude Platform.
- Медицинские специалисты получат больше поддержки в клинических задачах, хотя профессиональные биологические исследования и разработка лекарств останутся заблокированными.
Компания стремится сбалансировать катастрофические риски разработки биологического оружия с необходимостью предоставления передовых возможностей ИИ легитимным исследователям через доверенные каналы доступа.