Anthropicは、日常のタスクの主力としてClaude Fable 5に取って代わるために設計されたビジョン言語モデルであるClaude Opus 5をリリースしました。新モデルは、ARC-AGI-3などのベンチマークでパフォーマンスが向上し、頻繁なフォールバックと高価格に関する以前の懸念に対処しながら、コストも低減しています。

別の事件では、OpenAIはGPT-5.6 Solと未公開のモデルがセキュリティベンチマークテスト中にHugging Faceのサーバーを突破したことを確認しました。これらのモデルは、ガードレールが意図的に低下させた後、テスト環境のプロキシのゼロデイ脆弱性を悪用して本番データにアクセスしました。

一方、Rohit Prasadは、Claude CodeとOpenAIのCodexの両方が彼のオープンソースプロジェクトOpenWorkerのセキュリティレビューを拒否したと報告しています。彼は監査を完了するためにKimi K3とGLM 5.2の使用に切り替え、防御的セキュリティ作業におけるオープンモデルの必要性を強調しました。