GPT-5.6に対して2つの特定のAPI設定を有効にしたところ、ARC-AGI-3ベンチマークでのパフォーマンススコアが3倍になりました。
推論能力を保持し、圧縮を有効にすることで改善が実現され、効率性も向上しました。
GPT-5.6に対して2つの特定のAPI設定を有効にしたところ、ARC-AGI-3ベンチマークでのパフォーマンススコアが3倍になりました。
推論能力を保持し、圧縮を有効にすることで改善が実現され、効率性も向上しました。
GPT-5.1から4週間後、OpenAIはプロフェッショナルな知識作業用に設計された新しいモデルシリーズであるGPT-5.2をリリースしました。これは、いくつかの主要なベンチマークにおいてGoogleのGemini 3 Proと同等かそれ以上の性能を発揮します。
OpenAIはGPT-4.5をリサーチプレビューとしてリリースし、同社迄今为止の最大かつ最良のチャットモデルであると説明している。このモデルはまずChatGPT Proユーザーと開発者に提供され、来週以降PlusおよびTeamユーザーへのアクセスが拡大する。
OpenAIは、最も先進的なAIモデルへの無料アクセスを10万人の学術研究者に提供しています。このイニシアチブは、学術コミュニティ内の科学研究、協力、発見を加速させることを目的としています。
DeepSWEベンチマークにおけるKimi K3とGPT-5.6 Solの比較により、GPT-5.6 Solが一発での品質(72.7%対68.5%)でリードしているものの、Kimi K3はk > 1に対してpass@kスコアをより高いコスト効率で達成することが明らかになった。
ChatGPTは、米国の対象ユーザーが医療記録とApple Healthデータを安全に接続できる新しいHealth機能を導入しました。
アクセス解析とサイト改善のために Cookie を使用します。分析 Cookie を許可または拒否できます。 プライバシーポリシー