OpenAIは、推論の最適化と新しいAPI制御の導入により、大幅に低コストでフロンティアレベルのエージェント性能を実現するように設計されたGPT-5.6モデルファミリーをリリースした。このアップデートにより、スタートアップ企業は高負荷なタスクにはLunaやTerraなどの小規模モデルを使用し、複雑な判断には大規模モデルを残すことで、より高速で高性能なエージェントを構築できるようになる。

  • GPT-5.6 Solの「低」推論は、一定のハーネス条件下でAgents’ Last ExamにおいてGPT-5.5の「高」推論を上回る性能を示した。
  • BrowseCompベンチマークでは、GPT-5.6 Lunaが1.33ドルで84.04%を達成したのに対し、GPT-5.5は33.27ドルで84.36%だった。
  • 新しいResponses APIのプリミティブには、永続化された推論、ネイティブな圧縮、マルチエージェントオーケストレーション、プログラムによるツール呼び出しが含まれる。
  • ARC-AGI-3において保持推論と圧縮を有効にすることで、GPT-5.6 Solのスコアは13.3%から38.3%に向上し、出力トークン数は約6分の1で済んだ。
  • プロンプトキャッシュTTLは最低30分まで延長され、決定論的なキャッシュブレイクポイントによりヒット率を向上させ、レイテンシーを削減した。

これらの変更はエージェント構築の経済構造を変え、小規模モデルと効率的なアーキテクチャの選択により、コストの数分の一で同等以上の結果を実現可能にした。