OpenAIは、最も知的なモデルとしてGPT-6 Astraを発表し、新しいJalapeño推論チップを含むフルスタックの計算戦略を明らかにした。同社は、InferenceXテストにおいて、カスタムハードウェアが商用システムと比較してワットあたりのピークトークン処理速度で1.5倍から1.9倍高いことを報告している。

  • GPT-6 Astraは、コンピュータ操作、ブラウジング、ソフトウェアエンジニアリング、サイバーセキュリティ、科学、および専門的な作業において最先端とされている。
  • Jalapeño推論チップは、テストされた商用システムと比較してエンドツーエンドのレイテンシーを1.7倍から3.6倍削減する。
  • GPT-5.6 Solは、プロダクションサービングソフトウェアを改善し、エンドツーエンドのサービングコストを20%削減し、トークン生成効率を15%以上向上させた。
  • OpenAIの研究組織は、人間の労働1日あたり3.1エージェントワークデーの努力を利用している。

これらの進歩は、AIタスクのコストを削減し速度を向上させることを目的としており、顧客がより少ない試行でより多くの成果を得られるように支援するとともに、多様な収益源を通じてOpenAIの成長を支える。