ソース · Together AI Blog
media Together AI Blog · 13日前 · 9 回表示

Moonshotが2.8兆パラメータの最大規模オープンウェイトモデル「Kimi K3」をリリース

Moonshot AIは、長期コーディングと深い推論のために設計された2.8兆パラメータのオープンウェイトモデル「Kimi K3」をリリースしました。これは3兆パラメータクラス初のオープンソースモデルであり、100万トークンのコンテキストウィンドウをサポートします。

media Together AI Blog · 16日前 · 9 回表示

Together AI、Moonshot AIと提携しKimiモデルを提供

Together AIは、MoonshotのオープンウェイトモデルのローンチプラットフォームとなるためのMoonshot AIとの戦略的パートナーシップを発表しました。最初のモデルとしてKimi K3が提供されます。この協力により、開発者はTogether AIの米国ホストインフラとツールを通じて、最先端リリースへのゼロデイアクセスを得ることができます。

media Together AI Blog · 21日前 · 8 回表示

Kimi K3はDeepSWEの品質においてClaude Fable 5と同等で、コストは3分の1

Moonshot AIが公開するオープンウェイトモデルであるKimi K3は、DeepSWEベンチマークにおいてAnthropicのClaude Fable 5と同等のパフォーマンスを発揮し、タスクあたりのコストを大幅に抑えています。2026年7月16日の評価では、Kimi K3はpass@1で68.5%を達成し、Fable 5の69.9%には及びませんでしたが、複数回の試行シナリオではこれを上回り、コスト効率においても優れていました。

media Together AI Blog · 16日前 · 2 回表示

ThunderAgentがプログラムレベルのスケジューリングによりエージェント推論を2倍高速化

ThunderAgentは、高同時実行の合成データ生成におけるKVキャッシュのスラッシングに対処するため、エージェントLLMリクエストのスケジューリングにプログラム抽象化を導入するシステムです。エージェントワークフローを独立したリクエストではなくスケジューリング可能なプログラムとして扱うことで、スループットを大幅に向上させ、レイテンシを削減します。

media Together AI Blog · 17日前

Together AI が専用モデル推論向けの容量認識ルーティングを解説

Together AI は、エンドポイント、デプロイメント、不変設定を容量認識のトラフィック分割で結びつける Dedicated Model Inference プラットフォームのアーキテクチャについて詳述している。このシステムは、固定パーセンテージではなく有効容量(重み×準備完了レプリカ数)に基づいてリクエストをルーティングし、ゼロダウンタイムでのロールアウトや A/B テストなどの機能を実現する。

media Together AI Blog · 22日前

Togetherがカスタムトレーニングベータ版付きの専用モデル推論をリリース

Togetherは、その推論プラットフォームに重要なアップデートを導入し、オープンウェイトモデルのパフォーマンス、コスト、品質に対する完全な制御をユーザーに提供するために設計された「Dedicated Model Inference」を発表しました。このアップデートでは、フルウェイトとLoRAの強化学習を含むカスタムトレーニング機能のクローズドベータ版も発表されています。

media Together AI Blog · 25日前 · 2 回表示

Together AIとY CombinatorがYCスタートアップ向け専用GPUクラスターを立ち上げ

Together AIとY Combinatorは、Y CombinatorのポートフォリオにあるAIネイティブなスタートアップ専用に設計された最初の専用GPUクラスターを提供するためのパートナーシップを発表した。この取り組みは、長期契約を必要とせずに柔軟で費用対効果の高いインフラストラクチャを提供することで、計算リソースへのアクセスという重要なボトルネックを解決することを目指している。