Source · Together AI Blog
media Together AI Blog · il y a 21 j · 8 vues

Kimi K3 égale Claude Fable 5 sur la qualité DeepSWE pour un tiers du coût

Kimi K3, un modèle à poids ouverts de Moonshot AI, atteint des performances comparables à celles de Claude Fable 5 d'Anthropic sur le benchmark DeepSWE tout en coûtant nettement moins par tâche. Lors d'une évaluation du 16 juillet 2026, Kimi K3 a obtenu un taux de réussite pass@1 de 68,5 % contre 69,9 % pour Fable 5, mais l'a surpassé dans les scénarios à multiples tentatives et a offert une efficacité coûts supérieure.

media Together AI Blog · il y a 16 j · 2 vues

ThunderAgent atteint une inférence agnostique 2 fois plus rapide grâce à l'ordonnancement au niveau du programme

ThunderAgent est un système qui introduit une abstraction de programme pour l'ordonnancement des requêtes LLM agnostiques afin de résoudre le thrashing du cache KV dans la génération de données synthétiques à haute concurrence. En traitant les workflows d'agent comme des programmes ordonnançables plutôt que comme des requêtes indépendantes, il améliore considérablement le débit et réduit la latence.

media Together AI Blog · il y a 17 j

Together AI explique le routage conscient de la capacité pour l'inférence de modèles dédiés

Together AI détaille l'architecture de sa plateforme d'Inférence de Modèles Dédiés, qui relie les points de terminaison, les déploiements et les configurations immuables via un partage de trafic conscient de la capacité. Ce système achemine les requêtes en fonction de la capacité effective (poids multiplié par le nombre de réplicas prêts) plutôt que sur des pourcentages fixes, permettant des fonctionnalités telles que les déploiements sans interruption et les tests A/B.

media Together AI Blog · il y a 22 j

Together lance l'inférence de modèles dédiée avec un bêta d'entraînement personnalisé

Together a publié une mise à jour majeure de sa plateforme d'inférence, introduisant « Dedicated Model Inference » conçu pour offrir aux utilisateurs un contrôle total sur les performances, les coûts et la qualité des modèles à poids ouverts. La mise à jour annonce également un bêta fermé pour les capacités d'entraînement personnalisé, incluant le renforcement par apprentissage avec des poids complets et LoRA.

media Together AI Blog · il y a 25 j · 2 vues

Together AI et Y Combinator lancent un cluster GPU dédié aux startups de YC

Together AI et Y Combinator ont annoncé un partenariat pour fournir le premier cluster GPU dédié exclusivement au portefeuille de startups axées sur l'IA de Y Combinator. Cette initiative vise à résoudre le goulot d'étranglement critique de l'accès au calcul en offrant une infrastructure flexible et rentable pour l'entraînement et l'inférence, sans engagement à long terme.