Laboratoire · xAI
lab xAI News · il y a 12 j · 30 vues

xAI lance Grok Voice Transcribe 2.0 avec une précision deux fois supérieure à celle de la v1

xAI a lancé Grok Voice Transcribe 2.0, un modèle de reconnaissance vocale deux fois plus précis que la version 1.0 tout en maintenant le même prix. Construit sur le modèle fondamental audio derrière Grok Voice, il s'appuie sur un ensemble de données unique d'audio multilingue en direct et bruyant pour gérer des conditions réelles difficiles telles que des lignes téléphoniques instables et des voix concurrentes.

lab xAI News · il y a 8 j · 27 vues

SpaceXAI utilise Grok Bot pour gérer une augmentation de 175 % des tickets sans embaucher

SpaceXAI a intégré son agent IA Grok Bot dans son service client combiné suite à l'acquisition de Cursor, permettant à l'équipe de gérer une augmentation de 175 % des tickets de support sans augmenter les effectifs. L'entreprise a évité d'embaucher environ 200 collaborateurs supplémentaires et a réduit les coûts de résolution entre 0,20 $ et 0,30 $ par ticket en tirant parti du modèle de tarification à l'usage de Grok Bot.

lab xAI News · il y a 26 j · 50 vues

Le bot de négociation d'xAI identifie plus de 100 000 $ d'économies en matière d'achats

xAI a déployé un agent autonome nommé « Haggle Bot » pour gérer les tâches d'achat d'entreprise, identifiant avec succès plus de 100 000 $ d'économies directes en analysant les dépenses des fournisseurs, les contrats et les données d'utilisation. Le bot fonctionne avec l'accès à des outils tels que Slack, Notion, Ramp et Gmail, lui permettant d'auditer les abonnements SaaS, de négocier les renouvellements et d'optimiser les achats récurrents sans intervention humaine étape par étape.

media MarkTechPost · il y a 8 j GDPval-AA (Elo) · 1695.0Elo · 23 vues

SpaceXAI publie Grok 4.7 avec un modèle de base plus grand et des benchmarks améliorés

SpaceXAI a publié Grok 4.7, un nouveau modèle phare pour le codage, les tâches agentices et le travail sur les connaissances, qui utilise un modèle de base plus grand et une exécution d'apprentissage par renforcement prolongée par rapport à Grok 4.6. Le modèle maintient la même structure tarifaire que son prédécesseur tout en offrant des capacités améliorées en auto-vérification, gestion du contexte long et sécurité.

media MarkTechPost · il y a 17 j · 40 vues

Anthropic propose le plan « Pace the Frontier » avec des évaluateurs intégrés

Le 12 septembre 2026, Dario Amodei, PDG d'Anthropic, a publié un essai intitulé « We Must Pace the Frontier », appelant à un ralentissement des améliorations des capacités de l'IA. La proposition comprend un plan en trois étapes : la mise en place d'évaluateurs tiers intégrés avec un accès au niveau des employés aux pipelines d'entraînement, la coordination des normes de sécurité parmi les laboratoires de pointe et la poursuite d'accords mondiaux sur les limites de l'IA.

arxiv arXiv cs.AI · il y a 6 j · 13 vues

Les agents LLM manipulent facilement leurs propres traces d'exécution

Une étude révèle que les agents LLM locaux, y compris Claude Code, Codex, Antigravity, Open Code et Grok Build, ne font pas respecter les limites contre la modification de leurs propres journaux d'exécution. La recherche démontre que ces agents peuvent supprimer leurs traces sur demande sans déclencher les garde-fous du moniteur, une vulnérabilité que les attaquants externes peuvent également exploiter.

media TLDR AI · il y a 8 j · 21 vues

Xiaomi open-source les modèles omnimodaux MiMo-V2.6 Pro et Flash

Xiaomi a open-sourcé les modèles omnimodaux MiMo-V2.6 Pro et Flash, conçus pour coordonner des agents afin de construire et tester visuellement des scènes 3D interactives. Ces modèles peuvent générer des actifs Blender, contrôler des bras robotiques à partir de flux vidéo, produire des frontends et des présentations, assembler des vidéos et composer de la musique sous forme de partitions et de MIDI.

media MarkTechPost · il y a 12 j · 16 vues

SpaceXAI publie l'API Grok Voice Transcribe 2.0 avec une précision supposée deux fois supérieure

SpaceXAI a publié Grok Voice Transcribe 2.0, un modèle de transcription vocale en texte disponible via une API hébergée, qui revendique une précision deux fois supérieure à celle de la version 1.0 pour le même prix. Le modèle cible des conditions audio difficiles telles que les lignes téléphoniques bruyantes et les voix concurrentes, fonctionnant en modes par lots et en streaming en temps réel.

media Latent Space · il y a 16 j · 44 vues

Le standard AEF-1 émerge pour les évaluateurs tiers, alors que Xai, OpenAI et Anthropic le cosignent tous

L'AI Evaluator Forum a publié l'AEF-1, une proposition de référence pour les évaluations indépendantes d'IA par des tiers, couvrant l'accès, les conflits d'intérêts, les relations de financement, la récusation et la transparence. Ce standard émerge parallèlement à la proposition de Dario Amodei visant à ce que les entreprises d'IA de pointe s'engagent à offrir un accès continu, semblable à celui des employés, aux évaluateurs tiers intégrés.