Top 20 de la semaine
lab OpenAI News · il y a 1 j BrowseComp · 84.36% · 8 vues

OpenAI lance GPT-5.6 pour des flux de travail agents abordables et haute performance

OpenAI a lancé la famille de modèles GPT-5.6, conçue pour offrir des performances d'agent de pointe à des coûts nettement inférieurs en optimisant l'effort de raisonnement et en introduisant de nouveaux contrôles API. Cette mise à jour permet aux startups de construire des agents plus rapides et plus capables en utilisant des modèles plus petits comme Luna et Terra pour les tâches à fort volume, tout en réservant les modèles plus grands pour le jugement complexe.

lab Google DeepMind Blog · il y a 2 j · 13 vues

Google DeepMind publie le modèle SL2T de traduction de langue des signes en texte pour Gboard et Live Transcribe

Google DeepMind et Android ont présenté SL2T, un modèle de traduction de langue des signes en texte (SL2T) massivement multilingue qui apporte l'IA de la langue des signes aux produits grand public pour la première fois. La technologie alimente la dictée de signes en texte dans Gboard et Live Transcribe sur Pixel 11, en commençant par la langue des signes américaine (ASL) vers l'anglais.

lab Google — The Keyword (AI) · il y a 3 j · 40 vues

Google démontre des capacités de consultation vidéo clinique en temps réel avec AMIE

Google Research et Google DeepMind ont fait progresser leur système de recherche en IA médicale, AMIE, pour démontrer des capacités de consultation vidéo clinique en temps réel dans une étude inédite. Construit sur Gemini et Project Astra à l'aide d'une architecture multi-agents, le système interprète les indices visuels et auditifs, guide les examens physiques virtuels et raisonne diagnostiquement en temps réel.

lab xAI News · il y a 3 j · 42 vues

xAI lance Grok Bot, des agents IA toujours actifs pour desktop et iOS

xAI a lancé Grok Bot en bêta, introduisant un système d'agents IA toujours actifs qui opèrent sur leur propre ordinateur cloud pour gérer les tâches de bout en bout. Disponible aujourd'hui pour les abonnés SuperGrok Heavy, Cursor Ultra et Cursor Teams Premium sur desktop et iOS, les bots fonctionnent entre applications et outils sans nécessiter de configuration manuelle des flux de travail.

lab Anthropic News · il y a 3 h · 2 vues

Claude implémente le filigrane SynthID-Text pour la conformité au règlement européen sur l'IA

Anthropic mettra en œuvre un filigrane textuel dans les futures versions de Claude pour se conformer au règlement européen sur l'IA et à son code de pratique relatif à la transparence du contenu généré par l'IA. L'entreprise utilise la méthode SynthID-Text publiée par Google DeepMind, qui intègre un motif détectable dans le texte généré sans affecter la qualité de sortie ni ajouter de tokens supplémentaires.

lab NVIDIA Research · il y a 4 h · 1 vue

HorizonRelight utilise l'auto-conditionnement masqué pour un relighting vidéo cohérent sur le long terme

Les chercheurs abordent les discontinuités temporelles dans le relighting vidéo de longue durée en reformulant la tâche comme une traduction de domaine latent conditionnée temporellement. Le cadre impose une continuité inter-blocs en propageant les latents du domaine cible à travers les frontières et utilise l'auto-conditionnement masqué du domaine cible pour rendre ce comportement apprenable.

lab NVIDIA Research · il y a 4 h · 2 vues

Nvidia présente FusionRelight pour le re-éclairage de portraits en temps réel via une fusion hybride de connaissances de domaine

Des chercheurs de Nvidia ont présenté FusionRelight, une méthode de re-éclairage de portraits qui combine un transfert d'illumination physiquement plausible avec la préservation de l'identité et une inférence compacte en temps réel. L'approche utilise la Fusion Hybride de Connaissances de Domaine (HDKF), un cadre d'entraînement qui distille les a priori de physique, de réflectance et de réalisme à partir de données synthétiques, One-Light-at-a-Time (OLAT) et in-the-wild dans un modèle étudiant.

lab OpenAI News · il y a 2 j · 15 vues

OpenAI signale un écart croissant alors que l'IA d'entreprise passe de l'assistance à l'exécution

De nouvelles études d'OpenAI révèlent que les entreprises de pointe — celles dans le top 10 % de l'utilisation mensuelle de l'IA — génèrent 8,3 fois plus de tokens de sortie par utilisateur actif que les entreprises typiques, contre 2,6 fois en janvier. Cet écart croissant reflète un changement dans l'adoption de l'IA d'entreprise : on passe de l'utilisation de l'IA pour l'assistance à la délégation de travaux substantiels aux outils agents tels que Codex et ChatGPT Work.

lab NVIDIA Research · il y a 3 j · 38 vues

Les LLM égalent ou surpassent l'optimisation bayésienne pour l'optimisation des hyperparamètres

Un nouvel article explore l'utilisation de grands modèles linguistiques fondamentaux (LLM) pour automatiser l'optimisation des hyperparamètres (HPO), un processus qui repose généralement sur des approches manuelles dans des configurations à budget limité. Les auteurs ont développé une méthodologie où les LLM suggèrent des configurations d'hyperparamètres basées sur les descriptions du jeu de données et du modèle, qui sont ensuite affinées itérativement en fonction des performances du modèle.

lab NVIDIA Research · il y a 3 j · 40 vues

Source introduit la différenciation déroulée approximative pour l'attribution des données d'entraînement

Les chercheurs présentent Source, une nouvelle méthode d'attribution des données d'entraînement (TDA) qui combine l'efficacité computationnelle des fonctions d'influence avec la précision des approches basées sur le déroulement. En utilisant une formule similaire à la fonction d'influence pour approximer la différenciation déroulée, Source adresse les limitations des méthodes de différenciation implicite, telles que leur incapacité à prendre en compte le biais d'optimisation ou les pipelines multi-étapes.