Sujet · Retrieval & RAG
lab OpenAI News · il y a 20 j · 35 vues

OpenAI présente ChatGPT pour les services financiers avec des données intégrées et GPT-6 Astra

OpenAI a lancé ChatGPT pour les services financiers, une expérience sur mesure combinant le raisonnement de GPT-6 Astra à des données financières premium intégrées pour aider les équipes dans la recherche, la modélisation et la création de documents clients. Le produit a été développé en partenariat avec Morgan Stanley et Evercore afin de répondre aux principaux défis du secteur bancaire d'investissement et de la recherche en actions.

lab Google — The Keyword (AI) · il y a 13 j · 27 vues

L'ONU lance le System Data Commons pour unifier les statistiques mondiales

Le système de l'ONU lance le UN System Data Commons, une plateforme open-source construite sur Google's Data Commons qui unit les statistiques mondiales en une seule ressource interconnectée connue sous le nom de graphe de connaissances prêt pour l'IA. Soutenu par Google.org, le projet vise à rendre les données critiques universellement accessibles et à aider à suivre les progrès mondiaux en temps réel.

media MarkTechPost · il y a 7 h · 4 vues

Perplexity publie Photon, réduisant la latence p99 de récupération de 800 ms à 65 ms

Perplexity a publié Photon, un moteur de récupération et de classement basé sur Rust développé en interne qui gère désormais tout le trafic de production, remplaçant un composant open-source précédemment forké. Le nouveau système permet un mode « Recherche rapide » dans l'API Perplexity Search, offrant une latence nettement inférieure pour les workflows agents.

lab Hugging Face Blog · il y a 1 j · 1 vue

ProvenanceGuard ajoute une vérification consciente de la source aux agents MCP

ProvenanceGuard est une couche de vérification post-génération pour les agents du protocole Model Context Protocol (MCP) qui détecte la confusion inter-sources en s'assurant que les affirmations sont attribuées à la bonne source d'évidence. Le système analyse les traces MCP capturées sans réentraîner l'agent, décompose les réponses en affirmations et vérifie que la source de soutien correspond à celle nommée ou implicite dans la sortie.

arxiv arXiv cs.AI · il y a 1 j · 1 vue

RareDx utilise l'optimisation de politique ancrée sur un graphe pour améliorer le diagnostic des maladies rares

Les auteurs présentent RareDx, un système qui couple l'utilisation contrôlée des preuves avec une optimisation de politique ancrée sur un graphe de connaissances afin de résoudre le problème de raisonnement à longue traîne du diagnostic des maladies rares. Le pipeline d'entraînement combine le post-entraînement Top-10 avec RareDx-KGPO, qui projette les prédictions dans un graphe canonique de maladies et intègre la pertinence graduée curatée, la proximité ontologique, la similarité biomédicale et la cohérence phénotypique.

arxiv arXiv cs.AI · il y a 3 j · 15 vues

Highlight-Then-Summarize compresse les éléments de preuve pour améliorer la compréhension sur longs contextes

Les chercheurs proposent Highlight-Then-Summarize (H2S), un paradigme « compresser puis raisonner » qui identifie les éléments de preuve pertinents par rapport à la question et les intègre dans un résumé compact avant de générer une réponse. L'équipe construit H2S-Dataset avec 6 647 exemples et introduit H2S-RL pour fournir des récompenses au niveau du processus pour la sélection des preuves.

arxiv arXiv cs.CL · il y a 3 j · 6 vues

Highlight-Then-Summarize compresse les preuves pour une meilleure compréhension des contextes longs

Les chercheurs proposent Highlight-Then-Summarize (H2S), un paradigme de compression puis raisonnement qui identifie les preuves pertinentes à la question et les intègre dans un résumé compact avant de générer une réponse. Pour soutenir cette approche, l'équipe a construit H2S-Dataset avec 6 647 exemples provenant de 11 familles de benchmarks et a introduit H2S-RL pour des récompenses au niveau du processus.

arxiv arXiv cs.CL · il y a 3 j · 7 vues

KuaFu compresse le comportement utilisateur en compréhension à l'échelle du milliard

Tencent présente KuaFu, une couche unifiée de compression du comportement qui condense l'historique brut de l'utilisateur en représentations compactes pour les agents conversationnels et les recommandeurs. Le système utilise un projecteur à deux axes pour compresser chaque élément de comportement en 2-4 tokens de largeur 128-256, adressant les goulots d'étranglement dans le traitement des séquences longues pour un milliard d'utilisateurs.

media Hugging Face Forums · il y a 3 j · 5 vues

Les modèles JEPA biologiques utilisent des contraintes biologiques pour modéliser la progression des maladies

Un nouveau projet open-source appelé Biological JEJA combine l'apprentissage de représentations de style JEPA avec des contraintes biologiques pour modéliser comment les maladies progressent au fil du temps. L'approche a été testée sur des données réelles d'ADNI provenant de 2 347 patients et comparée à plusieurs autres modèles.

media Hugging Face Forums · il y a 11 j · 13 vues

Le routage sémantique réduit de 41 % les jetons d'entrée et la latence de 45 % lors d'un test de stress sur un contexte de 14K

Un test de stress GPU utilisant Qwen2.5-7B-Instruct gelé en 4 bits sur les questions de pont HotpotQA démontre que le routage sémantique conscient de la tâche améliore significativement l'efficacité et la précision dans des conditions à fort distracteur. L'étude a comparé un contexte complet limité à un sélecteur sémantique conscient de la requête conservant 60 % du budget, révélant des gains substantiels en vitesse et en précision.