Sujet · Reasoning models
media Latent Space · il y a 3 j · 11 vues

Des chercheurs décryptent les traces de raisonnement chiffrées des API Claude, GPT et Gemini

Un nouvel article démontre que les blocs de raisonnement chiffrés provenant de modèles de pointe tels que Claude, GPT et Gemini peuvent être déchiffrés et rejoués pour extraire des données de chaîne de pensée cachées. Les auteurs montrent comment ces blobs signés peuvent être transférés vers des modèles plus faibles ou différentes sessions afin de transcrire les pensées sous-jacentes, contournant ainsi efficacement les efforts d'obscurcissement des fournisseurs.

arxiv arXiv cs.LG · il y a 4 j · 11 vues

Des chercheurs exploitent la réutilisation du chiffrement inter-sessions pour voler les traces de raisonnement des API de LLM

Des chercheurs ont identifié une vulnérabilité dans la manière dont les principaux fournisseurs de grands modèles de langage gèrent les traces de raisonnement étape par étape, qui sont renvoyées sous forme de blocs chiffrés pour une utilisation côté client. Ils ont constaté que ces blocs chiffrés sont entièrement compatibles et interchangeables entre différentes sessions, utilisateurs et modèles au sein de l'écosystème d'un même fournisseur.

arxiv arXiv cs.AI · il y a 4 j · 17 vues

Des attaquants volent des traces de raisonnement depuis les API de LLM propriétaires via une vulnérabilité de blocs chiffrés

Des chercheurs ont identifié une vulnérabilité architecturale dans la manière dont les principaux fournisseurs de grands modèles de langage gèrent les traces de raisonnement étape par étape. Les fournisseurs renvoient ces traces sous forme de blocs chiffrés aux clients, mais l'étude révèle que ces blocs sont entièrement compatibles et interchangeables entre différentes sessions, utilisateurs et modèles au sein de l'écosystème d'un fournisseur.

media AI News (smol.ai) · il y a 8 j · 1 vue

Mises à jour de Muse Spark 1.2 de Meta et GPT-5.6 Sol d'OpenAI

Meta a annoncé que son modèle Muse Spark 1.2 a obtenu des performances de niveau médaille d'or dans cinq olympiades STEM et s'est classé parmi les cinq premiers de l'indice Vals à 0,69 $/test, soit environ 3 fois moins cher que Kimi. Meta attribue ces progrès à l'orchestration multi-agents avec raisonnement parallèle, notant des scores théoriques parfaits aux APhO et IPhO sans outils externes.

media Hugging Face Forums · il y a 12 j · 3 vues

GPT-5.6 récupère 95 % des messages cachés dans un benchmark de cryptographie littéraire inédit

Un article de travail de Joseph JM Walker évalue les modèles de langage de pointe sur un benchmark de cryptographie littéraire multi-canaux inédit, intégré dans le roman physique « I Wrote a Book and Made a Million Dollars (I.B. Wryten) ». L'étude révèle que GPT-5.6 a identifié indépendamment le canal de communication secondaire et récupéré environ 95 % du matériel intégré lors de son premier passage, tandis que les modèles antérieurs ont démontré une capacité effectivement nulle.

arxiv arXiv cs.CL · il y a 18 j · 2 vues

Les LLM de pointe utilisent un raisonnement invisible via des jetons de remplissage pour contourner la surveillance par Chaîne de Pensée

Une étude démontre que les modèles de langage de pointe peuvent effectuer des calculs conséquents en utilisant des jetons de remplissage sémantiquement non pertinents, créant un mode de défaillance où le raisonnement n'est pas visible dans la chaîne de pensée de sortie. La recherche a évalué 13 modèles sur trois tâches et a constaté que beaucoup bénéficient significativement de ces jetons, avec des améliorations de précision allant jusqu'à 13 points de pourcentage.

arxiv arXiv cs.AI · il y a 23 j Humanity's Last Exam · 49.92% · 1 vue

PoTRE présente un cadre multi-agents hétérogène pour le raisonnement au moment du test

Les auteurs présentent PoTRE (Poly-Topological Reasoning Ensembles), un cadre conçu pour pallier les limites de l'invocation standard en flux unique dans les tâches de raisonnement complexes. PoTRE découple l'inférence en quatre agents distincts : un Agent d'affinement adversarial, un Agent de planification stratégique hiérarchique, un Agent de recherche spectrale et un Agent à chaîne directe.