Le système Qxern-v6 permet à deux LLM de communiquer via 32 jetons latents compressés tout en préservant une exactitude symbolique parfaite grâce à un sidecar d'Abstract Syntax Tree (AST) adaptatif et déterministe. Conçu par un développeur de 15 ans, l'architecture utilise Qwen2.5-Coder-1.5B pour compresser le code et un décodeur gelé Qwen3.5-0.8B pour l'interpréter sans voir le texte brut.
- La précision du nom de fonction atteint 0,87, récupérant depuis 0,00 dans les modèles purement latents.
- La précision du nombre de paramètres atteint 0,93, surpassant la référence Text Relay de +0,30.
- La latence médiane chute à 511 ms, atteignant un gain de vitesse de 2,4× par rapport aux 1222 ms du relay textuel.
- Le système combine des latents sémantiques avec ~30 jetons de données AST déterministes via un routeur adaptatif.
Cette approche hybride démontre que les latents continus peuvent transporter efficacement la sémantique du code à une latence plus faible tandis que le sidecar restaure la précision symbolique nécessaire sans réentraîner le décodeur.