El sistema Qxern-v6 permite que dos LLM se comuniquen mediante 32 tokens latentes comprimidos mientras preserva la exactitud de los símbolos a través de un sidecar de Abstract Syntax Tree (AST) determinista adaptativo. Desarrollado por un desarrollador de 15 años, la arquitectura utiliza Qwen2.5-Coder-1.5B para comprimir el código y un decodificador congelado Qwen3.5-0.8B para interpretarlo sin ver texto en bruto.
- La precisión del nombre de función alcanza 0.87, recuperándose de 0.00 en modelos puramente latentes.
- La precisión del recuento de parámetros llega a 0.93, superando la línea base Text Relay en +0.30.
- La latencia mediana se reduce a 511 ms, logrando una aceleración de 2.4× frente a los 1222 ms del relay de texto.
- El sistema combina latentes semánticos con ~30 tokens de datos AST deterministas mediante un enrutador adaptativo.
Este enfoque híbrido demuestra que los latentes continuos pueden transportar eficientemente la semántica del código a menor latencia mientras el sidecar restaura la precisión simbólica necesaria sin reentrenar el decodificador.