O sistema Qxern-v6 permite que dois LLMs se comuniquem por meio de 32 tokens latentes comprimidos, preservando a exatidão dos símbolos por meio de um sidecar de Árvore Sintática Abstrata (AST) determinístico adaptativo. Criado por um desenvolvedor de 15 anos, a arquitetura usa Qwen2.5-Coder-1.5B para comprimir o código e um decodificador congelado Qwen3.5-0.8B para interpretá-lo sem ver o texto bruto.

  • A precisão do nome da função atinge 0,87, recuperando-se de 0,00 em modelos latentes puros.
  • A precisão da contagem de parâmetros atinge 0,93, superando a linha de base Text Relay em +0,30.
  • A latência mediana cai para 511 ms, alcançando uma aceleração de 2,4× em relação aos 1222 ms do relay de texto.
  • O sistema combina latentes semânticos com ~30 tokens de dados AST determinísticos por meio de um roteador adaptativo.

Esta abordagem híbrida demonstra que latentes contínuos podem transportar eficientemente a semântica do código em menor latência, enquanto o sidecar restaura a precisão simbólica necessária sem retreinar o decodificador.