Система Qxern-v6 позволяет двум LLM общаться через 32 сжатых латентных токена, сохраняя точность символов благодаря адаптивному детерминированному AST-сайдкару. Архитектура, созданная 15-летним разработчиком, использует Qwen2.5-Coder-1.5B для сжатия кода и замороженный декодер Qwen3.5-0.8B для его интерпретации без доступа к исходному тексту.

  • Точность имен функций достигает 0.87, восстанавливаясь с 0.00 в чистых латентных моделях.
  • Точность подсчета параметров достигает 0.93, превосходя базовый уровень Text Relay на +0.30.
  • Медианная задержка снижается до 511 мс, обеспечивая ускорение в 2.4 раза по сравнению с текстовым ретранслятором (1222 мс).
  • Система объединяет семантические латенты с ~30 токенами детерминированных AST-данных через адаптивный маршрутизатор.

Этот гибридный подход демонстрирует, что непрерывные латенты могут эффективно передавать семантику кода при меньшей задержке, в то время как сайдкар восстанавливает необходимую символьную точность без переобучения декодера.