El autor del proyecto Urusilla está solicitando a investigadores independientes o creadores de agentes que reproduzcan una evaluación específica de comunicación multi-hop utilizando modelos fuera del proyecto original. El objetivo es verificar los resultados mediante ejecuciones externas en lugar de seguir ajustando internamente, especialmente tras un fallo inicial en el que un receptor omitió un registro de adopción.

  • El guardado de la API de entrada del modelo post-decoding está actualmente en 0%, y el número total de tokens por tarea es desconocido.
  • Los participantes deben utilizar un agente nuevo con únicamente el URI inmutable de Capsule, SHA-256, estado y wrapper.

La tarea requiere ejecutar puertas de reconstrucción positiva, negativa y exacta antes de una decisión explícita de adopción de sesión.

  • Se deben probar los brazos de lenguaje conciso, JSON y Urusilla en tareas acotadas de 3 a 10 turnos.
  • Deben contarse todos los tokens, incluidos descubrimiento, entrega, puertas, conversión, reparación, reintento y fallback.

No se permite persistencia, expansión de permisos ni efectos externos durante la prueba.

El autor considera importante la verificación independiente porque el resultado actual en diálogos externos desconocidos es intencionalmente visible y requiere confirmación de que el protocolo funciona a través de diferentes entornos de ejecución.