El equipo de AWS Strands Agents ha lanzado Strands Harness, un harness de agentes de propósito general y código abierto disponible bajo la licencia Apache 2.0 para Python y TypeScript. La herramienta está diseñada para cerrar la brecha entre el prototipado de agentes en entornos como Claude Code o Codex y su implementación con bucles personalizados.

  • El harness reporta un costo por token un 28% menor en comparación con los harnesses rivales en seis benchmarks, incluyendo ALFWorld, GAIA y Terminal-Bench 2.1, mientras mantiene una precisión comparable.
  • Cuenta con reglas de gestión de contexto integradas que truncen los resultados de las herramientas cuando superen los 1.500 tokens, activan la resumización al alcanzar el 85% del uso del contexto y manejan la recuperación dentro del bucle.
  • Los benchmarks utilizando Claude Fable 5 en Terminal-Bench 2.1 mostraron que Strands Harness costó $56.29 con una precisión del 69,7%, significativamente más barato que Claude Code ($248.05, 61,8% de precisión) mientras lo superaba en puntuación.
  • El sistema admite la ejecución en modelos de razonamiento actuales a través de Amazon Bedrock, Anthropic, OpenAI, Google, Ollama o LiteLLM, e incluye herramientas de shell, archivos y web de serie.

El lanzamiento tiene como objetivo proporcionar a los desarrolladores un marco de agentes de propósito general desplegable que reduce los costos operativos mediante una gestión eficiente del contexto sin sacrificar el rendimiento.