Tim AWS Strands Agents telah merilis Strands Harness, sebuah harness agen tujuan umum open-source yang tersedia di bawah lisensi Apache 2.0 untuk Python dan TypeScript. Alat ini dirancang untuk menjembatani kesenjangan antara pembuatan prototipe agen di lingkungan seperti Claude Code atau Codex dan penyiapannya dengan loop kustom.

  • Harness melaporkan biaya token 28% lebih rendah dibandingkan harness saingan di enam benchmark, termasuk ALFWorld, GAIA, dan Terminal-Bench 2.1, sambil mempertahankan akurasi yang sebanding.
  • Ia memiliki aturan manajemen konteks bawaan yang memotong hasil alat jika melebihi 1.500 token, memicu peringkasan pada penggunaan konteks 85%, dan menangani pemulihan di dalam loop.
  • Benchmark menggunakan Claude Fable 5 pada Terminal-Bench 2.1 menunjukkan Strands Harness menelan biaya $56,29 dengan akurasi 69,7, jauh lebih murah daripada Claude Code ($248,05, akurasi 61,8) sambil mengunggulinya dalam skor.
  • Sistem ini mendukung berjalan pada model penalaran terkini melalui Amazon Bedrock, Anthropic, OpenAI, Google, Ollama, atau LiteLLM, dan menyertakan alat shell, file, dan web secara bawaan.

Rilis ini bertujuan memberikan kepada pengembang kerangka kerja agen tujuan umum yang dapat diimplementasikan, yang mengurangi biaya operasional melalui penanganan konteks yang efisien tanpa mengorbankan kinerja.