A Quesma lançou uma lista aberta e curada contendo 218 entradas que rastreiam onde os tokens são gastos em fluxos de trabalho de LLM e agentes. O recurso cobre monitoramento, cache semântico, modelos locais baratos, engenharia de contexto e governança de custos.

Cada entrada inclui uma citação e data, excluindo deliberadamente afirmações que carecem de números ou métodos de apoio. O objetivo é distinguir entre tokens desperdiçados e aqueles bem gastos.

Os mantenedores convidam correções por imprecisões e acolhem sugestões para novas entradas, que passam pelo mesmo processo de revisão do conteúdo existente.