Quesma a publié une liste ouverte et curatée contenant 218 entrées qui suivent où les tokens sont dépensés dans les flux de travail LLM et agents. La ressource couvre la surveillance, le cache sémantique, les modèles locaux bon marché, l'ingénierie du contexte et la gouvernance des coûts.
Chaque entrée inclut une citation et une date, excluant délibérément les affirmations dépourvues de chiffres ou de méthodes de soutien. Elle vise à distinguer les tokens gaspillés de ceux bien dépensés.
Les mainteneurs invitent aux corrections d'inexactitudes et accueillent les suggestions pour de nouvelles entrées, qui subissent le même processus de révision que le contenu existant.