Quesma выпустила открытый курируемый список, содержащий 218 записей, которые отслеживают, где расходуются токены в рабочих процессах LLM и агентов. Ресурс охватывает мониторинг, семантическое кэширование, дешевые локальные модели, контекстную инженерию и управление затратами.
Каждая запись включает цитирование и дату, при этом список намеренно исключает утверждения без подтверждающих чисел или методов. Он призван различать токены, которые тратятся впустую, и те, что используются эффективно.
Содержатели приглашают исправления неточностей и приветствуют предложения по новым записям, которые проходят тот же процесс проверки, что и существующий контент.