Запись архива

Дашборд ежедневного мониторинга цен API: разница между агентным и пакетным вызовом достигает 33x

Разработчик запустил автоматический сборщик цен OpenRouter (425 моделей, 58 провайдеров) и обнаружил, что стоимость одного вызова одной и той же модели может отличаться в 33 раза в зависимости от формы запроса — «агентной» или «пакетной».

График сравнения стоимости API-вызовов LLM в зависимости от формы запроса
График сравнения стоимости API-вызовов LLM в зависимости от формы запроса
File:Envisioning emerging technology for 2012 and beyond.png | by Michell Zappa | openverse | by-sa

На Hacker News опубликован пост, описывающий проект costpertoken.dev — автоматизированный сборщик цен на LLM API. Автор настроил ежедневный скрипт, который снимает полный каталог OpenRouter (425 моделей, 58 провайдеров) и вычисляет разницу с предыдущим днём. Данные собираются через локальный launchd-демон, независимо от каких-либо AI-моделей, чтобы исключить «тихую» остановку мониторинга.

Главное открытие: 33-кратный разрыв в стоимости
В ходе недельного сбора автор обнаружил закономерность: на одной и той же модели стоимость вызова может отличаться в 33 раза в зависимости от формы запроса. Для «агентного» вызова (большой контекст на входе, генерация кода на выходе) и «пакетного» вызова (массовая классификация) разница составила:

GPT-5.6 — 33.6x
Claude Sonnet 5 — 33.3x
Gemini 3.7 Flash — 33.3x

Цифры оказались почти идентичными для трёх независимых ценовых таблиц, что указывает на фундаментальное свойство формы вызова, а не на особенности конкретного вендора.

Как устроен сбор данных
Платформа представляет собой статический сайт на Cloudflare Worker. Данные собираются раз в сутки с помощью локального launchd-задания, запускаемого на машине разработчика. Скрипт снимает полный каталог OpenRouter, вычисляет дифф относительно предыдущего дня и публикует результаты. Автор подчёркивает, что система спроектирована так, чтобы не зависеть от AI-модели или API — она не может «тихо перестать работать».

Практические выводы для разработчиков
Разница в 33x означает, что выбор формы вызова напрямую влияет на бюджет. Если вы используете одну и ту же модель для агентных и пакетных задач, стоимость может варьироваться на порядок. Разработчикам рекомендуется:
— Учитывать форму вызова при оценке затрат, а не только базовую цену за токен.
— Для пакетных задач (классификация, извлечение данных) использовать «пакетные» вызовы.
— Для агентных сценариев (генерация кода, многократные контекстные запросы) закладывать значительно более высокий бюджет.

Ограничения и источники
Проект находится на стадии раннего запуска (8-й день). Автор предупреждает о возможных шероховатостях и приветствует обратную связь и коррекцию цен. Данные основаны исключительно на каталоге OpenRouter и не охватывают прямые цены провайдеров. Подтверждение ценовых политик отдельных вендоров (например, Anthropic) можно проверить на официальных страницах.

Источники
Оригинальный пост на Hacker News: https://news.ycombinator.com/item?id=49586810
Проект costpertoken.dev: https://costpertoken.dev
Гайд о причинах разрыва цен: https://costpertoken.dev/guides/why-agent-calls-cost-more-than-chat-calls/
Официальная страница Anthropic: https://www.anthropic.com/news