ИИ стал главным клиентом ИИ: агентный расход токенов на OpenRouter вырос в 14 раз
На OpenRouter — крупнейшем агрегаторе доступа к языковым моделям — AI-агенты уже потребляют больше токенов, чем люди. Агентное потребление выросло в 14 раз, тогда как человеческое — лишь в 2,8 раза. Есть нюанс: почти 70% агентного трафика приходится на дешёвые кэшированные промпты, поэтому реальные расходы растут гораздо медленнее сырых цифр.
AI-обработка оригинала The Decoder; редакция Hamidun News
AI-агенты потребляют на платформе OpenRouter больше токенов, чем живые пользователи, и разрыв стремительно растёт: агентное потребление увеличилось в 14 раз, тогда как человеческое — лишь в 2,8 раза. Статистику крупнейшего агрегатора языковых моделей разбирает The Decoder.
Машины обогнали людей
OpenRouter — удобный термометр всей AI-индустрии: через единый API платформа маршрутизирует запросы к сотням моделей от десятков провайдеров, и её публичная статистика отражает реальные паттерны использования, а не маркетинговые заявления. Термометр показывает структурный сдвиг: точка, в которой агентный трафик превысил человеческий, уже пройдена, и с тех пор кривые только расходятся.
За сухими цифрами — смена самой природы потребления ИИ. Человек задаёт вопрос и читает ответ: это единицы запросов в минуту. Агент, выполняющий задачу, крутит циклы: планирует, вызывает инструменты, читает результаты, проверяет себя — и каждый оборот цикла сжигает токены. Один работающий агент генерирует трафик десятков человек.
- Агентное потребление токенов выросло в 14 раз, человеческое — в 2,8 раза
- Агенты стабильно потребляют больше людей — и разрыв увеличивается
- Почти 70% агентного трафика — кэшированные промпты по сниженной цене
Почему расходы растут медленнее трафика
The Decoder обращает внимание на важную оговорку: около 70% агентного потребления приходится на кэшированные промпты. Агенты на каждом шаге пересылают модели один и тот же контекст — системные инструкции, историю задачи, документацию, — и провайдеры тарифицируют повторную обработку таких фрагментов в разы дешевле. Поэтому фактические затраты растут существенно медленнее, чем сырой счётчик токенов.
Для провайдеров моделей это двоякая новость. Взрывной агентный спрос — подтверждение рынка. Но структура этого спроса — дешёвые кэшированные токены — означает, что выручка масштабируется хуже трафика, а инфраструктурная нагрузка остаётся реальной.
Что это значит
Экономика ИИ разворачивается от чатов к конвейерам: главным потребителем моделей становится не человек с вопросом, а программа с задачей. Это меняет требования к продуктам — латентность, кэширование и цена цикла становятся важнее красоты интерфейса — и объясняет, почему провайдеры наперегонки снижают цены именно на кэшированные и батчевые запросы. Следующая фаза конкуренции моделей будет выиграна на экономике агентного цикла, а не на очках в бенчмарках.
Частые вопросы
Что такое OpenRouter?
Агрегатор доступа к языковым моделям: единый API, через который разработчики обращаются к сотням моделей разных провайдеров. Публичная статистика платформы стала популярным индикатором реального спроса на модели.
Почему кэшированные промпты дешевле?
Провайдеры сохраняют уже обработанные фрагменты контекста и при повторной отправке не пересчитывают их заново — вычислений меньше, и тариф на такие токены в разы ниже стандартного.
Хотите не читать про ИИ, а внедрить его?
«AI News» — это полезные новости из мира ИИ. Системно научиться работать с нейросетями и применять их в работе — в Hamidun Academy.
Главное из мира ИИ — раз в неделю
7 ключевых событий недели, отобранных вручную. Без шума, репостов и пресс-релизов.
Готово! Проверьте почту — мы отправили подтверждение.