AI

Сколько стоит AI-агент: из чего складывается цена

24 августа 2026·9 минут чтения·EPIHEN Team

Вопрос «сколько стоит AI-агент» почти всегда упирается в то, что тарифы разных продуктов несопоставимы: где-то платят за сообщения, где-то за токены, где-то за «кредиты», смысл которых нигде не расшифрован. Разберём, из чего складывается цена на самом деле, какие модели тарификации существуют и где в каждой из них спрятан подвох.

Из чего вообще состоит счёт

За любым тарифом, каким бы он ни был, стоит одна и та же себестоимость — оплата провайдеру модели за токены. Токен это примерно две трети слова в английском и заметно меньше в русском: кириллица кодируется расточительнее, и один и тот же текст на русском стоит в полтора-два раза дороже, чем на английском. Это первое, что стоит знать, если считаете бюджет.

Считаются и вход, и выход, причём выход дороже входа в разы. И главное — вход это не только ваш вопрос. Туда идёт вся история разговора, системная инструкция, описания доступных инструментов и результаты их вызовов.

Отсюда неочевидное следствие: короткая реплика в длинном разговоре стоит дорого. Вы написали «а подробнее?» — три слова, — но модель получила на вход всю переписку целиком. Сотое сообщение в чате стоит в десятки раз больше первого, и на глаз эта разница никак не видна.

Что ещё попадает в счёт помимо ответа

У агента, в отличие от простого чата, есть накладные расходы, о которых редко пишут:

Поэтому сравнивать продукты по «цене за сообщение» бессмысленно. Сообщение сообщению рознь: «привет» и «разбери этот отчёт на сорок страниц и сходи проверь цифры в трёх источниках» отличаются по себестоимости в тысячи раз.

Четыре модели тарификации

Фиксированная подписка. Платите месяц, пользуетесь «сколько нужно». Удобно тем, что счёт предсказуем. Подвох в том, что безлимита не бывает: где-то в документах есть ограничения, и обнаруживаются они в тот момент, когда упираешься. Плюс тяжёлые модели в такие тарифы обычно не входят или входят с квотой.

Оплата за токены. Платите ровно за потреблённое, как за электричество. Честно и хорошо масштабируется, но требует понимания, что такое токен, и не даёт предсказуемости: месяц активной работы может обойтись втрое дороже обычного.

Внутренняя валюта. Покупаете условные единицы, они списываются за действия. Модель распространённая, и её главный недостаток — непрозрачность: если нигде не сказано, сколько единиц стоит конкретное действие, вы не можете спланировать расход. Работоспособной такая схема становится только при опубликованном курсе и видимой истории списаний.

За рабочие места. Корпоративный вариант: платите за сотрудника. Предсказуемо для финансов и слабо связано с реальным потреблением — тихий сотрудник субсидирует активного.

Где обычно прячется разница

Три места, на которые стоит смотреть, сравнивая тарифы:

Какие модели доступны. Тариф с дешёвыми моделями и тариф с топовыми различаются по себестоимости в десятки раз. «Безлимитный доступ к ИИ» за небольшие деньги почти наверняка означает лёгкую модель.

Что происходит при исчерпании лимита. Три варианта: работа останавливается до следующего периода, включается автодоплата, или вас молча переключают на модель попроще. Последнее — самый неприятный вариант, потому что качество падает, а вы не знаете почему.

Тарифицируются ли внутренние шаги. Если агент планирует, ищет и проверяет, кто-то за это платит. Либо вы, и тогда счёт больше ожидаемого, либо продукт из своей маржи — и тогда стоит понимать, что за счёт этого он экономит на чём-то другом.

Сколько это в деньгах

Порядки величин на середину 2026 года, чтобы было от чего оттолкнуться.

Короткий вопрос с коротким ответом на средней модели — доли цента. Разбор документа на десять страниц — единицы центов. Час активной работы с агентом, с поиском и инструментами — от нескольких десятков центов до пары долларов, в зависимости от модели. Генерация одного видео — единицы долларов.

Отсюда прикидка для типичного рабочего использования: несколько долларов в месяц при эпизодической работе, десятки — при ежедневной, сотни — если агент работает в фоне на потоке задач. Подписки на потребительские продукты стоят порядка двадцати долларов и рассчитаны на средний профиль: кто-то в них переплачивает, кто-то субсидируется остальными.

Как не переплачивать

  1. Начинайте новый чат под новую тему. Самый действенный приём из всех: вы перестаёте оплачивать всю предыдущую переписку на каждом ходу.
  2. Не берите тяжёлую модель под лёгкую задачу. Переформатировать список или перевести абзац дешёвая модель делает не хуже, а стоит в разы меньше. Автоматический подбор модели под задачу экономит больше любых других мер.
  3. Не загружайте лишнее. Прикреплённый на всякий случай документ на сто страниц оплачивается при каждом следующем сообщении в этом чате.
  4. Смотрите на расход по неделям. Если в продукте нет видимой статистики потребления — это само по себе довод против него.

Чего ждать дальше

Две тенденции, которые видно уже сейчас. Первая — стоимость токена падает: то, что год назад стоило заметных денег, сегодня стоит копейки, и это продолжается. Вторая — потребление растёт быстрее, чем дешевеют токены, потому что агенты делают больше шагов и работают дольше.

В сумме это означает, что счёт за единицу работы падает, а общий счёт скорее растёт: вы просто поручаете агенту больше. Планировать бюджет разумнее не от цены за токен, а от объёма задач, которые вы готовы отдать.

Какая модель под какую задачу нужна и где вы переплачиваете за избыточную мощность — в отдельном разборе.

Попробовать EPIHEN

50 поинтов в подарок при регистрации. Модель подбирается под задачу автоматически, расход виден по каждому запросу.

Создать аккаунт

Читать дальше

Модели
Какую нейросеть выбрать в 2026: гайд по задачам
Модели
GPT-5.5 vs Claude vs Gemini: сравнение 2026