
Разбор · Опубликовали 08.10.2026
Стоимость токенов GPT в агентной задаче включает чтение проекта, ответ и повторные попытки
Короткое поручение запускает несколько обращений к модели. Показываем расчёт до принятой правки и границы нашего счётчика расходов.
Текст написан инженером, который ведёт vibecoding.ru, вместе с машиной агентов · числа проверены 8 октября 2026
Вы просите «Добавьте фильтр заказов по датам», но в стоимость токенов GPT входят ещё чтение проекта, ответы модели и повторы после проверок.
Разложим расход на учебном примере и покажем наш публичный счётчик: своего клиентского замера у нас нет.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
1. Короткое поручение запускает несколько платных обращений.
Агент начинает с того, что выясняет, как устроены заказы и где находится фильтр. Он читает правила, ищет нужные файлы, предлагает правку. Ваше сообщение остаётся коротким, а объём переданного модели текста растёт.
Не каждый шаг агента сам по себе расходует токены модели. Запуск теста выполняет программа. Но когда агент отправляет модели сообщение об ошибке, этот текст становится оплачиваемым входом следующего обращения.
Входом могут стать и правила для ИИ-агентов, и найденный код, и история предыдущих шагов. Выходом служат не только слова «готово»: модель генерирует код, команды инструментам, а у рассуждающих моделей в оплату выхода входят внутренние рассуждения.
В счёт попадает работа между поручением и ответом.
Документация OpenAI по reasoning и prompt caching, проверена 08.10.2026. Это схема категорий, не замер клиентской задачи.
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Тарифы | Открыли официальные прайсы OpenAI и Anthropic. Для GPT-6.1 Sol взяли Standard до 272 тысяч токенов входа; для Sonnet 5.5 запись кеша на пять минут, базовые ставки без региональной надбавки. | 2026-10-08 |
| Расчёт | Объёмы четырёх обращений заданы для объяснения арифметики. Это не клиентский кейс. Один блок на 30 000 токенов записывается в кеш и затем читается в трёх обращениях; попадания в кеш предполагаются. | 2026-10-08 |
| Наша машина | Живой /open/api-costs: 01.07–08.10.2026, 100 дней, 69,1 млрд токенов. Для GPT-6.1 Sol нет цены: 3,1 млрд токенов посчитаны по нулю. Денежный итог неполный; цену клиентской правки из него не выводим. | 2026-10-08 |
| Предложение | Живой /services: «Один проект», 250 000 ₽ в месяц. Нейросети для кода, текстов и картинок оплачивает исполнитель; у отдельно выбранных моделей и работы продукта свои расходы. | 2026-10-08 |
2. У входа, кеша и ответа разные цены.
«Цена токена» без названия модели и категории не позволяет посчитать задачу. В прайсе отдельно стоят обычный вход и выход. Для повторяющейся части входа могут действовать тарифы записи в кеш и чтения из него.
Кеш хранит уже обработанную часть входа. Если начало следующего запроса совпало и сервис засчитал попадание в кеш, повторное чтение стоит по другому тарифу. Неизменные правила и часть проекта могут повторяться; новый код и сообщение об ошибке меняют запрос.
На 8 октября 2026 года у GPT-6.1 Sol в режиме Standard и у Claude Sonnet 5.5 базовые ставки в этой таблице совпадают. Это совпадение прайсов, а не доказательство равного качества или одинакового расхода на вашу задачу.
Тариф зависит от категории токенов.
Официальные прайсы, проверены 08.10.2026. OpenAI: Standard, вход до 272 тысяч токенов; при большем входе действуют повышенные ставки. Anthropic: базовые ставки без региональной надбавки, запись в кеш на пять минут; запись на час стоит иначе. Ускоренные и пакетные режимы не включены.
Запись в кеш нельзя прибавить к обычному входу тех же токенов. По документации OpenAI из общего входа вычитают чтение и запись в кеш: остаток считают по обычной ставке. Иначе одна часть проекта попадёт в счёт дважды.
Внутренние рассуждения тоже не надо повторно прибавлять к уже учтённому выходу. Для бюджета нужен весь оплачиваемый выход из данных API, а не длина ответа, который видит руководитель.
Стоимость обращения складывается из четырёх частей.
Прайс и инструкция OpenAI по учёту кеша, 08.10.2026. Стоимость задачи получается суммой стоимостей всех её обращений.
3. До принятой правки считают все попытки.
Вернёмся к фильтру заказов. Пусть агент сделал четыре обращения: разобрал код, написал правку, исправил ошибку теста и проверил результат. Объёмы ниже заданы для примера, они не сняты с клиентской работы и не предсказывают цену фильтра.
В первом обращении мы условно записали в кеш один блок проекта на 30 000 токенов. В следующих обращениях читается тот же блок; остальные переданные фрагменты идут обычным входом. Мы считаем, что кеш сработал и не истёк. Реальное попадание надо смотреть в данных API.
Количество токенов выхода включает всё, что API выставил к оплате, в том числе рассуждения. Все объёмы учебные и округлённые. Здесь нет цены работы инженера, платных инструментов, инфраструктуры и работы самого продукта.
Четыре обращения стоят $0,284 при заданных объёмах.
Наши условные объёмы × официальный прайс GPT-6.1 Sol Standard на 08.10.2026. «Вход» в таблице означает обычный вход без записи и чтения кеша. Инженерная таблица может прокручиваться на узком экране.
Если остановиться на первом ответе, получится $0,125. Но правка ещё не принята. Ошибка теста не обнуляет потраченные токены: неудачная попытка остаётся частью стоимости задачи.
Если кеш не сработал и весь тот же вход оплачен как обычный, арифметика меняется. В примере общий вход составляет 135 000 токенов, выход 17 000. По тем же ставкам получится $0,44. Это сравнение двух допущений одного расчёта, а не обещание экономии на каждой задаче.
Для живого проекта расход может оказаться выше или ниже. Агент может прочитать меньше файлов, вызвать другую модель или застрять на проверке. Поэтому исполнитель должен показать границы задачи и расход до её принятия; универсальная ставка «за такую правку» из этого примера не получается.
Одинаковый объём даёт разный счёт при разных допущениях.
Тот же условный пример и прайс на 08.10.2026. Новая попытка увеличит объём и изменит обе суммы.
4. Наш счётчик показывает расход машины, а не цену клиента.
На vibecoding.ru инженер ведёт машину агентов. В её счётчике за период с 1 июля по 8 октября 2026 года, 100 дней, учтено 69,1 млрд токенов. Это работа над сайтом, а не одна правка в чужом бизнесе.
У денежного итога есть ограничение: в день проверки счётчик сообщает, что для GPT-6.1 Sol нет цены и 3,1 млрд токенов этой модели посчитаны по нулевой стоимости. Поэтому мы не используем показанный денежный итог как полный бюджет машины или прогноз для клиента.
Счётчик полезен устройством учёта. Он включает сабагентов и считает сообщения без повторов из скопированной истории продолженных сессий. У Codex расход берётся из событий, чтобы унаследованный итог родительской сессии не посчитать заново.
В РуБенче стоимость прогона тоже читается рядом с результатом проверки задачи. Для бизнеса из этого следует правило: дешёвая попытка, которую нельзя принять, не заменяет готовую правку. Среднее по всему нашему сайту этого не покажет.
5. Повторную работу ограничивают проверкой и условием остановки.
У нас расход возникал и там, где агент заново разбирал одно и то же правило. В августе проверку пунктуации перенесли из модельной приёмки в автоматическую проверку. Когда условие можно проверить программой, нет смысла каждый раз просить модель истолковать его заново.
Ошибки бывают и в самом учёте. Если продолженная сессия скопировала историю, сумма токенов по файлам даст повторный расход на бумаге. Нужны отдельные события и правила исключения дублей, а не сумма длин всех сохранённых разговоров.
Поломка учёта или проверки меняет правило работы.
22.08
Модельная приёмка повторно разбирала требования к пунктуации. Правило перенесли в автоматическую проверку.
27.09
Аудит нашёл повторы из продолженных сессий и наследования итогов. Учёт свели к сообщениям без дублей и событиям расхода, сабагентов включили отдельно.
08.10
Живой счётчик показывает модель без цены. Пока прайс не восстановлен, денежный итог читаем как неполный. Это ограничение текущего замера, не закрытая поломка.
Собственные записи машины из среза серии и публичная методика /open/api-costs. Даты первых двух событий не являются замером цены клиентской работы.
Для нового поручения договоритесь, что значит «готово». В постановке задач ИИ-агенту мы разбираем критерии приёмки. У фильтра по датам таким критерием может быть проверка заказов на границах периода и сохранение прежнего результата без фильтра.
Затем назовите условие остановки: например, повтор одной и той же ошибки без нового объяснения. Агент возвращает причину, текущий расход и предложение следующего шага. Если принимать любой ответ «готово», расход может выглядеть небольшим, а исправления начнутся после выпуска; ответственность за ошибки ИИ от этого не исчезает.
Исполнитель связывает обращения основной сессии, сабагентов и повторных запусков с одной задачей. После приёмки остаётся запись: что проверили, что приняли и сколько стоили все модельные обращения. Точную цену человеко-часа для этого придумывать не нужно.
Запись по задаче соединяет расход с результатом.
Предлагаемая схема учёта для читателя на основе нашего опыта. Такого клиентского отчёта у нас пока нет.
6. Бюджет сравнивают с принятыми правками.
Руководителю полезен ответ на два вопроса: кто оплачивает модель и что он получает за весь бюджет разработки. Даже точный счёт за токены не включает работу инженера, проверку и работу продукта после выпуска.
На странице агентной разработки подписка «Один проект» стоит 250 000 ₽ в месяц, проверено 8 октября 2026 года. Нейросети для кода, текстов и картинок оплачивает исполнитель. Вы оцениваете фикс месяца и поток принятых правок; здесь нет отдельной цены за каждое слово поручения.
У этого предложения есть граница: видео, звук и выбранные вами отдельно модели оплачиваются по цене сервиса. Хостинг, сторонние сервисы и ИИ-функции, которыми пользуются клиенты вашего продукта, тоже остаются расходами продукта. Их нельзя считать оплаченными вместе с разработкой.
Перед покупкой разделите разработку и работу продукта.
Условия /services на 08.10.2026 и вопросы к договорённости с исполнителем. Универсальную цену часа мы не выводим.
Если вы собираетесь вести агента сами, сначала проверьте, сможете ли поставить проверяемую задачу и принять её результат. Для обсуждения этой работы откройте следующий шаг для руководителя.
После первой принятой задачи сравните ожидание с фактом: объём, попытки, расход и результат. Если бюджет вырос, разберите причину до следующей задачи. Так учёт возвращается в правила работы и помогает управлять следующей правкой.
7. Частые вопросы
Что такое токен и можно ли считать его словом?+
Токен представляет фрагмент текста в кодировке модели. Слово может разбиваться на несколько токенов. Для счёта используйте данные конкретного API, а не универсальное число букв или слов.
Подойдёт ли этот расчёт для стоимости токенов Claude?+
Подойдёт схема суммирования категорий и обращений. Подставьте прайс своей модели, режим и данные её API. В таблице показан Sonnet 5.5 с записью кеша на пять минут; другой срок хранения или модель изменят цену.
Можно ли узнать цену до чтения проекта?+
Можно задать денежный лимит и попросить оценку первого этапа. Точную стоимость всей задачи без объёмов обращений, результатов проверок и числа повторов этот расчёт не даёт.
Лимит в интерфейсе гарантирует, что агент остановится?+
Это зависит от инструмента. Проверьте, что именно ограничено: предупреждение, один запрос, сессия или весь проект. Запишите условие остановки и проверьте его действие до длинной задачи.
Нужно ли переводить цену токенов в рубли?+
Если оплачиваете API в другой валюте, считайте по условиям своего платежа, включая курс и комиссии. В статье тарифы оставлены в долларах, чтобы не подменять прайс предположением о вашем способе оплаты.
Источники
- OpenAI. GPT-6.1 Sol: прайс Standard — официальная документация
- OpenAI. Prompt caching: категории входа и учёт кеша — официальная документация
- OpenAI. Reasoning: оплата внутренних рассуждений — официальная документация
- Anthropic. Claude pricing: Sonnet 5.5 и кеш — официальная документация
- vibecoding.ru. Счётчик расходов и методика учёта — наш публичный счётчик
- vibecoding.ru. Условия агентной разработки — наше предложение
- vibecoding.ru. РуБенч: результат и стоимость прогона — наш бенчмарк
Запомнить
- Считайте все обращения до приёмки, включая неудачные попытки и сабагентов.
- Разделяйте обычный вход, запись в кеш, чтение кеша и выход; проверяйте прайс модели и режима.
- Сохраняйте критерий приёмки и причину остановки рядом с расходом по задаче.
- Сравнивайте бюджет с принятыми правками; отделяйте разработку от работы продукта.
- После задачи возвращайте причину перерасхода в правила следующей работы.