Сколько стоит ИИ на сайте: тысяча нажатий за 15 рублей вместо восьми тысяч

Разбор
За каждое обращение к нейросети на сайте платит владелец сайта. Разобрала по своим замерам, из чего складывается счёт, что меняет цену в разы и как поставить защиту, чтобы публичная страница не съела бюджет.

11 мин 7 Обновлено 29 сентября

Сколько стоит ИИ на сайте: тысяча нажатий за 15 рублей вместо восьми тысяч

TL;DR

  • Тысяча примерок в месяц обходится примерно в 15 рублей. Если заставить нейросеть рисовать картинку целиком, та же тысяча стоила бы около восьми тысяч.
  • Главное правило: не просите нейросеть рисовать то, что нарисует обычная программа. У меня она только выбирает место, а код рисует программа.
  • Одна и та же нейросеть через разных посредников стоит по-разному. Смена посредника уронила счёт в 12 раз, а тариф без гарантий скорости – ещё вдвое.
  • Цену нельзя вывести из прайса. Расчёт по тарифам завысил мне её в 1,75 раза против фактического счёта, а мой собственный счётчик, наоборот, занижал расход на девять процентов.
  • Дневной лимит ставится в рублях, а не в числе запросов: разные вызовы стоят по-разному, и в запросах лимит не защищает.

Это третья часть разбора эксперимента с ИИ-конфигуратором маркировки: в первой части сама конструкция, во второй методика оценки. Здесь деньги. Цифры сняты в августе 2026 года по разнице баланса до и после прогона. Там, где цифра не замерена, а посчитана по прайсу, я это оговариваю отдельно.

Что я сделала

Мой клиент наносит на товары коды обязательной маркировки. На его сайте стоит примерка: посетитель выбирает тип товара, загружает фото и сразу видит, как код встанет на его упаковку. Рядом – ориентировочная цена и срок.

Третий шаг конфигуратора: посетитель загрузил фото своего товара и сразу видит, как на нём встанет код маркировки
Шаг конфигуратора с превью: фотография плюшевого медведя и наложенный на неё код маркировки

Место для кода подсказывает нейросеть. А за каждое нажатие посетителя платит владелец сайта. Эта статья о том, сколько именно и как не дать публичной странице съесть бюджет.

Короткий ответ

Тысяча примерок в месяц обходится примерно в 15 рублей. Десять тысяч – около 150 рублей. За весь день запуска, со всеми проверками и перезапусками, конфигуратор потратил меньше сорока копеек.

Если ту же задачу решать красиво и заставить нейросеть рисовать картинку целиком, та же тысяча стоила бы около восьми тысяч рублей.

Сколько примерок помещается в 100 рублей, по нижней замеренной цене 0,014 руб.
Обычная примерка7 000Сложный кадр с переспросом2 900Полная генерация картинки13

Разница в пятьсот раз получается из-за одного решения: нейросеть у меня ничего не рисует. Она только выбирает место из тех, что ей предложила обычная программа, а код рисует сама программа.

Одна оговорка. Пятнадцать рублей я замерила по счёту. Восемь тысяч посчитала по прайсу, ни одной реальной картинки на боевом сайте не генерировала. Ниже будет история о том, как такой же расчёт по прайсу завысил мне цену почти вдвое против фактического счёта. Так что восемь тысяч – это верхняя граница, а не факт.

Из чего складывается счёт

Нейросети берут деньги не за запрос, а за объём текста, который через них прошёл. Токен – это единица, за которую платят нейросетям, примерно половина слова. Считается всё: и то, что вы отправили, и то, что она ответила. Причём ответ обычно дороже.

Дальше встретятся ещё три слова, которые обычно сливаются в одно. Разведу их сразу.

  • Тот, кто обучил модель. На цену не влияет никак.
  • Тот, на чьих серверах она отвечает. Одна и та же модель бывает развёрнута у разных хозяев инфраструктуры, и у каждого свой прайс.
  • Посредник. Витрина над всем этим: один ключ, один счёт в рублях, а под капотом он сам решает, кому отправить ваш запрос. Если не указать маршрут явно, выбор остаётся за ним.

Формула цены простая: складываем отправленное и полученное, каждое по своему тарифу, и умножаем на число обращений.

цена вызова = отправлено токенов × тариф на вход
            + получено токенов  × тариф на выход

счёт за месяц = цена вызова × число нажатий

Мои числа для обычной примерки на модели gpt-5.6-luna: отправлено 1 322 токена, получено 23. Тариф 11,23 рубля за миллион отправленных и 67,36 за миллион полученных.

1 322 × 11,23 / 1 000 000 = 0,0148 руб.
   23 × 67,36 / 1 000 000 = 0,0016 руб.
                             ------------
                              0,0164 руб. за нажатие

Замер по счёту дал 0,0166 рубля. Формула сходится.

Что меняет цену в разы

Пять вещей, по убыванию силы. Первые две дали почти весь эффект.

Что именно вы просите у нейросети

Самое сильное сокращение дала не смена модели и не короткий запрос, а смена формата ответа. Пока модель диктовала координаты и объясняла ход мысли, её ответ стоил от пятисот до семисот токенов. Когда всю геометрию забрала программа, а модель стала отвечать номером готового места, ответ сжался до 23–120 токенов, а время упало с 6,6 до 1,9 секунды.

Правило простое: чем меньше нейросети нужно сказать, тем дешевле вызов. Выбрать из размеченного радикально дешевле, чем описать и обосновать.

Через кого вы подключены

Пока конфигуратор жил на тестовом стенде, он ходил в модели через один шлюз, а на боевом сайте подключён агрегатор OpenRouter: один ключ, один счёт в рублях, доступ к моделям OpenAI, Anthropic, Google и другим. На боевом сайте подключили другого посредника, и цифры разъехались так, что часть лабораторных выводов пришлось отозвать.

Одна и та же модель у двух посредников. Цены за миллион токенов
ТарифШлюз стендаБоевой агрегаторРазница
Текстовая модель, вход135 ₽11,23 ₽дешевле в 12 раз
Текстовая модель, выход810 ₽67,36 ₽дешевле в 12 раз
Картиночная модель, выход8 100 ₽6 736 ₽дешевле в 1,2 раза

Текст подешевел в двенадцать раз, картинка почти не изменилась. Разрыв между моей схемой и полной перерисовкой из-за этого не сократился, а вырос: был сорокакратным на стенде, стал 275-кратным в бою.

А вечером того же дня цена упала ещё вдвое, и не сменой модели, а одной строкой в запросе. Оказалось, что у одной и той же модели бывает несколько тарифов.

Тарифы у одного посредника на одну и ту же модель
МаршрутВходВыходЧто это
flex5,61 ₽33,68 ₽обслуживание по остаточному принципу, без гарантий скорости
стандарт11,23 ₽67,36 ₽каталожная цена
приоритетвдвое дорожевдвое дорожегарантированное место в очереди
корпоративные облакав 10–20 раз дорожев 10–20 раз дорожедоговор, регион хранения данных, гарантии уровня сервиса

Flex – это официальная скидка за терпение: так продают простаивающие мощности, обслуживая запрос по остаточному принципу и не обещая скорости. Отсюда естественное сомнение: раз дешевле, значит медленнее. Я прогнала серию, чередуя тарифы, чтобы нагрузка была честной.

Один и тот же запрос на двух тарифах, прогоны чередовались
ПрогонСтандартFlex
Первый7,4 с, 0,0166 ₽7,5 с, 0,0083 ₽
Второй4,9 с, 0,0174 ₽4,6 с, 0,0083 ₽

Скорость одинаковая, цена ровно вдвое ниже. С учётом тарифа итоговый разрыв между моей схемой и перерисовкой вырос с 275-кратного до 550-кратного.

Тариф надо закреплять за собой явно. Жёсткий вариант "только flex" означает, что при недоступности вызов просто упадёт. Я выбрала список предпочтений с запретом подстановки: сначала flex, при перебое обычный, всё остальное запрещено. Запрет тут важнее порядка: без него посредник вправе молча увести запрос на корпоративный тариф, который дороже в десять раз, и узнаете вы об этом из счёта.

Есть ли на выходе картинка

Главный источник трёхзначных разрывов – это тариф на то, что модель возвращает, когда она рисует изображение. По объёму схемы сопоставимы: 2 186 токенов у перерисовки против 1 558 у моей, разница в полтора раза. Но токен нарисованной картинки стоит в десятки раз дороже текстового, поэтому в рублях разрыв трёхзначный.

Я сама сначала сравнила только то, что модели вернули, и получила красивое "в 12 раз". Это была нечестная арифметика: считать надо в деньгах, отправленное и полученное отдельно.

Вторая ловушка: размер картинки на выходе фиксирован. Я попробовала сэкономить, отправляя модели не весь снимок, а фрагмент вокруг места. Замер: на полном кадре ответ 1 377 токенов, на фрагменте 1 383, из них на саму картинку в обоих случаях ровно 1 120. Обрезкой входа эту статью расхода не уменьшить. Гипотеза прожила десять минут, ровно столько занял замер, который её закрыл.

Сколько раз приходится переспрашивать

Первый рефлекс, когда модель ошиблась, – вернуть ей ответ на доработку. Такой повтор удваивает цену: он оплачивается полностью, а фотография занимает большую часть отправленного. Посчитать то же самое у себя и передать модели коротким текстом стоит около четырёх процентов от цены вызова.

Отсюда два приёма. Первый: не проверять после, а подсказывать до. Всё, что можно вычислить программой, я считаю сама и отдаю модели готовым. Второй: просить запас в том же ответе. Два-три места вместо одного стоят плюс три процента, зато при браке первого запасное берётся без нового вызова.

Там, где повтор всё же нужен, он ставится по условию, а не по умолчанию: дешёвая модель отвечает всегда, дорогая подключается, только если проверка забраковала выбор или модель сама отказалась. Трудных кадров меньшинство, поэтому средняя цена почти не растёт. Замеры это подтвердили: обычный кадр около полутора копеек, кадр с повтором около трёх с половиной.

Замер вместо прайса

И ещё одна статья, которую легко пропустить: одна и та же картинка стоит разное число токенов у разных моделей. На одном фрагменте фото: 165 токенов у одной, 251 у второй, 1 101 у третьей. Разница почти семикратная, причём у самой прожорливой формально низкий тариф. В прайсах этого не видно вообще.

Отсюда правило: итоговую цену нельзя вывести из прайса, её надо мерить прогоном. Иначе легко выбрать дешёвую модель, которая на ваших данных окажется дороже.

И вторая ступень того же правила: мерить надо там, где функция будет работать. Я пересчитала стендовые токены по новым тарифам и получила 0,084 рубля за прогон, а замер по счёту показал 0,048. Расчёт был завышен в 1,75 раза.

Как я это обнаружила

Цифры в этой статье двух возрастов: лабораторные сняты 5 августа на тестовом шлюзе, боевые – 7 августа, когда конфигуратор переехал на рабочего посредника. Разница между ними и есть сюжет.

Сначала я посчитала всё на стенде и получила стройную картину: разрыв между схемами сорокакратный, режим со свободными координатами дороже режима с номерами в разы, значит сложные товары на него переключать дорого.

Потом конфигуратор переехал, и половину выводов пришлось отозвать. Текст подешевел в двенадцать раз, картинка нет, разрыв вырос до 275 раз. Разница между двумя режимами оказалась не в разы, а в 1,4–1,7 раза, то есть переключать сложные товары можно, не заглядывая в бюджет. А вечером нашёлся тариф flex, и цена упала ещё вдвое.

Вывод, который я не смогла бы получить в лаборатории: цена ИИ-функции – это не свойство её устройства, а свойство пары "устройство плюс поставщик". Одно и то же решение при переезде между посредниками меняет экономику в разы. Пересчитывать надо при каждой такой смене, а не один раз на старте.

Как не дать функции съесть бюджет

Даже дешёвый вызов на публичной странице нужно закрывать от накрутки и от собственного успеха.

  • Дневной лимит в рублях, а не в числе запросов. Шестьсот вызовов – это совершенно разные суммы для вызова за полторы копейки и за восемь рублей. Ограничивать надо деньги.
  • Кончились деньги – сайт работает дальше. Когда баланс у посредника пуст, конфигуратор молча переходит на свой алгоритм и продолжает показывать результат. Посетитель не видит ни ошибки, ни пустого места.
  • Нейросеть включается после действия посетителя, а не при заходе на страницу. У меня это загрузка фотографии: случайный гость до неё не доходит.
  • Один вызов на одну картинку. Результат запоминается, повторные показы бесплатны.
  • Ограничение частоты по адресу и сессии, чтобы функцию нельзя было накрутить.
  • Свой счётчик расходов сверяется со счётом поставщика. Мой насчитал 0,069 рубля там, где посредник списал 0,076: около девяти процентов теряются в округлениях, и ошибка в опасную сторону. Реальный расход выше того, что видит защита бюджета, значит лимит надо ставить с запасом.

Отдельно про интерфейс. Идею кнопки "показать реалистично" для дорогого режима заказчица отклонила, и довод стоит запомнить: такая кнопка сообщает клиенту, что по умолчанию ему показывают нереалистично, и убивает эффект, ради которого блок делается. Ограничивать надо сценарием, а не кнопкой.

Проверьте свой проект

Если у вас на сайте уже работает ИИ-функция, четыре вопроса покажут, переплачиваете вы или нет.

  1. Сколько стоит одно нажатие? Не месячный счёт, а цена вызова. Если цифры нет, экономить пока не на чем: сначала замер по счёту.
  2. Нейросеть придумывает ответ или выбирает из готовых вариантов? Второе в разы дешевле. Перевести задачу из первого во второе – самая выгодная правка из всех возможных.
  3. Когда вы последний раз сравнивали тарифы своего посредника? У одной и той же модели их бывает несколько, и разница двукратная.
  4. Ваш лимит стоит в рублях или в запросах? В запросах он не защищает: разные вызовы стоят по-разному.

Встроить ИИ в сайт так, чтобы он работал предсказуемо и за понятные деньги, я делаю под ключ: от замеров и прототипа до запуска на рабочем сайте. Если хотите понимать стоимость до запуска, а не из первого счёта, напишите мне.

Частые вопросы

Сколько стоит одно обращение к нейросети на сайте?

В моём случае около полутора копеек за обычную примерку и около трёх с половиной за сложный кадр, где нейросеть приходится спрашивать дважды. Повторный показ того же фото бесплатен, результат запоминается. Полная перерисовка картинки нейросетью обошлась бы примерно в восемь рублей, но это расчёт по прайсу, таких прогонов я не делала.

Почему нарисовать картинку настолько дороже, чем выбрать место?

Из-за тарифа на то, что нейросеть возвращает. По объёму схемы сопоставимы, разница в полтора раза, но токен нарисованного изображения стоит в десятки раз дороже текстового. Плюс размер картинки на выходе фиксирован: обрезка того, что вы отправляете, эту статью расхода не уменьшает.

Можно ли посчитать стоимость по прайсу поставщика?

Только приблизительно, и ошибка будет в разы. Одна и та же картинка стоит разное число токенов у разных моделей: в моём замере от 165 до 1 101 за один и тот же фрагмент, причём у самой прожорливой формально низкий тариф. И даже расчёт по верным тарифам подвёл: он дал 0,084 рубля за прогон против 0,048 по фактическому счёту. Мерить надо прогоном и там, где функция будет работать.

Что сильнее всего снижает счёт?

Два решения дали почти весь эффект. Первое – формат ответа: когда нейросеть перестала диктовать координаты и стала называть номер готового места, ответ сжался с 500–700 токенов до 23–120. Второе – посредник и тариф: смена посредника уронила счёт в двенадцать раз, а тариф без гарантий скорости ещё вдвое, при той же скорости в замере.

Как защитить бюджет публичной страницы от накрутки?

Дневной лимит в рублях, а не в числе запросов. Нейросеть включается после осознанного действия посетителя, а не при заходе на страницу. Результат запоминается, повторные показы бесплатны. Частота ограничена по адресу и сессии. И главное: когда деньги кончились, сайт продолжает работать на своём алгоритме, а не показывает ошибку.

Что такое тариф без гарантий скорости и стоит ли его брать?

Это официальная скидка за терпение: так продают простаивающие мощности, обслуживая запрос по остаточному принципу. Я прогнала серию, чередуя тарифы: скорость оказалась одинаковой, цена ровно вдвое ниже. Брать стоит, но тариф надо закреплять явно и запрещать подстановку других, иначе посредник вправе молча увести запрос на корпоративный, который дороже в десять раз.

7

Материалы по теме

Что почитать дальше по этой теме

Эксперимент Не всё нужно отдавать нейросети: как я сделала ИИ-примерку в 500 раз дешевле Когда на сайт встраивают ИИ, обычно отдают нейросети всю задачу и берут самую дорогую модель. Я проверила оба решения: моя собственная программа справилась с частью работы лучше нейросети, а после сужения задачи дешёвая модель на простых кадрах выбирала то же место, что и дорогая. 11 мин 12 28 сентября 2026 Исследование Как проверить, что нейросеть работает правильно: из 18 объяснений правдой оказались 4 Нейросеть объясняла свой выбор складно, а по факту заявленное совпало с реальностью в 4 случаях из 18. Разбираю, чем измерение отличается от впечатления и что спросить у подрядчика, который делает вам ИИ-функцию. 9 мин 9 28 сентября 2026 Разбор ChatGPT уже отправляет вам клиентов – как увидеть это в логах 237 подтверждённых запросов ChatGPT-User за три дня на обычном B2B-сайте: 21 точечный вопрос и две глубокие сессии агентного ресёрча по каталогу. Разбираю тройку ботов OpenAI, показываю сессии на графике и объясняю, почему этот трафик не видит ни Метрика, ни GA4. 8 мин 342 21 июля 2026