Сколько стоит ИИ на сайте: тысяча нажатий за 15 рублей вместо восьми тысяч
Разбор11 мин 7 Обновлено 29 сентября
TL;DR
- Тысяча примерок в месяц обходится примерно в 15 рублей. Если заставить нейросеть рисовать картинку целиком, та же тысяча стоила бы около восьми тысяч.
- Главное правило: не просите нейросеть рисовать то, что нарисует обычная программа. У меня она только выбирает место, а код рисует программа.
- Одна и та же нейросеть через разных посредников стоит по-разному. Смена посредника уронила счёт в 12 раз, а тариф без гарантий скорости – ещё вдвое.
- Цену нельзя вывести из прайса. Расчёт по тарифам завысил мне её в 1,75 раза против фактического счёта, а мой собственный счётчик, наоборот, занижал расход на девять процентов.
- Дневной лимит ставится в рублях, а не в числе запросов: разные вызовы стоят по-разному, и в запросах лимит не защищает.
Это третья часть разбора эксперимента с ИИ-конфигуратором маркировки: в первой части сама конструкция, во второй методика оценки. Здесь деньги. Цифры сняты в августе 2026 года по разнице баланса до и после прогона. Там, где цифра не замерена, а посчитана по прайсу, я это оговариваю отдельно.
Что я сделала
Мой клиент наносит на товары коды обязательной маркировки. На его сайте стоит примерка: посетитель выбирает тип товара, загружает фото и сразу видит, как код встанет на его упаковку. Рядом – ориентировочная цена и срок.

Место для кода подсказывает нейросеть. А за каждое нажатие посетителя платит владелец сайта. Эта статья о том, сколько именно и как не дать публичной странице съесть бюджет.
Короткий ответ
Тысяча примерок в месяц обходится примерно в 15 рублей. Десять тысяч – около 150 рублей. За весь день запуска, со всеми проверками и перезапусками, конфигуратор потратил меньше сорока копеек.
Если ту же задачу решать красиво и заставить нейросеть рисовать картинку целиком, та же тысяча стоила бы около восьми тысяч рублей.
Разница в пятьсот раз получается из-за одного решения: нейросеть у меня ничего не рисует. Она только выбирает место из тех, что ей предложила обычная программа, а код рисует сама программа.
Одна оговорка. Пятнадцать рублей я замерила по счёту. Восемь тысяч посчитала по прайсу, ни одной реальной картинки на боевом сайте не генерировала. Ниже будет история о том, как такой же расчёт по прайсу завысил мне цену почти вдвое против фактического счёта. Так что восемь тысяч – это верхняя граница, а не факт.
Из чего складывается счёт
Нейросети берут деньги не за запрос, а за объём текста, который через них прошёл. Токен – это единица, за которую платят нейросетям, примерно половина слова. Считается всё: и то, что вы отправили, и то, что она ответила. Причём ответ обычно дороже.
Дальше встретятся ещё три слова, которые обычно сливаются в одно. Разведу их сразу.
- Тот, кто обучил модель. На цену не влияет никак.
- Тот, на чьих серверах она отвечает. Одна и та же модель бывает развёрнута у разных хозяев инфраструктуры, и у каждого свой прайс.
- Посредник. Витрина над всем этим: один ключ, один счёт в рублях, а под капотом он сам решает, кому отправить ваш запрос. Если не указать маршрут явно, выбор остаётся за ним.
Формула цены простая: складываем отправленное и полученное, каждое по своему тарифу, и умножаем на число обращений.
цена вызова = отправлено токенов × тариф на вход
+ получено токенов × тариф на выход
счёт за месяц = цена вызова × число нажатий
Мои числа для обычной примерки на модели gpt-5.6-luna: отправлено 1 322 токена, получено 23. Тариф 11,23 рубля за миллион отправленных и 67,36 за миллион полученных.
1 322 × 11,23 / 1 000 000 = 0,0148 руб.
23 × 67,36 / 1 000 000 = 0,0016 руб.
------------
0,0164 руб. за нажатие
Замер по счёту дал 0,0166 рубля. Формула сходится.
Что меняет цену в разы
Пять вещей, по убыванию силы. Первые две дали почти весь эффект.
Что именно вы просите у нейросети
Самое сильное сокращение дала не смена модели и не короткий запрос, а смена формата ответа. Пока модель диктовала координаты и объясняла ход мысли, её ответ стоил от пятисот до семисот токенов. Когда всю геометрию забрала программа, а модель стала отвечать номером готового места, ответ сжался до 23–120 токенов, а время упало с 6,6 до 1,9 секунды.
Правило простое: чем меньше нейросети нужно сказать, тем дешевле вызов. Выбрать из размеченного радикально дешевле, чем описать и обосновать.
Через кого вы подключены
Пока конфигуратор жил на тестовом стенде, он ходил в модели через один шлюз, а на боевом сайте подключён агрегатор OpenRouter: один ключ, один счёт в рублях, доступ к моделям OpenAI, Anthropic, Google и другим. На боевом сайте подключили другого посредника, и цифры разъехались так, что часть лабораторных выводов пришлось отозвать.
| Тариф | Шлюз стенда | Боевой агрегатор | Разница |
|---|---|---|---|
| Текстовая модель, вход | 135 ₽ | 11,23 ₽ | дешевле в 12 раз |
| Текстовая модель, выход | 810 ₽ | 67,36 ₽ | дешевле в 12 раз |
| Картиночная модель, выход | 8 100 ₽ | 6 736 ₽ | дешевле в 1,2 раза |
Текст подешевел в двенадцать раз, картинка почти не изменилась. Разрыв между моей схемой и полной перерисовкой из-за этого не сократился, а вырос: был сорокакратным на стенде, стал 275-кратным в бою.
А вечером того же дня цена упала ещё вдвое, и не сменой модели, а одной строкой в запросе. Оказалось, что у одной и той же модели бывает несколько тарифов.
| Маршрут | Вход | Выход | Что это |
|---|---|---|---|
| flex | 5,61 ₽ | 33,68 ₽ | обслуживание по остаточному принципу, без гарантий скорости |
| стандарт | 11,23 ₽ | 67,36 ₽ | каталожная цена |
| приоритет | вдвое дороже | вдвое дороже | гарантированное место в очереди |
| корпоративные облака | в 10–20 раз дороже | в 10–20 раз дороже | договор, регион хранения данных, гарантии уровня сервиса |
Flex – это официальная скидка за терпение: так продают простаивающие мощности, обслуживая запрос по остаточному принципу и не обещая скорости. Отсюда естественное сомнение: раз дешевле, значит медленнее. Я прогнала серию, чередуя тарифы, чтобы нагрузка была честной.
| Прогон | Стандарт | Flex |
|---|---|---|
| Первый | 7,4 с, 0,0166 ₽ | 7,5 с, 0,0083 ₽ |
| Второй | 4,9 с, 0,0174 ₽ | 4,6 с, 0,0083 ₽ |
Скорость одинаковая, цена ровно вдвое ниже. С учётом тарифа итоговый разрыв между моей схемой и перерисовкой вырос с 275-кратного до 550-кратного.
Тариф надо закреплять за собой явно. Жёсткий вариант "только flex" означает, что при недоступности вызов просто упадёт. Я выбрала список предпочтений с запретом подстановки: сначала flex, при перебое обычный, всё остальное запрещено. Запрет тут важнее порядка: без него посредник вправе молча увести запрос на корпоративный тариф, который дороже в десять раз, и узнаете вы об этом из счёта.
Есть ли на выходе картинка
Главный источник трёхзначных разрывов – это тариф на то, что модель возвращает, когда она рисует изображение. По объёму схемы сопоставимы: 2 186 токенов у перерисовки против 1 558 у моей, разница в полтора раза. Но токен нарисованной картинки стоит в десятки раз дороже текстового, поэтому в рублях разрыв трёхзначный.
Я сама сначала сравнила только то, что модели вернули, и получила красивое "в 12 раз". Это была нечестная арифметика: считать надо в деньгах, отправленное и полученное отдельно.
Вторая ловушка: размер картинки на выходе фиксирован. Я попробовала сэкономить, отправляя модели не весь снимок, а фрагмент вокруг места. Замер: на полном кадре ответ 1 377 токенов, на фрагменте 1 383, из них на саму картинку в обоих случаях ровно 1 120. Обрезкой входа эту статью расхода не уменьшить. Гипотеза прожила десять минут, ровно столько занял замер, который её закрыл.
Сколько раз приходится переспрашивать
Первый рефлекс, когда модель ошиблась, – вернуть ей ответ на доработку. Такой повтор удваивает цену: он оплачивается полностью, а фотография занимает большую часть отправленного. Посчитать то же самое у себя и передать модели коротким текстом стоит около четырёх процентов от цены вызова.
Отсюда два приёма. Первый: не проверять после, а подсказывать до. Всё, что можно вычислить программой, я считаю сама и отдаю модели готовым. Второй: просить запас в том же ответе. Два-три места вместо одного стоят плюс три процента, зато при браке первого запасное берётся без нового вызова.
Там, где повтор всё же нужен, он ставится по условию, а не по умолчанию: дешёвая модель отвечает всегда, дорогая подключается, только если проверка забраковала выбор или модель сама отказалась. Трудных кадров меньшинство, поэтому средняя цена почти не растёт. Замеры это подтвердили: обычный кадр около полутора копеек, кадр с повтором около трёх с половиной.
Замер вместо прайса
И ещё одна статья, которую легко пропустить: одна и та же картинка стоит разное число токенов у разных моделей. На одном фрагменте фото: 165 токенов у одной, 251 у второй, 1 101 у третьей. Разница почти семикратная, причём у самой прожорливой формально низкий тариф. В прайсах этого не видно вообще.
Отсюда правило: итоговую цену нельзя вывести из прайса, её надо мерить прогоном. Иначе легко выбрать дешёвую модель, которая на ваших данных окажется дороже.
И вторая ступень того же правила: мерить надо там, где функция будет работать. Я пересчитала стендовые токены по новым тарифам и получила 0,084 рубля за прогон, а замер по счёту показал 0,048. Расчёт был завышен в 1,75 раза.
Как я это обнаружила
Цифры в этой статье двух возрастов: лабораторные сняты 5 августа на тестовом шлюзе, боевые – 7 августа, когда конфигуратор переехал на рабочего посредника. Разница между ними и есть сюжет.
Сначала я посчитала всё на стенде и получила стройную картину: разрыв между схемами сорокакратный, режим со свободными координатами дороже режима с номерами в разы, значит сложные товары на него переключать дорого.
Потом конфигуратор переехал, и половину выводов пришлось отозвать. Текст подешевел в двенадцать раз, картинка нет, разрыв вырос до 275 раз. Разница между двумя режимами оказалась не в разы, а в 1,4–1,7 раза, то есть переключать сложные товары можно, не заглядывая в бюджет. А вечером нашёлся тариф flex, и цена упала ещё вдвое.
Вывод, который я не смогла бы получить в лаборатории: цена ИИ-функции – это не свойство её устройства, а свойство пары "устройство плюс поставщик". Одно и то же решение при переезде между посредниками меняет экономику в разы. Пересчитывать надо при каждой такой смене, а не один раз на старте.
Как не дать функции съесть бюджет
Даже дешёвый вызов на публичной странице нужно закрывать от накрутки и от собственного успеха.
- Дневной лимит в рублях, а не в числе запросов. Шестьсот вызовов – это совершенно разные суммы для вызова за полторы копейки и за восемь рублей. Ограничивать надо деньги.
- Кончились деньги – сайт работает дальше. Когда баланс у посредника пуст, конфигуратор молча переходит на свой алгоритм и продолжает показывать результат. Посетитель не видит ни ошибки, ни пустого места.
- Нейросеть включается после действия посетителя, а не при заходе на страницу. У меня это загрузка фотографии: случайный гость до неё не доходит.
- Один вызов на одну картинку. Результат запоминается, повторные показы бесплатны.
- Ограничение частоты по адресу и сессии, чтобы функцию нельзя было накрутить.
- Свой счётчик расходов сверяется со счётом поставщика. Мой насчитал 0,069 рубля там, где посредник списал 0,076: около девяти процентов теряются в округлениях, и ошибка в опасную сторону. Реальный расход выше того, что видит защита бюджета, значит лимит надо ставить с запасом.
Отдельно про интерфейс. Идею кнопки "показать реалистично" для дорогого режима заказчица отклонила, и довод стоит запомнить: такая кнопка сообщает клиенту, что по умолчанию ему показывают нереалистично, и убивает эффект, ради которого блок делается. Ограничивать надо сценарием, а не кнопкой.
Проверьте свой проект
Если у вас на сайте уже работает ИИ-функция, четыре вопроса покажут, переплачиваете вы или нет.
- Сколько стоит одно нажатие? Не месячный счёт, а цена вызова. Если цифры нет, экономить пока не на чем: сначала замер по счёту.
- Нейросеть придумывает ответ или выбирает из готовых вариантов? Второе в разы дешевле. Перевести задачу из первого во второе – самая выгодная правка из всех возможных.
- Когда вы последний раз сравнивали тарифы своего посредника? У одной и той же модели их бывает несколько, и разница двукратная.
- Ваш лимит стоит в рублях или в запросах? В запросах он не защищает: разные вызовы стоят по-разному.
Встроить ИИ в сайт так, чтобы он работал предсказуемо и за понятные деньги, я делаю под ключ: от замеров и прототипа до запуска на рабочем сайте. Если хотите понимать стоимость до запуска, а не из первого счёта, напишите мне.
Частые вопросы
Сколько стоит одно обращение к нейросети на сайте?
В моём случае около полутора копеек за обычную примерку и около трёх с половиной за сложный кадр, где нейросеть приходится спрашивать дважды. Повторный показ того же фото бесплатен, результат запоминается. Полная перерисовка картинки нейросетью обошлась бы примерно в восемь рублей, но это расчёт по прайсу, таких прогонов я не делала.
Почему нарисовать картинку настолько дороже, чем выбрать место?
Из-за тарифа на то, что нейросеть возвращает. По объёму схемы сопоставимы, разница в полтора раза, но токен нарисованного изображения стоит в десятки раз дороже текстового. Плюс размер картинки на выходе фиксирован: обрезка того, что вы отправляете, эту статью расхода не уменьшает.
Можно ли посчитать стоимость по прайсу поставщика?
Только приблизительно, и ошибка будет в разы. Одна и та же картинка стоит разное число токенов у разных моделей: в моём замере от 165 до 1 101 за один и тот же фрагмент, причём у самой прожорливой формально низкий тариф. И даже расчёт по верным тарифам подвёл: он дал 0,084 рубля за прогон против 0,048 по фактическому счёту. Мерить надо прогоном и там, где функция будет работать.
Что сильнее всего снижает счёт?
Два решения дали почти весь эффект. Первое – формат ответа: когда нейросеть перестала диктовать координаты и стала называть номер готового места, ответ сжался с 500–700 токенов до 23–120. Второе – посредник и тариф: смена посредника уронила счёт в двенадцать раз, а тариф без гарантий скорости ещё вдвое, при той же скорости в замере.
Как защитить бюджет публичной страницы от накрутки?
Дневной лимит в рублях, а не в числе запросов. Нейросеть включается после осознанного действия посетителя, а не при заходе на страницу. Результат запоминается, повторные показы бесплатны. Частота ограничена по адресу и сессии. И главное: когда деньги кончились, сайт продолжает работать на своём алгоритме, а не показывает ошибку.
Что такое тариф без гарантий скорости и стоит ли его брать?
Это официальная скидка за терпение: так продают простаивающие мощности, обслуживая запрос по остаточному принципу. Я прогнала серию, чередуя тарифы: скорость оказалась одинаковой, цена ровно вдвое ниже. Брать стоит, но тариф надо закреплять явно и запрещать подстановку других, иначе посредник вправе молча увести запрос на корпоративный, который дороже в десять раз.
Материалы по теме
Что почитать дальше по этой теме