ИИ подешевел в 5 раз за месяц: что происходит с ценами на модели

30 июля OpenAI срезал цену GPT-5.6 Luna на 80%, 13 августа Google выкатил Gemini 3.7 Flash со скидкой вдвое, Anthropic цену не трогает. Разбираю по цифрам, что ценовая война значит для тех, кто делает продукты на ИИ.

Коллеги, за последний месяц ИИ для разработчиков подешевел так, что старые расчёты можно выкидывать. Сначала OpenAI срезал цену одной из моделей на 80%, потом Google выкатил свою вдвое дешевле. Я пересчитал экономику своих проектов и понял, что половина решений «дорого, не потянем» больше не актуальна.

Собрал в одном месте, что именно произошло, кто сколько стоит сейчас и что с этим делать, если вы пилите продукты на ИИ.

Что случилось

30 июля 2026 OpenAI снизил цены на две модели из семейства GPT-5.6 - примерно через три недели после их публичного релиза. По данным VentureBeat и CNBC:

  • Luna - минус 80%: было $1 за миллион входных токенов и $6 за миллион выходных, стало $0.20 и $1.20;

  • Terra - минус 20%: стало $2 за вход и $12 за выход;

  • Sol (самая мощная) - цену не тронули: те же $5 и $30. Зато добавили режим Sol Fast за двойную цену, $10 и $60, с бóльшей пропускной способностью.

13 августа ответил Google: Gemini 3.7 Flash вышел со стартовой ценой $0.75 за вход и $3.75 за выход - это половина от обычной. Модель заточена под кодинг и агентов, а кеширование контекста стоит вообще $0.075 за миллион токенов.

Как выглядит ценовая война моделей
Иллюстрация к материалу VentureBeat о ценовой войне ИИ-моделей
Источник иллюстрации: VentureBeat
Сколько стоят модели сейчас

Чтобы сравнивать яблоки с яблоками, беру цену за миллион токенов - вход плюс выход вместе (как считает VentureBeat):

  • DeepSeek Flash - $0.42;

  • GPT-5.6 Luna - $1.40 (месяц назад было $7);

  • Gemini 3.5 Flash-Lite - $2.80;

  • GPT-5.6 Terra - $14;

  • Claude Opus 5 - $30;

  • GPT-5.6 Sol - $35.

Разрыв между самой дешёвой и самой дорогой - 83 раза. Это и есть главная новость: выбор модели теперь решает не только качество ответа, а ваш счёт в конце месяца.

Почему они вдруг подобрели

Не подобрели. Их прижали с двух сторон.

Первое - клиенты начали считать. Год назад все соревновались, кто скормит модели больше токенов. Сейчас бизнес требует показать отдачу, и дорогую модель никто не ставит в прод просто потому что она умная.

Второе - китайцы. DeepSeek с моделью за $0.42 за миллион токенов тянет весь рынок к нулю, и отвечать на это приходится ценой, а не пресс-релизами.

Интересно, что Anthropic в эту гонку не полез. Цену Opus они не снижали - вместо этого выпустили более сильную модель за те же $30. То есть подешевела не цена, а единица качества.

⚠️
Скидка - не навсегда

Стартовая цена Gemini 3.7 Flash действует до 31 декабря 2026 года. С 1 января она удваивается: $1.50 за вход и $7.50 за выход. Если вы посчитаете экономику продукта по промо-цене и запуститесь в декабре, в январе вас ждёт сюрприз ровно вдвое. Считайте по цене после акции - тогда сюрпризов не будет.

Посчитаем на живом примере

Возьмём телеграм-бота, который обрабатывает 1000 сообщений в день. На каждое уходит примерно 2000 токенов на вход (промпт плюс контекст) и 500 на выход. В месяц это 60 миллионов входных и 15 миллионов выходных токенов.

  • на Luna по новым ценам: 60 × $0.20 + 15 × $1.20 = $30 в месяц;

  • на Sol: 60 × $5 + 15 × $30 = $750 в месяц.

Двадцать пять раз разницы на одной и той же задаче. При этом отвечать на «во сколько обойдётся доставка» обе модели будут одинаково хорошо.

Вот из-за такой арифметики и живёт правило: считайте не цену модели, а цену одной решённой задачи.

Что я делаю у себя, и вам советую

Пересобрать экономику проекта - это вечер работы. По шагам:

  • открыть биллинг за прошлый месяц и посмотреть, какая задача съела больше всего токенов;

  • развести задачи по моделям: классификация, короткие ответы, разбор текста - дешёвая модель; сложные рассуждения и код - дорогая;

  • вынести неизменную часть промпта в кеш контекста - у Gemini это $0.075 за миллион, дешевле обычного входа в десять раз;

  • прогнать 20-30 реальных запросов через дешёвую модель и сравнить ответы глазами, а не по бенчмаркам;

  • пересчитать по цене после окончания акции.

Отдельно про агентов: они гоняют модель десятками вызовов на одну задачу, и там цена бьёт больнее всего. Если строите агента - начинайте с дешёвой модели и поднимайте класс только там, где она реально спотыкается.

Частые вопросы
  • Дешёвая модель = плохие ответы? Не обязательно. На простых задачах разницы вы не увидите, а на сложных - увидите сразу. Отсюда и правило разводить задачи по моделям.

  • Стоит ли сейчас переезжать на другого провайдера? Сначала посчитайте свой счёт. Если в месяц выходит десять долларов, переезд не окупит вечера работы.

  • Цены будут падать дальше? Судя по темпу - да, но точных обещаний никто не даёт. Поэтому архитектуру лучше держать такой, чтобы модель менялась в одну строчку.

  • А скорость? Тоже растёт: 13 августа OpenAI добавил режим Ultrafast для Sol - до 750 токенов в секунду.

Главный вывод простой: если вы отложили идею продукта на ИИ из-за «дорого» - достаньте её и пересчитайте. За месяц цифры изменились в разы, и то, что вчера не сходилось, сегодня вполне может сойтись.

А если у вас уже что-то крутится на моделях - напишите, сколько выходит в месяц, интересно сравнить.

Посчитаем экономику вашего проекта - напишите мне

Подписаться на @kursorai