Назад в ленту

OpenAI меняет экономику GPT-5.6 Sol: стартовала ценовая война за ИИ-бюджеты

Флагман OpenAI получил быстрый и дорогой режим, пока Google и Anthropic ищут свои ответы на новую реальность.

OpenAI объявила «major price cuts today» — и на этот раз за словами стоят по-настоящему серьёзные цифры. Флагманская линейка GPT-5.6 резко подешевела, а рынок ИИ в одночасье превратился в арену ценовой войны.

Впрочем, самое интересное даже не размер скидок, а логика решений: OpenAI одновременно режет цену младших моделей и добавляет платный Fast-режим для старшей. Вместе с ответами Google и Anthropic это меняет правила игры для разработчиков.

GPT-5.6 Luna: 80% дешевле и в низком ценовом сегменте

Сэм Альтман вышел на X с лаконичным, но красноречивым заявлением: «major price cuts today». И под этими словами действительно есть мощная база. Пока конкуренты возятся с релизами новых моделей, OpenAI решила сыграть на поле экономики и одним махом обрушила цену на самую младшую модель в своей флагманской линейке. GPT-5.6 Luna подешевела на 80%: входные токены упали с $1 до $0.20 за миллион, а выходные — с $6 до $1.20. Итого за миллион суммарных токенов теперь просят смешные $1.40 вместо прежних $7. ### Лунная гонка за кошельки После такого радикального среза цена GPT-5.6 Luna выглядит почти провокационно. Она в два раза дешевле, чем свежая Google Gemini 3.5 Flash-Lite, которая стоит $2.80 за миллион токенов суммарно. А более мощная Gemini 3.6 Flash и вовсе уходит в отрыв с $9 — теперь это небо и земля. Бонусом Luna уделывает и собственных «старших родственников»: OpenAI GPT-5.4 и GPT-5.6 Terra стоят заметно дороже, хотя по части скорости и простоты Luna им не уступает. Впрочем, абсолютным «демпинг-королём» её не назвать. На чистом рынке токенов всё ещё правят бал бюджетные китайские бойцы: Xiaomi MiMo-V2.5 Flash за $0.40 и deepseek-v4-flash за $0.42. Но сравнивать их с фронтлайн-серией OpenAI — всё равно что ставить смартфон из Ашана против флагмана. Luna впервые приносит «почти фронтирный» интеллект в тот ценовой пояс, где раньше обитали только узкоспециализированные облегчённые модели. ### Дешевле — не значит глупее Самое вкусное кроется не только в ценнике, но и в характеристиках. По данным Artificial Analysis, даже младшая Luna умудряется обойти по производительности и Google Gemini 3.6 Flash, и старушку Gemini 3.1 Pro. Другими словами, OpenAI предлагает за эти смешные деньги больше интеллекта, чем Google даёт за свои «флэшки». Стоимость единицы «мозга» у GPT-5.6 Luna теперь настолько привлекательна, что архитекторам высоконагруженных систем придётся пересчитать свои бюджеты. Позиционирование у модели осталось прежним: это снаряд для высоконагруженных и низколатентных задач. Суммаризация, классификация, маршрутизация, лёгкие real-time ассистенты — всё то, где цена за один запрос критична, а миллисекунды решают. После 80-процентного среза Luna превратилась в идеального кандидата для стартапов, которые хотят получить качество OpenAI, не сжигая венчурные миллионы на каждом вызове API. Это уже не просто скидка — это новый входной билет в мир агентного ИИ.

GPT-5.6 Terra: новая середина рынка и баланс для production-задач

OpenAI продолжает перекраивать ценовую карту своей флагманской серии. GPT-5.6 Terra подешевела на 20%: теперь входные токены обходятся в $2 за миллион, выходные — в $12, а в сумме выходит $14 вместо прежних $17.50. Выглядит скромнее, чем ценовой обвал младшей модели, но именно Terra сейчас превращается в самую интересную опцию для тех, кто не гонится за абсолютным интеллектом, а считает деньги в проде.

А вот дальше — чистая математика. На новом ценнике Terra вплотную подобралась к Google Gemini 3.1 Pro Preview для контекста до 200K токенов: $14 против $14. При этом собственная GPT-5.4 от OpenAI так и осталась на уровне $17.50 и теперь выглядит откровенно странно: свежая и более дешёвая Terra обходит её прямо на глазах. Ник Данц из Krea AI не сдержался и написал в X, что модель даёт «тот же интеллект примерно за 1/13 стоимости». Правда, в исходнике не уточняется, с чем именно сравнивает Данц, но посыл понятен: цена за единицу интеллекта упала радикально.

Terra и раньше задумывалась как рабочая лошадка — модель для general production use, где нужен баланс возможностей и эффективности. Она не пытается утереть нос флагманскому Sol в сложных reasoning-задачах и не мечтает обогнать лёгкую Luna по скорости. Её стихия — обычные продакшн-задачи, где нужен не героизм, а предсказуемый результат за разумные деньги.

История появления серии тоже добавляет контекста. GPT-5.6 вышла в конце июня 2026 года: сначала строго ограниченным тиражом по запросу правительства США, и только потом доступ открыли для всех. Теперь, спустя короткое время после релиза, ценовые уровни серии окончательно разошлись: Luna стоит в 10 раз дешевле Terra, а сама Terra на 60% дешевле Sol Standard. Тройка превратилась в полноценную лестницу, где у каждой ступеньки — свой баланс цены и интеллекта.

GPT-5.6 Sol, ответ Google и Anthropic и экономика агентного ИИ

«Begun, the AI price wars have!» — именно с этой отсылки к древнему джедайскому мастеру VentureBeat начинает разбор стремительных изменений на рынке ИИ. И контекст тут подходящий: OpenAI не просто переписывает ценники, а перекраивает экономику своей флагманской линейки GPT-5.6. В центре внимания — GPT-5.6 Sol, модель, которая осталась на вершине линейки и теперь получает принципиально новую опцию.

Fast-режим для Sol: скорость без потери интеллекта

Sol Standard не подешевела: как и раньше, цена составляет $5 за миллион входных и $30 за миллион выходных токенов. Но у флагмана появился Fast-режим за $10 и $60 соответственно. OpenAI обещает до 2,5 раза большую пропускную способность без изменения интеллекта модели. Правда, за такую производительность придётся платить: суммарные $70 за миллион токенов делают этот конфиг самым дорогим во всей сравнительной таблице VentureBeat.

Sol по-прежнему рассчитана на самые сложные reasoning-heavy и agentic сценарии: продвинутый кодинг, многошаговое планирование, системы, активно использующие инструменты. Для таких задач задержка критична, и OpenAI решила, что часть клиентов готова доплачивать за скорость.

Google и Anthropic: разные пути к одной цели

Изменения стали прямым ответом на свежие релизы конкурентов. Google выкатила Gemini 3.6 Flash и Gemini 3.5 Flash-Lite, сделав ставку на экономику агентных нагрузок. Gemini 3.6 Flash потребляет на 17% меньше выходных токенов, а на длинных инженерных задачах экономия достигает 65%. Gemini 3.5 Flash-Lite при этом позиционируется как самая быстрая модель в серии 3.5. OpenAI подрезает Google по цене за единицу интеллекта и параллельно пытается переманить пользователей Anthropic скоростью: те, кто готов платить больше, получают заметный буст через Fast-режим GPT-5.6 Sol.

Anthropic же пошла своим путём. Claude Opus 5 предлагается по цене Opus 4.8 — $5 за миллион входных и $25 за миллион выходных токенов. Производительность при этом почти повторяет более дорогую Fable 5, но примерно за полцены. Иными словами, Anthropic не снижает ценник, а повышает отдачу за те же деньги и добавляет регулируемую глубину рассуждений.

Рынок переходит от доступа к экономике

По оценке Cognition, GPT-5.6 теперь находится на парето-кривой эффективности «цена/производительность». Это значит, что модели OpenAI предлагают одни из лучших показателей интеллекта на рынке при минимальной стоимости. Конкуренция смещается от простого доступа к моделям к совокупной стоимости production-задач: для high-volume приложений даже небольшая разница в цене токенов становится решающей.

Ценовая война в ИИ только начинается. Уже сейчас понятно одно: победят не те, у кого самая умная модель, а те, кто сможет предложить самую низкую стоимость за реально выполненные задачи. Следим за развитием событий и обязательно расскажем, что будет дальше.

Справка по теме (FAQ)
Почему OpenAI ввела Fast-режим для GPT-5.6 Sol?
Fast-режим рассчитан на latency-sensitive задачи: за $10/$60 за миллион токенов он даёт до 2,5 раза большую пропускную способность без изменения интеллекта модели. Суммарные $70 делают этот конфиг самым дорогим, но для сложных agentic сценариев скорость решает.
Как Google ответил на снижение цен OpenAI?
Google сделал ставку на экономику агентов: Gemini 3.6 Flash потребляет на 17% меньше выходных токенов, а на длинных инженерных задачах экономия доходит до 65%. Gemini 3.5 Flash-Lite позиционируется как самая быстрая модель в серии 3.5.
Почему считается, что Claude Opus 5 выгоднее GPT-5.6 Sol?
Claude Opus 5 стоит $5/$25 (суммарно $30 против $35 у Sol Standard) и почти дотягивает до производительности Fable 5, при этом цена совпадает с Opus 4.8. Вдобавок появилась регулируемая глубина рассуждений для гибкой настройки под задачи.
Что значит «парето-кривая» применительно к GPT-5.6?
По оценке Cognition, GPT-5.6 находится на парето-кривой «цена/производительность»: модели дают один из лучших уровней интеллекта на рынке за минимальную стоимость. Это важный сигнал для high-volume продакшн-задач.