Назад в ленту

DeepSeek повышает цены на API с 16 августа: новые тарифы V4-Pro и V4-Flash

Разбираемся, как изменится стоимость токенов DeepSeek, при чём тут открытый Harness и почему компания перестала демпинговать.

Когда китайская лаборатория выкатывает свежую модель в паре с собственным окружением для агентов, обычно ждёшь одной истории: «опять дёшево и сердито». На этот раз DeepSeek сыграла сложнее. Пока одна часть анонса — открытый харнесс DeepSeek Harness и обновлённый V4-Pro — говорит о развитии, вторая незаметно режет по живому: API дорожает. Причём так, что слово «недорого» из лексикона компании, кажется, начинают вычёркивать.

В этом материале разбираем, как DeepSeek меняет стратегию и почему новый тарифный сдвиг бьёт по тем, кто привык к почти символическим ценам на токены.

DeepSeek Harness: открытый каркас для ИИ-агентов вместо Claude Code

DeepSeek решила, что мало просто раздавать модели. Ладно, модели. Теперь она покусилась на святая святых разработчиков — на инструменты, в которых живут ИИ-агенты. В четверг китайская лаборатория представила DeepSeek Harness v0.1 — открытый агентный харнесс под лицензией MIT. Это бесплатный и открытый исходный код, который уже лежит на GitHub и запускается элементарной командой npx @deepseek-ai/dsh web.

Философия проекта сформулирована с пугающей простотой — «всё — это плагин». Архитектура построена на фреймворке Cordis: модели, инструменты, навыки, сессии, песочницы, файловые системы, циклы, оркестрация и даже пользовательские интерфейсы заменяются как картриджи. Захотел другую модель — вставил. Не понравилась песочница — воткнул свою. В теории звучит идеально. На практике репозиторий честно предупреждает: проект находится в стадии developer preview, впереди compatibility-breaking changes. Так что забирать это в прод-контур прямо сейчас — сомнительное удовольствие для тех, кто дорожит стабильностью.

Но функционально харнесс уже умеет многое: читать репозитории, редактировать файлы, выполнять shell-команды, искать по файлам и вебу, строить планы, вызывать навыки, делегировать задачи субагентам и применять политики одобрения. Это тот самый чек-лист, который превращает бездумное автодополнение в настоящего агента, способного работать, а не подсказывать.

Почему это не просто очередной конкурент

Сразу напрашивается параллель с Claude Code и Codex. Но важно понимать: Harness — модельно-агностичная и модульная альтернатива, а не полноценная замена той developer experience, которую успели выстроить конкуренты. У Claude Code, например, куда более зрелые системы разрешений, песочницы, hosted-агенты и интеграции с GitHub. DeepSeek же делает ставку на радикальную гибкость: в этом мире сам модель — просто очередной плагин, а не центр вертикально интегрированной вселенной. Это одновременно и сила, и слабость проекта.

Первый день выдался насыщенным: репозиторий собрал примерно 27 500 звёзд и 2 000 форков на GitHub. Цифры быстро меняются, но старт показательный. Осталось понять, простят ли разработчики DeepSeek нестабильность предрелизного кода ради такой свободы.

DeepSeek V4-Pro: ставка на агентные сценарии и совместимость

Три уровня размышлений: когда «думать» — роскошь

Отдельного внимания заслуживает новая настройка reasoning effort. В документации V4 теперь расписаны три режима: Non-think для быстрой рутинной работы, Think High для сложного планирования и Think Max, когда задача требует выжать из нейросети максимум. В агентных системах, работающих с ИИ, это настоящая находка — гонять максимальные рассуждения на каждом шаге значит жечь токены впустую. Иногда агенту достаточно просто прочитать файл или дёрнуть тривиальный инструмент, а не устраивать мозговой штурм. Теперь интеллектуальную нагрузку можно дозировать, как кофе в капсульной кофемашине.

Цифры красивые, но есть нюанс

В собственной бенчмарк-таблице DeepSeek свежая V4-Pro-0813 показывает 87,9 балла в Terminal Bench 2.1, 74,1 в Toolathlon-Verified, 71,1 в DSBench-FullStack и 67,2 в DSBench-Hard. Правда, безоговорочным лидером её назвать не выйдет: конкурент Fable 5 в той же таблице умудряется набрать 77,9 в Toolathlon-Verified и 77,2 в DSBench-FullStack. Очко не в пользу флагмана, но совсем не смертельно.

И вот тут самое интересное. DeepSeek честно предупреждает: для публичных задач Code Agent модель тестировали не саму по себе, а в связке с Harness в «минимальном режиме». То есть результаты отражают способности пары «модель + харнесс», а не чистого ИИ в вакууме. Звучит как момент истины: непонятно, где заканчиваются таланты самой модели и начинается вклад обвязки. Осталось проверить, как это всё работает в бою, а не на бумаге с десятком знаков после запятой.

API DeepSeek дорожает: новая тарифная сетка и стратегический сдвиг

С 16 августа в 16:00 UTC DeepSeek переводит API на двухставочную сетку. Пиковыми считаются промежутки 01:00–04:00 UTC и 06:00–10:00 UTC; всё остальное время — вне пика, с ценами вдвое ниже. Только вот «вне пика» больше не значит «дёшево».

Не пиком единым: цифры нового прайса

Даже вне пиковых часов стоимость заметно подскакивает. V4-Flash подорожает с $0,14 до $0,22 за миллион входных токенов в режиме cache-miss, а выходные токены — с $0,28 до $0,66. Для V4-Pro цифры ещё ощутимее: вход поднимается с $0,435 до $0,66, выход — с $0,87 до $1,98. В часы пик Flash доходит до $0,44 за вход и $1,32 за выход, Pro — до $1,32 и $3,96 соответственно.

Не пощадили и кэшированный ввод. У V4-Pro он вырастает с копеечных $0,003625 до $0,022 вне пика и до $0,044 в пик. У Flash — с $0,0028 до $0,007 и $0,014. По оценкам Reuters, в зависимости от модели, категории токенов и времени суток рост составит от 50% до более чем 1100%. Важная оговорка: скидка в 50% вне пика считается от новых пиковых ставок, а не от тех цен, что разработчики платят сегодня.

Что это значит на практике

Примитивный сценарий: миллион входных токенов (cache-miss) плюс миллион выходных. Сейчас V4-Pro в такой раскладке обходится в $1,305. После 16 августа — $2,64 вне пика и $5,28 в пик. У V4-Flash те же цифры выглядят как $0,42 сегодня, $0,88 вне пика и $1,76 в пик. Реальные бюджеты будут другими из-за пропорции кэша и генерации, но тренд очевиден.

Почему DeepSeek повышает цены

Главное здесь — не столько сам прайс, сколько сигнал. DeepSeek выходит за рамки конкуренции по стоимости. С открытым Harness она занимает слой оркестрации агентов: модели теперь можно менять за стандартизированными интерфейсами, а вот сам харнесс, который управляет инструментами, файлами и рабочими процессами, заменить куда сложнее. Компания фактически показывает: агрессивно низкие тарифы не были обещанием навсегда. Разработчикам, которые строят на DeepSeek долгосрочные продукты, стоит закладывать в смету не только сегодняшние цены, но и запас на будущее.

Повышение цен — не паника и не попытка всех разогнать. Это скорее смена вывески: DeepSeek больше не хочет быть только «бесплатной альтернативой», а метит в полноценную платформу. Харнесс с открытым кодом и агентный V4-Pro дают ей право претендовать на роль, которую раньше застолбили западные гиганты. Но теперь разработчикам придётся внимательнее следить и за счетами. Что из этого выйдет — посмотрим. Пока же одно можно сказать точно: эпоха безудержного демпинга на API DeepSeek закончилась.

Справка по теме (FAQ)
Когда вступают в силу новые тарифы DeepSeek API?
С 16 августа в 16:00 UTC.
Какое время считается пиковым?
Пик — 01:00–04:00 UTC и 06:00–10:00 UTC; в остальное время действует непиковый тариф, который вдвое ниже пикового.
Насколько вырастет цена для V4-Pro?
Вне пика входные токены в режиме cache-miss подорожают с $0,435 до $0,66 за миллион, выходные — с $0,87 до $1,98. В пиковые часы — $1,32 и $3,96 соответственно.
Что изменилось для V4-Flash?
Вне пика вход поднимается с $0,14 до $0,22, выход — с $0,28 до $0,66; в пик — $0,44 и $1,32.
Почему DeepSeek повышает цены?
Компания делает ставку на агентную платформу: открытый DeepSeek Harness закрепляет за ней слой оркестрации, а прежние сверхнизкие тарифы не обещали быть вечными.