Перейти к содержанию
среда, 7 октября 2026 г.

ИИ Вестник

Главные новости о развитии искусственного интеллекта в России

ИИ дешевеет, а железо дорожает: как OpenAI и Anthropic устроили гонку цен

Источник: Все публикации в потоке Разработка
Silicon chips and server racks glowing in a data center, price war concept.
Generated by Sourceful Riverflow (RouterAI)

22 сентября Anthropic и OpenAI с разницей около полутора часов выпустили модели, которые оказались дешевле предшественников, а DeepSeek отдала кэшированный вход по 0,003 доллара за миллион токенов. Одновременно с этим розничная память DDR5 за шесть недель прибавила около 9%, а аренда H100 за год подорожала на 15%. Удешевление токена больше не связано с падением стоимости железа — изменился вопрос о том, кто и как оплачивает себестоимость.

В конце сентября рынок больших языковых моделей пережил сразу несколько синхронных релизов, каждый из которых снижал цену относительно предыдущего поколения. Первой выступила Anthropic с моделью Claude Opus 5.5, а примерно через полтора часа OpenAI представила GPT-6 Sol и GPT-6 Luna. Через неделю, 28 сентября, Anthropic добавила Sonnet 5.5, а 29 сентября OpenAI на DevDay показала GPT-6.1 Sol с еще более дешевым кэшированным входом. Формально это выглядит как очередная волна щедрости со стороны вендоров, однако заявления компаний и цифры из проспекта Anthropic указывают на то, что причина лежит не в падении закупочных цен на вычисления.

Ключевые цифры новых прайсов выглядят так. В Claude Opus 5.5 миллион входных токенов стоит 4 доллара, выходных — 20 долларов, тогда как у Opus 5 это было 5 и 25 долларов соответственно. Чтение из кэша подешевело сильнее всего — с 0,50 до 0,20 доллара за миллион токенов. У OpenAI GPT-6 Sol стоит 2 доллара за вход и 10 долларов за выход, GPT-6 Luna — 0,10 и 0,50 доллара. Против базовых тарифов GPT-5.6 новая Sol дешевле на 60% по входу и на 67% по выводу, а кэшированный вход на GPT-6.1 Sol подешевел вдвое — с 0,20 до 0,10 доллара, то есть скидка достигает 95%. Sonnet 5.5 от Anthropic стоит те же 2 и 10 долларов, что и Sonnet 5, но, по данным компании, тратит вчетверо меньше токенов на типовой ответ.

Технически удешевление опирается на два разных механизма. Первый — инженерный: кэширование входных токенов, сжатие KV-кэша и модели, которые расходуют меньше токенов на ту же задачу. OpenAI добавила точки кэширования, предварительный прогрев кэша, дашборд и диагностику промахов, а также разрешила менять уровень reasoning effort посреди сессии через элемент configuration_update в запросе — раньше смена effort означала полный пересчет контекста. Anthropic в Opus 5.5 сделала режим thinking неотключаемым: значение disabled возвращает ошибку 400, глубину рассуждения задает только параметр effort, а принудительный tool_choice со значениями any и tool запрещен. Это значит, что миграция с Opus 5 на 5.5 для агентных систем не сводится к замене имени модели в конфиге. Второй механизм — финансовый: разницу между падающей ценой токена и растущей стоимостью железа кто-то покрывает из собственного баланса.

Контекст этой гонки цен задают не только предыдущие релизы, но и состояние рынка оборудования. Розничная DDR5 за шесть недель прибавила около 9%, аренда H100 за год подорожала на 15%, и это происходит на фоне того, что цена токена у ведущих вендоров снижается двузначными темпами. Раньше удешевление моделей объяснялось оптимизацией вычислений и конкуренцией за разработчиков, теперь к этому добавился элемент финансирования. Anthropic 1 июня подала конфиденциальную заявку на IPO, а 28 сентября Reuters сообщил о содержании проспекта: выручка за 2025 год около 4,6 млрд долларов, что примерно в 12 раз больше, чем годом ранее, выручка второго квартала 2026 года по предварительным данным превышает 11,5 млрд долларов. Чистый убыток за 2025 год составил 42 млрд долларов, но около 34 млрд из них — неденежное начисление из-за роста оценки финансирования, которое может конвертироваться в акции, а операционный убыток — около 8 млрд. При этом обязательства по облаку и вычислениям на ближайшие годы достигают 518 млрд долларов, а почти четверть выручки 2025 года обеспечили два клиента по 12% каждый.

Для российского рынка эта динамика имеет двойственный характер. С одной стороны, снижение цен на токены у OpenAI и Anthropic напрямую не влияет на большинство локальных команд, поскольку доступ к этим API ограничен, а оплата требует обходных схем. С другой стороны, ценовые ориентиры быстро подхватываются отечественными провайдерами и открытыми моделями: DeepSeek с кэшированным входом по 0,003 доллара за миллион токенов задает нижнюю границу, ниже которой локальным игрокам становится сложно удерживать маржу. Российские разработчики, строящие агентов, RAG-системы и кодинг-ассистентов, все чаще считают экономику не по прайсу за миллион токенов, а по стоимости типовой задачи с учетом хитрейта кэша, и этот сдвиг постепенно доходит до локальных платформ. Дополнительный фон создает зависимость инфраструктуры от иностранных сервисов: проверка 50 российских сайтов показала, что серверы в основном перенесены, но сертификаты, аналитика и шрифты по-прежнему завязаны на зарубежных провайдеров.

Если сравнивать новые модели между собой, картина перестает быть линейной. По Terminal-Bench 4.0 Claude Opus 5.5 набирает 66,4% на уровне effort xhigh против 57,9% у GPT-6 Astra и 55,8% у Fable 5.1, а Sonnet 5.5, вышедшая неделей позже, показывает 70,6% — то есть младшая модель обходит старшую по этому бенчмарку. FrontierCode v1.1 у Opus 5.5 дает 54,4%, GDPval-AA v2.1 — 1846 Elo. OpenAI обещает почти уровень Astra в агентном кодинге за пятую часть цены и до 300 токенов в секунду в Codex, что в восемь раз быстрее обычного режима. Однако сопоставлять эти цифры напрямую нельзя: за один месяц в анонсах встречаются Terminal-Bench 2.1 и 4.0, OSWorld 2.0 и 2.1, GDPval-AA v2 и v2.1, CursorBench 3.2 и 4.0, а эффективность измеряется на разных уровнях effort. Даже совпадение названия бенчмарка не гарантирует одинаковую методику. Отдельно стоит отметить, что Anthropic перенаправляет большинство задач по кибербезопасности Opus 5.5 на Opus 4.8, то есть часть возможностей новой модели сознательно ограничена по соображениям безопасности.

Дальнейшее развитие событий зависит от того, как долго вендоры смогут удерживать расхождение между ценой токена и стоимостью вычислений. Обязательства Anthropic на 518 млрд долларов и раунд OpenAI, о котором говорят в контексте триллионной оценки, предполагают, что финансирование дешевых токенов продолжится как минимум до выхода на публичные рынки. Для разработчиков это означает, что прайс за миллион токенов окончательно перестает быть надежным ориентиром: считать нужно стоимость конкретной задачи с учетом кэша, длины системного промпта и профиля нагрузки. Открытыми остаются вопросы о том, что произойдет с ценами после IPO, сохранится ли неотключаемый thinking в следующих версиях Claude и не приведет ли рост стоимости памяти и аренды ускорителей к тому, что скидки придется компенсировать где-то еще. Пока же рынок движется в сторону, где дешевый токен и дорогое железо существуют одновременно, а разницу оплачивает инвестор.

Читайте также