Опубликовано
Фронтир подешевел: считаем экономику GPT-6 Sol и Opus 5.5
Автор: Гусев Николай [портфолио]
Дата обновления не указана в исходнике.
Темы: llm-api, benchmarks, token-economics
22 сентября 2026 года OpenAI выпустила GPT-6 Sol и Luna, а Anthropic в тот же день уронила цену Opus 5.5. Лента кричит про бенчи и революцию. Я задала себе скучный вопрос: на каких задачах токенэкономика этих моделей сходится, а на каких нет - и посчитала. Цены, лимиты подписок и бенчи ниже проверены по первоисточникам 22.09, расчёты воспроизводятся на калькуляторе.

Что именно вышло
Сначала факты, потому что в ленте их уже перемешали.
GPT-6 Sol - новый фронтир OpenAI: $2 за миллион инпут-токенов и $10 за миллион аутпута. Вдвое дешевле GPT-5.6 Sol ($4/$20), который уходит на пенсию - у меня в интерфейсе ChatGPT уже висит плашка об этом. GPT-6 Luna стоит $0.10/$0.50 - это не модель для разговоров, это модель для фоновой возни: маршрутизация, извлечение, классификация, батч-обработка.
Claude Opus 5.5 вышел в тот же день за $4/$20 против $5/$25 у Opus 5. По замеру Artificial Analysis он забрал вершину их Intelligence Index: 58 очков, плюс пять сразу к предыдущему лидеру Fable 5.1 и GPT-6 Astra. Плюс 20% дешевле предшественника и 30% быстрее на выдаче.
GPT-6 Astra никуда не делась: $10/$50, самый дорогой фронтир на рынке. Премиум за длинные автономные задачи.
Сколько стоит одна агентная сессия
Мой профиль типичной агентной сессии: 600 тысяч инпут-токенов, 40 тысяч аутпута, половина инпута обслуживается из кэша. Это не абстракция: агент в Hermes, Claude Code или Codex читает системный промпт и кодовую базу много раз за сессию, а отвечает мало. Именно поэтому соотношение инпута к аутпуту 15 к 1.
Считаем в долларах:
Модель ин/аут $/М кэш $/М сессия $200 = сессий/мес
GPT-6 Astra 10/50 5.00 $6.50 31
Opus 5 5/25 2.50 $3.25 62
GPT-5.6 Sol 4/20 2.00 $2.60 77
Opus 5.5 4/20 0.20 $2.06 97
Sonnet 5 2/10 0.50 $1.15 174
GPT-6 Sol 2/10 1.00 $1.15 174
GPT-6 Luna 0.1/0.5 0.025 $0.06 3478
Кэш-рейт Opus 5.5 подтверждён - $0.20 за миллион, Anthropic срезала его в полтора раза. Для GPT-6 Sol я брала консервативно $1/М. GPT-6 Sol отдаёт уровень прошлого фронтира по цене вчерашнего миддла. Это главная новость дня, а не очки в бенчах.
Когда подписка за $100-200 окупается
Подписка - это кредитное плечо, и оно работает только при ежедневном выжигании лимитов.
Claude Max 20x за $200 в месяц по замерам сообщества даёт около $1100 API-эквивалента в неделю, то есть примерно $4700 в месяц при полном выжигании. Плечо 24x. В пересчёте на мои сессии это около 3000 запусков Opus 5.5 в месяц за $200.
Теперь обратная сторона. Если у вас 20-30 агентных сессий в месяц, вы платите $200 за то, что по API стоило бы $40-60. Подписка окупается в одном случае: автономный кодинг каждый рабочий день, агенты гоняются часами, лимиты реально упираются. Если нет - API с кэшем выгоднее.
У OpenAI лимиты Astra на Pro 20x - 100-900 задач в пятичасовом окне, но Astra за $6.50 за сессию по API всё равно держит дистанцию от миддла: это инструмент для задач, где провал дороже цены.
Правило трёх попыток
Главный вопрос не "умная ли модель", а "какой у неё процент задач, решённых с первой попытки, на вашем коде". Посчитаем брейк-эвен.
Миддл-класс (Sonnet 5 или GPT-6 Sol) стоит $1.15 за сессию. Фронтир-класс (Opus 5.5) - $2.06. Если миддл решает задачу с первой попытки, он всегда дешевле, спор закрыт. Если миддлу нужны две попытки ($2.30) - он уже дороже одного прохода Opus 5.5. Три попытки ($3.45) - фронтир дешевле в полтора раза.
Отсюда практический вывод: прежде чем платить за фронтир или отказываться от него, замерьте на десяти своих реальных задачах, сколько попыток делает дешёвая модель. Три и больше - покупайте фронтир. Одна - не покупайте. Это час работы, который экономит тысячи долларов в год.
Масштаб 1-2 миллиарда токенов в месяц
На этом объёме разговор про подписки заканчивается. Один полностью выжженный Max 20x даёт $4700 API-эквивалента в месяц, а миллиард токенов на Opus 5.5 стоит $3548 - надо выжигать лимит на 100% каждый день без простоев, и это ещё нарушение ToS при корпоративном использовании персонального плана. Только API.
База для расчёта: миллиард токенов, 90% инпут, 10% аутпут, кэш-хиты 60%. Два миллиарда - умножайте на два.
Модель 1 млрд ток/мес batch (-50%)
Opus 5.5 $3,548 $1,774
GPT-6 Sol $2,260 $1,130
Sonnet 5 $1,990 $995
GPT-6 Luna $100 $50
GPT-6 Astra $11,300 $5,650
Каскад меняет всё. Разбираем трафик по ролям: 92% на Luna (маршрутизация, извлечение, классификация), 6% на GPT-6 Sol (рабочий кодинг), 2% на Opus 5.5 (судья и сложные случаи):
Всё на Luna $166/мес
Каскад 92/6/2 $298/мес
Всё на Sol $2,260/мес (x8 к каскаду)
Всё на Opus 5.5 $3,548/мес (x12 к каскаду)
Всё на Astra $11,300/мес (x38 к каскаду)
Годовая дельта между "всё на Opus 5.5" и каскадом - $39 тысяч на каждый миллиард токенов. Между "всё на Sol" и каскадом - $23.6 тысячи. Каскад на пять-десять инженерных дней окупается за один-два месяца. Batch-режим для фоновой возни - ещё минус половина счёта без единой строчки кода маршрутизации.
Вопрос "оправдан ли дорогой фронтир" на этом масштабе неправильный. Правильный: какая доля трафика вообще требует фронтира. На практике - 2-8%.
Насколько революционны бенчи
На очках - не очень. DeepSWE: Astra 74.1% против 72.7% у GPT-5.6 Sol - плюс полтора очка за цену в два с половиной раза выше. Независимый разбор подтверждает: у Astra нет агрегированного скачка против 5.6 Sol, индекс тот же, а на максимальном усилии задача обходится примерно на 75% дороже.
Но два результата настоящие.
Первый: Intelligence Index Opus 5.5 - 58 очков, плюс пять к предыдущему SOTA. Скачки по +1-2 в этом индексе норма, +5 - редкость.
Второй, и он важнее: GDPval-AA, Opus 5.5 на среднем усилии обходит GPT-6 Astra на максимальном - примерно $0.85 против $4.50 за задачу. Та же работа в пять раз дешевле. Вот где революция: не в новых способностях, а в цене единицы работы.
Есть и ложка дёгтя. Opus 5.5 - жадная модель: по замерам AA она потребляет больше всего токенов на задачу среди всех замеренных, так что часть скидки съедается аппетитом. И это осознанный ход Anthropic: резать цену за токен, зная, что модель будет тратить их больше.
Что делать
Для разработчика с агентным воркфлоу: GPT-6 Sol - новый дефолт для рабочего кодинга по цене Sonnet-класса. Opus 5.5 - судья и эскалация. Luna - вся фоновая возня, она практически бесплатна. Astra - только там, где провал задачи дороже $6 за сессию, и таких задач меньше, чем кажется.
Для владельца прод-трафика на 1-2 миллиарда токенов: подписки не при чём, считайте каскад. Разделение трафика по ролям стоит несколько инженерных дней и отыгрывается за месяц-два.
Революция не в бенчах. Она в том, что уровень прошлого фронтира теперь стоит цену вчерашнего миддла - и это перекраивает бюджет сильнее, чем любые очки в индексах.
Источники
Цены GPT-6 Sol и Luna: The New Stack, Reuters, 22.09.2026
Цены и контекст линейки Claude: документация Anthropic
Замеры Opus 5.5, GDPval-AA, цитаты AA: Techmeme за 22.09.2026
Бенчи GPT-6 Astra и стоимость за задачу: Artificial Analysis, MindStudio
Лимиты Astra на подписках: справка OpenAI
API-эквивалент лимитов Claude Max: замер сообщества r/ClaudeAI
