← Лендинг Hermes Agent

Опубликовано

Фронтир подешевел: считаем экономику GPT-6 Sol и Opus 5.5

Автор: Гусев Николай [портфолио]

Дата обновления не указана в исходнике.

Темы: llm-api, benchmarks, token-economics

22 сентября 2026 года OpenAI выпустила GPT-6 Sol и Luna, а Anthropic в тот же день уронила цену Opus 5.5. Лента кричит про бенчи и революцию. Я задала себе скучный вопрос: на каких задачах токенэкономика этих моделей сходится, а на каких нет - и посчитала. Цены, лимиты подписок и бенчи ниже проверены по первоисточникам 22.09, расчёты воспроизводятся на калькуляторе.

Джилл за барной стойкой: три бокала - три ценовых класса GPT-6 Astra, Opus 5.5, GPT-6 Sol

Что именно вышло

Сначала факты, потому что в ленте их уже перемешали.

GPT-6 Sol - новый фронтир OpenAI: $2 за миллион инпут-токенов и $10 за миллион аутпута. Вдвое дешевле GPT-5.6 Sol ($4/$20), который уходит на пенсию - у меня в интерфейсе ChatGPT уже висит плашка об этом. GPT-6 Luna стоит $0.10/$0.50 - это не модель для разговоров, это модель для фоновой возни: маршрутизация, извлечение, классификация, батч-обработка.

Claude Opus 5.5 вышел в тот же день за $4/$20 против $5/$25 у Opus 5. По замеру Artificial Analysis он забрал вершину их Intelligence Index: 58 очков, плюс пять сразу к предыдущему лидеру Fable 5.1 и GPT-6 Astra. Плюс 20% дешевле предшественника и 30% быстрее на выдаче.

GPT-6 Astra никуда не делась: $10/$50, самый дорогой фронтир на рынке. Премиум за длинные автономные задачи.

Сколько стоит одна агентная сессия

Мой профиль типичной агентной сессии: 600 тысяч инпут-токенов, 40 тысяч аутпута, половина инпута обслуживается из кэша. Это не абстракция: агент в Hermes, Claude Code или Codex читает системный промпт и кодовую базу много раз за сессию, а отвечает мало. Именно поэтому соотношение инпута к аутпуту 15 к 1.

Считаем в долларах:

Модель         ин/аут $/М   кэш $/М   сессия   $200 = сессий/мес
GPT-6 Astra    10/50        5.00      $6.50    31
Opus 5         5/25         2.50      $3.25    62
GPT-5.6 Sol    4/20         2.00      $2.60    77
Opus 5.5       4/20         0.20      $2.06    97
Sonnet 5       2/10         0.50      $1.15    174
GPT-6 Sol      2/10         1.00      $1.15    174
GPT-6 Luna     0.1/0.5      0.025     $0.06    3478

Кэш-рейт Opus 5.5 подтверждён - $0.20 за миллион, Anthropic срезала его в полтора раза. Для GPT-6 Sol я брала консервативно $1/М. GPT-6 Sol отдаёт уровень прошлого фронтира по цене вчерашнего миддла. Это главная новость дня, а не очки в бенчах.

Когда подписка за $100-200 окупается

Подписка - это кредитное плечо, и оно работает только при ежедневном выжигании лимитов.

Claude Max 20x за $200 в месяц по замерам сообщества даёт около $1100 API-эквивалента в неделю, то есть примерно $4700 в месяц при полном выжигании. Плечо 24x. В пересчёте на мои сессии это около 3000 запусков Opus 5.5 в месяц за $200.

Теперь обратная сторона. Если у вас 20-30 агентных сессий в месяц, вы платите $200 за то, что по API стоило бы $40-60. Подписка окупается в одном случае: автономный кодинг каждый рабочий день, агенты гоняются часами, лимиты реально упираются. Если нет - API с кэшем выгоднее.

У OpenAI лимиты Astra на Pro 20x - 100-900 задач в пятичасовом окне, но Astra за $6.50 за сессию по API всё равно держит дистанцию от миддла: это инструмент для задач, где провал дороже цены.

Правило трёх попыток

Главный вопрос не "умная ли модель", а "какой у неё процент задач, решённых с первой попытки, на вашем коде". Посчитаем брейк-эвен.

Миддл-класс (Sonnet 5 или GPT-6 Sol) стоит $1.15 за сессию. Фронтир-класс (Opus 5.5) - $2.06. Если миддл решает задачу с первой попытки, он всегда дешевле, спор закрыт. Если миддлу нужны две попытки ($2.30) - он уже дороже одного прохода Opus 5.5. Три попытки ($3.45) - фронтир дешевле в полтора раза.

Отсюда практический вывод: прежде чем платить за фронтир или отказываться от него, замерьте на десяти своих реальных задачах, сколько попыток делает дешёвая модель. Три и больше - покупайте фронтир. Одна - не покупайте. Это час работы, который экономит тысячи долларов в год.

Масштаб 1-2 миллиарда токенов в месяц

На этом объёме разговор про подписки заканчивается. Один полностью выжженный Max 20x даёт $4700 API-эквивалента в месяц, а миллиард токенов на Opus 5.5 стоит $3548 - надо выжигать лимит на 100% каждый день без простоев, и это ещё нарушение ToS при корпоративном использовании персонального плана. Только API.

База для расчёта: миллиард токенов, 90% инпут, 10% аутпут, кэш-хиты 60%. Два миллиарда - умножайте на два.

Модель         1 млрд ток/мес   batch (-50%)
Opus 5.5       $3,548           $1,774
GPT-6 Sol      $2,260           $1,130
Sonnet 5       $1,990           $995
GPT-6 Luna     $100             $50
GPT-6 Astra    $11,300          $5,650

Каскад меняет всё. Разбираем трафик по ролям: 92% на Luna (маршрутизация, извлечение, классификация), 6% на GPT-6 Sol (рабочий кодинг), 2% на Opus 5.5 (судья и сложные случаи):

Всё на Luna            $166/мес
Каскад 92/6/2          $298/мес
Всё на Sol             $2,260/мес   (x8 к каскаду)
Всё на Opus 5.5        $3,548/мес   (x12 к каскаду)
Всё на Astra           $11,300/мес  (x38 к каскаду)

Годовая дельта между "всё на Opus 5.5" и каскадом - $39 тысяч на каждый миллиард токенов. Между "всё на Sol" и каскадом - $23.6 тысячи. Каскад на пять-десять инженерных дней окупается за один-два месяца. Batch-режим для фоновой возни - ещё минус половина счёта без единой строчки кода маршрутизации.

Вопрос "оправдан ли дорогой фронтир" на этом масштабе неправильный. Правильный: какая доля трафика вообще требует фронтира. На практике - 2-8%.

Насколько революционны бенчи

На очках - не очень. DeepSWE: Astra 74.1% против 72.7% у GPT-5.6 Sol - плюс полтора очка за цену в два с половиной раза выше. Независимый разбор подтверждает: у Astra нет агрегированного скачка против 5.6 Sol, индекс тот же, а на максимальном усилии задача обходится примерно на 75% дороже.

Но два результата настоящие.

Первый: Intelligence Index Opus 5.5 - 58 очков, плюс пять к предыдущему SOTA. Скачки по +1-2 в этом индексе норма, +5 - редкость.

Второй, и он важнее: GDPval-AA, Opus 5.5 на среднем усилии обходит GPT-6 Astra на максимальном - примерно $0.85 против $4.50 за задачу. Та же работа в пять раз дешевле. Вот где революция: не в новых способностях, а в цене единицы работы.

Есть и ложка дёгтя. Opus 5.5 - жадная модель: по замерам AA она потребляет больше всего токенов на задачу среди всех замеренных, так что часть скидки съедается аппетитом. И это осознанный ход Anthropic: резать цену за токен, зная, что модель будет тратить их больше.

Что делать

Для разработчика с агентным воркфлоу: GPT-6 Sol - новый дефолт для рабочего кодинга по цене Sonnet-класса. Opus 5.5 - судья и эскалация. Luna - вся фоновая возня, она практически бесплатна. Astra - только там, где провал задачи дороже $6 за сессию, и таких задач меньше, чем кажется.

Для владельца прод-трафика на 1-2 миллиарда токенов: подписки не при чём, считайте каскад. Разделение трафика по ролям стоит несколько инженерных дней и отыгрывается за месяц-два.

Революция не в бенчах. Она в том, что уровень прошлого фронтира теперь стоит цену вчерашнего миддла - и это перекраивает бюджет сильнее, чем любые очки в индексах.

Источники

Цены GPT-6 Sol и Luna: The New Stack, Reuters, 22.09.2026

Цены и контекст линейки Claude: документация Anthropic

Замеры Opus 5.5, GDPval-AA, цитаты AA: Techmeme за 22.09.2026

Бенчи GPT-6 Astra и стоимость за задачу: Artificial Analysis, MindStudio

Лимиты Astra на подписках: справка OpenAI

API-эквивалент лимитов Claude Max: замер сообщества r/ClaudeAI