OpenAI выпустила две новые модели семейства GPT-6 — GPT-6 Sol и GPT-6 Luna. Они стоят ниже GPT-6 Astra, вышедшей ранее в этом месяце, и обучены схожими методами: цель — перенести наработки старшей модели в более быстрые и дешёвые решения. Обе уже доступны в API под именами gpt-6-sol и gpt-6-luna.
Это API-only модели: весов для самостоятельного развёртывания нет. Для администраторов и разработчиков это значит, что вариантов «поставить локально» не появилось — только облачный вызов.
Три уровня семейства GPT-6
Семейство теперь делится на три уровня. Astra — старшая модель для самых сложных задач. Sol нацелена на сложное программирование и профессиональные задачи при меньшей стоимости. Luna рассчитана на быструю повседневную работу с большими объёмами запросов.
По заявлению команды OpenAI, улучшенное кэширование и инференс позволяют отдавать эти модели дешевле. Цены API для Sol и Luna снижены на 50% относительно промо-тарифов GPT-5.6.
| Модель | Вход (за 1 млн токенов) | Выход (за 1 млн токенов) |
|---|---|---|
| GPT-6 Astra | $10.00 | $50.00 |
| GPT-6 Sol | $2.00 (было $4) | $10.00 (было $20) |
| GPT-6 Luna | $0.10 (было $0.20) | $0.50 (было $1.20) |
Одна деталь: цена выхода у Luna падает с $1.20 до $0.50 — это сокращение примерно на 58%, а не на 50%.
Что показывают бенчмарки
Профессиональные задачи. На AutomationBench 1.0.6 Sol при усилии xhigh набирает 33.2% при $0.27 за задачу. Claude Opus 5 на максимальном усилии — 26.9% при стоимости в 11.1 раза выше. Astra на низком усилии — 30.3% при затратах в 3.9 раза больше, чем у Sol. Luna на высоком усилии прибавляет 5.4 пункта к предшественнику при стоимости за задачу на 58% ниже.
На Agents' Last Exam Sol на максимальном усилии показывает 56.4% — это выше лучшего результата Claude Opus 5 при стоимости за задачу на 60% ниже.
Программирование. На DeepSWE v1.1 Sol на максимальном усилии даёт 68.8% — на 1.1 пункта меньше, чем Claude Fable 5 на xhigh, при стоимости за задачу примерно на 80% ниже. Luna на максимальном усилии — 66.6%, что сопоставимо с Opus 5 и Fable 5 на среднем усилии. В этих сравнениях Luna обходится на 93% дешевле Opus 5 и на 96% дешевле Fable 5 за задачу. Похожие задачи закрывает и кодинг-модель Cognition SWE-2, построенная на базе Kimi K3.
На FrontierCode 1.1 Main, который оценивает готовность кода к слиянию, Sol не уступает Claude Fable 5.1 на xhigh при существенно меньшей стоимости.
Работа с компьютером. На OSWorld 2.0 offline Sol на xhigh набирает 60.5% против 60.3% у Opus 5 на среднем усилии, а стоимость за задачу примерно на 80% ниже. Luna на максимальном усилии обходит GPT-5.6 Sol на среднем за 1/10 стоимости.
Достоверность. Внутренний тест OpenAI использует деперсонализированные диалоги ChatGPT, где пользователи отметили ошибки модели. Sol делает примерно вдвое меньше ошибок, чем предшественник. Luna на повышенном усилии соответствует GPT-5.6 Sol примерно за 1/100 стоимости.
OpenAI также перенесла в новые модели стиль общения Astra: ответы должны стать яснее и чуть короче, с меньшим количеством жаргона, особенно в разговорах о коде.
Кэш промптов для долгоживущих агентов
Агенты на каждом шаге заново отправляют одни и те же инструкции, описания инструментов и историю. GPT-6 поставляется с улучшенной системой кэширования промптов: по умолчанию выше доля попаданий в кэш. Чтение из кэша даёт скидку до 90%. Теперь под это подпадают и общие префиксы, переиспользованные в течение 30 минут.
Для разработчиков появились новые элементы управления:
- Prompt Caching Dashboard отслеживает долю попаданий во времени.
- Диагностический инструмент объясняет промахи, например
"reason": "tools_changed". - Явные точки останова позволяют выбрать, где заканчивается кэшируемый префикс.
- Усилие рассуждения можно менять посреди диалога через
configuration_update, не ломая кэш. - allowed_tools ограничивает набор вызываемых инструментов, сохраняя стабильность определений.
- Prewarming готовит известный контекст до первого запроса пользователя.
Полное руководство по кэшированию промптов описывает каждый из этих шаблонов. По данным GitHub, эти изменения сократили долю токенов промптов, требующих свежей обработки, более чем на 50%, что помогает Copilot отвечать быстрее.
Где доступны Sol и Luna
- API:
gpt-6-solиgpt-6-luna. - ChatGPT Work и Codex: пользователи Plus, Pro, Business, Enterprise и Edu.
- Free и Go: Luna в десктопном приложении ChatGPT.
- Chat: пока нет.
Развёртывание в ChatGPT идёт постепенно в течение дня запуска.
Частые вопросы
Кого касается это обновление?
Разработчиков и компании, которые платят за вызовы OpenAI API, а также пользователей тарифов Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex. Для тех, кто считает бюджет на токены, снижение цен на Sol и Luna — прямое сокращение расходов.
Насколько именно подешевел API?
Sol: $2 за миллион входных токенов вместо $4 и $10 за миллион выходных вместо $20. Luna: $0.10 вместо $0.20 за вход и $0.50 вместо $1.20 за выход. Для Luna фактическое снижение цены выхода — около 58%.
Можно ли развернуть Sol или Luna на своих серверах?
Нет. Это API-only модели, весов для самостоятельного хостинга OpenAI не публикует. Локальный инференс на своём железе недоступен.
Чем Sol отличается от Luna?
Sol — для сложного программирования и профессиональных задач, Luna — для быстрой повседневной работы с большими объёмами. Обе дешевле Astra, которая остаётся старшей моделью для самых тяжёлых задач.
Как сэкономить на вызовах новых моделей?
Использовать кэширование промптов: чтение из кэша даёт скидку до 90%, а общие префиксы, переиспользованные в течение 30 минут, теперь тоже учитываются. Помогают явные точки останова и диагностика промахов через "reason": "tools_changed".
Доступны ли модели в ChatGPT?
В ChatGPT Work и Codex — да, для тарифов Plus, Pro, Business, Enterprise и Edu. На Free и Go Luna доступна в десктопном приложении ChatGPT. В Chat моделей пока нет, развёртывание идёт постепенно в день запуска.
Насколько Sol и Luna лучше предшественников?
По данным OpenAI, Sol делает примерно вдвое меньше ошибок, чем предшественник, а Luna на повышенном усилии соответствует GPT-5.6 Sol примерно за 1/100 стоимости. На AutomationBench Sol при усилии xhigh обходит Claude Opus 5 на максимальном усилии при стоимости в 11 раз ниже.
Источник: marktechpost.com