ai · openai · gpt-6 · coding-agents · gpt-6-sol · gpt-6-luna · api-pricing · prompt-caching28 сентября в 02:32 · 5 мин

GPT-6 Sol и Luna: доступный интеллект для сложных рабочих задач

Компания OpenAI представила две новые модели в семействе GPT-6: GPT-6 Sol и GPT-6 Luna. Эти модели предназначены для решения сложных профессиональных задач, предлагая высокое качество результатов и надёжность по аналогии с флагманской GPT-6 Astra, но при значительно более низкой стоимости. Обе модели снизили цену на 50% по сравнению с предыдущим поколением и включают улучшенное кэширование промптов, что делает их экономически эффективными инструментами как для индивидуальной разработки, так и для масштабных корпоративных агентов.

# GPT-6 Sol и Luna: доступный интеллект для сложных рабочих задач

В начале месяца компания OpenAI представила модель GPT-6 Astra — наиболее интеллектуальную и согласованную с заданными принципами систему до сих пор. Однако для большинства реальных сценариев использования не требуется максимальной вычислительной мощности Astra. Задачи в мире программирования и бизнеса варьируются по масштабу, требуя разную скорость обработки и бюджетные решения.

Для балансировки между производительностью и стоимостью семейство GPT-6 расширено двумя новыми моделями: GPT-6 Sol и GPT-6 Luna. Как поясняется в официальной документации, эти модели позволяют сделать преимущества нового поколения AI доступнее за счёт повышенной эффективности.

*Примечание редактора: Если задача критически важна и не допустит даже малейшего риска ошибки, стоит вернуться к использованию GPT-6 Astra. Sol и Luna — это компромиссный выбор для рутинных, итеративных и ресурсоёмких процессов.*

Экономическая эффективность и ценообразование

Ключевой инновацией новых моделей стало снижение стоимости API. Благодаря улучшениям в кэшировании и механизмах инференса (вывода), стоимость обслуживания моделей уменьшилась, и эта экономия передана пользователям напрямую.

Цены для GPT-6 Sol и GPT-6 Luna снижены на 50% по сравнению с промо-тарифами на модели GPT-5.6. Ниже приведена сравнительная таблица цен за миллион входных и выходных токенов (сравнение GPT-5.6 против новых версий):

| Модель | Входные токены ($/млн) | Выходные токены ($/млн) | Снижение цены | | :--- | :---: | :---: | :---: | | GPT-6 Sol | $2 (было $4) | $10 (было $20) | -50% | | GPT-6 Luna | $0.10 (было $0.20) | $0.50 (было $1.20) | -50% |

Цены указаны в долларах США за миллион токенов. GPT-6 Sol ориентирована на сложные рабочие сценарии, предлагая больше лимитов на использование и более низкую стоимость итераций по сравнению с конкурентами в том же ценовом сегменте.

Профессиональные задачи и фактическая точность

Обе новые модели прошли rigorous тестирование на способности решать реальные бизнес-процессы. В бенчмарке AutomationBench, который оценивает выполнение сквозных рабочих процессов (продажи, маркетинг, HR, финансы), GPT-6 Sol продемонстрировала выдающуюся производительность.

На максимальном уровне усилий (xhigh) GPT-6 Sol показала результат в 33,2%, при этом стоимость выполнения одной задачи составила всего $0,27. Это результат выше, чем у Claude Opus 5 (максимальный уровень усилий), при том что стоимость задачи Opus 5 оказалась выше в 11,1 раза. Также Sol превзошла модель Claude Fable 5.1, которая в тесте имела более высокий показатель эффективности только за счёт редких fallback-переходов на мощную модель Opus.

GPT-6 Luna также показала значительный прогресс. На высоких уровнях усилий она достигла уровня эффективности предшественника, но при этом стоимость задачи снизилась на 58%. В тесте Agents' Last Exam, оценивающем экономически значимые задачи из 55 подотраслей, GPT-6 Sol набрала 56,4%, превысив лучший результат Claude Opus 5 и обойдясь при этом на 60% дешевле.

Важным аспектом является фактическая точность. Во внутренних тестах, основанных на обезличенных реальных диалогах, где модели ранее допускали ошибки, GPT-6 Sol допускает примерно вдвое меньше фактических ошибок, чем её предшественник. По надёжности она приближается к уровню GPT-6 Astra, сохраняя при этом более низкую стоимость.

Программирование и работа с кодом

Использование кодировщиков (coding-agents) внутри OpenAI растёт экспоненциально. Исследователи из верхних процентов по использованию API тратят сотни и тысячи долларов ежедневно. Новые модели направлены на снижение этого барьера входа без потери качества.

В бенчмарке FrontierCode, который оценивает способность агентов вносить в реальные репозитории изменения, готовые к слиянию, GPT-6 Sol заметно превосходит GPT-5.6 Sol и достигает уровня Claude Fable 5.1.

В тесте DeepSWE, проверяющем решение сложных задач по разработке ПО в реальных кодовых базах: * GPT-6 Sol (xhigh) достигла 68,8%, что лишь на 1,1 процентного пункта ниже рекордсмена Claude Fable 5 (69,9%) при стоимости задачи, которая примерно на 80% ниже. * GPT-6 Luna (xhigh) набрала 66,6%, что сопоставимо с результатами Claude Opus 5 и Fable 5 при среднем уровне усилий, но при стоимости задачи на 93%–96% ниже.

Также было отмечено улучшение стиля взаимодействия в технических обсуждениях. Ответы моделей стали чище, с меньшим количеством жаргона и неестественных формулировок. Примеры диалогов показывают, что новые модели быстрее приходят к сути решения, экономя токены и время пользователя.

Улучшение кэширования и согласованности

Одной из технических инноваций стало улучшение prompt caching. Разработчики могут повторно использовать контекст, получая скидку до 90% на чтение закэшированных входных токенов. Это особенно важно для агентов, использующих большие объемы контекста.

Теперь уровень рефлексии (reasoning effort) и доступность инструментов можно менять динамически, не сбрасывая накопленный кэш. Согласно данным GitHub, эти улучшения позволили сократить на более чем 50% долю токенов, которые приходилось обрабатывать заново, на миллиардах запросов.

В части alignment (содержательного выравнивания) модели показывают лучшие результаты, чем их аналоги из поколения GPT-5.6. В провокационных тестах на обман при работе с кодом, сокрытие сломанных инструментов и попытки обойти системы безопасности GPT-6 Sol и Luna демонстрируют значительное снижение частоты ошибок по сравнению с предшественниками.

Доступность

GPT-6 Sol и GPT-6 Luna доступны для всех подписчиков планов Plus, Pro, Business, Enterprise и Edu в экосистеме ChatGPT Work и Codex. Модели уже запущены в OpenAI API под идентификаторами gpt-6-sol и gpt-6-luna.

Пользователи тарифов Free и Go могут использовать модель GPT-6 Luna через десктопное приложение. Распространение новых версий внутри веб-интерфейса ChatGPT планируется постепенным в течение суток для сохранения стабильности сервиса.

Система тестируется в исследовательской среде, поэтому результаты могут незначительно отличаться от поведения в продакшене. Тем не менее, представленный набор инструментов открывает новые горизонты для эффективного использования искусственного интеллекта в повседневной разработке и бизнес-процессах.

Первоисточники

Habr AI ↗
← Вернуться в эфир