Новое поколение в ограниченном обзоре

2 октября 2026 года OpenAI объявила о начале ограниченного обзора GPT-5.6 — нового поколения моделей искусственного интеллекта (ИИ). Серия включает три отдельные модели: самый мощный флагман Sol, сбалансированную Terra для повседневных задач и быструю и доступную Luna. Terra показывает результаты, сопоставимые с GPT-5.5, по цене вдвое ниже, а Luna предлагает сильные возможности на самом низком ценовом уровне OpenAI. По данным компании, Sol запускается с самым прочным стеком безопасности в её истории — после нескольких недель тестирования и усиления защиты. На первом этапе модели открываются только для ограниченного круга партнёров — через API и Codex, о чём сообщается в официальном блоге OpenAI. Причина — запрос правительства США: официальные лица хотят изучить возможности моделей до их широкого распространения. Широкий доступ сначала откроется для доверенных партнёров через API и Codex, а затем охват будет расширен. OpenAI планирует выпустить все три модели в широкий доступ в ближайшие недели.

Три модели: Sol, Terra и Luna

В новой серии OpenAI предлагает трёхуровневую систему вместо одной универсальной модели. Sol представлен как флагман серии и самая мощная модель, созданная компанией на сегодняшний день. Он демонстрирует агентные возможности в кодинге, биологии и кибербезопасности — показатели по этим трём направлениям подробно приведены в разделах ниже. Terra — сбалансированный вариант для повседневных задач: он рассчитан на выполнение большого объёма рутинных задач по низкой цене, показывая результаты, сопоставимые с GPT-5.5, но вдвое дешевле. Luna описана как быстрая и доступная модель, предлагающая сильные возможности по самой низкой цене в истории OpenAI.

Эта трёхуровневая структура отражает новый подход OpenAI к именованию моделей — ранее компания пересматривала названия моделей (см. связанную статью). Теперь каждая модель ориентирована на конкретную задачу: Sol — для самых тяжёлых задач, Terra — для повседневной рабочей нагрузки, Luna — для высокопроизводительных и доступных решений. Разница в ценах существенная: Terra показывает результат уровня флагмана предыдущего поколения за полцены, а Luna устанавливает совершенно новый нижний ценовой порог — оставаясь самой доступной моделью, которую предлагала OpenAI, она сохраняет сильные возможности.

Цены за миллион токенов установлены следующие: Sol — вход $5, выход $30; Terra — вход $2,50, выход $15; Luna — вход $1, выход $6. Sol находится на самом высоком ценовом уровне: он предназначен для самых тяжёлых и требовательных задач. Terra занимает средний уровень — результат уровня GPT-5.5 предлагается по цене вдвое ниже. Luna же занимает самый низкий ценовой уровень OpenAI: $1 за миллион входных токенов, $6 за миллион выходных. В пересчёте на миллион токенов цена выхода во всех трёх моделях в шесть раз выше цены входа: у Sol $30 против $5, у Terra $15 против $2,50, у Luna $6 против $1. Выходная цена Sol в $30 — самая высокая среди трёх моделей, что отражает его высочайший уровень интеллекта.

Новые режимы: «max» и «ultra»

Вместе с GPT-5.6 представлены два новых режима рассуждения. «max» — новый уровень reasoning effort, выделяющий максимум времени на размышления; он позволяет Sol проводить самый глубокий анализ. Для сложных задач дополнительное время на «раздумья» напрямую влияет на качество результата: модель продумывает больше шагов, прежде чем ответить.

Режим «ultra» выходит за пределы одного агента и ускоряет сложную работу с помощью субагентов — небольших вспомогательных агентов. В этом режиме основной агент разбивает задачу на мелкие части и поручает их субагентам; субагенты работают одновременно и параллельно, возвращая результаты основному агенту. По словам OpenAI, «ultra» предназначен для координации нескольких независимых процессов и параллельного выполнения больших объёмов задач. Этот подход позволяет работать одновременно в нескольких направлениях вместо одного последовательного процесса.

Результаты бенчмарков: кодинг

В области кодинга GPT-5.6 Sol установил новый рекорд в тесте Terminal-Bench 2.1. Этот бенчмарк оценивает рабочие процессы, выполняемые через командную строку, — задачи, требующие планирования, итераций и координации инструментов. Такие тесты измеряют поведение модели в реальной среде разработки: от неё требуется не только писать код, но и выполнять команды в терминале, исправлять ошибки и реализовывать многоэтапный план. Рекордный результат демонстрирует лидерство Sol в области агентного кодинга. Поскольку Terminal-Bench 2.1 ориентирован именно на агентные рабочие процессы, этот результат подтверждает способность модели самостоятельно выполнять сложные задания.

Результаты бенчмарков: биология и кибербезопасность

В области биологии модель показала в тесте GeneBench v1 результат сильнее, чем GPT-5.5, — при этом потратив меньше токенов. GeneBench оценивает долгосрочные геномные и количественные биологические анализы: эти тесты включают длительные анализы геномных последовательностей и количественные биологические вычисления. Более высокий результат при меньшем числе токенов означает рост эффективности модели: то же или лучшее качество получено при меньших вычислительных затратах.

В области кибербезопасности Sol показал в тесте ExploitBench результат, сопоставимый с моделью Mythos Preview, — для этого хватило примерно трети выходных токенов. То есть равный с конкурентом результат получен при втрое меньшем расходе токенов, что демонстрирует высокую эффективность модели в задачах кибербезопасности — такой же уровень результата при меньших вычислительных затратах. При этом модель не перешла порог «Cyber Critical» по системе Preparedness Framework компании OpenAI — официально зафиксировано, что наивысший уровень риска не достигнут.

Стек безопасности: многоуровневая защита

По сообщению OpenAI, GPT-5.6 Sol запускается с самым прочным стеком безопасности в истории компании. Защита была сформирована после нескольких недель red teaming (тестов с симуляцией атак) и работ по укреплению системы. Меры безопасности усилены по трём направлениям: деятельность с высоким риском, чувствительные киберзапросы и случаи повторного злоупотребления. Защита в течение нескольких недель тестировалась и укреплялась против реальных сценариев атак именно по этим направлениям.

В официальном заявлении говорится:

"GPT-5.6 Sol launches with OpenAI's most robust safety stack to date, after multiple weeks of red-teaming and hardening, with strengthened protections for higher-risk activity, sensitive cyber requests, and repeated misuse." — официальный блог OpenAI

Для автоматизированного red teaming выделено более 700 тысяч A100-эквивалентных GPU-часов вычислительной мощности. Основной целью тестов было выявление универсальных джейлбрейков — методов атак, работающих во многих запросах и контекстах и не привязанных к одному узкому сценарию. В течение нескольких недель искались уязвимости, система испытывалась под давлением и укреплялась против реальных атак. Кроме того, при участии сторонних экспертов был проведён масштабный человеческий red teaming; эти работы продолжатся и в период ограниченного обзора.

Поэтапный релиз и согласование с правительством

Причиной выхода модели в ограниченном обзоре стал запрос правительства США. OpenAI представила свои планы и возможности моделей официальным лицам до широкого распространения; по запросу правительства на первом этапе доступ получит только небольшая группа доверенных партнёров, чьё участие согласовано с правительством. В период ограниченного обзора компания в тесном сотрудничестве с партнёрами проведёт дополнительное тестирование и продолжит координацию на пути к широкому доступу.

Компания назвала этот шаг временным и заявила, что выступает против превращения такого порядка надзора в постоянную практику. В то же время OpenAI работает с администрацией над системой исполнительного указа по кибербезопасности и воспроизводимым процессом для будущих релизов моделей. Эта работа направлена на стандартизацию порядка согласования с правительством при будущих выпусках моделей: вместо отдельного согласования для каждой новой модели будет применяться один и тот же воспроизводимый процесс.

Цены и планы широкого доступа

В период ограниченного обзора модели GPT-5.6 сначала откроются для отобранных доверенных партнёров и организаций через API и Codex. OpenAI планирует выпустить все три модели в широкий доступ в ближайшие недели — на этом этапе модели откроются для более широкой аудитории. План широкого доступа предусматривает сначала открытие для доверенных партнёров через API и Codex.

По ценовой политике записи в кэш оплачиваются в размере 1,25 от цены некэшированного входа, минимальный срок хранения кэша — 30 минут. Это правило позволяет заранее рассчитывать затраты на кэш: разработчики точно знают, сколько сэкономят на повторных запросах. Luna остаётся самым доступным вариантом из трёх моделей — $1 за миллион входных токенов и $6 за миллион выходных. Компания также сообщила о планах запуска GPT-5.6 Sol на инфраструктуре Cerebras со скоростью до 750 токенов в секунду — этот вариант будет предназначен для рабочих процессов, требующих высокой скорости.