GPT-5.6 Sol, Terra & Luna:
полный обзор, benchmarks, pricing и guide по доступу

26 июня 2026 OpenAI выпустила крупнейшее семейство моделей года: GPT-5.6 Sol, Terra и Luna. Sol снимает Claude Mythos 5 с первого места coding-лидерборда TerminalBench 2.1 с рекордом 91,9 %. Все три модели достигают порога «High» в cybersecurity у OpenAI — впервые для целой продуктовой линейки. Но есть нюанс: по запросу правительства США сейчас доступ имеют лишь около 20 проверенных организаций.

Этот guide для разработчиков, лидов AI-команд и пользователей Cursor/Codex, оценивающих model stack. Мы разберём tiers и pricing, режимы рассуждения Max/Ultra, полные benchmark-данные, сравнение с Claude Mythos 5, executive order Трампа от 2 июня, deployment Cerebras на 750 tokens/second в июле, timeline доступа и шесть практических шагов подготовки. В конце вы поймёте, какой tier выбрать, можно ли использовать его сегодня и как подключить в production при открытии general access.

01 GPT-5.6 кратко: tiers моделей и болевые точки разработчиков

Семейство GPT-5.6 одним взглядом (26 июня 2026)
Модель Tier Input Output Highlight
GPT-5.6 Sol Flagship $5 / 1M tokens $30 / 1M tokens TerminalBench 2.1 #1 — 91,9 %
GPT-5.6 Terra Balanced $2,50 / 1M tokens $15 / 1M tokens Близко к GPT-5.5, на 50 % дешевле
GPT-5.6 Luna Lightweight $1 / 1M tokens $6 / 1M tokens На 80 % дешевле Sol для high-volume задач

Доступность сегодня: GPT-5.6 ограничен примерно 20 government-approved trusted partners через API и Codex preview. General ChatGPT access ожидается в течение нескольких недель. Трейдеры Polymarket дают 87 % вероятности широкого релиза к 31 июля 2026.

Запуск был политически острым. Executive order Трампа от 2 июня 2026 дал американским агентствам до 30 дней pre-release доступа к frontier-моделям. Это впервые, когда правительство США формально потребовало от AI-компании ограничить frontier-релиз. OpenAI выполнило требование, но публично возражало:

Мы не считаем, что такой government access process должен стать долгосрочной нормой. Он удерживает лучшие инструменты от пользователей, разработчиков, enterprise, cyber defenders и global partners, которым они нужны.

Что болит у разработчиков прямо сейчас:

  • General API пока нет: Большинство команд не может валидировать Ultra multi-agent mode Sol в production.
  • Конкуренты тоже заблокированы: Claude Mythos 5 ушёл offline 12 июня под export controls; Gemini 3.5 Pro сдвинулся на июль.
  • Путаница между tiers: Разрыв в pricing и capabilities Sol/Terra/Luna велик — benchmarks важнее брендинга.
  • Safety compliance: Все три tier несут «High» cyber rating OpenAI; enterprise нужны abuse controls и audit plans заранее.
  • Infra timing: В июле — Cerebras 750 t/s плюс public API; команды без elastic nodes рискуют integration bottlenecks в день открытия.

02 GPT-5.6 Sol, Terra и Luna: features и pricing

OpenAI впервые назвала семейство по небесным телам: Sol (Солнце) для flagship capability, Terra (Земля) для баланса cost/performance и Luna (Луна) для быстрого и доступного throughput.

GPT-5.6 Sol — flagship

Sol нацелен на сложный coding, long-horizon security research и multi-step agentic workflows. Pricing совпадает с GPT-5.5: $5 / $30 за миллион tokens input/output. Context window около 1,5M tokens.

Два новых режима рассуждения:

  • Max mode: Дополнительное время на reasoning перед ответом — latency в обмен на accuracy в high-stakes задачах.
  • Ultra mode: Запускает несколько параллельных subagents, которые делят работу, выполняют concurrently и сливают результаты. Эта архитектура даёт рекорд TerminalBench 91,9 %, но съедает значительно больше tokens.

GPT-5.6 Terra — balanced workhorse

Terra — default для high-volume business work: support tickets, internal tools, document analysis. Performance близко к GPT-5.5 при половине стоимости ($2,50 / $15 за MTok).

GPT-5.6 Luna — lightweight

Luna оптимизирован для summarization, drafting и routine automation. Это первая non-flagship модель OpenAI с рейтингом High и в cybersecurity, и в biology, по цене $1 / $6 за MTok.

Какую модель GPT-5.6 выбрать?
Задача Выбор
Сложные coding agents и multi-step workflows Sol (Ultra)
High-volume docs, support, production APIs Terra
Summarization, drafting, lightweight automation Luna
Качество уровня GPT-5.5 в рамках бюджета Terra
Ultra-low latency после июля (enterprise) Sol на Cerebras

03 Benchmark-результаты GPT-5.6 и Cerebras 750 tokens per second

Coding: TerminalBench 2.1

TerminalBench 2.1 прогоняет 89 сложных command-line planning challenges — ближе к реальной agent work, чем single-shot code completion.

Scores TerminalBench 2.1
Модель Score Mode
GPT-5.6 Sol 91,9 % Ultra (multi-agent)
GPT-5.6 Sol 88,8 % Standard
Claude Mythos 5 88,0 % Standard
GPT-5.5 83,4 % Standard
Gemini 3.1 Pro Preview 70,7 % Standard

Claude Mythos 5 держал лидерство всего 17 дней (с 9 июня), пока Sol не обошёл его.

Long-horizon agents: Agent's Last Exam

  • GPT-5.6 Sol: 50,9 % task completion — единственная модель выше 50 %
  • GPT-5.6 Luna: Чуть выше GPT-5.5

Cybersecurity: CTF и ExploitBench

GPT-5.6 — первое семейство OpenAI, где все три tier достигают классификации «High» в cybersecurity.

Hit rates capture-the-flag
Модель Hit rate
Sol 96,7 %
Terra 91,84 %
Luna 85,19 %

ExploitBench: Sol сопоставим с Mythos Preview от Anthropic при использовании лишь около трети output tokens — та же глубина security research при резко меньших затратах.

Safety note: red-teaming OpenAI подтвердило, что Sol не может автономно собрать полную функциональную exploit chain против hardened Chromium или Firefox targets. Модель остаётся ниже порога «Cyber Critical» OpenAI.

Life sciences: На GeneBench v1 Sol сопоставим с GPT-5.5 или лучше при меньшем числе tokens. HealthBench Professional: 60,5 (+8,7 vs GPT-5.5).

Ускорение Cerebras (июль 2026)

С июля Sol на Cerebras hardware нацелен на до 750 tokens per second. Большинство frontier-моделей сегодня работают на 50–150 t/s — ускорение в 5–15 раз. Ответ за 10 секунд может уложиться меньше чем в секунду для real-time coding assistants и streaming agents. Первый доступ ограничен select enterprise customers по мере роста capacity.

Встроенные safeguards: Real-time misuse classifiers, account-level review для sensitive flows, 700 000 A100-equivalent GPU hours automated red-teaming, universal jailbreak testing, specialized reasoning filter как backup и external security audits перед launch.

04 GPT-5.6 vs Claude Mythos 5 и government restriction

GPT-5.6 Sol vs Claude Mythos 5
Категория GPT-5.6 Sol Claude Mythos 5
TerminalBench 2.1 91,9 % (Ultra) / 88,8 % 88,0 %
ExploitBench Почти идентично, ~3× дешевле по tokens Сильный (restricted access)
Pricing $5 / $30 за MTok $10 / $50 (offline)
Availability Limited preview → general release скоро Offline (US export control)
Context window ~1,5M tokens 200K tokens

Итог: Sol лидирует на TerminalBench и даёт сопоставимый security research за половину цены. Mythos 5 может ещё вести на benchmarks вроде SWE-Bench Pro, где данные system card GPT-5.6 ещё не полностью опубликованы.

Июнь 2026: все три frontier labs заблокированы

Статус flagship releases — июнь 2026
Компания Модель Статус
OpenAI GPT-5.6 Sol/Terra/Luna Limited preview (~20 orgs)
Anthropic Claude Fable 5 / Mythos 5 Forced offline 12 июня
Google Gemini 3.5 Pro Delayed to July

Июнь должен был стать крупнейшим месяцем в истории AI. Вместо этого все три flagship releases застряли у двери — прецедент для global deploy frontier-моделей.

Timeline доступа:

  • Сейчас (июнь 2026): ~20 approved partners через API и Codex only.
  • Июль 2026: General ChatGPT (Plus/Pro first), public API, Cerebras Sol до 750 t/s для enterprise.

05 Шесть шагов подготовки, цитируемые данные и FAQ

Шесть шагов до general availability:

  1. Держать production на GPT-5.5 или Claude Opus 4.8, пока Sol не станет broadly available — не ломать agent pipelines на preview-only access.
  2. Pre-wire LiteLLM routes с placeholders для gpt-5.6-sol, gpt-5.6-terra и gpt-5.6-luna, чтобы A/B test через env vars в день открытия.
  3. Задать Ultra cost guardrails: Ultra multi-agent mode быстро сжигает tokens — добавить max_tokens и complexity thresholds в код.
  4. Версионировать Cursor Rules и Agent Skills в Git для one-hour benchmark replay при открытии API.
  5. Следить за OpenAI Status и Polymarket: 87 % implied odds релиза к 31 июля — полезный сигнал, не официальный schedule.
  6. Поднять 24/7 bare-metal node с Codex CLI, OpenClaw Gateway и self-hosted runners — смена модели как hot-swap, а не rebuild.

Цитируемые технические данные:

  • TerminalBench 2.1: Sol Ultra 91,9 %, standard 88,8 %, Mythos 5 88,0 %, GPT-5.5 83,4 %
  • CTF hit rates: Sol 96,7 %, Terra 91,84 %, Luna 85,19 %
  • Cerebras: до 750 t/s в июле — примерно 5–15× сегодняшних frontier speeds
  • Pricing: Sol $5/$30, Terra $2,50/$15, Luna $1/$6 за MTok
  • Context: ~1,5M tokens (перепроверить при выходе полной system card)

FAQ

  • GPT-5.6 уже в ChatGPT? Не для широкой публики. Только ~20 trusted partners; полный ChatGPT rollout ожидается в течение недель (июль 2026).
  • GPT-5.6 Sol лучше Claude Fable 5 для coding? Sol лидирует TerminalBench 2.1 (91,9 % vs 88 % у Mythos 5). Fable 5 ещё ведёт SWE-Bench Pro, но offline под export controls.
  • Что такое Ultra mode? Несколько параллельных subagents делят задачу, работают concurrently и синтезируют один ответ — выше performance, выше token cost.
  • Почему GPT-5.6 restricted? US government review под order Трампа от 2 июня, координация через White House OSTP и ONCD. OpenAI выполнило требование, но против permanent rule.
  • Насколько быстр GPT-5.6 на Cerebras? До 750 tokens per second — примерно 5–15× большинства текущих frontier models, июль 2026 для select enterprise customers.
  • Какой context window у GPT-5.6? Сообщается ~1,5M tokens, против 1M у GPT-5.5 — официальное подтверждение ожидается с полной system card.
  • Все три модели GPT-5.6 безопасны для cybersecurity work? Все несут «High» cyber rating OpenAI с многослойными safeguards; модели не могут автономно собрать полные functional exploits.

Источники (перепроверить ссылки после upstream update):

OpenAI: Previewing GPT-5.6 Sol

OpenAI Deployment Safety System Card

VentureBeat: GPT-5.6 Launch Coverage

SiliconAngle: GPT-5.6 vs Claude Mythos 5

TechTimes: Government Lock Analysis

Cloud IDE и shared VPS часто не тянут agent workloads: ноутбуки засыпают mid-run, команды конфликтуют на одном instance, launchd daemons не держат 24/7. Для production Cursor agents, Codex CLI и iOS CI/CD аренда bare-metal Mac Mini CALMVPS даёт dedicated Apple Silicon, provisioning за 120 секунд и monthly billing — переключить OPENAI_MODEL на изолированном node при открытии GPT-5.6 без rebuild stack.