26 июня 2026 OpenAI выпустила крупнейшее семейство моделей года: GPT-5.6 Sol, Terra и Luna. Sol снимает Claude Mythos 5 с первого места coding-лидерборда TerminalBench 2.1 с рекордом 91,9 %. Все три модели достигают порога «High» в cybersecurity у OpenAI — впервые для целой продуктовой линейки. Но есть нюанс: по запросу правительства США сейчас доступ имеют лишь около 20 проверенных организаций.
Этот guide для разработчиков, лидов AI-команд и пользователей Cursor/Codex, оценивающих model stack. Мы разберём tiers и pricing, режимы рассуждения Max/Ultra, полные benchmark-данные, сравнение с Claude Mythos 5, executive order Трампа от 2 июня, deployment Cerebras на 750 tokens/second в июле, timeline доступа и шесть практических шагов подготовки. В конце вы поймёте, какой tier выбрать, можно ли использовать его сегодня и как подключить в production при открытии general access.
01 GPT-5.6 кратко: tiers моделей и болевые точки разработчиков
| Модель | Tier | Input | Output | Highlight |
|---|---|---|---|---|
| GPT-5.6 Sol | Flagship | $5 / 1M tokens | $30 / 1M tokens | TerminalBench 2.1 #1 — 91,9 % |
| GPT-5.6 Terra | Balanced | $2,50 / 1M tokens | $15 / 1M tokens | Близко к GPT-5.5, на 50 % дешевле |
| GPT-5.6 Luna | Lightweight | $1 / 1M tokens | $6 / 1M tokens | На 80 % дешевле Sol для high-volume задач |
Доступность сегодня: GPT-5.6 ограничен примерно 20 government-approved trusted partners через API и Codex preview. General ChatGPT access ожидается в течение нескольких недель. Трейдеры Polymarket дают 87 % вероятности широкого релиза к 31 июля 2026.
Запуск был политически острым. Executive order Трампа от 2 июня 2026 дал американским агентствам до 30 дней pre-release доступа к frontier-моделям. Это впервые, когда правительство США формально потребовало от AI-компании ограничить frontier-релиз. OpenAI выполнило требование, но публично возражало:
Мы не считаем, что такой government access process должен стать долгосрочной нормой. Он удерживает лучшие инструменты от пользователей, разработчиков, enterprise, cyber defenders и global partners, которым они нужны.
Что болит у разработчиков прямо сейчас:
- General API пока нет: Большинство команд не может валидировать Ultra multi-agent mode Sol в production.
- Конкуренты тоже заблокированы: Claude Mythos 5 ушёл offline 12 июня под export controls; Gemini 3.5 Pro сдвинулся на июль.
- Путаница между tiers: Разрыв в pricing и capabilities Sol/Terra/Luna велик — benchmarks важнее брендинга.
- Safety compliance: Все три tier несут «High» cyber rating OpenAI; enterprise нужны abuse controls и audit plans заранее.
- Infra timing: В июле — Cerebras 750 t/s плюс public API; команды без elastic nodes рискуют integration bottlenecks в день открытия.
02 GPT-5.6 Sol, Terra и Luna: features и pricing
OpenAI впервые назвала семейство по небесным телам: Sol (Солнце) для flagship capability, Terra (Земля) для баланса cost/performance и Luna (Луна) для быстрого и доступного throughput.
GPT-5.6 Sol — flagship
Sol нацелен на сложный coding, long-horizon security research и multi-step agentic workflows. Pricing совпадает с GPT-5.5: $5 / $30 за миллион tokens input/output. Context window около 1,5M tokens.
Два новых режима рассуждения:
- Max mode: Дополнительное время на reasoning перед ответом — latency в обмен на accuracy в high-stakes задачах.
- Ultra mode: Запускает несколько параллельных subagents, которые делят работу, выполняют concurrently и сливают результаты. Эта архитектура даёт рекорд TerminalBench 91,9 %, но съедает значительно больше tokens.
GPT-5.6 Terra — balanced workhorse
Terra — default для high-volume business work: support tickets, internal tools, document analysis. Performance близко к GPT-5.5 при половине стоимости ($2,50 / $15 за MTok).
GPT-5.6 Luna — lightweight
Luna оптимизирован для summarization, drafting и routine automation. Это первая non-flagship модель OpenAI с рейтингом High и в cybersecurity, и в biology, по цене $1 / $6 за MTok.
| Задача | Выбор |
|---|---|
| Сложные coding agents и multi-step workflows | Sol (Ultra) |
| High-volume docs, support, production APIs | Terra |
| Summarization, drafting, lightweight automation | Luna |
| Качество уровня GPT-5.5 в рамках бюджета | Terra |
| Ultra-low latency после июля (enterprise) | Sol на Cerebras |
03 Benchmark-результаты GPT-5.6 и Cerebras 750 tokens per second
Coding: TerminalBench 2.1
TerminalBench 2.1 прогоняет 89 сложных command-line planning challenges — ближе к реальной agent work, чем single-shot code completion.
| Модель | Score | Mode |
|---|---|---|
| GPT-5.6 Sol | 91,9 % | Ultra (multi-agent) |
| GPT-5.6 Sol | 88,8 % | Standard |
| Claude Mythos 5 | 88,0 % | Standard |
| GPT-5.5 | 83,4 % | Standard |
| Gemini 3.1 Pro Preview | 70,7 % | Standard |
Claude Mythos 5 держал лидерство всего 17 дней (с 9 июня), пока Sol не обошёл его.
Long-horizon agents: Agent's Last Exam
- GPT-5.6 Sol: 50,9 % task completion — единственная модель выше 50 %
- GPT-5.6 Luna: Чуть выше GPT-5.5
Cybersecurity: CTF и ExploitBench
GPT-5.6 — первое семейство OpenAI, где все три tier достигают классификации «High» в cybersecurity.
| Модель | Hit rate |
|---|---|
| Sol | 96,7 % |
| Terra | 91,84 % |
| Luna | 85,19 % |
ExploitBench: Sol сопоставим с Mythos Preview от Anthropic при использовании лишь около трети output tokens — та же глубина security research при резко меньших затратах.
Safety note: red-teaming OpenAI подтвердило, что Sol не может автономно собрать полную функциональную exploit chain против hardened Chromium или Firefox targets. Модель остаётся ниже порога «Cyber Critical» OpenAI.
Life sciences: На GeneBench v1 Sol сопоставим с GPT-5.5 или лучше при меньшем числе tokens. HealthBench Professional: 60,5 (+8,7 vs GPT-5.5).
Ускорение Cerebras (июль 2026)
С июля Sol на Cerebras hardware нацелен на до 750 tokens per second. Большинство frontier-моделей сегодня работают на 50–150 t/s — ускорение в 5–15 раз. Ответ за 10 секунд может уложиться меньше чем в секунду для real-time coding assistants и streaming agents. Первый доступ ограничен select enterprise customers по мере роста capacity.
Встроенные safeguards: Real-time misuse classifiers, account-level review для sensitive flows, 700 000 A100-equivalent GPU hours automated red-teaming, universal jailbreak testing, specialized reasoning filter как backup и external security audits перед launch.
04 GPT-5.6 vs Claude Mythos 5 и government restriction
| Категория | GPT-5.6 Sol | Claude Mythos 5 |
|---|---|---|
| TerminalBench 2.1 | 91,9 % (Ultra) / 88,8 % | 88,0 % |
| ExploitBench | Почти идентично, ~3× дешевле по tokens | Сильный (restricted access) |
| Pricing | $5 / $30 за MTok | $10 / $50 (offline) |
| Availability | Limited preview → general release скоро | Offline (US export control) |
| Context window | ~1,5M tokens | 200K tokens |
Итог: Sol лидирует на TerminalBench и даёт сопоставимый security research за половину цены. Mythos 5 может ещё вести на benchmarks вроде SWE-Bench Pro, где данные system card GPT-5.6 ещё не полностью опубликованы.
Июнь 2026: все три frontier labs заблокированы
| Компания | Модель | Статус |
|---|---|---|
| OpenAI | GPT-5.6 Sol/Terra/Luna | Limited preview (~20 orgs) |
| Anthropic | Claude Fable 5 / Mythos 5 | Forced offline 12 июня |
| Gemini 3.5 Pro | Delayed to July |
Июнь должен был стать крупнейшим месяцем в истории AI. Вместо этого все три flagship releases застряли у двери — прецедент для global deploy frontier-моделей.
Timeline доступа:
- Сейчас (июнь 2026): ~20 approved partners через API и Codex only.
- Июль 2026: General ChatGPT (Plus/Pro first), public API, Cerebras Sol до 750 t/s для enterprise.
05 Шесть шагов подготовки, цитируемые данные и FAQ
Шесть шагов до general availability:
- Держать production на GPT-5.5 или Claude Opus 4.8, пока Sol не станет broadly available — не ломать agent pipelines на preview-only access.
- Pre-wire LiteLLM routes с placeholders для
gpt-5.6-sol,gpt-5.6-terraиgpt-5.6-luna, чтобы A/B test через env vars в день открытия. - Задать Ultra cost guardrails: Ultra multi-agent mode быстро сжигает tokens — добавить max_tokens и complexity thresholds в код.
- Версионировать Cursor Rules и Agent Skills в Git для one-hour benchmark replay при открытии API.
- Следить за OpenAI Status и Polymarket: 87 % implied odds релиза к 31 июля — полезный сигнал, не официальный schedule.
- Поднять 24/7 bare-metal node с Codex CLI, OpenClaw Gateway и self-hosted runners — смена модели как hot-swap, а не rebuild.
Цитируемые технические данные:
- TerminalBench 2.1: Sol Ultra 91,9 %, standard 88,8 %, Mythos 5 88,0 %, GPT-5.5 83,4 %
- CTF hit rates: Sol 96,7 %, Terra 91,84 %, Luna 85,19 %
- Cerebras: до 750 t/s в июле — примерно 5–15× сегодняшних frontier speeds
- Pricing: Sol $5/$30, Terra $2,50/$15, Luna $1/$6 за MTok
- Context: ~1,5M tokens (перепроверить при выходе полной system card)
FAQ
- GPT-5.6 уже в ChatGPT? Не для широкой публики. Только ~20 trusted partners; полный ChatGPT rollout ожидается в течение недель (июль 2026).
- GPT-5.6 Sol лучше Claude Fable 5 для coding? Sol лидирует TerminalBench 2.1 (91,9 % vs 88 % у Mythos 5). Fable 5 ещё ведёт SWE-Bench Pro, но offline под export controls.
- Что такое Ultra mode? Несколько параллельных subagents делят задачу, работают concurrently и синтезируют один ответ — выше performance, выше token cost.
- Почему GPT-5.6 restricted? US government review под order Трампа от 2 июня, координация через White House OSTP и ONCD. OpenAI выполнило требование, но против permanent rule.
- Насколько быстр GPT-5.6 на Cerebras? До 750 tokens per second — примерно 5–15× большинства текущих frontier models, июль 2026 для select enterprise customers.
- Какой context window у GPT-5.6? Сообщается ~1,5M tokens, против 1M у GPT-5.5 — официальное подтверждение ожидается с полной system card.
- Все три модели GPT-5.6 безопасны для cybersecurity work? Все несут «High» cyber rating OpenAI с многослойными safeguards; модели не могут автономно собрать полные functional exploits.
Источники (перепроверить ссылки после upstream update):
OpenAI: Previewing GPT-5.6 Sol
OpenAI Deployment Safety System Card
VentureBeat: GPT-5.6 Launch Coverage
SiliconAngle: GPT-5.6 vs Claude Mythos 5
TechTimes: Government Lock Analysis
Cloud IDE и shared VPS часто не тянут agent workloads: ноутбуки засыпают mid-run, команды конфликтуют на одном instance, launchd daemons не держат 24/7. Для production Cursor agents, Codex CLI и iOS CI/CD аренда bare-metal Mac Mini CALMVPS даёт dedicated Apple Silicon, provisioning за 120 секунд и monthly billing — переключить OPENAI_MODEL на изолированном node при открытии GPT-5.6 без rebuild stack.