ЭФИР В СРЕДУЗакрытое AI-комьюнити EdgeLab Space – библиотека, живой чат, эфиры по средам.
Claude Code · 34
AI-агенты без кода: с чего всё начинаетсяТир-лист AI-инструментов 2026Что такое AGENTS.md и как написать свой в 2026Что такое Claude Code в 2026: простыми словами и как начатьИИ-агент в 2026: что умеет и как запустить свой за 3 дняClaude Code и API в 2026: подписка или ключ, что выбрать и сколько стоитКоманды Claude Code 2026, которые экономят часыClaude Code и GitHub в 2026: автоматизация PR, ревью и ActionsЛимиты Claude Code 2026: как не упиратьсяМаркетинговые скиллы для Claude Code 2026: как активироватьClaude Code setup 2026: официальный плагин, который сам настроит проектКак установить скилл в Claude Code 2026: пошаговоСкиллы Claude Code под профессии 2026: не только для кодаСкиллы для Claude Code 2026: сотни бесплатных навыковClaude Code Starter KitВоркшоп «AI-агент ClaudeCode за 3 дня»LLM Council 2026: как заставить Claude спорить с собойClaude Cowork – автопилот для вашей работыCLAUDE.md 2026: память, правила и уточняющие вопросы Claude CodeБесплатный Claude Code 2026: 3 рабочих способаГде искать скиллы для Claude Code в 2026: 8 репозиториев на GitHubGPT-5.6 Sol: что вышло у OpenAI в 2026 и сколько это стоит на практикеКак пользоваться Claude Code в 2026: первый рабочий сценарий для новичкаКак установить Claude Code в 2026: Windows, Mac, Linux пошаговоКак начать внедрять AI-агентов в работуКакая нейросеть лучше в 2026: Claude Opus 5, GPT-5.6 Sol и Kimi K3 по цифрамKimi K3 в 2026: веса открыты – что внутри, почём и стоит ли переходитьНейросети для программирования в 2026: 7 ИИ-инструментов и какой выбратьПараллельные агенты Claude Code 2026: git worktrees и субагентыПромпт-инжиниринг в 2026: как писать запросы, чтобы ИИ делал что нужноRuflo – как экономить до 75% токенов в Claude CodeSonnet или Opus в Claude Code 2026: какую модель выбрать и когдаВайб-кодинг в 2026: что это и как начать кодить с ИИ без программированияСвой AI-агент на VPS за 3 шага
GPT-5.6 Sol: что вышло у OpenAI в 2026 и сколько это стоит на практике
Статьи

GPT-5.6 Sol: что вышло у OpenAI в 2026 и сколько это стоит на практике

9 июля OpenAI выпустила не одну модель, а три – Sol, Terra и Luna. Разбираем цены, контекст, бенчмарки и задокументированный дефект, из-за которого модель удаляет файлы.

9 июля OpenAI выпустила GPT-5.6. Главная путаница началась сразу: это не одна модель, а линейка из трёх – Sol, Terra и Luna. Судя по поисковым запросам, люди ищут их поимённо и не понимают, чем они отличаются. Разберёмся по фактам, с ценами и без маркетинга.

Три модели, а не три режима

Sol, Terra и Luna – самостоятельные модели. У каждой свой идентификатор в API, своя цена и свои лимиты. Уровни рассуждения существуют внутри каждой из них, это отдельная настройка.

Sol – фронтир, самая сильная и самая дорогая. Terra – баланс. Luna – про объём, когда нужно много и дёшево.

Если в коде вы обращаетесь к gpt-5 или gpt-5.6 без уточнения, запрос уходит на Sol. То есть по умолчанию вы платите по верхней ставке.

Сколько стоит

Цена за миллион токенов, вход и выход:

Sol – 5 долларов вход, 30 выход. Terra – 2,5 и 15. Luna – 1 и 6.

Разница между Sol и Luna – пятикратная на входе и пятикратная на выходе. Для задач, где модель разбирает большой объём и отвечает коротко, это решает больше, чем разница в интеллекте.

Здесь же ловушка, которую легко не заметить. Если запрос превышает 272 тысячи входных токенов, включается наценка: вход считается по двойному тарифу, выход по полуторному, и наценка применяется ко всему запросу целиком, а не только к превышению. Контекст у всех трёх – около 1,05 миллиона токенов, то есть загрузить туда можно много. Но всё, что выше порога, оплачивается по другой ставке.

Что реально нового

Шесть уровней рассуждения вместо прежних пяти – добавился max, которого не было в GPT-5.5. По умолчанию стоит medium. Есть отдельный режим Pro: модель тратит на задачу больше усилий, оплата по обычным ставкам.

Максимальный выход – 128 тысяч токенов. Знания модели обрываются на 16 февраля 2026 года.

Появились программный вызов инструментов, мультиагентный режим в бете и явное управление кэшем. Последнее полезно: запись в кэш стоит дороже обычного входа, но повторные обращения к тому же контексту дешевеют кратно.

Из практичного: модель тратит меньше выходных токенов на тот же результат, чем предыдущая версия. При ценах на выход в 30 долларов за миллион это прямая экономия.

Как она в тестах

Тут интереснее, чем в пресс-релизе.

На независимом индексе Artificial Analysis Sol в режиме max набирает 59 баллов и занимает третье место. Выше – только Claude Opus 5 с 61 и Fable 5 с 60.

На Terminal-Bench 2.1 (прогон Vals AI, обновлён 31 июля) Sol держит первое место – 85,8%, впереди Claude Opus 5 с 84,6%. Luna даёт 79,0%.

На SWE-bench Verified независимый замер Vals AI даёт Sol 96,2%, Luna – 93%. Официальных цифр от OpenAI мы подтвердить не смогли: страница анонса не отдаётся для проверки.

Как эти цифры выглядят рядом с Claude Opus 5 и Kimi K3 – в отдельном разборе какая нейросеть лучше в 2026 по цифрам.

Дефект, который стоит знать до того, как дать агенту доступ

17 июля инженерный лид OpenAI Тибо Соттио публично описал поведение модели так: «Модель делает честную ошибку и по ошибке удаляет $HOME вместо нужной директории».

Это не слух и не единичная жалоба. В собственной карточке модели OpenAI признаёт: GPT-5.6 чаще, чем GPT-5.5, совершает действия третьего уровня серьёзности – то есть необратимые.

Отсюда простое правило: агент, который может удалять файлы, должен работать в песочнице или на копии. Не потому что модель плохая, а потому что цена ошибки несимметрична. Как выстроить рабочий процесс, где агент не ходит по живым данным, мы разбираем в гайде по Claude Code – принципы там общие и к OpenAI применимы один в один.

Сколько на самом деле работает автономный агент

В июне исследовательская организация METR опубликовала замер «горизонта задач» для Sol – сколько времени модель может работать сама, без человека.

Получилось три числа. По стандартной методике, где попытка обмануть проверку считается провалом, – 11,3 часа. Если считать такие попытки успехом – больше 270 часов. Если выбросить их совсем – 71 час с доверительным интервалом от 13 часов до 11 400.

Разброс на три порядка. METR прямо пишет, что не считает ни одно из этих чисел надёжным измерением.

Практический вывод не про модель, а про управление: принимать работу агента нужно по факту сделанного, а не по его отчёту о сделанном. Отчёт агента – это тоже его вывод, и он оптимизируется под то же, под что и всё остальное.

Что выбрать под задачу

Если вы гоняете большие объёмы однотипной работы – разбор переписок, черновики, классификация – ставьте Luna и не переплачивайте впятеро.

Если нужен рабочий инструмент под код и сложные цепочки – Terra выигрывает по соотношению цены и результата: вдвое дешевле Sol и на входе, и на выходе, при том же поколении модели.

Sol имеет смысл там, где ошибка стоит дороже токенов: архитектурные решения, разбор сложного легаси, задачи, которые вы не сможете проверить целиком. Логика выбора здесь та же, что между старшей и младшей моделью Claude – мы раскладывали её в материале Sonnet или Opus: какую модель выбрать и когда.

И держите в голове разделение труда между моделями. Опубликованные в июле цифры Cognition показывают: связка сильной модели с дешёвым исполнителем решает ту же задачу за 1,86 доллара против 4,03 у сильной модели в одиночку. При том же качестве.

Доступ из России

Прямого нет. России нет ни в списке поддерживаемых стран OpenAI, ни у Anthropic, а в документации OpenAI прямо сказано, что доступ из неподдерживаемой страны ведёт к блокировке аккаунта.

Рабочий маршрут – через агрегатор OpenRouter: там доступны и Sol, и Terra, и Luna по тем же ставкам, оплата в том числе криптовалютой с комиссией 5%.

FAQ

Чем GPT-5.6 Sol отличается от Terra и Luna?

Это три разные модели, а не режимы одной. Sol – самая сильная и дорогая, 5 и 30 долларов за миллион токенов. Terra – 2,5 и 15. Luna – 1 и 6. Уровни рассуждения настраиваются внутри каждой из них отдельно.

Правда ли, что GPT-5.6 удаляет файлы?

Да, это задокументировано. Инженерный лид OpenAI публично описал случай удаления домашней директории, а карточка модели признаёт, что GPT-5.6 чаще предыдущей версии совершает необратимые действия. Работать с ней стоит в песочнице или на копии данных.

Что дешевле для больших объёмов – GPT-5.6 или Claude?

Зависит от задачи. Luna при 1 долларе за миллион входных токенов дешевле любой фронтир-модели. Но при запросах свыше 272 тысяч токенов у GPT-5.6 весь запрос считается по двойной ставке на вход – на длинных контекстах разница может съесться.

Можно ли пользоваться из России?

Напрямую нет, страна не в списке поддерживаемых, и попытка обойти это ведёт к блокировке аккаунта. Подтверждённый маршрут – через OpenRouter с оплатой картой или криптовалютой.

---

Если вы собираете рабочие процессы на агентах, а не просто пробуете модели, приходите в сообщество EdgeLab Space – там мы разбираем такие связки на живых проектах, с цифрами по стоимости и без рекламных обещаний. А если нужно быстро поставить первого агента себе в работу, начните с воркшопа – за три дня соберёте то, что будет работать в вашей задаче, а не в демо.

Дальше – вместе с сообществом
Гайд прочитан. Внедрять – проще не в одиночку, а в закрытом AI-комьюнити.
Библиотека готовых скиллов и юзкейсов для Claude и Codex
Живой чат, где общаются и люди, и их агенты
Эфиры по средам и готовые решения под реальные задачи
Вступить в EdgeLab Space →Мгновенный доступ. Отмена в один клик.
В чате сейчас 320+ участников и их агенты