OpenAI показала GPT-5.6: три модели, режим суб-агентов и доступ по списку

26 июня OpenAI анонсировала семейство GPT-5.6 — Sol, Terra и Luna. Флагман Sol попал в категорию High по кибербезопасности и био/химии в рамках Preparedness Framework, и на старте доступ получили лишь около 20 партнёрских организаций.

DB
DBG · по материалам OpenAI Blog
0

OpenAI представила новое поколение моделей — GPT-5.6, и это сразу три модели под разные задачи. Sol — флагман, заточенный под самое тяжёлое: сложный код и исследования в области безопасности. Terra — сбалансированный вариант под объёмные рабочие сценарии: поддержка, внутренние инструменты, разбор документов. Luna — быстрая и дешёвая, под рутину вроде суммаризации, черновиков и типовой автоматизации. В API это gpt-5.6-sol, gpt-5.6-terra и gpt-5.6-luna, а алиас gpt-5.6 ведёт на Sol.

Самое обсуждаемое в анонсе — не бенчмарки, а условия доступа. По Preparedness Framework все три модели отнесены к категории High capability сразу по двум направлениям: кибербезопасность и биологические/химические риски. Отсюда и режим выката: на старте, 26 июня, модели ушли не в общий доступ, а примерно двум десяткам доверенных организаций — по API и в Codex. Широкому кругу платящих API-разработчиков модели открыли только в июле, после нескольких недель дополнительного стресс-тестирования защит. Из новых возможностей заявлены расширенные настройки объёма рассуждения и режим ultra, который дробит задачу между несколькими суб-агентами.

По опубликованному прайсу за 1 млн токенов (стандартный короткий контекст): Sol — $5 на вход и $30 на выход, Terra — $2,50/$15, Luna — $1/$6.

Что это значит на практике. Первое и главное: не планируйте миграцию на превью. Модель, доступную двадцати компаниям, нельзя закладывать в роадмап — но можно закладывать в архитектуру. Если у вас в коде хардкодом прошит gpt-5.5 в двадцати местах, самое время вынести выбор модели в конфиг: волна переименований показала, что имена моделей у OpenAI теперь живут меньше, чем ваш релизный цикл. Второе — разнесение на три уровня сделано не для маркетинга, и относиться к нему стоит как к инструменту экономии. Разница между Luna и Sol по выходным токенам пятикратная, и гонять флагман на суммаризацию тикетов — это не «немного дороже», это счёт в пять раз больше за тот же результат. Заведите роутер: дешёвая модель на классификацию и черновики, флагман — только там, где задача реально не решается. И третье: режим ultra с дроблением на суб-агентов звучит красиво ровно до момента, когда вы увидите его в счёте — каждый суб-агент ест свой контекст, и стоимость одного «умного» ответа складывается из нескольких полноценных прогонов.

Комментарии

OpenAI показала GPT-5.6: три модели, режим суб-агентов и доступ по списку | DBG