Модель GPT-5.6 Sol Ultra вместе с Codex собрала по одному запросу игру про енотов, обчищающих музей: с графикой, уровнями и игровой механикой. Не текст, не сценарий, не заготовка кода — работающая игра. Ключевое слово тут «one-shot»: человек описал задачу один раз и не вмешивался, пока ИИ не выдал результат. Эксперимент показателен не игрой, а тем, где сегодня проходит граница самостоятельности ИИ.
Один запрос вместо технического задания
Раньше работа с ИИ над кодом шла итерациями: попросили функцию, проверили, попросили следующую. Здесь модель получила описание задачи целиком и сама разложила её на части — графику, логику, управление, сборку.
Результат оказался сложнее ожидаемого. Вместо привычного «енот собирает предметы» вышла игра с полноценной механикой ограбления. На практике это значит: описывать ИИ имеет смысл не следующий шаг, а цель — он справится с декомпозицией сам.
Субагенты: ИИ раздаёт задачи другим ИИ
GPT-5.6 Sol Ultra работает через субагентов — вспомогательных помощников, каждый со своей задачей. Один рисует изображения, другой правит ошибки, третий собирает всё вместе. Главная модель раздаёт им работу и принимает результат.
Отсюда и качество: узкая задача даётся исполнителю, который занят только ею. Той же логике следуют современные ИИ-агенты в обычных задачах — как они устроены, мы разбирали в полном гиде по OpenClaw и в материале про три локальных агента, работающих вместе.
Ошибку исправил, но сам её не заметил
В игре оказался баг: у енотов над головами висели чёрные шары вместо глаз. Codex прогнал проверку и не увидел проблемы. Человек указал на неё одной фразой — модель исправила сразу.
Это точная иллюстрация границы. ИИ хорошо чинит то, на что ему указали, и плохо замечает, что результат выглядит неправильно. Проверка глазами остаётся за человеком, и снимать её с себя пока рано.
Час работы и пять долларов
Codex потратил на проект около часа. По тарифам API это вышло бы примерно в $5.
Цифра важнее, чем кажется. Она переводит эксперимент из разряда «дорогая демонстрация возможностей» в разряд обычной рабочей операции: за пять долларов проверяют гипотезу, а не запускают проект. Порог входа для «попробовать сделать что-то целиком» упал до стоимости обеда.
Что из этого можно применить уже сегодня
Собирать игры по одному запросу — пока территория экспериментов, и повторить результат с первого раза не выйдет. А вот привычку формулировать задачу целиком, а не по шагам, можно забрать себе прямо сейчас: опишите ИИ, что должно получиться и зачем, вместо того чтобы диктовать очередное действие.
Второе — правило проверки. Всё, что ИИ отдаёт как готовое, смотрите сами: он находит ошибку по вашей подсказке, но редко ловит её сам.
Если хотите подключить такого помощника к своим задачам, начните с раздела интеграций — там разобрано, как агенты соединяются с сервисами, которыми вы уже пользуетесь. За тем, куда это движется дальше, удобно следить в разделе новостей.
Источник: Moonlight & Mayhem (Raccoon Heist by Codex + GPT-5.6 Sol Ultra), Simon Willison, 2026.
Что ещё вышло в этой волне релизов: DeepSeek V4 и обновление Claude 5.