OpenAI выпустил очередной дайджест новостей для разработчиков, посвящённый хакатону Build Week, релизу семейства моделей GPT-5.6, обновлённой структуре ChatGPT и практическим советам по оптимизации работы с токенами.
OpenAI Build Week: приём заявок открыт до 21 июля
Регистрация на хакатон OpenAI Build Week, который проходит с 13 по 21 июля, ещё открыта. Проекты будут оценивать руководители OpenAI — Тибо Соттио, Питер Штайнбергер, Кэт Коревек, Тара Сешан и Ли Белски. Общий призовой фонд составляет 100 000 $, а победители также получат билеты на конференцию OpenAI DevDay, бесплатный год подписки ChatGPT Pro и упоминание в материалах компании.
В рамках хакатона проходят более 60 локальных мероприятий, организованных амбассадорами по всему миру, вступительный стрим с Грегом Брокманом и Тибо Соттио, обзорный стрим по Codex с Питером Штайнбергером, а также сообщество в Discord с открытыми часами для вопросов. Участвовать можно как в одиночку, так и командой.
GPT-5.6: новое семейство моделей для сложных рабочих процессов
Модель GPT-5.6 сочетает усиленные возможности в кодинге, работе с инструментами и компьютером, а также улучшенное чувство дизайна с новым уровнем эффективности. Модель уже доступна в API и Codex в виде трёх вариантов:
- GPT-5.6 Sol — флагманская модель для самых сложных задач кодинга и агентной работы. При максимальном уровне рассуждений Sol превосходит Claude Fable 5, используя при этом на 54% меньше выходных токенов.
- GPT-5.6 Terra — сбалансированная модель для повседневных рабочих нагрузок с производительностью на уровне GPT-5.5 по более низкой цене.
- GPT-5.6 Luna — самая быстрая и доступная модель для чётко определённых задач большого объёма.
По заявлению OpenAI, GPT-5.6 Sol задаёт новый отраслевой стандарт по возможностям модели, эффективности и согласованности поведения, извлекая больше «интеллекта» из каждого токена.
Демонстрационные проекты на GPT-5.6
Среди примеров возможностей модели — цифровая карточная игра Asterism, полностью созданная GPT-5.6 Sol от промпта до готового к игре результата, а также аркадная платформенная игра Codex Pet Arena, построенная с использованием Codex и GPT-5.6.
Новый ChatGPT: режимы Chat, Work и Codex
OpenAI представила обновлённую структуру ChatGPT с тремя отдельными режимами:
- Chat — самый быстрый способ получить ответ, провести брейншторм, написать текст или решить повседневную задачу.
- Work — режим для многошаговых рабочих процессов, доступный в вебе, на мобильных устройствах и десктопе. Работает на основе движка Codex и агентного рантайма, может взаимодействовать с подключёнными приложениями и файлами, превращая цель в готовый результат.
- Codex — режим для разработки на уровне репозитория с локальным кодом, терминалами и инструментами разработчика на десктопе, а также мобильная версия Codex для работы из любой точки.
Формула OpenAI: Chat — для ответов, Work — для рабочих процессов, Codex — для разработки.
Советы по эффективному использованию токенов
- Кешируйте повторяющийся контекст — переиспользование стабильных префиксов промпта вместо повторной обработки одного и того же контекста в каждом запросе снижает стоимость и задержку.
- Сохраняйте рассуждения между репликами — если цели, допущения и приоритеты остаются стабильными, стоит включить параметр reasoning.context в значение all_turns и продолжать работу через previous_response_id, чтобы GPT-5.6 могла использовать совместимые рассуждения из предыдущих ответов.
- Позвольте модели самой составлять и запускать JavaScript-код для управления вызовами инструментов — программируемый вызов инструментов (Programmatic Tool Calling) превращает открытое использование инструментов в предсказуемые этапы и выполняет код в изолированной облачной среде, не засоряя основной контекст.
- Проверяйте инструкции для Codex — стоит проверять Skills и файлы AGENTS.md на предмет дублирующихся или излишне детализированных указаний: GPT-5.6 точнее следует общему замыслу задачи, поэтому более компактные инструкции способны сохранить нужный сценарий работы при меньшем объёме повторяющегося контекста.
Больше возможностей внутри Codex
Сам Codex теперь умеет редактировать diff'ы и проверять пул-реквесты. Функция PR Chat позволяет вносить последующие правки, не покидая Codex. Встроенный браузер может работать с открытыми вкладками, загрузками и аннотациями, а расширение для Chrome даёт доступ к уже открытой пользователем сессии браузера. Функция Computer Use ускоряет длительную многошаговую работу и делает её более экономной по токенам. С помощью Sites идею можно превратить в защищённое приложение и опубликовать его за считаные минуты.
Управление долгими задачами в Codex
Для задач с чёткой конечной целью, но неясным путём её достижения, можно использовать команду /goal — она задаёт итоговый результат, ограничения и критерии завершения задачи, а также цикл проверки, исправления и валидации, чтобы Codex мог тестировать, исправлять и продолжать работу до прохождения всех проверок.
Для независимых частей работы предусмотрены субагенты в отдельных потоках Codex — они позволяют делегировать исследование кода, написание тестов или реализацию функциональности параллельно, управлять субагентами по ходу выполнения и получать в основном потоке уже обработанные результаты. Это особенно полезно для настройки производительности, миграций, расследования нестабильных тестов и многошаговых рефакторингов.
ChatGPT Workspace Agent с API-триггером
OpenAI также описала сценарий создания рабочего агента ChatGPT (Workspace Agent), который может использовать подключённые приложения, следовать заданному skill, запускаться по расписанию и сохранять результат работы. К такому агенту можно добавить API-триггер, чтобы форма, тикет, запись CRM или другое событие бэкенда запускало рабочий процесс — выполнение происходит асинхронно, а результат записывается в заранее настроенное место назначения.
Инсайдерские истории от инженеров OpenAI
В разделе для разработчиков команда OpenAI поделилась историей расследования старого бага: после анализа года дампов памяти сервиса Rockset инженеры обнаружили, что за одинаковыми на вид сбоями стояли две разные причины — неисправный хост Azure и состояние гонки в библиотеке GNU libunwind возрастом 18 лет.
Отдельная команда рассказала, как экспертные правки пользователей превращаются в целевые проверки (evals) и ограниченные инженерные задачи для Codex с явными регрессионными тестами — по словам разработчиков, после того как продукт научился прослеживать правку эксперта, превращать её в целевую проверку и передавать Codex как ограниченную задачу, сигналы из продакшена перестали теряться в бэклоге.
Проекты разработчиков
- Пьетро Скирано обучил на основе своего архива iMessage языковую модель на 1,38 млн параметров с помощью одного промпта GPT-5.6 Sol.
- Эндрю Ку, технический директор по ПО в Vercel, с помощью GPT-5.6 и Codex сдвинул с мёртвой точки внутреннего агента для дата-сайентистов, который «застревал» на более ранних моделях.
- Шуан Чжэн с помощью GPT-5.6 Sol и Codex создал играбельную tower-defense игру Acornado, используя короткие точные итерации без излишнего усложнения кода.
- Победитель корейского Codex Skillathon Джей-хим Чхве упаковал реальный рабочий процесс приёма заказов ресторана в переиспользуемый Codex Skill, который обрабатывает CSV с заказами и возвращает аналитику, отчёты и черновики писем.
- Габриэль Чжоу создала прототип приложения Good Dog Blood, помогающего владельцам собак находить программы донорства крови для животных.
- Сеу Хан с помощью Sites, Codex и Annotations превратила архив мероприятий корейского Codex-сообщества в публичный ресурс с материалами для новичков.
Итог
Июльский дайджест OpenAI показывает сразу несколько параллельных направлений развития платформы: активное вовлечение сообщества разработчиков через Build Week, выход более эффективной модели GPT-5.6, реструктуризацию ChatGPT под три разных сценария использования и растущий набор инструментов для управления долгими агентными задачами и стоимостью токенов.