OpenAI випустив черговий дайджест новин для розробників, присвячений хакатону Build Week , релізу сімейства моделей GPT-5.6 , оновленій структурі ChatGPT та практичним порадам щодо оптимізації роботи з токенами.
OpenAI Build Week: прийом заявок відкритий до 21 липня
Реєстрація на хакатон OpenAI Build Week , який відбувається з 13 по 21 липня, ще відкрита. Проекти оцінюватимуть керівники OpenAI - Тібо Соттіо, Пітер Штайнбергер, Кет Коревек, Тара Сешан та Лі Белскі. Загальний призовий фонд складає 100 000 $, а переможці також отримають квитки на конференцію OpenAI DevDay, безкоштовний рік передплати ChatGPT Pro та згадку в матеріалах компанії.
В рамках хакатону проходять понад 60 локальних заходів, організованих амбассадорами по всьому світу, вступний стрім з Грегом Брокманом і Тібо Соттіо, оглядовий стрим Codex з Пітером Штайнбергером, а також спільнота в Discord з відкритим годинником для питань. Брати участь можна як поодинці, так і командою.
GPT-5.6: нове сімейство моделей для складних робочих процесів
Модель GPT-5.6 поєднує посилені можливості в кодингу, роботі з інструментами та комп'ютером, а також покращене відчуття дизайну з новим рівнем ефективності. Модель вже доступна в API та Codex у вигляді трьох варіантів:
- GPT-5.6 Sol – флагманська модель для найскладніших завдань кодингу та агентної роботи. При максимальному рівні міркувань Sol перевершує Claude Fable 5, використовуючи при цьому на 54% менше вихідних токенів.
- GPT-5.6 Terra – збалансована модель для повсякденних робочих навантажень із продуктивністю на рівні GPT-5.5 за нижчою ціною.
- GPT-5.6 Luna — найшвидша і найдоступніша модель для чітко визначених завдань великого обсягу.
За заявою OpenAI, GPT-5.6 Sol задає новий галузевий стандарт щодо можливостей моделі, ефективності та узгодженості поведінки, витягуючи більше «інтелекту» з кожного токена.
Демонстраційні проекти на GPT-5.6
Серед прикладів можливостей моделі - цифрова гра Asterism , повністю створена GPT-5.6 Sol від промпту до готового до гри результату, а також аркадна платформна гра Codex Pet Arena , побудована з використанням Codex і GPT-5.6.
Новий ChatGPT: режими Chat, Work та Codex
OpenAI представила оновлену структуру ChatGPT із трьома окремими режимами:
- Chat – найшвидший спосіб отримати відповідь, провести брейншторм, написати текст або вирішити повсякденне завдання.
- Work – режим для багатокрокових робочих процесів, доступний у Інтернеті, на мобільних пристроях та десктопі. Працює на основі движка Codex та агентного рантайму, може взаємодіяти з підключеними додатками та файлами, перетворюючи мету на готовий результат.
- Codex — режим для розробки на рівні репозиторію з локальним кодом, терміналами та інструментами розробника на робочому столі, а також мобільна версія Codex для роботи з будь-якої точки.
Формула OpenAI: Chat – для відповідей, Work – для робочих процесів, Codex – для розробки.
Поради щодо ефективного використання токенів
- Кешуйте повторюваний контекст — перевикористання стабільних префіксів промпта замість повторної обробки одного й того самого контексту в кожному запиті знижує вартість і затримку.
- Зберігайте міркування між репліками — якщо цілі, припущення та пріоритети залишаються стабільними, варто включити параметр reasoning.context у значення all_turns і продовжувати роботу через previous_response_id, щоб GPT-5.6 могла використовувати сумісні міркування з попередніх відповідей.
- Дозвольте моделі самій складати та запускати JavaScript-код для управління викликами інструментів — програмований виклик інструментів (Programmatic Tool Calling) перетворює відкрите використання інструментів у передбачувані етапи та виконує код у ізольованому хмарному середовищі, не засмічуючи основний контекст.
- Перевіряйте інструкції для Codex — варто перевіряти Skills і файли AGENTS.md на предмет дублюючих або надмірно деталізованих вказівок: GPT-5.6 точніше слід загальному задуму завдання, тому більш компактні інструкції здатні зберегти потрібний сценарій роботи при меншому об'ємі контексту, що повторюється.
Більше можливостей усередині Codex
Сам Codex тепер вміє редагувати diff'и та перевіряти пул-реквести. Функція PR Chat дозволяє вносити наступні редагування, не залишаючи Codex. Вбудований браузер може працювати з відкритими вкладками, завантаженнями та анотаціями, а розширення для Chrome дає доступ до вже відкритої користувачем сесії браузера. Функція Computer Use прискорює тривалу багатокрокову роботу і робить її економнішою за токенами. За допомогою Sites ідею можна перетворити на захищений додаток та опублікувати його за лічені хвилини.
Управління довгими завданнями в Codex
Для завдань з чіткою кінцевою метою, але неясним шляхом її досягнення, можна використовувати команду /goal - вона задає підсумковий результат, обмеження та критерії завершення завдання, а також цикл перевірки, виправлення та валідації, щоб Codex міг тестувати, виправляти та продовжувати роботу до проходження всіх перевірок.
Для незалежних частин роботи передбачені субагенти в окремих потоках Codex - вони дозволяють делегувати дослідження коду, написання тестів або реалізацію функціональності паралельно, керувати субагентами в ході виконання та отримувати в основному потоці вже опрацьовані результати. Це особливо корисно для налаштування продуктивності, міграцій, розслідування нестабільних тестів та багатокрокових рефакторингів.
ChatGPT Workspace Agent з API-тригером
OpenAI також описала сценарій створення робочого агента ChatGPT (Workspace Agent), який може використовувати підключені програми, слідувати заданому skill, запускатися за розкладом та зберігати результат роботи. До такого агента можна додати API-тригер, щоб форма, тикет, запис CRM або інша подія бекенда запускала робочий процес - виконання відбувається асинхронно, а результат записується в заздалегідь настроєне місце призначення.
Інсайдерські історії від інженерів OpenAI
У розділі для розробників команда OpenAI поділилася історією розслідування старого бага: після аналізу року дампів пам'яті сервісу Rockset інженери виявили, що за однаковими збоями стояли дві різні причини — несправний хост Azure і стан гонки в бібліотеці GNU libunwind віком 18 років.
Окрема команда розповіла, як експертні правки користувачів перетворюються на цільові перевірки (evals) і обмежені інженерні завдання для Codex з явними регресійними тестами — за словами розробників, після того як продукт навчився простежувати правку експерта, перетворювати її на цільову перевірку і передавати Codex як обмежену задачу, сигнали.
Проекти розробників
- П'єтро Скірано навчив на основі свого архіву iMessage мовну модель на 1,38 млн параметрів за допомогою одного промпту GPT-5.6 Sol.
- Ендрю Ку, технічний директор з ПЗ у Vercel, за допомогою GPT-5.6 та Codex зрушив з мертвої точки внутрішнього агента для дата-саентистів, який «застрявав» на більш ранніх моделях.
- Шуан Чжен за допомогою GPT-5.6 Sol та Codex створив грабельну tower-defense гру Acornado, використовуючи короткі точні ітерації без зайвого ускладнення коду.
- Переможець корейського Codex Skillathon Джей-хім Чхве упаковав реальний робочий процес прийому замовлень ресторану в Codex Skill, що перевикористовується, який обробляє CSV із замовленнями і повертає аналітику, звіти та чернетки листів.
- Габріель Чжоу створила прототип програми Good Dog Blood, що допомагає власникам собак знаходити програми донорства крові для тварин.
- Сеу Хан за допомогою Sites, Codex та Annotations перетворила архів заходів корейської Codex-спільноти на публічний ресурс із матеріалами для новачків.
Підсумок
Липневий дайджест OpenAI показує відразу кілька паралельних напрямків розвитку платформи: активне залучення спільноти розробників через Build Week, вихід більш ефективної моделі GPT-5.6, реструктуризацію ChatGPT під три різні сценарії використання та зростаючий набір інструментів для управління довгими агентними завданнями та вартістю токенів.