OpenAI опубликовала руководство по работе с новым семейством моделей GPT-6, сделав акцент на задачах, которые могут занимать часы или даже дни. Компания описывает модели не только как инструменты для генерации ответов, но и как основу для систем, способных самостоятельно выполнять многоэтапную работу.

В семейство входят три модели. GPT-6 Astra предназначена для наиболее сложных задач, требующих максимальных возможностей рассуждения. GPT-6.1 Sol ориентирована на программирование, исследования и управление компьютером, а GPT-6 Luna — на быстрые повторяющиеся задачи, которые выполняются в больших объемах.
OpenAI отдельно рекомендует не пытаться решать все задачи одной и той же моделью. Для каждой работы стоит учитывать сложность, стоимость и скорость ответа, а также выбирать подходящий уровень усилий на рассуждения. Для простых операций компания предлагает низкий уровень, а для сложного анализа и отладки — высокий или максимальный, если дополнительное качество оправдывает затраты.
Одно из главных изменений касается длительных задач. GPT-6 может получать уточнения уже во время выполнения работы, причем новые инструкции не отменяют запущенные операции и не стирают сделанные ранее шаги. Это позволяет менять направление работы, если требования изменились, не начиная весь процесс заново.
Модели также могут выполнять несколько независимых операций параллельно. Например, пока одна задача требует времени на тестирование, система может продолжать другую работу, не связанную с ее результатом. GPT-6.1 Sol дополнительно поддерживает многоагентный режим: модель может разделить крупную задачу между несколькими субагентами, а затем объединить их результаты. Сейчас эта возможность находится в стадии бета-тестирования.
Еще одна возможность — управление компьютером. GPT-6 Astra, GPT-6.1 Sol и GPT-6 Luna могут взаимодействовать с сайтами и настольными приложениями даже в тех случаях, когда у них нет специального API. Модель способна прочитать информацию на экране, нажать кнопки или заполнить форму. OpenAI приводит в качестве примера сценарий, в котором ИИ исследует ошибку, исправляет код, а затем открывает продукт в браузере и проверяет результат.
При этом OpenAI советует четко определять границы самостоятельности модели. В инструкциях нужно заранее указать, какие действия она может выполнять сама, а для каких решений требуется одобрение человека. Также разработчикам рекомендуют явно описывать критерии завершения работы: модель должна не просто внести изменения, а запустить их, проверить результат и устранить обнаруженные ошибки.
Для работы в продакшене OpenAI рекомендует использовать кэширование и сжатие контекста, отслеживать успешность выполнения задач, задержку и стоимость. Компания также советует тестировать типичные сценарии до развертывания системы и оценивать не только скорость или цену, но и стоимость одной успешно выполненной задачи.
OpenAI рассматривает GPT-6 прежде всего как основу для более длительной и самостоятельной работы ИИ-систем. Модели должны не просто отвечать на отдельные запросы, а выполнять цепочки действий, получать уточнения по ходу работы, использовать внешние инструменты и при необходимости распределять задачи между несколькими агентами.
Читайте также:
GPT-6 Astra расшифровала письмо времен Наполеона, которое не могли прочитать 217 лет
OpenAI уволила трех сотрудников после передачи конфиденциальных данных