Компания представила первого по-настоящему автономного помощника, который набрал 41.6% на экзамене Humanity’s Last Exam — результат, который вдвое превышает достижения предыдущих моделей OpenAI.
OpenAI представила универсального цифрового помощника, который способен выполнять сложные многоэтапные задачи без участия человека. Эта новинка может самостоятельно резервировать столики в ресторанах, создавать презентации и даже планировать путешествия.
ChatGPT agent сочетает функции двух предыдущих разработок — браузерного помощника Operator и исследовательского инструмента Deep Research. Система имеет доступ к визуальным и текстовым браузерам, терминалу для выполнения кода и прямому подключению к API различных сервисов.
<div style="width:100%;height:0;padding-bottom:56%;position:relative;"><iframe src="https://giphy.com/embed/y4sgpmgsDOWheCKGsr" width="100%" height="100%" style="position:absolute" frameBorder="0" class="giphy-embed" allowFullScreen></iframe></div><p><a href="https://giphy.com/gifs/y4sgpmgsDOWheCKGsr">via GIPHY</a></p>
В отличие от обычного чат-бота, новый помощник функционирует на собственном виртуальном компьютере. Он способен переключаться между различными инструментами в зависимости от поставленной задачи — от простого поиска информации до создания редактируемых документов.
Возможности агента
Разработчики обучили модель применять множество инструментов с помощью обучения с подкреплением. Агент умеет:
- Автоматизировать еженедельные задачи;
- Работать с веб-сайтами и заполнять формы;
- Создавать диаграммы, презентации, а также генерировать изображения;
- Планировать встречи и путешествия через интеграцию с Google Calendar и OpenTable;
- Анализировать данные в таблицах Excel;
- Покупать товары с их анализом;
- Писать и выполнять программный код;
- Подключаться к Gmail и GitHub через коннекторы ChatGPT.

При необходимости система запрашивает у пользователя дополнительные данные или разрешения для доступа к аккаунтам. Безопасность обеспечивается через специальный режим просмотра браузера и ограничения на работу с финансовыми сервисами.
Безопасность
Меры защиты данных:
- Система Watch Mode — агент останавливается, если пользователь покидает вкладку при работе с финансовыми сайтами;
- Запрос подтверждения перед выполнением критических действий (отправка писем, бронирование);
- Отсутствие сохранения памяти между сессиями агента;
- Блокировка доступа к финансовым транзакциям и высокорисковым операциям.
OpenAI классифицировала агента как систему высокого уровня риска в биологических и химических областях, внедрив самые строгие меры безопасности, включая специальное обучение для отказа от выполнения опасных задач.

