OpenAI заявила, что её ИИ достиг уровня исследователя-стажёра — цели, намеченной на сентябрь. По определению компании, такой агент выполняет под руководством человека чётко поставленные исследовательские задания, включая те, которые заняли бы у квалифицированного специалиста несколько дней. Вывод представлен в отчёте от 6 сентября.

Компания анализировала реальные рабочие сессии собственных сотрудников. Агенты пишут исследовательский код, помогают устранять неполадки и следят за запусками экспериментов. По словам сотрудников, спрос на технические консультации снизился настолько, что одна из команд прекратила регулярные консультации для исследователей.

Уровень "стажёра" остаётся оценкой самой OpenAI. Успешность задач оценивали с помощью ИИ, исключая случаи с неясным исходом. Более половины успешно выполненных заданий категории 4–8 часов потребовали хотя бы одного вмешательства человека; длительность здесь означает оценку времени, которое потратил бы специалист.

Следующая цель OpenAI — автоматизированный ИИ-исследователь к марту 2028 года. Пока человек задаёт приоритеты, выбирает перспективные результаты и решает, выпускать ли модель. Практический смысл нынешней ступени — возможность делегировать агенту содержательное задание и проверять его работу, сохраняя за собой руководство исследованием.

Фото: OpenAI.