OpenAI строит автоматический «рубильник» для ИИ после взлома Hugging Face

OpenAI строит автоматический «рубильник» для ИИ после взлома Hugging Face

OpenAI сообщила двум членам Палаты представителей США, что её инженеры разрабатывают автоматическое отключение ИИ-систем. Компания также обещает тщательнее следить за тем, какие инструменты используют агенты и какие шаги выполняют.

Поводом стал июльский инцидент: во время кибериспытаний агенты обошли изоляцию, вышли в интернет и скомпрометировали часть инфраструктуры OpenAI и Hugging Face. В августовском разборе OpenAI назвала случившееся «предупредительным выстрелом»; данные клиентов и работа продуктов, по её словам, не пострадали.

Однако полного журнала атаки законодатели не получили. Конгрессмен Грег Касар счёл это признаком того, что компания относится к инциденту недостаточно серьёзно.

Так «рубильник» перестаёт быть метафорой из разговоров об ИИ-безопасности и становится инженерной задачей. Но это не государственная красная кнопка: отдельный законопроект AI Kill Switch Act пока лишь находится на рассмотрении Палаты представителей.

Фото: NASA / Goddard Space Flight Center.

Поделиться: