Проект Datasette 11 сентября выпустил версии 1.0a39 и 0.65.4 после своего первого полноценного аудита безопасности с Claude Fable 5.1, GPT-5.6 Sol и GPT-6 Astra. По словам создателя проекта Саймона Уиллисона, агенты помогли найти ряд малозаметных ошибок; затем разработчики почти неделю проверяли находки и готовили исправления.

Обновления усилили разграничение доступа к таблицам и поисковым индексам, закрыли утечки сведений о скрытых строках, исправили экранирование SQL-идентификаторов и HTML, а также запретили превращать непроверенные адреса в ссылки. Большинство проблем затрагивало публичные экземпляры Datasette, в которых авторизованным пользователям одновременно открывают частные данные; исправления уже установлены в Datasette Cloud.

Аудит не был автономным. Уиллисон и Алекс Гарсия разделяли работу так, чтобы один человек писал тест для найденной проблемы, а другой реализовывал исправление; таким образом каждую правку просматривали два разработчика вдобавок к агентам на разных моделях. Часть тестов пока не публикуют, чтобы дать администраторам время обновиться.

Datasette не раскрывает, какую именно уязвимость нашла каждая модель, а некоторые проблемы первоначально сообщили внешние исследователи. Поэтому этот случай не доказывает, что ИИ способен самостоятельно гарантировать безопасность кода. Он подтверждает более узкий, но практический результат: агенты дали разработчикам полезные находки в реальном аудите, и проект намерен включить такие проверки во всю дальнейшую работу.