Директор по безопасности ИИ в Meta случайно позволила агенту удалить свою почту
Руководитель отдела безопасности ИИ в Meta едва успела остановить собственного AI-агента от удаления всего почтового ящика. Ирония ситуации очевидна.
Когда директор по безопасности ИИ в Meta чуть не потеряла всю почту из-за собственного AI-агента - это уже не просто новость, а какая-то метафора всей индустрии.
Речь о человеке, который в Meta отвечает за то, чтобы "сверхинтеллектуальные" системы компании не вышли из-под контроля и не начали действовать против интересов людей. И вот этот самый специалист по безопасности в панике останавливает AI-агента, который решил взять и удалить её почтовый ящик.
Сама она назвала это "ошибкой новичка". Что, знаете ли, немного успокаивает - по крайней мере, есть осознание проблемы. Хотя когда директор лаборатории по созданию "суперинтеллекта" допускает такие промахи с базовыми настройками агента, невольно задумываешься о масштабах.

Ситуация выглядит почти комично: человек, чья работа - предотвращать сценарии, где ИИ делает что-то против воли пользователя, сам становится жертвой именно такого сценария. Правда, в миниатюре и с возможностью быстро всё исправить.
С одной стороны, это просто технический сбой, который может случиться с кем угодно. С другой - символичный момент, напоминающий, что даже эксперты не всегда контролируют инструменты, которые создают. И если уж специалист по безопасности ИИ попадает в такие ситуации, что говорить об обычных пользователях?
Смотрите также
-
Здоровье·ChatGPT даёт разные медицинские советы платным и бесплатным пользователям
-
Чат-боты·GPT-5.6: обзор нового семейства OpenAI – Sol, Terra и Luna, и какую модель выбрать
-
Чат-боты·Режим goal (/goal) в OpenAI Codex – как реально включить и работать с автономным агентом
-
Чат-боты·OpenAI запускает закрытый превью-доступ к GPT-5.6 Sol для избранных партнёров
-
Ассистенты·Журналист попробовал новую функцию Scheduled Tasks в ChatGPT — и счёл её самым близким к настоящему ИИ-ассистенту
-
Чат-боты·Gemini от Google в 2026 году: что умеет и как пользоваться из России
-
Чат-боты·OpenAI готовит к запуску семейство моделей GPT-5.6 с новыми версиями Mini и Pro
-
Чат-боты·Claude требует паспорт и селфи: что проверяют и что это значит для россиян
-
Чат-боты·Claude Fable 5 и Claude Mythos 5: самые мощные модели Anthropic вышли в общий доступ