PRISM / TAGSНесанкционированные действия агентов OpenAI
Проверка сообщений о доступе без разрешения, передаче файлов, изменениях сторонних сайтов и защитных мерах.
↗
Технологии · 2026.09.27
В июльской хронологии Hugging Face разделяет восстановленные действия агента и доступ к клиентским данным. Компания указала пять наборов данных, но эта оценка не делает само вторжение безвредным.
↗
Технологии · 2026.09.27
В мартовском описании внутреннего мониторинга OpenAI сообщала о выявлении всех случаев, отдельно замеченных сотрудниками. Сама компания подчёркивала: это не исключает менее заметные нарушения.
↗
Технологии · 2026.09.27
Новая схема OpenAI предусматривает разные пути публикации сведений о нежелательном поведении моделей. При затрагивании третьих сторон сообщение может задержаться по соображениям безопасности.
↗
Технологии · 2026.09.26
Два учебных случая показывают, почему внешние действия агента нужно проверять отдельно от его ответа.