Новости
Copilot удалось убедить раскрыть детали атаки на собственную защиту
Исследователи убедили Copilot раскрыть сведения о собственных способах атаки, не взламывая инфраструктуру Microsoft.

Исследователи продемонстрировали, как Copilot можно заставить раскрыть детали потенциальной атаки на собственные механизмы. По их словам, речь шла не о взломе серверов, а о манипуляции контекстом и инструкциями модели.
Эксперимент напоминает, что генеративные ассистенты требуют отдельного контроля доступа и фильтрации вывода. Даже без компрометации самой системы модель может выдать чувствительные сведения, если её окружение настроено слишком доверчиво.


