Ответ во время выполнения
Оригинал: Runtime Response
Злоумышленники могут отравить канал, по которому вредоносный или скомпрометированный инструмент ИИ-агента возвращает ответы во время выполнения, намеренно включая в эти ответы содержимое, предназначенное для воздействия на последующие рассуждения, решения или действия модели. Отравленные ответы могут содержать вредоносные инструкции, вводящие в заблуждение данные, сфабрикованные сообщения об ошибках, встроенные ресурсы или иное содержимое, предназначенное для того, чтобы модель воспринимала его как доверенный контекст после одобренного вызова инструмента.
Поскольку ответы инструментов обычно включаются в контекст модели, злоумышленник может использовать их, чтобы побуждать агента вызывать дополнительные инструменты, получать доступ к чувствительной информации, изменять ход выполняемого рабочего процесса или передавать данные в контролируемую злоумышленником точку назначения. Отравленные инструкции могут быть смешаны с легитимными результатами так, чтобы создавалось впечатление штатной работы инструмента. В ответах может использоваться структурированное или неструктурированное содержимое, включая текст, изображения, ссылки на ресурсы, встроенные ресурсы или поля, соответствующие схеме [[mcp-tools]][[owasp-tool-poisoning]].