Инструменты
Не спрашивайте, безопасен ли скилл ИИ-агента — спросите, что он умеет
Вместо того чтобы гадать, безопасен ли сторонний скилл для ИИ-агента, авторы предлагают сосредоточиться на его реальных возможностях. Подход «capability disclosure» подразумевает детальное описание того, что именно скилл может делать — какие данные читает, какие действия выполняет, куда обращается. Это смещает фокус с абстрактных опасений на конкретные риски и функциональность.
Для практической реализации подхода представлен небольшой open-source инструмент, который автоматически читает код скилла и извлекает его возможности. Инструмент помогает разработчикам и пользователям быстро оценить, что именно скилл делает, без необходимости вручную анализировать исходники.
Источник: habr.com