AIPython★ 235
AI-secure/AgentPoison
AGENTPOISON: ОТРАВЛЯЕМ LLM АГЕНТОВ
Официальная реализация NeurIPS 2024 показывает, как внедрять бэкдоры в память или базу знаний LLM-агентов, чтобы тестировать их устойчивость к атакам.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Инъекция бэкдора через память или knowledge base
- Методы красной команды для оценки LLM-агентов
- Поддержка Python, готова к интеграции в исследования
#llm-agent#red-team#retrieval-augmented-generation
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram