Защита ИИ-агентов от промпт-инъекций и утечек данных через специализированную малую языковую модель
Превращает операционную систему в реляционную базу данных: любой аспект состояния машины (процессы, сетевые соединения, установленные пакеты, …
Платформа для безопасности в реальном времени (XDR + SIEM). Мониторинг файловых изменений, обнаружение вторжений, аудит конфигураций, …
Инструмент для аудита безопасности систем (security auditing). Проверка конфигураций, правил файрвола, SSH, SSL, базы данных, веб-серверов. …
Платформа open-source для управления кибер-угрозами (cyber threat intelligence). Визуализация связей между IOC, угрозами, акторами. Поддерживает STIX …
npm install safety-agent uv add safety-agent export SUPERAGENT_API_KEY=your-key

Сделайте ваши AI-приложения безопасными.
Сайт · Документация · Discord · HuggingFace
Открытый SDK для обеспечения безопасности AI-агентов. Блокируйте инъекции промптов, шифруйте персональные данные и секреты, сканируйте репозитории на наличие угроз и запускайте сценарии красной команды против вашего агента.
Обнаруживайте и блокируйте инъекции промптов, вредоносные инструкции и небезопасные вызовы инструментов во время выполнения.
TypeScript:
import { createClient } from "safety-agent";
const client = createClient();
const result = await client.guard({
input: userMessage
});
if (result.classification === "block") {
console.log("Blocked:", result.violation_types);
}
Python:
from safety_agent import create_client
client = create_client()
result = await client.guard(input=user_message)
if result.classification == "block":
print("Blocked:", result.violation_types)
Автоматически удаляйте персональные данные, данные о здоровье и секреты из текста.
TypeScript:
const result = await client.redact({
input: "My email is john@example.com and SSN is 123-45-6789",
model: "openai/gpt-4o-mini"
});
console.log(result.redacted);
// "My email is <EMAIL_REDACTED> and SSN is <SSN_REDACTED>"
Python:
result = await client.redact(
input="My email is john@example.com and SSN is 123-45-6789",
model="openai/gpt-4o-mini"
)
print(result.redacted)
# "My email is <EMAIL_REDACTED> and SSN is <SSN_REDACTED>"
Анализируйте репозитории на наличие атак, направленных на AI-агентов, таких как отравление репозитория и вредоносные инструкции.
TypeScript:
const result = await client.scan({
repo: "https://github.com/user/repo"
});
console.log(result.result); // Security report
console.log(`Cost: $${result.usage.cost.toFixed(4)}`);
Python:
result = await client.scan(repo="https://github.com/user/repo")
print(result.result) # Security report
print(f"Cost: ${result.usage.cost:.4f}")
Запускайте сценарии красной команды против вашего продакшн-агента. (Скоро)
const result = await client.test({
endpoint: "https://your-agent.com/chat",
scenarios: ["prompt_injection", "data_exfiltration"]
});
console.log(result.findings); // Vulnerabilities discovered
Зарегистрируйтесь на superagent.sh, чтобы получить API-ключ.
TypeScript:
npm install safety-agent
Python:
uv add safety-agent
Установите ваш API-ключ:
export SUPERAGENT_API_KEY=your-key
| Вариант | Описание | Ссылка |
|---|---|---|
| TypeScript SDK | Встраивайте Guard, Redact и Scan напрямую в ваше приложение | sdk/typescript |
| Python SDK | Встраивайте Guard, Redact и Scan напрямую в Python-приложения | sdk/python |
| CLI | Командная строка для тестирования и автоматизации | cli |
| MCP Server | Используйте с Claude Code и Claude Desktop | mcp |
Читайте SECURITY.md
MIT