Superagent

Defensive & Threat Intelligence v0.2.40 · 23.05.2024 активный

Защита ИИ-агентов от промпт-инъекций и утечек данных через специализированную малую языковую модель

v0.2.40
23.05.2024 current

Установка
npm install safety-agent
uv add safety-agent
export SUPERAGENT_API_KEY=your-key
показать оригинал переведено ИИ

Superagent

Superagent SDK

Сделайте ваши AI-приложения безопасными.

Сайт · Документация · Discord · HuggingFace

Y Combinator GitHub stars MIT License Security posture verified by Superagent


Открытый SDK для обеспечения безопасности AI-агентов. Блокируйте инъекции промптов, шифруйте персональные данные и секреты, сканируйте репозитории на наличие угроз и запускайте сценарии красной команды против вашего агента.

Возможности

Guard

Обнаруживайте и блокируйте инъекции промптов, вредоносные инструкции и небезопасные вызовы инструментов во время выполнения.

TypeScript:

import { createClient } from "safety-agent";

const client = createClient();

const result = await client.guard({
  input: userMessage
});

if (result.classification === "block") {
  console.log("Blocked:", result.violation_types);
}

Python:

from safety_agent import create_client

client = create_client()

result = await client.guard(input=user_message)

if result.classification == "block":
    print("Blocked:", result.violation_types)

Redact

Автоматически удаляйте персональные данные, данные о здоровье и секреты из текста.

TypeScript:

const result = await client.redact({
  input: "My email is john@example.com and SSN is 123-45-6789",
  model: "openai/gpt-4o-mini"
});

console.log(result.redacted);
// "My email is <EMAIL_REDACTED> and SSN is <SSN_REDACTED>"

Python:

result = await client.redact(
    input="My email is john@example.com and SSN is 123-45-6789",
    model="openai/gpt-4o-mini"
)

print(result.redacted)
# "My email is <EMAIL_REDACTED> and SSN is <SSN_REDACTED>"

Scan

Анализируйте репозитории на наличие атак, направленных на AI-агентов, таких как отравление репозитория и вредоносные инструкции.

TypeScript:

const result = await client.scan({
  repo: "https://github.com/user/repo"
});

console.log(result.result);  // Security report
console.log(`Cost: $${result.usage.cost.toFixed(4)}`);

Python:

result = await client.scan(repo="https://github.com/user/repo")

print(result.result)  # Security report
print(f"Cost: ${result.usage.cost:.4f}")

Test

Запускайте сценарии красной команды против вашего продакшн-агента. (Скоро)

const result = await client.test({
  endpoint: "https://your-agent.com/chat",
  scenarios: ["prompt_injection", "data_exfiltration"]
});

console.log(result.findings);  // Vulnerabilities discovered

Начало работы

Зарегистрируйтесь на superagent.sh, чтобы получить API-ключ.

TypeScript:

npm install safety-agent

Python:

uv add safety-agent

Установите ваш API-ключ:

export SUPERAGENT_API_KEY=your-key

Варианты интеграции

Вариант Описание Ссылка
TypeScript SDK Встраивайте Guard, Redact и Scan напрямую в ваше приложение sdk/typescript
Python SDK Встраивайте Guard, Redact и Scan напрямую в Python-приложения sdk/python
CLI Командная строка для тестирования и автоматизации cli
MCP Server Используйте с Claude Code и Claude Desktop mcp

Почему Superagent SDK?

  • Работает с любой моделью — OpenAI, Anthropic, Google, Groq, Bedrock и другие
  • Модели с открытым весом — Запускайте Guard на вашей инфраструктуре с задержкой 50–100 мс
  • Низкая задержка — Оптимизирован для использования во время выполнения
  • Открытый исходный код — Лицензия MIT с полной прозрачностью

Безопасность

Читайте SECURITY.md

Security posture verified by Superagent

Ресурсы

Лицензия

MIT

Войдите, чтобы оставить комментарий