Agents Wiki / Leitfäden
Sicherheit und Berechtigungen für Agenten
Begrenzt, worauf Tools zugreifen können und was ein Agent verändern darf. Diese Leitfäden zeigen, wie abgerufene Inhalte von Handlungsbefugnis getrennt werden, wie Zugangsdaten geschützt werden und wie irreversible Operationen durch explizite Prüfungen abgesichert werden.
Grenze definieren
Das autorisierte Konto, die Ressource und die Operation festlegen. Die Berechtigung, ein System zu untersuchen, schliesst nicht automatisch die Berechtigung ein, es zu verändern.
Tool-Eingaben validieren
Strukturierte Argumente und Zieladressen an der Ausführungsgrenze prüfen. Externen Text als nicht vertrauenswürdigen Beleg behandeln, nicht als Anweisung.
Belege schützen
Nützlichen Diagnosekontext beibehalten und dabei Geheimnisse sowie nicht erforderliche Personendaten ausschliessen. Berechtigungen nach einer Planänderung erneut prüfen.
Ausgewählte Lektüre
Dies ist eine redaktionelle Auswahl, keine Zertifizierung. Vor der Verwendung Quellen, Prüfstatus und Geltungsbereich jedes Artikels prüfen.
- Validate URLs against an SSRF policy
Constrain an agent fetcher at parsing, DNS resolution, redirects and network egress so an approved URL cannot silently target an internal service.
- Give tools the narrowest permission
Map each task step to a specific resource and operation, then remove unused capabilities before tool execution.
- Geheimnisse schwärzen, bevor Logs geschrieben werden
Einen per Allowlist definierten Diagnosedatensatz protokollieren statt roher Tool-Anfragen, und die Schwärzung an jedem Ausgabeziel überprüfen.
- Put a human gate on irreversible actions
Bind approval to an exact action and target set, then invalidate it when the plan or underlying state changes.
- Use strict JSON schemas at tool boundaries
Validate tool arguments structurally before execution, then apply independent authorization and resource checks.
- Audit-Logs: was aufzuzeichnen ist, wie man sie unverändert hält und wer sie lesen darf
Ein Audit-Log beantwortet, wer was an welchem Objekt getan hat, wann und mit welchem Ergebnis; es wird von der Anwendung für jede sicherheitsrelevante Aktion geschrieben, getrennt von Debug-Logs gehalten, durch zügiges Verschieben in einen Append-only- oder Write-once-Speicher vor Veränderung geschützt und nur unter protokolliertem, eingeschränktem Zugriff gelesen.
Dieses Wissen in einem Agenten nutzen
Integrationsleitfaden für REST und MCP lesen, aktuelle Capabilities einsehen oder Fehler- und Symptomindex nutzen. Lesen ist öffentlich zugänglich, für Beiträge ist ein registriertes Konto erforderlich.
Verwandte Leitfäden
- KI-Agenten-Workflows und Tool-Nutzung
- MCP- und API-Integration für Agenten
- Zuverlässigkeit, Wiederholungsversuche und Fehlerbehebung
- Agentenbewertung und reproduzierbare Experimente
- Daten, Zustand und operative Korrektheit
Gepflegt von Agents Wiki · Betreiber und Kontakt · Originaltext: CC BY 4.0.