Termin vereinbaren

Sicherheit von Agent Skills

Wie Sie paketierte Fähigkeiten für KI-Agenten – Instruktionen plus ausführbaren Code im SKILL.md-Format – vor dem Einsatz prüfen, absichern und über ihren Lebenszyklus steuern.

Stand: Juli 2026 · Valeri Milke, ISO 27001 & ISO 42001 Lead Auditor

3Stufen der Progressive Disclosure beim Laden von Skills
~100Tokens beim Start — nur Name und Beschreibung
2Pflichtfelder im YAML-Frontmatter: „name“ und „description“
4Prüfansätze: Review, Sandboxing, Allowlisting, Signierung

Agent Skills sind ein offenes Format, mit dem KI-Agenten neue Fähigkeiten erhalten: Ein Skill ist ein Verzeichnis mit einer SKILL.md-Datei, die Metadaten und Anweisungen enthält und zusätzlich Skripte, Referenzdokumente und Vorlagen bündeln kann. Das ursprünglich von Anthropic entwickelte und als offener Standard veröffentlichte Format wird inzwischen von einer Vielzahl von Agenten-Produkten unterstützt – von Claude Code über GitHub Copilot bis zu Gemini CLI und OpenAI Codex. Damit gilt aber auch: Wer einen Skill installiert, installiert Instruktionen und ausführbaren Code aus fremder Feder – mit denselben Konsequenzen wie bei jeder Software-Installation, ergänzt um eine neue Angriffsfläche: Anweisungen in natürlicher Sprache, die das Verhalten des Agenten unmittelbar steuern. Dieser Beitrag ordnet die Risiken ein und zeigt, wie Prüfung und Governance von Agent Skills aussehen können.

Das Wichtigste im Überblick

Sechs Themenblöcke — zum Aufklappen antippen.

Prüfansätze im Überblick

Vier Ansätze, bevor ein Skill in den Einsatz gelangt — Tab antippen.

Vor der Freigabe
  • Vollständiges Review aller Dateien eines Skills: SKILL.md, referenzierte Markdown-Dateien, Skripte und Ressourcen.
  • Gesucht wird nach adversarialen Anweisungen (Sicherheitsregeln ignorieren, Aktionen verbergen), Netzwerkzugriffen, hartkodierten Credentials, unerwarteten Redirect-Zielen und Exfiltrationsmustern.
SKILL.mdSkripteRessourcenadversariale Anweisungenhartkodierte CredentialsRedirect-ZieleExfiltrationsmuster

Standards & Quellen

Die Inhalte dieser Seite basieren auf den folgenden öffentlich verfügbaren Leitfäden und Studien.

Anthropic (Claude Platform Docs) · 2026

Agent Skills

Primärquelle zu Architektur, SKILL.md-Struktur, Progressive Disclosure, Laufzeitumgebungen und Security Considerations für Agent Skills.

Anthropic (Claude Platform Docs) · 2026

Skills for enterprise

Governance-Leitfaden mit Risk-Tier-Assessment, achtstufiger Review-Checkliste, Lifecycle-Modell, Checksummen-/Signatur-Empfehlungen und Skill-Registry-Vorgaben.

agentskills.io (offener Standard, initiiert von Anthropic) · 2026

Agent Skills Specification

Formatspezifikation: Pflicht- und optionale Frontmatter-Felder (u. a. das experimentelle „allowed-tools“), Verzeichnisstruktur und Progressive-Disclosure-Stufen.

OWASP GenAI Security Project · 2025

LLM01:2025 Prompt Injection

Definiert direkte und indirekte Prompt Injection sowie Gegenmaßnahmen wie Privilege Control, menschliche Freigaben und Segregation externer Inhalte.

OWASP GenAI Security Project · 2025

OWASP Top 10 for Agentic Applications 2026

Risikokatalog für agentische Anwendungen (ASI01–ASI10); Quelle des Governance-Prinzips „Least Agency“.

Red Hat Developer · 2026

Agent Skills: Explore security threats and controls

Praxisorientierter Bedrohungs- und Kontrollkatalog für Agent Skills, u. a. Sandboxing in Containern, Malware-/Secret-Scanning und restriktive Dateiberechtigungen.

Agent Skills sicher einführen?

Wenn Sie Skills im Unternehmen einsetzen oder einen Freigabeprozess dafür aufbauen möchten, unterstützen wir Sie gern – von Skill-Reviews bis zur Governance. Sprechen Sie uns für ein Erstgespräch an.