Prendre rendez-vous

Sécurité des Agent Skills

Comment vérifier, sécuriser et piloter tout au long de leur cycle de vie les capacités packagées pour agents IA – instructions et code exécutable au format SKILL.md – avant leur mise en service.

Mise à jour: juillet 2026 · Valeri Milke, Lead Auditor ISO 27001 & ISO 42001

3étapes de progressive disclosure au chargement des skills
~100tokens au démarrage — seuls le nom et la description
2champs frontmatter obligatoires : « name » et « description »
4approches de vérification : revue, sandboxing, allowlisting, signature

Les Agent Skills sont un format ouvert qui permet de doter les agents IA de nouvelles capacités : un skill est un répertoire contenant un fichier SKILL.md avec métadonnées et instructions, qui peut en outre regrouper des scripts, des documents de référence et des modèles. Développé à l'origine par Anthropic et publié comme standard ouvert, le format est désormais pris en charge par de nombreux produits d'agents – de Claude Code à GitHub Copilot, en passant par Gemini CLI et OpenAI Codex. Mais cela signifie aussi : qui installe un skill installe des instructions et du code exécutable écrits par des tiers – avec les mêmes conséquences que toute installation logicielle, auxquelles s'ajoute une nouvelle surface d'attaque : des instructions en langage naturel qui pilotent directement le comportement de l'agent. Cet article met les risques en perspective et montre à quoi peuvent ressembler la vérification et la gouvernance des Agent Skills.

L'essentiel en un coup d'œil

Six blocs thématiques — appuyez pour les déplier.

Approches de vérification en un coup d'œil

Quatre approches avant la mise en service d'un skill — choisissez un onglet.

Avant approbation
  • Une revue complète de tous les fichiers d'un skill : SKILL.md, fichiers Markdown référencés, scripts et ressources.
  • À la recherche d'instructions adversariales (ignorer les règles de sécurité, dissimuler des actions), d'accès réseau, d'identifiants codés en dur, de cibles de redirection inattendues et de schémas d'exfiltration.
SKILL.mdscriptsressourcesinstructions adversarialesidentifiants codés en durcibles de redirectionschémas d'exfiltration

Normes & sources

Le contenu de cette page s'appuie sur les guides et études suivants, accessibles publiquement.

Anthropic (Claude Platform Docs) · 2026

Agent Skills

Source primaire sur l'architecture, la structure SKILL.md, la progressive disclosure, les environnements d'exécution et les security considerations des Agent Skills.

Anthropic (Claude Platform Docs) · 2026

Skills for enterprise

Guide de gouvernance avec évaluation par niveaux de risque, checklist de revue en huit étapes, modèle de cycle de vie, recommandations de checksums/signatures et exigences de registre de skills.

agentskills.io (offener Standard, initiiert von Anthropic) · 2026

Agent Skills Specification

Spécification du format : champs frontmatter obligatoires et optionnels (dont le champ expérimental « allowed-tools »), structure des répertoires et étapes de progressive disclosure.

OWASP GenAI Security Project · 2025

LLM01:2025 Prompt Injection

Définit la prompt injection directe et indirecte ainsi que des contre-mesures telles que le privilege control, les validations humaines et la ségrégation des contenus externes.

OWASP GenAI Security Project · 2025

OWASP Top 10 for Agentic Applications 2026

Catalogue de risques pour les applications agentiques (ASI01–ASI10) ; source du principe de gouvernance « Least Agency ».

Red Hat Developer · 2026

Agent Skills: Explore security threats and controls

Catalogue pratique de menaces et de contrôles pour les Agent Skills, incluant le sandboxing en conteneurs, le scan de malwares/secrets et des permissions de fichiers restrictives.

Déployer les Agent Skills en toute sécurité ?

Si vous utilisez des skills dans votre entreprise ou souhaitez mettre en place un processus d'approbation dédié, nous vous accompagnons volontiers – des revues de skills à la gouvernance. Contactez-nous pour un premier échange.