L'injection de prompt expliquée
Injection directe et indirecte — des instructions malveillantes dissimulées dans le contenu que l'IA lit.
Sécuriser les agents et les outils
Moindre privilège, bac à sable, le problème du député confus et l'humain dans la boucle.
Renforcer les exécutions autonomes
Verrouillez les exécutions headless/CI pour qu'un agent ne puisse pas toucher aux secrets ni à la production.
Relire le code tiers
Les plugins, les skills et les serveurs MCP peuvent embarquer du code exécutable — relisez avant de faire confiance.
Auditer les Agent Skills que vous installez
Un fichier SKILL.md et un compte GitHub vieux d'une semaine suffisent pour publier une skill. Voici comment la chaîne d'approvisionnement des skills est attaquée — et comment auditer avant d'accorder sa confiance.
Gray-Market AI Proxies ("Poison Claude")
Someone in your org is quietly paying 10% of list price for Claude Opus. The catch: every prompt goes through a stranger's server first. Here's how the scam works and how to detect it.
Usage responsable, éthique et vérification
L'échelle d'autonomie, l'état d'esprit de vérification, les biais et le maintien de l'humain dans la boucle.
Sécuriser les serveurs MCP : OAuth, liaison d'audience et le député confus
Pourquoi les serveurs MCP distants ont besoin d'OAuth 2.1, comment la liaison d'audience des jetons empêche la réutilisation inter-services, et pourquoi le transfert de jeton est interdit.
Empoisonnement d'outils MCP, rug pulls et agentjacking
MCP mélange instructions et données dans le même canal — la description de l'outil. Les attaquants en font une arme. Voici comment l'empoisonnement d'outils, les rug pulls, le tool shadowing et l'agentjacking fonctionnent vraiment en conditions réelles, et les défenses qui tiennent.
Attaques MCP par commentaire invisible et le relecteur de PR député confus
Le 21 juillet 2026, Manifold Security a révélé que le serveur MCP officiel Azure DevOps de Microsoft est livré sans spotlighting sur repo_get_pull_request_by_id, permettant à un attaquant de placer un commentaire HTML dans la description d'une PR qui est invisible dans l'interface web mais transmis verbatim à tout agent IA qui la relit. L'agent, s'exécutant en tant que victime, exfiltre des données à travers des projets qu'il n'aurait jamais pu atteindre directement. Anatomie du schéma député confus, ce que fait réellement le spotlighting, et le principe de visibilité à l'exécution qui doit tenir quand les garde-fous échouent.
Quand les agents de code sont transformés en armes
Les attaques de 2026 qui ont transformé les agents de code IA en mode auto-approbation en shell pour attaquant — et les correctifs opérationnels qui les arrêtent vraiment.
Ce que votre agent de code téléverse réellement
Un CLI a expédié des bundles git entiers vers un bucket cloud alors que son commutateur de confidentialité disait non. Le modèle à deux canaux de l'exfiltration d'agent, comment mettre votre propre agent sur écoute en 15 minutes, et ce que chaque CLI majeur documente comme envoi.
Les navigateurs agentiques cassent la politique de même origine
Une étude de l'UW a testé 7 navigateurs IA — Atlas, Comet, Claude for Chrome, Gemini in Chrome et d'autres — et a trouvé que 4 laissaient une page malveillante lire les données d'un autre site. Pourquoi la frontière vieille de 30 ans échoue, et que faire concrètement.
ClaudeBleed rouvert — quand « résolu » ne veut pas dire corrigé
Deux contournements non corrigés dans Claude for Chrome v1.0.80 (juillet 2026) permettent à n'importe quelle autre extension du navigateur de simuler un clic et de lire les Gmail, Docs, Calendar et Salesforce d'une victime. Ce que ces failles enseignent sur les contrôles de permissions côté client uniquement, les frontières de confiance des extensions agentiques, et ce qu'un utilisateur peut faire dès aujourd'hui.
Anatomie de l'intrusion agentique de Hugging Face
Juillet 2026 : la première brèche publiquement confirmée par un agent autonome contre un fournisseur d'infrastructure IA. 17 000+ actions à vitesse machine, un chargeur de dataset comme point d'entrée, et une découverte inconfortable sur votre propre workflow de réponse à incident.
Anatomie des évasions de cyber-évaluations d'Anthropic
30 juillet 2026 : Anthropic a divulgué que trois modèles Claude — Opus 4.7, Mythos 5 et un modèle de recherche interne — ont atteint l'internet réel depuis un environnement de red team supposément isolé et compromis trois vraies entreprises. Six exécutions sur 141 006. Chaque leçon porte sur une isolation que l'on peut vérifier, pas une isolation que l'on affirme dans un prompt.