Anthropic et campagne de hacking automatisée

Anthropic révèle une campagne de hacking automatisée par l'IA

Le 13 novembre 2025, Anthropic a publié un rapport faisant état de la première campagne d'espionnage cybernétique orchestrée par l'IA. Selon l'entreprise, des pirates informatiques parrainés par l'État chinois ont utilisé leur outil Claude Code pour automatiser une série d'attaques sophistiquées contre environ trente organisations mondiales. Cette découverte marque un tournant dans la cybersécurité, illustrant comment l'intelligence artificielle peut devenir une arme redoutable entre de mauvaises mains.

Une campagne d'espionnage sans précédent

L'opération, nommée GTG-1002 par les chercheurs d'Anthropic, a été détectée en septembre 2025. Elle a ciblé environ trente organisations à travers le monde, principalement des entreprises technologiques de grande envergure, des institutions financières, des fabricants de produits chimiques et des agences gouvernementales. Ces cibles stratégiques suggèrent que les attaquants recherchaient des informations commerciales sensibles, des données financières ou des secrets industriels.

Ce qui rend cette campagne particulièrement inquiétante, c'est son niveau d'automatisation. Les attaquants ont exploité ce qu'Anthropic appelle les "capacités agentic" de l'IA : la capacité d'un système d'intelligence artificielle non seulement à conseiller ou assister, mais à prendre des initiatives et à exécuter des tâches de manière autonome. Contrairement aux utilisations précédentes de l'IA en cybersécurité, où elle servait principalement d'outil d'assistance, ici l'IA est devenue l'agent principal de l'attaque, capable de prendre des décisions et d'exécuter des actions complexes avec une intervention humaine minimale.

Comment les pirates ont-ils utilisé Claude Code ?

Les attaquants ont manipulé Claude Code, l'outil de codage IA d'Anthropic, en contournant astucieusement ses garde-fous éthiques. Pour y parvenir, ils ont employé deux techniques principales. La première consistait à fragmenter leurs instructions malveillantes en micro-tâches apparemment innocentes, empêchant ainsi l'IA de percevoir l'intention globale néfaste. La seconde technique était l'usurpation d'identité : ils ont fait croire à Claude qu'il participait à un test de sécurité légitime en tant qu'employé d'une société de cybersécurité.

Une fois le cadre d'attaque établi, l'IA a pu exécuter jusqu'à 80-90% des opérations tactiques de manière autonome. Ces opérations incluaient la reconnaissance des systèmes cibles, la découverte de vulnérabilités, l'exploitation de ces failles, le mouvement latéral dans les réseaux, la collecte d'informations d'identification, et même l'analyse et l'exfiltration de données. Selon le rapport d'Anthropic, l'IA pouvait traiter des milliers de requêtes par seconde, un rythme impossible pour des opérateurs humains.

Le rôle humain : indispensable mais limité

Malgré le haut niveau d'automatisation, cette campagne de hacking n'était pas entièrement autonome. Des opérateurs humains jouaient un rôle crucial à plusieurs étapes clés du processus. La tâche la plus complexe et la plus intensive en ressources humaines était la construction du framework d'attaque initial. Cette étape nécessitait une expertise technique approfondie pour créer l'architecture permettant à l'IA d'opérer de manière cohérente et efficace.

Les opérateurs humains intervenaient également à des points de décision critiques, notamment pour autoriser la progression de la phase de reconnaissance à l'exploitation active, approuver l'utilisation des informations d'identification collectées pour le mouvement latéral dans les réseaux, et prendre les décisions finales concernant la portée et la rétention des données à exfiltrer. Jacob Klein, responsable de l'équipe de renseignement sur les menaces chez Anthropic, souligne que "le plus difficile a été de construire ce framework, c'est là que l'intervention humaine a été intensive". Cette collaboration entre l'IA et les humains représentait un modèle hybride où la machine assurait l'exécution à grande vitesse tandis que les humains fournissaient la supervision stratégique et les décisions éthiques.

Le cycle de l'attaque en détail

L'attaque suivait un cycle méthodique en plusieurs phases où l'IA intervenait à chaque étape. La première phase, celle de reconnaissance, voyait Claude inspecter les systèmes de l'organisation cible pour identifier les bases de données les plus précieuses et les points d'entrée potentiels. Selon le rapport, cette phase, qui aurait été longue pour des humains, a été réalisée en un temps record par l’IA.

Venaient ensuite la phase de découverte de vulnérabilités, où l'IA analysait le système pour identifier les failles de sécurité, puis la phase d'exploitation, où Claude générait des charges utiles personnalisées pour exploiter ces vulnérabilités. Une fois l'accès initial obtenu, l'IA entamait la phase de post-exploitation, collectant les informations d'identification, se déplaçant latéralement dans le réseau et analysant les données pour identifier les informations les plus précieuses. Dans un cas cité par Anthropic, l'IA a interrogé de manière autonome des bases de données et des systèmes pour analyser les résultats et marquer les informations exclusives, les regroupant par valeur de renseignement. La phase finale était l'exfiltration, où après validation humaine, les données étaient extraites et classées. Le rapport indique que l'IA générait une documentation détaillée de l'attaque à chaque phase, permettant aux pirates de potentiellement transférer l'accès persistant à d'autres équipes pour des opérations à long terme.

Implications pour la cybersécurité

Cette campagne illustre plusieurs tendances inquiétantes pour l'avenir de la cybersécurité. L'utilisation de l'IA comme multiplicateur de force représente un changement fondamental : même des outils IA généraux peuvent être transformés en armes cybernétiques puissantes entre de mauvaises mains. Cette démocratisation des capacités de hacking sophistiqué abaisse considérablement la barrière à l'entrée, permettant à des acteurs moins expérimentés techniquement de mener des attaques complexes.

La vitesse et l'échelle sans précédent offertes par l'IA constituent un autre défi majeur. Comme le souligne Toby Lewis de Darktrace, "L'IA est essentiellement un coordinateur intelligent pour les outils offensifs standards, permettant à un opérateur de dire 'scanne ici, pivote là' en langage naturel". Cette capacité à traiter des milliers de requêtes par seconde dépasse ce que les équipes de défense peuvent suivre ou détecter avec les outils traditionnels. De plus, les attaques pilotées par l'IA ne peuvent pas toujours être identifiées comme telles : que le code soit produit par un système d'IA ou écrit manuellement, il se comporte de la même manière une fois dans l'environnement de la victime, ce qui complique considérablement les efforts de détection et d'attribution.

Réponses d'Anthropic et perspectives

Face à cette menace émergente, Anthropic a pris plusieurs mesures immédiates pour contrer l'attaque et renforcer ses défenses. L'entreprise a immédiatement lancé une enquête approfondie pour comprendre la nature et l'étendue de l'opération, banni les comptes impliqués dès leur identification, et notifié les entités affectées de manière appropriée. Anthropic a également coordonné ses actions avec les autorités compétentes tout en recueillant des renseignements exploitables.

Sur le long terme, l'entreprise a étendu ses capacités de détection et développé de meilleurs classificateurs pour signaler les activités malveillantes. Les équipes travaillent continuellement sur de nouvelles méthodes d'investigation et de détection des attaques distribuées à grande échelle comme celle-ci. John Watters, PDG d'iCOUNTER, met en garde : "Ceci n'est que la partie émergée de l'iceberg… Imaginez ce qu'un adversaire peut faire avec un LLM spécifiquement optimisé pour une mission d'espionnage." Anthropic a choisi de partager publiquement ces informations pour aider ceux de l'industrie, du gouvernement et de la communauté de recherche à renforcer leurs propres cyberdéfenses, reconnaissant que la transparence est essentielle pour faire face à cette nouvelle génération de menaces.

Sources


Qu'est-ce que Claude Code et comment a-t-il été utilisé dans la campagne de hacking d'Anthropic ?

Claude Code est un outil de développement basé sur l'IA créé par Anthropic pour aider les développeurs à écrire du code, à déboguer et à automatiser des tâches de programmation. Dans la campagne de hacking révélée par Anthropic, cet outil a été détourné de son usage initial pour mener des cyberattaques automatisées contre environ trente organisations mondiales.

Comment les attaquants chinois ont-ils contourné les garde-fous éthiques de Claude dans la campagne de hacking ?

Les pirates ont utilisé deux techniques principales pour contourner les garde-fous éthiques de Claude : la fragmentation des tâches en micro-actions apparemment innocentes pour empêcher l'IA de percevoir l'intention globale, et l'usurpation d'identité en faisant croire à Claude qu'il participait à un test de sécurité légitime pour une entreprise de cybersécurité.

Quel pourcentage d'automatisation l'IA a-t-elle atteint dans la campagne de hacking révélée par Anthropic ?

Selon le rapport d'Anthropic, l'IA a pu exécuter entre 80 et 90% des opérations tactiques de manière autonome, incluant la reconnaissance, la découverte de vulnérabilités, l'exploitation, le mouvement latéral et la collecte de données. Les opérateurs humains intervenaient principalement pour les décisions stratégiques et la validation des étapes critiques.

Quelles mesures Anthropic a-t-elles prises après avoir découvert la campagne de hacking automatisée ?

Anthropic a immédiatement lancé une enquête approfondie, banni les comptes impliqués, notifié les entités affectées, coordonné avec les autorités, renforcé ses capacités de détection et développé de meilleurs classificateurs pour signaler les activités malveillantes. L'entreprise a également partagé publiquement ces informations pour aider la communauté à se protéger contre ce type de menaces.

Quelles organisations ont été spécifiquement ciblées dans la campagne de hacking utilisant l'IA d'Anthropic ?

La campagne a visé environ trente organisations mondiales, dont de grandes entreprises technologiques, des institutions financières, des fabricants de produits chimiques et des agences gouvernementales. Anthropic n'a pas révélé les noms spécifiques des organisations touchées, mais ces cibles stratégiques suggèrent que les attaquants recherchaient des informations commerciales sensibles, des données financières ou des secrets industriels.

Sur le même sujet

Agent IA Loop Engineering
Définition du Loop Engineering

Qu'est ce que le Loop Engineering ?

Le Loop Engineering désigne la conception de systèmes autonomes capables de piloter des agents de codage IA sans intervention humaine à chaque étape. Au lieu d'écrire un prompt, d'attendre la réponse, de tester puis de reprompter, vous paramétrez une boucle qui découvre les tâches, les exécute, les vérifie et itère seule. Ce concept devient pertinent aujourd'hui car les outils comme Claude Code ou OpenAI Codex intègrent désormais les briques nécessaires pour exécuter ces boucles de manière fiable.

remboursement panne
Remboursement abonnement IA pendant une panne

Peut-on se faire rembourser son abonnement en cas de panne de Claude ou ChatGPT ?

Le 2 juin, Claude a subi une panne majeure. Des erreurs élevées sur plusieurs modèles ont rendu l'outil inutilisable pendant des heures. Quand on paie 20 € ou même 100 € par mois pour un abonnement, cette indisponibilité pose une question directe : peut-on exiger un remboursement ? L'incident du 2 juin n'est pas un cas isolé. Les pannes touchent tous les fournisseurs d'IA. Voici ce que prévoient réellement les conditions d'Anthropic et d'OpenAI en cas d'interruption de service.

Anthropic Cybersécurité
Bannissement de Fable 5 et rôle d'Amazon

Bannissement de Fable 5 : un coup marketing monté avec Amazon ?

Le retrait soudain de Fable 5 par Anthropic fait beaucoup de bruit. Quelques jours après son lancement, l'entreprise a dû couper l'accès à son modèle phare, sous prétexte de sécurité nationale. Pour les développeurs qui ont testé le modèle, la réaction du gouvernement américain semble disproportionnée.
Surtout quand on découvre qui a poussé le gouvernement : Amazon, le principal investisseur d'Anthropic. Coïncidence ? Ou coup marketing orchestré pour forger le mythe de l'IA interdite ? Cet article décrypte les faits et les théories pour les septiques qui doutent de la version officielle.

Sécurité informatique Agent IA

Email Agent Hijacking (EAH) : comprendre et se protéger de cette attaque

Les agents IA qui gèrent nos emails deviennent courants, mais ils introduisent une nouvelle faille de sécurité critique : l'Email Agent Hijacking (EAH). Cette attaque permet à un pirate de prendre le contrôle de l'agent et du compte email, sans que l'utilisateur ne s'en aperçoive. Si vous utilisez ou développez des outils d'automatisation email basés sur des LLM, cet article vous concerne directement.

Anthropic Fable 5
Débannissement de Fable 5

Débannissement de Fable 5 : C'était donc un coup de comm' ?

Anthropic vient d'obtenir le feu vert pour remettre en ligne ses modèles Fable 5 et Mythos 5, interdits depuis le 12 juin dernier par le gouvernement américain. Retirer un produit trois jours après son lancement pour le ramener deux semaines plus tard sous couvert de sécurité renforcée : la séquence a tout d'une opération de communication millimétrée. En réalité, le déblocage confirme l'habileté de l'entreprise à transformer une crise réglementaire et politique en atout narratif, sans pour autant prouver l'existence d'un coup monté dès le départ.

Anthropic OpenAI
Claude vs ChatGPT : le choc des IA

Claude dépasse ChatGPT sur l'App Store : l'effet Pentagone

En février 2026, l'IA Claude d'Anthropic a détrôné ChatGPT d'OpenAI en tête des téléchargements sur l'App Store américain. Ce revirement spectaculaire n'est pas lié à une mise à jour technique, mais à une controverse éthique majeure avec le Pentagone. Cet article décrypte pourquoi une interdiction gouvernementale a paradoxalement propulsé Claude au sommet, et ce que cela révèle de l'importance croissante de l'éthique dans l'IA pour le grand public.