OSS Scanner : Anthropic offre des audits IA à l'open source, sans relecture
Anthropic propose aux projets open source des audits de sécurité périodiques réalisés par ses modèles les plus puissants, gratuitement mais sans validation humaine. Le service répond à un goulot d'étranglement : 29 000 failles candidates, 6 000 triées.
Anthropic a lancé le 8 octobre OSS Scanner, un service facultatif qui fournit aux projets open source des analyses de sécurité périodiques, réalisées sans frais par ses « modèles les plus puissants », dont Claude Mythos. Particularité : les rapports sont entièrement générés par les modèles, sans relecture ni tri humain. Les mainteneurs reçoivent donc plus vite des signalements, mais certains peuvent être erronés.
Un goulot d'étranglement humain
Le service découle de l'expérience acquise avec le Project Glasswing. Selon Anthropic, l'entreprise a découvert en six mois plus de 29 000 vulnérabilités candidates dans des logiciels importants, mais n'a pu en examiner manuellement qu'environ 6 000. Face à cette limite, certains mainteneurs demandent d'eux-mêmes l'envoi de tout ce qui existe, même non validé : près de 5 000 rapports ont déjà été transmis ainsi.
Anthropic s'appuie aussi sur la progression des modèles : sur le benchmark académique CyberGym, la part de vulnérabilités trouvées serait passée de moins de 20 % début 2025 à plus de 85 % cette année. L'entreprise affirme que les mainteneurs reçoivent désormais surtout des rapports de qualité, et non plus du « slop ». Le contexte reste contrasté : selon The Verge, certains projets, dont celui de Linus Torvalds et même Google, peinent à absorber l'afflux de rapports générés par IA.
Le modèle revendiqué est l'OSS-Fuzz de Google. OSS Scanner se distingue de Claude Security, produit destiné aux entreprises.
Ce que contiennent les rapports
Chaque rapport comprend un reproducteur autonome, une explication de la faille (avec, si possible, l'identification du moment où le bogue a été introduit) et, quand il existe, un correctif candidat. Lors de tests sur des dizaines de projets, des centaines de rapports ont été produits, dont plusieurs failles enchaînables jusqu'à une exécution de code à distance sans authentification.
Pour valider une version préliminaire, des pentesteurs experts ont examiné 97 vulnérabilités critiques ou élevées issues de 48 projets. Selon Anthropic, 85 (88 %) respectaient les critères de son processus de divulgation coordonnée. Sur les 12 restantes, 11 étaient réelles mais déjà connues ou en doublon, et une seule était un faux positif. Des mainteneurs signalent toutefois des niveaux de gravité parfois gonflés, ou une mauvaise compréhension du modèle de menace. « Nous ne pouvons pas garantir que le scanner sera parfait » (traduction), reconnaît l'entreprise, qui promet d'affiner le système.
Un retour favorable vient d'OpenSSL : « Les rapports reçus d'Anthropic, sortie brute du modèle comprise, étaient aussi bons et parfois meilleurs que ceux que nous recevons de personnes » (traduction), déclare Anton Arapov, d'OpenSSL Corporation (Help Net Security).
Modalités et inscription
Les mainteneurs principaux candidatent par une pull request sur le dépôt GitHub dédié. Les critères reprennent ceux d'OSS-Fuzz : un « impact critique sur l'infrastructure et la sécurité des utilisateurs », avec examen au cas par cas. Selon Cointelegraph, l'exposition aux attaques distantes et le nombre d'utilisateurs ou de projets dépendants entrent aussi en compte.
D'après Help Net Security, un projet inscrit reçoit par e-mail un premier lot de rapports, puis des scans ultérieurs ciblant les nouvelles failles et celles manquées. La fréquence dépend notamment de la demande et de la diffusion du projet. Les mainteneurs peuvent préciser quoi tester, quelles entrées juger malveillantes et quels correctifs ils souhaitent. Le service vise les équipes capables de suivre des rapports vérifiés de gravité élevée et d'enquêter sur davantage de constats.
Les résultats non validés n'imposent pas le délai de divulgation de 90 jours. Si Anthropic valide ensuite un rapport via sa procédure coordonnée, ce délai peut commencer à la notification. Un projet peut suspendre les envois automatiques ou se retirer pour ne recevoir que les rapports vérifiés. Anthropic maintient par ailleurs cette voie humaine, notamment pour les projets sans moyens de tri.
Les premiers candidats viennent de la crypto
Selon Cointelegraph, Nethermind (client Ethereum) et ZEUS (portefeuille Bitcoin et Lightning) ont déposé leur candidature le vendredi 9 octobre. Nethermind demande l'audit de tout son dépôt ; ZEUS, celui des paiements, des clés privées et des connexions Lightning. VirtEngine, place de marché de calcul décentralisée, a aussi candidaté, ainsi que des projets d'assistants IA, d'outils de sécurité d'agents ou de stockage cloud. Aucune pull request n'avait été fusionnée à la publication.
Ce contexte tient aux attaques assistées par IA : Boltz a suspendu ses services le 3 août, ses équipes ne pouvant corriger aussi vite que les exploits apparaissaient, rapporte crypto.news. Le même média indique qu'Anthropic n'a annoncé ni calendrier d'approbation ni nombre de projets retenus, et que ces candidatures ne valent pas audit réalisé.
Anthropic prévient que l'IA pourrait avantager les attaquants à court terme, l'exploitation devenant moins chère alors que vérifier et corriger reste lent. Le service s'inscrit dans l'initiative Anthropic Cyber Mission, annoncée le 8 octobre.
Sources
- An opt-in vulnerability-finding service for open-source software — Anthropic
- Anthropic launches free AI security scans for open-source projects — The Verge
- Anthropic offers free AI security scans to open-source maintainers - Help Net Security — Help Net Security
- Crypto Projects Seek Anthropic AI Security Scans — Cointelegraph
- Crypto firms turn to Anthropic AI to find security flaws — crypto.news