Anthropic OSS Scanner : analyses de failles IA gratuites

Anthropic a lancé OSS Scanner, un service gratuit qui met ses modèles d'IA les plus performants au service de la recherche de vulnérabilités dans le code open source. Les mainteneurs qui s'inscrivent bénéficient d'analyses régulières et reçoivent des rapports décrivant les failles présumées, la manière de les reproduire et, quand c'est possible, la façon de les corriger.

Le service est issu de Project Glasswing, une initiative antérieure d'Anthropic qui utilisait Claude pour traquer les vulnérabilités logicielles. Il s'inscrit dans une offensive plus large de l'entreprise dans le domaine de la sécurité, qui a récemment décidé d'étendre le programme cyber de Claude à trois niveaux.

Pas de relecture humaine

Le choix de conception le plus marquant tient à ce qu'OSS Scanner laisse de côté. Selon Anthropic, la validation humaine est devenue un goulet d'étranglement dans ses travaux de recherche de vulnérabilités. Le nouveau service transmet donc les résultats générés par l'IA directement aux équipes des projets, sans relecture humaine intermédiaire.

Les signalements sont ainsi plus rapides. Mais la tâche de vérifier chaque résultat, et de décider quels correctifs passent en priorité, revient désormais aux mainteneurs eux-mêmes.

Anthropic ne cache pas les risques. "Nous ne pouvons pas garantir que le scanner sera parfait", a déclaré l'entreprise. Elle reconnaît que les rapports peuvent surestimer la gravité d'un bug, ou mal interpréter les hypothèses de sécurité sur lesquelles repose un projet.

Premiers résultats des testeurs d'intrusion

Anthropic a communiqué les chiffres d'une première version du scanner. Des testeurs d'intrusion ont examiné 97 résultats classés de gravité élevée ou critique, répartis sur 48 projets.

Parmi eux, 85 répondaient aux critères de son processus de divulgation coordonnée, selon Anthropic. Onze autres correspondaient à de vrais problèmes, mais faisaient doublon avec des bugs connus ou d'autres résultats. Un seul était invalide.

Au moins un mainteneur affirme que la qualité a radicalement changé. Anton Arapov, d'OpenSSL Corporation, a qualifié d'"épouvantables" les premiers rapports générés par IA reçus il y a environ 18 mois, avant Project Glasswing.

"Les rapports que nous avons reçus d'Anthropic, y compris la sortie brute du modèle, étaient aussi bons, et parfois meilleurs, que ceux que nous recevons de personnes. En particulier quand un rapport est accompagné d'un véritable exploit, le travail de l'ingénieur est pratiquement fait, puisqu'il peut le vérifier tout de suite", a déclaré Arapov.

Comment fonctionnent les analyses

Les projets inscrits reçoivent d'abord une analyse initiale, suivie d'un lot de rapports envoyés par e-mail. Les analyses suivantes recherchent les vulnérabilités nouvellement introduites, ainsi que les problèmes passés inaperçus lors des contrôles précédents. La fréquence des analyses dépendra de plusieurs facteurs, dont la demande et le degré d'utilisation du logiciel.

Les mainteneurs peuvent orienter le processus. Ils peuvent indiquer à Anthropic ce qu'il faut tester, quelles entrées doivent être considérées comme potentiellement malveillantes, comment évaluer la gravité, et quel type de correctifs proposés leur serait utile.

Anthropic précise que le service ne s'adresse pas à tous les projets. Il vise les équipes qui parviennent déjà à traiter les rapports vérifiés de gravité élevée et critique, et qui ont encore la capacité d'examiner davantage de résultats.

Qui peut postuler

Les mainteneurs principaux peuvent déposer leur candidature via le dépôt GitHub d'OSS Scanner. Chaque demande est évaluée au cas par cas. L'éligibilité cible des projets établis, importants pour les infrastructures et la sécurité des utilisateurs.

Les règles de divulgation diffèrent de celles d'un signalement de bug classique. Les résultats non validés envoyés par le scanner ne sont pas soumis à un délai de divulgation obligatoire de 90 jours. Si Anthropic valide ultérieurement un rapport dans le cadre de son programme de divulgation coordonnée existant, un délai de 90 jours peut commencer à courir dès que les mainteneurs sont informés de cette validation.

Les projets ne sont pas engagés définitivement. Ils peuvent suspendre les rapports automatisés, ou se désinscrire complètement et revenir aux seuls rapports traités dans le cadre du processus de divulgation standard d'Anthropic.

Notre analyse

OSS Scanner arrive à un moment où les équipes open source peinent déjà à gérer les rapports de bugs générés par IA. Google a récemment suspendu son programme de bug bounty OSS précisément pour cette raison. La réponse d'Anthropic semble miser sur la qualité plutôt que sur le volume, et les chiffres des tests d'intrusion, s'ils se confirment à grande échelle, suggèrent que les résultats sont bien meilleurs que les signalements bâclés que les mainteneurs ont appris à redouter.

Reste que supprimer la relecture humaine est un vrai compromis. Cela reporte le travail de tri sur des bénévoles et de petites équipes, ce qui explique pourquoi Anthropic réserve le service aux projets déjà capables de traiter des rapports vérifiés. Reste à voir si ce filtre fonctionne en pratique.

La préoccupation principale, c'est la vitesse, des deux côtés. Un cas récent, celui d'une faille de Rejetto HFS découverte par l'IA puis exploitée par la suite, montre que les bugs découverts par l'IA peuvent se transformer en attaques réelles. Si des outils comme OSS Scanner mettent au jour des failles plus vite que les mainteneurs ne peuvent les corriger, l'absence de délai de divulgation fixe pour les résultats non validés pourrait devenir un détail important. Il faudra suivre combien de rapports débouchent sur des correctifs, et à quelle vitesse.