Anthropic OSS Scanner ofrece análisis gratuitos con IA
Anthropic ha lanzado OSS Scanner, un servicio gratuito que pone a sus modelos de IA más capaces a revisar código abierto en busca de vulnerabilidades de seguridad. Los mantenedores que se apuntan reciben análisis periódicos e informes que describen los fallos sospechosos, cómo reproducirlos y, cuando es posible, cómo corregirlos.
El servicio nace de Project Glasswing, una iniciativa anterior de Anthropic que utilizaba Claude para cazar vulnerabilidades de software. Se suma a una apuesta más amplia de la compañía por la seguridad, que incluye su reciente decisión de ampliar el programa de ciberseguridad de Claude a tres niveles.
Sin revisión humana
La decisión de diseño más llamativa es lo que OSS Scanner deja fuera. Según Anthropic, la validación humana se ha convertido en un cuello de botella en su investigación de vulnerabilidades. Por eso, el nuevo servicio envía los hallazgos generados por la IA directamente a los equipos de los proyectos, sin ninguna revisión humana de por medio.
Así los informes llegan antes. Pero también recae en los propios mantenedores el trabajo de comprobar cada hallazgo y decidir qué correcciones van primero.
Anthropic no oculta los riesgos. "No podemos garantizar que el escáner sea perfecto", afirmó la compañía. Reconoció que los informes pueden exagerar la gravedad de un fallo o malinterpretar los supuestos de seguridad sobre los que se construye un proyecto.
Primeros resultados de los pentesters
Anthropic compartió datos de una versión temprana del escáner. Varios expertos en pruebas de penetración revisaron 97 hallazgos calificados de gravedad alta o crítica, repartidos entre 48 proyectos.
De ellos, según Anthropic, 85 cumplían los criterios de su proceso de divulgación coordinada. Otros 11 eran problemas reales, pero duplicaban fallos ya conocidos u otros hallazgos. Solo uno no era válido.
Al menos un mantenedor asegura que la calidad ha cambiado radicalmente. Anton Arapov, de OpenSSL Corporation, calificó de "espantosos" los primeros informes generados por IA de hace unos 18 meses, antes de Project Glasswing.
"Los informes que recibimos de Anthropic, incluida la salida en bruto del modelo, eran tan buenos como los que nos llegan de personas, y a veces mejores. Sobre todo cuando un informe viene con un exploit real adjunto: eso para un ingeniero es prácticamente trabajo hecho, porque puede verificarlo de inmediato", dijo Arapov.
Cómo funcionan los análisis
Los proyectos que se inscriben reciben primero un análisis inicial y, a continuación, un paquete de informes por correo electrónico. Los análisis posteriores buscan vulnerabilidades introducidas recientemente, así como problemas que las revisiones anteriores pasaron por alto. La frecuencia con la que se analice cada proyecto dependerá de varios factores, como la demanda y lo extendido que esté el software.
Los mantenedores pueden orientar el proceso. Pueden indicar a Anthropic qué probar, qué entradas deben considerarse potencialmente maliciosas, cómo debe valorarse la gravedad y qué tipo de parches propuestos les resultarían útiles.
Anthropic afirma que el servicio no está pensado para todos los proyectos. Se dirige a equipos que ya dan abasto con los informes verificados de gravedad alta y crítica y que aún tienen margen para estudiar más hallazgos.
Quién puede solicitarlo
Los mantenedores principales pueden presentar su solicitud a través del repositorio de GitHub de OSS Scanner. Cada solicitud se evalúa de forma individual. Se da prioridad a proyectos consolidados que sean relevantes para las infraestructuras y la seguridad de los usuarios.
Las reglas de divulgación difieren de las de un informe de fallos habitual. Los hallazgos no validados enviados a través del escáner no llevan asociado un plazo obligatorio de divulgación de 90 días. Si Anthropic valida más adelante un informe mediante su programa de divulgación coordinada ya existente, puede empezar a correr un plazo de 90 días a partir del momento en que se comunique esa validación a los mantenedores.
Los proyectos no quedan atados. Pueden pausar los informes automáticos o darse de baja por completo y volver a recibir únicamente los informes gestionados mediante el proceso de divulgación estándar de Anthropic.
Nuestra opinión
OSS Scanner llega en un momento en el que los equipos de código abierto ya tienen problemas con los informes de fallos generados por IA. Google pausó hace poco su programa de recompensas por fallos en código abierto precisamente por eso. La respuesta de Anthropic parece apostar por la calidad antes que por el volumen, y las cifras de las pruebas de penetración, si se mantienen a gran escala, indican que el resultado es muy superior a los envíos de poca calidad que los mantenedores han aprendido a temer.
Aun así, prescindir de la revisión humana tiene un coste real. Traslada el trabajo de criba a voluntarios y equipos pequeños, y por eso Anthropic limita el servicio a proyectos que ya pueden asumir informes verificados. Habrá que ver si ese filtro funciona en la práctica.
La mayor preocupación es la velocidad en ambos bandos. Un caso reciente, en el que un fallo de Rejetto HFS descubierto por IA acabó siendo explotado, demuestra que los fallos descubiertos por IA pueden convertirse en ataques reales. Si herramientas como OSS Scanner sacan a la luz fallos más rápido de lo que los mantenedores pueden parchearlos, la ausencia de un plazo fijo de divulgación para los hallazgos no validados puede convertirse en un detalle importante. Merecerá la pena seguir cuántos informes acaban en correcciones, y con qué rapidez.
