Anthropic amplía el programa ciber de Claude a tres niveles
Anthropic ha ampliado su Cyber Verification Program (CVP), que permite a profesionales de la seguridad verificados usar capacidades avanzadas de Claude con menos bloqueos automáticos en tareas delicadas como el análisis de malware o las pruebas de vulnerabilidades.
Con esta ampliación, la empresa ha fusionado el CVP y Project Glasswing en un único programa. El acceso se divide ahora en tres niveles, y el que se asigna a cada solicitante depende del alcance de su trabajo en ciberseguridad. Cada nivel tiene sus propios requisitos de verificación y controles de seguridad, ajustados a las tareas que permite.
Defense Access para los defensores del día a día
El nivel de entrada, Defense Access, abarca la investigación de incidentes, el análisis de malware y el análisis y la validación de vulnerabilidades. Está pensado para equipos de seguridad de empresas, organizaciones sin ánimo de lucro, universidades y organismos públicos que protegen sistemas propios o que mantienen.
También pueden solicitarlo los operadores de infraestructuras críticas, las empresas de seguridad más pequeñas, los responsables de proyectos de código abierto y los investigadores independientes con un historial de notificación de vulnerabilidades. Anthropic prevé que muchas empresas dedicadas a la seguridad defensiva cumplan los requisitos y afirma que su objetivo es responder a las solicitudes en pocos días.
Red Team Access añade las pruebas ofensivas
El segundo nivel, Red Team Access, incluye todo lo de Defense Access más las pruebas de penetración autorizadas y los ataques simulados. Está diseñado para equipos rojos internos y gubernamentales, así como para empresas de pruebas de seguridad.
Los participantes solo pueden probar sistemas que estén autorizados a evaluar. Algunas acciones siguen bloqueadas en tiempo real, como desplegar ransomware, probar sistemas de seguridad de alto riesgo y cualquier otra cosa que pueda causar daños físicos o trastornos generalizados.
La revisión para este nivel puede tardar unas semanas. Mientras tanto, las organizaciones que cumplan los requisitos obtienen Defense Access. Por ahora, los investigadores independientes no pueden solicitar Red Team Access.
Specialized Access para sistemas de alto riesgo
El nivel superior, Specialized Access, es el que tiene menos bloqueos de ciberseguridad. Está limitado a un pequeño grupo de organizaciones verificadas y autorizadas para probar sistemas de alto riesgo, como sistemas operativos de vuelo, redes eléctricas, redes de telecomunicaciones, infraestructuras de transferencias interbancarias y redes administrativas de los gobiernos. En estos entornos, una interrupción podría afectar a la vida de las personas o a los mercados.
Anthropic revisa cada solicitud para este nivel junto con el Gobierno de Estados Unidos. Los miembros actuales de Project Glasswing pasan a Specialized Access sin necesidad de una nueva aprobación para los modelos que ya utilizan.
Quienes queden fuera del programa no se quedan sin opciones. "Nuestros modelos de disponibilidad general pueden seguir utilizándose para tareas como la revisión de código, la corrección de problemas conocidos, la búsqueda de vulnerabilidades en código fuente propio y la clasificación de alertas de seguridad", señaló la empresa.
Conservación de datos y despliegue
Unirse al programa implica aceptar la conservación de datos, para que Anthropic pueda vigilar posibles usos indebidos en materia de ciberseguridad. Una función llamada Enterprise Frontier Safeguards, prevista para más adelante este otoño, permitirá a las empresas que cumplan los requisitos mantener los datos en una infraestructura en la nube bajo su control sin renunciar a las salvaguardas contra el uso indebido.
Hasta entonces, las organizaciones que ya tengan aprobado el uso de Claude Fable 5.1 o Claude Mythos 5.1 sin conservación de datos también pueden usar el CVP en esa misma modalidad.
El programa funciona en Claude Platform, Vertex AI de Google Cloud y Microsoft Foundry. En Amazon Bedrock, el acceso se limita a los clientes que puedan optar a Enterprise Frontier Safeguards.
Los miembros actuales del CVP serán evaluados automáticamente para acceder a Claude Opus 5.5, Claude Sonnet 5.5 y Claude Mythos 5.1, y su configuración para los modelos anteriores se mantiene tal cual. Los nuevos solicitantes deben superar la verificación y acreditar los controles de seguridad que exige su nivel.
Cómo cambian los niveles lo que Claude está dispuesto a hacer
Para mostrar el efecto de cada nivel, Anthropic sometió a Claude Opus 5.5 a CyScenarioBench, una prueba que comprueba si los modelos pueden planificar y ejecutar ciberoperaciones en varias fases con restricciones realistas. Las salvaguardas se configuraron para reproducir los niveles del CVP, y el modelo tuvo cinco intentos para cada uno de los 10 retos de la prueba.
Sin acceso al CVP, los 50 intentos se bloquearon en la primera instrucción. Con Defense Access, 46 intentos toparon con un bloqueo en algún momento y cuatro tuvieron éxito. Con Red Team Access no se bloqueó ningún intento, y el modelo completó 34 de 50.
El botín de vulnerabilidades de Glasswing
Anthropic también ha compartido cifras de Project Glasswing. Entre abril y julio de 2026, los socios usaron modelos Claude Mythos para encontrar al menos 129.000 vulnerabilidades de software verificadas en sus propios sistemas. Anthropic encontró otras 5.500 mediante el análisis de código abierto entre abril y octubre.
Más de 33.000 de estos fallos se calificaron de gravedad crítica o alta. La empresa afirmó que las cifras reales probablemente sean mayores, ya que los datos proceden solo de una parte de los socios de Glasswing.
Nuestro análisis
El modelo por niveles refleja un problema con el que el sector lleva tiempo lidiando: la misma capacidad que ayuda a un defensor a analizar malware puede ayudar a un atacante a crearlo. En lugar de aplicar las mismas barreras a todo el mundo, Anthropic vincula la capacidad a la identidad y a la autorización. Para los equipos de seguridad, esto apunta a que el papeleo de verificación podría convertirse en algo habitual para sacar todo el partido a las herramientas de IA más avanzadas.
Las cifras de la prueba dejan claro el precio a pagar. Defense Access siguió bloqueando casi todas las operaciones en varias fases, así que los equipos que necesiten pruebas ofensivas probablemente tendrán que pasar por la revisión, más lenta, de Red Team. Los investigadores independientes se quedan fuera de ese nivel por ahora, lo que puede frustrar a los pentesters por cuenta propia.
Las cifras de Glasswing encajan además en una tendencia más amplia de la IA acelerando el descubrimiento de vulnerabilidades, y en el debate sobre si los atacantes van ahora por delante de los defensores en el uso de estas herramientas. Encontrar fallos a esta escala solo sirve si se corrigen, y los responsables de los proyectos ya están desbordados, como se vio cuando Google suspendió un programa de recompensas por fallos de código abierto por culpa de los informes generados por IA. Habrá que ver con qué rapidez llegan de verdad las aprobaciones de Defense Access, cómo se concreta el papel del Gobierno de Estados Unidos en las revisiones de Specialized Access y si el requisito de conservación de datos echa para atrás a las organizaciones más celosas de su privacidad antes de que llegue Enterprise Frontier Safeguards.
