Claude Cyber Verification Program se abre a más defensores

Claude Cyber Verification Program se abre a más defensores

Anthropic amplía el círculo de personas que pueden usar Claude para trabajos de seguridad de corte ofensivo. El Cyber Verification Program (CVP) de la compañía está ahora abierto a un grupo mucho más amplio de profesionales de la seguridad. Los participantes verificados acceden a los modelos más potentes de Anthropic con algunos de los filtros de seguridad habituales rebajados.

El motivo de restringir el acceso es sencillo. Las habilidades que ayudan a un defensor a encontrar un fallo son las mismas que ayudan a un atacante a explotarlo.

Lo que los modelos públicos rechazan y lo que no

Los modelos estándar de Claude, disponibles para el público, bloquean la mayor parte del trabajo que más interesa a los equipos de seguridad: investigación de vulnerabilidades, análisis de malware, respuesta a incidentes y pruebas de penetración. Un modelo capaz de desmontar un malware o de trazar una ruta de ataque para un defensor podría hacer lo mismo para alguien con peores intenciones.

No todo está bajo llave. Las tareas rutinarias, como revisar código o parchear fallos conocidos, siguen funcionando sin ninguna autorización especial. El CVP cubre el extremo más arriesgado del espectro, donde Anthropic quiere saber quién pregunta antes de responder.

Tres niveles de acceso

El programa clasifica a los participantes en tres niveles, cada uno con un alcance distinto.

1. Defense Access

Es el nivel más amplio. Está abierto a equipos de seguridad corporativos, organismos públicos, universidades, operadores de infraestructuras críticas, desarrolladores de código abierto e investigadores independientes. Los investigadores independientes pueden solicitarlo directamente, algo importante para las muchas personas que trabajan en seguridad fuera de una gran organización.

2. Red Team Access

Este nivel permite simulaciones de ataque autorizadas, los ejercicios controlados de "entrar para encontrar los puntos débiles" que los equipos rojos realizan contra sus propios sistemas o los de sus clientes. Solo pueden optar organizaciones. Los particulares no pueden solicitar este nivel.

3. Specialized Access

El nivel más restringido abarca las pruebas sobre sistemas críticos, como controles de vuelo, redes eléctricas e infraestructuras bancarias. Aquí Anthropic no verifica a los solicitantes por su cuenta. Revisa a cada solicitante junto con el Gobierno de Estados Unidos.

La estructura responde a una lógica clara: cuanto más daño pueda causar un mal uso, más estrictos son los controles sobre quién entra.

Las cifras detrás de la ampliación

El CVP se apoya en una iniciativa anterior llamada Project Glasswing. Según Anthropic, los socios de ese programa encontraron al menos 129.000 vulnerabilidades confirmadas entre abril y julio de 2026. Más de 33.000 de ellas se calificaron como de gravedad alta o crítica.

Esas cifras merecen algo de contexto. Proceden de encuestas a solo una parte de los socios de Glasswing, no de un recuento completo. Anthropic afirma que el impacto real es al menos cinco veces mayor que las cifras comunicadas. Se trata de una estimación de la propia compañía y no ha sido verificada de forma independiente.

Varios socios aseguraron además que la IA aceleró su trabajo en meses y, en algunos casos, en años. Es una afirmación de peso. Si se cumple aunque sea en parte, explica por qué Anthropic quiere que más defensores usen estas herramientas.

El panorama general

Este movimiento sugiere que los grandes laboratorios están convergiendo en una respuesta común al problema del doble uso en ciberseguridad: mantener prudentes los modelos públicos y entregar capacidades más potentes a defensores verificados. La apuesta de Google por la IA de ciberdefensa apunta en la misma dirección. La propia oferta para la administración pública de Anthropic muestra lo estrechamente ligado que está ya este trabajo a las instituciones públicas.

La presión también aumenta desde fuera. Los modelos de pesos abiertos se están acercando en la creación de exploits, y no tienen ningún filtro de verificación. Eso debilita los argumentos para negar capacidades a los defensores.

Para los lectores que trabajan en equipos de seguridad, esto podría suponer mejoras reales de velocidad. Hay varias cosas que conviene vigilar: lo estricta que resulte la verificación en la práctica, si Anthropic publica datos más completos que las encuestas a socios y si algún mal uso se cuela entre los niveles.