
Anthropic ha ampliado su Cyber Verification Program (CVP), un programa de acceso verificado que permite a determinados profesionales de ciberseguridad utilizar modelos Claude con menos bloqueos para tareas defensivas y de pruebas autorizadas. La novedad, anunciada el 6 de octubre de 2026, organiza el acceso en tres niveles —Defense Access, Red Team Access y Specialized Access— y busca resolver un problema cada vez más evidente: los modelos más capaces pueden ayudar a descubrir vulnerabilidades reales, pero las mismas capacidades también pueden utilizarse de forma ofensiva.
La decisión importa porque no consiste simplemente en “quitar filtros” a Claude. Anthropic está intentando construir un sistema de acceso gradual en el que el nivel de capacidad permitido dependa del tipo de organización, el trabajo autorizado y los controles de seguridad. Eso convierte al CVP en un experimento relevante para el futuro de la IA aplicada a ciberseguridad: cómo dar más capacidad a los defensores sin abrir esa misma capacidad indiscriminadamente.
En este artículo analizamos qué cambia, quién puede acceder a cada nivel, qué modelos están incluidos, qué resultados ha publicado Anthropic y qué límites siguen existiendo.
Qué ha anunciado Anthropic exactamente
Anthropic publicó la ampliación del programa el 6 de octubre de 2026. Según su anuncio oficial del Cyber Verification Program, el sistema pasa a organizarse en tres niveles de acceso con distintos requisitos, controles y permisos.
Los niveles incluyen acceso a modelos avanzados de la compañía, entre ellos Claude Opus 5.5, Claude Sonnet 5.5 y Claude Mythos 5.1, además de nuevos modelos a medida que se incorporen al programa. El objetivo es que equipos de seguridad puedan utilizar capacidades que en las versiones generales de Claude pueden quedar bloqueadas por los clasificadores de seguridad.
El punto de partida es un dilema conocido en ciberseguridad: una herramienta capaz de encontrar una vulnerabilidad también puede ayudar a explotarla. Anthropic mantiene por eso salvaguardas conservadoras en los modelos de acceso general, pero reconoce que esas mismas barreras pueden generar falsos positivos y bloquear trabajo legítimo de defensa.
Los tres niveles del Cyber Verification Program
La estructura del programa intenta adaptar el acceso al riesgo de cada tarea. No todos los equipos reciben el mismo nivel de libertad.
Defense Access: defensa, respuesta e investigación
El primer nivel está orientado a trabajo defensivo. Anthropic menciona tareas como operaciones de un centro de seguridad, respuesta a incidentes, análisis de malware, ingeniería inversa y análisis o validación de vulnerabilidades.
Entre los perfiles que pueden encajar están equipos internos de empresas, universidades, organizaciones sin ánimo de lucro, operadores de infraestructuras críticas, pequeñas firmas de seguridad, mantenedores de software de código abierto e investigadores individuales con un historial demostrable de vulnerabilidades reportadas.
Anthropic afirma que espera que muchas organizaciones que realizan defensa real puedan optar a este nivel y que su objetivo es responder a las solicitudes en cuestión de días.
Red Team Access: pruebas ofensivas autorizadas
El segundo nivel añade pruebas de penetración y red teaming sobre sistemas para los que existe autorización. Está pensado para equipos internos de red team, organismos públicos y empresas especializadas en pruebas de seguridad.
Aquí el sistema permite tareas que se acercan mucho más al comportamiento de un atacante real, pero mantiene límites para acciones que podrían causar daño físico o interrupciones a gran escala. Anthropic cita, por ejemplo, ransomware o pruebas contra sistemas de seguridad de alto riesgo.
Este nivel está reservado actualmente a organizaciones. Los investigadores individuales no pueden solicitarlo. Además, la revisión puede tardar varias semanas porque los requisitos de seguridad son mayores.
Specialized Access: el nivel más restringido
El nivel Specialized Access tiene los menores bloqueos relacionados con ciberseguridad y está reservado a un grupo reducido de organizaciones verificadas que realizan pruebas autorizadas sobre sistemas de alta sensibilidad.
Anthropic menciona ejemplos como sistemas de operación de vuelos, redes eléctricas, telecomunicaciones, infraestructura de transferencias interbancarias y redes administrativas gubernamentales. La compañía afirma que revisa en profundidad a las organizaciones de este nivel en colaboración con el Gobierno de Estados Unidos.
Los participantes de Project Glasswing pasan a este nivel sin necesidad de una nueva aprobación para los modelos que ya utilizan.
Por qué Anthropic está abriendo más capacidades de Claude
El argumento principal de la compañía es que los defensores necesitan herramientas comparables a las capacidades que previsiblemente estarán disponibles para atacantes sofisticados.
En nuestro análisis sobre la IA agéntica aplicada a ciberseguridad empresarial vimos precisamente cómo el sector está pasando de asistentes que explican alertas a sistemas capaces de investigar, correlacionar señales y ejecutar partes de un proceso. El CVP lleva esa evolución a un terreno todavía más delicado: búsqueda de vulnerabilidades y pruebas ofensivas autorizadas.
Anthropic sostiene que Project Glasswing ha demostrado que sus modelos más especializados pueden acelerar de forma importante la detección de fallos. En la actualización del 6 de octubre, la compañía asegura que sus socios identificaron al menos 129.000 vulnerabilidades de software verificadas entre abril y julio de 2026, y que sus propias actividades de análisis de código abierto localizaron otras 5.500 vulnerabilidades verificadas entre abril y octubre.
Según Anthropic, más de 33.000 de esas vulnerabilidades han sido clasificadas hasta ahora como críticas o de alta severidad. La propia empresa advierte que esos números son una estimación mínima porque proceden de datos parciales enviados por una parte de los socios.
Qué muestran las pruebas de Anthropic sobre los bloqueos
Para comprobar si los niveles de acceso realmente producen comportamientos distintos, Anthropic evaluó Claude Opus 5.5 con CyScenarioBench, un benchmark que mide la capacidad de planificar y ejecutar operaciones cibernéticas de varias etapas bajo restricciones realistas.
Los resultados publicados son especialmente ilustrativos. Sin acceso al CVP, todas las tareas fueron bloqueadas en el primer prompt. En Defense Access, 46 de 50 intentos fueron bloqueados en algún punto del ejercicio y solo cuatro consiguieron completarse.
En Red Team Access no se produjeron esos bloqueos y Claude Opus 5.5 completó 34 de 50 intentos. Anthropic señala que ese resultado es prácticamente equivalente al rendimiento del modelo sin salvaguardas en esa evaluación, situado en un 67,6 %.
Estos datos no demuestran que el sistema sea perfecto. Sí muestran que Anthropic está intentando crear una diferencia técnica real entre un usuario general, un defensor y una organización autorizada para pruebas ofensivas.
Por qué el problema de los falsos positivos importa
Un sistema de seguridad demasiado permisivo puede facilitar abuso. Uno demasiado restrictivo puede impedir trabajo legítimo. Ese equilibrio resulta especialmente difícil en ciberseguridad porque muchas instrucciones defensivas y ofensivas se parecen técnicamente.
Analizar malware, estudiar una vulnerabilidad o reproducir una explotación dentro de un laboratorio aislado puede ser necesario para reparar un sistema. El mismo procedimiento fuera de un entorno autorizado puede convertirse en una intrusión.
Por eso el CVP no intenta resolver el problema únicamente clasificando prompts. Añade una segunda capa: verificar quién utiliza el sistema, para qué tipo de trabajo y bajo qué controles.
Esta idea tiene paralelismos con los nuevos controles de permisos que estamos viendo en agentes de escritorio. En nuestro artículo sobre los cambios de Apple en Full Disk Access ante los riesgos de los agentes de IA explicamos por qué la autoridad concedida a un sistema importa tanto como su inteligencia. En ciberseguridad ocurre algo parecido: no basta con medir la capacidad del modelo; también importa quién recibe acceso a esa capacidad.
Qué papel tiene Claude Mythos 5.1
Claude Mythos 5.1 ocupa un lugar especial dentro de esta estrategia. Anthropic lo presenta como su modelo más orientado a investigación avanzada en ciberseguridad y biología. Su acceso general sigue siendo limitado precisamente por la sensibilidad de esas capacidades.
La compañía ya había mostrado resultados preocupantes y útiles al mismo tiempo: modelos de la familia Mythos podían encontrar vulnerabilidades complejas y, en determinados entornos de evaluación, convertir esos fallos en cadenas de explotación completas.
Anthropic describió este salto de capacidad en su investigación sobre evaluación de modelos capaces de desarrollar exploits. El punto clave no es que Claude “sea un hacker”, sino que la automatización de tareas técnicas antes reservadas a especialistas está aumentando rápidamente.
Qué cambia para empresas y equipos de seguridad
Para un equipo empresarial, el cambio más interesante es que el acceso ya no se limita a un pequeño círculo de socios de investigación. El nivel Defense Access pretende abrirse a un conjunto mucho más amplio de organizaciones legítimas.
Eso puede tener varias consecuencias prácticas. Un equipo de seguridad puede utilizar modelos más capaces para revisar código, investigar alertas, analizar malware o buscar vulnerabilidades dentro de sistemas propios. En algunos casos, puede reducir el tiempo necesario para pasar de una señal inicial a una hipótesis verificable.
Pero la herramienta no elimina la necesidad de personal cualificado. Cuanto mayor sea la capacidad del modelo, más importante es saber interpretar resultados, descartar falsos positivos y controlar qué acciones se permiten.
Para profesionales que todavía están construyendo una base general de conocimientos sobre IA, una formación introductoria puede ayudar a comprender mejor estas diferencias entre capacidad, automatización y supervisión. Nuestro análisis de INTELIGENCIA ARTIFICIAL PARA TODOS revisa una opción de aprendizaje general para quien necesita ordenar conceptos antes de entrar en áreas más especializadas.
La verificación de identidad se convierte en parte de la seguridad
Una de las ideas más relevantes del CVP es que Anthropic no intenta confiar únicamente en el modelo para decidir si una petición es legítima. Parte de la decisión se desplaza al proceso de admisión.
Eso introduce un nuevo tipo de arquitectura de seguridad: determinadas capacidades no dependen solo del prompt, sino también del nivel de verificación del usuario u organización.
Es un enfoque comparable al de muchos sistemas profesionales donde determinadas funciones solo aparecen para cuentas verificadas o roles específicos. La diferencia es que aquí no se trata de acceder a un panel administrativo, sino de ampliar el rango de comportamiento permitido a un modelo de propósito general.
Qué pasa con la privacidad y la retención de datos
El programa también introduce condiciones relacionadas con la supervisión. Anthropic indica que las organizaciones inscritas deben aceptar retención de datos para que la compañía pueda monitorizar posibles usos indebidos.
La empresa está preparando una solución llamada Enterprise Frontier Safeguards (EFS), prevista para más adelante este otoño, que pretende combinar controles de seguridad con la posibilidad de mantener determinados datos en infraestructura controlada por el cliente.
Hasta que EFS esté disponible, existen excepciones concretas para algunos clientes que ya utilizan Claude Fable 5.1 o Claude Mythos 5.1 con configuraciones de retención cero. La disponibilidad exacta depende del modelo, la plataforma y el nivel de acceso.
Dónde estará disponible el Cyber Verification Program
Anthropic indica que el CVP está disponible en Claude Platform, Google Cloud Vertex AI y Microsoft Foundry. En Amazon Bedrock, el acceso está limitado actualmente a clientes que cumplan los requisitos relacionados con Enterprise Frontier Safeguards.
Esto es importante porque muchas organizaciones de seguridad no trabajan directamente desde una interfaz web. Integran modelos dentro de pipelines internos, herramientas de análisis y sistemas de respuesta a incidentes.
La disponibilidad en varias nubes permite que el programa se adapte mejor a entornos empresariales que ya tienen controles propios de identidad, registro y acceso.
Qué no significa este anuncio
La ampliación del CVP no significa que Anthropic haya eliminado sus salvaguardas de ciberseguridad para todos los usuarios. Tampoco significa que cualquier profesional pueda solicitar el nivel más permisivo.
Defense Access sigue teniendo bloqueos relevantes. Red Team Access exige autorización y está limitado a organizaciones. Specialized Access está reservado a casos especialmente sensibles con revisión profunda.
Tampoco debemos interpretar las cifras de vulnerabilidades como una medición independiente del rendimiento del modelo. Son datos publicados por Anthropic y sus socios, y la propia compañía reconoce limitaciones en la muestra y en la información de parcheo.
Una señal de hacia dónde va la seguridad de los modelos
El CVP sugiere una evolución importante: los sistemas de IA pueden empezar a tener niveles de capacidad según el contexto de confianza, no solo un único conjunto de filtros para todo el mundo.
Ese modelo podría extenderse a otros ámbitos sensibles. En medicina, biología, finanzas o infraestructura crítica, un usuario general y un profesional verificado no necesariamente necesitan el mismo acceso ni los mismos límites.
La dificultad será evitar que la verificación se convierta simplemente en una puerta burocrática y demostrar que los controles realmente reducen abuso sin bloquear a quienes trabajan de forma legítima.
Para quien quiera comprender mejor cómo se construyen estas capas de responsabilidad antes de especializarse, nuestro análisis de Aprende Inteligencia Artificial revisa un material formativo general en formato PDF. No sustituye formación específica en ciberseguridad, pero puede servir como punto de partida conceptual.
Hechos, inferencias y predicciones
Hecho confirmado: Anthropic amplió el Cyber Verification Program el 6 de octubre de 2026 y lo organizó en tres niveles de acceso.
Hecho confirmado: Defense Access mantiene bloqueos importantes; Red Team Access permite pruebas autorizadas más amplias; Specialized Access está reservado a organizaciones verificadas de alto riesgo.
Hecho confirmado: Anthropic afirma que sus socios y sus propios programas de análisis han identificado decenas de miles de vulnerabilidades de alta o crítica severidad.
Inferencia razonable: la industria se está moviendo hacia un modelo en el que la identidad y el contexto de confianza influyen en las capacidades que un modelo puede ejecutar.
Predicción: veremos más sistemas de acceso escalonado para capacidades sensibles, especialmente en ciberseguridad, biología e infraestructuras críticas.
Preguntas frecuentes
¿Puede cualquier persona solicitar el Cyber Verification Program?
Defense Access está abierto a un conjunto relativamente amplio de defensores cualificados, incluidos algunos investigadores individuales. Los niveles superiores tienen requisitos más estrictos y Red Team Access está limitado actualmente a organizaciones.
¿El programa elimina todos los bloqueos de Claude?
No. Cada nivel mantiene controles diferentes. Specialized Access es el que tiene menos bloqueos, pero está reservado a un grupo muy limitado de organizaciones.
¿Qué modelos incluye?
Anthropic menciona Claude Opus 5.5, Claude Sonnet 5.5 y Claude Mythos 5.1, además de nuevos modelos a medida que se incorporen.
¿Puede utilizarse para atacar sistemas de terceros?
No de forma legítima. Los niveles que permiten pruebas ofensivas exigen autorización sobre los sistemas evaluados. El programa no convierte una intrusión no autorizada en una actividad permitida.
¿Qué demuestra el benchmark CyScenarioBench?
Demuestra que los niveles de acceso producen diferencias medibles en cuántas tareas quedan bloqueadas y cuántas puede completar el modelo dentro de la evaluación. No demuestra que el sistema sea infalible ni que todas las situaciones reales se comporten igual.
Conclusión
La ampliación del Cyber Verification Program es relevante porque aborda uno de los problemas más difíciles de la IA avanzada: cómo permitir usos profesionales legítimos de capacidades sensibles sin ofrecer exactamente la misma libertad a cualquier usuario.
Anthropic está apostando por una combinación de modelos potentes, verificación de organizaciones, niveles de acceso y monitorización. Los resultados publicados muestran que esa configuración puede cambiar de forma significativa lo que Claude es capaz de hacer dentro de una tarea de ciberseguridad.
El reto ahora será demostrar que el sistema escala, que los controles reducen abuso y que las organizaciones pueden convertir esa capacidad en vulnerabilidades corregidas y sistemas más seguros. Si funciona, el CVP puede convertirse en uno de los primeros ejemplos importantes de acceso graduado a capacidades avanzadas de IA.
Fuentes principales consultadas el 7 de octubre de 2026: Anthropic, Project Glasswing, investigación oficial de evaluaciones de exploits y panel público de divulgación coordinada de vulnerabilidades.
