Anthropic anunció el 6 de octubre de 2026 la ampliación de su Cyber Verification Program, un esquema que levanta de forma escalonada los bloqueos que la propia empresa había impuesto a que su modelo Claude ejecute tareas de ciberseguridad. La empresa fija tres niveles de acceso y se reserva la facultad de verificar qué organizaciones entran en cada uno, de acuerdo con la publicación en su sala de prensa.
El primer nivel, al que la empresa llama Defense Access, cubre operaciones de centros de seguridad, respuesta a incidentes, ingeniería inversa de programas maliciosos y análisis de vulnerabilidades. El segundo, Red Team Access, suma pruebas de penetración autorizadas. El tercero, Specialized Access, habilita pruebas sobre sistemas de vuelo, redes eléctricas y redes de telecomunicaciones.
El nivel más amplio se revisa con el gobierno de Estados Unidos
Según el texto de la empresa, las organizaciones que solicitan el tercer nivel son revisadas «en colaboración con el gobierno de Estados Unidos». El documento no precisa qué dependencia participa, bajo qué instrumento jurídico lo hace ni si media un contrato. Ninguna agencia estadounidense ha confirmado públicamente esa participación, y no hay respuesta del gobierno de ese país sobre el punto.
El acceso exige que el cliente acepte la retención de sus datos para que la empresa pueda vigilar el uso. La opción de retención cero, que Anthropic denomina Enterprise Frontier Safeguards, está anunciada para el otoño de 2026: es un plazo anunciado, no una función disponible.
Las cifras del anuncio las midió quien vende el producto
La empresa reporta que las organizaciones participantes en su programa previo, Project Glasswing, identificaron 129 mil vulnerabilidades de software verificadas entre abril y julio de 2026, y que su propio rastreo de código abierto sumó 5 mil 500 más. De ese total, más de 33 mil fueron clasificadas como críticas o de severidad alta. Las tres cifras provienen de un solo emisor, que es la empresa que vende el modelo evaluado, y no hay medición independiente que las contraste.
Lo mismo aplica a la medición de sus propias salvaguardas: Anthropic informa que en una prueba interna llamada CyScenarioBench su sistema bloqueó 46 de 50 tareas en la versión Claude Opus 5.5. El banco de pruebas y el resultado son de la empresa.
En el mismo documento, Anthropic nombra el riesgo de doble uso: sostiene que las mismas capacidades que permiten a un equipo de seguridad encontrar y corregir una vulnerabilidad pueden ayudar a un actor malicioso a explotarla. Afirma que mantiene salvaguardas conservadoras que bloquean la mayor parte del trabajo de ciberseguridad y que los usuarios seguirán encontrando bloqueos en tiempo real sobre acciones que podrían causar daño físico.
No se localizó a ningún especialista o institución que discrepe públicamente de esas mediciones al cierre de este martes. Lo verificable es que el anuncio se hizo y que esas cifras fueron publicadas por la empresa; el contenido de las mediciones no queda establecido por este reporte.
Falta por conocer el nombre de la dependencia estadounidense que participa en la revisión, cuántas organizaciones hay ya en cada nivel y si la prueba CyScenarioBench es replicable por terceros. La regulación del sector sigue abierta: la Comisión de Bolsa y Valores de Estados Unidos propuso esta semana su primer marco de custodia de criptoactivos, y la Casa Blanca anunció una Fuerza de Superinteligencia que su orden ejecutiva no crea.
Transparencia: Desarticulista.com utiliza herramientas de Anthropic en su proceso editorial. A esta empresa se le exige el mismo documento, la misma respuesta y el mismo contraste que a cualquier otra del sector.