En pocas palabras: Anthropic lanzó en beta pública el Claude Security plugin para Claude Code: un escáner multi-agente que corre en tu terminal, verifica cada hallazgo con una pasada adversarial donde Claude intenta refutar su propio resultado y propone parches que vos aprobás. El código nunca sale de tu entorno.
Claude Security es el producto de seguridad de Anthropic que escanea repositorios buscando vulnerabilidades, verifica los hallazgos antes de mostrarlos y sugiere parches. El plugin para Claude Code lleva ese mismo motor a la terminal del desarrollador. Según la página oficial del producto, Claude Security está disponible en beta pública para Claude Enterprise, y el plugin de Claude Code entró en beta.
En 30 segundos
- Qué es: un escáner de vulnerabilidades de Anthropic que razona sobre el código en vez de matchear patrones, ahora empaquetado como plugin de Claude Code.
- Lo distinto: cada hallazgo pasa por una verificación adversarial donde Claude intenta refutar su propio resultado antes de reportarlo.
- No solo detecta: cada finding viene con un parche sugerido que mantiene el estilo y la estructura de tu código.
- Dónde vive tu código: escaneás, validás y parcheás adentro de Claude Code, sin que el código salga de tu entorno.
- Disponibilidad: beta pública para Claude Enterprise; el plugin de Claude Code también en beta.
Anthropic es una empresa de investigación en inteligencia artificial fundada en 2021 que desarrolla modelos de lenguaje como Claude. Se especializa en crear sistemas de IA seguros y alineados mediante investigación en alineación e interpretabilidad.
¿Por qué un escáner de seguridad con IA y no un SAST tradicional?
Porque los escáneres clásicos buscan formas, no significado. Un SAST tradicional tiene reglas: si ve eval() con una variable adentro, prende una luz roja. Si ve una query armada con concatenación de strings, otra luz roja. Funciona, hasta que la vulnerabilidad real vive repartida en cuatro archivos y ninguno de los cuatro, por sí solo, se ve mal.
Ponele este caso: un endpoint recibe un parámetro, lo pasa a un helper que “sanitiza” (esas comillas están puestas a propósito), ese helper llama a un normalizador de otro módulo que le saca los escapes, y recién después de eso el valor termina en una query. Ninguna línea aislada dispara una regla. El bug está en el recorrido, no en la línea.
Anthropic apunta a eso. Según la descripción oficial, Claude “razona sobre tu código como un investigador de seguridad experimentado. Entiende contexto, rastrea flujos de datos, y detecta vulnerabilidades que las herramientas de pattern-matching pasan por alto”. Es la promesa central del producto y también su punto de mayor escrutinio, porque razonar es exactamente donde un modelo puede alucinar con confianza.
¿Y cómo evitás que un modelo que razona te llene el backlog de fantasmas? Ahí entra la parte más interesante del diseño.
¿Qué es la verificación adversarial de Claude Security y por qué importa?
Es una pasada en la que Claude cuestiona sus propios hallazgos antes de mostrártelos. La página oficial lo describe así: “Every finding goes through an adversarial verification pass. Claude challenges its own results before surfacing them”. El resultado que Anthropic reivindica: se reportan más problemas reales y menos falsos positivos que hacen perder tiempo al analista. Más contexto en propuesta diferencial de Anthropic.
Cualquiera que haya corrido un escáner de seguridad sobre un monorepo sabe por qué esto es el punto que más importa. El problema nunca fue que la herramienta no encontrara nada. El problema es que encontraba 340 cosas, de las cuales 12 eran reales, y para el hallazgo número 60 el equipo ya había aprendido a ignorar el reporte entero. La fatiga de alertas mata más programas de seguridad que la falta de herramientas.
El mecanismo es simple de explicar y difícil de hacer bien: en vez de que un solo pase decida “esto es una vulnerabilidad”, hay un segundo pase cuyo trabajo es tratar de romper esa conclusión. Si el hallazgo sobrevive al intento de refutación, se reporta. Si no, se descarta antes de llegar a tu pantalla.
Ojo con una cosa: Anthropic no publicó, en la información disponible, números de precisión ni tasa de falsos positivos medida contra un benchmark independiente. Habría que ver. Es una afirmación del fabricante sobre su propio producto, y hasta que haya evaluaciones de terceros conviene tomarla como lo que es.
¿Qué tipo de vulnerabilidades detecta Claude Security?
Según la descripción oficial, apunta a patrones de vulnerabilidad complejos y multi-componente: los que involucran varios archivos y flujos de datos que cruzan módulos. La empresa enfatiza el rastreo de flujos de datos entre archivos como la capacidad diferencial, en contraste con los escáneres que evalúan cada archivo por separado.
Lo que Anthropic describe concretamente sobre el alcance:
- Análisis contextual, no por archivo. Claude Security entiende contexto y rastrea flujos de datos a través de archivos, según la documentación del producto.
- Patrones multi-componente. Identifica vulnerabilidades que surgen de la interacción entre partes del sistema, no de una línea puntual.
- Escaneo en paralelo. El producto se presenta con capacidad de escanear el código en paralelo, lo que en la práctica importa cuando el repo es grande.
- Cada hallazgo con explicación. Anthropic promete ver “la vulnerabilidad, por qué importa, y el fix propuesto” para cada detección.
Sobre la lista larga de categorías específicas (inyección SQL, bypass de autenticación, corrupción de memoria, errores lógicos), la información oficial que tengo a mano no las enumera una por una. Un motor que razona sobre flujos de datos apunta naturalmente a esa familia de problemas, pero no voy a darte una lista cerrada como si fuera especificación confirmada.
¿Cómo genera los parches y quién los aprueba?
Claude detecta el problema y propone el fix, pero la aprobación es humana. Cada hallazgo incluye un parche recomendado para que el equipo lo revise y lo apruebe. Anthropic resume el flujo como “from scan to fix, done seamlessly”: Claude escanea el codebase, valida los hallazgos y sugiere parches que vos revisás. Te puede servir nuestra cobertura de infraestructura técnica de Anthropic.
El detalle que me parece bien pensado: los parches sugeridos mantienen la estructura y el estilo de tu código. Suena menor y no lo es. Un fix técnicamente correcto que reescribe una función entera con otro estilo de manejo de errores, otro naming y otra forma de loggear es un fix que nadie mergea, porque el review se convierte en una discusión de estilo en vez de una de seguridad.
La idea de fondo: arreglar rápido en vez de sumar al backlog. Es el problema real de la mayoría de los equipos, que no es descubrir vulnerabilidades sino cerrar las que ya conocen. Escaneás, te salen 40 hallazgos, priorizás 8, arreglás 3, y el mes que viene el escaneo te devuelve 45. Con el parche ya redactado, la fricción entre “sé que está roto” y “está arreglado” baja bastante.
¿Está disponible Claude Security para todos los usuarios?
No. Claude Security está en beta pública para Claude Enterprise, según la página oficial del producto, y el Claude Security Plugin para Claude Code también está en beta. Si tu equipo no está en Enterprise, el acceso al producto completo no es inmediato.
Sobre requisitos técnicos exactos (versión mínima de Python, versión mínima de Claude Code, habilitación desde la consola de administración, sistemas operativos soportados), la información oficial que pude verificar no los especifica. Antes de planificar un rollout, mirá la documentación de Claude Code para Claude Security, que es donde Anthropic mantiene los requisitos actualizados. Prefiero mandarte a la fuente que tirarte un número de versión que después no coincide y te rompe el script de instalación.
Un punto que sí está confirmado y pesa para cualquier equipo con requisitos de compliance: con el plugin escaneás, validás y parcheás adentro de Claude Code manteniendo todo el código dentro de tu entorno. Para organizaciones que no pueden mandar el fuente a un servicio externo, esa frase es la diferencia entre evaluar la herramienta o descartarla en la primera reunión.
¿Cómo se integra Claude Security con Slack, Jira y el pipeline de CI/CD?
Los hallazgos se empujan vía webhooks a Slack o Jira, se exportan para auditoría, y podés programar escaneos recurrentes. Anthropic lo plantea como “fits your existing workflow”: la herramienta se acomoda al proceso que ya tenés en vez de pedirte que armes uno nuevo alrededor de ella.
Esto es lo que separa una herramienta que el equipo usa de una que quedó instalada y nadie abre. Si el hallazgo aparece solo en un dashboard que hay que ir a mirar, no existe. Si aparece como ticket en Jira con el parche adentro, entra al sprint como cualquier otra cosa. Lo explicamos a fondo en por qué elegir Claude sobre OpenAI.
Los escaneos programados son la otra pata. Escanear una vez, en el momento en que instalaste la herramienta, te da una foto. Escanear todas las noches te da una serie, y la serie es lo que te dice si el equipo está mejorando o si cada release suma deuda de seguridad nueva.
Claude Security plugin vs. escáneres tradicionales: en qué se diferencian
La diferencia central es el nivel de análisis: los escáneres clásicos evalúan patrones sintácticos por archivo, Claude Security rastrea flujos de datos entre archivos y verifica cada hallazgo con una pasada adversarial antes de reportarlo. Esta tabla resume los ejes confirmados por la documentación oficial.
| Eje | Escáner SAST tradicional | Claude Security plugin |
|---|---|---|
| Método de detección | Reglas y pattern-matching sobre sintaxis | Razonamiento sobre contexto y flujos de datos |
| Alcance del análisis | Mayormente por archivo o función | Cruza archivos y componentes |
| Validación del hallazgo | Ninguna, o triage manual del analista | Pasada adversarial: Claude refuta su propio resultado |
| Salida | Lista de findings para priorizar | Finding + explicación + parche sugerido |
| Estilo del fix | Recomendación genérica | Parche que preserva estructura y estilo del código |
| Dónde corre | Depende del proveedor | Dentro de Claude Code, código en tu entorno |
| Disponibilidad | Maduro, ecosistema amplio | Beta pública (Enterprise) / plugin en beta |

Dicho esto: “beta” en la última fila no es un detalle de color. Un escáner tradicional lleva años de reglas afinadas contra millones de repos, y eso vale. Lo sensato durante la beta es correr ambos en paralelo un tiempo y comparar qué encuentra cada uno, no reemplazar tu pipeline de seguridad con una herramienta que Anthropic todavía marca como beta.
Qué significa para equipos en Latinoamérica
El cuello de botella acá casi nunca es la herramienta: es que no hay un rol de seguridad dedicado. En la mayoría de los equipos de producto de la región, la revisión de seguridad la termina haciendo el mismo dev senior que está cerrando el sprint, entre dos reuniones y con el deploy del viernes encima. Un escáner que además redacta el parche cambia la ecuación más para ese equipo que para uno que ya tiene un AppSec full-time.
El freno práctico es la disponibilidad: beta para Claude Enterprise deja afuera a buena parte de las pymes y agencias de la región, al menos por ahora. Si estás en ese grupo, lo razonable es seguir la evolución del plugin y mientras tanto no descuidar lo básico: dependencias actualizadas, secretos fuera del repo y una infraestructura que no te agregue superficie de ataque por su cuenta. Si tu stack corre sobre hosting o servidores en Argentina, arrancá por tener eso ordenado en donweb.com antes de sumar capas de análisis sobre una base floja.
Errores comunes al usar un escáner de seguridad con IA
- Mergear el parche sugerido sin leerlo. El diseño del producto es explícito en que el equipo revisa y aprueba. Un parche generado que cierra la vulnerabilidad pero cambia el comportamiento de un caso borde te rompe producción con un commit que decía “security fix” y nadie miró.
- Tratar “cero hallazgos” como “código seguro”. Un escaneo limpio significa que esta herramienta, con este alcance, no encontró nada. No cubre errores de configuración del servidor, permisos mal puestos ni la lógica de negocio que permite que un usuario vea el pedido de otro.
- Reemplazar el pipeline entero durante una beta. Corrolo al lado de lo que ya tenés y compará resultados unas semanas antes de sacar nada. Es una beta y Anthropic lo dice.
- Escanear una sola vez. El valor está en los escaneos programados y en la tendencia. Una foto aislada envejece con el primer merge.
- Ignorar el reporte porque “el escáner miente”. Ese reflejo viene de años de falsos positivos, es entendible, y es justo lo que la verificación adversarial intenta atacar. Dale una ventana de evaluación honesta antes de aplicarle el prejuicio de la herramienta anterior.
Preguntas Frecuentes
¿Qué es el Claude Security plugin?
Es un escáner de vulnerabilidades de Anthropic que corre dentro de Claude Code y permite escanear, validar y parchear código sin que salga de tu entorno. Usa razonamiento sobre el contexto y los flujos de datos en lugar de pattern-matching, y cada hallazgo llega con un parche sugerido.
¿Cómo funciona la verificación de hallazgos?
Cada hallazgo atraviesa una pasada de verificación adversarial en la que Claude cuestiona sus propios resultados antes de mostrarlos. Anthropic sostiene que ese paso hace que se reporten más problemas reales y menos falsos positivos. No hay, por ahora, benchmarks independientes que midan esa afirmación. Sobre eso hablamos en ventajas de Claude frente a Gemini.
¿Quién puede usar Claude Security hoy?
Claude Security está en beta pública para Claude Enterprise, y el plugin para Claude Code está en beta. Si tu organización no tiene Claude Enterprise, el acceso al producto completo no es directo. Los requisitos exactos de versión y habilitación están en la documentación oficial de Claude Code.
¿Mi código sale de mi infraestructura al escanear?
Con el plugin de Claude Code, el escaneo, la validación y el parcheo ocurren manteniendo todo el código dentro de tu entorno, según Anthropic. Es el punto que más pesa para equipos con requisitos de compliance que no pueden enviar fuente a servicios externos.
¿Reemplaza a mi escáner SAST actual?
Durante la beta, no conviene. Lo razonable es correr ambos en paralelo y comparar hallazgos por unas semanas: los escáneres tradicionales tienen años de reglas afinadas, y Claude Security aporta análisis de flujos entre archivos y parches sugeridos. Son complementarios antes que sustitutos.
¿Se pueden programar escaneos automáticos?
Sí. Anthropic confirma escaneos recurrentes programados, envío de hallazgos por webhooks a Slack o Jira, y exportación para auditoría. Eso permite integrarlo al flujo de trabajo existente en vez de tener que consultar un dashboard aparte.
Conclusión
Lo que cambió no es que exista otro escáner de seguridad. Es que el escáner ahora razona sobre flujos de datos entre archivos, se auto-cuestiona antes de reportar, y te entrega el parche escrito en el estilo de tu propio código, todo adentro de la terminal donde ya estás trabajando.
Si tenés Claude Enterprise, la movida obvia es habilitarlo sobre un repo real, no sobre uno de prueba, y comparar sus hallazgos contra los de tu herramienta actual durante dos o tres semanas. Ahí vas a ver si la promesa de menos falsos positivos se sostiene en tu código o si es una frase de landing.
Si no tenés Enterprise, mirá la documentación oficial para seguir cuándo se abre el acceso, y mientras tanto ordená lo aburrido: dependencias al día, secretos fuera del repo, permisos revisados. Ninguna herramienta con IA te va a salvar de un .env commiteado.
Fuentes
- Claude Security | Claude by Anthropic – página oficial del producto, con el detalle de verificación adversarial, parches sugeridos y disponibilidad en beta
- Documentación oficial de Claude Security en Claude Code – requisitos técnicos y guía de uso del plugin
- MarkTechPost – cobertura del lanzamiento del plugin multi-agente en beta
- GBHackers – análisis del lanzamiento desde la óptica de seguridad ofensiva
- Cybersecurity News – reporte del anuncio y su alcance
