Anthropic ha presentado OSS Scanner, un servicio gratuito de detección de vulnerabilidades pensado para proyectos de código abierto que decidan registrarse de forma voluntaria. La herramienta ejecuta escaneos periódicos con sus modelos más avanzados, entre ellos Claude Mythos, y llega justo cuando Google ha pausado su propio programa de recompensas por errores tras recibir un aluvión de reportes generados con inteligencia artificial y de escasa calidad.
La compañía ha integrado el lanzamiento dentro de una estrategia de ciberseguridad más amplia, presentada el mismo mes, con la que busca canalizar la potencia de sus modelos hacia los maintainers que la solicitan de forma expresa. El movimiento llega en un momento en que buena parte de la industria lidia con el ruido de reportes automáticos de baja calidad, así que vamos a ver cómo funciona el sistema, qué cifras ha dado la propia Anthropic y qué papel ocupa dentro de su plan de ciberseguridad.
Cómo funciona el escáner de Anthropic
Cada informe que genera el sistema incluye un reproductor del fallo o una prueba de concepto autocontenida, una explicación técnica con bisección del código cuando es posible y, en algunos casos, un parche candidato ya listo para revisar. Si vuestro proyecto de código abierto cumple los criterios de elegibilidad y decide inscribirse en la plataforma, recibiréis estos análisis de forma periódica y sin coste alguno, ejecutados por los modelos de frontera de Anthropic, entre ellos Claude Mythos. La mecánica busca ser directa: entregar valor inmediato a quien recibe el aviso, no solo una alerta genérica.
Para los equipos que no contéis con capacidad propia de triage, existe una vía alternativa. Seguiréis recibiendo divulgaciones verificadas por personas, bajo la política de divulgación coordinada que Anthropic mantiene desde hace tiempo y que funciona como un canal separado del flujo automático. De este modo, los proyectos más pequeños no se ven obligados a lidiar con un volumen de alertas que no pueden gestionar por sí solos.
Los informes salen del modelo sin revisión humana
El límite más evidente de la herramienta está en su propio diseño. Los reportes se generan de principio a fin por el modelo, sin que ningún humano los revise antes de llegar al maintainer. Esa arquitectura permite entregar los hallazgos mucho más rápido, pero también deja una puerta abierta al error.
Anthropic espera que la tasa de verdaderos positivos supere el 90%, aunque se trata de una previsión interna y no de un dato verificado por terceros. Los equipos de mantenimiento seguirán teniendo que comprobar la severidad real de cada hallazgo antes de aplicar ningún cambio, una tarea que ya formaba parte de su trabajo diario pero que ahora puede multiplicarse por el volumen que genera el sistema automático. Ese equilibrio entre velocidad y precisión es, de hecho, el mismo problema que ha llevado a otras compañías a replantear sus programas de recompensas por errores.
El 88% de los hallazgos graves pasó el filtro de validación
Antes de lanzar el servicio, Anthropic pidió a los pentesters que revisan habitualmente sus divulgaciones coordinadas que auditaran una muestra de 97 hallazgos críticos y de severidad alta repartidos en 48 proyectos. El resultado: 85 de ellos, un 88%, pasaron el filtro de divulgación sin problemas. Decir que once hallazgos adicionales eran reales pero duplicaban fallos ya conocidos, y solo uno resultó ser un falso positivo.
La compañía también ha dado cifras sobre el volumen que maneja desde hace meses. En los últimos seis meses, sus modelos han marcado más de 29.000 vulnerabilidades candidatas. Alrededor de 6.000 pasaron por una revisión y triage manual, mientras que cerca de 5.000 reportes no verificados se enviaron directamente a los maintainers que pidieron recibirlos sin ese filtro.
Entre quienes han probado el sistema, Todd Ouska, de wolfSSL, recibió 74 informes de los que solo dos no eran válidos y cinco terminaron convertidos en CVEs. Noah Misch, de PostgreSQL, señaló que una fracción inusualmente alta de los reportes detectó defectos reales y que varios parches llegaron casi listos para usar. Anton Arapov, de OpenSSL Corporation, los calificó como iguales o mejores que los que recibe habitualmente de personas, y Eddie Kohler, de HotCRP, los describió como exhaustivos y claros.
Por qué llega cuando Google frena su programa de recompensas
El lanzamiento no ocurre en el vacío. El 1 de octubre de 2026, Google anunció la pausa temporal de su programa de recompensas por vulnerabilidades en software de código abierto (OSS VRP) tras un aluvión de reportes generados con inteligencia artificial que incluían alucinaciones y hallazgos de impacto insignificante. El volumen desbordó a los revisores humanos de la compañía.
Google mantiene excepciones para los reportes relacionados con la cadena de suministro y conserva su Patch Rewards Program como vía alternativa; la revisión completa del OSS VRP está prometida para el primer trimestre de 2027. El propio sector recuerda que la IA también tiene un lado útil en este terreno: el fallo «Copy Fail», que afectó a casi todas las distribuciones de Linux en mayo de 2026, se descubrió con ayuda de herramientas automatizadas. Linus Torvalds y otros maintainers del kernel de Linux han reclamado públicamente por la calidad desigual de los reportes automáticos, y OSS Scanner intenta responder a esa queja canalizando la misma tecnología hacia quienes la han pedido de forma expresa.
OSS Scanner es clave en la Cyber Mission de Anthropic
El escáner gratuito forma parte de una iniciativa más amplia que Anthropic presentó bajo el nombre de Cyber Mission. La segunda pata de esta estrategia es el Critical Infrastructure Defense Program, orientado a proteger redes eléctricas, suministro de agua, transporte y sistemas gubernamentales, es decir, la tecnología operacional que sostiene servicios esenciales.
Mientras OSS Scanner trabaja sobre proyectos de software libre, este segundo programa se dirige a proveedores que ya defienden infraestructuras críticas sobre el terreno. La compañía combina ambas patas bajo un mismo objetivo: usar sus modelos de frontera tanto para encontrar fallos en el código abierto como para reforzar la defensa de sistemas que, si fallan, afectan directamente a la vida cotidiana. Esa combinación refleja la apuesta de Anthropic por extender la misma tecnología de detección de vulnerabilidades, antes limitada al software libre, hacia la protección de infraestructuras físicas que no pueden permitirse interrupciones prolongadas.
Los 11 socios del Critical Infrastructure Defense Program
Este programa cuenta con 11 socios fundadores: Accenture, Booz Allen, CrowdStrike, Deloitte, Dragos, Hitachi, Insane Cyber, Nozomi Networks, Palo Alto Networks, PwC y Rockwell Automation. A través de él, Anthropic entrega modelos Claude de frontera, ingenieros destinados en sitio e investigación de amenazas a los proveedores que defienden infraestructuras críticas. Estas organizaciones trabajan ya con proveedores de redes eléctricas, suministro de agua, transporte y sistemas gubernamentales, los sectores que el programa identifica como prioritarios.
Todo este esfuerzo se apoya en Project Glasswing, una iniciativa lanzada el 7 de abril de 2026 junto a AWS, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, NVIDIA y Palo Alto Networks. Hace unos días Anthropic expandió su Cyber Verification Program a tres niveles (Defense, Red Team y Specialized Access) y fusionó Glasswing dentro de esta nueva estructura.
La financiación directa al software libre
Bajo el paraguas de Glasswing, Anthropic comprometió hasta 100 millones de dólares en créditos de uso de Claude Mythos Preview y 4 millones de dólares en donaciones directas a organizaciones de seguridad open source. De esa cifra, ya ha entregado 2,5 millones de dólares a Alpha-Omega y OpenSSF a través de la Linux Foundation, 1,5 millones a la Apache Software Foundation y fondos adicionales a la Python Software Foundation.
La tesis que defiende la compañía es que, en un plazo de dos años, la inteligencia artificial favorecerá más a la defensa que al ataque, facilitando detectar errores antes de que lleguen a producción. En el propio Glasswing, Anthropic observó que entre el hallazgo de una vulnerabilidad y su parche solían pasar meses; en tecnología operacional, reconoció, una corrección puede tardar décadas en aplicarse de forma segura. La diferencia de plazos explica por qué la compañía separa los dos programas: el código abierto permite ciclos de parcheo rápidos, mientras que la infraestructura física exige procesos de validación mucho más largos.
Qué queda sin confirmar sobre el despliegue de la herramienta
Las cifras presentadas hasta ahora proceden de la propia Anthropic, lo que no resta valor a los testimonios de maintainers como wolfSSL o PostgreSQL, pero sí deja preguntas abiertas sobre el funcionamiento a gran escala. La compañía ha fijado como objetivo una tasa de verdaderos positivos superior al 90%, una previsión interna que todavía no ha sido comprobada por auditores externos más allá de la muestra inicial de 97 hallazgos en 48 proyectos. Los criterios exactos de elegibilidad, el proceso concreto de inscripción y si existen límites de volumen por proyecto son detalles que la compañía todavía no ha precisado públicamente.
Tampoco está claro si la calidad observada en los 48 proyectos auditados se mantendrá cuando el servicio crezca a cientos o miles de registros. Los equipos de mantenimiento más pequeños, que ya reciben parte de esos 5.000 reportes sin triage previo, tendrán que decidir si asumen esa carga de trabajo mientras el programa de recompensas de Google permanece pausado al menos hasta el primer trimestre de 2027.
