Anthropic ha decidido no hacer público su último modelo de inteligencia artificial, Claude Mythos, después de que demostrara una capacidad sin precedentes para descubrir vulnerabilidades de software que podrían aprovecharse para ciberataques a gran escala.
Según informó The Guardian, la empresa con sede en San Francisco afirmó que el modelo ya ha identificado miles de puntos débiles en aplicaciones de uso generalizado, incluidos algunos que datan de hace décadas y que anteriormente no habían sido detectados por los desarrolladores. Preocupada por el posible uso indebido de tales capacidades, Anthropic está limitando el acceso a expertos en ciberseguridad y socios selectos.
A través de una iniciativa conocida como "Glasswing", la empresa está colaborando con importantes empresas de tecnología y seguridad, como Amazon, Apple, Microsoft, Cisco, CrowdStrike y Palo Alto Networks, así como con la Fundación Linux. El objetivo es utilizar el modelo defensivamente, ayudando a identificar y parchear vulnerabilidades antes de que los actores maliciosos puedan explotarlas.