Anthropic incorporará evaluadores de Accenture dentro de sus operaciones para revisar sus modelos más avanzados, una alianza que busca fortalecer la seguridad de la IA mediante supervisión independiente. Ambas compañías prevén invertir al menos 1,000 millones de dólares cada una durante los próximos cinco años.

Seguridad de la IA bajo evaluación externa
El equipo trabajará junto con especialistas internos de Anthropic para realizar pruebas de estrés, analizar la alineación de los modelos y comprobar sus mecanismos de protección. Los evaluadores tendrán un nivel de acceso comparable al de empleados de la compañía.
La operación será liderada por Faculty, firma especializada en inteligencia artificial adquirida por Accenture. Su experiencia incluye proyectos relacionados con gobiernos, defensa, salud e infraestructura, áreas donde la seguridad de la IA adquiere especial relevancia.
Un modelo que podría ampliarse
Anthropic reconoce que este esquema de evaluación integrada todavía está en construcción y carece de estándares definitivos sobre acceso, financiamiento y publicación de resultados. La empresa seguirá siendo responsable de la seguridad de sus sistemas pese a incorporar supervisores externos.
Además, la colaboración no será exclusiva: Anthropic prevé trabajar con otros evaluadores independientes y anunciar nuevas alianzas.
La apuesta coloca a la seguridad de la IA como un componente cada vez más relevante del desarrollo tecnológico y podría impulsar nuevos mecanismos de supervisión para los modelos de frontera.


