Historia
septiembre 19, 2026

El experimento de seguridad de IA de Anthropic pone a prueba la independencia

Anthropic apuesta a que los empleados de Accenture pueden supervisar de forma independiente el desarrollo de su IA de frontera desde dentro de la empresa. Sus partidarios ven un mecanismo práctico de seguridad; los escépticos podrían cuestionar si un evaluador financiado por una empresa puede seguir siendo verdaderamente independiente.

Anthropic intenta resolver un problema central de la gobernanza de la IA: ¿cómo puede una empresa que desarrolla sistemas cada vez más potentes supervisar sus propias afirmaciones de seguridad sin ceder el control de su tecnología?

La respuesta es una inusual alianza de cinco años con Accenture, que se convertirá en el primer “evaluador integrado” de Anthropic. El acuerdo proporciona a los evaluadores un acceso similar al de los empleados al proceso de desarrollo de la empresa, lo que les permite observar el entrenamiento, examinar las decisiones de implementación, probar las salvaguardas e informar de incidentes. Anthropic afirma que la alianza no es exclusiva y que le seguirán evaluadores adicionales.

La perspectiva conservadora presenta el acuerdo principalmente como un nuevo mecanismo de supervisión, al tiempo que subraya que Anthropic sigue siendo responsable de sus modelos. La empresa afirma que los evaluadores integrados pueden “verificar que está cumpliendo sus compromisos de seguridad” e identificar puntos ciegos, pero que “no reducen nuestra responsabilidad”. Ese enfoque hace hincapié en la transparencia sin dar a entender que el escrutinio externo transfiere la responsabilidad legal del desarrollador.

La perspectiva liberal sitúa el acuerdo en un debate político y sectorial más amplio sobre si el desarrollo de la IA debería ralentizarse. Describe la alianza como la primera implementación concreta de la propuesta del director ejecutivo Dario Amodei y señala que Anthropic y Accenture planean invertir al menos 1.000 millones de dólares en desarrollar capacidad de evaluación durante cinco años. Sin embargo, por ahora Anthropic financiará directamente a Accenture, aunque afirma que la financiación a largo plazo debería proceder de fondos mancomunados o de fuentes gubernamentales.

Ambas perspectivas coinciden en que el modelo es experimental y en que Anthropic busca socios adicionales, incluida la organización sin ánimo de lucro METR. Difieren en el énfasis: una destaca una salvaguarda corporativa voluntaria, mientras que la otra subraya el problema de independencia aún no resuelto. Un evaluador pagado por la empresa puede ver más que un auditor externo, pero su acceso, sus incentivos y su autoridad determinarán si la supervisión integrada se convierte en una rendición de cuentas significativa o simplemente en un ejercicio de confianza más sofisticado.

Anthropic se asocia con la empresa de TI Accenture para evaluar modelos de IA de frontera — “Los evaluadores independientes integrados no reducen nuestra responsabilidad, pero ayudan a hacerla más verificable.”

Anthropic selecciona a Accenture como primer evaluador integrado para ayudar a implementar la propuesta de ralentización de Amodei — “A largo plazo, creemos que la financiación debería proceder de fondos mancomunados o de fuentes gubernamentales.”