NeuralOS
Industria

AI Safety Index Verano 2026: ni un solo laboratorio pasa de C+, y tres reprueban

El Future of Life Institute evaluó a nueve gigantes de la IA con un panel de siete expertos, 37 indicadores y una escala de notas universitaria. Nadie sacó A ni B. El mejor de la clase, Anthropic, aprobó raspando con un C+. Tres laboratorios reprobaron con F. Es el único ranking independiente de seguridad de IA, y su titular es un aviso a toda la industria.

EN
Equipo NeuralOS
Radar de IA
Jul 14, 20265 min de lectura
En resumen

El AI Safety Index Verano 2026 del Future of Life Institute evaluó a 9 empresas de IA con 7 expertos y 6 dominios: ninguna sacó A ni B. El mejor fue Anthropic con C+ (2.66); xAI (0.65), DeepSeek (0.47) y Mistral (0.33) reprobaron con F.

Imagina que reparten las notas de fin de curso de toda una industria y no aparece ni una sola matrícula de honor. Ni un sobresaliente. Ni siquiera un notable. Eso es exactamente lo que ocurrió cuando el Future of Life Institute publicó su AI Safety Index Verano 2026: nueve de las empresas de IA más poderosas del planeta pasaron por el examen y ninguna sacó A ni B. El mejor de la clase, Anthropic, aprobó raspando con un C+. Y en el otro extremo, tres laboratorios reprobaron directamente. Cuando el alumno estrella apenas llega al aprobado, el problema no es un alumno: es el temario.

## Cómo se hace un boletín de notas que la industria no puede ignorar

Lo que le da peso a este informe no es la nota, es el método. El Future of Life Institute no es una empresa rival tirando piedras: es una organización independiente que lleva años empujando por una IA segura. Para el índice reunió a un panel de siete expertos externos que revisaron la evidencia pública de cada empresa hasta el 3 de junio de 2026, repartida en seis grandes dominios —evaluación de riesgos, daños actuales, marcos de seguridad, seguridad existencial, gobernanza y transparencia— desgranados en 37 indicadores concretos. Todo eso se tradujo a una escala de notas tipo GPA, la misma con la que se califica en las universidades de EE. UU. Es, hoy por hoy, el único ranking de seguridad de IA independiente y con metodología pública. O sea: no es una opinión de sobremesa, es el termómetro más serio que existe.

## El cuadro de honor que no honra a nadie

Vamos a los números, porque duelen. Anthropic encabezó la tabla con un 2.66 (C+), liderando en cinco de los seis dominios evaluados —el primero de la clase, pero un primero que aún tiene deberes pendientes—. Detrás, OpenAI sacó un 2.28 (C), aventajando eso sí en el dominio de evaluación de riesgos, y Google DeepMind un 2.01 (C): aprobados justos. Meta se quedó en D+, y Z.ai y Alibaba Cloud empataron en un pobre D-. Y luego el pelotón de los suspensos: xAI con un 0.65 (F), DeepSeek con 0.47 (F) y Mistral cerrando la lista con un 0.33 (F). Traducido: la mayoría del sector, incluidos nombres que usas o has oído a diario, no llega ni al aprobado en seguridad. Y hablamos de las empresas que están construyendo los sistemas que cada vez toman más decisiones por nosotros.

## El detalle incómodo que casi nadie titula

Hay un dato en el informe que se lee de refilón pero que debería congelarte la sonrisa: los revisores señalaron que, entre 2024 y 2026, Anthropic, OpenAI, Google DeepMind y Meta revirtieron sus prohibiciones de uso militar y hoy buscan activamente alianzas de defensa. Es decir, los cuatro laboratorios mejor posicionados de la tabla —los que se supone que van a la cabeza en responsabilidad— dieron marcha atrás en una línea roja que ellos mismos se habían pintado. No es un tecnicismo: es la prueba de hacia dónde tira la gravedad cuando la carrera aprieta. Cuando la competencia se calienta, las barandas de seguridad son lo primero que se afloja, y quien promete una cosa en la web corporativa puede estar firmando la contraria en un contrato. Por eso un índice independiente importa tanto: mide lo que se hace, no lo que se predica.

## Qué significa para quien construye con IA

La lección de este boletín de notas es tan clara como incómoda: la seguridad de la IA no viene incluida de fábrica, ni siquiera en los laboratorios que la lideran. Si el mejor del mundo aprueba raspando y varios reprueban, la responsabilidad no se puede delegar entera al modelo de turno; hay que construirla en la capa donde vive tu producto y tus datos. Y aquí lo decimos sin humo: NeuralOS no fabrica modelos de frontera ni pretende arreglar la seguridad de la industria entera. Lo que sí hacemos es tomarnos en serio las barandas en nuestro terreno —aislamiento de datos por tenant, credenciales cifradas, un protocolo de auditoría adversarial en cada sprint— y ser model-agnostic precisamente para no quedar atados al que hoy saca C+ y mañana quién sabe. Si algo deja este índice es que, en IA, confiar es fácil y verificar es el trabajo de verdad. Nosotros preferimos el trabajo.

Compartir
¿Listo para construir?

Empieza a construir en
menos de 3 minutos

Únete a 4.200+ creadores. Sin tarjeta. Construye tu primera app con IA en minutos.