O AI Safety Index Verão 2026 do Future of Life Institute avaliou 9 empresas de IA com 7 especialistas e 6 domínios: nenhuma tirou A nem B. O melhor foi a Anthropic com C+ (2.66); xAI (0.65), DeepSeek (0.47) e Mistral (0.33) foram reprovados com F.
Imagine que distribuem as notas de fim de ano de uma indústria inteira e não aparece uma única menção honrosa. Nenhum louvor. Nem sequer um bom. Foi exatamente isso que aconteceu quando o Future of Life Institute publicou seu AI Safety Index Verão 2026: nove das empresas de IA mais poderosas do planeta passaram pela prova e nenhuma tirou A nem B. O melhor da turma, a Anthropic, passou raspando com um C+. E no outro extremo, três laboratórios foram reprovados de vez. Quando o aluno estrela mal alcança a nota de aprovação, o problema não é um aluno: é a matéria.
## Como se faz um boletim que a indústria não pode ignorar
O que dá peso a este relatório não é a nota, é o método. O Future of Life Institute não é uma empresa rival atirando pedras: é uma organização independente que há anos empurra por uma IA segura. Para o índice, reuniu um painel de sete especialistas externos que revisaram a evidência pública de cada empresa até 3 de junho de 2026, distribuída em seis grandes domínios — avaliação de riscos, danos atuais, marcos de segurança, segurança existencial, governança e transparência — desmembrados em 37 indicadores concretos. Tudo isso foi traduzido para uma escala de notas tipo GPA, a mesma com que se avalia nas universidades dos EUA. É, hoje em dia, o único ranking de segurança de IA independente e com metodologia pública. Ou seja: não é uma opinião de mesa de bar, é o termômetro mais sério que existe.
## O quadro de honra que não honra ninguém
Vamos aos números, porque eles doem. A Anthropic liderou a tabela com um 2.66 (C+), na frente em cinco dos seis domínios avaliados — a primeira da turma, mas uma primeira que ainda tem tarefas pendentes. Atrás, a OpenAI tirou um 2.28 (C), levando vantagem, isso sim, no domínio de avaliação de riscos, e o Google DeepMind um 2.01 (C): aprovações justas. A Meta ficou em D+, e Z.ai e Alibaba Cloud empataram num pobre D-. E depois o pelotão dos reprovados: xAI com um 0.65 (F), DeepSeek com 0.47 (F) e Mistral fechando a lista com um 0.33 (F). Traduzindo: a maioria do setor, incluindo nomes que você usa ou já ouviu no dia a dia, não chega nem à nota de aprovação em segurança. E estamos falando das empresas que estão construindo os sistemas que cada vez mais tomam decisões por nós.
## O detalhe incômodo que quase ninguém coloca na manchete
Há um dado no relatório que se lê de passagem, mas que deveria congelar o seu sorriso: os revisores apontaram que, entre 2024 e 2026, Anthropic, OpenAI, Google DeepMind e Meta reverteram suas proibições de uso militar e hoje buscam ativamente parcerias de defesa. Ou seja, os quatro laboratórios mais bem posicionados da tabela — os que supostamente vão na frente em responsabilidade — deram marcha à ré numa linha vermelha que eles mesmos tinham traçado. Não é um tecnicismo: é a prova de para onde a gravidade puxa quando a corrida aperta. Quando a concorrência esquenta, as grades de segurança são a primeira coisa a se afrouxar, e quem promete uma coisa no site corporativo pode estar assinando o contrário num contrato. Por isso um índice independente importa tanto: ele mede o que se faz, não o que se prega.
## O que significa para quem constrói com IA
A lição deste boletim é tão clara quanto incômoda: a segurança da IA não vem incluída de fábrica, nem mesmo nos laboratórios que a lideram. Se o melhor do mundo passa raspando e vários são reprovados, a responsabilidade não pode ser delegada inteira ao modelo da vez; é preciso construí-la na camada onde vive o seu produto e os seus dados. E aqui dizemos sem enrolação: a NeuralOS não fabrica modelos de fronteira nem pretende consertar a segurança da indústria inteira. O que fazemos, sim, é levar a sério as grades de proteção no nosso terreno — isolamento de dados por tenant, credenciais criptografadas, um protocolo de auditoria adversarial em cada sprint — e ser model-agnostic justamente para não ficar amarrados a quem hoje tira C+ e amanhã sabe-se lá. Se algo este índice deixa é que, em IA, confiar é fácil e verificar é o trabalho de verdade. Nós preferimos o trabalho.