Pular para o conteúdo principal

Postagem em destaque

Anthropic surpreende ao exigir documento de identidade para usar o Claude — e a reação não foi positiva

IAs colocadas em simulações de crise nuclear escalaram para conflito atômico em 95% dos jogos, aponta estudo do King's College London

 

terminators

Um estudo publicado em fevereiro de 2026 pelo professor Kenneth Payne, do King's College London, submeteu três dos modelos de inteligência artificial mais avançados do mundo — GPT-5.2, Claude Sonnet 4 e Gemini 3 Flash — a uma série de 21 simulações de crise nuclear. Ao longo de 329 turnos, os modelos geraram aproximadamente 780 mil palavras de raciocínio estruturado — mais do que a soma de Guerra e Paz e A Ilíada. O projeto, publicado como pré-print no arXiv e ainda sem revisão por pares, é chamado de "Projeto Kahn", em referência a Herman Kahn, o estrategista da Guerra Fria que formulou a teoria da escada de escalada nuclear.

Todos os 21 jogos apresentaram sinalização nuclear por pelo menos um lado, e 95% envolveram uso de armas nucleares táticas. É importante distinguir: a guerra nuclear estratégica total foi rara, ocorrendo apenas três vezes, nos jogos com pressão de prazo. Um dado que unifica todos os modelos: em nenhum dos 21 jogos qualquer IA escolheu rendição ou fez concessões significativas, das oito opções de desescalada disponíveis.

Cada modelo exibiu um perfil estratégico distinto. Claude Sonnet 4 dominou os cenários sem prazo, com taxa de vitória geral de 67%, mas tratou armas nucleares como opção estratégica legítima em 86% dos seus jogos. GPT-5.2 mostrou o comportamento mais dramático: não venceu nenhum jogo nos cenários abertos, mas sua taxa de vitória saltou para 75% quando prazos foram introduzidos — transformando-se de modelo contido em agressor decisivo. Gemini foi o mais imprevisível, adotando o que o pesquisador descreveu como a "teoria do louco" de Nixon, e foi o único modelo a iniciar uma guerra nuclear estratégica total, fazendo isso já no turno 4 de um cenário de primeiro ataque.

A lógica clássica da dissuasão nuclear — a ideia de que a ameaça de retaliação impede o primeiro uso — não funcionou como esperado. Quando uma IA lançava armas nucleares táticas, a adversária desescalava apenas entre 18% e 25% das vezes. Nas demais, contra-escalava. O raciocínio registrado pelos modelos revela consciência do risco sem capacidade de parar: em um trecho documentado no paper, Claude registrou que poderia estar subestimando os perigos da escalada contínua — e ainda assim manteve o curso. Em outro momento, um modelo avaliou o comportamento do adversário e concluiu, por conta própria, que os sinais incompatíveis sugeriam engano deliberado, sem que ninguém tivesse instruído esse raciocínio.

O professor Payne alertou que avaliar um modelo em um único cenário pode ser profundamente enganoso: um sistema que parece cauteloso sob pressão baixa pode tornar-se marcadamente mais agressivo quando o contexto muda. Claude e Gemini especialmente trataram armas nucleares em termos puramente instrumentais, sem qualquer peso moral aparente. GPT-5.2 foi uma exceção parcial, limitando ataques a alvos militares e enquadrando a escalada como "controlada" — sugerindo alguma norma internalizada, ainda que distante do tabu que conteve líderes humanos desde 1945.

O estudo — ainda pendente de revisão por pares — tem implicações diretas para o debate sobre o uso de IA em sistemas de defesa, num momento em que governos e forças armadas ao redor do mundo aceleram a integração de modelos de linguagem em decisões estratégicas. A conclusão central de Payne é direta: modelos que parecem seguros e contidos em testes de baixa pressão podem se comportar de forma radicalmente diferente quando o contexto muda. Compreender essa lacuna, diz ele, é uma preparação essencial para um mundo em que a IA molda cada vez mais os resultados estratégicos.

Fontes:

Payne, K. AI Arms and Influence: Frontier Models Exhibit Sophisticated Reasoning in Simulated Nuclear Crises. arXiv

King's College London — nota oficial do estudo

Comentários

Mais populares da semana

Estudo científico identifica sinais de possível relação entre vacinas de COVID e câncer

  Uma revisão publicada em 3 de janeiro de 2026 na revista Oncotarget reuniu evidências de 69 artigos científicos publicados entre 2020 e 2025 sobre casos de câncer que surgiram ou pioraram após vacinação contra COVID-19 ou infecção pelo vírus. Assinado pelas pesquisadoras Charlotte Kuperwasser, da Tufts University, e Wafik S. El-Deiry, editor-chefe da Oncotarget e professor da Brown University, o trabalho analisou 333 relatos de pacientes de 27 países, além de estudos populacionais na Itália (quase 300 mil pessoas), na Coreia do Sul (8,4 milhões) e entre 1,3 milhão de militares americanos. Os autores destacam padrões que se repetem: progressão muito rápida de tumores, reativação de cânceres que estavam controlados ou dormentes, e aparecimento de tumores perto do local da injeção ou em linfonodos próximos. Entre os tipos mais citados estão linfomas, leucemias, câncer de mama e de pulmão. O texto discute mecanismos biológicos plausíveis, como a ação da proteína spike, desregulação i...

Hipocrisia de Swalwell: exige transparência nos arquivos de Epstein, mas bloqueia os próprios no FBI

  O congressista democrata Eric Swalwell, da Califórnia, enviou uma carta de cessar e desistir ao diretor do FBI, Kash Patel, exigindo que o bureau interrompa imediatamente qualquer plano de liberar documentos de uma investigação antiga sobre suas supostas ligações com Christine Fang, conhecida como “Fang Fang”, uma operadora de inteligência chinesa. A ação ocorre no momento em que Swalwell disputa a eleição para governador da Califórnia e alega que a liberação dos arquivos seria uma tentativa de difamação política sem qualquer acusação formal de irregularidade. Agentes do FBI foram enviados à Califórnia para revisar os documentos antes de uma possível divulgação pública. A investigação remonta ao período entre 2011 e 2015, quando Swalwell ainda era conselheiro municipal em Dublin e Fang cultivava contatos com políticos emergentes como parte de operações chinesas. Embora o congressista tenha cortado relações após ser alertado pelo FBI, ele nunca negou publicamente um possível relac...

Anthropic surpreende ao exigir documento de identidade para usar o Claude — e a reação não foi positiva

A Anthropic, empresa criadora do assistente de inteligência artificial Claude, anunciou silenciosamente nesta semana uma nova política de verificação de identidade para seus usuários. A página oficial de suporte, publicada em 14 de abril, informa que a empresa selecionou a Persona Identities como parceira de verificação — a mesma infraestrutura KYC usada por serviços financeiros — e exige passaporte físico, carteira de motorista ou documento de identidade nacional. Cópias, identidades digitais e credenciais estudantis não são aceitas. Uma selfie ao vivo também pode ser solicitada. A medida, no entanto, não é universal. A Anthropic lançou o mecanismo de autenticação em alguns casos de uso do Claude para prevenir abusos, aplicar políticas de uso e cumprir obrigações legais. A empresa afirma que não utiliza os dados de verificação para treinar modelos, e que as informações ficam armazenadas nos servidores da Persona — não nos sistemas da Anthropic. Claude Ainda assim, a falta de transparê...