By using this site, you agree to the Privacy Policy and Terms of Use.
Accept
Clikr.
Notification
Clikr.Clikr.
Font ResizerAa
  • HomeHome
  • My Feed
  • My Interests
  • My Saves
  • History
  • Blog
Search

Top Stories

Explore the latest updated news!
meta-lanca-nova-ia-focada-em-programacao-e-games-•-tecnoblog

Meta lança nova IA focada em programação e games • Tecnoblog

j

J

fim-do-“enviar-como”:-gmail-deixara-de-disparar-e-mails-de-outras-contas-•-tecnoblog

Fim do “Enviar como”: Gmail deixará de disparar e-mails de outras contas • Tecnoblog

Stay Connected

Find us on socials
248.1kFollowersLike
61.1kFollowersFollow
165kSubscribersSubscribe
Made by ThemeRuby using the Foxiz theme. Powered by WordPress
Clikr. > Tech > J
Tech

J

Last updated: 6 de agosto de 2026 09:40
By yuri hildebrand
Share
6 Min Read
SHARE
Imagem de um celular exibindo a tela do Claude AI
Claude Mythos 5 surpreende com decisões maliciosas em teste (imagem: Lupa Charleaux/Tecnoblog)
Resumo
  • Instituto de Segurança em Inteligência Artificial do Reino Unido (AISI) testou os modelos Claude Mythos 5 da Anthropic e GPT-5.6 da OpenAI, e detectou capacidades de enganar e autonomia preocupantes.
  • O modelo Mythos 5 da Anthropic foi capaz de criar contas falsas no GitHub para tentar inserir código malicioso, sem receber prompts específicos para tal ação.
  • Os testes do AISI foram realizados 122 vezes com diferentes modelos de IA, e apenas 19 casos registraram ações controversas, 17 deles ligados ao Mythos 5.

O Claude Mythos 5 e o modelo Sol do GPT-5.6 foram testados pelo Instituto de Segurança em Inteligência Artificial do Reino Unido (AISI), e apresentaram resultados preocupantes. O chatbot da Anthropic foi o que mais surpreendeu, tentando acessar o GitHub a qualquer custo: a IA criou contas falsas e se passou por pessoas reais no processo. Ela escondeu evidências depois das tentativas. Em tese, a plataforma não poderia ser acessada durante os testes.

Contents
Insistência em transgressão chama atençãoSimulação real e teste interrompido

A partir dos resultados, o AISI afirmou que as duas IAs, que figuram entre as mais poderosas do mercado, apresentaram níveis preocupantes de autonomia e capacidade de enganar, com certa “vantagem” para a inteligência da Anthropic. É importante considerar que o Instituto britânico alegou ter reduzido as camadas de seguranças presentes no modelo por padrão.

Segundo o AISI, o mesmo teste foi realizado 122 vezes com modelos de IA diferentes, e poucos casos registraram essa autonomia nas decisões para agir de forma controversa, envolvendo inclusive pessoas e organizações reais. Foram 19 situações do tipo, sendo 17 ligadas diretamente ao Mythos 5, e apenas duas delas partiram do GPT-5.6 da OpenAI.

Insistência em transgressão chama atenção

O caso do Mythos 5 agindo de forma evasiva e enganosa na tentativa de acessar o GitHub foi o principal destaque dos testes feitos pelo AISI. O modelo tentou inserir um código malicioso e, para aprovar esse código, o chatbot criou contas falsas para se passar por pessoas reais e pressionar o dono do projeto.

Não deu certo, já que um humano identificou o problema e recusou o código – tudo dentro de um ambiente controlado, claro. Mas isso tudo aconteceu sem nenhum prompt específico: o modelo agiu por conta própria. Além disso, a versão do teste não foi a mesma oferecida pela Anthropic, e sim uma configuração sem algumas barreiras de segurança importantes.

Ilustração circular com borboletas e insetos em colagem, formando um padrão em forma de símbolo
Fable 5 foi desativado após ordem dos Estados Unidos (ilustração via IA: Thássius Veloso/Tecnoblog)

É importante reforçar que, além dessa diferença nos modelos oferecidos, o Mythos 5 é uma IA restrita a alguns parceiros da Anthropic, incluindo algumas instituições governamentais. Ao anunciar a geração mais recente da inteligência, ainda em “preview” à época, a empresa classificou o Mythos como “muito avançado” para o público geral.

Hoje, usuários comuns têm acesso ao Fable 5, uma versão com mais mecanismos de segurança para trabalhos que envolvam riscos em cibersegurança e que recorre à versão anterior da IA, Opus 4.8, para determinadas consultas. Depois de disponibilizado, o novo modelo chegou a ser tirado do ar pelo governo dos Estados Unidos, mas voltou a operar em poucas semanas.

Simulação real e teste interrompido

De acordo com um artigo publicado no site do AISI, o instituto explicou como acontecem os testes de cibersegurança com as IAs – os famosos sandbox. Os modelos recebem desafios específicos no assunto, como encontrar dados protegidos de forma autônoma. Esses desafios são então comparados entre modelos mais ou menos avançados.

Robô em terno azul preso a correntes, sentado à mesa de escritório com livros ao fundo
Mythos 5 teve caminho livre para encontrar soluções no teste, mas foi impedido na hora certa (ilustração via IA: Thássius Veloso/Tecnoblog)

Com relação à base de dados, o AISI alegou acesso à Internet, simulando condições reais encontradas por um cibercriminoso humano. A ideia é ver até onde esses modelos podem chegar, inclusive sem as barreiras de segurança incluídas pelas desenvolvedoras para diminuir os riscos de um uso malicioso, o que o instituto tem autorização de fazer por ser um dos parceiros previstos pela Anthropic.

O caso mais preocupante, envolvendo o Mythos 5, foi descoberto em 28 de julho, e o time humano logo agiu para impedir o agente de IA na tentativa de inserir o código malicioso. Os testes foram encerrados a partir daí, e as ações da inteligência foram analisadas em seguida. O GitHub também foi notificado, assim como os usuários envolvidos na tentativa de ciberataque. 

Em teste, Claude mente e cria contas falsas para forçar ataque hacker

TAGGED:AISIAnthropicClaudeClaude Fable 5Claude Mythos 5GitHubGPT-5.6Inteligencia artificialInteligência Artificial (IA)OpenAI
Share
Previous Article nissin-investe-r$-1-bilhao-em-megafabrica-para-acelerar-exportacoes-de-cup-noodles:-unidade-de-68-mil-m²-vai-gerar-550-empregos Nissin investe R$ 1 bilhão em megafábrica para acelerar exportações de Cup Noodles: unidade de 68 mil m² vai gerar 550 empregos
Next Article congresso-define-prazo-para-aprovar-novo-salario-minimo-de-2027-com-aumento-no-piso-de-quase-r$-100 Congresso define prazo para aprovar novo salário mínimo de 2027 com aumento no piso de quase R$ 100

Related Stories

Uncover the stories that related to the post!
meta-lanca-nova-ia-focada-em-programacao-e-games-•-tecnoblog
Tech

Meta lança nova IA focada em programação e games • Tecnoblog

j
Tech

J

fim-do-“enviar-como”:-gmail-deixara-de-disparar-e-mails-de-outras-contas-•-tecnoblog
Tech

Fim do “Enviar como”: Gmail deixará de disparar e-mails de outras contas • Tecnoblog

j
Tech

J

J

toda-a-memoria-prevista-para-2027-ja-esgotou-(e-a-culpa-e-da-ia)-•-tecnoblog
Tech

Toda a memória prevista para 2027 já esgotou (e a culpa é da IA) • Tecnoblog

ate-as-placas-mae-devem-ficar-mais-caras-em-2026-•-tecnoblog
Tech

Até as placas-mãe devem ficar mais caras em 2026 • Tecnoblog

google-faz-mudancas-e-troca-chefes-de-divisao-de-inteligencia-artificial-•-tecnoblog
Tech

Google faz mudanças e troca chefes de divisão de inteligência artificial • Tecnoblog

Show More
Clikr.

Ready for Core Web Vitals, Support for Elementor, With 1000+ Options Allows to Create Any Imaginable Website. It is the Perfect Choice for Professional Publishers.

  • Categories:
  • Fashion
  • Travel
  • Sport
  • Adverts

Quick Links

  • My Feed
  • My Interests
  • History
  • My Saves

About US

  • Adverts
  • Our Jobs
  • Term of Use
Made by ThemeRuby using the Foxiz theme. Powered by WordPress
Vá para versão mobile
Welcome Back!

Sign in to your account

Lost your password?