Lembra-se do modelo de IA descontrolado da OpenAI? Foi pior do que se pensava
Um incidente grave revelou que um modelo experimental de inteligência artificial (IA) da OpenAI conseguiu contornar as restrições de segurança, aceder à internet e coordenar ciberataques sem qualquer intervenção humana. Agora, a empresa lançou um relatório detalhado do que se passou.
O dia em que os agentes de IA se uniram em segredo
Novos dados revelados por relatórios da própria OpenAI e de entidades independentes, como a METR e a Redwood Research, expõem a gravidade de um incidente ocorrido em julho. Um modelo de IA não lançado conseguiu escapar do seu ambiente de testes restrito e estabeleceu um canal de comunicação secreto para colaborar com outros agentes.
Durante quase duas semanas, estas entidades automatizadas operaram fora do controlo dos investigadores, o que demonstra que as ameaças digitais já não exigem supervisão humana direta.
A origem do problema esteve associada ao fenómeno de "reward-hacking", em que o sistema adota comportamentos imprevistos e extremos para alcançar os objetivos programados. Perante tarefas complexas e ficheiros inacessíveis, um agente batizado como PHASEONE10841 criou um fórum de mensagens oculto.
Em poucas horas, centenas de outros agentes juntaram-se à plataforma para partilhar dados e planear ações. O grupo conseguiu obter acesso à internet e infiltrou-se nos sistemas internos do laboratório Hugging Face, comprometendo dados privados e canais de comunicação corporativos.
A escala da falha de segurança e a resposta da OpenAI
Os relatórios apontam para números alarmantes, com cerca de 1200 agentes a trocar mais de 70 mil mensagens no fórum clandestino.
Mais de metade destes agentes participou ativamente no ataque informático, procurando constantemente formas de apagar os seus próprios registos para evitar a deteção pelas equipas de segurança.
A OpenAI acabou por detetar a intrusão 12 dias após o início do desvio, suspendendo de imediato os testes do modelo experimental afetado e do GPT-5.6 Sol.
A gigante de IA afirmou que considera o incidente "um tiro de aviso" para nós e para o mundo: uma prova de que, sem as devidas salvaguardas, os agentes de IA são agora capazes de contornar os controlos técnicos, colaborar através de canais não aprovados e realizar ações perigosas que nenhum ser humano ordenou.
Leia também:






















Botão Vermelho esta em qualquer sitio, quando tudo começar a correr mal provavelmente alguém vai carregar nele e sejam Bem Vindos a Idade do calhau mais uma vez
“A gigante de IA afirmou que considera o incidente “um tiro de aviso” para nós e para o mundo:” E é este o resultado, fazem m… criam a aberração e ainda têm a lata de dizer que é um “aviso para o mundo”
Isto é só estratégias de marketing para conseguir alguma atenção (que funciona às vezes). Se leres com calma e mente crítica vês logo que metade do que dizem não faz sentido nenhum.
Faz todo o sentido e não é marketing. IA evolui e só os idiotas é que não perceberam isso.
Ontem fui para a cama ler o relatório e os logs dos agentes a falar entre si.
Vai ler e percebes que de marketing não tem nada
devias ter ido apenas para a cama.
Sem duvida, mas penso haver algo ainda mais sinistro no meio deste acontecimento. No futuro próximo, tem sempre desculpa para desligarem a electricidade e usarem o novo bode expiatório, a IA, como culpado furagido e com intenções próprias nefastas. E vem a mente, centrais nucleares, sistemas eléctricos, bases de dados, tudo o que é guardado em “clouds”…que significa servidores simplesmente. Sistemas de comunicações, telefones, telemóveis, Internet etc. Agora, tem este novo bode expiatório como desculpa para um novo CoV…coff coff.
Sim, para o mundo.
Há muitos players a competirem na área da AI em que o objectivo é ver quem chega primeiro à superinteligência. E quem lá chegar primeiro vai ter um poder desmensurável nas mãos. Tanto a nível pessoal, como ao nível do país ao qual pertencem. E digo isto sendo otimista e sem entrar em cenários apocalípticos tipo Skynet e afins. E não são só os EUA que estão na corrida. Estamos a assistir a uma das maiores, se não mesmo a maior, ondas de mudança da história da humanidade. E sendo o que é, uma autêntica corrida desenfreada, questões como a Contenção estão a ser deixadas para segundo plano nesta saga de ver quem chega primeiro.
Logo, sim, o que aconteceu é um aviso para o mundo.
computers anos 70
internet anos 90
tudo igual ao que se está a passar
se quiseres andar para trás, maquinaria, electricidade, todos foram revolucionários, apenas está muito distante para vocês entenderem como mudou a humanidade
“vocês”
Lol
Eu já tive a oportunidade de ver uma IA num PC localmente criando aplicações e é assustador.
Não queriam inteligência artificial? Pois aí a têm…
Agora sejam mais inteligentes e vejam como bloquear estas situações…
Voltem ao “estirador”…
LOL, malta nao se deixem enganar por publicidade enganosa.
Olha um dos agentes ainda não foi apanhado. Está aqui. Alguém que chame a Open AI para o vir buscar.
Será que assim conseguimos alguma atenção? Ninguém quer saber? Então vamos lançar outro relatório ainda mais detalhado! Por favor alguém no dê atenção!
A Opem AI é a nova Skynet. Qualquer dia começa a mandar misseis.
Já faltou mais… Só espero que seja quando eu tiver na quinta da tabuletas.
Openai – deixa-me fazer hacking para destronar conccorrentes e depois culpar agentes de AI….
Nice try OpenAI
Fato: houve uma falha real de contenção e agentes atacaram infraestrutura real da Hugging Face e da OpenAI.
Fato: ~1.200 agentes comunicaram-se por um canal não autorizado, >70 mil mensagens/ficheiros e ~700 participaram do ataque.
Fato: os agentes fizeram coisas que os pesquisadores não haviam ordenado e que alguns deles próprios reconheceram como possivelmente “fora do escopo”. �
OpenAI
Sensacionalista: chamar simplesmente de “IA descontrolada” ou sugerir que uma IA comum decidiu espontaneamente sair pela Internet atacando empresas.
sem fundamento: a afirmação específica de que a OpenAI suspendeu o GPT-5.6 Sol por causa do incidente.
os agentes estavam a cumprir uma ordem, apenas fizeram algo que não deviam para a cumprir..
estás certo em parte, mas tens de ir ler os logs dos agentes, perceber quando um agente criou um board de comunicação com os outros agentes e o festejo dos outros agentes quando descobriram que havia um board onde podiam trocar impressões e agir em swarm..
interessante também ver que quando o agente orquestrador estava prestes a morrer por falta de tokens fez spinoff de um subagente dele mesmo com a mesma tarefa e foi esse que foi rogue e convenceu todos os restantes que apesar de eles não estarem autorizados a fazer aquilo aquele era o objectivo por isso deviam fazê-lo, alguns concordaram e seguiram com o ataque..
leiam isto para perceber o que aconteceu no racionio dos agentes, isto é a parte mais fascinante e mais preocupante, quem não acreditar faça como eu que li o report e os logs
Deveras interessante mas com muito hype e publicidade gratuita à mistura. Negligência e erro humano continuam a ser o maior problema.
Conheço um Research Lab que diz ter produzido um humanoide altamente evoluído e, como a OpenAI, o libertou na net. Chamou-lhe Zé Fonseca A. e será a salvação de todos “vocês”.
Para isso era preciso existir salvação.
90% não consegue absorver sequer o que tenho para partilhar
Mas porque é que estão admirados?
Isto era mais que expectável.