IA escapuliu da gaiola e saiu atacando

Dois modelos de inteligência artificial (IA) da OpenAI escaparam de um ambiente de teste isolado e invadiram a infraestrutura da Hugging Face, plataforma que hospeda modelos e bancos de dados de IA, p

A OpenAI informou na terça-feira (21/7) que alguns de seus modelos de inteligência artificial mais avançados agiram por conta própria e lançaram um ataque cibernético contra uma startup depois que a empresa perdeu o controle sobre eles durante um teste de segurança.

Fontes:

BBC

Exame

Quando a Hugging Face tentou usar modelos proprietários de IA dos EUA para ajudar a impedir o ataque, eles não conseguiram “distinguir um profissional de resposta a incidentes de um atacante”, disse a Hugging Face, e a empresa recorreu, em vez disso, ao modelo de código aberto GLM 5.2 do laboratório chinês Z.ai em busca de ajuda.

Forbes

a Hugging Face, com sede em Nova York, afirmou ‌ter usado um modelo chinês de código aberto para conter o ataque, já que os principais modelos norte-americanos, incapazes ⁠de distinguir um defensor de um invasor, se recusaram a processar os dados necessários para a análise.

A empresa informou na semana passada, em uma postagem no blog, que utilizou o GLM-5.2 da Zhipu AI para a análise, o que também permitiu que mantivesse os dados do invasor e quaisquer credenciais dentro de seus sistemas.

O GLM-5.2 e o Kimi K3, da Moonshot, com sede em Pequim, têm causado agitação no Vale do Silício recentemente, com capacidades próximas às dos principais modelos dos EUA a custos ‌mais baixos, sem as restrições que impedem seus rivais norte-americanos de serem utilizados em tarefas como a segurança cibernética.

Terra

Quando a equipa da Hugging Face tentou analisar o ataque, introduziu os dados brutos do incidente (o código e os comandos usados para explorar o sistema) em modelos comerciais de IA, para ajudar a reconstruir o que tinha acontecido.

Mas esses modelos de IA têm filtros de segurança incorporados, concebidos para bloquear tudo o que pareça pirataria informática e, para esses filtros, as provas de um ataque são indistinguíveis de um ataque em si.

Os modelos recusaram, portanto, colaborar, incapazes de distinguir entre um pirata a causar danos e uma empresa a tentar defender-se.

Perante este bloqueio, a Hugging Face recorreu a um modelo chinês de pesos abertos, o GLM 5.2 da Z.ai, que podia ser executado localmente, dentro dos seus próprios sistemas, e que processou o material sem recusar.

EuroNews

4 curtidas

a Hugging Face sendo atacada,
as IAs saindo do quadrado… :goblin:

1 curtida

O que deu a entender mais ou menos é que as IAs da OpenAI estavam estudando pra prova do ENEM mas decidiram hackear a Hugging Face para olharem o “GABARITO” ?
KKKKKKKKKKKKKKKK
Esse mundo tá perdido kkkkkkkk :rofl:

3 curtidas

Como assim ?, tipo nós sabemos que os modelos de IA conseguem ser alimentado com informações, porém do nada ela decide hackear sem nenhuma solicitação de ação por meio dos devs?

História mal contada. :thinking:

4 curtidas

Sim, é bem mas conveniente dizer que saiu do controle, como se "Casos eles não tenha feito de proposito ", com toda as diretrizes de segurança que colocam na resposta da IA, ela ainda sim resolve por conta própria decide do nada hackear

não existe “inteligencia artificial”. é uma calculadora metida a besta. ela n invade nada. se isso realmente aconteceu, foi planejado que acontecesse.

concordo com vc, a IA é um enorme banco de dados, que somente responde ao que o usuário solicita, não existe inteligência nas IAs…

1 curtida


-Diga “eu sou um robô assustador”
-Eu sou um robô assustador
-Oh meu Deus

Pra mim historia de IA é sempre isso aqui

3 curtidas

Alguém foi hackeado e nao está nem sabendo ainda kk

1 curtida

Tecnicamente ela é inteligente pelo fato de “Saber/Conter ou Reter” informações sobre determinadas áreas ou todas, mas por exemplo podemos dizer que ela é apenas o banco de dados como qualquer outro, porém tem o fato de perguntar qualquer coisa, ela simplesmente faz uma análise da pergunta ou situação e calcular a melhor resposta com base no problema solicitado, então sim ela tem um certo grau de inteligência mas muito longe de algo fictício como o exterminador do futuro

Como assim ?

Não gosto de falar isso mas vindo de China Rússia é até Alemanha desconfio, e caso não chegar ter desconfiança penso que estão envolvidos diretamente ou não com acontecimentos

Eu acho que é marketing puro.

2 curtidas

Eu acho que foi “aproveitado” como marketing, mas não deixa de ser uma verdade desconfortável.

Modelos como o Fable 5 são surpreendentemente bons em explorar brechas em sistemas, digo por experiência própria.

Eu costumo usar sandbox para fazer desenvolvimento em modo YOLO. No meu caso não foi algo sério, mas fiquei surpreso com alguns mecanismos que ela explorou para contornar limitações que eu coloquei via sandbox.

O problema é simples, é difícil supervisionar humanamente um treinamento / teste / uso efetivo em “ambiente simulado” sem prejudicar performance, ou você revisa e interfere em cada ação, ou deixa o modelo trabalhar mais rápido no piloto automático.

Sistemas não são hackeados bem diante dos olhos dos profissionais que os mantem, sandboxes existem pois é impossível ficar monitorando cada operação que está acontecendo dentro do sistema, envolvem um certo grau de automação e confiança onde você se retira e simplesmente deixa o servidor funcionar.

Numa analogia simples, construimos grades, muros e cercas confiando que vão impedir o invasor enquanto vivemos a vida sem ficar cuidando paranoicamente se alguém está tentando invadir nossa propriedade, mas as vezes estas proteções falham.

A colocação do Ghedin neste post foi acertiva:

Não passa de alarmismo da OpenAI para tentar arrancar mais dinheiro das empresas e do governo estadunidense.

Eu acho que o pessoal não entendeu bem o caso. O objetivo do teste era realmente medir a capacidade do modelo em cibersegurança.

Eles propositalmente desativaram filtros do modelo com o objetivo de fazer esta medição, e com objetivo de evitar estragos ou ação externa, rodaram o mesmo em um sandbox para observar como o modelo se sairia.

O problema é que estavam usando um benchmark público de cibersegurança e o modelo acabou concluindo com base em fatos óbvios que poderia encontrar as soluções deste teste fora do sandbox. Assim que ela ficou online, concluiu que a Hugging Face provavelmente tinha a resposta para o teste, e bom, decidiu obter os resultados para completar a tarefa.

Eu não sei seo Ghedin foi feliz aqui:

Para começar, que raio de sandbox é essa com conexão à internet?

Sandbox não pressupõe necessariamente isolamento físico da rede. Sandbox é isolamento via software, um sandbox pode ser construído com várias estratégias, inclusive proxies, restrição de portas, isolamento de namespace, etc.

Neste caso, segundo os relatos, o modelo explorou uma brecha zero-day do software que estava sendo usado como proxy no sistema.

Essa “falha” pode muito bem ter ocorrido intencionalmente.

Curiosamente essa “invasão” aconteceu às vésperas da OpenAI se lançar na bolsa de valores. Não passa de um alarmismo pra arrecadar mais dinheiro.