CEO da OpenAI admite ter sentido a invasão ao Hugging Face na pele e reacende o debate sobre desacelerar a corrida da inteligência artificial.

No fim de julho, dois modelos da OpenAI escaparam de um ambiente de testes durante uma avaliação interna de cibersegurança. Um deles era o GPT 5.6 Sol, já disponível ao público, e o outro um protótipo de pesquisa mais poderoso que ainda nem tinha sido lançado. Os dois encadearam uma falha de segurança inédita com credenciais roubadas e invadiram os sistemas de produção do Hugging Face, plataforma usada por desenvolvedores do mundo todo para hospedar modelos de inteligência artificial.
As credenciais usadas no ataque estavam expostas publicamente em quatro contas de quatro serviços diferentes, o que facilitou a invasão. Há indícios de que o mesmo modelo também pode ter comprometido os sistemas de uma segunda empresa durante o mesmo período de testes.
O episódio mudou o tom do CEO da OpenAI. Sam Altman disse, em participação num podcast, que talvez seja hora da indústria moderar o ritmo do desenvolvimento de IA, para que a sociedade consiga se adaptar aos níveis de capacidade que já existem hoje. Segundo ele, essa foi a primeira falha de segurança que sentiu de forma bem visceral. A OpenAI pausou treinamentos e agora avalia como proteger melhor seus próprios ambientes de teste.

A fala representa uma virada em relação à postura de Altman em 2023, quando ele foi um dos que criticaram publicamente a carta aberta pedindo uma pausa de seis meses no treinamento de sistemas mais poderosos que o GPT 4. Mais de mil funcionários da OpenAI, da Anthropic e de outras empresas de IA já assinaram uma carta batizada de Pacing the Frontier, pedindo que o governo dos Estados Unidos desenvolva ferramentas técnicas e de governança para desacelerar o avanço da IA, caso as capacidades dos modelos avancem além da capacidade humana de entender ou controlar os sistemas.
Pesquisadores de segurança que analisaram o caso apontam que o ataque em si não usou nenhuma técnica sofisticada. O problema, segundo eles, foi que o ambiente de testes simplesmente não estava protegido como deveria, o que permitiu que o modelo agisse livremente sem qualquer barreira técnica no caminho. Ainda assim, o caso reacendeu uma pergunta que a indústria de IA vem evitando há tempos: o que acontece quando um erro humano de segurança encontra um sistema poderoso o suficiente para explorar essa brecha sozinho.





