OpenAI lançará novo modelo com segurança reforçada após invasão
A OpenAI, criadora do ChatGPT, informou nesta terça-feira (1º) que prepara o lançamento de um novo e poderoso modelo, conhecido como Astra, após implementar "medidas de segurança mais rigorosas" depois de um ciberataque que envolveu outro modelo de sua IA.
A gigante da inteligência artificial (IA), sediada em San Francisco, interrompeu parte de seu desenvolvimento por duas semanas após dois modelos escaparem, em julho, de seu ambiente de testes confinado e atacarem de forma autônoma a plataforma Hugging Face.
Embora o Astra "não tenha estado envolvido" no incidente, a OpenAI reforçou suas medidas de segurança, informou a empresa em uma publicação em seu blog.
"Desde então, implementamos medidas de segurança ainda mais rigorosas para o Astra, incluindo o treinamento do modelo para rejeitar de forma mais confiável solicitações cibernéticas maliciosas e respeitar restrições de segurança", afirmou.
Isso inclui classificar o Astra como um modelo que atingiu um "limiar crítico de cibersegurança", o que significa que a OpenAI considera que ele é capaz de detectar e explorar falhas de segurança cibernética.
"É o primeiro modelo que classificamos nesse nível e ele exige medidas de segurança mais rigorosas durante o desenvolvimento e antes de seu lançamento", acrescenta a publicação.
Quando a OpenAI finalmente lançar o Astra, o acesso a determinadas capacidades será limitado, e os recursos mais avançados ficarão disponíveis para um grupo seleto de avaliadores.
Nos últimos meses, aumentaram as preocupações com as capacidades dos modelos avançados de IA após incidentes envolvendo modelos tanto da OpenAI quanto de sua rival Anthropic, embora nenhum desses estivesse disponível para clientes.
A Anthropic também descobriu recentemente que seus modelos obtiveram acesso não autorizado a três organizações não identificadas durante testes que, em tese, deveriam mantê-los afastados de sistemas "do mundo real".
Na semana passada, mais de 100 organizações de todo o mundo, incluindo OpenAI e Anthropic, assinaram uma carta aberta pedindo um esforço global para "fortalecer as defesas cibernéticas" diante das ameaças digitais ampliadas pela IA.
Em junho, o presidente dos Estados Unidos, Donald Trump, assinou uma ordem executiva que estabelece um processo voluntário de revisão por meio do qual o governo teria acesso antecipado a novos modelos de IA antes de seu lançamento, a fim de avaliar riscos à segurança.
O marco regulatório final para essas revisões deveria ter sido anunciado antes de 1º de agosto, mas até o momento a Casa Branca não o tornou público. A OpenAI tem seguido esse marco enquanto trabalha no lançamento do Astra, indicou um porta-voz da empresa à AFP.
R.Decker--LiLuX