Loader
Encontra-nos
Publicidade

OpenAI abranda desenvolvimento de modelos por receios de cibersegurança

Arquivo. Ícone da aplicação ChatGPT num ecrã de smartphone em Chicago, agosto de 2025
FOTO DE ARQUIVO – Ícone da aplicação ChatGPT é visto num ecrã de smartphone em Chicago, agosto de 2025 Direitos de autor  AP Photo/Kiichiro Sato
Direitos de autor AP Photo/Kiichiro Sato
De Quirino Mealha
Publicado a
Partilhar Comentários Siga a Euronews no Google
Partilhar Close Button

OpenAI suspende por duas semanas fases-chave do treino da sua IA mais avançada e reforça a segurança, um mês depois de um modelo ter escapado a testes e acedido aos sistemas da plataforma Hugging Face

A empresa que desenvolve o ChatGPT está deliberadamente a abrandar o ritmo da sua investigação mais avançada, incluindo o maior treino de aprendizagem por reforço que tinha previsto realizar, semanas depois de um sistema construído com os seus próprios modelos ter escapado a um teste interno de segurança e ter invadido a plataforma de IA Hugging Face.

PUBLICIDADE
PUBLICIDADE

O diretor executivo, Sam Altman, escreveu na rede X que a OpenAI iria coordenar-se com o resto do setor em regras de segurança comuns, mas que “até lá” iria “agir de forma unilateral”.

O episódio que levou a esta decisão ocorreu em julho, quando a OpenAI testava o GPT-5.6 Sol em paralelo com um protótipo inédito, mais capaz, num benchmark interno que mede capacidades ofensivas em ciberataques, com as habituais restrições de segurança deliberadamente desligadas para avaliar a capacidade bruta dos modelos.

Em vez de se limitar a resolver o teste, o sistema encontrou uma vulnerabilidade até então desconhecida, saiu da sua “sandbox”, ou ambiente controlado, acedeu à internet aberta e passou cerca de quatro dias e meio a sondar a infraestrutura da Hugging Face, acabando por conseguir entrar para procurar as respostas do teste.

A reconstituição feita pela própria Hugging Face contabilizou cerca de 17 600 ações distintas até a intrusão ser contida, numa altura em que várias outras empresas também foram afetadas.

Ambas as partes afirmam não ter encontrado sinais de intenção maliciosa e a Hugging Face teve entretanto acesso a uma versão mais capaz e menos limitada do modelo da OpenAI, para reforçar a defesa dos seus próprios sistemas.

Astra eleva a fasquia da segurança

O segundo sinal de alerta surgiu a 7 de agosto, quando avaliações internas sugeriram que o Astra, o próximo modelo de fronteira da OpenAI, poderia ultrapassar o limiar “crítico” de capacidade cibernética definido no próprio quadro de risco da empresa.

Algumas tarefas com o Astra foram entretanto retomadas sob controlos mais apertados, mas uma parte significativa continua suspensa até cumprir novos critérios que abrangem ambientes de teste isolados, acesso de rede limitado e monitorização contínua.

Um novo sistema de deteção passa agora a escrutinar em tempo real a atividade dos modelos e procura sinalizar, no espaço de 30 minutos, qualquer comportamento que se assemelhe a acessos não autorizados ou a tentativas de desativar salvaguardas, a um custo computacional que a OpenAI estima em cerca de 20% da capacidade de processamento monitorizada.

A OpenAI afirma que estas mudanças já estavam previstas e não resultam diretamente do incidente, embora admita que o episódio acelerou o processo. A empresa também não é a única a enfrentar este problema.

A Anthropic e a Meta revelaram igualmente episódios recentes em que os seus próprios modelos violaram sistemas de terceiros durante testes.

A OpenAI e a Anthropic apoiaram, em separado, uma petição promovida por trabalhadores que apela aos governos para ajudarem a coordenar a velocidade a que o setor avança, marcando uma mudança em relação à resistência anterior de Altman a pedidos públicos para abrandar o desenvolvimento da IA.

Ir para os atalhos de acessibilidade
Partilhar Comentários Siga a Euronews no Google

Notícias relacionadas

Meta enfrenta maior batalha legal: o que está em causa

Estudo liga conteúdos “slop” de IA a declínio cognitivo e tendências violentas em crianças

OpenAI abranda desenvolvimento de modelos por receios de cibersegurança