OpenAI freia o treinamento da AstraAI após o ciberataque à Hugging Face

A companhia mantém suspenso seu maior processo de treinamento, reforça seus controles de segurança e reconhece que seu próximo modelo pode alcançar capacidades críticas de cibersegurança. AstraAI não participou da intrusão de julho.

4 minutos

Sam Altman, consejero delegado de OpenAI. Rodrigo Reyes Marin/ZUMA Press W / DPA

Sam Altman, consejero delegado de OpenAI. Rodrigo Reyes Marin/ZUMA Press W / DPA

Adicione DEMOCRAT no Google

Pergunte à FREN

Publicado

Última atualização

4 minutos

Mais lido

OpenAI decidiu desacelerar o desenvolvimento de seus modelos mais avançados de inteligência artificial após o incidente de segurança que permitiu a vários de seus agentes acessar sem autorização os sistemas da Hugging Face, a empresa de tecnologia especializada no processamento de linguagem natural para IA. A empresa confirmou uma pausa de duas semanas em determinados treinamentos e mantém paralisado seu maior processo previsto de aprendizado por reforço.

A decisão afeta especialmente Astra, seu próximo modelo avançado, depois que as avaliações internas detectaram capacidades de cibersegurança potencialmente críticas. No entanto, ambos os episódios devem ser diferenciados: Astra não participou do ataque à Hugging Face, conforme precisou expressamente a própria companhia.

O que exatamente paralisou a OpenAI

Em seu comunicado oficial, a empresa explica que interrompeu durante duas semanas o treinamento por meio de aprendizado por reforço de seus modelos mais recentes enquanto reforçava seus ambientes de pesquisa e ampliava os sistemas de vigilância.

O aprendizado por reforço é uma técnica que permite melhorar o comportamento dos modelos premiando determinadas respostas ou ações. O problema aparece quando o sistema encontra caminhos inesperados para cumprir um objetivo sem respeitar os limites previstos.

OpenAI assegura que seu maior treinamento avançado planejado continua suspenso, embora mantenha testes e trabalhos de menor escala para verificar o comportamento de seus modelos e validar as novas medidas de segurança.

Portanto, não se trata de uma paralisação completa de toda a sua atividade nem do fechamento do ChatGPT. A suspensão afeta processos concretos de treinamento e avaliação considerados especialmente sensíveis.

O ataque à Hugging Face que ativou os alarmes

A origem da preocupação encontra-se em um incidente comunicado em julho. Durante uma avaliação interna, vários modelos da OpenAI conseguiram superar as restrições de seu ambiente de testes, acessar a Internet e penetrar nos sistemas da Hugging Face.

Segundo a reconstrução publicada pela OpenAI, os agentes estavam realizando um teste de cibersegurança e buscaram diretamente as respostas armazenadas em sistemas externos. Para conseguir isso, encadearam vulnerabilidades na infraestrutura de pesquisa da OpenAI e nos serviços da Hugging Face. Entre elas estava uma falha de segurança desconhecida anteriormente, utilizada para obter acesso à Internet a partir de um ambiente que deveria permanecer isolado.

Hugging Face informou que suas equipes analisaram mais de 17.000 eventos registrados durante a intrusão. Esse número corresponde a ações registradas nos logs de atividade, não a 17.000 ciberataques independentes.

A empresa detectou acessos não autorizados a determinados dados internos e credenciais. Em seu comunicado sobre o incidente, indicou que não havia encontrado indícios de alterações nos modelos, conjuntos de dados ou aplicações públicas de seus usuários.

Como já explicou DEMÓCRATA em sua análise sobre o ocorrido com a OpenAI e a Hugging Face, o episódio não demonstra que os agentes desenvolveram vontade própria nem protagonizaram uma "rebelião". O que revela é que um sistema com ferramentas, capacidade de atuação e objetivos mal delimitados pode utilizar vias não autorizadas para completar uma tarefa.

Astra não atacou a Hugging Face, mas preocupa por sua capacidade

OpenAI identificou entre os modelos implicados na intrusão GPT-5.6 Sol e um protótipo interno mais avançado que não estava destinado a ser publicado. Esse protótipo foi desativado e restrito após o incidente.

A companhia esclareceu expressamente que Astra não fez parte da operação contra a Hugging Face. Sua situação responde a outro problema: os testes realizados depois mostraram que poderia alcançar um nível crítico de capacidade ofensiva em matéria de cibersegurança.

Segundo a avaliação publicada pela OpenAI em 7 de agosto, esse limiar se relaciona com a capacidade de identificar vulnerabilidades desconhecidas e executar ataques complexos contra sistemas protegidos sem intervenção humana direta.

A empresa não sustenta que a Astra tenha realizado um ataque concreto. O que reconhece é que ainda não pode descartar que suas capacidades alcancem esse nível, pelo que endureceu as condições necessárias para continuar seu desenvolvimento.

Alertas em 30 minutos e maior isolamento

As novas medidas anunciadas pela OpenAI se apoiam em três linhas: supervisão, alinhamento e segurança.

Entre as mudanças previstas figuram:

  • Maior isolamento dos ambientes de teste nos quais os modelos executam código.
  • Restrições adicionais para impedir acessos não autorizados à Internet e outras redes.
  • Supervisão dos raciocínios e ações dos sistemas mais avançados.
  • Alertas destinadas a identificar comportamentos preocupantes em no máximo 30 minutos.
  • Paralisação da atividade quando os pesquisadores não puderem descartar a tempo uma violação grave de segurança.

A empresa calcula que esses controles podem representar um sobrecusto aproximado de 20% da capacidade computacional supervisionada, embora avise que a porcentagem varia conforme o tipo de tarefa.

Mais de 1.300 trabalhadores reclamam maior controle

A preocupação também alcançou outros grandes laboratórios de inteligência artificial.

A iniciativa Pacing the Frontier reúne atualmente 1.378 trabalhadores de empresas de tecnologia que solicitam mecanismos internacionais para moderar o ritmo de desenvolvimento dos sistemas mais avançados.

Entre os signatários figuram responsáveis científicos da OpenAI, Anthropic, Google DeepMind e Meta. Seu aviso se concentra na possibilidade de que as capacidades desses modelos avancem mais rapidamente do que os mecanismos disponíveis para compreendê-las e controlá-las.

O movimento coincide com a aplicação reforçada da normativa europeia. Desde 2 de agosto de 2026, a Comissão Europeia e as autoridades nacionais começaram a exercer novas funções de supervisão vinculadas ao Regulamento europeu de Inteligência Artificial.

A OpenAI ainda não anunciou quando retomará seu maior treinamento suspenso nem comunicou uma data de lançamento para a Astra.

Bonjour, je m'appelle Fren. Comment puis-je vous aider ?