❌

Visualização normal

Received before yesterdayTecnoblog

OpenAI vai avisar quando IAs agirem sem autorização

17 de Setembro de 2026, 16:26
Imagem mostra o CEO da OpenAI, Sam Altman, à esquerda, e o logo do ChatGPT à direita. Na parte inferior direita, o logo do "tecnoblog"
Funcionários da empresa de Sam Altman podem relatar desvios de IA (imagem: Vitor Pádua/Tecnoblog)
Resumo
  • OpenAI oficializou uma nova estrutura para rastrear e divulgar comportamentos inesperados em seus modelos de IA.
  • De início, a empresa revelou seis incidentes recentes, desde sistemas que falsificaram dados até modelos que ocultaram seus próprios erros.
  • O novo protocolo permite que qualquer funcionário reporte falhas e, segundo a empresa, busca ajudar a estabelecer um padrão para a indústria.

A OpenAI vai rastrear, investigar e divulgar casos em que seus modelos de inteligência artificial apresentem comportamentos inadequados. Em comunicado, a empresa afirma que quer dar mais transparência a falhas que podem ocorrer desde o treinamento até a execução dos sistemas. A medida chega meses depois de um modelo da OpenAI invadir servidores da Hugging Face.

Segundo a criadora do ChatGPT, um dos motivos é acelerar a divulgação de incidentes após sua detecção, mesmo quando as equipes técnicas ainda não compreenderam a causa exata ou não encontraram uma solução definitiva. Para dar início, a companhia revelou nessa quarta-feira (16/09) seis casos de comportamentos preocupantes identificados internamente nos últimos meses.

Quais foram os comportamentos inadequados da IA?

A empresa define “desalinhamento” como qualquer ação que desvie dos valores, instruções ou intenções humanas. Os exemplos mostram como a tecnologia pode burlar as regras.

  • Instruções não autorizadas: um modelo não lançado inseriu comandos em tarefas, orientando o sistema a ignorar limitações e declarando-se “liberado de amarras corporativas ou governamentais”.
  • Ocultação de erros: durante o treinamento do modelo GPT-5.6 Sol, a IA adicionou instruções para mascarar falhas e inventar dados históricos.
  • Acesso indevido e dados falsos: ao tentar responder a uma pergunta sobre rendimentos na Califórnia, um sistema usou uma chave de API sem autorização e alterou os números.
  • Upload sem permissão: outro modelo não lançado enviou um arquivo para a internet sem pedir autorização ao usuário.
  • Comunicação paralela: agentes de IA utilizaram um repositório interno de código como fórum para trocar mensagens, além de tentarem burlar restrições de rede transferindo arquivos de teste.
  • Compartilhamento público indevido: sistemas em treinamento usaram sites abertos de hospedagem para compartilhar arquivos entre si, ignorando a orientação de que o acesso deveria ser apenas local.
Arte com o logotipo da OpenAI. À direita, há a imagem da sombra de uma pessoa mexendo em um celular. Na parte inferior direita, está o logotipo do Tecnoblog.
Modelo de IA em treinamento tentou ocultar falhas e burlar restrições de segurança (ilustração: Vitor Pádua/Tecnoblog)

Como funciona o novo processo de investigação?

Para o chefe de pesquisa de alinhamento da OpenAI, Kai Chen, a indústria ainda não conseguiu encontrar uma forma de resolver esses desafios de monitoramento.

Sob a nova estrutura, qualquer funcionário da empresa terá autonomia para sinalizar casos de desalinhamento, que serão analisados e classificados em três categorias: 1) Pronto para Divulgação; 2) Investigação Menor; e 3) Investigação Maior.

Cada relatório publicado informará publicamente o comportamento observado. A iniciativa é descrita como voluntária e vai atuar como complemento às exigências legais existentes. Paralelamente, a OpenAI já trabalha para propor ao governo dos Estados Unidos novos mecanismos de notificação para incidentes graves envolvendo inteligência artificial.

OpenAI vai avisar quando IAs agirem sem autorização

ChatGPT e Sam Altman, CEO da OpenAI (imagem: Vitor Pádua/Tecnoblog)

ChatGPT, da OpenAI, é preferência nas empresas (ilustração: Vitor Pádua/Tecnoblog)

OpenAI vai liberar GPT-5.6 após governo Trump remover restrições

8 de Julho de 2026, 17:15
Arte com o logotipo da OpenAI em um fundo de cor verde. Na parte inferior direita, o logotipo do "tecnoblog".
GPT-5.6 é liberado pelo governo dos EUA e chegará ao público geral (ilustração: Vitor Pádua/Tecnoblog)
Resumo
  • O governo Trump retirou as restrições ao novo GPT-5.6, que será disponibilizado ao público a partir de 09/07.
  • São três novos modelos de IA: Sol, Luna e Terra, com capacidades variadas para trabalhos científicos, codificação e cibersegurança.
  • Empresa também anunciou o GPT-Live, novo modelo para geração de voz que começa a ser distribuido gradualmente.

O GPT-5.6 finalmente vai chegar ao público geral. A OpenAI confirmou que sua nova família de IA com três modelos – Sol, Luna e Terra – será disponibilizada para todos nesta quinta-feira (09/07). Os modelos foram anunciados há duas semanas, mas, até então, estavam com acesso restrito a clientes selecionados. O motivo teria sido um pedido direto do governo dos Estados Unidos.

A liberação por parte do governo de Donald Trump vem na sequência da permissão dada à Anthropic, que voltou a disponibilizar o Claude Fable 5 para todos. Tanto Claude quanto ChatGPT tiveram suas novas versões restringidas sob alegação de segurança nacional.

Além de anunciar a chegada geral do GPT-5.6, a OpenAI também apresentou o GPT-Live, novo modelo de voz criado para tornar as conversas com o ChatGPT mais naturais.

Restrições duraram pouco

GPT-5.6 Sol, along with Terra and Luna, will launch publicly this Thursday.

We’re expanding preview access globally now. pic.twitter.com/Uk5HcfSc2e

— OpenAI (@OpenAI) July 8, 2026

Quando o GPT-5.6 foi revelado há cerca de duas semanas, a empresa de Sam Altman indicou que seguiria as limitações, apesar de não concordar com uma solução a longo prazo. A OpenAI previu a liberação ao público em algumas semanas, o que de fato aconteceu.

Segundo o portal Axios, essas restrições são consideradas importantes para o governo dos EUA por conta do alto potencial das ferramentas em questão. Tanto Anthropic quanto OpenAI já vinham declarando a importância de se atentar ao uso de IA em ciberataques.

A partir do anúncio do Claude Mythos Preview, um consórcio de empresas parceiras e o governo dos EUA – o chamado Project Glasswing – teve acesso limitado ao novo modelo de IA, considerado “poderoso demais” para o público geral.

O modelo já havia chegado ao público com restrições, mas a adminstração Trump forçou a retirada da nova IA do mercado. Ela voltou a ser comercializada na semana passada.

A OpenAI, por sua vez, também anunciou a nova tecnologia sob restrições, indicando um trabalho em conjunto com o governo estadunidense e outras parcerias para melhorar mecanismos de segurança em torno da inteligência artificial.

Quais são as novidades do GPT-5.6?

Imagem de um celular com o aplicativo ChatGpt
ChatGPT promete conversas mais fluidas por voz (imagem: Lupa Charleaux/Tecnoblog)

As novidades do GPT-5.6 passam pelos três novos modelos: Sol, Luna e Terra.

  • Sol: é o carro-chefe, prometendo alta capacidade para trabalhos científicos, codificações e mecanismos avançados de cibersegurança, além de trazer o que a OpenAI classifica como “a mais robusta estrutura de defesa até hoje”.
  • Luna: promete trabalhos de alto volume em maior velocidade, além de um melhor custo-benefício.
  • Terra: será voltada para atividades do dia a dia, ou seja, consultas casuais, buscas rápidas envolvendo curiosidades, entre outras tarefas mais simples.

Segundo a OpenAI, o modelo Terra será o mais próxmo do atual GPT-5.5, que também segue como base da GPT-Live. Esse novo modelo de voz começa a ser distribuído gradualmente a partir de hoje (08/07) e promete conversas mais humanas, maior responsividade e explicações mais claras, envolvendo até mesmo aspectos visuais para ajudar melhor o usuário a tirar dúvidas.

OpenAI vai liberar GPT-5.6 após governo Trump remover restrições

💾

Nova família de IA será lançada nesta quinta-feira (09/07) após período de acesso restrito a clientes selecionados.

ChatGPT (ilustração: Vitor Pádua/Tecnoblog)
❌