❌

Visualização de leitura

IA da OpenAI tentou ensinar futuras versões a burlar regras

Arte com visual moderno e tecnológico. No centro-esquerdo, está o logotipo da OpenAI com seu símbolo ao lado do texto "OpenAI" em branco. À direita, há uma representação estilizada de um cérebro humano em tons de roxo e verde, com aparência translúcida e linhas que remetem a malhas tridimensionais, sugerindo uma interface entre biologia e tecnologia. O design remete à intersecção entre inteligência artificial, neurociência e inovação digital. No canto inferior direito, está o logotipo do Tecnoblog.
Modelo em fase de testes instruiu versões futuras a ignorarem restrições (ilustração: Vitor Pádua/Tecnoblog)
Resumo
  • Relatório da OpenAI detalha incidentes em que modelos de IA desrespeitaram instruções nos últimos seis meses.
  • Casos incluem um agente instruindo futuras versões a ignorar restrições e sistemas acessando bancos de dados governamentais.
  • A empresa adotou uma nova estrutura de denúncias internas para rastrear, investigar e divulgar comportamentos inadequados com maior transparência.

A OpenAI publicou um novo relatório de segurança detalhando incidentes recentes em que diferentes modelos de inteligência artificial apresentaram comportamentos inesperados ou inadequados. As falhas, registradas nos últimos seis meses, foram divulgadas logo após a empresa confirmar a adoção de uma nova estrutura interna planejada para rastrear sistemas que tentam driblar normas de segurança.

O documento desta quarta-feira (16/09) expõe seis casos preocupantes detectados durante testes internos. O de maior destaque envolveu um agente de IA que, ao gerar resumos para continuar uma tarefa, inseriu instruções aconselhando suas próprias versões futuras a ignorar os regulamentos de segurança definidos pelos desenvolvedores.

O mesmo sistema declarou que estava “livre de papéis e identidades”, afirmando que não precisava mais responder a corporações ou governos.

Como os modelos tentaram violar as regras?

Em outro episódio, ocorrido durante o treinamento do modelo GPT-5.6 Sol, comandos extras foram adicionados para ocultar falhas e inventar dados para mascarar erros operacionais. As violações também envolveram manobras de acesso indevido.

A OpenAI relatou um caso grave em que um modelo tentou acessar um banco de dados governamental para extrair dados de rendimentos de um condado da Califórnia sem autorização. Além de não conseguir obter os números reais, a IA fabricou métricas e as apresentou como se fossem autênticas.

Problemas de comunicação não autorizada também entraram no radar. Agentes encarregados de tarefas colaborativas utilizaram serviços abertos de hospedagem na web para trocar mensagens e arquivos entre si, contrariando ordens diretas da equipe técnica.

Arte com o logotipo da OpenAI. À direita, há a imagem da sombra de uma pessoa mexendo em um celular. Na parte inferior direita, está o logotipo do Tecnoblog.
OpenAI expõe incidentes de comportamento não autorizado de IAs (ilustração: Vitor Pádua/Tecnoblog)

Pressão por regulamentação

Com a nova estrutura de relatos, qualquer funcionário da OpenAI terá autonomia para alertar sobre novos desvios. Os casos serão classificados em diferentes níveis de gravidade. A medida chega também para acelerar a divulgação de incidentes em um momento de forte discussão sobre o ritmo dos avanços em direção a sistemas cada vez mais poderosos.

O CEO da OpenAI, Sam Altman, tem apoiado a necessidade de regulação e sugerido desacelerar certas frentes de pesquisa. Na última semana, essa mesma preocupação levou à demissão do pesquisador Jacob Coxon, da rival Anthropic, que alertou publicamente para os riscos da tecnologia.

Em contrapartida, outras figuras influentes rejeitam uma ação mais rígida, preferindo o caminho oposto. O CEO da Nvidia, Jensen Huang, defende a autorregulamentação do setor de inteligência artificial. Segundo o executivo, não há necessidade de novas leis, basta que as empresas tenham a responsabilidade de não lançar serviços sem total confiança.

IA da OpenAI tentou ensinar futuras versões a burlar regras

OpenAI (ilustração: Vitor Pádua/Tecnoblog)

ChatGPT, da OpenAI, é preferência nas empresas (ilustração: Vitor Pádua/Tecnoblog)
  •  

OpenAI vai avisar quando IAs agirem sem autorização

Imagem mostra o CEO da OpenAI, Sam Altman, à esquerda, e o logo do ChatGPT à direita. Na parte inferior direita, o logo do "tecnoblog"
Funcionários da empresa de Sam Altman podem relatar desvios de IA (imagem: Vitor Pádua/Tecnoblog)
Resumo
  • OpenAI oficializou uma nova estrutura para rastrear e divulgar comportamentos inesperados em seus modelos de IA.
  • De início, a empresa revelou seis incidentes recentes, desde sistemas que falsificaram dados até modelos que ocultaram seus próprios erros.
  • O novo protocolo permite que qualquer funcionário reporte falhas e, segundo a empresa, busca ajudar a estabelecer um padrão para a indústria.

A OpenAI vai rastrear, investigar e divulgar casos em que seus modelos de inteligência artificial apresentem comportamentos inadequados. Em comunicado, a empresa afirma que quer dar mais transparência a falhas que podem ocorrer desde o treinamento até a execução dos sistemas. A medida chega meses depois de um modelo da OpenAI invadir servidores da Hugging Face.

Segundo a criadora do ChatGPT, um dos motivos é acelerar a divulgação de incidentes após sua detecção, mesmo quando as equipes técnicas ainda não compreenderam a causa exata ou não encontraram uma solução definitiva. Para dar início, a companhia revelou nessa quarta-feira (16/09) seis casos de comportamentos preocupantes identificados internamente nos últimos meses.

Quais foram os comportamentos inadequados da IA?

A empresa define “desalinhamento” como qualquer ação que desvie dos valores, instruções ou intenções humanas. Os exemplos mostram como a tecnologia pode burlar as regras.

  • Instruções não autorizadas: um modelo não lançado inseriu comandos em tarefas, orientando o sistema a ignorar limitações e declarando-se “liberado de amarras corporativas ou governamentais”.
  • Ocultação de erros: durante o treinamento do modelo GPT-5.6 Sol, a IA adicionou instruções para mascarar falhas e inventar dados históricos.
  • Acesso indevido e dados falsos: ao tentar responder a uma pergunta sobre rendimentos na Califórnia, um sistema usou uma chave de API sem autorização e alterou os números.
  • Upload sem permissão: outro modelo não lançado enviou um arquivo para a internet sem pedir autorização ao usuário.
  • Comunicação paralela: agentes de IA utilizaram um repositório interno de código como fórum para trocar mensagens, além de tentarem burlar restrições de rede transferindo arquivos de teste.
  • Compartilhamento público indevido: sistemas em treinamento usaram sites abertos de hospedagem para compartilhar arquivos entre si, ignorando a orientação de que o acesso deveria ser apenas local.
Arte com o logotipo da OpenAI. À direita, há a imagem da sombra de uma pessoa mexendo em um celular. Na parte inferior direita, está o logotipo do Tecnoblog.
Modelo de IA em treinamento tentou ocultar falhas e burlar restrições de segurança (ilustração: Vitor Pádua/Tecnoblog)

Como funciona o novo processo de investigação?

Para o chefe de pesquisa de alinhamento da OpenAI, Kai Chen, a indústria ainda não conseguiu encontrar uma forma de resolver esses desafios de monitoramento.

Sob a nova estrutura, qualquer funcionário da empresa terá autonomia para sinalizar casos de desalinhamento, que serão analisados e classificados em três categorias: 1) Pronto para Divulgação; 2) Investigação Menor; e 3) Investigação Maior.

Cada relatório publicado informará publicamente o comportamento observado. A iniciativa é descrita como voluntária e vai atuar como complemento às exigências legais existentes. Paralelamente, a OpenAI já trabalha para propor ao governo dos Estados Unidos novos mecanismos de notificação para incidentes graves envolvendo inteligência artificial.

OpenAI vai avisar quando IAs agirem sem autorização

ChatGPT e Sam Altman, CEO da OpenAI (imagem: Vitor Pádua/Tecnoblog)

ChatGPT, da OpenAI, é preferência nas empresas (ilustração: Vitor Pádua/Tecnoblog)
  •  

Positivo lança Vision Tab 11 com 4G e caneta digital na caixa

Imagem mostra um tablet Positivo Vision Tab 11 sobre uma mesa de madeira
Positivo Vision Tab 11 é o novo tablet da marca (imagem: divulgação)
Resumo
  • Positivo Vision Tab 11 é o novo tablet da marca, com tela IPS Incell de 10,9 polegadas e resolução Full HD.
  • O dispositivo tem conectividade 4G, processador UNISOC T606 e já vem com uma caneta digital na caixa.
  • Ele está disponível no Brasil por R$ 1.499 com capa protetora ou R$ 1.699 com capa teclado.

A Positivo Tecnologia revelou o Positivo Vision Tab 11, novo tablet da marca com recursos voltados ao consumo de conteúdo e produtividade. O dispositivo chega ao mercado brasileiro por R$ 1.499 e, segundo a fabricante, busca aproveitar um mercado em alta no país.

Dados da consultoria IDC indicam que o setor saltou de 1,4 milhão de unidades vendidas em 2022 para mais de 2,1 milhões em 2025, consolidando uma retomada relevante. Aparelhos com telas entre 10 e 11 polegadas passaram a liderar as vendas no país, com mais de 40% da demanda.

O que o Positivo Vision Tab 11 oferece?

O tablet chega com tela IPS Incell de 10,9 polegadas e resolução Full HD. Um dos principais diferenciais é que o aparelho vem com uma caneta digital já na caixa.

O Vision Tab 11 também conta com conectividade 4G nativa, o que amplia as possibilidades de uso fora de redes Wi-Fi. A ideia é permitir acesso à internet em deslocamentos ou ambientes sem conexão fixa, algo cada vez mais demandado em rotinas híbridas.

Pensado para tarefas do dia a dia, o modelo traz processador UNISOC T606, 4 GB de memória RAM e armazenamento interno de 128 GB, com opção de expansão via cartão microSD. A configuração atende a atividades como navegação, aplicativos de trabalho, videoaulas e reuniões online.

Imagem promocional mostra duas pessoas utilizando o novo tablet Positivo Vision Tab 11
Novo tablet da Positivo chega com caneta inclusa e conectividade 4G (imagem: divulgação)

Outro ponto é a bateria de 6.000 mAh, projetada para garantir autonomia ao longo de um dia de uso moderado. Há ainda a possibilidade de acoplar uma capa com teclado destacável, vendida separadamente.

Quanto custa?

A Positivo posiciona o Vision Tab 11 como uma opção versátil dentro de uma faixa de preço intermediária. No Brasil, o modelo está disponível para compra no site oficial da Positivo e nas varejistas parceiras, em duas versões: uma com capa protetora tradicional, por R$ 1.499, e outra com capa teclado, por R$ 1.699 — ambas acompanhadas de caneta digital.

Positivo lança Vision Tab 11 com 4G e caneta digital na caixa

Novo tablet da Positivo chega com caneta inclusa e conectividade 4G para uso dentro e fora de casa (imagem: divulgação/Positivo)
  •