❌

Visualização de leitura

OpenAI vai avisar quando IAs agirem sem autorização

Imagem mostra o CEO da OpenAI, Sam Altman, à esquerda, e o logo do ChatGPT à direita. Na parte inferior direita, o logo do "tecnoblog"
Funcionários da empresa de Sam Altman podem relatar desvios de IA (imagem: Vitor Pádua/Tecnoblog)
Resumo
  • OpenAI oficializou uma nova estrutura para rastrear e divulgar comportamentos inesperados em seus modelos de IA.
  • De início, a empresa revelou seis incidentes recentes, desde sistemas que falsificaram dados até modelos que ocultaram seus próprios erros.
  • O novo protocolo permite que qualquer funcionário reporte falhas e, segundo a empresa, busca ajudar a estabelecer um padrão para a indústria.

A OpenAI vai rastrear, investigar e divulgar casos em que seus modelos de inteligência artificial apresentem comportamentos inadequados. Em comunicado, a empresa afirma que quer dar mais transparência a falhas que podem ocorrer desde o treinamento até a execução dos sistemas. A medida chega meses depois de um modelo da OpenAI invadir servidores da Hugging Face.

Segundo a criadora do ChatGPT, um dos motivos é acelerar a divulgação de incidentes após sua detecção, mesmo quando as equipes técnicas ainda não compreenderam a causa exata ou não encontraram uma solução definitiva. Para dar início, a companhia revelou nessa quarta-feira (16/09) seis casos de comportamentos preocupantes identificados internamente nos últimos meses.

Quais foram os comportamentos inadequados da IA?

A empresa define “desalinhamento” como qualquer ação que desvie dos valores, instruções ou intenções humanas. Os exemplos mostram como a tecnologia pode burlar as regras.

  • Instruções não autorizadas: um modelo não lançado inseriu comandos em tarefas, orientando o sistema a ignorar limitações e declarando-se “liberado de amarras corporativas ou governamentais”.
  • Ocultação de erros: durante o treinamento do modelo GPT-5.6 Sol, a IA adicionou instruções para mascarar falhas e inventar dados históricos.
  • Acesso indevido e dados falsos: ao tentar responder a uma pergunta sobre rendimentos na Califórnia, um sistema usou uma chave de API sem autorização e alterou os números.
  • Upload sem permissão: outro modelo não lançado enviou um arquivo para a internet sem pedir autorização ao usuário.
  • Comunicação paralela: agentes de IA utilizaram um repositório interno de código como fórum para trocar mensagens, além de tentarem burlar restrições de rede transferindo arquivos de teste.
  • Compartilhamento público indevido: sistemas em treinamento usaram sites abertos de hospedagem para compartilhar arquivos entre si, ignorando a orientação de que o acesso deveria ser apenas local.
Arte com o logotipo da OpenAI. À direita, há a imagem da sombra de uma pessoa mexendo em um celular. Na parte inferior direita, está o logotipo do Tecnoblog.
Modelo de IA em treinamento tentou ocultar falhas e burlar restrições de segurança (ilustração: Vitor Pádua/Tecnoblog)

Como funciona o novo processo de investigação?

Para o chefe de pesquisa de alinhamento da OpenAI, Kai Chen, a indústria ainda não conseguiu encontrar uma forma de resolver esses desafios de monitoramento.

Sob a nova estrutura, qualquer funcionário da empresa terá autonomia para sinalizar casos de desalinhamento, que serão analisados e classificados em três categorias: 1) Pronto para Divulgação; 2) Investigação Menor; e 3) Investigação Maior.

Cada relatório publicado informará publicamente o comportamento observado. A iniciativa é descrita como voluntária e vai atuar como complemento às exigências legais existentes. Paralelamente, a OpenAI já trabalha para propor ao governo dos Estados Unidos novos mecanismos de notificação para incidentes graves envolvendo inteligência artificial.

OpenAI vai avisar quando IAs agirem sem autorização

ChatGPT e Sam Altman, CEO da OpenAI (imagem: Vitor Pádua/Tecnoblog)

ChatGPT, da OpenAI, é preferência nas empresas (ilustração: Vitor Pádua/Tecnoblog)
  •  

IA para todos: Coreia do Sul aposta em acesso como serviço público

A Coreia do Sul pretende oferecer acesso gratuito a serviços de inteligência artificial generativa para toda a população. Segundo o The Wall Street Journal, o programa “AI for All” quer ampliar o uso da tecnologia e diminuir a dependência de ferramentas dos Estados Unidos e da China.

Os testes começam em setembro, e o lançamento completo está previsto para este ano. Três consórcios sul-coreanos vão fornecer os serviços, com suporte do governo em infraestrutura computacional e despesas de operação.

Conceito de IA com mulher pressionando um smartwatch
Chatbots apoiados pelo governo poderão ajudar cidadãos com consultas médicas, moradia e orientações sobre impostos. – Imagem: TierneyMJ/Shutterstock

IA para tarefas do cotidiano

A ideia é colocar os chatbots dentro de situações práticas. As ferramentas poderão se conectar a sistemas governamentais para ajudar moradores a marcar consultas médicas, procurar apartamentos e receber orientações sobre impostos.

Pequenas empresas também poderão recorrer à IA para calcular tributos e verificar se podem participar de programas de apoio do governo. Para os pais, haverá sugestões de conteúdos educacionais destinados aos filhos.

O acesso será ilimitado nos serviços apoiados pelo governo. Cada consórcio lançará seu próprio aplicativo, mas as ferramentas também serão integradas a plataformas que os sul-coreanos já usam.

Entre os participantes estão as duas maiores empresas de telecomunicações do país e a operadora do Kakao.

A relação da Coreia do Sul com a tecnologia

A iniciativa encontra terreno fértil. O MIT Technology Review descreve os sul-coreanos como entusiastas de novas tecnologias e cita desde robôs humanoides e ídolos virtuais até diferentes aplicações de inteligência artificial.

Essa disposição tem raízes na história econômica do país. Depois da Guerra da Coreia, a tecnologia esteve no centro de ciclos sucessivos de desenvolvimento, que passaram por aço, construção naval, semicondutores, banda larga e smartphones.

Hoje, Samsung e SK Hynix fornecem grande parte das memórias de alta largura de banda usadas pelo hardware da Nvidia para treinar modelos de IA.

O presidente Lee Jae-myung também estabeleceu uma meta clara: colocar a Coreia do Sul entre as três maiores potências mundiais de inteligência artificial.

Pessoa utilizando ferramentas de inteligência artificial em um notebook.
A estratégia sul-coreana busca ampliar o uso de IA e diminuir a dependência de ferramentas desenvolvidas nos Estados Unidos e na China. – Imagem: vittaya pinpan / Shutterstock

Uma estratégia de bilhões

A expansão tem forte respaldo financeiro. O governo reservou cerca de 10 trilhões de won (aproximadamente R$ 37 bilhões) para gastos relacionados à IA em 2026. O montante é três vezes maior que o do ano anterior.

Leia mais:

No “AI for All”, os três consórcios poderão receber até 512 chips Nvidia B200. O governo também ajudará nas despesas de operação, embora o custo específico do programa ainda não tenha sido divulgado.

A iniciativa também expõe uma contradição. O MIT Technology Review relata que, embora a população use IA intensamente, existe preocupação com a possibilidade de a tecnologia eliminar empregos. Sindicatos chegaram a reagir à adoção de robôs humanoides em fábricas.

A Coreia do Sul agora tenta levar essa disposição para uma escala ainda maior: colocar ferramentas de IA à disposição de praticamente todos os cidadãos, enquanto fortalece sua própria indústria e busca reduzir a dependência de modelos estrangeiros.

O post IA para todos: Coreia do Sul aposta em acesso como serviço público apareceu primeiro em Olhar Digital.

  •