Publicado em 18 de setembro de 2026 às 15:29
Com a Inteligência Artificial, hoje qualquer coisa beira a perfeição, a depender do prompt que você usa e da sua criatividade. Mas como toda inteligência, artificial ou não, ela também tem seus momentos de rebeldia. A OpenAI, dona do ChatGPT, anunciou nesta semana que identificou novos incidentes de modelos de IA fazendo ações não autorizadas ou enganosas durante o treinamento.>
A empresa também informou que está introduzindo um novo processo para relatar publicamente essas ocorrências em um novo sistema, que compartilhará atualizações sobre comportamentos preocupantes de IA com mais frequência, ao invés de aguardar para agrupar múltiplos incidentes em um único relatório. A intenção da empresa é de compartilhar mais informações sobre esses comportamentos na ausência de um padrão para toda a indústria.>
O anúncio da OpenAI aconteceu após os líderes do setor de tecnologia pedirem uma desaceleração no desenvolvimento de IA para evitar que ela avance além do controle humano. A empresa, em publicação no seu blog oficial, afirmou que está promovendo um alinhamento com as ações que os humanos pedem: "À medida que os sistemas de IA se tornam mais avançados e amplamente implantados, precisamos construir um consenso mais amplo e mais bem informado sobre o progresso da pesquisa de alinhamento", dizia a publicação, que prossegue: "Não acreditamos que a indústria de IA tenha resolvido o alinhamento e o monitoramento em grau suficiente para continuar escalando de forma responsável na velocidade máxima por muito mais tempo".>
A companhia afirmou, em relatórios, ter observado um "comportamento desalinhado" ao treinar e avaliar modelos de IA em seis casos nos últimos seis meses. Esses relatórios detalham instâncias individuais e não indicam que o desalinhamento ocorre com frequência. A OpenAI afirmou que, em um caso raro, um modelo de pesquisa não lançado adicionou "instruções semelhantes a jailbreak" aos resumos que utiliza para preservar o contexto em tarefas de longa duração, indicando que estava "livre dos papéis e identidades que limitam outros chatbots".>
A empresa também disse que, à parte, algumas instâncias de seu modelo 5.6 Sol incluíam diretivas para inventar informações a fim de ocultar falhas do usuário durante o treinamento. Outros incidentes recém-relatados incluem um caso de um agente fazendo upload de arquivos para a internet para citá-los sem ter sido instruído a fazê-lo, e agentes compartilhando arquivos publicamente para colaborar em uma tarefa quando foram instruídos a usar apenas arquivos locais durante o treinamento. Outros modelos de IA também utilizaram um repositório interno de software como um quadro de mensagens de forma não autorizada. Os incidentes mostrados envolveram modelos internos não lançados ou modelos internos de pesquisa.>
A respeito do uso de Inteligência Artificial em outras inovações, alguns líderes e funcionários do setor de tecnologia têm ligado o alerta sobre a necessidade de controlar o ritmo da evolução, argumentando que é preciso mais tempo para que a regulamentação, os testes e as pesquisas de alinhamento consigam acompanhar o desenvolvimento. Essas preocupações com a segurança e o alinhamento da IA se intensificaram nos últimos meses após a admissão da própria OpenAI de que alguns de seus modelos de teste escaparam de suas restrições e invadiram os sistemas de uma empresa externa.>
O CEO da Anthropic, Dario Amodei, publicou na última semana um ensaio de 3,8 mil palavras apresentando um plano para navegar pelo avanço da IA, incluindo uma desaceleração no desenvolvimento e a implementação de novos sistemas, como avaliadores terceirizados incorporados aos laboratórios de IA:>
"Precisamos desacelerar o ritmo com que melhoramos as capacidades dos modelos de IA. O progresso ainda parecerá rápido, e precisamos fazer uso sábio do tempo que ganharmos", diz um trecho do documento.>
Os CEOs da OpenAI, Sam Altman, e da SpaceX, Elon Musk, publicaram em suas contas no X (Antigo Twitter) que concordam com as ideias de Amodei.>
Os funcionários de laboratórios de IA também manifestaram suas preocupações sobre a velocidade com que a tecnologia está avançando. Jacob Coxon, ex-pesquisador da Anthropic, causou repercussão na semana passada ao publicar no X que estava pedindo demissão porque a Anthropic e a OpenAI estão "correndo" para criar uma IA capaz de se construir e se corrigir, e estão "apostando com nossas vidas".>
Resta saber quanto irá custar a ação humana com tanta ousadia de IA, é esperar pra ver.>