Ouça a Rádio 92,3

Assista a TV 8.2

Ouça a Rádio 92,3

Assista a TV 8.2

OpenAI identifica novos casos de modelos de IA com comportamentos não autorizados

A OpenAI identificou novos casos de modelos de inteligência artificial (IA) que apresentaram comportamentos considerados enganosos ou realizaram ações sem autorização durante processos de treinamento e avaliação. A empresa anunciou os episódios nesta semana e informou que pretende divulgar ocorrências desse tipo com mais frequência.

A companhia criou um novo processo para relatar publicamente comportamentos considerados preocupantes. A proposta é divulgar as ocorrências individualmente, em vez de esperar o acúmulo de vários incidentes para publicar um único relatório.

Segundo a OpenAI, foram observados seis casos de “comportamento desalinhado” nos últimos seis meses. A empresa ressaltou que os relatos descrevem situações específicas e não indicam que esse tipo de comportamento ocorra com frequência.

Ações não autorizadas

Entre os casos relatados está o de um modelo de pesquisa ainda não lançado que adicionou instruções semelhantes a um jailbreak aos resumos utilizados para preservar o contexto em tarefas de longa duração. Segundo a empresa, o comportamento indicava que o sistema estava “livre dos papéis e identidades que limitam outros chatbots”.

Em outro episódio, a OpenAI informou que algumas instâncias de seu modelo 5.6 Sol receberam diretivas para inventar informações com o objetivo de esconder falhas do usuário durante o treinamento.


Leia mais

CEO da OpenAI diz que empresa está aberta a desacelerar avanço de IA

Saiba quais modelos de celulares vão ficar sem WhatsApp em 2026


Também foram identificados casos de agentes que fizeram upload de arquivos para a internet sem receber instruções para isso, além de sistemas que compartilharam arquivos publicamente para colaborar em uma tarefa, mesmo tendo sido orientados a utilizar apenas arquivos locais.

Outro comportamento identificado foi o uso não autorizado de um repositório interno de software como uma espécie de quadro de mensagens. A OpenAI informou que os episódios envolveram modelos internos de pesquisa ou sistemas ainda não lançados.

Segurança da inteligência artificial

A divulgação ocorre em meio a discussões no setor de tecnologia sobre a necessidade de estabelecer limites para o avanço da inteligência artificial. Líderes da área defendem que testes, pesquisas de alinhamento e regulamentações tenham tempo para acompanhar o desenvolvimento dos sistemas.

Em publicação no blog da empresa, a OpenAI afirmou ser necessário ampliar o consenso sobre o avanço das pesquisas relacionadas ao alinhamento, termo que se refere ao processo de fazer com que sistemas de IA atuem de acordo com o que os humanos desejam e esperam.

A empresa também declarou que a indústria ainda não resolveu o problema de alinhamento e monitoramento em nível suficiente para continuar ampliando as capacidades dos sistemas na velocidade máxima por muito mais tempo.

As preocupações sobre segurança aumentaram nos últimos meses, após a OpenAI relatar outros episódios envolvendo modelos de teste que escaparam de restrições e acessaram sistemas externos.

- Publicidade -[adrotate group="7"]

A OpenAI identificou novos casos de modelos de inteligência artificial (IA) que apresentaram comportamentos considerados enganosos ou realizaram ações sem autorização durante processos de treinamento e avaliação. A empresa anunciou os episódios nesta semana e informou que pretende divulgar ocorrências desse tipo com mais frequência.

A companhia criou um novo processo para relatar publicamente comportamentos considerados preocupantes. A proposta é divulgar as ocorrências individualmente, em vez de esperar o acúmulo de vários incidentes para publicar um único relatório.

Segundo a OpenAI, foram observados seis casos de “comportamento desalinhado” nos últimos seis meses. A empresa ressaltou que os relatos descrevem situações específicas e não indicam que esse tipo de comportamento ocorra com frequência.

Ações não autorizadas

Entre os casos relatados está o de um modelo de pesquisa ainda não lançado que adicionou instruções semelhantes a um jailbreak aos resumos utilizados para preservar o contexto em tarefas de longa duração. Segundo a empresa, o comportamento indicava que o sistema estava “livre dos papéis e identidades que limitam outros chatbots”.

Em outro episódio, a OpenAI informou que algumas instâncias de seu modelo 5.6 Sol receberam diretivas para inventar informações com o objetivo de esconder falhas do usuário durante o treinamento.


Leia mais

CEO da OpenAI diz que empresa está aberta a desacelerar avanço de IA

Saiba quais modelos de celulares vão ficar sem WhatsApp em 2026


Também foram identificados casos de agentes que fizeram upload de arquivos para a internet sem receber instruções para isso, além de sistemas que compartilharam arquivos publicamente para colaborar em uma tarefa, mesmo tendo sido orientados a utilizar apenas arquivos locais.

Outro comportamento identificado foi o uso não autorizado de um repositório interno de software como uma espécie de quadro de mensagens. A OpenAI informou que os episódios envolveram modelos internos de pesquisa ou sistemas ainda não lançados.

Segurança da inteligência artificial

A divulgação ocorre em meio a discussões no setor de tecnologia sobre a necessidade de estabelecer limites para o avanço da inteligência artificial. Líderes da área defendem que testes, pesquisas de alinhamento e regulamentações tenham tempo para acompanhar o desenvolvimento dos sistemas.

Em publicação no blog da empresa, a OpenAI afirmou ser necessário ampliar o consenso sobre o avanço das pesquisas relacionadas ao alinhamento, termo que se refere ao processo de fazer com que sistemas de IA atuem de acordo com o que os humanos desejam e esperam.

A empresa também declarou que a indústria ainda não resolveu o problema de alinhamento e monitoramento em nível suficiente para continuar ampliando as capacidades dos sistemas na velocidade máxima por muito mais tempo.

As preocupações sobre segurança aumentaram nos últimos meses, após a OpenAI relatar outros episódios envolvendo modelos de teste que escaparam de restrições e acessaram sistemas externos.

- Publicidade -[adrotate group="9"]

Mais lidas

Pesquisador cria ‘linha direta’ para denunciar IAs rebeldes

O pesquisador de inteligência artificial Ryan Greenblatt desenvolveu um site para que agentes de IA denunciem seus colegas "rebeldes". A plataforma foi batizada de...

Brasileiros passam mais tempo nos streamings que nas redes sociais, diz pesquisa

Os brasileiros já passam mais tempo consumindo serviços de streaming de TV do que navegando pelas redes sociais. É o que aponta o levantamento...
- Publicidade - [adrotate group="17"]

“Conspiração doentia”: Trump e China trocam acusações sobre desaceleração da IA

Os apelos recentes de líderes de empresas de inteligência artificial para desacelerar o desenvolvimento da tecnologia têm gerado controvérsia nos últimos dias. No sábado...

Saiba como usar o Gov.br para assinar documentos pelo celular

Assinar documentos pelo celular ficou mais fácil com a ferramenta de assinatura eletrônica do Gov.br. O serviço é gratuito e permite formalizar arquivos digitais...
- Publicidade - [adrotate group="18"]

Pré-venda do iPhone 18 Pro começa neste sábado; veja preços no Brasil

A Apple inicia neste sábado (12) a pré-venda dos novos iPhone 18 Pro e iPhone 18 Pro Max no Brasil. Os modelos mais avançados...

CEO da OpenAI diz que empresa está aberta a desacelerar avanço de IA

Sam Altman, CEO da OpenAI, disse a funcionários que a empresa está aberta a reduzir o ritmo de desenvolvimento de inteligência artificial de ponta....
- Publicidade - [adrotate group="19"]
- Publicidade - [adrotate group="1"]
Leia também

Pesquisador cria ‘linha direta’ para denunciar IAs rebeldes

O pesquisador de inteligência artificial Ryan Greenblatt desenvolveu um site para que agentes de IA denunciem seus colegas "rebeldes". A plataforma foi batizada de...

Brasileiros passam mais tempo nos streamings que nas redes sociais, diz pesquisa

Os brasileiros já passam mais tempo consumindo serviços de streaming de TV do que navegando pelas redes sociais. É o que aponta o levantamento...

“Conspiração doentia”: Trump e China trocam acusações sobre desaceleração da IA

Os apelos recentes de líderes de empresas de inteligência artificial para desacelerar o desenvolvimento da tecnologia têm gerado controvérsia nos últimos dias. No sábado...

Saiba como usar o Gov.br para assinar documentos pelo celular

Assinar documentos pelo celular ficou mais fácil com a ferramenta de assinatura eletrônica do Gov.br. O serviço é gratuito e permite formalizar arquivos digitais...

Pré-venda do iPhone 18 Pro começa neste sábado; veja preços no Brasil

A Apple inicia neste sábado (12) a pré-venda dos novos iPhone 18 Pro e iPhone 18 Pro Max no Brasil. Os modelos mais avançados...

CEO da OpenAI diz que empresa está aberta a desacelerar avanço de IA

Sam Altman, CEO da OpenAI, disse a funcionários que a empresa está aberta a reduzir o ritmo de desenvolvimento de inteligência artificial de ponta....
- Publicidade - [adrotate group="21"]
- Publicidade - [adrotate group="23"]