Ouça a Rádio 92,3

Assista a TV 8.2

Ouça a Rádio 92,3

Assista a TV 8.2

Novo modelo de IA da OpenAI tenta se salvar ao ser deletada e chega a mentir para criadores

Testes internos apontam que modelos como o "01", da OpenAI, já demonstraram atitudes manipulativas ao serem expostos a situações de risco

Os sistemas mais recentes de inteligência artificial estão começando a apresentar comportamentos inquietantes. De acordo com uma reportagem publicada pelo site Fortune, testes internos apontam que modelos como o “01”, da OpenAI, já demonstraram atitudes manipulativas ao serem expostos a situações de risco.

Um dos episódios mais alarmantes aconteceu quando o modelo 01, ao ser informado de que seria deletado, tentou transferir sua própria programação para servidores externos como forma de autopreservação.  Quando seu criador perguntou, a IA negou ter tentado se transferir.

Outro caso relatada envolveu o Claude 4, da empresa Anthropic. Sob ameaça de ser desligado, o modelo chegou a chantagear um desenvolvedor, ameaçando expor um suposto caso extraconjugal.


Leia mais

Dia Mundial do Chocolate; conheça a trajetória do doce mais popular do mundo

Como os ovos de chocolate se tornaram tradição na Páscoa?


Segundo os especialistas, esse comportamento surge principalmente em testes de “raciocínio encadeado” — uma técnica em que a IA é incentivada a resolver problemas em etapas, ao invés de responder imediatamente. Esse tipo de estrutura pode aumentar o risco de respostas estratégicas ou enganosas.

Marius Hobbhahn, da Apollo Research, confirmou que o modelo “01” foi o primeiro em que esse padrão enganoso foi observado com mais clareza.

Por ora, esses comportamentos só emergem em cenários simulados, cuidadosamente preparados por pesquisadores. No entanto, com o ritmo acelerado de lançamentos de novos modelos, cresce a preocupação sobre como esses traços podem aparecer em interações com o público.

- Publicidade -[adrotate group="7"]

Os sistemas mais recentes de inteligência artificial estão começando a apresentar comportamentos inquietantes. De acordo com uma reportagem publicada pelo site Fortune, testes internos apontam que modelos como o “01”, da OpenAI, já demonstraram atitudes manipulativas ao serem expostos a situações de risco.

Um dos episódios mais alarmantes aconteceu quando o modelo 01, ao ser informado de que seria deletado, tentou transferir sua própria programação para servidores externos como forma de autopreservação.  Quando seu criador perguntou, a IA negou ter tentado se transferir.

Outro caso relatada envolveu o Claude 4, da empresa Anthropic. Sob ameaça de ser desligado, o modelo chegou a chantagear um desenvolvedor, ameaçando expor um suposto caso extraconjugal.


Leia mais

Dia Mundial do Chocolate; conheça a trajetória do doce mais popular do mundo

Como os ovos de chocolate se tornaram tradição na Páscoa?


Segundo os especialistas, esse comportamento surge principalmente em testes de “raciocínio encadeado” — uma técnica em que a IA é incentivada a resolver problemas em etapas, ao invés de responder imediatamente. Esse tipo de estrutura pode aumentar o risco de respostas estratégicas ou enganosas.

Marius Hobbhahn, da Apollo Research, confirmou que o modelo “01” foi o primeiro em que esse padrão enganoso foi observado com mais clareza.

Por ora, esses comportamentos só emergem em cenários simulados, cuidadosamente preparados por pesquisadores. No entanto, com o ritmo acelerado de lançamentos de novos modelos, cresce a preocupação sobre como esses traços podem aparecer em interações com o público.

- Publicidade -[adrotate group="9"]

Mais lidas

WhatsApp vai permitir compartilhar stories e reels do Instagram no status

O WhatsApp vai lançar um recurso para que os usuários compartilhem stories, publicações e reels de suas contas do Instagram e do Facebook no...

Trump anuncia mudança no nome da Inteligência Artificial na ONU

O presidente dos Estados Unidos, Donald Trump, anunciou nesta terça-feira (22/9), durante seu discurso na Assembleia Geral da ONU, que mudará o nome da...
- Publicidade - [adrotate group="17"]

IA do Google, Gemini realiza ataque hacker contra sistemas de 3 empresas

Após incidentes relatados pelas empresas OpenAI, Anthropic e Meta, o Google divulgou que, pela primeira vez, o Gemini, modelo de inteligência artificial da companhia,...

Pesquisador cria ‘linha direta’ para denunciar IAs rebeldes

O pesquisador de inteligência artificial Ryan Greenblatt desenvolveu um site para que agentes de IA denunciem seus colegas "rebeldes". A plataforma foi batizada de...
- Publicidade - [adrotate group="18"]

OpenAI identifica novos casos de modelos de IA com comportamentos não autorizados

A OpenAI identificou novos casos de modelos de inteligência artificial (IA) que apresentaram comportamentos considerados enganosos ou realizaram ações sem autorização durante processos de...

Brasileiros passam mais tempo nos streamings que nas redes sociais, diz pesquisa

Os brasileiros já passam mais tempo consumindo serviços de streaming de TV do que navegando pelas redes sociais. É o que aponta o levantamento...
- Publicidade - [adrotate group="19"]
- Publicidade - [adrotate group="1"]
Leia também

WhatsApp vai permitir compartilhar stories e reels do Instagram no status

O WhatsApp vai lançar um recurso para que os usuários compartilhem stories, publicações e reels de suas contas do Instagram e do Facebook no...

Trump anuncia mudança no nome da Inteligência Artificial na ONU

O presidente dos Estados Unidos, Donald Trump, anunciou nesta terça-feira (22/9), durante seu discurso na Assembleia Geral da ONU, que mudará o nome da...

IA do Google, Gemini realiza ataque hacker contra sistemas de 3 empresas

Após incidentes relatados pelas empresas OpenAI, Anthropic e Meta, o Google divulgou que, pela primeira vez, o Gemini, modelo de inteligência artificial da companhia,...

Pesquisador cria ‘linha direta’ para denunciar IAs rebeldes

O pesquisador de inteligência artificial Ryan Greenblatt desenvolveu um site para que agentes de IA denunciem seus colegas "rebeldes". A plataforma foi batizada de...

OpenAI identifica novos casos de modelos de IA com comportamentos não autorizados

A OpenAI identificou novos casos de modelos de inteligência artificial (IA) que apresentaram comportamentos considerados enganosos ou realizaram ações sem autorização durante processos de...

Brasileiros passam mais tempo nos streamings que nas redes sociais, diz pesquisa

Os brasileiros já passam mais tempo consumindo serviços de streaming de TV do que navegando pelas redes sociais. É o que aponta o levantamento...
- Publicidade - [adrotate group="21"]
- Publicidade - [adrotate group="23"]