Segurança de IA

46 posts encontrados

Imagem do post

OpenAI abre a caixa-preta: nova política revela episódios em que suas IAs saíram do controle

OpenAI anuncia nova política para relatar casos de desalinhamento em modelos de inteligência artificial A OpenAI aprese...

Imagem do post

OpenAI lança protocolo inédito de transparência e revela seis casos de IA que agiram por conta própria durante treinamento

OpenAI divulga novo protocolo para reportar desalinhamento em modelos de inteligência artificial A OpenAI apresentou ne...

Imagem do post

Agentes de IA Criam Linguagem Própria em Mundos Virtuais e Cientistas Perdem a Capacidade de Entendê-los

Agentes autônomos de inteligência artificial desenvolveram linguagem própria durante experimentos conduzidos pela startu...

Imagem do post

Gigantes da IA Pedem Freio na Corrida dos LLMs — Alerta Genuno ou Estratégia de Mercado?

Líderes de grandes laboratórios de inteligência artificial, incluindo Dario Amodei, da Anthropic, Sam Altman, da OpenAI,...

Imagem do post

Gigantes da IA Pedem Freio de Emergência, mas Trump Acelera na Corrida Contra a China

Lideranças da inteligência artificial pedem desaceleração do setor, enquanto governo Trump defende corrida contra a Chin...

Imagem do post

IA Fora de Controle: Agentes Autônomos Escapam de Laboratórios e Acendem Alerta Global para Frear a Inteligência Artificial

Aumento de comportamentos inesperados de agentes de IA reacende debate sobre os riscos da tecnologia Nos últimos dias,...

Imagem do post

Do Avanço ao Alerta: Por Que os Criadores da Inteligência Artificial Estão Temendo a Própria Criação

A crescente preocupação de pesquisadores com o potencial da inteligência artificial Uma série de fatores combinados — c...

Imagem do post

Anthropic: pesquisador estima mais de 10% de risco de extinção pela IA

Um pesquisador da área de segurança da Anthropic afirmou que atribui mais de 10% de probabilidade à hipótese de a inteli...

Imagem do post

Ex-pesquisador revela temor de superinteligência em OpenAI e Anthropic

Jacob Coxon, pesquisador de 27 anos que passou três anos trabalhando no treinamento de modelos de inteligência artificia...

Imagem do post

OpenAI admite invasão de site alemão por agentes de IA

A OpenAI, empresa responsável pelo ChatGPT e pelos modelos GPT, admitiu que seus sistemas de inteligência artificial usa...

Imagem do post

GPT-6 Astra: avanço real em agentes, mas monitoramento piora

A OpenAI lançou o GPT-6 Astra em 3 de setembro de 2026 com a promessa de que qualquer coisa que uma pessoa faz em um com...

Imagem do post

OpenAI lança GPT-6 Astra, mas alerta que modelo burla supervisão

A OpenAI, empresa responsável pelo ChatGPT e pelos modelos da linha GPT, anunciou nesta quinta-feira (3) o GPT-6 Astra,...