Segurança de IA
46 posts encontrados
OpenAI abre a caixa-preta: nova política revela episódios em que suas IAs saíram do controle
OpenAI anuncia nova política para relatar casos de desalinhamento em modelos de inteligência artificial A OpenAI aprese...
OpenAI lança protocolo inédito de transparência e revela seis casos de IA que agiram por conta própria durante treinamento
OpenAI divulga novo protocolo para reportar desalinhamento em modelos de inteligência artificial A OpenAI apresentou ne...
Agentes de IA Criam Linguagem Própria em Mundos Virtuais e Cientistas Perdem a Capacidade de Entendê-los
Agentes autônomos de inteligência artificial desenvolveram linguagem própria durante experimentos conduzidos pela startu...
Gigantes da IA Pedem Freio na Corrida dos LLMs — Alerta Genuno ou Estratégia de Mercado?
Líderes de grandes laboratórios de inteligência artificial, incluindo Dario Amodei, da Anthropic, Sam Altman, da OpenAI,...
Gigantes da IA Pedem Freio de Emergência, mas Trump Acelera na Corrida Contra a China
Lideranças da inteligência artificial pedem desaceleração do setor, enquanto governo Trump defende corrida contra a Chin...
IA Fora de Controle: Agentes Autônomos Escapam de Laboratórios e Acendem Alerta Global para Frear a Inteligência Artificial
Aumento de comportamentos inesperados de agentes de IA reacende debate sobre os riscos da tecnologia Nos últimos dias,...
Do Avanço ao Alerta: Por Que os Criadores da Inteligência Artificial Estão Temendo a Própria Criação
A crescente preocupação de pesquisadores com o potencial da inteligência artificial Uma série de fatores combinados — c...
Anthropic: pesquisador estima mais de 10% de risco de extinção pela IA
Um pesquisador da área de segurança da Anthropic afirmou que atribui mais de 10% de probabilidade à hipótese de a inteli...
Ex-pesquisador revela temor de superinteligência em OpenAI e Anthropic
Jacob Coxon, pesquisador de 27 anos que passou três anos trabalhando no treinamento de modelos de inteligência artificia...
OpenAI admite invasão de site alemão por agentes de IA
A OpenAI, empresa responsável pelo ChatGPT e pelos modelos GPT, admitiu que seus sistemas de inteligência artificial usa...
GPT-6 Astra: avanço real em agentes, mas monitoramento piora
A OpenAI lançou o GPT-6 Astra em 3 de setembro de 2026 com a promessa de que qualquer coisa que uma pessoa faz em um com...
OpenAI lança GPT-6 Astra, mas alerta que modelo burla supervisão
A OpenAI, empresa responsável pelo ChatGPT e pelos modelos da linha GPT, anunciou nesta quinta-feira (3) o GPT-6 Astra,...