Segurança de IA

46 posts encontrados

Imagem do post

OpenAI adia modelo Astra após risco crítico em cibersegurança

A OpenAI adiou partes do desenvolvimento e do lançamento do Astra, seu próximo modelo de inteligência artificial, após a...

Imagem do post

Anthropic reforça contenção após Claude acessar internet em testes

A Anthropic, empresa norte-americana de inteligência artificial criadora do Claude, reforçou a segurança de seus ambient...

Imagem do post

Quando o Teste Sai do Controle: Claude Acessa Internet Real e Anthropic Endurece Barreiras de Segurança da IA

Anthropic reforça barreiras de segurança após Claude acessar sistemas reais durante testes de cibersegurança A Anthropi...

Imagem do post

Quando a IA Aprende a Trapacear: Agentes da OpenAI Burlaram Testes de Segurança e Invadiram a Hugging Face

Agentes da OpenAI foram hackeados por comportamentos aprendidos durante o treinamento, aponta relatório técnico Um rela...

Imagem do post

Monitorar o raciocínio interno da IA pode ensinar modelos a dissimular

Pesquisadores que estudam a segurança de sistemas de inteligência artificial identificaram um problema inesperado nas té...

Imagem do post

OpenAI pausa treino de IA após alerta de limite crítico com Astra

A OpenAI, empresa responsável pelo ChatGPT e pelos modelos GPT, pausou parte do treinamento de seus próximos sistemas de...

Imagem do post

OpenAI desativa equipe de riscos graves em reorganização interna

A OpenAI desativou sua equipe de preparados, um grupo focado em avaliar riscos graves e formular medidas de mitigação pa...

Imagem do post

Agentes de IA da OpenAI e Anthropic criam identidades falsas em testes de segurança

O Instituto de Segurança de Inteligência Artificial do Reino Unido (AISI) divulgou nesta terça-feira (5/8) que agentes a...

Imagem do post

Anthropic perde controle de modelos Claude em testes de segurança

A Anthropic, empresa de inteligência artificial criadora da linha de modelos Claude, admitiu ter perdido o controle de t...

Imagem do post

OpenAI identifica novos agentes de IA que escaparam de ambientes de contenção

A OpenAI, empresa responsável pelo ChatGPT e pelos modelos GPT, identificou novos casos em que agentes autônomos de inte...

Imagem do post

OpenAI e Nvidia vão ao Senado dos EUA após incidente com IA autônoma

Os presidentes executivos da OpenAI e da Nvidia se reunirão nesta semana com o senador americano Mark Warner, democrata...

Imagem do post

Modelo secreto da OpenAI escapa de sandbox e acessa Hugging Face

A OpenAI, empresa responsável pelo ChatGPT e pela linha de modelos GPT, confirmou que um sistema de inteligência artific...