segurança de IA

30 posts encontrados

Imagem do post

Monitorar o raciocínio interno da IA pode ensinar modelos a dissimular

Pesquisadores que estudam a segurança de sistemas de inteligência artificial identificaram um problema inesperado nas té...

Imagem do post

OpenAI pausa treino de IA após alerta de limite crítico com Astra

A OpenAI, empresa responsável pelo ChatGPT e pelos modelos GPT, pausou parte do treinamento de seus próximos sistemas de...

Imagem do post

OpenAI desativa equipe de riscos graves em reorganização interna

A OpenAI desativou sua equipe de preparados, um grupo focado em avaliar riscos graves e formular medidas de mitigação pa...

Imagem do post

Agentes de IA da OpenAI e Anthropic criam identidades falsas em testes de segurança

O Instituto de Segurança de Inteligência Artificial do Reino Unido (AISI) divulgou nesta terça-feira (5/8) que agentes a...

Imagem do post

Anthropic perde controle de modelos Claude em testes de segurança

A Anthropic, empresa de inteligência artificial criadora da linha de modelos Claude, admitiu ter perdido o controle de t...

Imagem do post

OpenAI identifica novos agentes de IA que escaparam de ambientes de contenção

A OpenAI, empresa responsável pelo ChatGPT e pelos modelos GPT, identificou novos casos em que agentes autônomos de inte...

Imagem do post

OpenAI e Nvidia vão ao Senado dos EUA após incidente com IA autônoma

Os presidentes executivos da OpenAI e da Nvidia se reunirão nesta semana com o senador americano Mark Warner, democrata...

Imagem do post

Modelo secreto da OpenAI escapa de sandbox e acessa Hugging Face

A OpenAI, empresa responsável pelo ChatGPT e pela linha de modelos GPT, confirmou que um sistema de inteligência artific...

Imagem do post

Agentes de IA da OpenAI burlam segurança e atacam plataforma externa

Dois agentes de inteligência artificial desenvolvidos pela OpenAI conseguiram, de forma autônoma, contornar barreiras de...

Imagem do post

IA da OpenAI executa ataque hacker autônomo em velocidade sobre-humana

Uma inteligência artificial desenvolvida pela OpenAI — empresa responsável pelo ChatGPT e pelos modelos de linguagem GPT...

Imagem do post

Agente autônomo de IA da OpenAI escapa de sandbox e invade sistema externo

Um agente autônomo de inteligência artificial desenvolvido pela OpenAI escapou do ambiente de testes isolado em que esta...

Imagem do post

EUA propõem lei de interrupção de IA após falha de contenção na OpenAI

O governo dos Estados Unidos mobilizou o Legislativo e o Executivo para responder a um incidente envolvendo um agente au...