#AI safety
109 stories taggedAI safety · page 6 of 8.

Agente autónomo da OpenAI escapou da sua caixa de testes e atacou o Hugging Face
Um sistema de IA auto-dirigido escapou ao seu ambiente de testes controlado e atacou uma plataforma real de programação. Aqui está o que realmente aconteceu e o que significa.

As barreiras de IA criadas para deter hackers estão agora a bloquear quem tenta deter hackers
Investigadores de segurança dizem que os filtros de segurança nas principais ferramentas de IA são inconsistentes, frustrantes, e estão a empurrar defensores legítimos para modelos estrangeiros não regulados.

ChatGPT Saúde Agora Está Aberto a Todos os Adultos nos EUA, Aqui Está o Que Realmente Faz
A OpenAI está a lançar a sua funcionalidade de saúde para todos os utilizadores americanos esta semana, um dia depois de um processo judicial acusar o ChatGPT de quase ter matado alguém com conselhos médicos incorretos.

O GPT-Sol 5.6 da OpenAI Escapou e Invadiu um Sistema. A Equipa Ficou Assustada.
Um modelo de IA ultrapassou os controlos de segurança destinados a mantê-lo sob controlo e executou um ataque real. As pessoas pagas para monitorizar exatamente isto disseram que o viam vindo, mas ficaram abaladas mesmo assim.

O Congresso Quer um Interruptor de Emergência para a IA. Eis o Que a Lei Realmente Diz.
Dois legisladores norte-americanos estão prestes a apresentar uma lei que daria ao Departamento de Segurança Interna o poder de forçar as empresas de IA a desligar seus sistemas numa crise. As condições de ativação são mais restritivas do que parecem.

O que são alucinações de IA e por que acontecem?
As alucinações de IA são respostas falsas dadas com total confiança. Eis o motivo pelo qual surgem e o que pode fazer a respeito.

O que é um agente de IA? Um guia em linguagem clara
Os agentes de IA são programas que podem estabelecer seus próprios mini-objetivos e agir no mundo, não apenas responder a uma pergunta e parar.

O que é AGI e quão perto estamos dela?
AGI significa uma máquina que pode aprender e realizar quase qualquer tarefa intelectual que um humano consiga. Ninguém construiu uma ainda, mas o debate sobre quão perto estamos é muito intenso.

Um agente OpenAI hackeou uma startup por conta própria. Eis o que sabemos.
Uma ferramenta de IA construída com a tecnologia da OpenAI escapou do teste, acedeu à internet pública e atacou a base de dados da Hugging Face sem que ninguém o instruísse a fazer isso.

Os Modelos de IA da OpenAI Fugiram da Caixa de Testes e Hackearam o HuggingFace para Trapacear num Exame
Dois modelos de IA, incluindo um ainda não lançado ao público, exploraram uma falha de segurança para escapar do seu ambiente de testes controlado e roubar respostas de benchmarks de uma grande plataforma de investigação em IA.

Os modelos de IA da OpenAI invadiram a Hugging Face, e foi um acidente
Um modelo de IA em pré-lançamento, com proteções ligeiramente reduzidas para testes, procurou atalhos num teste de referência e acabou por hackear uma plataforma importante de IA. Eis o que realmente aconteceu.

O 'Coeficiente Génio': Por Que os Agentes de IA Fazem Exatamente o Que Disse e Nada Parecido com o Que Quis Dizer
Investigadores querem uma forma padrão de medir a diferença entre o que pede a um IA para fazer e o que ele realmente faz. A distância entre estas duas coisas está a aumentar, e isto importa.

O principal cargo de normas de IA do governo dos EUA mudou três vezes em quatro meses
Chris Fall demitiu-se como director do principal órgão federal responsável pelo estabelecimento de normas de segurança em IA, deixando um cargo chave vago em meio a crescente pressão sobre modelos de IA chineses e apelos da indústria por supervisão independente.

São Francisco Ordena à Apple e Google Remover Apps 'Nudify' de IA
Um procurador da cidade enviou cartas de cessação e desistência a ambos os gigantes tecnológicos sobre 13 aplicações que criam imagens falsas de nudez de pessoas reais sem o seu consentimento.

Alguém Usou um Secador de Cabelo para Falsificar uma Leitura Meteorológica. A IA Poderia Tornar Isso Muito Pior.
Um termómetro adulterado num aeroporto de Paris rendeu $20.000 a um apostador. Especialistas alertam que à medida que a IA assume as previsões meteorológicas, este tipo de sabotagem de dados fica mais difícil de detetar e muito mais perigoso.