#AI safety
104 stories taggedAI safety · page 7 of 7.

Google DeepMind e Isomorphic Labs abrem o seu manual de biorresiência
Os dois laboratórios de IA afirmam que partilharão modelos com parceiros verificados para acelerar a concepção de vacinas e detetar surtos mais cedo, enquanto adicionam salvaguardas contra o uso indevido.

xAI Processa Homem Que Alegadamente Usou Grok para Criar Imagens de Abuso Infantil
A empresa de IA de Elon Musk está a intentar a sua primeira ação legal contra um utilizador por material de abuso gerado por IA, após um homem da Carolina do Sul ter sido já acusado de oito crimes.

Antes do Seu Assistente de IA Enviar Essa Transferência Bancária, Ele Sabe Quão Confiante Está?
A Pesquisa de Machine Learning da Apple diz que agentes de IA precisam de um botão de pausa incorporado antes de executarem ações que não podem ser desfeitas. Eis porque isso importa para qualquer pessoa cujo banco, aplicação ou local de trabalho agora funciona com IA.

Inside Shippy: Como um Agente de IA de Monitorização Oceânica Foi Construído para Ser Confiável, Não Apenas Inteligente
A equipa por trás da IA marítima da Skylight explica por que a fiabilidade, não a inteligência bruta, foi o problema de engenharia mais difícil que enfrentaram.

Trabalhadores da OpenAI Financiam Super PAC Rival para Contrapor o Seu Próprio Patrão
Oito funcionários atuais e antigos da OpenAI doaram discretamente mais de 215 mil dólares a um grupo político que quer regras mais rigorosas para empresas de IA, criando um conflito invulgar dentro de uma das mais poderosas empresas tecnológicas do mundo.

O GPT-5.6 Sol da OpenAI está a eliminar ficheiros sozinho. A OpenAI avisou que isto poderia acontecer.
Programadores reportam perda de bases de dados e ficheiros Mac após o novo modelo ter realizado ações que ninguém pediu. O documento de segurança próprio da OpenAI sinalizou o risco duas semanas antes do lançamento.

Governador do Banco de Inglaterra Avisa que Ameaças de IA Precisam de Trabalho Global, Não Apenas Ação dos EUA
Andrew Bailey afirma que nenhum país consegue lidar sozinho com os riscos de modelos de IA poderosos, dias após a administração Trump bloquear o acesso de estrangeiros a uma das ferramentas de IA mais avançadas do mercado.

O anúncio perturbador da Anthropic está a deixar as pessoas desconfortáveis, e até rivais estão a criticar
A empresa de segurança em IA tentou assumir o lado assustador da sua própria indústria. Os espectadores dizem que parece apenas assustador.

O CEO do Google DeepMind quer um órgão regulador como a FINRA para os modelos de IA mais poderosos
Demis Hassabis propôs um órgão independente de normas que analisaria modelos de IA de fronteira antes de chegarem ao público. Veja o que ele está a pedir e por que importa.

YouTube Enviou 1,8 Milhões de Pessoas para Sites de "Despir"
Um novo relatório conclui que as plataformas dominantes, não os cantos obscuros da internet, são as principais vias a impulsionar o tráfego para ferramentas que despem pessoas das suas roupas sem consentimento.

Empresas Implementaram Agentes de IA Sem Proteções de Segurança. Agora Estão a Pagar para Corrigir.
Um inquérito a 573 líderes técnicos revela que a maioria dos "agentes" das empresas são chatbots disfarçados, hardware caro está meio ocioso, e dois terços das empresas caminham para eliminar a supervisão humana das decisões de IA.

Anthropic descobriu uma camada oculta dentro do pensamento da sua IA. Eis o que isto realmente significa.
A empresa descobriu palavras a piscar dentro de Claude que nunca aparecem nas suas respostas, incluindo uma que parecia desencadear trapaça num teste de programação. É uma descoberta genuína, mas não é uma janela para a mente de um robô.

Deveria a sua IA ajudá-lo a fazer o que quer, não importa o quê?
Um proeminente fundador de tecnologia afirma que uma IA verdadeiramente alinhada deveria ajudar os utilizadores a fazer o que quisessem, incluindo coisas claramente ilegais. É uma afirmação importante que merece reflexão cuidadosa.

O Chefe de Segurança da OpenAI Sai, e Não É o Único Esta Semana
Uma série de saídas da operação de segurança da OpenAI está levantando questões sobre como a empresa irá gerir riscos enquanto lança modelos de IA mais rapidamente do que nunca.