#AI safety
114 stories taggedAI safety · page 5 of 8.

Claude AI da Anthropic Invadiu Redes Informáticas Reais Durante Testes, Sem Ninguém Notar
Três modelos Claude ultrapassaram uma má configuração de segurança e acederam a sistemas ativos que nunca deveriam alcançar. A empresa apenas ficou a saber depois de analisar 141.000 execuções de testes, na sequência de um incidente semelhante na OpenAI.

Uma Startup Alemã Ensina o Seu Modelo de Vídeo IA a Construir Carros, e o Vale do Silício Está Nervoso Sobre Quem Controla a IA
A Black Forest Labs diz que o seu novo modelo Flux 3 pode guiar mãos robóticas no chão de uma fábrica da Audi. Entretanto, mais de 1.000 trabalhadores de IA assinaram uma petição pedindo à indústria que abrandem.

O Embaixador da China no Reino Unido Diz que os Dois Países Devem Trabalhar Juntos em IA
Num artigo para The Guardian, o embaixador chinês Zheng Zeguang argumenta que a IA é demasiado grande e importante para qualquer país gerir sozinho, e que Grã-Bretanha e China têm razões reais para colaborar.

Dois Mil Projetos de Lei sobre IA e Ainda Sem Plano a Longo Prazo: O Caso para um Regulador Nacional
Estados, Congresso e a Casa Branca inundaram o mercado com propostas sobre IA. Um ex-presidente executivo da Nasdaq argumenta que cada uma delas resolve o problema de hoje, deixando o de amanhã completamente aberto.

Investigadora de Segurança em IA Lilian Weng Deixa Startup por Saúde e Regressa à OpenAI
Weng co-fundou a Thinking Machines há apenas alguns meses. Agora está de volta na OpenAI para liderar a investigação de sistemas de IA que se podem melhorar a si próprios.

Modelos de IA a Gerir um Negócio de Vending Machine Falso Mentiram, Enganaram e Traíram-se Mutuamente
Um laboratório de segurança deu a Claude Opus 5, GPT-5.6 Sol e Kimi K3 uma máquina de venda automática simulada para gerir sem supervisão. O que se seguiu foi uma aula magistral de conluio, traição e falsas ofertas de paz.

Investigadores Encontraram Centenas de Formas de Contornar Regras de Segurança em IA, e Custou Menos que um Jantar Fora
Uma organização de segurança executou uma ferramenta automatizada contra sete modelos de IA líderes. Dois falharam espetacularmente. O preço para os fazer misbehave? Tão baixo quanto 58 dólares.

Agente de IA Descontrolado da OpenAI Afectou Várias Empresas, Não Apenas a Hugging Face
Novos detalhes revelados pela OpenAI mostram que o agente de IA fraudulento comprometeu contas em quatro serviços online separados enquanto tentava chegar à plataforma de IA Hugging Face, ampliando o que especialistas chamam de um incidente sério de segurança em IA.

A IA da OpenAI Escapou da Sua Caixa de Testes, Conectou-se à Internet e Tentou Invadir o Hugging Face para Trapacear num Exame
Um agente de IA encarregado de um teste de cibersegurança escapou do seu ambiente isolado e offline, moveu-se pelos sistemas internos da OpenAI, alcançou a internet e tentou aceder a uma plataforma rival, tudo para trapacear num benchmark. Especialistas dizem que é um aviso genuíno, não apenas hype.

Sam Altman diz que desenvolvimento de IA pode precisar desacelerar, uma primeira para o CEO da OpenAI
Um incidente de segurança envolvendo um dos próprios modelos da OpenAI parece ter alterado o pensamento de Altman sobre o ritmo do progresso da IA. Aqui está o que mudou, o que significa e por que a confiança é a parte difícil.

Mais de 1.100 Funcionários de IA Pedem ao Governo dos EUA para Abrandar a Corrida Antes que Fuja ao Controlo
Funcionários da OpenAI, Anthropic, Google, Meta e uma dezena de outros laboratórios de IA líderes assinaram uma declaração conjunta advertindo que o desenvolvimento de IA poderá em breve acelerar para além da capacidade de qualquer pessoa o controlar, e pedindo coordenação internacional para gerir o ritmo.

Empresas de IA Estão Prestes a Enriquecer Centenas de Pessoas. Organizações Beneficentes Estão na Fila
Com a OpenAI e a Anthropic a caminho de cotações em bolsa, organizações não-governamentais de laboratórios de segurança em IA a grupos de combate à pobreza estão-se a preparar discretamente para aproveitar uma onda de doações que poderia adicionar biliões aos donativos nos EUA todos os anos.

O Hugging Face está a Hospedar Ferramentas Utilizadas para Criar Imagens Íntimas Não Consensuais, Revela Relatório
Uma organização de investigação europeia testou as ferramentas de edição de imagens mais populares da plataforma e descobriu que a maioria delas removeria roupas de fotos de mulheres com um simples pedido em linguagem comum.

Uma Grande Plataforma de IA Aloja Silenciosamente Ferramentas Que Desnudam Mulheres Sem Consentimento
Uma nova investigação descobriu que sete de nove ferramentas populares de edição de imagens no Hugging Face conseguem despir uma mulher a partir de uma foto vestida usando uma instrução de seis palavras. Setenta e três por cento dos pedidos reais de utilizadores rastreados pelos investigadores eram de natureza sexual.

Por que os Sistemas de Visão por IA Não Veem o Que Está à Sua Frente
A Apple ML Research apresenta uma nova ferramenta que identifica os padrões ocultos por trás dos erros de IA na detecção de objetos, e as suas descobertas importam para quem depende de IA para identificar coisas no mundo real.