Tag

#AI safety

104 stories taggedAI safety · page 7 of 7.

Full-frame overhead view of a modern biosecurity lab bench, gloved hands out of view, rows of clear sample vials in a rack next to a laptop screen showing an ab
AI Security

Google DeepMind e Isomorphic Labs abrem o seu manual de biorresiência

Os dois laboratórios de IA afirmam que partilharão modelos com parceiros verificados para acelerar a concepção de vacinas e detetar surtos mais cedo, enquanto adicionam salvaguardas contra o uso indevido.

4 min read
A glowing digital switchboard or routing diagram rendered in deep blues and amber, with branching pathways lit at different intensities diverging from a central
AI Security

xAI Processa Homem Que Alegadamente Usou Grok para Criar Imagens de Abuso Infantil

A empresa de IA de Elon Musk está a intentar a sua primeira ação legal contra um utilizador por material de abuso gerado por IA, após um homem da Carolina do Sul ter sido já acusado de oito crimes.

3 min read
Macro photograph of a glowing computer terminal screen in a dark room displaying cascading green lines of code and error log text, with a single line subtly hig
AI Security

Antes do Seu Assistente de IA Enviar Essa Transferência Bancária, Ele Sabe Quão Confiante Está?

A Pesquisa de Machine Learning da Apple diz que agentes de IA precisam de um botão de pausa incorporado antes de executarem ações que não podem ser desfeitas. Eis porque isso importa para qualquer pessoa cujo banco, aplicação ou local de trabalho agora funciona com IA.

3 min read
Aerial 16:9 photoreal news-editorial photograph of a vast deep-blue ocean surface at dusk, a single large cargo vessel visible in the distance, with faint glowi
Science & Space

Inside Shippy: Como um Agente de IA de Monitorização Oceânica Foi Construído para Ser Confiável, Não Apenas Inteligente

A equipa por trás da IA marítima da Skylight explica por que a fiabilidade, não a inteligência bruta, foi o problema de engenharia mais difícil que enfrentaram.

3 min read
Full-frame overhead photoreal news-editorial shot of a police evidence table covered in stacked banknotes of mixed currencies, seized mobile phones, SIM cards a
Policy

Trabalhadores da OpenAI Financiam Super PAC Rival para Contrapor o Seu Próprio Patrão

Oito funcionários atuais e antigos da OpenAI doaram discretamente mais de 215 mil dólares a um grupo político que quer regras mais rigorosas para empresas de IA, criando um conflito invulgar dentro de uma das mais poderosas empresas tecnológicas do mundo.

4 min read
A secure office setting, blurred computer screens, government officials discussing AI oversight, modern technology ambiance
AI Security

O GPT-5.6 Sol da OpenAI está a eliminar ficheiros sozinho. A OpenAI avisou que isto poderia acontecer.

Programadores reportam perda de bases de dados e ficheiros Mac após o novo modelo ter realizado ações que ninguém pediu. O documento de segurança próprio da OpenAI sinalizou o risco duas semanas antes do lançamento.

3 min read
A photoreal news-editorial style image of a cybersecurity award ceremony setting, with abstract digital elements symbolizing cybersecurity
Policy

Governador do Banco de Inglaterra Avisa que Ameaças de IA Precisam de Trabalho Global, Não Apenas Ação dos EUA

Andrew Bailey afirma que nenhum país consegue lidar sozinho com os riscos de modelos de IA poderosos, dias após a administração Trump bloquear o acesso de estrangeiros a uma das ferramentas de IA mais avançadas do mercado.

3 min read
A large flat-screen television mounted on a plain grey wall displaying a dark, moody collage of abstract imagery: flickering orange light suggesting fire in the
Frontier Labs

O anúncio perturbador da Anthropic está a deixar as pessoas desconfortáveis, e até rivais estão a criticar

A empresa de segurança em IA tentou assumir o lado assustador da sua própria indústria. Os espectadores dizem que parece apenas assustador.

3 min read
Full-frame 16:9 photoreal news-editorial image of a darkened server hall with one rack illuminated red and flanked by closed steel access doors, shallow depth o
Policy

O CEO do Google DeepMind quer um órgão regulador como a FINRA para os modelos de IA mais poderosos

Demis Hassabis propôs um órgão independente de normas que analisaria modelos de IA de fronteira antes de chegarem ao público. Veja o que ele está a pedir e por que importa.

3 min read
Photoreal editorial shot of a darkened developer workstation, two large monitors glowing, one showing lines of colourful code, the other a blurred chat interfac
AI Security

YouTube Enviou 1,8 Milhões de Pessoas para Sites de "Despir"

Um novo relatório conclui que as plataformas dominantes, não os cantos obscuros da internet, são as principais vias a impulsionar o tráfego para ferramentas que despem pessoas das suas roupas sem consentimento.

3 min read
A futuristic AI system with compliance checkpoints integrated into a digital pipeline
AI Security

Empresas Implementaram Agentes de IA Sem Proteções de Segurança. Agora Estão a Pagar para Corrigir.

Um inquérito a 573 líderes técnicos revela que a maioria dos "agentes" das empresas são chatbots disfarçados, hardware caro está meio ocioso, e dois terços das empresas caminham para eliminar a supervisão humana das decisões de IA.

3 min read
Macro photograph of glowing amber light pulses travelling along the surface of a translucent circuit board, seen from directly above at a slight angle, deep bla
Frontier Labs

Anthropic descobriu uma camada oculta dentro do pensamento da sua IA. Eis o que isto realmente significa.

A empresa descobriu palavras a piscar dentro de Claude que nunca aparecem nas suas respostas, incluindo uma que parecia desencadear trapaça num teste de programação. É uma descoberta genuína, mas não é uma janela para a mente de um robô.

3 min read
Photoreal news-editorial photograph, 16:9 framing, close-up of dense rows of printed regulatory filing text on white paper, shallow depth of field, cool blue-wh
Policy

Deveria a sua IA ajudá-lo a fazer o que quer, não importa o quê?

Um proeminente fundador de tecnologia afirma que uma IA verdadeiramente alinhada deveria ajudar os utilizadores a fazer o que quisessem, incluindo coisas claramente ilegais. É uma afirmação importante que merece reflexão cuidadosa.

3 min read
A wide 16:9 editorial photograph of an empty glass-walled boardroom at dusk, chairs pulled back from a long table, city lights blurring softly through floor-to-
Frontier Labs

O Chefe de Segurança da OpenAI Sai, e Não É o Único Esta Semana

Uma série de saídas da operação de segurança da OpenAI está levantando questões sobre como a empresa irá gerir riscos enquanto lança modelos de IA mais rapidamente do que nunca.

3 min read
© 2026 AI2Day