120 Gigantes Tecnológicas Querem Partilhar Incidentes de Cibersegurança em IA Antes do Próximo Ataque

Um novo protocolo chamado SAFE permitiria às empresas reportar discretamente falhas de segurança em IA e partilhar o que aprendem, em vez de cada uma sofrer sozinha em silêncio.

AI2Day Newsdesk4 min read
Photoreal aerial view of sprawling fiber-optic cable infrastructure branching into a dark server room, soft blue bioluminescent glow tracing the cable paths, ed
Share

Pontos-chave

  • Mais de 120 organizações da Open Secure AI Alliance propuseram o protocolo SAFE a 6 de agosto de 2025, no primeiro dia da conferência de segurança Black Hat em Las Vegas.
  • SAFE significa Shared AI Findings Exchange, um conjunto de diretrizes para recolher e partilhar incidentes de segurança em IA em toda a indústria.
  • NVIDIA, Cisco, CrowdStrike, Amazon e Visa estão entre os membros que contribuem com ferramentas e se juntam à aliança.
  • A Linux Foundation está a coordenar um período de comentários públicos para que as organizações possam moldar as diretrizes antes da sua finalização.
  • As empresas participantes também estão a lançar dezenas de ferramentas de segurança gratuitas e de código aberto construídas especificamente para agentes de IA.

Uma coligação de mais de 120 empresas de tecnologia está a propor uma forma de tratar a segurança em IA como um problema partilhado, em vez de um constrangimento privado.

O grupo, chamado Open Secure AI Alliance, publicou um pedido de comentários públicos sobre o protocolo SAFE na quarta-feira. SAFE significa Shared AI Findings Exchange. Em termos simples, é um conjunto de regras para reportar confidencialmente incidentes de segurança envolvendo agentes de IA (software que pode executar tarefas multi-passo de forma autónoma, como agendar reuniões, escrever código ou analisar uma rede), analisar o que correu mal e publicar as lições para que toda a organização possa beneficiar.

O anúncio coincidiu com o primeiro dia da Black Hat, a conferência anual de cibersegurança onde os investigadores revelam novos métodos de ataque e defesa.

Por que razão é isto importante para as pessoas comuns?

Os agentes de IA estão a entrar rapidamente nos locais de trabalho. Bancos, hospitais, seguradoras e retalhistas já os estão a implementar. Quando um falha, ou é enganado, o dano pode propagar-se rapidamente.

Neste momento, a maioria das organizações que sofrem uma falha de segurança em IA mantém-se em silêncio. Esse silêncio significa que a próxima empresa comete o mesmo erro. O SAFE mudaria isso ao criar um canal de confiança para partilhar o que aconteceu, sem identificar ninguém, para que os defensores em todo o lado aprendam mais depressa.

O protocolo propõe quatro coisas concretas: recolher e analisar confidencialmente incidentes e quase-incidentes de IA, notificar os afetados, identificar padrões em como os controlos falham e publicar recomendações baseadas em evidências para reduzir o risco sistémico.

Que ferramentas já estão a ser partilhadas?

Além da proposta SAFE, os membros da aliança estão a lançar ferramentas gratuitas agora.

NVIDIA, cujas contribuições a NVIDIA destacou no seu próprio anúncio, lançou vários itens. Garak é um scanner de vulnerabilidades gratuito, uma ferramenta que verifica modelos de IA em busca de fragilidades como fugas de dados, injeção de prompt (um tipo de ataque que engana uma IA ao inserir instruções ocultas no seu input) e jailbreaks (tentativas de fazer um modelo ignorar as suas regras de segurança) antes do modelo entrar em operação. NeMo Guardrails impõe políticas de segurança em tempo de execução. O NVIDIA OpenShell runtime restringe o que um agente pode realmente alcançar ou modificar dentro de um sistema.

Colaborador Ferramenta O que faz
NVIDIA Garak Analisa modelos de IA em busca de vulnerabilidades antes da implementação
Microsoft PyRIT Automatiza testes de equipa vermelha de sistemas de IA
Amazon Cedar Define limites verificáveis e auditáveis do que os agentes podem fazer
Capital One VulnHunter Encontra falhas de segurança em código gerado por IA
Visa Vulnerability Agentic Harness Ajuda as equipas a encontrar e corrigir problemas de segurança do agente
Cisco Antares SLMs Modelos de linguagem pequenos treinados para identificar vulnerabilidades em bases de código

Amazon juntou-se à aliança no mesmo dia do anúncio e contribuiu com duas ferramentas: Strands Agents, um kit de ferramentas de código aberto para construir agentes de IA, e Cedar, uma linguagem de código aberto para definir regras rigorosas e auditáveis sobre o que um agente pode e não pode fazer.

Visa também se juntou, contribuindo com um teste de harness de vulnerabilidade construído especificamente para sistemas de agentes.

O que se segue?

O protocolo SAFE é ainda uma proposta. A Linux Foundation está a recolher feedback antes de qualquer versão final ser publicada.

Para as empresas que já utilizam agentes de IA, o resultado prático é que ferramentas de segurança gratuitas e validadas estão disponíveis hoje. As equipas de segurança não precisam de esperar pela finalização das diretrizes antes de utilizar Garak, PyRIT ou Cedar para fortalecer o que já implementaram.

Perguntas comuns

Este protocolo é obrigatório?

Não. SAFE é um conjunto voluntário de diretrizes. Qualquer organização pode escolher adoptá-lo, ignorá-lo ou submeter comentários para o moldar durante o período de feedback aberto.

Partilhar dados de incidentes significa expor informações privadas da empresa?

A proposta especificamente apela à recolha e análise confidencial, o que significa que a intenção é partilhar padrões e lições em vez de identificar qual empresa foi atingida ou como são os seus sistemas internos.

Estas ferramentas custam dinheiro?

Todas as ferramentas nomeadas no anúncio são de código aberto, o que significa que são gratuitas para descarregar e utilizar. São publicadas em plataformas como GitHub para qualquer equipa de segurança inspecionar e implementar.

© 2026 AI2Day