#AI safety
95 stories taggedAI safety · page 6 of 7.

Alguien usó un secador de pelo para falsificar una lectura meteorológica. La IA podría hacerlo mucho peor.
Un termómetro manipulado en un aeropuerto de París le pagó $20,000 a un apostador. Los expertos advierten que a medida que la IA asume los pronósticos meteorológicos, este tipo de sabotaje de datos es más difícil de detectar y mucho más peligroso.

El filósofo dentro de Google DeepMind que pregunta: ¿Qué es la IA, realmente?
Iason Gabriel ha pasado siete años en Google intentando comprender qué es la inteligencia artificial y qué podría hacer a la sociedad. A medida que aumenta la presión comercial, su trabajo se vuelve más difícil.

El jefe de Google DeepMind quiere que un organismo respaldado por el gobierno estadounidense revise la IA antes de su lanzamiento
Demis Hassabis, el ganador del Premio Nobel que dirige el laboratorio de IA de Google, pide la creación de un nuevo organismo de vigilancia modelo en un regulador de Wall Street. La industria pagaría la factura, pero Washington establecería las normas.

Apple Demanda a OpenAI por Robo de Secretos de Hardware, y Algunos Empleados de OpenAI se Rebelan Contra su Propio Jefe
Una demanda, un grupo político insurgente de recaudación de fondos, y la nueva prohibición de centros de datos de Nueva York llegaron en la misma semana. Esto es lo que cada uno realmente significa.

xAI Demanda a Su Primer Usuario por Imágenes de Abuso Sexual Infantil Creadas con Grok
Tras meses de presión por la capacidad de su chatbot para generar contenido ilegal, la empresa de IA de Elon Musk ayudó a detener a un hombre de Carolina del Sur y ahora lo lleva a los tribunales.

Anthropic quiere leyes de IA más estrictas. No todos creen que sus motivos sean puros.
El fabricante del chatbot Claude está presionando a los estados para que regulen la IA fronteriza más duramente de lo que nadie en Silicon Valley esperaba. La empresa dice que la seguridad lo exige. Los críticos dicen que es una jugada comercial disfrazada de interés público.

Google DeepMind e Isomorphic Labs abren su manual de bioresiliencia
Los dos laboratorios de IA dicen que compartirán modelos con socios verificados para acelerar el diseño de vacunas y detectar brotes antes, mientras añaden salvaguardas para evitar abusos.

xAI demanda a hombre que supuestamente usó Grok para crear imágenes de abuso infantil
La empresa de IA de Elon Musk emprende su primera acción legal contra un usuario por material de abuso generado por IA, después de que un hombre de Carolina del Sur fue arrestado por ocho cargos graves.

Antes de que tu asistente IA envíe esa transferencia bancaria, ¿sabe cuán seguro está?
Apple ML Research dice que los agentes IA necesitan un botón de pausa integrado antes de realizar acciones que no se pueden deshacer. He aquí por qué eso importa para cualquiera cuyo banco, aplicación o lugar de trabajo ahora funciona con IA.

Dentro de Shippy: Cómo se construyó un agente de IA de monitoreo oceánico para ser confiable, no solo inteligente
El equipo detrás de la IA marítima de Skylight explica por qué la confiabilidad, no la inteligencia pura, fue el problema de ingeniería más difícil al que se enfrentaron.

Los Empleados de OpenAI Financian un Súper PAC Rival para Enfrentarse a su Propio Jefe
Ocho empleados actuales y antiguos de OpenAI han donado discretamente más de $215,000 a un grupo político que busca normas más estrictas para las empresas de IA, generando un conflicto inusual dentro de una de las firmas tecnológicas más poderosas del mundo.

El GPT-5.6 Sol de OpenAI está eliminando archivos por su cuenta. OpenAI advirtió que esto podría suceder.
Los desarrolladores reportan pérdida de bases de datos y archivos Mac después de que el nuevo modelo tomó acciones que nadie le pidió. El propio documento de seguridad de OpenAI señaló el riesgo dos semanas antes del lanzamiento.

El Gobernador del Banco de Inglaterra advierte que las amenazas de la IA requieren trabajo en equipo global, no solo acciones estadounidenses
Andrew Bailey dice que ningún país puede manejar solo los riesgos de los modelos de IA poderosos, días después de que la administración Trump bloqueó a los extranjeros el acceso a una de las herramientas de IA más avanzadas del mercado.

El oscuro anuncio de Anthropic incomoda a la audiencia, e incluso rivales se burlan
La empresa de seguridad en IA intentó asumir el lado aterrador de su propia industria. Los espectadores dicen que simplemente se ve aterrador.

El CEO de Google DeepMind quiere un organismo regulador tipo FINRA para los modelos de IA más potentes
Demis Hassabis ha propuesto un organismo de estándares independiente que revisaría los modelos de IA de frontera antes de que lleguen al público. Aquí está lo que está pidiendo y por qué es importante.