#AI training data
26 stories taggedAI training data · page 2 of 2.

Des livres rares déchiquetés pour alimenter l'IA : des vendeurs australiens tirent la sonnette d'alarme
Des vendeurs de livres d'occasion et rares en Australie affirment que des livres anciens sont achetés en masse, numérisés pour l'entraînement de l'IA, puis détruits. Pour ceux qui commercent dans les livres physiques, ce processus ressemble à du vandalisme culturel.

Cinq plateformes construisant l'épine dorsale de l'IA physique en 2026
De la simulation aux usines de données, voici les couches d'infrastructure qui transforment un modèle entraîné en un robot capable d'accomplir réellement une tâche.

Google continue de combattre les racleurs de données web après une défaite judiciaire. Voici pourquoi c'est important.
Google a poursuivi une entreprise appelée SerpApi pour avoir vendu des résultats de recherche qu'elle avait raclés sur Google. Un juge a porté un coup à Google la semaine dernière. Google affirme qu'il poursuit néanmoins ses efforts, et Reddit s'est discrètement joint à la bataille.

Bloomsbury touchera des millions de l'accord de 1,5 milliard de dollars d'Anthropic avec les auteurs
L'éditeur de Harry Potter possède 14 087 titres dans l'accord, avec environ 3 000 dollars proposés par titre. C'est l'un des plus importants versements jusqu'à présent dans la longue bataille juridique sur les données d'entraînement de l'IA.

Anthropic accepte de verser 3 000 $ par livre dans un règlement de droits d'auteur de 1,5 milliard $
Un juge fédéral a approuvé l'accord lundi, le qualifiant de mesure de réparation significative pour les auteurs dont les livres auraient été utilisés sans permission pour entraîner l'IA d'Anthropic.

Un juge fédéral approuve le règlement de 1,5 milliard de dollars d'Anthropic avec les auteurs et les éditeurs
L'indemnité s'élève à 3 000 dollars par livre pour environ 500 000 ouvrages. Mais la décision qui a légalisé l'entraînement d'IA sur des textes protégeables demeure, et nombreux sont les auteurs qui ne célèbrent pas.

Patreon commence à bloquer les robots IA au lieu de simplement les demander gentiment
La plateforme de créateurs s'est associée à Cloudflare pour arrêter activement les bots qui exploitent les œuvres des créateurs pour entraîner les modèles d'IA, dépassant l'ancienne approche fondée sur l'honneur.

Des données piratées de Suno révèlent des millions de chansons extraites de YouTube Music, Deezer et autres
Une violation de sécurité chez le générateur musical IA a exposé du code interne montrant que l'entreprise a extrait plus de deux millions de clips de plateformes de streaming, et certains clients affirment qu'on ne les a jamais informés que leurs données avaient été consultées.

Les éditeurs poursuivent Google pour l'entraînement du Gemini, le qualifiant de l'une des plus grandes violations de droits d'auteur de l'histoire
Hachette, Cengage et Elsevier affirment que Google a utilisé des millions de livres protégeables sans permission pour développer son IA Gemini. Un procès fédéral déposé à New York pourrait transformer la façon dont les entreprises d'IA recueillent les données d'entraînement.

Un documentaire sur l'entraînement de l'IA sur des personnes réelles soulève des questions auxquelles il refuse de répondre
Le nouveau film de Marc Isaacs « Synthetic Sincerity » brouille les frontières entre réalité et fiction pour explorer comment l'IA apprend à partir de visages et d'histoires humaines. Les critiques affirment qu'il esquive les questions difficiles qu'il promet de poser.

Les créatifs australiens face aux entreprises d'IA : la bataille du droit d'auteur se dirige vers Canberra
Le Premier ministre Anthony Albanese s'apprête à aborder l'intelligence artificielle cette semaine, tandis que les artistes australiens exigent que leurs œuvres ne soient plus utilisées pour entraîner l'IA sans permission ni rémunération.