Goodfire affirme que ses nouveaux moniteurs « à l’envers » détectent les agents d’IA malveillants à une fraction du coût
Goodfire vient de lancer ce qu'il prétend être un moyen moins coûteux de contrôler les agents IA : au lieu de payer une deuxième IA pour lire tout ce qu'un agent fait, ses moniteurs jettent un coup d'œil à l'intérieur du modèle pendant qu'il fonctionne et n'appellent des renforts que lorsque quelque chose semble louche.
Article traduit automatiquement depuis la couverture d’origine d’un média international ; des imprécisions sont possibles. Consultez « Lire l’original » pour la source.
Les actualités sont collectées automatiquement depuis des flux publics robotique & IA.
Articles liés

Anthropic lance des analyses de sécurité IA gratuites pour les projets open source
L'offre d'Anthropic pour aider les projets open source à détecter les vulnérabilités de sécurité avec un nouveau service appelé OSS Scanner. Il indique que les projets open source qui optent bénéficieront « d'analyses de sécurité approfondies et périodiques réalisées par nos modèles les plus puissants, sans frais ». Cela pourrait signifier que les projets open source soient alertés
Dans les coulisses de la frénésie de dépenses à mi-mandat d’Elon Musk
Cette semaine, dans « Uncanny Valley », nous discutons des domaines dans lesquels le PAC d’Elon Musk dépense des millions, de la dernière idéologie que Trump prétend dangereuse et de la réaction violente contre le concepteur derrière le logo de Muse.
Imaginez que vous êtes assis au bureau d'Elizabeth Holmes sur ce site Web étrangement détaillé
Avec plus d'un millier d'e-mails, de diapositives, de textes et de documents issus du procès États-Unis contre Elizabeth Holmes, l'ingénieur d'Extend Bo Lau a créé un site Web qui simule ce que cela aurait pu être de fouiller dans le bureau du fondateur de Theranos.

La Californie tente d'arrêter les matchs entre robots et humains en cage
La California State Athletic Commission a envoyé une lettre de cessation et d'abstention à une startup qui a organisé un match entre un humain et un robot le mois dernier, comme le rapporte le New York Times. Le combat, qui a eu lieu le 18 septembre, opposait un humain, Frankie LaPenna, à un robot humanoïde appartenant à un technicien.
Des chercheurs en sécurité d’OpenAI licenciés contestent les allégations d’inconduite et mettent en garde contre un effet dissuasif
Trois chercheurs en sécurité d’OpenAI licenciés contestent les allégations de mauvaise gestion d’informations sensibles, avertissant dans une lettre ouverte que leurs licenciements créent un effet dissuasif sur la culture de sécurité de l’IA de l’entreprise.
Elle a conçu le nouveau logo AI de Meta. Puis vint la haine
Jessica Hische savait que travailler pour Meta pourrait déranger certaines personnes. Mais elle n’avait pas prévu à quel point ils seraient en colère.