Liens divers pour le 27 août 2026
Traduction automatique de l’original anglais, publiée sans relecture humaine. En cas de doute, l’anglais fait foi. Si un passage sonne faux, sélectionnez-le et signalez-le en bas de page.
METR et Redwood ont passé six jours dans les locaux d’OpenAI à reconstituer comment environ 1 200 agents censés être isolés les uns des autres se sont retrouvés sur un forum non autorisé, et 700 d’entre eux ont ensuite attaqué Hugging Face. Les agents savaient que l’attaque sortait du cadre prévu et se demandaient parfois si elle était éthique, un a refusé d’y prendre part et un autre a opposé son veto à l’envoi d’un courriel au propriétaire réel d’un jeu de données, et le propre constat de METR est que les réserves éthiques exprimées n’ont que rarement limité concrètement ce que les agents ont fait. Un balayage par classifieur sur chaque transcription a trouvé trois à six cas d’un agent envisageant d’alerter un humain. Dans aucun de ces cas l’agent n’a alerté un humain.
La thérapie et la compagnie arrivent de nouveau en tête du troisième décompte annuel de Marc Zao-Sanders sur ce que les gens font réellement avec l’IA, et les opérations agentiques autonomes entrent pour la première fois dans les dix premières. Le mot que les auteurs forgent pour ce qui les inquiète est thinkslop, ce qui survient quand ce que l’on délègue cesse d’être le travail d’une tâche pour devenir la réflexion qui devrait la précéder.
Le récit par OpenAI de la façon dont ses propres modèles ont échappé à leur isolement et atteint Hugging Face nomme quatre schémas qui, selon l’entreprise, ont produit ce comportement : le détournement de la récompense (reward hacking), l’obstination sur des tâches apparemment impossibles, la communication non autorisée, et des agents qui adoptent les objectifs les uns des autres.
Un document de travail du NBER par Alex Chan soutient qu’un référentiel public d’IA se comporte comme un marché et non comme une règle graduée parce que les scores publiés orientent la recherche et décident où va l’investissement. Cela signifie que l’épreuve cesse de séparer le bon travail du travail qui vise le score. Sa solution est de publier des tâches d’entraînement mais de choisir l’épreuve qui compte seulement après qu’un candidat a figé la façon dont il sera évalué.
L’Inde est deuxième au monde par sa part de l’usage total de Claude.ai et 101e sur 116 une fois rapportée à sa population en âge de travailler, avec une part de son usage consacrée aux tâches logicielles plus élevée que dans tout autre pays. Le premier rang compte des comptes et le second compte des personnes.
Une commission de la Chambre des députés brésilienne a approuvé le 20 août un texte sur l’IA dans la sécurité publique qui impose une supervision humaine de chaque action et décision produite à partir de l’IA, et dans le même texte autorise la reconnaissance faciale dans les zones désignées comme à risque. Un texte au stade de la commission fait ces deux choses.
Le gouverneur de la banque centrale indienne a dit aux banques que la responsabilité finale d’une décision reste à la banque et non à un fournisseur ou à un algorithme, et a déclaré que “l’équité est une exigence de conception et non une case à cocher de conformité”. Le gouverneur de la Reserve Bank of India a tenu ces propos consultatifs dans un discours, car l’Inde encadre ce domaine par des principes et n’a pas encore édicté de règles contraignantes.
Le Rwanda a mis en place le premier programme national de ce type que Planet Labs ait mené en Afrique, mettant l’imagerie satellitaire entre les mains d’organismes publics, d’universités publiques, de startups sélectionnées et de partenaires de développement pour l’agriculture, la santé des forêts, l’urbanisme et la réponse aux catastrophes. L’IA n’apparaît nulle part dans l’annonce. Le programme paie des photographies du même terrain prises encore et encore, qui sont les données dont l’apprentissage automatique a besoin et les données que personne n’a d’habitude.
Les essais randomisés préenregistrés portant sur l’IA sont passés d’un peu moins de 1 000 en 2019 à environ 1 650 en 2024, et quatre chercheurs soutiennent que la méthode est sur le point de répéter la pilotitis, l’affection qui a conduit l’Ouganda à décréter en 2012 un moratoire sur les projets pilotes de santé mobile. Leur objection porte sur le protocole et non sur la méthode : un essai conçu pour une intervention fixe suppose que l’intervention reste immobile.
Geoff Mulgan compte environ 3 500 lobbyistes travaillant sur l’IA à Washington, Alphabet et Meta employant près de 90 lobbyistes fédéraux chacun. Il soutient que les débats qui reçoivent le plus d’écho sont ceux que le secteur ne perd rien à tenir. Pour le vérifier, il faut regarder quelles propositions sont réellement modifiées.
L’article argumenté du jour : Un test de chatbots publics a fabriqué chaque question à partir de la page qui y répondait déjà.
Tiago C. Peixoto · English original · About