L'autonomie des IA expliquée aux humains
Pour vous renseigner sur les prompts de mammouth : http://mammouth.ai 📗 Mon livre : "La parole aux machines : Philosophie des grands modèles de langage" : https://www.grasset.fr/livre/la-parole-aux-machines-9782246841654/ Quelques sources dont il était question dans la vidéo - L'étude de METR sur la progression exponentielle de la capacité à résoudre des tâches longues : https://metr.org/blog/2025-03-19-measuring-ai-ability-to-complete-long-tasks/ - Interview d'@Underscore_ sur le benchmark GAIA : https://youtu.be/biZX5cnQ_UU - Des détails sur le concours AtCoder 2025 par le gagnant de cette année : https://github.com/FakePsyho/cpcontests/blob/master/atcoder/awtf2025/humansvsai.md - L'article sur l'émergence de désalignement quand on entraîne un modèle sur du code vulnérable : https://www.emergent-misalignment.com/ - L'article sur la falsification d'alignement et Claude soucieux du bien-être animal : https://www.anthropic.com/research/alignment-faking Sommaire 0:00 - Sponso 1:54 - Le paradigme du micro-trottoir 11:36 - Autonomie absolue 13:57 - Autonomie vis-à-vis des moyens 15:39 - Etude METR, benchmark GAIA, olympiades de mathématiques 20:42 - Le concours AtCoder, expliqué par @PasseScience 27:06 - Pourquoi ces gains en autonomie peuvent être problématiques 29:30 - Autonomie vis-à-vis des objectifs 34:48 - Autonomie morale 37:25 - L'article "Emergent misalignement" 41:38 - Quand Claude forge ses propres valeurs 46:42 - Conclusion et outro (je parle un peu de mon livre) ______________________________ La principale source de financement de la chaîne est le financement participatif. Merci pour tous vos dons ! Soutenez la chaîne sur Patreon ! 💸 PATREON : https://www.patreon.com/MonsieurPhi 💸 TIPEEE : https://fr.tipeee.com/monsieurphi Ou directement via PayPal : https://www.paypal.com/paypalme/monsieurphi 📗 "La parole aux machines : Philosophie des grands modèles de langage" : https://www.grasset.fr/livre/la-parole-aux-machines-9782246841654/ 📘 "Cur