IA y sociedad
Riesgos, seguridad y efectos sociales de la inteligencia artificial: los papers y libros que Dager comenta sobre alineación, sesgos y agentes.
25 estaciones
Estaciones de la línea, de la cabecera al final
Zona 1, Introductorio
Daniel Kokotajlo, Scott Alexander, Thomas Larsen, Eli Lifland, Romeo Dean
Bifurca: seguís por Superintelligence, Concrete Problems in AI Safety o Emergent Misalignment: Narrow finetuning can produce broadly misaligned LLMs
Jiannan Xu, Gujie Li, Jane Yi Jiang
Nancy G. Leveson, Clark S. Turner
Combina con la línea I, Oficio y equipos
Yo, robot
Isaac Asimov
Combina con la línea L, Ficción
Bifurca: seguís por Frankenstein; or, The Modern Prometheus o Robots Should Be Slaves
Yoshua Bengio
Shuo Xing
Philippe Laban, Hiroaki Hayashi, Yingbo Zhou, Jennifer Neville
Emily M. Bender, Timnit Gebru, Angelina McMillan-Major, Shmargaret Shmitchell
Bifurca: seguís por Agents of Chaos, Computer Power and Human Reason: From Judgment to Calculation, The Illusion of Thinking: Understanding the Strengths and Limitations of Reasoning Models via the Lens of Problem Complexity o Scalable watermarking for identifying large language model outputs (SynthID-Text)
Yaniv Leviathan, Matan Kalman, Yossi Matias
- The AI Layoff TrapPor completar
Hao-Ping Lee
Zona 2, Intermedio
Natalie Shapira, Chris Wendler, Avery Yen, Gabriele Sarti, Koyena Pal, Olivia Floody, Adam Belfki, Alex Loftus
Joseph Weizenbaum
Dario Amodei, Chris Olah, Jacob Steinhardt, Paul Christiano, John Schulman, Dan Mané
Frankenstein o el moderno Prometeo
Mary Shelley
Combina con la línea L, Ficción
Joanna J. Bryson
Superinteligencia: caminos, peligros, estrategias
Nick Bostrom
Bifurca: seguís por The Off-Switch Game o Information Hazards: A Typology of Potential Harms from Knowledge
Parshin Shojaee, Iman Mirzadeh, Keivan Alizadeh, Maxwell Horton, Samy Bengio, Mehrdad Farajtabar
Zona 3, Avanzado
Steve Petersen
Dylan Hadfield-Menell, Anca Dragan, Pieter Abbeel, Stuart Russell