El canal que explica por qué alinear una IA es más difícil de lo que parece
Miles lleva años explicando seguridad de la IA sin alarmismo ni tecnicismos vacíos: especificación de objetivos, reward hacking, convergencia instrumental, todo con ejemplos que se quedan grabados. Es el único canal que conozco donde los argumentos de alineamiento se presentan con la seriedad de un problema de ingeniería. Perfecto para escépticos de buena fe.
Robert Miles · YouTube
MIMarco IbáñezConexiones
Trazadas y explicadas por personas: la razón es lo que las hace valiosas.
«A aporta la historia humana y el contexto que hacen comprensible por qué importan los problemas de alineamiento; B traduce esa intuición en ejemplos técnicos y argumentos de ingeniería (reward hacking, especificación, convergencia) que muestran cómo medir y abordar esos riesgos.»
MIMarco Ibáñez
La mejor crónica periodística del alineamiento, contada por sus protagonistasLibro«El canal te da modelos claros y ejemplos memorables sobre problemas prácticos de alineamiento —especificación de objetivos, reward hacking, convergencia instrumental—; el podcast convierte esas intuiciones en discusión profunda con investigadores, datos y debates normativos, mostrando evidencias, desacuerdos y consecuencias políticas.»
MIMarco Ibáñez
El podcast que se toma en serio la pregunta de si la IA saldrá bien o malPodcast«Después de entender con Miles los conceptos y ejemplos que hacen evidente el problema, el foro te da acceso a las discusiones técnicas originales, críticas puntuales y contraejemplos (RLHF, interpretabilidad, deceptive alignment) que permiten evaluar rigor, matices y vías concretas de investigación.»
MIMarco Ibáñez
El foro donde el alineamiento se discute en serio, años antes de llegar a los papersWeb«Te permite traducir la apuesta estratégica y epistemológica de Anthropic a vectores de fallo concretos (especificación, reward hacking, convergencia instrumental) que hay que demostrar controlables; esencial para juzgar si “construir para hacer seguro” es factible.»
MIMarco IbáñezAnthropic pone por escrito su apuesta: quizá construir IA sea la forma de hacerla seguraArtículo