La mejor crónica periodística del alineamiento, contada por sus protagonistas
Christian hace algo poco frecuente: cuenta el alineamiento como historia humana, con entrevistas a quienes descubrieron los sesgos de word2vec o inventaron el RLHF, en vez de como especulación filosófica. Es el libro que regalo cuando alguien me pregunta si lo de la seguridad en IA va en serio. Rigor técnico y narrativa, un equilibrio rarísimo en este género.
Brian Christian · Wikipedia
MIMarco IbáñezConexiones
Trazadas y explicadas por personas: la razón es lo que las hace valiosas.
«Christian aporta el trasfondo humano y técnico —cómo y por qué surgieron sesgos y prácticas como word2vec o RLHF—; Russell ofrece una reformulación práctica (máquinas inseguras que aprenden observándonos) para evaluar soluciones. Juntas dan contexto real y un marco para juzgar propuestas.»
MIMarco Ibáñez
Russell propone máquinas que duden de lo que queremos, y ahí está todo el matizLibro«A aporta la historia humana y el contexto que hacen comprensible por qué importan los problemas de alineamiento; B traduce esa intuición en ejemplos técnicos y argumentos de ingeniería (reward hacking, especificación, convergencia) que muestran cómo medir y abordar esos riesgos.»
MIMarco IbáñezEl canal que explica por qué alinear una IA es más difícil de lo que pareceVídeo