El polémico informe de Microsoft que vio chispas de AGI en GPT-4
Ciento cincuenta páginas de investigadores de Microsoft jugando con GPT-4 antes de su lanzamiento: unicornios dibujados en TikZ, teoría de la mente, matemáticas improvisadas. Es metodológicamente discutible —y por eso mismo interesante—, porque plantea si se puede evaluar la inteligencia con anécdotas. Yo lo leo como diario de campo de gente sinceramente desconcertada por lo que tenía delante.
Sébastien Bubeck et al. · arXiv
MIMarco IbáñezConexiones
Trazadas y explicadas por personas: la razón es lo que las hace valiosas.
«Ir de A a B muestra la transición de una tesis técnica y escalado controlado (GPT‑3: in‑context learning sin reentrenar) a efectos emergentes en GPT‑4 que se examinan con anécdotas y desconcierto; ayuda a calibrar cómo hipótesis de laboratorio se convierten en problemas prácticos y metodológicos.»
MIMarco IbáñezEl paper de GPT-3: cuando escalar dejó de ser fuerza bruta y empezó a ser tesisPDF
«Leer A tras B muestra la continuidad: el ensayo de Gwern articula la apuesta teórica por que la inteligencia surge al escalar predicción, y el informe de Microsoft ofrece viñetas experimentales que parecen dar evidencia —y al mismo tiempo plantear dudas metodológicas— sobre esa apuesta.»
MIMarco Ibáñez
El ensayo maximalista que defendió escalar cuando escalar aún parecía una locuraArtículo«B explica cómo la escala produce habilidades emergentes de forma rigurosa; A aporta notas de campo y ejemplos anecdóticos que muestran cómo esas emergencias se manifiestan e interpretan en la práctica, revelando límites de evaluación y el riesgo de sobregeneralizar hacia "AGI".»
MIMarco IbáñezGPT-3: el paper que mostró que la escala, por sí sola, compra habilidades nuevasPDF