Dieciocho modelos frontier. Ciento cincuenta y tres experimentos autónomos. Ocho días sin interrupción, sin internet, sin pistas externas. Al final de la mayor prueba pública de investigación autónoma con IA hasta la fecha, el mejor modelo — Claude Fable 5 — llegó al 82% del camino hacia un récord establecido por docenas de investigadores humanos durante meses. Ningún modelo inventó una sola técnica que no estuviera ya en la literatura publicada. Continúa leyendo «La IA cierra el 82% del gap con los mejores investigadores humanos — pero el 1% que falta lo cambia todo»