El modelo que encabeza hoy el índice AA-Omniscience de Artificial Analysis, Claude Opus 5.5, acierta el 66 % de las preguntas de hechos concretos cuando no puede buscar en internet. El resto se reparte entre errores y respuestas del tipo «no lo sé». Ese dato explica por qué todos los asistentes de IA salen a la web cuando necesitan precisión, y por qué las páginas que encuentran ahí siguen importando. Continúa leyendo «Ni el mejor modelo de IA se sabe las respuestas: acierta el 66 % sin buscar en la web, y por eso el SEO sigue vivo»
Etiqueta: benchmarks
El papel de ChatGPT en la mejora de la Inteligencia Artificial
La generalización composicional es un concepto que ha ganado terreno en el mundo de la inteligencia artificial (IA). Ahora se ha publicado un estudio que arroja luz sobre cómo ChatGPT puede desempeñar un papel crucial en la mejora de esta área, específicamente en la detección de intenciones abiertas. Continúa leyendo «El papel de ChatGPT en la mejora de la Inteligencia Artificial»