DeepSeek presenta modelo con atención dispersa para reducir a la mitad los costos de inferencia
La compañía china DeepSeek ha lanzado un modelo experimental llamado V3.2-exp, orientado a optimizar el rendimiento de operaciones en contextos largos, uno de los grandes desafíos técnicos en los modelos de lenguaje actuales. Esta versión introduce un sistema innovador llamado DeepSeek Sparse Attention, cuyo objetivo es minimizar la carga computacional y, con ello, reducir significativamente… <a href="https://wwwhatsnew.com/2025/10/01/deepseek-presenta-modelo-con-atencion-dispersa-para-reducir-a-la-mitad-los-costos-de-inferencia/">Continúa leyendo »</a>