I
Inteligencia Artificial
Nuevo framework de IA promete reducir costes de inferencia un 40%
Un nuevo framework de inferencia afirma recortar hasta un 40% el coste de servir LLMs optimizando atención y caché de tokens. Qué implica y qué falta por demostrar.
4 min de lectura