KV Cache: el reto de guardar conversaciones de 100GB episode artwork

EPISODE · Jun 13, 2026 · 1H 1M

KV Cache: el reto de guardar conversaciones de 100GB

from La TERTULia de la Inteligencia Artificial

La KV Cache se ha convertido en uno de los grandes retos para escalar los LLMs: guardar el contexto de una conversación no significa almacenar texto, sino enormes tensores por cada token y capa del modelo. A partir de ahí aparece el verdadero problema: una conversación larga puede ocupar decenas o cientos de GB, saturar la VRAM de las GPUs y obligar a diseñar sistemas capaces de paginar, compartir, mover y reutilizar esa caché entre GPU, RAM, SSD y red. La idea central: los LLMs modernos no escalan solo con más cálculo, sino gestionando una memoria gigantesca de la forma más inteligente posible. Participan en la tertulia: Paco Zamora, Josu Gorostegui y Guillermo Barbadillo. Recuerda que puedes enviarnos dudas, comentarios y sugerencias en: https://x.com/TERTUL_ia Más info en: https://ironbar.github.io/tertulia_inteligencia_artificial/

Episode metadata supplied by the publisher feed · Published Jun 13, 2026

Embed this episode

NOW PLAYING

KV Cache: el reto de guardar conversaciones de 100GB

0:00 1:01:56

No transcript for this episode yet

We transcribe on demand. Request one and we'll notify you when it's ready — usually under 10 minutes.

No similar episodes found.

No similar podcasts found.

Frequently Asked Questions

How long is this episode of La TERTULia de la Inteligencia Artificial?

This episode is 1 hour and 1 minute long.

When was this La TERTULia de la Inteligencia Artificial episode published?

This episode was published on June 13, 2026.

Can I download this La TERTULia de la Inteligencia Artificial episode?

Yes. Use the download control on the episode player to save the publisher-provided media file.
URL copied to clipboard!