EPISODE · Oct 30, 2025 · 38 MIN
Fast Inference e Serving con vLLM #70
from Intervista Pythonista · host Python Milano
Conosciamo Nicolò Lucchesi, Senior Machine Learning Engineer presso Red Hat, e il suo lavoro su vLLM e l'ottimizzazione delle performance. Nicolò condivide la sua esperienza nel campo dell'AI e del Machine Learning, spiegando l'importanza di strumenti come Paged Attention e le sfide legate all'integrazione di nuovi modelli. Viene anche discusso il ruolo della community e le tecnologie utilizzate nel progetto vLLM, oltre a tendenze emergenti nel settore.
What this episode covers
Conosciamo Nicolò Lucchesi, Senior Machine Learning Engineer presso Red Hat, e il suo lavoro su vLLM e l'ottimizzazione delle performance. Nicolò condivide la sua esperienza nel campo dell'AI e del Machine Learning, spiegando l'importanza di strumenti come Paged Attention e le sfide legate all'integrazione di nuovi modelli. Viene anche discusso il ruolo della community e le tecnologie utilizzate nel progetto vLLM, oltre a tendenze emergenti nel settore.
NOW PLAYING
Fast Inference e Serving con vLLM #70
No transcript for this episode yet
Similar Episodes
Jul 22, 2026 ·18m
Jul 21, 2026 ·18m
Jul 21, 2026 ·31m
Jul 20, 2026 ·30m
Jul 20, 2026 ·18m
Jul 19, 2026 ·18m