Vai al contenuto
zarza zarza

Fast Inference e Serving con vLLM #70

30/10/2025 38 min Episodio 70

Ascolta "Fast Inference e Serving con vLLM #70"

Sintesi dell'episodio

Conosciamo Nicolò Lucchesi, Senior Machine Learning Engineer presso Red Hat, e il suo lavoro su vLLM e l'ottimizzazione delle performance. Nicolò condivide la sua esperienza nel campo dell'AI e del Machine Learning, spiegando l'importanza di strumenti come Paged Attention e le sfide legate all'integrazione di nuovi modelli. Viene anche discusso il ruolo della community e le tecnologie utilizzate nel progetto vLLM, oltre a tendenze emergenti nel settore.

ZARZA Studio — La sua radio in onda oggi: libreria, orologio musicale, palinsesto, cabina e rapporti, dal browser.

Scopra ZARZA Studio
in onda adesso radio in catalogo 67.746 podcast paesi