Episode 103 - Speed Up Inference - Speculative Decoding episode artwork

EPISODE · Nov 29, 2023 · 30 MIN

Episode 103 - Speed Up Inference - Speculative Decoding

from Knowledge Science - Alles über KI, ML und NLP · host Sigurd Schacht, Carsten Lanquillon

Send us Fan MailIn der heutigen Sendung sprechen wir über Speculative Decoding, eine Methode, mit der die Inferenzzeit um den Faktor 2 - 2,4x beschleunigt werden kann. Wie das Verfahren funktioniert und welche Möglichkeiten es schafft, erfahren Sie in dieser Sendung. Bleiben Sie dran. Vielen Dank auch an unseren Sponsor XL2: XL2 ist ein Joint Venture von Audi und Capgemini, dass die digitale Transformation in der Automobilindustrie vorantreibt. Das Unternehmen erarbeitet innovative End-to-End-Prozesse und implementiert maßgeschneiderte IT-Lösungen für seine Kunden.Support the show

Episode metadata supplied by the publisher feed · Published Nov 29, 2023

Embed this episode

NOW PLAYING

Episode 103 - Speed Up Inference - Speculative Decoding

0:00 30:13

No transcript for this episode yet

We transcribe on demand. Request one and we'll notify you when it's ready — usually under 10 minutes.

No similar episodes found.

No similar podcasts found.

Frequently Asked Questions

How long is this episode of Knowledge Science - Alles über KI, ML und NLP?

This episode is 30 minutes long.

When was this Knowledge Science - Alles über KI, ML und NLP episode published?

This episode was published on November 29, 2023.

Can I download this Knowledge Science - Alles über KI, ML und NLP episode?

Yes. Use the download control on the episode player to save the publisher-provided media file.
URL copied to clipboard!