Y
HN Search
Hacker News Search
new
|
comments
|
top
|
jobs
loading thread…
4 ms
·
Accelerating LLM Inference with Parallel Draft Models (PARD)
1 points
by
dhruvdh
1y ago