Lossless Acceleration of LLM via Adaptive N-Gram Parallel Decodinghttps://arxiv.org/abs/2404.08698 by PaulHoule • 2 years ago 136 23 2 years agoARarxiv.org