Post-transformer inference: 224× compression of Llama-70B with improved accuracyhttps://zenodo.org/records/17873275 by anima-core • 8 months ago 72 56 8 months agoZEzenodo.org