ML Workload Runs 30x Faster w AVX-512https://parallelprogrammer.substack.com/p/quantizing-to-nf4-with-avx-512 by ryandotsmith • 9 months ago 3 1 9 months agoPAparallelprogrammer.substack.com