Fast NF4 Dequantization Kernels for Large Language Model InferencePublished in EMC2 Workshop, 2026, 2026Share on Bluesky Facebook LinkedIn Mastodon X (formerly Twitter) Previous Next