Skip to content

feat(qwen4_exp): load-time per-tensor FP8 dense projections (W8A8 via _scaled_mm) - #389

Draft
gdevenyi wants to merge 6 commits into
FlashML-org:mainfrom
gdevenyi:feat/qwen4-exp-fp8-dense
Draft

feat(qwen4_exp): load-time per-tensor FP8 dense projections (W8A8 via _scaled_mm)#389
gdevenyi wants to merge 6 commits into
FlashML-org:mainfrom
gdevenyi:feat/qwen4-exp-fp8-dense

Commits

Commits on Sep 4, 2026