Skip to content

feat(quantization): add native SM110 MXFP6 - #1759

Merged
AlpinDale merged 1 commit into
mainfrom
feat/native-mxfp6-sm110
Aug 2, 2026
Merged

feat(quantization): add native SM110 MXFP6#1759
AlpinDale merged 1 commit into
mainfrom
feat/native-mxfp6-sm110

Conversation

@AlpinDale

@AlpinDale AlpinDale commented Aug 2, 2026

Copy link
Copy Markdown
Member

Maybe works on SM100 too, haven't tested yet.

Screenshot 2026-08-02 at 7 28 30 AM

It's online quantization, so you can directly load a regular BF16 model in MXFP6 format, for example:

aphrodite run Qwen/Qwen3.5-4B -q mxfp6

There's more options for leaving certain modules unquantized, etc. See the documentation for more details.

Signed-off-by: AlpinDale <alpindale@gmail.com>
@AlpinDale
AlpinDale merged commit d8830f7 into main Aug 2, 2026
2 checks passed
@AlpinDale
AlpinDale deleted the feat/native-mxfp6-sm110 branch August 2, 2026 03:03
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant