Skip to content

mimo : support dflash (convert + feature extraction) - #29650

Merged
ggerganov merged 2 commits into
masterfrom
gg/mimo-dflash-v2
Sep 30, 2026
Merged

ggerganov merged 2 commits into
masterfrom
gg/mimo-dflash-v2

Conversation

@ggerganov

@ggerganov ggerganov commented Sep 29, 2026 •

Copy link
Copy Markdown
Member

Overview

Add support for MiMo v2.6 DFlash. Based on notes from https://huggingface.co/TrevorJS/MiMo-V2.6-Flash-RL-GGUF + help from @am17an.

Currently works with CUDA, but the Metal backend produces NaN - to be investigated. Edit: the Metal issues are unrelated -> will be fixed in follow-up PR

Models: https://huggingface.co/ggml-org/MiMo-V2.6-Flash-MOPD-GGUF

Requirements

@github-actions github-actions Bot added model Model specific conversion labels Sep 29, 2026
@ggerganov
ggerganov marked this pull request as ready for review September 29, 2026 16:16
@ggerganov
ggerganov requested a review from CISC as a code owner September 29, 2026 16:16
Comment thread conversion/base.py
prefix = "model" if not self.is_mistral_format else "consolidated"
part_names: list[str] = ModelBase.get_model_part_names(self.dir_model, prefix, ".safetensors")
is_safetensors: bool = len(part_names) > 0
is_safetensors: bool = len(part_names) > 0 or (not self.is_mistral_format and (self.dir_model / "model.safetensors.index.json").is_file())

Copy link
Copy Markdown
Member

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

We should come up with something more clever, but I like this for now.

Comment thread conversion/qwen.py Outdated
Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@huggingface.co>
@ggerganov
ggerganov merged commit 22bdcc4 into master Sep 30, 2026
20 of 22 checks passed
@ggerganov
ggerganov deleted the gg/mimo-dflash-v2 branch September 30, 2026 14:05
pierreguillot pushed a commit to Ircam-Partiels/llama.cpp that referenced this pull request Oct 1, 2026
* convert : update to support dflash

* cont : fix

Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@huggingface.co>

---------

Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@huggingface.co>
frostyautumnleaf pushed a commit to frostyautumnleaf/llama.cpp that referenced this pull request Oct 5, 2026
* convert : update to support dflash

* cont : fix

Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@huggingface.co>

---------

Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@huggingface.co>
edwardyoon pushed a commit to edwardyoon/focus-llama that referenced this pull request Oct 7, 2026
* convert : update to support dflash

* cont : fix

Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@huggingface.co>

---------

Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@huggingface.co>
(cherry picked from commit 22bdcc4)
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

conversion model Model specific

Projects

None yet

Development

Successfully merging this pull request may close these issues.

2 participants