qwen3_5_moe (MODEL_QWEN3_5_MOE)
Linear-attention layers + MoE FFN. Separate enum from dense MODEL_QWEN3_5 (decision 4).
Spec: doc/plans/engine-inference-core.md § E3
Part of: #106 (E3) · Epic: #56
Depends on: E1 MoE block (#104); hybrid cache + unified gate
Tasks
Notes
- Do not collapse with
MODEL_QWEN3_5 dense
qwen3_5_moe (
MODEL_QWEN3_5_MOE)Linear-attention layers + MoE FFN. Separate enum from dense
MODEL_QWEN3_5(decision 4).Spec:
doc/plans/engine-inference-core.md§ E3Part of: #106 (E3) · Epic: #56
Depends on: E1 MoE block (#104); hybrid cache + unified gate
Tasks
LinearAttnWeightsfwd_moeweights_expected_names()forMODEL_QWEN3_5_MOENotes
MODEL_QWEN3_5dense