Skip to content

Commit cba54c5

Browse files
gallery: add grug-27b GGUF variants (#11311)
Assisted-by: Codex:gpt-5 Co-authored-by: localai-org-maint-bot <306269227+localai-org-maint-bot@users.noreply.github.com>
1 parent f951419 commit cba54c5

1 file changed

Lines changed: 109 additions & 0 deletions

File tree

gallery/index.yaml

Lines changed: 109 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -1,4 +1,113 @@
11
---
2+
- &grug-27b
3+
name: "grug-27b"
4+
variants:
5+
- model: grug-27b-q8
6+
- model: grug-27b-mtp
7+
url: "github:mudler/LocalAI/gallery/virtual.yaml@master"
8+
urls:
9+
- https://huggingface.co/ProCreations/grug-27b
10+
- https://huggingface.co/ProCreations/grug-27b-qat-q4-gguf
11+
description: |
12+
Grug 27B is a multimodal Qwen3.5-derived model for chat, reasoning, vision,
13+
and tool use. This entry uses the QAT Q4_K_M GGUF build.
14+
license: "apache-2.0"
15+
tags:
16+
- llm
17+
- gguf
18+
- vision
19+
- multimodal
20+
overrides:
21+
backend: llama-cpp
22+
function:
23+
automatic_tool_parsing_fallback: true
24+
grammar:
25+
disable: true
26+
known_usecases:
27+
- chat
28+
mmproj: llama-cpp/mmproj/grug-27b/mmproj-grug-27b-f16.gguf
29+
options:
30+
- use_jinja:true
31+
parameters:
32+
model: llama-cpp/models/grug-27b/grug-27b-qat-Q4_K_M.gguf
33+
template:
34+
use_tokenizer_template: true
35+
files:
36+
- filename: llama-cpp/models/grug-27b/grug-27b-qat-Q4_K_M.gguf
37+
uri: huggingface://ProCreations/grug-27b-qat-q4-gguf/grug-27b-qat-Q4_K_M.gguf
38+
sha256: 777df9862d6e884ce006a5b13f77f99b56a4dd7c79bf1386af8a826875d7223e
39+
- filename: llama-cpp/mmproj/grug-27b/mmproj-grug-27b-f16.gguf
40+
uri: huggingface://ProCreations/grug-27b-gguf/mmproj-grug-27b-f16.gguf
41+
sha256: abec0c68ae222300197d247bc9bb2e72f0e7b285d38eb49265a2fc28c952550d
42+
- !!merge <<: *grug-27b
43+
name: "grug-27b-q8"
44+
variants: []
45+
urls:
46+
- https://huggingface.co/ProCreations/grug-27b
47+
- https://huggingface.co/ProCreations/grug-27b-gguf
48+
description: |
49+
Grug 27B Q8 is the higher-precision Q8_0 GGUF build for multimodal chat,
50+
reasoning, vision, and tool use.
51+
overrides:
52+
backend: llama-cpp
53+
function:
54+
automatic_tool_parsing_fallback: true
55+
grammar:
56+
disable: true
57+
known_usecases:
58+
- chat
59+
mmproj: llama-cpp/mmproj/grug-27b-q8/mmproj-grug-27b-f16.gguf
60+
options:
61+
- use_jinja:true
62+
parameters:
63+
model: llama-cpp/models/grug-27b-q8/grug-27b-Q8_0.gguf
64+
template:
65+
use_tokenizer_template: true
66+
files:
67+
- filename: llama-cpp/models/grug-27b-q8/grug-27b-Q8_0.gguf
68+
uri: huggingface://ProCreations/grug-27b-gguf/grug-27b-Q8_0.gguf
69+
sha256: fe2714d8770ef1b5fe4cd960d07e781fabf6f4bd028c3d202cb512565202187f
70+
- filename: llama-cpp/mmproj/grug-27b-q8/mmproj-grug-27b-f16.gguf
71+
uri: huggingface://ProCreations/grug-27b-gguf/mmproj-grug-27b-f16.gguf
72+
sha256: abec0c68ae222300197d247bc9bb2e72f0e7b285d38eb49265a2fc28c952550d
73+
- !!merge <<: *grug-27b
74+
name: "grug-27b-mtp"
75+
variants: []
76+
urls:
77+
- https://huggingface.co/ProCreations/grug-27b
78+
- https://huggingface.co/ProCreations/grug-27b-mtp-gguf
79+
description: |
80+
Grug 27B MTP is the Q4_K_M GGUF build with multi-token prediction enabled
81+
for speculative decoding, plus the shared vision projector.
82+
tags:
83+
- llm
84+
- gguf
85+
- vision
86+
- multimodal
87+
- mtp
88+
overrides:
89+
backend: llama-cpp
90+
function:
91+
automatic_tool_parsing_fallback: true
92+
grammar:
93+
disable: true
94+
known_usecases:
95+
- chat
96+
mmproj: llama-cpp/mmproj/grug-27b-mtp/mmproj-grug-27b-f16.gguf
97+
options:
98+
- use_jinja:true
99+
- spec_type:draft-mtp
100+
parameters:
101+
model: llama-cpp/models/grug-27b-mtp/grug-27b-mtp-Q4_K_M.gguf
102+
template:
103+
use_tokenizer_template: true
104+
files:
105+
- filename: llama-cpp/models/grug-27b-mtp/grug-27b-mtp-Q4_K_M.gguf
106+
uri: huggingface://ProCreations/grug-27b-mtp-gguf/grug-27b-mtp-Q4_K_M.gguf
107+
sha256: 9442fabb262a54e4a3441ce00e764b6dd334c7ee57548ef86b274eeedb30b0b4
108+
- filename: llama-cpp/mmproj/grug-27b-mtp/mmproj-grug-27b-f16.gguf
109+
uri: huggingface://ProCreations/grug-27b-gguf/mmproj-grug-27b-f16.gguf
110+
sha256: abec0c68ae222300197d247bc9bb2e72f0e7b285d38eb49265a2fc28c952550d
2111
- name: "deepseek-v4-flash-0731"
3112
url: "github:mudler/LocalAI/gallery/virtual.yaml@master"
4113
urls:

0 commit comments

Comments
 (0)