Skip to content

Commit 314a824

Browse files
gallery: consolidate POCKET-35B variants (#11249)
Keep the canonical POCKET-35B family, add its missing Q3_K_M build, and remove the duplicate artifact entries introduced by overlapping gallery additions. Assisted-by: Codex:gpt-5 [web] Co-authored-by: localai-org-maint-bot <306269227+localai-org-maint-bot@users.noreply.github.com>
1 parent b60b01d commit 314a824

1 file changed

Lines changed: 26 additions & 91 deletions

File tree

gallery/index.yaml

Lines changed: 26 additions & 91 deletions
Original file line numberDiff line numberDiff line change
@@ -2,6 +2,7 @@
22
- &pocket-35b
33
name: "pocket-35b"
44
variants:
5+
- model: pocket-35b-q3
56
- model: pocket-35b-q2
67
- model: pocket-35b-iq1
78
url: "github:mudler/LocalAI/gallery/virtual.yaml@master"
@@ -38,6 +39,31 @@
3839
- filename: llama-cpp/models/FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q4_K_M.gguf
3940
sha256: 6f479f637c8fb932df39b9cfabdc454568eee48c0e7c0584e1815a27558e8ffe
4041
uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q4_K_M.gguf
42+
- !!merge <<: *pocket-35b
43+
name: "pocket-35b-q3"
44+
variants: []
45+
description: |
46+
POCKET-35B is an Apache-2.0 Qwen3.5-family mixture-of-experts model from
47+
FINAL-Bench/VIDRAFT, derived from Darwin-36B-Opus and packaged for stock
48+
llama.cpp. This entry uses the balanced Q3_K_M GGUF quantization.
49+
overrides:
50+
backend: llama-cpp
51+
function:
52+
automatic_tool_parsing_fallback: true
53+
grammar:
54+
disable: true
55+
known_usecases:
56+
- chat
57+
options:
58+
- use_jinja:true
59+
parameters:
60+
model: llama-cpp/models/FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q3_K_M.gguf
61+
template:
62+
use_tokenizer_template: true
63+
files:
64+
- filename: llama-cpp/models/FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q3_K_M.gguf
65+
sha256: 9ab4184f0f5af0cc1cf8eee7e553664b692c3f837a8868c4a16137bb3a3c97a2
66+
uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q3_K_M.gguf
4167
- !!merge <<: *pocket-35b
4268
name: "pocket-35b-q2"
4369
variants: []
@@ -4988,97 +5014,6 @@
49885014
- filename: mmproj-F16.gguf
49895015
sha256: 6edcca228213c28d3567a35d22f849eea52d8360875093851959adf5d2f270eb
49905016
uri: https://huggingface.co/unsloth/gemma-4-31B-it-GGUF/resolve/main/mmproj-F16.gguf
4991-
- &pocket-35b
4992-
name: pocket-35b-q4-k-m
4993-
url: github:mudler/LocalAI/gallery/virtual.yaml@master
4994-
urls:
4995-
- https://huggingface.co/FINAL-Bench/Darwin-36B-Opus
4996-
- https://huggingface.co/FINAL-Bench/POCKET-35B-GGUF
4997-
description: |
4998-
POCKET-35B is an Apache-2.0 Qwen3.5-family sparse MoE model derived from
4999-
Darwin-36B-Opus. Its official GGUF ladder spans Q4_K_M, Q3_K_M, Q2_K, and
5000-
IQ1_M so LocalAI can select a build for the available memory. All builds run
5001-
with the stock llama.cpp backend.
5002-
license: apache-2.0
5003-
icon: https://huggingface.co/FINAL-Bench/POCKET-35B-GGUF/resolve/main/pocket_hero.svg
5004-
tags:
5005-
- llm
5006-
- gguf
5007-
- gpu
5008-
- cpu
5009-
- qwen
5010-
- qwen3.5
5011-
- moe
5012-
last_checked: "2026-07-29"
5013-
overrides:
5014-
backend: llama-cpp
5015-
known_usecases:
5016-
- chat
5017-
options:
5018-
- use_jinja:true
5019-
parameters:
5020-
model: POCKET-35B-Q4_K_M.gguf
5021-
template:
5022-
use_tokenizer_template: true
5023-
files:
5024-
- filename: POCKET-35B-Q4_K_M.gguf
5025-
uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q4_K_M.gguf
5026-
sha256: 6f479f637c8fb932df39b9cfabdc454568eee48c0e7c0584e1815a27558e8ffe
5027-
variants:
5028-
- model: pocket-35b-q3-k-m
5029-
- model: pocket-35b-q2-k
5030-
- model: pocket-35b-iq1-m
5031-
- !!merge <<: *pocket-35b
5032-
name: pocket-35b-q3-k-m
5033-
overrides:
5034-
backend: llama-cpp
5035-
known_usecases:
5036-
- chat
5037-
options:
5038-
- use_jinja:true
5039-
parameters:
5040-
model: POCKET-35B-Q3_K_M.gguf
5041-
template:
5042-
use_tokenizer_template: true
5043-
files:
5044-
- filename: POCKET-35B-Q3_K_M.gguf
5045-
uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q3_K_M.gguf
5046-
sha256: 9ab4184f0f5af0cc1cf8eee7e553664b692c3f837a8868c4a16137bb3a3c97a2
5047-
variants: []
5048-
- !!merge <<: *pocket-35b
5049-
name: pocket-35b-q2-k
5050-
overrides:
5051-
backend: llama-cpp
5052-
known_usecases:
5053-
- chat
5054-
options:
5055-
- use_jinja:true
5056-
parameters:
5057-
model: POCKET-35B-Q2_K.gguf
5058-
template:
5059-
use_tokenizer_template: true
5060-
files:
5061-
- filename: POCKET-35B-Q2_K.gguf
5062-
uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q2_K.gguf
5063-
sha256: 2567ed710fb5b5bdf0df99ecfa241ab1a2b35edc618d2830b91d468e3a3ce191
5064-
variants: []
5065-
- !!merge <<: *pocket-35b
5066-
name: pocket-35b-iq1-m
5067-
overrides:
5068-
backend: llama-cpp
5069-
known_usecases:
5070-
- chat
5071-
options:
5072-
- use_jinja:true
5073-
parameters:
5074-
model: POCKET-35B-IQ1_M.gguf
5075-
template:
5076-
use_tokenizer_template: true
5077-
files:
5078-
- filename: POCKET-35B-IQ1_M.gguf
5079-
uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-IQ1_M.gguf
5080-
sha256: c56c77d158786f6dfb084e8cf3467456668e400cc7632c366cc0444b9f8565a1
5081-
variants: []
50825017
- name: qwen3.5-35b-a3b-apex
50835018
url: github:mudler/LocalAI/gallery/virtual.yaml@master
50845019
urls:

0 commit comments

Comments
 (0)