|
2 | 2 | - &pocket-35b |
3 | 3 | name: "pocket-35b" |
4 | 4 | variants: |
| 5 | + - model: pocket-35b-q3 |
5 | 6 | - model: pocket-35b-q2 |
6 | 7 | - model: pocket-35b-iq1 |
7 | 8 | url: "github:mudler/LocalAI/gallery/virtual.yaml@master" |
|
38 | 39 | - filename: llama-cpp/models/FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q4_K_M.gguf |
39 | 40 | sha256: 6f479f637c8fb932df39b9cfabdc454568eee48c0e7c0584e1815a27558e8ffe |
40 | 41 | uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q4_K_M.gguf |
| 42 | +- !!merge <<: *pocket-35b |
| 43 | + name: "pocket-35b-q3" |
| 44 | + variants: [] |
| 45 | + description: | |
| 46 | + POCKET-35B is an Apache-2.0 Qwen3.5-family mixture-of-experts model from |
| 47 | + FINAL-Bench/VIDRAFT, derived from Darwin-36B-Opus and packaged for stock |
| 48 | + llama.cpp. This entry uses the balanced Q3_K_M GGUF quantization. |
| 49 | + overrides: |
| 50 | + backend: llama-cpp |
| 51 | + function: |
| 52 | + automatic_tool_parsing_fallback: true |
| 53 | + grammar: |
| 54 | + disable: true |
| 55 | + known_usecases: |
| 56 | + - chat |
| 57 | + options: |
| 58 | + - use_jinja:true |
| 59 | + parameters: |
| 60 | + model: llama-cpp/models/FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q3_K_M.gguf |
| 61 | + template: |
| 62 | + use_tokenizer_template: true |
| 63 | + files: |
| 64 | + - filename: llama-cpp/models/FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q3_K_M.gguf |
| 65 | + sha256: 9ab4184f0f5af0cc1cf8eee7e553664b692c3f837a8868c4a16137bb3a3c97a2 |
| 66 | + uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q3_K_M.gguf |
41 | 67 | - !!merge <<: *pocket-35b |
42 | 68 | name: "pocket-35b-q2" |
43 | 69 | variants: [] |
|
4988 | 5014 | - filename: mmproj-F16.gguf |
4989 | 5015 | sha256: 6edcca228213c28d3567a35d22f849eea52d8360875093851959adf5d2f270eb |
4990 | 5016 | uri: https://huggingface.co/unsloth/gemma-4-31B-it-GGUF/resolve/main/mmproj-F16.gguf |
4991 | | -- &pocket-35b |
4992 | | - name: pocket-35b-q4-k-m |
4993 | | - url: github:mudler/LocalAI/gallery/virtual.yaml@master |
4994 | | - urls: |
4995 | | - - https://huggingface.co/FINAL-Bench/Darwin-36B-Opus |
4996 | | - - https://huggingface.co/FINAL-Bench/POCKET-35B-GGUF |
4997 | | - description: | |
4998 | | - POCKET-35B is an Apache-2.0 Qwen3.5-family sparse MoE model derived from |
4999 | | - Darwin-36B-Opus. Its official GGUF ladder spans Q4_K_M, Q3_K_M, Q2_K, and |
5000 | | - IQ1_M so LocalAI can select a build for the available memory. All builds run |
5001 | | - with the stock llama.cpp backend. |
5002 | | - license: apache-2.0 |
5003 | | - icon: https://huggingface.co/FINAL-Bench/POCKET-35B-GGUF/resolve/main/pocket_hero.svg |
5004 | | - tags: |
5005 | | - - llm |
5006 | | - - gguf |
5007 | | - - gpu |
5008 | | - - cpu |
5009 | | - - qwen |
5010 | | - - qwen3.5 |
5011 | | - - moe |
5012 | | - last_checked: "2026-07-29" |
5013 | | - overrides: |
5014 | | - backend: llama-cpp |
5015 | | - known_usecases: |
5016 | | - - chat |
5017 | | - options: |
5018 | | - - use_jinja:true |
5019 | | - parameters: |
5020 | | - model: POCKET-35B-Q4_K_M.gguf |
5021 | | - template: |
5022 | | - use_tokenizer_template: true |
5023 | | - files: |
5024 | | - - filename: POCKET-35B-Q4_K_M.gguf |
5025 | | - uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q4_K_M.gguf |
5026 | | - sha256: 6f479f637c8fb932df39b9cfabdc454568eee48c0e7c0584e1815a27558e8ffe |
5027 | | - variants: |
5028 | | - - model: pocket-35b-q3-k-m |
5029 | | - - model: pocket-35b-q2-k |
5030 | | - - model: pocket-35b-iq1-m |
5031 | | -- !!merge <<: *pocket-35b |
5032 | | - name: pocket-35b-q3-k-m |
5033 | | - overrides: |
5034 | | - backend: llama-cpp |
5035 | | - known_usecases: |
5036 | | - - chat |
5037 | | - options: |
5038 | | - - use_jinja:true |
5039 | | - parameters: |
5040 | | - model: POCKET-35B-Q3_K_M.gguf |
5041 | | - template: |
5042 | | - use_tokenizer_template: true |
5043 | | - files: |
5044 | | - - filename: POCKET-35B-Q3_K_M.gguf |
5045 | | - uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q3_K_M.gguf |
5046 | | - sha256: 9ab4184f0f5af0cc1cf8eee7e553664b692c3f837a8868c4a16137bb3a3c97a2 |
5047 | | - variants: [] |
5048 | | -- !!merge <<: *pocket-35b |
5049 | | - name: pocket-35b-q2-k |
5050 | | - overrides: |
5051 | | - backend: llama-cpp |
5052 | | - known_usecases: |
5053 | | - - chat |
5054 | | - options: |
5055 | | - - use_jinja:true |
5056 | | - parameters: |
5057 | | - model: POCKET-35B-Q2_K.gguf |
5058 | | - template: |
5059 | | - use_tokenizer_template: true |
5060 | | - files: |
5061 | | - - filename: POCKET-35B-Q2_K.gguf |
5062 | | - uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-Q2_K.gguf |
5063 | | - sha256: 2567ed710fb5b5bdf0df99ecfa241ab1a2b35edc618d2830b91d468e3a3ce191 |
5064 | | - variants: [] |
5065 | | -- !!merge <<: *pocket-35b |
5066 | | - name: pocket-35b-iq1-m |
5067 | | - overrides: |
5068 | | - backend: llama-cpp |
5069 | | - known_usecases: |
5070 | | - - chat |
5071 | | - options: |
5072 | | - - use_jinja:true |
5073 | | - parameters: |
5074 | | - model: POCKET-35B-IQ1_M.gguf |
5075 | | - template: |
5076 | | - use_tokenizer_template: true |
5077 | | - files: |
5078 | | - - filename: POCKET-35B-IQ1_M.gguf |
5079 | | - uri: huggingface://FINAL-Bench/POCKET-35B-GGUF/POCKET-35B-IQ1_M.gguf |
5080 | | - sha256: c56c77d158786f6dfb084e8cf3467456668e400cc7632c366cc0444b9f8565a1 |
5081 | | - variants: [] |
5082 | 5017 | - name: qwen3.5-35b-a3b-apex |
5083 | 5018 | url: github:mudler/LocalAI/gallery/virtual.yaml@master |
5084 | 5019 | urls: |
|
0 commit comments