|
941 | 941 | - filename: llama-cpp/mmproj/inkling-UD-Q4_K_XL/mmproj-BF16.gguf |
942 | 942 | sha256: 662c925e1df293cfba16ffd6bd53dac31d3c73160ba65dff7270d7a70f351e91 |
943 | 943 | uri: https://huggingface.co/unsloth/inkling-GGUF/resolve/main/mmproj-BF16.gguf |
| 944 | +- &inkling-small |
| 945 | + name: "inkling-small" |
| 946 | + url: "github:mudler/LocalAI/gallery/virtual.yaml@master" |
| 947 | + urls: |
| 948 | + - https://huggingface.co/thinkingmachines/Inkling-Small |
| 949 | + - https://huggingface.co/unsloth/Inkling-Small-GGUF |
| 950 | + description: | |
| 951 | + Inkling Small is a 276B-parameter mixture-of-experts multimodal model with 12B active parameters for text, image, and audio understanding, instruction following, coding, and tool use. This entry uses the Q4_K_M GGUF quantization, whose five language-model shards total approximately 162.5 GB. |
| 952 | + license: "apache-2.0" |
| 953 | + tags: |
| 954 | + - llm |
| 955 | + - gguf |
| 956 | + - vision |
| 957 | + - audio |
| 958 | + - multimodal |
| 959 | + overrides: |
| 960 | + backend: llama-cpp |
| 961 | + function: |
| 962 | + automatic_tool_parsing_fallback: true |
| 963 | + grammar: |
| 964 | + disable: true |
| 965 | + known_usecases: |
| 966 | + - chat |
| 967 | + mmproj: llama-cpp/mmproj/Inkling-Small-UD-Q4_K_M/mmproj-BF16.gguf |
| 968 | + options: |
| 969 | + - use_jinja:true |
| 970 | + parameters: |
| 971 | + model: llama-cpp/models/Inkling-Small-UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00001-of-00005.gguf |
| 972 | + template: |
| 973 | + use_tokenizer_template: true |
| 974 | + files: |
| 975 | + - filename: llama-cpp/models/Inkling-Small-UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00001-of-00005.gguf |
| 976 | + sha256: a51ac3f439198f2817219edd582be4b600c273be24e78cbd58ebff982d9f007e |
| 977 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00001-of-00005.gguf |
| 978 | + - filename: llama-cpp/models/Inkling-Small-UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00002-of-00005.gguf |
| 979 | + sha256: 3dccdd473cc3a191e6028f6105b01831ed3a8dc30ec4e02679f9e0c2ccb59671 |
| 980 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00002-of-00005.gguf |
| 981 | + - filename: llama-cpp/models/Inkling-Small-UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00003-of-00005.gguf |
| 982 | + sha256: 1a7edf29bda1d278b4668e1a082d7db634b845a53ea58c918a8cea1f9006c21c |
| 983 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00003-of-00005.gguf |
| 984 | + - filename: llama-cpp/models/Inkling-Small-UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00004-of-00005.gguf |
| 985 | + sha256: 376f67568438da96b10566730e8a9e17e3f665ab1b9d82eba48ec33708b172f7 |
| 986 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00004-of-00005.gguf |
| 987 | + - filename: llama-cpp/models/Inkling-Small-UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00005-of-00005.gguf |
| 988 | + sha256: e34364af0d04d2d295bc374f1a4fa80002e4277db1bcf4b56240dbd443ac21d3 |
| 989 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/UD-Q4_K_M/Inkling-Small-UD-Q4_K_M-00005-of-00005.gguf |
| 990 | + - filename: llama-cpp/mmproj/Inkling-Small-UD-Q4_K_M/mmproj-BF16.gguf |
| 991 | + sha256: 05d4475a956030be87b099865d6552a541a476db8cc3e266fcfa7c5a24846248 |
| 992 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/mmproj-BF16.gguf |
| 993 | + variants: |
| 994 | + - model: inkling-small-iq2-m |
| 995 | +- !!merge <<: *inkling-small |
| 996 | + name: "inkling-small-iq2-m" |
| 997 | + description: | |
| 998 | + Inkling Small is a 276B-parameter mixture-of-experts multimodal model with 12B active parameters for text, image, and audio understanding, instruction following, coding, and tool use. This entry uses the IQ2_M GGUF quantization, whose three language-model shards total approximately 82.4 GB. |
| 999 | + overrides: |
| 1000 | + backend: llama-cpp |
| 1001 | + function: |
| 1002 | + automatic_tool_parsing_fallback: true |
| 1003 | + grammar: |
| 1004 | + disable: true |
| 1005 | + known_usecases: |
| 1006 | + - chat |
| 1007 | + mmproj: llama-cpp/mmproj/Inkling-Small-UD-IQ2_M/mmproj-BF16.gguf |
| 1008 | + options: |
| 1009 | + - use_jinja:true |
| 1010 | + parameters: |
| 1011 | + model: llama-cpp/models/Inkling-Small-UD-IQ2_M/Inkling-Small-UD-IQ2_M-00001-of-00003.gguf |
| 1012 | + template: |
| 1013 | + use_tokenizer_template: true |
| 1014 | + files: |
| 1015 | + - filename: llama-cpp/models/Inkling-Small-UD-IQ2_M/Inkling-Small-UD-IQ2_M-00001-of-00003.gguf |
| 1016 | + sha256: 3b6ace30e488ad26e816cdba4e42714f40110a3142a210bd5c2e48f69e27cb31 |
| 1017 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/UD-IQ2_M/Inkling-Small-UD-IQ2_M-00001-of-00003.gguf |
| 1018 | + - filename: llama-cpp/models/Inkling-Small-UD-IQ2_M/Inkling-Small-UD-IQ2_M-00002-of-00003.gguf |
| 1019 | + sha256: 5ca94e858ae116eb513a2af1facd35844d42ef4a209e1d85cc4ecc73cd21b894 |
| 1020 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/UD-IQ2_M/Inkling-Small-UD-IQ2_M-00002-of-00003.gguf |
| 1021 | + - filename: llama-cpp/models/Inkling-Small-UD-IQ2_M/Inkling-Small-UD-IQ2_M-00003-of-00003.gguf |
| 1022 | + sha256: 8a84e00d4625d52491969f88f24f0999bc77527b7fa1d15cbe44ef88235bb377 |
| 1023 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/UD-IQ2_M/Inkling-Small-UD-IQ2_M-00003-of-00003.gguf |
| 1024 | + - filename: llama-cpp/mmproj/Inkling-Small-UD-IQ2_M/mmproj-BF16.gguf |
| 1025 | + sha256: 05d4475a956030be87b099865d6552a541a476db8cc3e266fcfa7c5a24846248 |
| 1026 | + uri: https://huggingface.co/unsloth/Inkling-Small-GGUF/resolve/main/mmproj-BF16.gguf |
| 1027 | + variants: [] |
944 | 1028 | - name: "qwythos-9b-v2" |
945 | 1029 | url: "github:mudler/LocalAI/gallery/virtual.yaml@master" |
946 | 1030 | urls: |
|
0 commit comments