From 00601a429927ed6fb0cd04023a59cb2f2197e190 Mon Sep 17 00:00:00 2001 From: localai-org-maint-bot <306269227+localai-org-maint-bot@users.noreply.github.com> Date: Thu, 30 Jul 2026 00:05:34 +0000 Subject: [PATCH] gallery: add Laguna XS 2.1 GGUF variants Add the official Q4_K_M build and seven APEX quality and size variants for llama.cpp. Assisted-by: Codex:gpt-5 [Hugging Face API] --- gallery/index.yaml | 232 +++++++++++++++++++++++++++++++++++++++++++++ 1 file changed, 232 insertions(+) diff --git a/gallery/index.yaml b/gallery/index.yaml index 9776061a2..0b67ee931 100644 --- a/gallery/index.yaml +++ b/gallery/index.yaml @@ -1080,6 +1080,238 @@ - filename: llama-cpp/models/Gemmable-4-12B-MTP-GGUF/gemmable-4-12b-Q4_K_M-mtp.gguf sha256: 217dc0ed177ecc733f801a851c3e3854cf1b17a1f86cd5430c0a7f82d93027bc uri: https://huggingface.co/Mia-AiLab/Gemmable-4-12B-MTP-GGUF/resolve/main/gemmable-4-12b-Q4_K_M-mtp.gguf +- &laguna-xs-2-1 + name: "laguna-xs-2.1" + url: "github:mudler/LocalAI/gallery/virtual.yaml@master" + variants: + - model: laguna-xs-2.1-apex-i-quality + - model: laguna-xs-2.1-apex-i-balanced + - model: laguna-xs-2.1-apex-i-compact + - model: laguna-xs-2.1-apex-i-mini + - model: laguna-xs-2.1-apex-quality + - model: laguna-xs-2.1-apex-balanced + - model: laguna-xs-2.1-apex-compact + urls: + - https://huggingface.co/poolside/Laguna-XS-2.1 + - https://huggingface.co/poolside/Laguna-XS-2.1-GGUF + - https://huggingface.co/mudler/Laguna-XS-2.1-APEX-GGUF + description: | + Laguna XS 2.1 is Poolside's 33B-parameter, 3B-active Mixture-of-Experts model for agentic coding and long-horizon work on local machines. It supports tool use, interleaved reasoning, and a native 262K-token context window. This default entry uses the official 20.3 GB Q4_K_M GGUF. + + License: OpenMDW 1.1. + license: "other" + icon: https://poolside.ai/assets/laguna/laguna-xs2-1-banner.svg + tags: + - llm + - gguf + - moe + - reasoning + - code + - agent + - tools + - long-context + last_checked: "2026-07-30" + overrides: + backend: llama-cpp + function: + automatic_tool_parsing_fallback: true + grammar: + disable: true + known_usecases: + - chat + - completion + options: + - use_jinja:true + parameters: + model: llama-cpp/models/poolside/Laguna-XS-2.1-GGUF/Laguna-XS-2.1-Q4_K_M.gguf + template: + use_tokenizer_template: true + files: + - filename: llama-cpp/models/poolside/Laguna-XS-2.1-GGUF/Laguna-XS-2.1-Q4_K_M.gguf + sha256: 1ac7079101fca5a6df8c5a7523a3c30ea7d1c0e4b1258090e7d6d4039287f6cb + uri: https://huggingface.co/poolside/Laguna-XS-2.1-GGUF/resolve/main/Laguna-XS-2.1-Q4_K_M.gguf +- !!merge <<: *laguna-xs-2-1 + name: "laguna-xs-2.1-apex-i-quality" + variants: [] + description: | + Laguna XS 2.1 in the 21.8 GB APEX-I Quality format. This is the highest-fidelity importance-matrix APEX build for llama.cpp. + + License: OpenMDW 1.1. + overrides: + backend: llama-cpp + function: + automatic_tool_parsing_fallback: true + grammar: + disable: true + known_usecases: + - chat + - completion + options: + - use_jinja:true + parameters: + model: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-I-Quality.gguf + template: + use_tokenizer_template: true + files: + - filename: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-I-Quality.gguf + sha256: e15e4b9c7c5833c9a58bc70c9745f0cd21e00d4f9edd0c114cd39862ebe545c3 + uri: https://huggingface.co/mudler/Laguna-XS-2.1-APEX-GGUF/resolve/main/Laguna-XS-2.1-APEX-I-Quality.gguf +- !!merge <<: *laguna-xs-2-1 + name: "laguna-xs-2.1-apex-i-balanced" + variants: [] + description: | + Laguna XS 2.1 in the 24.3 GB APEX-I Balanced format, an importance-matrix build balancing fidelity and memory use for llama.cpp. + + License: OpenMDW 1.1. + overrides: + backend: llama-cpp + function: + automatic_tool_parsing_fallback: true + grammar: + disable: true + known_usecases: + - chat + - completion + options: + - use_jinja:true + parameters: + model: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-I-Balanced.gguf + template: + use_tokenizer_template: true + files: + - filename: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-I-Balanced.gguf + sha256: 64f0a1aab7a72121e68f7c2f6814471f0bd4a87130e5d0d8dff3003eb74b5510 + uri: https://huggingface.co/mudler/Laguna-XS-2.1-APEX-GGUF/resolve/main/Laguna-XS-2.1-APEX-I-Balanced.gguf +- !!merge <<: *laguna-xs-2-1 + name: "laguna-xs-2.1-apex-i-compact" + variants: [] + description: | + Laguna XS 2.1 in the 15.8 GB APEX-I Compact format, an importance-matrix build tuned for lower memory use in llama.cpp. + + License: OpenMDW 1.1. + overrides: + backend: llama-cpp + function: + automatic_tool_parsing_fallback: true + grammar: + disable: true + known_usecases: + - chat + - completion + options: + - use_jinja:true + parameters: + model: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-I-Compact.gguf + template: + use_tokenizer_template: true + files: + - filename: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-I-Compact.gguf + sha256: b674541db815d8829e4c57bd56cffebbd49e9822e284e69f199ae7fbd0b705d2 + uri: https://huggingface.co/mudler/Laguna-XS-2.1-APEX-GGUF/resolve/main/Laguna-XS-2.1-APEX-I-Compact.gguf +- !!merge <<: *laguna-xs-2-1 + name: "laguna-xs-2.1-apex-i-mini" + variants: [] + description: | + Laguna XS 2.1 in the 12.8 GB APEX-I Mini format, the smallest importance-matrix APEX build for llama.cpp. + + License: OpenMDW 1.1. + overrides: + backend: llama-cpp + function: + automatic_tool_parsing_fallback: true + grammar: + disable: true + known_usecases: + - chat + - completion + options: + - use_jinja:true + parameters: + model: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-I-Mini.gguf + template: + use_tokenizer_template: true + files: + - filename: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-I-Mini.gguf + sha256: 04d7ccf014da825f20d2d09e996258faf399f3f2176d57fd7ce375b8b8d71de1 + uri: https://huggingface.co/mudler/Laguna-XS-2.1-APEX-GGUF/resolve/main/Laguna-XS-2.1-APEX-I-Mini.gguf +- !!merge <<: *laguna-xs-2-1 + name: "laguna-xs-2.1-apex-quality" + variants: [] + description: | + Laguna XS 2.1 in the 21.8 GB APEX Quality format, the highest-fidelity non-imatrix APEX build for llama.cpp. + + License: OpenMDW 1.1. + overrides: + backend: llama-cpp + function: + automatic_tool_parsing_fallback: true + grammar: + disable: true + known_usecases: + - chat + - completion + options: + - use_jinja:true + parameters: + model: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-Quality.gguf + template: + use_tokenizer_template: true + files: + - filename: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-Quality.gguf + sha256: fd7dba637bcb1c3e1590a9b33c40bd5fe411a1156f6520b14ccd6dfb344feffd + uri: https://huggingface.co/mudler/Laguna-XS-2.1-APEX-GGUF/resolve/main/Laguna-XS-2.1-APEX-Quality.gguf +- !!merge <<: *laguna-xs-2-1 + name: "laguna-xs-2.1-apex-balanced" + variants: [] + description: | + Laguna XS 2.1 in the 24.3 GB APEX Balanced format, balancing fidelity and memory use for llama.cpp. + + License: OpenMDW 1.1. + overrides: + backend: llama-cpp + function: + automatic_tool_parsing_fallback: true + grammar: + disable: true + known_usecases: + - chat + - completion + options: + - use_jinja:true + parameters: + model: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-Balanced.gguf + template: + use_tokenizer_template: true + files: + - filename: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-Balanced.gguf + sha256: 997c6b9de70c594423f21cef07f3ad45944bbbe37a0ee10b4ea20bf094e615fa + uri: https://huggingface.co/mudler/Laguna-XS-2.1-APEX-GGUF/resolve/main/Laguna-XS-2.1-APEX-Balanced.gguf +- !!merge <<: *laguna-xs-2-1 + name: "laguna-xs-2.1-apex-compact" + variants: [] + description: | + Laguna XS 2.1 in the 15.8 GB APEX Compact format, tuned for lower memory use in llama.cpp. + + License: OpenMDW 1.1. + overrides: + backend: llama-cpp + function: + automatic_tool_parsing_fallback: true + grammar: + disable: true + known_usecases: + - chat + - completion + options: + - use_jinja:true + parameters: + model: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-Compact.gguf + template: + use_tokenizer_template: true + files: + - filename: llama-cpp/models/mudler/Laguna-XS-2.1-APEX-GGUF/Laguna-XS-2.1-APEX-Compact.gguf + sha256: cb2604e56eec8037e553cc91a81b454a816695d8443a18a162856fb6d1c8128a + uri: https://huggingface.co/mudler/Laguna-XS-2.1-APEX-GGUF/resolve/main/Laguna-XS-2.1-APEX-Compact.gguf - &laguna-s-2-1-q8 name: "laguna-s-2.1-q8" url: "github:mudler/LocalAI/gallery/virtual.yaml@master"