软件内支持高速下载本地前沿模型
支持 HuggingFace 与 ModelScope 双源本地模型,以及众多国内外云端模型服务商
Qwen 3.5 0.8B (中文更佳)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL
极速轻量文本模型,适合低配及 CPU 环境,中文分析表现均衡。
Qwen 3.5 0.8B (轻量识图)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
极致运行速度,适合极低配置环境,且支持图片分析,欠精准。
LFM2.5 2.6B(越狱)
Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M
LFM2.5 2.6B 去限制无审查版本,平衡速度与质量。
Gemma 4 E4B-it(支持音频)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
谷歌的原版量化版本,支持文本、图像和音频分析。
Qwen 3.5 4B(平衡)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
去限制版本(Abliterated)平衡速度与质量。
Qwen 3.5 2B(较好)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
4G显存首选。
Qwen 3.5 2B(日语优化)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
日语数据集优化的文本分析模型,仅支持文本分析。
Qwen 3.5 2B(越狱文本)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
对内容有一定理解能力的越狱模型。
MiniCPM-V 4.6 (识图小钢炮)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
顶级端侧多模态模型,在 OCR、物体识别、复杂场景理解方面表现极其优异。
Gemma 4 E2B-it QAT MTP(全能-高速)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
全能力,外加MTP技术提速,目前为止不二之选的模型。
MiniCPM5 1B Claude微调(思维链)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
基于Claude Opus Fable5数据集微调的MiniCPM5-1B,支持思维链推理,擅长编程和指令遵循。
Nanbeige 4.2 3B(超越9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
3B身材硬钢9B,强列推荐,但仅支持文本。
Nanbeige 4.2 3B(越狱-优化)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B身材硬钢9B,越狱版i1量化精度更高,但仅支持文本。
Gemma 3 1B Instruct(基础)
unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL
英文小模型翘楚
LFM2.5 8B A1B(越狱)
gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M
LFM2.5 8B A1B MoE 无审查版本,仅 1B 激活参数,速度与质量均衡。
Bonsai 27B 1-bit(超级压缩)
dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0
Bonsai 27B 一比特量化越狱版本,去对齐无审查,支持文本与图像分析。
Qwen 3.8 27B(最强-越狱)
JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M
Qwen3.8-27B 无审查量化版本,保留 MTP 多头预测,支持文本与图像分析。
Qwen 3.8 2B(蒸馏)
empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M
Qwen3.8 蒸馏版,极致运行速度,仅支持文本分析。
Qwen 3.8 9B(蒸馏)
empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M
Qwen3.8 蒸馏版,继承大模型深度推理能力,仅支持文本分析。
Ornith 1.5 9B(顶级)
ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M
Ornith 1.5 多模态模型,支持文本与图像分析。
Spark X2.5 1.7B(轻量)
XHToken/Spark-X2.5-1.7B-GGUF
Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。