Unterstützt im Programm das schnelle Herunterladen modernster lokaler Modelle
Unterstützt lokale Modelle von HuggingFace und ModelScope sowie zahlreiche in- und ausländische Cloud-Modellanbieter
Qwen 3.5 0.8B (Chinesisch ist besser)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL
Extrem schnelles und leichtes Textmodell, geeignet für Low-End- und CPU-Umgebungen, mit ausgewogener chinesischer Analyseleistung.
Qwen 3.5 0.8B (Leichte Bilderkennung)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Extreme Laufgeschwindigkeit, geeignet für Umgebungen mit extrem geringer Konfiguration und unterstützt die Bildanalyse, die weniger genau ist.
LFM2.5 2.6B(Gefängnisausbruch)
Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M
LFM2.5 2.6B ungefilterte Version ohne Zensur, ausgewogen zwischen Geschwindigkeit und Qualität.
Gemma 4 E4B-it(Unterstützt Audio)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
Die ursprüngliche quantifizierte Version von Google, die Text-, Bild- und Audioanalyse unterstützt.
Qwen 3.5 4B(Gleichgewicht)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
Die abgeschwächte Version vereint Geschwindigkeit und Qualität.
Qwen 3.5 2B(Besser)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
4G-Videospeicher ist die erste Wahl.
Qwen 3.5 2B(Japanische Optimierung)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Für japanische Datensätze optimiertes Textanalysemodell, unterstützt nur Textanalyse.
Qwen 3.5 2B(Jailbreak-Text)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Ein Jailbreak-Modell, das ein gewisses Verständnis für den Inhalt hat.
MiniCPM-V 4.6 (Bildlesbare kleine Stahlkanone)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
Das multimodale Top-End-Modell bietet eine hervorragende Leistung bei OCR, Objekterkennung und komplexem Szenenverständnis.
Gemma 4 E2B-it QAT MTP(Allround – hohe Geschwindigkeit)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Mit allen Funktionen und der MTP-Technologie für Geschwindigkeit ist es bei weitem das beste Modell, das Sie wählen können.
MiniCPM5 1B Claude微调(Gedankenkette)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
MiniCPM5-1B, das auf der Grundlage des Claude Opus Fable5-Datensatzes fein abgestimmt ist, unterstützt das Denken in der Denkkette und ist gut in der Programmierung und Befolgung von Anweisungen.
Nanbeige 4,2 3B (über 9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
3B-Körper aus hartem Stahl 9B, sehr zu empfehlen, unterstützt aber nur Text.
Nanbeige 4.2 3B(Jailbreak-Optimierung)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B-Körper aus hartem Stahl 9B, die Jailbreak-Version von i1 hat eine höhere Quantisierungsgenauigkeit, unterstützt aber nur Text.
Gemma 3 1B Instruct(基础)
unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL
Englischer Vorzeigeführer
LFM2.5 8B A1B(Gefängnisausbruch)
gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M
LFM2.5 8B A1B MoE ohne Zensurversion, nur 1B aktivierte Parameter, ausgewogenes Verhältnis zwischen Geschwindigkeit und Qualität.
Bonsai 27B 1-bit(Super Kompression)
dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0
Bonsai 27B ist eine einbit quantisierte Jailbreak-Version mit De-Alignment und zensurfreier Unterstützung für Text- und Bildanalyse.
Qwen 3.8 27B(Der stärkste Jailbreak)
JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M
Qwen3.8-27B ist eine unzensierte quantitative Version, die lange MTP-Vorhersagen beibehält und Text- und Bildanalyse unterstützt.
Qwen 3.8 2B(Destillation)
empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M
Qwen3.8-Distill, extrem schnelle Ausführung, nur Textanalyse.
Qwen 3.8 9B(Destillation)
empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M
Die destillierte Version von Qwen3.8 erbt die Tiefenschlussfähigkeiten großer Modelle und unterstützt nur die Textanalyse.
Ornith 1.5 9B(Top)
ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M
Ornith 1.5 Multimodales Modell, unterstützt Text- und Bildanalyse.
Spark X2.5 1.7B(Leicht)
XHToken/Spark-X2.5-1.7B-GGUF
Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。
Bereit für ein stärkeres lokales KI-Dateimanagement?
Keine komplexe Konfiguration erforderlich: Das Firefly AI Folder unterstützt integrierte Engines und einen Modell-Download mit einem Klick, um Ihnen eine intelligente und effiziente Organisation zu ermöglichen.