Suporte para descarga rápida de modelos de ponta locais dentro do software
Suporte para modelos locais de fontes duplas HuggingFace e ModelScope, bem como numerosos provedores de serviços de modelos em nuvem nacionais e internacionais
Qwen 3.5 0.8B (Chinês é melhor)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL
Modelo de texto extremamente rápido e leve, adequado para ambientes low-end e de CPU, com desempenho de análise chinês balanceado.
Qwen 3.5 0.8B (Reconhecimento de imagem leve)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Velocidade de execução extrema, adequada para ambientes de configuração extremamente baixa e suporta análise de imagens, que é menos precisa.
LFM2.5 2.6B(Fuga da prisão)
Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M
Versão sem restrições e sem censura do LFM2.5 2.6B, equilibrando velocidade e qualidade.
Gemma 4 E4B-it(Áudio de suporte)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
Versão quantificada original do Google, com suporte para análise de texto, imagem e áudio.
Qwen 3.5 4B(Equilíbrio)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
A versão Abliterada equilibra velocidade e qualidade.
Qwen 3.5 2B(Melhorar)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
A memória de vídeo 4G é a primeira escolha.
Qwen 3.5 2B(Otimização japonesa)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Modelo de análise de texto otimizado para conjuntos de dados japoneses, suporta apenas análise de texto.
Qwen 3.5 2B(Texto de jailbreak)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Um modelo de jailbreak que possui uma certa compreensão do conteúdo.
MiniCPM-V 4.6 (Pequeno canhão de aço para leitura de imagens)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
O modelo multimodal de ponta tem um desempenho extremamente bom em OCR, reconhecimento de objetos e compreensão de cenas complexas.
Gemma 4 E2B-it QAT MTP(Versátil - alta velocidade)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Com recursos completos, além da tecnologia MTP para velocidade, é de longe o melhor modelo para escolher.
MiniCPM5 1B Claude微调(Cadeia de pensamento)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
MiniCPM5-1B, que é ajustado com base no conjunto de dados Claude Opus Fable5, suporta raciocínio em cadeia de pensamento e é bom em programação e seguimento de instruções.
Nanbeige 4.2 3B (além de 9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
Corpo 3B em aço duro 9B, altamente recomendado, mas suporta apenas texto.
Nanbeige 4.2 3B(Otimização de jailbreak)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
Corpo 3B em aço duro 9B, a versão jailbroken do i1 tem maior precisão de quantização, mas suporta apenas texto.
Gemma 3 1B Instruct(基础)
unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL
Líder modelo inglês
LFM2.5 8B A1B(Fuga da prisão)
gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M
Versão sem revisão do LFM2.5 8B A1B MoE, apenas 1B de parâmetros ativados, equilíbrio entre velocidade e qualidade.
Bonsai 27B 1-bit(Supercompressão)
dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0
Versão Jailbreak do Bonsai 27B com quantização de 1-bit, sem moderação e sem revisão, suporte para análise de texto e imagem.
Qwen 3.8 27B(O Jailbreak mais forte)
JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M
Qwen3.8-27B é uma versão quantitativa sem censura que retém longas previsões do MTP e oferece suporte à análise de texto e imagem.
Qwen 3.8 2B(Destilação)
empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M
Qwen3.8 Versão destilada, velocidade máxima de execução, suporta apenas análise de texto.
Qwen 3.8 9B(Destilação)
empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M
Qwen3.8 Versão destilada, herda a capacidade de raciocínio profundo do modelo grande, suporta apenas análise de texto.
Ornith 1.5 9B(Topo)
ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M
Ornith 1.5 Modelo multimodal, suporta análise de texto e imagem.
Spark X2.5 1.7B(Leve)
XHToken/Spark-X2.5-1.7B-GGUF
Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。
Preparado para experimentar uma gestão de arquivos AI local mais potente?
Sem configuração complexa, a Firefly AI Folder suporta motor integrado e descarga de modelos com um clique, abrindo uma jornada de organização inteligente e eficiente para si.