Suporte para descarga rápida de modelos de ponta locais dentro do software
Suporte para modelos locais de fontes duplas HuggingFace e ModelScope, bem como numerosos provedores de serviços de modelos em nuvem nacionais e internacionais
Qwen 3,5 0,8B (Básico)
ggml-org/Qwen3.5-0.8B-GGUF:Q4_0
Ele pode funcionar sem uma placa gráfica separada e tem uma velocidade de execução extremamente rápida. Ele suporta apenas análise de texto e é menos preciso.
Qwen 3.5 0.8B (reconhecimento de imagem leve)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Velocidade de execução extrema, adequada para ambientes de configuração extremamente baixa e suporta análise de imagens, que é menos precisa.
Qwen 3.5 9B (ajuste fino de Claude)
DavidAU/Qwen3.5-9B-Claude-4.6-OS-Auto-Variable-HERETIC-UNCENSORED-THINKING-MAX-NEOCODE-Imatrix-GGUF:D_AU-IQ3_M-imat
Ajustado com base no conjunto de dados Claude 4.6 e tem bom desempenho ao seguir as instruções.
Gemma 4 E4B-it (áudio suportado)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
Versão quantificada original do Google, com suporte para análise de texto, imagem e áudio.
Qwen 3.5 4B (equilibrado)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
A versão Abliterada equilibra velocidade e qualidade.
Qwen 3.5 2B (melhor)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
A memória de vídeo 4G é a primeira escolha.
Qwen 3.5 27B (mais forte)
unsloth/Qwen3.5-27B-GGUF:Q4_0
O modelo de parâmetros muito grandes requer placa gráfica de alto desempenho para suportar análise de texto e imagem.
Qwen 3.5 2B (otimização japonesa)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Modelo de análise de texto otimizado para conjuntos de dados japoneses, suporta apenas análise de texto.
Qwen 3.5 2B (texto de jailbreak)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Um modelo de jailbreak que possui uma certa compreensão do conteúdo.
Instrução Qwen 3.5 2B (QI alto)
mradermacher/Qwen3.5-2B-Polaris-HighIQ-INSTRUCT-GGUF:IQ4_XS
Uma versão altamente inteligente e ajustada do Polaris que suporta análise de texto e imagem.
MiniCPM-V 4.6 (pequeno canhão de aço para leitura de imagens)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
O modelo multimodal de ponta tem um desempenho extremamente bom em OCR, reconhecimento de objetos e compreensão de cenas complexas.
Qwen 3.6 27B MTP (mais recente)
unsloth/Qwen3.6-27B-MTP-GGUF:UD-IQ2_XXS
A versão 3.6, que possui um QI explosivo, precisa ser atualizada para 2.1+ para suportá-la.
Gemma 4 E2B-it QAT MTP (alta velocidade geral)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Com recursos completos, além da tecnologia MTP para velocidade, é de longe o melhor modelo para escolher.
MiniCPM5 1B Claude ajuste fino (cadeia de pensamento)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
MiniCPM5-1B, que é ajustado com base no conjunto de dados Claude Opus Fable5, suporta raciocínio em cadeia de pensamento e é bom em programação e seguimento de instruções.
Nanbeige 4.2 3B (além de 9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
Corpo 3B em aço duro 9B, altamente recomendado, mas suporta apenas texto.
Nanbeige 4.2 3B (além de 9B de alta precisão)
owao/Nanbeige4.2-3B-GGUF:Q8_0
3B corpo de aço duro 9B, quantificação de maior precisão Q8_0, altamente recomendado, mas suporta apenas texto.
Nanbeige 4.2 3B (otimizado para jailbreak)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B corpo de aço duro 9B, a versão jailbroken do i1 tem maior precisão de quantificação, mas suporta apenas texto.
Preparado para experimentar uma gestão de arquivos AI local mais potente?
Sem configuração complexa, a Firefly AI Folder suporta motor integrado e descarga de modelos com um clique, abrindo uma jornada de organização inteligente e eficiente para si.