Centro de Ecossistema de Modelos de IA

Suporte para descarga rápida de modelos de ponta locais dentro do software

Suporte para modelos locais de fontes duplas HuggingFace e ModelScope, bem como numerosos provedores de serviços de modelos em nuvem nacionais e internacionais

30+
Compatível com modelos locais leves
100%
Privacidade sem preocupações, funcionamento offline
35+
Integração com APIs em nuvem principais
能力筛选:
ggml-orgHuggingFace

Qwen 3,5 0,8B (Básico)

ggml-org/Qwen3.5-0.8B-GGUF:Q4_0

内置
文本
参数:0.8B
大小:563MB
量化:Q4_0
上下文:128k
速度极速
质量

Ele pode funcionar sem uma placa gráfica separada e tem uma velocidade de execução extremamente rápida. Ele suporta apenas análise de texto e é menos preciso.

#oficial#leve#Suporte à operação da CPU#somente texto
unslothHuggingFace

Qwen 3.5 0.8B (reconhecimento de imagem leve)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL

文本图像
参数:0.8B
大小:976MB
上下文:128k
速度极速
质量

Velocidade de execução extrema, adequada para ambientes de configuração extremamente baixa e suporta análise de imagens, que é menos precisa.

#GPU extremamente rápida#Suporte à operação da CPU#multimodal#mini
DavidAUHuggingFace

Qwen 3.5 9B (ajuste fino de Claude)

DavidAU/Qwen3.5-9B-Claude-4.6-OS-Auto-Variable-HERETIC-UNCENSORED-THINKING-MAX-NEOCODE-Imatrix-GGUF:D_AU-IQ3_M-imat

文本图像
参数:9B
大小:6.5GB
上下文:128k
速度极速
质量

Ajustado com base no conjunto de dados Claude 4.6 e tem bom desempenho ao seguir as instruções.

#Otimização de ajuste fino#Conjunto de dados Claude#multimodal#NSFW#Sem censura#fuga da prisão
UnslothHuggingFace

Gemma 4 E4B-it (áudio suportado)

unsloth/gemma-4-E4B-it-GGUF:Q4_K_S

文本图像音频
参数:4B
大小:5.83GB
量化:Q4_K_S
上下文:128k
速度快速
质量

Versão quantificada original do Google, com suporte para análise de texto, imagem e áudio.

#multimodal#rápido#Áudio#Inglês é melhor
mradermacherHuggingFace

Qwen 3.5 4B (equilibrado)

mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M

文本图像
参数:4B
大小:3.08GB
量化:Q4_K_M
上下文:256k
速度快速
质量

A versão Abliterada equilibra velocidade e qualidade.

#limitar#Sem censura#NSFW#fuga da prisão#multimodal
mradermacherHuggingFace

Qwen 3.5 2B (melhor)

mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0

文本图像
参数:2B
大小:2.68GB
量化:Q8_0
上下文:256k
速度很快
质量极高

A memória de vídeo 4G é a primeira escolha.

#limitar#Sem censura#NSFW#fuga da prisão#multimodal
UnslothHuggingFace

Qwen 3.5 27B (mais forte)

unsloth/Qwen3.5-27B-GGUF:Q4_0

文本图像
参数:27B
大小:16.63GB
量化:Q4_0
上下文:128k
速度较慢
质量极高

O modelo de parâmetros muito grandes requer placa gráfica de alto desempenho para suportar análise de texto e imagem.

#Parâmetros muito grandes#multimodal#GPU de alto desempenho
tatsuyaaaaaaaHuggingFace

Qwen 3.5 2B (otimização japonesa)

tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0

文本
参数:2B
大小:1.2GB
量化:Q4_0
上下文:128k
速度快速
质量

Modelo de análise de texto otimizado para conjuntos de dados japoneses, suporta apenas análise de texto.

#Otimização japonesa#somente texto#Memória de vídeo baixa
jordanwoodsonHuggingFace

Qwen 3.5 2B (texto de jailbreak)

jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M

文本
参数:2B
大小:1.27GB
量化:Q4_K_M
上下文:128k
速度快速
质量

Um modelo de jailbreak que possui uma certa compreensão do conteúdo.

#fuga da prisão#Sem censura#NSFW#somente texto
mradermacherHuggingFace

Instrução Qwen 3.5 2B (QI alto)

mradermacher/Qwen3.5-2B-Polaris-HighIQ-INSTRUCT-GGUF:IQ4_XS

文本图像
参数:2B
大小:1.54GB
量化:IQ4_XS
上下文:128k
速度快速
质量

Uma versão altamente inteligente e ajustada do Polaris que suporta análise de texto e imagem.

#Otimização de ajuste fino#QI alto#multimodal
OpenBMBHuggingFace

MiniCPM-V 4.6 (pequeno canhão de aço para leitura de imagens)

ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M

文本图像
参数:0.8B
大小:1.17GB
量化:Q4_K_M
上下文:32k
速度快速
质量极高

O modelo multimodal de ponta tem um desempenho extremamente bom em OCR, reconhecimento de objetos e compreensão de cenas complexas.

#multimodal#OCR#Compreensão da cena#Reconhecimento de imagem superior
unslothHuggingFace

Qwen 3.6 27B MTP (mais recente)

unsloth/Qwen3.6-27B-MTP-GGUF:UD-IQ2_XXS

文本图像
参数:27B
大小:9.77GB
量化:UD-IQ2_XXS
上下文:128k
速度较慢
质量极高

A versão 3.6, que possui um QI explosivo, precisa ser atualizada para 2.1+ para suportá-la.

#multimodal#MTP#Parâmetros muito grandes#GPU de alto desempenho
unslothHuggingFace

Gemma 4 E2B-it QAT MTP (alta velocidade geral)

unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL

文本图像音频
参数:2B
大小:3.71GB
量化:UD-Q4_K_XL
上下文:128k
速度极速
质量

Com recursos completos, além da tecnologia MTP para velocidade, é de longe o melhor modelo para escolher.

#multimodal#Áudio#Quantificação de QAT#MoE#Memória de vídeo muito pequena#Inglês é melhor
GnLOLotHuggingFace

MiniCPM5 1B Claude ajuste fino (cadeia de pensamento)

GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M

文本
参数:1B
大小:688MB
量化:Q4_K_M
上下文:128k
速度极速
质量极高

MiniCPM5-1B, que é ajustado com base no conjunto de dados Claude Opus Fable5, suporta raciocínio em cadeia de pensamento e é bom em programação e seguimento de instruções.

#Otimização de ajuste fino#Conjunto de dados Claude#Cadeia de pensamento#Otimização de programação#leve#Suporte à operação da CPU#somente texto
owaoHuggingFace

Nanbeige 4.2 3B (além de 9B)

owao/Nanbeige4.2-3B-GGUF:Q4_K_M

文本
参数:3B
大小:2.40GB
量化:Q4_K_M
上下文:128k
速度快速
质量

Corpo 3B em aço duro 9B, altamente recomendado, mas suporta apenas texto.

#fuga da prisão#Sem censura#NSFW#somente texto
owaoHuggingFace

Nanbeige 4.2 3B (além de 9B de alta precisão)

owao/Nanbeige4.2-3B-GGUF:Q8_0

文本
参数:3B
大小:4.13GB
量化:Q8_0
上下文:128k
速度快速
质量

3B corpo de aço duro 9B, quantificação de maior precisão Q8_0, altamente recomendado, mas suporta apenas texto.

#fuga da prisão#Sem censura#NSFW#somente texto#Alta precisão
mradermacherHuggingFace

Nanbeige 4.2 3B (otimizado para jailbreak)

mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M

文本
参数:3B
大小:2.78GB
量化:i1-Q5_K_M
上下文:128k
速度快速
质量

3B corpo de aço duro 9B, a versão jailbroken do i1 tem maior precisão de quantificação, mas suporta apenas texto.

#fuga da prisão#Sem censura#NSFW#somente texto#Alta precisão

Preparado para experimentar uma gestão de arquivos AI local mais potente?

Sem configuração complexa, a Firefly AI Folder suporta motor integrado e descarga de modelos com um clique, abrindo uma jornada de organização inteligente e eficiente para si.