Centro de Ecossistema de Modelos de IA

Suporte para descarga rápida de modelos de ponta locais dentro do software

Suporte para modelos locais de fontes duplas HuggingFace e ModelScope, bem como numerosos provedores de serviços de modelos em nuvem nacionais e internacionais

34+
Compatível com modelos locais leves
100%
Privacidade sem preocupações, funcionamento offline
35+
Integração com APIs em nuvem principais
Filtrar por capacidades:
unslothHuggingFace

Qwen 3.5 0.8B (Chinês é melhor)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL

Texto
Parâmetros:0.8B
Tamanho:579MB
Quantização:UD-Q5_K_XL
Contexto:128k
VelocidadeVelocidade extrema
QualidadeMédio

Modelo de texto extremamente rápido e leve, adequado para ambientes low-end e de CPU, com desempenho de análise chinês balanceado.

#Leve#Suporte à operação da CPU#Ultra-rápido#Somente texto
unslothHuggingFace

Qwen 3.5 0.8B (Reconhecimento de imagem leve)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL

TextoImagem
Parâmetros:0.8B
Tamanho:976MB
Contexto:128k
VelocidadeVelocidade extrema
QualidadeMédio

Velocidade de execução extrema, adequada para ambientes de configuração extremamente baixa e suporta análise de imagens, que é menos precisa.

#GPU extremamente rápida#Suporte à operação da CPU#Multimodal#Mini
AbirayHuggingFace

LFM2.5 2.6B(Fuga da prisão)

Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M

推荐
Texto
Parâmetros:2.6B
Tamanho:1.56GB
Quantização:Q4_K_M
Contexto:32k
VelocidadeMuito rápido
QualidadeAlto

Versão sem restrições e sem censura do LFM2.5 2.6B, equilibrando velocidade e qualidade.

#Limitar#Sem censura#NSFW#Somente texto
UnslothHuggingFace

Gemma 4 E4B-it(Áudio de suporte)

unsloth/gemma-4-E4B-it-GGUF:Q4_K_S

推荐
TextoImagem Áudio
Parâmetros:4B
Tamanho:5.83GB
Quantização:Q4_K_S
Contexto:128k
VelocidadeRápido
QualidadeAlto

Versão quantificada original do Google, com suporte para análise de texto, imagem e áudio.

#Multimodal#Rápido#Áudio#Inglês é melhor
mradermacherHuggingFace

Qwen 3.5 4B(Equilíbrio)

mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M

TextoImagem
Parâmetros:4B
Tamanho:3.08GB
Quantização:Q4_K_M
Contexto:256k
VelocidadeRápido
QualidadeAlto

A versão Abliterada equilibra velocidade e qualidade.

#Limitar#Sem censura#NSFW#Fuga da prisão#Multimodal
mradermacherHuggingFace

Qwen 3.5 2B(Melhorar)

mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0

TextoImagem
Parâmetros:2B
Tamanho:2.68GB
Quantização:Q8_0
Contexto:256k
VelocidadeMuito rápido
QualidadeMuito elevado

A memória de vídeo 4G é a primeira escolha.

#Limitar#Sem censura#NSFW#Fuga da prisão#Multimodal
tatsuyaaaaaaaHuggingFace

Qwen 3.5 2B(Otimização japonesa)

tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0

Texto
Parâmetros:2B
Tamanho:1.2GB
Quantização:Q4_0
Contexto:128k
VelocidadeRápido
QualidadeMédio

Modelo de análise de texto otimizado para conjuntos de dados japoneses, suporta apenas análise de texto.

#Otimização japonesa#Somente texto#Memória de vídeo baixa
jordanwoodsonHuggingFace

Qwen 3.5 2B(Texto de jailbreak)

jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M

Texto
Parâmetros:2B
Tamanho:1.27GB
Quantização:Q4_K_M
Contexto:128k
VelocidadeRápido
QualidadeAlto

Um modelo de jailbreak que possui uma certa compreensão do conteúdo.

#Fuga da prisão#Sem censura#NSFW#Somente texto
OpenBMBHuggingFace

MiniCPM-V 4.6 (Pequeno canhão de aço para leitura de imagens)

ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M

推荐
TextoImagem
Parâmetros:0.8B
Tamanho:1.17GB
Quantização:Q4_K_M
Contexto:32k
VelocidadeRápido
QualidadeMuito elevado

O modelo multimodal de ponta tem um desempenho extremamente bom em OCR, reconhecimento de objetos e compreensão de cenas complexas.

#Multimodal#Reconhecimento Óptico de Caracteres#Compreensão da cena#Reconhecimento de imagem superior
unslothHuggingFace

Gemma 4 E2B-it QAT MTP(Versátil - alta velocidade)

unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL

推荐
TextoImagem Áudio
Parâmetros:2B
Tamanho:3.71GB
Quantização:UD-Q4_K_XL
Contexto:128k
VelocidadeVelocidade extrema
QualidadeMédio

Com recursos completos, além da tecnologia MTP para velocidade, é de longe o melhor modelo para escolher.

#Multimodal#Áudio#Quantificação de QAT#MoE#Memória de vídeo muito pequena#Inglês é melhor
GnLOLotHuggingFace

MiniCPM5 1B Claude微调(Cadeia de pensamento)

GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M

Texto
Parâmetros:1B
Tamanho:688MB
Quantização:Q4_K_M
Contexto:128k
VelocidadeVelocidade extrema
QualidadeMuito elevado

MiniCPM5-1B, que é ajustado com base no conjunto de dados Claude Opus Fable5, suporta raciocínio em cadeia de pensamento e é bom em programação e seguimento de instruções.

#Otimização de ajuste fino#Conjunto de dados Claude#Cadeia de pensamento#Otimização de programação#Leve#Suporte à operação da CPU#Somente texto
owaoHuggingFace

Nanbeige 4.2 3B (além de 9B)

owao/Nanbeige4.2-3B-GGUF:Q4_K_M

Texto
Parâmetros:3B
Tamanho:2.40GB
Quantização:Q4_K_M
Contexto:128k
VelocidadeRápido
QualidadeMédio

Corpo 3B em aço duro 9B, altamente recomendado, mas suporta apenas texto.

#Fuga da prisão#Sem censura#NSFW#Somente texto
mradermacherHuggingFace

Nanbeige 4.2 3B(Otimização de jailbreak)

mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M

推荐
Texto
Parâmetros:3B
Tamanho:2.78GB
Quantização:i1-Q5_K_M
Contexto:128k
VelocidadeRápido
QualidadeAlto

Corpo 3B em aço duro 9B, a versão jailbroken do i1 tem maior precisão de quantização, mas suporta apenas texto.

#Fuga da prisão#Sem censura#NSFW#Somente texto#Alta precisão
GoogleHuggingFace

Gemma 3 1B Instruct(基础)

unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL

Texto
Parâmetros:1B
Tamanho:770MB
Quantização:UD-Q4_K_XL
Contexto:32k
VelocidadeVelocidade extrema
QualidadeMédio

Líder modelo inglês

#Leve#Suporte à operação da CPU#Somente texto#Inglês é melhor
gaston-parraviciniHuggingFace

LFM2.5 8B A1B(Fuga da prisão)

gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M

推荐
Texto
Parâmetros:8B-A1B
Tamanho:4.80GB
Quantização:Q4_K_M
Contexto:32k
VelocidadeMuito rápido
QualidadeAlto

Versão sem revisão do LFM2.5 8B A1B MoE, apenas 1B de parâmetros ativados, equilíbrio entre velocidade e qualidade.

#MoE#Sem censura#NSFW#Fuga da prisão#Somente texto#Inglês é melhor
dealignaiHuggingFace

Bonsai 27B 1-bit(Supercompressão)

dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0

TextoImagem
Parâmetros:27B
Tamanho:5.21GB
Quantização:Q1_0
Contexto:128k
VelocidadeRápido
QualidadeMédio

Versão Jailbreak do Bonsai 27B com quantização de 1-bit, sem moderação e sem revisão, suporte para análise de texto e imagem.

#1-bit#Fuga da prisão#Sem censura#NSFW#Multimodal#Memória de vídeo baixa
JonathanColettiHuggingFace

Qwen 3.8 27B(O Jailbreak mais forte)

JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M

TextoImagem
Parâmetros:27B
Tamanho:16.52GB
Quantização:Q4_K_M
Contexto:128k
VelocidadeMais lento
QualidadeAlto

Qwen3.8-27B é uma versão quantitativa sem censura que retém longas previsões do MTP e oferece suporte à análise de texto e imagem.

#Sem censura#Fuga da prisão#NSFW#Multimodal#Parâmetros grandes#MTP
empero-aiHuggingFace

Qwen 3.8 2B(Destilação)

empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M

推荐
Texto
Parâmetros:2B
Tamanho:1.22GB
Quantização:Q4_K_M
Contexto:128k
VelocidadeVelocidade extrema
QualidadeAlto

Qwen3.8 Versão destilada, velocidade máxima de execução, suporta apenas análise de texto.

#Destilação#Leve#Suporte à operação da CPU#Somente texto
empero-aiHuggingFace

Qwen 3.8 9B(Destilação)

empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M

推荐
Texto
Parâmetros:9B
Tamanho:5.38GB
Quantização:Q4_K_M
Contexto:128k
VelocidadeRápido
QualidadeMuito elevado

Qwen3.8 Versão destilada, herda a capacidade de raciocínio profundo do modelo grande, suporta apenas análise de texto.

#Destilação#Raciocínio#Somente texto#Otimização de ajuste fino
ornith-aiHuggingFace

Ornith 1.5 9B(Topo)

ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M

推荐
TextoImagem
Parâmetros:9B
Tamanho:6.24GB
Quantização:Q4_K_M
Contexto:128k
VelocidadeMédio
QualidadeMuito elevado

Ornith 1.5 Modelo multimodal, suporta análise de texto e imagem.

#Multimodal#Análise de imagem#Inglês é melhor
XHTokenHuggingFace

Spark X2.5 1.7B(Leve)

XHToken/Spark-X2.5-1.7B-GGUF

Texto
Parâmetros:1.7B
Tamanho:3.19GB
Contexto:128k
VelocidadeRápido
QualidadeMédio

Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。

#Leve#Suporte à operação da CPU#Somente texto

Preparado para experimentar uma gestão de arquivos AI local mais potente?

Sem configuração complexa, a Firefly AI Folder suporta motor integrado e descarga de modelos com um clique, abrindo uma jornada de organização inteligente e eficiente para si.