Centro de ecosistema de modelos de IA

Descarga rápida de modelos vanguardistas locales directamente desde el software

Compatible con modelos locales de HuggingFace y ModelScope, así como numerosos proveedores de modelos en la nube nacionales e internacionales

34+
Compatible con modelos ligeros locales
100%
Privacidad sin preocupaciones, funcionamiento sin conexión
35+
Integración con APIs en la nube principales
Filtrar capacidades:
unslothHuggingFace

Qwen 3.5 0.8B (El chino es mejor)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL

Texto
Parámetros:0.8B
Tamaño:579MB
Cuantización:UD-Q5_K_XL
Contexto:128k
VelocidadVelocidad extrema
CalidadMedio

Modelo de texto extremadamente rápido y liviano, adecuado para entornos de CPU y de gama baja, con un rendimiento de análisis chino equilibrado.

#Ligero#Soporta operación de CPU#Ultra rápido#Solo texto
unslothHuggingFace

Qwen 3.5 0.8B (Reconocimiento de imágenes ligero)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL

TextoImagen
Parámetros:0.8B
Tamaño:976MB
Contexto:128k
VelocidadVelocidad extrema
CalidadMedio

Velocidad de ejecución extrema, adecuada para entornos de configuración extremadamente baja y admite análisis de imágenes, que es menos preciso.

#GPU extremadamente rápida#Soporta operación de CPU#Multimodal#Mini
AbirayHuggingFace

LFM2.5 2.6B(Fuga de la prisión)

Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M

推荐
Texto
Parámetros:2.6B
Tamaño:1.56GB
Cuantización:Q4_K_M
Contexto:32k
VelocidadMuy rápido
CalidadAlto

Versión de LFM2.5 2.6B sin restricciones y sin censura, equilibrio entre velocidad y calidad.

#Limitar#Sin censura#NSFW#Solo texto
UnslothHuggingFace

Gemma 4 E4B-it(Audio de soporte)

unsloth/gemma-4-E4B-it-GGUF:Q4_K_S

推荐
TextoImagen Audio
Parámetros:4B
Tamaño:5.83GB
Cuantización:Q4_K_S
Contexto:128k
VelocidadRápido
CalidadAlto

La versión cuantificada original de Google, que admite análisis de texto, imágenes y audio.

#Multimodal#Rápido#Audio#El ingles es mejor
mradermacherHuggingFace

Qwen 3.5 4B(Balance)

mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M

TextoImagen
Parámetros:4B
Tamaño:3.08GB
Cuantización:Q4_K_M
Contexto:256k
VelocidadRápido
CalidadAlto

La versión eliminada equilibra velocidad y calidad.

#Limitar#Sin censura#NSFW#Fuga de la prisión#Multimodal
mradermacherHuggingFace

Qwen 3.5 2B(Mejor)

mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0

TextoImagen
Parámetros:2B
Tamaño:2.68GB
Cuantización:Q8_0
Contexto:256k
VelocidadMuy rápido
CalidadMuy alto

La memoria de video 4G es la primera opción.

#Limitar#Sin censura#NSFW#Fuga de la prisión#Multimodal
tatsuyaaaaaaaHuggingFace

Qwen 3.5 2B(Optimización japonesa)

tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0

Texto
Parámetros:2B
Tamaño:1.2GB
Cuantización:Q4_0
Contexto:128k
VelocidadRápido
CalidadMedio

Modelo de análisis de texto optimizado para conjuntos de datos japoneses, solo admite análisis de texto.

#Optimización japonesa#Solo texto#Memoria de vídeo baja
jordanwoodsonHuggingFace

Qwen 3.5 2B(Texto de fuga)

jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M

Texto
Parámetros:2B
Tamaño:1.27GB
Cuantización:Q4_K_M
Contexto:128k
VelocidadRápido
CalidadAlto

Un modelo de jailbreak que tiene cierta comprensión del contenido.

#Fuga de la prisión#Sin censura#NSFW#Solo texto
OpenBMBHuggingFace

MiniCPM-V 4.6 (Cañón de acero pequeño que lee imágenes)

ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M

推荐
TextoImagen
Parámetros:0.8B
Tamaño:1.17GB
Cuantización:Q4_K_M
Contexto:32k
VelocidadRápido
CalidadMuy alto

El modelo multimodal del extremo superior funciona extremadamente bien en OCR, reconocimiento de objetos y comprensión de escenas complejas.

#Multimodal#Reconocimiento óptico de caracteres#Comprensión de la escena#Reconocimiento de imagen superior
unslothHuggingFace

Gemma 4 E2B-it QAT MTP(Todo terreno: alta velocidad)

unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL

推荐
TextoImagen Audio
Parámetros:2B
Tamaño:3.71GB
Cuantización:UD-Q4_K_XL
Contexto:128k
VelocidadVelocidad extrema
CalidadMedio

Con todas sus capacidades, además de la tecnología MTP para mayor velocidad, es, con diferencia, el mejor modelo para elegir.

#Multimodal#Audio#Cuantificación QAT#MoE#Memoria de vídeo muy pequeña#El ingles es mejor
GnLOLotHuggingFace

MiniCPM5 1B Claude微调(Cadena de pensamiento)

GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M

Texto
Parámetros:1B
Tamaño:688MB
Cuantización:Q4_K_M
Contexto:128k
VelocidadVelocidad extrema
CalidadMuy alto

MiniCPM5-1B, que está optimizado en función del conjunto de datos de Claude Opus Fable5, admite el razonamiento en cadena de pensamiento y es bueno en programación y seguimiento de instrucciones.

#Optimización de ajuste fino#Conjunto de datos de Claude#Cadena de pensamiento#Optimización de la programación#Ligero#Soporta operación de CPU#Solo texto
owaoHuggingFace

Nanbeige 4.2 3B (más allá de 9B)

owao/Nanbeige4.2-3B-GGUF:Q4_K_M

Texto
Parámetros:3B
Tamaño:2.40GB
Cuantización:Q4_K_M
Contexto:128k
VelocidadRápido
CalidadMedio

Cuerpo 3B de acero duro 9B, muy recomendable, pero solo admite texto.

#Fuga de la prisión#Sin censura#NSFW#Solo texto
mradermacherHuggingFace

Nanbeige 4.2 3B(Optimización de jailbreak)

mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M

推荐
Texto
Parámetros:3B
Tamaño:2.78GB
Cuantización:i1-Q5_K_M
Contexto:128k
VelocidadRápido
CalidadAlto

3B con cuerpo de acero duro 9B, la versión con jailbreak de i1 tiene una mayor precisión de cuantificación, pero solo admite texto.

#Fuga de la prisión#Sin censura#NSFW#Solo texto#Alta precisión
GoogleHuggingFace

Gemma 3 1B Instruct(基础)

unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL

Texto
Parámetros:1B
Tamaño:770MB
Cuantización:UD-Q4_K_XL
Contexto:32k
VelocidadVelocidad extrema
CalidadMedio

Líder modelo inglés

#Ligero#Soporta operación de CPU#Solo texto#El ingles es mejor
gaston-parraviciniHuggingFace

LFM2.5 8B A1B(Fuga de la prisión)

gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M

推荐
Texto
Parámetros:8B-A1B
Tamaño:4.80GB
Cuantización:Q4_K_M
Contexto:32k
VelocidadMuy rápido
CalidadAlto

LFM2.5 8B A1B MoE Versión sin censura, solo parámetros de activación 1B, velocidad y calidad equilibradas.

#MoE#Sin censura#NSFW#Fuga de la prisión#Solo texto#El ingles es mejor
dealignaiHuggingFace

Bonsai 27B 1-bit(Súper compresión)

dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0

TextoImagen
Parámetros:27B
Tamaño:5.21GB
Cuantización:Q1_0
Contexto:128k
VelocidadRápido
CalidadMedio

Versión jailbreak cuantificada a 1 bit de Bonsai 27B, desalineada y sin censura, compatible con análisis de texto e imágenes.

#1 bit#Fuga de la prisión#Sin censura#NSFW#Multimodal#Memoria de vídeo baja
JonathanColettiHuggingFace

Qwen 3.8 27B(El jailbreak más fuerte)

JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M

TextoImagen
Parámetros:27B
Tamaño:16.52GB
Cuantización:Q4_K_M
Contexto:128k
VelocidadLento
CalidadAlto

Qwen3.8-27B es una versión cuantitativa sin censura que conserva predicciones largas de MTP y admite análisis de texto e imágenes.

#Sin censura#Fuga de la prisión#NSFW#Multimodal#Grandes parámetros#MTP
empero-aiHuggingFace

Qwen 3.8 2B(Destilación)

empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M

推荐
Texto
Parámetros:2B
Tamaño:1.22GB
Cuantización:Q4_K_M
Contexto:128k
VelocidadVelocidad extrema
CalidadAlto

Qwen3.8 versión destilada, velocidad de ejecución extrema, solo admite análisis de texto。

#Destilación#Ligero#Soporta operación de CPU#Solo texto
empero-aiHuggingFace

Qwen 3.8 9B(Destilación)

empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M

推荐
Texto
Parámetros:9B
Tamaño:5.38GB
Cuantización:Q4_K_M
Contexto:128k
VelocidadRápido
CalidadMuy alto

Qwen3.8 versión destilada, hereda la capacidad de razonamiento profundo del modelo grande, solo admite análisis de texto。

#Destilación#Razonamiento#Solo texto#Optimización de ajuste fino
ornith-aiHuggingFace

Ornith 1.5 9B(Premium)

ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M

推荐
TextoImagen
Parámetros:9B
Tamaño:6.24GB
Cuantización:Q4_K_M
Contexto:128k
VelocidadMedio
CalidadMuy alto

Ornith 1.5 modelo multimodal, admite análisis de texto e imagen。

#Multimodal#Reconocimiento de imágenes。#El ingles es mejor
XHTokenHuggingFace

Spark X2.5 1.7B(Ligero)

XHToken/Spark-X2.5-1.7B-GGUF

Texto
Parámetros:1.7B
Tamaño:3.19GB
Contexto:128k
VelocidadRápido
CalidadMedio

Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。

#Ligero#Soporta operación de CPU#Solo texto

¿Listo para disfrutar de una gestión de archivos AI local más potente?

Sin configuraciones complejas, Firefly AI Folder admite motores integrados y descarga de modelos con un clic, iniciando un viaje de organización inteligente y eficiente.