Centro de ecosistema de modelos de IA

Descarga rápida de modelos vanguardistas locales directamente desde el software

Compatible con modelos locales de HuggingFace y ModelScope, así como numerosos proveedores de modelos en la nube nacionales e internacionales

30+
Compatible con modelos ligeros locales
100%
Privacidad sin preocupaciones, funcionamiento sin conexión
35+
Integración con APIs en la nube principales
能力筛选:
ggml-orgHuggingFace

Qwen 3.5 0.8B (Básico)

ggml-org/Qwen3.5-0.8B-GGUF:Q4_0

内置
文本
参数:0.8B
大小:563MB
量化:Q4_0
上下文:128k
速度极速
质量

Puede ejecutarse sin una tarjeta gráfica separada y tiene una velocidad de ejecución extremadamente rápida. Solo admite análisis de texto y es menos preciso.

#oficial#ligero#Soporta operación de CPU#solo texto
unslothHuggingFace

Qwen 3.5 0.8B (reconocimiento de imágenes liviano)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL

文本图像
参数:0.8B
大小:976MB
上下文:128k
速度极速
质量

Velocidad de ejecución extrema, adecuada para entornos de configuración extremadamente baja y admite análisis de imágenes, que es menos preciso.

#GPU extremadamente rápida#Soporta operación de CPU#multimodal#mini
DavidAUHuggingFace

Qwen 3.5 9B (ajuste fino de Claude)

DavidAU/Qwen3.5-9B-Claude-4.6-OS-Auto-Variable-HERETIC-UNCENSORED-THINKING-MAX-NEOCODE-Imatrix-GGUF:D_AU-IQ3_M-imat

文本图像
参数:9B
大小:6.5GB
上下文:128k
速度极速
质量

Ajustado según el conjunto de datos de Claude 4.6 y funciona bien siguiendo las instrucciones.

#Optimización de ajuste fino#Conjunto de datos de Claude#multimodal#NSFW#Sin censura#fuga de la prisión
UnslothHuggingFace

Gemma 4 E4B-it (compatible con audio)

unsloth/gemma-4-E4B-it-GGUF:Q4_K_S

文本图像音频
参数:4B
大小:5.83GB
量化:Q4_K_S
上下文:128k
速度快速
质量

La versión cuantificada original de Google, que admite análisis de texto, imágenes y audio.

#multimodal#rápido#Audio#el ingles es mejor
mradermacherHuggingFace

Qwen 3.5 4B (equilibrado)

mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M

文本图像
参数:4B
大小:3.08GB
量化:Q4_K_M
上下文:256k
速度快速
质量

La versión eliminada equilibra velocidad y calidad.

#limitar#Sin censura#NSFW#fuga de la prisión#multimodal
mradermacherHuggingFace

Qwen 3.5 2B (mejor)

mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0

文本图像
参数:2B
大小:2.68GB
量化:Q8_0
上下文:256k
速度很快
质量极高

La memoria de video 4G es la primera opción.

#limitar#Sin censura#NSFW#fuga de la prisión#multimodal
UnslothHuggingFace

Qwen 3.5 27B (más fuerte)

unsloth/Qwen3.5-27B-GGUF:Q4_0

文本图像
参数:27B
大小:16.63GB
量化:Q4_0
上下文:128k
速度较慢
质量极高

El modelo de parámetros muy grandes requiere una tarjeta gráfica de alto rendimiento para admitir el análisis de texto e imágenes.

#Parámetros muy grandes#multimodal#GPU de alto rendimiento
tatsuyaaaaaaaHuggingFace

Qwen 3.5 2B (optimización japonesa)

tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0

文本
参数:2B
大小:1.2GB
量化:Q4_0
上下文:128k
速度快速
质量

Modelo de análisis de texto optimizado para conjuntos de datos japoneses, solo admite análisis de texto.

#optimización japonesa#solo texto#Memoria de vídeo baja
jordanwoodsonHuggingFace

Qwen 3.5 2B (texto de jailbreak)

jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M

文本
参数:2B
大小:1.27GB
量化:Q4_K_M
上下文:128k
速度快速
质量

Un modelo de jailbreak que tiene cierta comprensión del contenido.

#fuga de la prisión#Sin censura#NSFW#solo texto
mradermacherHuggingFace

Qwen 3.5 2B Instrucción (alto coeficiente intelectual)

mradermacher/Qwen3.5-2B-Polaris-HighIQ-INSTRUCT-GGUF:IQ4_XS

文本图像
参数:2B
大小:1.54GB
量化:IQ4_XS
上下文:128k
速度快速
质量

Una versión altamente inteligente y optimizada de Polaris que admite análisis de texto e imágenes.

#Optimización de ajuste fino#alto coeficiente intelectual#multimodal
OpenBMBHuggingFace

MiniCPM-V 4.6 (pequeño cañón de acero con lectura de imágenes)

ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M

文本图像
参数:0.8B
大小:1.17GB
量化:Q4_K_M
上下文:32k
速度快速
质量极高

El modelo multimodal del extremo superior funciona extremadamente bien en OCR, reconocimiento de objetos y comprensión de escenas complejas.

#multimodal#OCR#Comprensión de la escena#Reconocimiento de imagen superior
unslothHuggingFace

Qwen 3.6 27B MTP (más nuevo)

unsloth/Qwen3.6-27B-MTP-GGUF:UD-IQ2_XXS

文本图像
参数:27B
大小:9.77GB
量化:UD-IQ2_XXS
上下文:128k
速度较慢
质量极高

La versión 3.6, que tiene un coeficiente intelectual explosivo, debe actualizarse a 2.1+ para admitirla.

#multimodal#MTP#Parámetros muy grandes#GPU de alto rendimiento
unslothHuggingFace

Gemma 4 E2B-it QAT MTP (alta velocidad total)

unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL

文本图像音频
参数:2B
大小:3.71GB
量化:UD-Q4_K_XL
上下文:128k
速度极速
质量

Con todas sus capacidades, además de la tecnología MTP para mayor velocidad, es, con diferencia, el mejor modelo para elegir.

#multimodal#Audio#Cuantificación QAT#MoE#Memoria de vídeo muy pequeña#el ingles es mejor
GnLOLotHuggingFace

MiniCPM5 1B Claude ajuste fino (cadena de pensamiento)

GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M

文本
参数:1B
大小:688MB
量化:Q4_K_M
上下文:128k
速度极速
质量极高

MiniCPM5-1B, que está optimizado en función del conjunto de datos de Claude Opus Fable5, admite el razonamiento en cadena de pensamiento y es bueno en programación y seguimiento de instrucciones.

#Optimización de ajuste fino#Conjunto de datos de Claude#cadena de pensamiento#Optimización de la programación#ligero#Soporta operación de CPU#solo texto
owaoHuggingFace

Nanbeige 4.2 3B (más allá de 9B)

owao/Nanbeige4.2-3B-GGUF:Q4_K_M

文本
参数:3B
大小:2.40GB
量化:Q4_K_M
上下文:128k
速度快速
质量

Cuerpo 3B de acero duro 9B, muy recomendable, pero solo admite texto.

#fuga de la prisión#Sin censura#NSFW#solo texto
owaoHuggingFace

Nanbeige 4.2 3B (más allá de 9B: alta precisión)

owao/Nanbeige4.2-3B-GGUF:Q8_0

文本
参数:3B
大小:4.13GB
量化:Q8_0
上下文:128k
速度快速
质量

Cuerpo 3B de acero duro 9B, cuantificación de máxima precisión Q8_0, muy recomendable, pero solo admite texto.

#fuga de la prisión#Sin censura#NSFW#solo texto#Alta precisión
mradermacherHuggingFace

Nanbeige 4.2 3B (optimizado para jailbreak)

mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M

文本
参数:3B
大小:2.78GB
量化:i1-Q5_K_M
上下文:128k
速度快速
质量

3B con cuerpo de acero duro 9B, la versión con jailbreak de i1 tiene una mayor precisión de cuantificación, pero solo admite texto.

#fuga de la prisión#Sin censura#NSFW#solo texto#Alta precisión

¿Listo para disfrutar de una gestión de archivos AI local más potente?

Sin configuraciones complejas, Firefly AI Folder admite motores integrados y descarga de modelos con un clic, iniciando un viaje de organización inteligente y eficiente.