Descarga rápida de modelos vanguardistas locales directamente desde el software
Compatible con modelos locales de HuggingFace y ModelScope, así como numerosos proveedores de modelos en la nube nacionales e internacionales
Qwen 3.5 0.8B (El chino es mejor)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL
Modelo de texto extremadamente rápido y liviano, adecuado para entornos de CPU y de gama baja, con un rendimiento de análisis chino equilibrado.
Qwen 3.5 0.8B (Reconocimiento de imágenes ligero)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Velocidad de ejecución extrema, adecuada para entornos de configuración extremadamente baja y admite análisis de imágenes, que es menos preciso.
LFM2.5 2.6B(Fuga de la prisión)
Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M
Versión de LFM2.5 2.6B sin restricciones y sin censura, equilibrio entre velocidad y calidad.
Gemma 4 E4B-it(Audio de soporte)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
La versión cuantificada original de Google, que admite análisis de texto, imágenes y audio.
Qwen 3.5 4B(Balance)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
La versión eliminada equilibra velocidad y calidad.
Qwen 3.5 2B(Mejor)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
La memoria de video 4G es la primera opción.
Qwen 3.5 2B(Optimización japonesa)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Modelo de análisis de texto optimizado para conjuntos de datos japoneses, solo admite análisis de texto.
Qwen 3.5 2B(Texto de fuga)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Un modelo de jailbreak que tiene cierta comprensión del contenido.
MiniCPM-V 4.6 (Cañón de acero pequeño que lee imágenes)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
El modelo multimodal del extremo superior funciona extremadamente bien en OCR, reconocimiento de objetos y comprensión de escenas complejas.
Gemma 4 E2B-it QAT MTP(Todo terreno: alta velocidad)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Con todas sus capacidades, además de la tecnología MTP para mayor velocidad, es, con diferencia, el mejor modelo para elegir.
MiniCPM5 1B Claude微调(Cadena de pensamiento)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
MiniCPM5-1B, que está optimizado en función del conjunto de datos de Claude Opus Fable5, admite el razonamiento en cadena de pensamiento y es bueno en programación y seguimiento de instrucciones.
Nanbeige 4.2 3B (más allá de 9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
Cuerpo 3B de acero duro 9B, muy recomendable, pero solo admite texto.
Nanbeige 4.2 3B(Optimización de jailbreak)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B con cuerpo de acero duro 9B, la versión con jailbreak de i1 tiene una mayor precisión de cuantificación, pero solo admite texto.
Gemma 3 1B Instruct(基础)
unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL
Líder modelo inglés
LFM2.5 8B A1B(Fuga de la prisión)
gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M
LFM2.5 8B A1B MoE Versión sin censura, solo parámetros de activación 1B, velocidad y calidad equilibradas.
Bonsai 27B 1-bit(Súper compresión)
dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0
Versión jailbreak cuantificada a 1 bit de Bonsai 27B, desalineada y sin censura, compatible con análisis de texto e imágenes.
Qwen 3.8 27B(El jailbreak más fuerte)
JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M
Qwen3.8-27B es una versión cuantitativa sin censura que conserva predicciones largas de MTP y admite análisis de texto e imágenes.
Qwen 3.8 2B(Destilación)
empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M
Qwen3.8 versión destilada, velocidad de ejecución extrema, solo admite análisis de texto。
Qwen 3.8 9B(Destilación)
empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M
Qwen3.8 versión destilada, hereda la capacidad de razonamiento profundo del modelo grande, solo admite análisis de texto。
Ornith 1.5 9B(Premium)
ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M
Ornith 1.5 modelo multimodal, admite análisis de texto e imagen。
Spark X2.5 1.7B(Ligero)
XHToken/Spark-X2.5-1.7B-GGUF
Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。
¿Listo para disfrutar de una gestión de archivos AI local más potente?
Sin configuraciones complejas, Firefly AI Folder admite motores integrados y descarga de modelos con un clic, iniciando un viaje de organización inteligente y eficiente.