Descarga rápida de modelos vanguardistas locales directamente desde el software
Compatible con modelos locales de HuggingFace y ModelScope, así como numerosos proveedores de modelos en la nube nacionales e internacionales
Qwen 3.5 0.8B (Básico)
ggml-org/Qwen3.5-0.8B-GGUF:Q4_0
Puede ejecutarse sin una tarjeta gráfica separada y tiene una velocidad de ejecución extremadamente rápida. Solo admite análisis de texto y es menos preciso.
Qwen 3.5 0.8B (reconocimiento de imágenes liviano)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Velocidad de ejecución extrema, adecuada para entornos de configuración extremadamente baja y admite análisis de imágenes, que es menos preciso.
Qwen 3.5 9B (ajuste fino de Claude)
DavidAU/Qwen3.5-9B-Claude-4.6-OS-Auto-Variable-HERETIC-UNCENSORED-THINKING-MAX-NEOCODE-Imatrix-GGUF:D_AU-IQ3_M-imat
Ajustado según el conjunto de datos de Claude 4.6 y funciona bien siguiendo las instrucciones.
Gemma 4 E4B-it (compatible con audio)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
La versión cuantificada original de Google, que admite análisis de texto, imágenes y audio.
Qwen 3.5 4B (equilibrado)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
La versión eliminada equilibra velocidad y calidad.
Qwen 3.5 2B (mejor)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
La memoria de video 4G es la primera opción.
Qwen 3.5 27B (más fuerte)
unsloth/Qwen3.5-27B-GGUF:Q4_0
El modelo de parámetros muy grandes requiere una tarjeta gráfica de alto rendimiento para admitir el análisis de texto e imágenes.
Qwen 3.5 2B (optimización japonesa)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Modelo de análisis de texto optimizado para conjuntos de datos japoneses, solo admite análisis de texto.
Qwen 3.5 2B (texto de jailbreak)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Un modelo de jailbreak que tiene cierta comprensión del contenido.
Qwen 3.5 2B Instrucción (alto coeficiente intelectual)
mradermacher/Qwen3.5-2B-Polaris-HighIQ-INSTRUCT-GGUF:IQ4_XS
Una versión altamente inteligente y optimizada de Polaris que admite análisis de texto e imágenes.
MiniCPM-V 4.6 (pequeño cañón de acero con lectura de imágenes)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
El modelo multimodal del extremo superior funciona extremadamente bien en OCR, reconocimiento de objetos y comprensión de escenas complejas.
Qwen 3.6 27B MTP (más nuevo)
unsloth/Qwen3.6-27B-MTP-GGUF:UD-IQ2_XXS
La versión 3.6, que tiene un coeficiente intelectual explosivo, debe actualizarse a 2.1+ para admitirla.
Gemma 4 E2B-it QAT MTP (alta velocidad total)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Con todas sus capacidades, además de la tecnología MTP para mayor velocidad, es, con diferencia, el mejor modelo para elegir.
MiniCPM5 1B Claude ajuste fino (cadena de pensamiento)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
MiniCPM5-1B, que está optimizado en función del conjunto de datos de Claude Opus Fable5, admite el razonamiento en cadena de pensamiento y es bueno en programación y seguimiento de instrucciones.
Nanbeige 4.2 3B (más allá de 9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
Cuerpo 3B de acero duro 9B, muy recomendable, pero solo admite texto.
Nanbeige 4.2 3B (más allá de 9B: alta precisión)
owao/Nanbeige4.2-3B-GGUF:Q8_0
Cuerpo 3B de acero duro 9B, cuantificación de máxima precisión Q8_0, muy recomendable, pero solo admite texto.
Nanbeige 4.2 3B (optimizado para jailbreak)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B con cuerpo de acero duro 9B, la versión con jailbreak de i1 tiene una mayor precisión de cuantificación, pero solo admite texto.
¿Listo para disfrutar de una gestión de archivos AI local más potente?
Sin configuraciones complejas, Firefly AI Folder admite motores integrados y descarga de modelos con un clic, iniciando un viaje de organización inteligente y eficiente.