Téléchargement rapide de modèles de pointe locales directement dans l'application
Compatible avec les modèles locaux HuggingFace et ModelScope, ainsi qu'avec de nombreux fournisseurs cloud de modèles nationaux et internationaux
Qwen 3.5 0.8B (de base)
ggml-org/Qwen3.5-0.8B-GGUF:Q4_0
Il peut fonctionner sans carte graphique séparée et sa vitesse de fonctionnement est extrêmement rapide. Il ne prend en charge que l'analyse de texte et est moins précis.
Qwen 3.5 0.8B (reconnaissance d'image légère)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Vitesse d'exécution extrême, adaptée aux environnements à configuration extrêmement faible et prenant en charge l'analyse d'images, qui est moins précise.
Qwen 3.5 9B (mise au point Claude)
DavidAU/Qwen3.5-9B-Claude-4.6-OS-Auto-Variable-HERETIC-UNCENSORED-THINKING-MAX-NEOCODE-Imatrix-GGUF:D_AU-IQ3_M-imat
Affiné sur la base de l'ensemble de données Claude 4.6 et fonctionne bien dans les instructions suivantes.
Gemma 4 E4B-it (audio pris en charge)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
Version quantifiée originale de Google, prenant en charge l'analyse de texte, d'image et d'audio.
Qwen 3.5 4B (équilibré)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
La version ablitérée équilibre vitesse et qualité.
Qwen 3.5 2B (meilleur)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
La mémoire vidéo 4G est le premier choix.
Qwen 3.5 27B (le plus fort)
unsloth/Qwen3.5-27B-GGUF:Q4_0
Le modèle à très grands paramètres nécessite une carte graphique hautes performances pour prendre en charge l'analyse de texte et d'images.
Qwen 3.5 2B (optimisation japonaise)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Modèle d'analyse de texte optimisé pour les ensembles de données japonais, prend uniquement en charge l'analyse de texte.
Qwen 3.5 2B (texte de jailbreak)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Un modèle de jailbreak qui a une certaine compréhension du contenu.
Qwen 3.5 2B Instruct (QI élevé)
mradermacher/Qwen3.5-2B-Polaris-HighIQ-INSTRUCT-GGUF:IQ4_XS
Une version très intelligente et optimisée de Polaris qui prend en charge l'analyse de texte et d'images.
MiniCPM-V 4.6 (petit canon en acier à lecture d'images)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
Le modèle multimodal haut de gamme fonctionne extrêmement bien en matière d'OCR, de reconnaissance d'objets et de compréhension de scènes complexes.
Qwen 3.6 27B MTP (plus récent)
unsloth/Qwen3.6-27B-MTP-GGUF:UD-IQ2_XXS
La version 3.6, qui a un QI explosif, doit être mise à niveau vers la version 2.1+ pour la prendre en charge.
Gemma 4 E2B-it QAT MTP (haute vitesse polyvalente)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Avec toutes ses capacités, ainsi que la technologie MTP pour la vitesse, c'est de loin le meilleur modèle à choisir.
MiniCPM5 1B Claude réglage fin (chaîne de réflexion)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
MiniCPM5-1B, qui est affiné sur la base de l'ensemble de données Claude Opus Fable5, prend en charge le raisonnement en chaîne de pensée et est bon en programmation et en suivi d'instructions.
Nanbeige 4.2 3B (au-delà de 9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
Corps 3B en acier dur 9B, fortement recommandé, mais ne supporte que le texte.
Nanbeige 4.2 3B (au-delà de 9B-haute précision)
owao/Nanbeige4.2-3B-GGUF:Q8_0
Corps en acier dur 3B 9B, quantification de la plus haute précision Q8_0, fortement recommandé, mais ne prend en charge que le texte.
Nanbeige 4.2 3B (optimisé pour le jailbreak)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
Corps 3B en acier dur 9B, la version jailbreakée de i1 a une précision de quantification plus élevée, mais ne prend en charge que le texte.
Prêt à découvrir une gestion de fichiers IA locale encore plus puissante ?
Pas de configuration complexe nécessaire, le Firefly AI Folder AI prend en charge le moteur intégré et le téléchargement de modèles en un clic, vous ouvrant la voie à une organisation intelligente et efficace.