Téléchargement rapide de modèles de pointe locales directement dans l'application
Compatible avec les modèles locaux HuggingFace et ModelScope, ainsi qu'avec de nombreux fournisseurs cloud de modèles nationaux et internationaux
Qwen 3.5 0.8B (Le chinois est meilleur)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL
Modèle de texte extrêmement rapide et léger, adapté aux environnements bas de gamme et CPU, avec des performances d'analyse chinoise équilibrées.
Qwen 3.5 0.8B (Reconnaissance d'image légère)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Vitesse d'exécution extrême, adaptée aux environnements à configuration extrêmement faible et prenant en charge l'analyse d'images, qui est moins précise.
LFM2.5 2.6B(Évasion de prison)
Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M
Version sans restriction ni censure de LFM2.5 2.6B, équilibre entre vitesse et qualité.
Gemma 4 E4B-it(Prise en charge audio)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
Version quantifiée originale de Google, prenant en charge l'analyse de texte, d'image et d'audio.
Qwen 3.5 4B(Équilibre)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
La version ablitérée équilibre vitesse et qualité.
Qwen 3.5 2B(Mieux)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
La mémoire vidéo 4G est le premier choix.
Qwen 3.5 2B(Optimisation japonaise)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Modèle d'analyse de texte optimisé pour les ensembles de données japonais, prend uniquement en charge l'analyse de texte.
Qwen 3.5 2B(Texte de jailbreak)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Un modèle de jailbreak qui a une certaine compréhension du contenu.
MiniCPM-V 4.6 (Petit canon en acier à lecture d'images)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
Le modèle multimodal haut de gamme fonctionne extrêmement bien en matière d'OCR, de reconnaissance d'objets et de compréhension de scènes complexes.
Gemma 4 E2B-it QAT MTP(Polyvalent – grande vitesse)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Avec toutes ses capacités, ainsi que la technologie MTP pour la vitesse, c'est de loin le meilleur modèle à choisir.
MiniCPM5 1B Claude微调(Chaîne de pensée)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
MiniCPM5-1B, qui est affiné sur la base de l'ensemble de données Claude Opus Fable5, prend en charge le raisonnement en chaîne de pensée et est bon en programmation et en suivi d'instructions.
Nanbeige 4.2 3B (au-delà de 9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
Corps 3B en acier dur 9B, fortement recommandé, mais ne supporte que le texte.
Nanbeige 4.2 3B(Optimisation du jailbreak)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
Corps 3B en acier dur 9B, la version jailbreakée de i1 a une précision de quantification plus élevée, mais ne prend en charge que le texte.
Gemma 3 1B Instruct(基础)
unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL
Leader du mannequin anglais
LFM2.5 8B A1B(Évasion de prison)
gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M
LFM2.5 8B A1B MoE Version non censurée, seulement 1B paramètres d'activation, vitesse et qualité équilibrées.
Bonsai 27B 1-bit(Super-compression)
dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0
Version jailbreak Bonsai 27B 1-bit quantification, désalignée sans censure, prise en charge de l'analyse de texte et d'images.
Qwen 3.8 27B(Le jailbreak le plus puissant)
JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M
Qwen3.8-27B est une version quantitative non censurée qui conserve les prédictions longues MTP et prend en charge l'analyse de texte et d'images.
Qwen 3.8 2B(Distillation)
empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M
Qwen3.8 version distillée, vitesse d'exécution maximale, prend uniquement en charge l'analyse de texte.
Qwen 3.8 9B(Distillation)
empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M
Qwen3.8 version distillée, héritant de la capacité de raisonnement profond des grands modèles, prend uniquement en charge l'analyse de texte.
Ornith 1.5 9B(Haut de gamme)
ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M
Modèle multimodal Ornith 1.5, prend en charge l'analyse de texte et d'images.
Spark X2.5 1.7B(Léger)
XHToken/Spark-X2.5-1.7B-GGUF
Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。
Prêt à découvrir une gestion de fichiers IA locale encore plus puissante ?
Pas de configuration complexe nécessaire, le Firefly AI Folder AI prend en charge le moteur intégré et le téléchargement de modèles en un clic, vous ouvrant la voie à une organisation intelligente et efficace.