Téléchargement rapide de modèles de pointe locales directement dans l'application
Compatible avec les modèles locaux HuggingFace et ModelScope, ainsi qu'avec de nombreux fournisseurs cloud de modèles nationaux et internationaux
Qwen 3.5 0.8B (Le chinois est meilleur)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL
Modèle de texte extrêmement rapide et léger, adapté aux environnements bas de gamme et CPU, avec des performances d'analyse chinoise équilibrées.
Qwen 3.5 0.8B (Reconnaissance d'image légère)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Vitesse d'exécution extrême, adaptée aux environnements à configuration extrêmement faible et prenant en charge l'analyse d'images, qui est moins précise.
MiniCPM5 2B(Haute qualité•Rapide•Évasion de prison)
Abiray/MiniCPM5-2B-heretic-abliterated-GGUF:Q4_K_M
La mémoire vidéo est insuffisante, et si vous souhaitez classer correctement les fichiers, vous devez me choisir pour restreindre la version (Ablitérée).
LFM2.5 2.6B(Évasion de prison)
Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M
Version sans restriction ni censure de LFM2.5 2.6B, équilibre entre vitesse et qualité.
Gemma 4 E4B-it(Prise en charge audio)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
Version quantifiée originale de Google, prenant en charge l'analyse de texte, d'image et d'audio.
Qwen 3.5 4B(Équilibre)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
La version ablitérée équilibre vitesse et qualité.
Qwen 3.5 2B(Mieux)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
La mémoire vidéo 4G est le premier choix.
Qwen 3.5 2B(Optimisation japonaise)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Modèle d'analyse de texte optimisé pour les ensembles de données japonais, prend uniquement en charge l'analyse de texte.
Qwen 3.5 2B(Texte de jailbreak)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Un modèle de jailbreak qui a une certaine compréhension du contenu.
MiniCPM-V 4.6 (Petit canon en acier à lecture d'images)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
Le modèle multimodal haut de gamme fonctionne extrêmement bien en matière d'OCR, de reconnaissance d'objets et de compréhension de scènes complexes.
Gemma 4 E2B-it QAT MTP(Polyvalent – grande vitesse)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Avec toutes ses capacités, ainsi que la technologie MTP pour la vitesse, c'est de loin le meilleur modèle à choisir.
Nanbeige 4.2 3B(Optimisation du jailbreak)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
Corps 3B en acier dur 9B, la version jailbreakée de i1 a une précision de quantification plus élevée, mais ne prend en charge que le texte.
Gemma 3 1B Instruct(基础)
unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL
Leader du mannequin anglais
LFM2.5 8B A1B(Évasion de prison)
gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M
LFM2.5 8B A1B MoE Version non censurée, seulement 1B paramètres d'activation, vitesse et qualité équilibrées.
Bonsai 27B 1-bit(Super-compression)
dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0
Version jailbreak Bonsai 27B 1-bit quantification, désalignée sans censure, prise en charge de l'analyse de texte et d'images.
Qwen 3.8 27B(Évasion de prison)
HauhauCS/Qwen3.8-27B-Uncensored-HauhauCS-Aggressive-MTP-GGUF:Q4_K_P
Qwen3.8-27B est une version de décensure radicale. La quantification de la série P conserve une plus grande précision dans les tenseurs clés, sans censure et prend en charge l'analyse d'images.
Ornith 1.5 9B(Haut de gamme)
ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M
Modèle multimodal Ornith 1.5, prend en charge l'analyse de texte et d'images.
Prêt à découvrir une gestion de fichiers IA locale encore plus puissante ?
Pas de configuration complexe nécessaire, le Firefly AI Folder AI prend en charge le moteur intégré et le téléchargement de modèles en un clic, vous ouvrant la voie à une organisation intelligente et efficace.