Centre de l'écosystème de modèles IA

Téléchargement rapide de modèles de pointe locales directement dans l'application

Compatible avec les modèles locaux HuggingFace et ModelScope, ainsi qu'avec de nombreux fournisseurs cloud de modèles nationaux et internationaux

30+
Prise en charge des modèles légers locaux
100%
Confidentialité sans souci, fonctionnement hors ligne
35+
Intégration des principales API cloud
能力筛选:
ggml-orgHuggingFace

Qwen 3.5 0.8B (de base)

ggml-org/Qwen3.5-0.8B-GGUF:Q4_0

内置
文本
参数:0.8B
大小:563MB
量化:Q4_0
上下文:128k
速度极速
质量

Il peut fonctionner sans carte graphique séparée et sa vitesse de fonctionnement est extrêmement rapide. Il ne prend en charge que l'analyse de texte et est moins précis.

#officiel#léger#Prise en charge du fonctionnement du processeur#texte uniquement
unslothHuggingFace

Qwen 3.5 0.8B (reconnaissance d'image légère)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL

文本图像
参数:0.8B
大小:976MB
上下文:128k
速度极速
质量

Vitesse d'exécution extrême, adaptée aux environnements à configuration extrêmement faible et prenant en charge l'analyse d'images, qui est moins précise.

#GPU extrêmement rapide#Prise en charge du fonctionnement du processeur#multimodal#mini
DavidAUHuggingFace

Qwen 3.5 9B (mise au point Claude)

DavidAU/Qwen3.5-9B-Claude-4.6-OS-Auto-Variable-HERETIC-UNCENSORED-THINKING-MAX-NEOCODE-Imatrix-GGUF:D_AU-IQ3_M-imat

文本图像
参数:9B
大小:6.5GB
上下文:128k
速度极速
质量

Affiné sur la base de l'ensemble de données Claude 4.6 et fonctionne bien dans les instructions suivantes.

#Optimisation fine#Ensemble de données Claude#multimodal#NSFW#Pas de censure#évasion de prison
UnslothHuggingFace

Gemma 4 E4B-it (audio pris en charge)

unsloth/gemma-4-E4B-it-GGUF:Q4_K_S

文本图像音频
参数:4B
大小:5.83GB
量化:Q4_K_S
上下文:128k
速度快速
质量

Version quantifiée originale de Google, prenant en charge l'analyse de texte, d'image et d'audio.

#multimodal#rapide#Audio#L'anglais est meilleur
mradermacherHuggingFace

Qwen 3.5 4B (équilibré)

mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M

文本图像
参数:4B
大小:3.08GB
量化:Q4_K_M
上下文:256k
速度快速
质量

La version ablitérée équilibre vitesse et qualité.

#limiter#Pas de censure#NSFW#évasion de prison#multimodal
mradermacherHuggingFace

Qwen 3.5 2B (meilleur)

mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0

文本图像
参数:2B
大小:2.68GB
量化:Q8_0
上下文:256k
速度很快
质量极高

La mémoire vidéo 4G est le premier choix.

#limiter#Pas de censure#NSFW#évasion de prison#multimodal
UnslothHuggingFace

Qwen 3.5 27B (le plus fort)

unsloth/Qwen3.5-27B-GGUF:Q4_0

文本图像
参数:27B
大小:16.63GB
量化:Q4_0
上下文:128k
速度较慢
质量极高

Le modèle à très grands paramètres nécessite une carte graphique hautes performances pour prendre en charge l'analyse de texte et d'images.

#Très grands paramètres#multimodal#GPU hautes performances
tatsuyaaaaaaaHuggingFace

Qwen 3.5 2B (optimisation japonaise)

tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0

文本
参数:2B
大小:1.2GB
量化:Q4_0
上下文:128k
速度快速
质量

Modèle d'analyse de texte optimisé pour les ensembles de données japonais, prend uniquement en charge l'analyse de texte.

#Optimisation japonaise#texte uniquement#Mémoire vidéo faible
jordanwoodsonHuggingFace

Qwen 3.5 2B (texte de jailbreak)

jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M

文本
参数:2B
大小:1.27GB
量化:Q4_K_M
上下文:128k
速度快速
质量

Un modèle de jailbreak qui a une certaine compréhension du contenu.

#évasion de prison#Pas de censure#NSFW#texte uniquement
mradermacherHuggingFace

Qwen 3.5 2B Instruct (QI élevé)

mradermacher/Qwen3.5-2B-Polaris-HighIQ-INSTRUCT-GGUF:IQ4_XS

文本图像
参数:2B
大小:1.54GB
量化:IQ4_XS
上下文:128k
速度快速
质量

Une version très intelligente et optimisée de Polaris qui prend en charge l'analyse de texte et d'images.

#Optimisation fine#QI élevé#multimodal
OpenBMBHuggingFace

MiniCPM-V 4.6 (petit canon en acier à lecture d'images)

ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M

文本图像
参数:0.8B
大小:1.17GB
量化:Q4_K_M
上下文:32k
速度快速
质量极高

Le modèle multimodal haut de gamme fonctionne extrêmement bien en matière d'OCR, de reconnaissance d'objets et de compréhension de scènes complexes.

#multimodal#OCR#Compréhension de la scène#Reconnaissance d'image supérieure
unslothHuggingFace

Qwen 3.6 27B MTP (plus récent)

unsloth/Qwen3.6-27B-MTP-GGUF:UD-IQ2_XXS

文本图像
参数:27B
大小:9.77GB
量化:UD-IQ2_XXS
上下文:128k
速度较慢
质量极高

La version 3.6, qui a un QI explosif, doit être mise à niveau vers la version 2.1+ pour la prendre en charge.

#multimodal#MTP#Très grands paramètres#GPU hautes performances
unslothHuggingFace

Gemma 4 E2B-it QAT MTP (haute vitesse polyvalente)

unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL

文本图像音频
参数:2B
大小:3.71GB
量化:UD-Q4_K_XL
上下文:128k
速度极速
质量

Avec toutes ses capacités, ainsi que la technologie MTP pour la vitesse, c'est de loin le meilleur modèle à choisir.

#multimodal#Audio#Quantification du QAT#MoE#Très petite mémoire vidéo#L'anglais est meilleur
GnLOLotHuggingFace

MiniCPM5 1B Claude réglage fin (chaîne de réflexion)

GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M

文本
参数:1B
大小:688MB
量化:Q4_K_M
上下文:128k
速度极速
质量极高

MiniCPM5-1B, qui est affiné sur la base de l'ensemble de données Claude Opus Fable5, prend en charge le raisonnement en chaîne de pensée et est bon en programmation et en suivi d'instructions.

#Optimisation fine#Ensemble de données Claude#Chaîne de pensée#Optimisation de la programmation#léger#Prise en charge du fonctionnement du processeur#texte uniquement
owaoHuggingFace

Nanbeige 4.2 3B (au-delà de 9B)

owao/Nanbeige4.2-3B-GGUF:Q4_K_M

文本
参数:3B
大小:2.40GB
量化:Q4_K_M
上下文:128k
速度快速
质量

Corps 3B en acier dur 9B, fortement recommandé, mais ne supporte que le texte.

#évasion de prison#Pas de censure#NSFW#texte uniquement
owaoHuggingFace

Nanbeige 4.2 3B (au-delà de 9B-haute précision)

owao/Nanbeige4.2-3B-GGUF:Q8_0

文本
参数:3B
大小:4.13GB
量化:Q8_0
上下文:128k
速度快速
质量

Corps en acier dur 3B 9B, quantification de la plus haute précision Q8_0, fortement recommandé, mais ne prend en charge que le texte.

#évasion de prison#Pas de censure#NSFW#texte uniquement#Haute précision
mradermacherHuggingFace

Nanbeige 4.2 3B (optimisé pour le jailbreak)

mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M

文本
参数:3B
大小:2.78GB
量化:i1-Q5_K_M
上下文:128k
速度快速
质量

Corps 3B en acier dur 9B, la version jailbreakée de i1 a une précision de quantification plus élevée, mais ne prend en charge que le texte.

#évasion de prison#Pas de censure#NSFW#texte uniquement#Haute précision

Prêt à découvrir une gestion de fichiers IA locale encore plus puissante ?

Pas de configuration complexe nécessaire, le Firefly AI Folder AI prend en charge le moteur intégré et le téléchargement de modèles en un clic, vous ouvrant la voie à une organisation intelligente et efficace.