Centre de l'écosystème de modèles IA

Téléchargement rapide de modèles de pointe locales directement dans l'application

Compatible avec les modèles locaux HuggingFace et ModelScope, ainsi qu'avec de nombreux fournisseurs cloud de modèles nationaux et internationaux

34+
Prise en charge des modèles légers locaux
100%
Confidentialité sans souci, fonctionnement hors ligne
35+
Intégration des principales API cloud
Filtre de capacités:
unslothHuggingFace

Qwen 3.5 0.8B (Le chinois est meilleur)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL

Texte
Paramètre:0.8B
Taille:579MB
Quantification:UD-Q5_K_XL
Contexte:128k
VitesseVitesse extrême
QualitéMoyen

Modèle de texte extrêmement rapide et léger, adapté aux environnements bas de gamme et CPU, avec des performances d'analyse chinoise équilibrées.

#Léger#Prise en charge du fonctionnement du processeur#Ultra rapide#Texte uniquement
unslothHuggingFace

Qwen 3.5 0.8B (Reconnaissance d'image légère)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL

TexteImage
Paramètre:0.8B
Taille:976MB
Contexte:128k
VitesseVitesse extrême
QualitéMoyen

Vitesse d'exécution extrême, adaptée aux environnements à configuration extrêmement faible et prenant en charge l'analyse d'images, qui est moins précise.

#GPU extrêmement rapide#Prise en charge du fonctionnement du processeur#Multimodal#Mini
AbirayHuggingFace

LFM2.5 2.6B(Évasion de prison)

Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M

推荐
Texte
Paramètre:2.6B
Taille:1.56GB
Quantification:Q4_K_M
Contexte:32k
VitesseTrès vite
QualitéÉlevé

Version sans restriction ni censure de LFM2.5 2.6B, équilibre entre vitesse et qualité.

#Limiter#Pas de censure#NSFW#Texte uniquement
UnslothHuggingFace

Gemma 4 E4B-it(Prise en charge audio)

unsloth/gemma-4-E4B-it-GGUF:Q4_K_S

推荐
TexteImage Audio
Paramètre:4B
Taille:5.83GB
Quantification:Q4_K_S
Contexte:128k
VitesseRapide
QualitéÉlevé

Version quantifiée originale de Google, prenant en charge l'analyse de texte, d'image et d'audio.

#Multimodal#Rapide#Audio#L'anglais est meilleur
mradermacherHuggingFace

Qwen 3.5 4B(Équilibre)

mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M

TexteImage
Paramètre:4B
Taille:3.08GB
Quantification:Q4_K_M
Contexte:256k
VitesseRapide
QualitéÉlevé

La version ablitérée équilibre vitesse et qualité.

#Limiter#Pas de censure#NSFW#Évasion de prison#Multimodal
mradermacherHuggingFace

Qwen 3.5 2B(Mieux)

mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0

TexteImage
Paramètre:2B
Taille:2.68GB
Quantification:Q8_0
Contexte:256k
VitesseTrès vite
QualitéTrès élevé

La mémoire vidéo 4G est le premier choix.

#Limiter#Pas de censure#NSFW#Évasion de prison#Multimodal
tatsuyaaaaaaaHuggingFace

Qwen 3.5 2B(Optimisation japonaise)

tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0

Texte
Paramètre:2B
Taille:1.2GB
Quantification:Q4_0
Contexte:128k
VitesseRapide
QualitéMoyen

Modèle d'analyse de texte optimisé pour les ensembles de données japonais, prend uniquement en charge l'analyse de texte.

#Optimisation japonaise#Texte uniquement#Mémoire vidéo faible
jordanwoodsonHuggingFace

Qwen 3.5 2B(Texte de jailbreak)

jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M

Texte
Paramètre:2B
Taille:1.27GB
Quantification:Q4_K_M
Contexte:128k
VitesseRapide
QualitéÉlevé

Un modèle de jailbreak qui a une certaine compréhension du contenu.

#Évasion de prison#Pas de censure#NSFW#Texte uniquement
OpenBMBHuggingFace

MiniCPM-V 4.6 (Petit canon en acier à lecture d'images)

ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M

推荐
TexteImage
Paramètre:0.8B
Taille:1.17GB
Quantification:Q4_K_M
Contexte:32k
VitesseRapide
QualitéTrès élevé

Le modèle multimodal haut de gamme fonctionne extrêmement bien en matière d'OCR, de reconnaissance d'objets et de compréhension de scènes complexes.

#Multimodal#Reconnaissance optique de caractères#Compréhension de la scène#Reconnaissance d'image supérieure
unslothHuggingFace

Gemma 4 E2B-it QAT MTP(Polyvalent – ​​grande vitesse)

unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL

推荐
TexteImage Audio
Paramètre:2B
Taille:3.71GB
Quantification:UD-Q4_K_XL
Contexte:128k
VitesseVitesse extrême
QualitéMoyen

Avec toutes ses capacités, ainsi que la technologie MTP pour la vitesse, c'est de loin le meilleur modèle à choisir.

#Multimodal#Audio#Quantification du QAT#MoE#Très petite mémoire vidéo#L'anglais est meilleur
GnLOLotHuggingFace

MiniCPM5 1B Claude微调(Chaîne de pensée)

GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M

Texte
Paramètre:1B
Taille:688MB
Quantification:Q4_K_M
Contexte:128k
VitesseVitesse extrême
QualitéTrès élevé

MiniCPM5-1B, qui est affiné sur la base de l'ensemble de données Claude Opus Fable5, prend en charge le raisonnement en chaîne de pensée et est bon en programmation et en suivi d'instructions.

#Optimisation fine#Ensemble de données Claude#Chaîne de pensée#Optimisation de la programmation#Léger#Prise en charge du fonctionnement du processeur#Texte uniquement
owaoHuggingFace

Nanbeige 4.2 3B (au-delà de 9B)

owao/Nanbeige4.2-3B-GGUF:Q4_K_M

Texte
Paramètre:3B
Taille:2.40GB
Quantification:Q4_K_M
Contexte:128k
VitesseRapide
QualitéMoyen

Corps 3B en acier dur 9B, fortement recommandé, mais ne supporte que le texte.

#Évasion de prison#Pas de censure#NSFW#Texte uniquement
mradermacherHuggingFace

Nanbeige 4.2 3B(Optimisation du jailbreak)

mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M

推荐
Texte
Paramètre:3B
Taille:2.78GB
Quantification:i1-Q5_K_M
Contexte:128k
VitesseRapide
QualitéÉlevé

Corps 3B en acier dur 9B, la version jailbreakée de i1 a une précision de quantification plus élevée, mais ne prend en charge que le texte.

#Évasion de prison#Pas de censure#NSFW#Texte uniquement#Haute précision
GoogleHuggingFace

Gemma 3 1B Instruct(基础)

unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL

Texte
Paramètre:1B
Taille:770MB
Quantification:UD-Q4_K_XL
Contexte:32k
VitesseVitesse extrême
QualitéMoyen

Leader du mannequin anglais

#Léger#Prise en charge du fonctionnement du processeur#Texte uniquement#L'anglais est meilleur
gaston-parraviciniHuggingFace

LFM2.5 8B A1B(Évasion de prison)

gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M

推荐
Texte
Paramètre:8B-A1B
Taille:4.80GB
Quantification:Q4_K_M
Contexte:32k
VitesseTrès vite
QualitéÉlevé

LFM2.5 8B A1B MoE Version non censurée, seulement 1B paramètres d'activation, vitesse et qualité équilibrées.

#MoE#Pas de censure#NSFW#Évasion de prison#Texte uniquement#L'anglais est meilleur
dealignaiHuggingFace

Bonsai 27B 1-bit(Super-compression)

dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0

TexteImage
Paramètre:27B
Taille:5.21GB
Quantification:Q1_0
Contexte:128k
VitesseRapide
QualitéMoyen

Version jailbreak Bonsai 27B 1-bit quantification, désalignée sans censure, prise en charge de l'analyse de texte et d'images.

#1-bit#Évasion de prison#Pas de censure#NSFW#Multimodal#Mémoire vidéo faible
JonathanColettiHuggingFace

Qwen 3.8 27B(Le jailbreak le plus puissant)

JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M

TexteImage
Paramètre:27B
Taille:16.52GB
Quantification:Q4_K_M
Contexte:128k
VitessePlus lent
QualitéÉlevé

Qwen3.8-27B est une version quantitative non censurée qui conserve les prédictions longues MTP et prend en charge l'analyse de texte et d'images.

#Pas de censure#Évasion de prison#NSFW#Multimodal#Grands paramètres#MTP
empero-aiHuggingFace

Qwen 3.8 2B(Distillation)

empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M

推荐
Texte
Paramètre:2B
Taille:1.22GB
Quantification:Q4_K_M
Contexte:128k
VitesseVitesse extrême
QualitéÉlevé

Qwen3.8 version distillée, vitesse d'exécution maximale, prend uniquement en charge l'analyse de texte.

#Distillation#Léger#Prise en charge du fonctionnement du processeur#Texte uniquement
empero-aiHuggingFace

Qwen 3.8 9B(Distillation)

empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M

推荐
Texte
Paramètre:9B
Taille:5.38GB
Quantification:Q4_K_M
Contexte:128k
VitesseRapide
QualitéTrès élevé

Qwen3.8 version distillée, héritant de la capacité de raisonnement profond des grands modèles, prend uniquement en charge l'analyse de texte.

#Distillation#Raisonnement#Texte uniquement#Optimisation fine
ornith-aiHuggingFace

Ornith 1.5 9B(Haut de gamme)

ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M

推荐
TexteImage
Paramètre:9B
Taille:6.24GB
Quantification:Q4_K_M
Contexte:128k
VitesseMoyen
QualitéTrès élevé

Modèle multimodal Ornith 1.5, prend en charge l'analyse de texte et d'images.

#Multimodal#Reconnaissance d'images#L'anglais est meilleur
XHTokenHuggingFace

Spark X2.5 1.7B(Léger)

XHToken/Spark-X2.5-1.7B-GGUF

Texte
Paramètre:1.7B
Taille:3.19GB
Contexte:128k
VitesseRapide
QualitéMoyen

Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。

#Léger#Prise en charge du fonctionnement du processeur#Texte uniquement

Prêt à découvrir une gestion de fichiers IA locale encore plus puissante ?

Pas de configuration complexe nécessaire, le Firefly AI Folder AI prend en charge le moteur intégré et le téléchargement de modèles en un clic, vous ouvrant la voie à une organisation intelligente et efficace.