Внутри приложения поддерживается высокоскоростная загрузка передовых локальных моделей
Поддержка локальных моделей из двух источников — HuggingFace и ModelScope, а также многочисленных облачных провайдеров моделей как внутри страны, так и за рубежом
Qwen 3.5 0.8B (Китайский лучше)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL
Чрезвычайно быстрая и легкая текстовая модель, подходящая для сред низкого уровня и ЦП, со сбалансированной производительностью анализа на китайском языке.
Qwen 3.5 0.8B (Легкое распознавание изображений)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Экстремальная скорость работы, подходит для сред с чрезвычайно низкой конфигурацией и поддерживает менее точный анализ изображений.
LFM2.5 2.6B(побег из тюрьмы)
Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M
Версия без ограничений и цензуры LFM2.5 2.6B, баланс скорости и качества.
Gemma 4 E4B-it(Поддержка аудио)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
Оригинальная количественная версия Google, поддерживающая анализ текста, изображений и аудио.
Qwen 3.5 4B(баланс)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
Урезанная версия сочетает в себе скорость и качество.
Qwen 3.5 2B(лучше)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
Видеопамять 4G — лучший выбор.
Qwen 3.5 2B(Японская оптимизация)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Модель анализа текста, оптимизированная для японских наборов данных, поддерживает только анализ текста.
Qwen 3.5 2B(текст побега из тюрьмы)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Модель джейлбрейка, имеющая определенное понимание содержания.
MiniCPM-V 4.6 (Маленькая стальная пушка, читающая картинки)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
Мультимодальная модель верхнего уровня очень хорошо справляется с оптическим распознаванием текста, распознаванием объектов и пониманием сложных сцен.
Gemma 4 E2B-it QAT MTP(Всестороннее - высокая скорость)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Обладая всеми возможностями, а также технологией MTP для обеспечения скорости, это, безусловно, лучшая модель для выбора.
MiniCPM5 1B Claude微调(Цепочка мыслей)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
MiniCPM5-1B, настроенный на основе набора данных Claude Opus Fable5, поддерживает цепочку мышления и хорош в программировании и выполнении инструкций.
Наньбежевый 4,2 3B (за пределами 9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
Корпус 3B из твердой стали 9B, настоятельно рекомендуется, но поддерживает только текст.
Nanbeige 4.2 3B(Джейлбрейк-Оптимизация)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B корпус из твердой стали 9B, версия i1 с джейлбрейком имеет более высокую точность квантования, но поддерживает только текст.
Gemma 3 1B Instruct(基础)
unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL
Английский модельный лидер
LFM2.5 8B A1B(побег из тюрьмы)
gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M
версия LFM2.5 8B A1B MoE без цензуры, всего 1B активированных параметров, баланс скорости и качества.
Bonsai 27B 1-bit(супер сжатие)
dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0
Bonsai 27B — это однобитная квантованная версия джейлбрейка с поддержкой выравнивания и цензуры для анализа текста и изображений.
Qwen 3.8 27B(Самый сильный побег из тюрьмы)
JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M
Qwen3.8-27B — это количественная версия без цензуры, которая сохраняет длинные прогнозы MTP и поддерживает анализ текста и изображений.
Qwen 3.8 2B(дистилляция)
empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M
Qwen3.8 Дистилляционная версия, экстремальная скорость работы, поддерживает только текстовый анализ.
Qwen 3.8 9B(дистилляция)
empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M
Дистилляционная версия Qwen3.8, унаследовавшая способность глубокого рассуждения больших моделей, поддерживает только текстовый анализ.
Ornith 1.5 9B(высший)
ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M
Мультимодальная модель Ornith 1.5 поддерживает анализ текста и изображений.
Spark X2.5 1.7B(легкий)
XHToken/Spark-X2.5-1.7B-GGUF
Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。
Готовы испытать более мощное локальное управление AI-файлами?
Без сложной настройки, Firefly AI Folder поддерживает встроенный движок и однокнопочную загрузку моделей, открывая для вас путь к умной и эффективной организации.