Внутри приложения поддерживается высокоскоростная загрузка передовых локальных моделей
Поддержка локальных моделей из двух источников — HuggingFace и ModelScope, а также многочисленных облачных провайдеров моделей как внутри страны, так и за рубежом
Qwen 3.5 0.8B (Китайский лучше)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL
Чрезвычайно быстрая и легкая текстовая модель, подходящая для сред низкого уровня и ЦП, со сбалансированной производительностью анализа на китайском языке.
Qwen 3.5 0.8B (Легкое распознавание изображений)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Экстремальная скорость работы, подходит для сред с чрезвычайно низкой конфигурацией и поддерживает менее точный анализ изображений.
MiniCPM5 2B(высокое качество•высокоскоростной•побег из тюрьмы)
Abiray/MiniCPM5-2B-heretic-abliterated-GGUF:Q4_K_M
Недостаточно видеопамяти, и если вы хотите правильно классифицировать файлы, вы должны выбрать меня, чтобы ограничить версию (с ограниченным доступом).
LFM2.5 2.6B(побег из тюрьмы)
Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M
Версия без ограничений и цензуры LFM2.5 2.6B, баланс скорости и качества.
Gemma 4 E4B-it(Поддержка аудио)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
Оригинальная количественная версия Google, поддерживающая анализ текста, изображений и аудио.
Qwen 3.5 4B(баланс)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
Урезанная версия сочетает в себе скорость и качество.
Qwen 3.5 2B(лучше)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
Видеопамять 4G — лучший выбор.
Qwen 3.5 2B(Японская оптимизация)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Модель анализа текста, оптимизированная для японских наборов данных, поддерживает только анализ текста.
Qwen 3.5 2B(текст побега из тюрьмы)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Модель джейлбрейка, имеющая определенное понимание содержания.
MiniCPM-V 4.6 (Маленькая стальная пушка, читающая картинки)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
Мультимодальная модель верхнего уровня очень хорошо справляется с оптическим распознаванием текста, распознаванием объектов и пониманием сложных сцен.
Gemma 4 E2B-it QAT MTP(Всестороннее - высокая скорость)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Обладая всеми возможностями, а также технологией MTP для обеспечения скорости, это, безусловно, лучшая модель для выбора.
Nanbeige 4.2 3B(Джейлбрейк-Оптимизация)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B корпус из твердой стали 9B, версия i1 с джейлбрейком имеет более высокую точность квантования, но поддерживает только текст.
Gemma 3 1B Instruct(基础)
unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL
Английский модельный лидер
LFM2.5 8B A1B(побег из тюрьмы)
gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M
версия LFM2.5 8B A1B MoE без цензуры, всего 1B активированных параметров, баланс скорости и качества.
Bonsai 27B 1-bit(супер сжатие)
dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0
Bonsai 27B — это однобитная квантованная версия джейлбрейка с поддержкой выравнивания и цензуры для анализа текста и изображений.
Qwen 3.8 27B(побег из тюрьмы)
HauhauCS/Qwen3.8-27B-Uncensored-HauhauCS-Aggressive-MTP-GGUF:Q4_K_P
Qwen3.8-27B — версия с радикальной децензурой. Квантование серии P сохраняет более высокую точность ключевых тензоров без цензуры и поддерживает анализ изображений.
Ornith 1.5 9B(высший)
ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M
Мультимодальная модель Ornith 1.5 поддерживает анализ текста и изображений.
Готовы испытать более мощное локальное управление AI-файлами?
Без сложной настройки, Firefly AI Folder поддерживает встроенный движок и однокнопочную загрузку моделей, открывая для вас путь к умной и эффективной организации.