Внутри приложения поддерживается высокоскоростная загрузка передовых локальных моделей
Поддержка локальных моделей из двух источников — HuggingFace и ModelScope, а также многочисленных облачных провайдеров моделей как внутри страны, так и за рубежом
Квен 3.5 0.8B (Базовый)
ggml-org/Qwen3.5-0.8B-GGUF:Q4_0
Он может работать без отдельной видеокарты и имеет чрезвычайно высокую скорость работы. Он поддерживает только анализ текста и менее точен.
Qwen 3.5 0.8B (облегченное распознавание изображений)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
Экстремальная скорость работы, подходит для сред с чрезвычайно низкой конфигурацией и поддерживает менее точный анализ изображений.
Qwen 3.5 9B (Клод доработка)
DavidAU/Qwen3.5-9B-Claude-4.6-OS-Auto-Variable-HERETIC-UNCENSORED-THINKING-MAX-NEOCODE-Imatrix-GGUF:D_AU-IQ3_M-imat
Точно настроен на основе набора данных Claude 4.6 и хорошо работает в соответствии со следующими инструкциями.
Джемма 4 E4B-it (с поддержкой звука)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
Оригинальная количественная версия Google, поддерживающая анализ текста, изображений и аудио.
Квен 3,5 4Б (сбалансированный)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
Урезанная версия сочетает в себе скорость и качество.
Квен 3,5 2Б (лучше)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
Видеопамять 4G — лучший выбор.
Квен 3.5 27Б (самый сильный)
unsloth/Qwen3.5-27B-GGUF:Q4_0
Для модели с очень большими параметрами требуется высокопроизводительная видеокарта для поддержки анализа текста и изображений.
Qwen 3.5 2B (японская оптимизация)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
Модель анализа текста, оптимизированная для японских наборов данных, поддерживает только анализ текста.
Qwen 3.5 2B (текст о побеге из тюрьмы)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
Модель джейлбрейка, имеющая определенное понимание содержания.
Qwen 3.5 2B Инструкт (высокий IQ)
mradermacher/Qwen3.5-2B-Polaris-HighIQ-INSTRUCT-GGUF:IQ4_XS
Высокоинтеллектуальная, тонко настроенная версия Polaris, поддерживающая анализ текста и изображений.
MiniCPM-V 4.6 (маленькая стальная пушка, считывающая изображения)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
Мультимодальная модель верхнего уровня очень хорошо справляется с оптическим распознаванием текста, распознаванием объектов и пониманием сложных сцен.
Qwen 3.6 27B MTP (более новая)
unsloth/Qwen3.6-27B-MTP-GGUF:UD-IQ2_XXS
Версию 3.6, обладающую взрывным IQ, необходимо обновить до 2.1+ для ее поддержки.
Gemma 4 E2B-it QAT MTP (всесторонне-высокая скорость)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
Обладая всеми возможностями, а также технологией MTP для обеспечения скорости, это, безусловно, лучшая модель для выбора.
MiniCPM5 1B Тонкая настройка Клода (цепочка мышления)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
MiniCPM5-1B, настроенный на основе набора данных Claude Opus Fable5, поддерживает цепочку мышления и хорош в программировании и выполнении инструкций.
Наньбежевый 4,2 3B (за пределами 9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
Корпус 3B из твердой стали 9B, настоятельно рекомендуется, но поддерживает только текст.
Nanbeige 4,2 3B (выше 9B-высокая точность)
owao/Nanbeige4.2-3B-GGUF:Q8_0
Корпус 3B из твердой стали 9B, Q8_0, высочайшая точность количественного определения, настоятельно рекомендуется, но поддерживает только текст.
Nanbeige 4.2 3B (оптимизирован для джейлбрейка)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B корпус из твердой стали 9B, версия i1 с джейлбрейком имеет более высокую точность количественного определения, но поддерживает только текст.
Готовы испытать более мощное локальное управление AI-файлами?
Без сложной настройки, Firefly AI Folder поддерживает встроенный движок и однокнопочную загрузку моделей, открывая для вас путь к умной и эффективной организации.