Центр экосистемы AI-моделей

Внутри приложения поддерживается высокоскоростная загрузка передовых локальных моделей

Поддержка локальных моделей из двух источников — HuggingFace и ModelScope, а также многочисленных облачных провайдеров моделей как внутри страны, так и за рубежом

34+
Совместимость с лёгкими локальными моделями
100%
Конфиденциальность без забот, автономная работа
35+
Подключение к популярным облачным API
Фильтр по возможностям:
unslothHuggingFace

Qwen 3.5 0.8B (Китайский лучше)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL

Текст
Параметры:0.8B
размер:579MB
Квантование:UD-Q5_K_XL
Контекст:128k
СкоростьЭкстремальная скорость
КачествоСредне

Чрезвычайно быстрая и легкая текстовая модель, подходящая для сред низкого уровня и ЦП, со сбалансированной производительностью анализа на китайском языке.

#легкий#Поддержка работы процессора#Экспресс#только текст
unslothHuggingFace

Qwen 3.5 0.8B (Легкое распознавание изображений)

unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL

ТекстИзображение
Параметры:0.8B
размер:976MB
Контекст:128k
СкоростьЭкстремальная скорость
КачествоСредне

Экстремальная скорость работы, подходит для сред с чрезвычайно низкой конфигурацией и поддерживает менее точный анализ изображений.

#Графический процессор чрезвычайно быстрый#Поддержка работы процессора#мультимодальный#мини
AbirayHuggingFace

LFM2.5 2.6B(побег из тюрьмы)

Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M

推荐
Текст
Параметры:2.6B
размер:1.56GB
Квантование:Q4_K_M
Контекст:32k
СкоростьОчень быстро
КачествоВысоко

Версия без ограничений и цензуры LFM2.5 2.6B, баланс скорости и качества.

#ограничивать#Нет цензуры#NSFW#только текст
UnslothHuggingFace

Gemma 4 E4B-it(Поддержка аудио)

unsloth/gemma-4-E4B-it-GGUF:Q4_K_S

推荐
ТекстИзображение Аудио
Параметры:4B
размер:5.83GB
Квантование:Q4_K_S
Контекст:128k
Скоростьбыстрый
КачествоВысоко

Оригинальная количественная версия Google, поддерживающая анализ текста, изображений и аудио.

#мультимодальный#быстрый#Аудио#английский лучше
mradermacherHuggingFace

Qwen 3.5 4B(баланс)

mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M

ТекстИзображение
Параметры:4B
размер:3.08GB
Квантование:Q4_K_M
Контекст:256k
Скоростьбыстрый
КачествоВысоко

Урезанная версия сочетает в себе скорость и качество.

#ограничивать#Нет цензуры#NSFW#побег из тюрьмы#мультимодальный
mradermacherHuggingFace

Qwen 3.5 2B(лучше)

mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0

ТекстИзображение
Параметры:2B
размер:2.68GB
Квантование:Q8_0
Контекст:256k
СкоростьОчень быстро
КачествоОчень высоко

Видеопамять 4G — лучший выбор.

#ограничивать#Нет цензуры#NSFW#побег из тюрьмы#мультимодальный
tatsuyaaaaaaaHuggingFace

Qwen 3.5 2B(Японская оптимизация)

tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0

Текст
Параметры:2B
размер:1.2GB
Квантование:Q4_0
Контекст:128k
Скоростьбыстрый
КачествоСредне

Модель анализа текста, оптимизированная для японских наборов данных, поддерживает только анализ текста.

#Японская оптимизация#только текст#Мало видеопамяти
jordanwoodsonHuggingFace

Qwen 3.5 2B(текст побега из тюрьмы)

jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M

Текст
Параметры:2B
размер:1.27GB
Квантование:Q4_K_M
Контекст:128k
Скоростьбыстрый
КачествоВысоко

Модель джейлбрейка, имеющая определенное понимание содержания.

#побег из тюрьмы#Нет цензуры#NSFW#только текст
OpenBMBHuggingFace

MiniCPM-V 4.6 (Маленькая стальная пушка, читающая картинки)

ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M

推荐
ТекстИзображение
Параметры:0.8B
размер:1.17GB
Квантование:Q4_K_M
Контекст:32k
Скоростьбыстрый
КачествоОчень высоко

Мультимодальная модель верхнего уровня очень хорошо справляется с оптическим распознаванием текста, распознаванием объектов и пониманием сложных сцен.

#мультимодальный#ОЦИ#Понимание сцены#Лучшее распознавание изображений
unslothHuggingFace

Gemma 4 E2B-it QAT MTP(Всестороннее - высокая скорость)

unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL

推荐
ТекстИзображение Аудио
Параметры:2B
размер:3.71GB
Квантование:UD-Q4_K_XL
Контекст:128k
СкоростьЭкстремальная скорость
КачествоСредне

Обладая всеми возможностями, а также технологией MTP для обеспечения скорости, это, безусловно, лучшая модель для выбора.

#мультимодальный#Аудио#Количественная оценка QAT#MoE#Очень маленькая видеопамять#английский лучше
GnLOLotHuggingFace

MiniCPM5 1B Claude微调(Цепочка мыслей)

GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M

Текст
Параметры:1B
размер:688MB
Квантование:Q4_K_M
Контекст:128k
СкоростьЭкстремальная скорость
КачествоОчень высоко

MiniCPM5-1B, настроенный на основе набора данных Claude Opus Fable5, поддерживает цепочку мышления и хорош в программировании и выполнении инструкций.

#Точная оптимизация#Набор данных Клода#Цепочка мыслей#Оптимизация программирования#легкий#Поддержка работы процессора#только текст
owaoHuggingFace

Наньбежевый 4,2 3B (за пределами 9B)

owao/Nanbeige4.2-3B-GGUF:Q4_K_M

Текст
Параметры:3B
размер:2.40GB
Квантование:Q4_K_M
Контекст:128k
Скоростьбыстрый
КачествоСредне

Корпус 3B из твердой стали 9B, настоятельно рекомендуется, но поддерживает только текст.

#побег из тюрьмы#Нет цензуры#NSFW#только текст
mradermacherHuggingFace

Nanbeige 4.2 3B(Джейлбрейк-Оптимизация)

mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M

推荐
Текст
Параметры:3B
размер:2.78GB
Квантование:i1-Q5_K_M
Контекст:128k
Скоростьбыстрый
КачествоВысоко

3B корпус из твердой стали 9B, версия i1 с джейлбрейком имеет более высокую точность квантования, но поддерживает только текст.

#побег из тюрьмы#Нет цензуры#NSFW#только текст#Высокая точность
GoogleHuggingFace

Gemma 3 1B Instruct(基础)

unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL

Текст
Параметры:1B
размер:770MB
Квантование:UD-Q4_K_XL
Контекст:32k
СкоростьЭкстремальная скорость
КачествоСредне

Английский модельный лидер

#легкий#Поддержка работы процессора#только текст#английский лучше
gaston-parraviciniHuggingFace

LFM2.5 8B A1B(побег из тюрьмы)

gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M

推荐
Текст
Параметры:8B-A1B
размер:4.80GB
Квантование:Q4_K_M
Контекст:32k
СкоростьОчень быстро
КачествоВысоко

версия LFM2.5 8B A1B MoE без цензуры, всего 1B активированных параметров, баланс скорости и качества.

#MoE#Нет цензуры#NSFW#побег из тюрьмы#только текст#английский лучше
dealignaiHuggingFace

Bonsai 27B 1-bit(супер сжатие)

dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0

ТекстИзображение
Параметры:27B
размер:5.21GB
Квантование:Q1_0
Контекст:128k
Скоростьбыстрый
КачествоСредне

Bonsai 27B — это однобитная квантованная версия джейлбрейка с поддержкой выравнивания и цензуры для анализа текста и изображений.

#1 бит#побег из тюрьмы#Нет цензуры#NSFW#мультимодальный#Мало видеопамяти
JonathanColettiHuggingFace

Qwen 3.8 27B(Самый сильный побег из тюрьмы)

JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M

ТекстИзображение
Параметры:27B
размер:16.52GB
Квантование:Q4_K_M
Контекст:128k
СкоростьМедленнее
КачествоВысоко

Qwen3.8-27B — это количественная версия без цензуры, которая сохраняет длинные прогнозы MTP и поддерживает анализ текста и изображений.

#Нет цензуры#побег из тюрьмы#NSFW#мультимодальный#Большие параметры#MTP
empero-aiHuggingFace

Qwen 3.8 2B(дистилляция)

empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M

推荐
Текст
Параметры:2B
размер:1.22GB
Квантование:Q4_K_M
Контекст:128k
СкоростьЭкстремальная скорость
КачествоВысоко

Qwen3.8 Дистилляционная версия, экстремальная скорость работы, поддерживает только текстовый анализ.

#дистилляция#легкий#Поддержка работы процессора#только текст
empero-aiHuggingFace

Qwen 3.8 9B(дистилляция)

empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M

推荐
Текст
Параметры:9B
размер:5.38GB
Квантование:Q4_K_M
Контекст:128k
Скоростьбыстрый
КачествоОчень высоко

Дистилляционная версия Qwen3.8, унаследовавшая способность глубокого рассуждения больших моделей, поддерживает только текстовый анализ.

#дистилляция#рассуждение#только текст#Точная оптимизация
ornith-aiHuggingFace

Ornith 1.5 9B(высший)

ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M

推荐
ТекстИзображение
Параметры:9B
размер:6.24GB
Квантование:Q4_K_M
Контекст:128k
СкоростьСредне
КачествоОчень высоко

Мультимодальная модель Ornith 1.5 поддерживает анализ текста и изображений.

#мультимодальный#График#английский лучше
XHTokenHuggingFace

Spark X2.5 1.7B(легкий)

XHToken/Spark-X2.5-1.7B-GGUF

Текст
Параметры:1.7B
размер:3.19GB
Контекст:128k
Скоростьбыстрый
КачествоСредне

Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。

#легкий#Поддержка работы процессора#только текст

Готовы испытать более мощное локальное управление AI-файлами?

Без сложной настройки, Firefly AI Folder поддерживает встроенный движок и однокнопочную загрузку моделей, открывая для вас путь к умной и эффективной организации.