소프트웨어 내에서 최신 로컬 모델을 고속 다운로드 지원
HuggingFace 및 ModelScope 두 소스의 로컬 모델을 지원하며 다수 국내외 클라우드 모델 서비스 제공업체 지원
Qwen 3.5 0.8B (중국어가 더 낫다)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q5_K_XL
균형 잡힌 중국어 분석 성능을 갖춘 로우엔드 및 CPU 환경에 적합한 매우 빠르고 가벼운 텍스트 모델입니다.
Qwen 3.5 0.8B (경량 이미지 인식)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
극한의 실행 속도로 구성이 매우 낮은 환경에 적합하며 정확도가 떨어지는 이미지 분석을 지원합니다.
LFM2.5 2.6B(감옥 휴식)
Abiray/LFM2.5-2.6B-Heretic-Abliterated-GGUF:Q4_K_M
LFM2.5 2.6B 제한 제거 무검열 버전, 속도와 품질 균형.
Gemma 4 E4B-it(오디오 지원)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
텍스트, 이미지 및 오디오 분석을 지원하는 Google의 원래 수량화 버전입니다.
Qwen 3.5 4B(균형)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
축소 버전은 속도와 품질의 균형을 유지합니다.
Qwen 3.5 2B(더 나은)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
4G 비디오 메모리가 첫 번째 선택입니다.
Qwen 3.5 2B(일본어 최적화)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
일본어 데이터 세트에 최적화된 텍스트 분석 모델은 텍스트 분석만 지원합니다.
Qwen 3.5 2B(탈옥 문자)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
콘텐츠에 대해 어느 정도 이해하고 있는 탈옥 모델입니다.
MiniCPM-V 4.6 (그림을 읽는 소형 강철 대포)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
최고급 다중 모드 모델은 OCR, 객체 인식 및 복잡한 장면 이해에서 매우 뛰어난 성능을 발휘합니다.
Gemma 4 E2B-it QAT MTP(만능 - 고속)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
모든 기능과 속도를 위한 MTP 기술을 갖춘 이 제품은 단연 최고의 모델입니다.
MiniCPM5 1B Claude微调(생각의 사슬)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
Claude Opus Fable5 데이터 세트를 기반으로 미세 조정된 MiniCPM5-1B는 사고 연쇄 추론을 지원하고 프로그래밍 및 지시 따르기에 능숙합니다.
난베이지 4.2 3B (9B 이상)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
3B 본체 단단한 강철 9B를 적극 권장하지만 텍스트만 지원합니다.
Nanbeige 4.2 3B(탈옥 최적화)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B 바디 하드 스틸 9B, i1의 탈옥 버전은 양자화 정확도가 더 높지만 텍스트만 지원합니다.
Gemma 3 1B Instruct(基础)
unsloth/gemma-3-1b-it-GGUF:UD-Q4_K_XL
영국의 모델 리더
LFM2.5 8B A1B(감옥 휴식)
gaston-parravicini/LFM2.5-8B-A1B-Uncensored-Gaston-GGUF:Q4_K_M
LFM2.5 8B A1B MoE 무수정 버전, 1B 활성화 매개변수만, 균형 잡힌 속도와 품질.
Bonsai 27B 1-bit(슈퍼 압축)
dealignai/Bonsai-27b-1bit-CRACK-GGUF:Q1_0
Bonsai 27B 1비트 양자화 제이브레이커 버전, 탈정렬 무검열, 텍스트 및 이미지 분석 지원.
Qwen 3.8 27B(최강자-Jailbreak)
JonathanColetti/Qwen3.8-27B-Uncensored-GGUF:Q4_K_M
Qwen3.8-27B는 MTP 긴 예측을 유지하고 텍스트 및 이미지 분석을 지원하는 무수정 정량 버전입니다.
Qwen 3.8 2B(증류)
empero-ai/Qwen3.8-2B-Distill-GGUF:Q4_K_M
Qwen3.8 디스틸버전, 극한의 실행 속도, 텍스트 분석만 지원.
Qwen 3.8 9B(증류)
empero-ai/Qwen3.8-9B-Distill-GGUF:Q4_K_M
Qwen3.8 디스틸버전, 대규모 모델의 심층 추론 능력 계승, 텍스트 분석만 지원.
Ornith 1.5 9B(최고급)
ornith-ai/Ornith-1.5-9B-GGUF:Q4_K_M
Ornith 1.5 멀티모달 모델, 텍스트 및 이미지 분석 지원.
Spark X2.5 1.7B(경량)
XHToken/Spark-X2.5-1.7B-GGUF
Spark X2.5 1.7B 文本模型,轻量高效,仅支持文本分析。
더 강력한 로컬 AI 파일 관리 경험을 시작해 보시겠습니까?
복잡한 설정 없이, Firefly AI Folder가 내장 엔진과 원클릭 모델 다운로드를 지원하여 스마트하고 효율적인 정리 여행을 시작합니다.