Unsloth v0.1.800 - Qwen3.8-27B 파인튜닝 지원
2026년 8월 14일 Unsloth는 Qwen3.8-27B에 대한 로컬 파인튜닝 지원을 공식 추가했다. 사용자는 17GB RAM에서 Dynamic GGUF 양자화를 통해 모델을 실행하고, 20GB VRAM 이상의 GPU에서 파인튜닝할 수 있다.
핵심 성능 개선
- 파인튜닝 속도: 표준 Hugging Face 설정 대비 약 2배 빠름
- VRAM 효율성: 약 70% 적은 VRAM 사용으로 더 큰 모델 학습 가능
- 정확도: QLoRA 사용 시 정확도 저하 0% (근사 없이 정확한 수학 연산)
- MoE 모델: 2026년 2월 릴리스에서 12배 빠른 혼합 전문가 모델 훈련 지원 추가
파인튜닝 방식 및 도구
Unsloth는 손으로 작성한 Triton 커널로 훈련 루프의 병목 부분을 교체하고, 역전파 단계를 자동미분 대신 수동으로 유도하여 성능을 최적화한다. 또한 Unsloth Studio 웹 UI와 데스크톱 애플리케이션을 통해 코드 없이 파인튜닝을 수행할 수 있으며, 결과를 LoRA 어댑터 또는 GGUF로 저장할 수 있다.