This post has not been translated to English yet. Showing the original text.
와...정말
Qwen 3.8만으로도 글을 몇 개를 쓰는지
기존의 Qwen 3.8에서 고질적인 과도한 추론을 개선한 파인튜닝 버전 Swift-Qwen3.8-27B 이라는것도 있네요. 역시 자세한 설명은 제미니를 부려먹었습니다.
안녕하세요. 최근 로컬 AI 진영에서 Qwen 3.8 27B 모델의 인기가 높은데, 특유의 고질병인 '과도한 추론(Overthinking)' 버릇을 힘으로 깎아 고쳐놓은 파인튜닝 버전인 「Swift-Qwen3.8-27B」 소식이 핫해서 공유해 드립니다.
순정 Qwen 3.8 27B가 똑똑하긴 한데, 답변을 내놓기 전에 혼자 끙끙 앓으며 불필요한 추론 토큰을 너무 많이 소비해 출력 속도가 답답하셨던 분들께 아주 유용한 정보입니다.
1. Swift 버전의 핵심 개선점
2. 순정(Original) 모델과 비교 시 장단점
장점: 무의미하게 소모되는 토큰이 적어 로컬 인프라 자원(VRAM/메모리 및 대역폭)을 훨씬 효율적으로 씁니다. 코딩, 데이터 추출, 요약 등 실무 영역에서는 대기 시간이 절반 수준입니다.
단점: 아주 난해한 수학이나 꼬아놓은 논리 문제의 경우, 진득하게 생각하는 순정 모델에 비해 정답률이 미세하게 떨어질 수 있습니다.
3. 사양별 구동 가이드 팁
이미 허깅페이스에 GGUF 포맷으로 배포가 완료되어 LM Studio나 Ollama 등에서 바로 불러올 수 있습니다. 본인의 하드웨어 사양에 맞춰 아래와 같이 세팅해 보시는 걸 추천합니다.