조금전에 갈아끼우고 클로드에게 비교 글 써달라고 했습니다. 아직 직접 써보지는 않아서 체감은 못하고 있습니다. 아래는 클로드가 쓴 글입니다.
Qwen3.8 27B, 3.6에서 그냥 갈아끼워도 됩니다 (RTX 3090)
unsloth GGUF Q4로 바꿔봤습니다. 설정 그대로, llama.cpp를 새로 빌드하지 않아도 잘 돌아갑니다.
받기 전에 두 모델의 설정 파일을 비교해봤는데 내부 구조가 3.6과 똑같더군요. 그래서 쓰던 빌드에서 바로 올라갑니다.
실측 (3090 24GB, 같은 질문·같은 설정, 양쪽 다 MTP 켠 상태)
3.6 3.8
속도 47.6 tok/s 47.5 tok/s
메모리 23.3GB 22.7GB
MTP(모델에 내장된 속도 가속 기능)는 3.8에서도 그대로 켜져서 돌아갑니다. 서버 상태 확인까지 했습니다. 속도는 같고, 메모리는 3.8이 0.5GB쯤 덜 씁니다.
이미지 인식, 한국어(한자 안 섞임), 도구 호출 모두 정상이었습니다.
품질 비교는 안 했습니다. 짧은 질문 하나로만 재봤습니다. “바꿔도 느려지거나 깨지지 않는다”까지가 확인한 전부입니다.
팁 하나: 기존 모델 파일은 지우지 마세요. 되돌리는 데 30초면 됩니다.