Perbandingan singkat qwen 3.8 dan 3.6

168

Barusan saya menggantinya dan meminta Claude menulis perbandingan. Saya belum mencobanya sendiri, jadi belum bisa merasakan bedanya. Di bawah ini tulisan dari Claude.

Qwen3.8 27B, cukup ditukar langsung dari 3.6 (RTX 3090)

Saya beralih ke unsloth GGUF Q4. Dengan pengaturan yang sama, ia berjalan lancar tanpa perlu build ulang llama.cpp.

Sebelum mengunduh saya membandingkan file konfigurasi kedua model, dan struktur internalnya sama persis dengan 3.6. Jadi langsung jalan di build yang sudah dipakai.

Hasil pengukuran (3090 24GB, pertanyaan sama dan pengaturan sama, MTP aktif di keduanya)

3.6 3.8

Kecepatan 47.6 tok/s 47.5 tok/s

Memori 23.3GB 22.7GB

MTP (fitur akselerasi kecepatan yang tertanam di model) tetap aktif dan berjalan di 3.8 juga. Saya bahkan memeriksa status server. Kecepatannya sama, dan 3.8 memakai memori sekitar 0,5GB lebih sedikit.

Pengenalan gambar, bahasa Korea (tanpa tercampur aksara Han), dan pemanggilan tool semuanya normal.

Saya tidak membandingkan kualitasnya. Saya hanya mengukur dengan satu pertanyaan pendek. Yang saya pastikan hanya sampai pada "menggantinya tidak membuat lebih lambat atau rusak."

Satu tips: jangan hapus file model lama. Mengembalikannya hanya butuh 30 detik.

로그인한 회원만 댓글 등록이 가능합니다.

개발한당

KR | ID | EN
  • IDR
  • KOR
7.52 ▼ -0.01

2026.10.09 KEB 하나은행 고시회차 2593회

다가오는 한인 행사일정

  • 등록 된 일정이 없어요!