5060ti 16vram + 48ram에서 qwen3.8 flash iq2_xs 간단히 돌려봤네

1

자료 없이 썰로 푸는 그냥 초 간단 아주 가벼운 테스트 입니다 ^^

amd 5600 cpu에 5060ti 16vram+48ram 사용 중입니다 ^^

최근에 qwen3.8 27b 구해서 돌려보고 있는데 이 녀석이 너무 무거워 버벅임이 심하네요 그래서

실사용은 힘들듯해서 그냥 저냥 테스트만 잠시했고

그 후에는 평이 좋다는 Bonsai-2-27B-PQ2_0.gguf llama-prism에 올려서 놀고 있었습니다.

며칠전 qwen3.8 flash IQ2_xs 모델을 알고서 오전에 테스트 해봤네요...
당연히 이녀석이 qwen3.8 27b 보다는 쾌적해서 며칠 이 녀석도 며칠 가지고 놀았습니다.

더 한 두 윗급의 모델 사이즈로 테스트 했더라면 어떻게 되었을지 모르지만

일단은 저의 시스템이 버틸 수 있는 정도인 IQ2_xs 나 PQ2_0 정도로만 테스트 했습니다 ^^

qwen3.8 flash iq2에서 대화 모드는 약 70-80토큰 정도로 빠르진 않지만 아주 답답한 수준은 아니고
오늘 과학 잡지 사인언스 pdf판 일부(전공분야)를 번역 시켜 봤네요 (qwen3.8 flash iq2 추론 모드 off 시키고)

Bonsai-2-27B와 비교해서 qwen3.8 flash가 번역 속도 살짝 빠른듯하고 품질도 약간 더 좋은 느낌이네요....
저는 이미지 분석이 필요해서 mmproj 달고서 아슬아슬하게 잘 실행되는 수준이라 일단은 단독 사용만

해야 할듯하네요 ㅎ
저의 기준 셋 중에서는 제일 나은듯요ㅎ

로그인한 회원만 댓글 등록이 가능합니다.

개발한당

KR | ID | EN
  • IDR
  • KOR
7.53 ▲ 0.01

2026.10.10 KEB 하나은행 고시회차 4023회

다가오는 한인 행사일정

  • 등록 된 일정이 없어요!