Mac 유저들을 위한 Qwen 3.8 Splash

56

검색을 해봐도 관련 정보가 없는거 같아서 올려봅니다.

유튜브에서 M6 맥미니 32G 에서 'Qwen 3.8 Splash' 를 돌렸더니 퍼포먼스가 2배 좋아졌다라는 영상을 발견하고는 이게 뭔가 싶어서 조사를 좀 해봤습니다. 맥에서 많이 좋아졌다라는건 알겠는데 상세하게 설명을 드릴 자신이 없어서 내용은 제미니에게 부탁했습니다 ㅋㅋㅋ


결론부터 말씀드리면, 이번에 나온 Qwen 3.8 Splash는 새로운 AI 모델이 아니라 '애플 실리콘(M 시리즈) 전용으로 미친 듯이 깎아 만든 튜닝 추론 엔진'입니다. Inco AI에서 오픈소스로 공개했고, 최근 LM Studio에도 공식 탑재되었습니다. 

핵심 요약은 다음과 같습니다. 

1. 미친 구동 속도 (기존 엔진 대비 2~3배) 

  • 오직 Qwen 3.8 27B / 35B MoE 딱 두 모델만 타겟으로 C++와 Metal 커널을 커스텀 최적화했다고 합니다. 

  • 일반적인 M 시리즈 프로/맥스 칩셋 환경에서 short prompt 기준 초당 70~140토큰의 속도가 나옵니다. 로컬 LLM 중 체감 속도가 가장 빠릅니다. 

  • 15만 자가 넘는 장문 문맥(Context)에서도 속도 저하 없이 초당 20~30토큰을 안정적으로 유지합니다. 

2. 지능 체급 (상용 미니 모델 완벽 대체) 

  • GPT-4o나 3.5 Sonnet 같은 유료 플래그십보다는 살짝 아쉽지만, GPT-4o-mini나 Claude 3.5 Haiku 같은 가성비 상용 API 수준은 가볍게 씹어먹는 성능을 보여줍니다. 

  • 일상적인 코딩, 데이터 추출, 논문 요약, 업무 자동화 에이전트용으로는 차고 넘칩니다. 

3. 맥 유저들에게 강력 추천하는 이유 

  • 유료 API 비용 지불 없이, 그리고 내 개인 코드나 중요 데이터가 외부 서버로 유출될 걱정 없이 맥 로컬 안에서 상용급 속도로 무제한 연산이 가능합니다. 

  • 특히 통합 메모리(RAM) 용량이 넉넉한 맥을 쓰시는 분들은 성능 저하가 적은 8비트(HQ) 양자화 모델까지 쾌적하게 돌리실 수 있습니다. 

로그인한 회원만 댓글 등록이 가능합니다.

개발한당

KR | ID | EN
  • IDR
  • KOR
7.52 ▼ -0.01

2026.10.09 KEB 하나은행 고시회차 2023회

다가오는 한인 행사일정

  • 등록 된 일정이 없어요!