Saya sudah mencoba menggunakan laguna-s-2.1

1.246.***.***
16

Saya sudah mencobanya di dgx spark

Karena HuggingFace menggunakan vllm, saya mencoba mengaturnya dan menggunakannya, hasilnya sekitar 19~20 token.

Terjadi banyak kesalahan juga.

Hari ini saya mengunjungi halaman web llama, dan ternyata sudah dirilis kemarin. Saya mengunduhnya dan mencobanya.

Memuatnya ke RAM spark memakan waktu agak lama, dan pada awalnya menghasilkan 9 token, jadi saya berpikir ini tidak bisa digunakan. Namun, setelah beberapa kali mencoba, kecepatan generasi token semakin meningkat.

Melihat hasilnya sekitar 20~22 token, jika nanti ada vllm atau alat optimasi lain yang dirilis, saya yakin akan menghasilkan lebih dari 30 token.

Dengan 20 token, ini kecepatan generasi yang tepat untuk mengerjakan tugas sebelum tidur dan menerima hasilnya keesokan harinya.

qwen3.6-27b juga menghasilkan sekitar 22 token ketika menggunakan versi yang dioptimalkan. Semoga perkembangan llama terus berlanjut!????

로그인한 회원만 댓글 등록이 가능합니다.

개발한당

KR | ID | EN
  • IDR
  • KOR
8.28 0.01

2026.07.22 KEB 하나은행 고시회차 890회

다가오는 한인 행사일정

  • 등록 된 일정이 없어요!