Saat ini saya menjalankan DeepSpeech dengan 0731 Q2KL,
Ketika dijalankan, ia mengonsumsi sekitar 100W dan menghasilkan sekitar 10 token per detik
Untuk menghasilkan 1 juta token, dibutuhkan waktu 27 jam -_-ㅋ
Namun, jika menggunakan OpenRouter, saya dapat memprosesnya dengan biaya yang sangat murah.
Sepertinya tagihan listrik akan meningkat ㅋㅋㅋ
Meskipun saya melihatnya dengan seksama, Qwen 3.6 27B Q6, 35B A3B Q6 atau Step 3.7 Q4 tampaknya menjadi batasnya;
Tentu saja, DeepSpeech juga melakukan pekerjaan yang baik dengan Q2KL.