BottleCap AI menyatakan bahwa ThinkingCap Qwen3.6-27B tidak kehilangan kemampuan kognitifnya, tetapi proses berpikirnya telah dioptimalkan.
Dengan mengurangi token yang tidak perlu dalam proses berpikir, waktu proses berpikir rata-rata berkurang sekitar 45%.
Dalam beberapa tes tertentu, waktu yang dibutuhkan untuk menghasilkan output menjadi enam kali lebih cepat.
MTP juga didukung.

huggingface : bottlecapai/ThinkingCap-Qwen3.6-27B
Tes
oMLX v0.5.1 M5 Pro (20c) 64GB
Prompt : Buat file HTML tunggal yang mensimulasikan tata surya
Model | PREFILL(T/S) | THINKING(S) | TOKEN GEN (T/S) |
|---|
Qwen3.6-27B-oQ4e-mtp | 5.3t/s (23 tok) | 19.3s (545 tok) | 30.2t/s (7630 tok) |
ThinkingCap-Qwen3.6-27B-oQ4e-mtp | 5.2t/s (23 tok) | 6.4s (108 tok) | 29.5t/s (7053 tok) |
Kita dapat melihat bahwa waktu THINKING telah berkurang secara signifikan.
Hasil
Model Umum
ThinkingCap