Dikatakan sebagai model agen yang dikhususkan, tetapi mereka berpendapat bahwa perubahannya adalah penerapan loop perbaikan diri sendiri dibandingkan dengan versi 1.0 yang hanya menerima penilaian.
397B (Dense)
35B-A3B (MoE)
9B
Ini adalah tiga model.
Model 397B bahkan mencapai skor benchmark yang setara dengan opus 4.8...

Dikatakan bahwa model 9B melampaui Gemma4 31B dalam benchmark...

Yah, saya mencoba 9B melalui ollama dan ternyata cukup pintar dalam menjawab. Namun, seperti sebelumnya, loop masih berjalan saat pertanyaan menjadi panjang, dan bahasa Cina yang muncul tiba-tiba tetap mengecewakan. Tapi setidaknya terasa ada peningkatan dibandingkan versi 1.0.
Silahkan dicatat~
▶ Sumber asli: https://ornith.ai/ornith_1_5.html