얼마전 올라마 클라우드 사용량에 대해 글을 올렸슴미다
glm5.3 flash 이것과 deepseek4.1 이갓을 사용하고 가격대가 비슷해서 glm을 메인으로 딥시크를 서브로 사용하고 있슴미다
표시되는 가격은 거의 같은 가격임미다
그런데 실사용을 하면 glm쪽이 실제 토큰사용량이 더 많슴미다
간단한 것은 3배까지 차이가 났고 glm쪽은 씽킹 없이 해도 기본적으로 씽킹이 어느정도 섞여서 토큰생성이 되는거 같슴미다
딥시크도 좀 섞이겠지만 기본적으로 glm이 딥시크보다 토큰 차이가 씽킹 맥스로 했을때 2배 가까이 차이가 남미다
그래서 요청수가 딥시키가 2배 많아도 실사용량에서 glm이 2배 많이 사용된거로 나옴미다
제가 glm가 gpt나 클로드를 제외하면 가장 잘 맞는 모델이라 이걸 메인으로 사용하는데.... 싸다고 막 사용하다 보니 토큰사용량에서 넘 차이가 많이 나오네요 320대 파라미터인데 700대 파라미터 모델과 비빌 수 있는건가 봄미다
같은 요청에 모델들의 씽킹에따라 대략 얼마나 토큰사용이 되는지도 표시 됐으면 좋을거 같은데...
안해주겠죠???