Head Story · Community

GLM·Kimi·Qwen 등 중국계 모델 가성비와 사용 한도 비교

🕐 2026-09-02
본 기사는 여러 오픈카톡방 대화를 완전 익명(발화자 식별 정보 전면 제거) 처리해 병합한 것입니다.

자정을 갓 넘긴 00시 18분, 한 참여자가 중국계 모델을 9개월 동안 실제로 굴려 온 결과를 방에 풀었다. 벤치마크 점수를 옮겨 적은 것이 아니라 매달 결제하고 리밋(사용 한도)에 걸려 본 사람의 정산표에 가까웠다. 이야기의 축은 어느 모델이 더 똑똑한가가 아니라, 한 달을 끊기지 않고 버티려면 무엇을 얼마에 써야 하는가였다.

"GLM Max를 9개월째 쓰는 상황 중인데, glm 5 3 flash의 코딩 퀄리티는, composer 2.5 / grok 4.6 정도로 보입니다."

품질 평가에 곧바로 붙은 것은 지구력 이야기였다. Kimi k3 Allegro가 2일, 비바체가 4일 만에 리밋에 걸리는 동안 GLM으로는 버틸 만했다는 것이다. 비바체(Vivace)는 이 한도 사례에 나란히 놓인 모델인데, 어떤 제품인지까지는 방에서 설명되지 않았다. 성능이 엇비슷한 구간에서는 한도가 먼저 바닥나는 쪽이 먼저 탈락한다는 뜻이고, 실제 선택은 그 지점에서 갈렸다. 코딩 퀄리티를 다른 상용 모델과 견주는 문장 바로 옆에 며칠 만에 막히더라는 문장이 붙어 있었다는 점이, 이 비교가 어떤 자로 이뤄졌는지를 보여 준다.

가격 비교는 한층 구체적이었다. 캐시미스(cache miss·캐시가 듣지 않아 원문을 다시 넣는 경우) 기준으로 Deepseek v4 flash가 백만 토큰 입력당 0.22달러인 데 비해, glm 5.3 flash는 프로모션 0.075달러·정가 0.15달러라는 것이다. 딥시크보다 싸다는 것이 이 참여자가 내린 결론이었다.

"Deepseek v4 flash가 캐시미스에 백만토큰 입력당 0.22 달러인데, Glm 5 3 flash는 프로모션 0.075 달러, 정가는 0.15 달러라"

반대 방향의 사례도 나왔다. Qwen 3.8 Max로 1시간 10분 만에 1억8천만 토큰을 쓰고 주간 리밋에 걸렸다는 보고다. 단가가 낮아도 한도가 시간 단위로 닫혀 버리면 장기 약정이 오히려 짐이 된다는 이야기이고, 실제로 이 방에서는 연 단위 구독을 접었다는 언급도 함께 오갔다.

"Qwen 3.8 Max로 1시간 10분만에 1억8천만 토큰쓰고는"

다른 참여자들의 계산은 조금씩 달랐다. 한 참여자는 코딩 전용이 아니라 일상 용도에서 가성비가 좋다는 쪽으로 정리했고, 또 다른 참여자는 활용 빈도가 떨어져 Kimi 결제를 해지했다고 밝혔다. 해지 사유가 품질 불만이 아니라 손이 덜 가서였다는 점은, 이 방의 구독 판단이 성능 평가만으로 내려지지 않는다는 것을 보여 준다. 같은 모델을 다른 실행 도구에 붙였을 때 속도가 어떤지 묻는 질문도 나왔지만 이어진 답은 없었다.

"glm5.3 flash 일상 용도로 가성비 좋다고 합니다"

"kimi는 활용이 줄어들어 결제 해지를.."

정리하면 이날 대화에서 중국계 모델을 가르는 기준은 성능표가 아니라 한도표였다. 값이 싸도 며칠 만에 막히면 결제를 끊고, 조금 비싸도 끝까지 돌아가면 남긴다는 셈법이 여러 명에게서 반복해서 나왔다. 구독형 AI의 비교축이 토큰 단가에서 한 달을 버티는 사용량 쪽으로 옮겨가고 있음을 시사한다.