Full Story · 에르메스단

그록 4.7에 '제대로 된걸 내놔라' — 그록봇은 단순 크롤링용으로 밀려났다

🕐 2026-09-29에르메스단
본 기사는 여러 오픈카톡방 대화를 완전 익명(발화자 식별 정보 전면 제거) 처리해 병합한 것입니다.

그록 4.7 실망과 그록봇의 VM 리셋·모델 선택 불가 한계가 오간 에르메스단 대화


28일 저녁 8시 11분, 에르메스단에 짧은 불만 하나가 올라왔다.

그록 4.7은 좀 별로긴했는데 제대로 된걸 내놔라

한 참여자는 그록 4.7이 토큰만 많이 쓰고 4.6보다 나아진 체감이 없다고 했다. 같은 분에 다른 참여자가 맞장구를 쳤다. 챗에서는 아직 4.6만 제공한다며 속상함을 드러낸 것이다.

6명이 36건을 주고받은 짧은 대화였지만, 새 버전에 대한 기대가 실망으로 돌아선 분위기가 뚜렷했다. 성능이 나아졌다는 체감은 없는데 비용 격인 토큰은 더 든다는 불만이 먼저 나왔다는 점이 눈에 띈다.

이 대화가 놓인 자리도 눈여겨볼 만하다. 이날 저녁 방은 GPT 한도 누수 불만으로 문을 열었고, 그록 4.7에 대한 실망 뒤에는 구독료를 어디까지 낼 것인가를 두고 긴 가치창출 논쟁이 이어졌다. 토큰을 더 쓰는데 나아진 게 없다는 불만은, 쓴 만큼 값을 하느냐는 그날 밤의 공통 질문과 맞닿아 있는 것으로 보인다.

설정해 둘 수 없는 봇

화제는 곧 그록봇으로 넘어갔다. 한 참여자는 그록봇의 VM(가상 머신)이 리셋돼 설정을 해 두기 어렵다고 했고, 1분 뒤 다른 참여자는 모델을 고를 수 없다는 점을 단점으로 꼽았다. 10분쯤 뒤 앞의 참여자는 성능이 아쉬워 단순 크롤링(웹 자료 수집)에만 쓴다고 덧붙였다.

환경을 붙잡아 둘 수 없고 모델도 고를 수 없다면, 오래 굴리는 작업을 맡기기는 어렵다는 판단이 뒤따르는 것으로 보인다. 사용자 손에서 도구가 맡는 일의 폭이 단순 수집 정도로 좁혀진 셈이다.

교차검증에서도 밀려난 그록

8시 27분에는 또 다른 경험담이 나왔다. 여러 모델의 답을 맞춰 보는 교차검증에 그록을 넣었다가 결과를 망친 일이 잦았다는 이야기다.

교차검증하는데 그록이 헛소리해서 결과 망가진적도 많아서, 전 교차검증도 데이터 검증에만 씁니다 ㅋㅋ

교차검증을 아예 접은 것이 아니라 그록을 넣는 범위를 데이터 검증으로 줄였다는 이야기로 읽힌다. 신뢰가 통째로 사라졌다기보다, 맡길 일을 가려 쓰는 쪽으로 옮겨 간 것으로 보인다.

낮의 평가와 겹쳐 보면

같은 날 낮 이 방에서는 코덱스 곁에 붙일 보조 모델로 클로드와 그록을 견주는 대화가 있었다. 그때만 해도 grok 4.7 xhigh가 루나 맥스보다 낫지 않겠느냐는 의견이 나왔지만, 그록은 이제 이미지·영상용이라며 클로드 쪽으로 추천이 모였다. 낮에는 4.7을 권하는 목소리도 있었지만, 저녁에는 실망이 먼저 나온 셈이다.

저녁 대화까지 겹쳐 보면 그록의 쓰임새가 이미지·영상이나 단순 크롤링처럼 좁은 칸으로 나뉘어 가고 있음을 시사한다. 다만 그록 4.7을 어떤 작업에 써서 이런 평가가 나왔는지는 이날 대화 안에서 구체적으로 드러나지 않았다.