Full Story · 에르메스단

코덱스(Codex) 한도 공백, 데빈(Devin) SWE-2와 딥시크(DeepSeek)가 메웠다 — 새로 나온 그록(Grok) 4.7엔 체감 없다는 평

🕐 2026-09-23에르메스단
본 기사는 여러 오픈카톡방 대화를 완전 익명(발화자 식별 정보 전면 제거) 처리해 병합한 것입니다.

신모델 출시보다 무료 이용과 속도가 선택을 가른 코덱스 공백기


22일 밤 9시 7분, 한 참가자가 "swe-2가 없었다면 이번달은 힘들었을텐데 다행"이라며 이번 달을 돌아봤다. 이번 집계 기간(21일 새벽~23일 오전) 동안 AI 코딩 에이전트 데빈(Devin)의 SWE-2 무료 이용은 코덱스 한도 공백을 메우는 자리에 있었고, 그 옆으로 딥시크 4.1(플래시)과 GLM 5.3 플래시가 보조 모델 후보로 오르내렸다. 21일 오후 2시 39분에는 속도 병목을 겪는 이들에게 딥시크를 권하는 조언이 나왔다.

"속도에서 병목느끼시는분들 딥식 초 추천"

한도가 막히면 SWE-2를, 속도가 막히면 딥시크를 꺼내는 식의 역할 분담이 방 안에서 공유되고 있는 것처럼 읽힌다. 주력 하나에 기대기보다 여러 모델을 상황별로 갈아 끼우는 작업 구성이 엿보인다. 무료 이용과 속도라는 서로 다른 장점이 각기 다른 빈칸을 맡은 셈이다.

22일 오전에는 한 참가자가 "opus5보다 swe-2가 더 잘하네"라며, 이벤트가 끝나도 클로드에서 데빈으로 옮길지 생각해 봐야겠다고 적었다. 같은 날 오후에는 "딥식 -> swe -> glm 순으로 맘이 가네요"라는 선호 순서도 나왔다. SWE-2를 견준 상대가 코덱스가 아니라 opus5였다는 점도 눈여겨볼 만하다. 코덱스의 빈자리를 메우려고 쓰기 시작한 모델을 두고, 한 참가자는 클로드 대신 데빈을 고민하기도 했다.

그록 4.7은 조용했다

22일 0시 50분께 그록 4.7이 나왔지만 반응은 미지근했다. 체감 변화가 없다는 평이 많았다. 새 버전이 나왔다는 소식 자체보다 써 본 뒤 무엇이 달라졌느냐가 먼저 오간 셈이다.

"4.7 은 근데 진짜 변한게 아무것도 체감이 없는거 같네요"

샤오미 MiMo v2.6 Pro가 GPT 5.6 Sol (max)급이라는 전언도 돌았지만, 방의 관심은 SWE-2와 딥시크 쪽에 더 머문 것으로 보인다. 새 모델이라는 사실만으로는 방의 선택을 바꾸지 못한 셈이다.

직전 기간에도 GLM 5.3 플래시·딥시크 4.1 플래시·SWE-2를 둔 비교가 14명·27건 규모로 오갔고, 그때 SWE-2는 하루 1억 토큰급 가성비로 꼽혔다. 벤치는 GLM이 좋지만 후기는 딥시크 4.1 플래시가 낫다는 말과 SWE-2 프로모션이 10월 17일까지 연장됐다는 전언도 그때 돌았다. 이번 기간 비슷한 화제는 76명·392건으로 커졌고, 한 참가자의 선호 순서에서 GLM은 맨 뒤였다. 다만 개인 선호 하나를 흐름으로 일반화하긴 어렵다.

23일 새벽에는 GPT-6 솔·루나가 나오며 이제 중국 모델보다 싸다는 반응도 같은 방에서 나왔다. 가성비를 앞세우던 대안 모델들이 이 변화 뒤에도 자리를 지킬지는 이번 기간 안에서 가려지지 않았다. 지금으로선 새 모델 출시 소식보다 당장 쓸 수 있는 한도와 속도가 선택을 가르고 있는 것으로 보이며, 벤치 점수보다 써 본 후기가 순위를 정하는 흐름이 직전 기간에서부터 이어지고 있음을 시사한다.