워크스페이스 두 달 쪼갠 끝의 현타 — 모델이 똑똑해질수록 얇게, 영어로 토큰 효율 30% 좋아졌다는 체감도
하네스를 잘게 나눌지 얇게 둘지 — 에르메스단 저녁 토론
어제 저녁 7시 40분 무렵 에르메스단에서 한 참가자가 다른 참가자의 하네스(모델을 감싸 작업을 돌리는 실행 틀) 설계를 두고 질문을 던졌다. 워커마다 워크스페이스(작업 공간 단위)를 따로 두지 않고 서브에이전트(메인 에이전트가 일을 나눠 맡기는 보조 에이전트)를 부르는 쪽을 택한 이유가 뭐냐는 것이었다. 돌아온 답은 작업 단위별로 태스크를 할당해 추적하는 방식을 좋아하고, 작업 단위를 많이 세팅하면 며칠씩 돌기도 한다는 것이었다.
질문의 배경은 곧 드러났다. 질문한 참가자 본인이 역할별로 워크스페이스를 나누는 하네스를 두 달째 짓고 있었고, 그 과정의 현타를 털어놨다. 이 갈래에는 6명이 참여해 55건이 오갔는데, 이날 밤 에르메스단 토픽 가운데 발화가 가장 많았다.
"일반/오케스트레이터, 설계, 구현, 검증/검토/리뷰/패치/디버깅 이렇게 워크스페이스 나누고 다 지침이랑 스킬 최적화하는 쪽으로 하네스 구축 중이거든요"
「최대한 얇게」라는 반대 방향의 조언
다른 참가자의 조언은 정반대 쪽을 가리켰다. 그는 "요즘 모델들은 세부적으로 안나누고 스킬하나도 퉁치는게 효율이 더 좋을때가 많더라고요"라며 최대한 얇게 세팅하라고 했다. 이유로는 "모델이 똑똑해질수록 걷어내야하는것도 생각해야해서"를 들었다. 열심히 만들다 새 모델이 나오면 엎는다는 맞장구도 이어졌다.
역할을 잘게 나눠 지침과 스킬을 따로 다듬는 설계와, 모델에게 더 많이 맡기고 구조를 덜어내는 설계가 한 대화 안에서 정면으로 마주 선 셈이다.
영어로 나누면 토큰이 준다는 체감
같은 대화에서 언어를 나누는 요령도 나왔다. 질문한 참가자는 사람을 상대할 때는 한국어, AI끼리는 영어로 나눠 쓴다며 "이렇게만 해도 토큰 효율이 입출력 소모 기준 30%는 좋아지더라구요?"라고 했다. 이 30%는 한 사람이 자기 쓰임에서 느낀 수치로 읽는 편이 맞아 보인다.
곧바로 한국어 토크나이저가 비싼 건 사실이지만 함축성 때문에 실사용 차이는 크지 않다는 얘기도 있다는 반론이 붙었다. 토큰을 아끼는 요령 하나도 누가 어떤 작업에 쓰느냐에 따라 체감이 갈릴 수 있다는 점을 보여 주는 장면이다.
누구를 위해 짓는가
마지막 갈래는 하네스를 쓸 사람이 누구냐는 물음이었다. 한 참가자는 이렇게 털어놨다.
"ai를 잘쓰는 개인이 쓰는것에 워크스페이스구축은 필요없어보이구.. 저는 ai를 못쓰는 팀원들 ai떠먹여줄라고 워크스페이스 구축중인데 머리아프네요"
이 토론은 하네스를 얼마나 잘게 쪼갤지에 정답이 하나로 정해져 있지 않다는 점을 시사한다. 혼자 쓰는 하네스는 모델이 좋아질수록 걷어내는 쪽으로 기우는 반면, AI에 익숙하지 않은 팀원이 쓸 구조는 여전히 손이 많이 간다는 판단이 함께 남아 있는 것으로 보인다. 두 달 공든 구조가 새 모델 하나로 무색해질 수 있다는 걱정이 「현타」라는 말에 담긴 것으로 읽힌다.