GPT-6 아스트라와 페이블 5.1 오케스트레이션 전략
GPT-6 아스트라와 클로드 계열 페이블 5.1의 역할 분담을 실험한 오케스트레이션 노하우와 토큰 효율성 논쟁을 다룬다.
새 모델 등장, 역할 분담부터 다시
오전 시간 에르메스단에서 한 참여자가 질문 하나를 던지며 대화가 시작됐다. GPT-6 아스트라(Astra)가 클로드 계열 페이블(Fable) 5.1보다 아직 못 미치는 영역이 무엇인지 묻는 질문이었다.
"여러분들이 사용하면서 평가하기에 아스트라가 fable5.1보다 아직 못하는 영역이 뭐인거 같나요?"
자정을 넘긴 시각, 다른 참여자가 짧게 답을 보탰다. 기획 단계에서 전체 프레임과 구조를 잡는 작업은 페이블 5.1이 낫다는 의견이었다.
"프레임 잡고 구조 잡는건 페이블 5.1 좋아요"
기획은 페이블, 구조화는 아스트라
이십여 분 뒤 더 구체적인 조합이 공유됐다. 한 참여자는 맨땅에서 시작하는 기획 단계에는 페이블 5.1이 강하지만, 얼개가 나온 뒤 작업을 100개 단위로 쪼개고 배치하는 세부 계획 단계에서는 아스트라가 낫다고 정리했다.
"맨땅에서 헤딩하는 기획은 fable5.1이 좋은데 어느정도 얼개 나오고 task 100개씩 쪼개고 배치하고 이런 세부 계획은 astra가 낫긴 하더라구요 전 그래서 fable med 기획이랑 플래닝 -> astra high 프로젝트 계획서 구조화 -> fable low로 오케스트레이팅 요렇게 합니다 아주 만족중이에요"
이 참여자가 밝힌 루틴은 페이블로 기획하고 아스트라로 구조화한 뒤, 다시 페이블로 세부 오케스트레이션을 맡기는 3단계 순환이었다. 곧이어 다른 참여자는 코덱스와 클로드 코드(Claude Code)를 동시에 쓸 때의 오케스트레이션 방법을 물으며, 지시문 작성 자체가 토큰 낭비로 이어지고 있다는 고민을 털어놓았다.
"혹시 Claude code, codex 동시에 쓰실 때 오케스트레이팅 좋은 방법이 뭐가있을까요?? 현재는 지시문 자체를 claude 통해 대화하며 작성하고 있었는데 토큰도 그렇고 이래저래 비효율적인거같네요 ㅜ_ㅜ"
토큰 효율성 논쟁까지
같은 시간대 외부에서 공유된 한 분석 글도 화제에 올랐다. 아스트라가 xhigh 설정보다 medium 설정에서 오히려 토큰 효율이 떨어진다는 내용으로, medium이 34% 더 저렴하지만 턴 수는 3배 더 많이 소비한다는 분석이었다. 이 글을 전한 참여자는 반복 추론 구조를 가리켜 "Loop Transformers의 승리인가"라는 농담을 덧붙였다.
정답 없는 조합 찾기
이 화제에는 참여자 16명, 발화 19건이 모였다. 참여 규모는 크지 않았지만, 새 모델이 나올 때마다 반복되는 질문 — 어느 모델에 무슨 역할을 맡길 것인가 — 을 놓고 구체적인 3단계 루틴까지 만들어낸 밀도 있는 대화였다. 기획은 페이블, 세부 구조화는 아스트라라는 역할 분담이 한 참여자의 경험으로 제시됐지만, 이것이 방 전체의 합의는 아니었다. 토큰 효율 분석까지 겹치면서, 성능과 별개로 설정값 하나(medium vs xhigh)가 실제 비용 구조를 크게 바꿀 수 있다는 점도 함께 드러난 셈이다. 결국 이날 대화는 어떤 모델이 더 낫다는 결론보다, 모델별 강점을 쪼개 쓰는 오케스트레이션 자체가 새로운 숙제로 떠올랐다는 인상을 남겼다.