오푸스5 문체 지적 — 한 참여자 "글쓰기는 오푸스 4.6으로"
클로드 오푸스5의 문체 변화에 대한 불만과 이전 버전 선호 흐름이 에르메스단에서 나타났다.
밤 11시를 넘긴 시각, 에르메스단에서는 클로드 오푸스5(Opus 5)의 글쓰기 문체를 둘러싼 불만이 이어졌다. 23시8분 한 참여자가 "오퍼스 단어 선택이 요즘 왜이러지.. 글을 너무 읽기 힘들게 쓰네요 원래 이랬나"라고 지적하며 대화가 시작됐다.
1분 뒤인 23시9분에는 다른 참여자가 "오퍼스는5는 나올때부터 gpt 스럽더라구요 이전 opus나 Fable은 괜찮습니다"라고 답하며, 오푸스5가 출시 시점부터 이런 경향을 보였다는 관찰을 보탰다. 23시10분에는 처음 문제를 제기했던 참여자가 다시 "글은 오퍼스 4.6으로 내려서 써야겠네요.. 5는 진짜 영 ㅜ"라고 밝히며 실제로 이전 버전으로 돌아가겠다는 뜻을 나타냈다. 이 화두에는 5명이 참여해 5건의 발화가 오갔다.
발화 수는 적지만 반응은 구체적이다. 단순히 "문체가 별로다"는 인상 수준을 넘어, 특정 이전 버전인 오푸스 4.6의 이름을 직접 거론하며 용도별로 모델을 나눠 쓰겠다는 실행 계획까지 나온 점이 눈에 띈다. 코딩이나 분석 작업과 달리 글쓰기처럼 문체 자체가 결과물의 품질로 직결되는 용도에서는, 최신 모델이라고 해서 무조건 선호되지는 않는다는 점을 보여주는 사례로 읽힌다.
이전 오푸스나 클로드 페이블(Fable)은 "괜찮다"는 평가를 받은 반면 오푸스5만 콕 집어 GPT 계열 문체에 가깝다는 지적이 나온 것도 특징적이다. 모델 세대가 올라갈수록 벤치마크 지표는 개선되더라도, 실제 사용자가 체감하는 문체라는 정성적 요소는 별도로 평가받고 있다는 것을 시사하며, 작업 목적에 따라 구버전 모델을 의도적으로 유지하려는 흐름이 이 방에서 나타나고 있는 것으로 보인다.
이런 미세한 평가 차이에 방이 민감하게 반응하는 것은, 참여자들이 이미 여러 모델을 용도별로 나눠 쓰는 데 익숙해져 있다는 방증이기도 하다. 코딩용과 글쓰기용을 구분해 쓰는 습관이 자리잡은 상태에서, 새 버전이 나올 때마다 어떤 용도에 적합한지를 빠르게 판단하고 필요하면 이전 버전으로 되돌아가는 유연함이 이 짧은 대화에서도 드러난다.
발화 하나하나는 짧고 감상에 가깝지만, 그 안에는 구체적인 판단 기준이 담겨 있다. "읽기 힘들다"는 인상을 "GPT 스럽다"는 구체적 비교로 뒷받침하고, 다시 "4.6으로 내리겠다"는 실행으로 이어지는 흐름은, 참여자들이 모델 선택을 감이 아니라 실제 작업 결과물을 놓고 판단하고 있음을 보여준다.
이 대화가 짧게 끝난 것도 오히려 의미심장하다. 별다른 반박 없이 지적과 공감, 그리고 대안 선택까지 세 마디로 정리됐다는 것은, 방 안에서 오푸스5의 문체 경향이 이미 어느 정도 공유된 인식이었을 가능성을 시사한다. 새 모델이 나올 때마다 방이 곧바로 용도별 재평가에 들어가는 모습은, 최신 버전을 무조건 따라가기보다 결과물의 질을 기준으로 도구를 고르는 참여자들의 실용적인 태도를 다시 한번 보여준다.