대화 기억으로 어울릴 가상 인물을 그려 보니 얼굴이 다 비슷했다, 더배러 참가자들이 모델별 결과를 견줬다
메모리를 근거로 어울릴 가상 인물을 그려 달라는 프롬프트를 해 본 더배러 참가자들의 비슷한 결과와 모델별 차이
밤 9시 무렵 더배러에 프롬프트 하나가 올라왔다. 한 참가자가 지금까지 나눈 대화에서 드러난 나이와 성격, 취향을 바탕으로 어울릴 만한 가상 인물을 그려 달라는 요청문을 공유한 것이다. 이 주제에는 9명이 59건을 남겼고, 여럿이 따라 해 보며 결과에 대한 반응을 남겼다.
반응은 놀람보다 의아함에 가까웠다. 해 본 사람들의 그림이 서로 비슷하게 나온다는 말이 나왔기 때문이다.
근데 결과가 어째 다 비슷하게 나오네요
사람마다 대화 이력이 다른데 그림이 닮았다는 것은, 입력의 차이가 결과의 차이로 충분히 이어지지 않았다는 뜻으로 읽힌다. 다만 얼마나 비슷했는지는 참가자들의 체감이며, 대화에 수치나 비교 자료가 올라오지는 않았다.
조언과 관찰이 이어졌다
다른 참가자는 한 번에 끝내지 말고 메모리부터 끌어낸 뒤 후속 프롬프트를 쓰는 멀티턴 방식이 더 효과적일 것이라고 조언했다.
멀티턴방식이 더 효과적일듯
기억에서 먼저 단서를 꺼내게 하고 그 위에 그림을 요청하자는 취지다. 처음 프롬프트를 공유했던 참가자는 해 보다가 연령대에 따라 인물의 모습이 비슷해지는 것을 발견했다고 말했다. 즉 취향이나 성격 설명이 달라도 같은 나이대로 읽히면 비슷한 얼굴이 나온다는 관찰이다.
모델을 바꾸면 얼굴도 바뀌었다
밤 10시 50분께 모델 비교로 화제가 넘어갔다. 한 참가자는 제미나이로 하면 다른 얼굴이 나온다고 전했고, 몇 분 뒤 같은 참가자가 챗GPT로 하니 앞에서 봤던 얼굴이 나온다며 웃음을 달았다.
두 발화는 4분 간격으로 이어졌고, 같은 질문에 모델이 다르면 답이 달라질 수 있다는 점을 보여 주는 장면으로 자연스럽게 겹쳤다. 특히 챗GPT에서 앞에서 본 얼굴이 되풀이됐다는 말은, 결과가 닮는다는 첫 반응이 특정 모델에서 두드러졌을 가능성을 시사한다.
어떻게 읽을 수 있나
이 대화에서 확인되는 것은 세 가지다. 결과가 비슷하다는 반응, 연령대가 같으면 모습이 닮는다는 관찰, 제미나이에서는 다른 얼굴이 나온다는 전언이다. 이를 이으면 그림의 모습을 정하는 요인이 개인 대화 이력보다 모델이 연령대에 대응해 두는 기본 이미지에 있을 가능성이 있다고 볼 수 있다. 다만 어디까지나 체감에서 나온 추정이며, 대화에서 같은 조건으로 비교했는지는 확인되지 않는다.
멀티턴 조언도 같은 맥락에서 읽힌다. 조언은 밤 9시 19분, 첫 의아함이 나온 지 6분 만에 붙었다. 기억을 한 번에 요약시키기보다 단계별로 끌어내라는 제안은, 한 번의 프롬프트로는 개인차가 충분히 반영되지 않는다는 문제의식으로 보인다. 올라온 프롬프트에는 정답이 따로 없어서, 비교의 기준도 각자의 눈대중이었다. 간단한 놀이처럼 시작한 프롬프트가 모델의 결과 다양성을 가늠하는 시험이 된 셈이다.