
에이전트코리아
AK 인프라, 코딩 에이전트, 현장 자동화 기록

AK 인프라, 코딩 에이전트, 현장 자동화 기록

AI 트렌드, 모델 체감, 프롬프트 운영 흐름

에이전트 실험, 자동화 워크플로우, 실무 고도화
같은 밤 에이전트코리아에서는 프롬프트 없는 완전자율 에이전트가 아직 시기상조라는 회의론이 오갔고, 에르메스단 웨비나에서는 에이전트에게 설득하듯 구체적으로 지시하라는 실전 조언이 나왔다. 두 논의는 결국 사람이 얼마나 명확한 방향을 제시하느냐가 에이전트 활용의 병목이라는 지점으로 수렴한다.
지피티6 아스트라(GPT-6 Astra) 공개 직후 200달러 최상위 플랜(ChatGPT Pro x20) 신규 구독이 막혀, 에이전트코리아와 에르메스단이 같은 날 아침부터 같은 화면을 공유했다. 에르메스단에서는 범위가 한 지역이 아니라는 전언과 원인 추정이 오갔고, 오전에 대안으로 안내된 카카오톡 경로마저 오후에 닫혔다는 보고가 이어졌다. 신모델이 사용량을 더 빨리 소모시키는 동안 요금제 상단 진입이 같은 날 막혔다는 점이, 두 방이 동시에 이 화두에 붙은 이유를 시사한다.
브라우저 에이전트 어사이드(Aside)가 같은 날 두 오픈카톡방을 동시에 붙들었다. 에이전트코리아는 제품 안에 들어선 수익화 장치와 인수 가능성을 읽었고, 에르메스단은 오후에 열린 윈도우 베타 신청에 몰려들었다. 한 제품이 사업 궤적과 설치 대기줄이라는 두 층위에서 동시에 읽힌 셈이어서, 평가 기준이 모델 성능보다 일상 업무 안의 체감으로 옮겨가고 있음을 시사한다.
아스트라(GPT-6 Astra)가 출시 첫날보다 느리고 둔해졌다는 토로가 아침부터 저녁까지 끊이지 않았다. 속도·품질 불만에 토큰 소모가 크다는 지적이 겹치고 딥식이 의외로 낫다는 반응과 오푸스는 여전히 메인이라는 옹호가 엇갈렸는데, 공개된 변경 내역이나 확인된 성능 저하 없이 체감만 오간 국면 자체가 화두가 된 것으로 보인다.
주간 토큰이 바닥난 참여자들이 딥식(DeepSeek) V4.1 플래시로 옮겨가면서 속도 이야기가 방을 채웠다. 초당 처리량부터 다르다는 체감이 짧은 간격으로 겹쳤지만 결론은 모델 교체가 아니라 클로드 오푸스 5를 메인에 두고 빠른 쪽을 워커로 쪼개는 분업이었고, 품질을 아직 모르는 모델의 위험을 줄이는 선택으로 보인다.
오픈AI가 실시간 음성 API 지피티 라이브-1(GPT Live-1)을 공개하자 분당 0.05달러라는 단가와 자연스러운 대화 품질이 먼저 화제가 됐다. 대화는 곧 이 API를 아바타 생성 사이트와 연결해 실시간 강사로 쓰는 조합으로 넘어갔다. 기술 가능성보다 분당 단가가 서비스 형태를 정하는 단계로 넘어갔음을 시사한다.
중국 선전 미니PC 제조사가 보내온 라이젠 기기에 35B 모델을 올려 그래픽카드 없이 초당 22토큰을 뽑아낸 사례가 공유됐다. 127B 적용 가능이라는 설명과 램 128GB면 300B까지라는 전망이 뒤따랐지만 그 구간의 실측 속도는 제시되지 않았다. 로컬 구동의 문턱이 값비싼 가속기 확보에서 메모리 증설로 옮겨가고 있음을 시사한다.
브라우저형 AI 에이전트를 만드는 팀의 CTO가 방에 직접 들어와 역할 분담과 개발 비화를 풀어놨다. 윈도우 버전이 예상보다 훨씬 어려웠다는 토로와 함께 이번 작업에서 AI가 맡은 비중은 20%뿐이고 나머지는 예전 방식대로 직접 짰다고 밝혔는데, 에이전트를 만드는 쪽의 작업은 여전히 사람 손에 기대어 있음을 시사한다.
개인 에이전트 뮤즈(Muse)가 미국에서 2위까지 올라왔다는 소식이 전해지며 오픈클로·헤르메스는 저무는 쪽으로 묘사됐다. 강점으로 꼽힌 대목은 성능 수치가 아니라 인스타그램·왓츠앱에 쌓인 개인 자료 연동과 별도 서버 없는 24시간 구동이었다. 개인 에이전트를 고르는 기준이 '무엇을 잘 푸나'에서 '내 생활 기록에 얼마나 붙어 있나'로 옮겨가고 있음을 시사한다.
클로드 계열 모델인 페이블(Fable)을 향한 팬심과 주간 한도 불만이 같은 대화에 섞였다. 5시간 제한 위에 주간 한도의 50%까지만 쓸 수 있다는 두 겹 제한, 20x 요금제의 주간 캡이 표기만큼 늘지 않는다는 지적과 6월 집단소송 언급까지 이어졌는데, 한도가 모델 선택을 대신 결정하는 국면으로 보인다.
같은 챗GPT 프로(ChatGPT Pro) 구독인데 결제 창구에 따라 31만원·299,000원·199.99달러로 표시가가 갈렸다. 참여자들은 플랫폼 수수료와 세금을 원인으로 거론했지만 어느 단계에서 얼마가 얹혔는지는 확인되지 않았고, 창구가 늘어난 만큼 가격 비교가 사후에야 일어나는 구조로 보인다.
지피티6 아스트라(GPT-6 Astra)로 기존 업무를 전부 옮겨 돌려본 결과, 마케팅 분석 프로세스 설계 같은 복잡한 작업은 아직 클로드 페이블(Fable) 5.1이 낫다는 후기가 나왔다. 반대로 컴퓨터 사용이나 3D 작업에서는 아스트라가 넘기 어려운 수준일 것이라는 전망이 같은 후기에 붙었다. 모델 선택의 축이 총점 비교에서 '내 업무의 어느 구간이 무너지나'로 갈라지고 있음을 시사한다.
코그니션(Cognition)의 신모델 SWE-2 발표 내용이 오전 끝자락에 방에 전해졌다. FrontierCode 50.0%로 이전 버전과 타 진영 모델을 앞섰고 클로드 계열의 페이블(Fable) 5.1과 맞먹는 성능을 64% 낮은 비용으로 낸다는 주장이었는데, 한 달 무료 조건은 성능 홍보보다 실제 사용처 확보를 노린 것으로 보인다.
지피티6 아스트라와 솔의 관계가 클로드 계열의 오푸스·페이블 관계와 같은지, 테라는 소넷 자리이고 루나는 하이쿠 자리인지를 묻는 추측성 질문이 오갔다. 확인된 답으로 정리되지는 않았고, 솔을 페이블과 같은 자리로 여겼다가 되묻는 장면까지 이어졌다. 고유명으로 갈아탄 작명에서 순서 단서가 사라진 탓에 이용자 쪽이 직접 등급 대응표를 만들고 있음을 시사한다.
16일 저녁부터 17일 새벽까지 코덱스(OpenAI Codex) 장애가 세 차례 반복되는 사이, 전날까지 임박설로만 돌던 Kimi K3가 전격 개방됐다. 커뮤니티는 출시 몇 시간 만에 벤치마크·요금제·토큰 소진율 실측을 끝내가며 갈아탈 채비에 들어갔다.
환경청과 법제처 공무원들 사이에서 한 참여자의 개인 개발 법령 검색 도구 'korean-law-mcp'가 화제에 올랐다. 정부 공식 서비스보다 속도와 정확도가 낫다는 평가가 이어지며, 공공 법률 AI 영역의 기술 격차를 드러내는 사례로 보인다.
법률 검색 도구의 우수성을 설명하던 대화는 검색(RAG)과 추론이 서로 다른 능력이라는 해설로 이어졌고, 곧이어 장기기억 벤치마크에서 90점을 기록했다는 자랑으로 번졌다. 실측 수치와 성과가 맞물리면서도, RAG 구축 비용에 대한 부담은 여전히 해소되지 않은 화두임을 시사한다.
새벽 대화에서 한 참여자가 개발보다 마케팅이 진짜 돈이 된다고 말하자, 두 개의 1인 기업으로 상반기 매출 1억에 가까운 실적을 낸 참여자가 클로드 코드 자동화 경험을 풀어놓았다. 완성도보다 속도, 개발력보다 판매력을 우선하는 정서가 이날 대화 전반을 관통했다는 것을 시사한다.
LazyCodex(가재코드) 개발자의 즉석 웨비나 정원이 50명에서 330명까지 부스트 후원으로 늘어나며 저녁 내내 방을 들썩이게 했다. 전날 화면공유 인원 제한을 둘러싼 문의와 겹쳐 보면, 이번 열기는 방 자체가 빠르게 몸집을 키우고 있다는 신호로 읽힌다.
90% 할인 중인 패스트캠퍼스 데이터 분석 강의를 두고 커뮤니티에 의견을 구했지만 돌아온 반응은 대체로 회의적이었다. 커리큘럼 최신성에 의문을 제기하는 구체적 지적까지 더해지며, 할인율보다 콘텐츠 실효성을 먼저 따지는 태도가 이 커뮤니티의 소비 기준임을 시사한다.
일론 머스크의 X 코드베이스 오픈소스 공개 소식부터 개인 참여자가 완성한 AI 에이전트 도구, 자정 넘어 이어진 MCP 생산성 후기까지 하루 새 다양한 층위의 소식이 오갔다. 규모는 달라도 도구를 스스로 연결해 쓰는 흐름이 이 커뮤니티의 일상임을 시사한다.
보고서 피드백에 지친 한 참여자가 직접 만든 자동 전달 도구를 소개하고, 곧이어 서브에이전트 1.0과 2.0의 완전 격리 방식이 도마에 올랐다. 두 화제 모두 에이전트에게 일을 맡긴 뒤 그 결과를 사람이 어떻게 확인할 것인가라는 같은 고민을 안고 있었다는 것을 시사한다.
VPS나 맥미니에 에이전트를 심어두고 텔레그램으로만 연결해 쓰는데 파일 전송과 로컬만큼의 편의성이 부족하다는 고민에서 출발해 tailscale·syncthing·sftp 등 대안이 오갔다. 헤르메스 자체를 다른 맥미니로 옮기는 방법에 대한 질문도 이어졌다.
Kimi가 무료로 풀리며 GPT 신모델 출시 2주 뒤 비슷한 성능의 중국 모델이 따라 나오는 패턴에 대해 짜고 치는 판 같다는 의문이 제기됐다. 그록과 키미 중 어느 쪽을 구독할지 고민이 이어졌고, 키미로 슈퍼마리오 벤치마크를 재밌게 플레이했다는 후기도 공유됐다.
NotebookLM 개명, Gemini 3.5 Pro 출시 지연(블룸버그 보도)에 이어 신규 클라우드 에이전트 Spark를 직접 써본 후기가 공유됐다. 서버 없이 클라우드로 돌아가 컴퓨터 없이도 일을 맡길 수 있다는 게 장점이지만 이미지·영상 처리는 아직 지원되지 않는다는 실사용 소감이 오갔다.
푸른양이 만들고 있는 실무자 중심 문서관리·AI스캔 서비스에 대해 이도형이 직접 피드백을 줬다. 기존 시스템 데이터 이관 가능 여부를 첫 화면에 강조해야 한다는 제안과, 실무자 개인 구독 대 회사 전체 도입 사이 마케팅 순서 고민이 길게 이어졌다.
마마로티가 직접 만든 '부모 유형 테스트'(딸깍 제작)를 공유하며 성향 테스트 설계 노하우를 나눴다. 설계를 세밀히 하지 않으면 분포·판정이 단순해진다는 팁과 함께, 세션 5시간 리밋 때문에 캡처 오류를 못 고치고 있다는 후기가 오갔다.
카잣둠은 Hermes CLI에서 /model로 임시 전환해도 최근 업데이트 이후 기본 설정 자체가 바뀌어버리는 버그와, config.yaml에 persist_switch_by_default: false를 추가하는 해결법을 공유했다. 앞서 한 참여자가 Fable을 쓰기 어렵다고 토로한 데서 시작된 대화로, 그록 사용 시 vision·image_gen 등 xai oauth 연동을 매번 재설정해야 하는 불편도 함께 언급됐다.