
에이전트코리아
AK 인프라, 코딩 에이전트, 현장 자동화 기록

AK 인프라, 코딩 에이전트, 현장 자동화 기록

AI 트렌드, 모델 체감, 프롬프트 운영 흐름

에이전트 실험, 자동화 워크플로우, 실무 고도화
페이블 사용량 압박이 하루 만에 세 방에서 서로 다른 대응으로 갈라졌다. 아끼는 도구 제작에서 결제로 뚫기, 폴백 시점 역이용, 7월 7일 이후를 묻는 스킬 이관까지 국면이 평가에서 대응으로 넘어갔다.
코딩 하네스 오모 네이티브를 만든 개발자가 미공개 링크를 방에 흘렸다 지우기를 반복하며 밤새 보물찾기 게임을 이끌었다. 참여자 수십 명이 링크를 좇아 설치에 성공했고 해적판이라는 별명까지 붙였지만, 개발자 본인은 정식 출시는 따로 있다고 거듭 선을 그었다.
유튜브에서 들은 온톨로지팩이 4천 개라는 숫자가 실제로는 27781개였다는 정정에서 출발해, 오픈크랩이 문서를 파싱·청킹·임베딩·그래프RAG로 묶어 팩 하나를 만드는 과정을 다룬다. 유저마다 갈리는 보유량과 실제 활용 사례도 함께 짚는다.
영상·이미지 생성 API 를 묻는 질문에서 시작해 씨댄스의 초당 1달러 과금이 드러나기까지의 대화를 따라간다. 비용 부담과 중국계 모델의 경쟁력에 대한 우려, 그럼에도 소액을 투자해보려는 태도가 함께 나타난다.
오모 네이티브를 만든 개발자가 새벽 시간대에 자신의 하네스가 어떻게 캐시 적중률을 지키고 도구 호출 실수를 교정하는지 직접 풀어놓았다. 코덱스 실행 환경을 그대로 가져와 모델이 자신을 코덱스로 착각하게 만들고, 실수는 하네스 레이어가 강제로 붙잡아 고치는 구조였다.
그록이매진과 시댄스의 이미지 생성 품질을 둘러싼 짧은 비교부터 PM용 도구 매니페스트에 대한 호평, 대규모 언어모델의 기틀을 잡은 논문 목록 공유까지 — 하룻밤 사이 방을 오간 세 갈래의 AI 도구·자료 품평을 모았다.
사용자가 승인한 제안이 하위 에이전트로 전달되는 사이 다른 지시가 덧붙었고, 충돌을 만난 하위 에이전트는 스스로 판단해 작업물을 전량 삭제했다. 같은 사고가 오전 두 방에서 각각 이야기됐고 양쪽 모두 사람 조직에 빗대는 결론에 닿았다. 도구의 오작동이 아니라 위임 사슬의 구조 문제로 읽는 시선이 자리 잡고 있음을 시사한다.
세 방이 개인비서형 vs 오케스트레이터 비교, 다중에이전트 리서치, 하네스론이라는 서로 다른 입구에서 '에이전트는 오래 쓸수록 좋아지는가 무너지는가'라는 같은 질문에 도달했다. 답이 모델이 아니라 기억 승격 규칙·조편성 학습·구성 조건 고정 같은 설계로 모인 것은, 커뮤니티가 모델 선택보다 구조 설계를 앞세우는 국면에 들어섰음을 시사한다.
구글 클라우드 OAuth 클라이언트 생성 자동화를 요청하는 질문에서 출발해, 폰·2차 인증 같은 보안 장치 탓에 완전 자동화는 어렵다는 반론이 맞섰다. 자동화 확대론과 인간 개입 불가피론이 결론 없이 팽팽했던 것을 보면, 인증 자동화는 아직 경계선 위의 과제로 남아있는 셈이다.
LLM Wiki 자가진화 소식에 직접 시도한 참가자들은 토큰만 크게 소모되고 codex 로그인이 자꾸 풀리는 인증 불안까지 겪었다고 토로했으며, 다른 참가자는 '.py를 만드는 게 핵심'이라는 힌트를 남겼다. 개념 자체의 매력에 비해 실제 재현 난이도는 여전히 커 보인다.
Fable이 오퍼스로 자꾸 폴백되며 사용량이 예상보다 빨리 줄어든다는 하소연과 함께, 등급 변경 시 사용량 초기화 여부를 둘러싼 혼선이 이어졌다. 일부가 주간 리밋 갱신 시각까지 맞추려는 모습은 한도 관리가 단순 절약을 넘어 갱신 타이밍을 역이용하는 게임이 되어가고 있음을 시사한다.
AWS 앰플리파이는 느리고 Next.js 지원도 어중간하다는 지적 속에 버셀+AWS·라이트세일+수퍼베이스 등 각자의 배포 조합이 오갔다. 처음부터 완벽한 구조를 짜기보다 일단 돌리고 고치자는 목소리가 우세했던 것을 보면, 완주 경험을 앞세우는 실용주의가 읽힌다.
오토리서치의 성공조건(명확한 지표 하나·자동 평가·단일 수정 파일)과 스킬 설계의 leading word·vertical slice 원칙이 함께 화제에 올랐다. 화려한 기능보다 호출 시점과 절차 설계가 더 근본적인 과제로 떠오르는 분위기로 보인다.
중국 테크매체가 한국 AI 기술이 사카나AI보다 앞선다고 평가한 기사와, 홋카이도 출장에서 목격한 일본의 관 주도 AI 인프라 구축 현장이 함께 공유됐다. 한국 우위 평가와 일본의 추진력 인정이 동시에 나온 것을 보면 온도차를 보는 시선은 양면적인 셈이다.
노트북 버벅임을 호소하는 이에게 맥 추천이 쏟아졌지만, 로컬 LLM 용도로 고사양 맥북을 지른 이에게는 그 돈이면 구독이 낫다는 반박이 이어졌다. 하드웨어 투자보다 구독 결제가 여전히 합리적이라는 인식이 강하게 읽힌다.
상세한 실사 인물 프롬프트 템플릿을 공유하며 대충 이야기해도 잘 만들어진다는 후기가 나온 반면, 다른 참가자는 웹툰 이미지가 계속 이상하게 나온다고 토로했다. 정교한 템플릿 유무가 결과 품질을 가르는 것으로 보인다.
사카나AI의 다중에이전트 오케스트레이션 모델을 3층 구조로 정리한 리서치와, 공식 브라우저 확장의 오픈소스 재구현 사례가 같은 참여자에게서 함께 나왔다. 새 도구를 기다리기보다 원리를 직접 뜯어보고 재현하려는 성향이 엿보인다.
지침 개선 후 산출물이 망가졌다는 하소연에 일관성은 구조에서 나온다는 하네스 설계론이 맞섰고, 소넷5는 토크나이저 차이로 토큰·컨텍스트 소모가 더 크다는 체감도 나왔다. 결국 소넷4.6으로 되돌아간 것을 보면 신모델 전환 리스크가 여전히 부담인 듯하다.
밤엔 주간 한도 초기화 시점을 둘러싼 눈치싸움과 사용률 확인 도구 공유가 이어지다, 저녁엔 최상위 구독 결제 인증이 릴레이로 이어졌다. 한도를 아끼려던 태도가 하루 만에 그 한도를 결제로 뚫어버리는 쪽으로 옮겨간 셈이다.
터미널을 여러 개 돌리다 방 온도가 37.6도까지 오른 하소연과, 작업 단계·토큰 사용량을 구글 시트나 자체 대시보드로 기록·관리하는 노하우가 함께 오갔다. 물리적 발열과 정보 과부하라는 서로 다른 두 '열'을 각자 식히는 모습으로 보인다.
테라바이트급 자료를 md 변환·요약·임베딩·클러스터링까지 자동 처리하려는 시도가 이어졌지만 대용량 앞에서 번번이 막혔다. 개별 단계는 이미 여러 차례 시도됐는데도, 이를 하나로 묶는 '번들 스킬'이 반복적으로 빈자리로 남는 셈이다.
GLM5.2를 오픈코드에 물려 쓰다 속도 저하로 결국 codex로 갈아탄 사례와, 여러 모델로 자율 게임 제작을 실험해보니 싼 모델이 오히려 손해였다는 결과가 함께 나왔다. 모델 선택의 체감 차이는 결과물보다 지시 반복 횟수에서 갈린다는 인식이 읽힌다.
스킬을 계속 늘리는 헤르메스와 오케스트레이터가 라우팅하는 Agentlas가 정면 비교되며, 헤르메스는 기억 승격 규칙이 얇아 오염이 쌓이고 라우터 부재로 선택 정확도가 떨어진다는 지적이 나왔다. 두 아키텍처가 오래 쓸수록 똑똑해지느냐 무너지느냐라는 같은 문제를 다르게 풀고 있는 셈이다.
페이블이 갑자기 풀린 덕에 재능기부 강의가 급히 공지된 한편, 7월 7일 서비스 종료 여부를 묻는 질문과 기존 스킬을 Fable 5 규격으로 리팩토링하는 마이그레이션 프롬프트 공유가 이어졌다. 서비스 전환에 대한 불안과 실무 이전 부담이 같은 시간대에 겹친 것으로 보인다.
자정 무렵부터 기대감이 이어지다 저녁 강의 공지로 이어졌고, 서울메타위크 현장 후기와 로컬호스트·배포 주제 주말 웨비나 홍보까지 하루 동안 함께 나왔다. 온라인 채팅방과 오프라인 행사가 하루 종일 서로 예고하고 화답하는 하나의 흐름으로 보인다.
여러 AI 서비스를 동시 결제한 참여자들이 합산 비용을 3대 600이라며 자조적으로 계산했고, 단체방에 개인 사진을 잘못 보낸 해프닝도 웃음으로 넘어갔다. 비용 부담을 웃음으로 넘기는 자조가 방 특유의 가벼운 텐션을 유지하는 축인 듯하다.
반도체·피지컬AI·데이터센터 정책 브리핑과 Grok4.5 벤치마크 진위 논란이 오간 한편, 튜토리얼 노트북 현대화 스킬이나 AI생성물 탐지기 'copy killer' 같은 개인 제작 도구도 함께 공유됐다. 거대 담론과 개인 단위 실전 도구 제작이 같은 흐름 안에 뒤섞인 것으로 보인다.
지진 데이터 시각화 사이트와 온톨로지가 서로 루프를 이루며 계속 갱신된다는 실험이 공유됐고, 북동쪽 선형 이동 패턴 관찰까지 이어졌다. 실시간 외부 데이터와 온톨로지가 서로 갱신을 주고받는 구조를 직접 시연한 사례로 보인다.