BLUEBUG'S BLOG

하네스 무용론, 정말 맞는 이야기일까: AI 에이전트 하네스 논쟁

관련글 [하네스 무용론? 반은 맞고 반은 틀립니다] 요약 2026년 들어 AI 업계에서는 “모델이 좋아지면 하네스(harness)는 필요 없어진다”는 이른바 하네스 무용론이 계속해서 화제가 되고 있다. OpenAI의 연구원 노엄 브라운(Noam Brown)과 구글 딥마인드에서 AI 스튜디오와 Gemini API를 이끄는 로건 킬패트릭(Loga...

하네스 무용론, 이번엔 "판단과 실행을 분리하라"로 답한다

— 브라운·킬패트릭의 말과 행동이 어긋나는 이유, 그리고 판단 레이어 vs 실행 레이어라는 재배치 — 성격: 「코딩 하네스 논쟁」 시리즈 세 번째 문서. 최근 다시 확산 중인 “하네스 무용론”에 대한 작성자 본인의 분석(판단/실행 레이어 분리 프레임워크)을 중심에 놓고, 그 근거가 되는 발언과 사건들을 1차 출처로 교차 검증했습니다. 원문 ...

헤르메스 에이전트로 혼자 다섯 명 몫을 하는 법 — 샘 호트만의 1인 기업 자동화 전략

원본: HOW I AI PODCAST, 「헤르메스 에이전트 5개를 캐릭터별로 나눠서 혼자 일하는 방법, 실제 대화창까지 전부 공개합니다 (AI 엔지니어 샘 호트만님)」, 빌더 조쉬(Builder Josh) 채널, 2026년 7월 15일 공개 정리 기준일: 2026년 7월 16일 목차 들어가며 — 이 영상은 무엇을 다루는가 헤르메스 에...

"사내 AI 에이전트, 굳이 우리가 다시 만들어야 할까?" — 커스텀 에이전트 구축의 함정과 대안

이 글이 다루는 내용 이 문서는 유튜브 채널 퇴근길AI(운영사: 팀제이커브·teamjcurve.com)가 2026년 7월 9일 공개한 영상 “사내 AI 에이전트 만들면 생기는 문제들이 있습니다” 의 내용을 상세하게 풀어 정리한 것이다. 이 채널은 대기업 임직원을 대상으로 AX(AI Transformation) 교육과 컨설팅을 진행하는 팀의 실무 경험...

사무 자동화에서 LLM 벤치마크가 믿을 수 없는 이유 — Tool Calling 불일치, 프론티어 가격 딜레마, 그리고 굳어지는 해자 구조

1. 들어가며 https://www.threads.com/@unohee/post/Dazs7taE77A 일반 사무업무에 AI를 도입하는 경우 LLM 성능 벤치마크를 믿기가 상당히 어렵다. 특히나 새로운 업무 루브릭에 맞춰서 하네스를 짜려고 하거나 하면 tool calling 일관성에서 너무 다른 모습을 보이고 아무리 벤치마크를 여러종 돌려...

"AI가 개발자를 대체한다"가 아니라 "모든 조직이 소프트웨어 조직이 된다"

https://www.threads.com/@dev._pill/post/Da0mxpiAWBU Fable 5를 보면서 오히려 생각이 바뀌었다. 예전에는 앱은 커녕 웹사이트 하나 만드는 일조차 스타트업에서 늘 우선순위 뒤로 밀렸다. 비용도 크고 개발자가 필요했기 때문이다. 그런데 이제는 대표가 직접 AI로 프로토타입을 만든다. 만들 수 있...