#하니스
4개의 포스트
![[특집] SaaS가 25년 동안 못 지킨 약속, AI가 지킨다 — 「전문성의 힘」과 계속 배우는 루프(CLL) 완전 해부](/_next/image?url=https%3A%2F%2Ffiles.core.today%2Fstorage%2Fcoredot%2Fpublic%2Fblog%2Fep-cover.webp&w=3840&q=75)
[특집] SaaS가 25년 동안 못 지킨 약속, AI가 지킨다 — 「전문성의 힘」과 계속 배우는 루프(CLL) 완전 해부
2026년 2월, 앤트로픽의 클로드 코워크가 나오자 월가는 'AI가 SaaS를 죽인다'며 소프트웨어 주식을 던졌습니다. 그로부터 일곱 달 뒤인 9월 15일, 프라이머리 벤처 파트너스의 에밀리 만이 정반대 글을 올렸습니다. 「Enterprise AI is Finally Delivering on the Promise SaaS Made」, 즉 '기업용 AI가 드디어 SaaS가 했던 약속을 지키고 있다'. 1999년 세일즈포스가 '소프트웨어의 종말'을 선언한 이래 SaaS는 25년 동안 '전문성'을 팔았지만 정작 그 전문성은 제품이 아니라 영업사원과 컨설턴트의 머릿속에 있었다는 진단에서 출발해, 오늘의 AI 에이전트는 왜 '똑똑한 신입'에 불과한지, 신입을 베테랑으로 만드는 '스코어북'이란 무엇인지, 고객이 늘수록 다음 고객이 쉬워지는 '계속 배우는 루프(CLL)'가 왜 진짜 해자인지, 그리고 '연구소가 앱을 다 먹을 것'이라는 공포에 스노우플레이크와 세일즈포스의 역사가 뭐라고 답하는지를 따라갑니다. 카드 분쟁 100달러 사례, 청구서 예외의 롱테일, 카파시의 '시스템 프롬프트 학습'부터 2026년 8월의 '하니스 계속 학습' 논문까지 — 인터랙티브 6개와 삽화 13장, 원문 도표 4장으로 함께 읽어 보세요.

같은 모델인데 성적이 10배 차이 — 코딩 에이전트 하니스 해부 (Zoom·UMass 176개 실험 완전 정리)
Nemotron-3 550B가 32k 창에서 SWE-Bench Verified 6.4%를 받았다. 모델을 한 글자도 바꾸지 않고 하니스의 맥락 관리만 켜자 58.4%가 됐다. 같은 bash 단독 인터페이스가 550B에게는 +3.6pp에 비용 절반, Mistral에게는 −24pp였다. 2026년 9월 17일 공개된 Zoom·UMass·Emory 연구진의 논문은 코딩 하니스를 계획·행동 공간·맥락 관리 세 부품으로 분해해 4개 모델 × 2개 벤치마크 × 176개 설정에서 부품 하나씩의 효과를 쟀다. 결론은 ‘좋은 하니스’가 아니라 ‘모델·예산·과제에 따라 갈리는 하니스’다. ReAct에서 하니스 엔지니어링까지의 역사, 논문의 네 가지 발견, 그것이 Claude Code·Codex의 오늘과 어떻게 맞물리는지를 인터랙티브 위젯 6종과 삽화로 풀었다.

루프 엔지니어링 — 더 이상 에이전트에게 프롬프트하지 마라
Addy Osmani의 글 한 편이 개발자 타임라인을 뒤흔들었습니다. '에이전트에게 프롬프트하지 마라. 에이전트를 프롬프트하는 시스템을 설계하라.' 프롬프트→컨텍스트→하니스→루프로 이어진 추상화의 사다리, ReAct·Reflexion부터 2026년 /goal까지의 역사, 루프를 이루는 5가지 빌딩블록과 비용·위험을 논문과 사례로 쉽고 자세하게 풀어드립니다.

하니스(Harness) — AI가 스스로 일하는 방식을 설계하다
모델은 같은데 왜 어떤 AI는 50개 작업 중 20개에서 멈추고, 어떤 AI는 6일 만에 Bun을 통째로 다시 쓸까? 답은 '하니스(harness)'에 있습니다. ReAct에서 동적 워크플로우까지 — 모델을 둘러싼 골격이 어떻게 진화해 왔는지, 왜 지금 화제인지를 논문과 사례로 쉽게 풀어드립니다.