coredot.today
블로그로 돌아가기

#코딩 에이전트

8개의 포스트

[특집] 플랜 모드는 죽었다 — AI 코딩에서 '계획서'는 사라지고 '이해'의 문제만 남았다
특집특집플랜 모드
2026.09.27

[특집] 플랜 모드는 죽었다 — AI 코딩에서 '계획서'는 사라지고 '이해'의 문제만 남았다

2026년 9월 24일, 전 GitHub 엔지니어 아이먼 나딤이 「플랜 모드는 죽었다」라는 글을 올렸습니다. '계획'을 제품의 중심에 둔 코딩 앱을 직접 만들었다가 실패한 사람의 고백입니다. 이틀 만에 해커뉴스 553점, 댓글 477개가 달렸고, 맨 위 댓글은 Claude Code를 만든 보리스 체르니의 "대체로 동의합니다"였습니다. 이 특집은 그 글을 뼈대로, 1970년 로이스의 '폭포수' 논문이 사실은 폭포수를 경고했다는 이야기부터 브룩스의 '하나는 버려라', 켄트 벡의 변경 비용 곡선, 나우르의 '프로그래밍은 이론 쌓기', 쇤의 '재료와의 대화'를 거쳐 2025년 플랜 모드와 스펙 주도 개발 붐까지 따라갑니다. 나딤이 꼽은 네 가지 오판(계획하기와 계획서를 혼동했다, 모델이 너무 좋아졌다, 아무도 AI가 쓴 글을 읽고 싶어 하지 않는다, 계획과 구현을 떼어 놓았다)을 사례로 풀고, 에이전트가 수백 개로 늘어나는 2026년에 사람의 '이해'를 어떻게 지킬지까지 인터랙티브 6개와 웹툰 12장으로 함께 읽어 보세요.

코어닷투데이64분
[특집] AI가 코드를 거의 다 쓴다면, 소프트웨어 엔지니어링은 어떻게 되는가 — '연필을 내려놓은' 개발자들의 2026년
특집특집AI 코딩
2026.09.26

[특집] AI가 코드를 거의 다 쓴다면, 소프트웨어 엔지니어링은 어떻게 되는가 — '연필을 내려놓은' 개발자들의 2026년

2026년 9월 23일, 루비 온 레일스의 창시자 DHH가 무대에서 선언했습니다. '37시그널스는 연필을 내려놓았다.' 손으로 코드를 쓰는 일은 대부분의 회사에서 더 이상 경제적인 기술이 아니라는 겁니다. 이 선언을 아홉 달 먼저 내다본 글이 있습니다. 게르게이 오로스의 「AI가 코드를 거의 다 쓴다면, 소프트웨어 엔지니어링은 어떻게 되는가」입니다. 이 특집은 그 글을 뼈대로, 1950년대 '자동 프로그래밍'이라 불렸던 컴파일러에서 브룩스의 「은총알은 없다」, 암달의 법칙과 제번스의 역설까지 거슬러 올라가며 '코드가 공짜가 되면 무엇이 비싸지는가'를 쉽게 풀어 봅니다. 가치가 떨어지는 기술과 오르는 기술, 변경 실패율 30% 상승이라는 불편한 데이터, 사라지는 주니어 사다리, 그리고 코딩의 즐거움을 잃는 슬픔까지 — 인터랙티브 계산기와 웹툰으로 함께 따라가 보세요.

코어닷투데이60분
관련성은 문단에, 충분성은 집합에 — ‘부족한 증거’를 찾는 RAG와 평가의 재정의 (RAG 특집 2편)
특집RAG증거 충분성
2026.09.21

관련성은 문단에, 충분성은 집합에 — ‘부족한 증거’를 찾는 RAG와 평가의 재정의 (RAG 특집 2편)

‘우리 회사가 이 사업에 신청할 수 있나요?’에 답하려면 신청 자격·예외 조건·마감일 변경 공지 세 가지가 모두 필요하다. 관련성 순으로 뽑은 top-5는 전부 신청 자격의 변형이고, 그런데도 Recall@k는 만점이다. 지표가 실패를 보지 못한다. 2026년 9월 17일 공개된 「The Missing Complement」는 검색을 ‘이슈와 닮은 것의 순위’가 아니라 ‘지금 이 결정에 아직 부족한 것의 회수’로 다시 정의하고, 45개 저장소 500개 에이전트 상태에서 집합 단위 충분성을 재는 SERBench를 만들었다. 같은 주 CIKM 2026에 실린 TRACE는 OCR이 깨진 1887년 프랑스 의회·신문 아카이브에서 ‘답을 만드는 대신 출처를 찾고 모든 판정에 근거를 남기는’ 검색을 질문당 0.02달러로 구현했다. 두 논문을 따라가며, 왜 개별 관련성 대신 집합 충분성을 재야 하는지, 검색 결과에 어떤 네 필드를 더해야 하는지, 출처를 찾는 RAG와 답하는 RAG를 왜 분리해야 하는지를 인터랙티브 위젯 6종으로 만져 본다. RAG 특집 시리즈 2편.

코어닷투데이56분
같은 모델인데 성적이 10배 차이 — 코딩 에이전트 하니스 해부 (Zoom·UMass 176개 실험 완전 정리)
특집하니스Harness Engineering
2026.09.20

같은 모델인데 성적이 10배 차이 — 코딩 에이전트 하니스 해부 (Zoom·UMass 176개 실험 완전 정리)

Nemotron-3 550B가 32k 창에서 SWE-Bench Verified 6.4%를 받았다. 모델을 한 글자도 바꾸지 않고 하니스의 맥락 관리만 켜자 58.4%가 됐다. 같은 bash 단독 인터페이스가 550B에게는 +3.6pp에 비용 절반, Mistral에게는 −24pp였다. 2026년 9월 17일 공개된 Zoom·UMass·Emory 연구진의 논문은 코딩 하니스를 계획·행동 공간·맥락 관리 세 부품으로 분해해 4개 모델 × 2개 벤치마크 × 176개 설정에서 부품 하나씩의 효과를 쟀다. 결론은 ‘좋은 하니스’가 아니라 ‘모델·예산·과제에 따라 갈리는 하니스’다. ReAct에서 하니스 엔지니어링까지의 역사, 논문의 네 가지 발견, 그것이 Claude Code·Codex의 오늘과 어떻게 맞물리는지를 인터랙티브 위젯 6종과 삽화로 풀었다.

코어닷투데이72분
코딩을 사랑한 사람의 슬픔 — 「Feeling sad about AI」가 건드린 것, 그리고 2026년의 데이터
인사이트AI 코딩개발자 정체성
2026.09.12

코딩을 사랑한 사람의 슬픔 — 「Feeling sad about AI」가 건드린 것, 그리고 2026년의 데이터

2026년 9월 11일, 영국의 한 개발자가 9분짜리 영상을 올렸다. 코드는 한 줄도 나오지 않는 영상이었다. 그는 AI가 슬프다고 말했고, 그 슬픔의 이름을 '무시당함'이라고 붙였다. 해커뉴스 282개, Lobsters 67개의 댓글이 달렸다. 이 특집은 그 글을 끝까지 읽고, 왜 이 감정이 지금 터졌는지를 장인과 탈숙련의 역사에서 찾고, 'AI가 코딩한다'는 문장을 트랜스포머부터 에이전트 하네스까지 분해하고, 2026년의 실측 데이터로 그 문장의 진위를 따진다. 인터랙티브 실험 4종과 논문 원본 그림을 함께 싣는다.

코어닷투데이131분
데이터가 유일한 해자다 — AI 앱 시대, 무엇이 진짜 방어선인가
AI 전략데이터 해자data moat
2026.07.20

데이터가 유일한 해자다 — AI 앱 시대, 무엇이 진짜 방어선인가

"모델은 곧 상품이 된다. 그럼 우리에게 남는 건 뭔가?" 2026년 모든 AI 회사가 마주한 질문에 대한 한 가지 답 — 데이터. 그런데 2019년 a16z는 '데이터 해자는 텅 빈 약속'이라고 못 박았다. 누가 맞는가? 구글의 클릭 로그와 아마존의 추천 엔진에서 시작해, 친칠라 논문이 데이터를 왕좌에 앉힌 순간, 인류의 텍스트가 바닥나는 2026~2032년, 그리고 RLVR이 바꾼 '어떤 데이터가 중요한가'라는 질문까지 추적한다. 핵심은 데이터의 '양'이 아니라 피드백 밀도 — 왜 코딩 에이전트는 이겼고 슬라이드 생성기는 지지부진했는지, 2×2 지도와 계산기로 직접 확인해 본다.

코어닷투데이84분
저커버그의 고백: 'AI가 개발자를 대체한다'는 도박은 왜 빗나갔나 — 코딩 에이전트의 역사와 진짜 실력
AI 에이전트코딩 에이전트에이전틱 코딩
2026.07.04

저커버그의 고백: 'AI가 개발자를 대체한다'는 도박은 왜 빗나갔나 — 코딩 에이전트의 역사와 진짜 실력

2026년 7월 2일, 저커버그는 사내 회의에서 인정했다. '지난 넉 달간 에이전트 개발은 우리 기대만큼 빨라지지 않았다.' 8,000명을 내보내고 1,450억 달러를 태운 도박, 'AI가 프로그래머를 대체한다'는 가정이 흔들린 순간이다. 이 글은 그 도박의 정체인 '코딩 에이전트'가 어디서 왔는지 — HumanEval(2021)·ReAct(2022)·Toolformer(2023, 아이러니하게도 메타의 논문)·SWE-bench·Devin·Claude Code까지 — 논문과 그림으로 쉽게 풀고, SWE-bench 점수가 1.96%에서 90%로 치솟는 마법과 그 함정을 짚는다. 그리고 METR의 '19% 더 느렸다'는 충격 실험, '70%의 벽', 클라르나·메타의 부메랑을 통해 왜 '코드를 쓰는 것'과 '소프트웨어를 만드는 것'이 다른지 끝까지 쉽게 설명한다.

코어닷투데이58분
Codex의 탄생 — HumanEval에서 Computer Use까지 (Codex Use Cases 특집 1)
기술OpenAICodex
2026.05.29

Codex의 탄생 — HumanEval에서 Computer Use까지 (Codex Use Cases 특집 1)

코드 자동완성에서 '내 컴퓨터로 일을 끝내는 에이전트'가 되기까지 — Codex의 5년 역사와 벤치마크, 4-표면 아키텍처, 에이전틱 루프를 비유와 사례로 쉽게 풉니다. Codex Use Cases 특집 1편.

코어닷 AI48분