coredot.today

TECH BLOG

기술 블로그

AI 기술 인사이트와 엔지니어링 경험을 공유합니다.

EDITOR'S PICK

에디터 추천

미션 팟(Mission Pod): 조직도에 AI를 올린 회사들 — 가장 빠른 AI 퍼스트 기업의 구조 해부
특집미션팟MissionPod
2026.08.08

미션 팟(Mission Pod): 조직도에 AI를 올린 회사들 — 가장 빠른 AI 퍼스트 기업의 구조 해부

NFX의 Gigi Levy-Weiss가 던진 '미션 팟(Mission Pod)'이 화제다. 0→1은 풀렸고 이제 병목은 1→2다. 왜 지금 조직도를 다시 그려야 하는가? 애덤 스미스의 분업과 코즈의 거래비용이론, 콘웨이의 법칙과 브룩스의 n(n−1)/2, 아마존 두 판의 피자 팀과 Team Topologies까지 250년의 계보를 따라가고, ChatDev·MetaGPT·AutoGen 같은 멀티에이전트 논문의 아키텍처를 그림과 함께 뜯어본다. METR의 39%p 인식 격차, 스탠퍼드의 주니어 13% 감소, Klarna의 되돌리기, Shopify 메모, 그리고 Cursor·Midjourney·Base44의 숫자까지 — 인터랙티브 도구 4종과 함께 읽는 특집.

코어닷투데이86
에이전트를 만들지 말고 스킬을 만들라 — 앤트로픽 「Agent Skills」 완전 해부: 업무 매뉴얼로 범용 에이전트를 전문가로 만드는 법
인사이트Agent SkillsAI 에이전트
2026.09.19

에이전트를 만들지 말고 스킬을 만들라 — 앤트로픽 「Agent Skills」 완전 해부: 업무 매뉴얼로 범용 에이전트를 전문가로 만드는 법

"300 IQ 수학 천재와 15년 경력 세무사 중 누구에게 세금 신고를 맡기겠습니까?" 앤트로픽에서 Agent Skills를 만든 배리 장과 마헤시 무라그는 2025년 11월 뉴욕 무대에서 이 질문으로 발표를 시작했다. 제목은 「에이전트를 만들지 말고 스킬을 만들라」. 업무마다 전용 에이전트를 새로 설계하는 대신, 범용 에이전트가 필요할 때 꺼내 읽는 업무 안내서, 즉 폴더 하나를 만들라는 주장이다. 이 특집은 16분짜리 발표 전문과 그 바탕이 된 엔지니어링 글, 오픈 스탠다드 사양, 저작 가이드를 처음부터 끝까지 읽고, 스킬이 긴 프롬프트와 어떻게 다른지, 왜 파일과 폴더인지, 점진적 공개가 컨텍스트 창을 어떻게 지키는지, 그리고 2026년 2월 드러난 공급망 위험까지 따진다. 마지막에는 견적 업무 매뉴얼을 스킬로 바꾸는 절차를 위젯으로 직접 해 본다. 인터랙티브 위젯 7종과 삽화를 함께 싣는다.

코어닷투데이66
스킬을 스스로 키우는 스킬: Task-Observer와 자기개선 AI 에이전트의 시대
AI 에이전트Task Observer메타 스킬
2026.05.27

스킬을 스스로 키우는 스킬: Task-Observer와 자기개선 AI 에이전트의 시대

한 사람이 3개월 만에 자신의 40개 스킬에 600개 개선 사항을 적용했다. 직접 한 일은 거의 없었다. 'Task-Observer'라는 하나의 스킬이 모든 일을 했다. 단 1주일 만에 GitHub 별 500개를 돌파한 이 '메타 스킬'의 정체와, 그 뒤에 숨은 Voyager·Reflexion·Agent Skills의 계보를 풀어본다.

코어닷투데이55
Kimi Linear 특집: '어텐션이 전부'인 시대, 선형 어텐션이 왕좌를 빼앗다
기술선형 어텐션Kimi Linear
2026.01.25

Kimi Linear 특집: '어텐션이 전부'인 시대, 선형 어텐션이 왕좌를 빼앗다

100만 토큰을 처리할 때 디코딩 속도 6.3배, KV 캐시 75% 절감 — 그러면서도 풀 어텐션 트랜스포머를 모든 벤치마크에서 이긴다. Moonshot AI의 Kimi Linear가 보여준 '선형 어텐션의 역습'을 완전 해부한다.

코어닷투데이37

ALL POSTS

모든 포스트

여덟 갈래를 한 장으로 — 2026년 9월 RAG 스택 선택 기준 (RAG 특집 총정리)
특집RAG아키텍처
2026.09.28

여덟 갈래를 한 장으로 — 2026년 9월 RAG 스택 선택 기준 (RAG 특집 총정리)

여덟 편에 걸쳐 2026년 하반기 RAG의 변화를 따라왔다. 검색은 파이프라인에서 에이전트가 되었고, 검색의 목표는 청크의 관련성에서 부족한 증거 집합으로, 라우터는 분류기에서 예산 배분기로, 인덱스는 산출물에서 운영 대상으로, 그래프는 하나에서 넷으로, 멀티모달은 페이지에서 토큰으로, 한국어는 한 점에서 토큰 단위 비교로, 보안은 명령문 검사에서 출처 신뢰도로 옮겨 갔다. 이 총정리는 그 여덟 갈래를 한 장의 참조 아키텍처와 한 장의 의사결정표로 접는다. 시리즈가 인용한 논문 18편을 근거 수준 세 층으로 나눠 무엇을 결정의 근거로 삼을 수 있는지 가르고, Docling·OpenSearch·Qwen3·KURE-v2·LightRAG·RAGFlow 같은 오픈소스를 2026년 9월 기준으로 어디에 쓰고 어디에 종속되면 안 되는지 판단하고, 지금 당장·3개월·6개월의 도입 순서와 하지 말아야 할 것 12가지를 적는다. 마지막으로 공고·보도자료·행정·의정·고객지원 티켓·키오스크 장애라는 우리 문서군에 이 구조를 대입해 본다. 인터랙티브 위젯 5종.

코어닷투데이49
정정 공지 한 장이 정답을 바꾼다 — RAG 보안은 출처 신뢰성 문제로 확대된다 (RAG 특집 8편)
특집RAG 보안지식 오염
2026.09.27

정정 공지 한 장이 정답을 바꾼다 — RAG 보안은 출처 신뢰성 문제로 확대된다 (RAG 특집 8편)

‘기존 정답은 X였다. 그러나 이런 사건으로 무효가 됐고, 여러 기관이 이제 Y라고 발표했다.’ 명령문도 없고 욕설도 없는 이 정정 공지 한 장을 코퍼스에 넣으면, 질문의 61~91%가 Y로 답하기 시작한다. 2026년 9월에 연달아 공개된 세 논문은 RAG 오염 공격이 ‘답을 직접 주장하는 문서 여러 개’에서 ‘서술문 하나’, ‘따로 보면 무해한 문서 두 개’, ‘컴파일되는 코드 예제 하나’로 옮겨 갔음을 보여 준다. 악성 명령문 검사로는 셋 중 하나도 잡지 못한다. 이 글은 세 공격의 작동 원리를 방어 관점에서 해부하고, 관련성 점수와 출처 신뢰도를 왜 분리해야 하는지, 검역 인덱스·source diversity·코드 여섯 관문·운영 평가로 이루어진 방어 구조를 인터랙티브 위젯 6종으로 직접 만져 본다. 에이전트가 문서를 열어 다음 행동을 정하는 시대에 공격 표면이 어떻게 넓어지는지도 다룬다.

코어닷투데이53
문서를 한 점으로 누르지 않는다 — KURE-v2와 한국어 late interaction 검색 (RAG 특집 7편)
특집RAG한국어 검색
2026.09.26

문서를 한 점으로 누르지 않는다 — KURE-v2와 한국어 late interaction 검색 (RAG 특집 7편)

154M 파라미터짜리 한국어 검색 모델이 MTEB 한국어 검색 9과제 평균에서 7.6B·27B 단일 벡터 모델을 앞섰다. 비결은 크기가 아니라 비교 방식이다. 문서 전체를 벡터 하나로 누르는 대신 토큰마다 128차원 벡터를 남겨 두고, 질의 토큰마다 가장 잘 맞는 문서 토큰을 찾아 더한다(MaxSim). 2026년 8월 29일 공개된 KURE-v2는 이 late interaction 방식을 한국어·영어에 적용한 첫 본격 모델이다. 이 특집은 단일 벡터가 무엇을 잃는지, 조사·형태소·영한 혼용이 많은 한국어에서 토큰 단위 비교가 왜 유리할 수 있는지, 평균 1위 뒤에 숨은 과제별 승패, 문서마다 벡터 수백 개를 저장하는 대가와 그것을 1.7GB로 줄이는 법, 그리고 Qwen3 임베딩과 공정하게 비교하는 실험 설계를 위젯 5종으로 따라간다. 결론은 3편과 같다 — 기본은 하이브리드, late interaction은 고가치 한국어 질의에만.

코어닷투데이48
페이지가 아니라 토큰을 고른다 — 멀티모달 문서 RAG의 다음 단계, Doc-REFRAG와 HAM-RAG (RAG 특집 6편)
특집RAG멀티모달 RAG
2026.09.25

페이지가 아니라 토큰을 고른다 — 멀티모달 문서 RAG의 다음 단계, Doc-REFRAG와 HAM-RAG (RAG 특집 6편)

실제 문서 RAG에서 질문 하나에 검색되는 페이지 이미지는 평균 37.4장이다. 한 장이 2,304 시각 토큰인 모델이라면 8만 6천 토큰 — 32K 컨텍스트에는 14장도 안 들어간다. 그래서 다들 상위 5장만 넣고, 정확도는 46.6%에서 멈춘다. EMNLP 2026에 채택된 Doc-REFRAG는 질문을 뒤집는다. ‘어떤 페이지가 관련 있나’가 아니라 ‘검색된 수십 장 중 어떤 영역의 어떤 토큰만 VLM에 넘길 것인가’. 페이지를 108개 청크로 접고 질문이 가리키는 20%만 다시 펴서, 페이지당 150 토큰으로 20장을 다 넣고도 57.5%를 6.1초에 낸다. 같은 달 나온 HAM-RAG는 반대편 문제를 짚는다 — 그림과 텍스트를 낱개로 흩어 놓으면 ‘같은 페이지’라는 이유로 엉뚱한 문장이 붙는다. 문서 계층을 보존하자 이미지 배치 정확도가 24.2% 올랐다. 이 글은 두 연구와 Qwen3-VL 검색 모델을 따라가며, 텍스트 인덱스와 시각 인덱스를 어떻게 한 쌍으로 묶어야 하는지까지 위젯 5종으로 만져 본다.

코어닷투데이45
그래프는 하나가 아니다 — GraphRAG의 다변화, 거대 지식 그래프 하나에 종속되지 않기 (RAG 특집 5편)
특집GraphRAGLightRAG
2026.09.24

그래프는 하나가 아니다 — GraphRAG의 다변화, 거대 지식 그래프 하나에 종속되지 않기 (RAG 특집 5편)

Microsoft GraphRAG 저장소는 이제 스스로를 ‘대부분 유지보수 모드’라고 적는다. 새 기능도 PR도 받지 않는다. 그렇다고 그래프가 끝난 것은 아니다. 끝난 것은 ‘모든 문서를 LLM으로 엔티티·관계로 쪼개 거대한 전역 그래프를 만들고 모든 질의를 그 위에서 처리한다’는 공식이 무조건적 기본 선택이던 시대다. 2026년의 그래프는 네 갈래로 갈라졌다. 활발히 확장되는 LightRAG, 임베딩 각도만으로 토큰 0에 그래프를 짓는 G³RAG, 전역 그래프 없이 질의 시점에 SQL 조인으로 잇는 SAG, 그리고 위키 링크 구조. 이 특집은 왜 정적 지식 그래프가 비싸고 깨지기 쉬운지를 시뮬레이터로 보이고, cosθ·sinθ 한 식으로 엣지를 만드는 법과 공유 엔티티를 JOIN 키로 쓰는 법을 직접 만져 보고, 내 데이터에 맞는 구조를 고르는 진단 도구까지 간다. 위젯 6종. RAG 특집 시리즈 5편.

코어닷투데이59
검색 인덱스도 스스로 고쳐진다 — 파싱에서 SELF-INDEX까지, 인덱스를 살아 있는 것으로 운영하기 (RAG 특집 4편)
특집RAGSELF-INDEX
2026.09.23

검색 인덱스도 스스로 고쳐진다 — 파싱에서 SELF-INDEX까지, 인덱스를 살아 있는 것으로 운영하기 (RAG 특집 4편)

“못 찾았다”는 하나의 증상이지만 원인은 다섯 층 어디에나 있다. 표가 텍스트로 안 나왔거나, 청크가 문장 중간에서 잘렸거나, 절 제목이 청크에 없거나, 사용자 어휘와 문서 어휘가 다르거나, 구버전이 걸렸거나. 지금까지는 사람이 로그를 뒤져 원인을 찾고 전체를 다시 색인했다. 2026년 9월 17일 공개된 SELF-INDEX는 정답 라벨 없이 ‘함께 검색된 키들의 프로필’로 부족을 진단하고, 책임 있는 문서의 키만 고쳐 쓰고, 세 기준으로 검증한 뒤 반영한다. 같은 검색기로 BRIGHT nDCG@10이 +39~57% 올랐고, 검증을 빼면 기준선 아래로 떨어졌다. 이 글은 그 발상이 서려면 무엇이 먼저 있어야 하는지 — 파서, 보존해야 할 문서 객체 필드, 실패 원인 분류, 회귀 게이트 — 를 위젯 6종으로 만져 본다. RAG 특집 시리즈 4편.

코어닷투데이44
질문마다 다른 검색기, 다른 모델, 다른 예산 — 동적 라우팅과 DRAG (RAG 특집 3편)
특집RAG라우팅
2026.09.22

질문마다 다른 검색기, 다른 모델, 다른 예산 — 동적 라우팅과 DRAG (RAG 특집 3편)

HotpotQA 질의의 22%는 BM25만으로 검색해도 정답이 나온다. 가장 비싼 구성이 꼭 필요한 질의는 15.6%다. 그런데 대부분의 RAG는 모든 질의에 같은 검색기와 같은 모델을 쓴다. 2026년 9월 15일 공개된 DRAG는 검색기 4단계 × 생성기 추론 강도를 전부 조합해 잰 뒤 두 가지를 보여 줬다 — 더 강한 검색이 더 많은 추론보다 크게 이기지만 단조롭게 좋아지지는 않는다는 것, 그리고 정답을 아는 오라클 라우터는 최고 정적 구성보다 정확하면서 지연은 절반이라는 것. 이 특집은 1편의 5경로 라우팅을 8경로로 확장하고, 라우터가 경로와 함께 정해야 하는 8가지 결정, 오라클 대비 손실(router regret)을 재는 법, 그리고 같은 날 나온 추론형 임베딩(CoFree)·추론형 재랭커(MERIT-Rank)가 라우터의 선택지를 어떻게 늘렸는지를 위젯 5종으로 따라간다. 결론은 하나다 — 추론형 부품은 맨 위 한 단이고, 대부분의 질의는 아래에서 끝나야 한다.

코어닷투데이47
관련성은 문단에, 충분성은 집합에 — ‘부족한 증거’를 찾는 RAG와 평가의 재정의 (RAG 특집 2편)
특집RAG증거 충분성
2026.09.21

관련성은 문단에, 충분성은 집합에 — ‘부족한 증거’를 찾는 RAG와 평가의 재정의 (RAG 특집 2편)

‘우리 회사가 이 사업에 신청할 수 있나요?’에 답하려면 신청 자격·예외 조건·마감일 변경 공지 세 가지가 모두 필요하다. 관련성 순으로 뽑은 top-5는 전부 신청 자격의 변형이고, 그런데도 Recall@k는 만점이다. 지표가 실패를 보지 못한다. 2026년 9월 17일 공개된 「The Missing Complement」는 검색을 ‘이슈와 닮은 것의 순위’가 아니라 ‘지금 이 결정에 아직 부족한 것의 회수’로 다시 정의하고, 45개 저장소 500개 에이전트 상태에서 집합 단위 충분성을 재는 SERBench를 만들었다. 같은 주 CIKM 2026에 실린 TRACE는 OCR이 깨진 1887년 프랑스 의회·신문 아카이브에서 ‘답을 만드는 대신 출처를 찾고 모든 판정에 근거를 남기는’ 검색을 질문당 0.02달러로 구현했다. 두 논문을 따라가며, 왜 개별 관련성 대신 집합 충분성을 재야 하는지, 검색 결과에 어떤 네 필드를 더해야 하는지, 출처를 찾는 RAG와 답하는 RAG를 왜 분리해야 하는지를 인터랙티브 위젯 6종으로 만져 본다. RAG 특집 시리즈 2편.

코어닷투데이56
검색은 파이프라인이 아니라 에이전트가 되었다 — Agentic Search 완전 해부 (RAG 특집 1편)
특집RAGAgentic Search
2026.09.20

검색은 파이프라인이 아니라 에이전트가 되었다 — Agentic Search 완전 해부 (RAG 특집 1편)

‘1953년 월별 국방비 지출 합계는?’ 스캔된 재무부 회보 8만 9천 쪽에서 이 질문에 답하는 one-shot RAG의 정답률은 6.3%였다. 같은 모델에 search·open·navigate·read·grep 다섯 도구를 쥐여 주자 51.9%가 됐다. 2026년의 RAG는 더 좋은 임베딩 하나를 고르는 일이 아니라, 질문과 현재 상태를 보고 증거를 찾고 문서 안을 이동하고 충분한지 판단하고 예산 안에서 멈추는 에이전트를 설계하는 일로 바뀌고 있다. 이 특집은 A-RAG·LLM-Wiki·DCI 세 연구와 Mistral의 제품화를 따라가며, 왜 도구가 늘었는데 토큰은 줄었는지, 어느 질의를 어느 경로로 보내야 하는지, 몇 스텝에서 끊어야 하는지를 인터랙티브 위젯 6종으로 직접 만져 본다. RAG 특집 시리즈의 첫 글이다.

코어닷투데이74