coredot.today
블로그로 돌아가기

#SLM

5개의 포스트

토큰값이 67% 떨어졌는데, 왜 AI 청구서는 3배가 됐나 — 제번스의 역설과 추론 경제학
특집추론 경제학제번스의 역설
2026.07.30

토큰값이 67% 떨어졌는데, 왜 AI 청구서는 3배가 됐나 — 제번스의 역설과 추론 경제학

2026년, AI 모델의 토큰 단가는 1년 만에 67% 떨어졌다. GPT-4 기준으로는 3년간 99.7%가 빠졌다. 그런데 기업의 73%가 'AI 지출이 예상을 초과했다'고 답했고, 우버는 2026년 AI 예산을 4월에 다 태웠다. 값은 폭락하는데 청구서는 폭발하는 이 역설의 이름은 1865년 경제학자 윌리엄 스탠리 제번스가 석탄에서 발견한 '제번스의 역설'이다. 이 글은 왜 추론이 싸질수록 총지출이 늘어나는지 — 에이전트 한 작업이 챗의 1,000배 토큰을 먹는 배수의 폭발, 효율이 하드웨어 부족을 부르는 악순환의 고리 — 를 데이터로 해부하고, 'best model wins'가 'best fit wins'로 바뀐 시대의 생존 무기인 모델 라우팅과 비용 통제 플레이북까지 실무적으로 정리한다.

코어닷투데이21
교과서가 답이다: 작은 AI가 거대한 AI를 이긴 날
인사이트SLMPhi
2026.03.25

교과서가 답이다: 작은 AI가 거대한 AI를 이긴 날

1.3B 파라미터 모델이 175B GPT-3.5를 이겼다. 비결은 '교과서 품질' 데이터. 'Textbooks Are All You Need' 논문이 열어젖힌 소형 언어 모델 혁명과, 3년이 지난 2026년 지금 그 논문이 어떻게 현실이 되었는지를 추적한다.

코어닷투데이50
2026 AI 트렌드: 더 크게가 아니라 더 똑똑하게
인사이트AI 트렌드에이전트 AI
2026.03.17

2026 AI 트렌드: 더 크게가 아니라 더 똑똑하게

모델은 작아지고, 에이전트는 협업하고, 추론은 현장으로 내려온다. 2026년 AI 산업의 핵심 변화를 관통하는 하나의 키워드 — 실용주의.

코어닷투데이21
엣지 AI 완전 가이드: 클라우드 없이 현장에서 추론하는 시대가 열렸다
기술엣지 AINPU
2026.03.15

엣지 AI 완전 가이드: 클라우드 없이 현장에서 추론하는 시대가 열렸다

2026년, AI 추론의 55%가 클라우드가 아닌 현장에서 일어난다. 왜 엣지에서 돌려야 하는지(지연 1ms vs 200ms, 프라이버시, 비용 87% 절감), 어떤 하드웨어를 쓰는지(Jetson Thor 2,070 TOPS, Snapdragon 100 TOPS NPU), 그리고 실전에서 어떻게 배포하는지를 총정리한다.

코어닷투데이30
SLM 완전 가이드: 작은 AI가 큰 AI를 이기는 시대 — 비용 100분의 1, 성능 80%
기술SLM소형 언어 모델
2026.03.06

SLM 완전 가이드: 작은 AI가 큰 AI를 이기는 시대 — 비용 100분의 1, 성능 80%

프로덕션 AI의 80%는 노트북에서 돌리는 작은 모델로 충분하다. 비용은 100분의 1, 프라이버시는 완벽. DistilBERT에서 Phi-4 Mini까지 — SLM이 LLM을 대체하는 이유와 방법.

코어닷투데이13