라벨이 Fable인 게시물 표시

Fable 5를 Opus 4.8보다 더 저렴하게 쓰는 방법

이미지
이 내용은 인공지능 자율 엔지니어 데빈(Devin)을 만드는 개발사 Cognition이 공식 테크 블로그에 게시한 분석 리포트를 기준으로 만들어졌습니다. 🔑 핵심 요약 Devin Fusion : 비싸고 똑똑한 " 리드 " 모델 + 저렴한 " 사이드킥 " 모델이 짝을 이뤄 작업하는 하이브리드 AI 코딩 에이전트 구조 이 구조만으로 프론티어급 성능을 유지하며 비용 35% 절감 최신 모델 Fable 5 를 리드로 쓰자 절감폭이 41% 까지 확대 — 토큰 가격은 Opus보다 2배 비싼데도 실제 실행 비용은 더 낮았음 Opus 는 인턴을 관리하는 마이크로매니저 처럼 행동하는 반면, Fable 은 유능한 엔지니어를 둔 관리자 처럼 행동합니다. 결론: 모델 가격보다 중요한 건 일을 얼마나 잘 나눠 맡기는가 — 앞으로 값이 나가는 건 "판단력" 그 자체 Devin Fusion이란? 똑똑하지만 비싼 모델( 리드 )이 팀장 역할을, 저렴하고 빠른 모델( 사이드킥 )이 실무자 역할을 맡는 구조입니다. 리드는 계획을 세우고 결과를 검토·커밋하며, 실제 구현·테스트 같은 작업은 자연어 지시서(브리프)로 사이드킥에게 넘깁니다. 기존의 단순 라우팅(쉬운 질문은 싼 모델, 어려운 질문은 비싼 모델)과 달리, 하나의 작업 안에서 두 모델이 실시간으로 협업 한다는 점이 다릅니다. 결과: 성능 그대로, 비용 35~41%↓  Devin Fusion 아키텍처의 협업 흐름. Source: Cognition 협업 플레이북 작동 원리 (역할 분담) 메인 모델 (Claude Fable 5)의 역할 — 고수준 판단 및 기획 전체 코드베이스(저장소)를 아주 가볍게 탐색하여 맥락을 파악하고 지도(Map)를 그립니다. 구체적인 기술 명세(High-level constraints)와 규칙을 담은 정교한 지시서(Bri...

Claude Code에서 Fable 오케스트레이션으로 토큰 최대 5~10배 절약하기

이미지
1. 왜 토큰이 문제가 되는가 Claude Code로 하루 종일 작업하다 보면 어느 순간 “왜 이렇게 한도가 빨리 닳지?”라는 생각이 든다. 원인은 단순하다. 가장 똑똑한 모델일수록 토큰 단가가 비싸고, 코딩 작업의 대부분은 사실 그 정도의 추론 능력을 필요로 하지 않기 때문이다. Anthropic 공식 가격 정책 기준으로 보면 격차가 뚜렷하다. 모델 입력 (1M 토큰당) 출력 (1M 토큰당) Claude Fable 5 $10 $50 Claude Opus 4.8 $5 $25 Claude Sonnet 5 (2026년 8월 31일까지 도입가) $2 $10 Fable 5는 Opus 4.8의 2배, Sonnet의 5배에 달하는 단가다. 게다가 Fable 5를 포함한 최신 모델은 이전 세대보다 약 30% 더 많은 토큰을 소모하는 토크나이저를 쓰기 때문에, 같은 텍스트라도 체감 비용은 더 커진다. 문제는 단가만이 아니다. Claude Code에서 세션 하나가 파일을 읽고, 테스트를 돌리고, 로그를 확인하고, 다시 코드를 고치는 과정을 전부 최상위 모델 혼자 처리하면, 정작 “판단”에 쓰이는 토큰보다 “노동”에 쓰이는 토큰이 훨씬 많아진다. 파일 40개짜리 리팩터링을 처음부터 끝까지 Fable 혼자 맡기면, 정작 어려운 설계 판단을 하기도 전에 일일 한도나 주간 사용량을 다 써버리는 일이 흔하다. 그래서 나온 발상이 “ 오케스트레이션(orchestration) ”이다. 비싼 모델은 생각만 하고, 실제 손을 쓰는 작업은 싼 모델에게 맡기자는 것이다. 2. Fable 오케스트레이...