저가 모델이 대부분 실행하고 프런티어 모델은 설계·검토에만 쓰는 개인 AI 코딩 하니스
Hacker News 의견들
나도 Fable 하나에만 의존하다가 매주 사용량 한도에 걸림. 8월 말 Anthropic의 50% 사용량 증가가 끝나면 단일 모델, 단일 공급자 워크플로는 못 버틸 듯함.
난 지금 GPT-5.6 Luna로 전부 처리함. 어디로 가는지만 알고 있으면 세세하게 이끌어야 하지만, 필요한 작업에는 충분히 잘 돌아감.
멀티모델 워크플로 만지는 게 꽤 재밌더라. 나는 paseo로 전부 오케스트레이션 중임.
모든 작업에 Fable을 쓰는 건 납득 안 감. 모델 라우팅을 써야 함.
Sol도 사실상 비슷한 수준인데 사용량 조건이 더 나음. Fable에 묶인 상태가 아니라서 바로 바꿔도 품질 차이는 거의 못 느낄 거임.
난 스코핑 브리프를 먼저 만들고 그다음 계획을 세움. 그래도 이 글의 논지에는 동의함.
이 글은 단순한 멀티에이전트 시스템을 설명하는 정도라 약간 순진해 보이긴 함. 그래도 프런티어 모델이 DAG를 넘기고 저렴한 모델이 실행하게 하는 방식은 최고 성능보다 비용 절감에는 말이 됨.
일반 워크플로에서 검증기 없는 DAG는 시간 낭비임. 사람이 검증할 거면 예전처럼 머릿속에 DAG를 두는 편이 더 나음. 반대로 검증 가능한 하위 작업으로 분해되는 특정 업무라면 자동화 비용이 매우 싸져서 투자할 가치가 있음.