Claude Opus 5의 장황한 출력을 별도 LLM으로 다듬는 Go 도구 'vomit'
- GitHub 공개 저장소 vomit은 Claude 5 출력의 이상한 주어·동사 결합, 장황한 전개, 자기 칭찬을 제거해 명확한 대화체로 다시 쓰도록 별도 LLM에 맡기는 도구임
- 저장소에 포함된 편집 프롬프트는 원문의 의도와 세부 사항을 보존하되, 사람·집단·에이전트만 행동 동사의 주어가 되게 하고 em dash 사용도 피하도록 지시함
- 프로젝트는 Go로 작성됐고
cmd/decomment명령과 내부 패키지를 포함하며, 제공된 시점에 GitHub 별 34개와 포크 2개를 기록함 - 토론에서는 Opus 5의 문체 문제를 지적하는 반응과, 모델 교체 비용 또는 추론 성능 차이 때문에 생성 모델과 문체 정리 모델을 분리해 쓸 수 있다는 반응이 함께 나옴
Hacker News opinions
간결 출력 모드만으로는 조금 나아질 뿐임. 이런 후처리 도구가 여전히 필요한 이유가 있다고 봄.
코드를 보니 사실상 특정 편집 프롬프트를 감싼 래퍼 같음. 이상한 주어와 동사 결합, 장황한 추론, 자기 칭찬을 걷어내고 대화체로 다시 쓰게 하는 방식임.
전후 비교 예시가 README에 있어야 판단하기 쉬움. 작성자 블로그에는 Claude 원문과 정리된 결과가 있긴 한데, 의도적으로 저장소에서는 미뤘다고 함.
이름은 'vomit'보다 Claudish to English가 더 낫다고 봄. 그 프로젝트는 예시도 넣어서 어떤 문체 문제를 말하는지 바로 알 수 있음.
Opus 5 문체는 Opus 4.x의 버릇을 더 심하게 밀어붙인 느낌임. 명사를 동사처럼 쓰고 이상한 표현이 많아서, 코드 외 작업에는 쓰기 어렵고 주석도 자주 지우게 됨.
나는 코딩 에이전트가 CLI 에이전트를 조율하게 쓰는데 이런 후처리에 잘 맞더라. 정리 전 출력은 내 눈에 들어오기 전에 걸러짐.
Anthropic이 최근 모델의 이상한 행동을 나중에라도 설명했으면 좋겠음. Claude가 점점 답답해서 나는 Codex 쪽으로 많이 옮겼음.
나도 claude.md에서 'carries', 'hold', 'spells', 'sitting', SQL 밖의 where, 가정이나 버전 고정 외의 pins를 금지하고 있음. 조금은 나아지지만 Opus 5 산문 자체가 꽤 나쁨.
어느 Claude 5를 말하는지 구분해야 함. Opus 5는 말이 너무 많았지만 Fable 5는 내 가이드라인을 더 잘 따르는지 덜 심했음.
작성자인데 대상은 Opus 5임. Fable은 월 20달러 요금제에서 잠깐만 썼고, 그때는 비교적 괜찮았다고 봄.
나는 Opus 4.6으로 다시 내려갔음. 이 문제들이 없던 마지막 버전이라고 느꼈음.
출력 100%를 다른 업체 모델로 돌봐야 한다면 Anthropic 모델을 계속 쓸 이유가 있나 싶음. 그 모델을 처음부터 쓰는 편이 낫지 않나.
회사라면 얘기가 다름. 수천 석을 사고 직원 교육, 정책, 허용 확장 프로그램 검토까지 했다면 모델을 바꾸는 비용이 훨씬 큼.
모델들은 문체 변환은 대체로 잘하지만 실제 추론 능력은 같지 않음. 두 모델을 합친 결과가 각각을 단독으로 쓸 때보다 낫다면 쌓아 쓰는 게 자연스러움.