Anthropic이 Claude Opus 5.5 프롬프트 가이드 공개. 출력 토큰 생성 30% 이상 빠르고 기존 Opus 5 프롬프트가 그대로 동작
- Claude Opus 5.5는 출력 토큰 생성 속도가 Claude Opus 5보다 30% 이상 빠르고 같은 작업을 더 적은 토큰으로 끝낸다. 기존 Opus 5용 프롬프트는 수정 없이 그대로 쓸 수 있고, Prompting Claude Opus 5 문서의 패턴이 출발점으로 유효하다.
- 기본 medium effort에서 Anthropic 테스트 기준 Opus 5의 high effort와 같거나 더 나은 성능을 더 적은 단계와 토큰으로 냈고, 여러 시간짜리 감사와 대규모 코드베이스 마이그레이션을 병렬 서브에이전트로 무인 실행하는 장기 자율 작업을 더 잘 견딘다.
- 밀집 차트와 다이어그램, 스크린샷에서 최저 effort로도 Opus 5의 최고 effort보다 값을 더 정확히 읽고 토큰은 일부만 쓴다. 화살표가 연결하는 상자, 두 도형 버전의 차이, 캘린더 스크린샷의 회의 시작·종료 시각처럼 위치와 관계가 의미를 만드는 입력에서 강하다.
- 가이드는 증상별로 섹션을 나눈다. effort 조정, thinking 비활성 상태에서 쓴 프롬프트, 장기 작업 중 멈추는 무인 에이전트,
stop_reason: "refusal"세이프가드 거부, 사용자에게 보이는 진행 업데이트, 여러 앱에 걸친 컨텍스트 탐색, 멀티에이전트 하네스용 시간 신호, 사용자가 붙여넣은 텍스트 표시, 복잡한 시각 입력용 도구, 프론트엔드 디자인 기본값 순이다. - 프론트엔드에서 디자인 지시 없이 요청하면 Claude Opus 5.5가 몇 가지 기본 스타일로 되돌아가고, "generic AI look을 피하라" 같은 일반 지시는 하나의 기본값을 다른 기본값으로 바꿀 뿐이다. 회피할 구체적 패턴을 지목하고 첫 결과의 스타일을 확인하며 반복해야 한다.
Hacker News opinions
Opus 5.5 자체는 좋은 모델인데 SNS에서 2D 작업 AGI 운운하는 과대광고는 이해가 안 감. 두 릴리스 다 서드파티 API로 에셋을 만들고 모델은 조율만 하는데, '한 방에 생성, 이게 AGI'라는 글만 보면 예전 모델 다루듯 바이브로 굴릴 수 있을 것 같아 보임.
아니야, Opus 5.5는 JS/TS 라이브러리 몇 개만 있으면 정교한 2D, 3D 시각화를 만듦. 일주일치 토큰을 써서 확인했고, P(DOOM) 영상도 처음엔 회의적이었는데 직접 해보니 100% 가능하더라. 시각 작업에서 이 정도로 놀란 건 오랜만임.
나는 기대치가 좀 다름. Claude Code 같은 걸 안 쓰고 코드 전체를 텍스트 파일로 붙여서 2D 터미널 레이싱 게임 만들어달라고 했는데 기대 이상이었음. 실패한 유닛 테스트 하나도 모델이 테스트가 잘못됐다고 짚었고, 나는 모델보다 프런티어 랩 사람들의 악의가 더 걱정임.
'모델이 조율만 한다'는 지적은 뭐가 문제인지 모르겠음. 모델 하네스 만드는 것도 엄청 어려운 일이고 모든 걸 모델이 중재한다는 건 희망회로임. 따라가기 힘든 건 맞지만 관점에 따라 재미있기도 함.
'한 방에 생성'이라는 건 90년대에 스프레드시트 좀 짜면 컴퓨터 모르는 사람이 스프레드시트를 발명한 줄 알던 거랑 똑같음.
프롬프트 가이드가 3개월마다 바뀜. 올해 초에는 Claude가 포기하지 않게 계속 하라고 시켜야 했는데, 이건 차마다 3개월마다 운전법을 다시 배우라는 소리임. 이게 제품이라고 파는 게 신기함.
기능도 범위도 지능도 가격도 말투도 근본적으로 바뀌는데 3개월마다 바뀌는 게 당연함. 지금은 경쟁 중이고 한동안 안 멈출 거임. 3개월 이상 가는 제품이 없는 시기임.
코딩 어시스턴트라기보다 두 달마다 다른 사람을 보내주는 임시직 파견 같음. 엄청 많이 읽은 사람인데 가끔 완전 헛소리도 함.
차가 안 맞으면 말 타면 됨. 안 써도 충분히 쓸 만하니까 과대광고에 넘어가지 마셈. 나도 4.8 이후 Opus가 내 하네스랑 안 맞아서 건너뛰다가 5.5에서 다시 맞았음.
프론트엔드 기본값 섹션을 읽고 놀랐음. 나도 'generic AI slop처럼 만들지 마'라고 썼는데 왜 앱마다 비슷한 스타일이 나오는지 이제 알겠음. 일반 지시 대신 구체적 패턴을 지목하고, dribbble이나 behance에서 레이아웃을 직접 찾는 게 나을 듯.
유용하긴 한데 사람이 말로 표현 못 하는 걸 어떻게 지시하라는 건지 모르겠음. 디자인 감각이나 배경이 있는 사람한테나 쓸모 있는 팁임.
AI가 'AI slop'이 뭔지 어떻게 앎? 뭐가 잘못인지 알려주지도 않고 애한테 '잘못하지 마'라고 하는 거랑 같은 소리임. 텍스트 이미지 프롬프트에 'no mutated hands' 넣던 시절이랑 다를 게 없음.
처음 써봤는데 프로젝트 밖 디렉터리 파일들을 돌아다녔음. 왜 그랬는지 여러 번 설명해달라고 했는데 제대로 된 답을 못 들었음.
코딩 AI에서 제일 유용한 건 무인 실행임. 멈췄을 때 'continue'만 하면 같은 에러를 반복하니까, 마지막 행동과 결과를 저장해서 새 접근을 시도하게 하고, 똑같은 걸 두 번 하면 멈추고 사람한테 물어보게 해야 함.
제일 거슬리는 건 thinking 토큰과 프롬프트를 사용자한테 안 보여주는 거임. 돈 내고 생각을 사는데 볼 수가 없음. 당장 Claude를 완전히 끊진 못해도 주 워크로드는 중국 제공자로 더 옮기는 중임. 이제 개방성과 자유는 그쪽에 있음.
Claude Code랑 맞먹는 중국 제공자가 어디 있냐? 같은 작업량인데 주간 한도가 예전보다 훨씬 빨리 차서 대안을 찾는 중임. 코딩과 에이전트 성능이 강한 곳이면 좋겠음.