Claude Opus 5.5, 출력 토큰 30% 더 빨라지고 기본 effort가 medium으로 바뀌다
Prompting Claude Opus 5.5
Anthropic이 Claude Opus 5.5의 프롬프트 가이드를 공개했다. 출력 토큰 생성 속도가 Claude Opus 5보다 30% 이상 빠르고 같은 작업을 더 적은 토큰으로 끝낸다. 기본 effort가 medium으로 낮아졌지만 코딩과 지식 노동 평가에서 Opus 5의 high를 따라잡거나 능가한다. thinking이 항상 켜져 있어 max_tokens 설정과 effort 조정이 중요해졌다.
Effort level names don't correspond to the same amount of thinking across models: in Anthropic's testing, Claude Opus 5.5 at medium matches or exceeds Claude Opus 5 at high on coding and knowledge-work evaluations, and on several coding evaluations low comes close to it at much lower cost.
HN 토론
210- skeledrew
내 눈에 계속 들어오는 건, 사용자에게 thinking 토큰과 출력에서 전체 추론을 위한 프롬프트를 주는 걸 거부하도록 설정해놓은 점뿐이다. 그냥 날 더 멀어지게 만들 뿐이다. 지금 당장 Claude를 완전히 쓰지 않을 생각은 아니지만, 주요 워크로드는 점점 더 중국 제공자 쪽으로 옮기게 될 것이다. 지금 개방성과 자유가 있는 곳은 거기다.
- bluegatty
이건 AI 파운드리의 실패다. 모든 모델마다 완전히 다른 프롬프팅 기법을 써야 한다면, 이건 안 될 거다.
AI는 유용해질 수 있는 능력이 빠르게 포화되고 있고, 이 제품들은 이제 성숙해지기 시작해야 한다.
50개의 서로 다른 망가진 MCP와 그 망가진 방식의 다양성을 관리하는 건 '재미'가 아니다.
처음에는 '재미'였지만, 이제는 그냥 '망가진 기술'일 뿐이다.
Astra와 Opus 5.5는 견고한 툴링을 기대하는 차세대 AI의 '시작점'이다.
- prodigycorp
Opus 5.5는 좋은 모델이지만, 소셜 미디어에서 Opus의 2D 작업 능력에 대한 극단적인 과대광고를 이해하려고 노력해봤다. Astra가 3D 작업을 했을 때처럼 말이다. 두 릴리스 모두에서 모델은 자산을 생성하기 위해 타사 API에 광범위하게 접근해야 했고, 모델 작업의 상당 부분은 본질적으로 모든 것을 조율하는 것이었다.
"x가 한 번에 이걸 생성했다, 이건 AGI다" 같은 것들이 너무 많아서, 작년 모델을 다루던 방식 그대로 현대 모델을 바이브 운영할 수 있다는 인상을 준다. 그보다 훨씬 더 많은 게 필요하다. 이는 모델 능력의 도약에 대한 믿음을 요구하는데, 이전 모델에서는 분명 시간 낭비였을 것이다.
이 얘기를 어디로 끌고 가는지 모르겠지만, 대부분 공감하리라 생각한다. 따라가는 게 지치는 일이라는 걸. 한 살배기에서 사춘기로 1년 만에 넘어간 아이를 키우면서 내년에 대학 갈 계획을 세우는 게 어떤 느낌일지 상상이 안 간다. 이 업계는 너무 빨리 움직여서, 6개월마다 사용자가 "잘못 잡고 있는" 것이 사실이 되어가고 있다.
- jryan49
주말에 방금 테스트해봤는데, 최소한의 프롬프트로 33시간 동안 완전히 무인으로 Claude 세션을 돌렸다. 생성된 것들도 다 좋아 보인다. 미쳤다.
- silversmith
"생물학 안전장치는 Claude Fable 5.1과 동일하다 ... 일상적인 건강 및 교육 질문은 영향을 받지 않는다"
그런데 여기서는 "왜 훈련 후 종아리가 다른 근육보다 더 아픈가"가 음란한 질문으로 분류되고 있다.
- bob1029
> 넷째, 긴 도구 호출 턴이 원하는 것보다 오래 조용해진다면, 하네스가 업데이트를 요청하게 하라
이 복잡성을 이해하지 못하겠다. 내가 써본 모든 하네스에서 도구 호출 자체가 진행 상황의 표시로 사용자에게 드러난다. 이 주변의 UI/UX가 잘 설계되면, 사용자는 대략 무슨 일이 일어나는지 추론할 수 있어야 한다. 도구마다 이상적인 표현이 다르다. 모든 것을 평문 덩어리로 축소할 수는 없다.
턴 내 진행 업데이트가 절대적으로 필요하다면, 턴별로 별도의 트랜스크립트를 축적해서 결정적인 간격으로 더 저렴한 모델에 먹일 것이다.
- bronlund
내가 시도했을 때 가장 먼저 한 일은 프로젝트 훨씬 밖의 디렉터리에 있는 파일들을 돌아다니는 것이었다. 왜 그랬는지 여러 번 설명해달라고 했지만, 설명 비슷한 것조차 못 들었다.
- _superposition_
Anthropic은 새로운 Microsoft다.
그냥 직감이다. 나는 그들의 제품을 멀리할 것이다. 바라건대 3개월마다 바뀌는 독점적인 헛소리 대신 오픈 표준에 집중함으로써 내 커리어에도 같은 방식으로 도움이 되기를 바란다.