Claude Opus 5.5, 출력 토큰 30% 더 빨라지고 기본 effort가 medium으로 바뀌다

Prompting Claude Opus 5.5

Claude Opus 5.5, 출력 토큰 30% 더 빨라지고 기본 effort가 medium으로 바뀌다

Anthropic이 Claude Opus 5.5의 프롬프트 가이드를 공개했다. 출력 토큰 생성 속도가 Claude Opus 5보다 30% 이상 빠르고 같은 작업을 더 적은 토큰으로 끝낸다. 기본 effort가 medium으로 낮아졌지만 코딩과 지식 노동 평가에서 Opus 5의 high를 따라잡거나 능가한다. thinking이 항상 켜져 있어 max_tokens 설정과 effort 조정이 중요해졌다.

Effort level names don't correspond to the same amount of thinking across models: in Anthropic's testing, Claude Opus 5.5 at medium matches or exceeds Claude Opus 5 at high on coding and knowledge-work evaluations, and on several coding evaluations low comes close to it at much lower cost.
  1. skeledrew

    내 눈에 계속 들어오는 건, 사용자에게 thinking 토큰과 출력에서 전체 추론을 위한 프롬프트를 주는 걸 거부하도록 설정해놓은 점뿐이다. 그냥 날 더 멀어지게 만들 뿐이다. 지금 당장 Claude를 완전히 쓰지 않을 생각은 아니지만, 주요 워크로드는 점점 더 중국 제공자 쪽으로 옮기게 될 것이다. 지금 개방성과 자유가 있는 곳은 거기다.

  2. bluegatty

    이건 AI 파운드리의 실패다. 모든 모델마다 완전히 다른 프롬프팅 기법을 써야 한다면, 이건 안 될 거다.

    AI는 유용해질 수 있는 능력이 빠르게 포화되고 있고, 이 제품들은 이제 성숙해지기 시작해야 한다.

    50개의 서로 다른 망가진 MCP와 그 망가진 방식의 다양성을 관리하는 건 '재미'가 아니다.

    처음에는 '재미'였지만, 이제는 그냥 '망가진 기술'일 뿐이다.

    Astra와 Opus 5.5는 견고한 툴링을 기대하는 차세대 AI의 '시작점'이다.

  3. prodigycorp

    Opus 5.5는 좋은 모델이지만, 소셜 미디어에서 Opus의 2D 작업 능력에 대한 극단적인 과대광고를 이해하려고 노력해봤다. Astra가 3D 작업을 했을 때처럼 말이다. 두 릴리스 모두에서 모델은 자산을 생성하기 위해 타사 API에 광범위하게 접근해야 했고, 모델 작업의 상당 부분은 본질적으로 모든 것을 조율하는 것이었다.

    "x가 한 번에 이걸 생성했다, 이건 AGI다" 같은 것들이 너무 많아서, 작년 모델을 다루던 방식 그대로 현대 모델을 바이브 운영할 수 있다는 인상을 준다. 그보다 훨씬 더 많은 게 필요하다. 이는 모델 능력의 도약에 대한 믿음을 요구하는데, 이전 모델에서는 분명 시간 낭비였을 것이다.

    이 얘기를 어디로 끌고 가는지 모르겠지만, 대부분 공감하리라 생각한다. 따라가는 게 지치는 일이라는 걸. 한 살배기에서 사춘기로 1년 만에 넘어간 아이를 키우면서 내년에 대학 갈 계획을 세우는 게 어떤 느낌일지 상상이 안 간다. 이 업계는 너무 빨리 움직여서, 6개월마다 사용자가 "잘못 잡고 있는" 것이 사실이 되어가고 있다.

  4. jryan49

    주말에 방금 테스트해봤는데, 최소한의 프롬프트로 33시간 동안 완전히 무인으로 Claude 세션을 돌렸다. 생성된 것들도 다 좋아 보인다. 미쳤다.

  5. silversmith

    "생물학 안전장치는 Claude Fable 5.1과 동일하다 ... 일상적인 건강 및 교육 질문은 영향을 받지 않는다"

    그런데 여기서는 "왜 훈련 후 종아리가 다른 근육보다 더 아픈가"가 음란한 질문으로 분류되고 있다.

  6. bob1029

    > 넷째, 긴 도구 호출 턴이 원하는 것보다 오래 조용해진다면, 하네스가 업데이트를 요청하게 하라

    이 복잡성을 이해하지 못하겠다. 내가 써본 모든 하네스에서 도구 호출 자체가 진행 상황의 표시로 사용자에게 드러난다. 이 주변의 UI/UX가 잘 설계되면, 사용자는 대략 무슨 일이 일어나는지 추론할 수 있어야 한다. 도구마다 이상적인 표현이 다르다. 모든 것을 평문 덩어리로 축소할 수는 없다.

    턴 내 진행 업데이트가 절대적으로 필요하다면, 턴별로 별도의 트랜스크립트를 축적해서 결정적인 간격으로 더 저렴한 모델에 먹일 것이다.

  7. bronlund

    내가 시도했을 때 가장 먼저 한 일은 프로젝트 훨씬 밖의 디렉터리에 있는 파일들을 돌아다니는 것이었다. 왜 그랬는지 여러 번 설명해달라고 했지만, 설명 비슷한 것조차 못 들었다.

  8. _superposition_

    Anthropic은 새로운 Microsoft다.

    그냥 직감이다. 나는 그들의 제품을 멀리할 것이다. 바라건대 3개월마다 바뀌는 독점적인 헛소리 대신 오픈 표준에 집중함으로써 내 커리어에도 같은 방식으로 도움이 되기를 바란다.

이 날의 다른 글

2026-09-28