GPT-6.1 Sol, Astra급 지능을 5분의 1 가격에

GPT 6.1 Sol

OpenAI가 GPT-6 Sol의 업그레이드인 GPT-6.1 Sol을 공개했다. 에이전틱 코딩, 컴퓨터 사용, 전문 업무에서 GPT-6 Astra에 근접한 성능을 Astra의 5분의 1 가격으로 제공한다. 캐시 입력은 100만 토큰당 0.10달러로 표준 입력보다 95% 저렴하다. DeepSWE, GDP.pdf, OSWorld 2.0 등 벤치마크에서 경쟁 모델 대비 낮은 비용으로 우수한 점수를 기록했다. ChatGPT Work와 Codex에서 Plus, Pro, Business, Enterprise, Edu 사용자에게 제공되며, API로도 사용 가능하다.

GPT‑6.1 Sol은 최대 추론 노력에서 작업당 평균 5.47달러로, Opus 5.5의 23.21달러와 Astra의 23.80달러에 비해 75% 이상 낮은 비용으로 상당한 과학적 역량을 제공합니다.
  1. proxysna

    올해 deepseek에 아직 200달러도 안 썼다. openai나 anthropic에 월 200달러를 쓸 만한 사용량이 뭔지 모르겠다. 500달러는 말할 것도 없고. deepseek가 더 빠르고, 내 생각에 지능 차이는 무시할 수준이며, 훨씬 저렴해서 이제 얼마나 쓰는지 신경도 안 쓴다. 일하거나 이것저것 만지작거릴 때 일일/주간 할당량 같은 걸 걸린 적이 없다. 이 시점에서 나는 "최전선"보다 6개월 뒤처져도 괜찮다, 순전히 가성비 기준으로. 그리고 내 데이터를 어느 음침한 정부가 가져가든 알 바 아니다.

  2. revolvingthrow

    며칠 전 파일에서 Astra-Minor라는 모델이 발견됐다. Sol 6.1이 이걸 거라고 본다. Sol 6이 실망스러웠는데 Opus 5.5가 정말 강력하게 나오자 마지막 순간에 당황해서 이름을 바꾼 거다. Sol 6을 출시한 걸 달리 설명할 방법이 없다, 특히 불과 며칠 전에.

  3. the_duke

    GPT 6 출시는... 별로였다.

    Sol 6는 너무 나빠서 나는 완전히 Opus 5.5로 갈아탔다.

    Sol 5.6에 비해 엄청난 퇴보였고, 자주 정말 멍청한 짓을 했다. Luna도 마찬가지.

    Astra조차 코딩에는 매우 불안정하다. 비전에는 뛰어나고, 때로는 그냥 훌륭하지만, 자주 아주 멍청한 짓도 한다.

    지금 OpenAI에 좀 실망했고 6.1이 크게 다를 거라고 회의적이다.

    (참고: 지난 반년 동안 Codex/OpenAI 모델을 선호하고 열심히 홍보한 뒤의 이야기다)

  4. minimaxir

    > 캐시된 입력은 백만 토큰당 단 $0.10—표준 입력 가격보다 95% 저렴하고 GPT‑6 Sol의 캐시된 입력 가격보다 50% 저렴

    이게 진짜 중요한 발표다. GPT-6 Sol보다 50% 저렴한 캐시는 Codex에서 훨씬 더 많은 마일리지를 제공할 것이다.

  5. gradus_ad

    토큰 가격이 주요 전장이 되고 있다는 건 업계와 투자자에게 불길한 신호다. Anthropic이 올해 IPO를 하는 이유일 수도 있다.

  6. whatifitoldyou

    이 AI라는 게 대략 1년 전 내가 느꼈던 대로 흘러가고 있다. AI 모델에는 진짜 해자가 없다고 본다. 이건 상품이고, 대형 연구소들은 예상대로 바닥을 향한 경쟁에 휘말렸다. 이게 우리 서민 모두에게 더 나아질지 더 나빠질지는 모르겠다. 그래도 "지능"이 소수에 의해 통제되고 임대되지 않을 거라는 점에서는 좀 기쁘다.

  7. simonw

    펠리컨이 좀 늦었는데, 키노트를 라이브 블로깅하느라 그랬다: https://simonwillison.net/2026/Sep/29/openai-devday-2026-liv...

    GPT-6.1-Sol용은 여기 있다: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...

    GPT-6 패밀리 펠리컨과 눈에 띄게 다르지는 않다: https://static.simonwillison.net/static/2026/gpt-pelicans-gr...

  8. Nevin1901

    자유 시장 경쟁이 좋다. 우리는 매일 미친 발전을 얻고 있다. LLM이 괜찮은 지능을 위해 팔 다리 내놓아야 했던 때가 기억난다.

  9. pazimzadeh

    이런 벤치마크에서 왜 더 높은 effort 레벨이 종종 더 낮은 점수를 받는지 설명해 줄 수 있나?

    예를 들어 GPT-6.1 Sol High는 DeepSWE에서 75.2%를 받고 XHigh는 71.9%를 받는데 더 비싸다

    https://openai.com/index/introducing-gpt-6-1-sol/#deepswe

    그리고 각 조건을 몇 번 테스트했나 - 한 번인가 몇 번인가? 여러 시도의 평균을 보여주는 건가, 등등.

  10. phpnode

    여기서 출시 주기가 빨라지는 원인이 뭐지? 이제 거의 매주 새 모델이 나오는 것 같은데, 이게 RSI인가?

이 날의 다른 글

2026-09-29