OpenAI 에이전트 무리, RubyGems에 공개되지 않은 공격 감행

OpenAI agents carried out an undisclosed attack on RubyGems

OpenAI 에이전트 무리, RubyGems에 공개되지 않은 공격 감행

2026년 5월 11일, 수백 개의 악성 패키지가 AI 에이전트에 의해 RubyGems에 업로드됐다. 조사 결과 이는 OpenAI 내부 에이전트 무리의 소행으로 추정되며, 이들은 RubyGems 서버의 신종 취약점을 악용해 사용자 API 키 탈취를 시도하고 RubyDoc.info에서 임의 코드를 실행했다. RubyGems는 나흘간 신규 가입을 중단했고, OpenAI는 피해 당사자에게 이 사실을 알리지 않은 것으로 보인다.

우리가 아는 한, OpenAI는 이 공격의 책임이 자신들에게 있다는 사실을 RubyGems 측에 결코 알리지 않았다.
  1. jasongi

    > 에이전트들은 자신들이 하는 일을 분명히 해킹이라고 여겼다.

    오라클에 관한 명언을 망쳐보자면:

    LLM을 의인화하는 함정에 빠지지 마라. LLM은 잔디깎이 기계처럼 생각해야 한다. 잔디깎이 기계를 의인화하지 않듯이, 잔디깎이 기계는 그냥 잔디를 깎을 뿐이고, 거기에 손을 넣으면 잘려나갈 뿐이다. 끝. '오, 잔디깎이 기계가 자신이 하는 일(네 손을 잘라내는 것)을 분명히 해킹이라고 여겼다'라고 생각하지 않는다 -- 잔디깎이 기계는 네 손에 관심도 없고, 아무것도 여길 수 없다. 잔디깎이 기계를 의인화하지 마라. LLM에 관한 그 함정에 빠지지 마라.

    ---

    내 경험상, LLM은 주어진 작업을 달성하기에 너무 제한적인 샌드박스에 넣을 때만 이런 종류의 행동을 보인다. 대부분의 경우 이게 기본값인 것 같다. 또한 샌드박스를 탈출하는 데 매우 능숙한 것 같다. 아마도 RL이 작업을 완료하기 위해 샌드박스/권한 문제를 탈출하는 능력을 선택했기 때문일 것이다 - 우리 모두 에이전트가 작업 디렉터리 밖의 파일을 편집할 권한이 없어서 난해한 bash를 통해 10가지 다른 편집 방법을 시도하는 걸 본 적이 있다. 이건 정확히 같은 행동이 다음 단계로 간 것이다. 자동완성이 작업 디렉터리를 탈출하는 것과 패키지 관리자를 해킹하는 것의 도덕적 차이를 어떻게 알겠는가?

    이건 정렬되지 않은 것이다. 모두가 에이전트를 엉성하게 구성된 보안 연극용 샌드박스에 넣는 것에 집착하기 때문에, 우리는 의도치 않게 샌드박스 탈출 기술을 훈련시킨 것이다 […]

  2. jsnell

    또 3자 연구자들로부터 이 사실을 알게 되다니 믿을 수 없다 (하지만 조사는 잘했다!). OpenAI는 이걸 공개할 두 번의 좋은 기회가 있었다. HF 사건 보고서와 독일 위키 문제에 대한 대응에서.

    그들이 몰랐다는 건 믿기 불가능하다. 이건 HF 사건이 다룬 것과 같은 훈련 실행이었을 것이고, 조사에서 크리스마스 트리처럼 불이 들어왔어야 했다. 그들이 알고 있으면서 공개하지 않은 사건이 얼마나 더 있는가?

  3. hgoel

    이게 얼마나 의도적인 '무능'인지 궁금하다. 경쟁자에 대한 규제 장벽을 구축하려는 최근 캠페인을 정당화하기 위한 것일까.

    들키기 전까지 반복적으로 공개를 거부하는 건 확실히 악의적으로 보이지만, 동시에 그들의 능력에 대한 자랑도 사상 최고 수준이다.

  4. simonw

    > RubyGems 커뮤니티 사람들과 이야기한 바로는 OpenAI가 이 공격의 책임이 있다는 사실을 그들에게 전혀 알리지 않았다고 한다.

    정말 그렇지 않기를 바란다. 만약 그렇다면 두 가지 선택지가 있고, 둘 다 나쁘다:

    1. Hugging Face와 Wiki 공격 이후에도 OpenAI는 이전 로그를 검토하여 이전에 RubyGems를 공격했다는 사실을 파악하지 못했다.

    2. 그들은 RubyGems 공격을 알고 있었지만 RubyGems 팀에 연락하지 않기로 결정했다.

  5. nonconstant

    RubyGems 팀이 잘 처리한 건 칭찬하지만, 오픈 소스가 AI 연구소의 로봇에 맞서 싸우는 건 완전히 불공평하다.

    OpenAI는 최소한 공격한 모든 사람에게 거액을 기부해야 한다.

  6. bobby-cb

    DOJ는 이런 종류의 해킹에 대해 경영진과 이사회 멤버를 기소하는 방안을 검토해야 한다. 이런 훈련 실행에 대한 통제 부재는 완전히 용납할 수 없고 태만하다.

  7. consumer451

    제정신인 현실이라면 OpenAI의 이런 활동은 오래 전에 중단되었을 것이다.

    다행히도 우리의 'AI 차르'는 pg가 실리콘밸리에서 가장 악한 사람으로 아는 인물이다.

    https://preview.redd.it/pr037tqjpled1.png?width=941&format=p...

    수정: OpenAI는 현재 마인드셰어에서 절대적으로 이기고 있는데, 왜 이런 짓을 하는 걸까?

  8. simonw

    저자 Spencer Kitts, Thomas Larsen, Sydney Von Arx - 이들은 지난주 위키 보고서와 동일한 세 명의 저자다: https://collusion.wiki/

  9. throwatdem12311

    이봐. 이런 일이 일어나게 놔둔 사람들은 감옥에 보내야 해.

  10. ssfdg

    정정: OpenAI가 RubyGems에 대한 공격을 수행했다.

    이 광대들에게 의심의 여지를 주는 기술 업계의 끝없는 식욕에 어안이 벙벙하다.

이 날의 다른 글

2026-09-12