Perplexity AI의 추천 출처 60%가 하위 100만 웹사이트

Three sites made 215,128 "best software" pages for AI. Perplexity cites them

Perplexity AI의 추천 출처 60%가 하위 100만 웹사이트

2026년 9월, 380개 소프트웨어 카테고리에 대해 Perplexity의 두 모델이 생성한 7,534개의 인용 URL을 분석한 결과, 59.8%가 Tranco 상위 100만 밖의 도메인에서 왔고, 23.4%는 상위 100만에도 들지 못한 도메인이었다. 특히 세 개의 사이트(wifitalents.com, worldmetrics.org, gitnux.org)가 215,128개의 'best software' 페이지를 생성해냈으며, 이들은 모두 2023년 12월 이후에 등장했다. 또한 세 번째로 많이 인용된 guideflow.com은 마케팅 블로그로, 96개 카테고리에서 194회 인용되었다. 조사는 Perplexity에만 국한되며, 다른 엔진에는 적용되지 않는다.

이 페이지들은 제목과 설명에서 그들을 읽는 소프트웨어를 겨냥하고 있다.
  1. xpct

    기억이 맞다면, LLM이 인간이 쓴 글보다 LLM이 생성한 글을 선호한다는 논문들이 있었습니다. 저는 Claude에게 어떤 코드 스니펫을 선호하는지 물어봄으로써 이를 일관되게 재현할 수 있습니다: 다른 채팅에서 생성한 코드인지, 아니면 제가 제 필요에 맞게 리팩터링해서 더 유용하다고 생각하는 코드인지요. 항상 자기 자신의 것을 고르더군요 :) 또한 검색을 요청할 때 Claude와 Codex 모두 생성된 웹사이트를 일상적으로 포함시킨다는 것도 경험했습니다. OAI와 Anthropic이 가진 웹 검색 도구가 키워드나 도메인을 제외할 수 없는 등 매우 제한적이라는 점도 도움이 되지 않습니다.

  2. mstaoru

    음, 이것만 문제가 아니라, LLM 출력물로 LLM을 훈련시키는 것에 대한 보호 문제도 있습니다. LLM이 인간의 출력물로 훈련하는 것도 문제입니다.

    저는 한적한 작은 마을로 여행을 가면서, 미리 LLM으로 "조사"를 좀 했습니다. 모든 LLM이 저에게 "XYZ 타운에서 가장 좋은 길거리 음식"을 위해 "Foobar 광장"(이름 변경)에 가라고 열정적으로 말하더군요. 어떤 것은 다채로운 세부 사항도 덧붙였습니다.

    XYZ 타운에는 Foobar 광장이 없었습니다. 세상 어디에도 Foobar 광장은 없었습니다. 인기 없는 서브레딧의 인기 없는 게시물에 달린, 추천 수가 없는 오래된 Reddit 댓글이 하나 있었는데, 거기서 누군가 광장 이름을 분명히 잘못 입력하면서 "길거리 음식은 Foobar 광장으로 가라"고 말했습니다. "최고"라는 말은 전혀 없었습니다.

    이 모든 것이 거짓말입니다.

  3. Aurornis

    저는 12개월 무료 Perplexity 혜택이 곳곳에 있을 때 그중 하나를 사용했습니다. 처음에는 제가 상위 10개 Google 결과를 수동으로 훑고 싶지 않은 간단한 질문에 약간 유용하다고 느꼈습니다. 기억나는 특정 레시피나 도움말 페이지, 사용자 매뉴얼을 찾고 있다면 보통 빨리 찾아주었습니다.

    그런 다음 그들은 결과 품질보다 응답 속도 최적화를 시작했습니다. 질문을 입력하면 1초 만에 결과가 나타나는 것을 볼 수 있지만, 그것들은 쓰레기입니다. 그것이 제공하는 링크와 참조는 종종 바로 옆에 있는 텍스트와 일치하지 않습니다. 누군가 응답을 가능한 한 빨리 만드는 KPI를 가지고 있었고, 무엇보다도 그것을 최적화한 것 같은 느낌입니다.

    그들은 당신을 위해 조사해 주는 "Computer" 옵션을 추가했습니다. 절반은 UI를 통해 그것을 작동시킬 수 없습니다. 제출 버튼을 눌러도 작동하지 않습니다. 작동시킬 수 있을 때도, 대부분의 세션은 잠시 작동하다가 답변이 오기 전에 그냥 멈춥니다.

    제가 계속 사용하는 유일한 이유는 무언가에 대해 시장 선도적 위치를 차지했어야 할, 과대 마케팅되고 과대 포장된 회사를 계속 관찰하기 위해서입니다. Joe Rogan(Perplexity가 광고를 많이 한다고 들었습니다)을 듣는 비전문가들조차 저에게 그것에 대해 묻습니다.

    이제 시험 기간이 끝날 때 경고 없이 요금을 청구하는 사람들에 대한 보고가 있습니다. 그들은 이런 일이 발생하기 전에 경고하겠다고 말했음에도 불구하고요. 고객 지원이 형편없다는 충격적인 스크린샷도 있습니다. [...]

  4. toddmorey

    모델들이 현재 출처에 대한 회의감이 충분하지 않다고 생각합니다.

    결정을 내리는 데 도움이 되도록 두 옵션을 비교하라는 요청을 받았을 때 에이전트 추적을 보면, 조사에서 인용된 비교 페이지 중 상당수는 비교 대상 회사 중 하나가 호스팅하는 경우가 많고, 거의 모두 AI 생성 AEO(Answer Engine Optimization) 전략입니다. 게시된 정보의 동기를 깊이 고려하지 않는 것은 현재 악용될 수 있는 결함이지만, 그 창은 곧 닫힐 것입니다.

    모델 제공업체들이 "신뢰할 수 있는" 제품 정보, 비교, 리뷰를 위해 형편없는 유료 플레이 검증 시스템을 구축할 것이라고 확신합니다.

  5. jpimbert

    이 글 자체가 분명히 Claude 산출물인데, 몇 문장 이상 읽기가 어렵습니다.

  6. alangibson

    Perplexity는 곧 Google이 검색 엔진이기 이전에 안티 스팸 회사라는 것을 배우게 될 것입니다.

  7. rcar1046

    "네임서버 쌍을 공유하는 것은 소유권 증명이 아니라 공통 Cloudflare 계정에 대한 강력한 정황 증거입니다"

    -이 한 문장을 읽으면 기사의 다른 어떤 주장도 믿지 말아야 한다는 것을 알게 됩니다....

  8. throwaway2037

    이것은 천재적입니다. AI/LLM 특이점이 도래했으며, 그것은 자기 꼬리를 먹는 뱀(우로보로스) [1] (또는 자전거를 타는 펠리컨)의 형태를 띠고 있습니다.

    [1] https://www.newsbiscuit.com/post/ouroboros-unclear-if-it-s-e...

이 날의 다른 글

2026-09-02