“Я просто хочу искать”: почему поиск стал мусорным и как вернуть точное совпадение
I Just Want to Search

Автор, выросший на Google-fu 2000-х, с ностальгией вспоминает времена, когда поиск был точным и управляемым. Сегодня же, от веб-поиска до Gmail и Facebook Marketplace, алгоритмы заменяют буквальное совпадение «релевантностью», игнорируют кавычки и навязывают рекомендации. На примере поиска запчастей для умершего AV-ресивера он показывает, как трудно найти именно то, что нужно. В итоге он призывает к «режиму точного совпадения» — простому, надёжному grep по своим данным, и выражает готовность платить за такой поиск.
Дайте мне переключатель «только точное совпадение», уберите размытые подсказки, игнорируйте семантические догадки и просто запустите тупой, надёжный grep по моим данным, босс.
- superxpro12
Я уже схожу с ума от поиска в Facebook. Он игнорирует все параметры поиска. Геоограничение? Вот результаты за 500 миль. Длина товара? Нет, вот что-то на 50% короче. Цена? Просто конструкт. Они явно и намеренно поддерживают ленту заполненной, чтобы показать как можно больше рекламы, а не дать точные результаты. Сравните это с Craigslist, который действительно показывает «ноль результатов», если вы слишком строги. Черт, даже сайты AutoTrader теперь идут по пути Facebook. Это бесит.
- syntaxing
Дико, насколько сломанным стал поиск, LLM сделали его хуже, но и до этого он катился вниз. Даже Reddit заставляет войти, чтобы искать внутри сабреддита, и показывает раздражающую накладку «Лучшее место в интернете» после двух минут на сайте. Теперь я использую AnythingLLM с DuckDuckGo и локальной LLM-моделью для поиска.
- gtowey
Я всё больше думаю, что единственное решение — это поисковый индекс с человеческим редакторским контролем. Как бы я ни считал, что Google заслуживает презрения за то, как сильно они испортили поиск в вебе, мы должны помнить, что они борются с SEO и спамом. Похоже, они в основном сдались. Любое автоматическое решение всегда будет гонкой вооружений, где они будут на шаг позади. Единственный способ вырваться вперёд — гарантировать, что весь контент проходит через модерацию людей, прежде чем попасть в индекс — это единственный способ, который я могу придумать, чтобы разорвать эту динамику игры в кошки-мышки. Google, Facebook и другие никогда этого не сделают, потому что это дорого. Их экономия — наши токсичные отходы. Так как же выглядит жизнеспособное решение? Не уверен. Может быть, система с распределёнными волонтёрами-модераторами, как в Википедии. Она не идеальна, но эта модель отлично держалась на протяжении всего своего существования и, кажется, в основном выдерживала всё более изощрённые атаки.
- pooploop64
В поиске Google всё ещё есть функция, где маленький превью-блок выделяет жирным места, где совпадают части вашего запроса, чтобы вы могли видеть, в каком контексте встречается паттерн. Это всегда было очень полезно, но теперь это даёт вам хорошее представление о том, чем Google заменил ваш фактический запрос. С тех пор как я начал обращать на это внимание, я понял, что в большинстве случаев, когда мне нужно добавить кучу исключённых ключевых слов, я на самом деле постепенно выкручиваю руку Google, заставляя его искать то, что я хотел искать. Иногда требуется много исключённых ключевых слов, пока он наконец не исчерпает идеи, чем заменить весь мой запрос.
- Zambyte
Хотя статья больше о специализированном поиске (видео, покупки), для общего веб-поиска нужно упомянуть Kagi. Прошло так много времени с тех пор, как я пользовался другой поисковой системой (годы), что я обычно в шоке, когда вижу, как они выглядят и ведут себя сейчас. Он делает веб-поиск просто работающим, включая такие вещи, как точные фразы в кавычках, логические операторы и т.д., которые упоминаются как в целом гниющие возможности.