别再收律师函,直接 SELECT * FROM internet
Select * from Internet.blogposts
从 2007 年 Tim Berners Lee 的愿景到如今 X 向 Nitter 发送律师函,开放网络正被围墙花园吞噬。API 的关闭、速率限制和付费门槛让开发者无法真正构建服务,因为数据被割裂在各大公司的“档案柜”里。我们需要一种全新的模式,像 atproto 那样,通过个人数据服务器(PDS)和日志复制,让应用能够直接 `SELECT * FROM internet`。这不是简单的数据导出,而是让数据保持可操作状态,实现真正的身份持久化和跨服务互操作。当网络不再依赖单一公司的季度优先级,我们才能重建一个自由、开放且可索引的社交网络。
我们需要的不是对数据的窥视,而是整个数据集;我们需要它是实时的、可索引的,并且这种访问权不能被任何一家公司的季度优先级随意撤销。
HN 评论区
55- 8organicbits
对于博客文章,我会更推荐 RSS。那是这类内容传统发布的渠道。与其从 Bluesky 的索引里 SELECT 数据,不如使用 OPML 订阅列表。有很多地方都在整理 Feed 列表,因此遭遇像 Twitter 那样 API 突然停摆的风险要小得多。
有多个网站支持基于 RSS 的“关注”语义。Feedland 公开追踪订阅关系,你可以看到我读哪些博客(https://feedland.com/?username=robalexdev),以及谁在关注我的博客(https://feedland.com/?feedurl=https%3A%2F%2Falexsci.com%2Fbl...)。
我还运行了一个变体,通过爬虫收集 OPML 博客链接列表,这样你就能发现还有哪些人喜欢你喜欢的博客,以及他们推荐了什么。这是 Simon Willison 博客的页面(https://blogroll-network.alexsci.com/discover/feed-a34ee2a88...)。把 RSS 和博客链接看作一种网络,感觉比 Bluesky 的 Jetstream API 端点要稳健得多。
- arjie
起初,我认为想要这种对等网络的人只占很小一部分。我以为几乎所有人都希望对用户代理(user agents)施加广泛限制,并控制数据如何向用户展示。但 Bluesky 实际上并没有限制 AI 抓取和消费数据。无论你是浏览器还是无头代理,你只是另一个消费者,同样受到速率限制等规则的约束。我必须说,考虑到社区普遍比大多数地方更反 AI,Bluesky 能接受这种做法让我有些(惊喜地)意外。允许你消费 Feed 这一点简直太棒了。好东西!
- cube00
> 很简单:网络赢了。开发者不再被视为资产,API 也随之逐步关闭。
你也可以把 Reddit 加到这个名单里,IPO 在即,不如把我们曾鼓励开发者构建的第三方应用都定价出售。
- lightandlight
> 网络就是几十家公司,每家都守着一个个档案柜,门口还站着接待员。他一次只给你读一份文件,而且只能读你叫得出名字的文件,速度全看他心情,时间全看老板允不允许。
幸运的是,事实并非如此。社交媒体确实由几个巨大的围墙花园组成,但网络本身依然是开放的。去吧,建个网站!
- madrox
在我这一辈子,去中心化的尝试实在太多太多了。我曾经是坚定的信徒,也致力于解决这些问题,但不得不承认,我现在有些疲惫了。技术从来不是问题。问题永远是质量、投入和成本。
如果去中心化真的要赢,它必须开箱即用,解释起来不需要画网络拓扑图,基本上能在你的笔记本电脑上免费运行,而且必须包含人们真正想看的内容,而不仅仅是一群讲世界语(Lojban)的人。[1]
虽然我不确定 X 在法律上有多少立足之地,但我理解他们为什么宁愿 Nitter 不存在。Twitter 曾(在我看来是英勇地)试图保持开放。最终导致 API 封锁的,是停止财务失血的需求。广告是不可避免的,而通过 API 访问却没有任何可靠的方式来实现广告变现。
Twitter 解决了这三个问题,而几乎没人会花那么多时间去谈论或关心实现这些所用的技术,就像那些谈论去中心化的人一样。年轻时的我也包括在内。现在他们只是在捍卫自己的护城河。