LinkedIn 获法院禁令,阻止大规模数据爬取
LinkedIn wins court order blocking mass scraping of user data

加州联邦法官正式批准了 LinkedIn 与 ProAPIs 及 Netswift 达成的和解协议,要求这两家公司立即停止大规模爬取用户数据,并禁止其出售或转让相关数据。协议还规定,涉事方必须停止使用虚假账户访问 LinkedIn,并彻底删除已爬取的数据。LinkedIn 诉讼负责人 Sarah Wight 表示,这是保护用户隐私的重要胜利。此前,LinkedIn 指控这些公司创建了数百万个虚假账户,持续抓取会员、公司及学校信息,甚至包括用户的互动内容。尽管 LinkedIn 会迅速封禁这些账户,但对方仍能利用短暂窗口期抓取大量资料。此次胜利标志着 LinkedIn 在打击数据滥用方面的又一关键进展。
你的个人资料属于你自己,你在 LinkedIn 上选择分享的内容,是为你正在构建的专业社区服务的,而不是让外部公司未经同意就爬取并用于你从未同意的用途。
HN 评论区
33- unified101
这并没有开创先例……只是某个特定用例被阻止了。总体而言,根据之前的判决,网络爬虫依然是合法且可行的。
- at1as
广泛开放的互联网恐怕时日无多了。如果你用虚假账号进行爬取,那显然违反了你所同意的服务条款(ToS);而对于公开页面,法院会如何裁决则没那么明确。
随着公司越来越将数据的可防御性和价值视为核心,它们的线上存在将变得更加封闭,并通过其托管的体验进行筛选。社交媒体、新闻网站、Reddit 等早已如此,而像 Amazon、Ebay(它们自己也在与爬取行为斗争)这样的公司转向“必须登录才能浏览多页内容”的方向,也并非不可想象。
这意味着我们将被迫使用账号才能看到网站上的任何实质内容,而且跨网站浏览也会变得更加困难。
我知道这个特定案件是关于爬取个人数据的,但我认为它将成为许多即将发生的诉讼的催化剂,从而将互联网推向一个不受欢迎的方向。
- collabs
我创建了一个用于测试的第二个 LinkedIn 账号,最近开始收到这个提示,我觉得很奇怪,因为这个账号已经存在好几年了。最近发生了什么变化?这种限制是否也与阻止大规模爬取有关?
----
您的账号访问权限已被暂时限制
为什么会发生这种情况?
当我们检测到潜在的未授权访问或其他不符合我们政策的行为时,我们会采取主动措施来保护您。
接下来该怎么做?
我们首先需要验证您的身份以确保账号安全。要恢复账号访问权限,请提交政府签发的身份证件。
了解更多关于身份验证的信息。
----
- reenorap
他们应该解决员工冒充问题,更重要的是解决招聘人员冒充问题。我遇到过太多假招聘人员联系我,我现在已经分不清谁是真谁是假了。
这其实很容易解决,只要让招聘人员每月通过邮箱验证一次即可,但他们不这么做,这让我觉得他们要么是在纵容这种行为,要么就是根本不在乎,因为他们从中获利。
- TrueDuality
哦?既然是联邦法院,那这就确立了全国性的先例:禁止创建账号来爬取仅限注册访问的内容。在我看来,这大概是件好事。我敢打赌,LinkedIn 官方那句“你的档案属于你自己”的公开声明,将来会让他们自食其果,因为他们显然并没有那样对待用户档案。