2040 年:当每人拥有一台 B300 GPU
GPU World
这场故事征集活动邀请我们构想一个算力均匀分布的未来。目前,受限于 GPU 产能,只有少数人能接触到 Fable 或 Sol 等前沿 LLM。但到 2040 年,全球可能拥有 80 亿台等效 GPU,让每个人都能 24/7 访问顶级 AI。在这个 AI 进步停滞但算力普及的“常态”世界里,教育会被无限耐心的导师彻底改变吗?医疗会迎来世界级的 AI 医生?社交媒体会消亡吗?这或许比智能手机甚至互联网更具变革性,关键在于我们如何想象这个平凡的明天。
AI 作为我们已知的形态,其变革潜力可能远超智能手机,甚至超越互联网本身。
HN 评论区
236- chrismorgan
这个网站有个独特的“殊荣”:它是第一个我遇到的、只要网页字体被阻止(或加载失败)就会崩坏的纯内容型网站。
除了顶部那个奇怪的 5×5 彩色方块图之外,所有内容其实都在文档里,但他们却费尽心思用各种令人费解的方式搞破坏:① 如果禁用 JS,所有内容都会被“请启用 JavaScript 以查看本网站”的屏幕挡住;② 如果字体加载失败(字体?字体!?),所有内容都会被“字体未加载。请刷新网站。”的屏幕挡住;③ 就算你全都搞定,键盘导航(上/下/PageUp/PageDown/空格/Shift+ 空格)也是坏的,因为他们特意不用现成的文档滚动区域,而是自己在里面搞了个固定位置的滚动条,而且连焦点都设不了,所以在某些浏览器里按 Tab 键想把焦点移进去,结果直接跳到了页面中间。
(如果不是因为它有这种“首创”地位,我根本不会评论这些。)
- maxnevermind
> 总有一天,比如在 2040 年,每个人可能都能获得相当于“当代大语言模型用的 B300 GPU
- NitpickLawyer
的性能。那样的世界会是什么样?
如果我们只谈大语言模型,鉴于自 ChatGPT 以来的发展态势,我的猜测是变化不会太大。大语言模型并不是像互联网、蒸汽机或铁路那样的基础性技术。由于可靠性问题(这对大语言模型来说是完全无法解决的),能基于它们构建的产品寥寥无几。聊天机器人是其中一个不错的产品,代码辅助工具是另一个,但这远不及互联网或蒸汽机的影响力。大语言模型只是为那些高度自驱的专家型知识工作者提供了好用的生产力工具,仅此而已。大语言模型会越来越好,也确实会进步,但不可能把整个宇宙描述清楚并压缩进几 TB 的数据里——而这正是它们目前实际在做的事。所以,所有大语言模型的严重问题在 2040 年依然存在:缺乏持续学习能力、幻觉、极低的样本效率、智能体在长周期任务上的失败、指令遵循失败。
- rixed
我刚读完 Adrian Tchaikovsky 写的《Service Model》[1],这是一部非常应景的小说,探讨了大量关于人工智能、机器人、人性、控制、自我决定等未解的开放性问题。如果你喜欢这类题材,强烈推荐。
> 前提设定
> 假设人工智能的前沿进展在 2026 年 9 月 1 日停止:AI 变得更快、更便宜,但永远不会超越人类,也不会全面显著改进。
我绝对喜欢这个前提。几天前我就写过评论讨论过这个话题。我在 2024 年初使用一个小规模的本地模型时有了这个“顿悟”:即使模型再也不会进步,我依然还有几年时间去探索能用这些模型做哪些事。
太酷了,希望这个项目能产出一些有趣且不过分悲观的故事。这个世界已经充满了愤世嫉俗和负面情绪。我们需要一些关于大家使用由 Fable 运行的 openclaw2040 的搞笑解读。各种恶作剧应有尽有。
[1] - https://www.goodreads.com/en/book/show/195790861-service-mod...
- nbardy
自工业革命伊始,人们就一直惊叹于新技术带来的可能性,以及一旦这些技术被均匀分配后会对社会产生何种影响。技术进步一直在进行,渗透到每个角落,触及每一个人。然而,它从未真正“均匀分配”过。
当每个人都能访问互联网时会发生什么?当每个人都把电脑装进口袋时,世界会有多大不同?能否无视地点和语言与任何人沟通,且无需中介?这些都是我们不久以前还在问自己的问题。
结果呢:没什么变化。
要让未来真正均匀分配,必须发生比大规模制造高效 GPU 更巨大的变革。否则,技术只会用来确保进步和知识继续不均匀地分布。毕竟,这就是“放牧人类”的整个游戏;这叫“有组织的稀缺”。
- itomato
最神奇的事情之一是,当每个人都拥有一台 GPU 时,他们实际上将拥有 1k 到 10k 个智能体(agents)可供调遣。
大语言模型和 KV 缓存具有惊人的并发吞吐量性能特征。它的扩展性非常非线性。因此,批次内的 Token 吞吐量增长速度远远快于每个用户每秒的 Token 数。
这就是大语言模型提供商成本利润率如此惊人的原因。
- not2b
全世界的人都能接触到叉子/筷子/勺子,但每个人都有偏好,可能是 N+1 或者 0。
这个按人口索引的 GPU 集群会重新配置或自动扩展吗?在人口变化被人为操纵之前,临界点是什么?
如果要我发表意见,这是一个很奇怪的前提。
- jdub
希望在这个世界里,有人能想出办法,以当前 B300(功耗高达 1400 瓦)约 1/100 的功耗,提供相当于 B300 GPU 的性能,否则世界就要被烤熟了。