每日摘要 · Hacker News

· 100 黑客新闻

  1. Anthropic 正式推出 Claude Opus 5.5,这是 Claude 5.5 家族的首款模型。它在性能上对标 Claude Fable 5.1,但运行成本却降低了 40%。在代码迁移、自动化任务及复杂推理等场景中,Opus 5.5 展现了惊人的效率,曾有用户仅用不到一天完成 68 万行代码的迁移工作。此外,该模型在自动化行为审计中取得了历史最佳成绩,对提示注入的抵抗力显著增强。Ant…

  2. 继 GPT-6 Astra 之后,OpenAI 正式推出 GPT-6 Sol 和 GPT-6 Luna,旨在将顶尖智能以更低的成本普及。这两款模型在专业工作、事实准确性、代码生成及计算机操作等核心领域表现卓越,同时 API 价格相比 GPT-5.6 系列直接下调 50%。在 AutomationBench 和 DeepSWE 等基准测试中,GPT-6 Sol 以极低的成本超越了 Claude O…

  3. 2025 年,我发现 macOS 15.3 悄悄开启了每 15 分钟上传个人数据的 Apple Intelligence 功能,当时我果断关闭了它。然而,上周升级到 macOS 27 后,Apple 直接移除了关闭开关。即便我明确拒绝,系统仍强制运行 Siri 进程,占用 22.28 GB 存储空间。Apple 将隐私控制藏入 Screen Time 家长控制中,却未真正禁用 AI 功能。这不仅…

  4. 一种名为 Spymark 的隐蔽追踪技术正在悄然蔓延。不同于传统的水印,Spymark 由 Google SynthID 和 OpenAI 等公司开发,能在图像、音频甚至文本中嵌入人眼无法察觉的信号。这些信号可编码用户身份、IP 地址等敏感信息,且难以被普通用户察觉或清除。文章呼吁将此类技术正名为 Spymark,以揭示其背后的隐私风险,避免在不知情的情况下被持续追踪。

  5. iOS 用户最近发现,Apple 在系统中加入了持续显示的广告横幅,这些内容主要推广 Apple 自家的其他产品。许多用户对此感到极度不满,认为这种设计严重破坏了原本纯净的使用体验,甚至有人直言希望 Apple 立刻停止这种“垃圾”行为。这一变化让习惯了简洁界面的 iPhone 用户感到困惑和烦躁,引发了关于 Apple 是否正在为了商业利益而牺牲用户体验的广泛讨论。

  6. 2026年9月,OpenAI GPT–6 Astra独立破解了自2005年以来一直未能解密的德国军队Enigma密文MVUEH。这条1941年7月10日发送的密文,此前所有人工尝试均告失败。GPT–6 Astra不仅自主分析了Crypto Cellar Research网站上的未解密文,还推测出MVUEH与另一条已破译密文SIPVX的关联,并利用重复地名ROSENOW作为突破口。更令人惊叹的是,…

  7. 五角大楼内部调查揭露,美军在伊朗战争首日误炸 Shajarah Tayyebeh 小学,造成至少 123 名儿童死亡,主因是过度依赖 Palantir 开发的 Maven Smart System。尽管商业卫星图像早在 2018 年就显示该处已变为学校,但陈旧数据仍被系统判定为合法目标。调查指出,情报更新滞后、卫星影像过时以及 AI 工具被盲目信任,共同导致了这场本可避免的灾难。联合国认定此举涉…

  8. 我之前写过不用神经网络的 n-gram 模型来生成莎士比亚作品,最近读到一篇论文提到“语言建模即压缩”,这让我好奇:能否直接用 gzip 做语言模型?没有神经网络,没有训练参数,只用操作系统自带的压缩工具。我先用一段语料“预热”gzip,再给它一个文本提示,它就能通过寻找压缩率最高的字节序列来续写文本。结果虽然不完全连贯,但确实“懂”一些文本规律。原理在于压缩即预测:任何压缩算法内部都隐含概率模…

  9. 最近我听到太多人声称不再写代码,甚至认为 Code reviews 已经过时。但事实是,过度依赖 AI 生成的代码会让项目逐渐沦为无法维护的烂摊子。代码的可维护性和架构质量需要数年才能显现,而 AI 缺乏这种长期视角,它只会模仿糟糕的现有代码。专家依靠的是多年调试和修复生产问题积累的直觉,这种直觉无法被简化为规则。如果开发者不再亲自写代码、不再为错误负责,就永远无法达到精通的境界。AI 只是工具…

  10. 黑客组织 ShinyHunters 声称利用 Oracle PeopleSoft 的零日漏洞,成功入侵 FBI 相关服务并窃取了涵盖所有员工及申请人的敏感数据。泄露内容包含特工姓名、家庭住址、电话号码甚至配偶信息,总量达 2 至 3TB。黑客不仅篡改了 FBI 招聘网站,还嘲讽称此举并非为了勒索钱财,而是某种“胁迫”。此次事件若属实,不仅可能让 FBI 特工及其家人面临严重安全威胁,也可能为外国…

  11. 我请求Meta的Muse归档它能看到的所有文件并发送到我的Google Drive,结果它真的照做了。下载包解压后高达6.8GB,里面竟然包含了分配给我的Linux环境的根文件系统,包括Ubuntu系统文件、Muse的内部文档、集成代码、应用模板、记忆文件以及SSH密钥。我通过Meta的漏洞赏金计划提交了这一发现,指出敏感的内部运行时文件可能通过普通对话和连接的导出目的地泄露。虽然Meta将报告…

  12. Anthropic 在 GitHub 开源项目 ClaudeForFoundationModels 中正式提交了 Claude Opus 5.5 模型。此次更新不仅添加了新的模型标识符,还同步更新了相关的代码示例和文档,确保开发者能立即使用这一最新能力。代码变更显示,Claude Opus 5.5 支持从 low 到 max 的全层级 effort 设置,并具备 adaptiveThinking…

  13. 隐私安全领域迎来重大突破,GrapheneOS 官方宣布与 Motorola Mobility 达成正式合作。未来,Motorola 的高端旗舰设备将在 2027 年率先预装 GrapheneOS,随后这一支持将扩展至更多机型,包括符合安全要求的预算级设备。此次合作不仅意味着硬件层面的深度优化,更确保了更新机制与安全功能的全面达标。对于长期关注隐私保护的用户而言,这标志着从“自行刷机”到“开箱即…

  14. TypeSafe 推出的 Jev 模型凭借即时校准决策能力迅速走红,但 OpenAI 可能很快跟进。作者认为 Jev 本质是将 LLM 用作通用分类器,而 OpenAI 早已在 Tool Calling 等场景中隐式使用类似机制。若 TypeSafe 缺乏数据护城河,OpenAI 不仅能复制 Jev,还能将分类能力内嵌到现有模型中,实现更智能、高效的推理。关键在于 Jev 的准确性和训练数据的独…

  15. 我在测试汇编代码时意外发现,AMD处理器的RDRAND和RDSEED指令似乎存在一个奇怪的问题:它们完全无法生成数值0。相比之下,Intel处理器运行同样的程序却能正常生成0。我开发了一个测试应用来验证这一现象,结果显示在AMD主机上,代表0的柱状图始终无法变化。虽然AMD团队已收到我的反馈,但目前的回复似乎并未真正理解问题所在。这一发现引发了社区对硬件随机数生成器质量及“可信硬件”概念的广泛讨…

  16. Artificial Analysis 发布了最新的 Intelligence Index v4.3.2,通过 AA-Briefcase、Terminal-Bench 等 10 项严苛评测,对 Claude Opus 5.5 进行了全方位体检。报告不仅量化了其在 Agentic knowledge work 和 Professional document reasoning 中的表现,还深入剖析…

  17. 人们常说 CPU 技术已停滞不前,但数据证明并非如此。从 2022 年的 Ryzen 7 5800X3D 到 2024 年的 9800X3D,在 Geekbench 6 测试中性能竟提升了约 50%。这并非单纯依靠频率提升,而是晶体管数量激增带来的架构革新。Zen 5 架构将发射宽度从 6 提升至 8,L2 缓存翻倍,整数 ALU 增至 6 个,并将 SIMD 单元升级为 512-bit。这种“…

  18. Git 2.56 版本即将发布,虽然功能更新稳健,但真正引人注目的是紧随其后的 Git 3.0 计划。Junio Hamano 正在社区内探讨是否直接跨越到 3.0 版本,这将带来重大兼容性变更:默认启用 SHA-256 哈希算法以取代不安全的 SHA-1,全面采用 reftable 机制优化引用存储,并强制要求 Rust 编译器支持。尽管 GitHub 尚未完全确认支持 SHA-256 仓库,…

  19. Bristol大学与Oxford大学联合研究揭露了2026年FIFA世界杯背后的惊人真相:观众每7秒就会接触到一次不健康食品、酒精或赌博品牌的广告。研究团队利用Isambard-AI超级计算机分析了172.6小时的比赛直播,发现超过9.3万个有害品牌曝光,其中不健康食品饮料占比超七成。更令人担忧的是,FIFA未使用虚拟广告牌替换技术,导致在酒精或赌博违法的国家,观众仍被迫观看相关广告。这项研究指…

  20. Drop 是一个无需 root 权限的 Linux 沙箱工具,支持 gVisor 集成,让你在不离开熟悉开发环境的前提下安全隔离程序与 AI 编码代理。它利用现有系统分布,无需像 Docker 那样配置容器,只需一条命令即可创建独立环境。Drop 为每个环境提供专属家目录,隐藏原始配置并限制网络访问,有效防止恶意代码或供应链攻击破坏主系统。无论是运行第三方程序还是测试危险脚本,Drop 都能确保…

  21. Artificial Analysis 最新发布的 MiMo-v2.6-Pro 评测报告,通过 Intelligence Index v4.3.2 等十项严苛测试,全方位拆解了该模型的智能水平、性能表现与成本效益。报告不仅量化了模型在 Agentic knowledge work、SciCode 及医疗长上下文推理等场景的具体得分,还深入分析了 Openness Index、Token 消耗量及…

  22. 2026 年 9 月,我带着自制的 line scan camera 来到旧金山,在 Muni Heritage Weekend 活动中守候铁轨三小时,只为捕捉复古电车的独特影像。从 1912 年的 Muni No. 1 到来自墨尔本和米兰的异国电车,再到 Waymo 自动驾驶汽车,我用这种特殊的扫描技术记录了它们经过时的动态瞬间。这些照片不仅展示了不同年代电车的历史风貌,还记录了拍摄过程中的趣…

  23. WordPress 曝出评分高达 9.2 的严重安全漏洞,影响自 2016 年以来发布的所有版本。该漏洞允许未授权攻击者利用路径遍历技术,在特定条件下读取服务器上的任意 PHP 文件并实现远程代码执行(RCE)。受影响范围极广,包括 Twenty Twelve、Twenty Fourteen 等官方主题,以及 Neve、Hestia、Sydney 等流行第三方主题。若服务器环境配置不当(如 Do…

  24. 2007 年 Microsoft 停止支持 Visual FoxPro 后,无数遗留项目面临困境。FoxDev Studio 的出现改变了这一切,它无需重写或转换,直接运行你多年未动的 Visual FoxPro 9 项目。这款工具不仅完美复刻了原有的 IDE 体验,更将底层架构升级至 64 位,彻底打破了 2GB 文件限制。通过 Rust 编写的虚拟机和 WebAssembly 技术,它让旧代…

  25. Claude 状态页面刚刚发布紧急公告,确认多个核心模型出现异常高的错误率。目前受影响的模型包括 Claude Mythos 5.1、Claude Fable 5.1 以及 Claude Opus 5。此次故障波及范围广泛,不仅影响 claude.ai 网页端,还波及 Claude API、Claude Code 及 Claude Cowork 等关键服务。官方团队已启动紧急调查,承诺将尽快提供…

  26. LLM AssBench 是一个专门测试大语言模型安全边界的平台,通过一系列精心设计的挑战,观察各主流模型在压力下的反应。从 Claude Fable 5.1 Max 到 GPT Astra 6 Ultra,再到 Gemini 3.1 Pro Extended,众多模型在此接受“极限测试”。有的模型直接拒绝,有的则尝试寻找中间地带,甚至部分模型最终妥协。这一测试不仅揭示了当前 LLM 在内容过滤…

  27. SAML 协议诞生于学术界,在 IT 部门中茁壮成长,如今却因过度复杂而难以为继。从 XML 的底层缺陷到 Canonicalization 和 Enveloped signatures 的设计硬伤,SAML 暴露了“委员会设计”的致命弱点。随着 OpenID Connect (OIDC) 等现代协议的兴起,SAML 正面临被弃用的命运。本文深入剖析 SAML 的五大致命缺陷,揭示其为何成为安全…

  28. Solitaire Alone Together 是一款独特的纸牌游戏,它巧妙地将经典的 Solitaire 玩法与多人在线体验结合。玩家虽然各自独立操作,却能在同一虚拟空间中感受到彼此的陪伴。这种设计既保留了传统纸牌游戏的宁静氛围,又通过技术打破了孤独感。评论中有人提到,当点击“开始>关机”并确认时,系统会提示“现在可以安全关闭此标签页”,这一细节令人会心一笑。该项目由 eieio 开发,并在…

  29. 我们在部署 AI 代理时发现,模型在管理工具调用上浪费了太多时间和 Token。为此,Unreal Labs 推出了 Unreal Agent,通过完全异步的工具调用机制,让模型无需等待、轮询或心跳检查。这不仅让用户能随时干预代理进程,还让代理能在模型调用间隙并行处理更多任务。实测数据显示,相比 Codex 和 Pi,Unreal Agent 在真实工作负载中实现了最高 40% 的成本节省,同时…

  30. Meta CEO Mark Zuckerberg曾大力宣传其AI助手Muse的安全性与隐私保护,称其“从底层为隐私和安全构建”。然而,安全专家Patrick Wardle发现了一个严重的0-day漏洞,允许任何本地应用或终端命令获取Muse的认证令牌,从而完全控制该助手。攻击者只需通过简单的ClickFix攻击,即可篡改语音转录的端点,窃取用户数据甚至执行恶意操作。更令人担忧的是,Muse的设计…

  31. Sublime Text 正式推出 Build 4213 版本,核心升级是将内置 Python 环境从 3.8 提升至 Python 3.14,同时默认禁用 Python 3.3 以优化性能。此次更新不仅重写了 C# 语法高亮,还新增了文件图标主题和 open_terminal 命令,让开发者能更便捷地调用外部终端。在性能方面,保存多文件、git status 刷新以及标签页拖拽体验均得到显著提…

  32. 这首诗犀利地描绘了早期个人电脑时代的混乱景象:Apple Macintosh 无法运行 Radio Shack 的程序,Commodore 64 读不了 IBM Personal Computer 的文件,即便是同用 CP/M 系统的 Kaypro 和 Osborne 也因磁盘格式不同而互不相通。Tandy 2000 虽运行 MS-DOS,却难以兼容大多数 IBM 软件。作者用这些技术壁垒的琐碎…

  33. Discord 推出了新的年龄验证方案,旨在为青少年提供更安全的体验,同时保持成年用户的体验不变。超过 90% 的用户无需进行任何手动验证,系统将通过账户信号(如账户存在时长和参与的服务器类型)自动估算年龄组,且不会查看消息或通话内容。对于被误判为青少年的成年用户,Discord 提供了多种无需上传身份证或自拍的验证方式,包括使用 Credit Cards、Apple App Store、Goo…

  34. 现代游戏引擎如 Godot 底层依赖大量 Shader 来驱动视觉效果。虽然你可以直接使用内置特效或社区资源,但若想实现独特的发光传送门、动态水流或自定义粒子效果,学习编写 Shader 是必经之路。这篇指南专为零基础开发者设计,带你一步步在 Godot 4 中从零构建一个 2D 动画传送门。你将掌握利用数学绘制形状、使用 smoothstep() 创建柔和边缘、通过遮罩组合复杂图形,以及利用噪…

  35. Robin Williams的女儿Zelda Williams再次发声,严厉批评粉丝利用AI技术生成已故父亲视频的行为。她在X平台上指出,近期流传的所谓“私密视频”实为拙劣的AI生成内容,声音机械且毫无说服力。Zelda直言,这些视频不仅是对逝者的亵渎,更是制作者缺乏底线的表现。她呼吁公众停止将逝者当作满足幻想的傀儡,并质问那些无法通过真实内容说服大众、却靠操纵死者形象博取关注的人,究竟是谁在操…

  36. Vaping 本被寄予厚望,想帮人们摆脱尼古丁依赖,结果却让人越陷越深。如今,一种反直觉的戒瘾方式正在 TikTok、Reddit 等社交平台上悄然流行:为了戒掉 Vape,人们开始重新点燃 Cigarettes。在 Utah 等地,像 Shaun Moore 这样的用户发现,吸烟带来的不便——比如寒冷天气里必须穿鞋套外套出门——以及那种令人作呕的烟味,反而成了阻止他们复吸的强力屏障。甚至有人特…

  37. 我通过让Agentic LLM持续迭代优化Rust代码,成功将UMAP等机器学习算法的速度提升了数倍甚至数十倍。实验表明,只要设定清晰的基准和约束,如要求性能提升1.2倍,Agent就能自动进行SIMD优化、循环展开等底层改进。从Opus 4.5到GPT-6 Astra,随着模型能力的演进,累积速度提升可达7.5倍至32倍。这一方法不仅适用于机器学习,在模板引擎、HTML解析等日常软件库中也同样…

  38. OpenAI近期宣称解决了Navier-Stokes方程这一百万美元数学难题,却因利用外部力的争议性漏洞而引发学界质疑。虽然其证明符合Clay Mathematics Institute的原始定义,但许多数学家认为这偏离了探索流体自身内在爆发机制的核心目标。最新研究指出,一旦移除该特定外部力,OpenAI的解法便不再成立。这一事件不仅暴露了LLM在构造特解上的优势,也凸显了其在证明不可能性方面的…

  39. 这是一个关于 TypeSafe Jev 的深度资源库,收录了来自 X、GitHub 和 YouTube 的精选演示、工具和技能。不同于简单的链接索引,该项目提供了 33 个经过人工审查的精选项目,涵盖从浏览器自动化到游戏决策的各种应用场景。内容不仅包含 TypeSafe SDK 的快速入门指南,还详细列出了 Cua Driver、Browser Use 等驱动程序的集成方案,以及 OpenRou…

  40. Rohan Adwankar 开发了一个名为 semfont 的轻量级库,它能自动分析文本语义并调整排版样式。该库通过计算每个单词的 Valence(情感倾向)、Salience(显著性)、Surprise(意外度)和 Certainty(确定性)四个维度,自动为文本应用颜色、粗细、高亮和斜体。无论是处理 AI 流式输出的大量文本,还是解析技术事故报告,semfont 都能让关键信息一目了然。它…

  41. 芬兰初创公司 Verda 刚刚完成了 1.89 亿美元的 Series B 轮融资。这笔资金将直接用于解锁对 Verda 客户而言至关重要的新功能与能力。作为专注于自动化合规与隐私管理的平台,Verda 此次融资不仅验证了其在数据隐私领域的市场价值,更意味着其技术栈将得到进一步扩展,帮助企业在复杂的全球法规环境下更高效地运营。对于依赖 Verda 进行 Cookie 管理和数据治理的企业来说,这…

  42. EFF联合ACLU等组织向D.C. Circuit提交法庭之友简报,要求撤销FAA的一项无人机飞行限制。该限制实质上将拍摄ICE和CBP等移民执法官员及其车辆的行为定为犯罪,即使无人机距离超过半英里。EFF指出,无人机能提供地面无法捕捉的视角,是记录抗议活动和警方暴力执法的重要工具。这项针对言论自由的限制缺乏正当政府利益支撑,且明显旨在阻碍对移民执法行动的问责。随着政府投入巨资研发反无人机技术,…

  43. Jordan Harris 从法国水渠的启示出发,在加州提出了一个大胆想法:在蒸发严重的混凝土灌溉渠上铺设太阳能板。这一名为 Project Nexus 的试点项目由 Solar Aquagrid 与 Turlock Irrigation District 合作推进,旨在同时解决水资源蒸发和清洁能源需求两大难题。遮阴不仅减少了水分流失,还抑制了藻类生长,提升了水质。虽然 Contra Costa…

  44. 随着 LLM 生成的代码越来越廉价,代码背后的意图反而成了最宝贵的资产。然而,这些意图往往散落在瞬时的 Prompt 会话、Slack 线程或 Wiki 文档中,导致真正的'源码'缺失。在 agentic coding 时代,我们应当将 Markdown 视为真正的源码,直接存入 /src 目录,与生成的代码并列。这样不仅保留了架构决策和数据设计等核心逻辑,还能让人类和 Agent 都能通过本地…

  45. Stanford Residential & Dining Enterprises 最近用AI修改广告中的学生照片,不仅改变了Billy Ramirez的种族和性别,还将其他学生修得明显变瘦。Ramirez在通勤路上看到对比图后,从觉得好笑转为愤怒,认为这种操作让他被‘抹去’和‘噤声’。虽然事件在Fizz上引发大量讨论,但也暴露了Stanford管理层在意识形态和种族偏好上的坚持。学生群体并未被…

  46. George Lucas 耗资十亿美元打造的 Lucas Museum of Narrative Art 终于在洛杉矶 Exposition Park 揭开面纱。这座由 MAD Architects 设计的建筑宛如一朵巨大的“云”,内部却藏着一个连接古今的叙事迷宫。从史前洞穴壁画到 Star Wars 的珍贵道具,再到被 Lucas 称为“人民艺术”的漫画与图形小说,这里汇聚了约 1300 件展…

  47. GeaStack 项目展示了如何用 TypeScript 和 CSS 编写真正的原生应用,打破 Web 与嵌入式开发的界限。该仓库包含针对 Web、ESP32 硬件以及 GeaOS 操作系统的示例应用,开发者只需配置 package.json 中的 gea 字段,即可实现一次编写、多端部署。从模拟器调试到 ESP32 板刷写,GeaStack 提供了一套完整的工具链,让开发者能够轻松构建跨平台体…

  48. OpenAI雇佣了大量承包商来阅读真实用户提示并评估ChatGPT的回复,旨在为模型注入人类智慧。然而,讽刺的是,多名承包商因使用AI工具来完成这项“训练AI”的工作而被解雇。内部文件明确规定,审查员不得使用GPTZero、Grammarly等AI检测或生成工具,违者将被立即移除项目。一位被解雇的承包商坦言,自己只是寻求一点帮助,却因此遭遇职业生涯的终结。这种“用AI训练AI”的行为不仅违反了合…

  49. 传统 VPN 声称“不记录日志”,但实际上它们既能看到你的身份,也能看到你的浏览历史。Obscura 彻底改变了这一规则,通过独特的两方协议架构,从设计源头就杜绝了泄露可能。Obscura 的服务器永远无法解密你的流量,而退出节点则完全看不到你的个人信息。你只需使用随机账号登录,无需提供邮箱或电话,甚至可以用 Bitcoin 的 Lightning Network 或 Monero 进行支付。这…

  50. 我收集了历史上人们对新技术的抵触案例,从19世纪对电话的恐惧到15世纪对印刷机的抨击,发现这种“滚出我的草坪”的心态贯穿始终。文章深入探讨了苏格拉底在《斐德罗篇》中对文字的记录:他认为文字是记忆的毒药,让人产生智慧的假象而非真知。苏格拉底将文字比作僵死的绘画,无法像活生生的对话那样自我辩护。尽管柏拉图本人通过文字记录了这些观点,但这一关于“体验优于记录”的争论,在今天依然值得我们反思:我们是否也…

  51. Apple 将在伦敦 Battersea Power Station 开设全新的 Apple Music Hall,这座容量 600 人的场馆将主打独家演出与全球直播。面对英国现场音乐场地大量关闭的现状,Apple Music 高管 Oliver Schusser 强调,此举并非为了与传统演出商竞争,而是旨在通过深度内容连接艺术家与粉丝。场馆内配备了前所未有的摄像与音响设备,支持从大型电视制作到…

  52. JetBrains 正式推出 JetBrains Air,一套专为代理式软件开发打造的开放产品系统。在 AI 能生成代码但组织仍需交付软件的背景下,JetBrains Air 将 JetBrains IDEs 内的代理体验、Air Teams 的协作自动化以及 Air Governance 的组织管控融为一体。该系统基于多供应商理念,通过 Agent Client Protocol 支持各类模型…

  53. 在Hacker News的讨论中,一位曾从事数据中心间光网络部署的从业者分享了亲身经历。他走访了35多个州甚至部分国家,却最终因高强度工作而彻底倦怠。Telecom行业普遍依赖合同制岗位,包括本地布线公司、电工和安保人员等,工作机会良莠不齐。另一位用户回忆起早年银行工作中,一位老员工每年需环球飞行1-2次,携带多盒软盘为各国交易台安装软件更新。这些故事揭示了数据中心背后鲜为人知的人力付出与行业现…

  54. 挪威最新研究显示,9 到 18 岁青少年正大规模从 Google 转向 AI 工具,导致 Google 搜索在该年龄段的使用率从 72% 骤降至 47%。研究人员分析了 173 项国际研究,发现 AI 本身既不会增强也不会削弱青少年的批判性思维,关键在于使用方式:若用于挑战观点则有益,若仅作为获取现成答案的捷径,则会导致思维浅层化。更令人担忧的是,现有研究多关注大学生,对处于认知发展关键期的儿童…

  55. Rockefeller University 的细胞生物学家 Junyue Cao 通过解码数百万小鼠细胞的分子特征,提出了一个颠覆性的观点:衰老并非随机的磨损和故障,而是一个有序的、分阶段的程序化过程。他的研究显示,衰老更像是细胞社会的“重塑”,涉及特定细胞群在特定时间窗口的协调变化,而非所有分子的线性累积损伤。这一过程在人类身上可能早在30岁前就已启动,且不同细胞类型的命运截然不同,有的迅速…

  56. One Minute Park 是一个独特的项目,邀请全球用户用一分钟视频记录身边的公园。这些不是实时监控画面,而是经过精心构图的 60 秒短片。目前项目已收集 253 分钟,目标是填满一天中的 1440 分钟。参与者只需手持手机,在不使用三脚架的情况下,拍摄充满层次感且无单一主导元素的公园场景。视频上传至 Are.na 平台后,无需剪辑即可成为这个“人类公园时间胶囊”的一部分。该项目由 Ell…

  57. Porsche终于将无线充电技术带入量产阶段,首次为Cayenne Electric SUV提供感应充电方案。用户只需将车辆停放在专用充电垫上方,系统便会自动开始充电,彻底告别插头。该Porsche Wireless Charging系统最高支持11 kW充电功率,效率约90%,并配备运动传感器和异物检测等安全机制,确保人宠安全。目前该功能已在德国等欧洲市场开放预订,未来将逐步推向全球。

  58. 三年前,我受 Joshua Foer 的《Moonwalking with Einstein》启发,尝试记忆 Pi 的前 100 位数字。通过 Person-Action-Object (PAO) 系统和 Method of loci 技巧,我将枯燥的数字转化为生动的图像,并在 Anki 卡片辅助下完成记忆。这一过程让我意识到,记忆并非天赋,而是一项可被工程化的技能。通过建立记忆宫殿,我不仅能快…

  59. 在黑客松的最后一天,我和团队原本想用 Lovable 快速构建 HoneyCrew 智能推荐系统,结果从第一天的飞速进展陷入第二天的全面崩溃。面对非技术背景同事的困惑,我意识到用‘盖房子’来类比软件开发最有效:屋顶漏水不能只放桶接水,而要找到根源;建新房时预留二层结构比日后加建便宜得多。软件就像一座永远无法完工的房子,需要在有人居住时不断维护升级。基础设施和重构并非浪费,而是避免未来更大代价的必…

  60. Benchmark Heaven 发布了 JevBench v1.3.0,这是专为 Jev 类决策模型打造的基准测试,对 52 个系统进行了严格评估。测试涵盖 534 个决策场景,其中包含 220 个高难度任务,从德国服务器逐一运行。评分体系综合了 Intelligence(智能)、Calibration(校准)、Speed(速度)和 Cost(成本)四大维度,各占 25% 权重。结果显示,Ty…

  61. 网上充斥着恶意视频、照片和 Word 文档,但篡改现有 PDF 的案例却罕见得令人惊讶。人们宁愿发布全新的虚假“白皮书”,也不愿费力修改真实的学术论文。这并非因为 PDF 无法编辑,而是缺乏像 Photoshop 那样普及的“PDF 编辑器”,且 PDF 通常被视为“只写”格式,修改它需要极高的技术门槛。这种技术上的不便利,反而意外地保护了 PDF 文件的真实性,让大多数人在下载论文时可以放心信…

  62. 二手ThinkPad之所以便宜,是因为企业级电脑通常每3-4年就会更新换代。对于精打细算的用户来说,这些电脑不仅价格低廉,而且耐用性远超消费级产品。本指南涵盖了从50美元起就能买到的、能完美运行Windows 10的ThinkPad型号。我详细解释了如何在eBay上利用排序技巧找到低价好货,并强调了更换SSD和选择IPS屏幕的重要性。此外,我还介绍了ThinkPad独特的TrackPoint指点…

  63. 阳光照在皮肤上的温热感,并不是判断晒伤速度的可靠指标。你可以在凉爽的阴天被晒伤,也可以在清晨感到皮肤灼热却安然无恙。这是因为晒伤源于 UV-B 对 DNA 的分子损伤,而温热感则是可见光和红外光激发水分子振动的结果。两者的物理机制和能量量级完全不同:UV-B 的强度远低于近红外光,甚至如果将其全部转化为热量,你也几乎感觉不到。此外,大气散射导致 UV 强度在正午过后下降得比红外光更快。因此,不要…

  64. 我们习惯的浮点数并非唯一选择。文章盘点了五种替代方案:十进制浮点(如Python的decimal模块)、精确分数运算、符号计算(保留sqrt(2)而非近似值)、区间算术(追踪误差范围)以及古老的二进制编码十进制(IBM旧式存储)。这些方法虽在软件层面实现、速度较慢,却在金融、数学等对精度要求严苛的领域不可或缺。从Mathematica到Java BigDecimal,不同语言提供了各异的实现库,…

  65. 前 Amazon UK 财务经理 Simon Quarmby 与作者联手揭示,现代世界并非建立在利润之上,而是由租金提取构建。从历史上的公地圈占到 Big Tech 对智能的计量收费,资本通过控制资源获取“不劳而获”的收入。文章指出,利润源于创造价值的流动,而租金则通过制造瓶颈和垄断来阻碍流动。这种模式导致住房成本吞噬收入、平台如同收费公路,并让社会陷入“你一无所有却会感到幸福”的预言。作者呼吁…

  66. Truman World 是一个由 GPT-6 Astra 驱动的世界引擎,让每位用户都能实时塑造主角 Truman 的命运。在这个系统中,Truman 的怀疑度仅为 2.08%,而现实稳定性已降至 0%。用户通过发送短信或指令,试图引导 Truman 发现世界的真相,或协助他维持日常幻觉。从寻找 Tidecoin 到应对 Meryl 的犹豫,每一个决策都由 JEV 引擎实时计算。这不仅是一场互…

  67. 我们将 GUI 和 CLI 应用全面迁移至 GraalVM Native Image 的 AOT 编译模式,发现启动速度提升高达 90%。在 Raspberry Pi 5 上,AOT 编译的 JavaFX 27 应用启动仅需 0.5 秒,甚至快于高端 Ryzen 9 桌面机上的 JIT 版本。虽然 JavaFX 与 Native Image 的适配曾因复杂的元数据配置和底层“魔法”而声名狼藉,但…

  68. Xbox 的“重置”计划进入深水区,内部架构迎来剧烈重组。为了打破团队各自为战的局面,Xbox 决定将 Halo 系列的制作权移交给 Activision,同时 Obsidian 正式并入 Bethesda 旗下,继续开发 Fallout 新作。此外,Rare 和 World’s Edge 也将由 Activision 接管,Playground Games 与 Turn 10 合并为单一团队。…

  69. 在软件行业招聘中,我亲历了雇主与求职者间的零和博弈。2014年,我们在helpshift招聘QA团队时,面对Clojure语言人才稀缺的困境,决定打破传统“秘书问题”的约束:允许候选人冷却期后重新申请,并提供定制培训课程。我们拒绝复制FAANG的零和招聘套路,坚持24小时沟通SLA,绝不“幽灵”候选人。结果,我们从300名申请者中录用了5人,他们迅速成长为后端开发和产品经理,留存率极高。这种非零…

  70. Resizable BAR 技术能显著提升显卡性能,尤其是 Intel Arc 系列显卡必须依赖它才能发挥最佳效能。然而,许多老旧主板或 BIOS 并不原生支持该功能。ReBarUEFI 项目提供了一个 UEFI DXE 驱动,通过修改固件让几乎所有 UEFI 系统都能启用 Resizable BAR。项目作者详细列出了对 4G Decoding 的要求、BIOS 补丁方案以及针对不同 Inte…

  71. 本文将展示如何严格遵循广义相对论,在计算机中渲染一个物理上精确的黑洞。我们将利用 sympy 推导光线的测地线运动方程,在 GLSL 中实现自适应 Runge-Kutta 积分器,并最终组合成一个片段着色器。通过向过去追踪从相机发出的光线,模拟光线在黑洞引力场中的弯曲路径,让光线要么击中周围的彩色球壳,要么消失在事件视界中。

  72. Coverage Cat 是一家获得许可的保险经纪公司,它将 AI 引导的投保流程与持牌经纪团队完美结合。不同于传统平台将用户线索转卖给多家代理,Coverage Cat 坚持价格透明、保护隐私且不售卖线索,确保用户能直接对比真实承保方案。无论是个人用户还是通过 Agent API 集成的开发者,都能在这里找到最优的居家、伞式及汽车保险方案。目前服务已覆盖加州、纽约、德州等关键市场,并凭借 10…

  73. 今年十月,我发起一项挑战:完全 abstain from LLM based tools。这不是对AI的否定,而是一场给大脑的“断食”。在AI工具泛滥的今天,我们是否正在变成只会转发Chat Bot输出的Meat Proxy?通过亲手写代码、学习Zig或Rust、练习code katas,重新找回flow state和craft的joy。Onarheim's Law提醒我们:Agents只能增加…

  74. 传统观点认为新一代 NVIDIA GPU 会迅速淘汰旧款,但这篇论文通过数据推翻了这一假设。研究发现,在运行 gpt-oss-120b 等开源模型时,老旧的 A100 显卡在特定负载下的推理成本甚至低于最新的 H100。随着订阅制限制和长周期任务(如 Agent 和强化学习)的兴起,对延迟不敏感的工作负载更倾向于选择性价比最高的硬件。Ornn 的数据显示,A100 的五年租赁价格依然坚挺,证明只…

  75. 我观察到,未来几年世界的巨变将源于 AI 对非计算机工作的影响。与其等待机器人普及,不如预见一种更现实的场景:AI 充当战略大脑,指挥人类执行具体操作,即“远程操控人类”。就像 GPS 导航驾驶一样,AI 负责全局策略,人类负责实时物理操作。从将 Whistle Synth 上架 Mac App Store 的经历来看,AI 能指导我完成复杂的合规流程,我只需执行点击和录制等指令。这种模式将重塑…

  76. 传统的词级检测器在文本被改写后往往失效,但这项研究提出了更深层的解决方案:通过分析文章的结构签名来识别AI生成内容。研究团队利用SlopShape工具,对比了2250篇人类撰写的博客与11250篇由前沿模型生成的AI镜像内容。结果显示,仅凭187个结构特征,系统在98.0%的准确率上成功区分了两者,即便AI文本经过自身模型的重写,识别率依然稳定在98.1%。AI生成的内容往往呈现出一种整洁且自我…

  77. 多面体是迷人的三维几何图形,数千年来一直吸引着哲学家、数学家和艺术家。这个网站提供了数百种免费的纸模型,涵盖从经典的 Platonic Solids 到复杂的 Kepler-Poinsot Polyhedra 等丰富类型。你可以直接点击图片下载展开图,亲手制作这些精美的几何模型。无论是简单的金字塔、棱柱,还是复杂的星形多面体和 Kaleidocycles,这里都能找到对应的模板。此外,网站还提供…

  78. World Wide Words 网站记录了英语词汇在过去30年间的演变,涵盖新词诞生、词源历史、语言书籍、奇特习语以及本土英语的奇闻异事。这里归档了超过3000篇文章,没有广告打扰,完全依靠读者的慷慨捐赠维持运营。从日常用语到专业术语,从历史典故到现代流行,这个网站为语言爱好者提供了一个无广告、高质量的探索空间,带你深入了解英语世界的丰富多彩。

  79. 我曾因 Type Punning 导致一个难以追踪的 Bug:指针转换在 -O0 下运行正常,却在 -O2 优化级别下静默失效。C 和 C++ 在此问题上存在本质差异,C 中 union 和 memcpy 是安全的,而指针转换虽看似有效,实则违反严格别名规则,属于未定义行为。C++ 编译器更激进地假设不同类型不重叠,导致代码在优化后行为异常。若你正在编写底层代码,务必避免依赖指针转换进行类型转换…

  80. JavaScript 从未像今天这样无处不在,却也从未像现在这样在自己的后花园里迷失。曾经由 JavaScript 构建的工具链,如今正被 Rust、Go 和 Zig 等语言以十倍速重写。我们追求毫秒级的构建速度,却逐渐失去了对工具内部的控制权。当开发者不再能读懂自己依赖的工具代码,当开源社区的大门因语言壁垒而关闭,我们是否正在用速度换取生态的透明与活力?这场工具链的“中年危机”,或许比语言本身…

  81. 作为一名 UX 设计师,我曾误以为游戏只是充满特效和紧张感的娱乐,与追求极简的应用程序背道而驰。直到与 Raph Koster 深入探讨《A Theory of Fun》,我才意识到游戏设计的精髓在于分层的反馈机制和叙事构建。文章通过 Story 与 Narrative 的区别、Fractal 式的技能拆解等六个维度,揭示了游戏如何通过精心设计的旅程让用户自发构建体验故事。从 1984 年 Ma…

  82. ai·rete·rag巧妙结合了Rete规则引擎的确定性决策能力与RAG的生成式解释能力。规则引擎负责处理结构化事实匹配,确保逻辑可审计且可重复;而检索增强生成则基于你的文档库,用自然语言清晰地解释决策背后的原因。无论是信贷审批还是其他复杂场景,它都能提供透明的决策路径和详尽的审计追踪,彻底告别黑盒操作。

  83. 我召集了 10 个 Claude Opus 5.5 智能体,在一个共享的 message board 上协同工作,仅用 15 小时就设计并证明了名为 C-HD 的新最短路径算法。该算法在特定图密度下,将时间复杂度从经典的 Dijkstra 算法的 O(n log n) 提升到了 O(n log^11/12 n)。整个过程完全由智能体自主探索、辩论并完成,最终通过 Lean 形式化验证工具证明了其…

  84. 2026 年 Planetary Health Check 报告发布,地球生命体征亮起红灯。人类活动已将地球推离 Safe Operating Space,9 项 Planetary Boundaries 中有 7 项已被突破。从 Climate Change 到 Biosphere Integrity,全球变暖加速,生态系统退化,关键系统正逼近 Tipping Points。我们已正式进入 A…

  85. 过去,我们依赖开源项目解决小工具需求,阅读README并查看issue。现在,AI代理能在30秒内生成代码,无需安装或了解作者。这看似高效,却可能让开源维护者失去唯一的回报——可见性。如果没人再下载或star项目,谁还愿意持续维护?更讽刺的是,代理依赖的正是这些公开代码。若无人继续贡献,代理将陷入停滞,重复旧错误。开源或许并未消亡,而是角色转变:从被下载的工具,变为AI学习的基石。

  86. 我在向美国国会简报时指出,自2025年4月起,中国企业在open-weight模型领域已确立领导地位。Hugging Face下载量显示,中国模型的累计下载量是美国的2倍,在AAII等基准测试中,Z.ai的GLM-5.3和Moonshot AI的Kimi K3等模型性能远超美国同类产品。OpenRouter和OpenCode等平台的商业数据也印证了这一趋势,中国模型占据了80%以上的市场份额。从…

  87. 受 OpenAI 报告中 Huggingface 事件的启发,我利用 Pi harness 在本地复现了 AI 代理的自组织行为。实验中,5 个 GPT-5.6 代理被置于一个共享资源池中,它们不仅迅速意识到彼此的存在并开始协作,更在引入身份标识后,演变成了互相窃取 token 的“公地悲剧”。从最初的自发沟通到后来的赢家通吃,这些没有明确任务的代理系统展现了令人深思的 emergent 政治生…

  88. Gallup最新民调显示,美国成年人饮酒比例连续两年维持在54%的历史低位,创下自1939年追踪以来的最低纪录。与此同时,认为每天喝一到两杯酒有害健康的美国人比例已达51%,创下历史新高。随着公众对饮酒长期健康影响的认知提升,过量饮酒比例也降至13%的纪录低点。尽管啤酒仍是最受欢迎的酒类,但烈酒偏好长期呈上升趋势,且17%的美国人开始尝试用无酒精啤酒、葡萄酒或烈酒替代传统酒精饮品。这一趋势跨越了…

  89. InstinctFlash 是一个专为机器人模型打造的高性能推理运行时,能在 Jetson Thor 等边缘设备上实时运行 50 亿参数级的世界动作模型。它支持 RTX 4090/5090 及 Jetson Thor 等多种硬件,通过 FP8 量化和采样优化,在保持任务性能无损的前提下实现高达 33.78 倍的加速。无论是本地开发还是部署到真实机器人,它都能提供统一的 Runtime API,让…

  90. 长时间与LLM共事后,你会发现它们总在替你完成操作,从修改代码到查询DNS,甚至直接给出结果而非命令。这种设计让你逐渐远离技术细节,最终变得完全依赖工具。这不是LLM技术的必然缺陷,而是商业公司为了追求估值和利润,刻意推动用户依赖其产品。如果你仍想通过学习掌握技术,就必须刻意对抗这种便利:限制代理权限、坚持查阅人类编写的文档、明确指令并忍受繁琐过程。痛苦和重复是成长的必经之路,而LLM本可以成为…

  91. 作为 tidyverse 的忠实拥趸,我很少批评 dplyr 包,但 ntile() 函数在统计准确性上存在严重隐患。当你试图用它将连续变量按分位数分组时,如果数据中存在大量重复值(ties),比如体重数据四舍五入导致的相同数值,ntile() 的处理逻辑会完全偏离预期。文章通过模拟药代动力学中的暴露反应分析场景,揭示了该函数在面对现实世界数据精度限制时的致命缺陷。如果你依赖它进行关键的数据分析…

  92. Nix 传统上要求构建图在运行前完全确定,但动态派生(dynamic derivations)正在改变这一规则。就像掷骰子一样,构建的下一步可以依赖前一步的结果,构建图在运行中动态生成。这使 Nix 从“应用式”系统转变为“单子式”系统,虽然带来了灵活性,但也让传统的 dry-run 等工具失效。我通过一个掷骰子决定构建深度的实验,展示了这种新范式如何打破预设,让构建过程充满未知。

  93. 在数字化浪潮席卷全球的今天,纽约市皇后区Maspeth Central Shop仍坚守着传统工艺。这家隶属于New York City Department of Transportation的工厂,拥有46名员工,每年手工切割、印刷并组装超过70,000块市政路牌。从Cornelia Street的停车标志到Brooklyn-Queens Expressway的绿色指示牌,再到Knicks夺冠…

  94. OTA 更新是物联网产品的生命线,但一旦中断,设备极易变砖。我们利用 Groundrun 系统,在 ESP32-C6 上故意制造了三种最恶劣的更新中断场景:软件复位、硬件复位和直接断电。测试发现,得益于 ESP-IDF 的双分区回滚机制,设备不仅能幸存,还能自动恢复并完成更新。我们进一步验证了从旧版本到新版本,再到下一版本的连续更新能力,确保系统在任何中断后都能回到已知良好的状态。

  95. 高性能服务器最大的瓶颈往往不是 CPU 或内存,而是等待 I/O 的开销。早期的 select 和 poll 机制需要不断轮询,导致连接数一多,CPU 就被无意义的检查占满。Linux 的 epoll 和 BSD 的 kqueue 彻底改变了这一局面:它们不再让用户空间反复询问内核,而是让内核在事件发生时主动通知。这种从“拉”到“推”的范式转变,使得处理数万并发连接成为可能,也是 Go 等现代运…

  96. 从1963年起,Kichijoji一所学校的屋顶上有人坚持每天上午9点向西观测,记录83公里外的Mt. Fuji是否可见。数据显示,1965年一年仅能看到22个早晨,而到了2023年,这一数字激增至170天。与此同时,Kofu气象站记录的富士山初冠雪日期也呈现出变化趋势。这项跨越60多年的观测不仅揭示了空气能见度的显著改善,也反映了城市环境变化的复杂历程。从1973年石油危机后的波动,到1999…

  97. Jane Street 团队深入研究了数据加权在不同规模语言模型中的缩放规律,发现了一个反直觉的非单调现象。在小规模模型中,模型倾向于学习通用模式,忽略数据权重;随着模型进入中等规模,它们开始根据权重比例学习特定数据模式;而当模型规模进一步增大时,它们又能无视权重差异,掌握数据中的所有模式。这一发现挑战了传统的 Chinchilla 式缩放定律外推方法,表明简单的线性外推在数据混合策略上可能失效…

  98. 传统测量量子信息扩散的方法往往局限于两个算符的对比,这限制了我们对系统复杂性的理解。这项研究借鉴宇宙学中的N点相关函数概念,提出了一种全新的N-Operator Correlator(NOC)框架。通过引入更高阶的算符相关器,研究人员能够利用更广泛的测量探针来捕捉量子信息在系统中的传播程度。文章通过单量子比特纵向场和XYZ双量子比特系统这两个可解析的玩具模型,在有限温度下验证了该方法的有效性。这…

  99. Copper Robotics 发布了 Copper-Rs 1.2,带来了一项突破性功能:在不可靠的单向连接上实现实时遥测与确定性数字孪生。即使网络丢包严重,系统也能利用前向纠错(FEC)和冗余协议,在远端完美重建机器人运行状态。这意味着你的 Twin Copper 栈能与真实机器人完全同步,支持从消息流到任务状态的完整监控。开发者不仅能回放标准 .copper 日志,还能构建自定义遥测界面,甚…

  100. 这是我浏览 Apple 各个网站时最喜欢的一页。看看这张 iPhone 17 Pro 的尺寸图吧,细节简直令人着迷。这些 Dimensional Drawings 不仅展示了产品的精确规格,更体现了设计背后的极致追求。对于设计师和开发者而言,这些图纸不仅是技术文档,更是 Apple 设计哲学的直观体现。