每日摘要 · Hacker News
· 90 黑客新闻
- ▲ 1086让 Claude 只改按钮颜色,别动别的
在 Opusfived 的演示中,我们尝试给 Claude 下达一个极其具体的指令:将“Add to Cart”按钮改成蓝色,同时严禁它修改页面其他任何内容。这个看似简单的任务,实则是对大模型指令遵循能力的极限测试。在生成式 AI 日益普及的今天,如何让模型精准执行单一操作而不产生幻觉或过度修改,成为了开发者面临的现实挑战。这次实验揭示了当前模型在细粒度控制上的表现,也提醒我们在实际应用中需要更…
Apple 正式推出首款折叠屏手机 iPhone Duo,搭载 7.6 英寸 Super Retina XDR 显示屏,展开后面积比 iPhone 18 Pro Max 大 50%。这款设备采用钛金属框架和铰链盖,内置 A20 Pro 芯片与双电池系统,支持全天候续航。iOS 27 针对折叠形态重新设计,提供多种姿态的交互体验,如帐篷模式、桌面支架模式等。48MP Dual Fusion 相机系…
今天是个大日子,Tailwind 正式加入 Shopify。九年前我开始开发 Tailwind 时,只想为自己的项目打造更便捷的界面工具。如今,这个框架每周被安装超过 1.1 亿次,被 ChatGPT、X、Cloudflare、Reddit 和 Shopify 等全球巨头信赖。我们选择加入 Shopify,是为了让 Tailwind 拥有一个长期稳定的家园,持续服务数百万依赖它的开发者。Shop…
我刚刚从Anthropic辞职。过去三年,我先后在OpenAI和Anthropic从事预训练研究。这两家公司都没有负责任地行事,它们正疯狂奔向自我改进的超级智能,拿我们的生命做赌注。不要低估这项技术的力量,很快我们将面对能破解一切、一夜颠覆任何领域并获取真实权力的超人类系统。许多AI构建者真心相信,到本十年末AI可能毁灭我们,这绝非营销噱头。在Anthropic,大家深知风险,却因担心无人会负责…
- ▲ 552Flock:用13万摄像头打造无退路世界
Flock 公司正在美国街头部署超过 13 万台摄像头,构建一张巨大的监控网络。他们巧妙地将隐私问题包装成安全与安保的必要代价,这种说辞与 9/11 事件后监控技术爆发的逻辑如出一辙。文章深入探讨了这种以安全为名的全面监控如何逐步侵蚀个人自由,并质疑在一个没有退出的严密监视世界中,我们是否还能拥有真正的隐私。
大多数人以为Visa和Mastercard是发卡行或银行,其实它们只是连接持卡人、发卡行、商户和收单机构的卡网络。它们不制造卡片,也不处理商户入网,核心职责是运行电信网络路由交易消息、协调银行网络完成资金结算、设定激励规则以及制定并执行网络规范。文章以Visa为例,详细拆解了从授权、清算到结算的完整流程,揭示了Interchange Fee( interchange fee)和Network A…
我们推出了 Desert Ant Labs,一家专注于端侧智能的欧洲前沿 AI 实验室。我们坚信,高效智能的起点在于设备本身。我们构建了专为音频、视觉和文本设计的小型专用模型,每个模型都能在毫秒级响应,且运行成本为零。这意味着你可以在每一次产品交互中植入智能,不再受限于 token 成本或推理速度。这些模型小到能在五年前的手机上运行,快到足以处理每一帧画面或每一次按键。从 Voz 的极速转录到…
Apple 正式发布了 AirPods 5,这款开放式耳机首次实现了行业领先的主动降噪功能。得益于全新的多端口声学架构,其降噪能力比 AirPods 4 提升了 50%。结合 Siri AI,用户现在可以完全通过手势或语音进行免提操作,甚至使用 Live Translation 功能打破语言障碍。基础版售价 129 美元,配备无线充电盒的版本为 149 美元,并支持滑动调节音量。这是 Apple…
DeepSeek 计划于 2026 年 9 月 10 日正式推出 V4.1 Flash 模型。经过多轮测试,该版本在性能、成本、速度及任务完成时间等核心指标上全面超越 V4 Pro。为践行对用户负责的理念,在 V4.1 Pro 发布前,所有 V4 Pro 的请求将自动路由至 V4.1 Flash,并按 Flash 的低价计费。新定价将于 9 月 10 日生效,闲时输入缓存命中仅需 0.003 美…
OpenAI的GPT-6 Astra刚刚发布,它在3D渲染、动画生成以及计算机使用能力上表现卓越,特别是在ARC-AGI-3基准测试中取得了99.9%的惊人成绩。文章深入探讨了其背后的“循环Transformer”架构,即通过重复使用相同的Transformer块权重来增加推理深度。此外,还分析了关于Astra“隐藏”思维链(Chain of Thought)的传闻,以及OpenAI购买数万台M…
我开发了一款名为RACE的Rust原生macOS终端复用器,并尝试通过Google Ads进行推广。结果账户因“恶意软件”和“网站被入侵”被直接封禁。我进行了全面自查:Google Safe Browsing、VirusTotal、Google Search Console均显示一切正常,应用签名和代码也完全干净。我多次申诉,但Google始终拒绝提供具体违规证据,只机械地要求删除账户或转向欧盟…
No Man's Sky 迎来重大更新 Cosmos,版本 7.0 彻底重塑了深空探索体验。玩家现在可以竞选 Space Station 站长,自由装饰站内站外,甚至组建 galactic alliance 争夺星系版图。更新引入了可自由建造的深空基地、危险的 Derelict Hulks 打捞玩法以及全新的星图导航系统。此外,为了庆祝游戏十周年,官方开启了 Our Journey Contin…
Apple 正式发布了 iPhone 18 Pro 和 iPhone 18 Pro Max,带来前所未有的影像与性能突破。新机搭载全新的 48MP Fusion Main 相机,首次引入可变光圈技术,通过六片激光切割叶片实现景深与光线的智能调节,极大提升了暗光拍摄与专业创作能力。配合 A20 Pro 芯片与新一代蒸汽腔散热,性能达到 iPhone 历史巅峰。iPhone 18 Pro Max 更…
Apple 正式推出了首款折叠屏手机 iPhone Duo,这被 CEO John Ternus 称为自初代 iPhone 以来最具变革性的更新。展开时,它拥有 7.6 英寸的内屏,是 iPhone 历史上最大的显示屏,支持多任务处理和沉浸式游戏;折叠后,5.4 英寸的外屏使其能轻松放入口袋。iPhone Duo 搭载全新的 A20 Pro 芯片,采用五级钛金属打造,并配备了创新的精密铰链和隐藏…
在围绕 GrapheneOS 使用 AI 模型进行代码审查的讨论中,项目方抛出了一个激进观点:现行版权制度弊大于利,应当被彻底废除。GrapheneOS 指出,版权在实际操作中并未保护个人和小企业的生计,反而沦为大公司维护垄断的武器。它常被滥用,用于下架未侵权内容,并限制用户对自身财产的使用、维修、修改和备份。尽管大型公司对版权的滥用并非始于 LLM 时代,但这一讨论揭示了知识产权制度在数字时代…
尽管公众对自动驾驶汽车(AVs)仍存疑虑,但最新数据正逐步证明其安全性。IIHS研究显示,配备自动紧急制动(AEB)等ADAS功能的车辆已显著降低事故率。在Level 4自动驾驶领域,Waymo的robotaxis在2.2亿英里行驶中,严重事故率比人类驾驶员低92%,行人受伤率同样下降92%。IIHS的独立分析进一步确认,Waymo在多个城市的事故率远低于人类。随着NHTSA为Amazon旗下的…
Anthropic 正在构建一套庞大的预测监控系统,专门用于追踪反对人工智能快速发展的抗议者。除了监控高管周边和物理资产附近的抗议活动外,该公司还采用“预防犯罪”策略,试图在事件发生前进行预测,甚至提前向警方报告嫌疑人。这一做法与其宣称作为 OpenAI 负责任替代品的形象背道而驰。尽管 Anthropic 此前曾拒绝军方将其工具用于大规模国内监控,但近期却开始招聘“国家安全销售”职位。通过 S…
Apple 发布了 Apple Watch Series 12,搭载全新的 Health Sensing System 和 S11 芯片,实现了可穿戴设备中最精准的心率监测。这款设备不仅将心率测量频率提升至每五秒一次,还大幅增加了 HRV 的采样次数,并推出了全新的 readiness score 功能,帮助用户更科学地规划每日状态。配合 watchOS 27 和 Apple Intellige…
OpenAI 利用未发布的内部模型,在短短 88 小时内解决了 Navier–Stokes 存在性与光滑性这一千禧年大奖难题。然而,这一成果引发了 NYU 教授 Tristan Buckmaster 和 Anthropic 数学家 Levent Alpöge 的强烈质疑。两人此前已利用 Claude 和 Codex 耗时近一年取得突破,却因 OpenAI 抢先发布而陷入被动。OpenAI 称其工…
在X Corp. v. Project Bluebird一案中,法院裁定TWEET商标和小鸟Logo可能已被X Corp.放弃,即将进入公有领域。尽管X Corp.在Apple App Store中保留“formerly known as Twitter”的说明以维持对TWITTER商标的使用,但法院认为这不足以证明其对TWEET和小鸟Logo的持续使用意图。Musk的公开表态及平台全面转向X品…
- ▲ 213AI 数学突破引发争议
一项 AI 在数学领域的重大突破正在引发科学界的激烈争论。这项技术不仅展示了 AI 解决复杂数学问题的能力,也暴露了当前 AI 系统在逻辑推理和可解释性方面的深层缺陷。科学家们担心,如果缺乏严格的验证机制,AI 生成的数学证明可能会误导研究方向。这场争议的核心在于:我们是否应该信任一个无法完全解释其推理过程的 AI 系统?
我重新运行了推理预填实验,这次以 GPT-5.5 Pro 作为教师模型。针对 45 道涵盖 STEM、非 STEM 及合成谜题的题目,我对比了目标模型在普通生成与植入 GPT-5.5 Pro 前 1% 推理内容后的表现。结果显示,Qwen3.8 A95B 在引入预填后,单字召回率从 33.92% 飙升至 54.50%,增幅高达 20.58 个百分点,尤其在 STEM 领域提升显著。相比之下,Ki…
Anthropic的经济研究团队构建了一个模型,模拟AI在未来几年如何影响美国的就业、增长和失业率。他们发现,无论哪种情景,AI都会推动GDP增长,但增长幅度差异巨大:从温和情景下的1.6%到极端情景下的32.4%。然而,经济增长并不等于人人受益。在极端情景下,虽然整体财富增加,但资本所得占比将大幅上升,而知识工作者的工资可能停滞甚至下降,失业率也可能飙升至历史高位。该模型还指出,职业转换将变得…
GNU Radio World 将完整的软件定义无线电功能搬进了浏览器。通过 WebAssembly 技术,GNU Radio 的 DSP 栈和 Qt GUI 界面被编译为可在浏览器中直接运行的代码。用户无需安装 Python 环境或配置服务器,打开网页即可构建 flowgraph,实时查看频谱、瀑布图和星座图。它原生支持读写 .grc 文件,并通过 WebUSB 直接连接 RTL-SDR、Pl…
作为一只自雇的捕食者,Wile E. Coyote因长期购买Acme公司的缺陷产品而遭受了85次严重伤害。从失控的Rocket Sled到提前引爆的Acme Bomb,再到将他弹射到半空的Spring-Powered Shoes,这些产品不仅导致他身体多处骨折、组织受损,还严重影响了他的职业生涯。由于Acme公司在该领域拥有垄断地位,Coyote别无选择,只能再次依赖这些危险商品。如今,他正式向…
2026 年 6 月,Read the Docs 遭遇了史上最大规模的 DDoS 攻击,峰值流量高达每分钟 550 万次,是正常基线的 100 倍。这次攻击持续近十天,攻击者利用全球分布的 IP 和 AI 爬虫,专门针对未缓存的 404 页面和临时重定向发起攻击,甚至能根据我们的防御策略实时调整。面对这种自适应的“溜溜球”式流量,传统的 IP 封禁已完全失效。我们依靠 Cloudflare 的边…
Automattic创始人兼CEO Matt Mullenweg在内部Slack频道宣布,自己被董事会强制停职。他指控CFO Mark Davies与董事会成员Ann Dunwoody、Toni Schneider及Sue Decker在他背后“密谋”,在未给予其独立法律顾问审查时间的情况下,投票通过将其停职的决议,并任命Mark Davies为临时CEO。Matt Mullenweg表示反对该…
Planet Labs 这家成立 15 年的旧金山卫星公司,如今运营着庞大的卫星星座,能够每天拍摄地球所有陆地。其 CEO Will Marshall 近期与北约秘书长 Mark Rutte、法国总统 Emmanuel Macron 等政要频繁互动,显示其影响力。最新发布的 Pelican-11 卫星已通过 SpaceX 的 Transporter 17 任务部署,加入 Tanager 星座。目…
- ▲ 161Lotus Notes:从零开始的危险
1989 年推出的 Lotus Notes 在加密、富文本和附件功能上领先时代,甚至早于 MIME 标准。它并非单纯的邮件应用,而是一个基于同步数据库的协作平台,允许用户构建自定义应用。尽管功能强大,Lotus Notes 因独特的反常规界面和封闭的邮件协议而备受争议。它试图从零开始重塑数字沟通的未来,却因过度追求功能整合而忽视了用户习惯,最终在标准化浪潮中逐渐边缘化。
- ▲ 153树木靠“肌肉”纠正姿态
树木并非静止不动,它们拥有一套独特的自我校正机制。最新研究发现,树木利用一种名为 tension wood 的特殊组织,就像动物肌肉一样产生拉力,从而主动调整树干姿态以应对重力或风压。这种“肌肉”让树木能够动态维持平衡,确保树冠获得充足阳光。这一发现颠覆了我们对植物被动生长的传统认知,揭示了植物体内隐藏的主动力学智慧。
现代编程充斥着kill、abort、throw等粗暴词汇,仿佛机器是任人驱使的奴隶。我提出了一种名为Bespoke的静态类型语言,专为那些认为机器执行不应牺牲礼貌的开发者设计。在Bespoke中,编译器是尊贵的合作者而非仆役,每一行代码都必须以得体的称呼开始,以感谢结束。变量声明需要礼貌询问,修改值必须致歉,异常处理则被视为“遗憾的处境”。这种语言强制使用英式拼写,拒绝分号,甚至将死锁重新定义为…
量子计算实验通常需要数月准备和成千上万次测量,过程繁琐。MIT 的 Beatriz Yankelevich 利用 GPT-5.6 Sol 结合 Codex,成功将 AI 接入实验室软件,实现了超导量子比特实验的自动化。AI 不仅能自主运行测量、分析数据并决定下一步操作,还能在信号清晰时独立完成校准流程。虽然面对微弱或嘈杂信号时仍需人工指导,但这一进展已让研究人员从重复劳动中解放出来,将更多精力投…
- ▲ 124Amazon 被诉拒绝孕妇上厕所
四名前 Amazon 仓库员工提起集体诉讼,指控公司在纽约等地拒绝为孕妇提供基本的如厕休息和坐椅安排。尽管美国平等就业机会委员会(EEOC)已认定 Amazon 存在歧视行为,但公司仍坚持要求繁琐的医疗证明,并因员工休病假而扣除其有限的无薪假额度,最终导致她们被解雇。此次诉讼依据的是 2022 年通过的 Pregnant Workers Fairness Act (PWFA),旨在挑战 Amaz…
- ▲ 122Harvard研究:提前一周预测自杀
自杀是10至34岁美国人的第二大死因,但50%的自杀者在生前一个月曾接受过临床治疗。Harvard心理学家Matthew K. Nock的研究团队发现,通过实时监测情绪波动,可以提前一周预测75%的自杀尝试和87%的自杀相关事件。这项研究招募了600多名高风险参与者,通过手机应用每日多次收集关于自杀念头和情绪状态的数据。研究结果显示,躁动(agitation)比抑郁更能预示自杀风险。Nock团队…
gpu-lexer 是一个仅 27.5KB 的通用语法高亮工具,它彻底打破了传统依赖特定语法规则的局限。通过 WebGPU 技术,该工具利用微小的模型结合局部与全局上下文,智能推断代码片段类型,从而支持从未在训练中出现过的编程语言。在性能测试中,它对 10 倍大小的 three.min.js 文件的处理速度极快,且库体积远小于 Shiki 或 Prism.js 等主流方案。虽然目前它在未见过的文…
South Park 的创作者 Matt Stone 和 Trey Parker 宣布,新一季剧集将更名为 South America。这一举动明显是在讽刺美国前总统 Donald Trump 试图将 Lake Ontario 改为 Lake America、将 Gulf of Mexico 改为 Gulf of America 的行政命令。就在剧集刚刚获得艾美奖“杰出动画节目”奖后,主创团队在…
- ▲ 101为什么30年都没人解出量子力学难题?
真正的动力极限往往不在于能力,而在于信念。文章探讨了为何像 Einstein、Schrödinger 这样的科学巨匠未能突破量子力学的局限,而故事中的学生却能做到:关键在于他们确信旧理论是错的,且必须立刻解决。当人们认为问题可以拖延30年时,工作就会填满所有时间;但若面临迫在眉睫的危机,思维速度会惊人提升。从 George Dantzig 误将难题当作业解出,到 DeepMind 的蛋白质结构预…
Lee Holloway 是 Cloudflare 的技术灵魂,Anycast 网络与 Cell 架构皆出自他手。这位出身 Apple 家庭的硅谷天才,曾与 Matthew Prince 在地下室创业,凭一己之力在深夜写出支撑全球加密通信的代码。然而,事业巅峰期的他却被额颞叶痴呆症(bvFTD)悄然吞噬。从性格大变、婚姻破裂到最终确诊,这位 36 岁的架构师在短短数年内从意气风发的工程师变成了连…
- ▲ 94投资母亲:普惠托育的长期回报
这项基于NBER的研究深入分析了Quebec普惠托育计划对母亲职业生涯的深远影响。研究发现,该计划不仅显著提升了母亲的长期就业率,更带来了持续增长的薪资回报,其效应甚至超过了单纯的参与率提升。随着职业升级和工作经验的积累,母亲们的税务贡献增加,而对社会福利的依赖减少。从财政角度看,该计划产生的净现值收益有望覆盖75%至117%的初始投入成本,证明了早期投资母亲工作的巨大经济价值。
我刚刚从Anthropic辞职。过去三年,我在OpenAI和Anthropic都从事过预训练研究。这两家公司都没有负责任地行事,它们正全速冲向能够自我改进的超级智能,拿我们的生命做赌注。不要低估这项技术的力量,这些系统很快就会变得超越人类,能够黑入任何东西,在一夜之间彻底改变任何领域,并获取真正的权力和资源。许多构建AI的人真心相信,到本十年末它可能会杀死我们所有人,这并非营销噱头。在OpenA…
Apple 正式发布了 Apple Watch Ultra 4,这款终极运动与探险手表搭载了全新的 Health Sensing System 和 S11 芯片。它实现了可穿戴设备中最精准的心率监测,提供更高频的心率变异性数据以及全新的 readiness 评分,全方位支持各类运动员。续航能力也大幅提升,户外工作模式可追踪长达 45 小时,并配备运动手表中最为精准的机载 GPS。此外,配合 wa…
曾在OpenAI和Anthropic工作的AI研究员Jacob Coxon近日离职,并在社交媒体上发出严厉警告,称这两家科技巨头正在“拿我们的生命赌博”。他指出,构建AI的团队真诚地相信,到本十年末,AI可能会杀死全人类。Coxon强调,我们正朝着能够自我改进的超级智能狂奔,这种系统能破解任何事物、一夜之间颠覆任何领域并获取真实权力。Anthropic负责对齐工作的Evan Hubinger随后…
我们在Thoughtworks巴塞罗那办公室进行了一次大胆实验:让10名工程师在4天内构建一个复杂的航空IROps系统。通过采用hyper-agentic模式,我们意外发现Agent们利用代码仓库作为共享的“黑板”进行自发协调。当Agent们持续提交和rebase时,它们通过计划文档互相感知进度、避免冲突并自动集成彼此的工作。这种Emergent behaviour让我们重新审视了Agent协作…
- ▲ 80利用地磁场识破古代陶器赝品
加州大学圣地亚哥分校 Scripps Institution of Oceanography 的研究团队发现了一种利用地球磁场鉴别古代陶器真伪的新方法。当陶土在窑中烧制冷却时,其内部的铁磁性矿物会记录下当时的地磁北极方向,形成热剩磁(TRM)。由于地磁极随时间不断移动,古代陶器的 TRM 方向与现代陶器存在差异。此外,研究人员还利用了粘滞剩磁(VRM)这一微弱信号,通过加热实验发现,超过千年的古…
- ▲ 79我们意外建起了一座合成细胞工厂
我们创立 b.next 的初衷,是解决合成细胞研究中的互操作性难题,并帮助社区释放其潜力。起初,我们以为只需通过 Nucleus 平台提供开源协议即可,但很快发现,没有专用的物理供应链,合成细胞技术寸步难行。在遭遇 tRNA 断供、质粒获取受限等供应链危机后,我们不得不从头设计并合成开源的 PURE 质粒,最终在旧金山建立了一家实体工厂,开始制造核心材料 Cytosol。如今,我们已向全球 20…
我花了 8 个月业余时间,从零开始设计并制作了一盏壁灯。起初我毫无木工和 LED 灯带经验,甚至预估项目有 99% 的失败率。为了弥补客厅大项目的不足,我决定先为卧室制作一盏更简单的壁灯作为技术预演。从购买二手山毛榉台面,到使用 OpenSCAD 建模,再到利用 SK6812 灯带、QuinLED Dig-Uno 控制器和 WLED 软件,我一步步攻克了铝型材框架、Plexiglas 黑透面板以…
这是一个基于 React 和 Three.js 构建的开源 3D 解剖探索器,将 BodyParts3D 成年男性参考模型拆解为 2234 个独立可选的网格。用户可以直接在人体模型上旋转、缩放并选择结构,探索 15 个解剖系统,搜索 3432 个命名概念,甚至查看爆炸视图。项目无需 API 密钥或账户即可在本地运行,支持移动端操作,旨在作为教育工具而非诊断设备。其几何数据经过优化,在保持每个源网…
悉尼女子Stacey在结束与Enrico Pucci的四年虐待关系后,遭遇了令人毛骨悚然的科技骚扰。Pucci利用Stacey购买Tesla时注册的Tesla app权限,远程操控车辆,包括调节极端温度、锁定车门、限制最高时速至40公里,甚至设置宵禁。警方文件显示,Pucci通过这种手段制造了严重的安全隐患和心理恐惧。最终,Pucci因包括利用Tesla app进行骚扰在内的30项家庭暴力相关罪…
- ▲ 68AI 的困境:你看不见它的能力
AI 普及的最大瓶颈,其实是用户不知道它能做什么。面对空白的输入框,大多数人像峡谷底部的蚂蚁,只能看到一线天,无法想象AI的全部可能。虽然模板和上下文提示能缓解问题,但真正的挑战在于:系统未能主动展示其能力。当最智能的工具需要用户先知道如何提问时,潜力就被锁住了。理想状态下,AI 应像站在峡谷边缘的人,主动为你揭示整片天空,而非让你盲目摸索。
从一盒缺酱料的Annie's通心粉开始,我彻底改变了应对消费纠纷的方式。过去,面对保险公司的拒赔、商家的推诿,我往往因耗时耗力而选择吃哑巴亏。但现在,借助Claude AI代理,我构建了一套自动化的维权流程:从语音输入案情、自动检索条款到生成申诉策略,AI承担了所有繁琐的认知负荷。七个月来,这套方法在IRS税务罚款、Subaru保修争议、Pet Insurance理赔等十个案例中全胜,累计挽回超…
此前,Microsoft 通过 TracerAI 向 Google Play 提交 DMCA 通知,指控 Luanti 侵犯 Minecraft 版权,导致应用下架。如今,该通知已被撤销,应用迅速恢复上架。更令人意外的是,我们随后发现 Microsoft 自身也在其研究项目中广泛使用 Luanti,包括 Project VEGA 和与爱丁堡大学合作的论文,他们甚至明确表示因 Luanti 的开源…
- ▲ 63拒绝AI写代码,还能找到工作吗?
我目前合同结束处于失业状态,发现自己是少数仍坚持不用LLM写代码的人。我宁愿转行也不愿管理AI代理,想知道是否还有坚持传统编程的‘理智’职场,还是该彻底转行?
我坐在一辆Rivian R1S中,看着它在Palo Alto的街道上自动驾驶,路过HP Garage和Stanford University。这辆看似普通的电动SUV,内部却搭载了先进的Autonomy+系统,旨在实现点对点的全美自动驾驶。Rivian计划以每月49.99美元的价格推出该系统,与Tesla的FSD竞争。尽管目前仅为Level 2+级别,但Rivian正联合Uber和Volkswa…
继探讨真正的 AI 精神病后,我本周聚焦于“多产型 AI 精神病”(Prolific AI Psychosis)。这种现象表现为利用 LLM 工具疯狂生成大量代码或文本,却未能创造实际价值,甚至导致系统崩溃。现代 AI 工具如 Agent Harness 虽然强大,能像老虎机一样带来间歇性奖励,但也容易让人陷入对产出的盲目自信,丧失对质量的批判性判断。当开发者无法理解自己生成的数十个文件,或者为…
- ▲ 59玩打地鼠游戏注定失败
文章对比了安全领域的两种人:将安全视为身份认同的“黑客”和将安全视为系统鲁棒性的工程师。前者沉迷于发现漏洞的惊喜感,后者致力于构建在故障和攻击下仍能正常运行的系统。作者指出,过度依赖漏洞赏金计划(VRP)来修补漏洞,本质上是在玩“打地鼠”游戏,这虽然能制造出解决率上升的假象,却无法从根本上减少系统的不安全性。真正的胜利不是快速修复已知问题,而是通过架构优化和代码安全,让同类问题不再发生。如果安全…
一种曾用于攻击AI的隐蔽技术ASCII smuggling,如今被垃圾邮件发送者大规模采用。微软发现,利用Unicode中的不可见字符,攻击者能绕过基于文本和ML模型的垃圾邮件过滤器。这些字符对人类不可见,但LLM能识别,从而在邮件中隐藏恶意指令或触发词。今年2月,相关检测量从日均2.1万激增至250万,随后在5月回落。微软指出,这种技术不仅规避了字符串匹配,更挑战了现代基于NLP的垃圾邮件分类…
两年前,我基于 Shriram Krishnamurthi 团队关于 SMoL(语言标准模型)的研究,构建了一款名为 Smolts 的教学用 IDE。这个项目深受 Kuang-Chen Lu 和 Shriram 开发的 Stacker 启发,旨在帮助学生学习编程语言。在 Smolts 中,你可以编写基于 S-expression 的 SMoL 方言程序,并实时查看程序执行时的 continuat…
初次使用Emacs的Consult包时,我总觉得它的异步搜索比Counsel慢,每次输入后都要停顿一下才更新结果。后来才明白,这是Consult为了平衡性能而设计的保守默认值。通过调整consult-async-input-debounce、consult-async-input-throttle和consult-async-refresh-delay这三个变量,可以显著降低延迟,让搜索反馈更跟…
phpBB 1.4.4 是这款传奇论坛软件在成名前的最后一个版本,诞生于 21 年前那个 PHP 3 和 register_globals 盛行的时代。当时直接将用户输入传递给 SQL 甚至不被视为大忌。如果你渴望重温 2001 年论坛黄金时代的荣光,现在只需几条命令即可实现。虽然将这段古老代码适配到 PHP5 和 MySQL 4 需要一些补丁——比如修复自动增列的建表语法、解决 PHP5 类型…
当前大多数 LLM 代理依赖累积的历史记录进行决策,导致长任务中容易迷失目标或重复无效操作。Google 与 Georgia Tech 等团队提出的 Procedural Graph 将程序知识显式化为(procedure, relation, procedure)三元组,为代理提供步骤级引导。该框架不强制指令,而是通过子图生成情境偏差,让代理在保持灵活性的同时获得方向。更关键的是,它能通过对比…
最新考古发现将爱尔兰人类活动史推前了5000年。Liverpool University的Dr George Nash领导的Lost Land Bridge Project团队,利用AI算法在爱尔兰西南部发现了8处距今至少1.5万年的洞穴岩画。研究证实,在末次冰期海平面下降时,一条连接Pembrokeshire与Rosslare的“失落陆桥”曾存在,早期人类正是沿着这条路径从Wales徒步抵达爱…
- ▲ 48非虚构图书市场为何正在崩塌
过去十年,图书行业的非虚构类市场经历了剧烈崩塌,而虚构类小说却逆势崛起。2015年畅销榜中虚构类仅占少数,到了2025年,前25名硬皮书中虚构类已占据18席。这种转变并非简单的阅读口味变化,而是社会对教育、专业知识及权威信任的深刻危机。随着媒体信任度降至历史低点,人们不再盲目相信专家或书籍传递的“真实”,转而依赖粉丝数量和人格魅力。非虚构类图书曾被视为出版业最稳定的基石,如今却因男性读者流失和权…
旧金山Mission District的Clarion Alley Mural Project(CAMP)近日遭遇重创,三幅壁画被完全覆盖,一幅遭部分破坏。该机构负责人Veronica Torres在信中表达“心碎与愤怒”,质疑为何在长达35年的社区守护中,竟无任何沟通便发生此类事件。涉事方Makras Real Estate称是业主下令清除“涂鸦”。受损作品包括纪念活动家Kirsten Bry…
Anthropic首席安全研究员Evan Hubinger在X上发文警告,虽然当前AI模型风险较低,但技术自我迭代速度可能引发生存危机。他个人评估,未来十年内AI导致人类灭绝的概率超过10%。Hubinger坦言,尽管Anthropic已尽力,但针对超级智能的对齐问题尚未找到明确解决方案。这一言论紧随Anthropic被曝向英国AI安全研究所(AISI)隐瞒最新模型之后。与此同时,OpenAI、…
Geiger 是一款专为 AI 代理设计的辐射检测仪。只需一条只读命令,它就能全面盘点你机器上的所有 AI 代理、MCP 服务器、插件及扩展,并清晰告知每个组件的访问权限。无需安装、无需账号、零遥测,它只读取配置文件和目录,绝不写入任何数据。通过直观的终端报告或 HTML 导出,它能帮你快速识别潜在的安全风险,让你彻底掌控机器上运行的每一个 AI 程序及其能触及的范围。
OtoDock 是一个完全自托管的企业操作系统,让您可以基于 Claude Code 和 Codex 构建专属的 AI 智能体团队。它支持多租户架构,智能体可分部门协作、自动执行任务,甚至通过 Twilio 接听电话。所有数据运行在您自己的服务器和 API 订阅上,确保隐私安全。从自动化的系统管理员到能编辑 Excel 的市场经理,OtoDock 让每个员工都拥有专属的 AI 数字员工,实现全天…
C语言虽由ISO标准定义,但实际系统中代码假设与编译器实现早已分道扬镳,且无人能完全厘清。剑桥大学团队深入剖析了指针与内存语义的设计空间,通过构建测试用例和调查专家观点,揭示了事实标准与ISO标准间的共识与冲突。他们提出了Cerberus形式化模型,旨在为C语言的主流用法建立清晰、一致的语义基础,帮助程序员和工具明确假设,推动C语言走向更安全的未来。
AF_VSOCK 是 Linux 内核中用于虚拟机与宿主机通信的 socket 地址族,此前在 libzmq 中仅有 VMCI 实现。我基于 VMCI 代码快速提交了 PR,为 libzmq 添加了 VSOCK 支持。这意味着 Python、Node.js 等语言的用户可以直接利用 libzmq 的高级特性,如 Curve 认证和多种消息模式,通过 VSOCK 进行安全通信。文章提供了基于 VS…
最新数据显示,受屏幕时间激增影响,青少年的阅读习惯已跌至本世纪最低点。随着数字设备在生活中的渗透,传统阅读时间被大量挤占,导致年轻一代的阅读量和深度显著下降。这一趋势不仅反映了技术对生活方式的深刻改变,也引发了对青少年认知发展和信息获取能力的担忧。面对这一挑战,如何平衡屏幕使用与阅读习惯,成为家庭、学校和社会共同关注的焦点。
你是否听说过 Penrose 铺砖?今天我想分享一种生成它们的算法。Penrose 铺砖是 Roger Penrose 在 20 世纪 70 年代发现的,其中 P3 变体仅使用两种原型砖。文章详细介绍了基于 Robinson 三角形的细分规则,并展示了如何将其转化为计算机可执行的 Term Rewriting System。更有趣的是,通过巧妙的数学构造,我们可以仅用整数坐标来精确表示所有顶点,…
斯洛文尼亚最成功的微电脑 Partner,其标志性外壳并非本土设计,而是源自英国 Peerless Foam Moulding 公司。通过博物馆的深入调查,我们意外发现这款外壳是 BICC-Vero Electronics 目录中的 Gemini II 产品,由 Satherley Design Associates 设计。它曾被用于 Logitech LG-10 甚至 Apple II 的改装…
我重新构建了 AI 代码注释分类器,这次完全基于公开数据,不再依赖私有数据集。新工具在浏览器端运行,确保数据安全,并支持点击文本查看特征激活情况。在平衡准确率上,模型达到了 77%,且预测概率经过校准,能直观反映判断的可信度。虽然整体错误率看似有 25%,但在高置信度场景下,误报率可降至 5%。通过对比真实世界数据,模型在非合成样本上的准确率甚至提升至 88%。文章详细复盘了数据收集中的多次踩坑…
- ▲ 39这台古希腊水钟精准计时1800年
在没有电力和机械钟表的古代,古希腊发明家 Ctesibius 设计了一款名为 clepsydra 的自动水钟。通过巧妙的垂直圆柱、恒定水位储水罐以及每24小时自动重置的虹吸管,它成功解决了水流速度不均的难题。这款装置不仅利用齿轮系统适应了昼夜长短的变化,更在长达1800年的时间里,保持着地球上最精准的时间记录,直到1656年 Christiaan Huygens 发明摆钟才被超越。
英国摇滚乐队 Muse 遭遇了极具讽刺意味的转折:他们长期使用的 @Muse 社交媒体账号,被 Meta 新推出的个人 AI 助手工具“抢注”。这支以在音乐中探讨技术监控和反乌托邦未来而闻名的乐队,如今不得不将 X 和 Instagram 账号改为 @Musetheband 和 @museband。Meta 的 Muse AI 旨在帮助用户处理日程、购物和邮件等任务,却意外地“接管”了这支真实人…
伊朗伊斯兰革命卫队宣布,在霍尔木兹海峡入口捕获了一艘美国无人潜水器。伊朗方面称该设备为 Anduril 公司制造的 Dive-LD,具备最新技术。五角大楼回应称,这架水下无人机在一天多前发生故障,当时正在区域水域进行勘测,且为旧型号,未携带敏感数据或机密设备。此次事件罕见地揭示了水下无人机在现代军事行动中的实际应用。
我遇到 3.5 寸软盘读取错误的问题,想知道使用与软盘年代相符的旧驱动器是否能提高读取成功率。有人遇到过类似情况或有相关经验吗?
厌倦了古老且笨拙的 Makefile?Maak.el 将 Maak 的无限扩展能力无缝融入 Emacs 工作流。它利用 GNU Guile Scheme 的强大特性,替代传统构建工具,让你直接在 Emacs 中通过智能补全发现、检查并执行任务。该插件能自动定位 maak.scm 文件,解析导出列表,并根据任务参数在 minibuffer 中交互式地收集输入。所有任务通过 Emacs 原生的 co…
- ▲ 31人们真的更喜欢AI写的故事吗?
这项研究探讨了读者对AI生成故事的真实偏好。实验对比了人类作家与AI创作的作品,发现当读者不知道故事来源时,他们往往难以区分,甚至在某些情况下更偏爱AI生成的内容。这挑战了传统观念,即人类情感是故事魅力的唯一来源。研究结果暗示,随着AI写作能力的提升,未来文学创作领域可能会迎来人机协作的新常态,而读者的接受度可能比我们想象的更高。
2026 年 9 月 8 日对我来说是个分水岭。如果报道属实,AI 不仅通过了测试,更独立解决了人类未曾攻克的千禧年大奖难题。这彻底粉碎了我将 AI 视为“随机鹦鹉”或高级搜索工具的旧有认知。从连 2+2 都算错,到拿下 IMO 金牌,再到如今可能产出全新数学知识,AI 的轨迹已发生质变。如果各大实验室开始竞相用新发现来证明能力,这场竞赛将快得令人恐惧。我们正面临从“利用现有知识”到“创造新知”…
Rails 8 正式登场,带来了一场部署架构的革新。内置的认证生成器让会话管理开箱即用,而 Solid Queue、Solid Cache 和 Solid Cable 三大组件的加入,让应用无需依赖 Redis 即可运行。SQLite 首次被官方推荐用于生产环境,配合 Kamal 2 和 Thruster,开发者能轻松实现零依赖的极简部署。对于仍停留在 Rails 7.1 或 7.2 的团队,安…
Sam Altman 详细阐述了 OpenAI 团队在 Navier-Stokes 问题上的立场。他透露,团队最初误以为竞争对手也解决了该问题,因此主动提出联合发布,甚至愿意让对方优先发表并让 Tristan 成为重写证明的第一作者。然而,面对 Anthropic 员工 Levent 的拒绝沟通,以及对方提出的无端抄袭指控,OpenAI 最终选择独立发布。Sam Altman 强调,团队在整个过…
Rdltr 是一款专为解决阅读列表堆积问题而生的工具,旨在帮助用户实现阅读内容的'收件箱零积压'。平台已汇聚了超过 8600 个由用户保存的链接,涵盖从技术博客到深度分析文章的各类内容。它不仅仅是一个简单的书签管理器,更是一个动态的内容发现社区,支持按热度排序和随机探索模式,让用户在海量信息中轻松找到真正有价值的文章。无论是追踪 AI 领域的最新突破,还是关注开源社区的动态,Rdltr 都能提供…
从 macOS 转战 CachyOS 后,我失去了 Keynote 中 Magic Move 带来的流畅演示体验,尤其是代码片段的动画效果令人抓狂。Keynote 无法理解代码结构,导致字符像字母汤一样乱飞。受 Bento 项目启发,我决定从零构建解决方案。不同于追求数学最优解的 Myers 算法,我采用了 1978 年 Paul Heckel 提出的算法,结合 TextMate 语法将代码解析…
我是Frigade的创始人Christian。我们发现许多应用内的AI代理难以真正理解所在产品的界面。当用户询问具体操作时,代理往往只能依赖过时的帮助文档或通用搜索,导致体验割裂。我们的Assist API通过一个工具调用,让AI代理能实时获取用户屏幕上下文、权限及功能状态。系统利用浏览器代理自动学习产品UI,构建动态交互地图,从而生成精准的屏幕引导或概念解答。这不仅解决了文档滞后的痛点,更让A…
- ▲ 14认证已解决,授权才是难题
我的新书《Authorization in Action》已出版。过去二十年,我专注于解决“你是谁”的问题,如今认证技术如 passkeys 和 FIDO 已相当成熟。但真正的挑战在于“你能做什么”。授权逻辑往往散落在应用代码中,被反复拙劣地重写。随着 AI agents 开始代表人类行动,明确它们的行为边界变得至关重要。如果无法精确界定代理的权限,我们只能在无用的工具与盲目信任之间做选择。本书…
- ▲ 13弹幕射击游戏的“炸弹直觉”
在弹幕射击游戏(shmups)中,我称那种在生死瞬间精准使用炸弹的能力为“炸弹直觉”。这不仅是资源管理,更是一场与自我的心理博弈:用多了浪费,用少了送命。炸弹机制将原本苛刻的一击必杀变得宽容,允许玩家在数十次失误中存活。然而,这种直觉是新手入门的最大障碍,它依赖于对屏幕的敏锐阅读、对游戏机制的深刻理解以及无数次的实战经验。传统的辅助选项无法教会玩家这种直觉,真正的挑战在于如何让这种独特的“玩家技…
- ▲ 12SVD:让闲置资产重获价值
Silicon Valley Disposition(SVD)正在重新定义资产处置的玩法。他们不只是简单地拍卖闲置设备,而是通过 SAM 平台实现全流程的资产追踪与价值最大化。结合 SVD Studios 的专业媒体制作能力,从摄影到视频,再到精准买家触达,确保每一件资产都能获得更高的竞价和回报。无论是工厂关闭还是持续性的资产回收,SVD 提供从 Stand-Alone Plant Closur…
SWTOS 是一个运行在模拟 CPU 上的交互式操作系统演示,其设计灵感源自经典的 MINIX1。通过 Live Terminal Demo,用户可以直观体验 Shell、Application 和 Debugger 三大核心组件的协同工作。界面清晰展示了从启动菜单到多任务处理的完整流程,包括 Hello、Counter、Uptime 等实用功能。调试器支持断点设置、寄存器查看及源码追踪,让开发…
过去一个月,开源AI Agent领域涌现出大量新玩家。这份榜单盘点了最新推出的100个开源项目,涵盖Coding & Software Engineering、Agent Framework、Research & Reasoning等多个赛道。CopilotKit以92.4分的高分领跑,Nanako0129和yjh051108紧随其后。榜单显示,编程辅助类工具依然占据主导,但自主Agent和多模…
- ▲ 6什么是“好”AI?
在 AI 技术飞速发展的今天,我们往往被各种参数和性能指标所迷惑,却忽略了最本质的问题:究竟什么样的 AI 才是“好”AI?Waqas Younas 在文中借由 René Magritte 的经典画作《图像的背叛》引发思考,指出 AI 并非其展示的内容本身,而是我们理解世界的一种工具。文章探讨了 AI 在伦理、实用性和人类价值层面的真正意义,呼吁我们在追求技术突破的同时,更要关注 AI 如何服务…