LLM 能否在 45 次查询中识别 16 张牌?

Can LLMs identify 16 cards in 45 bit-queries?

我尝试用 LLM 解决一个未决的数学组合问题:在 16 张洗牌后的卡片中,通过最少次数的二元属性查询来还原完整排列。理论下限是 45 次查询,而传统暴力策略需要 64 次。我在单台 MacBook 上构建了一个 LLM 代理,让它自主提出策略、编写代码并验证结果,经过 50 次迭代逐步逼近最优解。这个过程不仅探索了 LLM 在数学推理中的潜力,也揭示了在资源受限条件下,智能体如何通过自适应策略解决复杂问题。

看着 LLM 解决那些尚未被攻克(且真正困难)的问题,同时知道它们的能力源于本质上出奇简单的机制,这种喜悦和惊奇感是独特的。

同日更多故事

2026-07-28