Qwen3.8开源:2.4万亿参数模型首次公开

Qwen3.8-2.4T

Qwen3.8开源:2.4万亿参数模型首次公开

Qwen3.8系列正式发布,其中Qwen3.8-2.4T-A95B-FP8作为开源版本,首次将Qwen-Max级别的模型能力推向社区。该模型基于Qwen3.5架构升级,拥有2.4万亿总参数量,激活参数达950亿,原生支持26万上下文并可扩展至100万。在Coding Agent、SWE-bench Pro及PaperBench等多个基准测试中,Qwen3.8-Max展现了超越GPT-5.6 Sol和Claude Opus 4.8的竞争力,尤其在复杂多步骤任务执行和长程规划上表现突出。模型采用精细化的FP8量化技术,性能几乎无损,且完美兼容vLLM、SGLang等主流推理框架,为开发者提供了强大的本地部署选项。

Qwen3.8旨在更可靠地完成复杂的多步骤任务,而不仅仅是回答更难的问题。
  1. UncleOxidant

    大伙儿都在等两天后要发布的 3.8-27B 版本呢。

  2. WalterGR

    3 小时前提交,目前已有 63 条评论:https://news.ycombinator.com/item?id=49273478

  3. xlayn

    我好奇除了大实验室和那些超级大公司,还有谁能跑得起这个 2.6TB 的 q8 版本……

    毕竟那个 1 bit 的版本就有 508GB 了。

    假设在这么大的模型上 256k 上下文大小可以忽略不计,跑那个 1 bit 版本我得用 22 张 AMD 7900XTX(24GB 显存),而跑 2.6TB 的版本则需要 113 张。

    113 张显卡,假设负载接近恒定,且像我这台双卡机器那样轮流工作,功耗大概是 113 张 * 113W = 11KW……这仅仅是维持和运行这一个实例的功耗……至于散热需求,只有天知道了……

    我猜 Meta、Googly 或 Claudy 的某个人会说……哦不错,下载下来跑跑看……

    unsloth 那位大神是怎么处理这么大的文件的?

    https://huggingface.co/unsloth/Qwen3.8-2.4T-A95B-GGUF

同日更多故事

2026-08-12