你刷到一个数字,先别急着激动——2.4万亿参数、激活95B、千问史上首个开放权重的Max级模型,阿里2026年8月3日把Qwen3.8-Max端了出来。

它走的是稀疏MoE(混合专家)架构,总参数2.4万亿,每次推理只激活约950亿。上下文长度顶到1M tokens,硬件、显存、推理延迟这些事留给模型自己。定价是国际版每百万token输入2美元、输出6美元,对标Claude Opus 5只到对手的40%和24%。国内千问AI平台价格为每百万token输入12元、输出36元。
动手能力方面,官方甩出三个真实案例:模型从零搭建oh-my-cli项目,无人工介入跑16天,265次提交、127个PR、151个issue;复现一篇推理论文并自我迭代,连续工作125小时、7600行代码、33轮GPU训练,AIME24比原方法再涨2.7分;参加WWW2025多模态对话挑战赛,24小时内击败458支人类队伍。芯片设计任务里,500轮交互把硬件门数从8298压到678,物理面积从106×106微米缩到46×46微米,整体缩小81%。
基准上,PaperBench 93.0、IFBench 82.8、HealthBench 60.2、CoWorkBench 74.8、JobBench 53.4,多项超过Anthropic Fable 5和GPT-5.6 Sol;OSWorld-Verified 86.1、MLVU 90.8,多模态也不落下风。
说白了,这版千问终于把”长程自主”摆到台面上了,标杆不再是单点刷分,而是能不能从一个空文件夹干完一个真实项目。权重下周登陆Hugging Face和ModelScope,Qwen3.8-27B同步开源。能调用Codex、Claude Code、Qoder这些主流框架,国内直接上qianwenai.com。
我的判断是,国产大模型真正可用的临界点,不是榜单分数,而是这种”扔进去一个目标,干完十几个工作日”的工程闭环。等开源权重放出来,你会拿它跑什么?先想好怎么用。
来源:千问官方博客、凤凰网科技、IT之家