2026 年 8 月 3 日,阿里巴巴发布了新一代基座大模型 Qwen3.8。这次的看点不只是"又一个国产大模型":总参数量拉到 2.4 万亿(2.4T),是千问家族迄今最大的旗舰;第三方盲测榜单 Arena 上仅次于 Anthropic 的 Claude 系列;官方演示里它连续自主编程约 16 天、留下 265 次提交,从空文件夹搓出了一个可用的 Agent 框架。更关键的是,官方明确说 Qwen3.8-Max 下周开源——Max 级别的旗舰开源权重,这在以前是没有过的。
新闻谁都会转,这篇文章只解决一个实际问题:今天你怎么把它用起来,以及要花多少钱。下面三条路径,按需取用。
一、先搞清楚 Qwen3.8-Max 是什么
把关键规格摊在一张表里,方便判断它适不适合你的场景:
| 规格 | 数值 | 意味着什么 |
|---|---|---|
| 总参数量 | 2.4 万亿(MoE 稀疏架构) | 知识容量和复杂推理上限更高 |
| 激活参数 | 约 95B | 单次推理实际计算量可控,速度和成本不至于爆炸 |
| 上下文窗口 | 100 万 Token | 整本书、整个代码仓库可以一次性喂进去 |
| 输入模态 | 文本、图像、视频、文档 | 截图、PDF、视频内容都能直接分析 |
| 编程/办公 | 两大主打方向 | 官方与 QoderWork、MuleRun、悟空整合出了"千问办公" |
| 开源计划 | Qwen3.8-Max 与 Qwen3.8-27B 下周开源 | 可私有化部署,企业合规场景的硬需求 |
第三方榜单方面:Arena 综合榜仅次于 Claude 系列;Vision Arena 视觉榜全球第二;衡量电脑操作能力的 OSWorld-Verified 以 86.1 分居主流模型榜首。简单说,它目前处于全球第一梯队,尤其在 Agent 类任务上表现突出。
二、路径一:网页版,零成本先试水
最省事的方式是直接去千问的网页对话版,新模型已经接入。适合的场景:
- 快速验证它对你手里的真实任务到底行不行,比如把一段你正在写的代码、一份你头疼的需求文档丢给它;
- 体验 100 万 Token 上下文——上传一份几百页的 PDF 年报或产品手册,直接跨章节提问;
- 测试视觉能力:丢一张复杂的数据图表截图,让它解读并给出结论。
建议准备一个"基准题":拿一个你之前用其他模型做过、知道哪里容易翻车的任务,同样的提示词跑一遍,对比差异。十分钟就能判断值不值得为它接 API。
三、路径二:API 接入,五行代码跑起来
API 已上线千问 AI 平台(阿里云百炼 / DashScope 体系),并且兼容 OpenAI SDK,这对已经在用 OpenAI 或兼容接口的项目是好消息——基本上改两个值就能切过来。
第一步,在控制台开通服务并创建 API Key。第二步,用 OpenAI 兼容模式调用:
from openai import OpenAI
client = OpenAI(
api_key="你的 DashScope API Key",
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
resp = client.chat.completions.create(
model="qwen3.8-max", # 具体模型名以控制台列表为准
messages=[
{"role": "system", "content": "你是一名资深后端工程师,回答直接给可运行代码。"},
{"role": "user", "content": "用 Python 写一个带重试和超时控制的并发下载器。"},
],
)
print(resp.choices[0].message.content)
curl 党也可以直接验证:
curl -X POST "https://dashscope.aliyuncs.com/compatible-mode/v1/chat/completions" \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.8-max",
"messages": [{"role": "user", "content": "你好,用一句话介绍你自己"}]
}'
如果你之前照着本站那篇《大模型也开始限流了:给自己搭一套多模型备胎与自动切换方案》搭了多模型路由,把 Qwen3.8-Max 加进去就是一个新的 provider 配置项,顺手就有了一个国产旗舰备胎。
四、算一笔成本账
国内 API 定价(每百万 Token):
| 项目 | 价格 |
|---|---|
| 输入 | 12 元 |
| 输出 | 36 元 |
| 隐式缓存命中 | 1.5 元 |
国际定价大约是 Claude Opus 5 输入的 40%、输出的 24%——性能同一梯队,价格差出一个量级。
两个省钱要点:
- 长上下文任务吃缓存红利。100 万 Token 窗口最常见的用法是"喂一份大文档,反复提问"。只要前缀不变,后续请求的缓存命中价是 1.5 元/百万 Token,约为正常输入价的八分之一。所以把大文档放在 messages 最前面、保持内容稳定,是直接的省钱手段。
- 别拿旗舰模型干杂活。分类、摘要、简单改写这类任务用小模型(或者等 Qwen3.8-27B 开源后自己部署),把 Max 留给真正需要深度推理和代码交付的活。混合调度下,账单通常能砍掉一半以上。
五、路径三:千问办公(QwenWork),给不写代码的人
与模型同日开启公测的"千问办公",是把 QoderWork、MuleRun、悟空三款产品整合出来的企业级 Agent 产品,底层接的就是 Qwen3.8。它不面向 API 开发者,而是面向业务人员:整理报表、写方案、跨应用跑流程这类工作,用自然语言交代给它去执行。
判断是否值得试的标准很简单:如果你的工作里有大量"在 A 系统查数据、搬到 B 文档、再发到 C 群里"的重复动作,这类办公 Agent 正是干这个的。公测期申请门槛不高,建议拿一个真实但低风险的流程去跑,先观察它交接的准确率,再决定要不要把关键流程交出去。
注意事项与常见问题
- 开源还没落地:写作本文时(8 月 10 日)权重尚未放出,官方口径是"下周"。想私有化部署的团队,现在该做的是提前评估算力——2.4T 参数的 MoE 旗舰即便是稀疏激活,部署门槛也远高于常见的 70B 级别模型;预算有限的话,等 Qwen3.8-27B 更现实。
- API 模型名以控制台为准:新模型上线初期接口细节可能调整,接入前以官方文档的模型列表为准。
- 上下文大不等于可以乱喂:100 万 Token 的窗口很贵,先想清楚问题再投喂,别把"反正装得下"当默认策略。
- 榜单成绩不等于你的场景表现:Arena 排名是综合参考,最终还是要用自己真实的任务做基准测试,尤其是中文长文档和代码交付这两类它主打的场景。
小结
Qwen3.8-Max 是国产模型第一次把旗舰级能力、百万级上下文和"即将开源"同时摆上桌面的发布。今天的行动清单很短:网页版花十分钟验证真实任务,开发者用 OpenAI 兼容接口改两行配置接入 API 并加进自己的多模型路由,业务团队去申请千问办公公测。至于等开源的那批人,下周见分晓。
