来源:互联网 更新时间:2026-08-07 20:31
Qwen 3.8 Max 发布了。阿里在 2026 年 8 月 3 日正式推出,距离预览版两周。这一版之后,所有数字都不再是传闻。

bailian/qwen3.8-max,OpenAI 与 Anthropic 双协议bailian/qwen3.8-max,OpenAI 与 Anthropic 两种协议都能调,所以不用等阿里开 Claude 形状的端点就能塞进 Claude Code。输入输出:
| 支持情况 | |
|---|---|
| 输入模态 | 文本、图片、视频(QwenCloud);ofox 上是文本和图片,未列视频 |
| 输出模态 | 文本 |
| API 能力 | Function calling、结构化输出、上下文缓存、前缀续写 |
| 速率限制(QwenCloud) | 2M tokens/分钟,15K 请求/分钟 |
发布博客的重心压在多天自主执行上。头号案例是一次无人值守的编码运行,在一个公开仓库里 16 天左右产出了 265 个 commit、127 个 PR 和 151 个 issue。这套能力能不能迁移到你自己的代码库,恰恰是发布博客回答不了的那件事。
日期落在这两者之间的报道,其「未公布价格」「没有 benchmark」的说法现在都已过期,也包括那些引用「预览期按标价 10% 计费」的内容——那个折扣只适用于 Token Plan 预览窗口。
实际宣布的内容:
在权重真正落地前,有三件事别当定论。厂商口中的「下周」是计划不是发货日。对商用来说 license 比时间更要紧——Qwen 的开源版本历来用 Apache 2.0(Qwen3-235B-A22B 在 Hugging Face 上现在仍标着 apache-2.0),但那是先例,不是对 Max 级别发布的承诺。再有,2.4T 总参数、950 亿激活的模型不是工作站自部署的量级,27B 才是硬件账算得过来的那个。
| Qwen 3.8 Max(QwenCloud) | Qwen 3.7 Max(百炼新加坡) | |
|---|---|---|
| 输入 / 每百万 | $2.00 | $2.50 |
| 输出 / 每百万 | $6.00 | $7.50 |
| 隐式缓存读 / 每百万 | $0.25 | 未单独列出 |
| 显式缓存写 / 每百万 | $2.50 | 未单独列出 |
| 显式缓存读 / 每百万 | $0.17 | 未单独列出 |
这张表有两处要说明。缓存那几行来自不同的价目表,不能直接横向比:ofox 的 Qwen 3.7 Max 页面标的是缓存读 $0.50/M、缓存写 $3.125/M,那是网关的报价而不是阿里的。另外核实当天百炼新加坡价目表上 3.7 Max 挂着限时五折,所以实际差距可能比标价对标价看起来更小。
这张表两边的价格都会动。要拿它建成本模型之前,先自己拉一次当前值。
输出上限才是真正的变化。ofox 上 Qwen 3.7 Max 在同样的 1M 窗口下最大输出只有 64K,3.8 Max 把单次能吐出的量翻了一倍。这对阿里瞄准的那类负载很关键:一个能在 262K 推理 token 里做规划、却只有 64K 用来写产出物的模型,是一个会被截断的模型。
节选几行,Qwen 3.8 Max 对第一梯队:
| Benchmark | Qwen 3.8 Max | Opus 4.8 | Fable 5 | GPT-5.6 Sol (max) | Qwen 3.7 Max |
|---|---|---|---|---|---|
| Terminal Bench 2.1 | 86.6 | 84.6 | 84.6 | 88.8 | 74.5 |
| SWE-bench Pro | 67.7 | 69.2 | 80.0 | 64.6 | 60.6 |
| PaperBench | 93.0 | 80.3 | 88.8 | 90.5 | 64.8 |
| GPQA Diamond | 92.6 | 92.0 | 92.6 | 94.1 | 92.4 |
| HLE | 43.6 | 45.7 | 53.3 | 47.2 | 41.4 |
| IFBench | 82.8 | 62.2 | 63.5 | 72.7 | 79.1 |
| OSWorld-Verified | 86.1 | 83.4 | 85.0 | 83.2 | 73.3 |
| MMMU-Pro | 82.3 | 75.6 | 81.2 | 83.0 | 79.0 |
按惯例打个折看。竞品的 Terminal Bench 分数是从 Artificial Analysis 和 OpenAI 自己的帖子里引来的,不是 Qwen 重跑的;SWE-bench Pro 那一行用的是 Claude Code harness、temp 1.0、top_p 0.95、256K 上下文,这套配置是 Qwen 自己选的。表里还有几行是 Qwen 自家的 benchmark(QwenSWEBench、QwenQoderBench、QwenReactBench),被测的正是与之同名的那个模型。
这张表的缺口比表里任何一个数字都响:
qwen3.8-max,开发者路径。key 在 home.qwencloud.com/api-keys 申请。chat.qwen.ai,对话界面。qwen3.7-max,说明目录页滞后于公告,尽管底层端点是同一个。最后这条值得展开,因为品牌名把它藏住了。QwenCloud 自己的开发者文档调用的 OpenAI 兼容端点是 https://dashscope-intl.aliyuncs.com/compatible-mode/v1,key 从 DASHSCOPE_API_KEY 读——和百炼用的是同一个 DashScope 国际站主机。QwenCloud 是建在那套基础设施上的前端,不是另一套 API。
调用是 OpenAI 形状的:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope-intl.aliyuncs.com/compatible-mode/v1",
)
resp = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "总结这个仓库的测试策略。"}],
max_tokens=4096,
)
print(resp.choices[0].message.content)
qwen3.8-max。bailian/qwen3.8-max 在发布同一天上架 ofox。2026-08-03 一次目录调用返回 123 个模型,新 ID 已在其中,模型页标的是输入 $2/M、输出 $6/M、缓存读 $0.25/M、缓存写 $2.50/M,上下文长度 1,131,072、单次补全上限 131,072。四条价格与 QwenCloud 官方标价一致。
有一点值得点出来,因为它差点把我们坑了。目录里的 supported_endpoints 字段只列了 /v1/chat/completions 和 /v1/responses,读起来像是 Anthropic 这条路不通。实际是通的:2026-08-03 一次真实的 Messages 调用返回了格式完整的响应,stop_reason: end_turn。
两行 shell 就能把它塞进 Claude Code:
export ANTHROPIC_BASE_URL=https://api.ofox.io/anthropic
export ANTHROPIC_MODEL=bailian/qwen3.8-max
或者沿用上面那段 Python,改两个参数:
client = OpenAI(
api_key=os.getenv("OFOX_API_KEY"),
base_url="https://api.ofox.io/v1",
)
resp = client.chat.completions.create(model="bailian/qwen3.8-max", ...)
两条路怎么选:
| 你要的是 | 直接对接 QwenCloud | 走网关 |
|---|---|---|
| 最低的单价 | 是,这就是标价 | 这里与标价一致,但要逐个模型核 |
| Qwen 独有新功能的第零日访问 | 是 | 滞后,取决于网关多久跟上 |
| Claude Code 等 Anthropic 协议工具 | 今天做不到 | 可以 |
| 一把 key 打通 Qwen、Claude、GPT、Gemini | 不行 | 可以 |
| 某家限流时的自动故障转移 | 自己搭 | 内置 |
诚实的代价:网关多了一跳你控制不了的链路,而且它的价目表可能滞后于厂商的中途调价。看模型页,别看营销页——这句话对我们自己同样适用。
| Qwen 3.8 Max | Qwen 3.7 Max | |
|---|---|---|
| 发布时间 | 2026-08-03 | 2026-05-19 |
| 参数 | 2.4T(激活 95B) | 未公布 |
| 上下文 / 最大输出 | 1M / 131K | 1M / 64K(ofox 标注) |
| 输入 / 输出(每百万) | $2.00 / $6.00 | $2.50 / $7.50 |
| Terminal Bench 2.1 | 86.6 | 74.5 |
| SWE-bench Pro | 67.7 | 60.6 |
| ofox 上架 | 是,bailian/qwen3.8-max | 是,bailian/qwen3.7-max |
没有特别理由就选 3.8 Max。它更便宜、单次能写的量翻倍,而且两者用同一把 key 就能调,所以迁移只是换一个 model ID,不是重做一次接入。只有两种情况留在 3.7 Max:你为了可复现性锁了版本,或者你的评测集是按它校准的。价格差是 20% 不是一个数量级,光靠成本推不动这次迁移。想看更便宜的同系列,可以读 3.7 Plus 与 3.7 Max 的实测对比。
这次发布重新抛出的跨厂商问题,可以看 Kimi K3 对比 GPT-5.5 与 Opus 4.8(开源权重那一侧)和 Kimi K3 接入指南。两者今天都在 ofox 上,K3 是 moonshotai/kimi-k3,这个是 bailian/qwen3.8-max,所以把它们放在一起比只是换个 model ID,不是一次采购决策。
ANTHROPIC_BASE_URL 指向 https://api.ofox.io/anthropic,设置 ANTHROPIC_MODEL=bailian/qwen3.8-max。
GET https://api.ofox.io/v1/models(2026-08-03 实调:07:30 是 122 个模型,08:20 是 123 个且 bailian/qwen3.8-max 已在其中)bailian/qwen3.8-max 的真实请求实测,2026-08-03:POST /anthropic/v1/messages(200,Anthropic 形状正文)、POST /v1/chat/completions(200),以及一次图片输入调用(200,描述正确,prompt token 90,同一 prompt 不带图是 60)黄金价格不断创新高!黄金稳定币XAU、PAXG市值达11亿美元
新浪机器学习热点小时报丨2026年07月25日18时_今日实时机器学习热点速递
CC币价格预测(2026-2035):Canton币今日价格走势+长期价格预测
晶核艾尔莎角色盘点 晶核艾尔莎强度分析与实战表现
区块链OTC交易所有哪几家比较正规?
蚂蚁庄园今日答案7月21日(今日已更新) 蚂蚁庄园今天正确答案是什么呢
Intel喜讯连连:18A工艺良率提升到85%、CPU将涨价15%
新浪互联网热点小时报丨2026年07月26日16时_今日实时互联网热点速递
今日比特币暴涨分析:Metaplanet的比特币BTC投资推动股价上涨17%
腾讯ima怎么创建共享知识库?
AMD英特尔集体失眠!英伟达Rosa CPU搭载Rigel核:单核性能碾压x86
潜水员戴夫丛林DLC接吻的鱼任务攻略
合集38个项目筹集5.406亿美元 Figure融资2亿
快手手机版设置关闭展示亲密朋友的方法
遗忘之海密室通关教程 遗忘之海密室全关卡解谜思路与难点解析
五菱星光L六座新能源SUV上市:三版可选,中配12.28
抖音怎么取消申请退货退款?抖音上取消退货怎么操作
抖音app如何免费安装官方通道
macOS 28将移除Rosetta 2兼容层,Intel应用面临运行危机
kimi提示词专家使用方法新手指南
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc