来源:互联网 更新时间:2026-06-28 13:28
2026年阿里云带来的Qwen 3.7系列,可以说是把“定位互补”玩到了极致——Plus和Max两款模型,一个主攻多模态、苗条高效,一个死磕纯文本、笨重但强悍。它们共享100万tokens的超长上下文和35小时的自治执行上限,但内在架构、能力边界、价格档位截然不同。选错的可能要吃亏,选对的就能省钱又省心。下面咱们就把细节掰开看看。
Qwen 3.7 Plus是标准的多模态选手,原生支持文本、图像、视频输入,采用MoE混合专家架构,参数量约350亿,单轮推理只激活170亿参数——相当于一个轻量级专家随时待命。最大输出长度32768 tokens,足以覆盖绝大多数图文视频任务。
Qwen 3.7 Max则是纯文本旗舰,全参数密集架构,参数量约1.2T,推理时激活约450亿参数。没有视觉、视频能力,但文本推理深度、长篇连贯性、复杂逻辑推演是它的看家本领。最大输出65536 tokens,推理速度在纯文本场景下比Plus快7%到15%。它的主场是高强度智能体、百万行代码重构、超长文档深度分析,以及金融法律类高精度推演。
Max采用全参数密集架构,所有参数在推理时全部激活,计算资源拉满,换来的是纯文本推理时无可挑剔的精度与连贯性。代价也很直接——更高的计算成本和定价。
Plus的MoE架构则像一支专家混编团队,单轮推理只召唤少数几位(约170亿参数),大幅降低计算量,却依然能高效处理文本、图像、视频的跨模态融合。在多模态任务上,这种架构反而比密集模型更灵活、更划算。
两款模型都支持100万tokens的超长上下文,百万级文档、庞大代码库、超长对话历史都能从容应对。但输出上限不同:Max可以一口气吐出65536 tokens,适合生成完整代码仓库或深度报告;Plus的32768 tokens也不算短,图文分析报告、视频摘要、多轮回复都能搞定。
35小时的自治执行上限,意味着它们可以独自完成长时间的任务,比如持续调试代码、分析长文档。纯文本场景下,Max因全参数架构更稳;多模态自治任务(如持续分析视频流、处理图文混合内容)则是Plus的专长,Max插不上手。
Plus核心差异化就是图像与视频理解。它能识别截图、图表、UI设计、手写笔记、文档图片,完成OCR文本提取、图表数据分析、UI元素识别、内容语义理解等任务。举个例子:上传产品原型图,Plus自动解析界面布局,生成前端代码框架;上传财务报表图片,提取数据并生成分析报告。
视频理解方面,Plus支持视频帧序列分析,能理解内容、提取关键信息、生成摘要,甚至识别视频中的文本与图像。上传教学视频,它自动提取知识点、写课程笔记;上传监控片段,分析画面、识别异常事件。
Max是纯文本模型,完全不具备任何图像、视频处理能力。如果你的业务需要视觉信息,Max没法直接支持,必须额外搭配其他视觉模型——增加开发复杂度和成本。比如智能客服场景,用户上传问题截图,Max只能引导用户文字描述;内容创作场景,无法基于图片生成文案。
在Vision Arena多模态评测中,Qwen 3.7 Plus排到第16位,图像理解、图文问答表现不错。实测中,Plus处理10张不同类型图片(截图、图表、手写体、UI设计),OCR准确率达98%以上,图表数据分析准确率超95%,UI元素识别与代码生成成功率超过90%。视频理解任务里,处理10段1到5分钟的视频,关键信息提取准确率92%,视频摘要质量与人工摘要一致性评分达到85分以上。
在文本生成、摘要、翻译、问答等通用任务中,两款模型表现接近。Max在推理精度上略优,但差距很小。标准文本基准测试中,Max的Intelligence Index是56.6,Plus是52.1,相差约4.5个百分点。日常办公、内容创作、简单问答,用户几乎感觉不到区别。
代码能力是两款模型共同的优势。Bug修复测试中,Plus在10个真实Bug修复任务里全部成功(10/10),Max得分为9/10,Plus更优。复杂代码生成、重构、多文件处理场景下,Max因更大输出长度和全参数架构,处理超大规模代码库更稳定;但Plus在代码生成速度上表现惊人,端到端吞吐量147.5 t/s,是Max的3倍以上。
开启思考模式后,Plus的单次运行得分与Max持平。15道AIME竞赛级数学题,两款都答对14道,准确率一样。但推理速度差异显著:Plus单题平均113秒,Max要303秒,Plus快了近3倍。在复杂逻辑推理、多步骤问题解决中,Max连贯性略优,但Plus在速度上占尽优势。
两款模型都支持100万tokens上下文,超长文档分析、百万行代码处理、长对话历史理解都表现不错。Max凭借65536 tokens的输出上限,生成超长报告、完整代码库更具优势;Plus的32768 tokens虽短一些,但已能满足绝大多数场景,而且处理速度更快。
Qwen 3.7 Max:输入2.50元/百万tokens,输出7.50元/百万tokens;Qwen 3.7 Plus:输入0.40元/百万tokens,输出1.60元/百万tokens。综合下来,Plus的成本仅为Max的1/6左右,性价比极其突出。
以典型场景(100万tokens输入+50万tokens输出)为例:
同等业务量下,Plus节省80%以上成本,长期使用效果显著。
Qwen 3.7系列通过Plus与Max的差异化定位,覆盖了从通用多模态到专业纯文本的全场景需求。根据业务场景、成本预算、能力需求灵活选型,就能在保证AI能力的同时,实现成本与效果的最优平衡。
黄金价格不断创新高!黄金稳定币XAU、PAXG市值达11亿美元
新浪机器学习热点小时报丨2026年07月25日18时_今日实时机器学习热点速递
CC币价格预测(2026-2035):Canton币今日价格走势+长期价格预测
新浪互联网热点小时报丨2026年07月26日16时_今日实时互联网热点速递
腾讯ima怎么把微信内容一键导入知识库?
腾讯ima怎么创建共享知识库?
今日比特币暴涨分析:Metaplanet的比特币BTC投资推动股价上涨17%
蚂蚁庄园今日答案7月21日(今日已更新) 蚂蚁庄园今天正确答案是什么呢
新浪人工智能热点小时报丨2026年07月30日18时_今日实时人工智能热点速递
2026热门直线加速赛车手游推荐:高人气、爽快加速体验的精品榜单
Intel喜讯连连:18A工艺良率提升到85%、CPU将涨价15%
Windy卫星云图怎么看?云层变化识别技巧
kimi提示词专家使用方法新手指南
原神霜月三处月灵龛具体位置汇总
《幻兽帕鲁》不触发通缉捕捉传说商人方法
短剧《史上最强洪荒修为》剧情介绍
Aptos(APT)币是什么?APT代币经济学、价格预测及投资前景
9条破亿视频,新号涨粉百万,过去半年谁在制造AI爆款?
如何修复Edge浏览器无法通过微软账号进行身份验证?
为什么推特KOL都在BRC20赚钱 我一冲就亏?
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc