技术

阿里巴巴通义千问3.8 Max定价每百万token仅2美元——下周开放模型权重

Adrian Kessler

一款拥有2.4万亿参数的AI模型刚刚以每百万输入token 2美元、输出token 6美元的价格面世。它采用稀疏混合专家架构,每次只激活950亿参数,其余参数处于闲置状态,从而将单token成本压至低位。这款模型名为Qwen 3.8 Max,来自阿里巴巴。

与美国顶尖模型的定价差距堪称悬殊。Qwen 3.8 Max在多项标准基准测试中表现不俗:PaperBench得分93.0,OSWorld-Verified得分86.1,在这两项指标上均高于Fable 5和GPT-5.6 Sol。它的上下文窗口扩展至一百万token——单次提示可处理约一百万个单词的输入——足以覆盖长文档分析、大型代码库和复杂推理链条。该模型还支持多模态,可同时处理文本、图像和视频,而这一价格水平在一年前还只属于闭源专有模型。

更重大的进展可能在于阿里巴巴下周的承诺。该公司表示将公开模型权重,这意味着任何拥有足够算力的团队都能在本地运行Qwen 3.8 Max,无需支付API费用、无需向阿里巴巴服务器传输数据、也无需签署使用协议。如果这一承诺如期兑现,将首次使2.4万亿参数模型落入自托管用户手中。阿里巴巴还将同时发布一个更小的270亿参数检查点,供算力有限的机构使用。

需要注意的方面确实存在。在以文本为中心的大模型竞技场排行榜上,Qwen 3.8 Max仅排名第五——落后于Anthropic当前产品线中的四款模型。在面向企业AI团队最重要的编程智能体评估SWE-bench Pro上,它得分67.7,而Fable 5得分80.0。开源权重承诺于8月10日那一周发布,但截至发稿,Hugging Face或ModelScope上仍未出现任何权重。对于需要遵守欧盟数据驻留要求或美国出口管制规定的机构而言,Qwen 3.8 Max同样面临其他中国实验室模型所附带的司法管辖权问题。

8月10日这个开源权重发布窗口是首个硬性节点。如果阿里巴巴如期交付,那么任何愿意自建基础设施的团队都将迎来前沿AI推理成本的大幅下降。如果发布推迟或附带限制,那么每百万token 2美元的API价格依然使其成为当前最具攻击性定价的前沿模型之一。

标签: , , , , ,

讨论

有 0 条评论。