主要内容
阿里巴巴今日发布Qwen3.8-Max,其2.4万亿参数规模为当前中国最大AI模型,采用混合专家架构,单次仅激活约950亿参数,降低成本与响应延迟。该模型支持文本、图像、视频处理,最大上下文窗口达100万token,完成16天软件工程项目验证。规模接近Moonshot AI的Kimi K3(2.8万亿参数,7月发布),定价为输入2美元/百万tokens、输出6美元/百万tokens,低于Kimi K3(3美元/百万输入、15美元/百万输出)。在竞技场平台,Qwen3.8-Max位列中文文本模型第一,图像分析类模型排名第二(仅次于Anthropic Claude Fable 5变体)。
DeepSeek推出V4-Flash模型,以低价策略切入市场,输入成本0.14美元/百万tokens,输出0.28美元/百万tokens,显著低于主流系统。其缓存输入成本低至0.003美元/百万tokens(98%折扣),测试成本仅0.03美元/次,远低于Kimi K3(0.86美元)和GPT-5.6 Sol(1.86美元)。该模型总参数2840亿,推理时仅激活130亿,输出速率118 tokens/秒。
模型推理成本取决于架构、活跃参数、token消耗及任务调用次数,非仅规模。Moonshot Kimi K3虽参数更大,但Qwen3.8-Max通过优化架构和定价策略形成竞争优势。当前中国AI模型市场聚焦参数规模与价格双维度竞争,能力与成本平衡成关键。