AInspiro
技术趋势

中国开源大模型这一波:Qwen 放出 2.4 万亿,DeepSeek 改峰谷计价

AInspiro 编辑部·
部分内容由 AI 辅助创作。

一周,两次刷屏

八月初这一周,两个中国模型先后占满头条。一个把"最大开源"的门槛直接抬到 2.4 万亿参数,另一个悄悄改了计价方式,结果让亚洲时区的开发者账单集体变厚。

你想自己部署一个顶级模型,不走 API、数据不出本地机房。两个月前你还觉得这是大厂才玩得起的奢侈。现在权重开源了——但先别急着下载,因为你能下到的,和榜单上跑分的,很可能不是同一个东西。

阿里 Qwen:最大开源,但有减配

Qwen3.8-Max 总参数 2.4 万亿,每次推理激活约 950 亿,8 月 3 日发布,8 月 12 日放出权重。听起来很美。问题是开源出来的 Qwen3.8-2.4T-A95B 是减配版:纯文本、上下文砍到 26 万 token,多模态和那个一百万 token 的上下文只在阿里云托管版里有。许可证也不是宽松的 Apache,而是带营收门槛的自定义许可——年营收超过 5000 万美元的 MaaS 或 AI 助手业务,得单独申请授权。

DeepSeek:能力在线,计价变峰谷

V4 Pro 8 月 13 日转正,总参数 1.6 万亿、激活 490 亿,一百万 token 上下文、单次最多吐 38 万 token,权重 MIT 许可、可随意自托管。之前是平价 0.435 / 0.87 美元每百万 token。8 月 16 日改成峰谷计价:高峰 1.32 / 3.96,低谷 0.66 / 1.98。高峰时段是 UTC 01:00–04:00 和 06:00–10:00——换算到北京时间是上午 9 点到 12 点、下午 2 点到 6 点,基本就是你上班那几个小时。

翻译一下:一个在新加坡、北京时间办公的团队,白天调 DeepSeek V4 Pro,几乎每次都撞高峰价,单价是低谷的三倍。一个在旧金山同样干活的团队,夜里反而走低谷。同一家模型,成本因你坐哪而差出几倍。

大势:中国模型已经包了前五

OpenRouter 的周调用量里,DeepSeek-V4-Flash 以 7.22 万亿 token 登顶。更夸张的是,中国模型已经连续十四周包揽全球调用量前五。开源不是噱头,是真有人在大规模用。

谁该选哪个

要便宜、要可控、要无脑自托管,DeepSeek 的 MIT 权重最省心。要最强中文多模态、能接受许可约束,Qwen 托管版更合适。但预算紧、量又大的亚洲团队,记得 DeepSeek 的高峰正好撞你上班时间——把重活排到夜里,能省下一大截。

跟你有啥关系

你想做自己的 AI 产品、怕被外部 API 卡脖子、数据必须留本地,这波开源是真机会。但下手前先把两笔账算清:许可门槛(Qwen 那张营收网)和硬件成本(950 亿激活参数不是一张卡能跑的)。机会是真机会,坑也得真看见。

相关阅读:Qwen、DeepSeek、Kimi