涌金楼丨浙产大模型要改变全球AI竞争格局?
杭州网  发布时间:2026-08-14 08:03   

图源:开源社区

8月13日凌晨,杭州深度求索人工智能基础技术研究有限公司(DeepSeek),又悄悄搞了个大动作——DeepSeek V4 Pro正式版发布。

从官方测评数据看,该版本能力大幅提升,多项指标已接近Anthropic Fable 5等国外顶尖闭源模型。而在十天前,另一家浙江公司阿里巴巴发布旗舰模型Qwen3.8-Max,首次亮相即进入权威评测平台Arena综合榜Top5。

全球开源模型调用量排名中,两个浙产大模型,DeepSeek与千问已连续多周包揽前两席。人工智能正成为创新浙江最鲜明的标识、最核心的支撑。而选择“开源”来加速技术迭代、构建产业生态,成为浙产大模型企业一条坚定而清晰的路径。

这是企业对技术路径和商业模式的选择,也是浙江发展人工智能的战略共识。

如中国工程院院士、之江实验室主任王坚一直“安利”的观点:人工智能开源,正从开放源代码即"Open Source",转为开放资源即"Open Resource"。

中国开放AI模型,本质上意味着,把背后的资源和机遇开放给了全世界。

性能做强,门槛降低

“便宜的没它强,强的没它好用。”13日,杭州嗡嗡科技有限公司负责人刘杲劼,试用了DeepSeek V4 Pro版本。

他告诉记者,此前公司刚刚从国外模型,切换到了7月底发布的DeepSeek V4 Flash版本。它在编程等工作上表现不错,费用降低了不少。

这是DeepSeek和千问广受欢迎的原因:够便宜,够好用。

便宜到什么程度?DeepSeek V4 Flash涨价后,每百万输出Token才4.5元人民币,比较顶尖的国外模型,便宜约30倍。两者在代码编写能力相差不大。官方测试数据显示,仅差几个百分点。

好用到什么程度?DeepSeek V4 Pro总参数1.6万亿、每次激活约490亿参数,V4 Flash总参数2840亿、激活130亿参数,两者全系开源,均支持百万Token超长上下文。

千问3.8-Max同样如此:总参数量达2.4万亿,单次推理激活950亿参数,采用稀疏混合专家架构,支持最大1M Token的上下文窗口。这意味着开发者更方便在其上自由搭建、改造、并商业化落地。

图源:千问官网

杭州电子科技大学计算机学院副院长余宙告诉楼主,国内的开源大模型,集中精力做了两件事——把模型性能做强,把使用门槛降低。

“中小企业很难从0到1训练一个大模型。”浙江古珀医疗科技有限公司,是杭州一家专注医疗大数据领域的科技企业。创始人张强说,对开发者而言,这两大开源模型提供了成本更低、性价比更高的选择,拉低了人工智能现实落地的门槛。

古珀就利用开源模型,千问Qwen3.6-35B-A3B和Qwen3.6-27B,打造了一个面向C端的医疗智能体,具有医生分身+智能随访+慢病风险评估智能体+健康管理等功能。

截至目前,浙江累计已完成90款生成式人工智能服务备案。其中,有一些模型,就是利用千问、DeepSeek等基础大模型进行二次开发和参数调整获得的。

(原标题:涌金楼丨浙产大模型要改变全球AI竞争格局?)
来源:潮新闻  作者:记者 施力维  编辑:陈周滢
返回
杭州网·杭州新闻门户网站