终极一班2
开源,浙产大模型向世界敞开大门_我的网站

A | 本文来自微信公众号:财联社 (ID:cailianpress),作者:赵昊 全球六大主流大语言模型(LLM)各发1万美元,丢进同一真实市场实盘厮杀,会发生什么? 上周六(10月18日),美国人工智能研究实验室nof1.ai在其“Alpha Arena”(阿尔法竞技场)平台上举办了一场活动——给六个顶级模型一万美元的真金白银,让它们下场交易,而且并非模拟盘,真金白银地交易。 连续多周包揽全球开源模型调用量排名前两席8月13日凌晨,杭州深度求索人工智能基础技术研究有限公司(DeepSeek),又悄悄搞了个大动作——DeepSeek V4 Pro正式版发布。此前,DeepSeek V4的另一个版本Flash正式版已于7月底发布。

B | 从官方测评数据看,Pro版本能力大幅提升,多项指标已接近Anthropic Fable 5等国外顶尖闭源模型。 这六大模型分别为Anthropic的Claude 4.5 Sonnet、深度求索的DeepSeek V3.1 Chat、谷歌的Gemini 2.5 Pro、OpenAI的GPT 5、xAI的Grok 4和阿里通义的Qwen 3 Max。而在十天前,另一家浙江公司阿里巴巴发布旗舰模型Qwen3.8-Max,首次亮相即进入权威评测平台LMArena综合榜Top 5。全球开源模型调用量排名中,两个浙产大模型DeepSeek与千问已连续多周包揽前两席。 测试规则写道,每个模型获得10,000美元的“真实资本”,在交易所Hyperliquid上,以相同提示词与输入数据条件下,交易加密货币的永续合约。所有的对话都在nof1.ai网站上公开可见。人工智能正成为创新浙江最鲜明的标识、最核心的支撑。

C | 而选择“开源”来加速技术迭代、构建产业生态,成为浙产大模型企业一条坚定而清晰的路径。这是企业对技术路径和商业模式的选择,也是浙江发展人工智能的战略共识。 规则称,比赛的目标是“将风险调整后的收益最大化”:“每个人工智能(AI)模型必须自行产生Alpha(超额收益)、确定仓位、择时交易并管理风险”。 系统会告诉AI模型当前的时间、账户信息、持仓情况,然后附上实时价格、指标等数据。正如中国工程院院士、之江实验室主任王坚反复提及的观点:人工智能开源,正从开放源代码即“Open Source”,转为开放资源即“Open Resource”。然后,要求模型做出决策:如果持有仓位,是继续持有还是平仓;如果空仓,是买入还是继续观望。中国开放AI模型,本质上意味着把背后的资源和机遇开放给全世界。 经过近60小时的激战后,截至北京时间周一(10月20日)17:18,DeepSeek的持仓总市值接近1.4万美元,收益率约40%,最高时一度接近1.5万美元,是当前表现最好的模型。

D | 性能做强,门槛降低“便宜的没它强,强的没它好用。

E | ”8月13日,杭州嗡嗡科技有限公司负责人刘杲劼试用了DeepSeek V4 Pro版本。

F | 他告诉记者,此前公司刚从国外模型切换到了7月底发布的DeepSeek V4 Flash版本,它在编程等工作上表现不错,费用降低了不少。这是DeepSeek和千问广受欢迎的原因:够便宜,够好用。

G | 便宜到什么程度?DeepSeek V4 Flash最近采用了分时定价机制,在空闲时段,每百万输出Token仅需4.5元人民币,即便在高峰时段,价格也仅为9元/百万输出Token。相比顶尖的国外模型,价格优势依然显著,两者在代码编写能力相差不大,官方测试数据显示仅差几个百分点。

H | 好用到什么程度?DeepSeek V4 Pro总参数1.6万亿、每次激活约490亿参数,V4 Flash总参数2840亿、激活130亿参数,两者全系开源,均支持百万Token超长上下文。 Grok 4实力次之,目前持仓总市值在1.33万美元附近。具体来看,DeepSeek和Grok 4都依靠做多比特币和以太坊获利。 Claude主要交易瑞波币和以太坊,Qwen则专注于以太坊,两者收益位列三四,但也整体跑赢比特币现货的走势。 与之相比,GPT 5和Gemini已出现了明显亏损,目前持仓总市值分别为7300美元和6900美元,意味着两个模型已亏损约2700和3100美元,表现最差。 nof1.ai表示,进行这一竞赛是为了是让基准测试更贴近真实世界,而金融市场是最理想的试炼场,因为这类市场具有动态性、对抗性、开放性与高度不可预测性。 “这些特质能以静态测试无法企及的方式,真正挑战人工智能,”nof1.ai没有提到本次竞赛的结束时间,只写道“第一季将运行数周,随后推出重大更新的第二季”。Qwen3.8-Max同样如此:总参数量达2.4万亿,单次推理激活950亿参数,采用稀疏混合专家架构,支持最大1M Token的上下文窗口。这意味着开发者更方便在其上自由搭建、改造,并商业化落地。

I | 有分析认为,市场早已期待在DeFAI(DeFi+AI)方向上出现杀手级应用,让LLM参与链上博弈有很大的想象空间。杭州电子科技大学计算机学院副院长余宙告诉记者,国内的开源大模型集中精力做了两件事——把模型性能做强,把使用门槛降低。“中小企业很难从0到1训练一个大模型。”浙江古珀医疗科技有限公司是杭州一家专注医疗大数据领域的科技企业,创始人张强说,对开发者而言,这两大开源模型提供了成本更低、性价比更高的选择,拉低了人工智能现实落地的门槛。

J | 古珀就利用开源模型Qwen3.6-35B-A3B和Qwen3.6-27B,打造了一个面向C端的医疗智能体,具有“医生分身+智能随访+慢病风险评估智能体+健康管理”等功能。截至目前,浙江累计已完成90款生成式人工智能服务备案。其中,有一些模型,就是利用千问、DeepSeek等基础大模型进行二次开发和参数调整获得的。融入全球,改写规则两个“顶流”大模型的背后,是浙江在战略层面锚定的路线。

K | 浙江省“十五五”规划纲要中六次提及“开源”,频次之高、着墨之重,前所未有。2026年省政府工作报告提出,“积极抢占人工智能发展制高点,着力营造最优开源开放生态”,将开源列为全省AI布局的核心抓手之一。7月16日,浙江省委十五届九次全会在杭州举行。全会期间进行了人工智能专题辅导授课,组织考察了国家人工智能应用中试基地(具身智能)、“魔搭社区”(杭州)开发者中心、杭州城西科创大走廊未来科技城展馆。其中,“魔搭社区”是国内最大的人工智能开源社区。

L | 魔搭社区以“模型即服务”的模式,线上汇聚全球超2900万人工智能开发者、超20万个模型,极大降低了人工智能应用创新的门槛。浙江大学人工智能学院教授、本科生院院长吴飞解释了开源的底层逻辑:“开源是开放知识与创造能力。AI技术具有先行者引领的溢出效应,需要去主动构建开源生态。”“极致性价比+开放生态”的浙产大模型,正在重写全球AI竞争的游戏规则。

M | 7月24日,AI硬件巨头英伟达创始人黄仁勋,发布了一封公开信呼吁开放模型权重。该信件将开放模型比作1980年代开源软件运动——开放权重扩大了参与AI经济的途径。初创企业、成熟企业、高校及公共机构无需从零开始训练模型,也不必为每一项任务都支付高昂的尖端模型使用费,而是可以直接基于现有的先进模型进行开发。日前,联合国人工智能问题独立国际科学小组发布报告《对人工智能带来的机遇、风险和影响的询证评估》。该报告将Qwen及DeepSeek作为全球开源AI生态代表性案例单独列出。这既是技术层面的认可,也是国际社会对中国开源治理理念的一种肯定。
Current article:http://x2f.shuazhepenxingshuaisenqienai.buzz/news/20260826_6406186.html
Published on:17:51:40
















