本文报道 DeepSeek-V4-Flash 正式版 API 上线引爆港股 AI 概念行情,解析后训练优化与极致定价如何重塑国产大模型商业化预期,并拆解阿里与 MiniMax 联动上涨背后的持股加自研逻辑。
📝 详细摘要
8 月 3 日港股 AI 概念股集体上涨,阿里巴巴涨 7.01%重回 120 港元上方,MiniMax 涨 7.2%。文章将此轮行情归因于 7 月 31 日 DeepSeek-V4-Flash 正式版 API 上线公测:该模型总参数 2840 亿、激活参数 130 亿,仅重做后训练便令 Agent 能力大幅跃升,输入定价低至 1 元/百万 token,运行成本据称仅为 Anthropic 旗舰模型的 1/100,迫使 OpenAI 紧急下调 GPT-5.6 Luna 价格 80%应战。文章进一步拆解阿里与 MiniMax 的联动逻辑:MiniMax 发布多模态生成模型 H3 并计划开源、拟纳入港股通;阿里发布 Qwen3.8 并持有 MiniMax 约 12.52%股份。作者判断,国产大模型竞争已从参数竞赛转向后训练优化与推理成本的性价比之争。
💡 主要观点
- 仅重做后训练便实现 Agent 能力跃升,颠覆参数竞赛逻辑。 V4-Flash 总参数 2840 亿、激活仅 130 亿,轻量级 MoE 架构在 Terminal Bench、Cybergym 等多项 Agent 基准上超越 Pro 预览版,证明后训练优化足以释放接近顶级闭源模型的能力。
💬 文章金句
- 当市场还在争论'参数竞赛'是否可持续时,DeepSeek 证明后训练优化足以让轻量级模型释放接近顶级闭源模型的 Agent 能力。这意味着推理成本曲线可能比我们预期的更陡峭,对整个产业链的估值体系都会产生连锁反应。
- 当大模型从'烧钱换故事'进入'用财报和估值说话'的阶段,拥有清晰商业化路径和生态卡位能力的企业,才配得上持续的估值溢价。
📊 文章信息
AI 初评:76
来源:21世纪经济报道
作者:21世纪经济报道
分类:投资财经
语言:中文
阅读时间:8 分钟
字数:1987
标签: 港股, AI 概念股, LLM, AI Agent, AI 商业化