上海 AI Lab 发布 Intern-S2-Preview-397B 模型,以 397B 参数通过架构革新追平万亿模型,实现知识与推理分离,并在科学任务上显著提升效率。
📝 详细摘要
文章报道了上海人工智能实验室在 WAIC 2026 发布的 Intern-S2-Preview-397B 模型。该模型以 397B 参数规模,在分子设计、材料结构生成等科学任务上追平此前万亿参数模型。核心创新在于将知识承载与推理计算分离,采用 Memory Decoder(可插拔外部记忆)与 Mobius(知识向量与推理算子解耦)双引擎架构,并引入反向残差连接与动态隐空间推理机制,使端到端推理效率提升近 4 倍。训练方面,InternBootcamp 交互验证环境通过“行动-反馈”高密度训练强化长程规划与工具调用能力。在科学评测中,模型在 Biology-Instructions、Mol-Instructions 等任务上大幅领先其他模型,并通过率从 0.47%提升至 1.56%。基于该模型打造的“书生·端砚”科学发现平台已在生命科学、材料、半导体等六大领域落地。文章还介绍了视觉预训练反哺语言模型的创新路径,以及模型在免疫治疗靶点设计和材料结构预测中的具体应用案例。
💡 主要观点
- 397B 参数通过架构革新追平万亿模型,实现知识与推理分离。 Memory Decoder 引入可插拔外部记忆,Mobius 解耦知识向量与推理算子,使模型在吸收专业领域知识时减少对通用能力的扰动,并提升推理效率近 4 倍。
💬 文章金句
- 通识为体、专业为用:通用能力构成稳定底座,专业能力按需接入、彼此协同,并在解决真实问题的过程中共同抬升模型能力上限。
- 业界首次真正实现让大模型的“记忆”与“思考”各司其职、完美协同,也印证了大模型的进步不只来自“更多参数”,也可以来自更合理的知识组织方式、更高密度的推理训练和更有效的计算路径。
- 科学智能不应只是人工智能的一个应用分支,而是检验智能能否理解复杂世界、提出可验证假设并在反馈中持续进化的终极试炼。
📊 文章信息
AI 初评:84
来源:量子位
作者:量子位的朋友们
分类:人工智能
语言:中文
阅读时间:20 分钟
字数:4887
标签: 大模型, 科学智能, AI4S, 模型架构, 预训练