全部 未讀 (37807) ★ 收藏 (0) 🤖 人工智能 (14317) 📊 商业科技 (6643) 📁 媒体资讯 (5244) 📁 投资财经 (3226) 📁 生活文化 (2782) 💻 软件编程 (2054) 📁 个人成长 (1958) 📁 体育运动 (999) 🎨 产品设计 (532) 📁 AI 产品 (39)
篩選中: 🏷️ 训练优化 共 5 篇 ✕ 清除篩選
37809
全部文章
37807
未讀
77
今日新增
0
收藏
📡 Poller 最後抓取: 55 分鐘前 (08-07 02:00)
BestBlogs 精選 (37736)

🏷️ 熱門標籤

AI Agent 3167 政策解读 1604 投资与市场 1396 AI 编程 1330 宏观经济 1268 产业动态 1251 国际新闻 1152 LLM 1148 Anthropic 1087 Claude Code 1038 社会议题 990 国内新闻 964 地缘政治 924 OpenAI 891 科技新闻 880 AI 智能体 788 生活方式 690 开源 683 足球 673 个人成长 664
一文读懂 Kimi K3 预训练|3T 模型,不再是魔法
📌 一句话摘要 本文深入解析 Kimi K3 3T 参数模型的训练技术路径,涵盖 MoE、线性注意力、LatentMoE、并行优化及残差改造等关键创新。 📝 详细摘要 文章详细拆解了 Kimi K3 这一 2.78 万亿参数、激活约 1042 亿参数的 MoE 大模型在预训练阶段的关键技术。它首
📅 2026-07-30 14:06 (7 天前) 腾讯科技 人工智能 2 分鐘 ★ 93
大模型 MoE 线性注意力 LatentMoE
不用 NVLink,如何通过 AI Infra 工程优化拉满 Cosmos 3 训练吞吐
📌 一句话摘要 本文详细介绍了百度百舸团队在无 NVLink 的国内主流 GPU 环境下,通过系统性 AI Infra 工程优化,将 Cosmos3 模型训练吞吐提升 99.3% 并实现 12 节点 98.3% 扩展效率的完整实践。 📝 详细摘要 文章以 NVIDIA 开源的具身智能模型 Cos
📅 2026-07-08 18:00 (29 天前) 百度Geek说 人工智能 8 分鐘 ★ 88
AI Infra 模型训练优化 具身智能 GPU 优化
论文秀 Live#36|ICLR 独作突破×Oral 精选× LLM 训练推理新方法
📌 一句话摘要 本文预告并介绍了蚂蚁技术团队将在直播中分享的三篇 ICLR 2026 论文,聚焦于 LLM 预训练调度优化、强化学习熵正则化改进以及扩散模型推理加速三大前沿方向。 📝 详细摘要 文章是蚂蚁技术团队对其「论文秀 Live #36」直播活动的预告和内容摘要。直播将重点解读三篇入选 I
📅 2026-04-13 17:11 (04-13 17:11) 蚂蚁技术 AntTech 人工智能 2 分鐘 ★ 84
ICLR 2026 大语言模型 预训练优化 强化学习
不加算力,只改一个算法:Muon 在万亿 MoE 模型中最高 2 倍加速
📌 一句话摘要 本文介绍了 Gram Newton-Schulz 算法,通过将 Muon 优化器的迭代过程转移到更小的 Gram 矩阵上,在万亿级 MoE 模型训练中实现了最高 2 倍的优化器加速。 📝 详细摘要 普林斯顿大学和纽约大学的研究者(包括 Tri Dao)提出了 Gram Newto
📅 2026-03-31 13:36 (03-31 13:36) 机器之心 人工智能 1 分鐘 ★ 92
Muon 优化器 Newton-Schulz MoE 模型 模型训练优化
想进 OpenAI?先解出这道题,百万美元算力已就位
📌 一句话摘要 OpenAI 发起 Parameter Golf 挑战赛,要求在 16MB 产物大小和 10 分钟训练限制下优化模型,旨在挖掘极致的模型压缩与效率优化人才。 📝 详细摘要 本文报道了 OpenAI 推出的全新技术挑战赛——Model Craft Challenge「Paramet
📅 2026-03-19 14:46 (03-19 14:46) 机器之心 人工智能 2 分鐘 ★ 76
OpenAI 模型压缩 Parameter Golf 模型训练优化