SuperPortia Reading
總覽
文章
簡報
🔍 搜尋
全部
未讀 (37807)
★ 收藏 (0)
🤖 人工智能 (14317)
📊 商业科技 (6643)
📁 媒体资讯 (5244)
📁 投资财经 (3226)
📁 生活文化 (2782)
💻 软件编程 (2054)
📁 个人成长 (1958)
📁 体育运动 (999)
🎨 产品设计 (532)
📁 AI 产品 (39)
篩選中:
🏷️ 训练优化
共 5 篇
✕ 清除篩選
37809
全部文章
37807
未讀
77
今日新增
0
收藏
📡 Poller
最後抓取:
55 分鐘前
(08-07 02:00)
BestBlogs 精選 (37736)
🏷️ 熱門標籤
AI Agent
3167
政策解读
1604
投资与市场
1396
AI 编程
1330
宏观经济
1268
产业动态
1251
国际新闻
1152
LLM
1148
Anthropic
1087
Claude Code
1038
社会议题
990
国内新闻
964
地缘政治
924
OpenAI
891
科技新闻
880
AI 智能体
788
生活方式
690
开源
683
足球
673
个人成长
664
●
一文读懂 Kimi K3 预训练|3T 模型,不再是魔法
📌 一句话摘要 本文深入解析 Kimi K3 3T 参数模型的训练技术路径,涵盖 MoE、线性注意力、LatentMoE、并行优化及残差改造等关键创新。 📝 详细摘要 文章详细拆解了 Kimi K3 这一 2.78 万亿参数、激活约 1042 亿参数的 MoE 大模型在预训练阶段的关键技术。它首
📅 2026-07-30 14:06
(7 天前)
腾讯科技
人工智能
2 分鐘
★ 93
大模型
MoE
线性注意力
LatentMoE
●
不用 NVLink,如何通过 AI Infra 工程优化拉满 Cosmos 3 训练吞吐
📌 一句话摘要 本文详细介绍了百度百舸团队在无 NVLink 的国内主流 GPU 环境下,通过系统性 AI Infra 工程优化,将 Cosmos3 模型训练吞吐提升 99.3% 并实现 12 节点 98.3% 扩展效率的完整实践。 📝 详细摘要 文章以 NVIDIA 开源的具身智能模型 Cos
📅 2026-07-08 18:00
(29 天前)
百度Geek说
人工智能
8 分鐘
★ 88
AI Infra
模型训练优化
具身智能
GPU 优化
●
论文秀 Live#36|ICLR 独作突破×Oral 精选× LLM 训练推理新方法
📌 一句话摘要 本文预告并介绍了蚂蚁技术团队将在直播中分享的三篇 ICLR 2026 论文,聚焦于 LLM 预训练调度优化、强化学习熵正则化改进以及扩散模型推理加速三大前沿方向。 📝 详细摘要 文章是蚂蚁技术团队对其「论文秀 Live #36」直播活动的预告和内容摘要。直播将重点解读三篇入选 I
📅 2026-04-13 17:11
(04-13 17:11)
蚂蚁技术 AntTech
人工智能
2 分鐘
★ 84
ICLR 2026
大语言模型
预训练优化
强化学习
●
不加算力,只改一个算法:Muon 在万亿 MoE 模型中最高 2 倍加速
📌 一句话摘要 本文介绍了 Gram Newton-Schulz 算法,通过将 Muon 优化器的迭代过程转移到更小的 Gram 矩阵上,在万亿级 MoE 模型训练中实现了最高 2 倍的优化器加速。 📝 详细摘要 普林斯顿大学和纽约大学的研究者(包括 Tri Dao)提出了 Gram Newto
📅 2026-03-31 13:36
(03-31 13:36)
机器之心
人工智能
1 分鐘
★ 92
Muon 优化器
Newton-Schulz
MoE 模型
模型训练优化
●
想进 OpenAI?先解出这道题,百万美元算力已就位
📌 一句话摘要 OpenAI 发起 Parameter Golf 挑战赛,要求在 16MB 产物大小和 10 分钟训练限制下优化模型,旨在挖掘极致的模型压缩与效率优化人才。 📝 详细摘要 本文报道了 OpenAI 推出的全新技术挑战赛——Model Craft Challenge「Paramet
📅 2026-03-19 14:46
(03-19 14:46)
机器之心
人工智能
2 分鐘
★ 76
OpenAI
模型压缩
Parameter Golf
模型训练优化