全部 未讀 (37696) ★ 收藏 (0) 🤖 人工智能 (14295) 📊 商业科技 (6633) 📁 媒体资讯 (5216) 📁 投资财经 (3201) 📁 生活文化 (2769) 💻 软件编程 (2050) 📁 个人成长 (1954) 📁 体育运动 (995) 🎨 产品设计 (531) 📁 AI 产品 (39)
篩選中: 🏷️ 模型训练与推理 共 60 篇 ✕ 清除篩選
37698
全部文章
37696
未讀
206
今日新增
0
收藏
📡 Poller 最後抓取: 1 小時前 (08-06 20:00)
BestBlogs 精選 (37625)

🏷️ 熱門標籤

AI Agent 3158 政策解读 1593 投资与市场 1383 AI 编程 1326 宏观经济 1264 产业动态 1249 国际新闻 1150 LLM 1147 Anthropic 1087 Claude Code 1038 社会议题 983 国内新闻 958 地缘政治 924 OpenAI 891 科技新闻 879 AI 智能体 788 生活方式 688 开源 683 足球 671 个人成长 661
8GB 内存也能跑 Kimi K3?2026 本地部署大模型配置全指南
📌 一句话摘要 本文以 Kimi K3 在 8GB 内存上跑通的工程实验切入,系统梳理 2026 年本地部署大模型的显存瓶颈、硬件选型与推理软件配置。 📝 详细摘要 文章由 kimi-k3-in-c 项目在 8.24GB 内存下完成 Kimi K3 CPU 推理的现象引入,解释其原理:K3 为
📅 2026-08-05 22:23 (23 小時前) 张子豪 人工智能 2 分鐘 ★ 86
本地部署 LLM 模型训练与推理 模型量化
超过 1B 参数都是浪费?多模态情感模型进入「小」时代 | ACM MM'26
📌 一句话摘要 本文介绍 ACM MM 2026 论文 Light-MER,通过切片 Wasserstein 距离蒸馏与多奖励强化学习,将 8B 教师的生成式多模态情感识别能力压缩至低于 1B 参数的学生模型,平均性能反超教师且显存降低约 8 倍。 📝 详细摘要 本文报道格拉斯哥大学、山东大学与
📅 2026-08-01 13:32 (5 天前) 新智元 人工智能 2 分鐘 ★ 80
多模态 AI 模型训练与推理 知识蒸馏 情感识别
“榨”出硅的极限:怎么让 GPU 不“闲着”?
📌 一句话摘要 本文结合专家访谈与行业数据,系统拆解 AI Infra 的四层架构,解释 GPU 利用率低下的原因,并剖析 KV Cache 复用、连续批处理、PD 分离、投机采样等关键技术如何把算力效率榨到极限。 📝 详细摘要 在推理需求爆发与 GPU 短缺并存的背景下,AI Infra 成为
📅 2026-08-01 15:49 (5 天前) 硅谷101 人工智能 2 分鐘 ★ 88
AI Infra 模型训练与推理 LLM GPU
Kimi K3 技术报告英中对照 PDF 版来了
📌 一句话摘要 本文对 Kimi K3 技术报告进行解读,梳理其超稀疏 MoE、百万上下文、原生多模态和 Agent 强化学习等核心创新,并提供英中对照 PDF 下载。 📝 详细摘要 文章围绕 Kimi K3 技术报告展开解读,从模型规模、核心架构创新(KDA 与 Gated MLA、Atten
📅 2026-07-29 11:15 (8 天前) AINLP 人工智能 4 分鐘 ★ 80
LLM AI Agent MoE 多模态AI
Kimi K3 正式开源,3 万亿模型权重全球开放
📌 一句话摘要 本文报道 Kimi K3 正式开源,成为全球首个 3 万亿参数级开源模型,详解其 MoE 架构创新、百万上下文、原生多模态及 Agent 沙盒训练,并展示接近最强闭源模型的性能与成本优势。 📝 详细摘要 文章报道月之暗面(Moonshot AI)开源 Kimi K3 模型及技术报
📅 2026-07-28 21:30 (9 天前) 36氪 人工智能 2 分鐘 ★ 83
LLM 模型发布 多模态AI 模型训练与推理
具身智能迎年度检阅:训练可用数据量大增,算力需求涌上云平台
📌 一句话摘要 本文报道了 WAIC 2026 上具身智能行业的最新变化:训练可用数据量因「人类数据」采集范式兴起而大增,驱动算力需求快速涌向云平台,但真机数据稀缺与软硬件强耦合仍是能力跃进的瓶颈。 📝 详细摘要 文章基于 WAIC 2026 的现场采访,梳理了具身智能行业在数据和算力方面的最新
📅 2026-07-17 23:56 (19 天前) 第一财经 人工智能 2 分鐘 ★ 86
具身智能 AI 硬件与芯片 云原生 / DevOps 模型训练与推理
Kimi K3 不是中国的 Fable 5
📌 一句话摘要 文章报道月之暗面 Kimi K3 以 2.8 万亿参数和开源权重在编程基准上超越顶级闭源模型,分析其 KDA 架构及“双线战争”策略,指出中美 AI 差距加速缩小。 📝 详细摘要 2026 年 7 月 17 日,月之暗面发布旗舰模型 Kimi K3,总参数 2.8 万亿,成为全球
📅 2026-07-17 21:17 (20 天前) 腾讯科技 人工智能 2 分鐘 ★ 86
大语言模型 开源模型 模型评测与基准 上下文工程
2.8 万亿!全球参数最大的开源模型发布
📌 一句话摘要 本文报道月之暗面发布全球参数最大(2.8 万亿)的开源模型 Kimi K3,具备多模态理解与 100 万词元上下文窗口,针对复杂任务场景优化。 📝 详细摘要 文章报道了 2026 年世界人工智能大会上,月之暗面公司发布新一代开源模型 Kimi K3,参数规模达 2.8 万亿,为全
📅 2026-07-17 20:57 (20 天前) 人民网 人工智能 1 分鐘 ★ 78
LLM 开源模型 模型发布 多模态AI
智谱创始人唐杰内部信曝光:未来两年不追求变现,直指 AGI 高地
📌 一句话摘要 智谱创始人唐杰发布内部信,宣布启动“摸高计划”,未来两年将战略性投入攻坚长程任务、自治智能体、自我训练与模型安全,不追求短期应用变现,直指 AGI 下一个高地。 📝 详细摘要 文章独家披露了智谱创始人唐杰题为《巨浪已来》的内部信全文。信中,唐杰回顾了智谱“本质、反直觉、专注”的方
📅 2026-07-12 20:01 (25 天前) 21世纪经济报道 人工智能 2 分鐘 ★ 88
AI 商业化 AGI AI 安全与对齐 AI Agent
智谱内部信“摸高计划”公开
📌 一句话摘要 智谱创始人唐杰发内部信,宣布未来两年集中资源投入长程任务、自治智能体、自我进化与安全治理四个技术方向,冲击下一代模型。 📝 详细摘要 文章独家披露了智谱创始人唐杰的内部信《巨浪已来》,并详细解读了信中宣布的“Touch High(摸高)”计划。该计划决定未来两年不以商业变现为重,
📅 2026-07-11 23:09 (25 天前) Datawhale 人工智能 10 分鐘 ★ 88
AI Agent LLM 模型训练与推理 AI 安全与对齐
全球首个!「具身原生」世界动作模型来了
📌 一句话摘要 蚂蚁灵波发布全球首个具身原生预训练模型 LingBot-VA 2.0,采用因果建模与异步推理,在仿真基准上成功率 93.6%,推动机器人大脑走向自主决策。 📝 详细摘要 文章报道蚂蚁灵波发布的 LingBot-VA 2.0 模型,这是行业首个具身原生预训练模型。文章解释其与主流视
📅 2026-07-10 13:37 (27 天前) 新智元 人工智能 2 分鐘 ★ 84
具身智能 世界模型 机器人 AI Agent
SIGGRAPH 2026 | VeraRetouch:多任务推理式照片修图框架
📌 一句话摘要 本文介绍了 SIGGRAPH 2026 入选论文 VeraRetouch,一个轻量、全可微分、可移动端部署的多任务推理式照片修图框架,能将用户语言意图转化为像素级专业修图。 📝 详细摘要 文章详细介绍了 vivo BlueImage Lab 联合浙大、之江实验室与中科院大学提出的
📅 2026-07-08 20:00 (29 天前) vivo互联网技术 人工智能 7 分鐘 ★ 88
AI 产品与应用 多模态 AI 模型训练与推理 计算机视觉
AutoResearch-LLM:让 Agent 接手 LLM 训练优化
📌 一句话摘要 本文介绍一套 Agent 驱动的 LLM 微调自动化框架 AutoResearch-LLM,通过三阶段流水线(场景诊断→方案设计→自动化实验)将调参经验沉淀为 SKILL.md,并在 1688 电商任务上落地验证,提供了从理论到工程的可复用方法论。 📝 详细摘要 文章系统展示了
📅 2026-07-06 08:30 (07-06 08:30) 阿里云开发者 人工智能 16 分鐘 ★ 92
大语言模型 AI Agent 微调 模型训练与推理
刚刚,美团 LongCat-2.0 开源,1.6 万亿参数,纯国产卡训练
📌 一句话摘要 美团开源 LongCat-2.0 大模型,1.6 万亿参数 MoE,33B-56B 动态激活,基于 5 万张国产卡训练,Agent 基准测试与 Gemini 3.1 Pro 同档。 📝 详细摘要 文章报道美团开源了 LongCat-2.0 大模型。模型采用 MoE 架构,总参数
📅 2026-07-05 18:09 (07-05 18:09) 赛博禅心 人工智能 8 分鐘 ★ 82
LLM MoE 国产芯片 模型训练与推理
全球首次基于可控存内计算!忆阻器神经动力学芯片面世,0.43 秒搞定大脑表面建模
📌 一句话摘要 北京大学与中科院团队利用相变存储器的电阻漂移特性,研制出全球首款基于可控存内计算的神经动力学芯片,以 0.43 秒完成大脑皮层 3D 重建,速度比 GPU 快近 500 倍。 📝 详细摘要 北京大学杨玉超团队与中科院上海微系统所宋志棠团队合作,在 40 纳米制程上研制了一款神经动
📅 2026-07-05 17:11 (07-05 17:11) DeepTech深科技 人工智能 6 分鐘 ★ 90
AI 硬件与芯片 存算一体 神经动力系统 模型训练与推理
ACL 2026|块越大,推理越差?扩散语言模型的新难题被 T* 破解了
📌 一句话摘要 本文介绍一篇 ACL 2026 论文,提出 T* 方法通过渐进式块缩放课程解决扩散语言模型中大块推理质量下降的问题,在 MATH500 等数学推理任务上取得显著提升。 📝 详细摘要 文章报道了来自上海科学智能研究院等机构的研究者在扩散语言模型领域的新工作 T*。论文指出,掩码扩散
📅 2026-07-05 12:34 (07-05 12:34) 机器之心 人工智能 5 分鐘 ★ 85
扩散模型 LLM 强化学习 模型训练与推理
全球首款忆阻器神经动力学芯片问世,脑机接口赛道加速爆发
📌 一句话摘要 北大联合中科院团队研发出全球首款忆阻器神经动力学芯片,首次将运算时延压缩至毫秒级,较 GPU 提速最高 478 倍,为脑机接口与脑疾病诊疗带来全新硬件底座。 📝 详细摘要 文章报道了北京大学杨玉超团队联合中科院成功研制全球首款基于相变忆阻器的神经动力学芯片,相关成果已发表于《科学
📅 2026-07-04 20:42 (07-04 20:42) 券商中国 人工智能 11 分鐘 ★ 82
脑机接口 AI 硬件与芯片 模型训练与推理 AI 商业化
从 LLM 到 JEPA,中国团队正在把“世界模型”搬进细胞内部
📌 一句话摘要 本文介绍百曜科技发布的全球首个基于 LLM-JEPA 架构的 AI 虚拟细胞世界模型 AURA CellOS,阐述其多视角表征、JEPA 预测与无损扩容三大创新,以及产业格局与挑战。 📝 详细摘要 文章详细报道了百曜科技发布的 AURA CellOS 模型,这是全球首个将 JEP
📅 2026-07-03 22:28 (07-03 22:28) 田, 晏林 人工智能 7 分鐘 ★ 78
世界模型 LLM AI产品与应用 模型训练与推理
从「预测」到「规划」未来:WLA 统一了世界建模、语言推理与动作生成
📌 一句话摘要 上海交通大学 DENG Lab 提出 WLA 模型,将世界建模、语言推理与动作生成统一在自回归框架中,通过文本意图与物理动态双通道预测,实现高效实时机器人控制。 📝 详细摘要 文章介绍了上海交通大学 DENG Lab 提出的世界-语言-动作模型(WLA),旨在统一世界建模、语言推
📅 2026-07-03 15:04 (07-03 15:04) 机器之心 人工智能 6 分鐘 ★ 83
具身智能 世界模型 机器人 模型训练与推理
CVPR 2026 | 面向视频扩散模型的局部细节偏好优化方法 LocalDPO
📌 一句话摘要 本文介绍淘天音视频团队提出的 LocalDPO 方法,以高质量真实视频为正样本、通过局部时空退化自动构造负样本,结合区域感知 DPO 损失实现视频局部细节的细粒度偏好优化,无需人工标注或外部打分模型,在 CogVideoX 和 Wan2.1 等模型上显著提升视觉质量与人类偏好,相关
📅 2026-07-03 16:13 (07-03 16:13) 大淘宝技术 人工智能 8 分鐘 ★ 85
视频生成 扩散模型 模型训练与推理 偏好对齐