📡 Poller 最後抓取: 1 小時前 (08-06 18:00)
BestBlogs 精選 (37617)
🏷️ 熱門標籤
● 详解 Kimi K3:强到冲击 Anthropic 估值的模型什么样?
● 大模型重回参数竞赛:2 万亿成标配,3 万亿是下一站? - 经济观察网 - 专业财经新闻网站
● 谁在训练 Kimi K3 ? 深挖贡献者名单,这有一份最全档案
● 黄仁勋为何力挺梁文锋、杨植麟?
● 把思考折叠进序列:WeLM 617B MoE 的隐式 Scaling 路径
📅 2026-07-24 12:33 (13 天前) 新智元 人工智能 7 分鐘 ★ 84
● 探讨大模型参数规模增长与 Gated Delta Networks 架构
📅 2026-07-21 12:19 (16 天前) 向阳乔木 人工智能 1 分鐘 ★ 76
● 通识为体、专业为用:Intern-S2-Preview-397B 开启科学智能体基座时代 | WAIC 2026
● 397B 参数追平万亿模型,上海 AI Lab 发布科学智能体新基座 | WAIC 2026
● [随笔]什么是 AI Native
● Z Tech|专访 FaceMind 创始人 Adam Lu:循环世界模型(LoopWM)极有可能是下一代通用世界模型架构
● Loop 世界模型论文登顶 Hugging Face,来自中国一家初创,周鸿祎陆奇都投了
● Jumper 跳槽 Anthropic 后复盘 AlphaFold 的苦涩教训:成功源于定制化架构,根本不靠堆算力
● Gemma 4 12B 通过无编码器架构实现设备端多模态主动工作流
● Transformer 之父离开谷歌,奥特曼等了他十年
📅 2026-06-19 11:08 (06-19 11:08) 虎嗅APP 人工智能 8 分鐘 ★ 85
● HuggingFace CEO 力荐,Bengio 团队也押注:这个 1500 美元训出的 HRM 模型,凭什么火了?
● 新架构模型 HRM-Text 创新纪录!1B 参数、1000 美元,图灵奖得主都亲自下场了
● 有关第三代模型,苹果管理层回应一切
● jina-embeddings-v5-omni 发布!全模态向量小模型
📅 2026-05-14 17:37 (05-14 17:37) 魔搭ModelScope社区 人工智能 2 分鐘 ★ 86
● 开源神话:DeepSeek-V4 开源 SOTA!总参数 1.6T,最大开源模型;Flash 版输出仅 0.28 美元/百万 token;与 OpenClaw 等无缝集成;三项架构升级
📅 2026-04-24 14:19 (04-24 14:19) 51CTO技术栈 人工智能 2 分鐘 ★ 86
● DeepSeek-V4 全新注意力机制解析
📅 2026-04-24 12:02 (04-24 12:02) Berryxia.AI 人工智能 1 分鐘 ★ 83