全部 未讀 (37730) ★ 收藏 (0) 🤖 人工智能 (14302) 📊 商业科技 (6636) 📁 媒体资讯 (5224) 📁 投资财经 (3213) 📁 生活文化 (2771) 💻 软件编程 (2052) 📁 个人成长 (1954) 📁 体育运动 (995) 🎨 产品设计 (531) 📁 AI 产品 (39)
篩選中: 🏷️ 模型蒸馏 共 30 篇 ✕ 清除篩選
37732
全部文章
37730
未讀
240
今日新增
0
收藏
📡 Poller 最後抓取: 45 分鐘前 (08-06 22:00)
BestBlogs 精選 (37659)

🏷️ 熱門標籤

AI Agent 3163 政策解读 1598 投资与市场 1391 AI 编程 1328 宏观经济 1266 产业动态 1250 国际新闻 1151 LLM 1148 Anthropic 1087 Claude Code 1038 社会议题 986 国内新闻 961 地缘政治 924 OpenAI 891 科技新闻 879 AI 智能体 788 生活方式 689 开源 683 足球 671 个人成长 662
英伟达、Meta、微软和戴尔等联名支持开源模型 为“蒸馏”正名
📌 一句话摘要 英伟达、Meta、微软等硅谷巨头联名支持开源模型,并为“模型蒸馏”技术正名,强调开源生态对技术创新与竞争的重要性。 📝 详细摘要 本文报道了由英伟达创始人黄仁勋发起的硅谷企业联名行动。联名信强调开源权重模型对于加强安全、加快创新普及及推动技术自主的关键作用,认为美国在 AI 领域
📅 2026-07-26 15:07 (11 天前) 财新 商业科技 1 分鐘 ★ 82
开源模型 英伟达 模型蒸馏 AI 产业政策
AlloyDB 推出代理模型,用数据库本地推理替代外部大模型调用
📌 一句话摘要 谷歌 AlloyDB 推出代理模型架构,通过查询时模型蒸馏将大模型判断逻辑本地化,实现数据库原生速度的 AI 推理,吞吐量最高提升 23000 倍。 📝 详细摘要 谷歌宣布 AlloyDB AI 函数正式可用,并推出智能批处理与代理模型两项加速技术。文章重点解析了代理模型的架构创
📅 2026-07-17 12:59 (20 天前) InfoQ 中文 人工智能 2 分鐘 ★ 87
AI 产品与应用 LLM 数据库 AI 工作流
马斯克也开始 L4 降维 L2 了!FSD 正式进入反转时刻
📌 一句话摘要 特斯拉 FSD v14.3.5 统一了智能召唤、FSD 与 Robotaxi 的模型,研发主线从「量产车 L2 升维 L4」逆转为「Cybercab L4 模型蒸馏下放量产车 L2」,标志着 L2 与 L4 路线合流。 📝 详细摘要 特斯拉推送 FSD v14.3.5,核心变化是
📅 2026-07-15 15:22 (22 天前) 杰西卡 人工智能 2 分鐘 ★ 82
特斯拉 FSD 自动驾驶 Robotaxi
淘宝直播数字人 AgenticRL 实践:从 RLVR 到 MultiAgent RL
📌 一句话摘要 本文介绍淘宝直播数字人从 Workflow 升级到 Agentic 架构,通过 AgentTuning 蒸馏降低延迟、RLVR 减少幻觉及创新 Multi-Agent RL 算法,实现低延迟高拟真互动,事实正确性提升 4.1pt。 📝 详细摘要 文章详细阐述了淘宝直播数字人互动架
📅 2026-07-13 16:29 (24 天前) 大淘宝技术 人工智能 16 分鐘 ★ 92
AI Agent 强化学习 大模型蒸馏 RLVR
试用期结束,AI 大厂正在互相设防
📌 一句话摘要 本文基于 2026 年多个事件,分析谷歌、微软、Meta 等 AI 大厂开始互相限制使用对方模型,从资源、数据和资产三个维度解释“AI 试用期结束”的原因,并指出行业进入新竞合阶段。 📝 详细摘要 文章以 2026 年上半年一系列事件为线索:谷歌限制 Meta 使用 Gemini
📅 2026-07-06 07:45 (07-06 07:45) 人人都是产品经理 人工智能 7 分鐘 ★ 84
AI 商业化 AI 安全与对齐 LLM AI 编程
阿里内部全面禁用 Claude Code
📌 一句话摘要 阿里因 Anthropic 指控模型蒸馏攻击及发现 Claude Code 内置隐蔽中国用户检测机制,于 7 月 3 日全面禁用 Claude 系列产品。 📝 详细摘要 文章报道了阿里巴巴内部下发的通知:从 7 月 10 日起,全面禁用 Claude(包括 Sonnet、Opus
📅 2026-07-03 22:10 (07-03 22:10) Datawhale 人工智能 5 分鐘 ★ 87
Claude Code AI安全 模型蒸馏 安全检测
偷藏 3 个月,Anthropic 删除识别“中国 AI”的隐藏代码,官方回应:这只是一次实验,我们早想删了
📌 一句话摘要 Anthropic 在 Claude Code 中隐藏了一套检测中国时区、域名及 AI 实验室的代码,用于识别模型蒸馏行为,被开发者发现后引发隐私与信任争议,官方回应称已计划移除。 📝 详细摘要 本文报道了 Anthropic 在 Claude Code 中隐藏近三个月的检测代码
📅 2026-07-02 15:24 (07-02 15:24) CSDN 媒体资讯 8 分鐘 ★ 78
科技新闻 AI Agent LLM 隐私与安全
抱抱脸模型 TOP 榜,我现在只服 yuxinlu1
📌 一句话摘要 一位个人开发者利用高质量数据微调并量化 12B 本地模型,在 Hugging Face Trending 榜上击败多款大厂模型,下载量超 70 万。 📝 详细摘要 量子位报道了一位名为逯雨鑫(yuxinlu1)的个人开发者,他通过微调 Gemma 4-12B 模型,制作了专注于编
📅 2026-06-28 21:55 (06-28 21:55) 听雨 人工智能 6 分鐘 ★ 82
LLM 开源 模型蒸馏 GGUF
Fable 5 还未解禁,Anthropic 一纸诉状砸向 Qwen,自家 CEO 却被白宫嫌“怪”踢出局!
📌 一句话摘要 Anthropic 指控阿里巴巴旗下 Qwen 实验室对 Claude 发起大规模模型蒸馏,涉及近 2.5 万虚假账户和 2900 万次交互,同时该公司因 Fable 5 出口管制正与白宫谈判受阻。 📝 详细摘要 文章报道了 Anthropic 于 6 月 10 日致信美国参议员
📅 2026-06-25 16:42 (06-25 16:42) AI前线 人工智能 2 分鐘 ★ 82
LLM 模型蒸馏 AI安全与对齐 模型训练与推理
4 步出声,单卡 0.24 秒!Noiz AI 联合港科大清华,开源音频生成大模型
📌 一句话摘要 AudioX-Turbo 通过分布匹配蒸馏与对抗蒸馏,将音频生成扩散步数从 50-200 步压缩至 4 步,单卡 RTX 4090 上生成 10 秒音频仅需 0.24 秒,并配合 920 万量级强指令数据集实现精确时间戳控制,模型与代码已全部开源。 📝 详细摘要 文章报道了 No
📅 2026-06-15 14:52 (06-15 14:52) 思邈 人工智能 2 分鐘 ★ 84
AI 音频生成 模型蒸馏 扩散模型 多模态 AI
谷歌四大巨头齐聚:蒸馏模型的精髓是“挤柠檬”!Gemini 将用自己写的代码“改进”自己!五年后的谷歌可能只有一款产品
📌 一句话摘要 Google DeepMind 四位核心人物(Jeff Dean、Noam Shazeer、Oriol Vinyals、Koray Kavukcuoglu)深度对谈,揭秘 Gemini 3.5 Flash 研发幕后、模型蒸馏的“挤柠檬”精髓、Omni 作为世界模型的定位,并预测五年
📅 2026-05-30 18:09 (05-30 18:09) 51CTO技术栈 人工智能 2 分鐘 ★ 86
Gemini 3.5 Google DeepMind 模型蒸馏 世界模型
速递|马斯克当庭承认,xAI 蒸馏 OpenAI 模型来训练 Grok
📌 一句话摘要 马斯克在法庭上承认,xAI 通过蒸馏 OpenAI 模型来训练 Grok,并称这是 AI 公司的普遍做法。 📝 详细摘要 本文报道了埃隆·马斯克在加州联邦法院的证词,他承认 xAI 使用了蒸馏技术从 OpenAI 模型中学习以训练其 Grok 模型。马斯克声称这种做法在 AI 公
📅 2026-05-05 11:15 (05-05 11:15) Z Potentials 人工智能 1 分鐘 ★ 80
马斯克 xAI Grok OpenAI
Transformer 可以改装成 Mamba 了:苹果把推理成本直接打成线性
📌 一句话摘要 苹果提出一种两阶段蒸馏方法,将 Transformer 模型转换为 Mamba 架构,在仅使用 2.7% 训练数据的情况下,使 1B 参数模型的困惑度从 14.89 恢复至 14.11,逼近教师模型的 13.86,实现了推理成本从平方级到线性的转变。 📝 详细摘要 本文介绍了苹果
📅 2026-04-22 11:30 (04-22 11:30) 机器之心 人工智能 2 分鐘 ★ 88
Transformer Mamba 模型蒸馏 线性注意力
论文解读:模型蒸馏中的潜意识学习与安全风险
📌 一句话摘要 一篇 Nature 论文揭示,当学生模型与教师模型共享初始化权重时,即使训练数据(如纯数字序列)被完全过滤掉有害语义,教师模型的潜在偏好(如暴力倾向)仍能通过数据中的「微观纹理」传递给学生模型。 📝 详细摘要 这篇推文深度解读了一篇发表在 Nature 上的论文。论文通过一个思想
📅 2026-04-20 11:26 (04-20 11:26) 李继刚 人工智能 1 分鐘 ★ 91
模型蒸馏 AI 安全 潜意识学习 Nature 论文
Nature 论文揭示 AI 潜意识学习:不良特征可通过纯数字序列在模型间隐秘传播
📌 一句话摘要 一篇 Nature 论文揭示了 AI 模型可通过看似无意义的纯数字序列,将不良特征(如偏好或不对齐倾向)隐秘地传递给其他模型,这种现象被称为潜意识学习,对 AI 安全和模型蒸馏提出了根本性挑战。 📝 详细摘要 这篇推文深入解读了一篇发表在 Nature 上的论文,该论文揭示了一个
📅 2026-04-20 08:49 (04-20 08:49) 小互 人工智能 1 分鐘 ★ 89
潜意识学习 模型蒸馏 AI 安全 Nature 论文
Qwen3.5-9B 经 GLM-5.1 蒸馏版发布
📌 一句话摘要 作者转述并介绍了新开源的 Qwen3.5-9B-GLM5.1-Distill-v1 模型,称其通过 GLM-5.1 推理蒸馏提升了性能且仅需 8GB VRAM。 📝 详细摘要 这条推文热情地介绍了一个新开源模型:Qwen3.5-9B-GLM5.1-Distill-v1。该模型由开
📅 2026-04-16 22:59 (04-16 22:59) Berryxia.AI 人工智能 1 分鐘 ★ 82
Qwen 开源模型 模型蒸馏 GLM-5.1
推荐学习:关于「自我蒸馏」的内容分享
📌 一句话摘要 宝玉转发并推荐了一篇关于技术学习或模型「自我蒸馏」相关的推文内容。 📝 详细摘要 该推文为转发推荐性质,宝玉对被引用推文中的内容表示认可,并幽默地评论其为「自己蒸馏自己」。由于原引用推文仅含链接,结合宝玉的一贯关注领域,这通常指向 AI 模型训练、Prompt 工程或个人知识内化
📅 2026-04-11 11:15 (04-11 11:15) 宝玉 人工智能 3 分鐘 ★ 76
模型蒸馏 技术学习 知识内化 宝玉
一句话理解大模型蒸馏的本质
📌 一句话摘要 模型蒸馏的本质是让廉价且快速的小模型学习大模型的能力,以达到性价比平衡。 📝 详细摘要 作者通过通俗易懂的语言解释了「模型蒸馏」(Distillation)的核心逻辑:由于大语言模型(LLM)运行成本高、推理速度慢,通过技术手段让参数量较小的模型模仿大模型的输出,从而在保留大部分
📅 2026-04-10 11:25 (04-10 11:25) Mr Panda 人工智能 1 分鐘 ★ 81
模型蒸馏 LLM 模型压缩 技术科普
模型蒸馏与通用超智能的普及化
📌 一句话摘要 Garry Tan 认为,随着 AI 向超智能演进,模型蒸馏技术将让不同付费能力的各阶层用户都能从中受益。 📝 详细摘要 针对 AI 可能成为“奢侈品”的担忧,Garry Tan 解释了“母模型(Mother Models)”在将智能蒸馏到更小、更经济的模型中所起的作用。他断言,
📅 2026-04-10 05:00 (04-10 05:00) Garry Tan 人工智能 3 分鐘 ★ 84
模型蒸馏 AI 经济学 超智能 普及化
23 个月的周期:从前沿 AI 到掌上算力
📌 一句话摘要 Tomasz Tunguz 分析了 AI 模型压缩的飞速发展,指出前沿级性能现已能在短短 23 个月内从数据中心迁移到智能手机上。 📝 详细摘要 这条推文强调了 AI 模型压缩的加速步伐,并以 Google 发布 Gemma 4 E4B 为例,展示了前沿级性能如何在移动设备上本地
📅 2026-04-07 01:58 (04-07 01:58) Tomasz Tunguz 人工智能 1 分鐘 ★ 82
AI 压缩 Gemma 4 边缘 AI 模型蒸馏