全部 未讀 (37696) ★ 收藏 (0) 🤖 人工智能 (14295) 📊 商业科技 (6633) 📁 媒体资讯 (5216) 📁 投资财经 (3201) 📁 生活文化 (2769) 💻 软件编程 (2050) 📁 个人成长 (1954) 📁 体育运动 (995) 🎨 产品设计 (531) 📁 AI 产品 (39)
篩選中: 🏷️ GEMM 共 166 篇 ✕ 清除篩選
37698
全部文章
37696
未讀
206
今日新增
0
收藏
📡 Poller 最後抓取: 49 分鐘前 (08-06 20:00)
BestBlogs 精選 (37625)

🏷️ 熱門標籤

AI Agent 3158 政策解读 1593 投资与市场 1383 AI 编程 1326 宏观经济 1264 产业动态 1249 国际新闻 1150 LLM 1147 Anthropic 1087 Claude Code 1038 社会议题 983 国内新闻 958 地缘政治 924 OpenAI 891 科技新闻 879 AI 智能体 788 生活方式 688 开源 683 足球 671 个人成长 661
AI Infra 进阶:如何让大模型输出确定的结果
📌 一句话摘要 本文深入剖析了大模型推理中 Batch Invariance(批次不变性)缺失的底层技术根源,指出 GPU 算子动态调度策略(如 Split-K、BLOCK_K 变化)导致的浮点加法顺序改变是导致结果波动的核心原因,并探讨了在 AI Infra 层面的优化与 Trade-off。
📅 2026-08-05 17:25 (1 天前) 腾讯技术工程 人工智能 2 分鐘 ★ 90
AI Infra GPU GEMM vLLM
Gemma 4 助力 Cue 打造极速端侧语音智能体交互体验
📌 一句话摘要 文章介绍了谷歌 Gemma 4 模型如何被集成到端侧语音智能体 Cue 中,通过降低润色延迟并保留用户说话风格,实现更流畅的语音交互。 📝 详细摘要 文章详细阐述了 Cue 语音智能体如何将谷歌开源的 Gemma 4 E4B 模型引入本地润色流程,从而将语音转写后的润色延迟从 8
📅 2026-07-24 17:30 (13 天前) 谷歌开发者 人工智能 2 分鐘 ★ 84
Gemma 4 端侧 AI 语音智能体 语音润色
Google 发布 gemma-trainer:本地微调专属 Gemma 模型
📌 一句话摘要 Google 推出 gemma-trainer 工具,允许用户在自己电脑上微调 Gemma 模型,小互提供了详细教程链接。 📝 详细摘要 小互分享了 Google 发布的 gemma-trainer 工具,该工具支持在本地计算机上对 Gemma 模型进行微调。推文附带其个人网站上
📅 2026-07-18 12:05 (19 天前) 小互 人工智能 1 分鐘 ★ 82
Gemma Google 微调 AI训练
Google Pixel 10 演示 Gemma 4 本地化运行
📌 一句话摘要 Google 展示了在 Pixel 10 上通过 TPU 运行 Gemma 4 轻量版,实现离线状态下的多模态交互功能。 📝 详细摘要 在 Google I/O India 大会上,Google Tensor 与 Pixel 团队演示了将 Gemma 4 轻量版集成至手机 TPU
📅 2026-07-15 17:10 (22 天前) 小互 人工智能 2 分鐘 ★ 82
Gemma 4 Google Pixel On-device AI TPU
Gemma 4 12B Coder:本地运行,蒸馏 Fable 5 推理能力
📌 一句话摘要 基于 Google Gemma 4 微调的 12B 本地模型,蒸馏了 Fable 5 的推理链条,可在消费级显卡上离线运行顶级编码能力。 📝 详细摘要 本文介绍 Gemma 4 12B Coder GGUF 模型,基于 Google 的 gemma-4-12B-it 微调,专门针
📅 2026-06-15 16:14 (06-15 16:14) Berryxia.AI 人工智能 1 分鐘 ★ 87
Gemma 4 本地模型 代码生成 GGUF
正式推出 Gemma 4 12B: 一款统一、免编码器的多模态模型
📌 一句话摘要 Google 正式发布 Gemma 4 12B,一款采用免编码器统一架构、可在 16GB 显存笔记本上本地运行的多模态模型,性能接近 26B MoE 模型。 📝 详细摘要 本文是 Google 官方对 Gemma 4 12B 模型的发布公告。该模型采用创新的免编码器架构,直接处理
📅 2026-06-08 18:50 (06-08 18:50) 谷歌开发者 人工智能 2 分鐘 ★ 82
模型发布 多模态 AI LLM 端侧 AI
Gemma 4 多词元预测:生成速度最高提升约 3 倍
📌 一句话摘要 Gemma 4 通过多词元预测(MTP)草稿模型与投机解码技术,在单次前向传播中并行生成并校验多个词元,实现最高约 3 倍的推理加速,且不损失输出质量。 📝 详细摘要 本文介绍了 Google 推出的 Gemma 4 模型与多词元预测(MTP)草稿模型协同工作的技术原理与优势。M
📅 2026-05-28 16:35 (05-28 16:35) InfoQ 中文 人工智能 2 分鐘 ★ 85
Gemma 4 多词元预测 投机解码 推理加速
Google Gemma 团队推出 AIventure:一个融合 Agentic Workflow 的地牢游戏
📌 一句话摘要 Google Gemma 团队开源了 AIventure,一个将 agentic workflow 和 vibe-coding 融入地牢爬行游戏的开发者大师课项目。 📝 详细摘要 作者介绍了 Google Gemma 团队推出的开源项目 AIventure。这是一个复古风格的地牢
📅 2026-05-27 08:06 (05-27 08:06) Berryxia.AI 人工智能 1 分鐘 ★ 84
Google Gemma AIventure Agentic Workflow Vibe Coding
Gemma 4 留言板|真实用户反馈
📌 一句话摘要 本文汇总了 Google 开发者社区用户对 Gemma 4 模型在代码生成、多模态理解、端侧部署等场景的真实使用反馈,展示了其在实际应用中的表现与用户评价。 📝 详细摘要 本文是 Google 官方发布的一篇用户反馈合集,旨在通过真实用户的使用体验来展示 Gemma 4 模型的能
📅 2026-05-26 17:30 (05-26 17:30) 谷歌开发者 人工智能 2 分鐘 ★ 80
Gemma 4 Google AI 大语言模型 用户反馈
Gemma 4 开发者大赛|集结完毕!开发冲刺进行时
📌 一句话摘要 本文是 Gemma 4 开发者大赛的赛程更新与动员公告,宣布报名截止、作品提交与半决赛安排,并介绍导师支持与决赛福利。 📝 详细摘要 文章是谷歌开发者官方发布的 Gemma 4 开发者大赛阶段性公告。内容首先回顾了大赛启动以来开发者们的热情参与和感人故事,包括在校学生、职场技术人
📅 2026-05-22 17:30 (05-22 17:30) 谷歌开发者 媒体资讯 1 分鐘 ★ 76
Gemma 4 开发者大赛 谷歌开发者 黑客松
LLM 近期重大架构进化一览:从 Gemma 4 到 DeepSeek V4
📌 一句话摘要 本文翻译并整理了 Sebastian Raschka 的技术博客,系统梳理了 Gemma 4、Laguna XS.2、ZAYA1-8B 和 DeepSeek V4 等最新 LLM 在降低长上下文推理成本方面的架构创新,包括跨层 KV 共享、分层注意力预算、压缩卷积注意力和流形约束超
📅 2026-05-19 12:00 (05-19 12:00) 机器之心 人工智能 2 分鐘 ★ 87
LLM 架构 长上下文 KV Cache Gemma 4
Gemma 4 开发者大赛|2026
📌 一句话摘要 GDG China 发起 Gemma 4 开发者大赛,鼓励开发者利用 Google 最新开放模型构建 AI 应用,涵盖 Agent、多模态、边缘计算和社会公益四大赛道。 📝 详细摘要 本文是 GDG China 发起的 Gemma 4 开发者大赛的官方公告。大赛基于 Google
📅 2026-05-18 18:31 (05-18 18:31) 谷歌开发者 人工智能 1 分鐘 ★ 75
Gemma 4 开发者大赛 AI Agent 多模态
Gemma 4 性能跃迁: 借助 MTP 草稿模型实现高达 3 倍的推理加速
📌 一句话摘要 Google 为 Gemma 4 系列推出 MTP 草稿模型,通过推测性解码架构在保持输出质量的前提下实现最高 3 倍推理加速,有效解决内存带宽瓶颈。 📝 详细摘要 本文由 Google 官方发布,介绍了为 Gemma 4 系列模型推出的多 Token 预测 (MTP) 草稿模型
📅 2026-05-18 18:31 (05-18 18:31) 谷歌开发者 人工智能 2 分鐘 ★ 86
Gemma 4 MTP 推测性解码 推理加速
Google 为 Gemma 4 发布 MTP Drafter,推理速度最高提升 3 倍
📌 一句话摘要 Google 为开源模型 Gemma 4 发布了 MTP drafter,通过推测解码技术将推理速度提升最高 3 倍,且输出质量不变。 📝 详细摘要 这篇推文详细介绍了 Google 为其开源模型 Gemma 4 推出的 MTP drafter(多 token 预测草稿模型)。该
📅 2026-05-06 01:35 (05-06 01:35) 宝玉 人工智能 1 分鐘 ★ 88
Gemma 4 MTP Drafter 推测解码 推理加速
Google Gemma 官方教程:本地运行 Coding Agent
📌 一句话摘要 Google Gemma 官方发布了使用 Pi Agent 和 Gemma 4 模型在本地运行 Coding Agent 的教程。 📝 详细摘要 该推文引用了 Google Gemma 官方的教程,介绍了如何组合使用 Pi Agent、Gemma 4 26B 模型和 LM Stu
📅 2026-04-29 07:51 (04-29 07:51) Berryxia.AI 人工智能 1 分鐘 ★ 82
Google Gemma Coding Agent Pi Agent 本地部署
Gemma 4 E2B 驱动的本地浏览器 Agent 发布
📌 一句话摘要 一个由 Gemma 4 E2B 和 WebGPU 驱动的完全本地浏览器 Agent,可实现搜索历史、阅读总结页面和管理标签页。 📝 详细摘要 该推文引用 Google Gemma 官方账号的发布,介绍了一个完全运行在浏览器本地的 Agent。它由 Gemma 4 E2B 和 We
📅 2026-04-28 06:57 (04-28 06:57) Berryxia.AI 人工智能 1 分鐘 ★ 82
Gemma 4 WebGPU 浏览器 Agent 本地 AI
用 Gemma 4 + Pi Agent 在本地跑一个 Coding Agent 的完整指南
📌 一句话摘要 详细介绍了如何使用 Gemma 4 26B A4B 模型和 Pi Agent 框架搭建 100% 本地运行的 Coding Agent,涵盖模型选型、量化配置、上下文管理、安装步骤和安全防护。 📝 详细摘要 这条推文是一篇深度技术指南,引用并扩展了 @patloeber 的教程,
📅 2026-04-27 20:10 (04-27 20:10) meng shao 人工智能 1 分鐘 ★ 88
Gemma 4 Pi Agent Coding Agent 本地部署
测试 OpenCode、Ollama 与 Gemma 4 的协作能力
📌 一句话摘要 作者尝试使用 OpenCode 结合 Ollama 本地运行的 Gemma 4 模型进行编程测试。 📝 详细摘要 这是一条简短的测试推文,记录了作者开始探索 AI 编程工具链的组合:OpenCode(AI 编程环境)、Ollama(本地大模型运行框架)以及 Gemma 4 模型。
📅 2026-04-23 22:54 (04-23 22:54) 卫斯理 人工智能 1 分鐘 ★ 74
OpenCode Ollama Gemma 4 AI 编程
AI 编程体验:使用 Gemma 4 自动生成 Astro 博客
📌 一句话摘要 作者分享了利用 OpenCode 和本地模型 Gemma 4 编写 Astro 博客并部署至 Cloudflare 的体验,并感悟 AI 对编程范式的改变。 📝 详细摘要 作者通过引用前序推文,展示了具体的测试案例:要求 AI 编写一个基于 Astro 框架的小型博客并部署到 C
📅 2026-04-23 23:49 (04-23 23:49) 卫斯理 人工智能 1 分鐘 ★ 81
AI 编程 Astro Cloudflare Gemma 4
社区实践:小米 12 Pro 刷机运行 Ollama,部署 Gemma 4 作局域网 API
📌 一句话摘要 分享了一个社区项目:将小米 12 Pro 刷入 LineageOS,分配大内存给 Ollama,成功部署 Gemma 4 模型作为局域网 API 服务器。 📝 详细摘要 这条推文分享了一个极客社区实践案例。有用户将小米 12 Pro 手机刷入纯净的 LineageOS 系统,进行
📅 2026-04-16 16:23 (04-16 16:23) Yangyi 人工智能 1 分鐘 ★ 81
本地部署 Ollama Gemma 4 移动端AI