全部 未讀 (12239) ★ 收藏 (0) 🤖 人工智能 (7794) 📊 商业科技 (1919) 💻 软件编程 (1219) 📁 个人成长 (762) 🎨 产品设计 (214) 📁 生活文化 (131) 📁 媒体资讯 (80) 📁 投资财经 (76) 📁 AI 产品 (39) 📁 AI (5)
篩選中: 🏷️ 推测解码 共 2 篇 ✕ 清除篩選
12241
全部文章
12239
未讀
111
今日新增
0
收藏
📡 Poller 最後抓取: 1 小時前 (04-18 20:00)
BestBlogs 精選 (12220)

🏷️ 熱門標籤

AI Agent 1371 AI 智能体 738 Claude Code 656 Anthropic 651 LLM 564 AI 编程 538 OpenClaw 501 开源 445 AI 安全 410 Claude 400 AI 398 OpenAI 371 软件工程 359 开发者工具 349 生产力 308 GitHub 254 自动化 241 AI 基础设施 229 AI 开发 226 MCP 225
通过推测解码将 LLM 推理延迟降低 10 倍
📌 一句话摘要 这是一篇强烈推荐的博客文章,详细介绍了如何利用基于 SRAM 的 Corsairs 进行推测解码,从而实现超过 1400 tokens/秒的吞吐量并将延迟降低 10 倍。 📝 详细摘要 该推文强调了 LLM 推理优化方面的一项重大技术突破。通过将推测解码任务卸载到 2GB SRA
📅 2026-04-03 23:06 (14 天前) Deedy 人工智能 1 分鐘 ★ 82
LLM 推理 推测解码 延迟优化 AI 基础设施
**介绍 SPEED-Bench:一个用于推测解码的统一且多样化的基准测试**
📌 一句话摘要 SPEED-Bench 是一套全面的基准测试套件,旨在评估跨不同语义领域和真实生产级服务工作负载下的推测解码(Speculative Decoding, SD)。 📝 详细摘要 本文介绍了由 NVIDIA 开发的统一评估框架 SPEED-Bench,旨在解决推测解码(SD)基准测
📅 2026-03-19 22:04 (29 天前) Talor Abramovich, Maor Ashkenazi, Izzy Putterman, Benjamin Chislett, Tiyasa Mitra, Bita Rouhani, Ran Zilberstein, Yonatan Geifman 人工智能 2 分鐘 ★ 89
推测解码 LLM 推理 基准测试 性能优化