全部 未讀 (39825) ★ 收藏 (0) 🤖 人工智能 (14572) 📊 商业科技 (6938) 📁 媒体资讯 (5852) 📁 投资财经 (3657) 📁 生活文化 (3082) 💻 软件编程 (2079) 📁 个人成长 (2001) 📁 体育运动 (1042) 🎨 产品设计 (550) 📁 AI 产品 (39)
篩選中: 🏷️ 弹性扩缩容 共 1 篇 ✕ 清除篩選
39827
全部文章
39825
未讀
186
今日新增
0
收藏
📡 Poller 最後抓取: 1 小時前 (08-13 18:00)
BestBlogs 精選 (39754)

🏷️ 熱門標籤

AI Agent 3269 政策解读 1740 投资与市场 1520 宏观经济 1407 AI 编程 1372 产业动态 1349 国际新闻 1268 LLM 1189 社会议题 1101 Anthropic 1096 国内新闻 1061 Claude Code 1045 地缘政治 1000 科技新闻 923 OpenAI 905 AI 智能体 789 生活方式 758 具身智能 704 个人成长 704 足球 695
昆仑芯大规模 LLM 推理优化,实现秒级扩缩容
📌 一句话摘要 本文介绍了昆仑芯针对大规模 LLM 推理冷启动耗时长的痛点,通过权重传输优化、编译缓存复用、Lazy CUDA Graph 及守护实例等技术,实现了超大模型秒级扩缩容的工程实践。 📝 详细摘要 针对大模型推理服务在流量波动时扩容缓慢(动辄数分钟)的问题,昆仑芯团队提出了全链路优化
📅 2026-03-31 18:05 (03-31 18:05) 百度Geek说 人工智能 2 分鐘 ★ 88
LLM 推理 昆仑芯 vLLM 弹性扩缩容