SuperPortia Reading
總覽
文章
簡報
🔍 搜尋
全部
未讀 (39825)
★ 收藏 (0)
🤖 人工智能 (14572)
📊 商业科技 (6938)
📁 媒体资讯 (5852)
📁 投资财经 (3657)
📁 生活文化 (3082)
💻 软件编程 (2079)
📁 个人成长 (2001)
📁 体育运动 (1042)
🎨 产品设计 (550)
📁 AI 产品 (39)
篩選中:
🏷️ 弹性扩缩容
共 1 篇
✕ 清除篩選
39827
全部文章
39825
未讀
186
今日新增
0
收藏
📡 Poller
最後抓取:
1 小時前
(08-13 18:00)
BestBlogs 精選 (39754)
🏷️ 熱門標籤
AI Agent
3269
政策解读
1740
投资与市场
1520
宏观经济
1407
AI 编程
1372
产业动态
1349
国际新闻
1268
LLM
1189
社会议题
1101
Anthropic
1096
国内新闻
1061
Claude Code
1045
地缘政治
1000
科技新闻
923
OpenAI
905
AI 智能体
789
生活方式
758
具身智能
704
个人成长
704
足球
695
●
昆仑芯大规模 LLM 推理优化,实现秒级扩缩容
📌 一句话摘要 本文介绍了昆仑芯针对大规模 LLM 推理冷启动耗时长的痛点,通过权重传输优化、编译缓存复用、Lazy CUDA Graph 及守护实例等技术,实现了超大模型秒级扩缩容的工程实践。 📝 详细摘要 针对大模型推理服务在流量波动时扩容缓慢(动辄数分钟)的问题,昆仑芯团队提出了全链路优化
📅 2026-03-31 18:05
(03-31 18:05)
百度Geek说
人工智能
2 分鐘
★ 88
LLM 推理
昆仑芯
vLLM
弹性扩缩容