全部 未讀 (37696) ★ 收藏 (0) 🤖 人工智能 (14295) 📊 商业科技 (6633) 📁 媒体资讯 (5216) 📁 投资财经 (3201) 📁 生活文化 (2769) 💻 软件编程 (2050) 📁 个人成长 (1954) 📁 体育运动 (995) 🎨 产品设计 (531) 📁 AI 产品 (39)
篩選中: 🏷️ 模型部署与推理 共 1 篇 ✕ 清除篩選
37698
全部文章
37696
未讀
206
今日新增
0
收藏
📡 Poller 最後抓取: 59 分鐘前 (08-06 20:00)
BestBlogs 精選 (37625)

🏷️ 熱門標籤

AI Agent 3158 政策解读 1593 投资与市场 1383 AI 编程 1326 宏观经济 1264 产业动态 1249 国际新闻 1150 LLM 1147 Anthropic 1087 Claude Code 1038 社会议题 983 国内新闻 958 地缘政治 924 OpenAI 891 科技新闻 879 AI 智能体 788 生活方式 688 开源 683 足球 671 个人成长 661
本地部署 GLM-5.2 的门槛太高了,根本玩不起!
📌 一句话摘要 作者测试发现本地部署 GLM-5.2 需要超大显存(量化版 436G,FP8 版 704G),在 H20 上推理速度慢且并发能力差,硬件门槛极高。 📝 详细摘要 本文是作者在算力服务器上部署 GLM-5.2 的实测记录。尝试了两个版本:unsloth 的 UD-Q4_K_XL 量
📅 2026-06-28 17:51 (06-28 17:51) beginor 人工智能 8 分鐘 ★ 78
LLM 模型部署与推理 AI硬件与芯片 性能评测