全部 未讀 (37688) ★ 收藏 (0) 🤖 人工智能 (14292) 📊 商业科技 (6631) 📁 媒体资讯 (5216) 📁 投资财经 (3200) 📁 生活文化 (2769) 💻 软件编程 (2049) 📁 个人成长 (1953) 📁 体育运动 (995) 🎨 产品设计 (531) 📁 AI 产品 (39)
篩選中: 🏷️ 模型部署 共 22 篇 ✕ 清除篩選
37690
全部文章
37688
未讀
198
今日新增
0
收藏
📡 Poller 最後抓取: 1 小時前 (08-06 18:00)
BestBlogs 精選 (37617)

🏷️ 熱門標籤

AI Agent 3156 政策解读 1593 投资与市场 1382 AI 编程 1325 宏观经济 1264 产业动态 1248 国际新闻 1150 LLM 1147 Anthropic 1087 Claude Code 1038 社会议题 983 国内新闻 958 地缘政治 924 OpenAI 891 科技新闻 879 AI 智能体 788 生活方式 688 开源 683 足球 671 个人成长 661
腾讯开源新版 Agent 记忆管理中心,Qwen Audio 3 上线新 ASR 模型
📌 一句话摘要 本文介绍腾讯发布 Agent Memory 2.0 记忆管理系统,千问推出 Qwen Audio 3.0 新 ASR 模型,VeriLoop 推出编程模型 Coder-E1,DwarfStar 支持 DeepSeek V4 Flash 原生 CUDA MXFP4 推理,BarunL
📅 2026-08-04 15:38 (2 天前) 机器之心SOTA模型 人工智能 2 分鐘 ★ 86
AI Agent 语音识别 编程模型 模型部署
普通人跑不起 K3!Kimi 开源,Anthropic 微妙表态:从未主张禁止开放权重模型
📌 一句话摘要 月之暗面 Kimi 开源 2.8T 参数 K3 模型引发全球关注,Anthropic CEO 回应称从未主张禁止开放权重,同时披露了对芯片出口、蒸馏活动及安全测试的政策主张。 📝 详细摘要 北京时间 7 月 27 日晚,月之暗面正式开放 Kimi K3 模型权重、技术报告及关键
📅 2026-07-28 13:29 (9 天前) InfoQ 中文 人工智能 2 分鐘 ★ 85
Kimi K3 开源模型 AI 安全 大模型部署
不同模型厂同一家 Agentic Infra,AGI 时代的地基终于浮出水面
📌 一句话摘要 本文深度剖析了无问芯穹这家 AI Infra 公司如何凭借技术优势和战略布局,成为国产四大模型厂(Kimi、智谱、MiniMax、阶跃星辰)的共同选择,解析了其在效果保证、成本优化和稳定性方面的核心技术和商业模式。 📝 详细摘要 文章以量子位媒体的视角,深入分析了无问芯穹在 AI
📅 2026-07-20 18:33 (17 天前) 克雷西 人工智能 2 分鐘 ★ 88
AI Infra Agentic AI 模型部署 算力优化
Kimi K3 上架 Cola 平台,欢迎体验
📌 一句话摘要 Kimi K3 模型已可于 Cola 平台使用,但可能因火爆导致响应较慢。 📝 详细摘要 Orange AI(Cola 平台 CEO)宣布 Kimi K3 已在 Cola 上架,并提醒用户可能因模型火爆而响应较慢。附带平台截图。 📊 文章信息 AI 初评:78 来源:Orang
📅 2026-07-17 13:59 (20 天前) Orange AI 人工智能 1 分鐘 ★ 78
Kimi K3 Cola 平台 模型部署 AI 推理
科技爱好者周刊(第 404 期):你需要知道的 AI 内存知识
📌 一句话摘要 本文深入剖析了本地运行大模型时,独立显卡与板载芯片组在内存容量与带宽上的核心矛盾,并指出混合专家模型(MoE)是当前平衡两者的最优解。 📝 详细摘要 本期周刊的核心是一篇关于本地运行 AI 模型硬件选择的深度科普。作者通过对比 RTX 5090 独立显卡(32GB 显存、1792
📅 2026-07-17 07:51 (20 天前) 阮一峰 人工智能 10 分鐘 ★ 91
AI 硬件 LLM 模型部署 GPU
开源模型赢了 Token 流量,Anthropic 赚走了大部分钱
📌 一句话摘要 文章结合企业案例与平台数据指出,开源模型在 Token 流量上占优,但 Anthropic 等前沿模型在收入上依旧领先,形成“前沿模型用于场景验证,开源模型用于成熟部署”的双层经济结构。 📝 详细摘要 文章引用 Decagon CEO Jesse Zhang 的观点和 TechC
📅 2026-07-10 13:43 (27 天前) AI前线 人工智能 2 分鐘 ★ 83
LLM 开源模型 AI商业化 模型部署
把 Fable 5 装进 MacBook,还要多久
📌 一句话摘要 本文从 Fable 5 下线事件切入,分析芯片厂商与模型厂商在端侧 AI 上的进展,探讨何时能在本地设备运行顶级模型,并预测 2028 年可能实现的场景与代价。 📝 详细摘要 文章以 Anthropic 的 Fable 5 模型提前下线引发用户热议为引子,探讨端侧 AI 的发展现
📅 2026-07-09 01:31 (28 天前) Selina 人工智能 2 分鐘 ★ 87
端侧AI AI硬件 模型部署 高通
AI 自我改进的关键,从模型转向 Harness 了!
📌 一句话摘要 本文编译自 Lilian Weng 的博客,系统阐述 Harness Engineering 在 AI 递归自我改进中的核心作用、设计模式、优化方法及七个关键瓶颈。 📝 详细摘要 文章以 Lilian Weng 的技术博客为核心,指出在 AI 递归自我改进(RSI)中,包裹模型的
📅 2026-07-07 22:48 (29 天前) Datawhale 人工智能 15 分鐘 ★ 86
AI Agent 自我改进 上下文工程 工作流设计
腾讯 Hy3 开源:295B MoE,激活 21B,工具调用错误恢复与多脚手架泛化显著提升
📌 一句话摘要 腾讯混元开源新一代 Hy3 模型,295B MoE 激活 21B,在推理、智能体、长上下文任务上比肩参数规模 2-5 倍旗舰模型,工具调用错误恢复与多脚手架泛化性显著提升。 📝 详细摘要 腾讯混元团队正式开源新一代大模型 Hy3,采用 Apache 2.0 协议。总参数量 295
📅 2026-07-06 18:00 (07-06 18:00) 魔搭ModelScope社区 人工智能 2 分鐘 ★ 79
LLM MoE 开源模型 模型部署
Kimi 坐上全球程序员的工位!GitHub Copilot 模型菜单中第一次出现开放权重模型
📌 一句话摘要 Kimi K2.7 Code 成为 GitHub Copilot 中首个开放权重模型,标志 Copilot 从单一助手向多模型调度入口转变。 📝 详细摘要 文章报道了 Kimi K2.7 Code 正式集成到 GitHub Copilot 的消息,成为 Copilot 模型菜单中
📅 2026-07-03 15:35 (07-03 15:35) 51CTO技术栈 人工智能 6 分鐘 ★ 86
AI编程 LLM AI Agent GitHub Copilot
重磅!DeepSeek 开源最新 DSpark 技术论文
📌 一句话摘要 本文解读 DeepSeek 开源的 DSpark 推测解码框架,介绍其半自回归生成、置信度调度验证两大组件,以及在线部署中吞吐量提升 60%–85%的效果。 📝 详细摘要 文章详细解读 DeepSeek 最新开源的 DSpark 推测解码技术论文。首先指出推测解码的核心矛盾在于
📅 2026-06-29 08:33 (06-29 08:33) PaperAgent 人工智能 2 分鐘 ★ 79
LLM推理优化 推测解码 模型部署 DeepSeek
本地部署 GLM-5.2 的门槛太高了,根本玩不起!
📌 一句话摘要 作者测试发现本地部署 GLM-5.2 需要超大显存(量化版 436G,FP8 版 704G),在 H20 上推理速度慢且并发能力差,硬件门槛极高。 📝 详细摘要 本文是作者在算力服务器上部署 GLM-5.2 的实测记录。尝试了两个版本:unsloth 的 UD-Q4_K_XL 量
📅 2026-06-28 17:51 (06-28 17:51) beginor 人工智能 8 分鐘 ★ 78
LLM 模型部署与推理 AI硬件与芯片 性能评测
刚刚!AMD 中文教程项目发布了
📌 一句话摘要 Datawhale 与 AMD 联合发布 Hello-ROCm,首个系统性 ROCm 中文开源教程,覆盖从环境搭建、推理部署、模型微调到底层算子优化的完整 AI 实战链路。 📝 详细摘要 本文是 Datawhale 与 AMD 联合发布的 Hello-ROCm 项目介绍。文章首先
📅 2026-06-16 22:26 (06-16 22:26) Datawhale 人工智能 2 分鐘 ★ 80
AI 开发 ROCm AMD 大模型部署
端侧 AI 提速 80%?如何让 Qwen3-VL 在手机起飞
📌 一句话摘要 本文手把手演示如何利用 Arm SME2 指令集与 MNN 推理引擎,在支持 SME2 的旗舰手机上实现 Qwen3-VL-4B 多模态模型的高效部署,Prefill 阶段提速超 80%。 📝 详细摘要 文章由通义实验室工程师撰写,是一篇面向端侧 AI 开发者的工程实践教程。核心
📅 2026-06-11 19:44 (06-11 19:44) 通义实验室 人工智能 2 分鐘 ★ 88
AI 编程 LLM 端侧推理 模型部署
5 月 23 日:杭州 vLLM Meetup :Agentic AI 时代,推理加速框架如何重塑大模型部署?
📌 一句话摘要 本文报道了杭州 vLLM Meetup 活动,汇聚了 Inferact、阿里、Kimi、NVIDIA 等专家,分享了在 Agentic AI 时代,vLLM 推理加速框架在模型支持、缓存优化、分布式调度和底层通信等方面的前沿技术与最佳实践。 📝 详细摘要 本文是对 5 月 23
📅 2026-05-28 19:07 (05-28 19:07) 魔搭ModelScope社区 人工智能 2 分鐘 ★ 82
vLLM 推理加速 Agentic AI 大模型部署
对话灵感实验室:全帧率 VLM、低成本与分层部署,业务现场不止需要炫技模型
📌 一句话摘要 格灵深瞳灵感实验室分享了其在低成本全帧率视频理解上的技术突破,以及从 CV 到多模态时代,如何通过分层部署策略解决真实业务落地的工程化思考。 📝 详细摘要 本文是 InfoQ 对格灵深瞳灵感实验室的深度访谈。文章核心围绕两个层面展开:技术层面,灵感实验室介绍了其最新成果 LLaV
📅 2026-05-20 16:39 (05-20 16:39) InfoQ 中文 人工智能 2 分鐘 ★ 88
全帧率视频理解 LLaVA-OneVision-2.0 视觉编码器 VLM
8G 内存的手机,能跑多大的模型?|MiniCPM-V 4.6 开源
📌 一句话摘要 本文以面壁 MiniCPM-V 4.6 开源为契机,深入浅出地讲解了模型大小与内存占用的关系、量化原理、端侧模型的内存限制,并介绍了该模型的技术架构与性能表现。 📝 详细摘要 文章以面壁智能最新开源的 MiniCPM-V 4.6 多模态模型(1.3B 参数)为引子,面向技术从业者
📅 2026-05-13 12:04 (05-13 12:04) 赛博禅心 人工智能 2 分鐘 ★ 87
MiniCPM-V 端侧模型 模型量化 多模态
Mistral Medium 3.5 开源:一套权重搞定编码、推理和指令遵循,4 块 GPU 即可部署
📌 一句话摘要 Mistral AI 发布 Mistral Medium 3.5,将指令遵循、推理和编码三大能力统一于单一 128B 稠密模型,SWE-Bench Verified 得分 77.6%,仅需 4 块 GPU 即可部署,支持商业使用。 📝 详细摘要 文章介绍了 Mistral AI
📅 2026-05-06 17:55 (05-06 17:55) 魔搭ModelScope社区 人工智能 2 分鐘 ★ 86
Mistral Medium 3.5 开源模型 大语言模型 编码能力
Exo Lab 支持 MiniMax M2.7:Mac 集群推理新进展
📌 一句话摘要 Exo Lab 宣布支持 MiniMax M2.7 模型,通过 RDMA 和张量并行技术实现 Mac 集群的线性扩展推理。 📝 详细摘要 推文引用了 Exo Lab 的最新动态,该项目现已提供对 MiniMax M2.7 的零日支持。其核心技术亮点在于支持 RDMA 和张量并行(
📅 2026-04-12 15:25 (04-12 15:25) Berryxia.AI 人工智能 1 分鐘 ★ 82
Exo Lab MiniMax M2.7 Mac 集群 张量并行
Fireworks AI 模型库新增 Qwen 3.6 Plus
📌 一句话摘要 Fireworks AI 宣布在其推理平台上提供阿里巴巴最新的旗舰模型 Qwen 3.6 Plus。 📝 详细摘要 Fireworks AI 现已集成阿里巴巴的 Qwen 3.6 Plus 模型,开发者可通过其推理 API 进行调用。此次更新让用户能够通过 Fireworks A
📅 2026-04-05 23:23 (04-05 23:23) Fireworks AI 人工智能 1 分鐘 ★ 81
Qwen 3.6 Plus Fireworks AI LLM 模型部署