全部 未讀 (38185) ★ 收藏 (0) 🤖 人工智能 (14380) 📊 商业科技 (6698) 📁 媒体资讯 (5348) 📁 投资财经 (3299) 📁 生活文化 (2837) 💻 软件编程 (2058) 📁 个人成长 (1968) 📁 体育运动 (1008) 🎨 产品设计 (537) 📁 AI 产品 (39)
篩選中: 🏷️ 模型可靠性 共 4 篇 ✕ 清除篩選
38187
全部文章
38185
未讀
173
今日新增
0
收藏
📡 Poller 最後抓取: 52 分鐘前 (08-08 16:00)
BestBlogs 精選 (38114)

🏷️ 熱門標籤

AI Agent 3187 政策解读 1638 投资与市场 1418 AI 编程 1336 宏观经济 1300 产业动态 1274 国际新闻 1171 LLM 1156 Anthropic 1088 Claude Code 1039 社会议题 1018 国内新闻 987 地缘政治 938 OpenAI 894 科技新闻 888 AI 智能体 788 生活方式 705 开源 684 足球 680 个人成长 676
#552. AI 进展为何突然变得真实:详解 GPT 5.5、强化学习与模型最后一公里
📌 一句话摘要 OpenAI 内部研究者 Yann Dubois 详解 GPT 5.5 背后的可靠性跃迁、强化学习从竞赛走向真实世界的转变,以及 Posttraining 如何将知识转化为可用能力。 📝 详细摘要 本期节目通过 AI 声纹克隆技术,将 The MAD Podcast 与 Open
📅 2026-05-25 11:29 (05-25 11:29) 跨国串门儿计划 人工智能 2 分鐘 ★ 82
GPT 5.5 强化学习 Posttraining 模型可靠性
加里·马库斯将大语言模型可靠性问题与英伟达估值挂钩
📌 一句话摘要 加里·马库斯断言,如果公众理解了普林斯顿大学一项新研究揭示的大语言模型深层可靠性问题,英伟达的股价将会暴跌。 📝 详细摘要 加里·马库斯的这条推文引用了他自己早前的帖子,直接且颇具争议地将大语言模型(LLM)持续存在的可靠性问题与英伟达等人工智能硬件巨头的市场估值联系起来。被引用
📅 2026-03-18 01:24 (03-18 01:24) Gary Marcus 人工智能 4 分鐘 ★ 81
大语言模型可靠性 加里·马库斯 英伟达 AI 批判
大语言模型可靠性仍是深层问题,缺乏元认知能力
📌 一句话摘要 加里·马库斯强调,大语言模型的可靠性,尤其是它们缺乏元认知能力,仍然是一个关键且未解决的问题,并引用了普林斯顿大学的一项新评估和一篇分析顶级模型失败原因的论文。 📝 详细摘要 这条推文探讨了加里·马库斯长期以来关注的一个问题:大语言模型(LLMs)持续存在的可靠性问题。他指出,即
📅 2026-03-18 01:08 (03-18 01:08) Gary Marcus 人工智能 1 分鐘 ★ 90
大语言模型可靠性 元认知 AI 局限性 通用人工智能
AI 模型的分布引导置信度校准
📌 一句话摘要 一篇提出通过分布引导方法来改进机器学习模型置信度校准的论文。 📝 详细摘要 研究《相信你的模型》(Believe Your Model)探讨了模型过度自信或自信不足的问题。它提出了一种“分布引导置信度校准”技术,以确保模型的预测概率能更好地反映实际可能性,这对于可靠的 AI 部署
📅 2026-03-10 23:33 (03-10 23:33) AK 人工智能 1 分鐘 ★ 78
置信度校准 模型可靠性 机器学习 概率分布