全部 未讀 (38012) ★ 收藏 (0) 🤖 人工智能 (14359) 📊 商业科技 (6672) 📁 媒体资讯 (5291) 📁 投资财经 (3260) 📁 生活文化 (2821) 💻 软件编程 (2056) 📁 个人成长 (1962) 📁 体育运动 (1005) 🎨 产品设计 (534) 📁 AI 产品 (39)
篩選中: 🏷️ 算术基准测试 共 1 篇 ✕ 清除篩選
38014
全部文章
38012
未讀
282
今日新增
0
收藏
📡 Poller 最後抓取: 3 分鐘前 (08-07 22:00)
BestBlogs 精選 (37941)

🏷️ 熱門標籤

AI Agent 3181 政策解读 1618 投资与市场 1409 AI 编程 1333 宏观经济 1282 产业动态 1265 国际新闻 1159 LLM 1153 Anthropic 1087 Claude Code 1038 社会议题 1003 国内新闻 970 地缘政治 931 OpenAI 892 科技新闻 884 AI 智能体 788 生活方式 701 开源 684 足球 678 个人成长 672
潜在侧任务提升的初步探索 — LessWrong
📌 一句话摘要 本研究探讨了 LLM 是否可以通过填充 token 延长输出轨迹来提升潜在算术性能,结果发现 Claude Opus 4.5 有适度提升,而其他模型效果有限。 📝 详细摘要 本文对大语言模型中的“潜在侧任务能力”进行了实证研究,测试了通过使用短语重复作为填充物来提供更长的输出轨迹
📅 2026-04-02 10:23 (04-02 10:23) Bruce W. Lee 人工智能 1 分鐘 ★ 88
LLM 潜在推理 AI 控制 Claude Opus