全部 未讀 (38185) ★ 收藏 (0) 🤖 人工智能 (14380) 📊 商业科技 (6698) 📁 媒体资讯 (5348) 📁 投资财经 (3299) 📁 生活文化 (2837) 💻 软件编程 (2058) 📁 个人成长 (1968) 📁 体育运动 (1008) 🎨 产品设计 (537) 📁 AI 产品 (39)
篩選中: 🏷️ 无监督学习 共 2 篇 ✕ 清除篩選
38187
全部文章
38185
未讀
173
今日新增
0
收藏
📡 Poller 最後抓取: 53 分鐘前 (08-08 16:00)
BestBlogs 精選 (38114)

🏷️ 熱門標籤

AI Agent 3187 政策解读 1638 投资与市场 1418 AI 编程 1336 宏观经济 1300 产业动态 1274 国际新闻 1171 LLM 1156 Anthropic 1088 Claude Code 1039 社会议题 1018 国内新闻 987 地缘政治 938 OpenAI 894 科技新闻 888 AI 智能体 788 生活方式 705 开源 684 足球 680 个人成长 676
我的无监督诱导挑战 — LessWrong
📌 一句话摘要 作者提出了一个现实世界的挑战:在没有人工监督或语言先验知识的情况下,让 Claude Opus 4.6 正确完成一项基础古希腊语练习。 📝 详细摘要 本文探讨了 LLM 在用户缺乏专业知识以验证输出结果时的局限性。作者分享了使用 Claude Opus 4.6 辅助古希腊语学习的
📅 2026-04-08 09:30 (04-08 09:30) DanielFilan 人工智能 1 分鐘 ★ 86
LLM 提示工程 Claude 无监督学习
利用无监督 RLVR 扩展 LLM 训练
📌 一句话摘要 探索使用无监督变动资源强化学习(RLVR,Reinforcement Learning from Variable Resources)扩展 LLM 训练的可扩展性。 📝 详细摘要 这篇推文分享了一篇研究论文,调查了通过无监督变动资源强化学习(RLVR)扩展大语言模型训练的极限与
📅 2026-03-10 23:23 (03-10 23:23) AK 人工智能 1 分鐘 ★ 84
LLM 训练 强化学习 RLVR 缩放定律