全部 未讀 (38185) ★ 收藏 (0) 🤖 人工智能 (14380) 📊 商业科技 (6698) 📁 媒体资讯 (5348) 📁 投资财经 (3299) 📁 生活文化 (2837) 💻 软件编程 (2058) 📁 个人成长 (1968) 📁 体育运动 (1008) 🎨 产品设计 (537) 📁 AI 产品 (39)
篩選中: 🏷️ 交叉验证 共 3 篇 ✕ 清除篩選
38187
全部文章
38185
未讀
173
今日新增
0
收藏
📡 Poller 最後抓取: 1 小時前 (08-08 16:00)
BestBlogs 精選 (38114)

🏷️ 熱門標籤

AI Agent 3187 政策解读 1638 投资与市场 1418 AI 编程 1336 宏观经济 1300 产业动态 1274 国际新闻 1171 LLM 1156 Anthropic 1088 Claude Code 1039 社会议题 1018 国内新闻 987 地缘政治 938 OpenAI 894 科技新闻 888 AI 智能体 788 生活方式 705 开源 684 足球 680 个人成长 676
8 个维度量化评估框架:你写的 Skill,及格了吗?
📌 一句话摘要 本文提出了一套 8 维度的 Skill 量化评估框架,通过元数据质量、执行引导清晰度、领域知识密度等指标对 Skill 进行打分评级,并设计了多模型交叉验证流程以提升评估可靠性。 📝 详细摘要 文章针对 AI Agent Skill 质量难以客观衡量的问题,提出了一套 8 维度的
📅 2026-05-16 08:02 (05-16 08:02) dbaplus社群 人工智能 2 分鐘 ★ 88
AI Agent Skill评估 量化框架 多模型交叉验证
你写的 Skill,及格了吗?
📌 一句话摘要 本文提出了一套包含 8 个维度的 Skill 量化评估框架,通过元数据质量、执行引导、领域知识密度等指标对 AI Agent 的 Skill 进行打分评级,并设计了多模型交叉验证流程和四种执行策略来提升评估的可靠性与兼容性。 📝 详细摘要 文章针对 AI Agent 生态中 Sk
📅 2026-04-22 18:00 (04-22 18:00) 百度Geek说 人工智能 1 分鐘 ★ 88
AI Agent Skill 评估 评估框架 多模型交叉验证
幻觉
📌 一句话摘要 本文通过杨振宁家史的 AI 幻觉案例,探讨了大模型幻觉的不可避免性,提出交叉验证的应对策略,并延伸感悟了时代洪流下的家族悲剧。 📝 详细摘要 文章从用户反馈的 AI 幻觉问题出发,明确指出幻觉是大模型的固有特性,无法从技术上完全消除,只能通过方法论克服。作者分享了使用 Gemin
📅 2026-03-28 22:25 (03-28 22:25) 猫笔刀 人工智能 1 分鐘 ★ 82
AI 幻觉 大语言模型 交叉验证 杨振宁