SuperPortia Reading
總覽
文章
簡報
🔍 搜尋
全部
未讀 (38185)
★ 收藏 (0)
🤖 人工智能 (14380)
📊 商业科技 (6698)
📁 媒体资讯 (5348)
📁 投资财经 (3299)
📁 生活文化 (2837)
💻 软件编程 (2058)
📁 个人成长 (1968)
📁 体育运动 (1008)
🎨 产品设计 (537)
📁 AI 产品 (39)
篩選中:
🏷️ 交叉验证
共 3 篇
✕ 清除篩選
38187
全部文章
38185
未讀
173
今日新增
0
收藏
📡 Poller
最後抓取:
1 小時前
(08-08 16:00)
BestBlogs 精選 (38114)
🏷️ 熱門標籤
AI Agent
3187
政策解读
1638
投资与市场
1418
AI 编程
1336
宏观经济
1300
产业动态
1274
国际新闻
1171
LLM
1156
Anthropic
1088
Claude Code
1039
社会议题
1018
国内新闻
987
地缘政治
938
OpenAI
894
科技新闻
888
AI 智能体
788
生活方式
705
开源
684
足球
680
个人成长
676
●
8 个维度量化评估框架:你写的 Skill,及格了吗?
📌 一句话摘要 本文提出了一套 8 维度的 Skill 量化评估框架,通过元数据质量、执行引导清晰度、领域知识密度等指标对 Skill 进行打分评级,并设计了多模型交叉验证流程以提升评估可靠性。 📝 详细摘要 文章针对 AI Agent Skill 质量难以客观衡量的问题,提出了一套 8 维度的
📅 2026-05-16 08:02
(05-16 08:02)
dbaplus社群
人工智能
2 分鐘
★ 88
AI Agent
Skill评估
量化框架
多模型交叉验证
●
你写的 Skill,及格了吗?
📌 一句话摘要 本文提出了一套包含 8 个维度的 Skill 量化评估框架,通过元数据质量、执行引导、领域知识密度等指标对 AI Agent 的 Skill 进行打分评级,并设计了多模型交叉验证流程和四种执行策略来提升评估的可靠性与兼容性。 📝 详细摘要 文章针对 AI Agent 生态中 Sk
📅 2026-04-22 18:00
(04-22 18:00)
百度Geek说
人工智能
1 分鐘
★ 88
AI Agent
Skill 评估
评估框架
多模型交叉验证
●
幻觉
📌 一句话摘要 本文通过杨振宁家史的 AI 幻觉案例,探讨了大模型幻觉的不可避免性,提出交叉验证的应对策略,并延伸感悟了时代洪流下的家族悲剧。 📝 详细摘要 文章从用户反馈的 AI 幻觉问题出发,明确指出幻觉是大模型的固有特性,无法从技术上完全消除,只能通过方法论克服。作者分享了使用 Gemin
📅 2026-03-28 22:25
(03-28 22:25)
猫笔刀
人工智能
1 分鐘
★ 82
AI 幻觉
大语言模型
交叉验证
杨振宁