全部 未讀 (25616) ★ 收藏 (0) 🤖 人工智能 (11645) 📊 商业科技 (5081) 📁 媒体资讯 (2034) 💻 软件编程 (1793) 📁 个人成长 (1665) 📁 生活文化 (1390) 📁 投资财经 (1236) 🎨 产品设计 (454) 📁 体育运动 (270) 📁 AI 产品 (39)
篩選中: 🏷️ BridgeBench 共 1 篇 ✕ 清除篩選
25618
全部文章
25616
未讀
194
今日新增
0
收藏
📡 Poller 最後抓取: 4 分鐘前 (06-21 22:00)
BestBlogs 精選 (25564)

🏷️ 熱門標籤

AI Agent 2429 AI 编程 1124 Anthropic 1015 Claude Code 949 LLM 834 政策解读 801 AI 智能体 781 OpenAI 756 产业动态 724 投资与市场 694 宏观经济 620 开源 585 Claude 565 地缘政治 564 OpenClaw 557 科技新闻 539 AI 532 国际新闻 517 AI 安全 515 社会议题 501
Claude Opus 4.6 疑似降智?BridgeBench 数据显示幻觉率暴增
📌 一句话摘要 根据 BridgeBench 最新基准测试,Claude Opus 4.6 的幻觉率从 83.3% 跌至 68.3%,引发社区对其「偷偷降智」的讨论。 📝 详细摘要 推文引用了 BridgeMind 发布的 BridgeBench 最新数据,指出 Claude Opus 4.6
📅 2026-04-13 06:55 (04-13 06:55) Berryxia.AI 人工智能 1 分鐘 ★ 82
Claude Anthropic BridgeBench 模型评测