全部 未讀 (38042) ★ 收藏 (0) 🤖 人工智能 (14362) 📊 商业科技 (6673) 📁 媒体资讯 (5309) 📁 投资财经 (3263) 📁 生活文化 (2825) 💻 软件编程 (2056) 📁 个人成长 (1963) 📁 体育运动 (1005) 🎨 产品设计 (534) 📁 AI 产品 (39)
篩選中: 🏷️ 对抗性机器学习 共 1 篇 ✕ 清除篩選
38044
全部文章
38042
未讀
30
今日新增
0
收藏
📡 Poller 最後抓取: 1 小時前 (08-08 02:00)
BestBlogs 精選 (37971)

🏷️ 熱門標籤

AI Agent 3182 政策解读 1626 投资与市场 1410 AI 编程 1333 宏观经济 1282 产业动态 1267 国际新闻 1160 LLM 1153 Anthropic 1087 Claude Code 1038 社会议题 1013 国内新闻 980 地缘政治 932 OpenAI 892 科技新闻 884 AI 智能体 788 生活方式 704 开源 684 足球 678 个人成长 672
通过梯度下降寻找 X-Risks 和 S-Risks — LessWrong
📌 一句话摘要 作者提出利用梯度下降法,通过优化输入以最大化请求的合理性和有害输出的概率,从而系统地发现潜在的 AI 失效模式和安全风险。 📝 详细摘要 本文探讨了一种 AI 安全红队测试(red teaming)的新方法,即应用梯度下降来识别对抗性输入。作者借鉴了在卷积神经网络(CNN)中利用
📅 2026-03-26 01:58 (03-26 01:58) dspeyer 人工智能 1 分鐘 ★ 83
AI 安全 红队测试 梯度下降 对抗性机器学习