全部 未讀 (38042) ★ 收藏 (0) 🤖 人工智能 (14362) 📊 商业科技 (6673) 📁 媒体资讯 (5309) 📁 投资财经 (3263) 📁 生活文化 (2825) 💻 软件编程 (2056) 📁 个人成长 (1963) 📁 体育运动 (1005) 🎨 产品设计 (534) 📁 AI 产品 (39)
篩選中: 🏷️ 红队 共 13 篇 ✕ 清除篩選
38044
全部文章
38042
未讀
30
今日新增
0
收藏
📡 Poller 最後抓取: 21 分鐘前 (08-08 02:00)
BestBlogs 精選 (37971)

🏷️ 熱門標籤

AI Agent 3182 政策解读 1626 投资与市场 1410 AI 编程 1333 宏观经济 1282 产业动态 1267 国际新闻 1160 LLM 1153 Anthropic 1087 Claude Code 1038 社会议题 1013 国内新闻 980 地缘政治 932 OpenAI 892 科技新闻 884 AI 智能体 788 生活方式 704 开源 684 足球 678 个人成长 672
OpenAI 推出自动化红队模型 GPT-Red,专攻 GPT-5.6 提示注入漏洞
📌 一句话摘要 OpenAI 推出自动化红队模型 GPT‑Red,专门用于自动发现并修复 GPT‑5.6 中的提示注入漏洞。 📝 详细摘要 文章介绍了 OpenAI 最新推出的自动化红队模型 GPT‑Red,该模型通过自对弈强化学习生成对抗性提示,以检测 GPT‑5.6 中的提示注入漏洞。文章详
📅 2026-07-17 18:00 (21 天前) FreeBuf 人工智能 3 分鐘 ★ 78
AI安全 红队 提示注入 GPT-5.6
红队 AI 工具漏洞致攻击者可窃取 API 密钥并入侵操作者系统
📌 一句话摘要 Cracken 安全研究人员首次系统分析了 12 款 AI 驱动红队渗透测试工具,发现重大架构漏洞,可导致 LLM API 密钥泄露、沙箱逃逸和宿主机沦陷,并提出防护建议。 📝 详细摘要 文章编译自 cybersecuritynews.com 的报道,详述了 Cracken 研究
📅 2026-06-25 19:00 (06-25 19:00) FreeBuf 人工智能 1 分鐘 ★ 80
AI 安全 红队测试 渗透测试 大语言模型
awesome-ai-security:大模型安全资源合集
📌 一句话摘要 awesome-ai-security 是一个收录 AI 安全工具、红队测试、提示词注入检测等资源的开源合集,持续更新。 📝 详细摘要 GitHubDaily 推荐了 awesome-ai-security 开源合集,该合集包含 AI 安全基础学习、红队测试工具、提示词注入检测、
📅 2026-06-22 18:30 (06-22 18:30) GitHubDaily 人工智能 1 分鐘 ★ 77
AI安全 资源合集 开源 提示词注入
Anthropic 新发模型 Claude Fable 5 快速被越狱
📌 一句话摘要 Anthropic 最新发布的 Claude Fable 5 模型在发布仅两天后即被研究人员通过多 Agent 协同攻击成功越狱,并泄露了长达 12 万字符的系统提示词。 📝 详细摘要 文章报道了 Anthropic 于 2026 年 6 月 9 日发布其最强模型 Claude
📅 2026-06-11 18:00 (06-11 18:00) FreeBuf 人工智能 2 分鐘 ★ 76
AI 安全 LLM 模型越狱 AI Agent
Gergely Orosz 谈 Anthropic 红队测试技术细节
📌 一句话摘要 Gergely Orosz 确认正在深入研究 Anthropic 的红队测试工作,并表示在形成最终观点前希望收集更多数据。 📝 详细摘要 在这条回复中,Gergely Orosz 响应了阅读 Anthropic 红队测试博客文章的建议。他指出 Anthropic 提供的这些数据非
📅 2026-04-09 01:18 (04-09 01:18) Gergely Orosz 人工智能 1 分鐘 ★ 76
Anthropic 红队测试 AI 安全 技术研究
测试 OpenClaw 对抗顶级提示词黑客的安全性
📌 一句话摘要 Matthew Berman 向知名提示词黑客 @elder_plinius 发起挑战,试图越狱他的 OpenClaw 系统,展示了一场实战安全压力测试。 📝 详细摘要 这条推文展示了一场安全挑战,开发者 Matthew Berman 邀请提示词黑客与越狱社区的知名人物 @eld
📅 2026-04-04 04:57 (04-04 04:57) Matthew Berman 人工智能 1 分鐘 ★ 81
OpenClaw AI 安全 红队测试 提示词攻击
Google 是如何做到的:深入了解网络安全
📌 一句话摘要 Google Cloud 精选了 15 篇技术文章,详细介绍了其内部的网络安全方法,涵盖了从 AI 驱动的威胁检测到 SRE 实践和红队测试等主题。 📝 详细摘要 本文是 Google Cloud “Google 是如何做到的” (How Google Does It) 安全系列
📅 2026-03-28 05:00 (03-28 05:00) The Keyword (blog.google) 软件编程 1 分鐘 ★ 82
Google Cloud 网络安全 SRE 威胁检测
Promptfoo:AI 应用的自动化安全测试工具
📌 一句话摘要 Promptfoo 是一款开源工具,用于对大语言模型 (LLM) 应用进行自动化红队测试、渗透测试和漏洞扫描。 📝 详细摘要 这篇推文介绍了被 OpenAI 收购的开源安全工具 Promptfoo。它支持自动化红队测试、漏洞扫描以及 CI/CD 集成,能够检测 AI 应用中的提示
📅 2026-03-26 10:49 (03-26 10:49) Nav Toor 人工智能 1 分鐘 ★ 82
Promptfoo AI 安全 红队测试 LLM
通过梯度下降寻找 X-Risks 和 S-Risks — LessWrong
📌 一句话摘要 作者提出利用梯度下降法,通过优化输入以最大化请求的合理性和有害输出的概率,从而系统地发现潜在的 AI 失效模式和安全风险。 📝 详细摘要 本文探讨了一种 AI 安全红队测试(red teaming)的新方法,即应用梯度下降来识别对抗性输入。作者借鉴了在卷积神经网络(CNN)中利用
📅 2026-03-26 01:58 (03-26 01:58) dspeyer 人工智能 1 分鐘 ★ 83
AI 安全 红队测试 梯度下降 对抗性机器学习
受 Ilya Sutskever 启发的 AI 安全框架
📌 一句话摘要 介绍了一套 Claude 提示词,旨在利用对齐框架对 AI 系统进行压力测试和红队测试。 📝 详细摘要 本推文分享了 9 个 Claude 提示词,旨在帮助开发者对 AI 系统进行压力测试和红队测试。这些提示词围绕 Ilya Sutskever 的研究思想及 Safe Super
📅 2026-03-25 02:18 (03-25 02:18) Nav Toor 人工智能 1 分鐘 ★ 82
AI 安全 对齐 红队测试 提示词工程
AI 模型两周内发现 22 个 Firefox 漏洞
📌 一句话摘要 Claude Opus 4.6 在两周内发现了 22 个 Firefox 漏洞,其中包括传统模糊测试工具未能发现的高危逻辑错误,标志着 AI 驱动的安全研究发生了重大转变。 📝 详细摘要 本文报道了 AI 驱动的网络安全领域的一个重要里程碑:Anthropic 的 Claude
📅 2026-03-19 18:15 (03-19 18:15) Steef-Jan Wiggers 人工智能 2 分鐘 ★ 88
Claude Opus 4.6 Firefox 网络安全 漏洞发现
Anthropic 工程师都离不开!深夜随手撸出的开源神器,被 OpenAl 高价收购,23 人创业逆袭
📌 一句话摘要 OpenAI 宣布收购 AI 安全初创公司 Promptfoo,旨在通过其开源红队演练工具强化 OpenAI Frontier 平台的智能体安全评估能力。 📝 详细摘要 本文报道了 OpenAI 收购 AI 安全初创公司 Promptfoo 的行业动态。Promptfoo 由前
📅 2026-03-15 10:16 (03-15 10:16) InfoQ 中文 人工智能 4 分鐘 ★ 83
OpenAI Promptfoo AI 安全 红队演练
开源 LLM 测试与加固工具 Promptfoo 介绍
📌 一句话摘要 Promptfoo 是一款用于自动化评估、红队测试及加固大模型应用的开源工具,支持主流模型对比与 CI/CD 集成。 📝 详细摘要 该推文推荐了一个名为 Promptfoo 的开源工具,旨在解决 AI 应用开发中提示词(Prompt)修改后可能出现的安全漏洞和性能问题。该工具支持
📅 2026-03-11 21:30 (03-11 21:30) GitHubDaily 人工智能 3 分鐘 ★ 82
Promptfoo LLM 安全 提示词工程 红队测试