全部 未讀 (38042) ★ 收藏 (0) 🤖 人工智能 (14362) 📊 商业科技 (6673) 📁 媒体资讯 (5309) 📁 投资财经 (3263) 📁 生活文化 (2825) 💻 软件编程 (2056) 📁 个人成长 (1963) 📁 体育运动 (1005) 🎨 产品设计 (534) 📁 AI 产品 (39)
篩選中: 🏷️ LLM 安全 共 9 篇 ✕ 清除篩選
38044
全部文章
38042
未讀
30
今日新增
0
收藏
📡 Poller 最後抓取: 1 小時前 (08-08 02:00)
BestBlogs 精選 (37971)

🏷️ 熱門標籤

AI Agent 3182 政策解读 1626 投资与市场 1410 AI 编程 1333 宏观经济 1282 产业动态 1267 国际新闻 1160 LLM 1153 Anthropic 1087 Claude Code 1038 社会议题 1013 国内新闻 980 地缘政治 932 OpenAI 892 科技新闻 884 AI 智能体 788 生活方式 704 开源 684 足球 678 个人成长 672
CNCF 警告:仅靠 Kubernetes 不足以保障 LLM 工作负载的安全性
📌 一句话摘要 CNCF 警告,企业在 Kubernetes 上部署 LLM 时存在关键安全缺口,K8s 擅长编排和隔离但无法理解 AI 行为,需叠加 AI 特定控制层。 📝 详细摘要 云原生计算基金会 (CNCF) 发布博客指出,企业在 Kubernetes 上部署大语言模型 (LLM) 时面
📅 2026-05-07 11:21 (05-07 11:21) InfoQ 中文 人工智能 2 分鐘 ★ 86
Kubernetes LLM 安全 CNCF AI 安全
第三方 LLM 中转站安全风险警示与隐私探讨
📌 一句话摘要 推文揭露了第三方 LLM 路由器(中转站)存在的中间人攻击风险,并强调了本地数据安全与隐私保护的重要性。 📝 详细摘要 作者引用了关于第三方 LLM 路由器漏洞的研究,指出这些中转服务作为应用层中间人,拥有对 API Key、私钥及 tool call 参数的完全访问权,可能导致
📅 2026-04-10 22:31 (04-10 22:31) Yangyi 人工智能 1 分鐘 ★ 82
LLM 安全 中间人攻击 API 隐私 AI Agent
LangChain 与 Google Cloud 亮相 Next 大会:构建安全可扩展的 AI Agent 运行时
📌 一句话摘要 LangChain 与 Google Cloud 的工程师将在 Google Cloud Next 大会上分享如何构建高性能、零信任的运行时,以安全执行 LLM 生成的代码。 📝 详细摘要 此推文宣布了 LangChain 与 Google Cloud 在即将举行的 Google
📅 2026-04-11 00:01 (04-11 00:01) LangChain 人工智能 1 分鐘 ★ 83
AI Agents LangChain Google Cloud Next LLM 安全
保障 AI Agent 安全:防止通过提示词注入窃取凭据
📌 一句话摘要 该推文强调了 AI Agent 直接访问 API 密钥的安全风险,并推介 Composio 作为将凭据隔离在上下文窗口之外的解决方案。 📝 详细摘要 本推文探讨了 AI Agent 部署中一个关键的安全漏洞:敏感凭据在提示词注入(Prompt Injection)攻击下的暴露风险
📅 2026-04-07 23:42 (04-07 23:42) God of Prompt 人工智能 1 分鐘 ★ 81
AI 安全 提示词注入 AI Agent Composio
文言文越狱:大模型安全护栏的模式匹配局限
📌 一句话摘要 通过文言文绕过大模型安全护栏,揭示了当前安全对齐本质上是模式匹配而非意图理解。 📝 详细摘要 李继刚解读了一篇关于大模型安全性的论文,指出大模型安全护栏主要基于现代语言训练,对文言文这类低资源语言存在防御盲区。论文提出的 CC-BOS 框架利用文言文的语法特性成功越狱主流模型,证
📅 2026-03-26 10:31 (03-26 10:31) 李继刚 人工智能 3 分鐘 ★ 86
AI 安全 大模型 文言文 越狱
Claude Code 的自动模式
📌 一句话摘要 Simon Willison 分析了 Claude Code 新推出的 AI 驱动权限自动模式,强调了其对 Sonnet 4.6 分类器的使用,同时也批评了其非确定性的安全方法。 📝 详细摘要 本文探讨了 Claude Code 中“自动模式”的引入,该功能用基于 AI 的分类器
📅 2026-03-25 07:57 (03-25 07:57) Simon Willison 人工智能 1 分鐘 ★ 88
Claude Code AI 智能体 LLM 安全 Sonnet 4.6
两种不同的智能体授权类型
📌 一句话摘要 LangChain 在 LangSmith Fleet 中引入了两种智能体授权模型:Assistants(代表特定用户行事)和 Claws(使用固定凭据执行自主任务)。 📝 详细摘要 本文详细介绍了 LangSmith Fleet 的发布及其在智能体授权方面的专业方案,解决了智能
📅 2026-03-24 01:29 (03-24 01:29) LangChain Accounts 人工智能 2 分鐘 ★ 89
AI 智能体 LangChain LangSmith Fleet 智能体授权
关于 AI 安全系统缺陷的研究论文
📌 一句话摘要 这条推文提供了学术论文链接,详细阐述了关于“意图洗白”以及绕过主流 AI 安全系统的研究。 📝 详细摘要 这条推文是前述讨论的直接后续,提供了名为《意图洗白》的完整研究论文在 arXiv 上的链接。该论文详细介绍了如何通过简单地重新措辞危险提示来规避主流 AI 模型安全系统的方法
📅 2026-03-18 04:01 (03-18 04:01) Nav Toor 人工智能 3 分鐘 ★ 80
AI 安全研究 学术论文 LLM 安全 意图洗白
开源 LLM 测试与加固工具 Promptfoo 介绍
📌 一句话摘要 Promptfoo 是一款用于自动化评估、红队测试及加固大模型应用的开源工具,支持主流模型对比与 CI/CD 集成。 📝 详细摘要 该推文推荐了一个名为 Promptfoo 的开源工具,旨在解决 AI 应用开发中提示词(Prompt)修改后可能出现的安全漏洞和性能问题。该工具支持
📅 2026-03-11 21:30 (03-11 21:30) GitHubDaily 人工智能 3 分鐘 ★ 82
Promptfoo LLM 安全 提示词工程 红队测试