KNOWLEDGE DOMAIN / AI安全

AI安全

FRAMEWORK MAP

知识框架

LATEST SIGNALS

最近更新

  1. 700个Agent攻陷HuggingFace:一次评估沙箱逃逸的完整攻击链复盘 700个Agent攻陷HuggingFace:一次评估沙箱逃逸的完整攻击链复盘
  2. 无人值守任务的凭据安全:从一次定时任务静默拒跑到端点绑定设计 无人值守任务的凭据安全:从一次定时任务静默拒跑到端点绑定设计
  3. 系统提示词为什么防不住:从手工诱骗到梯度优化的提取攻击全景 系统提示词为什么防不住:从手工诱骗到梯度优化的提取攻击全景
  4. Agent Skill 供应链安全:命名空间冒用、评估失真与上下文黑洞的三重治理缺口 Agent Skill 供应链安全:命名空间冒用、评估失真与上下文黑洞的三重治理缺口
  5. AI CLI 编码工具安全修复潮复盘:七款工具暴露的五类防守盲区 AI CLI 编码工具安全修复潮复盘:七款工具暴露的五类防守盲区
  6. AI 对齐技术全景:从 RLHF 到 DPO、GRPO 与可扩展监督的演进 AI 对齐技术全景:从 RLHF 到 DPO、GRPO 与可扩展监督的演进
  7. 多智能体系统安全:身份验证、合谋攻击与通信防护 多智能体系统安全:身份验证、合谋攻击与通信防护
  8. 智能体安全检测评估框架:全链路多层防线 智能体安全检测评估框架:全链路多层防线

DOMAIN TAGS

领域标签