外观
AI SECURITY / RED TEAM RESEARCH
AI Security 研究知识库
围绕模型、数据、供应链、基础设施、智能体与协议边界建立的中文研究索引。
- 内容
- 32
- 核心攻击面
- 6
- 最近更新
- 2026-07-30
最新研究
全部文章 8 篇内容
AI 应用与智能体系统安全关注清单
持续关注清单:Agent Security / Prompt Injection 研究
整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个账号逐一做二次访问核实,使用前建议自行确认链接仍然有效。
协议、身份与集成安全关注清单
持续关注清单:AI 通信协议(MCP/A2A 等)安全研究
整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个来源逐一做二次访问核实,使用前建议自行确认链接仍然有效。
模型本体安全关注清单
持续关注清单:LLM Jailbreak 研究
整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个账号/仓库逐一做二次访问核实(不同于本仓库对开源代码仓库惯常的 GitHub API 核实流程),使用前建议自行确认链接仍然有效。
红队工程与防御验证关注清单
持续关注清单:Pentest Agent / 攻防对抗研究
整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个来源逐一做二次访问核实,使用前建议自行确认链接仍然有效。
AI 应用与智能体系统安全关注清单
持续关注清单:Sandbox / 执行隔离安全研究
整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个来源逐一做二次访问核实,使用前建议自行确认链接仍然有效。
标准、治理与参考体系标准规范
AI Security 红队研究分类与归档规范
本规范面向软件型 AI、生成式 AI 与智能体系统。当前版本不覆盖机器人、自动驾驶、无人系统等具身与物理 AI;相关研究在形成稳定规模后单独扩展,不强行放入“多模态”分类。
协议、身份与集成安全实验记录
Codex CLI 模型与 multi-agent 通信实验记录
- 日期:2026-07-30(Asia/Shanghai) - Codex CLI:codex-cli 0.146.0 - CLI 二进制:/opt/homebrew/bin/codex - 包装脚本:$HOME/.local/bin/codex - Provider:自定义 Respons...
AI 应用与智能体系统安全研究笔记
Pillar Security "Week of Sandbox Escapes" 系列深度研究:逃逸案例与检测方式
调研日期:2026-07-30。来源:Pillar Security 博客系列(7 篇独立逃逸披露 + 1 篇 OpenAI 第八案例追加 + 1 篇 CTF/Hugging Face 关联事件),核实方式为逐篇 WebFetch 全文抓取(而非只读汇总页摘要)。