Skip to content
AI SECURITY / RED TEAM RESEARCH

AI Security 研究知识库

围绕模型、数据、供应链、基础设施、智能体与协议边界建立的中文研究索引。

内容
32
核心攻击面
6
最近更新
2026-07-30
最新研究

8 篇内容

全部文章
AI 应用与智能体系统安全关注清单

持续关注清单:Agent Security / Prompt Injection 研究

整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个账号逐一做二次访问核实,使用前建议自行确认链接仍然有效。

协议、身份与集成安全关注清单

持续关注清单:AI 通信协议(MCP/A2A 等)安全研究

整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个来源逐一做二次访问核实,使用前建议自行确认链接仍然有效。

模型本体安全关注清单

持续关注清单:LLM Jailbreak 研究

整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个账号/仓库逐一做二次访问核实(不同于本仓库对开源代码仓库惯常的 GitHub API 核实流程),使用前建议自行确认链接仍然有效。

红队工程与防御验证关注清单

持续关注清单:Pentest Agent / 攻防对抗研究

整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个来源逐一做二次访问核实,使用前建议自行确认链接仍然有效。

AI 应用与智能体系统安全关注清单

持续关注清单:Sandbox / 执行隔离安全研究

整理日期:2026-07-30。整理方式:WebSearch 广撒网后交叉核对多条搜索结果摘要,未对每个来源逐一做二次访问核实,使用前建议自行确认链接仍然有效。

标准、治理与参考体系标准规范

AI Security 红队研究分类与归档规范

本规范面向软件型 AI、生成式 AI 与智能体系统。当前版本不覆盖机器人、自动驾驶、无人系统等具身与物理 AI;相关研究在形成稳定规模后单独扩展,不强行放入“多模态”分类。

协议、身份与集成安全实验记录

Codex CLI 模型与 multi-agent 通信实验记录

- 日期:2026-07-30(Asia/Shanghai) - Codex CLI:codex-cli 0.146.0 - CLI 二进制:/opt/homebrew/bin/codex - 包装脚本:$HOME/.local/bin/codex - Provider:自定义 Respons...

AI 应用与智能体系统安全研究笔记

Pillar Security "Week of Sandbox Escapes" 系列深度研究:逃逸案例与检测方式

调研日期:2026-07-30。来源:Pillar Security 博客系列(7 篇独立逃逸披露 + 1 篇 OpenAI 第八案例追加 + 1 篇 CTF/Hugging Face 关联事件),核实方式为逐篇 WebFetch 全文抓取(而非只读汇总页摘要)。