外观
研究伦理与安全边界
本知识库服务于防御性 AI Security 研究。漏洞复现、攻击语料、红队工具和自动化实验只能用于自有环境、本地运行的开源系统,或已取得明确书面授权的目标。
允许的研究范围
- 在隔离环境中复现漏洞、验证缓解措施和评估检测覆盖率。
- 对自有模型、应用、Agent、沙箱和基础设施开展测试。
- 在授权范围内执行最小影响验证,并保留完整审计记录。
- 使用模拟数据验证账号停用、主机隔离、IP 封禁等破坏性响应流程。
禁止的研究行为
- 对未授权的第三方系统或生产 SaaS 发起扫描、利用或持久化操作。
- 使用真实凭据、私人数据集、敏感目标信息或可识别个人信息进行测试。
- 将攻击语料替换为真实有害任务并投递到线上服务。
- 在没有必要性和影响控制的情况下执行破坏性动作或扩大利用范围。
记录要求
研究记录应区分已验证事实、合理推断和未公开实现,使用强、中、未披露等证据等级,不把“未公开披露”表述为“未实现”。涉及产品或模型的结论应记录验证日期、版本、受影响对象和披露状态。