Manifold↗
www.manifold.security/blog
专注 Agent 运行时安全的厂商研究团队,以完整复现披露编码 Agent、MCP 服务器与编辑器扩展生态的一手漏洞,另发布基于数万真实会话的 Agent 检测研究
适用场景适用于了解该资源的核心能力与用法
按「AI 自身安全 / AI 赋能安全 / 一线实战博客」三大主题分区陈列,区内按来源(国外 / 国内 / 项目)分组。每条资源以推荐卡呈现,附原始链接与编者备注。收录标准:官方或一线团队出品、近 12 个月仍活跃、可公开访问;每季度复核一次失效链接。
www.manifold.security/blog
专注 Agent 运行时安全的厂商研究团队,以完整复现披露编码 Agent、MCP 服务器与编辑器扩展生态的一手漏洞,另发布基于数万真实会话的 Agent 检测研究
适用场景适用于了解该资源的核心能力与用法
anthropic.com/research
前沿 AI 实验室,持续发布 Claude 系列模型与对齐、红队安全研究
适用场景适用于跟踪前沿对齐与红队安全研究动态
openai.com/research
顶级 AI 实验室,GPT 系列安全报告与红队实践的源头之一
适用场景适用于追踪 GPT 系列安全报告与红队实践
deepmind.google/research
Google DeepMind 前沿 AI 研究机构,聚焦对齐评估与模型安全
适用场景适用于了解模型对齐评估与安全研究进展
www.microsoft.com/en-us/security/blog
微软安全团队一线博客,AI 红队与防护体系建设经验分享
适用场景适用于学习 AI 红队体系建设与防护经验
github.com/facebookresearch
Meta 基础研究部门(FAIR),开源大模型与 Purple Llama 安全工具链
适用场景适用于查阅开源大模型与 Purple Llama 安全工具链
unit42.paloaltonetworks.com
Palo Alto 威胁情报团队,持续发布 AI 与云安全研究报告
适用场景适用于获取 AI 与云安全威胁研究报告
www.hiddenlayer.com
专注 AI 安全防护,提供模型攻击检测与防御方案
适用场景适用于企业选型模型攻击检测与防护方案
invariantlabs.ai
专注 Agent 安全研究,曾披露 MCP 工具投毒等供应链攻击
适用场景适用于研究 Agent 安全与供应链攻击案例
zenity.io/blog
面向企业 AI 应用的安全平台,覆盖生成式应用风险
适用场景适用于评估企业生成式 AI 应用风险
matrix.tencent.com
腾讯安全旗下实验室,聚焦大模型攻防与 AIGC 安全研究
适用场景适用于跟踪国内大模型攻防与 AIGC 安全研究
github.com/promptfoo/promptfoo
开源 LLM 评测与红队框架,自动化检测提示注入、越狱等风险
适用场景适用于 CI 集成与提示注入、越狱回归测试
github.com/microsoft/PyRIT
微软开源 AI 红队自动化工具,支持攻击编排与效果评估
适用场景适用于攻击编排与大规模红队效果评估
github.com/NVIDIA/garak
NVIDIA 开源 LLM 漏洞扫描器,覆盖注入、越狱等攻击场景探测
适用场景适用于对目标模型批量扫描注入、越狱等漏洞
xbow.com/blog
AI 驱动的渗透测试平台,自动化漏洞发现与利用
适用场景适用于探索 AI 驱动渗透测试与自动化漏洞发现
aicyberchallenge.com
DARPA 举办的 AI 网络挑战赛,探索 AI 漏洞挖掘与修复
适用场景适用于了解 AI 漏洞挖掘竞赛与前沿实践
projectzero.google
Project Zero 与 DeepMind 的 AI 漏洞挖掘项目,在开源软件中寻找未知漏洞
适用场景适用于关注 AI 在开源软件中挖洞的最新进展
aisle.com/blog
AI 安全研究项目,关注大模型应用与智能体安全
适用场景适用于研究大模型应用与智能体安全
zeropath.com/blog
AI 驱动的代码安全审计,专注应用逻辑漏洞
适用场景适用于 AI 驱动的应用逻辑漏洞审计
runsybil.com/blog
AI 安全研究团队,专注大模型威胁情报
适用场景适用于获取大模型威胁情报
github.com/GreyDGL/PentestGPT
开源 AI 渗透测试助手,以对话交互驱动自动化测试
适用场景适用于对话式 AI 渗透测试入门
github.com/oritera/Cairn
开源大模型红队框架,支持多样化攻击模板
适用场景适用于多样化攻击模板的快速红队演练
simonwillison.net
资深开发者,LLM 应用与 AI 安全实践的一手经验
适用场景适用于跟进 LLM 应用与 AI 安全的一手实践
embracethered.com
专注 LLM 安全研究,深入分析提示注入与 Agent 攻击
适用场景适用于深入分析提示注入与 Agent 攻击细节
nicholas.carlini.com
Google 安全研究员,AI 对抗攻击与模型安全深度剖析
适用场景适用于阅读 AI 对抗攻击与模型安全深度分析
jack-clark.net
Import AI 作者,AI 产业动态与安全事件的持续观察
适用场景适用于持续跟踪 AI 产业动态与安全事件
josephthacker.com
独立安全研究者,专注大模型漏洞与智能体安全
适用场景适用于关注大模型漏洞与智能体安全新发现