编号 JIANDOU-ARCHIVE/2026|密级 社区公开 登记于 2026-08-04 访客
JIANDOU ARCHIVE · 拣豆 · 第壹卷

拣豆大模型安全知识档案馆

以知识沉淀为基石,以实战工具为出口。五大安全维度、全生命周期风险矩阵与攻防案例,按档案规范编目入库。

登记为档案馆寻迹者,通过邮箱验证入场 注册 → 登录页
JIANDOU · 2026

NAME ORIGIN · 命名释义

拣选之「拣」。一颗一颗地拣,不放过一粒坏豆——从海量样本中拣出恶意与真知,是安全与档案的第一动作;「拣」又谐音「检」,恰如指纹识别与越狱测试。

微物之「豆」。如豆灯火、以豆喻微——最微小的输入,可撬动最庞大的模型;最细碎的痕迹,正是安全取证的关键。

拣豆藏卷 · PICK THE BEAN, ARCHIVE THE TRUTH — 万豆之中,拣取一真

馆藏登记 · COLLECTION LEDGER

A-001 威胁条目238
A-002 安全案例6
A-003 研究资料71
A-004 资源工具27
A-005 馆藏文档22
A-006 影音视频10
A-007 AI 网站26

安全风险矩阵

FIVE DIMENSIONS · 五大维度卷宗

最新入库

RECENT ACCESSIONS · 最近 5 条

精选推荐

FEATURED · 书架精选

研究追踪

RESEARCH TRACKING · 最近更新

常见问题

FAQ · 大模型安全入门
大模型安全是什么?

大模型安全研究大语言模型在训练、部署与运行全生命周期中面临的安全风险,包括提示注入、越狱攻击、数据投毒与供应链投毒等,并给出检测、防御与治理手段。

大模型有哪些常见攻击类型?

常见类型包括提示词注入、越狱攻击、训练数据投毒、模型窃取、Agent 工具滥用与供应链投毒。其中提示注入与越狱是当前最活跃的攻击面。

零基础如何入门大模型安全?

先建立模型与推理的基本概念,再通过 OWASP Top 10 for LLM 或 MITRE ATLAS 了解风险分类,最后用 Promptfoo、garak 等开源工具动手做评测与红队测试。

有哪些开源的大模型安全工具?

常用开源工具包括 Promptfoo(LLM 评测与红队)、微软 PyRIT(AI 红队自动化)、NVIDIA garak(漏洞扫描)与 Cairn(攻击模板),详见本站资源导航 /shelf。

提示注入和越狱有什么区别?

提示注入是利用外部不可信内容(如网页、文档)操纵模型行为;越狱是通过精心构造的提示绕过模型的安全对齐约束。两者常结合使用。

企业如何落地大模型安全防护?

建议从输入侧(提示过滤与注入检测)、模型侧(对齐与评估)、应用侧(权限隔离与供应链管控)三层建设,并建立红队评测与事件响应流程。

大模型安全工具会做哪些检测?

典型检测包括提示注入、越狱成功率、敏感信息泄露、工具调用越权与恶意输出,并输出结构化报告供回归对比。

浏览 27 条精选大模型安全资源 →