Bricks Planet
返回砖块库

Brick Card

system prompt

可以先理解为:定义模型角色边界工具规则和输出纪律的高优先级提示层

system prompt 像写给 agent 的驾驶手册:先说明它是谁、能做什么、不能做什么、遇到不确定时如何停下来,再规定工具使用和证据回报方式。但手册不是刹车系统,真正的边界还要靠工具权限和验证门。

关键结构图

当前相关远处

中心节点写 system prompt,左侧连接 role、policy、output format,右侧连接 Tool definitions、Trust boundary、Operational reliability;用虚线标出 prompt 要求,用实线标出 runtime 控制。

What

system prompt 是位于用户输入之前、用于定义模型角色、行为边界、工具规则、安全纪律和输出格式的高优先级提示层。它可以像一份 agent 行为说明书,但不能替代真正的日志、权限和运行时遥测。

system prompt 是位于用户输入之前、用于定义模型角色、行为边界、工具规则、安全纪律和输出格式的高优先级提示层。它可以把策略、语气、禁止事项、工具使用纪律、证据回报格式和失败处理写进 agent 的默认行为。但 system prompt 不是运行时监控:真正的权限控制、日志、审计和遥测仍要由工具层和 runtime 承担。

When

当你需要定义 agent 的默认角色、边界、工具纪律、证据回报和失败处理方式时,可以先检查 system prompt。

How

先写清角色、目标和禁止事项,再写清工具调用规则、证据回报格式、何时承认不确定、何时请求人工确认。最后把真正高风险的限制下沉到工具权限、runtime 日志、审计记录或 validation gates,不要只留在 prompt 里。

Examples

一个 coding agent 的 system prompt 可以要求每次修改后报告测试证据,但真正的测试结果仍要由命令输出、日志和 evidence pack 保存。

一个客服 agent 的 system prompt 可以禁止承诺退款,但权限系统仍要限制它不能直接执行高风险动作;否则一句规则会被误当成真实控制。

来源

类型:安全框架 / 概念整理

事实线:这张卡把「system prompt」整理为高优先级提示层:它定义角色、边界、工具规则、输出纪律和证据回报格式。

依据:1000 Bricks 既有 AI 安全治理概念,并合并 2026-06-26..2026-07-05 catch-up 中关于 system prompt as telemetry channel 的公开材料信号,以及 2026-07-27 concept automation digest 中关于 agent 行为说明书的读者安全信号。

边界:适用于 AI 风险治理、能力边界、防御策略和安全控制;不等于 system prompt 可以替代工具权限、日志、审计和运行时遥测。

常见误读:不要把 system prompt 当成万能安全层。它能塑造默认行为,但不能保证模型永远遵守,也不能单独提供可审计证据。