实践笔记
AI 代理应记录哪些日志,以便管理者审计其工作?
直接回答:AI代理应记录目标、输入、决策、行动、系统、权限与证据,使管理者能按人机分工审计。本文给出可落地的日志框架与审批路径。
AI 代理应记录每一次目标、输入、决策、行动、系统、权限和证据,使管理者能判断它是否按人机分工执行、何时需要人工介入。日志不是技术细节的堆砌,而是审计代理行为、追责和持续改进的治理工具。

为什么日志是 AI 代理治理的基础
AI 代理(AI agent)是能自主执行多步骤任务的软件,例如自动回复询盘、更新 CRM 或生成报告。管理者审计代理工作时,需要回答三个问题:它做了什么、为什么这样做、是否符合权限和预期。没有结构化日志,这些问题只能靠猜测。

日志也是人机协作(human-in-the-loop)的契约。当代理请求人工批准或升级时,日志记录了它当时的判断依据,让人类能快速复核而不是从头调查。一份好的日志应像飞行记录仪,在事故后能还原完整过程。

从治理角度看,日志是问责的基础。NIST AI 风险管理框架和 OECD AI 原则都强调透明度和可追溯性,而日志正是实现这两点的最低成本手段。对于小团队,日志还能帮助发现代理的重复错误和流程瓶颈。

代理应记录什么:七类核心日志
我们建议将日志分为七类,每类回答一个审计问题。这不是技术规范,而是一个管理框架,你可以根据业务风险增减字段。

- 目标(Objective):代理本次运行要完成什么任务,例如“将新询盘分类并分配给销售”。没有目标,审计无法判断行为是否合理。
- 输入(Inputs):代理接收了哪些数据,包括原始消息、文件、上下文和用户指令。输入日志用于验证数据来源和完整性。
- 决策(Decisions):代理在每一步做出的选择,例如“判定该询盘为高意向,因为包含预算和截止日期”。决策日志应包含推理摘要或依据。
- 行动(Actions):代理实际执行的操作,如“创建 CRM 记录”“发送邮件”“调用 API”。行动日志需包含时间戳和操作对象。
- 系统(Systems):代理访问或修改了哪些系统、工具和数据库,以及使用的凭证或权限范围。这用于检测越权访问。
- 权限(Permissions):代理当时的权限状态,例如“只读 CRM”“可发送邮件但需批准”。权限日志帮助审计是否超出授权。
- 证据(Evidence):支持决策的原始数据或引用,如邮件原文、知识库条目、外部 API 响应。证据让审计者能独立验证代理的结论。
这七类日志不必全部由代理自动生成,有些可以由系统记录。关键是管理者能在一个地方看到完整链路,而不是散落在不同工具中。

如何为一个工作流设计日志:入站线索示例
以下是一个入站线索处理工作流的日志设计示例,仅作说明,不代表任何客户结果。假设你的网站收到一条询盘,代理需要分类、评分并决定是否分配给销售或自动回复。

- 目标:将新询盘分类为“高意向”“低意向”或“垃圾”,并执行对应动作。
- 输入:记录询盘原文、来源渠道、提交时间、用户 IP 和任何附加文件。
- 决策:代理输出分类结果和置信度,例如“高意向(置信度 0.87),因为提到预算和项目时间”。同时记录使用的分类规则或模型版本。
- 行动:如果分类为高意向,代理创建 CRM 线索并通知销售;如果低意向,发送自动回复;如果垃圾,标记并归档。每个行动都记录时间戳和结果。
- 系统:记录访问了哪些系统(如 CRM、邮件服务)以及使用的 API 密钥或服务账号。
- 权限:记录代理当时的权限,例如“可创建 CRM 记录,但发送邮件需人工批准”。
- 证据:保存询盘原文、分类依据(如关键词匹配或模型输出)以及任何外部数据(如公司信息查询结果)。
管理者审计时,可以快速查看一条询盘的完整日志,判断代理是否误分类、是否越权发送邮件,或者是否遗漏了重要线索。如果代理请求升级,日志能让审批人立即看到上下文,减少来回沟通。

审批、日志和升级路径:代理行动前必须存在什么
在代理执行任何可能产生业务后果的行动前,必须定义清晰的审批规则和升级路径。审批规则应基于风险分级,例如:低风险行动(如打标签)可自动执行;中风险行动(如发送外部邮件)需人工批准;高风险行动(如修改合同或付款)必须完全由人类执行。

日志与审批紧密相关:代理在请求批准时,应附上相关日志摘要,让审批人快速决策。审批结果也应记录在日志中,包括批准人、时间和任何修改意见。这样审计时能看到完整的决策链。

升级路径是指当代理遇到不确定情况或权限不足时,应将任务转交给谁。例如,代理无法确定询盘意向时,升级给销售主管;检测到异常数据时,升级给技术负责人。升级事件也要记录日志,包括原因和接收人。

我们建议在启用代理前,先完成一次“桌面演练”:用历史数据模拟代理运行,检查日志是否完整、审批是否顺畅、升级是否及时。这能暴露很多设计问题,避免上线后手忙脚乱。

常见问题
以下是一些管理者常问的问题,基于上述框架回答。

日志应该保存多久?
保存时间取决于行业法规和业务需求。一般建议至少保存 6 个月,涉及财务或客户数据的可能需要更长。日志应定期备份,并限制访问权限。

如何确保日志不被篡改?
使用不可变存储或区块链技术可以防止篡改,但对小团队可能过重。至少应做到:日志只能追加,不能修改;访问日志需要身份验证;定期审计日志完整性。

代理日志和传统应用日志有什么区别?
传统应用日志主要记录系统事件和错误,而代理日志更关注决策和行动,因为代理的自主性带来了新的风险。代理日志需要包含推理依据和权限上下文,以便人类审计。

小团队如何开始实施代理日志?
从最关键的一个工作流开始,定义七类日志的最小字段,使用现有工具(如电子表格或日志服务)记录。运行两周后,根据审计发现的问题调整字段和审批规则。

如果你正在考虑为业务引入 AI 代理,建议先做一次流程映射,明确哪些步骤可以自动化、哪些需要人工把关。你可以通过联系页面带来一个真实工作流,我们可以一起做一次流程审查。

常见问题
AI 代理日志应该包含哪些关键信息?
AI 代理日志应包含目标、输入、决策、行动、系统、权限和证据七类信息,使管理者能完整审计代理的行为和依据。
如何审计 AI 代理是否越权操作?
通过检查权限日志和行动日志,对比代理当时的权限范围与实际执行的操作,可以识别越权行为。同时,系统日志能显示代理访问了哪些资源。
人机协作中,代理何时需要请求人工批准?
当代理要执行中高风险行动(如发送外部邮件、修改重要数据)时,应请求人工批准。审批规则应在部署前定义,并记录在日志中。
小企业如何开始建立 AI 代理审计流程?
小企业可以从一个关键工作流开始,定义最小日志字段和审批规则,使用简单工具记录,运行一段时间后根据审计发现迭代改进。
来源
- AI Risk Management Framework — NIST
- OECD AI Principles — OECD
- Artificial Intelligence Risk Management Framework (AI RMF 1.0) — NIST
- Ethics guidelines for trustworthy AI — European Commission
- Responsible AI: From Principles to Practice — UNESCO
- Model Cards for Model Reporting — arXiv