截图、会议记录、音频或视频可能保留文档的外观,却不保留可信的来源。AI Incident Database 维护一份与人工智能系统相关的已报告损害的公开目录,其中包括身份冒用和合成内容案例。该目录证明其存在,并支持案例研究;它并不衡量发生率。对审核员而言,其后果很具体:内容启动审查,来源决定证据能承载多大的证明力。
警示的范围
框架是准则 14——证据完整性——及其根基准则 02。行为主体、日期、准则、范围和有效性都可以出现在伪造的记录中;因此,仅凭目视审查并不足够。以下案例证明了风险及其机构层面的后果。但不能据此估算市场发生频率,也不能推定某项具体证据是合成的。
案卷:病症先于技术
风险先于生成式人工智能
APAS 认定,对 Wirecard 在 2016 至 2018 年间的审计存在职业违规行为。该决定依据工作底稿、通信、证言和第三方信息,对事务所及五名审计师作出处罚。官方案卷不足以将整个案件归结为某一类文件;但它确实证明,在任何深度伪造出现之前,佐证和工作底稿就已是问题的一部分。
文件审查存在明确的局限
2024 年,Umweltbundesamt 因违规问题拒绝了中国八个 UER 项目的证书。在提出法律和技术异议以及可能开展现场审查后,七份申请被撤回。主管机构给出了直接结论:利用卫星图像进行远程评估,或对提交的报告进行纸面审查,并不总能发现和证实滥用行为。这一局限可以用于方法层面的借鉴;案件细节不可泛化。
合成内容已成为事件范围的一部分
AI Incident Database 收录的已报告事件包括身份冒用以及合成音频、图像和视频。其数据库随新增条目而变化,并依赖公开报道;因此,本报告不固定某个统计数量,也不将第三方制作的分类归于该数据库。站得住脚的信息是定性的:审核员现在就应在风险模型中考虑合成证据。
伪造风险与来源控制
下表不设定通用的分钟数或成本。它梳理了各类载体的篡改风险及相应的来源控制。
| 证据类型 | 相关风险 | 如何确立其来源 |
|---|---|---|
| 屏幕截图或摘录 | 编辑、局部选取或在来源系统之外生成 | 核验人员直接访问来源,并记录查询过程 |
| 带抬头和签名的 PDF | 内容、签名或元数据被篡改 | 向签发方或通过公共登记记录核验;在风险需要时使用时间戳 |
| 日志和系统记录 | 选择性提取、修改或事后生成 | 技术保管、访问控制、完整性,以及与独立来源的关联核对 |
| 音频和视频 | 身份冒用、编辑或合成生成 | 核验人员控制的渠道、自行采集,以及接收材料的保管链 |
不变的要素在第三列。当内容的外观已不足以取信时,访问来源系统、自行采集和独立佐证支撑着证据的证明价值。
审核专业的应对
准则 14 将来源、完整性和保管纳入审核发现。在操作层面,它要求将证据分为由核验人员采集、经独立来源佐证,或由利益相关方提供。随后根据风险审查元数据和保管控制。创建日期与声明日期之间的差异是一种信号;在成为审核发现之前,需要了解其背景。
还有一个改变报告的举措。仅靠受审核方说法支撑的关键证据,不再作为审核发现的依据,而是列为待佐证——报告也要用这些措辞予以说明。准则 02 完成了这一框架:提出的主张必须得到证明,而如今,证明也必须涵盖承载它的载体。
在下一次内部或外部审核之前,请在证据矩阵中增加一列 · 来源。对于每项对审核发现具有证明力的证据,记录由谁生成、在哪个系统中生成、经过什么路径送达案头,以及采取了哪些防篡改保护。预先规定哪些证据类型要求核验人员直接采集——系统摘录、用于身份确认的视听材料——哪些可以接受在提供后加以佐证。报告须逐项证据声明佐证程度。
操作层面的总结是:未经佐证的所供记录,其证明力低于由核验人员采集或核对的记录。报告必须先声明这一差异,再据此形成结论。