山海印SHANHAIYIN

AI 图片检测是怎么做的?来源凭证、国标标识与像素复核详解

AI 图片检测不是让一个模型直接给出百分比,而是按证据强度依次检查原文件、来源凭证、国标标识和图像特征。

更新日期:2026-08-04

先说结论:直接证据优先于概率判断

上传一张图片后,AI 图片检测工具到底看了什么?

很多人以为,系统只是把图片交给一个模型,然后返回“AI 生成可能性 82%”。 这种理解只覆盖了最后一部分。更稳妥的图片鉴别,应该先寻找能够直接说明来源的证据, 再使用模型分析图像特征;不同证据不能混为一谈。

山海印目前采用的流程是:原文件与 SHA-256 指纹 → 可信 C2PA 来源凭证 → GB 45438—2025 文件标识 → 基础鉴别模型 → 必要时的像素复核 → 汇总报告

这个顺序的原则很简单:能验证直接来源时,优先使用直接证据;没有直接证据时,再进行概率性判断。

第一步:先固定本次检测对应的文件

图片进入分析流程后,系统首先根据用户实际上传的文件计算 SHA-256 内容指纹。

SHA-256 可以把一个文件转换为固定长度的摘要。文件中哪怕只有一个字节发生变化, 重新计算得到的指纹通常也会不同。因此,报告中的文件指纹用于回答: “这份报告对应的是不是我当时上传的那个文件?”

它不能回答图片是不是 AI 生成,也不能证明画面内容真实、作者是谁或文件何时创建。 它的作用是建立报告与文件之间的对应关系。

对于体积较大的图片,系统可能生成适合模型接口分析的副本,但报告中的 SHA-256 仍以用户上传的原文件为准。 这样做是为了适配分析服务的输入限制,不会把分析副本冒充成原文件。

第二步:核验可信 C2PA 来源凭证

系统接下来检查图片是否带有基于 C2PA 标准的 Content Credentials,也就是内容凭证。

C2PA 不是普通的备注字段。有效的内容凭证会通过密码学方式与文件绑定,并带有签名、签发者、 所用工具和处理动作等信息。山海印不会只因为文件里出现“C2PA”字样就下结论,而是继续检查:

  • 当前文件是否存在可读取的活动凭证;
  • 数字签名能否通过验证;
  • 签名证书能否连接到受信任的签发链;
  • 凭证描述的是相机拍摄、普通编辑,还是算法生成或增强;
  • 凭证与当前文件内容是否仍然匹配。

只有当凭证通过验证,并且其中的动作明确指向 AI 生成或算法增强时,系统才把它作为明确的 AI 来源证据。 一张相机拍摄的照片也可能带有有效 C2PA 凭证;“有 C2PA”并不自动等于“由 AI 生成”。

C2PA 能帮助确认来源记录是否完整、是否与文件绑定以及由谁签发,但它不负责判断画面中的事件是否真实。 C2PA 官方也明确说明,内容凭证验证的是来源信息是否有效、可信且未被篡改,不对内容本身作真假判断。

第三步:读取 GB 45438—2025 AIGC 文件标识

如果没有获得可直接下结论的 C2PA 证据,系统会继续检查文件中是否包含符合 GB 45438—2025《网络安全技术 人工智能生成合成内容标识方法》的 AIGC 元数据。

根据文件所带信息,系统可以读取生成合成内容属性、内容生产者或服务提供者、内容编号等字段:

  • Label=1:文件明确声明为人工智能生成合成内容,可作为直接的文件声明展示;
  • Label=2 或 Label=3:表示可能或疑似包含生成合成内容,只作为风险线索,继续进入模型分析。

这里必须区分“声明”和“验签”。国标 AIGC 字段是文件中的标识信息;C2PA 内容凭证还可以验证数字签名和信任链。 两者都有价值,但证据性质不同,报告中不应把文件声明写成已经完成密码学验真。

我国《人工智能生成合成内容标识办法》将标识分为显式标识和隐式标识,并要求相关服务在文件元数据中加入 生成合成内容属性、服务提供者名称或编码、内容编号等信息。该办法与 GB 45438—2025 均于 2025 年 9 月 1 日起实施。

第四步:没有直接来源证据时,进入基础模型鉴别

大量网络图片不带可信来源凭证,元数据也可能在截图、社交平台压缩、裁剪或重新导出时丢失。 没有发现来源信息,不代表图片一定由人拍摄;它只说明这一层没有提供可用证据。

此时,系统才会让基础鉴别模型分析当前图片。模型关注的是图像中与生成、合成或算法编辑相关的统计特征, 例如局部纹理的连续性、细节分布、边缘与光影关系,以及整体像素模式是否更接近训练中见过的生成内容。

模型返回的分数表示当前图片与相应类别的匹配程度或判断置信度, 不等于工具在所有图片上的总体准确率,也不表示图片有多少百分比由 AI 制作。

新的生成模型、强压缩、低分辨率、截图、局部裁剪、滤镜和后期编辑,都可能改变可观察特征。 真实照片也可能因为降噪、锐化、虚化或计算摄影处理而呈现类似生成图的统计特征。

第五步:结果不明确时,启动像素复核

如果基础鉴别已经得到相对明确的结果,系统不会为了堆叠分数而无条件重复检测。 只有结果落在不明确区间,或者基础分析暂时不可用时,才会启动第二层像素复核。

像素复核相当于从另一套分析视角检查 AI 生成或编辑特征。它的作用不是制造一个 “两个模型都同意,所以百分之百正确”的结论,而是减少把单一模型输出直接当成最终答案的风险。

当两层模型方向一致时,报告可以给出更清楚的风险提示;当结果彼此冲突或输入质量不足时, 更合理的处理是保留不确定性,提示结合原文件、发布来源和人工检查继续核验。

第六步:按照证据强度汇总,而不是把分数简单相加

最终结论不是把几项数值做平均。山海印按照证据类型和强度组织结果:

  1. 经过签名和信任链验证、且明确记录 AI 生成动作的来源凭证,优先作为直接来源证据;
  2. 文件中的国标 AIGC 标识按其声明等级解释,明确声明和疑似标识分别处理;
  3. 没有直接证据时,参考基础鉴别与像素复核的模型结果;
  4. 证据不足或相互冲突时,保留“需要进一步核验”的空间。

报告随后呈现主要结论、判断依据、请求编号和 SHA-256 文件指纹。 请求编号用于定位本次检测服务,文件指纹用于核对报告对应的原始文件,二者都不是司法鉴定编号。

为什么不能只依赖肉眼,也不能只依赖一个模型?

肉眼检查仍然有用,例如发现异常文字、重复纹理、结构错误或不合理光影。 但现在的生成图片已经不一定存在明显的手指、牙齿或文字错误;真实图片经过强处理后,也可能出现类似异常。

单一模型同样无法覆盖所有生成器、编辑方式和传播过程。NIST 对合成内容透明度技术的梳理也将来源记录、 标识、水印和内容检测视为不同的技术方向,而不是让一种方法包办全部问题。

因此,更实际的方法不是追求一个“万能识图器”,而是建立证据顺序: 先找可以验证的来源,再看文件声明,最后使用模型推断,并明确记录输入文件和分析边界。

这套流程不能证明什么?

即使检测发现较强的 AI 生成信号,也不能自动证明图片配文为假、发布者主观造假或某个具体的人制作了图片。 反过来,没有发现明显信号,也不能保证图片从未经过 AI 处理。

山海印目前不会声称能够识别所有平台的私有数字水印,也不会通过逆向方式冒充平台官方核验工具。 只有实际能够读取或验证的来源信号,才会被写入报告依据。

AI 图片检测报告适合用于初步筛查、风险提示和提供后续核验线索,不能代替司法鉴定、人工审核或最终事实认定。 涉及投诉、新闻核查、交易纠纷或重要决策时,还应保存原文件、下载页面、发布时间、上下文和创作记录, 并由相关人员综合判断。

结语

AI 图片检测的底层逻辑,不是“看起来像不像 AI”,也不是“一个分数决定真假”, 而是从直接来源证据逐步走向概率推断:先固定文件,再验 C2PA,读取国标标识, 必要时调用基础鉴别和像素复核,最后把依据与边界一起写进报告。

如果需要核验一张图片,建议尽量上传未经截图、裁剪或重新导出的原文件。 你可以先阅读如何判断一张图片是不是 AI 生成的, 了解实际检查步骤;也可以查看图片裁剪后为什么更难识别

使用山海印完成检测后,不要只截取结论或百分比,而应同时查看判断依据、请求编号和 SHA-256 文件指纹; 对于重要内容,再结合来源链路和人工复核继续判断。

常见问题

山海印检测图片时,是不是只调用一个 AI 模型?

不是。图片会先检查可信 C2PA 来源凭证和 GB 45438—2025 AIGC 文件标识。没有明确来源证据时,才进入基础模型鉴别;基础结果不明确或服务暂时不可用时,再进行像素复核。

图片带有 C2PA 凭证,就一定是 AI 生成的吗?

不一定。相机拍摄和普通编辑也可以产生 C2PA 内容凭证。只有凭证通过签名与信任链验证,并明确记录 AI 生成或算法增强动作时,才能作为相应来源证据。

GB 45438—2025 文件标识和 C2PA 是一回事吗?

不是。国标 AIGC 元数据提供文件中的生成合成内容标识;C2PA 内容凭证还涉及数字签名、内容绑定和信任链验证。报告应明确区分文件声明和可信来源凭证。

图片没有元数据,还能检测吗?

可以继续进行模型分析,但缺少来源信息会减少一类直接证据。截图、压缩、裁剪和重新导出都可能移除元数据,所以没有元数据不能证明图片不是 AI 生成,也不能证明它一定由 AI 生成。

为什么同一画面的原图和截图可能得到不同结果?

截图会生成一个新文件,可能移除内容凭证和元数据,也会改变分辨率、压缩方式与像素特征。因此两者不是同一个检测对象,SHA-256 指纹与模型结果都可能不同。

像素复核能保证结果准确吗?

不能。像素复核提供第二层分析视角,用于处理不明确结果或基础服务不可用的情况,但仍属于模型推断,不能消除所有误判。

山海印能检测所有平台的隐形水印吗?

不能这样承诺。不同平台的私有水印需要相应的核验能力或授权接口。山海印只把实际能够读取或验证的来源信号写入报告。

参考资料

  1. C2PA:C2PA and Content Credentials Explainer
  2. C2PA:Content Credentials Technical Specification 2.4
  3. 国家互联网信息办公室等:《人工智能生成合成内容标识办法》
  4. 全国标准信息公共服务平台:GB 45438—2025
  5. NIST:Reducing Risks Posed by Synthetic Content

核验你手中的图片

优先提交原文件,并结合来源凭证、模型依据、请求编号和内容指纹阅读检测报告。

开始图片鉴别 →