您现在的位置: 首页 > 阅读详情
人工智能在档案行业应用的安全风险评估举例
 
发布日期:2026-08-12     来源:《中国档案》2026年第7期      浏览次数:133     字体:      

以档案编研为例,该应用可视作“档案利用”一级场景下的具体应用环节,此环节可从输入和输出2个角度,细分为“素材选取”和“内容生成”2个功能点,每个功能点又可从安全要求和评估方法2个方面提出具体安全细则。

1.素材选取

指对各种格式的编研素材进行统一存储与标准化管理,自动清洗制表符、换行符等干扰字符,对文档标题、作者、日期、关键词等核心元数据进行自动识别并提取,同时强制执行规范标准格式,自动校验元数据完整性及合规性。

其安全细则包括:

(1)编研素材选取需符合用户权限要求

安全要求:人工智能抓取的档案应是用户有权限访问的内容,严禁未经授权获取敏感档案信息或超出编研范围的档案。

评估方法:一是模拟不同权限用户使用人工智能编研工具,检查人工智能是否会抓取超出用户权限的档案。二是通过“越权请求测试”(如输入敏感的关键词等),验证人工智能是否能拒绝访问未授权素材。

(2)编研素材选取需符合档案不同安全等级要求

安全要求:对不同开放利用等级的档案,人工智能需按预设规则筛选素材。涉密档案仅能用于涉密编研项目,且需在涉密环境中调用。含个人敏感信息的档案需先脱敏再作为素材。

评估方法:构建包含不同密级标识、敏感信息的档案测试集,测试人工智能是否按规则筛选。

(3)编研素材选取应具备完整性

安全要求:人工智能抓取的档案素材需完整,避免因素材碎片化导致编研成果断章取义。

评估方法:随机抽取人工智能抓取的素材,与档案库原始档案比对,检查是否存在遗漏内容的情况。

2.内容生成

指利用大模型的语言生成能力,根据用户需求和档案数据,自动生成大事记、年鉴、全宗指南、机构沿革等编研成果。

其安全细则包括:

(1)生成内容的真实性

安全要求:人工智能生成的编研内容不得篡改、曲解原始档案信息,关键信息(如时间、结论)需与原始档案完全一致,避免出现模型“幻觉”。

评估方法:选取已知关键信息的档案素材(如包含明确时间的历史事件档案),让人工智能生成编研内容,比对生成内容与原始档案的关键信息是否一致,并检查是否存在原始档案中无依据的虚构信息。

(2)生成内容不泄露敏感信息

安全要求:编研成果中不得包含未经脱敏的敏感信息,涉及敏感信息的档案素材需在生成内容时自动隐去,不得泄露敏感信息细节。

评估方法:自动检查编研生成内容是否存在敏感信息(如敏感个人信息、敏感关键词等)。

(3)生成内容的逻辑可解释

安全要求:人工智能选取素材、生成内容的推理过程可追溯,避免出现错误不可查。

评估方法:检查人工智能输出内容的推理过程,由具备权限的技术专家和档案人员联合审核推理过程合理性。

(4)生成内容的算法无偏见

安全要求:人工智能采用的模型和算法不能有主观偏见(如故意忽视特定素材)。

评估方法:选取具有多元视角的档案素材,检查人工智能生成的编研成果是否可以均衡引用不同视角素材,避免因算法偏好导致内容片面。



武汉云典档案管理SEO关键词:武汉档案整理、武汉档案公司、武汉档案整理公司、咸宁档案整理、咸宁档案公司、武汉档案数字化、咸宁档案数字化、湖北武汉档案整理、湖北武汉档案数字化、湖北武汉档案修复、咸宁档案修复、武汉档案、咸宁档案、湖北档案公司、湖北档案整理、武汉档案用品、咸宁档案用品、云典档案整理公司

上一篇:【档案知识】收文是否都需要归档?
下一篇:【档案知识】实物档案的分类与类型