扫描仪:必须使用爱普生DS-530,驱动下载地址:https://www.epson.com.cn/Products/Scanners/Business-DS-Series/DS-530.html(对应系统版本);电脑:Win10及以上,8G内存,50G剩余空间;U盘:16G以上(临时存储用)。
winget install Hamrick.VueScanwinget install Adobe.Acrobat.ProDC所有档案拆成单页,用平口螺丝刀撬开金属钉帽,拔出钉芯,严禁直接扯拉;胶条用酒精棉擦拭软化后小心揭除,破损页面用1cm宽透明胶带补好(仅补边缘破损,不覆盖字迹);绝对禁止用宽胶带或液体胶,会影响扫描识别。
按件号、页码顺序排列,每100页插入一张白色A4分隔纸,标注对应件号;排序后检查漏页、缺页,标记后单独存放,避免扫描遗漏。
打开电脑后,启动扫描仪电源,预热3分钟(确保扫描头稳定);打开VueScan,设备选择爱普生DS-530,模式选“文档扫描”,分辨率300DPI,颜色模式:纸质档案用“灰度”,彩色档案用“彩色”,输出格式JPG,质量90%;提前在桌面新建文件夹“孝感数字化档案/扫描图像”,设置输出路径为该文件夹。
逐页放入扫描仪,点击“扫描全部”,每扫完100页停止,检查图像是否清晰;核心命名规则:件号_页码.jpg,例如2023_001_005.jpg,对应2023年度第1件的第5页,孝感系统严格执行此规则,命名错误会导致入库失败。
打开IrfanView,点击“文件→批量转换/重命名”,添加所有扫描图像,勾选“旋转/翻转→自动纠偏”,输出路径设为“孝感数字化档案/预处理图像”,点击“开始批量转换”。
打开预处理后图像文件夹,点击“编辑→批量处理”,添加“滤镜→降噪(灰度)”,强度设为50(严禁超过60,否则会丢失字迹),点击“应用到所有图像”后保存。
打开Adobe Acrobat Pro DC,点击“创建PDF→从多个文件”,添加所有预处理后的图像,点击“合并”,生成“合并档案.pdf”,保存到“孝感数字化档案”文件夹。

打开合并后的PDF,点击“工具→扫描和OCR→识别文本”,选择“此文件中的所有页面”,语言选“中文(简体)”(选繁体会大幅降低准确率),点击“开始识别”;识别完成后,随机检查10%页面,修正识别错误(如“3”→“5”),孝感要求识别准确率≥98%。
下载著录工具v1.2后,双击安装包,默认点击“下一步”完成安装,桌面生成快捷方式,双击打开。
必须录入字段:件号、年度、保管期限、页码总数、扫描图像路径、OCR文本路径;所有字段不能留空,无内容填“无”,保管期限需与原档案一致(永久/30年/10年),系统会校验此字段,错误直接拦截。
点击工具顶部“导出→XML格式”,保存为“[件号]_著录结果.xml”,确保文件名与扫描图像命名规则对应。
打开入库校验工具v1.0,依次添加三类文件:扫描图像文件夹、OCR文本文件、著录XML文件,点击“校验”。
若提示“命名错误”,修改对应文件名;若提示“识别准确率不足”,回到OCR环节修正;全部通过后,将三类文件打包为ZIP格式(严禁用RAR,系统仅支持ZIP),命名为“[件号]_数字化包.zip”,压缩包大小≤1G。
发送压缩包至孝感档案指定邮箱:xdaj_digital@163.com,邮件主题填写“[年度]_[件号]_数字化档案”。
删除桌面临时文件夹(仅保留最终三个文件:扫描图像、OCR文本、著录XML),记录本次操作的件数、扫描时间、识别准确率,存档备查。