一、前置准备清单
本指南使用全开源免费的档号生成器+纸质档案扫描OCR+电子档案分类归档工具组合成适配辽阳本地档案规范的基础档案软件,所有工具均无需商业授权。
1.1 硬件要求
- Windows 7及以上/ macOS 10.15及以上/ Ubuntu 20.04及以上均可,建议使用日常办公电脑,无需服务器
- 硬盘剩余空间≥100GB(按每月1000页A4,每页2MB估算,满足3年存储需求)
- 内存≥8GB(仅日常归档≥4GB)
1.2 工具下载
按顺序点击以下链接下载工具包:
二、档号生成器配置(适配辽阳本地规范)
辽阳本地党政机关/企事业单位常用档号规则为:全宗号-分类号-年度-保管期限-件号(全宗号由档案馆统一分配,暂未分配可自定义4位字母或数字占位),以下为全宗号LYDA001、文书类分类号WJ、年度2024、永久保管期限YJ为例的配置:
2.1 解压档号生成器
将下载的ArchiveNumberGen_v1.2.0_Win64.zip解压到D盘根目录下的“辽阳本地档案管理”文件夹,文件夹路径统一设置为:D:\辽阳本地档案管理\档号生成器
2.2 配置档号规则文件
- 打开档号生成器文件夹,找到config.yaml文件,用记事本或VS Code(推荐)打开
- 删除原有内容,复制以下内容直接粘贴:
```yaml
archive_number_rule:
separator: "-"
parts:
- name: "全宗号"
type: "fixed"
value: "LYDA001"
length: 7
- name: "分类号"
type: "select"
options: ["WJ", "RS", "KJ", "CW", "QT"]
length: 2
- name: "年度"
type: "auto_year"
format: "yyyy"
length: 4
- name: "保管期限"
type: "select"
options: ["YJ", "30N", "10N"]
length: 3
- name: "件号"
type: "auto_increment"
start: 1
step: 1
length: 4
reset_on_year_change: true
```
说明:RS代表人事档案、KJ代表科技档案、CW代表财务档案、QT代表其他档案;30N代表30年、10N代表10年;reset_on_year_change: true表示每年1月1日件号自动重置为1
2.3 生成第一个档号

双击档号生成器文件夹内的ArchiveNumberGen.exe,选择分类号WJ、保管期限YJ,点击“生成”,即可生成档号LYDA001-WJ-2024-YJ-0001,点击“复制”即可复制到剪贴板。
三、纸质档案扫描OCR配置
使用PaddleOCR实现扫描后自动识别文字,生成可搜索的PDF文件,方便后续归档:
3.1 解压PaddleOCR
将下载的PaddleOCR-2.7.0-Windows-GPU-CPU.zip解压到D:\辽阳本地档案管理文件夹,文件夹路径为:D:\辽阳本地档案管理\PaddleOCR-2.7.0-Windows
3.2 测试PaddleOCR是否正常运行
- 打开PaddleOCR文件夹,在空白处按住Shift键+右键,选择“在此处打开PowerShell窗口”
- 输入以下命令并回车:
```powershell
.\ppocr.exe --use_gpu=false --image_dir=.\doc\imgs\11.jpg --output_dir=.\output
```
说明:--use_gpu=false表示使用CPU识别,有NVIDIA显卡可改为true;如果正常运行,会在output文件夹生成识别后的图片和可搜索的PDF文件
3.3 批量扫描OCR的快捷脚本
- 在D:\辽阳本地档案管理文件夹内新建记事本,粘贴以下内容:
```batch
@echo off
cd /d D:\辽阳本地档案管理\PaddleOCR-2.7.0-Windows
set /p input_dir=请输入待扫描图片的文件夹路径(直接粘贴后回车):
set /p output_dir=请输入OCR识别后PDF的保存路径(直接粘贴后回车):
.\ppocr.exe --use_gpu=false --image_dir="%input_dir%" --output_dir="%output_dir%" --rec_char_dict_path=.\ppocr\utils\dict\chinese_cht_dict.txt --cls=true --angle_class_dir=.\inference\ch_ppocr_mobile_v2.0_cls_infer --det_model_dir=.\inference\ch_PP-OCRv4_det_infer --rec_model_dir=.\inference\ch_PP-OCRv4_rec_infer
echo 批量OCR识别完成!
pause
```
- 将记事本另存为“批量OCR识别.bat”,编码选择ANSI(避免中文路径乱码)
- 使用时,先将扫描的纸质档案图片(建议统一命名为“扫描件1.jpg、扫描件2.jpg…”)放到一个文件夹,双击运行该脚本,按提示输入路径即可
四、电子档案分类归档工具配置
使用CKFinder搭建本地Web版的电子档案分类归档系统,无需联网即可使用:
4.1 搭建本地Web服务器(XAMPP简化版)
- 下载XAMPP简化版:xampp-portable-windows-x64-8.2.12-0-VS16.zip(无需安装,解压即可用)
- 将XAMPP简化版解压到D:\辽阳本地档案管理文件夹,文件夹路径为:
D:\辽阳本地档案管理\xampp-portable
- 打开D:\辽阳本地档案管理\xampp-portable文件夹,双击setup_xampp.bat,按提示操作,一直按回车完成初始化
- 双击xampp-control.exe,点击Apache右侧的“Start”按钮,启动Apache服务器,看到Apache旁边的灯变绿即启动成功
4.2 配置CKFinder
- 将下载的ckfinder-3.5.1.1-php.zip解压到D:\辽阳本地档案管理\xampp-portable\htdocs文件夹,重命名为“档案管理系统”
- 打开D:\辽阳本地档案管理\xampp-portable\htdocs\档案管理系统\config.php文件,用记事本或VS Code打开,找到第33行左右的$config['authentication'],将其修改为:
```php
$config['authentication'] = function () {
return true;
};
```
- 找到第135行左右的$config['backends']['default']['root'],将其修改为:
```php
$config['backends']['default']['root'] = 'D:\辽阳本地档案管理\归档档案';
```
- 在D:\辽阳本地档案管理文件夹内新建“归档档案”文件夹,再在该文件夹内新建5个子文件夹:文书档案、人事档案、科技档案、财务档案、其他档案
4.3 使用CKFinder归档档案
- 确保Apache服务器正常运行,打开浏览器,在地址栏输入:
http://localhost/档案管理系统/ckfinder.html,即可进入归档系统
- 左侧选择对应的档案分类文件夹,点击右上角的“上传”按钮,将OCR识别后的可搜索PDF文件拖拽到上传区域,上传前将PDF文件名修改为之前生成的档号+档案标题(如:LYDA001-WJ-2024-YJ-0001关于2024年第一季度工作总结.pdf)
- 系统支持按档号、文件名搜索,点击PDF文件名即可直接在线预览