所有操作需满足以下基础条件,否则会导致导入失败或费用虚高:
需先填写2张固定表格,用于精准计算人工+工具耗时成本:
| 表格名称 | 核心列要求 |
|---|---|
| 待导入档案统计 | 档案类型、单份页数、总条数 |
| 字段映射关系 | 软件字段名称、档案原字段名称 |
字段映射参考模板(直接套用):
| 软件必填字段 | 档案原字段示例 |
|---|---|
| 全宗号 | 文书档案-全宗号 |
| 档案号 | 系统统一编号 |
| 题名 | 档案标题 |
| 归档日期 | 归档时间 |
按职场基础行政岗每小时60元折算,单条档案导入耗时标准为2分钟(含核对字段、上传、校验),计算逻辑:
总费用=(总条数×2分钟÷60分钟)×60元/小时
例:1000条档案总费用=(1000×2÷60)×60=2000元;若用工具批量处理,耗时仅为原来的1/10,总费用可降至200元

将原始Excel转为软件要求的规范CSV,避免手动调整字段的人工成本:
```python import pandas as pd 加载原始档案文件 raw_df = pd.read_excel("待导入档案.xlsx", sheet_name=0) 对应字段映射(修改为你的原字段名称) mapped_df = raw_df.rename(columns={"系统统一编号":"档案号", "归档时间":"归档日期"}) 生成导入用CSV(必须用utf-8-sig编码,否则乱码) mapped_df.to_csv("导入用档案.csv", encoding="utf-8-sig", index=False) ```执行后生成的CSV即为合规导入文件,无需手动修改任何内容
登录系统后,进入系统设置-导入设置,勾选「允许CSV批量导入」,设置单批次最大导入条数为500(避免超时),点击保存
1. 点击左侧「批量导入」模块,选择刚才生成的「导入用档案.csv」
2. 系统会自动识别CSV字段,必须手动核对每个必填字段是否与软件对应,若有偏差可在页面直接调整映射关系
3. 若需导入档案扫描件,将所有附件放在与CSV同目录,命名规则为「档案号_页码.后缀」(例:DA2024001_1.pdf),系统会自动关联附件
1. 点击「开始导入」,等待进度条达到100%(容器异常时会自动重试,无需手动干预)
2. 校验环节:随机抽取10条档案,核对软件内的字段内容与原始档案完全一致
3. 若出现错误,查看日志文件路径:/dspace/logs/import.log,找到对应行号,修改CSV后重新导入,无需删除已导入数据
1. 提前去重:用Excel的「数据-删除重复值」功能去除重复档案,可减少30%以上的导入耗时
2. 分批次导入:每批次500条,单次出错率控制在1%以内,避免返工的额外费用
3. 工具预处理:用上述Python代码批量转换,可节省90%的手动调整字段时间,直接降低成本
核心注意:不得修改软件要求的必填字段名称,否则会导致导入失败,产生返工费用