星瀚元图书馆集群管理系统 — 导入套录库功能说明一、 页面概览本界面位于“数据维护”模块下的“导入套录库”页面。作为书目数据入库的“缓冲带”与“质检中心”,该页面的核心作用是为图书馆提供外部MARC数

本界面位于“数据维护”模块下的“导入套录库”页面。作为书目数据入库的“缓冲带”与“质检中心”,该页面的核心作用是为图书馆提供外部MARC数据的预检与校对环境。与外部数据直接导入正式馆藏不同,套录库允许馆员在数据安全隔离的前提下,对书商提供的大批量MARC文件进行解析、人工核对、查重及字段修正,确认数据准确无误后,再将其正式生成馆藏记录,从而最大程度保障图书馆书目主数据的权威性与整洁度。
页面顶部提供了与外部数据源对接的基础环境配置与文件传输入口:
· 字符集编码:下拉选择框(当前选中“gbk”),用于匹配外部MARC源文件的字符编码,防止因编码不一致导致的中文数据乱码。
· MARC类型:下拉选择框(当前选中“cnmarc文献”),指定源数据的标准格式,确保系统能按既定规则正确解析字段。
· Marc文件上传与状态:显示已选择的待上传文件(如“gbk_100多条.iso_0.16MB...”),并提供“上传”与“删除”操作。当前页面提示“gbk_100多条.iso上传文件成功”,表明文件已成功传输至系统服务器并等待解析。
· 导入数据与配置管理:“导入数据”按钮用于将解析后的套录库数据正式推入馆藏库;下方的“配置”下拉框结合“刷新”、“新增”、“编辑”、“删除”按钮,支持调用预设的MARC字段映射规则,实现不同书商数据的自动化解析。
文件成功上传并解析后,系统会将MARC数据转换为直观的表格形式供馆员逐条审校(当前显示第1到第10条,总共174条记录):
· 书目核心信息:“行号”、“完整题名”(如《彩图上下五千年.第四卷》、《弟子规:易解》)、“标准编号”(ISBN,如7-104-01774-7)、“分类号”(如K2, H1)与“索书号”。
· 出版与资产信息:“单价”(用于后续资产登记)、“第一责任者”(如龚德隆主编、(清)李毓秀)、“出版社”(如中国戏剧出版社)、“出版地”与“出版时间”。
· 操作:“查看”按钮可逐条展开详细的MARC字段层级,便于馆员核对原始数据与系统解析结果是否一致,及时发现并修正错误的编目信息。
当前页面处于采编业务的数据源头环节,与左侧菜单及其他模块形成了严密的数据流转闭环:
1. 导入套录库(当前页):接收外部MARC文件,进行数据的清洗、查重与人工作业校对,确保入库数据的高质量。
2. 导入馆藏数据:若馆员确认数据无需额外人工干预,也可跳过套录库,直接在此模块将MARC文件导入正式馆藏(适用于高度信任的成熟数据源)。
3. 文献入藏/馆际文献入藏:套录库中的数据经过确认后,需进入入藏模块分配具体的馆藏地点、生成文献条码,完成实物图书的资产登记。
4. 馆藏Marc输出/文献Marc输出:将系统内经过套录库校对后的标准数据反向导出,用于向上级机构上报或与其他图书馆进行数据交换。
1. 新书采购后的“数据安检”机制:当接收到书商随书附赠的MARC光盘或数据包(如本例中的174条数据)时,切勿直接导入正式馆藏。应先将其导入“套录库”,安排编目员逐页浏览预览列表。重点关注“标准编号”、“分类号”和“题名”是否准确,剔除书商数据中常见的错别字或冗余字段。
2. 结合“文献查重”防止主库污染:在将套录库数据正式“导入数据”至馆藏前,务必利用系统的查重功能(可结合上一轮提到的“导入数据配置”中的查重策略),比对系统中是否已存在该书目主记录。若已存在,则选择“套录追加馆藏”(不重复建书,只增加复本);若不存在,则生成新的书目记录,从而保持主库的干净与权威。
3. 灵活调用“导入配置”提升效率:针对长期合作的几家书商,建议在“导入配置”中提前保存好他们的MARC字段映射模板(如哪一位存条码、哪一位存价格)。下次导入同类型文件时直接调用,系统会自动将MARC原始字段精准映射到“单价”、“索书号”等系统字段中,大幅减少人工手动修改的工作量。
4. 分阶段处理大规模数据:面对多达174条甚至上千条的MARC数据,建议利用分页功能(每页显示10条)分批审校。对于解析明显错误的条目(如乱码或字段错位),可在套录库中直接编辑修正或删除,确认当前页无误后再进行下一页,确保最终导入正式馆藏的每一条数据都经得起考验。

这是“导入数据配置”弹窗的局部特写,展示了针对特定模板(配置名称为“111”)的进阶映射与质量控制规则。结合图书馆采编业务,对该部分配置进行详细解读与实操建议:
一、 基础与责任者配置
配置名称:111
这是当前映射模板的标识名称。在实际业务中,建议采用“书商名称+数据类型”的命名规范(例如“新华书店CNMARC”或“某某书商套录模板”),以便于后续在导入主页面快速识别和调用,避免多个模板之间产生混淆。
*必填项 编目人:admin
下拉选择框当前指定了默认编目员为“admin”。这意味着通过此模板导入的所有文献记录,其编目责任人将统一归属到该账户下。这有助于后续进行精准的工作量统计、数据追溯以及责任界定。
二、 数据查重与质量控制(核心防冗余机制)
文献查重:查重
此处启用了查重功能。在将外部MARC数据导入正式馆藏库前开启此选项,可以有效防止同一本书因多次采购或重复导入而在系统中生成多个重复的书目主记录,从而保证图书馆书目主数据库的权威性与整洁度。
文献查重字段:完整题名, 标准编号
指定了用于比对的唯一标识维度。“标准编号”(通常为ISBN)是图书的绝对唯一标识;而“完整题名”则作为辅助校验维度。系统在执行导入时,会同时比对这两个字段,只有两者都与库中现有记录完全一致时,才会判定为重复数据,极大地提升了查重的精准度。
三、 数据清洗与字段剔除
删除字段:905
这是非常关键的数据清洗配置。在CNMARC标准中,905字段通常被称为“本地字段”或“馆藏字段”,用于存放图书馆内部的索书号、条码号、馆藏地点等敏感或特定信息。
在导入外部书商提供的MARC数据时,勾选或填写删除905字段,意味着系统会在入库前自动剔除这些外部冗余或可能冲突的馆藏信息。这能强制要求馆员根据本校/本馆的实际排架规则重新分配索书号和条码,避免“拿来主义”导致馆藏数据混乱。
四、 业务场景与实操建议
优化查重策略以防漏判:虽然“标准编号+完整题名”的组合查重准确率很高,但在实际业务中,部分老旧图书或再版图书可能存在ISBN相同但题名微调的情况。建议根据书商数据质量,酌情考虑是否将“第一责任者”也加入查重字段中,形成多重校验。
严格管控“删除字段”保安全:除了905字段外,外部数据中可能还包含906(个人名称主题)、905$p(复本数)等不符合本馆编目规则的字段。建议在“删除字段”中将其一并列出(如填写 905, 906),确保导入系统的数据干净、规范,减轻后期人工清洗的负担。
模板的保存与复用:当前配置“111”设置完毕后,点击右下角“提交”即可保存。下次再接收同一家书商的MARC数据包时,直接在导入主页面的“配置”下拉框中选择“111”,即可一键复用这套成熟的映射与查重规则,实现高效、标准化的批量入库。