
简介一份关于中文图书计算机编目的49页教学PPT面向图书馆编目人员、图书情报专业学生及相关从业人员系统讲解机读目录格式与编目工作的核心规范。内容涵盖编目信息源选取原则、永久性与临时性信息处理方式、可变长字段与固定长字段的区别以及MARC标准记录结构的组成要素包括记录头标、地址目次、数据字段等。同时深入说明了001记录控制号、010 ISBN字段、100通用处理数据、101文献语种等必备或可选字段的填写规则并给出价格、卷册、限定信息等细节处理示例。资源为1个PPT文件压缩包大小约414KB已有33人学习。适合需要快速掌握计算机编目基础概念与MARC格式要点的读者作为课堂教学或自学复习的简明参考资料。1. 编目这件事远不止“录个书名”那么简单中文图书计算机编目听起来像是个坐在电脑前敲书名的活儿但真正上手干过的人都知道这条流水线是图书馆数据体系的根基。我经手过不少编目项目也带过新人很多人第一次拿到这套49页的培训PPT时第一反应是“字段怎么这么多”第二反应才是“原来书名不是照着封面抄就行”。这篇文章我打算从实际工作的角度把编目的核心思路、CNMARC字段怎么用、分类和主题词怎么给、常见错误怎么避一次讲透。适合刚入行的编目员、图书馆基层馆员、图书供应商的数据加工人员也适合想了解“图书馆里那串号码到底怎么来的”的书友。先摆一个我自己的理解计算机编目不是把书的信息“打”进系统而是把一本书的物理特征、内容主题、检索需求翻译成机器能读、读者能查的标准化语言。这个翻译过程有一套国际通用的语法中文图书用的就是CNMARC中国机读目录格式。你给的信息越规范、越完整读者检索时命中率越高馆藏盘点时账目越清晰馆际互借时数据传输越顺畅。所以编目质量直接决定了一座图书馆的数据底子好不好。去年我们馆做了一次编目数据回溯我才真正意识到早期人工录入的错误有多顽固ISBN少打一位、责任者姓名顺序颠倒、丛书项漏掉、分类号凭感觉给——这些坑在后期想修补成本比当初认真编目高得多。所以这篇博文里的很多内容既是方法论也是我踩坑换来的经验希望能帮你少走弯路。接下来按我平时带教新人的顺序来拆解先讲编目的整体设计思路再拆核心字段和规则然后走一遍完整实操流程最后整理高频问题和排查技巧。2. 核心思路拆解编目系统里的“查重—著录—标引—审核”2.1 为什么编目不能直接照抄书上的版权页很多初学者以为编目就是照着版权页和封面向系统里输入其实中间的差异很大。版权页上的信息侧重于出版方的记录逻辑而编目数据遵循的是ISBD国际标准书目著录和《中国文献编目规则》的逻辑。举个最典型的例子版权页上写到“王晓明 著”编目数据里责任者字段通常要求采用规范化的检索点即“王晓明”按姓名倒置规则处理后进入“200字段”必要时还要在“701字段”做个人名称规范控制。如果书名页写的是“XX丛书编委会”版权页落款却变成了某出版社编辑部这些差异都要靠编目员判断选哪个做正题名、哪个做交替题名或相关题名。再比如丛书。实体书上丛书名可能印在封面角落、丛书页、甚至只在CIP数据里出现但编目时丛书项需要著录到225字段并关联到4--字段做丛编连接。漏掉丛书项读者按丛书名检索时这本书就“失踪”了。这种细节没法靠OCR自动完成必须人工判断。所以编目的第一步不是“打字”而是“理解书”。拿到一本书先翻封面、题名页、版权页、丛书页、目次、后记把信息源按ISBD规定的优先顺序确认清楚再动键盘。这一套“先判断后录入”的思路是整个编目流程设计的第一原则。2.2 数据流设计从采编到典藏的完整链路编目在图书馆管理系统里不是一个孤立环节它夹在采购和典藏之间。一张完整的编目数据流大概是这样的采购验收后图书进入编目库也叫待编库系统分配一个采编批次号。编目员对每本书查重——确认馆内是否已有同ISBN、同版本的书防止重复购买和重复编目。编目员在CNMARC模板中填字段保存后生成一条完整的机读目录记录。审核人员抽查或全查数据修改错误、补漏字段。数据发布到OPAC公共检索系统同时生成馆藏条码信息图书进入典藏分配分配馆藏地、排架号。复本书直接复制已有编目数据仅需添加馆藏信息。这个链路里编目数据是所有下游模块的地基。OPAC检索靠它馆藏统计靠它读秀、百链这类第三方服务对接的也是这个接口。哪怕系统中一个200字段的题名多了一个空格导出数据到联合目录时都可能出现匹配问题。所以编目里谨慎不是保守是职业素养。2.3 一个成熟的编目模板长什么样我手头常用的CNMARC模板字段不是从零敲的而是基于国图、CALIS的标准模板改的。日常中文图书编目核心字段大概二十来个但真正每次都要手工判断的集中在下面这张表里字段含义实操要点001记录控制号一般为系统自动生成无需手工处理010ISBN注意校验位、价格多个ISBN时需要分别著录100一般处理数据含入档日期、出版日期类型、阅读对象代码容易漏101作品语种原著语种、译著源语种要区分200题名与责任者正题名、拼音题名、第一责任者、其他责任者重点字段205版本说明版次、版式说明如“第2版”“修订本”210出版发行出版地、出版社、出版年注意出版地无法确认时的著录方法215载体形态页数、图、尺寸多卷书要注意总页数和分册页数225丛编项丛书名、分册号、分册名很容易被忽略330内容提要帮助读者判断是否相关最好自己写而不是抄封底606学科主题依据《中国分类主题词表》选词注意用规范词690中图法分类号分类的核心字段按图书内容归类701/702个人名称责任者规范检索点注意姓名倒置和生卒年711/712团体责任者机构作者、会议录等3. 核心细节解析CNMARC必懂字段与著录规则3.1 200字段是门面题名和责任者最容易出错200字段题名与责任说明项是读者检索时命中率最高的字段也是编目员每天打交道最多的位置。它由多个子字段组成$a正题名、$b一般资料标识中文图书编目一般不用、$c另一著者的正题名、$d并列题名、$e副题名及其他题名信息、$f第一责任说明、$g其他责任说明、$h分册号、$i分册名、$v卷册号。实操中有一个非常典型的分歧并列题名什么时候放$d什么时候放200字段的附注甚至放到510字段做检索点。我的习惯是——只要题名页上出现了英文或其他语种的对应题名就著录在$d同时在510字段做并列正题名检索点。这方便读者按英文书名查也方便馆际数据对接。责任者这里有个必须养成的习惯区分“责任方式”。$f里“著”“主编”“编”“译”“绘”不能混。“著”表示原创性写作“编”表示汇编整理“主编”是组织者“译”是翻译。一个书名页印着“张三著李四译”就不要把两个人并列成$f张三、李四而要拆成$f张三著$g李四译。机器读起来才能分清哪种责任是主体。3.2 010字段的ISBN判断校验位是可以心算的ISBN-13的校验位计算规则不复杂前12位数字奇数位乘1偶数位乘3全部相加用10减掉“和对10取余”的结果得到校验位如果结果为10则记为0。编号029算出来校验位是说实话我手工算过不少次但编目系统一般会自动校验。真正要留意的是区分配套资源一套书里分册的ISBN、套装的总ISBN、电子书的ISBN必须按实体资源情况分别著录不能混在同一个010重复子字段里。还有些书版权页的ISBN印错了比如校验位不对CNMARC里通常在010$a照录同时在300字段一般附注里注明“ISBN号有误”或“版权页ISBN疑似错误”。这个处理方式很重要因为你去联合目录比对的时候错误的ISBN反而可能成为识别这本书的关键线索。3.3 690分类号是体力活也是技术活中图法中国图书馆分类法给分类号难不在背类目而在判断图书内容的主要学科归属。我常用的方法是“三步定类”先看题名和副题名判断大致学科范围。再翻目次和内容提要确认具体对象和写作角度。最后用中图法简表确定大类再逐级找下位类。举两个实际例子。一本《Python数据分析实战》内容讲的是用Python工具做数据清洗和可视化但案例偏商业分析。核心归TP311.561程序语言及编程这个基本没争议。但遇到一本《跑步受伤的预防与康复》就要判断侧重运动医学还是康复治疗如果是医学生写的、讲病理机制更多放R873运动损伤比较合适如果偏训练方法放G822田径运动也不是不行。分类号没有绝对的对错但必须有“主要读者对象是谁、这本书在馆藏体系里和谁放在一起最合理”的判断依据。分类号给完之后我还习惯顺手检查一下分类号长度。中图法分类号一般给到三级或四级个别学科到五级但不要为了“显得专业”把号位拉满。分类号太长不利于排架和检索太短又不足以区分主题度要自己把握。3.4 主题词别凭感觉词表查一下不丢人606字段学科主题的选词依据是《中国分类主题词表》。实操中很多编目员会犯一个毛病直接用书名里的关键词作为主题词。比如《特大城市群空气质量数值模拟研究》书名里“空气质量”看起来像主题词但词表里规范词可能是“环境空气质量”或“空气污染—数值模拟”。这时候不去查词表就可能造出一个索引用不了的“非法词”。我的习惯是先确定2到4个主题词保证覆盖“研究对象研究方法学科领域”然后逐个去词表里核对用词。宁可少给一个也不要给一个不规范的。因为OPAC里的主题检索是基于规范词匹配的乱给词就等于给读者挖坑。4. 实操过程复盘一本书从验收上架的全流程记录4.1 拿到一本书我的第一步不是开电脑说实话很多新馆员被培训PPT里的字段吓到但真正熟练之后编目最耗时的不是填字段而是判断。以我最近编的一本《江南民居图说》为例完整流程是这样的先查复本扫ISBN465进系统没有匹配记录说明是第一批订购需要从零编目。信息源核对题名页写《江南民居图说》封面上多了“中国传统民居系列”的丛书名版权页出版者、出版年清晰不缺项但CIP数据里的分类号是TU-092我核对中图法后认为这本书侧重民居建筑形态与地域文化TU-092中国建筑史可以接受就没有改CIP的号。著录字段200$a江南民居图说$f王XX著210$a北京$c中国建筑工业出版社$d2022215$a215页$c图$d26cm225$a中国传统民居系列606$a民居$y中国$z图集690$aTU-092$v5。审核套录国图数据比对确认225字段丛编子的$a形式一致606主题词“民居”用的是规范词。典藏分配馆藏地“建筑科学阅览室”生成索书号TU-092/57。整个过程约12分钟其中真正打字不到3分钟其余时间都在判断各种信息源的优先级。4.2 查重环节的细节不要让复本变成“新书”查重的标准操作是扫ISBN但必须知道ISBN也有盲区同一本书改版后ISBN变了、套装书的总ISBN和分册ISBN不同、个别书版权页ISBN和CIP数据ISBN不一致。所以经验丰富的编目员查重不会只看ISBN而是“ISBN题名责任者出版年”四要素比对。有一次我差点犯了大错两本《中国美术史》一本是某社2021年版另一本是2023年修订版ISBN不同查重时提示“无记录”。如果我直接新建数据馆里就会产生两条内容高度重叠的记录读者检索时一头雾水。我当时做的是比对题名页和版次说明确认是同一著作的修订版后沿用旧记录的编目数据只在205字段添加“修订版”并给新版单独分配馆藏条码。这比新建一条独立记录要科学得多。4.3 索书号的组成逻辑我建议你亲手推一遍索书号通常由分类号加种次号组成。种次号的分配逻辑各馆不同常见做法是同类书中按到馆顺序给流水号比如TU-092/57中的57就是该分类下的第57种。有些馆用“著者号”替代种次号按著者姓氏编码取号比如拼音首字母加数字。实操中我遇到过最头疼的问题是两个馆合并后馆藏数据冲突两馆同用分类号TU-092但种次号都编到57合并后索书号重复书没法排架。后来我们做了批次前缀比如旧馆数据统一加9新馆数据从0开始才算彻底解决。这件事给我的教训是索书号规则一定要在系统初始化时就定好前缀和步长不然后期数据清洗太痛苦。4.4 多卷书和丛书两种容易搞混的情况多卷书比如《中国通史》第一卷、第二卷和丛书比如“中国传统民居系列”里包含多种独立的书在编目时走两条路。多卷书往往整体著录一条总记录225字段给出分卷题名各分卷可以用“462字段”做分卷连接也可以分散著录每一卷单独成一条记录。我们的处理规则是一次性到馆且内容连贯的多卷书做整体著录丛书则优先分散著录每本书独立成条再用225字段和410字段连接丛书总记录。这样做的好处是读者按单册检索能命中按丛书浏览也能聚拢体验最好。但这个规则不是死的丛书里的每一册如果内容相对独立、有单独题名确实分散著录更合理反过来如果丛书每册都围绕同一课题展开、编号连续聚在一起反而方便研究性读者。5. 常见问题实录与排查技巧5.1 高频错误速查表我自己审校时反复出现的错误整理成了一张表分享出来给大家对照自查错误类型典型表现排查方法ISBN漏录或错录多卷书只录总ISBN、校验位不匹配用系统校验功能检查010字段多ISBN逐一核对题名不完整漏副题名、漏分册名对照题名页、封面、书脊三个信息源交叉核对责任者顺序颠倒第二责任者放到了第一责任者位置看书名页的版式第一行或字号最大的通常是第一责任者出版地误判丛书出版地写成总社所在地、分册出版地漏掉版权页、CIP数据、出版社官网三处求证225字段与410字段不一致丛书名在225和410里写法不同导出MARC后比对子字段$a的字符串主题词不规范用了书名关键词而非词表规范词逐一查《中国分类主题词表》分类号过粗或过细分类号只给到一级类目用中图法电子版辅助判断必要时查同类书分类5.2 一条编目记录的自查清单我给团队定的规矩是保存数据前按清单过一遍总耗时不超过90秒但能拦下八成错误。010字段ISBN有没有录全多个ISBN有没有分行著录价格有没有填100字段入档时间是不是今天出版年类型是不是判断对了101字段译著有没有在$a标“原作语种”200字段$a正题名有没有漏副题名$f第一责任者和$g其他责任者有没有混在一起205字段版本说明有没有漏“修订本”“增订本”210字段出版地、出版者、出版年是否和版权页一致215字段页数、图、尺寸填全了没尺寸单位不要手滑写成“cm”以外的值。225字段有没有丛书丛书名是否和410一致330字段内容提要写了没有如果是自己写的有没有透露太多主观评价606/690字段主题词是否词表核过分类号是否匹配内容且长度合理5.3 对“CIP数据”的正确态度CIP数据是出版社在出版前向版本图书馆申请的编目数据很多书商会直接给编目员提供CIP数据甚至系统自动带出。我的态度是CIP是重要参考但绝不能作为唯一依据。实际工作中我碰到过CIP数据的分类号和图书实际内容明显不符的情况也见过CIP题名已经改了而出版社忘了更新。编目员的职责是“按手里的实体书著录”CIP不是为了让你偷懒而是为了帮你判断——这一点我在带新人时反复强调。5.4 数据质量光靠个人细致是不够的最后说一个体会编目数据质量不能只靠个人细心更需要流程上的复核与抽查机制。我们现在的做法是“全查抽审”结合新入职编目员前三个月所有数据全查正式编目员每周按10%比例抽审每月用批处理脚本检查必填字段缺失率比如100字段是否有值、010字段缺失比例等。这样下来整体字段缺失率从最初的两个月3%左右降到了现在的0.3%以下。我实操中的一个判断是编目员一天能高质量完成的新编量大约在80到120种之间超过这个数错误率明显上升。如果你是馆内管理者与其逼编目员冲量不如控制好节奏、预留审核时间。数据这个东西前期埋的雷后面都是要还的。中文图书计算机编目说到底是一个“标准意识细节功夫”的活。我在实际工作中最大的体会是不要嫌字段多、规则细每一个看似繁琐的约定背后都是无数读者检索失败的案例换来的。你在电脑前多花两分钟核对一个主题词可能就帮一个不知道准确书名的读者找到了他要的那本书。这个行业没有那么多高光时刻但数据一点点做扎实了馆藏才能真正活起来。本文还有配套的精品资源点击获取