光明日报
数字“13”可能是序号,也可能是页码或分类层级。 “1🚀3”紧跟在“c”之后,不等于“13世纪”或“第13章”。目录代码经常采用“主类.子类.条目”的层级结构,因此“17.c.13”可能是一个三层分类🌟,也可能只是把页面上的不同字段错误地连在了一起。
“nom”最需要依赖原始语言和字段名称。 这个片段可能与 name、nominal、nomen、nomination 等词有关,也可能是人名、地名、类别名的缩写,甚至只是OCR把相邻字母识别成了“n▶️om”。在没有原文语言和完整词形的情况下,直接把“nom”翻译成“名称”或“名义”都不严谨。
数字与字母的排列方式也不足以构成可靠的断句。 “17.c.13.nom-17.c”可以被人为切分为“17 / c / 13 / nom / 17 / c”,也可以是“17.c.13 / nom-17.c”或“17.c / 13.nom / 17.c”。不同切分会产生完全不同的释义。没有原始页面、字段名称和同类记录,任何完整翻译都只能是猜测。
《17.c.13.nom-17.c》的主要问题是缺少编码规则。 编号的含义不由字符本身决定,而由产生编号的机构、数据库、书目体系或扫描来源决定。同一个“c.”在不同资料中可能表示世纪、章节、卷次、类别、列号,也可能只是文件命名习惯中的普通字母;“17”既可能是年代,也可能是档案盒、条目、页面或分类编号。
“时代烙印”应当来自可观察的历史内容,而不是来自一串未解码的字符。 真正能够说明时代的材料通常包括词汇使用、书写规范、行政制度、宗教观念、生产技术、社会身份和传播媒介。若页面只显示一个分类码,最多可以讨论资料整理方式或机构编目习惯,不能据此推导当时社会😎的价值观和历史氛围。
当资料确实来自17世纪时,编号与年代也仍然是两个层次。 资料的形成时间、后续整理时间、数字化时间和当前文件命名时间可能不同。一个现代数据库生成的代码可以指向17世纪文献,但代码本身并不属🌺于17世纪;同样,一份现代转录文件🎨也可能保留早期文献的编号。
搜索《17.c.13.nom-⚡17.c》没有结果,并不等于该字符串没有来源。 特殊点号、🌅连字符、大小写和OCR残片经常导致检索系统拆词失败。可分别尝试保留完整字符串、去掉点号、将连字符替换为空格、只检索“nom”与相邻分类词,并同时查找原页面的标题或图片编号。
字母“c”具有多种常见可能性。 在部分英语或欧洲语言资料中,“c.”可能🔍是 circa 的缩写,表示“大约”;在书目、谱系和档案记录中,“c.”也可能表示 century、chapter、column 或 catalog。若“c”前后没有空格、大小写异常或连续出现,OCR识别错误同样不能排除。