华语文学奖索引

方法论

这一页说明本站的数据从哪里来、哪些经过核实、哪些没有。凡是推断值都会在页面上标出来,不会混在核实过的数据里。

数据来源

颁奖年:核实值与推断值

作协系的源页多数只给评选时段不给颁奖年(如「第十一届茅盾文学奖获奖篇目(2019—2022)」)。这种情况下本站用评选时段终点作代理, 并在记录旁标注「年份为推断值」

经人工逐届查证报道后填入的颁奖年,才算核实值。目前2,665 / 3,595 条记录的颁奖年是核实过的。

★ 不用「时段终点 +1」这类公式外推。该规律对骏马奖近三届成立, 但对儿童文学奖两处证伪——第四届评选时段 1995—1997,实际拖到 2000 年才颁奖。 按公式补出来的年份看起来都通顺,正因为通顺才没法被后续检查发现。

内容简介

不转载他站简介原文。本站简介是依据素材压缩改写的, 且每条都必须满足两个条件才会上线:经编辑审阅、注明依据来源。 两者缺一,页面上宁可显示「简介待补」。

目前 532 条简介已上线, 另有 547 部作品素材已入库但尚未撰写。

授奖辞是另一回事——那是评委会原文,属适当引用,照引不改写并给出处, 不经过上述审阅闸门。目前收录 179 条。

已知缺口

缺口在这里列出来,而不是藏起来:

校验

构建链带四道闸:数据缺失、中文路由编码、页面内容空壳、部署文件数上限, 任一不过即中断,不会把坏的产物发出去。 另有 40 条带实测出处的校验规则,每条都对应一次真实失效—— 包括数次「所有检查都通过但产物是错的」的具体形态。

数据集可在数据下载页取得, 自行核对比听我们说更可靠。