把“研究热点”当成检索结果里最显眼的词,是论文选题里最常见的误判。发文变多只说明这个说法还在被生产,并不说明它仍被后续研究使用。更稳妥的做法,是把发文趋势当作热度、把引文趋势当作影响力,放进同一张战略坐标:两条趋势各自标成向上、平稳或向下,候选主题就会落到热点区、过热区、冷点区或研究贫乏区。先看位置,再决定进入、调整或放弃。
位置比热词更重要
李秀霞、韩霞、史盛楠在2021年发表的趋势分析中,以学科主题为例,用发文趋势和引文趋势绘出含研究贫乏区、热点区、冷点区、过热区的战略坐标,用来区分主题所处的发展阶段。李秀霞、程结晶、韩霞发表于《图书情报工作》2019年第11期的研究,同样先按这两条趋势把情报学主题分成贫乏、热点、冷点和过热四类,再做优先级排序。这些工作说明:分区是为了看发展等级,不是为了给某个宽词发一张长期有效的“热点证书”。
本文采用的操作口径与这一思路一致,方便开题时直接判断:
- 发文趋势向上、引文趋势也向上,视为热点区:还在被写,也还在被用。
- 发文趋势向上、引文趋势向下或明显弱于发文,视为过热区:产量高,后续采用不足。
- 发文趋势向下、引文趋势仍向上或相对平稳,视为冷点区:新论文变少,已有工作仍被引用。
- 两条趋势都处于低位或向下,视为研究贫乏区:看起来像没人做,但先不能叫空白。
平稳不是第四条轴,而是“方向不明显”。某一区的边界年出现走平,不要强行算成向上或向下,宁可把该主题标成“待复核”,缩短时间窗或改用更细的检索式再看一次。
四区对应的默认动作
| 所在区 | 两条趋势 | 默认判断 | 默认动作 |
|---|---|---|---|
| 热点区 | 发文向上,引文向上 | 主题仍有生产和影响 | 可以进入,但必须把宽词收成一个可回答的问题 |
| 过热区 | 发文向上,引文向下或偏弱 | 同题论文已经很多 | 不直接开题;先换样本、换机制或换问题 |
| 冷点区 | 发文向下,引文仍向上或平稳 | 产出降温,影响未同步消失 | 先查降温原因和是否改名,再决定回访或放弃 |
| 研究贫乏区 | 发文、引文都低或向下 | 可能是缺口,也可能是做不成 | 排除数据不可得、方法不成立之后,才考虑开题 |
热点区的优先,只说明“这个方向还活着”。过热区不等于不能写,研究贫乏区也不等于研究空白。后两区最容易看反,下面单独处理。
把宽词收成一张筛选表
宽泛热词不能直接进战略坐标。先把它拆成几条可以检索、也可以在一篇论文里回答的候选主题,再逐条标趋势。
筛选表至少保留这些列:候选主题、数据库、检索式、时间窗、发文趋势、引文趋势、所在区、决策、调整时改的是什么、数据是否可得、方法是否成立。
操作顺序可以固定为六步。
- 把宽词拆开。对象、情境和问题至少占住两项。例如不要只检索“在线学习”,而要分成高校混合式教学中的学习投入、职业院校直播课的持续使用、课后服务平台的使用意愿。同一宽词下,这几条的分区可以完全不同。
- 只选一个主数据库,写死检索式和时间窗。中文库和外文库覆盖不一样,不能把两边的年度数量加在一起再看趋势。
- 按年导出发文量和引文量。引文用总被引还是篇均被引都可以,但同一张表只能用一种口径。
- 比较近年与前段年份的方向,标成向上、平稳或向下。看的是变化方向,不是某一年绝对篇数高不高。
- 按上表落入四区,写下进入、调整后再进入,或放弃。
- 在表下注明导出日期。几个月后若要写开题报告,用当天重新导出的序列覆盖旧表,不沿用学长笔记里的分区。
学生阶段不一定先上复杂模型。年度序列已经能看出方向时,直接标注即可。若方向争议大、年与年之间跳动明显,再考虑正式的趋势估计。已有研究在主题发展等级划分中使用过主题模型和 Sen's 斜率一类估计,那是加强证据的工具,不是开题前的入场券。无论用目测还是用斜率,都要在选题说明里写清规则,避免同一张表里有的主题凭感觉、有的主题凭检验。
过热区要挪开,而不是再写一篇相似论文
过热区的典型形态,是题目里的对象名称一换,假设、量表、模型和结论句式几乎不动。这种题目检索很容易,写作也快,但审稿时很难说明新的贡献。发文还在涨、引文已经跟不上,往往就是同质化的信号:社区仍在重复生产,后续研究却越来越少引用这些重复。
调整只走三条路,而且三条都要能在文献里指出“旧做法没覆盖什么”。
- 换样本。不是再找一个更方便发放的群体,而是换到既有研究确实很少覆盖、你又有合规接触途径的对象。样本好找但文献里已经反复出现,分区不会因此改变。
- 换机制。同一现象可以改解释路径,例如从态度和意愿,转到组织约束、制度激励或技术条件,前提是这条路径在近邻文献中尚未被检验,而不是只换了一个自变量的名字。
- 换问题。少问“是否显著相关”,改问“在什么条件下原结论失效”,或“现有测量把哪一类对象排除在外”。问题变了,贡献才变。
一个直接的自查:删掉你的样本地名和年份,若正文结构和已有几篇高度同构,说明你还站在过热区中心。此时应继续改问题,而不是把“以某地为例”写成创新点。
贫乏区先排除假空白
检索结果少,常见原因不是“别人没发现”,而是这个问题目前写不出来。开题前至少排除两类限制。
数据不可得。主题依赖内部流程、未公开统计或敏感个人信息,而你没有合规、稳定的获取路径。只写“拟通过调研获得”不算排除。要写明数据由谁持有、你凭什么能拿到、拿不到时做什么。
方法不成立。问题需要的测量、识别或对照,以你现在的训练和条件做不到;或者核心概念无法操作化,检索词少只是因为这个说法在文献里本来就不成立。方法不成立时,分区再“空”也不构成选题理由。
同时满足下面三条,才可以把贫乏区暂记为可能的真实缺口,而不是空白本身。
- 检索式已经覆盖同义词、上下位词,并在相邻数据库复核过,不是只搜了一个中文词。
- 近邻主题或综述能够说明:该对象、情境或条件确实少被处理,或者已有结论互相冲突且原因没有被解释。
- 你能写清数据来源、分析步骤和做不成时的退出标准。退出标准应在开题时就定下,例如核心数据在某一日期前仍无法合规取得,则改题而不是放宽概念凑数。
三条里缺任何一条,决策栏写“放弃”或“继续缩小”,不要写“填补空白”。
冷点区和热点区也不要顺手就做
冷点区容易被当成“过时”。发文下降而引用还在,至少有三种可能:问题没解决但难做了,数据源中断了,或者社区换了词、旧词不再被用来发文。先做词形追踪,看旧主题是不是被新术语接走;接走了,就按新术语重算分区。没有改名、引用仍在、你又能解释降温原因,回访才有意义。解释不了,就放弃,不要因为“竞争者变少”而进入。
热点区的风险相反。两条趋势都向上,只说明社区还在生产和引用,不说明你的题目已经具体。进入条件是:能在既定篇幅和期限内回答一个问题,并且数据与方法匹配。若开题报告的主体仍是在复述热词为什么重要,分区再好也还没有形成论文选题。
分区只对检索当日有效
同一主题换数据库、换时间窗、换检索式,所在区都可能变。引用还有滞后期,近一两年的引文趋势往往偏低,不能把窗口截断误判成主题失效。比较时宁可把最后一年单独注明,或看稍早若干年的方向,不要用未完成累积的当年引文否定一条仍在上升的曲线。
因此,筛选表上的趋势不是文献综述里的形容词,而是你导出当天的年度序列。开题报告里写明数据库、检索式、起止年份和导出日期。导师或合作者若使用另一套库,分区要重算,不能直接合并结论。
战略坐标也不是各类“前沿报告”的替身。前沿报告适合了解有哪些专业簇正在形成;你手里这个候选主题该不该做,仍要回到自己检索当日的发文趋势和引文趋势。前人绘出的四区图,对应的是他们当时的学科、数据库和年份,只能当作方法样例,不能当作你的专业今天的地图。
动笔前用四问收口
- 这个题目是一条可检索的候选主题,还是一个宽词?
- 按导出当日的序列,它落在哪一区?趋势是向上、平稳还是向下?
- 若在过热区,样本、机制、问题至少改了哪一项,改完后是否还与旧文同构?
- 若在贫乏区,数据不可得和方法不成立是否都已排除?排除不了,是否已经决定放弃?
四问都能用筛选表上的格子回答,再进入研究设计。回答不了,说明位置还没算完,此时继续搜集“为什么这个热点重要”的句子,对选题没有帮助。


