引用报告的作用及其必须呈现的内容
审核你申请材料的USCIS官员,手上既没有Scopus的登录账号,也没有Web of Science的机构访问权限,更没有义务主动到Google Scholar上替你搜索核实。你提交的任何引用证据,都必须能够自证——材料本身必须包含足够的细节,让官员在不离开卷宗的情况下就能核实你的说法。这正是制作引用报告的核心原则:它不是你口头断言的一份摘要,而是一份你能拿出证据支撑的记录。
这份材料需要证明的三件事
一份完整的引用报告需要同时呈现以下三点:
- 总引用次数——针对你的每一篇关键论文,从不止一个数据库中提取数据,使这些数字之间可以互相核对。
- 引用作者的独立性——证明引用你工作的人,不是你本人、你的合著者,或与你关系密切的合作者。因为一个被自引灌水的数字,和一个由不相关研究者构成的数字,所代表的说服力是不一样的。
- 可追溯性——你汇总表格中的每一个数字,都必须有对应的截图或导出文件作为支撑,清楚显示这个数字的来源和获取时间。
需要避免的失败模式
一份只有引用数字、却没有底层截图、没有标注数据库名称、也没有注明检索日期的表格,读起来就像是一句缺乏证据支撑的空口断言。这种“有说法、无记录”的缺口,恰恰是招致Request for Evidence(简称RFE,即“补件通知”)的典型原因。解决办法是程序性的,而非靠说服力弥补:在撰写依赖这些数据的叙述文字之前,先把完整的证据链建立起来。
从 Google Scholar 提取引用数据
第一步:找到或建立个人主页
如果申请人已经有 Google Scholar 个人主页(scholar.google.com/citations),登录后打开即可——上面会列出所有被收录的论文及其实时引用次数。如果还没有主页,不要仅仅为了制作这份材料而专门建一个;而是在 Google Scholar 的主搜索框里,用论文的准确标题逐篇检索。
第二步:读取“被引用次数”
每条搜索结果或主页条目下方都有一个“被引用次数:N”(Cited by N)的链接。这个数字就是 Scholar 目前给出的该篇论文的总引用次数。把它和检索日期一并记录下来——Scholar 的引用数会随着它每周重新抓取网络数据而变动。
第三步:打开引用列表并保存证据
点击“被引用次数:N”,会展开完整的引用文献列表。把这个列表截图保存(如果有多页就都截下来),或者用浏览器的“打印为 PDF”功能保存整页内容,确保网址栏里能看到搜索关键词和日期。这份文件应作为汇总表所引用的原始来源文件保存下来,而不是只把数字抄进电子表格里了事。
第四步:注明 Scholar 的收录范围较宽
Google Scholar 会把预印本、学位论文、会议摘要等非同行评审材料和期刊论文一起计入索引。不要悄悄把这些过滤掉——应在材料中注明 Scholar 的统计数字包含了这类来源,这样审核人员在把它与 Scopus 或 Web of Science 的数字对比时,才能理解为什么这个数字更高,而不会误以为是数据出错。
从 Scopus 提取引用数据
Scopus 的收录范围和访问方式都与 Google Scholar 不同,报告应当如实反映这种差异,而不是把两个数据库的数字混在一起、不加区分。
定位文献记录
- 打开 scopus.com,用文献标题搜索;如果需要完整的发表列表,也可以用作者姓名搜索。
- 如果申请人有 Scopus Author Identifier(Scopus 为区分同名作者而分配的唯一编号),应改用该编号搜索——这样可以避免把申请人的成果和同名的其他作者混为一谈。该编号显示在申请人的 Scopus 作者主页上,报告中应注明以备核查。
- 打开每条文献记录,在页面上方找到“Cited by”(被引次数)计数。
导出引用文献列表
- 点击“Cited by”链接,打开引用该文献的文献列表。
- 全选列表条目,然后使用导出按钮(通常显示为箭头图标或“Export”字样)将列表下载为 CSV 文件,或导出为文献管理软件可识别的格式。
- 将 CSV 文件与引用文献列表及汇总计数的截图一并保存。
如果无法获得完整访问权限
Scopus 的完整检索与导出功能需要机构订阅或个人订阅。如果没有订阅权限,可以访问申请人的 Scopus 作者主页(可通过免费的 Scopus 预览页面或 ORCID 关联进入),查看引用概览——包括总引用数和 h 指数——即便详细的引用文献列表可能受限无法查看。报告中应注明所使用的访问级别,因为这会影响仅凭该证据材料本身能核实到什么程度。
从 Web of Science 获取引用数据
Web of Science(WoS,由 Clarivate 公司维护)需要机构或个人订阅才能使用。如果能通过所在大学图书馆或雇主获得访问权限,应使用 Core Collection(核心合集)检索,而不是范围更广的 "All Databases"(全部数据库)选项,因为 Core Collection 是文献计量学语境中最常被引用的引文索引。
检索并提取引用数据
- 登录后选择 Web of Science Core Collection。
- 按作者姓名检索(如果申请人有 Researcher ID/Publons 档案,可用其消除同名混淆并整合发表记录),或按论文的准确标题检索。
- 打开每条记录,查看记录页面右侧显示的 Times Cited(被引次数)数字。
- 若需要汇总申请人所有论文的引用情况,可勾选相关记录并使用 Create Citation Report(创建引文报告)功能。该功能会生成一份汇总表,列出每篇论文及总计的引用次数,并给出仅基于 WoS 数据计算的 h 指数。
- 使用 Export to Excel 或 Save to text file 选项导出引文报告,同时对报告页面截图,确保截图上显示提取日期。
为何数字会有出入
WoS 收录的期刊和会议论文集数量少于 Scopus,并且对来源收录采用更严格的标准。同一篇文章在 WoS 中的 Times Cited 总数通常会低于 Google Scholar 和 Scopus——这是数据库覆盖范围差异带来的已知现象,不是需要纠正的错误。
将三个数据库的引用数汇总成一张表
从三个数据库分别取得引用数之后,应当将它们合并成一张表格,而不是提交三份互不相干的证据。审核人员应当能够针对每一篇论文,直接并排看到三个数字的对比。
示例表格
| 论文标题 | 年份 | Google Scholar 引用数 | Scopus 引用数 | Web of Science 引用数 | 数据提取日期 |
|---|---|---|---|---|---|
| Novel biomarker for early detection of X | 2019 | 142 | 98 | 87 | 2024-03-11 |
| Machine learning approach to Y prediction | 2021 | 76 | 51 | 44 | 2024-03-11 |
| Structural analysis of Z compound | 2017 | 210 | 165 | 150 | 2024-03-11 |
将申请材料所依赖的每一篇论文各列一行,顺序应与它在申请材料其他部分(例如简历或相关证据附件)中出现的顺序一致,方便审核人员逐一核对。
为什么三个数字会不一致
Google Scholar、Scopus 与 Web of Science 各自收录的文献范围并不相同:Google Scholar 会将预印本、学位论文、灰色文献等一并纳入统计;Scopus 与 Web of Science 则只收录经过筛选的同行评审期刊与会议论文集,而这两者各自的期刊收录清单本身也并不完全一致。因此,这三栏数字几乎不可能完全吻合,而这种差异并不是需要设法弥合或解释掉的数据错误——它是三个数据库收录范围不同所必然产生的结果。应当在表格附近直接说明这一点,而不是让审核人员自己去猜测这些数字为何不一致。
剔除自引,识别独立引用作者
原始引用数量中包含申请人本人后续论文的引用,以及合著者的引用,这些并不能证明是独立的学术认可。三个数据库导出的引用列表都需要人工逐条核查,才能把这些引用识别出来。
第一步:提取引用作者名单
从 Google Scholar 的“Cited by”页面、Scopus 导出的 CSV 文件,以及 Web of Science 的 Citation Report 中,逐一提取每一篇引用文献的作者姓名。
第二步:与申请人的合著者履历交叉核对
整理出一份名单,列出曾在申请人本人论文中担任过合著者的所有姓名。将每篇引用文献的作者名单与这份合著者名单逐一比对。
第三步:在表格中逐条标注
在每一条引用记录旁新增一列,标为“Citation type”(引用类型)。如果引用文献的作者中出现了申请人本人或其合著者,标注为“Self”(自引);否则标注为“Independent”(独立引用)。按数据库分别统计两类引用的累计数量。
第四步:将拆分结果写入汇总表
在汇总表中同时列出每篇论文的总引用数和独立引用数,而不是只呈现一个合并后的总数。
这一人工核查环节无法省略——三个数据库都不会自动完成这项筛选。审查引用证据的官员可能会关注一个很高的总引用数是否主要由自引构成,因此支撑这一判断的明细数据应当随时可查,并且要与证据材料中其他地方所引用的总数保持一致。
材料格式与文件命名
文件命名
采用与请愿书证据清单(exhibit list)一致的命名方式。例如,若该引用报告是 Exhibit J,主文件命名为 Exhibit_J_Citation_Report.pdf。每个底层截图或导出文件按数据库和提取日期命名,可作为附属文件保存,也可合并进同一份 PDF 作为附录:Exhibit_J_GoogleScholar_2025-03-14.pdf、Exhibit_J_Scopus_2025-03-14.csv(提交前需转换为 PDF)、Exhibit_J_WoS_2025-03-14.pdf。文件名中日期保持一致,可让审核人员确认三个数据库的提取是在同一天完成的。
文件顺序
组织材料结构时,应让审核人员无需四处查找即可核实:
- 封面页,说明本证据材料的内容及提取日期区间。
- 汇总核对表(论文、年份、三个数据库的引用数、提取日期)。
- 简要方法说明——如何识别自引、使用了哪些档案 ID(如 Scopus Author Identifier、Researcher ID)。
- 各数据库的截图或导出文件作为附录,按数据库分类排列,每一页都应显示搜索关键词、引用数,以及浏览器或导出文件表头中可见的日期。
提交前的最终检查清单
- 在提交前几天内重新提取全部三项数据;不要沿用几个月前拉取的旧报告。
- 确认汇总表中的每一个数字都能在附录中找到对应的截图。
- 确认每张截图上都能看到明确的日期和搜索词。
- 确认文件名与证据清单及目录(table of contents)中的编号一致。
- 将原始导出文件的存档副本与最终排版的 PDF 分开保存,以备日后需要核查差异时使用。
容易招致 RFE 的常见错误
以下这些问题在因引用影响力证据而收到 Request for Evidence(RFE,补件通知)的申请中反复出现。
-
数字没有出处。 一句“被引用超过200次”,如果没有注明数据库名称、检索日期,也没有对应到具体证据文件(exhibit),审核官员没有数据库权限,根本无法核实。请愿叙述中出现的每一个引用数字,都必须能追溯到引用报告证据中的具体一行。
-
截图与声称的总数对不上。 如果叙述部分写的是214次引用,而附上的 Scopus 截图显示的却是198次,且检索日期还不一样,那么这个差异本身就会成为问题所在,而不是数字大小的问题。提交前务必重新抓取数据并核对一致。
-
未说明自引情况。 如果直接使用未经筛查的总引用数,其中包含了申请人本人或合著者的引用,却没有加以标注,这会让审核官员对整份证据的可靠性产生怀疑,而不仅仅是质疑某一个数字。
-
只依赖单一数据库。 如果引用报告只用 Google Scholar 数据拼凑而成,没有用 Scopus 或 Web of Science 做交叉核对,会显得像是挑选对自己有利的数据,而非全面呈现——尤其考虑到这三个平台的收录范围差异如此之大。
-
数据过期。 如果引用数字是八个月前抓取的,且之后未重新核实,就很可能与官员今天搜索同一篇文章时看到的结果不一致。各数据库的数据是持续更新的,引用报告的检索日期应尽量接近递交日期;如果两者之间间隔较大,应当重新抓取数据,而不是原样沿用旧数据。