不是套话合集,而是一份可以追溯判断依据的完整审稿报告

同行评审意见范例:完整审稿报告、主要意见与判断方法

以一篇虚构的集群随机试点研究为案例,从第一次阅读、问题分级到给作者的完整报告、给编辑的保密说明和最终建议,演示审稿意见究竟应该怎样落到证据上。

更新于 2026 年 8 月 28 日预计阅读 34 分钟含完整报告、逐条拆解、反例改写与提交前检查表
审稿人将论文问题整理为分级同行评审意见并形成评审结论
本页目录

好的同行评审意见让编辑能判断、让作者能行动

一份有用的同行评审意见,应当说明审稿人如何理解稿件、哪些证据支持或削弱主要结论、问题为什么重要,以及作者可以用什么方式回应。它不是替作者重做研究,也不是只有“建议大修”的评分单。

高质量报告通常同时具备四个特征:评价对象明确、严重程度可解释、修改要求有边界、建议与正文一致。评论越尖锐,越需要指出稿件位置、判断标准和对结论的具体影响。

所有稿件信息、数值和评语均为原创虚构教学案例,不对应任何真实论文、作者或期刊。它展示的是推理结构,不是可直接粘贴到其他稿件的通用批评。

同行评审意见范例的价值在判断过程,不在可复制句子

搜索“审稿意见怎么写”的人,常见困难不是不会使用礼貌措辞,而是不知道怎样从论文内容形成一组有优先级的判断。只有模板,容易得到格式完整但证据空洞的报告。

概念页回答“是什么”

解释角色、流程、匿名模式和编辑决定,不展开具体稿件诊断。

回复信页回答“作者怎么回”

重点是修订动作、证据、定位和版本一致性。

完整范例回答“审稿人怎么写”

展示阅读、定位、分级、措辞、建议和自检的完整链条。

期刊表格决定最终格式

自由文本、结构化问题和评分字段可能不同,实例必须服从真实表单。

案例稿件:宿舍夜间通知静默与学生睡眠的四周试点

虚构稿件摘要:研究在8栋学生宿舍中按宿舍分配“夜间通知静默提醒”或常规使用,共招募240名本科生。作者报告干预组四周后可穿戴设备记录的平均睡眠时间增加,并声称该措施改善了睡眠和课堂专注度。

审查对象稿件提供的信息初步疑问
设计8栋宿舍按宿舍分配,两组各4栋分析是否考虑集群分配与宿舍内相关性
主要结局睡眠时长、睡眠效率、夜间唤醒和专注度均有结果主要结局是否预先指定,如何处理多重比较
缺失240人入组,192人进入主要分析两组脱落是否平衡,排除规则是否在分组后决定
测量睡眠来自设备,专注度来自单项自评“课堂表现改善”的表述是否超过测量范围
实施参与者可以关闭提醒依从性、组间污染和实际暴露如何记录

审稿人的任务不是看到表格后立即选择“大修”,而是判断每个疑问会影响哪一级主张、现有材料能否解决,以及无法解决时结论需要收窄到什么程度。

先用三遍阅读把理解、核验和写作分开

  1. 第一遍只重建论证:研究问题是什么,设计允许回答什么,作者实际声称了什么。先不逐句修改。
  2. 第二遍建立证据地图:把每个主要主张对应到方法、结果、图表、附件和预注册信息,标记断点。
  3. 第三遍才形成评论:合并重复问题,判断严重程度,为每条评论写清影响和可接受的回应路径。

这种顺序能减少“读到哪里批到哪里”的碎片化报告,也能避免前后提出互相矛盾的要求。语言与格式问题可以随读随记,但应在最后集中整理。

一条实质审稿意见应包含位置、发现、后果和请求

组成案例写法缺失后的问题
位置方法2.4与结果表2作者无法快速核对评论对象
发现分配单位是宿舍,模型却把个人视为独立观察只剩主观结论,缺乏可复核依据
后果标准误可能被低估,组间差异的不确定性随之失真作者不知道问题为何属于主要意见
请求使用考虑集群结构的分析,或充分说明不可行并收窄推断评论变成诊断,没有可执行出口

请求应描述必须解决的科学问题,而不是强迫作者使用审稿人偏爱的唯一软件、模型或写法。如果多种方法都能处理同一问题,应允许作者选择并说明理由。

完整同行评审意见范例:给作者的报告

给作者和编辑均可见

稿件概述与总体评价

本研究评估宿舍层面的夜间通知静默提醒是否与本科生四周后的睡眠变化有关。使用可穿戴设备而非完全依赖回忆,是本稿的重要优点;以宿舍为单位实施也贴近真实应用场景。稿件目前最关键的问题在于,分配发生在宿舍层面,但主要分析似乎按个人独立处理;此外,主要结局、缺失数据和干预依从性的报告不足,使睡眠时长差异的稳健性难以判断。专注度仅由单项自评测量,因此“改善课堂表现”的结论也超出了现有证据。以下问题解决后,研究的可解释性会明显提高。

主要意见1|分析单位与随机分配单位不一致

方法2.2说明8栋宿舍被分配至两组,但方法2.4的线性模型和表2置信区间没有说明是否处理宿舍内相关性。若把同一宿舍学生视为完全独立,标准误和区间估计可能过于乐观。请明确随机化与分析层级,报告每栋宿舍的样本量和基线分布,并采用适合有限集群数量的分析或敏感性分析。若数据不足以支持稳定的干预效应估计,请相应降低因果结论的确定性。

主要意见2|主要结局与多重比较策略不清

摘要突出睡眠时长,但正文同时检验睡眠效率、夜间唤醒、入睡时间和专注度,注册信息也未在稿件中标明。读者无法判断睡眠时长是否为预先指定的主要结局,还是从多个结果中事后选择。请说明结局层级及其确定时间,提供注册或方案入口;如无预先指定,应把相关分析标为探索性,并解释多重比较对结果解读的影响。

主要意见3|缺失数据可能改变组间比较

流程图显示240人入组,但主要分析只包含192人;两组分别排除的人数、原因和测量时间点未完整报告。若退出与干预体验或睡眠状况有关,仅分析完整案例可能产生偏差。请按组报告失访与设备数据不足的原因,比较纳入和未纳入分析者的可用基线信息,并说明缺失处理假设。建议补充能够检验主要结论对合理缺失假设是否敏感的分析。

主要意见4|实际接受的干预与组间污染需要量化

参与者可以关闭提醒,同一宿舍内也可能共享设置建议,但稿件只报告分配组别。请说明提醒送达、保留开启或被关闭的记录方式,分别报告两组依从性,并讨论宿舍间交流造成污染的可能性。主要分析仍应尊重原分配原则;依从性分析可以作为补充,但不能替代分配组比较。

主要意见5|“课堂表现改善”超过现有测量支持

研究只使用一个自报专注度条目,没有课堂观察、成绩或经过验证的表现量表。该结果最多支持参与者感知的专注度差异,不能直接证明课堂表现改善。请修改标题、摘要结论和讨论中的相关措辞,准确命名测量变量,并把单项自评的测量限制纳入讨论。

次要意见

  1. 在摘要中报告各组样本数、效应估计与不确定性区间,而不只报告显著性。
  2. 定义“夜间”时间窗,并说明跨越午夜时日期如何归类。
  3. 补充设备有效佩戴日的最低标准,以及不足天数的处理规则。
  4. 表1应以宿舍和个人两个层级呈现关键基线信息,避免只给合并均值。
  5. 图2图例需要说明误差线含义,并给出每个时间点的实际分母。
  6. 讨论部分请把可行性、初步效应和正式有效性检验区分开。

结语:该试点具有实际问题背景和客观睡眠测量优势,但目前的分析层级、结局定义和缺失处理直接影响核心效应估计。建议作者优先解决上述主要问题,再据修订结果调整结论范围。

主要意见不是“工作量大”,而是会改变可信度或决定

案例问题影响的判断为何是主要意见可能的合格回应
忽略集群结构效应不确定性可能改变区间、显著性和结论强度重做适当分析并报告限制
主要结局不清选择性报告风险影响读者理解结果是否为事前假设提供方案依据或标为探索性
差异性缺失组间可比性可能改变效应方向或幅度报告失访并做敏感性分析
措辞超过测量结论有效范围把主观感知写成客观表现准确命名变量并收窄主张

一项分析即使只需几行代码,也可能属于主要问题;一张图即使需要重新绘制数小时,也可能只是次要修正。分级依据是对论文判断的影响,不是作者预计花费的时间。

次要意见要集中处理,不能淹没核心判断

格式、术语、图例、局部报告和文字清晰度问题可以有价值,但逐行罗列几十处轻微问题会把作者的注意力从研究有效性上移开。相同类型的问题应合并成一条规则,并给一两个代表性位置。

适合单独列出

图表分母不清、术语定义缺失、关键数字前后不一致。

适合合并说明

多处缩写未定义、相同单位格式不一致、类似句式反复含糊。

不必代写

不影响含义的个人风格偏好,以及完整段落的审稿人式重写。

可能升级为主要意见

看似局部的问题若遮蔽主要结局或改变数据含义,就不能放在次要清单里。

把模糊批评改写成可核验、可回应的意见

低信息量评论问题建设性改写
统计方法不合适。没有指出模型、标准或后果分配单位为宿舍,但模型未说明集群结构;请解释分析层级并处理宿舍内相关性。
需要增加更多文献。数量要求替代了知识缺口引言讨论了个人自控,却未覆盖环境层面的数字干预;请补充这一研究脉络并说明本研究差异。
结论太强。作者不知道具体哪条主张越界“改善课堂表现”超出单项自评专注度支持;请准确命名结局并收窄标题和摘要措辞。
英文需要全面修改。可能混淆语言与科学评价方法中“依从”同时指设备佩戴和提醒开启,建议分别定义,以免读者误解分析样本。
请做我建议的模型。把解决方案偏好写成唯一要求请采用能反映集群分配的分析并说明选择;若估计受集群数限制,请提供敏感性结果。

给编辑的保密意见用于编辑判断,不是隐藏科学批评

仅编辑可见的示例

本稿关注的问题适合该刊读者,客观睡眠测量也是明显优点。我建议“大修”,因为集群分配未在主要分析中体现、结局层级不清且完整案例分析可能受差异性失访影响。这些问题有可能利用现有数据和更透明的报告进行处理,但有限的集群数量可能仍限制精确推断。若作者无法提供适当的集群分析或稳健性评估,编辑可能需要重新判断稿件是否能支持干预有效性的核心定位。我未发现需要单独启动伦理调查的明确证据。

保密意见不应突然出现给作者报告中没有的致命科学理由。若问题可以由作者解释或修正,就应在作者可见部分提出。真正敏感的身份、利益冲突或疑似不端线索,应中性描述观察事实并交由编辑按程序处理,而不是自行调查或下结论。

审稿建议必须与问题的可修复性和严重程度相匹配

建议类别通常适用情形需要避免
接受核心判断已充分支持,仅剩制作性处理报告仍列出会改变结论的未决问题
小修局部澄清或报告改进,不改变核心分析把重做主要模型包装成小修
大修存在重要问题,但现有数据可能允许验证、重分析或收窄结论暗示完成要求就保证接受
拒稿核心问题不可由本稿材料修复,或与期刊范围明显不符用个人偏好、结果方向或作者身份作依据

本案例选择“大修”,不是因为意见条数多,而是关键问题可能改变效应的不确定性与结论范围,同时看起来仍有机会用现有数据回应。若重新分析显示结论不再成立,作者也需要如实调整,而非维持原叙事。

遇到伦理疑问时,描述迹象并交给编辑处理

审稿人可能发现图像相似、数据不一致、未说明的注册偏差、作者利益关系或隐私风险。报告应区分“稿件中观察到的现象”和“对原因的推测”,避免直接指控欺诈、抄袭或不端。

  • 记录具体页面、图表、数值或文件,而不是评价作者动机。
  • 优先通过编辑和期刊程序提出,不直接联系作者或第三方。
  • 不要为验证怀疑而把保密材料上传到公开查重、图像或AI系统。
  • 若疑问同时影响科学解释,给作者的报告仍应说明需要澄清的内容。

审稿人复审时要核对问题是否解决,而不是寻找原句

原意见:分配发生在宿舍层面,但主要模型没有说明集群结构,可能低估不确定性。

合格回复的核心:作者应说明采用了什么集群方法、模型选择依据、更新后的效应与区间位于哪里,以及这些结果是否改变摘要和结论。若因集群数有限无法稳定估计,也应披露限制并提供合理的敏感性结果。

复审时不要只检查作者是否说“已修改”,也不要要求必须逐字采用原建议。真正的核验对象是科学关切是否被回答、证据是否进入稿件、相关章节是否同步,以及新的分析有没有引入新的问题。

可复用的是报告骨架,不是案例中的结论

  1. 稿件概述:用自己的话写研究问题、设计、主要结果和作者核心主张。
  2. 总体评价:说明价值与优势,并列出最影响判断的两到四个问题。
  3. 主要意见:按重要性排序,每条写清位置、发现、后果和请求。
  4. 次要意见:合并局部报告、术语、图表和文字问题。
  5. 给编辑的说明:概括建议依据,必要时报告敏感程序事项。
  6. 推荐类别:使用期刊选项,并检查它是否与正文严重程度一致。

不同研究设计需要不同标准。随机试验、质性研究、系统综述、方法论文和数据集论文不能用同一套统计问题机械审查。骨架可以复用,评价标准必须来自文章类型、学科规范和目标期刊要求。

把阅读笔记压缩成报告,需要一次去重和一次反向核验

  1. 收集:把疑问连同稿件位置、相关图表和依据记录下来。
  2. 归并:把同一根因造成的多处表现合并,例如多个结论都来自同一分析层级错误。
  3. 分级:判断问题是否会改变有效性、解释、伦理或决定。
  4. 排序:先写最影响主张的问题,再写报告和表达问题。
  5. 反向核验:从建议类别回看报告,确认正文足以解释这个建议。
  6. 语气检查:删除人格评价、讽刺、绝对化推断和不必要的命令。

AI可以改变写作效率,但不能改变审稿人的保密和责任

是否允许使用AI、允许使用到什么程度以及是否需要披露,由目标期刊的当前政策决定。未获明确允许时,不应把未公开稿件、补充数据、编辑通信或其他受限材料上传到外部服务。

即使政策允许语言润色,审稿人仍需核验事实、评价逻辑和引用,不能把建议责任交给系统。AI生成的通用批评尤其容易缺少稿件位置、误判研究设计或提出不存在的数据要求。

评审表格和决定类别最终由目标期刊定义

在准备投稿或评审前,先保存期刊官网的文章类型、评审模式、审稿表字段、数据政策和AI政策入口。工具可以帮助整理候选期刊,但不能替代对当前官方页面的核验。

把期刊匹配与评审政策核验放在同一条准备流程中

使用工具前只需准备研究主题、文章类型和公开摘要级信息。不要上传未公开全文、受限数据或真实审稿材料;匹配结果也不代表期刊一定送审或录用。

提交审稿意见前,用十二个问题做最终检查

  • 开头是否准确概括了研究,而不是只复述标题?
  • 是否至少指出一项真实优点,且没有用赞美稀释关键问题?
  • 每条主要意见是否对应具体位置、证据或缺失信息?
  • 是否说明了问题对有效性、解释或决定的影响?
  • 修改要求是否有边界,并允许合理的替代解决方案?
  • 是否把个人写作偏好误写成期刊或学科规则?
  • 主要与次要意见是否按科学影响而非工作量区分?
  • 是否提出了超出现有研究范围的不必要新项目?
  • 给编辑与给作者的科学判断是否一致?
  • 推荐类别是否能由报告正文直接解释?
  • 是否删除了身份推测、人格评价、讽刺和不端定性?
  • 是否遵守保密、利益冲突、AI和期刊表单要求?

看似严格的报告,也可能因为推理断裂而失去价值

只有结论,没有依据

“方法很差”“创新不足”无法让编辑判断,也无法让作者回应。

要求越来越大

把可回答的论文改造成审稿人理想中的另一项研究。

意见与建议冲突

正文只有小问题,却选择拒稿;或列出致命问题却建议小修。

把分歧写成错误

理论取向或模型选择不同,不等于作者违反方法标准。

用引用服务自己

要求加入与判断无关的审稿人文献,或以引用数量代替知识缺口。

隐藏关键科学意见

只在编辑密语中写致命理由,使作者没有解释和修正机会。

同行评审意见范例常见问题

同行评审意见应该写多长?

没有统一字数。报告应足以说明稿件贡献、关键问题、问题影响和可执行要求,同时避免重复、逐句改写和与决定无关的细节。

主要意见和次要意见如何区分?

主要意见会影响研究有效性、核心解释、伦理合规或编辑决定;次要意见通常不改变核心判断,可以通过局部澄清、格式或报告修正解决。

审稿人是否必须给出接受或拒稿建议?

取决于期刊系统。若系统要求选择建议,应使用期刊提供的类别,并确保建议与报告中问题的严重程度一致;最终决定通常由编辑作出。

给编辑的保密意见可以写什么?

可写不适合直接向作者披露的程序性或敏感事项,例如潜在利益冲突、身份核验疑问或需要编辑处理的伦理线索。重要科学理由仍应在给作者的意见中说明。

可以使用AI帮助撰写审稿意见吗?

必须先遵守目标期刊政策并保护稿件保密性。未经允许,不应把未公开稿件、数据或评审材料上传到外部系统;审稿人始终对报告内容负责。

来源与进一步核验入口