Skip to content

评审与修订:打分、意见与按意见改稿 ​

论文写完后,报告页右侧「评审」tab 会出现一份带分数的评审。很多人第一反应是「6 分是不是不合格」,第二反应是「这些意见能不能让它自己改」。两件事都有明确答案:分数是 1–10 的同行评审口径,意见可以勾选后让写作助手一次修订成一个新版本。

评审从哪来 ​

评审是一次独立的模型调用,不是写作时顺手打的分。输入是整篇正文、章节 key 列表、指标表([D n] 对应的值),以及门禁已经标出的待核实句;输出四维分和 3–8 条意见:

维度(界面名)含义
严谨性 soundness方法与结果本身站不站得住
呈现 presentation结构、术语、图文对应
贡献 contribution新意与价值
总体 overall综合

评审身份按体裁变:研究报告用「报告审阅专家」,综述用「综述类期刊审稿人」,其它是「一般 SCI 期刊审稿人」。意见语言跟论文语言走。

每条意见带三样:锚点(具体到章节 key,如 methods;模型只写「第 2 节」就归一成 §2)、严重度(major = 影响结论或方法正确性,minor = 表述或完整性,nit = 措辞格式)、状态(待处理 / 已纳入 / 已忽略)。另附两张固定条目的检查表:呈现(结构完整 / 术语一致 / 图表与文字对应)与幻觉(每个数字有 [D n] / 引用都在表内 / 没有超出证据的结论)。

两条硬规则决定了评审不会重复扣分:

  • 数字核对以指标表为准。正文数字与它挂的 [D n] 值一致就算有支撑,评审不会自己重排 D 号。
  • 门禁已标的待核实句是已知项,只进幻觉检查表,不再当新意见。

模型不可用或调用失败时退回规则评审:严谨性随待核实句占比线性下降(占比 ≥ 25% 到底 1 分),呈现每个空节扣 2 分,贡献固定 5 分——并明确写「未配置模型,只做了规则检查」。

什么时候会自动评审 ​

成文结束后系统自动评审一次(研究记录里 actor 是 system:auto)。专业档且论文体裁(非研究报告)下,总体分 < 6 会自动修订一轮:按意见数最多的 ≤ 2 节重写(总体 ≤ 5 时 3 节,呈现 ≤ 4 再加 1 节);若严谨性是三维里最低且 < 6,Results / Methods 强制排最前,并附「只按分析作业规格描述变量与方法,不许加规格外的协变量 / 稳健性检验」的约束。自动修订只一轮、覆盖当前版本、不建新版本,之后不会再循环。

免费档、研究报告体裁、或本版已修订过的,都不自动修订。

想重评就点「重新评审」:同一任务已在评审中会返回同一个作业,不会跑两份;前端每 3 秒轮询一次,最长 2 分钟。评审通常 5 分钟内出,不阻塞阅读。

逐条处理意见 ​

意见卡上能做的事:

  • 定位到该节:跳到正文对应章节。
  • 忽略:填一句原因(可空,≤ 500 字),意见移到「已忽略」页签,可随时恢复为待处理。
  • 给 AI 的补充(可选):勾选意见后展开,例如「用作业 #4 的 bootstrap CI」,会随这条意见一起交给写作助手。
  • 仅改这一节:只重生成这条意见锚定的章节,单出一版(走「重新生成本节」的路径,意见状态不变)。

「已纳入」不能手动设——只有修订成功真正改到了那一节,意见才会标已纳入并记下版本号。已纳入的意见不能再改状态。

右栏「评审」:顶部四维分数条(严谨性 / 呈现 / 贡献 / 总体),中间按待处理 / 已纳入 / 已忽略筛选和「勾选意见后一次修订」按钮,下方每条意见带定位到该节、仅改这一节、忽略

评审栏从上到下:分数、按状态筛选、一次修订按钮、逐条意见;已忽略的意见折叠在最底下,随时能恢复。

按所选意见一次修订 ​

勾选若干条待处理意见(「全选待处理」可一把选完),点「按所选 N 条意见一次修订」。系统按锚点把意见分组:

  1. 锚到现存章节的,按节分组;未锚定(§n)、锚到参考文献、或锚的节已不存在的,当总体意见。
  2. 最多改 4 节(按意见出现顺序取前 4 个节)。只有总体意见时落到讨论节;一条都锚不到 → 422「所选意见没有锚定到论文的任何一节」。
  3. 每节调用一次模型改写,然后跑与成文相同的确定性收尾:图表块归位、D 记号校正、图号重排、三道门禁重算。
  4. 只建一个新版本(版本类型「修订」),备注「按 N 条评审意见修订 M 节」;版本上记着基于哪些意见、每节句级增删数与新增记号。

单节改写失败不拖累其它节:那一节保留评审前的文本并挂一条降级说明;全部节都失败才报「所选意见对应的节都没有修订成功」。同一任务同时只允许一个修订在跑,再点会提示上一次还在进行。修订约 3–8 分钟,消耗 1 次研究额度。

修订出的新版本还没有评审——评审 tab 会标「评审基于 vN · 当前 vM」,意见仍属于上一个有评审的版本,可以继续挑剩下的意见再修订,也可以对新版重新评审。

修订在现稿上改,不缩篇幅 ​

09-30 起修订不再「按大纲重写整节」,而是把本节现稿(图表块、表格行剥掉,已展开的数字还原成占位符)交给模型在现稿上改:只改评审指出的问题,保留其余论述与全部 [L n] 引用和占位符,可以补论证,不许删减实质内容,也不许新增证据里没有的数字或引用。

篇幅有硬约束:下限 = 现稿的 95%,上限放宽到 120%。改出来比现稿短 10% 以上会要求重写一次;两次都明显偏短就退回现稿,本节标「修订稿比现稿短 x%,保留修订前的本节」。所以你不会看到修订把一节改薄。

对比两版 ​

版本时间线每一版都有「对比 vA → vB」,打开对比抽屉:按节分组的句级 diff,三种视图(并排 / 行内 / 只看改动),头部写明改了几节、+x −y 句、由哪几条评审意见驱动。界面只对相邻两版开放对比;接口层允许跨度 ≤ 3。

对比完不满意,「回滚到此」= 以那一版为底新建一版,历史不删。

坑 ​

  • 评审分数不是质量证书。它是一次模型调用的判断;规则评审(method=rules)的分更只反映门禁结果。
  • 意见锚到「参考文献」的不会被修订(参考文献不重写),只能自己处理。
  • 修订用户篇幅系数与成文一致:在确认页设的目标字数会一起作用于重写节的长度区间。
  • 「仅改这一节」和「按所选意见修订」都会生成新版本;连点几次就有好几版,先看时间线再决定。

相关 ​