← 返回科研写作工作流
研究者与五个承担不同任务的科研机器人围绕一份论文工作

Research writing · skills · engineering

装了 13 个
科研 Skills,
离一篇好论文
还有多远?

从专业工具到可追溯、可复查、可负责的科研写作流程

Skills 解决“会不会做”;工程化解决“整篇论文能不能一直对得上”。
AI 生成教学插画

01 · 今天带走什么

我们只回答三个问题

QUESTION 01

每个 Skill 真正擅长什么?

按选题、文献、分析、图表、写作和投稿支持来看,不被名字迷惑。

QUESTION 02

为什么“逐个完成”仍可能出错?

因为同一概念、变量和版本,要跨越很多独立任务。

QUESTION 03

工程化究竟多做了什么?

让输入、输出、检查、状态、责任人和恢复方式都能被追踪。

本课不比较“谁最强”,比较的是:每种组织方式能控制哪些风险。

02 · 来源先说清

13 个名字,来自三类能力体系

K-Dense

早期思考、文献综述、统计和可视化等通用科学工作。

scientific-brainstormingliterature-reviewstatistical-analysisscientific-visualization

Nature Skills

社区科研工具。Nature 表示面向相应写作、绘图和审稿语境,不是期刊认证。

nature-academic-searchnature-figurenature-writingnature-polishingnature-reviewernature-responsenature-datanature-paper2ppt

ARS

研究到论文的套件入口,本地适配包含状态、交接和强制核验流程。

academic-research-suite

核查范围:本地安装快照+2026-09-15 上游公开文档。截图本身未提供版本。

03 · 前端能力

找到方向,还要检验这个方向

IDEATE

scientific-brainstorming

独立构思与反方检验
假设、预测、异议和决策日志

点子不是研究发现,也不是伦理批准。

SEARCH

nature-academic-search

多源检索、MeSH 与引文格式
公开数据库与可选服务路由

检索覆盖面受数据库、权限和检索式影响。

SYNTHESIZE

literature-review

记录检索、筛选和质量评价
主题综合与引文核验

摘要级阅读不能冒充全文核查。

证据链至少区分:找到文献 → 文献存在 → 读过全文 → 支持这条论断

04 · 中段能力

算得出,还要解释对、画得诚实

STATISTICS

statistical-analysis

检验选择、假设检查、效应量、功效和规范报告。

不会替作者决定研究问题、变量含义或因果范围。

VISUALIZATION

scientific-visualization

保留原始数据、变换、缺失值、导出信息和可访问性检查。

自动报告不能成为科学正确或期刊合规证书。

FIGURE

nature-figure

图契约、Python/R 路径、统计完整性与图形 QA。

图形 QA 不能证明上游研究设计和数据正确。

数据图由分析结果生成;ChatGPT 生图只用于本课的概念插画。

05 · 表达能力

语言变漂亮以后,论断有没有变大?

作者原意

在当前数据与分析条件下,结果提示两组存在差异。

需要警惕的润色风险

我们的研究证实该方法具有广泛临床价值。
maysuggestsindicatesshowsdemonstrates

nature-writing

论点先行;证据不足时用占位符;维护术语与边界。

nature-polishing

改善英文、结构、翻译和版式;润色后仍要复核事实与论断强度。

06 · 后端能力

审稿、回复、数据声明和汇报:各有工位

REVIEW

nature-reviewer

模拟多重点审查;上游新版要求隔离上下文、互盲并冻结后综合。

模型报告不等于真实专家或编辑决定。

RESPONSE

nature-response

编号意见、逐条回应、定位修改并标记作者缺项。

必须核对声称的修改确实存在。

DATA

nature-data

数据声明、仓库计划、数据集引用与 FAIR 元数据。

声明不等于数据已上传或可复现。

PRESENT

nature-paper2ppt

从论文提炼中文 PPTX、讲稿和展示 QA。

汇报质量不能提升原研究证据。

版本提醒:本地快照与上游 main 可不同;正式使用要记录版本和运行证据。

07 · 先公平承认

ARS 已经不是单个工位,而是一条流水线

研究问题收敛、证据搜集
写作大纲、章节、材料交接
完整性核验引用、数据、论断
评审多轮审查与意见
修订回应、修改、复核
定稿最终核验与交付
已读版本具备 Material Passport、状态跟踪和强制核验;部分约束在 Codex 适配中仍属于提示层或可选运行配置。

08 · 教学模拟

每一站都完成,为什么稿件还是错的?

四个科研工位接力时中心符号逐步改变,最后研究者困惑AI 生成教学插画
定义圆形
分析方形
图表三角形
稿件不规则形

09 · 点击互动 · 教学模拟

一个字段改名,为什么整篇都要重查?

VERSION A
recorded_at
系统写入数据库的时间
VERSION B
observed_at
临床观察实际发生的时间
方法时间零点与纳入窗
分析排序、窗口和特征
图表横轴与分组解释
稿件摘要、结果和局限
名称相似,不代表语义等价。点击后,所有依赖项进入“需要复核”。

10 · 控制跨步骤关系

科研写作工程化:给每个产物一个清楚的接口

证据、分析、图表、论断和稿件像模块一样连接,另有模块尚未连接AI 生成教学插画
输入

来源、数据、研究定义从哪里来?

输出

产生了什么文件、报告或决策?

检查

检查结构、数值、引用还是语义?

状态

待确认、可执行、阻断或已失效?

责任

谁生成、谁审核、谁最终接受?

恢复

中断后依据哪份记录继续?

11 · academic-research-graph-writing v1.1.2

它重点管住了状态、版本与授权

01 / CONTRACT

概念与方法先绑定

研究问题、终点、操作化和边界先形成契约,由作者确认后才能分析与起草。

concept_method → project + version + SHA-256
02 / STATE

一份权威状态

当前状态指向不可变 revision;兼容文件冲突时从权威状态重建。

state-store/current.json → revisions/0000xx.json
03 / ACTION

按动作判断

分析、起草、Graph、综合、审核、接受和外部动作分别判断,不用一个“大暂停”替代。

status --action <exact_action>
04 / INVALIDATE

内容变,批准失效

对象哈希变化后,旧批准和相关下游报告不能自动沿用。

old_hash ≠ current_hash → review required
05 / REVIEW

独立审核再接受

综合稿需要边界和一致性报告,再进入独立审核与作者接受。

draft → audit → reviewer → author
06 / G3

外部动作精确授权

上传、投稿、发布等外部动作绑定具体动作和具体对象,不由“写完了”自动推出。

external action + exact bytes

12 · 点击互动 · 教学模拟

研究定义一变,哪些地方要重新评估?

研究者更换中心定义卡片,周围代码、图表和稿件亮起待复核状态AI 生成教学插画
点击下方模块,模拟查看影响范围。

13 · 教学模拟

生成、检查、接受、投稿是四件事

研究者与审核者核对证据、方法、图表和稿件,远处外发包裹仍封闭AI 生成教学插画
🤖
生成写作、计算、作图
🔎
检查结构、引用、数字、边界
👩‍🔬
作者接受当前版本与科学责任
📤
外部动作投稿、上传、发布的具体授权
前一步完成,不能自动替代后一步。

14 · 公平比较

三种组织方式,解决的是不同层次的问题

比较维度临时串联多个 SkillsAcademic Research SuiteGraph Writing v1.1.2
专业任务覆盖广,可自由组合广,端到端流程依赖已绑定的专业工具
统一状态与恢复取决于操作者记录Material Passport/状态追踪权威指针+不可变 revision
概念/方法批准绑定可人工约定有阶段与检查点项目、版本、哈希、作者、时间
跨产物变更失效需人工排查依赖流程与运行配置当前对象哈希不匹配则失效
独立评审可单独安排多阶段评审设计最终接受前要求有效独立报告
外部动作授权依赖操作者按环境与流程实施具体动作+具体对象

“有机制”不等于“本次已执行”。此表依据所读文档与 v1.1.2 代码观察,不是论文质量或录用率实验。

15 · 透明边界

v1.1.2 也有明确局限

01
结构检查不等于语义正确脚本能发现字段、术语和版本漂移,不能证明学科定义或因果推断正确。
02
独立上下文不等于独立专家隔离可减少相互影响,仍不能保证专业资质或消除共同模型偏差。
03
治理带来维护成本契约、状态、版本、审核和作者确认都需要真实时间。
04
不能补救上游证据不足流程再完整,也不能把弱数据变成强结论,更不能保证录用。
工程化提高的是
可追溯性与可控性
不是把科学判断外包。
doctor 返回 READY:只证明环境与结构检查通过。

16 · 最小够用

不要按名字选工具,按任务风险选组织方式

🧰

单步任务

查一条文献、润色一段文字、检查一张图、整理一次回复。

一个专业 Skill+人工核对
🧭

多阶段研究

从问题、证据到完整论文,需要持续状态、交接和核验。

ARS 等流水线+阶段检查点
🏗️

高风险长链条

多人、多版本、多产物,且存在投稿、上传或敏感数据边界。

专业 Skills+工程化治理层
项目约束写在项目契约里:终点、外推边界、数据权限和目标期刊;不为单个项目改坏全局 Skill。

18 · 一篇论文的完成条件

“写完”之外,还要回答五个问题

📚证据来源可核查
🧪方法与问题匹配
📊结果可重复计算
🧾论断不越过边界
👩‍🔬责任作者接受当前版本

Skills 提供专业能力;
工程化让能力之间对得上。

能追溯

论断回到证据,结果回到数据与代码。

能复查

知道检查了什么,也知道什么仍需专家判断。

能负责

作者接受与外部动作授权清楚分开。

可投 ≠ 已投稿;已投稿 ≠ 已录用。现在,欢迎提问。

CURRENT

NEXT · 00:00

SPEAKER SCRIPT