SCI论文数据共享与开放科学趋势:投稿署名新规范
在科通编译十余年累计服务5万+篇SCI/SSCI/EI论文的润色与投稿咨询实践中,我们注意到一个明显趋势:从2024年起,几乎所有主流SCI期刊都开始强制要求作者披露数据共享方式、署名贡献、生成式AI使用情况。这些新规不再是"建议性"的,而是直接体现在投稿系统的必填项里——作者如果未按要求填写,稿件甚至无法完成 Submission。
这一变化的背景是 FAIR 数据原则(Findable, Accessible, Interoperable, Reusable) 与开放科学运动(Open Science)的全球推进。从欧盟、美国到中国的国家科学基金(NSFC)在2025年陆续发布开放科学行动计划,要求受资助论文的数据可访问、可重用、可标注。
对一线科研作者来说,这意味着 投稿策略需要系统性调整——不仅是"语言"或"格式"的层面,而是关乎"你的研究是否在流程上合规、数据是否可重现、署名是否经得起质询、是否使用 AI 而未声明"。
本文系统解读5个最关键的新规——Data Availability Statement、Preprint 投稿、CRediT 署名分类、生成式 AI 披露、ORCID 强制要求——并提供5个投稿实操调整建议。文末附FAQ与署名争议避险指南,帮助你在新规环境下顺利完成投稿。
本系列更多文章见科通编译学术知识库,覆盖导师关系、合作者署名、读博规划、青年教师策略、转型经验等学术成长全流程。
一、为什么"开放科学"从趋势变成了强制规范
要理解这一轮投稿规则变化的力度,需要先理解它的推动力。
国际层面:2016 年起,多个机构(包括欧盟 H2020 / Horizon Europe、NIH、Nature 系期刊、PLOS 系期刊等)陆续出台"数据共享 + 预印本 + ORCID"的政策包。截至2026年8月,PLOS、Nature、Science、Cell、eLife、等国际主流出版集团已全部上线相关强制项。
中国层面:国家自然科学基金委(NSFC)在2024年发布《开放科学实施指南》,要求所有受 NSFC 资助的论文需要做出"数据可用性声明"。中国科学院 2025 年发布《关于推进开放科学工作的指导意见》。
驱动逻辑:
- 研究可重复性危机——近年大量顶刊论文因数据不可重现被撤稿(reproducibility crisis)。新规是出版界对危机的回应。
- AI 生成内容识别需要——2023 年起 ChatGPT 等大模型爆发后,期刊必须明确"AI 是否参与写作"的边界。
- 学术贡献透明化——CRediT 署名让"谁做了什么"变得可追溯,减少署名争议。
- 基金监管需要——资助方需要确保研究成果可被其他纳税人资助的研究者复用。
这些变化,对国内作者最直接的影响是:投稿时必须填写更多必填项,未填写会被系统拦截。下面逐项拆解。
二、5个新规详解与投稿实操
2.1 Data Availability Statement(数据可用性声明)
新规现状:几乎所有SCI/SSCI/EI期刊现在都要求作者在稿件中明确给出"Data Availability Statement",并在投稿系统勾选或填写。
典型表述(选其一):
| 选项 | 适用情况 | 标准表述 |
|---|---|---|
| 数据全部公开 | 数据已上传公共数据库(如 GenBank、PDB、Zenodo、Figshare) | "All data generated or analyzed during this study are included in this article and its supplementary files. The raw sequencing data are available in the [Database Name] repository, [Accession Number]." |
| 部分公开 | 部分数据因伦理/隐私不能公开 | "The datasets generated and analyzed during the current study are available from the corresponding author on reasonable request. Raw data are not publicly available due to [reason]." |
| 不适用 | 研究未产生新数据(如综述/meta-analysis) | "Data sharing is not applicable to this article as no datasets were generated or analyzed during the current study." |
| 自有数据 | 数据尚未上传 | "The data that support the findings of this study are available from the corresponding author upon reasonable request." |
投稿实操建议:
- 投稿前就确定数据共享策略。如果数据可以公开,尽快上传到 Zenodo / Figshare / 学科专用数据库(如医学:GenBank / ClinicalTrials.gov;材料:Cambridge Structural Database),获得 DOI 编号;投稿时在声明里引用 DOI。
- 如果数据因隐私/伦理不能公开,准备一份"reason"说明——典型原因:受试者隐私保护、商业敏感、合作机构数据使用限制、未脱敏的临床数据。明确写在 Statement 里,避免被审稿人质疑。
- Meta-analysis / Review 类稿件:仍需要 Data Availability Statement,可填"Data sharing is not applicable as no new data were generated"。
- 预注册研究(如临床试验):补注 ClinicalTrials.gov 注册号;预注册分析方案可放 Supplementary Materials。
2.2 Preprint(预印本)投稿与"先发表后评审"模式
新规现状:主流 SCI 期刊现在几乎全部明确接受"曾以预印本形式发布"的稿件(除非期刊政策明确禁止)。预印本平台如 bioRxiv、medRxiv、arXiv、SSRN、Research Square、ChinaXiv 在投稿前预先发布已成常态。
预印本投稿流程:
- 稿件准备完成后,先上传到 preprint 平台(需符合"未在其他期刊发表"的承诺)。
- preprint 平台会做基本的语言 / 学术伦理筛查(不算同行评审)。
- 分配 DOI,1-3 天内发布。
- 在投稿 SCI 期刊时,在 Cover Letter 或投稿系统注明"this manuscript has been posted on [bioRxiv/medRxiv] as [DOI]"。
- 期刊评审通过后,正式发表时注明"this is the peer-reviewed version of a manuscript posted on [preprint server]".
投稿实操建议:
| 场景 | 建议 |
|---|---|
| 顶刊投稿前 | 先发 preprint,可获得早期反馈,部分顶刊会"反向发现"preprint 上的爆款论文主动约稿 |
| 临床试验 | 多家期刊明确要求先在 ClinicalTrials.gov 注册才能讨论试验结果 |
| 时间敏感研究 | 优先发 preprint 锁定首发权,再正式投稿 |
| 不确定能否发表 | 先发 preprint 试水,看学术社区反馈 |
| 强保密数据 | 不建议发 preprint,避免数据泄露 |
注意点:preprint 与"已发表的论文"在投稿系统中是不同状态——大多数期刊对 preprint 是"明确接受",对已发表论文是"明确不接受"。投稿前确认期刊 preprint policy。
2.3 CRediT 署名分类(Contributor Roles Taxonomy)
新规现状:CRediT 是 NISO(美国国家信息标准组织)发布的14类署名贡献分类系统,从2020年开始被多家期刊(Cell、PLOS等)作为强制要求引入。
14类 CRediT 贡献:
| 贡献类型 | 英文 | 说明 |
|---|---|---|
| 1 | Conceptualization | 思路提出 |
| 2 | Data curation | 数据整理 |
| 3 | Formal analysis | 形式分析 |
| 4 | Funding acquisition | 经费获取 |
| 5 | Investigation | 调查研究 |
| 6 | Methodology | 方法学 |
| 7 | Project administration | 项目管理 |
| 8 | Resources | 资源提供 |
| 9 | Software | 软件开发 |
| 10 | Supervision | 指导 |
| 11 | Validation | 验证 |
| 12 | Visualization | 可视化 |
| 13 | Writing – original draft | 初稿撰写 |
| 14 | Writing – review & editing | 审阅与编辑 |
投稿实操建议:
- 投稿前就讨论署名贡献。14 类贡献在投稿前由所有作者共同确认,避免署名争议。
- 每个作者至少 1 个贡献。纯"挂名"作者(没有实际贡献)逐渐被审稿人和编辑质疑。
- 通讯作者 vs 第一作者 vs 共同一作 vs 末位作者的分工需要明确——特别是 CRediT 中"Supervision""Funding acquisition""Resources"主要应由 PI/导师承担。
- Cover Letter 中对署名顺序的合理性给出说明(特别是共同一作 / 末位通讯的情况)。
2.4 生成式 AI 使用披露
新规现状:从 2023 年起,Nature、Science、IEEE、ACS等国际主流出版集团主流出版集团全部出台 AI 使用政策,明确要求:
- 大语言模型(如 ChatGPT / Claude / Gemini)不能作为作者署名(因为 AI 不能承担责任)。
- 如果使用了 AI 辅助写作 / 数据分析 / 图表生成 / 文献检索,必须在 Methods 或 Acknowledgements 中明确披露。
- 学术图片(如 Western blot、电镜图、影像图)若使用 AI 增强 / 处理,必须披露并保留原始版本。
投稿实操建议:
- 在投稿系统的"AI Disclosure"必填项里如实申报。隐瞒 AI 使用一旦被发现,期刊会直接拒稿或撤稿。
- 披露范围:写作润色(AI 改语法建议)、文献检索(AI 推荐)、数据分析(AI 生成代码)、图表生成(AI 辅助)。
- 不承担责任的AI使用(如仅查重 / 推荐参考文献)通常无需特别披露,但建议在 Cover Letter 注明使用的工具。
- 图片真实性检查:投稿前用图片完整性检测工具(如 ImageTwin / Proofig / 期刊推荐工具)排查"AI 生成 / 增强"的痕迹,避免被"image integrity"问题拒稿。
典型披露模板:
"During the preparation of this work the author(s) used [Tool Name] in order to [reason: language polishing / reference formatting / data visualization]. After using this tool, the author(s) reviewed and edited the content as needed and take(s) full responsibility for the content of the publication."
2.5 ORCID 强制要求
新规现状:ORCID(Open Researcher and Contributor ID)已是主流期刊的强制/推荐项。从投稿系统视角看,未绑定 ORCID 的作者无法完成投稿。
投稿实操建议:
- 所有作者在投稿前注册 ORCID(免费,orcid.org)。
- 在投稿系统中链接每位作者 ORCID。这能让期刊自动验证作者身份和发表记录。
- ORCID 信息保持更新:包括单位变动、研究兴趣、新发表论文。期刊投稿系统会从 ORCID 自动抓取。
三、5个新规环境下的投稿策略调整
调整1:投稿准备从"语言+格式"扩展为"语言+格式+数据+署名+AI+ORCID"的6维准备清单
| 维度 | 必要动作 |
|---|---|
| 语言 | 母语润色 / 学术英语审校 |
| 格式 | 按期刊 Output Style 调整参考文献 / 排版 |
| 数据 | Data Availability Statement 撰写 + 数据上传 |
| 署名 | CRediT 贡献分类 + 通讯作者位置说明 |
| AI | AI 使用披露 |
| ORCID | 所有作者 ORCID 注册与绑定 |
调整2:投稿前增加"预发布"步骤
对时间敏感型研究,建议先上传 preprint(bioRxiv / SSRN / ChinaXiv)锁定首发权,再正式投稿。这样即使期刊审稿延迟,研究成果也能被学界看到。
调整3:合作者协议前置
CRediT 14类贡献要求所有作者在投稿前就贡献分类达成共识。不要等到期刊投稿时再讨论贡献顺序——合作者协议应在研究启动阶段就明确。
调整4:建立论文级"审稿问答预案"
针对 AI 使用、数据共享、署名分类等新规问题,准备一份"FAQ 答辩材料"——准备好回答"为何选择该数据共享方式""为何使用 AI 仅用于语言润色""第一作者与通讯作者分工的合理性"等问题。审稿人在新规环境下越来越关注这些"管理层面"的细节。
调整5:对数据不能共享的研究,提前撰写"受限原因说明"
如果你因为 IRB 伦理、商业保密、受试者隐私等原因不能公开数据,提前准备一份 200-300 字的"reason statement",贴在 Data Availability Statement 中。常见理由示例:
- 受试者隐私保护(patient privacy concerns)
- 商业合作方数据保密协议(confidentiality agreement with commercial partner)
- 伦理委员会限制(IRB restrictions on data sharing)
- 未脱敏的临床数据,公开前需进一步脱敏(de-identification pending)
四、5个高频问题答疑
Q1:数据共享会不会被人"抢先发表"或"滥用"?
A:数据共享 ≠ 数据无控制使用。在 Zenodo / Figshare 等平台发布时,可设置 Creative Commons 许可证(如 CC-BY-NC、CC-BY-NC-ND),明确使用范围。CC-BY-NC 意味着他人可使用但不得商业化,CC-BY-NC-ND 进一步禁止衍生品。对临床数据可设置访问申请制(request access)。
Q2:CRediT 类别可以"加码"吗?比如所有类别都选上?
A:不可以。每个作者的 CRediT 贡献必须真实反映其实际工作。如果一个作者被列出 14 个贡献但只做了其中 2 个,被期刊或第三方质疑时会面临署名撤除的风险。建议诚实填写,仅选实际贡献的类别。
Q3:使用 ChatGPT 翻译/润色论文是否合规?
A:纯语言层面的 AI 辅助使用(如改语法、换更学术的表达)在大多数期刊政策中是允许的,但必须披露。如果用 AI 生成研究思路、解释实验结果、撰写 Discussion 段落,则会触碰期刊政策红线。科通编译的母语润色服务采用"母语编辑+AI辅助双线"模式——母语编辑全权负责学术判断,AI 仅用于拼写/语法初筛,并在投稿时如实披露。
Q4:发布 preprint 后是否影响后续期刊投稿?
A:大多数主流 SCI 期刊明确接受"曾以 preprint 发布"的稿件。投稿时需在 Cover Letter 或投稿系统注明 preprint DOI。少数期刊(如部分 Cell 系子刊)有特殊政策,需要在投稿前确认。
Q5:未注册的 ORCID 能否投稿?
A:部分期刊要求 ORCID 强制绑定,未注册 ORCID 无法完成投稿。建议每个研究者(特别是早期研究生)都注册并使用——ORCID 是国际学术身份证,对未来求职、申请项目、奖金申报都有用。
五、署名争议避险指南
新规环境下,署名争议的风险点从"挂名"扩展为"贡献透明度不足"。"挂名"是指没有实际贡献却出现在作者列表中;"贡献透明度不足"是指有贡献但未在 CRediT 中体现,或贡献分类与实际不符。
预防策略:
- 研究启动前就签署"合作者协议":明确每位参与者的贡献方向、署名顺序、共同一作情况、知识产权归属。协议应在 IRB 申请之前签署。
- 每次主要贡献变更时更新协议:例如某成员中途退出、某成员贡献扩大、需要加作者等情况下,重新签字确认。
- 投稿前召开署名沟通会议:所有作者在投稿前对作者列表、署名顺序、CRediT 贡献分类做最终确认。建议用邮件确认,避免事后纠纷。
- 通讯作者与第一作者的分工明确:通讯作者负责"投稿全流程沟通",第一作者负责"研究执行";共同一作需明确排序规则(贡献均等或字母序)。
- 避免"礼节性署名":未实际做出可识别贡献的人不建议列为作者,即使其是 PI 或资深教授。CRediT 制度下,"挂名"会越来越容易被审稿人或第三方识破。
纠纷处理:
- 内部协商未果 → 寻求学院/研究所学术伦理委员会调解
- 投稿前已有争议 → 暂缓投稿,先解决署名问题
- 已投稿后发现争议 → 主动联系期刊编辑撤换作者,期刊通常允许投稿前更换作者,录用后更换作者需全体签字声明
六、写在最后
开放科学新规看似增加了投稿工作量,但从长期看,它对认真做研究的作者是利好——更透明的署名规则让"靠挂名走捷径"的做法越来越难;更清晰的数据共享让研究的影响力扩展;更严格的 AI 披露规范让真正的研究贡献得到保护。
科通编译的投稿咨询与投稿指导服务也对应做了调整——我们的投稿咨询老师具备 CRediT 署名分类指导、Data Availability Statement 撰写协助、AI 使用披露模板、Preprint 投稿策略辅导等能力。如果你对开放科学新规下的投稿策略有疑问,或需要从选刊、署名、数据准备、AI 披露到 Cover Letter 的全流程支持,发送论文摘要至 55017753@qq.com,我们的投稿专家会为你做一次免费的稿件层级评估。
本系列更多文章见科通编译学术知识库,欢迎查阅学术经验系列其他文章(导师关系、合作者署名、读博规划、青年教师策略、转型经验、返修策略、时间管理、发表路线图等)。
📧 业务邮箱:55017753@qq.com
📱 微信:扫描添加客服微信咨询
🌐 学术服务官网:kotoon.com