Skip to content

【外滩大会2026】ScholarForge OS|研语工坊:科研事实安全审校工作台 #52

Description

@liqinglq666

参赛项目名称

ScholarForge OS|研语工坊
科研事实安全审校工作台

普通 AI 帮助修改论文,ScholarForge 负责阻止 AI 改错论文。
模型提出候选 · 代码独立核验 · 作者最终决定

团队 / 作者

个人开发者:liqinglq666
GitHub:@liqinglq666

我做了什么

我使用阿里云百炼 qwen-plus 构建了一套面向研究生、科研人员和学术编辑的科研写作审校系统,用来解决一个常被忽略的问题:

大模型在翻译、润色和重写论文时,可能悄悄改变数值、单位、引用、实验声明、因果关系、结论强度或研究范围。

ScholarForge 没有把模型输出直接覆盖到论文,而是在 AI 候选稿与作者工作稿之间加入独立的 ScholarForge Safety Gate|科研事实安全门

  1. 模型只提出候选:生成候选稿、问题位置、证据和修改理由,无权覆盖作者文本;
  2. 代码独立核验:检查数值、单位、引用、术语、实验声明、因果、确定性与研究范围;
  3. 作者逐条决定:接受、拒绝或暂缓建议,只有满足唯一文本锚点、不跨段落、无重叠且不改变科研事实等条件时,才允许安全应用;
  4. 高风险结果自动隔离:硬规则失败时进入 quarantined 状态,保留原文、展示阻断证据并关闭自动应用;
  5. 全流程可恢复:支持撤销、重做、历史记录、版本比较、JSON 备份以及 TXT、Markdown、清洁 DOCX 导出。

系统目前支持三类核心任务:

  • 科研中译英:保护数值、单位、术语、引用和证据强度;
  • 英文保守润色:改善语法、句法、连贯性和学术表达,但不新增事实或升级结论;
  • 投稿前检查:识别语言、报告规范、逻辑和证据边界风险,不预测录用,也不替代同行评议。

此外还实现了:

  • 粘贴文本与浏览器端 DOCX 正文提取;
  • 公开合成示例、我的文本、DOCX 导入三种明确来源模式;
  • 多论文项目、多章节、目标期刊与术语规则;
  • 跨章节数值、样本量和术语一致性检查;
  • 导师意见拆分、回复记录与版本比较;
  • 请求大小、会话/IP 限流、并发、超时和每日预算熔断;
  • 模型未配置时明确返回 503,不会生成伪造的演示结果。

使用的工具

  • OpenWork / 百炼 CLI:项目运行时未依赖 OpenWork 或 CLI,服务端直接调用百炼 DashScope OpenAI 兼容接口
  • 百炼能力 / 模型:阿里云百炼 DashScope,默认模型 qwen-plus,支持通过环境变量切换兼容模型
  • Skill 名称:自研 ScholarForge Safety Gate 结构化审校工作流与确定性规则引擎(项目内能力,非官方独立 Skill 包)
  • 其他:Next.js 16、React 19、TypeScript strict、Mammoth、docx、Vitest、Playwright、Vercel,可选 Supabase 偏好同步

效果展示

1. 科研事实安全审校工作流

ScholarForge OS 科研事实安全审校工作流

2. 任务配置工作台全览

正式线上版本的快速审校工作台。左侧为论文正文、来源状态和同主题公开示例,右侧集中设置任务类型、章节、目标期刊、术语规则和分析状态。

ScholarForge OS 任务配置工作台全览

3. 三种任务联动与正文来源保护

切换到“科研中译英”后,公开示例的正文、任务名称、期刊和术语规则同步更新;用户一旦编辑正文或设置,系统会进入“我的文本”模式,之后切换任务不会覆盖作者内容。

ScholarForge OS 科研中译英任务联动

4. 分析前确认

在调用模型前,系统明确展示字符数、任务类型、正文来源和章节,并再次提醒作者核对事实、数值、单位、方法、引用和结论强度。只有用户主动确认后才会发送分析请求。

ScholarForge OS 分析前确认弹窗

5. Safety Gate 与问题中心

审校结果页同时展示代码独立执行的数值与单位、术语与引用、因果/结论强度/研究范围检查,以及逐条问题证据。作者可以接受、拒绝或暂缓建议;不满足安全应用条件的修改只能保留为人工建议。

ScholarForge OS Safety Gate 与问题中心

6. 作者确认后的交付文件

完成逐条核对后,可导出作者工作稿 TXT、审校报告 Markdown,以及重新生成的清洁 DOCX;原始 DOCX 不会被原地覆盖。

ScholarForge OS 导出交付文件

上述工作台图片均由 Playwright Chromium 从当前正式线上版本截取。为避免泄露真实论文内容,截图使用公开合成的水泥基材料科研案例;Safety Gate 结果页使用确定性的结构化审校响应,仅用于稳定展示真实产品界面与交互,不包含任何用户论文或隐私数据。

推荐评审路径

  1. 打开在线快速体验;
  2. 载入一个公开合成科研案例;
  3. 切换“科研中译英 / 英文保守润色 / 投稿前检查”,观察正文与任务设置联动;
  4. 确认本次发送的正文来源、字符数、任务和章节;
  5. 运行真实百炼模型分析;
  6. 查看 Safety Gate 的逐项检查与阻断证据;
  7. 对每条建议选择接受、拒绝或暂缓;
  8. 只应用代码允许的局部修改,并体验撤销、重做和导出。

当前工程质量门包括:生产依赖审计、ESLint、75 项单元/API/组件测试、TypeScript、Next.js 生产构建,以及 30 项桌面端与移动端 Playwright E2E。

项目链接

踩坑记录(可选)

1. 不能相信模型自己声明“修改安全”

早期只依赖模型输出风险等级,但模型可能遗漏数字变化,也可能声称候选稿安全。最终把权限拆开:模型负责提出候选,代码重新计算硬规则,作者负责最终决定。

2. 结构化模型输出会漂移或截断

模型可能返回非 JSON、字段缺失、重复问题、截断内容或空结果。现在服务端会验证响应结构、结束原因、必填字段和重复项;异常时返回明确错误,不把不完整结果包装成成功。

3. “接受建议”不等于可以直接替换

同一句话可能在论文中出现多次,正文也可能已被作者修改。安全应用必须重新验证唯一锚点、段落边界、事实一致性、修改重叠和当前工作稿状态,否则只保留为人工建议。

4. 隐私与演示体验需要同时成立

DOCX 原始二进制文件不上传,正文只在用户确认分析后发送;公开示例只填入浏览器草稿,不会自动调用模型。未配置 API Key 时明确禁用分析,不用假数据伪装产品可用。

Safety Gate 通过只代表候选稿通过当前自动规则,不代表科学、统计、引用或伦理内容已经被验证。最终论文责任始终属于作者。

Metadata

Metadata

Assignees

No one assigned

    Labels

    showcase提交的案例(待处理)外滩大会2026外滩大会 2026 参赛作品

    Type

    No type

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions