报告封存目录该放云盘还是工作区,阿里云上的三点取舍

简介: 本文介绍dsh-research-report在ECS上的报告封存最佳实践:采用独立ESSD云盘存储(/data)、配置绝对路径避免多工作区冲突、后台组装+周期性SARIF校验门禁,确保报告字节级可验证、长期可重算、交付可信。

把可验证报告引擎搬上 ECS 之后,最先要回答的不是性能,而是「封存出来的东西放哪、怎么活下来」。dsh-research-report 会把每份报告封成 <reportRoot>/<slug(topic)>/<YYYYMMDD-HHmmss>/,连同 report.md、manifest.json、verification.jsonl、disconfirmation.jsonl 一起长期留存——这些不是缓存,是交付物。下面三个取舍,正是围绕「放哪」展开的。安全扫描口径为「🔵 含敏感能力,尚无人工评估」,能力与风险要分开看。

取舍一 · 独立云盘 vs 工作区相对目录

默认 reportRoot 是 research-reports,相对路径按 harness 工作目录解析,报告和工作区绑在一起。单机随手跑,这样最省事;但报告只要要长期留档、要交付、要能事后重算哈希,就不该继续挂在工作区里。

倾向独立云盘:把 <ledgerRoot> 与 <reportRoot> 都指到 ESSD 数据盘(例如 /data):

好处有两个:工作区可以随便重建、重装、换目录,封存物不受牵连;备份边界清晰,给数据盘配自动快照策略就覆盖了。但云盘不是免死金牌——封存会拦下判定漂移、绑定证据被篡改或缺失、日志序列化失败这三类问题,没有可调开关;快照救的是误删和磁盘损坏,救不了「证据本身对不上」。

取舍二 · 单工作区相对路径 vs 多工作区绝对根目录

ledgerRoot / reportRoot 在挂载时按 harness 工作目录解析,这是默认行为,也是最容易被忽视的边界:多工作区部署必须为每个 profile 配绝对根目录,否则换个工作目录就「找不到账本」。

阿里云上的现实是,一台 ECS 常同时跑多个 profile、多个业务目录。此时:

  • 每个 profile 单独配绝对路径,绝不用默认相对值;
  • 目录权限按运行账号划分——root 跑和普通账号跑会看到完全不同的「工作区」,账本自然对不上;
  • 若还要多 workspace 出网,仍走 NAT 网关或弹性公网 IP,安全组出方向别漏。

一句话:相对路径省事,绝对路径省心;当交付物要求「别人能重算哈希」,省心优先。

取舍三 · 前台同步组装 vs 后台组装加周期门禁

报告组装可以前台同步做完,也可以走 ctx.jobs 后台跑。规模一大,前台同步就会把会话堵在等哈希上。

工程化的做法:用 background: true 经 ctx.jobs 返回 { kind: 'background', jobId },把组装挪到后台;封存之后,再用确定性的 verifySealedReport 兜底(零网络、零模型)重算封存哈希与审计哈希,把机器检查写进 verifier-note.md。在 ECS 上把它挂进周期性任务最划算:

dsh-research-verify 是独立命令行(打包为 lib/cli.js,零 @deepseek-ai 导入),不挂载插件也能审计一个封存目录;加 --seal <sha256> 拿期望封存哈希比对,--format sarif 输出 SARIF 2.1.0。任一执行到的检查失败即非零退出,正好当交付前门禁。注意默认 profile 只挂 search、没有 fetch 提供方,URL 抓取会大声失败(WEB_UNAVAILABLE / WEB_PROVIDER_UNAVAILABLE),后台任务同样依赖出网与 fetch 提供方。

三个会咬人的边界要提前知道:

  • 字节级,不是语义级。 内置检查只逐字定位数字和引文片段;没有可核对字面量的转述式主张会验成 unverified,真实主张若数字缺失、标签却以不同值出现,会读成 contradicted。
  • 会话事件是自适应的。 插件声明了 research-report/* 会话事件,但宿主不认识这些类型时追加不生效;账本日志才是永久的事实来源,会话镜像只是增强。
  • 负知识会咬人。 被推翻的主张按内容哈希记住,同样文本在证据未变时再次上报会被强制打回 disproven,证据变了才重新核验;会话锚定证据则永远核验为 unverified,需要人工对照会话日志。

想横向对照同类插件的中文清单,见 DeepSeek Harness Hub 插件清单。

总结

封存目录放独立云盘、根目录配绝对路径、组装与校验放后台并挂周期性门禁——这三条合起来,才是「报告封得住、也验得回」;想对照同类插件的中文清单与安装形态见 DeepSeek Harness Hub 插件清单。

适合与不适合

适合:需要长期留档、需要别人能重算哈希的交付场景;已在 ECS 上有独立数据盘和快照策略的团队;愿意把封存与只读校验做成周期任务的运维型使用者。不适合:只想在本地随手出一份 Markdown 的人;想自动联网深度检索的人(gather 只跑一轮,也不替你组装);拿它当通用知识库或向量检索用的人(没有嵌入、没有语义相似度)。

标签:dsh-research-report、DeepSeek Harness、阿里云、最佳实践、报告封存

本文由 DeepSeek Harness Hub 自动整理,数据来源于插件详情页。

目录
相关文章
|
15天前
|
人工智能 JSON API
全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程
全网爆火的 Jev 模型是什么?有什么用?怎么使用?怎么接入 AI 编程工具?效果真的好么?傻子可懂的 Jev 保姆级实战教程 + 项目实战测评来啦
8208 18
|
14天前
|
人工智能 并行计算 PyTorch
秋叶 ComfyUI 2026 整合包 v3.2 完整部署教程:Python 3.13 + Torch 2.13 全栈升级
秋叶aaaki ComfyUI 2026年8月整合包v3.2正式发布!全面升级Python 3.13.11、PyTorch 2.13.0+cu130及ComfyUI v0.30.2,原生支持MiniMax H3、Wan 2.2、Qwen-Image-2.1等2026主流音视频/图像模型,解压即用,无需环境配置。
2456 13
|
14天前
|
人工智能 测试技术 API
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
Jev是TypeSafe AI推出的“系统一模型”,不生成文本,专做毫秒级结构化决策:Choice(多选)、Score(打分)、Noul(是非概率)。响应快193倍、成本低444倍,适合工单路由、内容审核、测试定级等高频判断场景。
1860 4
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
|
12天前
|
人工智能 编解码 并行计算
MiniMax-H3 一键整合包技术文档:8G 显存运行 AI 漫剧制作 —— 角色替换 / 动作迁移 / 文图生视频部署与调参指南
MiniMax H3 是 MiniMax 开源的全模态视频生成模型,支持文/图/音/视多条件输入,输出最高2K、15秒带双声道音频视频。本文档详述其Int8量化版在8GB显存下的本地一键部署、三段式工作流(EDIT/REPLACE/CONTINUE)、参数调优及常见问题排查。(239字)
|
8天前
|
人工智能 Linux 开发者
【2026国内使用】Codex安装过程一篇讲透(Win/Mac/Linux全支持)
Codex是OpenAI推出的AI编程智能体,可读取本地项目、理解需求并自动修改代码。支持桌面GUI、命令行(CLI)及VS Code/Cursor插件三种形态,覆盖可视化操作、终端高效开发与编辑器无缝集成场景,助开发者用自然语言驱动编码全流程。(239字)
【2026国内使用】Codex安装过程一篇讲透(Win/Mac/Linux全支持)
|
8天前
|
人工智能 JSON 编解码
【2026最新版】ComfyUI本地部署教程,新手也能看懂!
ComfyUI是本地运行的AI绘画工具,采用节点式工作流设计:通过拖拽连接“加载模型”“提示词编码”“采样”“解码”等模块,实现高度可控的文生图。新手推荐使用秋叶整合包,一键启动、内置模型管理与插件安装器,轻松上手。(239字)
|
22天前
|
缓存 IDE Java
【保姆级】Android Studio下载、安装和汉化教程(2026最新)
Android Studio 是 Google 官方推出的免费 Android 应用开发集成环境,基于 IntelliJ IDEA,内置模拟器、调试器、性能分析及 Compose 界面工具,功能全面,文档丰富,是安卓开发首选工具。(239字)
2417 1

热门文章

最新文章