报告封存目录该放云盘还是工作区,阿里云上的三点取舍

简介: 本文介绍dsh-research-report在ECS上的报告封存最佳实践:采用独立ESSD云盘存储(/data)、配置绝对路径避免多工作区冲突、后台组装+周期性SARIF校验门禁,确保报告字节级可验证、长期可重算、交付可信。

把可验证报告引擎搬上 ECS 之后,最先要回答的不是性能,而是「封存出来的东西放哪、怎么活下来」。dsh-research-report 会把每份报告封成 <reportRoot>/<slug(topic)>/<YYYYMMDD-HHmmss>/,连同 report.md、manifest.json、verification.jsonl、disconfirmation.jsonl 一起长期留存——这些不是缓存,是交付物。下面三个取舍,正是围绕「放哪」展开的。安全扫描口径为「🔵 含敏感能力,尚无人工评估」,能力与风险要分开看。

取舍一 · 独立云盘 vs 工作区相对目录

默认 reportRoot 是 research-reports,相对路径按 harness 工作目录解析,报告和工作区绑在一起。单机随手跑,这样最省事;但报告只要要长期留档、要交付、要能事后重算哈希,就不该继续挂在工作区里。

倾向独立云盘:把 <ledgerRoot> 与 <reportRoot> 都指到 ESSD 数据盘(例如 /data):

好处有两个:工作区可以随便重建、重装、换目录,封存物不受牵连;备份边界清晰,给数据盘配自动快照策略就覆盖了。但云盘不是免死金牌——封存会拦下判定漂移、绑定证据被篡改或缺失、日志序列化失败这三类问题,没有可调开关;快照救的是误删和磁盘损坏,救不了「证据本身对不上」。

取舍二 · 单工作区相对路径 vs 多工作区绝对根目录

ledgerRoot / reportRoot 在挂载时按 harness 工作目录解析,这是默认行为,也是最容易被忽视的边界:多工作区部署必须为每个 profile 配绝对根目录,否则换个工作目录就「找不到账本」。

阿里云上的现实是,一台 ECS 常同时跑多个 profile、多个业务目录。此时:

  • 每个 profile 单独配绝对路径,绝不用默认相对值;
  • 目录权限按运行账号划分——root 跑和普通账号跑会看到完全不同的「工作区」,账本自然对不上;
  • 若还要多 workspace 出网,仍走 NAT 网关或弹性公网 IP,安全组出方向别漏。

一句话:相对路径省事,绝对路径省心;当交付物要求「别人能重算哈希」,省心优先。

取舍三 · 前台同步组装 vs 后台组装加周期门禁

报告组装可以前台同步做完,也可以走 ctx.jobs 后台跑。规模一大,前台同步就会把会话堵在等哈希上。

工程化的做法:用 background: true 经 ctx.jobs 返回 { kind: 'background', jobId },把组装挪到后台;封存之后,再用确定性的 verifySealedReport 兜底(零网络、零模型)重算封存哈希与审计哈希,把机器检查写进 verifier-note.md。在 ECS 上把它挂进周期性任务最划算:

dsh-research-verify 是独立命令行(打包为 lib/cli.js,零 @deepseek-ai 导入),不挂载插件也能审计一个封存目录;加 --seal <sha256> 拿期望封存哈希比对,--format sarif 输出 SARIF 2.1.0。任一执行到的检查失败即非零退出,正好当交付前门禁。注意默认 profile 只挂 search、没有 fetch 提供方,URL 抓取会大声失败(WEB_UNAVAILABLE / WEB_PROVIDER_UNAVAILABLE),后台任务同样依赖出网与 fetch 提供方。

三个会咬人的边界要提前知道:

  • 字节级,不是语义级。 内置检查只逐字定位数字和引文片段;没有可核对字面量的转述式主张会验成 unverified,真实主张若数字缺失、标签却以不同值出现,会读成 contradicted。
  • 会话事件是自适应的。 插件声明了 research-report/* 会话事件,但宿主不认识这些类型时追加不生效;账本日志才是永久的事实来源,会话镜像只是增强。
  • 负知识会咬人。 被推翻的主张按内容哈希记住,同样文本在证据未变时再次上报会被强制打回 disproven,证据变了才重新核验;会话锚定证据则永远核验为 unverified,需要人工对照会话日志。

想横向对照同类插件的中文清单,见 DeepSeek Harness Hub 插件清单。

总结

封存目录放独立云盘、根目录配绝对路径、组装与校验放后台并挂周期性门禁——这三条合起来,才是「报告封得住、也验得回」;想对照同类插件的中文清单与安装形态见 DeepSeek Harness Hub 插件清单。

适合与不适合

适合:需要长期留档、需要别人能重算哈希的交付场景;已在 ECS 上有独立数据盘和快照策略的团队;愿意把封存与只读校验做成周期任务的运维型使用者。不适合:只想在本地随手出一份 Markdown 的人;想自动联网深度检索的人(gather 只跑一轮,也不替你组装);拿它当通用知识库或向量检索用的人(没有嵌入、没有语义相似度)。

标签:dsh-research-report、DeepSeek Harness、阿里云、最佳实践、报告封存

本文由 DeepSeek Harness Hub 自动整理,数据来源于插件详情页。

目录
相关文章
|
10天前
|
弹性计算 网络协议 安全
在阿里云 ECS 上把 DSH 接进 MCP 管理控制台:出网、安全组与备份
dsh-mcp-panel 是 DeepSeek Harness 官方 MCP 管理控制台,轻量易装但部署关键在出网配置:需配安全组出向、NAT/SNAT、内网地址或 ssh 端口转发,并确保系统盘余量与 Node 版本(≥22.19.0)达标。
100 2
|
14天前
|
运维 Linux 网络安全
阿里云上长期跑 iPolloWork:哪些做法该留,哪些别做
本文详解iPolloWork在阿里云长期运维的核心原则:坚持状态隔离(开发/Cloud配置互不干扰)、安全组与出网最小化、严守“桌面壳≠服务端”“本地包≠正式版”两条红线,并厘清package仅推进版本号而不发布。适合云上长期运行团队,助你降本增效。(239字)
60 3
|
3天前
|
存储 人工智能 并行计算
大模型本地部署终端选型方法论:以 Qwen3.8-27B 为例的四档分层完整流程
本文提出一套大模型本地部署终端选型方法论:定约束、定档位、定框架、定参数四步决策法,配合入门、主力、质量、无损四档分层模型。以 Qwen3.8-27B 实测数据为例,逐环节解读显存、带宽、存储、散热、系统、预算等要素,给出面向不同预算的优选方案、决策自查清单与市场观察框架。文末前瞻 AI 笔记本的 CPU+GPU 与统一内存两条路线,论证四步决策法在新品类上的延续性。
|
5天前
|
缓存 开发工具 git
DSH skill 怎么安装、放在哪个目录?DeepSeek Harness 技能与插件的区别与用法
dsh skill 不是插件:它是给模型的可加载 Markdown 指令集,由本地提供方按 rank 扫描六个根目录发现,用 dsh plugin add 装不进去。本文讲清六个根目录的优先级、SKILL.md 写法与两个调用开关。
177 4
DSH skill 怎么安装、放在哪个目录?DeepSeek Harness 技能与插件的区别与用法
|
20天前
|
自然语言处理 安全 测试技术
别再只测『答得对不对』:给大模型应用建一套 Prompt 注入红队回归集,把越权/泄密挡在上线前
本文揭示RAG客服应用因缺乏Prompt注入防护而致系统提示词泄露的事故,指出问题根源在于测试只关注“答得对”,却忽视“会不会答不该答的”。提出将注入测试升级为可回归的红队用例集:结构化存于jsonl,覆盖四类注入;用pytest参数化断言输出、工具调用与拒答行为;接入CI自动拦截。安全不是模型天赋,而是靠可执行、可演进的断言守出来的。
别再只测『答得对不对』:给大模型应用建一套 Prompt 注入红队回归集,把越权/泄密挡在上线前
|
2月前
|
自然语言处理 机器人 程序员
向量检索不准怎么办:混合检索与 Rerank 重排序召回优化实战
向量检索看不懂报错码和型号?一文讲透 BM25 关键词检索、RRF 混合检索与 Rerank 重排序,附 Python 代码,拉满 RAG 召回率与答案准确率
|
19天前
|
存储 人工智能 自然语言处理
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
阿里云千问办公(QwenWork)是通义实验室推出的AI原生办公平台,依托Qwen3.8大模型,支持自然语言生成PPT、Excel、网页、视频等;具备浏览器自动化、深度检索、钉钉/飞书集成、定时任务及多端协同能力,真正实现“对话即交付”。
487 2
|
21天前
|
人工智能 文字识别 API
阿里云百炼AI大模型平台:免费超7000万Tokens、模型活动API定价及Token Plan订阅计划全解析
阿里云百炼平台新用户可免费领超7000万Tokens(每模型100万),享万亿Tokens扶持及OpenClaw等优惠活动;支持按量计费(输入/输出Token分计)与Token Plan订阅,覆盖Qwen-Max/Plus/Turbo等全系列大模型,价格透明、地域灵活。
223 4
|
24天前
|
缓存 人工智能 自然语言处理
阿里云千问大模型Qwen3.8-Max介绍:2.4 万亿参数模型,编程与办公能力全面跃升,限时4折起
本文全面拆解阿里云千问旗舰模型Qwen3.8-Max,围绕其2.4万亿参数MoE架构核心特性展开,梳理百万级上下文、原生多模态理解、长程自主规划等核心能力,覆盖六大全球部署区域的功能差异与完整计费体系,重点突出其在编程、办公及法律、金融等专业场景的优势,同步配套新用户免费额度、夜间4折等专属优惠,为开发者提供清晰的选型参考与落地优化指引。

热门文章

最新文章