本地离线知识库的隐私底线 数据落用户目录不出域,察元AI还超级智能体

简介: 察元AI桌面版坚守“数据不出域”核心承诺:所有对话、知识库、文件、密钥、日志均本地存储(CHAYUAN_ROOT下),默认禁用遥测,Sidecar绑定127.0.0.1,模型密钥强加密。支持Ollama等本地模型实现完全闭环,0字节外传,满足政企等保与国产化合规要求。(239字)

察元AI还超级智能体 桌面单机版的核心隐私承诺:所有数据落在用户目录,不出域。这一篇讲实现。

承诺的具体含义。

具体一:对话历史在本地。所有 LLM 对话在 CHAYUAN_ROOT/data 的 SQLite 文件。不上传任何云。

具体二:知识库在本地。doc:* 文档库的 chunk 跟向量在 CHAYUAN_ROOT/vectors。不上传。

具体三:上传的原文件在本地。CHAYUAN_ROOT/uploads。不上传。

具体四:模型钥匙在本地。CHAYUAN_ROOT/credentials 加密存。不上传。

具体五:诊断日志在本地。CHAYUAN_ROOT/logs。不上传。

例外。LLM 调用本身。如果用户用云端模型(OpenAI、文心等),prompt(含 chunk 内容)发到厂商云。这部分不可避免。如果用户在意,用本地推理(Ollama)即可完全闭环。

工程实现。

实现一:sidecar 默认绑 127.0.0.1。外部网络访问不到。

实现二:禁用任何 默认 telemetry。chayuan-desktop 不发使用统计、不发 crash report 到云端(除非用户主动开 Langfuse 接入)。

实现三:模型钥匙加密。Stronghold + ChaCha20。

实现四:Tauri 配置 capability 限制。前端能调的 native API 严格白名单。

CLAUDE.md 里的红线。

红线一:不在查询阶段允许前端覆盖 embedding 模型。

红线二:vector / source 结果不能展示成 可下载文档附件 误导用户。

红线三:未验证就提交或推送代码。

红线四:没有权限校验就访问 KB / source。

红线五:在路由文件里继续堆大段业务 dispatch。

这些规则保护数据完整性和合规性。

跟厂商云模型的关系。chayuan-desktop 不替用户选 云端 vs 本地。用户配什么模型供应商,调用走那条路。如果配 OpenAI,prompt 当然到 OpenAI。chayuan-desktop 在前端明确显示当前模型(云 vs 本地),用户能看到 这次对话是不是发到外部。

完全闭环的方法。

方法一:模型用本地 Ollama 或 vLLM。

方法二:嵌入用本地 bge-m3-onnx(默认)。

方法三:重排用本地 bce-reranker(默认)。

方法四:OCR 用本地 RapidOCR(默认)。

方法五:向量库用本地 sqlite-vec(默认)或自建 Milvus。

方法六:业务数据库用自建(达梦、金仓在内网)。

方法七:所有外部源都接内网。

整套配下来 0 字节出域。

国产化支持下的不出域。政企等保合规要求严格。chayuan-desktop 的本地优先架构天然契合。

WPS AI 插件 chayuan-wps 的数据流跟 chayuan-desktop 一致。WPS 文档内容发给 sidecar,sidecar 在本地处理。不出 sidecar 范围。

数据落用户目录不出域是 chayuan-desktop 给用户的承诺。免费开源的AI软件 跟商业 SaaS 的根本差别就在这里。chayuan-desktop 在工程层面把这件事做扎实,让 隐私承诺 不只是口号。

相关文章
|
29天前
|
前端开发 Java Nacos
Nacos 注解全解析:7 个核心注解 + 5 个生产踩坑清单(2026 实测)
Nacos 注解用错,是 90% 微服务 Bug 的根源。本文把注册发现、配置热更新的 7 个核心注解、动态刷新原理和 5 个生产踩坑一次讲透,附可运行代码。
326 2
Nacos 注解全解析:7 个核心注解 + 5 个生产踩坑清单(2026 实测)
|
1月前
|
算法 NoSQL Java
Java在分布式ID生成器(雪花算法)中的实现与优化
在分布式系统中,需要全局唯一、趋势递增、高性能的ID(如订单号、消息ID)。数据库自增ID在分库分表后不再唯一;UUID无序且过长,影响索引性能。
308 1
|
29天前
|
人工智能 自然语言处理 数据可视化
短剧 / 广告量产神器!万镜一刻 yikeai 搭载 HappyHorse1.1,故事板 + 无限画布打通全链路 AI 视频生产
阿里云推出「万镜一刻(yikeai)」一站式AI视频创作平台,集成自研HappyHorse1.1大模型,首创“AI故事板+无限画布”双引擎,实现剧本→分镜→视频全自动流转;支持角色统一、动作连贯、音画同步、团队协作与资产管控,助力短剧、电商种草、品牌广告高效量产。
|
1月前
|
缓存 前端开发 安全
ReAct推理链的工程化实现与最佳实践
本文介绍向量空间JBoltAI平台基于Spring Boot 3.x与Java 21实现的企业级ReAct推理链架构,涵盖分层设计、模板方法、Function Calling驱动、并发安全机制及推理可视化等核心实践,助力LLM能力可靠落地。
|
1月前
|
人工智能 安全 算法
GEO 行业大清洗:倒闭的不是公司,是整个行业的投机小聪明
本文深度剖析GEO行业2026年集体暴雷的根源:AI技术迭代彻底颠覆旧有商业逻辑。指出虚假繁荣源于信息差红利,而今算法升级、监管加码与品牌认知觉醒共同终结“铺量套利”模式。文章穿透表象,从商业本质、技术底层、人性痛点、产业终局四维拆解,宣告低端中介退场,真GEO已升级为以AI认知基建、品牌信用沉淀为核心的高价值赛道。(239字)
|
1月前
|
存储 人工智能 安全
OpenHuman:本地优先的开源Agent
OpenHuman 展示了一条本地优先的 Agent 路线:把个人记忆、数据连接、自动更新结合,让 Agent 更懂你,也更尊重数据边界。
341 1
|
1月前
|
存储 关系型数据库 MySQL
MySQL索引底层原理:B+树能存多少数据?页分裂与回表机制详解
数据库小学妹带你深入B+树底层:为何选它而非二叉树或哈希?揭秘页分裂/合并机制、聚簇与二级索引差异、回表代价及磁盘I/O优化逻辑。3层B+树可存约800万数据,查询仅需3次I/O!
|
1月前
|
API
车型库查询-车型大全-车系大全-车型识别-汽车标志-车型车系-汽车品牌API接口介绍
本API提供全量车型库查询服务,支持按品牌→车系→车型三级检索,覆盖比亚迪、宝马等主流品牌及年款、排量、驱动、环保标准、指导价、配置参数等字段,广泛应用于汽车销售、保险与维修场景。
219 0
|
4月前
|
机器学习/深度学习 存储 算法
基于 YOLO26 的5类舌苔情况智能检测(中英文双版) | 附完整源码与效果演示
本项目基于YOLOv26算法,实现灰黑苔、镜面舌、薄白苔、白腻苔、黄腻苔5类舌苔的智能检测,融合中医舌诊理论与深度学习技术,提供高精度、实时化、易部署的中英文双语解决方案,附完整源码、模型与演示视频。
|
11月前
|
人工智能 自然语言处理 Java
从青铜到王者,DeepSeek+Spring AI 搭建 RAG 知识库
本文介绍了基于RAG(检索增强生成)技术构建知识库的原理与实现方法。RAG通过结合检索与生成模型,提升大语言模型在问答任务中的准确性与相关性,有效缓解“幻觉”问题。文章还详细讲解了如何利用DeepSeek与SpringAI搭建高效RAG系统,并提供了完整的Java代码示例,帮助开发者快速实现文档处理、向量存储与智能问答功能。适用于智能客服、内容生成、辅助决策等多个场景。
2501 2

热门文章

最新文章