本地离线知识库的隐私底线 数据落用户目录不出域,察元AI还超级智能体

简介: 察元AI桌面版坚守“数据不出域”核心承诺:所有对话、知识库、文件、密钥、日志均本地存储(CHAYUAN_ROOT下),默认禁用遥测,Sidecar绑定127.0.0.1,模型密钥强加密。支持Ollama等本地模型实现完全闭环,0字节外传,满足政企等保与国产化合规要求。(239字)

察元AI还超级智能体 桌面单机版的核心隐私承诺:所有数据落在用户目录,不出域。这一篇讲实现。

承诺的具体含义。

具体一:对话历史在本地。所有 LLM 对话在 CHAYUAN_ROOT/data 的 SQLite 文件。不上传任何云。

具体二:知识库在本地。doc:* 文档库的 chunk 跟向量在 CHAYUAN_ROOT/vectors。不上传。

具体三:上传的原文件在本地。CHAYUAN_ROOT/uploads。不上传。

具体四:模型钥匙在本地。CHAYUAN_ROOT/credentials 加密存。不上传。

具体五:诊断日志在本地。CHAYUAN_ROOT/logs。不上传。

例外。LLM 调用本身。如果用户用云端模型(OpenAI、文心等),prompt(含 chunk 内容)发到厂商云。这部分不可避免。如果用户在意,用本地推理(Ollama)即可完全闭环。

工程实现。

实现一:sidecar 默认绑 127.0.0.1。外部网络访问不到。

实现二:禁用任何 默认 telemetry。chayuan-desktop 不发使用统计、不发 crash report 到云端(除非用户主动开 Langfuse 接入)。

实现三:模型钥匙加密。Stronghold + ChaCha20。

实现四:Tauri 配置 capability 限制。前端能调的 native API 严格白名单。

CLAUDE.md 里的红线。

红线一:不在查询阶段允许前端覆盖 embedding 模型。

红线二:vector / source 结果不能展示成 可下载文档附件 误导用户。

红线三:未验证就提交或推送代码。

红线四:没有权限校验就访问 KB / source。

红线五:在路由文件里继续堆大段业务 dispatch。

这些规则保护数据完整性和合规性。

跟厂商云模型的关系。chayuan-desktop 不替用户选 云端 vs 本地。用户配什么模型供应商,调用走那条路。如果配 OpenAI,prompt 当然到 OpenAI。chayuan-desktop 在前端明确显示当前模型(云 vs 本地),用户能看到 这次对话是不是发到外部。

完全闭环的方法。

方法一:模型用本地 Ollama 或 vLLM。

方法二:嵌入用本地 bge-m3-onnx(默认)。

方法三:重排用本地 bce-reranker(默认)。

方法四:OCR 用本地 RapidOCR(默认)。

方法五:向量库用本地 sqlite-vec(默认)或自建 Milvus。

方法六:业务数据库用自建(达梦、金仓在内网)。

方法七:所有外部源都接内网。

整套配下来 0 字节出域。

国产化支持下的不出域。政企等保合规要求严格。chayuan-desktop 的本地优先架构天然契合。

WPS AI 插件 chayuan-wps 的数据流跟 chayuan-desktop 一致。WPS 文档内容发给 sidecar,sidecar 在本地处理。不出 sidecar 范围。

数据落用户目录不出域是 chayuan-desktop 给用户的承诺。免费开源的AI软件 跟商业 SaaS 的根本差别就在这里。chayuan-desktop 在工程层面把这件事做扎实,让 隐私承诺 不只是口号。

相关文章
|
2月前
|
前端开发 Java Nacos
Nacos 注解全解析:7 个核心注解 + 5 个生产踩坑清单(2026 实测)
Nacos 注解用错,是 90% 微服务 Bug 的根源。本文把注册发现、配置热更新的 7 个核心注解、动态刷新原理和 5 个生产踩坑一次讲透,附可运行代码。
365 2
Nacos 注解全解析:7 个核心注解 + 5 个生产踩坑清单(2026 实测)
|
2月前
|
算法 NoSQL Java
Java在分布式ID生成器(雪花算法)中的实现与优化
在分布式系统中,需要全局唯一、趋势递增、高性能的ID(如订单号、消息ID)。数据库自增ID在分库分表后不再唯一;UUID无序且过长,影响索引性能。
332 1
|
Java 关系型数据库 MySQL
Spring Boot实现第一次启动时自动初始化数据库
在现在的后端开发中,只要是使用关系型数据库,相信SSM架构(Spring Boot + MyBatis)已经成为首选。 不过在我们第一次运行或者部署项目的时候,通常要先手动连接数据库,执行一个SQL文件以创建数据库以及数据库表格完成数据库的初始化工作,这样我们的SSM应用程序才能够正常工作。 这样也对实际部署或者是容器化造成了一些麻烦,必须先手动初始化数据库再启动应用程序。 那能不能让我们的SSM应用程序第一次启动时,自动地帮我们执行SQL文件以完成数据库初始化工作呢? 这样事实上是没问题的,今天就以Spring Boot + MyBatis为例,使用MySQL作为数据库,完成上述的数
|
30天前
|
机器学习/深度学习 缓存 人工智能
SSE流式传输稳定性进阶:心跳保活、断连重连、分片处理与双端容错实战.162
SSE(Server-Sent Events)是基于HTTP的单向流式协议,天然适配大模型逐字输出场景。具备轻量、兼容性好、自动重连、低内存占用等优势,相比WebSocket更契合服务端单向推送需求,是AI应用流式响应的理想选择。
315 7
|
1月前
|
人工智能 JSON API
百炼 Skills 实战:spark-video——让零基础用户一句话做出完整AI视频
spark-video 是百炼平台推出的AI视频端到端Skill,封装Qwen编剧、HappyHorse渲染、Qwen-VL质检、CosyVoice配音等多模态能力,用户仅需一句话描述+4次确认,即可零门槛生成完整MP4视频,费用透明、流程可控,专为小白打造“输入即成片”体验。(239字)
|
2月前
|
人工智能 开发工具 git
Claude Code新手零基础入门教程:安装配置、国产模型接入与常用命令全集
在AI编程工具快速迭代的当下,传统代码补全插件已经无法满足复杂开发需求,而**Claude Code**凭借终端原生、任务驱动、轻量高效、多模型兼容的独特优势,成为开发者首选的智能编程助手。它不需要依赖笨重的IDE插件,全程在终端运行,能够自主理解项目需求、拆解开发任务、生成代码、修改文件、执行终端命令、管理Git版本仓库,覆盖从项目初始化、代码编写、Bug修复到项目重构的全流程开发工作。
928 3
|
2月前
|
人工智能 缓存 安全
阿里云百炼:重磅发布Qwen3.7 Max 面向智能体时代的新一代旗舰模型
阿里云百炼重磅发布Qwen3.7-Max旗舰大模型,面向智能体时代,支持100万tokens超长上下文、30K RPM高并发,具备卓越编程能力、MCP集成与长周期自主执行能力。现推理后付费限时5折,新用户可免费试用100万Tokens。开百炼免费体验:https://t.aliyun.com/U/fPVHqY
|
5月前
|
机器学习/深度学习 人工智能 监控
猪的危险行为数据集(5000+高清标注)| YOLO实战 智慧养殖与异常行为预警
本数据集开源5000+高清标注样本,精准覆盖猪只攻击、咬耳朵、咬尾巴三类危险行为,标注准确率≥98%,按7:1.5:1.5划分训练/验证/测试集,YOLO格式,兼容v5/v8/v11,支持智慧养殖实时预警与异常行为监测。
|
5月前
|
机器学习/深度学习 存储 算法
基于 YOLO26 的5类舌苔情况智能检测(中英文双版) | 附完整源码与效果演示
本项目基于YOLOv26算法,实现灰黑苔、镜面舌、薄白苔、白腻苔、黄腻苔5类舌苔的智能检测,融合中医舌诊理论与深度学习技术,提供高精度、实时化、易部署的中英文双语解决方案,附完整源码、模型与演示视频。
|
6月前
|
人工智能 自然语言处理 数据可视化
大模型应用:大模型驱动智能体协同实现:技术原理与实战落地全解析.35
本文详解大模型与智能体融合机制:大模型作为“大脑”负责理解与规划,智能体作为“手脚”执行工具调用,通过Prompt驱动实现“感知→规划→执行→整合”闭环。以销售分析智能体为例,完整呈现端到端自动化实践,显著提升任务落地能力、结果准确性与业务实用性。
844 15

热门文章

最新文章