本地离线知识库的隐私底线 数据落用户目录不出域,察元AI还超级智能体

简介: 察元AI桌面版坚守“数据不出域”核心承诺:所有对话、知识库、文件、密钥、日志均本地存储(CHAYUAN_ROOT下),默认禁用遥测,Sidecar绑定127.0.0.1,模型密钥强加密。支持Ollama等本地模型实现完全闭环,0字节外传,满足政企等保与国产化合规要求。(239字)

察元AI还超级智能体 桌面单机版的核心隐私承诺:所有数据落在用户目录,不出域。这一篇讲实现。

承诺的具体含义。

具体一:对话历史在本地。所有 LLM 对话在 CHAYUAN_ROOT/data 的 SQLite 文件。不上传任何云。

具体二:知识库在本地。doc:* 文档库的 chunk 跟向量在 CHAYUAN_ROOT/vectors。不上传。

具体三:上传的原文件在本地。CHAYUAN_ROOT/uploads。不上传。

具体四:模型钥匙在本地。CHAYUAN_ROOT/credentials 加密存。不上传。

具体五:诊断日志在本地。CHAYUAN_ROOT/logs。不上传。

例外。LLM 调用本身。如果用户用云端模型(OpenAI、文心等),prompt(含 chunk 内容)发到厂商云。这部分不可避免。如果用户在意,用本地推理(Ollama)即可完全闭环。

工程实现。

实现一:sidecar 默认绑 127.0.0.1。外部网络访问不到。

实现二:禁用任何 默认 telemetry。chayuan-desktop 不发使用统计、不发 crash report 到云端(除非用户主动开 Langfuse 接入)。

实现三:模型钥匙加密。Stronghold + ChaCha20。

实现四:Tauri 配置 capability 限制。前端能调的 native API 严格白名单。

CLAUDE.md 里的红线。

红线一:不在查询阶段允许前端覆盖 embedding 模型。

红线二:vector / source 结果不能展示成 可下载文档附件 误导用户。

红线三:未验证就提交或推送代码。

红线四:没有权限校验就访问 KB / source。

红线五:在路由文件里继续堆大段业务 dispatch。

这些规则保护数据完整性和合规性。

跟厂商云模型的关系。chayuan-desktop 不替用户选 云端 vs 本地。用户配什么模型供应商,调用走那条路。如果配 OpenAI,prompt 当然到 OpenAI。chayuan-desktop 在前端明确显示当前模型(云 vs 本地),用户能看到 这次对话是不是发到外部。

完全闭环的方法。

方法一:模型用本地 Ollama 或 vLLM。

方法二:嵌入用本地 bge-m3-onnx(默认)。

方法三:重排用本地 bce-reranker(默认)。

方法四:OCR 用本地 RapidOCR(默认)。

方法五:向量库用本地 sqlite-vec(默认)或自建 Milvus。

方法六:业务数据库用自建(达梦、金仓在内网)。

方法七:所有外部源都接内网。

整套配下来 0 字节出域。

国产化支持下的不出域。政企等保合规要求严格。chayuan-desktop 的本地优先架构天然契合。

WPS AI 插件 chayuan-wps 的数据流跟 chayuan-desktop 一致。WPS 文档内容发给 sidecar,sidecar 在本地处理。不出 sidecar 范围。

数据落用户目录不出域是 chayuan-desktop 给用户的承诺。免费开源的AI软件 跟商业 SaaS 的根本差别就在这里。chayuan-desktop 在工程层面把这件事做扎实,让 隐私承诺 不只是口号。

相关文章
|
3月前
|
前端开发 Java Nacos
Nacos 注解全解析:7 个核心注解 + 5 个生产踩坑清单(2026 实测)
Nacos 注解用错,是 90% 微服务 Bug 的根源。本文把注册发现、配置热更新的 7 个核心注解、动态刷新原理和 5 个生产踩坑一次讲透,附可运行代码。
554 2
Nacos 注解全解析:7 个核心注解 + 5 个生产踩坑清单(2026 实测)
|
3月前
|
算法 NoSQL Java
Java在分布式ID生成器(雪花算法)中的实现与优化
在分布式系统中,需要全局唯一、趋势递增、高性能的ID(如订单号、消息ID)。数据库自增ID在分库分表后不再唯一;UUID无序且过长,影响索引性能。
453 1
|
2月前
|
人工智能 运维 供应链
AI算力爆发,液冷CDU成刚需!核心原理、成本拆解、头部玩家全盘点
本文深度解析液冷CDU行业:随GB200/Rubin集群落地,单柜功耗超100kW,液冷成智算中心刚需。CDU作为液冷“心脏”,技术壁垒高、供需缺口大。全面梳理英维克、申菱等国产龙头及Vertiv等海外巨头的核心技术、客户生态与差异化优势,助力IDC与算力建设方决策。(239字)
|
Linux C++ Windows
c++ 通过域名获取ip(跨平台)
c++ 通过域名获取ip(跨平台)
1512 0
|
1月前
|
人工智能 安全 数据可视化
AI桌面助手的隐私底线 数据可落本地不出域,还能一键切换云端,全能智能体
本地部署模型 + 数据不出域 + 本地数据分析,让数据更安全。
|
2月前
|
人工智能 IDE 数据处理
2026年Vibe Coding系统学习指南:从入门到实战全路径
IDC 2025全球AI编程工具报告显示,Vibe Coding(氛围编程)已成为开发者效率提升的核心路径,62%的技术团队已将其纳入日常开发流程。传统编程学习需数月掌握语法、框架与调试逻辑,而Vibe Coding以自然语言交互为核心,大幅降低入门门槛,但缺乏系统学习方法易陷入“只会描述、不会把控”的误区。本文以PySpark数据处理Pipeline为实战场景,结合TRAE、Cursor、Claude Code等主流工具,从基础认知、工具选型、提示词工程、实战迭代到工程化落地,构建完整学习体系,帮助开发者快速掌握Vibe Coding核心能力。
1320 2
|
8月前
|
算法 编译器 C语言
【2026最新】MinGW64官网下载安装保姆级教程(附安装包+图文并茂)
MinGW-w64 是 Windows 下的轻量级 GNU 编译器集合,支持 C/C++ 编译,无需虚拟机即可生成独立 exe 文件。它体积小、免安装、静态链接运行库,兼容 Win10/11 与旧系统,配置简单,广泛用于算法开发、刷题及教学场景。
15164 5
|
2月前
|
人工智能 自然语言处理 JavaScript
Vibe Coding(氛围编程)的核心优势
Vibe Coding(氛围编程)是2025年入选柯林斯年度词汇的AI编程新范式,由Karpathy提出。开发者用自然语言描述需求,AI自动生成并迭代代码,聚焦创意与验证。显著提升效率(月级→小时级)、降低门槛、加速创意落地、优化协作与工程化,正成为个人与团队高效交付主流方式。(239字)
895 0
|
5月前
|
人工智能 自然语言处理 数据可视化
阿里云AI产品特惠:Qwen3.6全模型通享4.5折,至高享7000万免费tokens,加速Al应用落地
阿里云推出AI产品特惠活动,以Qwen3.6-Plus升级为核心,带来智能体编程、Vibe Coding及多模态识别等能力的跃升。活动涵盖全模型通享低至4.5折的优惠,支持百万词元上下文窗口及主流Agent框架优化。用户可体验电商营销、广告创作、短剧漫剧、AI Coding、智能客服、AI办公六大场景应用,并享受弹性GPU算力部署服务。此外,阿里云提供超30款AI产品及7000万大模型tokens免费试用,助力企业快速构建高性价比的AI解决方案。
|
3月前
|
存储 关系型数据库 MySQL
MySQL索引底层原理:B+树能存多少数据?页分裂与回表机制详解
数据库小学妹带你深入B+树底层:为何选它而非二叉树或哈希?揭秘页分裂/合并机制、聚簇与二级索引差异、回表代价及磁盘I/O优化逻辑。3层B+树可存约800万数据,查询仅需3次I/O!

热门文章

最新文章