从零开始搭建知识库 · EP01 · 基础篇(系列首发,长期连载)
一个实测出来的结论
在阿里云百炼上跑企业知识问答,现在大家都会先想到"把文件传给模型"。2026 年这已经是标准动作。但我在百炼 CLI 上用 qwen3.8-max 做了三组对照实验,结论是:
"传文件"这个动作本身有三个工程缺口,而这三个缺口恰好定义了企业知识库该干什么。
对做企业落地的团队,这个结论有直接意义:知识库项目的价值不是"让模型能答",而是把传文件动作里的缺口系统性地填掉。方向搞清楚,预算才不会花错地方。
三组实验,一分钟看完
问题域:企业差旅制度问答。工具:百炼 CLI(bl)+ qwen3.8-max。统一提问模板,自变量只有贴入的制度文本。
| 组 | 注入内容 | 模型表现 |
|---|---|---|
| E1 | 制度标准条款(抽掉流程条款) | 标准答对;流程部分拿行业常识静默补全,输出无法区分来源 |
| E2 | 制度全文(对照) | 完整推理链:450 标准、超标 100、OA 双签审批、30 日时限全推对 |
| E3 | 2023 旧版制度(上限 600,新版 450) | 逐项尽职核对后放行"可全额报销",全程零版本质疑 |
E1 值得展开。模型在流程问题上先承认"制度中未明确例外流程",然后拿行业常识补齐了发票、付款记录等材料清单(reasoning 原话:"制度没细说,但可以建议")。模型对注入内容的覆盖缺口没有告警机制,员工拿到的回答里,制度事实和模型常识混在一起,无法验证。
E3 是企业落地更该警惕的形态。它核对了城市分类、含税价、单人单晚、时限,甚至提醒"601 就超标",然后按作废标准放行了一笔订房。损失推演:一晚自贴 150。模型只对自己生成的内容负责,不校验你输入的文件时效。这个缺口,只有把权威知识源接进系统才能补上。
从"传文件"到知识库:百炼的能力路径
手动传文件有效,但撑不起企业使用:每次要传、换对话即忘、无法团队共享、版本不受控。而且最根本的问题是:员工往往不知道答案藏在哪个文件里,报销的答案横跨制度 PDF、OA 公告、群公告,谈何传全。
把它工程化就是 RAG:存(多源文档入库建索引)→ 找(跨文件检索召回)→ 答(生成)。百炼平台在这条路径上的能力是齐的:控制台建知识库、bl knowledge retrieve 命令行检索(支持稠密/稀疏双路召回和重排)、bl app call 挂知识库管道的应用调用。本系列第二篇开始逐一实测这条路径,从建第一个库到跑通第一问,15 分钟。
再往后,系列会走到行业前沿:Agentic RAG(智能体自主决定检索策略)、Karpathy 今年 4 月提出的 LLM Wiki 范式(把"每次现查"改成"知识编译",中文技术圈已讨论了四个月)、Graph RAG 与视觉检索。每一期都基于百炼能力实测。
写在系列开头
这个系列定位长期连载:基础篇(EP01-04)→ 进阶篇(EP05)→ 范式篇(EP06-07)→ 前沿篇(EP08-09)→ 实战篇(EP10 起)。实战篇从一个小微企业客服知识库系统开始:客服答案散落在产品页、售后文档和运营的 Excel 里,新人翻十分钟聊天记录找不到,用一条知识库链路解决,并横向对比 Dify、FastGPT、RAGFlow 等开源方案与百炼路线的取舍。
对在百炼上做企业落地的开发者,这个系列可以直接当能力地图用。对内容团队,它是一个"认知填充"式的科普连载:用相对易懂的语言,把知识库这件事从零讲透。