實踐:搭建知識庫問答助手
本篇以「為單位搭建一個基於內部制度文件的問答助手」為例,帶你走完從建立知識庫、召回驗證、編排對話流、偵錯測試到發佈上線的完整流程。適合首次在 LanSphere 上搭建對話類應用的開發人員與管理員閱讀。
場景與價值
單位的規章制度、管理辦法通常散落在多份文件中,日常諮詢高度依賴人工答疑:
- 員工遇到問題要翻多份文件,找不到、看得慢;
- 人事行政部門反覆回答同類問題,佔用大量精力;
- 不同人答覆口徑不一致,容易引發爭議;
- 新文件下發後,舊答覆還在流傳,資訊滯後。
把制度文件放進知識庫,讓對話流基於知識庫作答:員工隨時自助提問,答案有據可查、口徑統一,人事行政部門也能從重複答疑中解放出來。
你將搭建什麼
一個「制度問答助手」對話流應用:員工在對話中提問,應用從制度知識庫中檢索相關內容,由大模型組織語言回答並標註引用來源;查不到時明確告知,不編造。最終將應用發佈到應用廣場,並上架藍信客戶端「AI 助理市場」,全單位員工在藍信中即可使用。
整體鏈路:知識庫(制度文件)→ 對話流(輸入 → 知識庫 → 大模型 → 回覆)→ 發佈(應用廣場 + 藍信 AI 助理)。
推薦流程
| 步驟 | 說明 |
|---|---|
| 1 建立知識庫 | 簡易模式上傳制度 PDF,選「通用文件問答」分段策略,向量索引 + 重排序模型 |
| 2 召回測試 | 用典型問題驗證召回片段、匹配度與來源,不合格先調知識庫 |
| 3 編排對話流 | 輸入 → 知識庫(Top K 3、混合檢索)→ 大模型(約束提示詞)→ 回覆 |
| 4 設定對話功能 | 開場白、引用歸屬、敏感詞審查 |
| 5 偵錯測試 | 涵蓋「該答對」與「該拒答」兩類案例,多輪追問驗證記憶 |
| 6 發佈上線 | 儲存 → 發佈到應用廣場 → 發佈到藍信 AI 助理 |
準備工作
| 項目 | 要求 |
|---|---|
| 平台角色 | 開發人員及以上(建立知識庫、編排對話流);發佈到藍信 AI 助理需管理員及以上 |
| 資源歸屬 | 發佈到藍信僅限本人建立的應用,建議全程使用同一帳號操作 |
| 藍信綁定 | 發佈前確認帳號已綁定藍信(「個人中心 → 綁定藍信」) |
| 制度文件 | PDF 格式,單檔案不超過 15MB(亦支援 DOCX、TXT、MD、XLSX、XLS、CSV 等) |
| 模型 | 對話大模型可用;向量模型(必選)與重排序模型(建議)已在「模型列表」中設定,未設定請聯絡管理員 |
第一步:建立知識庫
- 進入「左側選單 → 知識庫」,點擊「建立知識庫」,構建模式選擇「簡易」(標準建立)。
- 基礎資訊:填寫名稱(必填,不超過 30 字元,如「單位制度知識庫」)與描述(選填)。
- 上傳檔案:上傳制度 PDF 檔案。
- 分段策略:選擇預設策略「通用文件問答」。該策略為父子分段·段落模式,子區塊最大 512,適合制度條款這類按段落組織的文件,無需手動調整分段規則。
- 參數確認:父子分段模式下索引方式鎖定為「向量索引」;選擇向量模型(必選),建議同時選擇重排序模型以提升召回精度。
- 確認建立:頁面逐檔案顯示處理進度,全部成功後點擊「進入知識庫」。
注意:向量索引選定後不支援切回關鍵詞索引;後續向該知識庫追加檔案時,自動繼承建立時的分段模式,不可變更。
第二步:召回測試驗證知識庫
知識庫建立後先不要急著編排應用,先做召回測試,確認「問得到、問得準」:
- 進入剛建立的知識庫,開啟召回測試功能(按頁面提示進入)。
- 輸入幾個典型問題,如「年假有幾天」「出差住宿標準是多少」。
- 檢視召回片段、匹配度與來源文件:
- 召回片段確實包含答案 → 知識庫可用,進入下一步;
- 召回片段不相關或為空 → 先處理知識庫分段問題(見文末「驗證與調優」),不要帶著問題上畫布。
提示:召回測試階段多試幾種問法(口語化問法、簡稱),這些就是員工真實的提問方式。
第三步:編排對話流
- 點擊「新建專案」,應用類型選擇「對話流」,填寫應用名稱(如「制度問答助手」)。
- 進入「應用開發」分頁的畫布,「輸入」節點預設存在,作為對話入口。
- 點擊新增「知識庫」節點,連接在「輸入」節點之後:
- 關聯知識庫:選擇剛建立的「單位制度知識庫」;
- 檢索方式:選擇「混合檢索」(語意與關鍵詞加權,對條款編號、專有名詞更友好);
- Top K:保持預設 3;
- 已設定重排序模型時,可啟用以提升精度。
- 點擊新增「大模型」節點,連接在「知識庫」節點之後。選擇對話模型,將知識庫節點的檢索結果作為上下文傳入,並編寫提示詞:
你是單位的制度問答助手,負責依據知識庫檢索結果回答員工關於規章制度的問題。
【知識庫檢索結果】
(此處插入知識庫節點的輸出變數)
請嚴格遵守以下規則:
1. 僅依據上方檢索結果回答,不得使用檢索結果之外的任何資訊。
2. 檢索結果中沒有答案時,明確回覆「未在現行制度文件中找到相關規定」,
並建議員工諮詢人事行政部門,不要編造條款或數字。
3. 回答末尾標註引用來源,格式:來源:《文件名》相關章節。
4. 分條陳述,語言簡潔正式;與制度無關的問題,禮貌說明本助手僅解答制度問題。
提示:提示詞中的上下文請透過畫布的變數選擇器插入知識庫節點的輸出變數,佔位寫法以實際變數名為準。
- 點擊新增「回覆」節點,連接在「大模型」節點之後,回覆內容引用大模型節點的輸出。對話流透過「回覆」節點向使用者輸出訊息。
第四步:設定對話功能
在對話流的功能設定中開啟以下能力(按頁面提示完成設定):
| 功能 | 設定建議 | 作用 |
|---|---|---|
| 開場白 | 開啟,預置 2-3 個常見問題(如「年假怎麼申請?」) | 首次進入自動展示,引導員工提問 |
| 引用歸屬 | 開啟 | 回答標註引用的知識庫來源,增強可信度 |
| 敏感詞審查 | 開啟 | 對輸入與輸出做敏感內容審查,符合單位合規要求 |
第五步:偵錯與典型問題測試
- 使用整體偵錯進行多輪對話測試,每輪檢視各節點的輸入、輸出與錯誤;過往記錄可在「偵錯歷史」中回看。
- 按下表涵蓋兩類案例——該答對的要答準,該拒答的要拒答:
| 類型 | 測試問題範例 | 預期表現 |
|---|---|---|
| 該答對 | 「年假有幾天?怎麼申請?」 | 依據制度文件分條回答,標註來源 |
| 該答對 | 「出差住宿標準是多少?」 | 引用對應文件中的標準條款 |
| 該答對 | 「試用期多久?」(口語化問法) | 能召回相關條款並正確回答 |
| 該拒答 | 「食堂今天中午吃什麼?」 | 明說知識庫中沒有相關規定,不編造 |
| 該拒答 | 「幫我寫一份年終總結」 | 禮貌說明僅解答制度相關問題 |
- 多輪追問測試:先問「年假有幾天」,再追問「那探親假呢」,確認多輪記憶正常、上下文不串。
第六步:儲存與發佈
- 儲存:點擊「儲存」,草稿僅本人可見。
- 發佈到應用廣場:儲存最新內容後,點擊「儲存」按鈕下拉 →「發佈到應用廣場」。上架後平台內全員(含閱覽成員)可見可用,適合先小範圍試用、收集回饋。
- 發佈到藍信 AI 助理(需管理員及以上角色):
- 進入應用詳情頁「發佈渠道」分頁,選擇「藍信 AI 助理」渠道;
- 帳號已綁定藍信:確認彈出視窗後直接發佈;未綁定:按彈出視窗引導跳轉藍信授權認證中心,掃碼認證通過後自動執行發佈;
- 助理標題預設繼承應用名稱(不超過 10 字)、描述預設繼承應用說明(不超過 20 字),命名時請注意長度限制;
- 發佈後按鈕變為「已發佈」置灰,不可重複發佈;系統自動在藍信側建立應用與機器人實例,上架藍信客戶端「AI 助理市場」。
員工側體驗:在藍信「AI 助理市場」看到助理圖示、標題與描述,點擊進入;首次使用需完成資料授權,同意授權後方可對話;若拒絕則無法使用,再次進入會重新推送授權卡片。
驗證與調優
上線後在「對話日誌」分頁檢視真實提問,對回答標記好評/差評並新增標註回覆,按下表針對性調優:
| 現象 | 可能原因 | 調整方法 |
|---|---|---|
| 答非所問 | 召回片段不相關 | 用召回測試複查;調大 Top K;啟用重排序模型 |
| 編造答案(幻覺) | 提示詞約束不足 | 強化「僅依據知識庫回答、無答案明說」規則;確認已開啟引用歸屬 |
| 已有條款查不到 | 文件分段不合理 | 檢視分段結果;條款被截斷時調整分段策略後重建知識庫 |
| 回答冗長、離題 | 輸出未限定 | 在提示詞中限定分條陳述與篇幅 |
驗收要點
- 制度類問題回答準確,內容與文件原文一致,末尾標註引用來源;
- 知識庫中沒有的問題明確拒答,不編造條款、不編造數字;
- 多輪追問上下文連貫,引用歸屬正常展示;
- 藍信「AI 助理市場」中可見該助理,終端使用者完成資料授權後可正常對話。
擴充思路
- 開啟「檔案上傳」,讓員工臨時上傳一份檔案參與問答;
- 開啟「推薦提問」,根據本輪回答自動推薦下一輪問題,提升連續使用體驗;
- 在畫布中加入「意圖識別」節點,把制度諮詢與其他事務分流到不同分支;
- 透過「發佈渠道 → API 存取」將問答能力接入單位內部系統。

