知識庫導入・AGENT 的底層核心

Agent 真正的核心,
不是模型,是你的知識庫

同一個模型,餵不同的知識庫,就是完全不同的兩位員工。 下面是這套知識庫實際的架構、權限與導入管線。

架構・資料分級

四層平行的知識庫,
不是一個大資料夾。

四層等重要、等距——能不能讀是「等級 ≤ 讀取上限」的門檻問題,不是包含關係。

資料分級管線

L4 封在獨立機房,預設不出你的環境
資料分級四級平台:L1 公開資料、L2 內部資料、L3 敏感資料、L4 高敏感資料封存於獨立機房 L1 公開資料 L2 內部資料 L3 敏感資料 L4 高敏感資料
L1 公開資料
官網、型錄、FAQ、公開簡報
可用一般 AI/SaaS
L2 內部資料
SOP、教育訓練、一般文件
可用企業版 AI 或私有知識庫
L3 敏感資料
客戶資料、合約、報價、財務、內部策略
建議私有雲或內部部署
L4 高敏感資料
個資、醫療、法務、機密研發、營業秘密
原則上不直接丟給外部模型,需嚴格控管
架構・讀取權限

每位 Agent 一個讀取上限。

客服 Agent 讀得到 FAQ 與 SOP,讀不到財務與客戶名單——不是叫它別說,是它撈不到。

Agent 讀取權限指派

後台可逐位調整
AGENTL1L2L3L4
客服 Amber
社群 Sunny
數據 Ivy
營運 Morgan
總管 Vivian

上表為配置範例。實際權限由你在導入時逐位指派並存進你自己的資料庫, 系統沒有預設值——因為哪些人該看到什麼,只有你公司說了算。

導入・八道關卡

從一份 PDF 到能被問的知識。

市面工具做到第三關就交給你。第 5、6 關是最花時間、也最不能省的兩關。

匯入管線

綠色=需要人,藍色=AI,灰色=系統自動
01
盤點取得
我們+你
02
抽文字
保留頁碼
系統
03
切塊
系統
04
轉成條目
AI
05
敏感度預判
AI
06
人審
人・不可略過
07
發布+指派權限
08
改版・封存
我們+你

第 6 關:待審佇列

AI 產出一律是草稿,沒人按過通過就進不了 Agent
匯入知識 · 待審條目 3 筆待審
L1
標準版方案包含哪些服務?
標準版含線上部署、5 位 Agent 席次與每月一次成效檢視⋯⋯
問答來源 第 4 頁信心 0.92
通過退回
L3
A 客戶的專案報價與折讓條件
年約 12 個月,首年折讓 15%,含 2 次到府教育訓練⋯⋯
事實來源 第 11 頁 含金額含客戶名稱
通過退回
L2
退換貨處理流程
1. 收到申請當日回覆 → 2. 確認到貨狀態 → 3. 開立退款單⋯⋯
步驟來源 第 7 頁信心 0.88
通過退回

畫面為示意。審的不只是「對不對」,還有「這條該給誰看」—— 上面那條報價若被誤標成 L1,就等於允許客服 Agent 對外講你的成本結構。錯放一級,就是一次外洩。

資安・這道牆在哪

分級守在資料庫層,
不是靠提示詞。

很多系統的「權限分級」只是 UI 欄位——撈資料時照樣全撈,再交代模型不要講。那不叫權限,那叫請求。

超過等級的內容撈不出來

檢索函式本身帶「這位 Agent 的上限等級」參數,超標的內容在資料庫那一層就被濾掉,不會離開資料庫,更不會進到送給模型的內容裡。

// 客服 Agent 提問時,實際發生的事
match_kb_chunks(question, max_level: 2)
  → L1 ✓  L2 ✓  L3 ✗  L4 ✗

資料庫預設拒絕,只有伺服器進得去

知識庫資料表對匿名角色完全關閉,只有跑在伺服器端的服務金鑰能存取。瀏覽器端沒有任何一把鑰匙——前端程式碼被看光也拿不到讀取權限。

// 資料表權限
anon        revoked
authenticated  revoked
service_role   server-only

草稿不進 prompt

AI 產出一律待審,沒人按過通過就不會被檢索。

每條知道從哪來

來源文件、頁碼、版本、負責人、複審日期跟著條目走。

引用留紀錄

每次回答用到哪幾條都查得到,事後追得出根據。

退場不等於刪除

封存後不再被檢索,紀錄留著可回溯。

從盤點開始

先看看你手上,
有哪些能變成 Agent 的腦袋。

30 分鐘線上盤點,分出「馬上能用」「要整理」「先別碰」三堆,再談導入。

盤點不收費・不綁約・沒有的我們就說沒有