客服
HangRui Desk
開在 LINE 上,而且答不出來會說。
多數客服機器人自信而且答錯,省下來的工單抵不過賠掉的信任。Desk 只從你給的文件回答,把出處秀出來,不確定就轉給人——在 LINE 上、在 Telegram 上,也在你自己網站的小視窗裡,三個地方同一個答案、同一組數字。整條管線也可以跑在你自己的機器上,而那通常是它能不能靠近客人對話的前提。
- 網頁
問這個網站。
回答由模型讀這個站自己的頁面產生。它不是真人,也不知道任何沒有寫在這裡的事。
它能做什麼
答案來自你的文件,材料用完就停
它從你的說明中心、政策文件與過往工單回答。問題跟這些材料一段都對不上的時候,它不會呼叫模型——它會說出來,並且給人。
開在客人本來就打開著的地方
LINE、Telegram,以及貼在你自己網站上的一行 script。三個通道後面是同一個 brain,所以同一個問題在哪裡問都是同一個答案。
引用是驗過的,不只是印出來
答案裡的每個編號都對回這一次真正送進模型的那幾段。對得上的變成連結,編出來的留成純文字並標記為未驗證。
可以整台裝在你的店裡
同一條管線,接你自己 GPU 上的開放權重模型。客人的訊息與你的文件都留在你自己的機器上,而且沒有按次計費。
怎麼運作
指向你的材料
說明中心、退換貨規定、運費表、營業時間、已經結案的工單。PDF、Markdown 或一個網址都可以。
接上通道
你的 LINE 官方帳號、一支 Telegram bot,或在你原本就有的網站上貼一行 script。
設轉手規則,然後看它答不出來的那些題
哪些主題一定要轉給人;以及每週一次,那些它沒有文件可依據的問題。那份清單就是下一份該寫的文件。
通道
答案要出現在客人本來就在的地方。
一個 brain,三個 adapter。同一個問題在三個通道拿到同一個答案,底下也是同一組數字:讀了幾段、送了幾段、引用驗了幾個。
LINE
一張回覆卡:答案、每個來源一顆按鈕直接開到那一頁,以及一顆把對話轉給真人的按鈕。它在讀的時候會先出現讀取動畫。
回覆客人的訊息是免費的,事後主動推播才計額度,所以轉人工的通知走信箱而不走推播。
Telegram
同一個答案,邊生成邊寫出來:訊息是就地編輯的,所以文字會像在網頁上那樣一段段長出來。來源是 inline 按鈕,/human 轉真人。
編輯有節流,最快 1.5 秒一次——內容沒變的編輯會被 API 當成錯誤退回來。
你自己的網站
貼一行 script。它開的是 iframe,所以你的樣式進不來、我們的也出不去;面板會把自己的高度回報給宿主頁面,不會開起來半空或把來源切掉。
跟這一頁上的助理是同一個面板:數字、依據、落選的來源全部印出來,因為機制本身就是產品。
2026-09-02 實測:同一題在 LINE 與 Telegram 上都讀了 28 段、送了 5 段、驗了 1 個引用。三個通道一致是驗收條件,不是加分項。
量出來的
把外面那層程式拿掉,會發生什麼事。
同一個模型、同一份 28 段語料、同一組 30 題。只拿掉模型外面那層程式:挑段落、一段都對不上就停下來、事後驗引用。
| 量的是什麼 | 有那層程式 | 沒有 |
|---|---|---|
| 平均送進模型的來源 | 3 段(240 字) | 28 段(2,076 字) |
| 每題輸入 token | 497 | 2,768 |
| 每題成本(同一組假設單價) | $0.000647 | $0.002959 |
| 30 題全部答得可接受 | 30 / 30 | 23 / 30 |
| 答案不在文件裡的時候 | 完全不呼叫模型 | 照樣寫一段通順的話,還附一個對不上的編號 |
| 宣稱有出處但驗不到 | 0% | 20% |
兩輪對照,都在 2026-09-02 跑在我們自己的機器上。段數與字數來自 qwen2.5:7b 那一輪(30 題 × 3);token、成本與驗證那幾列來自 llama3.1:8b 那一輪(30 題 × 1)。單價是假設值,用來示範算式,不是報價。28 段是很小的語料,這些數字要換到你的文件上重跑過才算數。
我們的機器,或你自己的一台。
整條管線只有一格認得供應商,所以同一個 Desk 兩種接法都跑得起來。差別在對話最後落在哪裡。
裝在你店裡的機器上
- 客人的訊息與你的文件都留在你自己的硬體上
- 沒有按次計費,成本是那台機器與顧它的人
- 模型必須常駐:14B 在這裡實測第一次呼叫 20.7 秒,那是回覆預算的大半
- 對外的網址走 Cloudflare tunnel,通道本身不用錢,要付的是網域
跑在我們的機器上
- 當天就能回答,沒有東西要安裝
- 用得到單一工作站裝不下的大模型
- 客人的訊息會經過模型供應商,這件事你的隱私政策要寫明白
- 按用量計費,所以上面那個送出段數才是要盯的數字
兩邊的檢索、提示與驗證是同一份程式。四個 4B 到 14B 的地端模型跑下來,檢索那幾個數字完全相同:換模型改變的是它把話講成什麼樣,不是它有沒有找到對的那份文件。
另外八個
心裡已經有想法了嗎?
說說你想做什麼,我們會老實告訴你,這件事適不適合交給我們。