The Anatomy of Effective Commerce Agents:電商 agent 的架構、效能與上線
這是什麼
Anthropic 官方的電商 agent 建置指南,分三部分:架構、效能、上線。講怎麼蓋一個能幫消費者買東西、幫商家管營運的 AI agent。對象是零售、旅遊、電信、票務這類產業的工程團隊。
核心概念怎麼運作
最反直覺的主張是:用一個模型加上 skills,不要用一堆各司其職的子 agent。原因是子 agent 之間交接本身就是成本,也是出錯的來源——原文把它叫做「交接稅」。
agent 由四個零件組成:幾乎每輪都用得到的規則、按領域載入的作業流程、呼叫後端系統的工具,以及專門用來畫 UI 的工具。分配原則是頻率——高頻的常駐,低頻的按需載入。
速度分兩種處理:真正花掉的時間靠減少來回次數,使用者感覺等了多久則靠元件邊串流邊畫、以及具體的進度提示。
安全寫在程式裡,不是寫在提示詞裡。核心是「模型只負責提案,實際執行要由人或政策批准」,沒有任何模型直接碰金流。
解決什麼問題
電商 agent 直接碰錢,出錯代價很高。而且顧客會用講的問問題,介面必須同時處理「聽懂」和「不能亂做」這兩件事。
用到哪些東西
標準的 agent 迴圈、skills、呼叫後端的工具、畫 UI 的工具、prompt 快取、以及一套用快照跑的行為測試。
設計師可以怎麼用
這篇雖然在講電商,但裡面有四條是所有介面都適用的通則。
一、進度提示要具體。
它舉的例子是顯示「正在找靠水的飯店」,而不是一個轉圈圈。差別在於前者讓等待變成可理解的,後者只是告訴你「還沒好」。
任何載入、送出、上傳都適用。這條你明天就能改,而且不用問任何人。
二、記憶要看得見、改得掉。
只要產品會記住使用者的偏好,就要給一個地方讓人檢視、修正、刪除。而且要以使用者為單位而不是帳號——共用帳號的情境比你想的多,店家的後台尤其如此。
三、版面順序就是「可指涉性」。
使用者會說「第一間」「左邊往下第三個」。這篇要求 UI 元件的參數排列必須跟視覺排列一致,模型才對得上。
對設計師的意思是:在對話式介面裡,你排版的順序不只是視覺決策,它決定了使用者能不能用講的指東西。 這是一個以前不存在的設計責任。
四、有些文字不准 AI 改寫。
費用、法律揭露這類內容,一律用核准過的原文渲染,模型不能自己換句話說。
你在交付時要明確標出哪些字是不可改寫的。否則 AI 會很自然地幫你「優化文案」,然後你就有一個法務問題。
要注意的:這篇假設你已經有商品資料、庫存、金流系統,agent 是加在上面的一層。如果你在想「自己架電商」,順序是先有店,再加 agent,不能反過來。