Skip to main content
AI Chat v2 API(/aichat2/conversations)是新一代的對話接口,是 AI Chat API 的全面升級版本。它在 v1 簡潔、托管多輪對話的基礎上,擴展了:
  • 多模態用戶輸入:透過結構化 message 欄位直接傳文本 + 圖片 + 檔案塊,無需先用 references 間接附加。
  • Agent 化工具調用:內建一套聯網搜尋、網頁抓取、檔案讀取等工具,並可掛載用戶授權的 MCP 伺服器(Google Drive、Notion、Slack、GitHub 等),模型可在一次請求裡多輪自主調用工具完成複雜任務。
  • 結構化串流事件:透過 accept: text/event-streamapplication/x-ndjson 可拿到逐 token 的 text_deltatool_usetool_resultthinkingcitationcardartifact 等事件,便於在前端按對應類型分別渲染。
  • 可中斷 / 可恢復:模型在需要用戶補充資訊時會發出 ask_user_question 事件並暫停,下次調用透過 tool_results 回填答案即可繼續。
  • 新增 CRUD 動作:在同一個 endpoint 上透過 action 欄位完成 retrieve / retrieve_batch / update / delete,無需額外的會話管理 API。
  • 持續更新的模型列表:預設接入 GPT-5.4、Claude Opus 4.7、Claude Sonnet 4.6、Gemini 3.1 Pro、GLM 5.1、DeepSeek V4、Kimi K2.5 等當代模型。
同時它在請求體層面完全向後相容 v1:只傳 model + question(+ 可選 stateful / id / references / preset)即可得到與 v1 等價的 {answer, id} JSON 回應,所以從 /aichat/conversations 遷移過來不需要重寫客戶端,只需把路徑換為 /aichat2/conversations
如果你目前在使用 /aichat/conversations,舊接口仍會保留服務,可以按自己的節奏遷移。

申請流程

要使用 API,需要先到 AI Chat v2 API 對應頁面申請對應的服務,進入頁面之後,點擊「Acquire」按鈕即可獲取請求所需要的憑證。 如果你尚未登入或註冊,會自動跳轉到登入頁面,註冊並登入之後會自動返回當前頁面。 在首次申請時會有免費額度贈送,可以免費使用該 API。

基本使用

最簡單的用法和 v1 完全一致:傳 model + question,拿到 {answer, id} CURL 範例:
返回結果:
Python 範例:
可用的 model 取值可在右側的 Try 面板下拉裡直接看到,常用類別包括:
  • OpenAI:gpt-5.4-minigpt-5.4-nanogpt-5.2-progpt-5.1-allgpt-5-allgpt-4.1gpt-4ogpt-4o-imageo3o4-mini
  • Anthropic:claude-opus-4-7claude-opus-4-6claude-opus-4-5-20251101claude-sonnet-4-6claude-sonnet-4-5-20250929claude-haiku-4-5-20251001
  • Google:gemini-3.1-progemini-3.1-pro-previewgemini-3.1-flash-image-previewgemini-3-pro-previewgemini-2.5-flash-lite
  • xAI:grok-4grok-4-1-fastgrok-4-1-fast-reasoninggrok-3-mini-fast
  • DeepSeek:deepseek-v4-flashdeepseek-v3.2-expdeepseek-r1-0528
  • Moonshot:kimi-k2.5kimi-k2-thinkingkimi-k2-thinking-turbo
  • Zhipu:glm-5.1glm-5glm-5-turboglm-4.7glm-4.5v
具體計費規則參見服務頁面的 Pricing 卡片。

多輪對話

和 v1 一樣,傳 stateful: true 開啟會話保存,API 會返回一個 id;後續請求把 id 帶回來即可繼續對話,無需自己維護 messages 歷史。 第一次請求:
返回:
第二次請求,帶上同一個 id
stateful 預設是 true,省略和顯式傳 true 等價。如果你不希望服務端保存這一輪對話,可以顯式設定 stateful: false

流式回應

v2 支援兩種流式格式,按照 accept 頭選擇:

NDJSON 範例

NDJSON 每一行都是結構化事件,最常見的是 text_delta

SSE 範例

瀏覽器端使用 EventSource 不支援自訂請求體,建議使用 fetch + 手動按 \n\n 切片解析:

流式事件類型

對於只關心最終答案的客戶端,把所有 text_deltacontent 拼接起來就和 application/json 模式下的 answer 等價。

多模態輸入

如果用戶輸入包含圖片或檔案,傳 message(陣列)代替 question。每個陣列元素是一個內容塊:
支援的塊類型:
  • text — 普通文本,必填 text 欄位。
  • image_url — 圖片,必填 image_url.url
  • file_url — 檔案(PDF、CSV、TXT 等),必填 file_url.url

與 v1 references 的關係

為了相容舊客戶端,v2 仍然識別 references: ["https://...", ...] 欄位:
  • URL 後綴是 jpg / jpeg / png / gif / bmp / webp / svg / heic / heif,自動轉成 image_url 塊;
  • 其他副檔名轉成 file_url 塊;
  • 如果還同時提供了 question,則把它作為一個 text 塊前置。
因此只想從 v1 遷移又不想改請求體的話,把路徑換成 /aichat2/conversations 即可,原 references 用法照常工作。 需要更精細控制(比如把多張圖片放在文本之間、或者順序很重要)就直接用 message 陣列。

工具調用與 MCP

v2 的核心增強點是模型可以自主調用工具完成多步任務,這是預設開啟的,不需要客戶端在請求裡做任何額外配置。常見場景:
  • 用戶問「幫我搜一下最近上海有什麼新展覽」→ 模型調用內建 web search → 把結果整理成回答。
  • 用戶問「讀一下這個 PDF 然後寫個摘要」→ 模型調用 file_read → 寫摘要。
  • 用戶已在 Connections 裡授權了 Google Drive / GitHub / Notion 等 → 模型可調用對應的 MCP 工具讀寫其資料。
在 NDJSON / SSE 串流裡,工具調用透過 tool_usetool_result 兩類事件呈現,例如:
如果你不想在前端展示工具調用細節,忽略 tool_use / tool_result / card / citation 這幾類事件即可,模型最終輸出依然透過 text_delta 流出。 max_turns 可以限制本次請求裡模型最多自我調用工具幾輪,預設上限由平台決定。把它設小(比如 max_turns: 1)可以強制單次回答、不允許任何工具調用。

恢復暫停的對話

某些工具會讓模型「反問用戶」,模型這時會發出一個 ask_user_question 事件,對話被冻结在 awaiting_user_input 狀態:
在前端把這個事件渲染成卡片讓用戶選答案,然後用同一個 id 發起下一次請求,把答案透過 tool_results 回填:
請求體中 tool_use_id 必須和暫停時的 tool_id 完全一致;不一致會返回 400。當請求裡同時存在 tool_results 時,question / message / references 都會被忽略。 如果用戶決定放棄這個問題,直接傳一個新的 question / message 即可,平台會自動把暫停的工具調用標記為「用戶跳過」。

會話管理(CRUD)

v2 在同一個 endpoint 上透過 action 欄位提供輕量級會話管理,無需另外開 API。

action: retrieve —— 拉取一個會話

返回完整的會話文件(包含 messages 歷史、modeltitletools_used 等)。

action: retrieve_batch —— 列出會話摘要

返回 { items: [...], total }摘要不包含 messages,適合做側邊欄列表;如果用戶點開某條會話,再用 action: retrieve 單獨拉取它的完整消息。 可選過濾參數:user_idapplication_idmodel_groupmodel

action: update —— 改標題或重寫歷史

messages 也可以傳,但服務端會做嚴格的 schema 校驗(必須是折疊後的 ToolUseContent 形態),不符合會返回 400。一般只建議用來改 title

action: delete —— 刪除一個會話

返回 { id, success: true }。刪除後無法恢復,請確認後再調用。

從 v1 平滑遷移

如果你已經在使用 /aichat/conversations,遷移到 v2 幾乎不需要改程式碼:
  1. 把 URL 由 https://api.xhuoapi.ai/v1/aichat/conversations 改成 https://api.xhuoapi.ai/v1/aichat2/conversations
  2. 如果你之前傳的是 v1 模型名(如 gpt-3.5gpt-4-browsing 等),切換到 v2 時建議升級到當代模型(如 gpt-5.4claude-opus-4-7gemini-3.1-pro 等)。
  3. NDJSON 串流的欄位保持向後相容:每個 text_delta 事件依然帶 delta_answerid,因此原來按行解析 delta_answer 的客戶端無需改動。
遷移之後可以按需啟用 v2 的新能力(多模態 message、SSE、工具調用、action CRUD),按節奏推進即可。

錯誤處理

錯誤回應統一為:
常見錯誤:
  • 400 bad_request:缺少必填欄位、tool_use_id 不匹配、messages schema 非法等。
  • 401 invalid_tokenauthorization 頭不正確。
  • 404 not_foundaction: retrieve / update / deleteid 對應的會話不存在。
  • 429 too_many_requests:觸發了速率限制。
  • 500 chat_error:上游 LLM 報錯或本輪 completion_tokens=0(按未消費處理,不會扣費)。
在流式回應裡,錯誤以 {"type":"error","message":"..."} 事件發出,緊接著串流就會結束。

結論

AI Chat v2 API 在向後相容 v1 的同時,把對話從「單輪 / 多輪問答」升級為「Agent 化的可觀測對話」:多模態輸入、工具調用、可暫停 / 可恢復、流式結構化事件、內建 CRUD。建議新接入直接使用 v2;已有 v1 集成可以分階段平滑遷移。如有任何問題,請隨時聯繫我們的技術支援團隊。