/aichat2/conversations)是新一代的對話接口,是 AI Chat API 的全面升級版本。它在 v1 簡潔、托管多輪對話的基礎上,擴展了:
- 多模態用戶輸入:透過結構化
message欄位直接傳文本 + 圖片 + 檔案塊,無需先用references間接附加。 - Agent 化工具調用:內建一套聯網搜尋、網頁抓取、檔案讀取等工具,並可掛載用戶授權的 MCP 伺服器(Google Drive、Notion、Slack、GitHub 等),模型可在一次請求裡多輪自主調用工具完成複雜任務。
- 結構化串流事件:透過
accept: text/event-stream或application/x-ndjson可拿到逐 token 的text_delta、tool_use、tool_result、thinking、citation、card、artifact等事件,便於在前端按對應類型分別渲染。 - 可中斷 / 可恢復:模型在需要用戶補充資訊時會發出
ask_user_question事件並暫停,下次調用透過tool_results回填答案即可繼續。 - 新增 CRUD 動作:在同一個 endpoint 上透過
action欄位完成retrieve/retrieve_batch/update/delete,無需額外的會話管理 API。 - 持續更新的模型列表:預設接入 GPT-5.4、Claude Opus 4.7、Claude Sonnet 4.6、Gemini 3.1 Pro、GLM 5.1、DeepSeek V4、Kimi K2.5 等當代模型。
model + question(+ 可選 stateful / id / references / preset)即可得到與 v1 等價的 {answer, id} JSON 回應,所以從 /aichat/conversations 遷移過來不需要重寫客戶端,只需把路徑換為 /aichat2/conversations。
如果你目前在使用 /aichat/conversations,舊接口仍會保留服務,可以按自己的節奏遷移。
申請流程
要使用 API,需要先到 AI Chat v2 API 對應頁面申請對應的服務,進入頁面之後,點擊「Acquire」按鈕即可獲取請求所需要的憑證。 如果你尚未登入或註冊,會自動跳轉到登入頁面,註冊並登入之後會自動返回當前頁面。 在首次申請時會有免費額度贈送,可以免費使用該 API。基本使用
最簡單的用法和 v1 完全一致:傳model + question,拿到 {answer, id}。
CURL 範例:
model 取值可在右側的 Try 面板下拉裡直接看到,常用類別包括:
- OpenAI:
gpt-5.4-mini、gpt-5.4-nano、gpt-5.2-pro、gpt-5.1-all、gpt-5-all、gpt-4.1、gpt-4o、gpt-4o-image、o3、o4-mini等 - Anthropic:
claude-opus-4-7、claude-opus-4-6、claude-opus-4-5-20251101、claude-sonnet-4-6、claude-sonnet-4-5-20250929、claude-haiku-4-5-20251001等 - Google:
gemini-3.1-pro、gemini-3.1-pro-preview、gemini-3.1-flash-image-preview、gemini-3-pro-preview、gemini-2.5-flash-lite等 - xAI:
grok-4、grok-4-1-fast、grok-4-1-fast-reasoning、grok-3-mini-fast等 - DeepSeek:
deepseek-v4-flash、deepseek-v3.2-exp、deepseek-r1-0528等 - Moonshot:
kimi-k2.5、kimi-k2-thinking、kimi-k2-thinking-turbo等 - Zhipu:
glm-5.1、glm-5、glm-5-turbo、glm-4.7、glm-4.5v等
多輪對話
和 v1 一樣,傳stateful: true 開啟會話保存,API 會返回一個 id;後續請求把 id 帶回來即可繼續對話,無需自己維護 messages 歷史。
第一次請求:
id:
stateful預設是true,省略和顯式傳true等價。如果你不希望服務端保存這一輪對話,可以顯式設定stateful: false。
流式回應
v2 支援兩種流式格式,按照accept 頭選擇:
NDJSON 範例
text_delta:
SSE 範例
瀏覽器端使用EventSource 不支援自訂請求體,建議使用 fetch + 手動按 \n\n 切片解析:
流式事件類型
對於只關心最終答案的客戶端,把所有
text_delta 的 content 拼接起來就和 application/json 模式下的 answer 等價。
多模態輸入
如果用戶輸入包含圖片或檔案,傳message(陣列)代替 question。每個陣列元素是一個內容塊:
text— 普通文本,必填text欄位。image_url— 圖片,必填image_url.url。file_url— 檔案(PDF、CSV、TXT 等),必填file_url.url。
與 v1 references 的關係
為了相容舊客戶端,v2 仍然識別 references: ["https://...", ...] 欄位:
- URL 後綴是
jpg / jpeg / png / gif / bmp / webp / svg / heic / heif,自動轉成image_url塊; - 其他副檔名轉成
file_url塊; - 如果還同時提供了
question,則把它作為一個text塊前置。
/aichat2/conversations 即可,原 references 用法照常工作。
需要更精細控制(比如把多張圖片放在文本之間、或者順序很重要)就直接用 message 陣列。
工具調用與 MCP
v2 的核心增強點是模型可以自主調用工具完成多步任務,這是預設開啟的,不需要客戶端在請求裡做任何額外配置。常見場景:- 用戶問「幫我搜一下最近上海有什麼新展覽」→ 模型調用內建 web search → 把結果整理成回答。
- 用戶問「讀一下這個 PDF 然後寫個摘要」→ 模型調用 file_read → 寫摘要。
- 用戶已在 Connections 裡授權了 Google Drive / GitHub / Notion 等 → 模型可調用對應的 MCP 工具讀寫其資料。
tool_use 和 tool_result 兩類事件呈現,例如:
tool_use / tool_result / card / citation 這幾類事件即可,模型最終輸出依然透過 text_delta 流出。
max_turns 可以限制本次請求裡模型最多自我調用工具幾輪,預設上限由平台決定。把它設小(比如 max_turns: 1)可以強制單次回答、不允許任何工具調用。
恢復暫停的對話
某些工具會讓模型「反問用戶」,模型這時會發出一個ask_user_question 事件,對話被冻结在 awaiting_user_input 狀態:
id 發起下一次請求,把答案透過 tool_results 回填:
tool_use_id 必須和暫停時的 tool_id 完全一致;不一致會返回 400。當請求裡同時存在 tool_results 時,question / message / references 都會被忽略。
如果用戶決定放棄這個問題,直接傳一個新的 question / message 即可,平台會自動把暫停的工具調用標記為「用戶跳過」。
會話管理(CRUD)
v2 在同一個 endpoint 上透過action 欄位提供輕量級會話管理,無需另外開 API。
action: retrieve —— 拉取一個會話
messages 歷史、model、title、tools_used 等)。
action: retrieve_batch —— 列出會話摘要
{ items: [...], total }。摘要不包含 messages,適合做側邊欄列表;如果用戶點開某條會話,再用 action: retrieve 單獨拉取它的完整消息。
可選過濾參數:user_id、application_id、model_group、model。
action: update —— 改標題或重寫歷史
messages 也可以傳,但服務端會做嚴格的 schema 校驗(必須是折疊後的 ToolUseContent 形態),不符合會返回 400。一般只建議用來改 title。
action: delete —— 刪除一個會話
{ id, success: true }。刪除後無法恢復,請確認後再調用。
從 v1 平滑遷移
如果你已經在使用/aichat/conversations,遷移到 v2 幾乎不需要改程式碼:
- 把 URL 由
https://api.xhuoapi.ai/v1/aichat/conversations改成https://api.xhuoapi.ai/v1/aichat2/conversations。 - 如果你之前傳的是 v1 模型名(如
gpt-3.5、gpt-4-browsing等),切換到 v2 時建議升級到當代模型(如gpt-5.4、claude-opus-4-7、gemini-3.1-pro等)。 - NDJSON 串流的欄位保持向後相容:每個
text_delta事件依然帶delta_answer與id,因此原來按行解析delta_answer的客戶端無需改動。
message、SSE、工具調用、action CRUD),按節奏推進即可。
錯誤處理
錯誤回應統一為:400 bad_request:缺少必填欄位、tool_use_id不匹配、messagesschema 非法等。401 invalid_token:authorization頭不正確。404 not_found:action: retrieve / update / delete時id對應的會話不存在。429 too_many_requests:觸發了速率限制。500 chat_error:上游 LLM 報錯或本輪completion_tokens=0(按未消費處理,不會扣費)。
{"type":"error","message":"..."} 事件發出,緊接著串流就會結束。

