Qwen3.5 Plus:完整規格、定價、API 串接及應用場景(2026)
Qwen3.5 Plus 為阿里巴巴 Qwen 系列的原生視覺-語言大型模型,專為推理、程式設計、長上下文處理、視覺理解及 Agent 工作流程設計。根據官方文件,Qwen3.5 Plus 支援文本、圖像與影片輸入,輸出為文本,並具備可切換思維模式,以及 100 萬 token 的上下文視窗。本文將結合實際應用解析這些參數的意義,並以 Gate.AI 於 2026年4月27日掛載之參數作為定價與型號參考。
什麼是 Qwen3.5 Plus?
Qwen3.5 Plus 屬於阿里巴巴 Qwen3.5 原生視覺-語言模型系列的 Plus 級別。阿里雲於 2026年2月16日於國際市場發布原始 qwen3.5-plus,功能涵蓋語言理解、推理、程式碼生成、Agent 支援、圖像與影片理解、GUI 互動及工具調用。
此模型支援啟用或關閉思維(thinking)模式,方便開發者依需求選擇更深入的推理流程,或在直達型任務中避免不必要的推理開銷。隨後阿里於 4月20日推出新版快照 qwen3.5-plus-2026-04-20,進一步提升了 Agent 領域的程式碼能力與推理速度,同時維持長上下文與推理效能。
需注意,此型號不同於 Qwen3.5 Omni Plus——後者還專注於音訊理解與生成。Qwen3.5 Plus 官方僅支援文本、圖像、影片輸入,輸出為文本。
Qwen3.5 Plus 的核心參數與定價
| 規格 | Qwen3.5 Plus |
|---|---|
| 提供方 | 阿里巴巴 / Qwen |
| 官方模型名稱 | qwen3.5-plus |
| Gate.AI 模型 ID | qwen/qwen3.5-plus |
| 官方發布時間 | 2026年2月16日 |
| Gate.AI 上線日期 | 2026年4月27日 |
| 上下文視窗 | 1,000,000 tokens |
| 最大輸入 | 991,808 tokens |
| 最大輸出 | 65,536 tokens |
| 輸入模態 | 文本、圖像、影片 |
| 輸出模態 | 文本 |
| 思維模式 | 支援 |
| 功能調用 | 支援 |
| 結構化輸出 | 支援 |
| Gate.AI 輸入價格 | $0.115 / 100萬 tokens |
| Gate.AI 輸出價格 | $0.688 / 100萬 tokens |
| Gate.AI 快取讀取 | $0.057 / 100萬 tokens |
| Gate.AI 快取寫入 | $0.717 / 100萬 tokens |
阿里官方確認上下文視窗為 100 萬 tokens,常規最大輸入 991,808 tokens,最大輸出 65,536 tokens。若啟用思維模式,最大輸入為 983,616 tokens。
上表美元價格為 Gate.AI 掛牌價,並非阿里雲直售價格;阿里採區域與上下文級距定價,兩者不完全相同。
以 Gate.AI 掛牌價計算,假設某次請求消耗 100,000 個未命中快取的輸入 token,輸出 10,000 個 token,理論費用如下:
(0.1 × $0.115) + (0.01 × $0.688) = $0.01838
此為理論計算,實際費用仍需根據帳號相關條件調整。
Qwen3.5 Plus 在生產上的核心優勢為何?
其最突出的生產特性為超長上下文視窗結合原生視覺輸入。藉由此模型,工作流程可將長篇技術文件與截圖、流程圖、掃描頁或影片畫格一併處理,無需分別呼叫文本與視覺模型。官方明確表示文件支援文本、圖像、影片輸入,並具備功能調用與結構化輸出能力。
這對需多模態訊息的自動化文件處理系統尤其重要,因為 OCR 僅為流程之一,Qwen3.5 Plus 可進一步對表格、版面、圖表、截圖與相關文本進行整合推理。
多模態 Agent 同樣受益明顯。例如軟體 Agent 可審查介面或截圖,辨識當前狀態,產生結構化訊息,並自動呼叫工具。阿里官方明確將 GUI 互動與 Agent 任務列為此系列目標功能之一。
針對程式設計 Agent,最新4月快照版本特別適用——官方報告此版於 Agent 程式碼能力及推理速度均優於2月版本。
Qwen3.5 Plus 支援哪些輸入輸出模態?
| 模態 | 輸入 | 輸出 | 實際應用場景 |
|---|---|---|---|
| 文本 | 是 | 是 | 聊天、推理、程式設計、長文本解析 |
| 圖像 | 是 | 否 | 截圖、圖表、掃描文件、視覺分析 |
| 影片 | 是 | 否 | 影片理解、視覺序列分析 |
| 音訊 | 無官方支援 | 否 | 建議選用 Omni 或專用音訊模型 |
阿里官方文檔明確說明:圖像、文本、影片為輸入模態,文本為唯一輸出模態。Qwen3.5 Plus 並不支援音訊輸入或輸出,如有相關需求請選用 Omni 系列。
建構多模態流程時須注意此區分:儘管 Qwen3.5 Plus 可理解帶有視覺元素的影片,若涉及原生語音,應選擇專用的 Omni 系列音訊模型。
Qwen3.5 Plus 有哪些侷限?
雖然上下文視窗可達 100 萬 tokens,但實際單次請求可用輸入量有限。常規最大輸入為 991,808 tokens,啟用思維模式時為 983,616 tokens,需預留部分給輸出及推理流程。
此外,Qwen3.5 Plus 僅支援文本輸出,無法直接生成圖像、影片或音訊,因此不能取代專業內容生成模型。
截至 4 月快照,阿里官方尚未釋出本版本的微調(fine-tuning)及批次推理支援。若需託管微調或大規模批次任務,請評估是否有其他型號更合適。
最後,超長上下文模型雖提升便利性,但也代表更高的成本與運算需求。建議按需篩選關鍵資訊填入上下文,而非盲目填滿整個視窗。
Qwen3.5 Plus 最適合哪些場景?
Qwen3.5 Plus 於以下複合需求場域展現明顯優勢:
- 大文件解析:如契約、研究報告、程式碼庫、操作手冊或學術資料,須持續存取大量上下文。
- 文件與視覺解析:流程上需處理文本與截圖、掃描件、表格、圖表或流程圖。
- 多模態 Agent:系統須理解視覺狀態,後續呼叫工具或生成結構化輸出。
- 程式設計 Agent:特別適用於需長上下文、反覆推理或工具鏈整合的軟體開發流程。
- 影片理解:需從影片分析或擷取多段內容。
若需同時結合超長上下文與視覺推理,建議優先考慮 Qwen3.5 Plus。若為短文本、極度重視延遲或預算有限的應用,則可選擇更輕量化模型。
Qwen3.5 Plus 與 Qwen3.5 Flash、Qwen3.6 Plus 有何不同?
| 型號 | 定位 | 多模態輸入 | 上下文規模 | 理想用途 |
|---|---|---|---|---|
| Qwen3.5 Plus | Qwen3.5 高效能 Plus 版 | 文本、圖像、影片 | 1M | 長上下文、推理、多模態 Agent |
| Qwen3.5 Flash | Qwen3.5 效能效率優先型 | 文本、圖像、影片 | 長上下文 | 高效率、低延遲、重視成本的流程 |
| Qwen3.6 Plus | 新一代 Plus | 文本、圖像、影片 | 長上下文 | 程式設計和視覺能力更強的升級情境 |
Qwen3.5 Flash 較適合針對吞吐量與成本效率要求高的應用——阿里官方強調 Flash 主打響應速度,整體能力接近 Qwen3.5 Plus。可詳見 Qwen3.5 Flash 參數與定價指南。
Qwen3.6 Plus 屬新一代升級型號,重點在程式碼生成、視覺解析等能力提升。阿里指出,其於 Agent 編碼、前端開發、OCR、物件辨識及在地化處理等皆優於 Qwen3.5 Plus。
因此,選型時可根據實際需求決策:Qwen3.5 Plus 適用於多模態、長上下文任務;Flash 強調效率與成本,新一代 Plus 型號則適合需先進功能的團隊。
如何透過 Gate.AI 使用 Qwen3.5 Plus?
根據 Gate.AI 官方模型卡,型號標識為:
qwen/qwen3.5-plus
Gate.AI 採用與 OpenAI 標準兼容之 API,基礎網址為 https://api.gate.ai/openai/v1,通過 API-key 認證,支援 Chat Completions 工作流程。也可於呼叫時顯式指定模型,而非仰賴自動路由。
Python 範例
import osfrom openai import OpenAIclient = OpenAI(api_key=os.environ["GATEAI_API_KEY"],base_url="https://api.gate.ai/openai/v1",)response = client.chat.completions.create(model="qwen/qwen3.5-plus",messages=[{"role": "user","content": "Explain the main advantages of a 1M-token context window."}],)print(response.choices[0].message.content)
cURL 範例
curl https://api.gate.ai/openai/v1/chat/completions \-H "Authorization: Bearer $GATEAI_API_KEY" \-H "Content-Type: application/json" \-d '{"model": "qwen/qwen3.5-plus","messages": [{"role": "user","content": "Summarize the benefits of multimodal document analysis."}]}'
上述程式碼均採用 Gate.AI 官方 OpenAI 介面格式,模型 ID 與官網一致,基礎網址及 Chat Completions 工作流程皆可參考官方說明文件。
常見問題解答
Qwen3.5 Plus 是否支援 100 萬 token 上下文視窗?
是的。阿里官方文件明確 Qwen3.5 Plus 支援 1,000,000 token 上下文視窗,常規最大輸入 991,808 tokens,最大輸出 65,536 tokens。
Qwen3.5 Plus 能否理解圖像與影片?
可以。官方文件支持文本、圖像與影片為輸入模態,輸出為文本。
Qwen3.5 Plus 是否支援思維模式(thinking mode)?
支援。官方文件單列思維模式上下文限制,Qwen 工具組也強調 Qwen3.5 Plus 可支援思維驅動的推理流程。
Qwen3.5 Plus 在 Gate.AI 的定價如何?
依 Gate.AI 掛牌價,輸入每百萬 tokens $0.115,輸出每百萬 tokens $0.688,快取讀取 $0.057/百萬,快取寫入 $0.717/百萬。此為 Gate.AI 標準定價,與阿里雲直銷的區域與階梯價格不同。
Qwen3.5 Plus 適合用於文件 OCR 嗎?
其原生圖像理解及多模態文件處理能力,可應用於 OCR 類文件解析,尤其在需整合文本與圖像共同推理時特別合適。實際生產環境中,如對精準轉錄有高度需求,仍建議對輸出進行人工驗證。


