模型比較 / 審閱於 2026 年 8 月 2 日

DeepSeek V4 Flash 0731 GLM-5.2

這份指南協助團隊在著重 AI 代理工作流程的 DeepSeek API 更新與開放權重推理模型之間作選擇,並清楚分開供應商資料與獨立測量。

可確認的比較範圍

獨立指數分數相近;發佈記錄與實際使用路徑則不同。

項目DeepSeek V4 Flash 0731GLM-5.2
發佈記錄2026 年 7 月 31 日 V4-Flash API 更新;DeepSeek 表示模型沿用預覽版的架構和規模,並調整了後續訓練。獨立追蹤資料記錄 GLM-5.2(max)於 2026 年 6 月發佈;最新產品條款請直接向 Z.ai 查閱。
上下文官方文件列出 100 萬 token 上下文視窗。Artificial Analysis 為 GLM-5.2(max)列出 100 萬 token 上下文視窗。
獨立指數社群報告和獨立追蹤資料把更新後的 Flash 列於 Intelligence Index 約 50 分;這並非 DeepSeek 的官方主張。Artificial Analysis 在同一套指數中為 GLM-5.2(max)報告 51 分。
價格資料請使用最新 DeepSeek 價目表;價格以人民幣發佈,並按快取狀態和使用方式而異。Artificial Analysis 為其中一條追蹤路徑列出每百萬 token:輸入 1.40 美元 / 輸出 4.40 美元;供應商實際定價可能不同。
建議先測試工具調用能否連續運作、長時間多步驟編程,以及團隊實際採用的 API 整合路徑。推理及編程任務,以及團隊計劃採用的權重、供應商與授權路徑。

解讀

不要憑一分差距作採購決定。

50 與 51 的差距很小,應先安排實測,而不是就此下結論。該指數採用既定評估項目,未必能反映團隊實際使用的工具、提示詞、重試方式、延遲預算或部署選擇。

方法與來源

逐項核實,而非只看綜合排名

DeepSeek 的發佈與 API 資料來自官方發佈說明最新定價文件

GLM 數據和指數背景來自 Artificial Analysis 的 GLM-5.2 模型頁及相關方法文章;兩者均屬獨立追蹤來源,不是供應商的證明文件。