這篇來認識 AI 開源模型界的四大天王,Claude/GPT 之外的經濟選擇,或許能舒緩大家的 Token 焦慮。

AI 模型的 App Store + 路由器平台 - OpenRouter,前陣子發了一篇部落格文章,整理目前眾多開源模型中,最頂尖的四款主流模型,有些在特定應用的表現逼近 OpenAI/Anthropic 先進模型,Token 成本卻不到百分之一。

DeepSeek V4 Flash

最大亮點是極佳的性價比,輸出成本甚至只有 GPT-5.5 的 1/150。(註:官方 API 有資料會被用於訓練的風險,歐美托管 API 較貴但較無此疑慮)

在程式碼與 Agent 能力方面表現出色,採用 MIT 授權,缺點在於文案、語氣控制偏弱,且需要較明確 Prompt 指引。

但模型能力偏向技術向,寫文章或把控語氣風格的表現較為一般

GLM 5.2

最大優勢在於任務規劃品質高與長時間的程式碼編寫能力,GLM 5.2 在開源智力指數榜拿下第一名,Agent 基準測試表現基本與 GPT-5.5 的 xhigh 版本相近,也是採用高自由度的 MIT 授權。

但模型輸出時常傾向深入思考,會消耗更多的輸出 Token,實際運行的總成本並沒有單價看起來那麼低。伹由於推出時間較短,目前各家托管平台推理品質參差不齊。

MiniMax M3

本次四款模型中唯一能原生理解影像、圖表和影片的多模態模型(其餘三者只支援純文字),且評測表現接近 Claude Sonnet 4.6。

缺點在於純文字與程式碼能力不如 GLM 5.2,以及採用自家社群協議(非 MIT 協議),商用需標註署名,用於大型商業產品還需要提前取得官方書面授權 。

Nemotron 3 Ultra

NVIDIA 的親生兒子,純正美國本土血統,有完整的軟硬體生態支援,具備極好的部署效率和生態整合性,且包含訓練資料、評估工具與強化學習基礎設施都全面開源。

基礎能力水準比不上 GLM 5.2,程式碼能力也略遜於 DeepSeek 等模型,此外,它採用 OpenMDW 協議,開放程度不如 MIT 協議。


Comments

# by Pokai

請問, "官方 API 有資料會被用於訓練的風險" , 這句版大如何得知? 好奇.

# by Jeffrey

to Pokai, 就明確寫在服務條款裡,參考:https://chatgpt.com/s/t_6a5192c99044819184088d06bd32e853

# by Ming

中國的AI服務商就算明文表示不會用來模型訓練我也不信啦!中國能信嗎?光是中國的法規就不可信,上層建築不可信,下層自然一樣。

# by joe

真的強烈建議不要用前三個中國的AI服務商

Post a comment