Kimi K3 擊敗 Claude 與 ChatGPT 前端編程能力登全球第一

根據 7 月 16 日公布的排行榜,Kimi K3 以 1,679 分排名第一,領先 Claude Fable 5 的 1,631 分,以及 GPT-5.6 Sol 的 1,618 分。
值得留意的是,上一代 Kimi 模型在同一排行榜僅排名第 18 位,Kimi K3 僅經過一代更新便躍升至榜首,排名大幅提升。
Kimi K3 採用 2.8 兆(2.8 Trillion)參數的 Mixture of Experts(MoE)架構,支援 100 萬 Token 上下文長度,並引入名為 Kimi Delta Attention 的全新混合線性注意力機制,主要提升運算效率。
Moonshot AI 表示,Kimi K3 預計於 7 月 27 日前以修改版 MIT 授權釋出模型權重,屆時除了可透過 API 使用外,亦支援本地部署。
在 API 收費方面,Kimi K3 的定價為每百萬輸入 Token 3 美元、每百萬輸出 Token 15 美元,而長時間對話使用快取輸入 Token 時,收費可降至每百萬 Token 0.3 美元。
與上一代相比,Kimi K3 的 API 收費提高約三至四倍,同時亦高於 DeepSeek V4 Pro、GLM 5.2 等其他中國開源模型。不過,其定價與 Claude Sonnet 5 的標準價格相同,並低於 GPT-5.6 Sol 及 Claude Opus 4.8 的收費水平。
報道指出,Moonshot AI 採用較高定價,反映公司對 Kimi K3 的競爭力充滿信心,希望與 Claude、ChatGPT 及 Gemini 等國際主流 AI 模型正面競爭。
不過,Arena.ai 的 Frontend Code 排行榜主要反映人類評測者對前端程式開發能力的偏好,因此目前仍只是其中一項參考指標,Kimi K3 後續表現仍有待更多基準測試及獨立評估進一步驗證。
