網路 2026-07-28

導讀:2026年7月,中國AI圈被一個叫Kimi K3的模型攪動了。上線不到一周,它成了硅谷和國內開發者社區中最割裂的存在——有人驚呼“國產旗艦終於追上了”,有人吐槽“根本沒法好好用”。 這種褒貶不一,不是誰在黑誰,而是Kimi K3身上恰好同時具備了天使和魔鬼的兩面。

讓人興奮的:它真的能“幹活”了

如果你只看榜單,Kimi K3的成績單確實漂亮。2.8萬億參數、100萬token上下文,在Artificial Analysis綜合智慧指數上排名全球第三,僅次於Claude Fable 5和GPT-5.6 Sol;更是在前端代碼盲測中登頂Arena榜首,壓過所有美國閉源模型

但真正讓開發者覺得“真香”的,不是跑分,是它在真實任務裏的表現。

一個最出圈的測試是:讓Kimi K3從零復刻一個《GTA5》風格的網頁遊戲。在完全無人幹預的Auto模式下,它生成了一個可玩的開放世界——有駕駛系統、碰撞體積、警察追捕邏輯,甚至玩家犯罪後警車會趕來、警察會下車開槍、直升機探照燈搜索玩家。這些細節說明它真的理解了遊戲機制,而不只是堆代碼。

另一個讓硅谷創業公司緊張的點是:它已經悄悄嵌入生產流程。SpaceX旗下代碼工具Cursor的核心跑在Kimi前代模型上,DoorDash把低級別工作交給了Kimi。K3發布後,近200家美國創業公司聯名警告政府:如果封禁中國開源模型,“將有數百家公司瞬間死亡”

“審美”是另一個讓用戶買單的理由。和GPT-5.6 Sol同題PK時,K3生成的3D迷宮帶像素風,火炬和牆面紋理更有設計感;“日本武士拔刀”動畫色彩更濃烈、視覺衝擊力更強。在“好不好看”這件事上,不少測評者認爲K3贏過了Sol。

讓人頭疼的:慢、貴、還買不到

如果說“強”是共識,那“慢”就是另一個共識。

同樣一個3D迷宮遊戲,GPT-5.6 Sol已經能玩了,Kimi K3還在加載;生成時間通常是Sol的兩到三倍,視頻剪輯任務能花近兩個小時。有用戶調侃:“用它幹活,得先泡杯咖啡,喝完它還沒做完。”

價格也讓很多人犯了難。API輸出定價每百萬token 15美元,雖然只有Fable 5的三分之一,但比國內對手智譜GLM-5.2貴了3倍多,比DeepSeek更是貴了一個量級。更現實的問題是:K3完成單個任務的token消耗量偏高,開個699元最高檔會員,一天測幾個任務就消耗了5億token

最魔幻的是,上線48小時服務器就被擠爆,月之暗面直接宣布暫停C端新用戶訂閱。想花錢買會員?對不起,排隊等着算力擴容。

爭議背後:兩個更根本的問題

表面的褒貶之下,其實藏着兩個更深層的博弈。

第一,開源到底是“加速”還是“減速”? 硅谷爲此吵翻了。OpenAI戰略主管公開說開源模型是“減速主義”,會削弱前沿實驗室利潤、拖慢最強模型發展;黃仁勳則反駁說“免費的AI對芯片好”,更便宜的模型會讓更多人用AI,算力需求反而會增加。這場爭論的結果,可能影響美國是否會用政策手段封堵中國開源模型。

第二,Kimi要走哪條路? DeepSeek當年引爆市場,靠的是“能力接近前沿+價格斷崖式下跌+權重立即開源”三件事同時發生。而K3的定價在國內算貴的,完整權重承諾7月27日才發布。月之暗面選擇了一條不一樣的路——不做“價格屠夫”,而是希望靠真正的任務交付能力贏得付費用戶。這條路能走通嗎?只有時間能回答。

總結

Kimi K3之所以褒貶不一,因爲它既不是“完美神器”,也不是“營銷噱頭”。

它確實在某些場景裏做出了讓人驚豔的復雜作品,也確實驗證了中國模型能擠進全球第一梯隊的技術實力。但同時,它的速度、成本和可用性,離“讓人用得舒心”還有明顯距離。

這是一個“上限很高、下限還沒穩住”的產品——如果你願意爲它的審美和復雜任務能力買單、且不介意等一等,它可能會給你驚喜;如果你追求穩定、快速、省心,那它現在的槽點也是真實存在的。

免責聲明:凡注明來源中國制造網的所有作品,均爲中國制造網合法擁有版權或有權使用的作品,歡迎轉載並注明出處。非本網站作品均來自互聯網,僅代表作者本人的觀點,中國制造網轉載目的在於傳遞信息,並不代表本網贊同其觀點或對其真實性負責。因作者信息不明等原因,中國制造網使用的部分作品報酬未及時支付,相關權利人可與本網聯系。

分享到: