在英偉達(NVDA)股價因中國初創公司月之暗面(Moonshot AI)發佈開源模型Kimi K3而劇烈震盪之際,英偉達CEO黃仁勳卻在中國公開讚揚中國開源AI“世界級”,並主張美國企業“絕對”應被允許使用這些模型。這一與市場情緒截然相反的舉動,背後暗含著一套自洽的商業邏輯。
7月中旬,Kimi K3正式亮相。該模型擁有2.8萬億參數、100萬tokens上下文窗口,在前端編碼競技場Frontend Code Arena排行榜上登頂,並在GDPval-AA v2測試中取得高分。消息一出,華爾街迅速作出反應:半導體板塊自2026年6月高點下跌超過20%,英偉達一度短暫失去全球市值最高公司的寶座。
就在市場彌漫悲觀情緒之時,黃仁勳現身中國國際供應鏈促進博覽會。他非但沒有唱衰競爭對手,反而點名讚揚了包括Kimi在內的DeepSeek、阿裡巴巴、騰訊、MiniMax、百度等一系列中國開源模型,稱中國開源AI生態充滿活力並具備全球競爭力。他明確表示,美國公司“絕對”應該被允許使用中國的開源AI模型,這一立場與特朗普政府部分官員以及試圖遊說華盛頓全面封禁中國模型的美國AI實驗室直接相悖。
黃仁勳並非毫無保留。他支持限制英偉達最先進的芯片架構——如Blackwell和Rubin——對中國出口。他的核心主張是:硬件可以受限,但軟件不應被禁。他給出的理由是,開源權重模型相比封閉的專有系統反而更有利於安全與協作。
看似“自損式”的站台,實則精准服務于英偉達的長遠利益。半導體研究機構SemiAnalysis的分析揭示了個中玄機。Kimi K3雖然搭載了名為KDA(Kimi Delta Attention)的創新架構,通過選擇性讀取先前token將KV緩存降低75%,推理速度提升六倍,但這並不意味著算力需求下降。相反,Kimi K3的龐大參數量與896個專家的混合專家架構,採用了WideEP技術,將專家分散到多塊GPU上,至少需要56顆芯片才能承載模型推理。SemiAnalysis指出,為了高效運行此類模型,需要配備英偉達GB300 NVL72這類高端參考架構,而KV緩存減少後,跨芯片通信帶寬需求急劇增加,反而強化了對英偉達NVLink互聯技術的依賴。
這正是黃仁勳“反向操作”的精髓。表面上Kimi帶來的效率提升似乎動搖了高端GPU的需求根基,但經濟史上反復出現的傑文斯悖論表明,資源使用效率的躍升往往導致總消耗量不減反增。Kimi對英偉達高性能芯片與高速互聯架構的剛性需求,證明模型效率與算力擴張並非零和博弈。與此同時,監管壓力可能使美國企業優先採用本土模型,但擁抱全球開源生態,無疑將進一步做大整個AI算力市場的蛋糕。
黃仁勳在股價暴跌中力挺Kimi,是一次看似冒險、實則深思熟慮的戰略呼應。他看清了繁榮的開源軟件生態終將需要更強的基礎硬件來承載,而英偉達要做的,就是確保自己始終是那個不可或缺的底座。