OpenAI 9個月自研「超越Blackwell晶片」,NVIDIA還有護城河嗎?
OpenAI聯合博通推出的推理晶片Jalapeño首次曝光實測數據:每瓦算力領先NVIDIA同類系統1.5至1.9倍,響應速度快1.7至3.6倍。高盛認為,這並不是「NVIDIA終結者」,而是AI硬體從壟斷走向多元的信號——訓練端的護城河仍然存在,但推理端的利潤蛋糕,正在被悄悄切割。
OpenAI聯合博通推出的自研推理晶片Jalapeño首次公布實測數據,性能指標顯著超越現有英偉達級別系統,引發市場對AI晶片格局重構的廣泛討論。
據高盛交易部門負責人Rich Privorotsky的最新分析,Jalapeño並非所謂的"英偉達終結者",但其問世標誌著AI硬體市場正從高度集中走向多元分化。這一判斷直接關係到英偉達的長期估值邏輯——不是今年的出貨量,而是未來數年的利潤結構。
對市場而言,此次事件的核心影響有兩個維度:其一,英偉達在訓練晶片和CUDA生態上的護城河短期內不受威脅;其二,推理端這一高頻、高量的日常工作負載,正在成為客製化晶片的主戰場,英偉達的"年金式"收入來源面臨漸進式侵蝕。
Jalapeño的實測數據:推理效能領先,但定位明確
OpenAI與博通聯合設計的Jalapeño晶片近期公布了首批公開基準測試數據。測試結果顯示,該晶片每瓦可完成的AI運算量是同類英偉達系統的1.5至1.9倍,回應速度則快1.7至3.6倍。
從硬體規格來看,單顆Jalapeño晶片額定功耗約700瓦,實際運作功耗通常更低。一個完整機架可容納128顆晶片,搭載約27.5TB的HBM4高頻寬記憶體,每顆晶片的記憶體頻寬達15.4TB/秒。
值得注意的是,OpenAI並未在記憶體配置上妥協——這是一顆刻意追求頻寬密集型設計的晶片,而非通過削減記憶體來壓低成本。
Jalapeño的部署計劃是今年晚些時候小規模啟動,2027年進入量產爬坡階段。OpenAI方面已明確表示,該晶片是英偉達等合作夥伴的補充,而非替代。
訓練與推理的本質分野:英偉達的護城河在哪裡
理解此次事件的關鍵,在於區分AI晶片的兩類核心工作負載。
訓練是"上學"——將海量資料餵給模型並更新權重,任務複雜、規模龐大、耗時漫長,仍然高度依賴英偉達式的通用GPU。推理是"工作"——用戶向ChatGPT提問、智能體預訂機票、程式工具生成函數,模型已經訓練完畢,需要的是以最低成本、最快速度輸出結果。
Jalapeño是一顆推理專用ASIC(客製化晶片),而非訓練晶片。用Privorotsky的比喻:GPU是瑞士軍刀,ASIC是主廚刀——後者在特定任務上更出色,但無法替代前者的通用性。
這意味著,OpenAI在可預見的未來仍需採購英偉達GPU用於模型訓練和研究工作。Privorotsky明確指出,Jalapeño不會造成"英偉達需求的懸崖式下滑",但"AI硬體的討論邊界正在持續擴大"。
混合轉移,而非行業消亡
Privorotsky在分析中提出三個核心論點。
第一,客製化推理晶片已不再是實驗室項目。一家沒有半導體歷史的軟體公司,能在極短周期內與博通聯合推出性能可觀的晶片,證明進入這一領域的門檻已大幅降低。
第二,這不代表英偉達今年需求下滑。訓練、研究以及大量非標準化工作負載仍需通用GPU,而第一代客製化晶片出貨量有限、交付周期偏長。
第三,從更長週期來看,AI推理業務中越來越多的工作負載將遷移至專用晶片。這是一種"混合轉移"——改變的是利潤的歸屬,而非行業的規模。
高盛同時指出,此次事件對記憶體行業並不構成利空。一個搭載27.5TB HBM4的128晶片機架,意味著OpenAI將向SK海力士、三星、美光等記憶體供應商支付更高的單位有效瓦特費用。推理遷移至客製化晶片,不會減少對高頻寬記憶體的需求,反而可能加劇稀缺性。
AI輔助晶片設計:真正被低估的敘事
Privorotsky在分析末尾提出了一個被市場普遍忽視的問題:一家沒有晶片設計歷史的公司,為何能在創紀錄的時間內完成這顆晶片?
高盛的答案是:強化學習與AI輔助設計循環——用模型探索電路方案、壓縮設計-測量-驗證週期,再用AI生成運行在新晶片上的軟體程式碼。
這一"遞迴"邏輯意味著,AI正在參與設計運行AI的機器本身。如果這一設計循環持續有效,通用GPU圍繞軟體生態構建的護城河,在穩定推理場景下將逐漸變薄。
對整個行業而言,編譯器、核心生成器以及"為晶片寫程式的模型",正在從邊緣工具演變為戰略基礎建設。
生態系統的重新分層:誰受益,誰承壓
英偉達:短期無虞,長期面臨結構性壓力。訓練叢集、CUDA生態、網路互聯以及"週二就能跑新模型"的靈活性,仍構成真實護城河。但若推理這一高頻日常工作負載持續向ASIC遷移,英偉達將保住"淘金熱",但逐步失去部分"年金"。這是一個關乎估值倍數的多年期問題,而非2026年的出貨量危機。
博通及客製化晶片代工廠:成為每一家想要自研晶片、但不想成為台積電的公司的"軍火商"。客製化推理是一門服務與網路業務,更多的Jalapeño意味著更多的封裝、SerDes及機架級製造需求。
模型實驗室:Jalapeño是一件利潤武器和產品武器。擁有自研推理晶片的實驗室可以降價、提高速率上限,或允許智能體在帳單失控前執行更多步驟。只租用GPU的實驗室,租的是別人的成本結構;擁有推理晶片的實驗室,可以重新定義產品本身。Google為此建了TPU,亞馬遜為此建了Trainium,OpenAI剛剛帶著公開成績單加入了這場競賽。
用戶與定價:推理成本下降通常帶來兩個同步結果——基礎層價格下降,前沿層因模型更大、更具智能體特性而更貴。每token總擁有成本的下降,是同時實現"20美元聊天機器人"和"每月2000美元智能體服務"的數字基礎。
免責聲明:文章中的所有內容僅代表作者的觀點,與本平台無關。用戶不應以本文作為投資決策的參考。
您也可能喜歡
好萊塢醞釀「影視製作回流」!美國經濟「軟著陸」迎來2491億美元影視激勵藍圖助力
一項研究顯示,聯邦政府對電影及電視製作的激勵措施,至2035年將為美國經濟帶來2,491億美元收入,並新增143,500個全職工作機會。美國電影協會一直與好萊塢工會合作,發起一場爭取國家激勵措施的運動,以更好地與英國及澳洲等市場競爭。

今晚,「鴿派加息」?
美聯儲今晚加息幾乎已成定局,但關鍵在於「加息後會說什麼」。花旗將此次行動定義為「微調」,暗示未來不一定會繼續加息,但警告如果主席沃什沒有給予明確的前瞻指引,將可能引發市場劇烈波動;高盛則直言此次加息缺乏充足經濟基礎,通脹僅屬一次性因素,預計將是一場「無信號加息」。
摩根大通:「開源衝擊」、「AI安全」都不是問題,未來兩年資本支出仍有空間,半導體設備將成「新瓶頸」
摩根大通認為,開源模型並非威脅、監管 擾動屬於短期現象、雲廠商槓桿仍然偏低——算力投資基本面並未改變。其預測七大科技巨頭資本支出將從2025年的4430億美元飆升至2027年的1.577萬億美元,半導體設備將成為供應鏈最核心瓶頸,晶圓代工與先進封裝將迎來新一輪漲價周期。
美光高管:儲存決定AI上限,實質性新增產能要到2028年後
美光高管Sumit Sadana表示,記憶體頻寬與容量已成為決定AI系統效能上限的核心要素。面對供需結構性失衡,美光預計將2027財年資本支出提升至超過450億美元,但受限於製程複雜度,實質性新增產能需到2028年才能釋放。此外,長期供應協議正在重塑產業商業模式,人形機器人將引爆下一波海量需求。
