Deepseek v3.2...新的開源SOTA(12月1日)
精煉的資訊流 剛剛在地鐵上研究了deepseek的發佈...
下面快速整理了一下,
1/ Deepseek這次發佈,跑出來的效果是非常驚艷的好。
- 毫無疑問的開源sota;
- 各項能力基本上對標的也是閉源的前沿模型;
2/ 技術面不是說非常新,
- 還是沿用DSA + post train佔比超過10%也不是大新聞;
- 增量資訊是,用上次v3.2實驗版的這些東西,搞出來的效果這麼好,直接對標gemini3.0這種最新發佈的SOTA;
- 現在學術文獻已經不容易推動市場敘事;這次能力跑出來會更加直觀。
3/ 大家最擔心的算力塌縮?並不存在。
按照deepseek自己的說法,我們才和最前沿模型仍有差距。
換個角度看,模型層的「知識護城河」虛無縹緲,算力仍然是差異化因素。
Deepseek研究員Zhibin Gou的看法;gemini3證明pretrain..deepseek 3.2證明RL;
繼續在各個層面上做scaling;不要讓撞牆的噪音干擾。
更重的 RL、更長的 CoT、更多推理時計算力消耗;不會得出算力通縮的敘事。
4/ 從應用的角度看...肯定是利多的。引用星友的說法,
-
「對算力的需求永無止境,其實現在的token成本實用價值很低,只有通過硬體和模型創新把成本幾何級的降下去才能大規模應用」
-
對於想要靠「模型能力」建立應用護城河的公司(比如某OAI),倒是一個很大的敘事削弱。
5/ Deepseek自稱tokens的使用效率「inferior」...這裡在Speciale版本裡,用的tokens數量是更多了...(紅框那裡)..
6/ 彩蛋部分,Zhibin Gou說他們花了一年時間把v3推向極限...有些星球微信群友的看法是,把v3榨乾了,下一個版本終於要上v4了?
7/ 今天似乎是ChatGPT推出的3週年...
今晚市場應該會挺波動的...日本一些亂七八糟的宏觀因素+BTC攪亂;
下一個小的催化事件可能是亞馬遜的re:invent;早上群裡也做了一點點前瞻。
免責聲明:文章中的所有內容僅代表作者的觀點,與本平台無關。用戶不應以本文作為投資決策的參考。
您也可能喜歡
高盛:別等中期選舉,「金髮姑娘」行情或提前點燃美股年末行情
高盛認為,市場已過度定價滯脹與高收益率風險,關稅效應減弱、能源或將迎來通縮,AI消費化降低成本將推動通脹回落;增長雖然放緩但核心盈利依然強勁,央行鷹派政策空間受限。「金髮姑娘」情境下,AI FOMO再度升溫,無需等待中期選舉,「金髮姑娘」行情或將提前燃點美股年底行情。
三季報在即,三星電子和海力士面臨「極高預期」,考驗「全球AI交易」
AI浪潮推動全球半導體「超級週期」,三星與SK Hynix第三季合併營業利潤或將逼近190兆韓元歷史紀錄。HBM4爭奪戰進入白熱化階段,智能體AI將記憶體頻寬需求推升十倍,記憶體正成為AI數據中心真正的「血液」。兩份即將出爐的財報,將決定這場繁榮究竟是曇花一現,還是能帶來重塑科技基礎建設的結構性變革。

Meta AI主管Alexandr Wang:為何我要做Muse
Muse上線12天狂攬280萬下載,超越ChatGPT同期 表現,單日創下26.4萬次美國紀錄——Meta市值隨之暴增2340億美元。這背後,是首席AI官Alexandr Wang那封談論「人類渴望」的公開信,以及扎克伯格當年那筆曾被嘲笑為「瘋狂」的143億美元收購:如今看來,這或許是矽谷史上最划算的一筆人才收購。
瑞銀:維持特斯拉 (TSLA.US)「中性」評級 目標價385美元 AI敘事主導股價定價邏輯
瑞銀預測,特斯拉 2026 年第三季度(3Q26)全球交付量約為 47.0 萬輛,年減 5%,季減 1%。
