來源于:32天就下架,DeepSeek為何對自家旗艦下狠手-開云線上登錄平臺入口
發布時間:2026-09-13 07:11:42
文章摘要:
32天就下架,DeepSeek為何對自家旗艦下狠手-開云線上登錄平臺入口:32天就下架,DeepSeek為何對自家旗艦下狠手-開云線上登錄平臺入口 32天就下架,DeepSeek為何對自家旗艦下狠手-開云線上登錄平臺入口
出品 | 智能 作者 | 小扣 編輯 | 王鳳枝 從正式發布到被Flash接替,天下DeepSeek只給V4 Pro正式版留了32天。何對 9月10日,旗艦開云官方在線注冊DeepSeek發布V4.1 Flash,下狠同時宣布:從北京時間9月14日中午12點起,天下官方API中發給V4 Pro的何對請求,將全部由Flash接手,旗艦并按更低的下狠Flash價格收費。這項安排會一直持續到V4.1 Pro推出。天下 V4 Pro從4月24日開始提供預覽版,8月13日才正式發布。旗艦正式版上線還不到一個月,下狠公司就已經定好了它的天下"退場時間"。 更值得追問的何對是,DeepSeek為什么不把Pro降價保留下來,旗艦或者干脆等下一代Pro準備就緒,再讓兩者正常交班? 我的判斷是,V4 Pro仍有強項,卻已不值得DeepSeek繼續單獨投入算力。讓架構更高效、已在多項智能體測試中反超的V4.1 Flash接手,既能降低公司的運行開銷,也能把用戶的開云官方在線注冊賬單降下來。 01 Flash追上了Pro上個月主打的方向 一個月前,V4 Pro正式版上線,它主打的方向非常明確:智能體、代碼編程和工具調用。DeepSeek當時為它開放了不同推理強度,還專門適配了Codex,希望它能接下更復雜、流程更長的工作。 但正式版上線當天就出了狀況:官網通知和開放平臺公告一度撤下,當晚才恢復,期間API調用入口始終保留。另據媒體報道,部分開發者還反饋模型思考時間過短、長任務中途提前結束,同一道題隔幾個小時再跑,結果也可能差別很大。 緊接著的漲價,又抬高了它要兌現的標準。8月17日起,Pro高峰時段的輸出價格從每百萬Token 6元漲到27元,是原來的4.5倍。對已經覺得表現不穩的開發者來說,這筆多出來的支出,很難說換回了對應的提升。 現在,新發布的Flash恰好在這些關鍵方向上趕了上來。 官方數據顯示,在軟件工程測試DeepSWE v1.1和辦公自動化測試AutomationBench中,Flash分別以74.2分和54.8分,大幅領先V4Pro的62.7分與43.2分。新模型打贏的,恰恰是Pro上個月主推的任務。 Pro并非每項都輸。在不調用工具的HLE純文本子集中,它仍以42.7分領先Flash的39.1分;但在允許使用工具的完整HLE測試中,Flash拿到了63.9分,高出Pro的60分。此外,在后訓練前的基礎模型對比里,Pro仍在SimpleQA-Verified知識問答和LongBench-V2長文本測試中保持領先。 因此,DeepSeek官方公告中的"全面超越",不能簡單理解為每個分項都勝出。Pro依然有擅長的事,對恰好需要這些特定能力的用戶來說依然有價值。真正發生動搖的,是旗艦產品原有的商業定位。 過去,開發者和企業很容易理解兩檔模型的劃分:預算有限選Flash,復雜長任務交給更貴的Pro。如今Flash已在多項主流智能體測試中反超,Pro很難再靠"更貴,但普遍更強"的標簽說服市場。廣泛領先足以支撐一檔面向大眾的高客單價旗艦;但如果只在部分細分任務里占優,公司就必須重新核算:還有多少人離不開這些能力,愿意為此多付多少溢價,又是否值得專門劃撥算力集群來支撐。 公開資料還沒有給出具體的成本和用戶細分賬本。但從DeepSeek的產品動作來看,它顯然放棄了為舊Pro保留一個獨立專屬檔位的念頭。 02給Pro降價,省不下運行它的開銷 如果問題僅僅在于Flash便宜,Pro自然也可以跟著降價促銷。難處在于,降價只能改變賬單上的數字,卻改變不了模型底層的物理消耗。 按照官方模型卡披露的數據,V4 Pro每個Token激活的參數量高達490億。而V4.1Flash將處理輸入與生成回答解耦,分別僅激活80億和160億參數。參數比例固然不能直接等同于成本降幅,但兩者每一次前向推理所調用的計算規模已完全不在一個量級。 新架構還在大幅壓縮長上下文任務的存儲開銷。相比V4 Flash,V4.1 Flash的全局KV緩存占用降到了約四分之一,持久化KV緩存占用的SSD空間降到了約八分之一。智能體運行需要反復讀取上下文代碼、參考文檔和外部工具返回的數據,緩存專門用來存放大模型計算過的歷史狀態。一旦任務周期拉長、并發量攀升,存儲顯存就會迅速見底。Flash要解決的從來不只是答對一道題,還有海量并發任務同時跑起來時的資源擠兌。 DeepSeek在發布公告中直接談到,更高的架構效率讓公司能以更低成本承載更多并發,因此順理成章地下調了價格。 截至9月11日,按谷時每百萬Token計算,V4 Pro未命中緩存的輸入價格為4.5元,輸出為13.5元;V4.1Flash對應則只要1元和4元(兩款模型的峰時價格均為谷時的兩倍)。隨著切換落地,原本昂貴的Pro接口,收費也會直接降到Flash的水平。 兩者定價差異雖然不等同于DeepSeek真實的物料成本,但策略指向十分清晰:用高效率的新架構全面承接老接口的請求,再把節省下來的硬件成本讓渡給市場。給Pro降價,平臺仍要獨自承擔沉重的推理與維護開銷;換成Flash,才有機會把用戶賬單和服務器負載同時降下來。 大模型跑完訓練,花錢的無底洞并沒有關上。它每響應一次調用,都在實時占用算力資源,運營維護也一刻不能停。"剛花了巨資訓出來"無法成為保留舊Pro的免死金牌。沉沒成本已成事實,維持老模型運轉卻需要持續消耗真金白銀。就算舊Pro還能繼續賺流水,但同樣的硬件算力,拿去跑效率更高的新模型顯然更劃算。 03 16萬顆昇騰芯片,交付可能要一年以上 結合DeepSeek近期的幾個關鍵動作,更能看懂這種資源騰挪背后的緊迫感。 今年8月,DeepSeek上線了峰谷浮動定價,引導那些非實時的批處理任務轉向閑時運行。這本質上是在外部硬件受限的情況下,先從內部調度把現有的算力吃干榨盡。 硬件采購方面同樣在推進,但遠水難解近渴。彭博社9月4日援引知情人士報道稱,DeepSeek計劃在內蒙古的數據中心部署至少16萬顆華為昇騰950DT芯片,目前主要規劃用于模型推理而非訓練。但報道同時提及,華為產能需要兼顧多家客戶,受制于供應鏈瓶頸,整個訂單交付周期可能長達一年以上。 DeepSeek融資也在提速。路透社9月9日援引知情人士消息稱,DeepSeek已聘請中信證券推進科創板IPO進程,籌資主要為了填補算力基建、模型前沿研發與頂尖人才招募的資金缺口。不過上市時間表、募資額度與估值目標尚未最終敲定,DeepSeek與中信證券均未對此置評。 將這幾塊拼圖放在一起,勾勒出的是一家渴望高速擴張、卻又時刻受制于物理資源邊界的創業公司。向外采購硬件、謀求IPO融資,解決的是長期的資源增量;而在算法架構上死磕效率,則是為了讓現有的存量算力抗住更大的調用洪峰。前者需要漫長的交付周期和資本運作,而后者只要技術成熟,立刻就能在現有業務中釋放運力。 在如此緊繃的資源約束下,繼續維持舊旗艦固然可行,但性價比極低。當更輕量、更便宜的模型已經能勝任絕大多數核心任務時,舊Pro僅存的那幾個單項優勢,實在很難說服團隊繼續分流寶貴的集群來為它托底。 創始人梁文鋒此前與投資人溝通時,就曾明確過這種取舍。他明確將長期的AGI探索置于短期利潤最大化之上,認為開源模型與商業化完全能夠自洽,并直言算力是當前業務擴張的核心瓶頸。 從這個視角回看這次"閃電換模",我更傾向于一種戰略解釋:DeepSeek的目標是在推進下一代前沿探索的同時,把現有服務規模盡快推向極致。既然新技術已經徹底重構了算力成本與性能曲線,產品矩陣就必須雷厲風行地重排,根本沒必要給上一代旗艦強行留出漫長的溢價保護期。 04 DeepSeek沒有等下一款Pro 這次換代最引人注目的特質在于它的決絕:DeepSeek甚至沒有等V4.1 Pro成型。 按照常規商業軟件的做法,它完全可以先保留舊Pro的獨立通道,安撫那些依賴老模型的企業客戶,同時把Flash作為降配平替推出;等到下一代Pro全面成熟,再按部就班地完成階梯式迭代,讓產品線看起來平滑整齊。 但DeepSeek公布的是另一種安排:舊Flash由V4.1 Flash接管,舊Pro的API流量也將在9月14日后強行并入Flash。雖然保留了原有的接口名,計費也直接打折,但底層的模型內核已經被徹底替換。官方仍然提到了未來的V4.1 Pro,只是沒有為了等它,繼續保住舊Pro的位置。DeepSeek愿意讓自己的新技術先淘汰自己的舊旗艦,研發投入多少、上線才剛滿月,都沒有變成必須保護下去的理由。 不過,接口名不變,并不意味著開發者可以高枕無憂。許多企業此前圍繞舊Pro精細調優的Prompt框架、系統設定和多步工具調用鏈路,大概率都需要在新模型上重新跑一遍回歸測試。如果某些重度依賴Pro長文本或純文本推理的任務表現出現滑坡,社區與企業客戶要求保留老通道的呼聲,同樣有其現實合理性。 這給還沒亮相的下一代Pro設了個難題:如果它要重新以更高價格提供獨立服務,就得拿出Flash難以完成、又值得用戶額外付費的能力,而不只是比舊Pro更強。![]()
![]()
![]()
![]()
![]()
![]()
![]()
返回首頁