BTCC / BTCC Square / TechFlowPost /
DeepSeek,為什麼讓西方 AI 從業人員人人自危?

DeepSeek,為什麼讓西方 AI 從業人員人人自危?

Published:
2025-01-27 09:56:16

作者:Carl Franzen

編譯:深潮 TechFlow

就在幾天前,只有最專業的極客們(作為其中一員,我這樣說)才聽說過Deepseek,這是一家中國AI公司,是同樣具有獨特名字的High-Flyer Capital Management (一家於2015年成立的量化分析公司)的子公司。 然而在過去的幾天裡,它可能成為了矽谷最受關注的公司。

這主要歸功於DeepSeek-R1的發布,這是一個新的大語言模型(LLM),它能夠進行類似於OpenAI當前最佳模型o1的"推理"——在回答困難問題和解決複雜問題 時需要花費數秒或數分鐘,透過步驟式或"思維鏈"的方式對自身的分析進行反思。

不僅如此,DeepSeek-R1在各種第三方基準測試(用於測量AI在各種主題上回答問題的性能的測試)中的得分與OpenAI的o1持平或更高,而且據報導其訓練 成本僅為約500萬美元,使用的圖形處理器(GPU)數量也遠遠少於美國(OpenAI的大本營)嚴格禁運的數量。

但與o1不同的是,o1只向付費的ChatGPT Plus級別訂閱者(每月20美元)和更高級別的訂閱者(如每月200美元的Pro級別)開放,而DeepSeek-R1是 作為完全開源模型發布的,這也解釋了為什麼它迅速攀升至AI代碼共享社區Hugging Face最受歡迎和最活躍模型的榜首。

而且,由於它是完全開源的,人們已經對該模型進行了多種微調和訓練,以適應不同的特定任務,例如使其小到可以在移動設備上運行,或者與其他開源模型結合 使用。 即使你想將其用於開發目的,DeepSeek的API成本也比OpenAI的同等o1模型低90%以上。

最令人印象深刻的是,你甚至不需要是軟件工程師就能使用它:DeepSeek為美國用戶提供了免費的網站和移動應用,其R1驅動的聊天機器人界面與OpenAI的ChatGPT非常相似。 不過,DeepSeek再次通過將這個強大的推理模型與網絡搜索連接起來超越了OpenAI——這是OpenAI目前還沒有實現的(網絡搜索目前只在功能較弱的GPT系列模型上可用)。

一個顯而易見的諷刺

考慮到OpenAI最初致力於為大眾民主化AI的目標,這裡存在著一個相當有趣,或者說令人不安的諷刺。 正如Nvidia高級研究經理Jim Fan在X上所說:"我們正生活在這樣一個時間線裡:一家非美國公司正在延續著OpenAI的原始使命——真正開放的前沿研究,賦能所有人。這說 不通。但最有趣的結果往往就是最可能發生的。"

又如X用戶@SuspendedRobot所說(引用了有關DeepSeek似乎是在ChatGPT生成的問答輸出和其他數據上訓練的報導):"OpenAI從整個互聯網竊取數據來讓自己變得更富有,而DeepSeek 從他們那裡竊取後又免費回饋給大眾,這讓我想起了一個英國民間故事。"

Meta陷入危機,因開源Llama落後?

但不只是Fan注意到了DeepSeek的成功。 基於我與各種工程師、思想家和領導者的交談和閱讀,DeepSeek-R1的開源可用性、其高性能表現,以及它似乎"突然冒出來"就挑戰了前生成式AI領導者的事實,在 整個矽谷及其他地方引起了震動。 如果不是像我誇張的標題所說的"所有人"都在為之瘋狂,它至少是科技和商業圈裡的熱門話題。

一則發佈在Blind(矽谷匿名八卦分享應用)上的訊息正在廣泛傳播,暗示Meta因DeepSeek的成功而陷入危機,因為它如此迅速地超越了Meta自身透過Llama模式成為開源AI之王的努力 。

“這改變了整個遊戲規則”

X用戶@tphuang發表了令人信服的觀點:"DeepSeek已經在最頂級之外實現了AI的商品化。第一張圖片讓我豁然開朗。R1比美國的勞動力成本低得多,這 意味著未來5年內許多工作將被自動化取代。

"o1有3個巨大問題:

1)太慢

2)太貴

3)最終使用者缺乏控制權/過度依賴OpenAI。

R1解決了所有這些問題。 公司可以購買自己的Nvidia GPU來運行這些模型,不用擔心額外成本或OpenAI伺服器反應慢/不回應的問題。 "

@tphaung還提出了一個發人深省的類比問題:"DeepSeek會成為LLM領域的Android嗎?"

網絡企業家Arnaud Bertrand在X上直言不諱地談到了DeepSeek成功的驚人影響:"這對整個遊戲規則的改變程度怎麼強調都不過分。這不僅關係到AI,也是對美國試圖阻止中國技術 發展這一誤導性嘗試的巨大諷刺,如果沒有這種限制,DeepSeek可能就不會出現(正如諺語所說,需求是發明之母)。"

審查問題

然而,也有人對DeepSeek的快速崛起提出警告,認為作為一家在中國運營的初創公司,它必然要遵守該國的法律和內容審查要求。 事實上,在我自己在美國使用iOS版DeepSeek時就發現,它不會回答某些問題。

作為新聞媒體的一員,我當然非常重視言論和表達自由,這是我堅定支持的最基本的理念之一。

然而,我也不得不指出,OpenAI的模型和產品(包括ChatGPT)同樣會拒絕回答一系列問題——特別是涉及人類性行為和成人/NSFW內容的問題,即使這些問題很普通。

當然,這不是一個完全對等的比較。 對某些人來說,依賴外國技術的抵觸會讓他們對DeepSeek的最終價值和實用性持懷疑態度。 但其性能和低成本是無可否認的。

在美國16.5%的商品都從中國進口的時代,我很難僅僅基於審查擔憂或安全風險來警告不要使用DeepSeek-R1——特別是當模型代碼可以免費下載、離線使用、在安全環境 中設備上運行,並且可以隨意微調的情況下。

我確實察覺到圍繞DeepSeek的熱烈討論中有一些關於"西方衰落"和"中國崛起"的存在主義危機思維。 有人已經將此與美國用戶在TikTok短暫被禁時加入小紅書(Xiaohongshu)app的情況聯繫起來,當時他們對在那裡分享的視頻中展示的中國生活質量感到驚訝。 DeepSeek-R1的出現就發生在這樣的敘事背景下——在這個背景下,中國看起來(且在許多指標上確實)正在崛起,而美國看起來(且在許多指標上也確實)在衰落。

第一個但絕非最後一個震撼世界的中國AI模型

這也不會是最後一個威脅矽谷巨頭主導地位的中國AI模型——即使這些巨頭像OpenAI一樣,正在為其開發通用人工智慧(AGI,即在大多數具有經濟價值的工作中超越人類 的程序)籌集比以往更多的資金。

就在昨天,另一個來自TikTok母公司字節跳動的中國模型——Doubao-1.5-pro發布,其在第三方基準測試中的表現與OpenAI的非推理型GPT-4o模型相當,但 成本僅為後者的1/50。

中國模型發展得如此之快、如此之好,以至於連科技行業之外的人也注意到了:《經濟學人》雜誌剛剛發表了一篇關於DeepSeek的成功和其他中國AI努力的文章 ,政治評論員Matt Bruenig在X上發文稱:"我已經使用Gemini、ChatGPT和Claude進行NLRB文檔總結將近一年了。Deepseek在這方面比它們都要好。它的聊天機器人版本是免費的。使用其 API的價格比OpenAI的API低99.5%。[聳肩表情]"

OpenAI如何應對?

難怪OpenAI聯合創始人兼CEO Sam Altman今天表示,公司將把尚未發布的第二代推理模型系列o3引入ChatGPT,甚至免費用戶也可以使用。 OpenAI似乎仍在通過更專有和先進的模型開闢自己的道路——設定行業標準。

但問題在於:隨著DeepSeek、位元組跳動和其他中國AI公司緊隨其後,OpenAI還能在製作和發布新的前沿AI模型方面保持領先多久? 如果它真的落後了,其衰落會有多快、多嚴重?

不過,OpenAI確實有另一個歷史先例可以藉鏡。 如果DeepSeek和中國AI模型確實像Google的開源Android之於行動領域那樣——在一段時間內佔據了市場的大部分份額——你只需要看看蘋果iPhone是如何透過其封閉、專有、全內部 的方法佔據了市場的高端部分,並從那裡穩步向下擴張,特別是在美國,以至於現在擁有近60%的國內智慧型手機市場份額。

儘管如此,對於所有正在花大價錢使用領先實驗室AI模型的人來說,DeepSeek表明,相同的功能可能以更低的價格獲得,並且能獲得更大的控制權。 在企業環境中,這可能足以贏得勝利。

|Square

下載BTCC APP,您的加密之旅從這啟程

立即行動 掃描 加入我們的 100M+ 用戶行列