DeepSeek 是什麼?2026 完整指南:V4、梁文鋒與爭議
目錄
DeepSeek(深度求索)是一家來自中國杭州的 AI 團隊。2025 年 1 月,它用一款訓練成本號稱極低的開源模型 R1,讓輝達(Nvidia)股價在單日蒸發近 6,000 億美元,被市場稱為「DeepSeek 時刻」。一年多後,它推出 2026 年的新旗艦 V4,並完成約 70 億美元融資。這篇指南一次整理:DeepSeek 是誰、模型怎麼演進、如何使用、開源到什麼程度,以及圍繞它的隱私與地緣爭議。
DeepSeek 是什麼?從幻方量化走出的 AI 團隊
DeepSeek 成立於 2023 年 7 月,是中國量化避險基金幻方量化(High-Flyer)分拆出來的 AI 研究團隊。幻方本身成立於 2015 年,靠自建 GPU 叢集做量化交易,也因此累積了訓練大型模型所需的算力。DeepSeek 創辦人兼執行長梁文鋒同時是幻方的執行長,透過持股實體握有 DeepSeek 約 84% 股權。公司總部位於杭州,團隊刻意維持精簡、以研究為導向,2025 年時約僅 160 人。與多數 AI 公司不同,DeepSeek 從一開始就把目標放在通用人工智慧(AGI),而非急於商業化。
在 2026 年首輪融資後,梁文鋒的身價據估翻倍至約 360 億美元,一度被稱為全球最富有的 AI 創辦人。
2025 年 1 月的「DeepSeek 時刻」:輝達單日蒸發 5,890 億美元
2025 年 1 月 20 日,DeepSeek 發布主打推理能力的 R1,性能對標 OpenAI 的 o1,卻宣稱只用了遠低於同業的訓練算力。恐慌很快傳導到市場:1 月 27 日,輝達單日市值蒸發 5,890 億美元,是美國股市史上單一公司最大單日跌幅,股價重挫約 17%。同一天,DeepSeek 也超越 ChatGPT,登上美國 iOS 免費 App 排行第一。
外界最常引用的「訓練成本僅 560 萬美元」數字,其實出自 DeepSeek V3 的技術報告,指的只是最終一次正式訓練的算力成本,約 2,048 張 H800 GPU、跑約 55 天,並不包含先前的研究、實驗、資料與人力等投入。半導體研究機構 SemiAnalysis 估計,DeepSeek 累計的 GPU 資本支出可能高達約 5 億美元。換句話說,那個小數字是真的,但它是一個很窄的「邊際算力」成本,而非 DeepSeek 的全部花費。
模型演進:從 R1 到 2026 年旗艦 V4
DeepSeek 的模型大致分成兩條線:以 V 為名的通用模型,以及以 R 為名、專攻推理的模型。從 2024 年的 V2、V3,到 2025 年 1 月引爆話題的 R1,DeepSeek 逐步把「思考」能力整合進主線:2025 年 8 月的 V3.1 首度採用混合思考架構,年底的 V3.2 再導入稀疏注意力(DSA)以提升長文效率。外界一度盛傳的獨立版 R2 最終沒有單獨推出,推理能力被併入 V3.1 到 V4 這條混合路線(完整版本可查 DeepSeek 官方更新紀錄)。
2026 年,這些線被新旗艦 V4 整合。V4 內建可選的「思考模式」,等於把過去 R1 負責的推理任務也一併吸收。它在 4 月 24 日以預覽版亮相,分為效能較強的 V4-Pro 與輕量的 V4-Flash,兩者都支援 100 萬 token 的上下文長度,足以一次讀進整套程式碼庫或長篇文件。7 月 31 日,DeepSeek 推出 V4-Flash 的正式版,強化了自主代理(agent)能力並再度調降 API 價格;更大的 V4-Pro 正式版,截至 8 月初仍在預覽階段。
V4 最受關注的是效率。根據麻省理工科技評論,V4-Pro 只需要前一代 V3.2 約 27% 的運算量、10% 的記憶體用量,V4-Flash 更壓到 10% 運算量、7% 記憶體。效能方面,DeepSeek 稱 V4-Pro 可與 Anthropic 的 Claude Opus 4.6、OpenAI 的 GPT-5.4 與 Google 的 Gemini 3.1 等頂級閉源模型並駕齊驅,這些是 DeepSeek 自己公布的跑分,宜視為廠商說法。V4 也特別針對華為昇騰(Ascend)等中國國產晶片做了優化。
怎麼用 DeepSeek:網頁、App、API 與本地部署
一般使用者最簡單的方式,是直接用官方網頁版 chat.deepseek.com,或下載 DeepSeek 手機 App,介面與 ChatGPT 類似,可免費對話並開啟深度思考模式。
開發者則透過 API 串接。DeepSeek 一向以低價著稱,以官方公布的價格為例,V4-Flash 每百萬 token 輸入約 0.14 美元、輸出約 0.28 美元;更大的 V4-Pro 輸入約 0.44 美元、輸出約 0.87 美元,命中快取時還會更低。這樣的定價往往只有同級美國閉源模型的數分之一,也是它在開發者之間快速普及的關鍵。
由於 DeepSeek 開放模型權重,進階使用者也能把模型下載到本地執行,例如透過 Ollama 在自己的電腦或伺服器上跑,資料不必送上雲端。完整的 V4 模型體積龐大、需要高階硬體,但 DeepSeek 也釋出多個體積較小的蒸餾版本,讓一般硬體也能嘗試。
開源與授權:MIT 權重與蒸餾模型
DeepSeek 的模型權重自 2025 年 1 月起採用寬鬆的 MIT 授權開放,允許商用與再訓練,這也是它被大量採用的原因之一。不過精確地說,DeepSeek 是「開放權重(open-weight)」而非完全「開源」:它公開了模型權重與技術報告,但沒有釋出訓練資料與完整的訓練流程。為了讓一般硬體也能使用,DeepSeek 還把 R1 的推理能力蒸餾進 1.5B 到 70B 不等的較小模型,這些模型分別以 Qwen 與 Llama 為基礎,適合在本地或邊緣裝置運行。
2026 近況:70 億美元融資、暫緩二輪與梁文鋒的算力論
2026 年 6 月,DeepSeek 完成首輪約 70 億美元的外部融資,投資方包括騰訊、電池大廠寧德時代(CATL),以及官方背景的國家人工智慧產業投資基金,估值來到約 3,500 億元人民幣。緊接著它啟動第二輪、目標至少 100 億元人民幣的募資,投前估值一度上看約 4,800 億元人民幣。
但這輪募資在 7 月按下暫停。導火線是創辦人梁文鋒在一場投資人會議上的談話紀錄外流:他把中國 AI 與美國的差距歸因於算力,而非人才。根據第一財經取得的會議紀錄,梁文鋒說:「我們與美國最大的差距在於資源。」他表示 DeepSeek 手上約有相當於 2 萬張輝達 H 系列 GPU 的算力,並與華為深度合作、透過自研的 TileLang 等工具繞過輝達的 CUDA 生態。管理階層對非公開言論外流感到挫敗,於是口頭通知投資人暫緩簽約,但未來仍可能重啟;該公司也在籌備最快 2026 年底提出的 IPO。
爭議:資料落地中國、審查與各國封鎖
圍繞 DeepSeek 的爭議主要有三類。第一是資料隱私,DeepSeek 的隱私政策載明會把使用者資料儲存在中國境內的伺服器,內容包含輸入文字、IP 位址、上傳檔案,甚至打字模式,而中國政府對境內企業資料握有廣泛的法律調取權。第二是內容審查,託管版模型在天安門、台灣等政治敏感議題上,會拒答或給出貼近中國官方立場的回答。第三是各國對公務使用的限制,義大利在 2025 年 1 月因資料疑慮將它下架,美國透過國防授權法與相關法案禁止聯邦裝置使用,範圍涵蓋 NASA、海軍、五角大廈、商務部等機關,台灣數位發展部也在 2025 年 1 月底要求公部門、國營事業與公立學校不得使用,澳洲、南韓、印度同樣有類似限制。
此外,2025 年 1 月 OpenAI 與微軟曾表示,正在調查是否有與 DeepSeek 相關的團體透過 OpenAI API「蒸餾」不當取得資料;2026 年也出現 Anthropic 指控 DeepSeek 大量擷取 Claude 對話的報導。這些目前都屬於指控、尚無公開定論,但也反映出 DeepSeek 在快速崛起的同時,一直伴隨著資料來源正當性的質疑。
DeepSeek 與 Claude、ChatGPT、Gemini:定位與取捨
和 OpenAI 的 GPT、Anthropic 的 Claude、Google 的 Gemini 這些閉源旗艦相比,DeepSeek 的定位很清楚:開放權重、低價,並在程式、數學與代理任務的跑分上主打「接近前沿,但便宜一個量級」。這些對標頂級模型的效能數字,多半是 DeepSeek 自己公布的結果,宜視為廠商說法而非獨立驗證。
對開發者來說,DeepSeek 適合成本敏感、想自行部署、或希望避開單一供應商綁定的場景;但若手上的資料涉及隱私或合規敏感,就要把「資料落地中國」與各國公務限制一併納入考量。簡單說,它是目前開放權重陣營裡最有份量的選項之一,但用在哪裡、用它處理什麼資料,需要分開判斷。
常見問題
DeepSeek 是哪一國的公司?
DeepSeek 來自中國,總部在杭州,2023 年 7 月由量化避險基金幻方量化分拆成立。
DeepSeek 可以免費用嗎?
可以。網頁版與手機 App 提供免費對話;開發者串接 API 則依用量計費,但單價偏低。此外模型權重開源,進階使用者能免費下載到本地運行。
DeepSeek 最新的模型是哪一個?
2026 年的 V4 家族。輕量的 V4-Flash 已於 7 月底推出正式版,更大的旗艦 V4-Pro 截至 8 月初仍在預覽階段。
DeepSeek 訓練成本真的只有 560 萬美元嗎?
那個數字指的是 V3 最終一次正式訓練的算力成本,不含研發、實驗與人力等投入。累計投入被估計高得多,SemiAnalysis 估其 GPU 資本支出可能達約 5 億美元。
用 DeepSeek 安全嗎?資料會存在中國嗎?
託管版會把資料存放在中國境內伺服器,且有政府調取疑慮,多國因此禁止公務使用。若在意隱私,可改用開源權重在本地部署,讓資料不外流。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。


