開放權重 AI 為何撼動 OpenAI 與 Anthropic 的壟斷地位:10 大關鍵理由

Chinese open-weight rivals gain token share while OpenAI's unreleased Astra model claims 10 decade-old math problems. (Image: Shutterstock)
Chinese open-weight rivals gain token share while OpenAI's unreleased Astra model claims 10 decade-old math problems. (Image: Shutterstock)

2025 年 1 月 27 日,一家多數投資人幾乎沒聽過的中國實驗室,單日就讓 Nvidia 市值蒸發 5,890 億美元,寫下美股史上最大單日市值跌幅。這波拋售的導火線,是 DeepSeek,而它「犯的錯」,就是太開放。

比特幣 (BTC) 都一度震盪。市場開始正視一個簡單但顛覆性的事實:最前沿的 AI,不再只屬於少數幾家封閉實驗室。

重點整理

  • 「開放權重」模型會公開訓練完成的參數,任何人都能下載、部署與改造;這與「完整開源」不同,後者還包含訓練程式碼與數據細節。
  • 在公開榜單上,最佳開放模型與封閉模型的品質差距,約一年內從 8% 縮小到不到 2%,同期間推論價格卻暴跌數百倍。
  • 低成本部署、國家主權需求、較友善的監管環境,加上龐大的開發者生態系,正讓開放權重對僅供 API 的龍頭形成實質壓力。

什麼是「開放權重」AI?

這個詞近來被用得很鬆散,因此需要先講清楚。所謂「開放權重」,是指開發者公開一個已訓練完成的神經網路參數——也就是模型學會的一串數字。你可以把它下載回來,在自己的硬體上執行,還能進一步微調。

但「開放權重」不等於「開源」。Open Source Initiative(OSI)在 2024 年 10 月 28 日公布《Open Source AI Definition》,門檻訂得更高。要符合定義,發佈內容必須包含權重、訓練程式碼,以及足夠詳盡的訓練數據資訊,讓專業人士有能力大致重建出該系統。

以這個標準來看,當前號稱「開源」的多數模型其實都不合格。Meta 的 Llama、阿里巴巴的 Qwen 和 DeepSeek,都只釋出權重,並未附上完整數據配方。

OSI 對此區別講得很直接,指出只公開權重,並不能帶來與開源軟體相同的自由。也因此,業界一直有一場圍繞「open washing」的論戰:有些公司打著開放旗號,卻保留足以讓他人無法真正重製成果的關鍵要素。

即便如此,對多數實際在做產品的團隊來說,權重仍是最關鍵的戰利品。有了權重,你就能上線服務、壓縮模型、再訓練、打包出貨。細看不同模式實際交付什麼:

  • 開放權重:釋出訓練好的參數,授權通常允許使用、修改,且時常可商用。
  • 完整開源:權重+訓練程式碼+足夠詳細的數據說明,讓他人能重建模型。
  • 封閉模式:不提供任何可下載內容,只能透過介面、按用量計費。

真正爆炸性成長的是中間那一類——開放權重模型;而這正是讓封閉實驗室夜不成眠的核心威脅。

延伸閱讀:Nvidia 股價重挫近 5%,只因一紙尚未簽署的 2,500 億美元 OpenAI 擔保

與 OpenAI、Anthropic 的模式有何不同?

OpenAIAnthropic 走的是完全相反的路。它們把最高等級的權重鎖在自家資料中心,只透過 API 對外販售。你送出提示,得到回覆,但永遠摸不到模型本身。

這種設計在商業上很合理:保護訓練投資、維持訂閱與用量計費,並且可以隨時更新行為準則或關閉特定使用者的存取。

這套模式也有安全上的論述支撐。Anthropic 執行長 Dario Amodei 一再強調,一旦權重公開,開發者就失去了後續更新防護欄、或在發現風險時「收回」系統的能力。

但代價是依賴。

只要模型只存在對方的伺服器上,供應商就握有定價權、服務穩定度、資料條款與版本汰舊時間表。你的產品建立在一個你既無法掌控、也無從審視的基礎設施上。

儘管多年來以「開放研究」自居,OpenAI 自 2019 年 GPT-2 之後,一直到 2025 年 8 月 5 日才再度釋出任何開放語言模型。當天推出的兩款 gpt-oss 模型,在寬鬆的 Apache 2.0 授權下公開,被外界視為對開放權重壓力的直接回應——靠封閉 API 起家的公司,不得不在開放陣營的戰場上應戰。

延伸閱讀:OpenAI 爭取 2,500 億美元 Nvidia 授信,打造俄亥俄州超級園區

開放權重為何威脅集中式模式的 10 大理由

先說在前頭:以下這些理由並不保證開放權重一定能完全勝出。技術最前沿仍高度集中在大型實驗室手中,風險也真實存在。但過去三年的大方向相當一致,而且一路是逆著封閉、計量收費的模式而行。

關鍵在於:「為什麼要多付一大筆錢去租一個黑箱?」這個問題越來越難回答。技術、經濟與政治三股力量正在同時發生收斂。

以下是權力天平開始傾斜的十個原因。

一、品質差距幾乎消失

最關鍵的事實就是「收斂」。史丹佛大學在《2025 AI Index》報告中指出,在 Chatbot Arena 排行榜上,最佳封閉模型與最佳開放模型的得分差距,從 2024 年 1 月的 8%,縮小到 2025 年 2 月的 1.7%。

頂尖戰場也變得擁擠:排行榜第 1 名與第 10 名的差距,在一年內從 11.9% 縮到 5.4%。

當「第二好的選擇」只要「第一名」的零頭價格時,要替封閉模型的高額溢價辯護就越來越困難。對任何以「獨家性能」作為核心賣點的廠商來說,這就是實打實的定價難題。

二、「智慧」的價格崩盤

成本下滑的速度比品質差距縮小還要驚人。根據 Epoch AIArtificial Analysis 數據,AI Index 報告估算,執行一次 GPT-3.5 等級查詢的成本,從 2022 年 11 月每百萬 token 約 20 美元,跌到 2024 年 10 月的 0.07 美元。

這代表不到兩年內,成本下滑約 280 倍。

DeepSeek 則把同樣的邏輯往「訓練成本」推進。其 V3 技術報告聲稱,最終訓練階段只花了約 560 萬美元、動用 2,048 顆 Nvidia H800 晶片,就達到與西方同級模型需數千萬甚至上億美元才能及的水準。當智慧變得如此便宜時,優勢在於誰能大規模鋪開,而不是誰把模型鎖得最緊。

三、你真正「擁有」模型

租用封閉模型,就得接受房東的遊戲規則。供應商可以調漲價格、改契約條款,甚至下架你核心產品所倚賴的版本。

一旦你握有權重,這種談判籌碼就大幅削弱。你可以凍結某個版本,穩穩跑上好多年,還能在不改動整個系統架構的情況下,自由更換雲端供應商。

廠商綁定不是抽象風險,而是具體成本:轉換開發、強迫升級、以及你幾乎無從議價的價格表。擁有權重可以逐項拆解這些問題:

  • 凍結模型版本:只要業務需要,就維持原樣。
  • 任選運算環境:換雲端、上自家機房,都不必重寫整個堆疊。
  • 避免突襲式汰舊:不會一夜之間因為 API 下線而讓線上產品全面停擺。

當然,就連「開放」授權也要看細節。Meta 的 Llama 授權要求每月活躍用戶超過 7 億的公司,必須另行商談商業條款,這也是為什麼不少開源社群人士拒絕承認 Llama 是真正的開源。

四、隱私與數據主權

有些資料依法根本不能離開園區。醫療院所、金融機構與政府單位,往往無法把敏感紀錄送到第三方 API。

開放權重的解法,是「把模型搬到資料身邊」。你可以在本地機房或私有雲內部直接跑推論,敏感數據完全不必跨出自己的安全邊界。

這個單一特性,就打開了許多封閉 API 永遠進不了的門。對高度監管的產業而言,能否在「園區內」掌握 AI 通常是最終決策關鍵。

五、各國開始打造自己的模型

對「數位主權」的焦慮已經全球化。愈來愈多政府把過度依賴少數美、中 API 視為戰略風險。

2025 年 9 月 2 日,洛桑聯邦理工學院(EPFL)、**蘇黎世聯邦理工學院(ETH Zurich)**與瑞士國家超級電腦中心共同推出 Apertus——一款以逾 1.5 兆 token、覆蓋 1,000 多種語言訓練而成的完全開放模型。阿布達比的 Technology Innovation Institute 自 2023 年起持續推出 Falcon 系列開放模型,其他國家也紛紛跟進各自的國家級 AI 計畫。

這個劇本在各地重複上演:

  • 瑞士以 Apertus 釋出權重、數據與程式碼,完全透明。
  • 阿聯推出多代 Falcon 模型,授權條款相當寬鬆。
  • 法國、印度、日本、南韓等國,皆投入國產模型或算力基礎建設。

你不可能在只能「租用」的模型之上建立主權 AI。開放權重是前提條件,也因此,政府天然就成了開放陣營的重要金主與推手。

六、監管風向偏向開放

政策環境也開始朝開放傾斜。2025 年 7 月 23 日,美國 白宮發布「America's AI Action Plan」,其中明文寫出一節:〈鼓勵開源與開放權重 AI〉。

歐洲雖然論述風格不同,結構上卻走向類似方向。EU AI Act 對「免費且開源」的一般用途模型,在不被認定為「系統性風險」前提下,給予部分文件義務豁免。

這些誘因,對「非最前沿」模型的開發者來說,就是:與其鎖死,不如公開。當 AI 競賽中最大的國家開始主動鼓勵開放權重,原本「預設封閉」的產業邏輯,就不再那麼理所當然。

七、開發者生態系形成「飛輪」

規模會自我增生。Hugging Face 在 2025 年底公布,平台已累積 1,300 萬名用戶、逾 200 萬個公開模型與 50 多萬個公開數據集。

下載數字更能說明一切。Meta 表示,Llama 在 2025 年 3 月 18 日前,下載次數已突破 10 億次,而 2024 年 12 月初才剛達到 6.5 億;阿里巴巴的 Qwen 也在同期間衝上 7 億下載。 到 2026 年 1 月,該模型在 Hugging Face 上的累計下載量已達百萬次,衍生版本更突破 18 萬種,在「被分支(fork)」次數上正式超越 Llama,成為最常被改造的開源模型家族。

每一次微調(fine-tune)、外掛模組(adapter)或量化(quantization),都在替開源模型加深護城河。封閉式 API 無法承接這種來自社群的複利效應,因為沒有人能真正「建立在」一個自己無法掌握的模型之上。

在你的筆電就能跑

開源權重透過廉價開發工具鏈,與一般硬體接軌。量化技術能把模型壓縮到較低精度,縮小記憶體占用,而像 LoRA 這類方法則可在不重新訓練整個模型的前提下完成微調。

本機端推論框架讓這一切變成主流。Ollama、llama.cpp 和 vLLM 等工具,如今已能讓開發者在單張消費級 GPU,甚至一般筆電上,部署相當強大的模型。

能在一台約 2,000 美元的機器上跑的模型,是任何人都無法「遠端關機」的模型。這種自主性,正是按次計費的雲端模型永遠給不起的東西。

可稽核與可解釋性

看不見的東西,就無從檢視。封閉式 API 只丟回一個結果,卻不讓你看到背後是怎麼算出來的。

開源權重則讓研究人員可以直接剖析模型本體,研究它在什麼情境下會失誤,並在公開環境中反覆驗證其安全性。也正因為這樣的透明度,開源陣營才主張:自家模型在長期更容易、而不是更難,變得值得信任。

對必須為決策過程「說得清楚」的受監管產業而言,這種可見度不是加分選項,而往往是法律硬性要求。

去中心化前沿

最新的一個理由出現在 AI 與加密貨幣的交會點上。當權重是開放的,訓練與推論所需的運算,就不必綁在單一公司的資料中心。

Prime Intellect 這類專案,已經在全球分散的硬體上完成模型訓練,並設計機制驗證遠端機器是否真的執行了自己聲稱的工作。Bittensor 則運行一個以代幣為誘因的機器智能市場,其定價單位為 TAO (TAO) 代幣。

必須誠實指出的是,目前去中心化訓練在速度與成本上,仍不敵傳統集中式叢集。但開源權重一旦與可驗證、代幣化的運算資源結合,便形成封閉實驗室難以複製的全新競爭軸線。

延伸閱讀:Pixel 11 將更貴,Google 指向 AI 資料中心成本是主因

結語

開源權重不會讓封閉實驗室「消失」。技術最前沿依然掌握在願意砸下最大算力預算的玩家手中,開源釋出的版本往往比封閉模型慢上好幾個月,且公開權重一旦流出,濫用風險就不可能被「召回」。

但「取代」不等於「抹除」。真正的轉變是重心的移動,而這場位移已經在發生。

當品質差距愈來愈小、智能成本逼近於零,政府、開發者與監管機關,正持續選擇那些「能掌握在自己手中」的模型。集中式 AI 仍會在金字塔頂端販賣極致方便,但其餘廣大市場,正悄悄走向可以真正「擁有」的權重。

下一篇:Apple 難控記憶體價格,消費者成了埋單的一方

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev 是 Yellow.com 的內容總監,過去 10 年持續報導加密貨幣領域。他專長於撰寫深入的 Research 和 Learn 類型文章,特別關注分析式報導、產業脈絡,以及塑造加密貨幣世界的更大力量,從 AI 時代與資安技術到金融科技創新。他相信數位的一切即將全面超越類比的一切,並正為實現這一願景而全力以赴。

免責聲明與風險警告: 本文提供的資訊僅供教育與參考用途,並基於作者觀點,不構成財務、投資、法律或稅務建議。 加密貨幣資產具有高度波動性並伴隨高風險,包括可能損失全部或大部分投資金額。買賣或持有加密資產可能並不適合所有投資者。 本文中所表達的觀點僅代表作者立場,不代表 Yellow、其創辦人或管理層的官方政策或意見。 請務必自行進行充分研究(D.Y.O.R.),並在做出任何投資決策前諮詢持牌金融專業人士。
開放權重 AI 為何撼動 OpenAI 與 Anthropic 的壟斷地位:10 大關鍵理由 | Yellow