Qwen開放模型衍生版增至15萬個,為Meta的2.6倍

Hugging Face上週五(8/14)發布 夏季開放模型生態觀察報告,指出阿里巴巴Qwen目前已有151,448個衍生模型,遠高於Google的82,506個,還是Meta旗下模型衍生版總數的2.6倍,持續擴大在開放模型開發者生態的優勢。

Hugging Face Hub現為全球主要的開放AI模型平台,自今年起以半年一次的方式發布開放模型生態觀察,分析Hub上的模型發布、下載、按讚及衍生模型等活動。該平台的公開模型儲存庫已從243萬增至296萬,資料集從71.1萬增至100萬,Spaces也從100萬增至144萬。不過模型使用高度集中,約85.6%的模型累計下載不到200次,僅1.5%的模型儲存庫就佔99.2%的下載量。

春季報告已發現中國模型在下載量及大型前沿模型的發展上皆已領先美國,夏季則延續此一趨勢,今年中國實驗室每個月所發布的最大開放模型,其參數規模幾乎都超越美國。中國業者的最大模型介於7540億至2.78兆參數之間,相較之下,美國今年前7個月有5個月的最大模型不到1300億參數。中國業者Moonshot、MiniMax、小米及Z.ai幾乎不發布700億參數以下的模型,小米與美團更相繼推出兆級參數模型。

不過,若從開放模型的發布數量來看,美國業者仍居領先地位。今年在Hugging Face Hub發布最多新模型的前3名皆為美國業者,其中AMD與Nvidia均發布逾200個模型儲存庫,Liquid AI則以約100個排名第三。Hugging Face認為,AMD與Nvidia積極發布開放模型,反映硬體業者正透過針對自家硬體最佳化的模型,擴大晶片及運算平台生態。

今年以來,Hub上模型家族下載的前10名依序是Qwen(20.45億次)、BAAI(5.19億次)、Google(4.18億次)、OpenAI(3.29億次)、Meta Llama(2.27億次)、DeepSeek(1.86億次)、Nvidia(1.79億次)、微軟(1.47億次)、Z.ai(7,800萬次),以及IBM Granite(5,100萬次)。

Hugging Face也公佈開放模型的衍生模型數量排行,用來觀察哪些模型最常被開發者作為後續開發的基礎。在衍生模型數量上領先的是Qwen,目前Hub已有151,448個以Qwen為基礎建立的衍生模型,Google以82,506個居次,Qwen的數量為Meta旗下模型總數的2.6倍,若單看Llama系列則是4.7倍。

Hugging Face認為,Qwen能形成龐大的衍生模型生態,主要得益於穩定的發布頻率、涵蓋不同尺寸及用途的完整模型家族,以及Apache 2.0等較寬鬆授權。今年前7個月,Hub平均每天新增約180至210個Qwen衍生模型,目前151,448個衍生模型主要來自其他開發者,而非Qwen官方發布,顯示Qwen已逐漸成為開發者微調及部署模型的重要基礎。

此外,儘管前沿模型規模持續膨脹,但實際下載量仍以中小型模型為主。Hugging Face將700億參數以上列為大型模型,今年這類模型僅佔Hub下載量3%,其餘97%均來自700億參數以下模型。Hugging Face認為,主要原因在於規模較小的模型較能在多數開發者實際擁有的硬體上執行。