字節跳動訓練10兆參數AI模型 規模直逼Anthropic Mythos

  • 責任編輯Yu Han Lei、新聞中心
  • 發佈時間:2026.08.08 09:00
  • 最後更新時間:2026.08.08 09:00
字節跳動訓練超大型AI模型,參數量上看10兆。(圖/達志影像)

字節跳動訓練超大型AI模型,參數量上看10兆。(圖/達志影像)

人工智慧(AI)競賽持續升溫,字節跳動(ByteDance)正訓練一款參數量可能達10兆的超大型AI模型,規模可望接近Anthropic最先進的Mythos。據《金融時報》報導,這款模型目前仍處於預訓練階段,若進展順利,完成訓練後將進一步微調並推出。


字節跳動打造10兆參數模型

據知情人士透露,字節跳動目前正在訓練一款參數量最多達10兆的AI模型,規模約為中國AI新創月之暗面(Moonshot AI)Kimi K3的3倍。Kimi K3目前擁有約2.8兆參數,是目前中國已發布的參數規模最大的AI模型。

AI模型的「參數」可視為模型從資料中學習的數值設定,用於辨識模式、生成回答及執行各種任務。參數量通常可作為衡量模型規模的指標,但並不代表模型能力越強,實際表現仍取決於訓練資料、方法及模型架構等因素。

字節跳動這款新模型目前正在進行預訓練,通常需要約3至6個月,之後才會進入微調階段。知情人士表示,模型的確切規模要到後續階段才會確定。


中國AI業者加速追趕美國

Anthropic並未公開旗下模型的參數量,但業界估計,其最先進的Mythos 5約有8兆參數,Fable 5則約為5兆。因此,如果ByteDance最終打造10兆參數模型,其規模將接近甚至可能超過外界對Mythos的估算。

不過,由於Anthropic及OpenAI等美國AI業者並未公布Fable、Mythos或GPT-5.5等模型的參數量,因此不同模型之間難以直接比較。

字節跳動近年積極擴大AI投資,除了建設資料中心、招募研究人員,也持續發展雲端業務及AI晶片。旗下Seed模型團隊由前Google DeepMind科學家吳永輝領導,目前在中國及海外約有2,000名成員,涵蓋模型研究、基礎設施及資料處理等工作。

與部分中國AI業者不同,字節跳動近年在AI模型開發上相對低調,其模型多採封閉式發展。公司近年也要求Seed團隊採取更獨立的模型開發方式,不再依賴「模型蒸餾」,也就是讓較小模型學習大型模型能力的方式,改為更加獨立地訓練模型。