據英國《金融時報》最新報道,字節跳動目前正處於一項超大規模基礎模型的預訓練階段,該模型最終規模最高可能達到 10 萬億(10 Trillion)參數。如果順利完成訓練,這將成爲全球規模最大的 AI 基礎模型之一,也將刷新中國大模型的參數紀錄。
![]()
![]()
消息人士透露,這款模型目前仍處於 Pre-training(預訓練) 階段,這一過程通常需要 3 至 6 個月。最終模型是否達到 10 萬億參數,還將根據訓練效果進行調整。
參數規模首次衝擊 10 萬億
如果按照報道中的最高規模計算,這款模型將比月之暗面的 Kimi K3(約 2.8 萬億參數) 大出三倍以上,也遠超此前國內主流萬億級模型。
![]()
報道稱,目前業內普遍估計,Anthropic 最新的 Mythos 5 模型約爲 8 萬億參數,而字節跳動此次瞄準的目標,甚至可能超過這一規模。由於 Anthropic、OpenAI 等公司並未公開官方參數數量,因此相關數字均來自行業估算。
不過,業內人士也強調,參數規模並不等於模型能力。模型最終性能仍受到訓練數據質量、架構設計、推理方式以及訓練策略等多種因素影響,因此更大的模型並不一定意味着更好的實際表現。
大就是好😁😁😁
更多遊戲資訊請關註:電玩幫遊戲資訊專區
電玩幫圖文攻略 www.vgover.com
