8月6日消息,字節跳動正籌劃訓練參數規模超5萬億的超大規模模型,超越阿里Qwen 3.8-Max(2.4萬億)與月之暗面K3(2.8萬億),成為國内已知最大。
觀點網訊:8月6日,據報道,字節跳動正籌劃訓練一個參數規模超5萬億的超大規模模型,其體量将超越阿里的Qwen 3.8-Max(2.4萬億參數)與月之暗面的K3(2.8萬億參數),成為目前國内已公開信息中參數量最大的模型。
該計劃尚處早期階段,最終是否發布仍存在不确定性。新模型将由Seed Foundation負責人項亮牽頭,並聯合大語言模型預訓練數據負責人沈科共同推進。
為此,Seed正系統梳理組織架構,明确職責分工,優化資源配置。多位字節内部人士透露,今年上半年,Seed多個團隊持續開展復盤與反思。
這也是字節探讨訓練超5萬億參數模型的重要動因之一:與其在既有參數量級上漸進追趕,不如一步跨越至行業數倍規模,搶占技術制高點。
“這更像一場豪賭。”一位接近Seed的人士坦言。自創立以來,字節始終信奉“大力出奇迹”——切入新領域時,常同步組建多支團隊,集中投入資源,平行推進多個方向。
免責聲明:本文内容與數據由觀點根據公開信息整理,不構成投資建議,使用前請核實。
審校:楊毅
