Bytedance trainiert laut Financial Times ein KI-Modell mit bis zu zehn Billionen Parametern – dreimal so groß wie Moonshots Kimi K3, das bislang größte chinesische Modell. Damit käme der TikTok-Konzern in die Nähe von Anthropics Spitzensystem Mythos 5, das Branchenschätzungen bei rund acht Billionen Parametern sehen. Anthropic selbst nennt keine eigenen Zahlen.
Drei Insider sagten der FT, das Modell stecke im Vortraining, das üblicherweise drei bis sechs Monate dauert. Parameter bestimmen, wie viel ein Modell speichern kann, die Leistung hängt aber auch von Datenqualität und Trainingsmethoden ab. Eine der Personen sagt, Bytedance verzichte seit über einem Jahr auf Distillation, also das Nachtrainieren an fremden Modellen.
Gründer Zhang Yiming forderte das 2.000 Personen starke Seed-Team intern auf, langfristig weltweit führende Modellfähigkeiten anzustreben. Auch xAI hat laut Elon Musk Grok-Varianten mit sechs und zehn Billionen Parametern auf dem Cluster Colossus 2 im Training.
KI-News ohne Hype – von Menschen kuratiert
Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den "KI Radar"‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.



