ByteDance entwickelt ein neues großes Sprachmodell, das bis zu 10 Billionen Parameter erreichen könnte. Das Modell befindet sich derzeit in der Phase des Pre-Trainings, die üblicherweise zwischen drei und sechs Monaten dauert. Nach Abschluss des Pre-Trainings plant ByteDance, das Modell feinabzustimmen, bevor es zum Einsatz kommt.
Die finale Größe des neuen Modells steht noch nicht fest. Das Modell wird Schätzungen zufolge in seiner Skalierung dem Mythos 5-System von Anthropic ähneln.
Geschätzte Anzahl der Parameter des Anthropic Mythos 5 Modells
Branchenquellen schätzen, dass das Mythos 5-Modell von Anthropic etwa 8 Billionen Parameter besitzt. Ein direkter Vergleich mit US-amerikanischen Konkurrenten wie Anthropic oder OpenAI ist jedoch schwierig, da diese Unternehmen die Parameterzahlen ihrer fortschrittlichen Modelle wie Mythos, Fable oder GPT-5.5 nicht öffentlich bekannt gegeben haben.
Vergleich mit bisherigen Modellen
Das neue Modell von ByteDance wäre mehr als dreimal so groß wie Kimi K3 von Moonshot AI, welches 2,8 Billionen Parameter aufweist. Zum Vergleich: Das Modell Qwen3.8-Max von Alibaba verfügt über 2,4 Billionen Parameter. Vor der Entwicklung des neuen Modells von ByteDance gehörten Meituan's LongCat-2.0 und DeepSeek V4-Pro mit jeweils etwa 1,6 Billionen Parametern zu den größten Modellen in China.
Mehrere chinesische Unternehmen haben kürzlich Modelle vorgestellt, die 1 Billion Parameter überschreiten. Im Gegensatz zu vielen chinesischen Wettbewerbern hält ByteDance die Gewichte seiner leistungsfähigsten Allzweck-Modelle weitgehend geschlossen.
Investitionen und technologische Basis
Bisherige KI-Entwicklungen bei ByteDance
Die Anzahl der Parameter allein bestimmt nicht die Leistung eines Modells; auch die Effizienz der Architektur, die Trainingsdaten und die Methoden sind entscheidende Faktoren.
Der Bericht der Financial Times über das neue Modell von ByteDance konnte von Reuters nicht unabhängig verifiziert werden. ByteDance hat auf Anfragen für eine Stellungnahme zu dem Bericht nicht reagiert.