Moonshot's AI model Kimi K3 is causing a stir in the Western AI community. The big question is how close it actually gets to the best Western models. In the Code Arena: Frontend benchmark, Kimi K3 scores 1,679, beating Claude Fable 5 (1,631), GPT-5.6 Sol (1,618), and every other tested model by a wide margin. It's the first time a Chinese model has claimed the top spot on this benchmark.
Bei anspruchsvoller Mathematik zeigt Kimi K3 jedoch klare Schwächen. Laut Daten von Epoch AI erreicht es im FrontierMath-Benchmark (Tier 4, die schwierigsten Experten-Mathematikaufgaben) nur etwa 39 Prozent Genauigkeit. Modelle von OpenAI oder Anthropic erzielen dort teils beinahe 90 Prozent.
Bei komplexen mathematischen Aufgaben liegt Kimi K3 deutlich hinter den westlichen Spitzenmodellen. | Bild: Epoch AIKI-News ohne Hype – von Menschen kuratiert
Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den "KI Radar"‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.



