Kurze Zusammenfassung
In diesem Video wird das neue KI-Modell Kimika 3 des chinesischen Startups Moonshot AI vorgestellt, das als ernstzunehmender Konkurrent zu OpenAI und Anthropic gilt. Mit 2,8 Billionen Parametern und ausgezeichneten Benchmark-Ergebnissen wird Kimika 3 in verschiedenen Tests gegen Cloud Fable 5 und GPT 5.6 Soul antreten, wobei die Bereiche Kosten, Ergebnisqualität und Geschwindigkeit bewertet werden.
- Kimika 3 hat 2,8 Billionen Parameter und gilt als das größte offene KI-Modell.
- Die Preise von Kimika 3 sind im Vergleich zu den Konkurrenzmodellen deutlich günstiger.
- Kimika 3 zeigt in verschiedenen Benchmarks vielversprechende Ergebnisse, hat jedoch bei der Geschwindigkeit noch Nachholbedarf.
Einleitung
Im Intro wird das KI-Modell Kimika 3 vorgestellt, das von Moonshot AI veröffentlicht wurde. Es wird als bedeutender Mitbewerber im KI-Bereich bezeichnet, der mit über 2,8 Billionen Parametern und einem umfangreichen Kontextfenster aufwarten kann. Die Diskussion dreht sich um die Leistung von Kimika 3 im Vergleich zu Cloud Fable 5 und GPT 5.6 Soul sowie die Tatsache, dass Kimika 3 ein Openweight-Modell ist, das für jedermann zugänglich ist.
Preise
In diesem Abschnitt werden die Kosten für die Nutzung der KI-Modelle erörtert. Kimika 3 kostet 3 USD pro Million Input-Token und 15 USD pro Million Output-Token, während GPT 5.6 Soul 5 USD und Cloud Fable 10 bis 50 USD kostet. Es wird betont, dass die Kosten pro Aufgabe von der Tokenintensität der Modelle abhängen, was bedeutet, dass Kimika 3 nicht immer die billigste Option sein könnte, wenn es viele Tokens verbraucht.
Benchmarks
Kimika 3 wird in verschiedenen Benchmarks bewertet, die eine Kombination aus Aufgaben wie Mathematik, Logik und Fachwissen umfassen. In diesen Vergleichen zeigt sich, dass Kimika 3 dicht hinter Cloud Fable 5 und GPT 5.6 Soul liegt. Besonders hervorzuheben ist ein Benchmark, in dem Kimika 3 im Frontend-Bereich gut abschneidet. Auch beim Programmieren zeigt Kimika 3 vielversprechende Ergebnisse, benötigt jedoch mehr Zeit als die Konkurrenz.
Der Praxistest
Im Praxistest werden alle drei Modelle mit denselben Aufgaben konfrontiert, um deren Qualität, Geschwindigkeit und Tokenverbrauch zu vergleichen. Jede KI erhält denselben Prompt und muss ohne Nachjustierungen ihr Ergebnis liefern. Die produzierten Outputs werden anonymisiert, sodass die Qualität von jedem Modell unvoreingenommen beurteilt werden kann.
Test 1
Die erste Testaufgabe besteht darin, eine Animation der Mona Lisa zu erstellen. Nach den Durchläufen wird GPT Soul als das schwächste Modell identifiziert, wobei Kimika 3 und Cloud Fable 5 bessere Ergebnisse liefern. Die Zeit und Kosten für jeden Test werden ebenfalls analysiert, wobei die Effizienz von Kimika 3 positiv hervorsticht.
Test 2
Im zweiten Test wird eine 3D-Animation des Sonnensystems gefordert. Die Ergebnisse variieren stark, wobei Kimika 3 in der visuellen Darstellung von Planeten überzeugen kann. Cloud Fable 5 bietet in Gesamtheit das beste Ergebnis, während GPT Soul die schwächsten Resultate liefert.
Test 3
Die finale Testaufgabe besteht darin, ein Open World Spiel zu erstellen. Kimika 3 liefert die überzeugendsten Ergebnisse in Bezug auf Funktionalitäten und visuelle Qualität, während Cloud Fable 5 und GPT 5.6 Soul schwächer abschneiden. Die Unterschiede in der Geschwindigkeit und den benötigten Tokens werden hervorgehoben, wobei Kimika 3 trotz längerer Bearbeitungszeit die beste Outputqualität erzielt.
Fazit
Das Video schließt mit einer Zusammenfassung der Ergebnisse. Während Kimika 3 in den meisten Tests die besten Kosten-Nutzen-Verhältnisse bietet, zeigt Cloud Fable 5 insgesamt die stärkste Performance, vor allem in einer Vielzahl von Aufgabentypen. Das Video thematisiert die Entwicklungen im Bereich Openweight-Modelle und schließt mit dem Hinweis auf die zukünftige Verfügbarkeit von Kimika 3 für breitere Nutzung.

