
Grok 4.6 veröffentlicht: Benchmarks, Preise und erste Reaktionen
SpaceXAI hat Grok 4.6 veröffentlicht. Per Nachtraining rückt das Modell zur Spitzengruppe auf, der Preis bleibt unverändert. Benchmarks, Kosten und erste Reaktionen im Überblick.
Beiträge zum Thema
8 Beiträge

SpaceXAI hat Grok 4.6 veröffentlicht. Per Nachtraining rückt das Modell zur Spitzengruppe auf, der Preis bleibt unverändert. Benchmarks, Kosten und erste Reaktionen im Überblick.

Alibaba hat Qwen 3.8 Max freigegeben. Das Modell soll in die Nähe der Spitzenmodelle kommen und weniger kosten als die Konkurrenz. Benchmarks, Preise und Reaktionen im Überblick.

AGI steht für Maschinen, die geistig mit dem Menschen gleichziehen. Woher der Begriff kommt, wie er gemessen wird und warum die Fachwelt über ihn streitet.

Moonshot AI hat Kimi K3 veröffentlicht: 2,8 Billionen Parameter und Preise auf Claude-Niveau. Ein Überblick über Benchmarks, erste Reaktionen und Kritik.

Meta hat Muse Spark 1.1 vorgestellt und startet dazu eine bezahlte Entwickler-API. Das Modell ist auf Agenten-Aufgaben und Coding zugeschnitten und kostet deutlich weniger als die Topmodelle der Konkurrenz. Ein Überblick über Funktionen, Preise, Benchmarks und Kritik.

OpenAI hat GPT-5.6 freigegeben. Das Topmodell Sol soll Claude Mythos 5 übertreffen und die Hälfte kosten. Der Start des Modells wurde von der US-Regierung verzögert. Ein Überblick über Benchmarks, Preise und Kritik.

xAI hat Grok 4.5 vorgestellt. Das Modell soll fast Spitzenniveau erreichen und deutlich weniger kosten als die Konkurrenz. Ein Überblick über Benchmarks, Community-Feedback und Kritik.

Im Benchmark CEO-Bench der Princeton University haben 14 Sprachmodelle ein fiktives Software-Startup durch 500 simulierte Tage gesteuert. Nur drei haben ihr Startkapital vermehrt. Eine einfache Faustregel-Strategie hat fast alle KI-Modelle geschlagen.