Grok 4.7: xAI startet KI-Modell mit 2,1 Billionen Parametern
Veröffentlicht am: 22.09.2026 um 18:22 Uhr | Redaktion boerse-global.de
xAI hat sein neues KI-Modell Grok 4.7 veröffentlicht, nachdem die Markteinführung seit Ende Juli mindestens fünf Mal verschoben worden war. Das neue Basismodell ist laut Berichten größer als der Vorgänger Grok 4.6 und wurde mit einem längeren Reinforcement-Learning-Training auf einem anspruchsvolleren Aufgabenmix trainiert, der auch mehrstündige Aufgaben umfasst und stark auf den sogenannten Grok Bot Harness gewichtet ist.
Größeres Modell, unveränderte Preise
Grok 4.7 verfügt laut Berichten über rund 2,1 Billionen Parameter – ein Plus von 40 Prozent gegenüber Grok 4.6 mit 1,5 Billionen Parametern. Die offizielle Model Card von xAI bestätigt diese Zahl allerdings nicht.
An der Preisstruktur hat sich gegenüber Grok 4.6 nichts geändert: Für Prompts unter 200.000 Tokens verlangt xAI 2 US-Dollar pro einer Million Input-Tokens, 6 US-Dollar pro einer Million Output-Tokens und 0,50 US-Dollar pro einer Million gecachter Input-Tokens. Bei umfangreicheren Prompts über 200.000 Tokens verdoppeln sich alle drei Raten auf 4, 12 und 1 US-Dollar pro Million Tokens.
Das Modell bietet ein Kontextfenster von 500.000 Tokens, einen Wissensstand bis Mai/Juni 2026 sowie Text- und Bildeingabe bei Text-Ausgabe. Nutzer können zwischen vier Reasoning-Stufen wählen – Low, Medium, High und xHigh, wobei High als Standard voreingestellt ist.
Zu den unterstützten Tools zählen Function Calling, Websuche, X-Suche und Code-Ausführung. Zusätzlich trainierte xAI das Modell mit SpaceX-Daten, darunter Starlink-Telemetrie, Fertigungsprotokolle und Engineering-Fehlerlogs.
Uneinheitliches Bild bei Benchmarks
Nach xAI-eigenen Angaben verbessert sich Grok 4.7 bei mehreren Benchmarks deutlich gegenüber Grok 4.6: Bei CursorBench 4.0 erreicht das Modell 46,3 Prozent statt zuvor 40,4 Prozent, bei Terminal-Bench 4.0 steigt der Wert von 20,3 auf 38,0 Prozent. Auch bei DeepSWE v1.1, EEBench, Harvey Legal Agent und HealthBench Professional verzeichnet xAI Zuwächse.
Bei Artificial Analysis liegt Grok 4.7 im Briefcase-v1.1-Test bei 1.657 Elo-Punkten, ein Plus von 111 gegenüber Grok 4.6 High. Im GDPval-Test erreicht das Modell 1.695 Elo-Punkte und nähert sich damit Claude Fable 5.1 (1.735 Punkte) an, liegt aber über GPT-6 Astra (1.542 Punkte).
Im Artificial Analysis Intelligence Index kommt Grok 4.7 im xHigh-Modus jedoch nur auf 46 Punkte – lediglich zwei mehr als Grok 4.6 – und bleibt damit hinter Claude Fable 5.1 und GPT-6 Astra zurück, die beide 53 Punkte erreichen. Im Coding Agent Index mit Grok Build erzielt das Modell 56 Punkte, ein Plus von neun Punkten, und landet auf Rang vier.
Grok 4.7 ist da — mit rund 2,1 Billionen Parametern, unveränderten Token-Preisen und einem neuen Safeguard-Stack. Doch die Benchmark-Bilder gehen auseinander, und im xHigh-Modus verbraucht das Modell deutlich mehr Output-Tokens pro Aufgabe. Wer das für sein Team einordnen will, findet hier die wichtigsten Schritte. Kostenlosen Praxis-Leitfaden zur Modellwahl anfordern
Unabhängige Tests fallen teils kritischer aus. Laut ValsAI fiel Grok 4.7 im Ranking von Platz 14 auf Platz 24 zurück und liegt fünf Punkte unter Grok 4.6. Bei Terminal-Bench 4.0 erreichte das Modell dort nur eine Pass-Rate von 26 bis 27 Prozent, während GPT-6 Astra 60 Prozent und Fable 5.1 55 Prozent schafften.
In einem separaten Praxistest mit 105 vorgegebenen Bugs über drei Runden behob GPT-6 Astra 45 Bugs, während Grok 4.7 und Grok 4.6 jeweils nur 28,7 Bugs lösten.
Zudem verbraucht Grok 4.7 im xHigh-Modus mit rund 81.000 Output-Tokens pro Aufgabe deutlich mehr als Grok 4.6 xHigh mit rund 38.000 Tokens und GPT-6 Astra Max mit rund 27.000 Tokens. Die Kosten pro Aufgabe liegen bei rund 3,74 US-Dollar gegenüber rund 3,26 US-Dollar bei GPT-6 Astra Max.
Neuer Sicherheits-Stack und eingeschränkte Verfügbarkeit
xAI stellt für Grok 4.7 einen neuen Safeguard-Stack vor, der das Modell laut eigenen Angaben zum stärksten Modell bei Refusals und Jailbreak-Resistenz macht. Im LatchBio-Biosafety-Benchmark erreicht das Modell 62,4 Prozent, im HackerBench v0.3 ließ es nur 3,3 Prozent riskanter Dual-Use-Prompts durch. Ausgewählte Cybersecurity-Partner erhalten zudem einen Invite-only-Zugang für Red-Team-Tests.
Neben dem Hauptmodell führt xAI die Variante Grok 4.7 Fast ein, die bei doppelter Token-Rate rund doppelt so schnell arbeitet und ausschließlich über Cursor und Grok Build verfügbar ist. Ein US-Regional-Endpoint verlangt einen Preisaufschlag von 10 Prozent.
Grok 4.7 ist über die Grok-App, Cursor, Grok Build, die xAI-API, Drittanbieter-Harnesses, Model-Router sowie Cloud-Plattformen wie OpenRouter, Vercel und Cloudflare erreichbar. Einen Termin für die Consumer-Grok-App oder einen kostenlosen Tarif nannte xAI bislang nicht.
Nicht jedes Benchmark-Ergebnis hält dem Praxistest stand: In unabhängigen Tests fiel Grok 4.7 gegenüber dem Vorgänger zurück, und der Token-Verbrauch pro Aufgabe treibt die Kosten. Bevor Sie Ihr Modell festlegen, lohnt ein nüchterner Blick auf Zahlen, Sicherheitsanforderungen und Alternativen. Sicherheits- und Kosten-Checkliste jetzt abrufen
Elon Musk bezeichnete Grok 4.7 als ungefähr gleichauf mit Claude Opus 5.0 und sprach von einer sehr wettbewerbsfähigen Balance aus Intelligenz, Geschwindigkeit und Kosten.
Für die Zukunft kündigte er die Modelle Grok 4.8 und 4.9 der „Astra/Fable-Klasse" sowie Grok 5 an, ohne konkrete Termine zu nennen. Zudem bestätigte Musk, dass das Training von Grok 4.8 mit 2,5 Billionen Parametern bereits vollständig abgeschlossen sei.
