Grok 4.6 Benchmark zeigt SpaceXAI auf GPT-5.6-Niveau

SpaceXAI hat mit Grok 4.6 eine neue Generation seines KI-Modells vorgestellt. Das Unternehmen rückt damit direkt in die Nähe der führenden Sprachmodelle von OpenAI und Anthropic. Benchmark-Ergebnisse und eine aggressive Preispolitik sollen Entwickler und Unternehmen überzeugen. Parallel dazu erweitert SpaceXAI sein Produktportfolio um weitere KI-gestützte Tools.
Grok 4.6 Benchmark-Ergebnisse
Im Artificial Analysis Intelligence Index erreicht Grok 4.6 exakt 61 Punkte. Dieser Wert entspricht dem Ergebnis von GPT-5.6 Sol, wenn die Reasoning-Funktion auf maximal gesetzt ist. Nur Claude Fable 5 Max schneidet mit einem Punkt Vorsprung minimal besser ab.
Gegenüber dem Vorgänger Grok 4.5 verbessert sich das neue Modell in jeder gemessenen Kategorie. SpaceXAI verweist auf folgende Benchmark-Tests, in denen die Steigerung sichtbar wird:
- CursorBench
- FrontierCode
- APEX-Agents
- Terminal-Bench
Die Ergebnisse unterstreichen die Positionierung von SpaceXAI als ernsthafter Wettbewerber im Markt der großen KI-Modelle.
Technik und Stärken des Modells
Das Modell ist speziell auf langläufige Agenten-Aufgaben, Programmierarbeit und komplexe Wissensverarbeitung ausgelegt. SpaceXAI führt die Leistungssteigerung vor allem auf ein längeres zusätzliches Training zurück. Zusätzlich fließen bessere Engineering-Daten ein und ein erweitertes Reinforcement Learning für Coding-Anwendungen.
Entwickler profitieren davon, dass Grok 4.6 über viele Arbeitsschritte hinweg den Fokus behält. Das Modell kann unbekannte Codebasen analysieren und prüft zunehmend seine eigenen Ausgaben, bevor es eine Aufgabe als abgeschlossen markiert. Diese Selbstüberprüfung soll Fehler reduzieren und die Zuverlässigkeit in anspruchsvollen Szenarien erhöhen.
Preis und Verfügbarkeit der API
Die API-Preisgestaltung startet bei 2 US-Dollar pro Million Input-Tokens. Output-Tokens berechnet SpaceXAI mit 6 US-Dollar pro Million. Wer eine schnellere Inferenz-Variante benötigt, zahlt den doppelten Preis im Vergleich zur Standard-API.
Das Modell ist ab sofort über mehrere Kanäle nutzbar:
- Cursor
- Grok Build
- SpaceXAI API
- OpenRouter
- Vercel
- Cloudflare
Nutzer von Cursor und Grok Build erhalten in der ersten Woche eine verdoppelte Nutzungsmenge. Der Code-Editor Cursor wurde bereits im Juni 2026 von SpaceXAI übernommen. Zusätzlich stellte das Unternehmen diese Woche Grok Bot für iPhone und Mac vor, was die aggressive KI-Strategie des Unternehmens weiter unterstreicht.
Das könnte dich auch interessieren
Weitere Geschichten aus Technik News.

Claude Cowork Chrome macht Browser-Sessions portabel
Claude Cowork Chrome macht Browser-Sessions geräteübergreifend portabel. Synchronisierte Chats, sofortige Skills und Schutz vor Prompt-Injection.

Sonos bringt die Ace Ultra mit KI-Features im September
Die Sonos Ace Ultra sollen im September 2026 starten und setzen auf KI-Funktionen sowie Sprachbefehle für Chatbots von Drittanbietern.

Anthropic bettet Claude-Wasserzeichen in KI-Texte ein
Anthropic markiert Claude-Texte mit unsichtbaren Signaturen. Das Claude-Wasserzeichen unterstützt Transparenz, beweist aber keine KI-Autorenschaft.

Meta startet Muse Code KI-Agent für Mac und Linux
Muse Code ist der neue KI-Agent von Meta für macOS und Linux. Der Contributor-Tarif tauscht Code-Daten gegen stark reduzierte Kosten.

Reddit prüft Kündigung des Lizenzvertrags mit Google
Reddit-Chef Steve Huffman kritisiert Googles KI-Suchzusammenfassungen scharf und signalisiert zugleich, dass das Unternehmen den 60-Millionen-Dollar-Lizenzdeal beenden könnte. Weitere große Publisher wiegen ebenfalls einen Ausstieg.

Geschichtsprofessor deckt KI-Betrug mit verstecktem Prüfungs-Trick auf
Ein US-Professor hat in einer Klausur eine unsichtbare Textfalle platziert. Das Ergebnis: Die überwältigende Mehrheit der Studenten nutzte KI-Tools und scheiterte daran.
Kommentare
Sei der Erste, der hier kommentiert.
Du musst angemeldet sein, um zu kommentieren.