let's techle it · künstliche Intelligenz

DrivingBench: GPT-6 Astra fährt Corolla, aber nur im Schritttempo

Corolla mit comma.ai-Technik fährt selbstständig durch Pylonenparcours, Mensch überwacht Notbremse
BP | KI-generiert mit ChatGPT KI am Steuer: Corolla im Pylonentest
Erschienen
Aktualisiert
Lesezeit3 Min · 680 Wörter
Seite1 / 2

GPT-6 Astra hat als erstes große Sprachmodell einen echten Toyota Corolla durch einen Pylonenparcours gesteuert. Der Benchmark DrivingBench zeigt aber vor allem, wie viel dieser Erfolg nicht beweist.

Ein Toyota Corolla, ausgestattet mit comma.ai-Hardware, rollt mit knapp einem Meter pro Sekunde durch einen 134,7 Meter langen Pylonenparcours. Am Steuer sitzt kein Mensch, sondern GPT-6 Astra, das Fahrzeug über einzelne Chat-Befehle lenkt.

Demnach schaffte Astra die Strecke im zweiten Versuch in 5 Minuten und 22 Sekunden und ließ Konkurrenzmodelle von Anthropic und xAI deutlich hinter sich. Es ist ein technisch bemerkenswerter Moment, weil ein Modell, das eigentlich für Text und Code gebaut wurde, ohne Fahrtraining ein physisches Fahrzeug bewegt hat. Nur: Von autonomem Fahren im eigentlichen Sinn ist das weit entfernt.

Wie der Test funktionierte

Das Projekt hinter DrivingBench stammt von den Entwicklern Aditya Ramabadran, Simon Mahns und Tobias Gessler. Eine comma.ai comma 4 übernahm die Anbindung an Lenkung, Gas und Bremse über den Fahrzeug-CAN-Bus. Die Modelle steuerten das Auto dabei nicht direkt, sondern über drei MCP-Werkzeuge innerhalb ihrer gewohnten Coding-Umgebung, GPT-6 Astra etwa in Codex, Claude Fable 5.1 in Claude Code. Ein Tempolimit von 3,5 Metern pro Sekunde und ein Mensch mit Zugriff auf die Notbremse sicherten den Versuch ab, wie berichtet.

Astra scheiterte im ersten Anlauf nach etwa der Hälfte der Strecke, absolvierte den Kurs nach einer Fehleranalyse aber im zweiten Versuch vollständig. Dafür verarbeitete das Modell rund 6,6 Millionen Tokens zu Kosten von etwa 7,74 Dollar. Bemerkenswert ist zudem ein Detail aus dem Bericht: Manche Modelle zierten sich, das reale Fahrzeug überhaupt zu steuern und verwiesen dabei auf Sicherheitsbedenken, bevor sie überhaupt losfuhren.

Deutlicher Abstand zur Konkurrenz

Der Sprung zwischen den OpenAI-Generationen fällt auf: Der Vorgänger GPT-5.6 Sol kam kaum von der Startlinie weg, während Astra die komplette Strecke bewältigte. Claude Fable 5.1 schaffte in seinem dritten Versuch etwa die Hälfte des Parcours, Grok 4.6 kam laut den veröffentlichten Ergebnissen ebenfalls nicht über die erste Kurve hinaus.

Martin Wald

Tech & Security

Martin Wald analysiert die Schnittstelle zwischen Geld, Macht und Alltag. Seine Themen reichen von Rente, Sozialstaat und Gesundheit bis zu Wirtschaft, Märkten und technologischen Umbrüchen. Er zerlegt politische Entscheidungen, Urteile und Trends auf ihre ökonomischen Folgen und macht sichtbar, wer gewinnt, wer verliert und wo Risiken liegen. Der Blick ist pragmatisch, pointiert und nutzenorientiert. Keine Wohlfühltexte, sondern Einordnung für Menschen, die verstehen wollen, wie Systeme funktionieren und was das für ihre Entscheidungen bedeutet.