Manchmal sagt ein spielerischer Test mehr über KI aus als jede Werbebroschüre. Diese Woche ist mir ein Beispiel begegnet, das ich hier bei Media Nord gern einordne — weil dahinter eine sehr praktische Lehre für kleine Unternehmen steckt.
Was hat der Forscher da gemacht?
Ethan Mollick ist ein bekannter KI-Forscher an der Wharton School der University of Pennsylvania. Er hat verschiedenen KI-Modellen — darunter ChatGPT von OpenAI und Claude von Anthropic — eine ungewöhnliche Aufgabe gestellt: Sie sollten eine Hafenstadt über 6.000 Jahre simulieren, vom Jahr 3000 vor Christus bis 3000 nach Christus. Die Stadt sollte schön aussehen und sich per Zeitstrahl vor- und zurückspulen lassen — mit wachsenden Häusern und sich verändernden Schiffstypen.
Am besten schnitt dabei das aktuelle Claude-Opus-Modell ab. Es erschuf eine detaillierte, interaktive Hafenstadt im Zeitraffer.
Warum so ein verrückter Test?
Mollicks Argument finde ich überzeugend: Eine solche Aufgabe verlangt der KI alles auf einmal ab — Programmieren, Design, sinnvolle Entscheidungen und geschichtliches Wissen. Genau darin liegt der Wert. Denn übliche KI-Tests (sogenannte Benchmarks) messen oft nur einzelne Fähigkeiten in Zahlen. Eine komplexe, kreative Aufgabe zeigt dagegen, ob ein Modell in der Praxis wirklich etwas zusammenbringt.
Was wir bei Media Nord davon halten
Ehrlich gesagt: Die Hafenstadt selbst ist eine nette Spielerei. Aber die dahinterliegende Botschaft ist für kleine und mittlere Unternehmen richtig wertvoll — und die lautet: Trauen Sie den Werbe-Zahlen der KI-Anbieter nicht blind. Fast jeder Anbieter behauptet, sein Modell sei „das beste“. Diese Bestenlisten ändern sich im Wochentakt und sagen wenig darüber aus, ob eine KI Ihnen im Alltag hilft.
Unser Tipp aus der Praxis: Der eigene Mini-Test
Machen Sie es wie Mollick — nur in klein. Nehmen Sie eine echte Aufgabe aus Ihrem Arbeitsalltag und geben Sie sie mehreren KI-Werkzeugen zum Lösen:
- Ein typisches Kundenanschreiben formulieren lassen
- Ein langes PDF zusammenfassen lassen
- Aus Stichpunkten einen Angebotstext erstellen lassen
Welches Werkzeug liefert das brauchbarste Ergebnis für Ihre Sprache, Ihre Branche, Ihren Ton? Genau das zählt — nicht die Position in irgendeiner Rangliste. So einen Praxistest hat man in einer halben Stunde gemacht, und er ist aussagekräftiger als jedes Datenblatt.
Fazit
Der Hafenstadt-Test ist ein charmantes Beispiel dafür, dass echte Aufgaben mehr über KI verraten als abstrakte Zahlen. Für Ihren Betrieb heißt das: einfach ausprobieren, mit einer Aufgabe, die Sie ohnehin haben. Wir behalten die spannenden KI-Entwicklungen für Sie im Blick.
Quellen
- https://t3n.de/news/ki-modelle-hafenstaedte-simulation-1753416/
- https://www.finanznachrichten.de/nachrichten-2026-07/69059081-simulation-ueber-6-000-jahre-ki-forscher-laesst-sprachmodelle-hafenstaedte-im-zeitraffer-bauen-397.htm
Hinweis zur Transparenz: Dieser Beitrag wurde KI-gestützt erstellt und vor der Veröffentlichung redaktionell geprüft. Inhalte können Fehler enthalten — für wichtige Entscheidungen bitte die verlinkten Originalquellen heranziehen.


