Google DeepMind nutzt das MMORPG EVE Online als neue Forschungsumgebung für KI-Agenten. Am 6. Mai 2026 gaben DeepMind und Fenris Creations (ehemals CCP Games) eine Partnerschaft bekannt, in deren Rahmen DeepMind eine Minderheitsbeteiligung an dem isländischen Spielestudio erwarb. Die Forschung knüpft an 15 Jahre Spielforschung an, die von einfachen Atari-Titeln über Schach und Go bis zu komplexen Echtzeit-Strategiespielen reicht.
Von Atari-Pixeln zu persistenten Welten
DeepMind gründete sich 2010 unter anderem durch Demis Hassabis, selbst ehemaliger Spieleentwickler. Videospiele dienten von Anfang an als zentrale Testumgebung. 2015 veröffentlichte ein kleines Team in Nature das Deep Q-Network (DQN), ein tiefes neuronales Netzwerk, das 49 Atari-2600-Spiele direkt aus rohen Pixeln erlernte – ohne spielspezifisches Engineering. Die Arbeit katalysierte die moderne Ära des Deep Reinforcement Learning.
2016 besiegte AlphaGo den Weltmeister Lee Sedol im Go, ein Ereignis, das Experten für noch ein Jahrzehnt entfernt hielten. Zug 37 ("Move 37"), ein so unerwarteter Spielzug, dass professionelle Kommentatoren ihn zunächst für einen Fehler hielten, kehrte jahrhundertealte Weisheit im Go um. Folgeprojekte wie AlphaGo Zero, das ausschließlich aus selbstgeneriertem Spiel lernte, und AlphaZero, das einen einzigen Algorithmus auf Schach, Shogi und Go anwandte, verallgemeinerten den Ansatz. MuZero lernte später zu spielen, ohne die Spielregeln zu kennen.
2019 erreichte AlphaStar Grandmaster-Niveau in StarCraft II und navigierte dabei Echtzeit-Komplexität und unvollständige Informationen. Die gleichen Grundlagen flossen auch in AlphaFold ein, das Proteinfaltungs-System, das 2024 mit dem Nobelpreis für Chemie ausgezeichnet wurde.
Paradigmenwechsel: Agenten statt Punktejäger
Die jüngere Forschungslinie verschiebt den Fokus von Systemen, die ein einzelnes Spiel mit klarem Punktestand meistern, hin zu Agenten, die sich in beliebigen Spielwelten bewegen. SIMA (Scalable Instructable Multiworld Agent) nimmt nur wahr, was ein Spieler auf dem Bildschirm sieht, und agiert durch gewöhnliche Tastatur- und Maussteuerungen. Der Agent hat keinen Zugriff auf Game-Code und muss den Spielzustand aus dem Bildschirm-Output ableiten – die gleiche Einschränkung, unter der menschliche Spieler operieren.
Im November 2025 erweiterte SIMA 2 mit einem Gemini-Modell als Kern das Repertoire der ersten Version über deren 600 sprachbasierte Fähigkeiten hinaus. DeepMind berichtet, dass SIMA 2 einen signifikanten Teil der Lücke zur menschlichen Task-Completion-Leistung in Trainingsumgebungen schließt, einschließlich Spiele, auf die es nicht trainiert wurde (wie ASKA und eine Minecraft-Forschungsimplementierung). SIMA 2 kann über Ziele nachdenken, mit Nutzern konversieren und sich durch selbstgesteuertes Spielen verbessern. Der Agent kämpft allerdings noch mit sehr langfristigen Aufgaben und arbeitet mit begrenztem Speicher (durch das Context Window für niedrige Latenz eingeschränkt). Er ist nur als limitierte Forschungsvorschau für eine kleine Gruppe von Akademikern und Spieleentwicklern verfügbar.
EVE Online als "Final Boss" für KI
EVE Online ist eine persistente Welt, die seit 2003 kontinuierlich läuft. Das Single-Shard-Universum hält tausende Spieler in einer gemeinsamen Wirtschaft mit echter Angebots- und Nachfrage-Dynamik sowie von Spielern vollständig aufgebauten politischen Strukturen. Gegenüber Engadget sagte Hilmar Veigar Pétursson, CEO von Fenris Creations: "We jokingly say that the final boss for AI in games would obviously be EVE Online."
Im Gegensatz zu den meisten bisherigen Forschungsumgebungen hat EVE keinen definierten Match, kein klares Ziel und keinen Punkt, an dem alles zurückgesetzt wird. Die Forschung mit DeepMind beginnt mit einer Offline-Version von EVE Online, die auf lokalen Servern läuft. Die Live-Tranquility-Universe wird nicht beeinträchtigt. Die Agenten sehen nur das, was ein Mensch sieht, nicht die zugrunde liegenden Datenstrukturen – die gleiche observational constraint wie bei der Atari-DQN-Arbeit und SIMA.
Unternehmensstruktur und Partnerschaft
Die DeepMind-Partnerschaft fiel zeitlich mit einer umfassenden Transformation von CCP Games zusammen. Am 30. April 2026 wurde ein Management-Buyout von Pearl Abyss abgeschlossen. Hilmar Veigar Pétursson und das Team besitzen das Unternehmen nach acht Jahren unter dem südkoreanischen Publisher wieder. Birgir Már Ragnarsson, CCP-Mitgründer, übernahm die Position des Board Chair.
Am 6. Mai 2026 kündigte das nun wieder unabhängige und isländische Studio ein Rebranding zu Fenris Creations an – ein Callback zum ersten veröffentlichten Spiel von CCP aus 1997. Am gleichen Tag wurde die Minderheitsbeteiligung von DeepMind und die Forschungspartnerschaft bekannt gegeben. Die Unternehmen planen, AI-gestützte Gameplay-Erfahrungen zu erkunden.
Weitere Partnerschaften
Neben Fenris Creations unterhält DeepMind tiefe Partnerschaften mit Hello Games, Coffee Stain Studios und Foulball Hangover. Die EVE Online-Partnership wird als nächster logischer Schritt in DeepMinds historischer Forschungslinie betrachtet: Atari-Spiele → Schach und Go → EVE Online.
