KI dringt immer mehr in den Alltag ein und ich persönlich beschäftige mich auch schon lange hobbymäßig damit, quasi als man die ersten sau-hässlichen Bilder mit Dall-E die ersten Bilder generieren konnte und dann mit Stable Diffusion das ganze auch lokal möglich geworden ist.
In diesem Thread möchte ich mit euch Modding in Kombination mit KI erkunden. Denn Modding ist schon immer ein Bestandteil von Total War gewesen, aber gerade Medieval 2 hatte da recht niedrige Einstiegshürden und leicht maschinell lesbare Textdateien und ich kenne mich eher damit aus als mit meinetwegen Attila. Deshalb vergreife ich mich hier auch an Medieval 2. Also seit gespannt, ich bin es auch ![]()
Warum das ganze, bis auf dem Spaß an der Freude? Medieval 2 hat wie gesagt vergleichsweise geringe Einstiegshürden. Dennoch, um ein größeres Traumprojekt zu Ende zu bringen, braucht es am besten ein Team aus mehreren Leuten die unterschiedlichen Dinge können + sehr viel Zeit. Mithilfe von KI könnte man den Aufwand aber vielleicht deutlich reduzieren und es damit auch jemand der erst mal überhaupt keinen Plan hat, was er wie tun muss erlauben das Spiel zu modden.
Aber damit man einigermaßen folgen kann was ich tue, fange ich mal mit dem Setup an, wobei ich unterschiedliche Tools und KIs verwenden werden:
Frontend + Provider:
- OpenCode mit Ollama.
- Claude Code mit...na ja Claude.
Verwendete KI Modelle (bisher):
- Opus 4.8
- Fable
- GLM 5.2
- Deepseek V4 Flash
- Ornith 9b
- Qwen Coder 14B
Zusätzlich:
- Git
- Github
- Superpowers (https://github.com/obra/superpowers)
- headroom (nur Claude Code - https://github.com/headroomlabs-ai/headroom)
Sowohl OpenCode als auch Claude Code verwende ich in der GUI Variante für Windows = mit grafischer Oberfläche, nicht die Terminal-Variante. In der Vergangenheit habe ich auch OpenClaw getestet und das hat grundsätzlich auch gut funktioniert, in Kombination mit Ollama sogar etwas besser als OpenCode. Problem war, dass gefühlt jedes Update alles zerschossen hat und ich quasi die Hälfte der Zeit nicht mit dem eigentlichen Projekt, sondern mit dem wieder zum Laufen bringen von OpenClaw beschäftigt war. Wenn ihr andere Frontends wie z.B. Hermes länger ausprobiert habt, dann berichtet gerne über eure Erfahrungen dazu ![]()
Als ich damals an Schwert und Speer und Orient & Okzident mitgearbeitet habe, gab es so was Schönes wie Git noch nicht für uns. Wir haben mit jeder Menge Backups gearbeitet immer Gefahr laufend doch etwas kaputtzumachen. Jederzeit auf alte Dateistände zurückrollen zu können ist aber ein Mega Plus, auf welches ich auch ohne KI jetzt nicht mehr verzichten würde. Superpowers macht Coding einfach noch ein bisschen besser und headroom spart Tokens.
Ziel:
Das Ziel meines Projekts ist es SuS um die Features von M2EX zu ergänzen und mit den aufgehobenen Limitierungen auch neue Fraktionen oder Features mit einzubauen. Das macht es für die KI auch ein bisschen schwerer, weil sie vielleicht ein bisschen was von Medieval 2 weiß, aber praktisch nichts von M2EX.
Erste Erkenntnisse:
In meinem ersten Beitrag gehe ich jetzt erst mal noch nicht weiter auf die technischen Details wie Installation der Tools ein, wenn das gewünscht ist, kann ich es nachholen, aber eigentlich gibt es im Internet genug Tutorials dazu.
Ich habe jede KI erst mal gefragt, ob sie Medieval 2 Modding kann und jede KI hat das auch mehr oder weniger bejaht. Qwen und Ornith sind lokale Modelle. Im Grunde funktioniert das, gerade wenn man gute Hardware und kein Model hat. Probleme dabei: Medieval 2 Modding ist eher ein Randthema, die Modelle sind nicht fokussiert darauf trainiert, große Modelle wissen zu dem Thema tendenziell mehr und man profitiert tatsächlich bei diesem Thema sehr stark von einem riesigen Kontextfenster und das hat man lokal eher nicht.
Also weiter zu den Alternativen und weiteren Erkenntnissen:
GLM 5.2 ist aktuell eines der besten Opensource Coding-Modelle, verwende ich wie die lokalen Modelle über Ollama Cloud, Deepseek V4 Flash ist etwas schlechter, aber bei OpenCode gratis mit dabei und hat einige Sachen erstaunlich gut gelöst. Wer überhaupt kein Geld ausgeben möchte, kann es auch OpenRouter testen. Nachteil, bei den kostenlosen Modellen stimmt man meist zu, dass die eigenen Eingaben fürs Training verwendet werden. Außerdem hatte ich, als ich es früher mal getestet habe, viel häufiger Timeouts als bei Ollama.
Ich habe beide Modelle ohne tiefere Vorbereitung auf Schwert und Speer losgelassen und erst mal über Github Issues und dazugehörige Planungen anlegen lassen, um M2EX Features für die Mod zu portieren. Ich habe dabei auch Learnings angelegt, d.h. die KI sollte in eine .md Datei Dinge schreiben, die sie herausgefunden hat, in der Architektur oder Dinge die sie falsch gemacht hat, um sie bei Wiederholung besser zu machen.
Die KI ist im Grunde ganz gut darin den Medieval 2 Log auszulesen und wenn es nur darum geht eine einzelne Datei zu ändern läuft das ganze auch ziemlich solide. Gerade GLM ist ja wie gesagt sehr gut darin strukturiert zu arbeiten und so etwas wie einen Kampagnenscript abzuarbeiten. Gute gesammelte Erkenntnisse waren dabei z.B. die Formatierung (also z.B. UTF-8, 16 etc. welche die Dateien haben müssen/können um fehlerfrei gelesen werden zu können.
Spätestens beim Hinzufügen einer Fraktion kamen wir dann aber sehr schnell an die Grenzen. Ich wollte Wales aus Kingdoms hinzufügen und das war dann tatsächlich ein bisschen frustrierend. Anders als z.B. bei der Nutzung irgendeiner Programmiersprache fehlt es dann doch an tiefgreifenden Kenntnissen zum Medieval 2 Modding. Die KI kennt sich zwar so ungefähr aus und kann Wales auch in diversen Dateien hinzufügen, aber Medieval 2 hat sehr viele Abhängigkeiten von unterschiedlichen Dateien. Wird da an irgendeiner Stelle unsauber gearbeitet hat man meist direkt einen Absturz.
Debugging und noch mehr Erkenntnisse:
Ich bin dann dazu übergegangen mit Opus 4.8 und Fable zu debuggen. Interessanterweise hatte ich dabei das Gefühl, dass sich Fable dabei manchmal dümmer angestellt hat als Opus, keine Ahnung warum. Hier zeigt sich dann auch eine weitere Erkenntnis: Es liegt nicht nur daran, dass Opus so viel schlauer wäre als GLM, GLM hat keinerlei Vision-Fähigkeit und ist quasi blind. Opus kann mit Screenshots arbeiten und z.B. nativ die Kartendaten optisch lesen, GLM hat da ewig drum rumgearbeitet und versucht das über ein python Programm auszulesen. Kostet natürlich auch wesentlich mehr Tokens. Letztendlich muss ich aber sagen: Hätte ich die Fraktion von Hand eingebaut, wäre ich schneller gewesen.
Ziel für weitere Arbeiten:
Es ging mir hier erst mal um Prüfung wie gut Modelle überhaupt mit Medieval 2 klarkommen, noch nicht um maximale Effizienz. Die soll jetzt aber besser werden, deshalb ein paar Sachen die ich gerne machen möchte:
- KI lesbare Anleitung speziell zum Erstellen einer neuen Fraktion und zukünftig Fehler zu vermeiden.
- Mehr automatische Regressiontests - die KI kann damit nach jeder Änderung automatisiert und ohne großen Token-Verbrauch testen, ob ihre Änderung etwas zerschießt. Ich hab schon einige davon nebenher erstellen lassen, aber ich brauche noch mehr. Generell sind diese Tests auch ganz ohne KI lauffähig und wären daher auch so gar nicht verkerht fürs Modding.
- Darauf aufbauend KI-lesbare Moddingtools, welche der KI erleichtern Änderungen vorzunehmen, ohne was zu zerschießen.
- Je nach Umfang und Praktikabilität dann auch ein UI drauf klatschen, damit auch Menschen es verwenden können.
- Einen Weg finden auch die grafischen Elemente durch die KI ändern zu lassen ohne zwangsweise ein Abo für z.B. OpenAI Modelle haben zu müssen und auch auf Medieval 2 angepasst.