KI im Gerichtssaal: Zwischen Effizienzversprechen und richterlicher Unabhängigkeit
Am 27.09.2026 wurde an der Universität des Saarlandes über eine Justiz diskutiert, in der Künstliche Intelligenz längst mehr ist als ein Schreibprogramm im Hintergrund. Beim 35. EDV-Gerichtstag kamen mehr als 900 Teilnehmende zusammen. Es ging um Tempo, Kosten und neue Werkzeuge – aber auch um die ziemlich unbequeme Frage, wer am Ende für ein Urteil geradesteht, wenn zuvor eine Maschine Akten gelesen, Tatbestände sortiert und Entscheidungsgründe formuliert hat.
Stefan Groß, Referent und Vertreter einer Münchner Steuerkanzlei, schilderte KI-Agenten als festen Bestandteil seiner täglichen Arbeit. Werden spezialisierte Programme miteinander verknüpft, könne eine „Schwarmintelligenz“ entstehen. Die Trennung von Primär- und Sekundärtexten ermögliche gezieltere Ergebnisse. Auf Grundlage von Entscheidungen des Bundesfinanzhofs ließen sich sogar komplette Verhandlungen simulieren und Erfolgsaussichten prognostizieren.
200 Agenten für Kanzlei und Ausbildung
Groß präsentierte einen „Skills Operator“ mit rund 200 KI-Agenten. Je nach Aufgabe können sie zusammengestellt und automatisiert fortgebildet werden. Auch in der Ausbildung sieht er Einsatzmöglichkeiten: Angehende Steuerberater könnten sich etwa in simulierten mündlichen Prüfungen testen lassen. Das klingt praktisch – und ein bisschen so, als würde künftig der digitale Prüfungsausschuss schon vor dem echten Termin unangenehme Fragen stellen.
Das Saarbrücker Institut für Rechtsinformatik stellte eine kostenlose und frei zugängliche Toolbox mit etwa zwölf Anwendungen vor. Dazu gehören automatisierte Einzelnachweise und die Suche nach juristischen Fundstellen. Die KI kann dabei auch als kritischer Gesprächspartner dienen, um die eigene Argumentationsstruktur zu prüfen und zu verbessern.
In Kanzleien, berichtete der Präsident der saarländischen Anwaltskammer, Udo Michalsky, werden bereits Akten automatisiert angelegt und standardisierte Entwürfe für Klageschriften erstellt. Die kreativen Schlussfolgerungen blieben weiterhin Aufgabe der Anwälte. Gleichzeitig wächst die Sorge, dass KI Arbeitsplätze in der Anwaltschaft verdrängen könnte.
Auch außerhalb der Kanzleien verändert sich der Zugang zum Recht. Immer mehr Privatpersonen greifen auf juristische KI-Tools zurück. Im Sozialrecht trägt das laut Artikel zu einer starken Zunahme anhängiger Verfahren bei. Mehr Hilfe auf dem Bildschirm kann also paradoxerweise mehr Arbeit bei den Gerichten erzeugen.
Wo die richterliche Unabhängigkeit beginnt
EDV-Gerichtstag-Vorsitzende Anke Morsch verwies auf die verfassungsrechtliche Vorgabe, dass Rechtsprechung von menschlichen Richterinnen und Richtern ausgehen muss. Wenn Sprachmodelle Akten auswerten, Tatbestände erstellen und Entscheidungsgründe formulieren, stellt sich die Frage nach der menschlichen Verantwortung für Urteile. Der Hinweis auf die weiterhin entscheidenden Menschen könne eine „gefährliche Beruhigungspille“ sein.
Morsch schlug deshalb vor, Verfahrensbeteiligten vor der endgültigen richterlichen Würdigung eine Stellungnahme zu KI-generierten Entscheidungsentwürfen zu ermöglichen. Die konkrete Auswirkung des KI-Einsatzes auf die Justiz wurde auf dem Gerichtstag allerdings nur begrenzt behandelt. Als zentrale offene Frage blieb, ob die richterliche Unabhängigkeit durch KI-generierte Vorleistungen beeinträchtigt wird, die wegen hoher Arbeitsbelastung zunehmend genutzt werden.
Richterliche Unabhängigkeit bedeutet vor allem Freiheit von äußeren Weisungen und Einflüssen. Der Bundesgerichtshof unterscheidet dabei zwischen dem Kernbereich der richterlichen Tätigkeit und dem äußeren Ordnungsbereich. Zum Kernbereich gehören die eigentliche Rechtsfindung sowie vorbereitende und nachfolgende Sach- und Verfahrensentscheidungen. Organisatorische Rahmenbedingungen der Arbeit liegen dagegen im äußeren Ordnungsbereich.
Im Kernbereich sind vermeidbare Einwirkungen der Exekutive untersagt – auch mittelbare, subtile oder psychologische Einflussnahmen. Der Schutz gilt zudem gegenüber Privaten. Nach Art. 97 GG sind verpflichtende Vorgaben zur KI-Nutzung im richterlichen Kernbereich daher unzulässig. Ebenfalls unzulässig wäre mittelbarer Druck, etwa wenn angenommene KI-Zeitersparnisse in die zugrunde gelegte Bearbeitungszeit pro Fall einfließen.
Der richterliche Entscheidungsfindungsprozess darf nicht mithilfe dienstlich bereitgestellter Tools überwacht werden. Die verpflichtende Bearbeitung elektronischer Akten am Bildschirm ist dagegen zulässig, weil sie dem äußeren Ordnungsbereich zugeordnet wird. Klingt nach einer schmalen Linie – ist es auch.
Von der Datenbank bis zum Textentwurf
Bei der Digitalisierung der Justiz lassen sich sechs Entwicklungsstufen unterscheiden. Am Anfang stehen Berechnungsprogramme und Fachverfahren. Sie arbeiten deterministisch, transparent und nachvollziehbar. Danach folgen juristische Datenbanken privater Anbieter, deren Suchalgorithmen und Trefferkriterien intransparent sind. Ihr Einsatz wird meist akzeptiert, weil Richterinnen und Richter die Fundstellen selbst prüfen und auf den jeweiligen Fall übertragen müssen.
Auf der dritten Stufe stehen Legal-Tech-Tools zur Aktenarbeit, etwa Codefy zur Aktenstrukturierung in Bayern oder OLGA zur Kategorisierung von Massenverfahren am OLG Stuttgart. Sie gelten als unproblematisch, weil sie keine inhaltlichen Vorgaben machen.
Anders sieht es bei generativer KI aus, die Schriftsätze zusammenfasst, Zeitstrahlen erstellt oder streitigen und unstreitigen Vortrag trennt. Solche Systeme nehmen bereits eine inhaltliche Vorbewertung vor und berühren damit den richterlichen Kernbereich. Noch deutlicher wird der Eingriff, wenn generative KI eigene rechtliche Einschätzungen liefert oder Textentwürfe für Entscheidungen erstellt.
Vollautomatisierte Entscheidungen werden wegen fehlender rechtlicher Zulässigkeit und derzeit fehlender technischer Machbarkeit nicht weiter behandelt. Das bedeutet allerdings nicht, dass freiwillige Nutzung auf den Stufen vier und fünf harmlos wäre. Auch sie kann die richterliche Unabhängigkeit beeinträchtigen. Die Unabhängigkeit ist kein persönliches Standesprivileg, sondern schützt die Justiz als Institution und die Verfahrensbeteiligten. Ein Richter kann auf sie nicht verzichten.
Die Risiken beginnen bei den Anbietern. Trainingsdaten, deren Gewichtung und hinterlegte Wertvorstellungen können subtilen Einfluss ausüben. Auch die Exekutive kann über Ausschreibung und Vergabe von Justizsoftware mitbestimmen, welche Systeme eingesetzt werden. Und weil generative KI sprachlich oft sehr überzeugend klingt, droht ein Verlust der „inneren“ Unabhängigkeit. Fehlerhafte Ergebnisse könnten zu wenig überprüft werden; unvertretbare Rechtsansichten oder erfundene Quellenangaben, sogenannte „Phantomzitate“, könnten in gerichtliche Entscheidungen gelangen und das Vertrauen in den Rechtsstaat beschädigen.
Es gibt aber auch die andere Seite. Ein reflektiert-kritischer Einsatz könnte menschliche Denkfehler verringern und zu rationaleren sowie besser begründeten Entscheidungen beitragen. Entscheidend bleibt, dass der Richter jederzeit die Kontrolle über den Entscheidungsprozess behält. Je stärker ein System inhaltlich in die Entscheidungsfindung eingreift, desto größer werden die Risiken.
Wer kontrolliert die Modelle?
In einer Podiumsdiskussion ging es um die digitale Souveränität und Unabhängigkeit der Justiz. Können Sprachmodelle oder politisch gesteuerte Regierungen diese gefährden? Als Beispiel für politischen Einfluss wurden US-Sanktionen gegen mehrere Richter des Internationalen Gerichtshofs in Den Haag genannt. Unter anderem wurden Konten und elektronische Zahlungsmöglichkeiten eingeschränkt.
DFKI-Chef Antonio Krüger forderte eigene europäische KI-Modelle auf einer gesicherten Wertegrundlage. Anlass seien unter anderem US-Exportbeschränkungen für aktuelle KI-Modelle von Anthropic. DFKI-Forscher Philipp Slusallek bezeichnete Vertrauen als ein zentrales gesellschaftliches Gut.
Christian Ulbrich erklärte, dass Techkonzerne über Trainingsdaten und die Werteausrichtung ihrer Modelle deren ideologische Ausrichtung beeinflussen. Wer die Modelle kontrolliere, habe erheblichen Einfluss. Auch die wirtschaftliche Macht großer Anbieter wie Microsoft wurde thematisiert: Hohe Lizenzkosten und politische Einflussmöglichkeiten der USA führen laut Artikel bei deutschen Entscheidern zu wachsendem Interesse an Open-Source-Modellen. Schleswig-Holstein wurde als Beispiel für den Ausstieg aus einer Microsoft-Abhängigkeit genannt.
Die KI-Verordnung stuft justizielle KI-Systeme grundsätzlich als Hochrisikosysteme ein und sieht umfangreiche Compliance-Anforderungen vor. Zugleich erkennt sie an, dass KI die Entscheidungsgewalt von Richtern und die Unabhängigkeit der Justiz unterstützen kann. Ein zentrales Instrument ist die menschliche Aufsicht durch Anbieter und Betreiber.
Die mit dieser Aufsicht betrauten Personen müssen einen möglichen Automation Bias erkennen, KI-Ausgaben richtig interpretieren und sie gegeben
