ChatGPT
gedeckt OpenAI
Die GPT-Modellfamilie von OpenAI ist der bekannteste Name der KI-Welle und vielen Mitarbeitenden aus der privaten Nutzung vertraut - Bedienung und Antwortstil sind bekannt, die Einarbeitung fällt entsprechend kurz aus. Berufsrechtlich hängt alles am Bezugsweg: Geschlossen ist die Vertragskette ausschließlich über Azure: Dort ist die Verschwiegenheitsverpflichtung in Textform mit Belehrung über die Strafbarkeit gezeichnet, und Eingaben fließen nicht ins Modelltraining. Direkt beim Hersteller fehlt genau dieser Baustein - ein öffentlich verfügbares Dokument dazu war zum Recherchestand Juli 2026 nicht auffindbar -, und der frei zugängliche Zugang kennt weder Auftragsverarbeitungsvertrag noch Verschwiegenheitsverpflichtung.
- Höchste Bekanntheit im Team - ChatGPT ist der Einstieg, den alle bereits kennen
- Breite Aufgaben-Abdeckung von Entwurfsarbeit bis Recherche-Vorbereitung
Stärken, Grenzen und Einordnung auf der Modell-Seite
Claude Sonnet
gedeckt Anthropic
Die mittlere Stufe der Standard-Claude-Familie von Anthropic und für viele der praktische Standard: nah an der Textqualität der großen Stufe, aber spürbar schneller und günstiger je Vorgang - sie trägt die tägliche Entwurfs- und Zusammenfassungsarbeit. Auch hier entscheidet der Bezugsweg: Über Google Vertex AI ist die Kette geschlossen, denn der Plattform-Betreiber hat eine dienstgebundene Verschwiegenheitsvereinbarung nach § 203 StGB gezeichnet, und der Betrieb läuft über EU-Endpunkte ohne Speicherung über die Verarbeitung hinaus. Über Amazon Bedrock ist die technische Zusage stark, ein zeichenbares Dokument für die Verschwiegenheitsverpflichtung fehlt jedoch; über Azure, direkt beim Hersteller und über die frei zugänglichen Zugänge besteht keine Deckung.
- Ausgewogene Stufe aus Qualität und Durchsatz für die tägliche Entwurfs- und Zusammenfassungs-Arbeit
- Kein Content-Zugriff durch Google oder Anthropic auf der Google-Plattform (Anthropic-Doku), Speicherfreiheit wählbar
Stärken, Grenzen und Einordnung auf der Modell-Seite
Gemini Flash
gedeckt Google
Das schnelle Allzweck-Modell aus der Gemini-Familie von Google: Es liest lange Dokumente am Stück, fasst sie zusammen und beantwortet Rückfragen zum selben Text, ohne dass er erneut hochgeladen werden muss. Neben Text verarbeitet es Scans und Bilder, was es für Akten- und Belegarbeit brauchbar macht. Der geprüfte Bezugsweg ist Google Vertex AI, und auf ihm ist die Vertragskette geschlossen: Die Verschwiegenheitsvereinbarung nach § 203 StGB des Plattform-Betreibers ist gezeichnet, dienstgebunden für alle Modelle der Plattform, davor steht die Verpflichtung nach § 203 Abs. 4 StGB. Weil ein US-Konzern in der Kette bleibt, gehört der Drittland-Baustein zwingend dazu.
- Großes Kontextfenster und Multimodalität für Akten-, Tabellen- und Beleg-Arbeit
- Maximale No-Persistence-Konfiguration am EU-Endpunkt konfigurierbar (kein Caching, kein Abuse Monitoring)
Stärken, Grenzen und Einordnung auf der Modell-Seite
Llama
gedeckt Meta
Ein bewährtes offenes Textmodell von Meta für Zusammenfassung, Entwurfsarbeit und Korrespondenz. Weil die Gewichte offen vorliegen, gibt es keinen Modellhersteller, an den etwas übermittelt wird; bei komplexer juristischer Argumentation liegt die Textqualität unter den Claude-Stufen. Berufsrechtlich ist dieses Modell breit aufgestellt: Im dedizierten Betrieb auf reservierter Hardware in Deutschland, bei einem deutschen EU-Betreiber, über die Open Telekom Cloud und über Azure auf reservierter Kapazität ist die Kette jeweils geschlossen - das nach § 203 StGB nötige Glied, die Verschwiegenheitsverpflichtung des mitwirkenden Betreibers, liegt gezeichnet vor. Bei IONOS steht die produktbezogene Bestätigung dieser Klausel dagegen noch aus.
- Bewährtes offenes Text-Modell für Zusammenfassung und Entwurfsarbeit
- Offene Gewichte - Betrieb ohne US-Cloud in der Kette möglich
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
Qwen
gedeckt Alibaba Cloud (Qwen)
Ein offenes, auf Herleitung ausgelegtes Modell der Qwen-Familie, das seine Zwischenschritte ausweist: Man sieht nicht nur das Ergebnis, sondern den Weg zur Einordnung - hilfreich, wo die Herleitung fachlich nachgeprüft werden soll. Besonders zuverlässig arbeitet es bei strukturierter Extraktion aus Dokumenten; die deutsche Rechtssprache trifft es weniger sicher als die europäischen Modelle. Drei Wege sind für Berufsgeheimnisse geschlossen: der dedizierte Betrieb auf reservierter Hardware, der EU-Betreiber offener Modelle als deutscher Betreiber und die Open Telekom Cloud, wo das Modell in deutschen Rechenzentren läuft und die Verschwiegenheitsvereinbarung nach § 203 StGB gezeichnet ist. Über IONOS bleibt die Kette offen, solange die produktbezogene Bestätigung der § 203-Klausel fehlt.
- Reasoning-fähiges Modell mit nachvollziehbaren Zwischenschritten für Analyse- und Recherche-Vorbereitung
- Offene Gewichte - EU-Betrieb ohne Datenfluss an den Modellhersteller
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
Gemma
gedeckt Google
Googles offene Modellreihe in kompakter Größe: schnell, sparsam und mit solider deutscher Sprachqualität - im MÖVE-Benchmark der Bundesdruckerei auf deutschsprachigem Behörden- und Rechtsmaterial führt sie das Feld mit an, gemessen allerdings an Verwaltungs-, nicht an Mandatsarbeit. Weil die Gewichte offen sind, ist die Kette gleich auf vier Wegen geschlossen: über einen deutschen EU-Betreiber, über die Open Telekom Cloud, wo T-Systems dieses Modell selbst in Deutschland betreibt, und im dedizierten Betrieb auf reservierter Hardware, bei dem allein der Rechenzentrumsbetreiber über § 203 Abs. 4 StGB zu verpflichten ist. Beim Betrieb auf eigener Hardware in den eigenen Räumen wirkt gar kein Dritter mehr mit.
- Bester belegter Leistungsnachweis auf deutschsprachigen Verwaltungs- und Rechtstexten
- Offene Gewichte - Betrieb in Europa oder im eigenen Haus möglich
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
Apertus
gedeckt Swiss AI Initiative (EPFL, ETH Zürich)
Das transparenteste Modell dieses Katalogs, entwickelt an ETH Zürich und EPFL: Offengelegt sind nicht nur die Gewichte, sondern auch Trainingsdaten und Verfahren - ein Herkunftsnachweis, den geschlossene Modelle nicht bieten. Berufsrechtlich trägt es auf drei Wegen. Bei der EU-Betreiber offener Modelle, dem deutschen Betreiber, ist die Zusatzvereinbarung nach § 203 StGB gezeichnet, mit Belehrung über die Strafbarkeit und Kettenverpflichtung auf die Subunternehmer. Im dedizierten Betrieb auf reservierter Hardware bindet dieselbe Kettenverpflichtung den Rechenzentrumsbetreiber. Und beim Betrieb auf eigener Hardware in den eigenen Räumen wirkt kein Dritter mit, sodass sich die Offenbarungsfrage des § 203 gar nicht erst stellt.
- Vollständig offengelegt - Gewichte, Trainingsdaten und Verfahren sind belegbar
- Öffentlich-akademische Herkunft statt Anbieter-Blackbox
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
GPT-OSS
gedeckt OpenAI
Das Modell mit offenen Gewichten von OpenAI - nicht zu verwechseln mit ChatGPT. Der Antwortstil trägt eine verwandte Handschrift, ausführen lässt es sich aber im eigenen Haus, statt es beim Hersteller aufzurufen; der Funktionsumfang bleibt hinter der großen ChatGPT-Klasse zurück. Für Berufsgeheimnisse sind gleich vier Wege tragfähig: Beim Betrieb auf eigener Hardware wirkt kein Dritter mit, sodass sich die Offenbarungsfrage des § 203 StGB gar nicht erst stellt; im dedizierten Betrieb auf reservierter Hardware, bei einem deutschen EU-Betreiber und über die Open Telekom Cloud schließt die gezeichnete Verschwiegenheitsverpflichtung des jeweiligen Betreibers die Kette. Bei IONOS fehlt bislang die produktbezogene Bestätigung dieser Klausel.
- Offene Gewichte ohne Lizenzeinschränkungen - Betrieb in Europa oder im eigenen Haus
- Vertrauter Antwortstil für Teams, die OpenAI-Modelle gewohnt sind
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
DeepSeek
gedeckt DeepSeek
Ein Modell mit offenen Gewichten, das seine Denkschritte ausweist: Es rechnet Aufgaben schrittweise durch, statt nur ein Ergebnis zu nennen - hilfreich bei Fristenketten und mehrstufigen Prüfungen, deren Herleitung nachvollziehbar bleiben soll; je Antwort kostet das spürbar mehr Zeit. Für Berufsgeheimnisse tragen drei Wege: der EU-Betreiber offener Modelle als deutscher Betreiber und die Open Telekom Cloud, beide mit gezeichneter Verschwiegenheitsvereinbarung nach § 203 StGB, dazu Azure, wo das Modell von der Plattform selbst verkauft und über reservierte Kapazität in EU-Regionen betrieben wird. Der Bezug direkt beim Hersteller ist dagegen ausgeschlossen: Er führt personenbezogene Daten nach China, ohne Angemessenheitsbeschluss und ohne durchsetzbare Betroffenenrechte.
- Reasoning-Modell mit nachvollziehbaren Zwischenschritten für strukturierte Analyse-Aufgaben
- Offene Gewichte - Betrieb ohne US-Konzern in der Kette möglich
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
Muse Glimmer
gedeckt Meta
Die kompakte Stufe von Metas Muse-Reihe, der Nachfolge der Llama-Linie: aus dem größeren Schwestermodell destilliert und unter freier Lizenz veröffentlicht, also ohne Nutzerobergrenze und ohne Zustimmungsvorbehalt des Herstellers. Sie reicht für Zusammenfassungen, Vermerke und Korrespondenz am eigenen Material und kommt dabei mit überschaubarer Hardware aus. Genau daraus folgt die berufsrechtliche Lage: Geschlossen ist die Kette im dedizierten Betrieb auf reservierter Hardware in Deutschland, wo allein der Rechenzentrumsbetreiber noch mitwirken kann und über § 203 Abs. 4 StGB gebunden ist - und beim Betrieb auf eigener Hardware, bei dem sich die Offenbarungsfrage des § 203 nicht stellt.
- Apache 2.0 ohne Nutzerobergrenze - die Llama-Lizenz kannte eine Schwelle von 700 Millionen aktiven Nutzern
- Läuft mit 30 Milliarden Parametern auf einer einzelnen Grafikkarte, also im dedizierten Betrieb
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
Nemotron
gedeckt NVIDIA
NVIDIAs offene Modellreihe, gestaffelt von einer kompakten bis zu einer sehr großen Ausbaustufe. Der Grund für den Eintrag ist das außergewöhnlich große Kontextfenster: Eine vollständige Akte samt Anlagen passt in einen Vorgang, ohne sie vorher zu zerschneiden; die größte Stufe verlangt allerdings mehr Rechenleistung, als eine einzelne Maschine bereitstellt. Läuft das Modell auf eigener Hardware, wirkt kein Dritter mit, und die Offenbarungsfrage des § 203 StGB stellt sich nicht. Im dedizierten Betrieb auf reservierter Hardware in Deutschland und über die Open Telekom Cloud ist die Kette ebenfalls geschlossen: Dort bindet die gezeichnete Verschwiegenheitsverpflichtung den Betreiber, der an der Verarbeitung mitwirkt.
- Kontextfenster von bis zu einer Million Token - umfangreiche Akten müssen nicht gestückelt werden
- Nano und Super laufen im dedizierten Betrieb auf einer Karte, Ultra braucht mehr Hardware
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
GLM
gedeckt Z.ai (Zhipu AI)
Ein Modell mit offenen Gewichten unter MIT-Lizenz, das im Artificial-Analysis-Index den höchsten Wert unter den offenen Modellen erreicht (Stand 08/2026); Betrieb, Änderung und Weitergabe sind ohne Rückfrage beim Hersteller möglich, der Trainingsschwerpunkt liegt auf Programmier- und Agentenaufgaben, nicht auf deutscher Rechtssprache. Geschlossen ist die Vertragskette über die Open Telekom Cloud: T-Systems betreibt dieses Modell selbst in Deutschland und sagt zu, dass Ein- und Ausgaben weder gespeichert noch von der Telekom oder Dritten einsehbar sind und kein Training auf Kundendaten stattfindet. Der dedizierte Betrieb auf reservierter Hardware und der Betrieb auf eigener Hardware scheitern hier nicht am Recht, sondern an der Ausstattung.
- MIT-Lizenz - die freieste der gängigen Modelllizenzen, ohne Nutzerschwelle und ohne Nutzungsvorbehalt
- Höchster Wert im Artificial-Analysis-Index unter allen Modellen mit offenen Gewichten (Stand 08/2026)
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
Phi
gedeckt Microsoft
Microsofts kleine Modellreihe mit offener Lizenz, ergänzt um eine Variante mit Bildverstehen und eine auf Herleitung ausgelegte Stufe. Das ist die Klasse für Fleißarbeit an Belegen: Rechnungsdaten auslesen, Pflichtangaben prüfen, Scans erfassen - sparsam im Betrieb, für lange Schriftsätze aber zu klein. Weil die Gewichte offen vorliegen, endet die Verarbeitung dort, wo das Modell läuft. Im dedizierten Betrieb auf reservierter Hardware in einem deutschen Rechenzentrum ist die Kette deshalb geschlossen; gebunden ist dann der Rechenzentrumsbetreiber, über die Verpflichtung nach § 203 Abs. 4 StGB. Beim Betrieb auf eigener Hardware wirkt überhaupt kein Dritter mit, dann stellt sich die Offenbarungsfrage des § 203 nicht.
- MIT-Lizenz - Betrieb, Änderung und Weitergabe ohne Rückfrage beim Hersteller
- Klein genug für eine dedizierte Instanz mit geringen Betriebskosten
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
Whisper
gedeckt OpenAI
Das verbreitetste Modell für die Umwandlung von Sprache in Text, mit Abdeckung von über 99 Sprachen - für Diktate, Mandantengespräche und Besprechungsmitschnitte. Es erzeugt eine Mitschrift, keine Bewertung des Gesagten; Sprecherwechsel erkennt es nicht von selbst, und bei längerer Stille kann es Text erfinden, weshalb Mitschriften gegenzuhören sind. Auf vier Wegen ist die Vertragskette geschlossen: auf eigener Hardware, wo kein Dritter mitwirkt, im dedizierten Betrieb auf reservierter Hardware, über die Open Telekom Cloud in deutschen Rechenzentren sowie über Azure, wo die Verschwiegenheitsverpflichtung nach § 203 StGB gezeichnet vorliegt. Bei Diktaten ist zusätzlich das im Auslieferungszustand aktive Abuse-Monitoring zu würdigen.
- MIT-Lizenz und klein genug, um in jeder dedizierten Instanz mitzulaufen
- Über 99 Sprachen, belastbar auch bei Nebengeräuschen und Telefonqualität
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
Voxtral
gedeckt Mistral AI
Mistrals Modell für Sprache zu Text, auf laufende Verarbeitung ausgelegt: Der Text entsteht während des Diktats und nicht erst nach der Aufnahme, und im FLEURS-Vergleich liegt die Wortfehlerrate unter der des breit eingesetzten Referenzmodells - die Sprachabdeckung fällt dafür schmaler aus. Weil die Gewichte offen sind, kommt das Modell ohne Übermittlung an einen Modellhersteller aus: Im dedizierten Betrieb auf reservierter Hardware in einem deutschen Rechenzentrum ist die Kette geschlossen, gebunden wird dort der Rechenzentrumsbetreiber über die Kettenverpflichtung nach § 203 Abs. 4 StGB. Beim Betrieb auf eigener Hardware in den eigenen Räumen stellt sich die Offenbarungsfrage des § 203 gar nicht erst.
- Genauer als Whisper im FLEURS-Vergleich - 5,9 statt 7,4 Prozent Wortfehlerrate
- Echte Streaming-Verarbeitung: Text entsteht während des Diktats, nicht erst danach
Verarbeitung: Deutschland
Stärken, Grenzen und Einordnung auf der Modell-Seite
ChatGPT mini
gedeckt OpenAI
Die mittlere Größenklasse der GPT-Reihe von OpenAI, auf Durchsatz und Kosten geschnitten: dieselbe Familie, dieselbe Bedienung und derselbe Antwortstil wie die große Klasse, nur schneller und sparsamer - die Arbeitsstufe für alles, was in Menge anfällt. Berufsrechtlich trägt der Bezug über Azure: Die Verarbeitung bleibt in der EU, die Ablage im Ruhezustand in der gewählten Azure-Geografie, und die Verschwiegenheitslinie ist gezeichnet - sie erfasst die von Azure verkauften Modelle, zu denen diese Reihe laut Dokumentation zählt. Auf diesem Weg ist die Kette nach § 203 StGB damit geschlossen.
- Deutlich günstiger und schneller als die große Klasse - die passende Wahl für Aufgaben in Menge
- Gleiche Vertrags- und Residenz-Lage wie die große Klasse: EU-Verarbeitung, gezeichnete Verschwiegenheitsverpflichtung
Stärken, Grenzen und Einordnung auf der Modell-Seite
Mistral Medium
gedeckt Mistral AI
Die mittlere Ausbaustufe des französischen Herstellers Mistral AI, angesiedelt zwischen der großen Stufe und den kompakten Modellen. Sie passt zu Aufgaben, die in Menge anfallen, aber mehr Sorgfalt verlangen als reines Auslesen: Zusammenfassungen, Korrespondenz-Entwürfe, Vorprüfungen. Für Berufsgeheimnisse tragen zwei Wege, und auf beiden ist die Kette geschlossen: über Azure und über Google Vertex AI - auf beiden liegt die Verschwiegenheitsverpflichtung nach § 203 StGB gezeichnet vor. Beide Male steht ein US-Konzern als Plattformbetreiber in der Kette, und die EU-Bindung ist per Organisationsrichtlinie zu erzwingen.
- Ausgewogenes Verhältnis von Kosten, Antwortzeit und Qualität für Aufgaben in Menge
- Von der Plattform selbst verkauft und betrieben - dieselbe Vertrags- und Residenz-Lage wie die übrigen von Azure verkauften Modelle
Stärken, Grenzen und Einordnung auf der Modell-Seite
Gemini Pro
gedeckt Google
Die große, auf Herleitung ausgelegte Stufe der Gemini-Familie von Google mit sehr großem Kontextfenster - die Wahl für Akten mit vielen Anlagen und für Vertrags- und Schriftsatzarbeit, bei der der ganze Vorgang in einem Durchgang vorliegen muss. Über Google Vertex AI ist die Kette geschlossen: Der Plattform-Betreiber hat eine dienstgebundene Verschwiegenheitsvereinbarung nach § 203 StGB gezeichnet, die Verarbeitung während der Anfrage ist für die EU zugesagt, und die projektbezogene Ausnahme von der Protokollierung liegt genehmigt vor. Voraussetzung bleibt, dass der Bezug auf EU-Endpunkte beschränkt wird - der globale Endpunkt der Plattform gibt keine Residenz-Garantie.
- Sehr großes Kontextfenster - eine vollständige Akte mit Anlagen passt in einen Durchgang
- Reasoning-Stufe der Familie für Vertrags- und Schriftsatzarbeit mit vielen Bezügen
Stärken, Grenzen und Einordnung auf der Modell-Seite
Gemini Flash Lite
gedeckt Google
Die kompakteste Stufe der Gemini-Familie von Google, für Volumenarbeit gebaut: Belege sortieren, Felder aus Formularen ziehen, Posteingang klassifizieren, Standardkorrespondenz vorbereiten. Schriftsatzentwürfe und lange Herleitungen gehören auf eine größere Stufe der Familie. Bezogen wird sie über Google Vertex AI, und auf diesem Weg ist die Vertragskette geschlossen: Der Plattform-Betreiber hat eine Verschwiegenheitsvereinbarung nach § 203 StGB gezeichnet - dienstgebunden, also nicht an ein einzelnes Modell geknüpft -, davor greift die Kettenverpflichtung nach § 203 Abs. 4 StGB. Der Aufruf ist dafür auf die EU-Endpunkte zu beschränken; der globale Endpunkt gibt keine Residenz-Garantie.
- Günstigste und schnellste Stufe der Familie - für Massenläufe über viele Belege gebaut
- Über den EU-Endpunkt der Plattform aufrufbar, Verarbeitung in der EU zugesagt
Stärken, Grenzen und Einordnung auf der Modell-Seite