Worum es in diesem Teil geht
In Teil 1 ging es darum, was du mit fremden Texten veröffentlichen darfst. Teil 2 hat gezeigt, wann ein mit KI umgeschriebener Text zu nah am Original bleibt. Dieser Teil setzt einen Schritt früher an. Er fragt, was schon beim Hochladen gilt.
Ein PDF in ChatGPT ziehen, einen Vertrag in Claude kopieren, eine Excel-Liste an Copilot geben: Das dauert Sekunden. Rechtlich passiert dabei aber mehr, als man sieht. Das Dokument verlässt dein Unternehmen und landet auf den Servern eines Anbieters. Vier Rechtsgebiete können betroffen sein: Urheberrecht, Lizenzverträge, Vertraulichkeit und Datenschutz.
Dieser Text ist eine Momentaufnahme der Rechtslage zum Stand 8. Oktober 2026. Recht und Rechtsprechung ändern sich gerade bei KI schnell. Mehrere wichtige Verfahren sind noch offen. Beim Europäischen Gerichtshof läuft etwa ein erstes Verfahren über einen KI-Chatbot (C-250/25, Like Company gegen Google). Eine Entscheidung steht aus.
Vier Fragen vor jedem Upload
Bevor du ein fremdes Dokument in ein KI-Tool gibst, helfen dir vier Fragen weiter:
- Urheberrecht: Ist der Text geschützt, und darf ich ihn kopieren?
- Vertrag: Erlauben die Bedingungen, unter denen ich das Dokument bekommen habe, eine KI-Nutzung?
- Vertraulichkeit: Ist das Dokument geheim oder durch eine Verschwiegenheitsvereinbarung geschützt?
- Datenschutz: Stehen darin Namen, Kontaktdaten oder andere Angaben zu Personen?
Jede Frage für sich kann gegen einen Upload sprechen. Erst wenn alle vier Antworten passen, ist das Risiko gering.
Urheberrecht: Hochladen ist Kopieren
Lädst du eine Datei hoch oder fügst du Text in ein Chatfenster ein, entsteht eine Kopie beim Anbieter. Rechtlich ist das in aller Regel eine Vervielfältigung (§ 16 UrhG). Vervielfältigen darf grundsätzlich nur, wer die Rechte hat oder eine gesetzliche Erlaubnis nutzen kann.
Die bekannte Privatkopie hilft im Job nicht weiter. Sie gilt nur für Privatpersonen und nur für private Zwecke ohne Erwerbsbezug (§ 53 Abs. 1 UrhG). Eine allgemeine Erlaubnis für die interne Nutzung im Unternehmen kennt das Gesetz nicht.
Text- und Data-Mining: eine Erlaubnis mit offenen Fragen
Seit 2021 gibt es eine Erlaubnis für das sogenannte Text- und Data-Mining. Gemeint ist die automatisierte Analyse von einem oder mehreren Werken. Ziel ist, daraus Informationen zu gewinnen, vor allem über Muster, Trends und Zusammenhänge (§ 44b Abs. 1 UrhG). Dafür darfst du rechtmäßig zugängliche Werke kopieren (§ 44b Abs. 2 UrhG). Rechtmäßig zugänglich ist etwa ein frei abrufbarer Artikel oder eine Studie aus einem bezahlten Zugang. Die Kopien musst du löschen, sobald du sie für die Analyse nicht mehr brauchst.
Ob ein KI-Chat darunter fällt, ist nicht geklärt. Lässt du eine einzelne Studie zusammenfassen, willst du meist ihren Inhalt verstehen. Ob das schon eine Analyse auf Muster und Zusammenhänge ist, wird unterschiedlich gesehen. Ein Urteil genau zu dieser Frage ist uns nicht bekannt. Das Landgericht München I hat aber in einem anderen Fall entschieden: Die Erlaubnis deckt nur Kopien, die einer automatisierten Analyse dienen (Urteil vom 11. November 2025, 42 O 14139/24, GEMA gegen OpenAI). Das Urteil ist noch nicht rechtskräftig. Verlass dich deshalb nicht allein auf diese Erlaubnis.
Die bisherigen Urteile zum KI-Training betreffen eine andere Lage. Im Fall eines Fotografen gegen den Verein LAION ging es um einen Datensatz für das KI-Training. Das Landgericht Hamburg (27. September 2024, 310 O 227/23) und das Oberlandesgericht Hamburg (10. Dezember 2025, 5 U 104/24) wiesen die Klage ab. Die Gerichte stützten sich vor allem auf die Erlaubnis für die wissenschaftliche Forschung (§ 60d UrhG). Für Unternehmen greift sie meist nicht. Der Bundesgerichtshof hat am 3. September 2026 verhandelt (I ZR 281/25). Eine Entscheidung gibt es noch nicht. Möglich ist, dass er Fragen dem Europäischen Gerichtshof vorlegt.
Der Nutzungsvorbehalt
Rechteinhaber können das Text- und Data-Mining ausschließen. Dann greift die Erlaubnis nicht (§ 44b Abs. 3 Satz 1 UrhG). Bei Werken, die online stehen, muss dieser Vorbehalt maschinenlesbar sein, also von Programmen erkannt werden können (§ 44b Abs. 3 Satz 2 UrhG). Was genau als maschinenlesbar gilt, ist umstritten. Im LAION-Fall reichte dem Oberlandesgericht Hamburg ein Hinweis in Alltagssprache in den Nutzungsbedingungen nicht aus. Das galt aber für den Zeitpunkt des Downloads im Jahr 2021. Ob so ein Hinweis heute genügt, hat das Gericht offen gelassen.
Ein Beispiel
Du lädst eine frei abrufbare Marktstudie hoch und lässt dir die fünf wichtigsten Zahlen nennen. Einzelne Zahlen und Fakten sind in der Regel frei, das hat Teil 1 gezeigt. Die Kopie der ganzen Studie beim Anbieter ist die heikle Stelle. Sicherer ist es, nur die Abschnitte einzufügen, die du wirklich brauchst. Noch besser: Du prüfst vorher, ob die Studie unter einer offenen Lizenz steht.
Wenn der Anbieter mit deinen Uploads trainiert
Davon zu trennen ist eine zweite Frage. Manche Tarife erlauben dem Anbieter, deine Eingaben für das Training seiner Modelle zu nutzen. Dann wandert der fremde Text womöglich in ein Modell. Das Landgericht München I hat im GEMA-Fall schon das Merken von Liedtexten im Modell als Vervielfältigung gewertet. Verantwortlich war dort der Anbieter. Ob du als Nutzer mitverantwortlich wärst, ist gerichtlich nicht geklärt. Schalte die Trainingsnutzung deshalb ab, wenn du fremde Texte hochlädst. Das senkt das Risiko. An der Frage, ob du hochladen darfst, ändert es aber nichts. Wie das Abschalten geht, steht weiter unten im Abschnitt zum Datenschutz.
Lizenz- und Nutzungsbedingungen: Der Vertrag geht vor
Viele Fachtexte bekommst du nicht einfach so. Du hast ein Abo bei einem Verlag, einen Zugang zu einer Datenbank oder ein Dokument von einem Partner. Dann gelten die Bedingungen dieses Vertrags. Sie können mehr verbieten als das Urheberrecht.
Manche Anbieter von Studien und Datenbanken schließen in ihren Bedingungen die Nutzung für KI ausdrücklich aus. Andere behalten sich das Text- und Data-Mining vor. Nach verbreiteter Ansicht darf ein Vertrag die allgemeine Erlaubnis aus § 44b UrhG ausschließen. Anders ist es beim Text- und Data-Mining zur wissenschaftlichen Forschung (§ 60d UrhG). Darauf kann sich ein Rechteinhaber bei solchen Klauseln nicht berufen (§ 60g Abs. 1 UrhG). Für Unternehmen greift dieser Schutz in aller Regel nicht.
Ein Verstoß gegen die Bedingungen ist ein Vertragsbruch. Greift keine gesetzliche Erlaubnis, kann er zugleich das Urheberrecht verletzen. Der Anbieter kann dann zum Beispiel den Zugang sperren, Unterlassung oder Schadensersatz verlangen. Was genau droht, hängt vom konkreten Vertrag ab.
Beispiel: Deine Firma hat einen Zugang zu einem Statistikportal. Du willst zehn Grafiken in ein KI-Tool laden und daraus eine Präsentation bauen lassen. Lies vorher die Nutzungsbedingungen des Portals. Steht dort ein KI-Verbot, brauchst du eine Freigabe des Anbieters. Ob du die Zahlen mit Quellenangabe selbst übernehmen darfst, steht ebenfalls in den Bedingungen.
Vertraulichkeit: NDA und Geschäftsgeheimnisse
Ein Angebot eines Lieferanten, der Vertragsentwurf eines Kunden, die Präsentation eines Partners: Solche Unterlagen bekommst du oft unter einer Verschwiegenheitsvereinbarung, kurz NDA. Die meisten NDAs erlauben die Weitergabe nur an bestimmte Personen. Ob ein KI-Anbieter dazugehört, steht im Vertrag. Oft ist das nicht ausdrücklich geregelt. Frag dann vorher nach.
Daneben gilt das Geschäftsgeheimnisgesetz. Wer ein fremdes Geschäftsgeheimnis nur eingeschränkt nutzen oder nicht offenlegen darf, muss sich daran halten (§ 4 Abs. 2 Nr. 2 und 3 GeschGehG). Ob ein Upload in ein KI-Tool schon eine Offenlegung ist, hängt vom Einzelfall ab. Darauf solltest du es nicht ankommen lassen.
Auch deine eigenen Geheimnisse brauchen Schutz. Eine Information ist nur dann ein Geschäftsgeheimnis, wenn ihr Inhaber angemessene Geheimhaltungsmaßnahmen getroffen hat (§ 2 Nr. 1 GeschGehG). Das können Verträge, Zugriffsrechte oder klare interne Regeln sein. Wer Geheimnisse ohne Regeln in beliebige Tools gibt, schwächt im Streitfall seine Position. Eine interne KI-Richtlinie ist deshalb auch eine Schutzmaßnahme.
Für bestimmte Berufe gilt zusätzlich das Strafrecht. Ärzte, Anwälte, Steuerberater und andere Berufsgeheimnisträger unterliegen einer Schweigepflicht (§ 203 StGB). Auch wer für sie arbeitet, kann sich strafbar machen (§ 203 Abs. 4 StGB). Arbeitest du für sie oder mit ihren Unterlagen, kläre den KI-Einsatz deshalb vorher mit ihnen.
Datenschutz: Wenn Personen im Dokument stehen
Sobald ein Dokument Angaben zu Menschen enthält, gilt die Datenschutz-Grundverordnung (DSGVO). Personenbezogen sind alle Informationen, die sich einer Person zuordnen lassen (Art. 4 Nr. 1 DSGVO). Dazu gehören Namen, E-Mail-Adressen, Kundennummern und Gesprächsnotizen, oft auch Lebensläufe oder Verträge mit Unterschrift.
Du brauchst eine Rechtsgrundlage
Jede Verarbeitung braucht eine Rechtsgrundlage (Art. 6 Abs. 1 DSGVO). Im Unternehmen ist das oft ein Vertrag oder ein berechtigtes Interesse, also ein nachvollziehbarer geschäftlicher Grund. Ob das berechtigte Interesse trägt, entscheidet eine Abwägung mit den Interessen der Betroffenen. Außerdem gilt Datenminimierung: nur so viele Daten wie nötig (Art. 5 Abs. 1 lit. c DSGVO). Für besonders sensible Daten gelten strengere Regeln, etwa für Gesundheitsdaten (Art. 9 DSGVO). Die gehören ohne fachliche Prüfung in kein KI-Tool.
Ein Vertrag zur Auftragsverarbeitung
Verarbeitet ein Anbieter Daten in deinem Auftrag, brauchst du einen Vertrag zur Auftragsverarbeitung, kurz AVV (Art. 28 DSGVO). Darin verpflichtet sich der Anbieter, die Daten nur nach deinen Weisungen zu nutzen. Viele Anbieter bieten einen AVV nur für Business-, Enterprise- oder API-Tarife an. Für kostenlose Verbraucherkonten gibt es in der Regel keinen. Personendaten aus dem Unternehmen gehören deshalb nicht in solche Konten. Prüf das beim jeweiligen Anbieter, bevor dein Team Kundendaten hochlädt.
Daten in den USA
Viele KI-Anbieter sitzen in den USA. Für die Übermittlung dorthin brauchst du eine Grundlage nach Art. 44 ff. DSGVO. Seit dem 10. Juli 2023 gibt es dafür den Angemessenheitsbeschluss der EU-Kommission zum EU-US Data Privacy Framework. Darin bestätigt die Kommission, dass zertifizierte US-Unternehmen Daten ausreichend schützen. Er gilt also nur für US-Unternehmen, die sich danach zertifiziert haben. Das Gericht der EU hat eine Klage gegen den Beschluss am 3. September 2025 abgewiesen (T-553/23, Latombe). Der Kläger hat das Urteil beim Europäischen Gerichtshof angefochten (Rechtsmittel C-703/25 P). Eine Entscheidung steht aus. Kippt der Beschluss, müssten Unternehmen auf andere Grundlagen ausweichen. Das sind etwa Standardvertragsklauseln, also von der EU-Kommission vorgegebene Musterverträge (Art. 46 Abs. 2 lit. c DSGVO). Dazu gehört dann eine eigene Prüfung der Risiken. Mehr dazu steht im Guide KI-Agenten und Datenschutz.
Training abschalten, Business-Tarif wählen
Die deutschen Datenschutzbehörden raten: Die Nutzung deiner Eingaben für das Training sollte sich abschalten lassen. Bei Accounts für Beschäftigte sollen Training und Eingabe-Verlauf schon bei Inbetriebnahme abgeschaltet sein. So steht es in ihrer Orientierungshilfe „Künstliche Intelligenz und Datenschutz“ vom 6. Mai 2024. Die Anbieter regeln das unterschiedlich (Stand: Oktober 2026):
- Anthropic nutzt Chats aus den Verbrauchertarifen Free, Pro und Max seit Herbst 2025 für das Training, wenn du die entsprechende Einstellung aktiviert lässt. Die Daten bleiben dann bis zu fünf Jahre gespeichert, sonst grundsätzlich 30 Tage. Für Team, Enterprise und die API gilt das nach Angaben von Anthropic nicht.
- OpenAI nutzt nach eigenen Angaben Daten aus ChatGPT Business und Enterprise standardmäßig nicht für das Training. In den Verbrauchertarifen kannst du die Trainingsnutzung in den Einstellungen abschalten. Das wirkt nur für neue Chats.
Bei beiden gilt: Bewertest du eine Antwort per Daumen hoch oder runter, kann das Gespräch trotzdem ins Training fließen. Diese Angaben stammen von den Anbietern und können sich ändern. Prüf sie vor der Einführung selbst. Das Abschalten des Trainings ersetzt keinen AVV.
Anonymisieren und schwärzen
Am einfachsten ist es, Personendaten vorher zu entfernen. Daten, die sich keiner Person mehr zuordnen lassen, fallen nicht unter die DSGVO. So steht es in Erwägungsgrund 26, einer Erläuterung am Anfang der DSGVO. Wirklich anonym sind Daten erst, wenn niemand sie mit vertretbarem Aufwand wieder einer Person zuordnen kann. Ersetzt du Namen nur durch Kürzel und behältst die Zuordnung, bleiben die Daten für dich personenbezogen. Das nennt man Pseudonymisierung. Für einen Empfänger ohne Zuordnung können solche Daten nach dem Europäischen Gerichtshof anonym sein (C-413/23 P, 4. September 2025). Für dich ändert das nichts.
Beispiel: Du willst Beschwerden aus dem Kundenservice auswerten lassen. Lösch vorher Namen, E-Mail-Adressen und Bestellnummern aus der Tabelle. Achte auch auf Freitext, denn Kunden nennen dort oft Telefonnummern oder Adressen. Was übrig bleibt, gibst du in ein Tool mit AVV und abgeschaltetem Training.
Die Ampel für typische Dokumente
Die Ampel ist eine grobe Orientierung. Sie ersetzt nicht den Blick auf das einzelne Dokument.
Grün: in der Regel unproblematisch
- Eigene Texte ohne Personendaten und ohne Geheimnisse
- Gesetze, Verordnungen, amtliche Gerichtsentscheidungen und amtliche Leitsätze (§ 5 Abs. 1 UrhG), nicht aber Leitsätze und Anmerkungen von Verlagen
- Gemeinfreie Texte, deren Schutz abgelaufen ist (aber Vorsicht bei neueren Übersetzungen und Ausgaben)
- Texte unter einer offenen Lizenz wie CC BY, die das Kopieren mit Namensnennung erlaubt
Gelb: erst prüfen, dann mit Vorsicht
- Frei abrufbare Fachartikel, Studien und Presseartikel: nur nötige Auszüge, Training aus
- Inhalte aus bezahlten Datenbanken und Abos: Nutzungsbedingungen lesen
- Interne Unterlagen ohne Personendaten: nur im freigegebenen Firmen-Tool
- Dokumente mit wenigen Personendaten: vorher schwärzen oder anonymisieren
Rot: nicht ohne Freigabe
- Unterlagen unter NDA, wenn der Vertrag die Weitergabe nicht erlaubt
- Inhalte, deren Bedingungen eine KI-Nutzung ausschließen
- Kundenlisten, Personalakten oder Bewerbungen in Tools ohne AVV
- Gesundheitsdaten und andere besonders sensible Daten
- Geschäftsgeheimnisse in kostenlosen Verbrauchertarifen
- Unterlagen von Berufsgeheimnisträgern wie Kanzleien oder Arztpraxen
So gehst du vor
Die folgenden Schritte senken das Risiko deutlich. Eine Garantie sind sie nicht.
- Tool festlegen: Legt im Team fest, welche KI-Tools für Firmendaten erlaubt sind. Bevorzugt Tarife mit AVV und ohne Trainingsnutzung.
- Herkunft klären: Frag dich bei jedem Dokument, woher es stammt und unter welchen Bedingungen du es bekommen hast.
- Weniger hochladen: Gib nur die Abschnitte ein, die du für deine Frage brauchst. Ein ganzer Vertrag ist selten nötig.
- Personen entfernen: Lösch Namen und Kontaktdaten, bevor du hochlädst. Prüf auch Kopfzeilen, Kommentare und Metadaten wie Autor oder Bearbeitungsverlauf in der Datei.
- Link statt Datei: Bei öffentlichen Texten reicht oft eine kurze Beschreibung und der Link zur Quelle. Ruft das Tool die Seite selbst ab, entsteht aber auch dort eine Kopie. Rechtlich geklärt ist dieser Weg nicht.
- Regeln aufschreiben: Halte die Regeln in einer kurzen KI-Richtlinie fest. Das hilft dem Team und stärkt den Schutz deiner Geschäftsgeheimnisse. Seit Februar 2025 müssen Unternehmen Maßnahmen ergreifen, um die KI-Kompetenz ihrer Beschäftigten zu fördern (Art. 4 KI-Verordnung). Seit Juli 2026 ist die Pflicht etwas abgeschwächt: Ein bestimmtes Kompetenzniveau ist nicht mehr gefordert.
- Im Zweifel fragen: Frag deine Datenschutzbeauftragte, den Rechteinhaber oder den Vertragspartner, bevor du hochlädst.
Checkliste vor dem Hochladen
- Ist das Dokument urheberrechtlich geschützt? Wenn ja: Brauche ich wirklich den ganzen Text?
- Erlauben Abo, Lizenz oder Nutzungsbedingungen eine Nutzung mit KI?
- Gilt eine Verschwiegenheitsvereinbarung, die die Weitergabe einschränkt?
- Enthält das Dokument Geschäftsgeheimnisse, eigene oder fremde?
- Stehen darin Personendaten? Kann ich sie vorher entfernen?
- Gibt es für das Tool einen AVV, und ist die Trainingsnutzung abgeschaltet?
- Ist das Tool im Unternehmen für diese Art von Daten freigegeben?
Mehr dazu in den anderen Teilen
- Was du mit dem Ergebnis darfst: Wann ein KI-Text zu nah am Original bleibt, steht in Teil 2.
- Wem der KI-Text gehört: Ob an KI-Ergebnissen ein Urheberrecht entsteht, klärt Teil 3.
- Bilder und Screenshots: Was für Grafiken auf deiner Website gilt, behandelt Teil 5.
- Kennzeichnen: Wann du KI-Inhalte nach der KI-Verordnung der EU kennzeichnen musst, zeigt Teil 6.