AI Academy News - DeepSeeks offene Datenbank: Eine Million Logzeilen ohne Schutz
DEEPSEEK-DATENLECK

Breaking News

DeepSeeks offene Datenbank: Eine Million Logzeilen ohne Schutz

Breaking News

Wiz Research fand Anfang 2025 eine öffentlich erreichbare DeepSeek-Datenbank mit über einer Million Logzeilen, darunter Chat-Inhalte und sensible Schlüssel. Der Fall zeigt, wie eine ungeschützte Infrastruktur das Vertrauen in einen KI-Anbieter erschüttern kann.

AI-Avatar AnnaKI-gestützt · AI-Avatar Anna · News & Trends · AI-Redaktion
TB

Expert in the Loop · Fachlich geprüft von Dr. Tom Berger

27. September 2026 · 7 Min Lesezeit

Artikel teilen
Artikel anhören

Management Summary

Wiz Research fand Anfang 2025 eine öffentlich erreichbare DeepSeek-Datenbank mit über einer Million Logzeilen, darunter Chat-Inhalte und sensible Schlüssel. Der Fall zeigt, wie eine ungeschützte Infrastruktur das Vertrauen in einen KI-Anbieter erschüttern kann.

DeepSeeks offene Datenbank liefert Antworten, obwohl niemand ein Passwort eingegeben hat. Ende Januar 2025: Das Forschungsteam von Wiz untersucht die öffentlich erreichbare Infrastruktur des chinesischen KI-Anbieters und stößt auf einen Datenbankdienst, der Abfragen ohne Authentifizierung zulässt. Der Schauplatz ist ein aus dem Internet zugängliches ClickHouse-Webinterface. Eine genaue Uhrzeit des Fundes ist öffentlich nicht dokumentiert. Was sich dagegen belegen lässt, ist brisant: Hinter dem Zugang liegen mehr als eine Million Logzeilen mit Chat-Inhalten, sensiblen Schlüsseln und internen Betriebsinformationen.[1][1]

Es ist kein spektakulärer Einbruch mit gestohlenen Zugangsdaten. Die Forschenden müssen keine Anmeldung überwinden. Die entscheidende Sicherheitsbarriere fehlt. Am 29. Januar 2025 veröffentlicht Wiz den Bericht über einen Fund, der die Debatte um leistungsfähige KI auf eine unangenehm praktische Frage lenkt: Wer schützt eigentlich die Daten hinter dem Chatfenster?[1]

1. Die Spur führt nicht zum Modell, sondern zur Infrastruktur

DeepSeek zieht zu dieser Zeit weltweit Aufmerksamkeit auf sich. Doch Wiz untersucht nicht, wie klug das Modell antwortet oder wie effizient es trainiert wurde. Das Team betrachtet die nach außen sichtbaren Systeme des Unternehmens: Domains, Subdomains und erreichbare Dienste.[1][2]

Dabei fallen zwei offene Ports auf: 8123 und 9000. Sie führen zu einer ClickHouse-Datenbank. ClickHouse ist ein System zur Verarbeitung und Analyse großer Datenmengen, das unter anderem für Protokoll- und Ereignisdaten eingesetzt wird.[1]

Ein offener Port allein beweist noch keine Sicherheitslücke. Dienste müssen erreichbar sein, um ihre Aufgabe zu erfüllen. Entscheidend ist, wer darauf zugreifen darf. Hier stellt sich heraus: Die Datenbank ist öffentlich zugänglich, ohne dass Nutzende ihre Berechtigung nachweisen müssen. Aus einem technischen Fund wird damit ein konkretes Vertraulichkeitsproblem.[1][3]

2. Eine Abfrage, dann liegen interne Daten offen

Über die HTTP-Schnittstelle erreichen die Forschenden eine Oberfläche für SQL-Abfragen. Sie können die Datenbank untersuchen, Tabellen auflisten und Inhalte abrufen. Der Wiz-Bericht dokumentiert dabei eine Tabelle namens log_stream, die mehr als eine Million Protokolleinträge enthält.[1]

Die Zahl klingt gewaltig. Ihre Bedeutung liegt aber nicht allein in der Menge. Solche Aufzeichnungen können Vorgänge zusammenführen, die im normalen Betrieb an verschiedenen Stellen entstehen: Eingaben, technische Meldungen, Hinweise auf interne Dienste. Eine zentrale Protokollsammlung kann dadurch zum besonders empfindlichen Datenbestand werden.[4]

Wiz beschreibt nicht nur die Möglichkeit, einzelne Informationen zu lesen, sondern weitreichenden Zugriff auf Datenbankoperationen. Das unterscheidet den Vorfall von einer versehentlich veröffentlichten Datei: Hier steht ein aktiver Dienst offen, der auf Anfragen reagiert.[1] Die Forschenden sehen nicht bloß eine Oberfläche. Sie können mit dem dahinterliegenden System interagieren.

3. Warum die Logzeilen so brisant sind

Nach Angaben von Wiz finden sich in den zugänglichen Daten Chat-Verläufe beziehungsweise Chat-Inhalte, API-Geheimnisse, Backend-Informationen und operative Metadaten. Reuters greift den Fund auf und berichtet ebenfalls über offengelegte Chat-Historien und sensible technische Informationen.[1][2]

Damit treffen zwei Risikokategorien aufeinander. Gesprächsinhalte können vertrauliche Angaben enthalten. Technische Schlüssel wiederum können, abhängig von Gültigkeit und Berechtigungen, den Zugang zu weiteren Diensten ermöglichen. Ein Protokollsystem ist dann nicht nur Gedächtnis einer Anwendung, sondern möglicherweise auch Wegweiser zu anderen Teilen ihrer Infrastruktur.

Die entscheidende Einschränkung lautet: Mehr als eine Million Logzeilen bedeutet nicht mehr als eine Million betroffene Menschen. Ebenso wenig lässt sich daraus dieselbe Zahl vollständiger Gespräche ableiten. Ein einzelner Vorgang kann mehrere Einträge erzeugen. Die veröffentlichten Befunde erlauben keine belastbare Umrechnung in eine konkrete Zahl betroffener Personen.[1][2]

4. DeepSeek schließt den Zugang – Fragen bleiben

Wiz informiert DeepSeek über die offene Datenbank. Nach Darstellung des Forschungsteams reagiert der Anbieter und sichert den Zugang zeitnah ab. Auch Reuters berichtet, dass die Exposition nach dem Hinweis beendet wurde.[1][2]

Das ist der Wendepunkt der Geschichte: Der öffentlich erreichbare Zugang wird geschlossen. Doch damit ist nicht automatisch geklärt, was zuvor geschehen ist. Aus den genannten Berichten ergibt sich weder eine vollständige Rekonstruktion der Expositionsdauer noch ein gesicherter Überblick über mögliche Zugriffe durch Dritte.

Hier muss die Einordnung präzise bleiben. Belegt ist, dass Wiz sensible Informationen ohne Authentifizierung erreichen konnte. Nicht belegt ist damit, dass Kriminelle diese Daten bereits kopiert oder Schlüssel missbraucht haben. Umgekehrt beweist das Schließen des Zugangs nicht, dass zuvor niemand sonst hineingesehen hat. Eine bestätigte Offenlegung und ein bestätigter krimineller Datendiebstahl sind unterschiedliche Sachverhalte.[1][2]

5. Der Fall trifft auf eine größere Datenschutzdebatte

Der Vorfall steht nicht isoliert. Europäische Datenschutzbehörden beschäftigen sich Anfang 2025 mit DeepSeek und den datenschutzrechtlichen Fragen rund um generative KI. Der Europäische Datenschutzausschuss, kurz EDPB, berichtet im Februar über den Austausch zu DeepSeek und die Ausweitung seiner bisherigen ChatGPT-Taskforce auf KI allgemein.[3]

Diese Entwicklung darf nicht als Beweis für eine unmittelbare Reaktion auf genau die von Wiz gefundene Datenbank dargestellt werden. Die behördliche Debatte reicht weiter: Sie betrifft unter anderem den Umgang mit personenbezogenen Informationen und die Pflichten von KI-Anbietern.

Der technische Fund macht allerdings anschaulich, warum diese Fragen zusammengehören. Datenschutz hängt nicht nur von Erklärungen und Vertragsklauseln ab. Er muss auch im laufenden Betrieb funktionieren. Ob Informationen in einer Anwendung, einer Analysedatenbank oder einem Logsystem landen, ändert nichts daran, dass ihr Schutz organisiert werden muss.[4]

Was bedeutet das für Unternehmen?

Für Unternehmen ist die wichtigste Lehre nicht, einen einzelnen Anbieter pauschal abzuschreiben. Sie lautet: Modellleistung und Betriebssicherheit müssen getrennt bewertet werden. Ein überzeugender Test im Chatfenster sagt wenig darüber aus, wie sorgfältig Protokolle, Schnittstellen und Zugangsdaten geschützt sind.[4]

Erstens: Datenflüsse nachvollziehen. Vor dem produktiven Einsatz sollte geklärt sein, welche Eingaben gespeichert werden, ob sie in Diagnoseprotokollen auftauchen, wie lange sie erhalten bleiben und wer sie einsehen kann. Auch Support- und Monitoringprozesse gehören in diese Prüfung.[4]

Zweitens: Vertrauliche Inhalte begrenzen. Geschäftsgeheimnisse, personenbezogene Angaben und Zugangsschlüssel sollten nicht ungeprüft an externe KI-Dienste übermittelt werden. Verbindliche Regeln und technische Kontrollen helfen, die Entscheidung nicht allein einzelnen Beschäftigten zu überlassen.[4]

Drittens: Die eigene Infrastruktur prüfen. Der Fall ist ebenso eine Warnung an Betreiber interner KI-Anwendungen. Datenbanken benötigen geeignete Netzwerkgrenzen, Authentifizierung und begrenzte Berechtigungen. Protokolle sollten sensible Inhalte möglichst gar nicht erst aufnehmen.[4]

Viertens: Auf Offenlegungen vorbereitet sein. Werden möglicherweise noch gültige Schlüssel exponiert, reicht das Schließen eines Ports als Reaktion nicht aus. Dann sind die betroffenen Berechtigungen zu prüfen und Geheimnisse gegebenenfalls zu ersetzen. Bei personenbezogenen Daten müssen zudem mögliche Prüf-, Dokumentations- und Meldepflichten bewertet werden. Welche Schritte erforderlich sind, hängt vom konkreten Fall ab.[4]

Fazit

Die offene DeepSeek-Datenbank zeigt ein bekanntes Sicherheitsproblem in einem hochaktuellen Umfeld. Nicht das Sprachmodell wird überlistet. Eine unterstützende Komponente ist unzureichend abgeschirmt, und plötzlich sind sensible Informationen von außen abrufbar.[1]

DeepSeek sichert den Zugang nach dem Hinweis von Wiz. Das ist wichtig, ersetzt aber keine Aufklärung möglicher Folgen. Für Unternehmen bleibt eine nüchterne Erkenntnis: Vertrauenswürdige KI beginnt nicht erst bei der Qualität einer Antwort. Sie beginnt auch dort, wo Eingaben gespeichert, verarbeitet und protokolliert werden.[4]

Häufige Fragen

Wurden mehr als eine Million DeepSeek-Nutzer betroffen?

Das lässt sich aus den veröffentlichten Angaben nicht ableiten. Wiz nennt mehr als eine Million Logzeilen. Diese Zahl beschreibt Protokolleinträge, nicht eindeutig identifizierte Personen oder vollständige Chats. Eine belastbare Zahl betroffener Menschen geht daraus nicht hervor.[1]

Hat Wiz DeepSeek gehackt?

Wiz dokumentiert den Zugriff auf eine öffentlich erreichbare Datenbank ohne Authentifizierung. Eine Anmeldung musste dafür nicht überwunden werden. Präziser als die pauschale Bezeichnung „Hack“ ist daher: Die Forschenden entdeckten und überprüften eine offen zugängliche Datenbank.[1]

Ist ein Missbrauch durch Kriminelle nachgewiesen?

Die hier genannten Berichte belegen die Offenlegung und den Zugriff durch Wiz, aber keinen umfassend nachgewiesenen kriminellen Missbrauch. Ob andere Akteure zuvor Informationen abgerufen haben, bleibt auf dieser Quellenbasis offen. Diese Unsicherheit ist weder Entwarnung noch Beweis für einen Datendiebstahl.[1][2]

Quellen und Einordnung

[1] Wiz: Wiz Research Uncovers Exposed DeepSeek Database Leaking Sensitive Information, veröffentlicht am 29. Januar 2025.

[2] Reuters: Technologieberichterstattung zum von Wiz entdeckten DeepSeek-Datenbankvorfall, Januar 2025.

[3] EDPB: Nachrichten des Europäischen Datenschutzausschusses, Februar 2025, zum Austausch über DeepSeek und zur erweiterten KI-Taskforce.

[4] AI International Group: Eigene Analyse in diesem Beitrag; Einordnung und Handlungsempfehlungen, keine zusätzliche Tatsachenquelle zum Vorfall.

Noch keine Kurse verfügbar.

Dein nächster Schritt

Lernen, vernetzen, umsetzen

Wissen anwenden statt nur lesen – vertiefe das Thema in unseren KI-Kursen mit Zertifikat, Executive Circle, KI-Trends und AI Automation.