Reddit verklagt Anthropic wegen unbefugter Datenerhebung
Das Unternehmen Reddit hat Klage gegen das KI-Unternehmen Anthropic eingereicht und wirft ihm vor, seit Juli 2024 mehr als 100.000 Mal unbefugt auf seine Plattform zugegriffen zu haben, um Nutzerinhalte für das Training künstlicher Intelligenz zu sammeln. Die Klage wurde beim Superior Court in San Francisco eingereicht. Reddit behauptet, Anthropic habe trotz früherer Zusicherungen, dass seine Bots von der Website blockiert worden seien, weiterhin Daten gesammelt.
Worin besteht das Problem?
Ben Lee, Chief Legal Officer von Reddit, betonte gegenüber The Verge den einzigartigen kommerziellen Wert der fast 20 Jahre umfassenden menschlichen Konversationen auf Reddit und argumentierte, dass diese Diskussionen für das Training fortschrittlicher Sprachmodelle wie Claude von Anthropic von zentraler Bedeutung seien. Lee erklärte, das Diskussionsarchiv von Reddit könne „Milliarden von Dollar“ wert sein, und hob die Rolle der Plattform bei der Bereitstellung authentischer Interaktionen zwischen Menschen hervor – etwas, das in einem von künstlicher Intelligenz dominierten Umfeld zunehmend gefragt ist.
Anthropic hat sich bislang nicht öffentlich zu der Klage geäußert. Dieser Rechtsstreit verdeutlicht die wachsenden Spannungen zwischen Social-Media-Plattformen und Unternehmen, die künstliche Intelligenz entwickeln, hinsichtlich der Nutzung von Nutzerinhalten zum Training von KI-Modellen. Reddit argumentiert, dass seine Inhalte eine wertvolle Quelle menschlicher Kommunikation darstellen, die für die Entwicklung fortschrittlicher KI-Systeme unersetzlich ist.
Die Klage offenbart zudem umfassendere Fragen des Datenschutzes und der Rechte an geistigem Eigentum im Zeitalter der künstlichen Intelligenz, in dem Unternehmen mit der Frage konfrontiert sind, wie und woher sie Daten zum Training ihrer KI-Modelle beziehen dürfen. Reddit versucht, seine Plattform und die Nutzerinhalte vor unbefugter Nutzung zu schützen, während Unternehmen wie Anthropic umfangreiche Datensätze benötigen, um ihre KI-Systeme zu verbessern. Der Wert menschlicher Konversationen auf Plattformen wie Reddit gewinnt im Kontext der Entwicklung künstlicher Intelligenz zunehmend an Bedeutung. Diese Diskussionen liefern authentische Muster menschlicher Kommunikation, die für die Entwicklung von KI-Modellen unerlässlich sind, die auf natürliche Weise mit Nutzern interagieren können. Reddit behauptet, seine Inhalte stellten eine einzigartige Quelle solcher Daten dar, die einen beträchtlichen kommerziellen Wert besitzt.
Der rechtliche Präzedenzfall, den dieser Fall schaffen könnte, wird weitreichende Folgen für die gesamte KI- und Social-Media-Branche haben. Der Ausgang des Rechtsstreits zwischen Reddit und Anthropic könnte beeinflussen, wie Unternehmen künftig bei der Beschaffung von Daten für das KI-Training vorgehen und wie Plattformen ihre Inhalte vor unbefugter Nutzung schützen werden.



