Zum Hauptinhalt springen

Signal-Briefing / Globale Cloud-Services-Trends

Wer verkauft Ihre Daten, um KI zu trainieren?

Die Nutzung von aus dem Internet extrahierten Daten ist zu einem kontroversen Thema geworden, da Unternehmen öffentliche Inhalte nutzen, um ihre leistungsstarken generativen Modelle zu trainieren. Diese Praxis hat rechtliche Auseinandersetzungen ausgelöst, da Organisationen wie The New York Times und Getty Images Bedenken hinsichtlich der unbefugten Nutzung ihrer Inhalte geäußert haben.

Wer verkauft Ihre Daten, um KI zu trainieren?
Kategorie
Globale Cloud-Services-Trends

"Wer verkauft Ihre Daten, um KI zu trainieren?" wird als eine Internetinfrastruktur-Institution im Ökosystem der Internetinfrastruktur verfolgt.

Signalfokus
Markt
Inhaltstyp
Veranstaltung
Primäre Domain
Markt
Thema
Markt
Auswirkungen
Mittel
Konfidenz
Konfidenz-Score-Leitfaden
Begrenzte Konfidenz (72%)

Mehrere öffentliche Quellen

"Wer verkauft Ihre Daten, um KI zu trainieren?" wird von BTW Media profiliert, da veröffentlichte Belege es mit Internetinfrastruktur, Governance, operativen Abhängigkeiten oder Marktsichtbarkeit in Verbindung bringen.

  • Tumblr und WordPress.com befinden sich derzeit in Gesprächen, um Nutzerdaten an KI-Unternehmen wie OpenAI und Midjourney zu liefern.
  • The New York Times verklagt derzeit OpenAI, weil sie angeblich ohne Erlaubnis ihr umfangreiches Archiv zum Trainieren von Chatbots genutzt haben.

Die Nutzung von aus dem Internet extrahierten Daten ist zu einem kontroversen Thema geworden, da Unternehmen öffentliche Inhalte nutzen, um ihre leistungsstarken generativen Modelle zu trainieren. Diese Praxis hat rechtliche Auseinandersetzungen ausgelöst, da Organisationen wie The New York Times undGetty ImagesBedenken hinsichtlich der unbefugten Nutzung ihrer Inhalte geäußert haben.

Rechtliche Auseinandersetzungen um die Datennutzung

Einer der prominenten Fälle betrifft OpenAI, das derzeit von The New York Times verklagt wird, weil es angeblich die Archive der Zeitung ohne Genehmigung zum Trainieren von Chatbots genutzt hat. Als Reaktion hat OpenAI der Times vorgeworfen, zweifelhafte Taktiken anzuwenden, um ihre Behauptungen zu beweisen. Ebenso hat Getty Images Klage gegenStable Diffusionwegen Urheberrechtsverletzung im Zusammenhang mit der Nutzung seiner visuellen Inhalte eingereicht.

Die Auswirkungen von KI-Systemen, die die Arbeit von Journalisten, Musikern und Fotografen nutzen, gehen über rechtliche Auseinandersetzungen hinaus. Die Suche nach großen Mengen an Trainingsdaten hat Bedenken hinsichtlich der potenziellen Ausbeutung von Online-Content-Erstellern geweckt. Plattformen wie Tumblr und WordPress.com sollen in Gesprächen gewesen sein, um Nutzerdaten an KI-Unternehmen wie OpenAI und Midjourney zu verkaufen, was Fragen zum Datenschutz und Eigentum aufwirft.

Mehr dazu:Googles Bard-Chatbot erhält weltweit das Gemini Pro-Update

Partnerschaften beim Datenaustausch

Während einige Unternehmen den Rechtsweg gewählt haben, haben andere sich für Partnerschaften entschieden. The Associated Press hat einen Teil ihres Archivs an OpenAI lizenziert, während Shutterstock einen sechsjährigen Vertrag mit dem KI-Unternehmen abgeschlossen hat, um Zugang zu seiner umfangreichen Bibliothek mit Fotos, Videos und Musik zu gewähren.

Reddit, bekannt für seinen Reichtum an nutzergenerierten Inhalten, hat kürzlich einen Vertrag mit Google abgeschlossen, der dem Technologieriesen Zugang zu seiner API für das Training von KI-Modellen gewährt. Dieser Schritt unterstreicht den Wert der Nutzerbeiträge auf Plattformen und die ethischen Überlegungen zur Datennutzung.

Mehr dazu:OpenAI startet den GPT Store für persönliche KI-Chatbots ohne Programmierung

Verbreitete Praktiken des Datentrainings

Die weitverbreitete Praxis, KI-Modelle mit öffentlichen Daten aus dem Internet zu trainieren, geht über die in diesem Artikel erwähnten spezifischen Vereinbarungen hinaus. Eine aktuelle Untersuchung der Washington Post hat einen Datenschatz aus verschiedenen Quellen zutage gefördert, darunter Online-Foren, Crowdfunding-Plattformen und Social-Media-Seiten. Unternehmen wie Meta (ehemals Facebook) haben ebenfalls die öffentlichen Beiträge auf ihren Plattformen genutzt, um die KI-Fähigkeiten zu verbessern.

Die Debatte über Dateneigentum und Einwilligung bleibt ungelöst. Content-Ersteller, ob von Nischenblogs oder beliebten Social-Media-Plattformen, sehen sich mit der Aussicht konfrontiert, dass ihre Arbeit für KI-Training kommerzialisiert wird. Das Gleichgewicht zwischen Innovation und ethischen Datenpraktiken ist entscheidend für die Zukunft der KI-Entwicklung und ihre Auswirkungen auf digitale Ökosysteme.

Signalbericht

  • Signal: Wer verkauft Ihre Daten, um KI zu trainieren?
  • Region: Global
  • Marktklasse: Globale Cloud-Services-Trends

Betriebspräsenz

  • Veröffentlichte Quellen sollten die betroffenen Parteien, den Betriebsfußabdruck und die Marktexposition identifizieren, bevor diese Trendkarte als vollständig betrachtet wird.

Marktkontext

  • Operative Relevanz: Mittel
  • Zeithorizont: Nächstes Quartal

Was ansehen?

  • Achten Sie auf offizielle Stellungnahmen, regulatorische Aktualisierungen, Gefährdung von Kunden oder Partnern sowie ergänzende Offenlegungen.

Mitgliederbriefing

Vertiefter Trendkontext

Melden Sie sich mit der richtigen Mitgliedschaftsstufe an, um das vollständige Briefing und die Quellennotizen freizuschalten.

Nur für Strategic Circle

Strategic Circle

Offen für alle Leser. Schalten Sie Trend-Briefings nach Beitritt und Anmeldung frei.

Strategic Circle beitreten

Nur für Leadership Alliance

Leadership Alliance

Für Betreiber, Investoren und Politikteams, die Belege für Beziehungen, Fehlerpfade und Quellennotizen benötigen. Melden Sie sich an, um freizuschalten.

Leadership Alliance beitreten
ZurückMehr Berichterstattung: Globale Cloud-Services-Trends