• Einige Technologiegiganten sollen nicht autorisierte YouTube-Transkripte zum Trainieren von KI-Modellen verwendet haben.
  • Die Legalität der Nutzung nicht autorisierter Datenbanken zum Trainieren von KI ist unklar, was die zukünftige KI-Entwicklung behindern könnte.

UNSERE MEINUNG
Die Entwicklung der KI-Technologie ist zwar vielversprechend, aber ihre Schaffung und ihr Fortschritt beruhen auf Datenbanken. Der Mangel an Transparenz dieser Datenbanken ist unvermeidlich eine Quelle der Kontroversen. Die geschädigten Parteien und die regelwidrigen Unternehmen haben oft unterschiedliche Ansichten, ohne dass eine endgültige Lösung in Sicht ist. Diese Situation ist wie ein Damoklesschwert über der Industrie; wenn sie nicht angegangen wird, wird sie unweigerlich die kontinuierliche Entwicklung der KI behindern.

— Yasmine luo, BTW-Journalistin

Was ist passiert?

Einige große Technologieunternehmen werden beschuldigt, nicht autorisierte YouTube-Transkripte zum Trainieren ihrer KI-Modelle verwendet zu haben.

LautProof NewshatEleutherAI, eine gemeinnützige Organisation, einen Datensatz mit Transkripten von über 48.000 YouTube-Kanälen erstellt, darunter Inhalte von Top-Erstellern wie Marques Brownlee und MrBeast sowie von großen Publishern wieThe New York Times, derBBCundABC News. Laut einer neuen Untersuchung von Proof News habenApple,NVIDIA,Anthropicund andere große Technologieunternehmen diesen Datensatz zum Trainieren ihrer KI-Modelle verwendet.

Neal Mohan, CEO von YouTube, erklärte zuvor: „Unternehmen, die YouTube-Daten zum Trainieren von KI-Modellen nutzen, würden gegen die Nutzungsbedingungen der Plattform verstoßen.“

Marques Brownlee, ein berühmter YouTuber, veröffentlichte in sozialen Medien: „Apple hat Daten für seine KI von mehreren Unternehmen bezogen. Eines davon hat riesige Mengen an Daten/Transkripten von YouTube-Videos gesaugt, einschließlich meiner. Technisch gesehen vermeidet Apple hier Schuld, weil es nicht die Daten saugt. Aber das wird noch lange ein sich entwickelndes Problem sein.“

Derzeit haben Apple, NVIDIA, Anthropic und EleutherAI keine Stellungnahme zu dem Fall abgegeben.

À lire aussi:Warburg-gestützter CEO plant KI-gesteuerte Rechenzentrumserweiterung in Asien

À lire aussi:OpenAIs „Strawberry“-Projekt verbessert KI-Schlussfolgerung

Warum das wichtig ist

Das schnelle Wachstum von KI-Modellen, obwohl vielversprechend für die Zukunft, hat auch viele ungelöste rechtliche Fragen aufgeworfen. Die jüngsten Vorwürfe gegen die Technologiegiganten verstärken diese Bedenken. Seit ihrer Einführung steht die KI-Technologie vor dem Problem nicht transparenter Trainingsdatenbanken. Wenn die KI-Trainingsdaten nicht aus geeigneten Quellen stammen, besteht das Risiko von Urheberrechts- oder Datenbankrechtsverletzungen.

Es bleibt jedoch abzuwarten, ob die betroffenen Unternehmen rechtlichen Schritten ausgesetzt sein werden.The Vergehat eine Untersuchung unter Anwälten, Analysten und Mitarbeitern von KI-Startups durchgeführt, die geteilte Meinungen zu dieser Frage offenbarte.

„Ich sehe Leute auf beiden Seiten, die äußerst zuversichtlich in ihren Positionen sind, aber die Realität ist, dass niemand es weiß“, sagt Baio, ein KI-Beobachter.

Obwohl die betroffenen Unternehmen oder Einzelpersonen behaupten, dass es illegal ist, haben ihre Forderungen wenig Aussicht auf Behandlung, wie die fehlende Antwort der beschuldigten Unternehmen zeigt.

Wenn dieses Problem nicht gelöst wird, könnte es eines Tages die kontinuierliche Entwicklung der KI-Technologie behindern.