Zum Hauptinhalt springen

Signal-Briefing / Globale institutionelle Trends

Forscher von Google und Stanford starten KI-Tool zur Faktenprüfung

SAFE von Google DeepMind und der Stanford University verbessert KI-Chatbot-Antworten durch Faktenprüfung mit 76% Genauigkeit.

Forscher von Google und Stanford starten KI-Tool zur Faktenprüfung
Kategorie
Globale institutionelle Trends

Google and Stanford-Forscher wird als quellengestütztes Subjekt verfolgt, das mit der Marktabdeckung verbunden ist.

Signalfokus
Markt
Inhaltstyp
Signal-Briefing
Primäre Domain
Technologie
Thema
Markt
Auswirkungen
Mittel
Konfidenz
Konfidenz-Score-Leitfaden
Gute Zuversicht (78%)

Veröffentlichte Berichterstattung

Google and Stanford-Forscher ist ein öffentlicher Datensatz, der auf Artikelbeweisen, Objektkontext, Ereignislinks und Beziehungskontext basiert.

Eine aktuelle Entwicklung von Google DeepMind und der Stanford University stellt den Search-Augmented Factuality Evaluator (SAFE) vor, ein Werkzeug zur Überprüfung von Fakten in langen Antworten von KI-Chatbots. SAFE verwendet einen mehrstufigen Prozess, der Segmentierung, Korrektur und Vergleich mit Google-Suchergebnissen umfasst und bei der Überprüfung kontroverser Fakten eine Genauigkeit von 76 % erreicht. Diese Innovation verbessert nicht nur die Genauigkeit KI-generierter Antworten, sondern bietet auch wirtschaftliche Vorteile, da sie mehr als 20-mal günstiger ist als manuelle Annotation.

Unabhängig von der Leistungsfähigkeit aktueller KI-Chatbots neigen sie zu einem stark kritisierten Verhalten, bei dem sie den Nutzern zwar überzeugende, aber faktisch ungenaue Antworten liefern. Kurz gesagt, die KI „entgleist“ manchmal in ihren Antworten und verbreitet sogar Gerüchte. Ein solches Verhalten bei großen KI-Modellen zu verhindern, ist keine leichte Aufgabe und stellt eine technische Herausforderung dar. Laut dem ausländischen Medienunternehmen Marktechpost scheinen Google DeepMind und die Stanford University jedoch einen Workaround gefunden zu haben. Lesen Sie auch: Der GPT-Shop von OpenAI erfüllt nicht die Erwartungen.

Lesen Sie auch: US-Bundesbehörden müssen jetzt einen KI-Verantwortlichen haben. Das Werkzeug basiert auf dem Search-Augmented Factuality Evaluator (SAFE). Die Forscher stellten ein auf großen Sprachmodellen basierendes Werkzeug vor, den Search-Augmented Factuality Evaluator (SAFE), der Fakten in langen Chatbot-Antworten überprüfen kann. Ihre Forschungsergebnisse sowie der experimentelle Code und die Datensätze wurden veröffentlicht, klicken Sie hier, um sie einzusehen.

Das System analysiert, verarbeitet und bewertet die von Chatbots generierten Antworten in vier Schritten, um Genauigkeit und Authentizität zu überprüfen: Segmentierung der Antworten in einzelne Elemente zur Überprüfung, Korrektur des obigen Inhalts, dann Vergleich mit den Google-Suchergebnissen. Anschließend überprüft das System auch die Relevanz jeder Tatsache für die ursprüngliche Frage. Die Forscher erstellten einen Datensatz namens LongFact zur Bewertung seiner Leistung.

Um seine Leistung zu bewerten, erstellten die Forscher einen Datensatz namens LongFact mit etwa 16.000 Fakten und testeten das System an 13 großen Sprachmodellen von Claude, Gemini, GPT und PaLM-2. Die Ergebnisse zeigen, dass bei der gezielten Analyse von 100 kontroversen Fakten die Urteilsgenauigkeit von SAFE nach einer genaueren Prüfung 76 % erreicht. Gleichzeitig bietet das Framework auch wirtschaftliche Vorteile: Es ist mehr als 20-mal günstiger als manuelle Annotation.

Signalbericht

  • Signal: Forscher von Google und Stanford starten KI-Tool zur Faktenprüfung
  • Signaltyp: Markt
  • Region: Global
  • Marktklasse: Globale institutionelle Trends

Betriebspräsenz

  • Veröffentlichte Quellen sollten die betroffenen Parteien, den Betriebsfußabdruck und die Marktexposition identifizieren, bevor diese Trendkarte als vollständig betrachtet wird.

Marktkontext

  • Operative Relevanz: Mittel
  • Zeithorizont: Nächstes Quartal

Was ansehen?

  • Achten Sie auf offizielle Stellungnahmen, regulatorische Aktualisierungen, Gefährdung von Kunden oder Partnern sowie ergänzende Offenlegungen.

Mitgliederbriefing

Vertiefter Trendkontext

Melden Sie sich mit der richtigen Mitgliedschaftsstufe an, um das vollständige Briefing und die Quellennotizen freizuschalten.

Nur für Strategic Circle

Strategic Circle

Offen für alle Leser. Schalten Sie Trend-Briefings nach Beitritt und Anmeldung frei.

Strategic Circle beitreten

Nur für Leadership Alliance

Leadership Alliance

Für Betreiber, Investoren und Politikteams, die Belege für Beziehungen, Fehlerpfade und Quellennotizen benötigen. Melden Sie sich an, um freizuschalten.

Leadership Alliance beitreten
ZurückMehr Berichterstattung: Globale institutionelle Trends