Zusammenfassung

  • Breite Aufgabenabdeckung ist von robustem Denken, Gedächtnis, Handeln und Anpassung zu trennen.
  • Bewertung braucht unbekannte Aufgaben, wechselnde Bedingungen, Fehlerkosten und unabhängige Replikation.

Allgemeine KI meint Fähigkeiten über Bereiche statt Spitzenleistung in einer engen Aufgabe. Heutige Modelle wirken breit, weil eine Oberfläche viele gelernte Muster erreicht; bei neuen Regeln, fehlendem Kontext oder langem Handeln kann die Breite zerfallen. Entwickler und Käufer sollten Fähigkeitsgrenzen, Kontaminationskontrollen, Ressourcen und Fehlerfolgen offenlegen. Der nächste Beleg ist eine unabhängige Prüfung an wirklich unbekannter Arbeit, einschließlich Aufträgen, die das System ablehnen oder zurückgeben muss. Das Etikett sollte nach bewiesenem Transfer und Kontrolle kommen, nicht davor.

Quellen