• OpenAI hat den neuen Sprachmodus von ChatGPT verzögert und verschiebt dessen Einführung auf Juli.
  • Diese Verzögerung hat keinen Einfluss auf die Einführung der neuen Video- und Bildschirmfreigabefunktionen, die separat auf der Frühjahrspressekonferenz von OpenAI vorgestellt wurden.

UNSERE MEINUNG
Diese Entscheidung zeigt den starken Fokus des Unternehmens auf Produktqualität und Benutzererfahrung, während gleichzeitig die Herausforderungen und Komplexitäten bei der Einführung neuer Technologien hervorgehoben werden. Mit der Weiterentwicklung der KI-Technologie haben die Entscheidungen und Strategien von OpenAI tiefgreifende Auswirkungen auf die Branche und die Nutzer, insbesondere im Hinblick auf den Fortschritt der Sprachtechnologie und die Gewährleistung der Datensicherheit.

–Revel Cheng, BTW-Journalist

OpenAI hat den neuen Sprachmodus von ChatGPT verzögert und verschiebt dessen Einführung auf Juli.

Was ist passiert?

In einer Nachricht auf dem offiziellen Discord-Server vonOpenAIteilte das Unternehmen mit, dass es geplant hatte, Ende Juni eine Alpha-Version des erweiterten Sprachmodus für eine kleine Gruppe vonChatGPT Plus-Nutzern bereitzustellen. Anhaltende Probleme hätten das Unternehmen jedoch dazu gezwungen, die Einführung auf einen unbestimmten Zeitpunkt im Juli zu verschieben.

Im Mai, als OpenAI erstmals einen unheimlich realistischen und nahezu augenblicklichen „erweiterten Sprachmodus“ für seine KI-basierte Chatbot-Plattform ChatGPT vorstellte, hatte das Unternehmen angekündigt, dass diese Funktion innerhalb weniger Wochen für zahlende ChatGPT-Nutzer verfügbar sein würde.

Mehrere Monate später gibt OpenAI bekannt, dass es mehr Zeit benötigt.

OpenAI erklärt, dass der erweiterte Sprachmodus möglicherweise erst im Herbst für alle ChatGPT Plus-Kunden verfügbar sein wird, je nachdem, ob er bestimmte interne Sicherheits- und Zuverlässigkeitsprüfungen besteht. Diese Verzögerung hat jedoch keinen Einfluss auf die Einführung der neuen Video- und Bildschirmfreigabefunktionen, die separat auf der Frühjahrspressekonferenz von OpenAI vorgestellt wurden.

Diese Funktionen umfassen unter anderem das Lösen mathematischer Probleme anhand eines Fotos des Problems und das Erklären verschiedener Einstellungsmenüs auf einem Gerät. Sie sind so konzipiert, dass sie sowohl auf Smartphones als auch auf Desktop-Clients wie der macOS-App funktionieren, die jetzt allen ChatGPT-Nutzern zur Verfügung steht.

Lesen Sie auch:Ist Gemini AI Open Source? Hier ist, was Sie wissen müssen

Lesen Sie auch:Google stellt Gemma vor, ein leichtes und offenes KI-Modell

Warum ist das wichtig?

Auf der Bühne bei der Einführungsveranstaltung zeigten OpenAI-Mitarbeiter, wie ChatGPT fast augenblicklich auf Anfragen reagierte, wie zum Beispiel das Lösen einer Mathematikaufgabe auf einem Blatt Papier, das vor der Smartphone-Kamera eines Forschers lag.

„Der erweiterte Sprachmodus von ChatGPT kann Emotionen und nonverbale Signale verstehen und darauf reagieren, was uns natürlichen und Echtzeit-Gesprächen mit KI näherbringt“, schreibt OpenAI. „Unsere Mission ist es, Ihnen diese neuen Erfahrungen auf durchdachte Weise zu bieten.“

Der erweiterte Sprachmodus von OpenAI sorgte für Kontroversen, weil die Standardstimme „Sky“ der Schauspielerin Scarlett Johansson ähnelte. Johansson veröffentlichte daraufhin eine Erklärung, in der sie mitteilte, dass sie einen Rechtsbeistand eingeschaltet habe, um die Stimme zu untersuchen und genaue Details über ihre Entwicklung zu erfahren – und dass sie wiederholte Anfragen von OpenAI abgelehnt habe, ihre Stimme für ChatGPT zu lizenzieren.

OpenAI, das bestritt, Johanssons Stimme ohne Genehmigung oder eine Nachahmung verwendet zu haben, entfernte die Stimme später.