• Meta Platforms hat die ersten Versionen seines neuesten großen Sprachmodells Llama 3 veröffentlicht, mit neuen Programmierfähigkeiten und der Fähigkeit, Bildbefehle zu verarbeiten. Die Modelle werden in den virtuellen Assistenten Meta AI integriert, den das Unternehmen als den anspruchsvollsten unter seinen kostenlosen Konkurrenten bezeichnet.
  • Die Versionen von Llama 3, die in den kommenden Monaten veröffentlicht werden sollen, werden ebenfalls zur „Multimodalität“ fähig sein, was bedeutet, dass sie sowohl Text als auch Bilder generieren können, während Meta versucht, zum Marktführer für generative KI, OpenAI, aufzuschließen.
  • Das Modell Llama 2 ist nicht in der Lage, grundlegenden Kontext zu verstehen; Meta reduziert diese Probleme in Llama 3 durch die Verwendung von „hochwertigen Daten“, um dem Modell zu ermöglichen, Nuancen zu erkennen. Die Nachfrage nach Daten für generative KI-Modelle ist zu einer großen Spannungsquelle in der Technologieentwicklung geworden.

Meta Platforms hat die ersten Versionen seines neuesten großen Sprachmodells Llama 3 veröffentlicht, mit neuen Programmierfähigkeiten und der Fähigkeit, Bildbefehle zu verarbeiten. Der integrierte Bildgenerator aktualisiert Bilder in Echtzeit, während Benutzer Eingaben machen, während das Unternehmen versucht, zum Marktführer für generative KI, OpenAI, aufzuschließen.
Sehen Sie das Erklärvideo von CEO Mark Zuckerberg.

Ein KI-Modell mit Multimodalität anstreben

Die Versionen von Llama 3, die in den kommenden Monaten veröffentlicht werden sollen, werden ebenfalls zur „Multimodalität“ fähig sein, was bedeutet, dass sie sowohl Text als auch Bilder generieren können, obwohl das Modell derzeit nur Text produziert, sagte Chris Cox, Chief Product Officer bei Meta, in einem Interview.

Die Modelle werden in den virtuellen AssistentenMeta AIintegriert, den das Unternehmen als den anspruchsvollsten unter seinen kostenlosen Konkurrenten bezeichnet. Fortgeschrittenere Argumentation, wie die Fähigkeit, längere mehrstufige Pläne zu entwickeln, wird in späteren Versionen folgen.

Lesen Sie auch:Meta stellt einen „All-in-One“-MTAI-Chip vor, der 3-mal schneller ist als der Vorgänger

Die Einbeziehung von Bildern in das Training von Llama 3 würde ein Update verbessern, das dieses Jahr für die Ray-Ban Meta Smart Glasses bereitgestellt wurde, eine Partnerschaft mit dem BrillenherstellerEssilor Luxoticca, die es Meta AI ermöglicht, von Trägern gesehene Objekte zu identifizieren und Fragen dazu zu beantworten, sagte Chris Cox.

Datenkrise für das Training von KI-Modellen

Das Modell Llama 2 ist nicht in der Lage, grundlegenden Kontext zu verstehen; Meta reduziert diese Probleme in Llama 3 durch die Verwendung von „hochwertigen Daten“, um dem Modell zu ermöglichen, Nuancen zu erkennen. Der Rivale Google hatte ähnliche Probleme und hat kürzlich die Nutzung seines KI-Bildgenerierungstools Gemini AI ausgesetzt, nachdem es für ungenaue Darstellungen historischer Persönlichkeiten kritisiert worden war.

Meta-CEO Mark Zuckerberg sagte, dass die größte Version von Llama 3 derzeit mit 400 Milliarden Parametern trainiert wird und bereits eine Punktzahl von 85 beim Massive Multitask Language Understanding erreicht, wobei er auf Kennzahlen verweist, die zur Bewertung der Stärke und Leistung von KI-Modellen verwendet werden.

Lesen Sie auch:US-Abgeordneter schlägt Gesetz vor, das KI-Unternehmen zur Offenlegung von Trainingsdaten verpflichtet

Der enorme Datenhunger generativer KI-Modelle ist zu einer großen Spannungsquelle in der Technologieentwicklung geworden. Meta machte keine Angaben zu den verwendeten Datensätzen, gab aber an, Llama 3 mit der siebenfachen Datenmenge von Llama 2 versorgt und „synthetische“ oder KI-generierte Daten verwendet zu haben, um Bereiche wie Programmierung und logisches Denken zu verbessern.