• Veo kann hochwertige 1080p-Videos von über 60 Sekunden in verschiedenen Stilen erstellen, von Fotorealismus über Surrealismus bis hin zu Animation.
  • Veo bietet eine beispiellose kreative Kontrolle, indem es filmische Begriffe interpretiert, um präzise Videobearbeitungen aus Text zu ermöglichen, und kann KI-generierte Videos bearbeiten.
  • Google hat die Leistung verbessert, indem es vollständige Bildunterschriften in den Trainingsdatensatz integriert und hochauflösende Darstellungen genutzt hat.

Google hat am Mittwoch auf der jährlichen Entwicklerkonferenz I/OVeovorgestellt, sein fortschrittliches generatives KI-Videomodell, das von der KI-Abteilung DeepMind entwickelt wurde. Veo soll mitOpenAIs Sorain Bezug auf Realismus und Qualität von KI-generierten animierten Bildern konkurrieren.

Hochwertige Videogenerierung

Veo ist in der Lage, hochwertige 1080p-Videoclips von über 60 Sekunden zu erstellen. Laut einem Beitrag von DeepMind im sozialen Netzwerk X kann Veo verschiedene filmische Stile verarbeiten, von Fotorealismus über Surrealismus bis hin zu Animation. Das Modell unterstützt Text-zu-Video-, Video-zu-Video- und Bild-zu-Video-Transformationen und macht die Videoproduktion für alle zugänglich, sei es für erfahrene Filmemacher, aufstrebende Kreative oder Pädagogen.

Lesen Sie auch:Google bringt den fünfmal schnelleren KI-Chip Trillium auf den Markt

Lesen Sie auch:Google und HP bringen die 3D-Videokonferenzplattform Project Starline auf den Markt

In einer bemerkenswerten Zusammenarbeit hat der polynathische Künstler Donald Glover, auch bekannt als Childish Gambino, die Fähigkeiten von Veo über sein Kreativstudio Gilga getestet. Diese Partnerschaft unterstreicht das Potenzial des Modells, aus Textbeschreibungen atemberaubende Videos zu generieren, die kaum von der Realität zu unterscheiden sind. Zu den Beispielen gehören realistisch schwimmende Quallen und neonbeleuchtete Stadtlandschaften, die die Fähigkeit von Veo zeigen, hochwertige und realistische Videos zu produzieren.

Beispiellose kreative Kontrolle

Der Google-Vizepräsident für Produktmanagement, Eli Collins, und der leitende Forschungsdirektor, Douglas Eck, hoben die beispiellose kreative Kontrolle von Veo hervor. Das Modell versteht filmische Begriffe wie „Zeitraffer“ und „Luftaufnahmen“, was präzise und qualitativ hochwertige Videobearbeitungen auf der Grundlage von Textbeschreibungen ermöglicht. Veo kann KI-generierte Videos oder von Benutzern hochgeladene Clips bearbeiten und dabei die Konsistenz zwischen den Einzelbildern durch fortschrittliche latente Diffusionstransformatoren aufrechterhalten.

Diese Technologie reduziert Inkonsistenzen und bewahrt die Stabilität von Charakteren, Objekten und Stilen.

Um die Leistung zu verbessern, hat Google den Trainingsdaten detaillierte Beschreibungen hinzugefügt und hochwertige komprimierte Videodarstellungen verwendet. Diese Verbesserungen steigern die Gesamtvideoqualität und verkürzen die Generierungszeit. Darüber hinaus sind alle Veo-Videos mitSynthIDversehen, Googles Wasserzeichen zur Nachverfolgung von Inhaltsinformationen, das sicherstellt, dass sie als KI-generiert erkannt werden können.