News

OpenAI präsentiert „Sora“: Eine neue Ära der Text-zu-Video-KI

OpenAI, bekannt als Entwickler von ChatGPT, hat sein neuestes Modell namens „Sora“ vorgestellt. Sora ist ein fortschrittliches Text-zu-Video-Modell, das auf der Grundlage textueller Anweisungen realistische und imaginative Videosequenzen generieren kann.

Sora baut auf den Erfahrungen aus früheren OpenAI-Projekten wie DALL·E und GPT-Modellen auf und verwendet die Recaptions-Technik von DALL-E 3, um hochdeskriptive Bildunterschriften für die Trainingsdaten zu generieren. Das Modell kann komplexe Szenen mit mehreren Charakteren, spezifischen Bewegungsarten und detaillierten Darstellungen von Motiven und Hintergründen erschaffen. Es versteht, wie Objekte in der physischen Welt existieren, und kann Charaktere mit ausdrucksstarken Emotionen erzeugen.

Anwendungsbereiche und Demonstrationen

Sora erlaubt es Nutzer:innen, Videos von bis zu einer Minute Länge zu erstellen, die auf ihren geschriebenen Anweisungen basieren. Zu den Demos, die OpenAI veröffentlicht hat, gehören beeindruckende Szenen wie eine Luftaufnahme Kaliforniens während des Goldrausches und eine vermeintliche Zugfahrt durch Tokio. Obwohl einige Demos verräterische Zeichen künstlicher Intelligenz aufweisen, wie beispielsweise sich eigenartig bewegende Objekte, sind die Ergebnisse insgesamt beeindruckend.

Trotz der beeindruckenden Fähigkeiten von Sora gibt OpenAI zu, dass das Modell Schwierigkeiten haben kann, die Physik komplexer Szenen genau zu simulieren. Dies kann zu Fehlinterpretationen bestimmter Ursache-Wirkungs-Zusammenhänge führen. Das Modell ist derzeit nur einer ausgewählten Gruppe von „Red Teamern“ zugänglich, die es auf potenzielle Risiken und Schäden prüfen. Einige Künstler:innen, Designer:innen und Filmemacher:innen erhalten ebenfalls Zugang, um Feedback zu sammeln.

Zukünftige Entwicklungen und Sicherheitsbedenken

Die rasante Entwicklung der Videotechnologie stellt die KI-Branche vor neue Herausforderungen, insbesondere im Hinblick auf die Erstellung fotorealistischer, KI-generierter Videos, die mit echten Aufnahmen verwechselt werden könnten. OpenAI hat bereits Maßnahmen ergriffen, um die Authentizität seiner KI-Produkte zu gewährleisten, wie die Einführung von Wasserzeichen bei DALL-E 3, obwohl diese leicht entfernt werden können.

Via Anbieter

Jan Gruber

Chefredakteur Magazin und Podcasts

Neueste Artikel

Apple White Paper: Einblick in die Langlebigkeit von Produkten

Am 26. Juni 2024 veröffentlichte Apple ein White Paper, das den strategischen Ansatz des Unternehmens zur Langlebigkeit seiner Produkte erläutert.…

1. Juli 2024

Mac-Marktanteil USA: Starke Zuwächse Dank MacBook Air M3

Im ersten Quartal 2024 hat der Mac-Marktanteil in den USA durch die Einführung neuer MacBook Air Modelle ein bemerkenswertes Wachstum…

1. Juli 2024

Apple Vision Pro: Apple passt die Demo in den Stores an

Makr Gurman von Bloomberg brichtet in seinem aktuellen Newsletter darüber, dass Apple die Demo der Apple Vision Pro in den…

30. Juni 2024

Bericht zeigt, dass AAA-Spiele für iPhone und iPad bei Nutzer:innen keinen großen Anklang finden

Seit der Einführung des iPhone 15 Pro mit dem A17 Pro-Chip, Apples erstem Chip mit hardwarebeschleunigtem Raytracing, versucht Apple, große…

29. Juni 2024

Apple Vision Pro: Preise und Zubehör in Deutschland

Um 14 Uhr hat am Freitag die zweiwöchige Vorbestellphase für Apples Spacial Computer Vision Pro begonnen. Die Preise für die…

28. Juni 2024

Vorverkaufstart der Apple Vision Pro in Deutschland Freitag ab 14 Uhr

Heute, am Freitag den 28. Juni, startet der Vorverkauf der Apple Vision Pro unter anderem auch in Deutschland. Die Brille…

28. Juni 2024

Diese Website benutzt Cookies um Ihr Nutzererlebnis zu verbessern. Wenn Sie diese Website weiter nutzen, gehen wir von Ihrem Einverständnis aus.

Mehr lesen