OpenAI’s Sora Text-zu-Video-Generator, der in der Lage ist, hyperrealistische Szenen aus einer Texteingabe zu erstellen, wird im Laufe dieses Jahres für die Öffentlichkeit verfügbar sein. Sora richtet sich zunächst an visuelle Künstler, Designer und Filmemacher, soll aber in Zukunft auch Audio einbeziehen, um den Realismus zu erhöhen. OpenAI will es den Nutzern ermöglichen, den Inhalt der von Sora produzierten Videos zu bearbeiten, wobei die Notwendigkeit menschlichen Eingreifens aufgrund der gelegentlichen Ungenauigkeiten der KI anerkannt wird. Die Trainingsdaten für Sora werden nicht veröffentlicht. Mira Murati erwähnte, dass sie öffentlich verfügbar oder lizenziert waren und bestätigte die Verwendung von Inhalten von Shutterstock im Rahmen einer Partnerschaft. Trotz der Bedenken in Bezug auf generative KI-Tools und Fehlinformationen wird die Veröffentlichung von Sora wahrscheinlich die Erstellung von Bildern öffentlicher Personen einschränken und Wasserzeichen auf Videos enthalten. Allerdings wird die Wirksamkeit von Wasserzeichen als Lösung in Frage gestellt. Die Kosten des Tools sind ein Problem, aber OpenAI will es zu einem ähnlichen Preis wie DALL-E, ihr KI-Text-zu-Bild-Modell, zugänglich machen. Der Bericht des Wall Street Journal zeigt Beispiele für die Videofähigkeiten von Sora, darunter ein animierter Bulle in einem China-Laden und ein Smartphone-Review einer Meerjungfrau.
