Sora 2 von OpenAI: Bereit, Googles Veo 3 zu schlagen?
Vielleicht erwartet uns schon bald eine neue KI, die nicht nur beeindruckende Videos aus Text erstellt, sondern ihnen auch realistischen Ton hinzufügt – Sprache, Umgebungsgeräusche und sogar Lippensynchronisation. Genau darüber wird derzeit im Zusammenhang mit der kommenden Version Sora 2 von OpenAI gesprochen. Laut Informationen von den Servern des Unternehmens, die von Analysten entdeckt wurden, steht ein großes Update bevor, das Ton in textgenerierte Videos bringen soll. All das, damit Sora mit Googles fortschrittlichem Modell Veo 3 konkurrieren kann. Sehen wir uns das auf Grundlage der verfügbaren Details von TechRadar und anderen Quellen Schritt für Schritt genauer an.
Was wissen wir aus den verfügbaren Informationen über Sora 2?
Berichten von TechRadar und Informationen von OpenAI-Servern zufolge ist Sora 2 in internen Hinweisen aufgetaucht, was darauf hindeutet, dass die Veröffentlichung unmittelbar bevorsteht, obwohl eine offizielle Ankündigung bislang fehlt. Die erste Version von Sora beeindruckte mit ihrer Fähigkeit, Videos in hoher visueller Qualität zu erstellen, die realistische Physik und längere Sequenzen umfassten – konkret Clips von mehr als 20 Sekunden Länge. Das ist ein großer Vorteil gegenüber Konkurrenten, die häufig nur kürzere Abschnitte bewältigen. Doch Sora 1 war „stumm“ – kein Ton, keine Dialoge, nur visuelle Inhalte. Nun wird erwartet, dass Sora 2 diesen Mangel behebt. Quellen deuten auf die Integration von Ton hin, einschließlich Sprache, Umgebungsgeräuschen und Lippensynchronisation, was ein vollwertiges Filmerlebnis ermöglichen könnte. Dieses Update könnte mit dem Modell GPT-5 verbunden sein, das zur Verbesserung der Gesamtqualität und Integration beitragen würde.
Sora 2? pic.twitter.com/Wrij7q3XRq
— Tibor Blaho (@btibor91) 21. Juli 2025
Vergleich mit Googles Veo 3: Wo liegt Sora zurück?
Veo 3 zeigt bereits jetzt, was fortschrittliche Tonintegration bedeutet. Dieses Modell generiert Videos mit realistischen Soundeffekten – vom Plätschern des Kaffees bis zum Lärm eines Cafés – und fügt Dialoge mit präziser Lippensynchronisation hinzu. Videos von Veo 3 sind auf acht Sekunden begrenzt, erreichen jedoch 4K-Qualität mit filmischer Wirkung. Laut TechRadar muss Sora 2 nicht nur Ton hinzufügen, sondern dies auch auf hohem Niveau umsetzen: mit natürlicher Intonation, Harmonie zwischen Bild und Stimme sowie der richtigen Atmosphäre. Wenn OpenAI die längere Videodauer beibehält und diese Elemente ergänzt, könnte Sora 2 bei kreativen und professionellen Projekten wie Bildung oder Forschung einen Vorteil erlangen. Veo 3 hingegen ist in das Google-Ökosystem integriert, für Studierende über Gemini AI Pro kostenlos und für andere über Vertex AI in Google Cloud verfügbar.
Erwartete Funktionen von Sora 2
Die wichtigste Verbesserung von Sora 2 dürfte eine vollständige Tonintegration sein, was nicht nur Sprache, sondern auch Umgebungsgeräusche und Lippensynchronisation bedeutet. Dadurch könnten Videos erstellt werden, die nicht nur visuell beeindruckend, sondern auch akustisch realistisch sind. Quellen wie TechRadar betonen, dass Sora 2 die Zuschauer „beeindrucken“ muss, um Veo 3 zu übertreffen, das bereits jetzt eine synchronisierte Audiospur bietet. Ein weiterer Aspekt ist der Preis: Veo 3 ist Teil des Gemini-Advanced-Abonnements für 250 Dollar pro Monat, während Sora 2 in die kostenpflichtigen Tarife ChatGPT Plus oder Pro integriert werden könnte, wodurch es erschwinglicher wäre. Wenn OpenAI einen einfacheren Zugang gewährleistet, könnte dies schnell ein breites Publikum anziehen.
Mit Stimmen und realistischen Videos gehen auch Risiken einher. Beide Modelle – Sora und Veo 3 – unterliegen Einschränkungen: Sie verbieten die Generierung von Inhalten mit realen Personen, Gewalt oder Urheberrechtsverletzungen. Dennoch erhöht das Hinzufügen von Stimmen die Gefahr von Desinformation, da die Videos zu glaubwürdig aussehen und klingen könnten. Unternehmen wie OpenAI und Google befassen sich bereits mit diesen Problemen, doch mit der zunehmenden Ausgereiftheit von KI-Videos werden die ethischen Fragen noch dringlicher. So wird beispielsweise in entsprechenden Berichten darüber gesprochen, wie Sam Altman Hollywood-Filmemacher hinsichtlich der Fähigkeiten von Sora beruhigt.
Dieser Wettstreit zwischen OpenAI und Google könnte neue Standards für generative Videos setzen, bei denen es nicht mehr nur um Pixel, sondern um die gesamte filmische Wirkung geht. Wenn Sora 2 die Erwartungen erfüllt, erwartet uns ein aufregender Fortschritt bei KI-Technologien. Bleiben Sie dran für die offizielle Ankündigung!



