Grok hat seinen Videogenerator in Version 1.5 verbessert und beschleunigt

Grok hat seinen Videogenerator in Version 1.5 verbessert und beschleunigt

Ondřej Barták
Ondřej Barták
Unternehmer und Programmierer
19. 6. 2026
3 Minuten Lesezeit · 5 Aufrufe
Grok hat seinen Videogenerator in Version 1.5 verbessert und beschleunigt

    xAI hat die neueste Version seines Modells zur Videoerstellung veröffentlicht. Grok Imagine Video 1.5 nimmt Ihr Bild, Sie beschreiben, was darin geschehen soll, und das Modell erstellt daraus ein kurzes Video mit Bewegung, Ton und gesprochenem Wort. Und vor allem schnell. Während sein Vorgänger dafür noch über vierzig Sekunden benötigte, schafft es das neue Modell nun in etwa fünfundzwanzig.

    Geschwindigkeit, Ton und bessere Physik

    Beginnen wir mit dem, was den Menschen zuerst auffällt: der Geschwindigkeit. Die Variante Grok Imagine Video 1.5 Fast hat die Generierungsgeschwindigkeit nahezu verdoppelt. Ein sechssekündiges Video mit einer Auflösung von 720p erstellt sie in etwa fünfundzwanzig Sekunden. Das vorherige Modell benötigte dafür mehr als vierzig Sekunden. Warum ist das überhaupt wichtig? Wenn Sie Inhalte erstellen und auf jeden Clip eine Minute warten müssen, zieht sich die Arbeit in die Länge. Hier wird Ihre Arbeit deutlich beschleunigt.

    Das Modell erzeugt nicht nur Bilder, sondern auch Ton. Soundeffekte, Umgebungsgeräusche und Dialoge entstehen im selben Durchgang und passen genau zu dem, was auf dem Bildschirm geschieht. Das gesprochene Wort ist klarer und besser auf die Lippenbewegungen abgestimmt. Sie beschreiben die Szene, und das Modell liefert sowohl das Bild als auch die passende Tonspur. Dadurch entfällt die Tonbearbeitung in einem separaten Programm.

    Ältere Modelle zur Videoerstellung hatten häufig das Problem, dass sich Figuren und Gegenstände während des Clips verformten. Grok Imagine Video 1.5 hält die Bewegungen über die gesamte Länge der Aufnahme konsistent. Es gibt weniger merkwürdige Verzerrungen, und Objekte weisen ein glaubwürdiges Gewicht und eine realistische Trägheit auf. Wenn sich etwas bewegt, sieht es natürlicher aus.

    Zusammen mit dem Modell hat xAI mehrere Funktionen hinzugefügt, die die eigentliche Arbeit erleichtern. Sie können Ihre Kreationen in Projekten organisieren, die Sie im linken Bereich finden. Außerdem können Sie mehrere Aufgaben gleichzeitig ausführen, sodass Sie nicht warten müssen, bis ein Video fertig ist, bevor Sie das nächste starten. Sie geben einfach mehrere Prompts ein und lassen sie gleichzeitig bearbeiten. Und wenn Sie nach einem bestimmten Clip suchen, können Sie die Bibliothek durchsuchen, statt endlos zu scrollen.

    So funktioniert es und das benötigen Sie

    Sie stellen dem Modell ein Ausgangsbild bereit, beschreiben die Bewegung und wählen Auflösung und Länge aus. xAI zeigt einen Beispielcode, in dem Sie lediglich einen Prompt, den Link zum Bild, die Videolänge in Sekunden und die Auflösung angeben müssen. Danach warten Sie nur noch auf das Ergebnis.

    Das Modell ist über die xAI-Schnittstelle als grok-imagine-video-1.5 verfügbar. Sie können es auch direkt auf grok.com/imagine oder in den Apps für iOS und Android ausprobieren, in denen die erwähnte schnelle Variante läuft.

    Wo Sie das Modell finden und wie viel es kostet

    Neben dem direkten Zugriff über xAI ist Grok Imagine auch auf der Plattform Kie.ai verfügbar, die mehrere Modelle zur Videoerstellung an einem Ort vereint. Dort können Sie aus vier Eingabetypen wählen, von Bild-zu-Video über Text-zu-Video bis hin zu Text-zu-Bild.

    Kie.ai berechnet den Preis anhand der Länge des fertigen Videos in Sekunden. Eine Ausgabe in 480p kostet 1,6 Credits pro Sekunde, eine Auflösung von 720p kostet 3 Credits pro Sekunde. Es stehen verschiedene Generierungsmodi zur Verfügung, darunter „Normal“, „Fun“ und der ausdrucksstärkere Modus „Spicy“. Bei Videos, die aus einem selbst hochgeladenen Bild erstellt werden, funktioniert der Spicy-Modus jedoch nicht und wird automatisch auf „Normal“ umgestellt.

    Sie können außerdem Seitenverhältnisse vom vertikalen Format 9:16 bis zum Breitbildformat 16:9 auswählen und die Länge des Clips nach Bedarf festlegen.

    Werbung

    Inhalte entstehen mit Unterstützung von UpTier.

    SEO und GEO auf Autopilot. Die Multiagentensysteme von UpTier schreiben und optimieren Inhalte für Suchmaschinen und KI-Antworten.

    UpTier entdecken ↗

    Kategorie:KI
    Hat Ihnen dieser Artikel gefallen?
    Entdecken Sie weitere interessante Beiträge im Blog
    Zurück zum Blog

    Ähnliche Beiträge

    Amazon veröffentlicht Strands Decider 2B für Entscheidungen in Agenten-WorkflowsAmazon veröffentlicht Strands Decider 2B für Entscheidungen in Agenten-Workflows
    Strands Decider 2B wählt zwischen vorgegebenen Optionen und liefert dazu einen Konfidenzwert. Das neue Entscheidungsmodell von AWS ist vollständig Open Source und lässt sich lokal betreiben.
    2 Min. Lesezeit
    1. 10. 2026
    ChatGPT erhält Space für die Teamarbeit mit KI-AgentenChatGPT erhält Space für die Teamarbeit mit KI-Agenten
    OpenAI erweitert ChatGPT um den gemeinsamen Arbeitsraum Space und den Dokumenteditor Pages. Präsentationen sollen sich ebenfalls im Chat erstellen und gemeinsam bearbeiten lassen; Slides soll in den kommenden Wochen folgen.
    1 Min. Lesezeit
    1. 10. 2026
    AlphaSignal: d1 von Liquid AI liefert Entscheidungen statt TextAlphaSignal: d1 von Liquid AI liefert Entscheidungen statt Text
    Laut AlphaSignal hat Liquid AI d1 veröffentlicht. Das Modell liefert strukturierte Entscheidungen mit Wahrscheinlichkeiten, statt Text zu erzeugen, und verbindet Klassifikation und Bewertung in einem API-Aufruf.
    3 Min. Lesezeit
    30. 9. 2026
    Přihlaste se k odběru našeho newsletteru
    Zůstaňte informováni o nejnovějších příspěvcích, exkluzivních nabídkách, a aktualizacích.
    CodedTrip

    Betreiber: CodedTrip LLC, USA.

    YouTube
    TikTok