Nicht jedes Video beginnt mit Filmmaterial. Ein Produktfoto, ein Zitat, ein einzelnes gut komponiertes Bild — in ein bewegtes Video mit Musik darunter verwandelt — funktioniert auf sozialen Plattformen oft besser als ein statischer Beitrag, einfach weil Videoformate auf den meisten Feeds mehr Reichweite bekommen als Bilder.
Was „Bild zu Video" tatsächlich generiert
Der Bild-zu-Video-Modus nimmt genau ein Bild (JPG/PNG) und eine MP3-Datei und erzeugt ein Video, dessen Länge exakt der Audiospur entspricht — das Video ist nie länger oder kürzer als die Musik. Das Bild selbst kann statisch bleiben oder mit dezenter Bewegung animiert werden, damit es nicht wie eine eingefrorene Folie wirkt.
Die Bewegungseffekte
Bewegung ist optional, macht aber einen echten Unterschied — ein Standbild auf einer Videoplattform wirkt wenig aufwendig. Verfügbare Effekte:
- Ken Burns (Standard) — ein langsamer, kombinierter Zoom- und Schwenkeffekt, der klassische Dokumentarfilm-Stil. Funktioniert für fast jedes Foto gut.
- Hinein- / Herauszoomen — ein einfacher Zoom nach vorn oder zurück, ohne Schwenk.
- Schwenk (vier Richtungen) — der Bildausschnitt gleitet über das Bild von links nach rechts, rechts nach links, oben nach unten oder unten nach oben, ohne zu zoomen. Am besten für breite Bilder (Landschaften, Gruppenfotos), bei denen es durch Bewegung über das Bild mehr zu zeigen gibt als durch Zoomen.
- Zoom + Schwenk kombiniert (sanft) — eine sanftere Version von Ken Burns für Bilder, bei denen du Bewegung willst, ohne dass sie zu auffällig ist.
Die Bewegungsintensität lässt sich von sehr dezent bis zur doppelten Standardamplitude einstellen — ein Porträt oder ein Screenshot wirkt in der Regel bei geringer Intensität besser, während eine Landschaft einen stärkeren Zoom vertragen kann, ohne ablenkend zu wirken.
Text darüberlegen
Ein Textoverlay lässt sich über das Bild legen — nützlich für ein Zitat, eine Bildunterschrift oder einen Call-to-Action. Ein paar wissenswerte Einstellungen:
- Position — Mitte, oben oder unten.
- Anzeigemodus — der vollständige Text kann sofort erscheinen, oder Wort für Wort mit einstellbarer Geschwindigkeit, was sich natürlich mit einem Voiceover kombinieren lässt, sodass die Wörter ungefähr synchron zur Sprache erscheinen.
- Einblend-Animation — Einblenden, Hereingleiten aus beliebiger Richtung, oder ein dezentes Aufspringen — wird automatisch ignoriert, wenn die Wort-für-Wort-Anzeige aktiv ist, da sich beide gegenseitig ausschließen.
- Hintergrundbox — ein halbtransparentes Feld hinter dem Text verbessert die Lesbarkeit auf unruhigen Bildern; ohne sie kann heller Text auf einem hellen Teil des Fotos verschwinden.
Anpassungsmodi: enthalten vs. abdecken
Wenn das Seitenverhältnis deines Bildes nicht zu deiner Zielauflösung passt (zum Beispiel ein quadratisches Produktfoto, gerendert im vertikalen 9:16-Format), wählst du, wie mit der Lücke umgegangen wird:
- Enthalten (contain) — das gesamte Bild bleibt sichtbar, mit Rändern (einer einfarbigen Hintergrundfarbe), die den leeren Raum füllen. Nichts wird beschnitten.
- Abdecken (cover) — das Bild wird gezoomt und zentriert, um den gesamten Rahmen zu füllen, alles, was nicht passt, wird beschnitten. Keine Ränder, aber du verlierst die Bildränder.
Cover ist meist die bessere Standardwahl für Social-Video (keine sichtbaren Balken), außer die Ränder deines Bildes sind wirklich wichtig — etwa bei einer Produktaufnahme, bei der ein Beschnitt einen Teil des Produkts abschneiden würde.
So generierst du eines mit RapidVideoMaker
- Lade ein JPG/PNG-Bild und eine MP3-Datei hoch (genau je eines — dieser Modus akzeptiert keine mehreren Bilder).
- Wähle einen Bewegungseffekt und eine Intensität, oder deaktiviere Bewegung für ein vollständig statisches Bild.
- Füge optional ein Textoverlay mit Position, Animation und Anzeigegeschwindigkeit hinzu.
- Wähle deinen Anpassungsmodus und die Zielauflösung.
- Generieren — die Ausgabedauer entspricht exakt deiner MP3-Datei.
Dieser Modus ist auch über die API-Dokumentation als image_to_video verfügbar, nützlich, um Videoinhalte in großen Mengen aus einer Reihe von Produktfotos oder Zitatbildern zu generieren.
Häufig gestellte Fragen
Kann ich mehr als ein Bild verwenden?
Nein — dieser Modus akzeptiert genau ein Bild und eine MP3-Datei. Um mehrere Bilder zu kombinieren, generiere ein Video pro Bild und füge sie anschließend mit dem Fusion-Modus zusammen.
Was bestimmt die Länge des Videos?
Exakt die Dauer der MP3-Datei. Wenn du ein längeres oder kürzeres Video brauchst, passe zuerst die Audiodatei an.
Funktioniert der Bewegungseffekt bei jedem Bild?
Ja, aber eine sehr hohe Intensität bei einem niedrig aufgelösten Bild kann beim Zoomen pixelig wirken — beginne mit der Standardintensität und passe von dort aus an.