Veed Fabric 1.0
von Veed
Veeds Modell für sprechende Videos.
Aus einem Standbild und einer Audiodatei wird ein sprechendes Video mit synchronen Lippen‑, Kopf‑, Körper- und Handbewegungen.
Veed Fabric 1.0
von Veed
Hauptfunktionen
Technische Spezifikationen
1 image + 1 audio
JPG, PNG, WebP, GIF + MP3, WAV, M4A
480p or 720p
Zwei Auflösungsstufen
5 ratios
16:9, 4:3, 1:1, 3:4, 9:16
Up to 5 min
Pro Generierung
Anwendungsfälle
Social Content mit sprechendem Avatar
Erstellen Sie Talking-Head-Clips für Instagram, TikTok, LinkedIn und Shorts aus einem Bild und einer Tonspur. Kein Studio-Dreh nötig.
Werbung und Erklärvideos
Nutzen Sie ein Markencharakter- oder Maskottchen-Standbild als Sprecher für Werbespots, Produkterklärungen und Tutorials. Die visuelle Identität bleibt konsistent.
Mehrsprachige Content-Lokalisierung
Erstellen Sie dasselbe sprechende Video in mehreren Sprachen, indem Sie nur die Tonspur austauschen – die Lippensynchronisation folgt automatisch der neuen Sprache.
Sprechende stilisierte Charaktere
Animieren Sie sprechende Illustrationen, Anime-, Clay-Maskottchen oder 3D-Renderings, nicht nur realistische Porträts. Passt zu Marken- und Entertainment-Projekten.
Prompt-Beispiele
Talking-Head-Werbespot
Animieren Sie dieses Charakterporträt beim Sprechen der angehängten Audiospur, neutraler Hintergrund, Halbtotale, 720p, 30 Sekunden
Edit promptStilisiertes Maskottchen
Lassen Sie dieses illustrierte Maskottchen das angehängte Voiceover sprechen, ausdrucksstarke Lippen- und Kopfbewegung, ganzer Körper im Bild, 60 Sekunden
Edit promptLokalisiertes Erklärvideo
Erstellen Sie ein sprechendes Video dieses Charakters mit dem angehängten spanischen Voiceover, präzise Lippensynchronisation, sanfte natürliche Körperbewegung, 90 Sekunden
Edit promptÜberblick
Veed Fabric 1.0 ist Veeds Modell für sprechende Videos, ein anderer Ansatz als ein Standard-Lip-Sync-Modell. Statt von vorhandenem Filmmaterial auszugehen und nur den Mund neu zu synchronisieren, nimmt Fabric ein einzelnes Standbild plus eine Audiodatei und erzeugt das komplette sprechende Video von Grund auf, mit Lippen, Kopf, Körper und Handbewegung, die allesamt vom Audio gesteuert werden. Es akzeptiert realistische Fotos, Illustrationen, Anime, 3D-Renderings und stilisierte Maskottchen, unterstützt beliebige Sprachen über das Eingabe-Audio und läuft bis zu 5 Minuten pro Generierung, lang genug, um komplette Erklärvideos und Werbetexte in einem Durchgang abzudecken.
Einfache Preise
Starten Sie noch heute kostenlos, mit der Option, jederzeit zu upgraden oder zu kündigen.
Basic
2400 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Standard
3625 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Pro
6350 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Max
24650 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Enterprise
Für höhere Limits
Individuell
Preis- und Abrechnungsbedingungen

Free
Zum Ausprobieren
$0
dauerhaft kostenlos
Häufig gestellte Fragen
Weitere Modelle
Entdecken Sie den Rest des Morphic-Modellkatalogs.
ChatGPT Images 2.5
OpenAI
OpenAIs Bildmodell, erschienen im September 2026. Schärfere Details, präzise Edits, kürzere Wartezeit.
Lyria 3.5
Google DeepMind
Googles bestklingendes Musikmodell. Ganze Songs mit Aufbau und Gesang.
MiniMax H3 Max Turbo
fal.ai
Das Tempo-Modell von fal, aus H3 Max. Doppelt so schnell, fast gleiche Optik.
Inworld TTS 2
Inworld
Eine Stimme, über 100 Sprachen. 95 Stimmen, erster Ton in Echtzeit.