Bring jedes Porträt zum Sprechen
Teile ein Porträt und bis zu 15 Sekunden Sprache, oder lass Seed Audio deinen Text sprechen. Cherry 2 Pro lässt die Person ihn lippensynchron sprechen – mit natürlicher Mimik sowie Bildausschnitt, Licht und Umgebung des Bildes.
Erfordert den Mage-Connector ↓Lieber klicken? Öffne die Lipsync-App →Beispiele
Ein Porträt und eine Stimme
Ihre Worte passen zum Clip; Rollkragenpullover, Licht und Hintergrund passen zum Porträt.
So funktioniert's
So verwendest du den Skill Lipsync
Teile Person und Sprache
Ein frontales Porträt oder ein gespeicherter Character und ein Sprachclip von bis zu 15 Sekunden. Kein Clip? Seed Audio kann deinen Text sprechen.
Bestätige den Preis
Cherry 2 Pro in 480p, im Hochformat, mit der kürzesten Länge, die dein Audio abdeckt.
Synchronität prüfen
Sieh es dir in voller Geschwindigkeit an. Ein Profilbild oder ein verdeckter Mund sind das Erste, was du ändern solltest, wenn es nicht passt.
Läuft auf
Einrichtung
Mage in deinem Agenten einrichten
Mage verbinden
Füge den Mage-Connector zu Claude, ChatGPT, Claude Code, Grok oder Cursor hinzu und melde dich mit deinem Mage-Konto an.
MCP-Einrichtung öffnen →Skills hinzufügen
Füge in Claude Code, Codex, Cursor und anderen Agents alle Mage-Skills mit einem einzigen Befehl hinzu oder installiere das Claude-Code-Plugin.
npx skills add mage-space/skills/plugin marketplace add mage-space/skills/plugin install mage@mageEinfach anfragen
Beschreibe die Aufgabe oder führe /mage-lipsync aus.
Use Mage to make this portrait say, in a warm, friendly voice: “Hi, welcome back. Today I want to show you something new.” Portrait: https://www.mage.space/skills/app-inputs/face.jpg
FAQ
Häufig gestellte Fragen
Ist das dasselbe wie die Lipsync-App?
Ja. Der Skill sendet den eigenen Prompt der Lipsync-App mit denselben Modellen und Standardwerten. So bekommt dein Agent die Ergebnisse der App direkt aus einem Chat und kann den Skill auf viele Bilder auf einmal anwenden.
Wie lang darf die Sprache sein?
Bis zu 15 Sekunden, genau wie in der App. Längere Clips werden auf 15 Sekunden gekürzt.
Kann er den Text auch für mich schreiben und sprechen?
Ja. Nenne die Worte und beschreibe die Stimme. Der Skill erzeugt mit Seed Audio 5 oder 10 Sekunden, nennt dir vorab den Preis und speichert das Ergebnis als Audio-Referenz.
Darf ich das Gesicht einer echten Person verwenden?
Nur mit Erlaubnis dieser Person und niemals, um jemanden zu täuschen, zu belästigen oder zu sexualisieren. Schädliche Deepfakes sind auf Mage verboten, und der Skill nennt dir die Regel zusammen mit dem Preis, bevor er startet.
Warum fragt der Skill vor dem Rendern nach?
Videos werden nach Auflösung und Länge berechnet. Deshalb nennt der Skill Modell, Auflösung, Länge und Gems und wartet auf dein Ja. Er startet mit 480p, der günstigsten Stufe, und bietet für die finale Version 720p oder 1080p an.
Probiere Lipsync in Claude aus
Lass ein Porträt einen Sprachclip sprechen – mit lippensynchronen Bewegungen und dem Look des Bildes.
Weitere Skills
Entdecke weitere Skills
Videobearbeitung
Video Editor
Ändere mit einer Anweisung, was ein Video zeigt, und behalte Bewegung, Kamera und Timing bei.
Videobearbeitung
Video-Face-Swap
Tausche in jedem Frame eines Clips ein Gesicht aus – Bewegung, Mimik und Lippenbewegungen bleiben erhalten.
Videobearbeitung
Video-Character-Swap
Ersetze die ganze Person in einem Clip durch deinen Character – samt Körper und Outfit.
Videobearbeitung
Musikvideo
Deine Characters singen und tanzen in einem Musikvideo mit filmreifer Kameraführung zu einem Track.
Videobearbeitung
Scene Builder
Zwei Charaktere in einer fertigen Videoszene, vom Dinner-Date bis zum Boxkampf, beide bleiben erkennbar.
Basics
Generate
Jedes Bild, Video und Audio mit dem passenden Mage-Modell, mit Preis vorab und als Link geliefert.







