PixVerse CLI: KI-Videos und Bilder im Terminal erstellen

Installieren Sie PixVerse CLI, erstellen Sie KI-Videos, Bilder, Sprache und Musik im Terminal und automatisieren Sie Agenten-Workflows mit JSON.

Product Update
PixVerse CLI: KI-Videos und Bilder im Terminal erstellen

Einführung

Jeder kreative Workflow hat einen Engpass – den Moment, in dem Sie Ihren Code-Editor verlassen, einen Browser öffnen und manuell durch eine Weboberfläche klicken müssen, um ein Medium zu generieren. Für Entwickler, KI-Agenten und alle, die automatisierte Content-Pipelines erstellen, ist dieser Kontextwechsel eine Reibung, die sich schnell summiert.

PixVerse CLIbeseitigt diesen Engpass. Es ist die offizielle Befehlszeilenschnittstelle für PixVerse und ermöglicht Ihnen den Zugriff auf die PixVerse-Generierungs- und Arbeitsbereichs-Workflows direkt von Ihrem Terminal aus. Text-zu-Video, Bild-zu-Video, Text-zu-Bild, Bild-zu-Bild, Übergänge, Sprachgenerierung, Musikgenerierung, Referenzvideo, Bewegungssteuerung, Vorlagen, Hochskalierung und Asset-Management sind alle skriptfähig, Pipe-fähig und ohne Berührung eines Browsers verfügbar. Für den kürzesten Installationspfad und einen Überblick zur Agenteneinrichtung starten Sie auf der offiziellen PixVerse CLI-Seite.

Was PixVerse CLI besonders nützlich macht, ist seine Designphilosophie: Es wurde speziell für KI-Agenten entwickelt. Befehle können strukturiertes JSON mit --json oder -p zurückgeben, Exit-Codes sind deterministisch und jeder Pipeline-Schritt ist zusammensetzbar. Das bedeutet, dass Sie Claude Code, Cursor, Codex oder jeden anderen Agenten beibringen können, in Ihrem Namen Bilder, Videos, Sprache und Musik mit weniger fragilen Übergaben zu generieren.

Dieses Handbuch ist auf das aktuelle PixVerseAI/cli GitHub README, sein öffentliches Fähigkeitsmanifest und die PixVerse CLI-Produktseite abgestimmt, überprüft am 13. Juli 2026. PixVerse CLI wird fortlaufend über das GitHub-Repository aktualisiert, daher sollten Produktionsskripte dennoch pixverse --version, pixverse create <mode> --help und pixverse update vor einer großen Batch-Ausführung überprüfen.

Voraussetzungen

Bevor Sie beginnen, benötigen Sie:

  • Node.js 20 oder höher– erkundigen Sie sich bei node --version
  • Ein PixVerse-Konto– registrieren Sie sich unter pixverse.ai
  • Ein aktives PixVerse-Abonnement– CLI verwendet dasselbe Kreditsystem wie die Website; Nur abonnierte Benutzer können Inhalte generieren

PixVerse CLI erfordert kein manuelles Kopieren von API-Schlüsseln. Die Authentifizierung erfolgt über einen browserbasierten OAuth-Flow, der Ihr Token lokal speichert.

Schritt 1: Installieren Sie CLI

Global mit npm installieren:

npm install -g pixverse

Überprüfen Sie die Installation:

pixverse --version

Wenn Sie keine globale Installation bevorzugen, können Sie Befehle auch über npx ausführen:

npx pixverse create video --prompt "A cat walking on Mars"

Schritt 2: Authentifizieren

Führen Sie den Anmeldebefehl aus:

pixverse auth login

Der CLI öffnet einen Browser für die Autorisierung des OAuth-Geräts. Sie können die URL auch kopieren und die Autorisierung von jedem Browser auf jedem Gerät aus abschließen, was für SSH- und Headless-Umgebungen nützlich ist. Ihr Token wird automatisch in ~/.pixverse/ gespeichert und ist 30 Tage lang gültig.

Um zu überprüfen, ob Sie angemeldet sind und Ihr verfügbares Guthaben prüfen:

pixverse auth status pixverse account info pixverse account slots

Der Befehl account info zeigt Ihre Abonnementstufe, Ihr Workspace-Guthaben und Ihren Nutzungskontext an. Mithilfe von pixverse account usage können Sie den Kreditverbrauch überprüfen, während pixverse account slots die aktuellen gleichzeitigen Generierungsslots für Bild- und Videojobs anzeigt. CLI-Sitzungen sind unabhängig von PixVerse-Web-/App-Sitzungen, und Sie können das gespeicherte CLI-Token mit pixverse auth logout entfernen. Überprüfen Sie immer Ihr Guthaben und die verfügbaren Slots, bevor Sie Batch-Jobs ausführen.

Schnellstartbefehle

Wenn Sie nur den kürzesten Weg von der Installation zu einem generierten Asset benötigen, beginnen Sie mit dieser Reihenfolge:

npm install -g pixverse
pixverse auth login
pixverse create image --prompt "A photorealistic forest path at golden hour" --json
pixverse create video --prompt "A sunset over ocean waves" --model v6 --quality 720p --duration 5 --json

Lassen Sie für Agenten- und CI-Workflows --json oder -p aktiviert, damit stdout maschinenlesbar bleibt, während Fortschritt und Fehler auf stderr bleiben. Fügen Sie für Produktionswiederholungen --idempotency-key <key> zu den Erstellungsbefehlen hinzu, damit durch wiederholte Übermittlungen nicht versehentlich doppelte kostenpflichtige Aufträge erstellt werden.

Schritt 3: Generieren Sie Ihr erstes Bild

Die Text-zu-Bild-Generierung ist die schnellste Möglichkeit, Ihr Setup zu testen. Ausführen:

pixverse create image --prompt "A photorealistic forest path at golden hour" --json

Das aktuelle GitHub README listet GPT Image 2 als Standardbildmodell auf. Für reproduzierbare Automatisierungen legen Sie --model dennoch explizit fest und überprüfen Sie vor der Stapelverarbeitung die Live-Hilfe von CLI oder capabilities.json. Das --json-Flag gibt eine strukturierte Ausgabe zurück:

{ "image_id": 789012, "status": "completed", "image_url": "https://...", "prompt": "A photorealistic forest path at golden hour", "model": "gpt-image-2.0", "width": 1440, "height": 1440 }

Geben Sie für eine Ausgabe mit höherer Auflösung ein Modell an, das dies unterstützt:

pixverse create image \ --prompt "A photorealistic forest path at golden hour" \ --model seedream-5.0-lite \ --quality 2160p \ --aspect-ratio 16:9 \ --json

PixVerse unterstützt mehrere Bildmodelle mit jeweils unterschiedlichen Auflösungsgrenzen und Seitenverhältnisunterstützung:

Modell --model value Qualität Notizen
GPT Image 2 gpt-image-2.0 1080p, 1440p, 2160p Standardbildmodell; Unterstützt breite und hohe Seitenverhältnisse
Nano Banana 2 gemini-3.1-flash 512p, 1080p, 1440p, 2160p Flexible auto und Standard-Seitenverhältnisse
Nano Banana 2 Lite gemini-3.1-flash-lite 1080p Leichte Nano Banana 2-Option für schnelle Bild-Workflows
Qwen Image qwen-image 720p, 1080p Schnelle Generierung für häufige kreative Aufgaben
Nano Banana Pro gemini-3.0 1080p, 1440p, 2160p Hochwertige Bilderstellung in größeren Formaten
Nano Banana gemini-2.5-flash 1080p Leichte Bilderzeugung mit schneller Bearbeitungszeit
Seedream 5.0 Pro seedream-5.0-pro 1080p, 1440p Unterstützt Standard-Seitenverhältnisse und Multi-Referenz-Bild-Workflows
Seedream 5.0 Lite seedream-5.0-lite 1440p, 1800p, 2160p Kreative Bilder mit hoher Detailgenauigkeit
Seedream 4.5 seedream-4.5 1440p, 2160p Hochauflösende Bilderzeugung
Seedream 4.0 seedream-4.0 1080p, 1440p, 2160p Zusätzliche Seedream-Option für Bild-Workflows
Kling Image O3 kling-image-o3 1080p, 1440p, 2160p Stilisierte visuelle Ausgaben mit flexiblem Rahmen
Kling Image V3 kling-image-v3 1080p, 1440p Ausgewogene Qualität und Geschwindigkeit

Sie können ein vorhandenes Bild auch mit Bild-zu-Bild umwandeln:

pixverse create image \ --prompt "Turn this product photo into a clean watercolor illustration" \ --image ./product-photo.png \ --model gpt-image-2.0 \ --json

So laden Sie das generierte Bild herunter:

pixverse asset download 789012

Schritt 4: Erstellen Sie Ihr erstes Video

Text-to-Video funktioniert auf die gleiche Weise. Erzeugen Sie einen 5-Sekunden-Clip:

pixverse create video --prompt "A sunset over ocean waves" --json

Für eine vollständig maßgeschneiderte Generation:

pixverse create video \ --prompt "A cinematic drone shot over a misty mountain valley at dawn" \ --model v6 \ --quality 1080p \ --aspect-ratio 16:9 \ --duration 8 \ --audio \ --json

Das --audio-Flag ermöglicht KI-generierten Umgebungsklang, der zu Ihrem Videoinhalt passt. Das Flag --json gibt nach Abschluss ein video_url zurück, das Sie direkt an einen Download-Befehl oder den nächsten Schritt in einer Pipeline übergeben können.

PixVerse bietet mehrere Videomodelle mit unterschiedlicher Qualität, Dauer und Modusunterstützung:

Modell --model value Maximale Qualität Dauer Notizen
PixVerse V6 v6 1080p 1–15 Sek Standardvideomodell; Breite Unterstützung für Seitenverhältnisse
PixVerse C1 pixverse-c1 1080p 1–15 Sek Starke Unterstützung für Video-, Referenz- und Übergangsworkflows
Seedance 2.0 Standard seedance-2.0-standard 2160p 4–15 Sek Unterstützt Video-, Referenz- und Übergangsmodi
Seedance 2.0 Fast seedance-2.0-fast 720p 4–15 Sek Schnellere Seedance-Option für Video-, Referenz- und Übergangsmodi
Seedance 2.0 Mini seedance-2.0-mini 720p 4–15 Sek Lightweight Seedance-Option für Video-, Referenz- und Übergangsmodi
Google Gemini Omni gemini-omni-flash 720p 3–10 Sek Unterstützt Video- und Referenz-Workflows in 16:9 oder 9:16
Happy Horse 1.0 happyhorse-1.0 1080p 3–15 Sek Audiofähige Videooption für create video verfügbar
Kling O3 Pro kling-o3-pro 720p 3–15 Sek Unterstützt Video-, Referenz- und Übergangsworkflows
Kling O3 Standard kling-o3-standard 720p 3–15 Sek Standard-Kling O3-Option
Kling 3.0 Pro kling-3.0-pro 720p 3–15 Sek Unterstützt Video- und Übergangsworkflows
Kling 3.0 Standard kling-3.0-standard 720p 3–15 Sek Standard-Kling 3.0-Option
Grok Imagine 1.5 grok-imagine-1.5 720p 1–15 Sek Nur Bild-zu-Video; erfordert --image und folgt dem Seitenverhältnis des Eingabebilds
Grok Imagine grok-imagine 720p 1–15 Sek Frühere Grok-Option; unterstützt Video-, Erweiterungs- und Referenz-Workflows
Veo 3.1 Lite veo-3.1-lite 1080p 4, 6 oder 8 Sek Unterstützt Video- und 2-Frame-Übergangsworkflows
Veo 3.1 Standard veo-3.1-standard 2160p 4, 6 oder 8 Sek Veo-Option mit höherer Auflösung
Veo 3.1 Fast veo-3.1-fast 2160p 4, 6 oder 8 Sek Schnellere Veo-Option
Sora 2 Pro sora-2-pro 1080p 4, 8 oder 12 Sek Sora-Option mit fester Laufzeit
Sora 2 sora-2 720p 4, 8 oder 12 Sek Standard-Sora-Option
PixVerse v5.6 v5.6 1080p 1–10 Sek Wird weiterhin für Bewegungssteuerung und ausgewählte Generierungsworkflows verwendet
PixVerse v5.5 v5.5 1080p 1–10 Sek Wird für create modify-Workflows verwendet
PixVerse v5 v5 1080p 1–10 Sek Wird für Übergangsworkflows mit mehr als 3 Frames verwendet

Animieren Sie ein statisches Bild

Um ein Foto oder ein generiertes Bild in ein Video umzuwandeln, geben Sie das Flag --image an:

pixverse create video \ --prompt "Gentle wind moves through the scene" \ --image ./product-photo.jpg \ --model v6 \ --quality 1080p \ --json

Sie können einen lokalen Dateipfad oder eine URL übergeben. Lokale Dateien werden automatisch hochgeladen – kein manueller Upload-Schritt erforderlich. Lokale Bildeingaben, die größer als 1920x1920 oder 5MB sind, werden vor dem Hochladen automatisch in der Größe geändert oder komprimiert. Remote-Bild-URLs werden vom Backend unverändert validiert.

Für Grok Imagine 1.5 ist ein Bild erforderlich und das Ausgabeseitenverhältnis richtet sich nach diesem Bild:

pixverse create video \ --prompt "Slow camera push-in, subtle fabric motion, clean native ambience" \ --image ./campaign-poster.png \ --model grok-imagine-1.5 \ --quality 720p \ --duration 6 \ --json

Verwenden Sie Referenz, Übergang, Bewegungssteuerung und Vorlagen

Der aktuelle CLI unterstützt mehr als nur einfaches Text-zu-Video und Bild-zu-Video. Diese Erstellungsmodi sind nützlich, wenn Sie mehr Kontrolle über Charaktere, Keyframes, Bearbeitungen oder Effekte benötigen:

# Create a transition between keyframes pixverse create transition --images ./frame1.png ./frame2.png # Generieren Sie Sprachaudio aus Text pixverse create voice --text "Welcome to the launch" --voice-id <preset_voice_id> --output ./voiceover.mp3 # Generieren Sie Musik aus einer Eingabeaufforderung pixverse create music --prompt "A cinematic synth-pop intro with bright percussion" --auto-lyrics pixverse create music --prompt "Uplifting piano theme for a product reveal" --instrumental --duration-seconds 60 # Erweitern Sie ein generiertes Video pixverse create extend --video <video_id> # Ändern Sie ein vorhandenes Video pixverse create modify --video <video_id> --prompt "Change the background to a beach" # Hochwertige Videoauflösung pixverse create upscale --video <video_id> --quality 1080p # Erstellen Sie ein Video mit Referenzbildern pixverse create reference --images ./char1.png ./char2.png --prompt "Two friends walking in a park" # Die Seedance 2.0-Referenz kann Bild- und Videoeingänge mischen pixverse create reference \ --model seedance-2.0-standard \ --images ./character.png \ --videos ./motion.mp4 \ --prompt "@image1 follows the motion in @video1" # Seedance 2.0-Modelle unterstützen bis zu 9 Referenzbilder pixverse create reference \ --model seedance-2.0-standard \ --images ./char1.png ./char2.png ./char3.png ./char4.png \ --prompt "@image1 and @image2 walk through the scene together" # Bewegungssteuerung mit einem Charakterbild und einem Bewegungsreferenzvideo pixverse create motion-control --image ./character.png --video ./dance.mp4 # Erstellen Sie aus einer Vorlage oder einem Effekt pixverse create template --template-id 12345 --image ./photo.png

Nicht jedes Modell unterstützt jeden Erstellungsmodus. In der aktuellen README-Matrix unterstützt create video v6, pixverse-c1, Seedance 2.0 Standard/Fast/Mini, Google Gemini Omni, Happy Horse 1.0, Kling O3, Kling 3.0, Grok Imagine, Veo 3.1, Sora 2 und v5.6. grok-imagine-1.5 ist nur für die Bild-zu-Video-Übertragung geeignet und erfordert --image; create extend unterstützt v6 und grok-imagine; create reference unterstützt v6, pixverse-c1, Seedance 2.0 Standard/Fast/Mini, Google Gemini Omni, Kling O3, grok-imagine und v5.6; 2-Frame-Übergänge unterstützen die neueren Videofamilien; 3+ Rahmenübergänge verwenden v5; create modify verwendet v5.5; und create motion-control verwendet v5.6.

Schritt 5: Stimme und Musik generieren

Der aktuelle GitHub README dokumentiert eigenständiges Audio über spezielle Erstellungsbefehle. Verwenden Sie create voice für Text-to-Speech und create music für die Generierung von Prompt-to-Musik. Sprach- und Musikausgaben werden als Audio-Assets gespeichert, sodass Sie sie mit task verfolgen, mit asset list --type audio auflisten und mit asset download --type audio herunterladen können. Für eine native Videoatmosphäre verwenden Sie --audio oder --no-audio für unterstützte Videoerstellungsbefehle.

Sprachaudio generieren:

pixverse create voice \ --text "Welcome to the launch. Here is what changed this week." \ --model speech-2.8-hd \ --voice-id <preset_voice_id> \ --output ./voiceover.mp3 \ --json

Durchsuchen Sie Sprachmodelle und voreingestellte Stimmen:

pixverse voice models --json pixverse voice presets --model speech-2.8-hd --json

Musik generieren:

pixverse create music \ --prompt "A bright cinematic synth-pop track for a 30-second product reveal" \ --auto-lyrics \ --duration-seconds 30 \ --json

Für Instrumentalspuren verwenden Sie --instrumental. Übergeben Sie Liedtexte für Liedtext-fähige Modelle als wörtlichen Text, einen lokalen Dateipfad oder stdin:

pixverse create music \ --prompt "Uplifting electronic pop with a confident chorus" \ --lyrics ./lyrics.txt \ --json

Zu den aktuellen Sprachmodellfamilien gehören die Modelle MiniMax Speech 2.8 und ElevenLabs. Zu den aktuellen Musikmodellfamilien gehören MiniMax Music, ElevenLabs Music und Google Lyria 3 Pro. Verwenden Sie pixverse voice models und pixverse music models für den Live-Katalog, bevor Sie ein Skript für einen Produktionsworkflow erstellen.

Schritt 6: Führen Sie den interaktiven Assistenten aus

Wenn Sie zum ersten Mal erkunden und noch nicht mit allen verfügbaren Flags vertraut sind, führen Sie einen beliebigen Erstellungsbefehl ohne Argumente aus, um den geführten Assistenten aufzurufen:

pixverse create video pixverse create image

Der Assistent führt Sie Schritt für Schritt durch Eingabeaufforderung, Modellauswahl, Qualität, Seitenverhältnis, Dauer und andere Optionen – nützlich, um herauszufinden, welche Parameter verfügbar sind, bevor Sie sie mit einem Skript versehen.

Beyond Generation: Verwalten Sie Ihre Assets und Ihren Arbeitsbereich

Das aktuelle PixVerse CLI enthält außerdem Verwaltungsbefehle, die Sie beim Aufbau durchgängiger Terminal-Workflows unterstützen:

  • pixverse task status <id> und pixverse task wait <id> für die Aufgabenabfrage
  • pixverse task status --ids 123,456,789 --type video --json für Chargenstatusprüfungen
  • pixverse asset list, asset upload, asset info, asset download und asset delete für Video-, Bild- und Audio-Asset-Lebenszyklusvorgänge
  • pixverse saved list, saved items, saved new, saved rename, saved add, saved remove und saved delete für gespeicherte Ordner
  • pixverse template categories, template list, template search und template info zum Entdecken von Effekten und Vorlagen
  • pixverse voice models, voice presets und music models für die Erkennung von Live-Audiomodellen
  • pixverse workspace list, workspace status, workspace switch und workspace manage für Multi-Workspace-Vorgänge
  • pixverse account info, account usage und account slots für Kredit-, Nutzungs- und Parallelitätsprüfungen
  • pixverse config set, config list, config path und config defaults für wiederholbare lokale Standardeinstellungen

Dies macht es einfach, nicht nur die Erstellung, sondern auch die Organisation, Vorlagenerkennung, Audioerkennung, Download, Workspace-Routing und Bereitstellung in einem Skript zu automatisieren. Wenn Sie einen Befehl für einen anderen Arbeitsbereich ausführen müssen, verwenden Sie das globale Flag --workspace-id <id>. 0 zielt auf Ihren persönlichen Arbeitsbereich ab.

Skriptfreundliche Flags

Der Großteil der Automatisierung hängt von einer vorhersehbaren Ausgabe und einem vorhersehbaren Laufzeitverhalten ab. Diese Flags sind besonders nützlich in Skripten und AI-Agent-Workflows:

Flagge Verwenden Sie es für
--json Gibt eine strukturierte JSON-Ausgabe zurück
-p Kurzalias für --json
--count <n> Generieren Sie 1–4 Variationen aus einer Anfrage
--seed <number> Erleichtern Sie die Reproduktion einer Generation
--off-peak Nutzen Sie die Preise außerhalb der Hauptverkehrszeiten, sofern verfügbar
--audio / --no-audio Aktivieren oder deaktivieren Sie die Audiogenerierung für unterstützte Erstellungsbefehle
--multi-shot / --no-multi-shot Aktivieren oder deaktivieren Sie den Multi-Shot-Modus für Videos
--no-wait Geben Sie den Auftrag ab und kehren Sie umgehend zurück
--timeout <sec> Legen Sie das Abruf-Timeout fest, standardmäßig auf 300 Sekunden
--workspace-id <id> Überschreiben Sie den aktiven Arbeitsbereich für einen einzelnen Befehl
--trace-id <uuid> Hängen Sie zum Debuggen und zur Beobachtbarkeit eine vom Aufrufer bereitgestellte UUIDv4 an API-Anfragen an
--idempotency-key <key> Wiederholen Sie Erstellungsanfragen sicher, ohne versehentlich doppelte kostenpflichtige Aufträge zu erstellen

Texteingabe-Flags lassen sich jetzt einfacher automatisieren. --prompt, --text und --lyrics können eine Literalzeichenfolge, einen lokalen Dateipfad oder - für stdin akzeptieren:

pixverse create video --prompt ./scene.txt --json cat scene.txt | pixverse create image --prompt - --json echo "Hello from the command line" | pixverse create voice --text - --json pixverse create music --prompt "Bright synth-pop" --lyrics ./lyrics.txt --json

Bringen Sie Ihrem KI-Agenten bei, Medien zu generieren

Hier wird PixVerse CLI wirklich transformativ. Da Befehle strukturiertes JSON zurückgeben und deterministische Exit-Codes verwenden können, kann jedem KI-Agenten, der Shell-Befehle ausführen kann, beigebracht werden, Bilder und Videos bei Bedarf zu generieren.

PixVerse Skills installieren

PixVerse Skillsist eine strukturierte Skill-Bibliothek, die Agenten beibringt, wie sie CLI richtig verwenden: Befehlsflags, Modelleinschränkungen, mehrstufige Pipelines und robuste Fehlerbehandlung.

Für Claude Code und andere Agenten, die das Skills-Format unterstützen, fügen Sie die PixVerse-Skills direkt hinzu:

npx skills add https://github.com/pixverseai/skills --skill pixverse-ai-image-and-video-generator

Für Cursor, Claude Code, Codex und andere Agent-Frameworks verbessert diese Fähigkeit die Zuverlässigkeit, indem sie dem Agent explizite Einschränkungen gibt, anstatt ihn zu zwingen, diese von Grund auf abzuleiten.

PixVerse CLI liefert außerdem ein kompaktes maschinenlesbares Befehlsmanifest unter dist/capabilities.json, wobei die öffentliche Quelle als capabilities.json im GitHub-Repository verfügbar ist. Dieses Manifest beschreibt Befehle, Flags, Exit-Codes, JSON-Ausgabeerwartungen und Wirkungskategorien, sodass Agenten den CLI-Vertrag prüfen können, ohne den Hilfetext zu lesen.

Sobald Ihr Agent über die PixVerse-Fähigkeiten verfügt, können Sie ihm Anweisungen in natürlicher Sprache geben wie:

  • „Generieren Sie aus diesem Screenshot ein 10-sekündiges Produktdemovideo.“
  • „Erstellen Sie vier Variationen dieses Blog-Titelbilds im 16:9-Format.“
  • „Animieren Sie dieses Diagramm in einen 5-sekündigen Erklärclip mit Umgebungsgeräuschen.“
  • „Generieren Sie drei 8-sekündige 16:9-Werbeclips mit unterschiedlichen Kamerabewegungen“

Der Agent übersetzt diese Anweisungen in die richtigen CLI-Befehle, analysiert die JSON-Ausgabe und kümmert sich um Abfragen und Downloads – kein manueller Eingriff erforderlich.

Claude Code

In Claude Code wird PixVerse CLI zu einem nativen Tool, das der Agent autonom nutzt. Nachdem Sie die PixVerse-Skills geladen haben, können Sie die Medienerstellung direkt in jede Aufgabe einbinden:

Generate a cover image for this blog post about machine learning, use the seedream-5.0-lite model at 2160p in 16:9 format, download it to ./assets/cover.webp

Claude Code ruft die richtigen CLI-Befehle auf, analysiert die Bild-URL aus der JSON-Antwort und lädt die Datei in Ihren angegebenen Pfad herunter – alles innerhalb derselben Sitzung, in der auch Ihr Code geschrieben wird.

Ein typischer Claude Code-Workflow:

# Claude Code runs this autonomously based on your instruction IMG=$(pixverse create image \ --prompt "Abstract visualization of neural network layers, dark background, blue and purple tones" \ --model seedream-5.0-lite \ --quality 2160p \ --aspect-ratio 16:9 \ --json | jq -r '.image_url') # Dann animiert es pixverse create video \ --prompt "Slow pan across glowing neural connections" \ --image "$IMG" \ --model v6 \ --quality 1080p \ --duration 6 \ --json

Cursor

Cursor-Benutzer können PixVerse Skills als Projektkontextdatei laden. Platzieren Sie die relevanten Skilldateien in Ihrem .cursor/-Verzeichnis oder fügen Sie sie Ihren Arbeitsbereichsregeln hinzu. Nach dem Laden kennt Cursor alle PixVerse CLI-Befehle vollständig und kann im Rahmen jeder Codierungsaufgabe Medien generieren.

Ein üblicher Cursor-Workflow: Bitten Sie den Agenten, ein Mockup-Bild basierend auf einem von Ihnen erstellten Design zu erstellen, und verwenden Sie es dann direkt in Ihrer IDE-Sitzung als Referenz – ohne jemals den Editor zu verlassen.

Codex und andere Agenten

PixVerse CLI ist mit jedem Agenten kompatibel, der Shell-Befehle ausführen und JSON analysieren kann. Das strukturierte Ausgabeformat – konsistente Feldnamen, vorhersehbare Fehlercodes und durch stderr getrennte Fehlermeldungen – stellt sicher, dass selbst einfache Skriptagenten die Generierung zuverlässig integrieren können.

Der Exit-Code-Vertrag vereinfacht die Fehlerbehandlung:

Code Bedeutung Agentenaktion
0 Erfolg Analysieren Sie die JSON-Ausgabe
1 Allgemeiner Fehler Überprüfen Sie stderr und versuchen Sie es erneut mit validierten Eingaben
2 Auszeit Versuchen Sie es erneut mit längerem --timeout
3 Authentifizierung abgelaufen Führen Sie pixverse auth login erneut aus
4 Keine Credits mehr Guthaben prüfen, Benutzer benachrichtigen
5 Die Generierung ist fehlgeschlagen Probieren Sie verschiedene Parameter aus
6 Validierungsfehler Überprüfen Sie die Flagwerte

Automatisierungspipelines

Sobald Sie die einzelnen Befehle verstanden haben, schaltet PixVerse CLI leistungsstarke mehrstufige Workflows frei, die völlig ohne Benutzerinteraktion ablaufen.

Text zu Bild zu Video

Eine der nützlichsten Pipelines: Generieren Sie aus einer Textaufforderung ein hochauflösendes Bild und animieren Sie es dann zu einem Video.

# Step 1: Generate a base image IMG_RESULT=$(pixverse create image \ --prompt "A cyberpunk cityscape at night, neon lights reflecting on wet pavement" \ --model gemini-3.1-flash \ --quality 2160p \ --aspect-ratio 16:9 \ --json) IMAGE_URL=$(echo "$IMG_RESULT" | jq -r '.image_url') # Schritt 2: Animieren Sie es zu einem Video VID_RESULT=$(pixverse create video \ --prompt "Camera slowly pans across the neon-lit streets" \ --image "$IMAGE_URL" \ --model v6 \ --quality 1080p \ --duration 8 \ --json) VIDEO_ID=$(echo "$VID_RESULT" | jq -r '.video_id') # Schritt 3: Laden Sie das endgültige Video herunter pixverse asset download "$VIDEO_ID" --json

Vollständige Videoproduktionspipeline

Für eine polierte Ausgabe Kettenerstellung mit Nachbearbeitungsschritten. Verwenden Sie --audio oder --no-audio, wenn Sie nativen Sound für unterstützte Videoerstellungsbefehle wünschen, verwenden Sie dann create voice für Text-to-Speech-Audio und create music für eigenständige Musik-Assets, die Sie nachgelagert kombinieren:

# Step 1: Create the base video RESULT=$(pixverse create video \ --prompt "A product being assembled in slow motion" \ --model v6 \ --quality 720p \ --duration 5 \ --audio \ --json) VID=$(echo "$RESULT" | jq -r '.video_id') # Schritt 2: Dauer verlängern EXTENDED=$(pixverse create extend \ --video "$VID" \ --json | jq -r '.video_id') pixverse task wait "$EXTENDED" --json # Schritt 3: Hochskalieren auf 1080p FINAL=$(pixverse create upscale \ --video "$EXTENDED" \ --quality 1080p \ --json | jq -r '.video_id') pixverse task wait "$FINAL" --json # Schritt 4: Herunterladen pixverse asset download "$FINAL" --json # Optional: Erstellen Sie ein separates Voiceover-Asset pixverse create voice \ --text "The final reveal starts now." \ --voice-id <preset_voice_id> \ --output ./voiceover.mp3 \ --json

Batch-Generierung

Für Inhaltspipelines, die mehrere Variationen erfordern, führen Sie Jobs parallel aus:

# Check credits and concurrent generation slots first pixverse account info --json pixverse account slots --json # Reichen Sie vier parallele Generationen ein pixverse create video --prompt "Sunrise over mountains" --no-wait --json > /tmp/v1.json & pixverse create video --prompt "Sunset over ocean" --no-wait --json > /tmp/v2.json & pixverse create video --prompt "Stars over a desert" --no-wait --json > /tmp/v3.json & pixverse create video --prompt "Aurora over a frozen lake" --no-wait --json > /tmp/v4.json & wait # Überprüfen Sie alle zurückgegebenen Aufgaben-IDs in einem Batch-Statusaufruf IDS=$(jq -r '.video_id' /tmp/v1.json /tmp/v2.json /tmp/v3.json /tmp/v4.json | paste -sd, -) pixverse task status --ids "$IDS" --type video --json # Warten Sie auf jeden und laden Sie ihn herunter for f in /tmp/v1.json /tmp/v2.json /tmp/v3.json /tmp/v4.json; do ID=$(jq -r '.video_id' "$f") pixverse task wait "$ID" --json pixverse asset download "$ID" --json done

Das --no-wait-Flag sendet den Job und kehrt sofort mit einer Aufgaben-ID zurück, sodass Sie mehrere Jobs vor der Abfrage senden können. Zeichnen Sie mit --no-wait --json die zurückgegebenen Aufgaben-IDs und aufgelösten Erstellungsparameter zur Protokollierung und Reproduzierbarkeit auf. Verwenden Sie --count <n>, wenn Sie mehrere Variationen von einer Eingabeaufforderung wünschen, und verwenden Sie die Stapelverarbeitung task status --ids, wenn Sie eine Statusantwort für mehrere laufende Jobs wünschen. Der Befehl pixverse task wait übernimmt die adaptive Abfrage für Sie.

Standardeinstellungen konfigurieren

Wenn Sie stets dasselbe Modell, dieselbe Qualität oder dasselbe Seitenverhältnis verwenden, legen Sie diese als Standardwerte fest, damit Sie die Markierungen nicht jedes Mal wiederholen müssen:

pixverse config defaults set video model v6 pixverse config defaults set video quality 1080p pixverse config defaults set image model seedream-5.0-lite pixverse config set output-dir ~/Downloads/pixverse pixverse config defaults show pixverse config list pixverse config path

Befehlszeilenflags setzen Ihre konfigurierten Standardeinstellungen immer außer Kraft, sodass Sie die volle Flexibilität behalten und gleichzeitig Wiederholungen reduzieren. Fügen Sie für eine arbeitsbereichsspezifische Automatisierung --workspace-id <id> zu einem Befehl hinzu, wenn Sie den aktiven Arbeitsbereich für diesen einzelnen Lauf überschreiben möchten.

Was Sie bauen können

Durch die Integration von PixVerse CLI in Ihren Agenten-Workflow erweitert sich das Spektrum automatisierbarer Aufgaben erheblich:

  • Dokumentation– Generieren Sie im Rahmen Ihres Dokumenterstellungsprozesses automatisch Produktdemovideos und Screenshots
  • Marketing– Führen Sie nächtliche Batch-Jobs aus, die Variationen von Social-Media-Inhalten aus einer einzigen Eingabeaufforderungsbibliothek erstellen
  • App-Entwicklung– Lassen Sie Ihren Programmieragenten Platzhaltervisualisierungen, Mockup-Animationen oder Ladebildschirmvideos generieren, während Sie die Benutzeroberfläche erstellen
  • Audio-Workflows– Erstellen Sie Voiceover-Entwürfe, Ansage-zu-Musik-Tracks oder Audio-Assets für die spätere Bearbeitung
  • Content-Pipelines– Verketten Sie CLI-Aufrufe mit anderen Tools (ffmpeg, ImageMagick, Cloud-Speicher), um vollständig automatisierte Medienproduktions-Workflows zu erstellen
  • Prototyping– Erstellen Sie in Sekundenschnelle schnelle Konzepte, um Ideen zu validieren, bevor Sie mit der vollständigen Produktion beginnen

Der CLI ist so konzipiert, dass er sich natürlich in jeden Shell-basierten Workflow einfügt. Wenn Ihre vorhandene Automatisierung in Bash, Python, Node oder einer CI/CD-Pipeline ausgeführt wird, fügt sich PixVerse CLI ohne zusätzlichen Integrationsaufwand ein.

Checkliste für den Einstieg

  • Installieren Sie Node.js 20 oder höher
  • Führen Sie npm install -g pixverse aus
  • Führen Sie pixverse auth login aus und autorisieren Sie es im Browser
  • Führen Sie pixverse account info aus, um die Gutschriften zu überprüfen
  • Führen Sie pixverse account slots vor der gleichzeitigen Stapelverarbeitung aus
  • Generieren Sie Ihr erstes Bild: pixverse create image --prompt "..." --json
  • Generieren Sie Ihr erstes Video: pixverse create video --prompt "..." --json
  • Generieren Sie Ihr erstes Sprach-Asset: pixverse create voice --text "..." --json
  • Generieren Sie Ihr erstes Musik-Asset: pixverse create music --prompt "..." --json
  • Entdecken Sie Vorlagen mit pixverse template list
  • Installieren Sie PixVerse Skills für Ihren Agenten (Claude Code, Cursor oder Codex).
  • Richten Sie Ihre bevorzugten Standardeinstellungen mit pixverse config defaults set ein
  • Erstellen Sie Ihre erste Automatisierungspipeline

Den CLI auf dem neuesten Stand halten

Verwenden Sie den integrierten Updater, um Ihr lokales CLI auf dem neuesten Stand zu halten:

pixverse update

Sie können npm auch direkt verwenden:

npm install -g pixverse@latest

Da PixVerse CLI ein aktiv aktualisiertes Tool und kein einmaliger Launch ist, behandeln Sie diesen Artikel als praktischen Leitfaden und die offiziellen Quellen als Live-Referenz. Die offizielle PixVerse CLI-Seite ist der kürzeste Pfad für Installation und Agenten-Onboarding, während GitHub der Ort bleibt, um Release-Level-Änderungen und neu unterstützte Modelle zu verfolgen:

In den aktuellen Dokumenten werden PixVerse V6 als Standardvideomodell, GPT Image 2 als Standardbildmodell, Google Gemini Omni-Videosupport, Nano Banana 2 Lite- und Seedream 5.0 Pro-Bildsupport, Seedance 2.0 Mini-Unterstützung, modusspezifische PixVerse v5- und v5.5-Workflows, dedizierte create voice- und create music-Befehle, Audio-Asset-Management, gespeicherte Ordner, Arbeitsbereichsumschaltung, config defaults, capabilities.json für Agenten, pixverse update, stdin-Unterstützung für Texteingaben sowie --trace-id und --idempotency-key für sicherere Wiederholungsversuche hervorgehoben.

Nächste Schritte

Mit der offiziellen PixVerse CLI-Seite, PixVerse CLI auf GitHub und npm (npm install -g pixverse) erhalten Sie über eine einzige Schnittstelle sofortigen Zugriff auf Generierung, Aufgabenabfrage, Asset-Management, Vorlagen, gespeicherte Ordner, Kontoprüfungen, Audiomodellerkennung und Arbeitsbereichssteuerung. Das PixVerse Skills-Repository fügt agentenbereite Anleitungen hinzu, sodass Claude Code, Cursor, Codex und andere Tools diese Workflows mit größerer Zuverlässigkeit ausführen können.

Die Kombination aus einem zuverlässigen CLI und einer agentenbereiten Skill-Bibliothek bedeutet, dass die Bild-, Video-, Sprach- und Musikgenerierung im selben Workflow wie Ihr Code ablaufen kann – verwaltet von demselben Agenten, im selben Terminal, ohne die Tools zu wechseln.

Beginnen Sie mit einem einzigen Befehl. Bauen Sie von dort aus.

Für Teams, die vor der Kommandozeilenautomatisierung einen geführten Einstieg in der App bevorzugen, bietet PixVerse Agent einen agentenorientierten Kreativ-Workflow in der PixVerse App.