PixVerse CLI: gere vídeos e imagens de IA no terminal

Instale o PixVerse CLI para gerar vídeos, imagens, voz e música de IA no terminal e automatizar fluxos de agentes com JSON.

Product Update
PixVerse CLI: gere vídeos e imagens de IA no terminal

Introdução

Todo fluxo de trabalho criativo tem um gargalo – o momento em que você precisa sair do editor de código, abrir um navegador e clicar manualmente em uma interface da web para gerar uma mídia. Para desenvolvedores, agentes de IA e qualquer pessoa que crie pipelines de conteúdo automatizados, essa mudança de contexto é um atrito que aumenta rapidamente.

PixVerse CLIelimina esse gargalo. É a interface de linha de comando oficial do PixVerse, dando a você acesso à geração do PixVerse e aos fluxos de trabalho do espaço de trabalho diretamente do seu terminal. Texto para vídeo, imagem para vídeo, texto para imagem, imagem para imagem, transições, geração de voz, geração de música, vídeo de referência, controle de movimento, modelos, upscaling e gerenciamento de ativos são todos programáveis, canalizáveis ​​e disponíveis sem tocar em um navegador. Para o caminho de instalação mais curto e uma visão geral de configuração para agentes, comece pela página oficial do PixVerse CLI.

O que torna o PixVerse CLI particularmente útil é a sua filosofia de design: ele foi construído com agentes de IA em mente. Os comandos podem retornar JSON estruturado com --json ou -p, os códigos de saída são determinísticos e cada etapa do pipeline pode ser composta. Isso significa que você pode ensinar Claude Code, Cursor, Codex ou qualquer outro agente a gerar imagens, vídeos, voz e música em seu nome com menos transferências frágeis.

Este guia está alinhado com o PixVerseAI/cli GitHub README atual, seu manifesto de recursos público e a página de produto do PixVerse CLI, verificados em 13 de julho de 2026. O PixVerse CLI é atualizado continuamente pelo repositório do GitHub, portanto, os scripts de produção ainda devem verificar pixverse --version, pixverse create <mode> --help e pixverse update antes de uma execução em lote grande.

Pré-requisitos

Antes de começar, você precisa de:

  • Node.js 20 ou superior— verifique com node --version
  • Uma conta PixVerse— inscreva-se em pixverse.ai
  • Uma assinatura PixVerse ativa— o CLI usa o mesmo sistema de crédito do site; apenas usuários inscritos podem gerar conteúdo

PixVerse CLI não requer que nenhuma chave de API seja copiada manualmente. A autenticação é feita por meio de um fluxo OAuth baseado em navegador que armazena seu token localmente.

Etapa 1: Instale o CLI

Instale globalmente com npm:

npm install -g pixverse

Verifique a instalação:

pixverse --version

Se preferir não instalar globalmente, você também pode executar comandos via npx:

npx pixverse create video --prompt "A cat walking on Mars"

Etapa 2: autenticar

Execute o comando de login:

pixverse auth login

O CLI abre um navegador para autorização do dispositivo OAuth. Você também pode copiar o URL e finalizar a autorização de qualquer navegador em qualquer dispositivo, o que é útil para ambientes SSH e headless. Seu token é armazenado automaticamente em ~/.pixverse/ e é válido por 30 dias.

Para verificar se você está logado e verificar seus créditos disponíveis:

pixverse auth status pixverse account info pixverse account slots

O comando account info mostra seu nível de assinatura, créditos de espaço de trabalho e contexto de uso. pixverse account usage ajuda a revisar o consumo de crédito, enquanto pixverse account slots mostra os slots atuais de geração simultânea para trabalhos de imagem e vídeo. As sessões CLI são independentes das sessões da web/aplicativo PixVerse e você pode remover o token CLI armazenado com pixverse auth logout. Sempre verifique seu saldo e vagas disponíveis antes de executar trabalhos em lote.

Comandos de início rápido

Se você precisar apenas do caminho mais curto desde a instalação até um ativo gerado, comece com esta sequência:

npm install -g pixverse
pixverse auth login
pixverse create image --prompt "A photorealistic forest path at golden hour" --json
pixverse create video --prompt "A sunset over ocean waves" --model v6 --quality 720p --duration 5 --json

Para fluxos de trabalho de agente e CI, mantenha --json ou -p ativado para que stdout permaneça legível por máquina enquanto o progresso e os erros permanecem em stderr. Para novas tentativas de produção, adicione --idempotency-key <key> aos comandos de criação para que envios repetidos não criem acidentalmente trabalhos cobrados duplicados.

Etapa 3: gere sua primeira imagem

A geração de texto para imagem é a maneira mais rápida de testar sua configuração. Execute:

pixverse create image --prompt "A photorealistic forest path at golden hour" --json

O GitHub README atual lista GPT Image 2 como modelo de imagem padrão. Para automações reproduzíveis, defina --model explicitamente e verifique a ajuda ao vivo do CLI ou capabilities.json antes do trabalho em lote. O sinalizador --json retorna uma saída estruturada:

{ "image_id": 789012, "status": "completed", "image_url": "https://...", "prompt": "A photorealistic forest path at golden hour", "model": "gpt-image-2.0", "width": 1440, "height": 1440 }

Para saída de resolução mais alta, especifique um modelo compatível:

pixverse create image \ --prompt "A photorealistic forest path at golden hour" \ --model seedream-5.0-lite \ --quality 2160p \ --aspect-ratio 16:9 \ --json

PixVerse suporta vários modelos de imagem, cada um com diferentes limites de resolução e suporte para proporção de aspecto:

Modelo --model value Qualidade Notas
GPT Image 2 gpt-image-2.0 1080p, 1440p, 2160p Modelo de imagem padrão; suporta proporções largas e altas
Nano Banana 2 gemini-3.1-flash 512p, 1080p, 1440p, 2160p auto flexível e proporções padrão
Nano Banana 2 Lite gemini-3.1-flash-lite 1080p Opção leve do Nano Banana 2 para fluxos de imagem rápidos
Qwen Image qwen-image 720p, 1080p Geração rápida para tarefas criativas comuns
Nano Banana Pro gemini-3.0 1080p, 1440p, 2160p Criação de imagens de alta qualidade em tamanhos maiores
Nano Banana gemini-2.5-flash 1080p Geração de imagens leves com retorno rápido
Seedream 5.0 Pro seedream-5.0-pro 1080p, 1440p Suporta proporções padrão e fluxos com múltiplas imagens de referência
Seedream 5.0 Lite seedream-5.0-lite 1440p, 1800p, 2160p Imagens criativas com alto detalhe
Seedream 4.5 seedream-4.5 1440p, 2160p Geração de imagens de alta resolução
Seedream 4.0 seedream-4.0 1080p, 1440p, 2160p Opção adicional do Seedream para fluxos de trabalho de imagens
Kling Image O3 kling-image-o3 1080p, 1440p, 2160p Resultados visuais estilizados com enquadramento flexível
Kling Image V3 kling-image-v3 1080p, 1440p Qualidade e velocidade equilibradas

Você também pode transformar uma imagem existente com imagem para imagem:

pixverse create image \ --prompt "Turn this product photo into a clean watercolor illustration" \ --image ./product-photo.png \ --model gpt-image-2.0 \ --json

Para baixar a imagem gerada:

pixverse asset download 789012

Etapa 4: gere seu primeiro vídeo

A conversão de texto para vídeo funciona da mesma maneira. Gere um clipe de 5 segundos:

pixverse create video --prompt "A sunset over ocean waves" --json

Para uma geração totalmente customizada:

pixverse create video \ --prompt "A cinematic drone shot over a misty mountain valley at dawn" \ --model v6 \ --quality 1080p \ --aspect-ratio 16:9 \ --duration 8 \ --audio \ --json

O sinalizador --audio permite som ambiente gerado por IA que corresponde ao conteúdo do seu vídeo. O sinalizador --json retorna um video_url na conclusão que você pode passar diretamente para um comando de download ou para a próxima etapa em um pipeline.

PixVerse fornece vários modelos de vídeo com diferentes qualidade, duração e suporte de modo:

Modelo --model value Qualidade máxima Duração Notas
PixVerse V6 v6 1080p 1–15 segundos Modelo de vídeo padrão; amplo suporte para proporção de aspecto
PixVerse C1 pixverse-c1 1080p 1–15 segundos Forte suporte para fluxos de trabalho de vídeo, referência e transição
Seedance 2.0 Standard seedance-2.0-standard 2160p 4–15 segundos Suporta modos de vídeo, referência e transição
Seedance 2.0 Fast seedance-2.0-fast 720p 4–15 segundos Opção Seedance mais rápida para modos de vídeo, referência e transição
Seedance 2.0 Mini seedance-2.0-mini 720p 4–15 segundos Opção Seedance leve para modos de vídeo, referência e transição
Google Gemini Omni gemini-omni-flash 720p 3–10 segundos Suporta fluxos de vídeo e referência em 16:9 ou 9:16
Happy Horse 1.0 happyhorse-1.0 1080p 3–15 segundos Opção de vídeo com reconhecimento de áudio disponível para create video
Kling O3 Pro kling-o3-pro 720p 3–15 segundos Suporta fluxos de trabalho de vídeo, referência e transição
Kling O3 Standard kling-o3-standard 720p 3–15 segundos Opção Kling O3 padrão
Kling 3.0 Pro kling-3.0-pro 720p 3–15 segundos Suporta fluxos de trabalho de vídeo e transição
Kling 3.0 Standard kling-3.0-standard 720p 3–15 segundos Opção Kling 3.0 padrão
Grok Imagine 1.5 grok-imagine-1.5 720p 1–15 segundos Apenas imagem para vídeo; requer --image e segue a proporção da imagem de entrada
Grok Imagine grok-imagine 720p 1–15 segundos Opção Grok anterior; suporta fluxos de trabalho de vídeo, extensão e referência
Veo 3.1 Lite veo-3.1-lite 1080p 4, 6 ou 8 segundos Suporta fluxos de trabalho de transição de vídeo e de 2 quadros
Veo 3.1 Standard veo-3.1-standard 2160p 4, 6 ou 8 segundos Opção Veo de alta resolução
Veo 3.1 Fast veo-3.1-fast 2160p 4, 6 ou 8 segundos Opção Veo mais rápida
Sora 2 Pro sora-2-pro 1080p 4, 8 ou 12 segundos Opção Sora de duração fixa
Sora 2 sora-2 720p 4, 8 ou 12 segundos Opção Sora padrão
PixVerse v5.6 v5.6 1080p 1–10 segundos Ainda usado para controle de movimento e fluxos de trabalho de geração selecionados
PixVerse v5.5 v5.5 1080p 1–10 segundos Usado para fluxos de trabalho create modify
PixVerse v5 v5 1080p 1–10 segundos Usado para fluxos de trabalho de transição de mais de 3 quadros

Animar uma imagem estática

Para transformar uma foto ou imagem gerada em um vídeo, forneça o sinalizador --image:

pixverse create video \ --prompt "Gentle wind moves through the scene" \ --image ./product-photo.jpg \ --model v6 \ --quality 1080p \ --json

Você pode passar um caminho de arquivo local ou uma URL. Os arquivos locais são carregados automaticamente – nenhuma etapa de upload manual é necessária. As entradas de imagens locais maiores que 1920x1920 ou 5MB são automaticamente redimensionadas ou compactadas antes do upload; URLs de imagens remotas são validados pelo back-end no estado em que se encontram.

Para Grok Imagine 1.5, é necessária uma imagem e a proporção de aspecto de saída segue essa imagem:

pixverse create video \ --prompt "Slow camera push-in, subtle fabric motion, clean native ambience" \ --image ./campaign-poster.png \ --model grok-imagine-1.5 \ --quality 720p \ --duration 6 \ --json

Use referência, transição, controle de movimento e modelos

O CLI atual suporta mais do que simples texto para vídeo e imagem para vídeo. Esses modos de criação são úteis quando você precisa de mais controle sobre caracteres, quadros-chave, edições ou efeitos:

# Create a transition between keyframes pixverse create transition --images ./frame1.png ./frame2.png # Gere áudio de fala a partir de texto pixverse create voice --text "Welcome to the launch" --voice-id <preset_voice_id> --output ./voiceover.mp3 # Gere música a partir de um prompt pixverse create music --prompt "A cinematic synth-pop intro with bright percussion" --auto-lyrics pixverse create music --prompt "Uplifting piano theme for a product reveal" --instrumental --duration-seconds 60 # Estender um vídeo gerado pixverse create extend --video <video_id> # Modificar um vídeo existente pixverse create modify --video <video_id> --prompt "Change the background to a beach" # Resolução de vídeo sofisticada pixverse create upscale --video <video_id> --quality 1080p # Gere vídeo com imagens de referência pixverse create reference --images ./char1.png ./char2.png --prompt "Two friends walking in a park" # A referência do Seedance 2.0 pode misturar entradas de imagem e vídeo pixverse create reference \ --model seedance-2.0-standard \ --images ./character.png \ --videos ./motion.mp4 \ --prompt "@image1 follows the motion in @video1" # Os modelos Seedance 2.0 suportam até 9 imagens de referência pixverse create reference \ --model seedance-2.0-standard \ --images ./char1.png ./char2.png ./char3.png ./char4.png \ --prompt "@image1 and @image2 walk through the scene together" # Controle de movimento com imagem de personagem e vídeo de referência de movimento pixverse create motion-control --image ./character.png --video ./dance.mp4 # Crie a partir de um modelo ou efeito pixverse create template --template-id 12345 --image ./photo.png

Nem todo modelo oferece suporte a todos os modos de criação. Na matriz README atual, create video suporta v6, pixverse-c1, Seedance 2.0 Standard/Fast/Mini, Google Gemini Omni, Happy Horse 1.0, Kling O3, Kling 3.0, Grok Imagine, Veo 3.1, Sora 2 e v5.6. grok-imagine-1.5 é apenas imagem para vídeo e requer --image; create extend suporta v6 e grok-imagine; create reference suporta v6, pixverse-c1, Seedance 2.0 Standard/Fast/Mini, Google Gemini Omni, Kling O3, grok-imagine e v5.6; As transições de 2 quadros suportam as famílias de vídeo mais recentes; Mais de 3 transições de quadro usam v5; create modify usa v5.5; e create motion-control usa v5.6.

Etapa 5: gerar voz e música

O GitHub README atual documenta áudio independente por meio de comandos de criação dedicados. Use create voice para conversão de texto em fala e create music para geração de prompt para música. As saídas de voz e música são salvas como recursos de áudio, para que você possa rastreá-las com task, listá-las com asset list --type audio e baixá-las com asset download --type audio. Para ambiente de vídeo nativo, use --audio ou --no-audio nos comandos de criação de vídeo suportados.

Gerar áudio de voz:

pixverse create voice \ --text "Welcome to the launch. Here is what changed this week." \ --model speech-2.8-hd \ --voice-id <preset_voice_id> \ --output ./voiceover.mp3 \ --json

Procure modelos de voz e vozes predefinidas:

pixverse voice models --json pixverse voice presets --model speech-2.8-hd --json

Gerar música:

pixverse create music \ --prompt "A bright cinematic synth-pop track for a 30-second product reveal" \ --auto-lyrics \ --duration-seconds 30 \ --json

Para faixas instrumentais, use --instrumental. Para modelos compatíveis com letras, passe as letras como texto literal, um caminho de arquivo local ou stdin:

pixverse create music \ --prompt "Uplifting electronic pop with a confident chorus" \ --lyrics ./lyrics.txt \ --json

As famílias atuais de modelos de voz incluem os modelos MiniMax Speech 2.8 e ElevenLabs. As famílias atuais de modelos musicais incluem MiniMax Music, ElevenLabs Music e Google Lyria 3 Pro. Use pixverse voice models e pixverse music models para o catálogo ativo antes de criar um script de fluxo de trabalho de produção.

Etapa 6: execute o assistente interativo

Se você está explorando pela primeira vez e ainda não está familiarizado com todos os sinalizadores disponíveis, execute qualquer comando de criação sem argumentos para entrar no assistente guiado:

pixverse create video pixverse create image

O assistente orienta você passo a passo sobre prompt, seleção de modelo, qualidade, proporção, duração e outras opções - útil para descobrir quais parâmetros estão disponíveis antes de criá-los.

Beyond Generation: gerencie seus ativos e espaço de trabalho

O PixVerse CLI atual também inclui comandos de gerenciamento que ajudam a construir fluxos de trabalho de terminal ponta a ponta:

  • pixverse task status <id> e pixverse task wait <id> para pesquisa de tarefas
  • pixverse task status --ids 123,456,789 --type video --json para verificações de status em lote
  • pixverse asset list, asset upload, asset info, asset download e asset delete para operações de ciclo de vida de ativos de vídeo, imagem e áudio
  • pixverse saved list, saved items, saved new, saved rename, saved add, saved remove e saved delete para pastas salvas
  • pixverse template categories, template list, template search e template info para descobrir efeitos e modelos
  • pixverse voice models, voice presets e music models para descoberta de modelos de áudio ao vivo
  • pixverse workspace list, workspace status, workspace switch e workspace manage para operações em vários espaços de trabalho
  • pixverse account info, account usage e account slots para verificações de crédito, uso e simultaneidade
  • pixverse config set, config list, config path e config defaults para padrões locais repetíveis

Isso torna simples automatizar não apenas a criação, mas também a organização, a descoberta de modelos, a descoberta de áudio, o download, o roteamento do espaço de trabalho e a entrega em um script. Se você precisar executar um comando em uma área de trabalho diferente, use o sinalizador global --workspace-id <id>; 0 é direcionado ao seu espaço de trabalho pessoal.

Sinalizadores compatíveis com script

A maior parte da automação depende de resultados previsíveis e de comportamento previsível em tempo de execução. Esses sinalizadores são especialmente úteis em scripts e fluxos de trabalho de agentes de IA:

Bandeira Use-o para
--json Retornar saída JSON estruturada
-p Apelido curto para --json
--count <n> Gere de 1 a 4 variações de uma solicitação
--seed <number> Tornar uma geração mais fácil de reproduzir
--off-peak Use preços fora do horário de pico, quando disponível
--audio / --no-audio Habilite ou desabilite a geração de áudio em comandos de criação suportados
--multi-shot / --no-multi-shot Ative ou desative o modo multi-shot para vídeo
--no-wait Envie o trabalho e retorne imediatamente
--timeout <sec> Defina o tempo limite da pesquisa, padrão para 300 segundos
--workspace-id <id> Substituir o espaço de trabalho ativo por um único comando
--trace-id <uuid> Anexe um UUIDv4 fornecido pelo chamador às solicitações de API para depuração e observabilidade
--idempotency-key <key> Tente novamente solicitações de criação com segurança sem criar acidentalmente trabalhos cobrados duplicados

Os sinalizadores de entrada de texto agora são mais fáceis de automatizar. --prompt, --text e --lyrics podem aceitar uma string literal, um caminho de arquivo local ou - para stdin:

pixverse create video --prompt ./scene.txt --json cat scene.txt | pixverse create image --prompt - --json echo "Hello from the command line" | pixverse create voice --text - --json pixverse create music --prompt "Bright synth-pop" --lyrics ./lyrics.txt --json

Ensinando seu agente de IA a gerar mídia

É aqui que PixVerse CLI se torna genuinamente transformador. Como os comandos podem retornar JSON estruturados e usar códigos de saída determinísticos, qualquer agente de IA que possa executar comandos shell pode ser ensinado a gerar imagens e vídeos sob demanda.

Instalando PixVerse Skills

PixVerse Skillsé uma biblioteca de habilidades estruturada que ensina aos agentes como usar o CLI corretamente: sinalizadores de comando, restrições de modelo, pipelines de várias etapas e tratamento robusto de erros.

Para Claude Code e outros agentes que suportam o formato de habilidades, adicione as habilidades PixVerse diretamente:

npx skills add https://github.com/pixverseai/skills --skill pixverse-ai-image-and-video-generator

Para Cursor, Claude Code, Codex e outras estruturas de agente, essa habilidade melhora a confiabilidade ao fornecer restrições explícitas ao agente em vez de forçá-lo a inferi-las do zero.

PixVerse CLI também fornece um manifesto de comando compacto legível por máquina em dist/capabilities.json, com a fonte pública disponível como capabilities.json no repositório GitHub. Este manifesto descreve comandos, sinalizadores, códigos de saída, expectativas de saída JSON e categorias de efeitos, para que os agentes possam inspecionar o contrato CLI sem extrair o texto de ajuda.

Depois que seu agente tiver as habilidades PixVerse carregadas, você poderá fornecer instruções em linguagem natural, como:

  • “Gere um vídeo de demonstração do produto de 10 segundos a partir desta captura de tela”
  • “Crie quatro variações desta imagem de capa de blog no formato 16:9”
  • “Anime este diagrama em um clipe explicativo de 5 segundos com som ambiente”
  • “Gere três clipes promocionais 16:9 de 8 segundos com diferentes movimentos de câmera”

O agente traduzirá essas instruções nos comandos CLI corretos, analisará a saída JSON e lidará com pesquisas e downloads – sem necessidade de intervenção manual.

Claude Code

No Claude Code, o PixVerse CLI se torna uma ferramenta nativa que o agente utiliza de forma autônoma. Depois de carregar as habilidades PixVerse, você pode incluir a geração de mídia diretamente em qualquer tarefa:

Generate a cover image for this blog post about machine learning, use the seedream-5.0-lite model at 2160p in 16:9 format, download it to ./assets/cover.webp

Claude Code invocará os comandos CLI corretos, analisará o URL da imagem da resposta JSON e fará download do arquivo para o caminho especificado - tudo dentro da mesma sessão onde também está escrevendo seu código.

Um fluxo de trabalho típico do Claude Code:

# Claude Code runs this autonomously based on your instruction IMG=$(pixverse create image \ --prompt "Abstract visualization of neural network layers, dark background, blue and purple tones" \ --model seedream-5.0-lite \ --quality 2160p \ --aspect-ratio 16:9 \ --json | jq -r '.image_url') # Então anima pixverse create video \ --prompt "Slow pan across glowing neural connections" \ --image "$IMG" \ --model v6 \ --quality 1080p \ --duration 6 \ --json

Cursor

Os usuários do Cursor podem carregar o PixVerse Skills como um arquivo de contexto do projeto. Coloque os arquivos de habilidades relevantes em seu diretório .cursor/ ou adicione-os às regras do seu espaço de trabalho. Uma vez carregado, o Cursor tem total conhecimento de cada comando do PixVerse CLI e pode gerar mídia como parte de qualquer tarefa de codificação.

Um fluxo de trabalho comum do Cursor: peça ao agente para gerar uma imagem de maquete com base em um design que você está construindo e, em seguida, use-a como referência diretamente em sua sessão IDE - sem sair do editor.

Codex e outros agentes

PixVerse CLI é compatível com qualquer agente que possa executar comandos shell e analisar JSON. O formato de saída estruturado — nomes de campos consistentes, códigos de erro previsíveis e mensagens de erro separadas por stderr — garante que até mesmo agentes de script simples possam integrar a geração de maneira confiável.

O contrato do código de saída simplifica o tratamento de erros:

Código Significado Ação do Agente
0 Sucesso Analisar saída JSON
1 Erro geral Verifique stderr e tente novamente com entradas validadas
2 Tempo limite Tente novamente com --timeout mais longo
3 Autenticação expirada Execute novamente o pixverse auth login
4 Fora dos créditos Verifique o saldo, notifique o usuário
5 Falha na geração Experimente parâmetros diferentes
6 Erro de validação Revise os valores do sinalizador

Pipelines de automação

Depois de entender os comandos individuais, o PixVerse CLI desbloqueia fluxos de trabalho poderosos de várias etapas que são executados inteiramente sem interação do usuário.

Texto para imagem e vídeo

Um dos pipelines mais úteis: gerar uma imagem de alta resolução a partir de um prompt de texto e depois animá-la em um vídeo.

# Step 1: Generate a base image IMG_RESULT=$(pixverse create image \ --prompt "A cyberpunk cityscape at night, neon lights reflecting on wet pavement" \ --model gemini-3.1-flash \ --quality 2160p \ --aspect-ratio 16:9 \ --json) IMAGE_URL=$(echo "$IMG_RESULT" | jq -r '.image_url') # Etapa 2: anime-o em um vídeo VID_RESULT=$(pixverse create video \ --prompt "Camera slowly pans across the neon-lit streets" \ --image "$IMAGE_URL" \ --model v6 \ --quality 1080p \ --duration 8 \ --json) VIDEO_ID=$(echo "$VID_RESULT" | jq -r '.video_id') # Etapa 3: Baixe o vídeo final pixverse asset download "$VIDEO_ID" --json

Pipeline completo de produção de vídeo

Para uma saída refinada, criação de cadeia com etapas de pós-processamento. Use --audio ou --no-audio quando desejar som nativo em comandos de criação de vídeo suportados e, em seguida, use create voice para áudio de conversão de texto em fala e create music para recursos de música independentes que você combinará no downstream:

# Step 1: Create the base video RESULT=$(pixverse create video \ --prompt "A product being assembled in slow motion" \ --model v6 \ --quality 720p \ --duration 5 \ --audio \ --json) VID=$(echo "$RESULT" | jq -r '.video_id') # Etapa 2: Prolongue a duração EXTENDED=$(pixverse create extend \ --video "$VID" \ --json | jq -r '.video_id') pixverse task wait "$EXTENDED" --json # Etapa 3: fazer upgrade para 1080p FINAL=$(pixverse create upscale \ --video "$EXTENDED" \ --quality 1080p \ --json | jq -r '.video_id') pixverse task wait "$FINAL" --json # Etapa 4: baixar pixverse asset download "$FINAL" --json # Opcional: crie um recurso de narração separado pixverse create voice \ --text "The final reveal starts now." \ --voice-id <preset_voice_id> \ --output ./voiceover.mp3 \ --json

Geração de lote

Para pipelines de conteúdo que exigem diversas variações, execute jobs em paralelo:

# Check credits and concurrent generation slots first pixverse account info --json pixverse account slots --json # Envie quatro gerações paralelas pixverse create video --prompt "Sunrise over mountains" --no-wait --json > /tmp/v1.json & pixverse create video --prompt "Sunset over ocean" --no-wait --json > /tmp/v2.json & pixverse create video --prompt "Stars over a desert" --no-wait --json > /tmp/v3.json & pixverse create video --prompt "Aurora over a frozen lake" --no-wait --json > /tmp/v4.json & wait # Verifique todos os IDs de tarefas retornados em uma chamada de status em lote IDS=$(jq -r '.video_id' /tmp/v1.json /tmp/v2.json /tmp/v3.json /tmp/v4.json | paste -sd, -) pixverse task status --ids "$IDS" --type video --json # Aguarde cada um e baixe for f in /tmp/v1.json /tmp/v2.json /tmp/v3.json /tmp/v4.json; do ID=$(jq -r '.video_id' "$f") pixverse task wait "$ID" --json pixverse asset download "$ID" --json done

O sinalizador --no-wait envia o trabalho e retorna imediatamente com um ID de tarefa, permitindo enviar vários trabalhos antes da sondagem. Com --no-wait --json, registre os IDs de tarefa retornados e os parâmetros de criação resolvidos para registro e reprodutibilidade. Use --count <n> quando desejar diversas variações de um prompt e use o lote task status --ids quando desejar uma resposta de status para vários trabalhos em execução. O comando pixverse task wait cuida da pesquisa adaptativa para você.

Configurando padrões

Se você usa consistentemente o mesmo modelo, qualidade ou proporção, defina-os como padrão para não precisar repetir sinalizadores todas as vezes:

pixverse config defaults set video model v6 pixverse config defaults set video quality 1080p pixverse config defaults set image model seedream-5.0-lite pixverse config set output-dir ~/Downloads/pixverse pixverse config defaults show pixverse config list pixverse config path

Os sinalizadores de linha de comando sempre substituem os padrões configurados, para que você mantenha total flexibilidade e reduza a repetição. Para automação específica do espaço de trabalho, adicione --workspace-id <id> a um comando quando quiser substituir o espaço de trabalho ativo para essa execução única.

O que você pode construir

Com o PixVerse CLI integrado ao fluxo de trabalho do seu agente, a gama de tarefas automatizáveis se expande consideravelmente:

  • Documentação— gere automaticamente vídeos de demonstração de produtos e capturas de tela como parte do processo de criação de seu documento
  • Marketing— execute trabalhos em lote noturnos que produzem variações de conteúdo de mídia social a partir de uma única biblioteca de prompts
  • Desenvolvimento de aplicativos: deixe seu agente de codificação gerar recursos visuais de espaço reservado, animações de maquete ou vídeos de tela de carregamento enquanto você cria a IU
  • Fluxos de trabalho de áudio— gere rascunhos de narração, faixas com prompt de música ou recursos de áudio para edição posterior
  • Pipelines de conteúdo— encadeie chamadas CLI com outras ferramentas (ffmpeg, ImageMagick, armazenamento em nuvem) para criar fluxos de trabalho de produção de mídia totalmente automatizados
  • Prototipagem— gere conceitos de movimento rápido em segundos para validar ideias antes de iniciar a produção completa

O CLI foi projetado para se adaptar naturalmente a qualquer fluxo de trabalho baseado em shell. Se sua automação existente for executada em bash, Python, Node ou em um pipeline de CI/CD, o PixVerse CLI se encaixa sem qualquer sobrecarga adicional de integração.

Lista de verificação de primeiros passos

  • Instale Node.js 20 ou superior
  • Execute npm install -g pixverse
  • Execute pixverse auth login e autorize no navegador
  • Execute pixverse account info para verificar os créditos
  • Execute pixverse account slots antes do trabalho em lote simultâneo
  • Gere sua primeira imagem: pixverse create image --prompt "..." --json
  • Gere seu primeiro vídeo: pixverse create video --prompt "..." --json
  • Gere seu primeiro ativo de voz: pixverse create voice --text "..." --json
  • Gere seu primeiro ativo musical: pixverse create music --prompt "..." --json
  • Explore modelos com pixverse template list
  • Instale PixVerse Skills para seu agente (Claude Code, Cursor ou Codex)
  • Configure seus padrões preferidos com pixverse config defaults set
  • Crie seu primeiro pipeline de automação

Mantendo o CLI atualizado

Use o atualizador integrado para manter seu CLI local atualizado:

pixverse update

Você também pode usar o npm diretamente:

npm install -g pixverse@latest

Como o PixVerse CLI é uma ferramenta atualizada ativamente, não um lançamento único, trate este artigo como um guia prático e as fontes oficiais como a camada de referência em tempo real. A página oficial do PixVerse CLI é o caminho mais curto para instalação e integração de agentes, enquanto o GitHub continua sendo o local para acompanhar mudanças de versão e modelos recém-suportados:

Os documentos atuais destacam PixVerse V6 como o modelo de vídeo padrão, GPT Image 2 como o modelo de imagem padrão, suporte de vídeo ao Google Gemini Omni, suporte de imagem ao Nano Banana 2 Lite e Seedream 5.0 Pro, suporte Seedance 2.0 Mini, fluxos de trabalho PixVerse v5 e v5.5 específicos do modo, comandos create voice e create music dedicados, gerenciamento de ativos de áudio, pastas salvas, alternância de espaço de trabalho, config defaults, capabilities.json para agentes, pixverse update, suporte stdin para entradas de texto, --trace-id e --idempotency-key para tentativas mais seguras.

Próximas etapas

A página oficial do PixVerse CLI, o PixVerse CLI em GitHub e npm (npm install -g pixverse) oferecem acesso imediato à geração, pesquisa de tarefas, gerenciamento de ativos, modelos, pastas salvas, verificações de contas, descoberta de modelo de áudio e controles de espaço de trabalho em uma única interface. O repositório PixVerse Skills adiciona orientação pronta para agente para que Claude Code, Cursor, Codex e outras ferramentas possam executar esses fluxos de trabalho com maior confiabilidade.

A combinação de um CLI confiável e uma biblioteca de habilidades pronta para agente significa que a geração de imagem, vídeo, voz e música pode funcionar no mesmo fluxo de trabalho que seu código – gerenciado pelo mesmo agente, no mesmo terminal, sem trocar de ferramentas.

Comece com um único comando. Construa a partir daí.

Para equipes que preferem um ponto de partida guiado no app antes da automação por linha de comando, o PixVerse Agent oferece um fluxo de criação orientado por agentes no app PixVerse.