Guia do Gemini Omni Flash: prompts, riscos, SynthID e fluxo com PixVerse

Aprenda o que o Gemini Omni Flash pode fazer, como experimentá-lo no PixVerse, como o SynthID funciona e como escrever prompts mais seguros para vídeos originais de IA.

Industry News
Guia do Gemini Omni Flash sobre prompts, riscos de segurança, SynthID, copyright e fluxo de trabalho com PixVerse

Gemini Omni Flash é agora o modelo de vídeo Gemini oficial do Google para criação de entradas mistas e edição de conversação. Anunciado durante o ciclo Google I/O 2026 em 19 de maio de 2026, ele pode trabalhar a partir de referências de texto, imagens, áudio e vídeo para produzir vídeo de alta resolução com áudio, e o Google agora expõe o modelo de visualização gemini-omni-flash-preview por meio da API Gemini.

Para criadores, a pergunta prática já não é apenas o que o Gemini Omni consegue gerar. A pergunta é se um clipe gerado pode ser publicado ou usado comercialmente com segurança. O Google afirma que vídeos do Omni incluem marca d’água digital SynthID, enquanto testes recentes da mídia mostram que prompts ainda podem empurrar o modelo para personagens altamente reconhecíveis em estilo de IP.

Atualização de julho de 2026: Gemini Omni Flash agora é um lançamento oficial do Google, sendo lançado por meio do aplicativo Gemini, Google Flow, YouTube Shorts Remix, YouTube Create e modelo de visualização da API Gemini gemini-omni-flash-preview. O Google afirma que os vídeos gerados pelo Omni incluem marca d’água digital SynthID e podem ser verificados por meio do aplicativo Gemini, Gemini no Chrome e Pesquisa. Ao mesmo tempo, os testes de junho de 2026 do TechRadar relataram que Gemini Omni poderia produzir vídeos semelhantes a personagens de super-heróis/IP conhecidos quando solicitado com cuidado. Isso não significa que os criadores possam publicar ou comercializar legalmente esses resultados. As verificações de direitos autorais, semelhança, marca registrada, música e regras da plataforma ainda são importantes.

Infográfico de análise do Gemini Omni Flash mostrando o lançamento do modelo de vídeo de IA do Google I/O 2026, entradas mistas, edição de bate-papo e acesso de visualização da API Gemini

O que o Google anunciou oficialmente

O anúncio oficial do Gemini Omni do Google transformou Omni de rumor em produto. O primeiro modelo é o Gemini Omni Flash, um modelo criativo da família Gemini que combina o raciocínio do Gemini com capacidades de mídia generativa. O resumo de anúncios do Google I/O 2026 também confirma as principais superfícies de lançamento e sinais de segurança.

O lançamento oficial responde às maiores questões do ciclo de vazamento anterior: Gemini Omni é a família de produtos, Gemini Omni Flash é o primeiro modelo e o foco inicial é vídeo com áudio de entradas de texto, imagem, áudio e vídeo. O Google está lançando por meio de Gemini, Flow, YouTube Shorts Remix, YouTube Create e o modelo de visualização da API Gemini gemini-omni-flash-preview. O Google diz que o acesso ao YouTube Shorts Remix e YouTube Create começa para usuários com mais de 18 anos sem nenhum custo, enquanto o aplicativo Gemini e o lançamento do Flow dependem do acesso à assinatura do Google AI.

O Google também afirma que vídeos criados com Omni incluem uma marca d’água digital SynthID imperceptível. Segundo o anúncio do I/O, usuários podem verificar conteúdo pelo Gemini app, Gemini in Chrome e Search. Para criadores e marcas, isso faz do Omni não apenas um modelo criativo, mas também uma questão de divulgação e procedência: clipes gerados podem precisar de rotulagem de IA, conformidade com plataformas e revisão editorial antes da publicação.

Isso muda a conclusão original do artigo. O enquadramento correto não é mais “Omni era um vazamento?”. O enquadramento útil é “o que criadores e equipes podem realmente fazer com o Gemini Omni Flash, e como ele deve entrar em um fluxo prático de vídeo com IA?”.

Google Gemini Omni Flash official release timeline from leak to Google I/O 2026 launch with AI video model access and developer API status

Gemini Omni Flash model card: capacidades e limites

A model card do Gemini Omni Flash traz o resumo técnico mais útil porque separa linguagem de produto de detalhes do modelo.

Gemini Omni Flash aceita strings de texto, imagens, áudio e arquivos de vídeo como entradas. A saída é vídeo em alta resolução com áudio. O Google descreve a arquitetura como baseada em Transformer, com suporte multimodal nativo para entradas de texto, visão, vídeo e áudio.

Para criadores, três fatos importam mais:

  1. Gemini Omni Flash foi criado para geração de vídeo com entradas mistas, não apenas texto para vídeo.
  2. A edição conversacional é central no fluxo de trabalho, não um recurso lateral.
  3. O Google reconhece que consistência entre edições, movimento complexo e renderização exata de texto ainda podem ser desafiadores.

A grande mudança de fluxo é que o Omni trata a criação de vídeo mais como uma conversa editável. Um criador pode gerar uma cena base e depois pedir mudanças de ângulo de câmera, estilo, objetos, ação ou referências sem reescrever todo o prompt. Imagens de referência, clipes, desenhos, áudio e texto também podem carregar mais direção criativa do que um prompt textual isolado.

O Google também posiciona Omni como um modelo capaz de usar o conhecimento de mundo do Gemini para contexto histórico, científico, cultural, físico e narrativo. Isso o torna interessante para vídeos explicativos e educação em redes sociais, não só para demos de efeitos visuais.

Os limites continuam importantes. Gemini Omni Flash é um lançamento relevante, mas não promete que todo prompt complexo sairá perfeitamente. A melhor forma de avaliá-lo ainda é rodar prompts controlados nas mesmas categorias: movimento de câmera, consistência de objetos, física, renderização de texto, sincronização de áudio, fidelidade a referências e estabilidade em edições de múltiplos turnos.

A model card do Google também importa para planejamento de segurança. Ela diz que a Generative AI Prohibited Use Policy do Google se aplica, descreve avaliações internas de segurança e red-team, e menciona SynthID como parte das mitigações para verificar conteúdo gerado por IA. Também diz que Omni é capaz de alterar a fala de pessoas como parte da edição de vídeo, mas essa capacidade está restrita por enquanto enquanto o Google estuda caminhos de lançamento mais seguros. É um sinal forte de que voz, imagem pessoal e conteúdo com pessoas editadas devem ser tratados com cautela.

A pergunta mais importante sobre Gemini Omni para criadores já não é apenas “ele consegue fazer um bom vídeo?”. É “posso publicar este vídeo com segurança, especialmente se ele se parecer com um personagem, ator, marca ou música conhecidos?”.

Em um teste de junho de 2026, o TechRadar relatou que Gemini Omni podia ser induzido a gerar vídeos muito parecidos com super-heróis e IPs de entretenimento conhecidos. Isso é um alerta útil para criadores, não uma permissão de publicação. Um modelo produzir uma saída não significa que o usuário tenha o direito legal de postar, monetizar, anunciar, vender ou remixar essa saída.

As áreas de risco são previsíveis: personagens protegidos por copyright, imagem de celebridades, logotipos de marcas, figurinos característicos, frases marcantes, música, imitação de voz e regras específicas de remix de cada plataforma. A posição deste artigo é simples: não use Gemini Omni, PixVerse ou qualquer modelo de vídeo com IA para copiar IP protegida. Use essas ferramentas para criar personagens originais, cenas originais, ideias de produto originais e alternativas criativas mais seguras.

Tipo de risco Direção de prompt de alto risco Direção mais segura Verificar antes de publicar
Personagem com copyright Gerar um super-herói famoso ou personagem de universo de cinema. Criar um herói original em uma cena de ação genérica. A saída copia aparência, logo, figurino ou frase marcante?
Imagem de celebridade Gerar um ator, músico, atleta ou influenciador específico. Usar uma pessoa fictícia com traços faciais e roupa originais. Você tem direitos de imagem, performance e uso?
Marca/logo Adicionar logo, mascote, embalagem ou interface de uma marca real. Usar elementos sem marca ou ativos próprios aprovados. Regras de marca, publicidade e trademark estão satisfeitas?
Música/áudio Imitar uma música, cantor, trilha, voz ou hook conhecido. Usar áudio original, licenciado ou royalty-free. Direitos de música, voz, sincronização e plataforma estão liberados?
YouTube Remix Transformar diretamente um Short em alta sem checar elegibilidade. Usar Shorts elegíveis e seguir regras de plataforma e rótulos de IA. O criador original permitiu, e o resultado precisa de divulgação de IA?

Isto não é aconselhamento jurídico. É uma regra prática de fluxo criativo: se o clipe depende de um personagem protegido reconhecível, da imagem de uma pessoa real, de um ativo de marca ou de uma assinatura sonora famosa, trate-o como alto risco até que alguém com os direitos ou o contexto legal adequado aprove.

Gemini Omni vs Veo: novo modelo ou substituto?

Gemini Omni não é simplesmente “Veo 4 com outro nome”. O Google agora apresenta Gemini Omni e Veo como superfícies de modelo separadas: Gemini Omni fica dentro de Gemini, enquanto Veo continua como a linha especializada de modelos de vídeo do Google.

A distinção prática fica assim:

Dimensão Gemini Omni Flash Veo
Posicionamento público Modelo criativo nativo de Gemini para criar e editar a partir de qualquer entrada, começando por vídeo Linha especializada do Google para geração de vídeo cinematográfico com áudio
Fluxo principal Criação e edição conversacional de vídeo Geração de vídeo por prompt e fluxos de vídeo do ecossistema Google
Ênfase de entrada Texto, imagem, áudio e referências de vídeo Geração baseada em texto e imagem, dependendo da superfície
Diferencial Edições em múltiplos turnos, referências, conhecimento de mundo e composição com entradas mistas Qualidade cinematográfica, áudio nativo e integrações existentes de API/produto
Status da API nesta atualização Modelo de visualização da API Gemini gemini-omni-flash-preview Superfícies de desenvolvedor para modelos Veo atuais já estão documentadas

Isso importa porque muitos criadores viam Omni como possível rebranding de Veo. O lançamento oficial aponta para uma resposta mais nuanceada: Omni é uma família criativa de Gemini que começa com vídeo, enquanto Veo continua como uma família dedicada de modelos de vídeo.

Para criadores, a pergunta útil não é qual nome vence. A pergunta útil é qual fluxo dá o melhor resultado para uma tomada específica.

Guia de prompts do Gemini Omni: como orientar o modelo

O guia de prompts do Gemini Omni do Google é útil porque mostra uma forma mais visual de escrever prompts. Prompts fortes não apenas nomeiam um sujeito. Eles dirigem a tomada como um pequeno briefing de produção.

Comece pelo enquadramento. Diga ao modelo se a cena deve ser um plano aberto, close-up, ângulo sobre o ombro, macro ou câmera fixa. Depois descreva o comportamento da câmera: push in, órbita, tilt up, dolly zoom, movimento handheld ou um plano contínuo.

Em seguida, dê à cena uma linguagem visual. Estilo, iluminação e local devem funcionar juntos. “Anúncio de produto fotorrealista com luz quente de luminária de mesa” dá um alvo mais claro do que “vídeo legal”. “Explicador em claymation sobre uma mesa escura” define tanto o meio quanto o ambiente.

Depois defina a ação. Quem se move? O que muda? O que precisa permanecer estável? Para vídeos com muito texto, especifique as palavras exatas, onde elas aparecem e se texto extra é permitido. Para áudio, diga se quer ambiente de sala, música, efeitos sonoros, batidas sincronizadas ou nenhuma música.

Para edições no Omni, mantenha a instrução cirúrgica. Um bom prompt de edição diz o que mudar e o que preservar: mesmo personagem, mesma sala, mesmo timing, mas um novo objeto, ângulo de câmera ou estilo. Isso importa porque Omni foi projetado para refinamento em múltiplos turnos.

Como escrever prompts mais seguros para Gemini Omni

Prompt seguro não significa vídeo sem graça. Significa dar uma direção criativa forte sem pedir ao modelo para clonar IP protegida, uma pessoa real ou um ativo de marca restrito.

Não escreva prompts que nomeiem personagens com copyright, universos cinematográficos, equipes de super-heróis, atores, músicos ou figurinos registrados. Evite pedir uma aparência “quase idêntica”, um logo famoso, uma combinação característica de cores e roupa, uma frase marcante, uma música conhecida ou o rosto ou voz de um artista real. Mesmo que o modelo aceite o prompt, a saída ainda pode ser arriscada para publicar ou comercializar.

Use descrições originais. Em vez de pedir um super-herói famoso, descreva um herói original com silhueta nova, figurino próprio e premissa de ação genérica. Em vez de nomear uma franquia de cinema, peça “comic-book energy”, “cinematic rescue scene”, “high-stakes city rooftop action” ou “stylized graphic-novel lighting”. Em vez de usar uma celebridade, descreva uma pessoa fictícia com faixa etária, humor, roupa e postura sem copiar um rosto identificável.

Quando tiver direitos sobre o material de origem, use suas próprias imagens, filmagens, ativos de produto, brand kit aprovado ou áudio licenciado como referências. Antes de uma publicação comercial, verifique regras de plataforma, licenças de ativos, direitos musicais, direitos de voz, autorização de imagem, uso de marcas e se o clipe precisa de divulgação de IA ou verificação SynthID.

Padrão de prompt mais seguro para Gemini Omni

Use esta estrutura quando quiser resultados fortes sem depender de IP protegida:

Create a 10-second original cinematic video. The subject is [original character/product/scene], not based on any existing franchise or real person. The action is [specific motion]. The camera does [specific camera move]. The visual style is [broad style or mood, not a named IP]. Use [lighting/location/materials]. Avoid logos, copyrighted characters, celebrity faces, exact brand colors, catchphrases, and music imitation. Use original audio or ambient sound only.

Três prompts que testaríamos primeiro

Esses prompts foram pensados como testes reais, não exemplos decorativos. Eles cobrem três ângulos: controle de câmera cinematográfica, saída explicativa com conhecimento de mundo e vídeo social sincronizado com texto. Também evitam IP nomeada, imagem de celebridade, logotipos de marcas e imitação musical. Teste no Gemini Omni Flash se sua conta Google tiver acesso. Você também pode adaptar os mesmos briefings criativos aos modelos de vídeo atualmente disponíveis no PixVerse para comparar movimento, estilo, áudio e tratamento de texto entre ferramentas.

Prompt 1: teste de câmera cinematográfica e consistência

Create a 10-second 16:9 cinematic video in one continuous shot. A young product designer sits at a small desk beside a rainy window, opens a sketchbook, and a compact silver drone design rises from the page as a realistic hologram. The camera starts as a close-up on the pencil tip, slowly pulls back to a medium shot, then gently orbits left as the hologram rotates above the page. Warm desk lamp light, cool blue rain outside, shallow depth of field, realistic hand motion, no subtitles, no logos, natural room ambience only.

Por que este prompt funciona: ele testa progressão de tomada, consistência de identidade, contraste de luz, estabilidade de objeto e se o modelo consegue manter a cena coerente sem cortar.

Prompt 2: teste explicativo com conhecimento de mundo

Create a 10-second educational explainer video about the difference between classical computing and quantum computing. Use a tactile stop-motion paper-craft style on a dark tabletop. Show a single classical bit as a small paper switch flipping between 0 and 1, then show a qubit as a glowing paper coin spinning with both states implied before measurement. Use clear visual metaphors, accurate motion, soft overhead light, no human hands, no voiceover, no on-screen text except the exact labels "bit" and "qubit" placed beside the objects.

Por que este prompt funciona: ele testa se o modelo consegue transformar um conceito em lógica visual, controlar pouco texto e evitar explicação excessiva por excesso de elementos.

Prompt 3: teste de texto e ritmo para vídeo social

Create a 9-second horizontal 16:9 social video for an AI video creation tip. A clean black studio background with a floating glass timeline interface stretched across the frame. Each word appears one at a time in perfect rhythm with soft electronic clicks: "prompt", "reference", "motion", "lighting", "sound". Each word has a different tasteful animation style, but the timeline and camera stay stable. End with all five words arranged as a neat widescreen checklist. High contrast, crisp typography, no extra words, no brand names.

Por que este prompt funciona: ele testa tipografia, timing, layout widescreen e se o modelo respeita restrições de texto exato.

O que vimos nos vídeos de teste

Não trataríamos esses três clipes como um benchmark completo, mas eles são testes de estresse úteis porque cada um pede algo diferente ao Gemini Omni Flash: continuidade cinematográfica, raciocínio conceitual e controle exato de texto.

Na cena cinematográfica da mesa, Omni lidou melhor com clima do que com mecânica. A janela chuvosa, a luz quente da luminária, o movimento do lápis, a profundidade de campo rasa e o enquadramento em close funcionam bem. O clipe parece polido e emocionalmente coerente, com mão, sketchbook e atmosfera de produção críveis. O ponto fraco é a conclusão do prompt: o desenho do drone aparece, mas o holograma prateado solicitado não vira o principal payoff visual. Isso mostra a força do Omni em textura cinematográfica e mood de cena, mas também indica que momentos complexos de revelação precisam de prompts mais precisos ou edições posteriores.

O explicador quântico é o teste mais bem-sucedido em termos lógicos. Os cartões bit e qubit são legíveis, o estilo de papel artesanal sobre a mesa combina com o prompt e a comparação é fácil de entender de relance. Omni faz um bom trabalho ao transformar um conceito abstrato em metáfora visual simples, exatamente onde geração de vídeo com conhecimento de mundo pode ser útil para educação e explicadores curtos. O principal problema é a aderência a restrições: o prompt pedia no human hands, mas uma mão aparece na cena. O conceito ainda funciona, mas é o tipo de detalhe que uma equipe de produção precisa detectar antes de publicar.

O clipe de texto e ritmo é o caso de limitação mais claro. A interface de timeline de vidro e a composição widescreen são elegantes, e o conceito de movimento é fácil de ler. Mas as palavras exatas falham: o modelo transforma a sequência pedida em texto distorcido ou repetido, incluindo fragmentos com erro. Para vídeos sociais, isso importa. Se a criação depende de tipografia exata, copy de checklist, texto de marca ou rótulos de UI, Omni ainda exige revisão cuidadosa e provavelmente várias passagens de edição.

Nos três testes, Omni parece mais forte quando o prompt descreve mood, linguagem de câmera, iluminação, materiais físicos, metáforas simples e atmosfera de cena. Ele é menos confiável quando a saída depende de texto exato, restrições negativas rígidas ou uma transformação muito específica no momento certo. Conclusão prática: use Omni primeiro para ideação visual, construção de cenas cinematográficas, conceitos educacionais e refinamentos conversacionais; use um ciclo de revisão mais rígido para tipografia, detalhes de produto, rótulos factuais e ativos comerciais finais.

Gemini Omni vs PixVerse: o que criadores podem usar hoje

Gemini Omni Flash agora está ativo nas superfícies do Google e disponível por meio da visualização da API Gemini. PixVerse está adicionando Gemini Omni Flash como modelo de vídeo na Web, aplicativo e Canvas, oferecendo aos criadores uma maneira prática de testar o modelo junto com outros fluxos de trabalho de vídeo PixVerse.

Na primeira integração do PixVerse, o escopo é mais restrito do que a API completa do Google. PixVerse suporta geração de texto para vídeo, imagem para vídeo e referência de imagem para Gemini Omni Flash. Os criadores podem gerar vídeos 720p de 3 a 10 segundos, escolher 16:9 ou 9:16 e guiar o áudio sincronizado por meio do prompt. O modo de referência suporta até cinco imagens JPEG ou PNG que podem ser citadas em prompts como @image1 a @image5.

A PixVerse não está tratando o Gemini Omni Flash como um substituto para seus modelos existentes. Ele fica ao lado do PixVerse V6, PixVerse C1, Seedance, Kling, Veo, Sora e outras opções de vídeo para que os criadores possam comparar o mesmo resumo em todos os fluxos de trabalho. Para esta primeira versão, edição de vídeo, extensão de vídeo, transição, referência de vídeo e referência de voz não fazem parte do fluxo de trabalho PixVerse Gemini Omni.

Para obter um fluxo de trabalho passo a passo, estrutura imediata e casos de uso práticos, consulte nosso guia sobre como usar o Gemini Omni Flash no PixVerse.

Esta não é uma afirmação de que um modelo substitui o outro. O fluxo de trabalho mais forte é manter um conjunto de testes imediato, executá-lo nas ferramentas disponíveis e comparar os resultados por caso de uso. Uma cena cinematográfica, um anúncio de produto, um curta social com muito texto e uma edição baseada em referências podem não ter o melhor desempenho no mesmo modelo. Para trabalhos comerciais, compare não apenas a qualidade visual, mas também a originalidade, o custo de revisão, os direitos dos ativos, a segurança da marca e a velocidade de iteração.

Criadores devem usar Gemini Omni Flash agora?

Use Gemini Omni Flash agora se sua conta tiver acesso e seu objetivo for testar edição conversacional de vídeo, referências mistas, fluxos do ecossistema Google ou ideação visual rápida. Ele é especialmente relevante para filmes conceituais, inspiração social, explicadores educacionais, demos visuais e testes não comerciais em que você possa revisar cada frame antes de publicar.

Tenha mais cautela com anúncios de marca, campanhas pagas, lançamentos comerciais, conteúdo de personagens próximo a IP, imagem de pessoas reais, vídeos com logos e clipes que dependem de música ou estilo de voz. Nesses casos, qualidade criativa é apenas uma parte da decisão. Você também precisa de direitos de ativos, conformidade com plataformas, divulgação de IA, verificação SynthID, autorização de imagem, liberação musical e um plano para remover qualquer semelhança acidental com obras protegidas.

Não presuma que todos os recursos da API do Google estão disponíveis em todas as superfícies de produtos. A API Gemini agora expõe gemini-omni-flash-preview, mas a primeira integração do PixVerse se concentra na geração e não na edição de vídeo. As equipes ainda devem verificar os IDs dos modelos, preços, cotas, regiões, termos da política, detalhes de revisão de conteúdo e disponibilidade do produto PixVerse antes de iniciar uma campanha de produção.

Para produção, mantenha um fluxo de trabalho multimodelo. Use o Gemini Omni onde você tiver acesso, incluindo o PixVerse quando seu atual T2V, I2V ou escopo de referência de imagem se adequar ao briefing, e compare-o com outros fluxos de trabalho de vídeo PixVerse para obter benchmarks de prompt originais e versões criativas alternativas. O fluxo de trabalho mais forte do criador não é “qual modelo é mais legal?” É “qual modelo pode criar o melhor clipe original que podemos realmente publicar?”

Perguntas frequentes

O que é Gemini Omni Flash?

Gemini Omni Flash é o primeiro modelo do Google na família Gemini Omni. Ele foi desenvolvido para criar e editar vídeo a partir de entradas mistas, como texto, imagens, áudio e vídeo. O cartão modelo do Google lista vídeo de alta resolução com áudio como saída.

Onde posso experimentar o Gemini Omni Flash?

O Google afirma que o Gemini Omni Flash está sendo lançado por meio do aplicativo Gemini e do Google Flow para assinantes do Google AI Plus, Pro e Ultra em todo o mundo. O Google também afirma que está disponível no YouTube Shorts Remix e no YouTube Create para usuários maiores de 18 anos sem nenhum custo, com disponibilidade ainda dependente do tempo de lançamento, conta, região e configurações da plataforma.

PixVerse também está adicionando Gemini Omni Flash às suas opções de modelo de vídeo na Web, aplicativo e Canvas. No PixVerse, o suporte atual se concentra na geração de texto para vídeo, imagem para vídeo e referência de imagem, em vez do fluxo de trabalho de edição completo.

O Gemini Omni é gratuito?

Parcialmente. O anúncio do Google I/O 2026 diz que o Gemini Omni está disponível gratuitamente no YouTube Shorts Remix e no YouTube Create para usuários qualificados com mais de 18 anos. O acesso ao aplicativo Gemini e ao Flow depende do nível de assinatura e implementação do Google AI. O acesso à API Gemini é um acesso de visualização pago e o PixVerse usa seu próprio plano e regras de crédito para geração no produto.

Gemini Omni é o mesmo que Veo?

Não. O Google apresenta Gemini Omni e Veo como superfícies de modelo separadas. Gemini Omni está posicionado em torno da criação e edição de conversação nativa do Gemini, enquanto Veo continua sendo a linha de modelos de vídeo especializada do Google.

O Gemini Omni pode editar vídeos existentes?

Sim nas superfícies Gemini do Google e na visualização da API. A edição de vídeo conversacional é um dos recursos centrais que o Google destaca. Na primeira integração Gemini Omni Flash do PixVerse, entretanto, Modify/edição de vídeo ainda não está incluído. PixVerse atualmente se concentra na geração de texto para vídeo, imagem para vídeo e referência de imagem para este modelo.

Quais entradas e saídas o Gemini Omni suporta?

O cartão modelo do Google lista sequências de texto, imagens, arquivos de áudio e vídeo como entradas. Ele descreve a saída como vídeo de alta qualidade e alta resolução com áudio. No primeiro lançamento do PixVerse, o suporte do Gemini Omni Flash é mais restrito: prompts de texto, imagem para vídeo e até cinco referências de imagem, com áudio sincronizado gerado a partir do prompt.

O que é SynthID nos vídeos do Gemini Omni?

SynthID é a tecnologia de marca d’água digital do Google para conteúdo gerado por IA. O Google afirma que os vídeos criados com Omni incluem uma marca d’água digital SynthID imperceptível e podem ser verificados por meio do aplicativo Gemini, Gemini no Chrome e Pesquisa.

O Gemini Omni pode gerar personagens protegidos por direitos autorais?

Os testes de mídia sugerem que o Gemini Omni pode ser direcionado para vídeos que se assemelham a personagens conhecidos ou IP de entretenimento. Isso não significa que os usuários possam publicar, monetizar ou anunciar legalmente esses resultados. Evite avisos que copiem personagens, logotipos, fantasias, frases de efeito, rostos de celebridades ou mundos de marcas protegidos.

Posso usar vídeos do Gemini Omni comercialmente?

Talvez, mas somente após verificações de direitos e plataforma. O uso comercial deve ser analisado quanto a direitos autorais, semelhança, marca registrada, direitos de música, direitos de voz, políticas da plataforma, divulgação de IA, verificação de SynthID e quaisquer termos de API ou produto do Google que se apliquem à sua conta e caso de uso.

Como posso escrever prompts Gemini Omni mais seguros?

Escreva personagens originais, cenas originais, ideias de produtos originais e orientações de estilo genéricas. Evite nomes de IP específicos, semelhanças com celebridades, logotipos de marcas reais, fantasias exclusivas, bordões, músicas famosas e avisos que solicitem uma cópia aproximada. Use referências próprias ou licenciadas quando tiver direitos.

Quais são as principais limitações do Gemini Omni Flash?

O Google lista a consistência completa por meio de edições, movimentos complexos e renderização de texto perfeitamente precisa como desafios. Nossos testes também mostraram que a tipografia exata e as restrições negativas estritas precisam de uma revisão cuidadosa. Os fluxos de trabalho comerciais devem adicionar revisão de direitos e revisão de segurança.

Existe uma API Gemini Omni?

Sim. O Google lista gemini-omni-flash-preview na API Gemini como um modelo de geração e edição de vídeo de visualização. É um acesso à API de nível pago, portanto as equipes ainda devem verificar preços, cotas, regiões, termos da política e limitações da superfície do produto antes de construir sistemas de produção.

Quando devo usar o Gemini Omni no PixVerse?

Use o Gemini Omni no PixVerse quando quiser testá-lo em um espaço de trabalho de vídeo de IA mais amplo, comparar o mesmo prompt com outros modelos PixVerse, gerar vídeos originais de 3 a 10 segundos ou usar até cinco referências de imagem para orientação de assunto ou estilo. Se sua tarefa exigir edição de vídeo, extensão, transição, referências de vídeo, referências de voz, 1080p ou 4K, use outro fluxo de trabalho ou aguarde um lançamento posterior do PixVerse.