A ByteDance apresentou oficialmente o Seedance 2.5, sua nova geração de modelo de criação de vídeo. O anúncio, publicado em 31 de julho de 2026 no blog da equipe Seed, destaca uma mudança no que os usuários esperam: não basta gerar um clipe, é preciso completar uma obra criativa.
Segundo o seed.bytedance.com, o modelo mantém a arquitetura unificada de geração conjunta de áudio e vídeo do Seedance 2.0, mas agora foca em geração fundamental e geração baseada em referências. O resultado são avanços em narrativa longa, referência multimodal e edição.
Clipes de 30 segundos e extensão em múltiplas rodadas
O Seedance 2.5 consegue gerar clipes de áudio e vídeo de alta qualidade com até 30 segundos em uma única passada. Além disso, suporta múltiplas rodadas de extensão, permitindo que o usuário adicione novas cenas ao vídeo já existente.
A melhoria nas transições de cena e mudanças de plano garante maior continuidade em vídeos longos. A qualidade de imagem, áudio e movimento também teve ganhos notáveis, resultando em um visual mais natural e polido do que o comum em vídeos gerados por IA.
Com isso, é possível produzir conteúdo de vários minutos com linguagem audiovisual consistente, contando uma história completa em uma única tomada.
Referências multimodais aprimoradas
O modelo aceita até 30 imagens, 10 clipes de vídeo e 10 clipes de áudio como materiais de referência em uma única passada. Isso representa uma atualização completa em relação à versão anterior.
As capacidades de referência foram reforçadas, incluindo renderização em clay, movimento e referências criativas. O objetivo é que o modelo compreenda melhor a intenção do criador e realize ideias complexas que envolvam múltiplos sujeitos, cenas e mudanças de plano.
Edição mais precisa e estável
O Seedance 2.5 oferece controle em nível de timestamp para edição direcionada de áudio e vídeo. Isso melhora significativamente a eficiência e a controlabilidade do processo criativo.
Recursos avançados de edição, como tela verde, perspectiva de câmera e edição baseada em referência, também foram aprimorados. A ideia é atender às demandas rigorosas de campos profissionais e complexos, como cinema e publicidade.
Narrativa longa em uma única passada
A geração de vídeo em passada única foi estendida de 15 para 30 segundos. Dentro desse intervalo, o modelo organiza múltiplos planos logicamente conectados, permitindo que uma história se desenvolva com apresentação, desenvolvimento, ponto de virada e resolução.
Um exemplo citado pela equipe Seed é o de uma cantora em um show: o modelo retrata a interação com a equipe no camarim, a caminhada pelo corredor, o encontro com os dançarinos e a subida ao palco, em vez de apenas mostrar o momento da entrada.
A capacidade de extensão em múltiplas rodadas mantém a consistência dos personagens principais, ambientes e ritmo narrativo. Isso reduz o esforço de dividir clipes, remontar e corrigir transições.
Qualidade visual próxima do cinema
O modelo também ataca o aspecto artificial comum em vídeos gerados por IA. Texturas de objetos, características de pele e olhos, iluminação e saturação de cor foram sistematicamente otimizados.
Ocorrências não controladas em legendas e música de fundo foram minimizadas. O resultado final se aproxima da qualidade cinematográfica de filmagens reais.
Disponibilidade
O Seedance 2.5 já está disponível no Jimeng AI, no Doubao Pro e em outras plataformas. O acesso via API chegará em breve pelo BytePlus ModelArk.
A equipe Seed convida os usuários a testar o modelo e compartilhar feedback. A página do projeto está disponível no site oficial da Seed.