Hank Green admite vício em IA e reduz produção de vídeos no YouTube
O YouTuber Hank Green pediu desculpas pelo uso inadequado do ChatGPT na produção do canal Complexly e anunciou redução no ritmo de publicações.
Seedance 2.5 gera vídeos de 30 segundos com áudio sincronizado, suporta 50 arquivos de referência multimodal e traz controle por carimbo de data e hora.
A ByteDance oficializou o lançamento do Seedance 2.5, seu novo modelo de inteligência artificial focado na criação de conteúdo audiovisual integrado. A ferramenta já está disponível nas plataformas chinesas Jimeng AI e Doubao Pro, trazendo a capacidade inédita de gerar clipes de até 30 segundos de duração em uma única passagem (single pass), acompanhados por faixas de áudio nativas e sincronizadas. O modelo substitui a geração isolada de trechos curtos por uma arquitetura multimodal unificada capaz de entregar obras narrativas completas, desde a fase de introdução até o clímax visual.
Evolução direta do modelo Seedance 2.0, que limitava a criação inicial a sequências de 15 segundos, o Seedance 2.5 foca no desenvolvimento de narrativas longas e no controle rigoroso do usuário sobre o resultado final. A nova versão foi projetada sobre uma arquitetura conjunta de geração áudio-vídeo, permitindo que a inteligência artificial organize internamente a progressão dramática do vídeo — articulando montagem, desenvolvimento, pontos de virada e resolução em um único arquivo de saída. Com isso, os criadores conseguem produzir histórias complexas reduzindo a necessidade de softwares externos de edição.
Além da ampliação no tempo do primeiro render, o Seedance 2.5 implementou a funcionalidade de extensões em múltiplas rodadas (multi-round extensions). Essa tecnologia permite anexa sequências adicionais a um clipe existente sem perder a coerência entre os elementos em cena. Durante o processo de extensão narrativa, o modelo preserva as características físicas dos personagens principais, os cenários de fundo e o ritmo da linguagem audiovisual, viabilizando a entrega de vídeos finais com vários minutos de duração sem quebras bruscas de transição de câmera.
A capacidade de estruturar narrativas longas em uma só etapa é demonstrada em prompts complexos de texto para vídeo (T2V). Em um dos exemplos técnicos divulgados, o modelo processa uma cena de tomada contínua com suporte de estabilizador gimbal portátil. A câmera inicia a gravação atravessando uma fenda em uma cortina vermelha pesada para entrar no camarim iluminado em tons quentes. No local, uma jovem cantora ajusta seu fone de ouvido enquanto um membro da equipe lembra que é hora de subir ao palco, momento em que a personagem se vira para a câmera e começa a cantar uma faixa de estilo citypop.
Na mesma sequência sem cortes do Seedance 2.5, a câmera recua e acompanha a artista através de um corredor de bastidores com iluminação suave. Durante o percurso, a personagem interage com seus dançarinos e recebe um microfone das mãos de um assistente de produção. Ao saírem do corredor, a cantora e o corpo de baile entram na estrutura do palco. A câmera realiza um arco em torno das costas dos artistas, revelando progressivamente o design cenográfico nas cores preta e vermelha, telas de LED, refletores de iluminação, fumaça cênica e o piso reflexivo da arena.
O clímax do teste visual do Seedance 2.5 se encerra com um recuo de câmera para um plano geral (wide shot) que exibe a arena lotada, placas luminosas, bastões de luz e o público aplaudindo. Todo o processamento de iluminação de palco, sincronia labial do estilo citypop e física da fumaça ocorre em uma única passagem de renderização de 30 segundos, eliminando os erros clássicos de interpolação encontrados em modelos anteriores de vídeo sintético.
Para atender demandas de produção profissional, o Seedance 2.5 passou por uma reformulação na ingestão de materiais de entrada. O modelo agora aceita o carregamento simultâneo de até 30 imagens, 10 clipes de vídeo e 10 arquivos de áudio como referências em uma única solicitação. Essa expansão de dados permite que o algoritmo analise composição visual, estilos artísticos, atuações, adereços e vozes específicas, aplicando todos esses elementos ao produto final com rigor técnico.
Em sequências de extensão do tipo referência para vídeo (R2V), a consistência entre cortes é mantida através da leitura de tags diretas de identificação, como a referência a um clipe prévio denominado @Video 1. Em uma demonstração prática de extensão narrativa com o Seedance 2.5, o prompt instrui a continuidade de uma cena na qual um garoto corre pelo vagão de um metrô segurando uma bola de futebol. Quando o trem para e as portas se abrem, o garoto dispara para a plataforma enquanto o protagonista masculino corre em sua perseguição.
A cena gerada pelo Seedance 2.5 se estende pela plataforma até a área externa da rua, assustando pedestres e veículos pelo caminho, até o momento em que o homem alcança o jovem. A expressão do menino muda para uma feição entristecida, fazendo com que a raiva do protagonista desapareça gradualmente antes de afagar a cabeça da criança com um sorriso resignado. Durante toda a extensão de mais 30 segundos, o modelo mantém intactos os rostos, o vestuário e o comportamento físico dos atores pré-existentes.
A fidelidade física dos movimentos do Seedance 2.5 é visível em simulações complexas de figurino e artes cênicas, como na reconstituição de uma peça da Ópera de Pequim formatada no aspecto widescreen 16:9. Utilizando referências identificadas como @Image 1, @Image 2, @Image 3 e @Image 4, a inteligência artificial executa um giro circular de câmera ao redor do ator principal, acompanhando o movimento das mangas longas de tecido (water sleeves) sem quebrar o cálculo de física do ar.
Na cronologia exata desse teste de 20 segundos na Ópera de Pequim, o intervalo entre 0 e 5 segundos exibe um close-up do personagem Overlord de @Image 2, girando o torso enquanto as bandeiras presas às suas costas passam rente à lente da câmera, criando uma oclusão natural. Entre 6 e 10 segundos, a câmera contorna a personagem Consort Yu de @Image 1, acompanhando o momento em que ela desdobra o pulso, lança as teias de tecido e mantém a pose olhando lateralmente. Entre 11 e 20 segundos, um guerreiro de @Image 3 entra no enquadramento com um salto mortal (aerial flip) para iniciar um combate encenado.
A precisão cenográfica do Seedance 2.5 também é sustentada pelo recurso de referência por renderização em argila (clay render). Através deste fluxo de trabalho, os criadores podem importar modelos 3D sem textura (white models) para definir previamente a estrutura espacial de um ambiente, as poses dos personagens, as trajetórias de movimento e a marcação de cena (blocking). O modelo de inteligência artificial utiliza essa malha volumétrica como guia geométrico rígido para renderizar a iluminação e a textura final sobre o modelo geométrico.
Ao integrar as informações espaciais extraídas do arquivo clay render, o Seedance 2.5 calcula os parâmetros de iluminação física real, ajustando a direção da fonte de luz, a temperatura de cor, a intensidade do brilho e o ângulo de projeção das sombras na cena. Em um teste com temática de conto de fadas baseado na referência @Clay Render 1, o modelo acompanha o voo de criaturas místicas entre nuvens, um mergulho no oceano ao lado de raias gigantes e uma transição por um fenda espelhada no espaço-tempo até retornar ao quarto de uma criança, onde o pai fecha um livro de ilustrações no quadro final.
A fidelidade a orquestrações complexas pode ser observada no uso de 18 imagens de referência simultâneas para a criação de um concerto clássico em ambiente 16:9. A renderização utiliza a referência @Image 1 para o auditório, @Image 2 para o pianista, @Image 3 para o violoncelo, @Image 4 para o violino, @Image 5 para a cantora principal, o grupo de @Images 6 a 10 para a orquestra, @Images 11 a 14 para o coral e @Images 15 a 18 para a plateia disposta nos assentos do teatro.
O modelo organiza a entrada de cada instrumento de acordo com a câmera: o plano geral do teatro se estreita quando o pianista toca as primeiras teclas, a cantora avança para a iluminação de destaque (spotlight), e a lente se desloca suavemente entre o tom brilhante do violino e a sonoridade quente do violoncelo. Na fase final da apresentação de 30 segundos gerada pelo Seedance 2.5, o coral se junta à música, a cantora troca olhares com os espectadores da primeira fileira e a câmera recua até o encerramento dos aplausos do público.
A otimização visual promovida pela ByteDance no Seedance 2.5 focou na diminuição de artefatos gráficos típicos de modelos generativos, como deformações no rosto humano ou inconsistências em padrões de texto. A engenharia do modelo aprimorou a renderização de textura de pele, traços oculares, níveis de saturação de cor e comportamento da iluminação do ambiente. Paralelamente, foram reduzidas as falhas indesejadas na geração automática de legendas e nas variações abruptas de música de fundo.
No campo da pós-produção integrada, o Seedance 2.5 introduziu ferramentas de edição com precisão ao nível de carimbo de data e hora (timestamp-level control). Essa funcionalidade possibilita a alteração direcionada de trechos específicos de áudio e vídeo sem a necessidade de reprocessar todo o arquivo. O usuário pode indicar o segundo exato em que uma ação deve ser modificada ou ajustar pontualmente o enquadramento de um personagem em um intervalo pré-determinado da linha do tempo.
O pacote de edição avançada do Seedance 2.5 inclui suporte nativo a operações de fundo transparente ou tela verde (green screen), manipulação de perspectiva de câmera e edições orientadas por imagens de referência. Tais recursos visam atender aos requisitos de consistência exigidos em setores como o cinema comercial, efeitos visuais (VFX) e publicidade, nos quais o alinhamento com storyboards e especificações de marca é obrigatório.
O ecossistema de distribuição do Seedance 2.5 foi estruturado para atender tanto usuários finais quanto desenvolvedores no mercado corporativo. O modelo já pode ser acessado na plataforma web do Jimeng AI (navegando pelo menu de Geração de Vídeo e selecionando a opção Seedance 2.5) e também dentro da interface do Doubao Pro. Toda a documentação e os exemplos de uso foram reunidos na página oficial do projeto hospedada no domínio seed.bytedance.com/seedance2_5.
Para a integração em fluxos de trabalho industriais, a ByteDance confirmou que a oferta de interface de programação de aplicações (API) do modelo será disponibilizada em breve por meio do serviço em nuvem BytePlus ModelArk. Com essa infraestrutura, produtoras de mídia e empresas de tecnologia poderão conectar a arquitetura multimodal de 30 segundos do modelo diretamente em suas ferramentas internas de edição e sistemas de automação de conteúdo.
Para profissionais e estúdios que atuam no mercado audiovisual e criativo do Brasil, o avanço representado pelo Seedance 2.5 simplifica etapas operacionais críticas. A convergência entre áudio nativo, controle por modelos 3D sem textura, aceitação de 50 arquivos de referência e comandos orientados por marcação de tempo reduz significativamente o custo computacional e as horas de renderização manual anteriormente exigidas na produção de conteúdos sintéticos de alta fidelidade.
Fontes:
O YouTuber Hank Green pediu desculpas pelo uso inadequado do ChatGPT na produção do canal Complexly e anunciou redução no ritmo de publicações.
Juiz Donovan Frank rejeita liminar da xAI e permite que lei de Minnesota contra deepfakes de nudificação entre em vigor em 1º de agosto de 2026.
CEO da OpenAI sugere criar podcasts diários com ChatGPT Work para a rotina escolar, mas enfrentou forte reação negativa na internet.