JCS Studio

Seu Carrinho (0)

Seu carrinho está vazio.

Subtotal $0.00

LTX-2.5: vídeo por IA local, rápido... sem atalhos

LTX-2.5: vídeo por IA local, rápido... sem atalhos

Publicado em 18/08/2026 11:40 | Categorias: Artigos

O LTX-2.5 chega numa fase em que a geração de vídeo por IA está dividida entre serviços fechados, caros, dependentes de crédito, e, por outro lado, modelos que se podem descarregar mas exigem uma máquina pouco comum. A proposta da LTX é disponibilizar pesos abertos, permitir execução local e manter uma via de afinação para quem trabalha com dados próprios. Trata-se de proposta interessante, embora não transforme uma GPU doméstica modesta numa ilha de pós-produção.

Uma alteração técnica relevante chama-se Diffusion Fidelity Rendering. Em vez de repartir o processamento da mesma forma por todos os instantes de um plano, o sistema reserva mais atenção para movimento, textura e composição onde a cena é mais exigente. A estrutura é criada num espaço latente comprimido, com fotogramas-chave de maior fidelidade, e uma fase posterior trata do detalhe final. É uma solução pensada para reduzir a degradação habitual em rostos, materiais e movimento rápido.

Há também um novo descodificador de vídeo, um codificador de texto Gemma 4 de 12 mil milhões de parâmetros ajustado para LTX e previsão automática de duração. A combinação não garante que qualquer instrução complexa seja obedecida sem falhas mas indica que o modelo passou a ter ferramentas mais adequadas para cenas com vários sujeitos, ações, luz e direção de câmara.

Outro ponto interessante é o multi-shot nativo. O LTX-2.5 pode criar cortes ligados numa única geração e procurar preservar personagem, cenário, iluminação, voz e estilo entre os planos. Para pequenos anúncios, maquetas de narrativa ou pré-visualização, isto vale mais do que uma sucessão de clips isolados que depois tentam parecer da mesma produção.

O modelo suporta texto-para-vídeo, imagem-para-vídeo e transição entre primeiro e último fotograma. A documentação do ComfyUI já disponibiliza também fluxos nativos para estas três utilizações, com áudio sincronizado. Esta interface é útil porque torna repetível uma cadeia que, de outro modo, exige escolher componentes, caminhos e parâmetros à mão.

Convém separar capacidade técnica de promessa publicitária. A LTX anuncia 4K HDR, RAW e até 50 fotogramas por segundo, no entanto o modo Fast alojado no ComfyUI limita clips acima de dez segundos a 720p ou 1080p e a 24 ou 25 fps. Note-se que os 6,8 segundos para um clip de dez segundos foram medidos pela própria empresa em duas GPUs GB200, a 720p e em regime estabilizado... não são pois uma estimativa muito honesta para uma placa gráfica de consumo doméstico.

O requisito mínimo é de 16 GB de VRAM e deve ser lido como ponto de entrada, não como recomendação de conforto. O pacote oficial destilado em bf16 indicado no início rápido ocupa cerca de 66 GiB quando se descarregam os componentes necessários (pois.. isso mesmo..).  Há no entanto quantizações de FP8, offload para CPU ou disco e variantes próprias para ComfyUI que reduzem a pressão de memória, mas esses compromissos afetam obviamente velocidade, qualidade ou ambos (este último mais usualmente).

Também é imprudente prometer compatibilidade automática com qualquer LoRA anterior. A própria página do modelo afirma que a grande maioria dos LoRAs e IC-LoRAs treinados para LTX-2.3 funciona no LTX-2.5, mas admite excepções e recomenda validação antes de uso em produção.

A instalação local não é também uma coisa simples de apenas descarregar um ficheiro. Os pesos estão num repositório com acesso condicionado no Hugging Face: é preciso aceitar os termos e ter a conta autorizada. Depois, no ComfyUI, os ficheiros são distribuídos por modelos de difusão, codificadores de texto, VAE e upscaler; Aqui uma versão desatualizada da aplicação pode nem mostrar os fluxos oficiais... há que ter isso em atenção para não desesperar na instalação.

MAS... os primeiros sinais da comunidade são promissores embora mostrem as fricções normais de uma estreia.. no entanto, nada de muito significativo. Temos de ter sempre em mente que “aberto” não quer dizer “sem manutenção”. ^_^

No final do dia, o LTX-2.5 merece atenção por dar a equipas e criadores uma alternativa que podem alojar, adaptar e integrar sem ficarem presos a uma única API ou sistema fechado. A rapidez pelo seu lado, será uma vantagem real onde exista hardware adequado... já para os restantes, a leitura certa não é “vídeo 4K ilimitado de graça”, mas sim uma base aberta poderosa, ainda exigente e finalmente madura o suficiente para justificar testes sérios.

Novidades no Blog

Inspiração, novidades e ideias da JCS Studio.

Intismeran e melanoma: o avanço da vacina de mRNA que exige entusiasmo com método
Imagem gerada por I.A.

Intismeran e melanoma: o avanço da vacina de mRNA que exige entusiasmo com método

Publicado em 23/08/2026 20:00

Alegadamente... há uma boa notícia na investigação do cancro, mas não estamos perante uma “cura descoberta por inteligência artificial”.. não...

Ler Mais
OpenAI abranda trabalho em Astra: segurança cibernética não confirma um “GPT-6 adiado”
Imagem gerada por I.A.

OpenAI abranda trabalho em Astra: segurança cibernética não confirma um “GPT-6 adiado”

Publicado em 23/08/2026 16:40

A OpenAI confirmou que abrandou temporariamente o desenvolvimento de modelos de fronteira enquanto reforça medidas de segurança relacionadas com capacidades...

Ler Mais
Ox Alpha: o que se sabe sobre o modelo anónimo — e o que continua a ser rumor
Imagem gerada por I.A.

Ox Alpha: o que se sabe sobre o modelo anónimo — e o que continua a ser rumor

Publicado em 23/08/2026 14:30

É... o Ox Alpha apareceu como um modelo anónimo em plataformas usadas por programadores e depressa gerou o habitual frenesim...

Ler Mais
Claude Academy: formação gratuita que começa pelaquilo que os modelos não sabem fazer
Imagem gerada por I.A.

Claude Academy: formação gratuita que começa pelaquilo que os modelos não sabem fazer

Publicado em 23/08/2026 12:15

A Claude Academy é a plataforma de aprendizagem da Anthropic para quem quer usar os seus produtos com mais método....

Ler Mais
Ornith-1.5: o modelo que cria o próprio currículo, mas ainda tem de provar serviço
Imagem gerada por I.A.

Ornith-1.5: o modelo que cria o próprio currículo, mas ainda tem de provar serviço

Publicado em 23/08/2026 12:00

O Ornith-1.5 chega com uma promessa que merece alguma atenção (ou muita), pois em vez de depender apenas de tarefas...

Ler Mais
GEN 1.5
Créditos de imagem : generalistai.com
Link Externo

GEN 1.5

Publicado em 23/08/2026 11:15

GEN-1.5 é um modelo fundacional para robótica capaz de aprender novas tarefas físicas em segundos a partir de uma única demonstração, sem treino adicional, além de generalizar, improvisar e utilizar ferramentas nunca vistas.

Visitar Link
Qwen-Video-Edit
Créditos de imagem : github.com/yunpeng1998
Link Externo

Qwen-Video-Edit

Publicado em 23/08/2026 11:00

Qwen-Video-Edit é um sistema de edição de vídeo por instruções de texto que adapta o modelo de edição de imagens Qwen-Image-Edit para modificar vídeos diretamente, sem necessitar de um transformer previamente treinado em vídeo

Visitar Link
Audio8 TTS Preview 0.1B
Créditos de imagem : Audio8
Link Externo

Audio8 TTS Preview 0.1B

Publicado em 23/08/2026 10:45

Audio8 TTS Preview 0.1B é um modelo compacto de síntese de voz com cerca de 170 milhões de parâmetros, capaz de gerar fala e clonar vozes em zero-shot a partir de uma amostra de áudio, com suporte principal para inglês e chinês e experimental para outras seis línguas.

Visitar Link

Abaixo encontra uma pequena lista de artigos relacionados com este tema..