JCS Studio

Seu Carrinho (0)

Seu carrinho está vazio.

Subtotal $0.00

LTX-2.5: vídeo por IA local, rápido... sem atalhos

LTX-2.5: vídeo por IA local, rápido... sem atalhos

Publicado em 18/08/2026 11:40 | Categorias: Artigos

O LTX-2.5 chega numa fase em que a geração de vídeo por IA está dividida entre serviços fechados, caros, dependentes de crédito, e, por outro lado, modelos que se podem descarregar mas exigem uma máquina pouco comum. A proposta da LTX é disponibilizar pesos abertos, permitir execução local e manter uma via de afinação para quem trabalha com dados próprios. Trata-se de proposta interessante, embora não transforme uma GPU doméstica modesta numa ilha de pós-produção.

Uma alteração técnica relevante chama-se Diffusion Fidelity Rendering. Em vez de repartir o processamento da mesma forma por todos os instantes de um plano, o sistema reserva mais atenção para movimento, textura e composição onde a cena é mais exigente. A estrutura é criada num espaço latente comprimido, com fotogramas-chave de maior fidelidade, e uma fase posterior trata do detalhe final. É uma solução pensada para reduzir a degradação habitual em rostos, materiais e movimento rápido.

Há também um novo descodificador de vídeo, um codificador de texto Gemma 4 de 12 mil milhões de parâmetros ajustado para LTX e previsão automática de duração. A combinação não garante que qualquer instrução complexa seja obedecida sem falhas mas indica que o modelo passou a ter ferramentas mais adequadas para cenas com vários sujeitos, ações, luz e direção de câmara.

Outro ponto interessante é o multi-shot nativo. O LTX-2.5 pode criar cortes ligados numa única geração e procurar preservar personagem, cenário, iluminação, voz e estilo entre os planos. Para pequenos anúncios, maquetas de narrativa ou pré-visualização, isto vale mais do que uma sucessão de clips isolados que depois tentam parecer da mesma produção.

O modelo suporta texto-para-vídeo, imagem-para-vídeo e transição entre primeiro e último fotograma. A documentação do ComfyUI já disponibiliza também fluxos nativos para estas três utilizações, com áudio sincronizado. Esta interface é útil porque torna repetível uma cadeia que, de outro modo, exige escolher componentes, caminhos e parâmetros à mão.

Convém separar capacidade técnica de promessa publicitária. A LTX anuncia 4K HDR, RAW e até 50 fotogramas por segundo, no entanto o modo Fast alojado no ComfyUI limita clips acima de dez segundos a 720p ou 1080p e a 24 ou 25 fps. Note-se que os 6,8 segundos para um clip de dez segundos foram medidos pela própria empresa em duas GPUs GB200, a 720p e em regime estabilizado... não são pois uma estimativa muito honesta para uma placa gráfica de consumo doméstico.

O requisito mínimo é de 16 GB de VRAM e deve ser lido como ponto de entrada, não como recomendação de conforto. O pacote oficial destilado em bf16 indicado no início rápido ocupa cerca de 66 GiB quando se descarregam os componentes necessários (pois.. isso mesmo..).  Há no entanto quantizações de FP8, offload para CPU ou disco e variantes próprias para ComfyUI que reduzem a pressão de memória, mas esses compromissos afetam obviamente velocidade, qualidade ou ambos (este último mais usualmente).

Também é imprudente prometer compatibilidade automática com qualquer LoRA anterior. A própria página do modelo afirma que a grande maioria dos LoRAs e IC-LoRAs treinados para LTX-2.3 funciona no LTX-2.5, mas admite excepções e recomenda validação antes de uso em produção.

A instalação local não é também uma coisa simples de apenas descarregar um ficheiro. Os pesos estão num repositório com acesso condicionado no Hugging Face: é preciso aceitar os termos e ter a conta autorizada. Depois, no ComfyUI, os ficheiros são distribuídos por modelos de difusão, codificadores de texto, VAE e upscaler; Aqui uma versão desatualizada da aplicação pode nem mostrar os fluxos oficiais... há que ter isso em atenção para não desesperar na instalação.

MAS... os primeiros sinais da comunidade são promissores embora mostrem as fricções normais de uma estreia.. no entanto, nada de muito significativo. Temos de ter sempre em mente que “aberto” não quer dizer “sem manutenção”. ^_^

No final do dia, o LTX-2.5 merece atenção por dar a equipas e criadores uma alternativa que podem alojar, adaptar e integrar sem ficarem presos a uma única API ou sistema fechado. A rapidez pelo seu lado, será uma vantagem real onde exista hardware adequado... já para os restantes, a leitura certa não é “vídeo 4K ilimitado de graça”, mas sim uma base aberta poderosa, ainda exigente e finalmente madura o suficiente para justificar testes sérios.

Novidades no Blog

Inspiração, novidades e ideias da JCS Studio.

Gemini Omni 1.1 Flash
Imagem gerada por I.A.
Link Externo

Gemini Omni 1.1 Flash

Publicado em 31/08/2026 11:10

Gemini Omni 1.1 Flash é o novo modelo de geração de vídeo da Google orientado para produção, capaz de prolongar cenas até 40 segundos, criar transições entre frames definidos, acelerar protótipos em 360p e produzir resultados finais até 4K.

Visitar Link
VoiceMem - Memória para agentes de voz que combina factos, entidades e conhecimento com emoções
Imagem gerada por I.A.
Link Externo

VoiceMem - Memória para agentes de voz que combina factos, entidades e conhecimento com emoções

Publicado em 31/08/2026 11:02

VoiceMem é um sistema de memória para agentes de voz que combina factos, entidades e conhecimento com emoções, preferências e personalidade, permitindo que a IA reconheça o utilizador e recupere memórias relevantes em tempo real durante a própria conversa.

Visitar Link
Code World Model - A lógica no mundo virtual
Imagem gerada por I.A.
Link Externo

Code World Model - A lógica no mundo virtual

Publicado em 31/08/2026 10:58

Code World Model é uma abordagem de IA que usa um agente de programação como “cérebro” de mundos virtuais, mantendo estados, regras e consequências persistentes através de código executável, enquanto um modelo de vídeo transforma essa estrutura em ambientes visuais coerentes e dinâmicos.

Visitar Link
GLM-5.3-Flash confirma a pista de Ox Alpha e aperta o cerco aos modelos de fronteira
Imagem gerada por I.A.

GLM-5.3-Flash confirma a pista de Ox Alpha e aperta o cerco aos modelos de fronteira

Publicado em 31/08/2026 10:55

Bom... parece que o enigmático Ox Alpha que apareceu no OpenRouter deixou de ser apenas uma pista. A confirmação chegou:...

Ler Mais
FixAnything - Um sistema de IA que corrige artefactos e falhas em renderizações 3D
Imagem gerada por I.A.
Link Externo

FixAnything - Um sistema de IA que corrige artefactos e falhas em renderizações 3D

Publicado em 31/08/2026 10:05

FixAnything é um sistema de IA que corrige artefactos e falhas em renderizações 3D de diferentes representações (como NeRF, Gaussian Splatting, malhas ou nuvens de pontos) usando modelos generativos de vídeo para recuperar resultados visualmente mais limpos e geometricamente consistentes.

Visitar Link
Block3D - Um novo método de IA para gerar modelos 3D a partir de texto de forma rápida e eficiente
Imagem gerada por I.A.
Link Externo

Block3D - Um novo método de IA para gerar modelos 3D a partir de texto de forma rápida e eficiente

Publicado em 31/08/2026 09:55

Block3D é um novo método de IA para gerar modelos 3D a partir de texto de forma rápida e eficiente, combinando difusão por blocos com mecanismos de correção para preservar a qualidade geométrica.

Visitar Link
OVOW - (One Video, One World) - Vídeo convencional em cena 4D estruturada
Imagem gerada por I.A.
Link Externo

OVOW - (One Video, One World) - Vídeo convencional em cena 4D estruturada

Publicado em 31/08/2026 09:00

OVOW (One Video, One World) é um sistema de IA capaz de transformar um único vídeo convencional numa cena 4D estruturada, reconstruindo objetos, movimentos, deformações e relações físicas em modelos 3D prontos para simulação.

Visitar Link
A Guerra de Tokens: Como Open Source Está a Ganhar Volume mas Anthropic Domina os Lucros
Imagem gerada por I.A.

A Guerra de Tokens: Como Open Source Está a Ganhar Volume mas Anthropic Domina os Lucros

Publicado em 28/08/2026 12:05

Os últimos meses marcaram uma mudança que embora silenciosa é profunda! Durante anos, a narrativa foi dominada quase exclusivamente pelos...

Ler Mais

Abaixo encontra uma pequena lista de artigos relacionados com este tema..