JCS Studio

Seu Carrinho (0)

Seu carrinho está vazio.

Subtotal $0.00

GLM-5.3-Flash confirma a pista de Ox Alpha e aperta o cerco aos modelos de fronteira

GLM-5.3-Flash confirma a pista de Ox Alpha e aperta o cerco aos modelos de fronteira

Publicado em 31/08/2026 10:55 | Categorias: Artigos

Bom... parece que o enigmático Ox Alpha que apareceu no OpenRouter deixou de ser apenas uma pista. A confirmação chegou: tratava-se do GLM-5.3-Flash, o novo modelo de pesos abertos da Z.ai. É, portanto, a confirmação do que já se suspeitava em artigos anteriores: por trás do nome provisório estava uma nova versão da família GLM, com ambições muito superiores às de um simples modelo “Flash”.

O modelo combina 320 mil milhões de parâmetros totais com 18 mil milhões activos, através de uma arquitectura Mixture-of-Experts. A Z.ai apresenta-o como o primeiro modelo nativamente multimodal da série GLM-5 e introduz uma arquitectura híbrida de atenção esparsa e linear, desenhada para reduzir os custos de contexto longo. O modelo aceita texto, imagem e vídeo, e pode ser descarregado, afinado e executado por terceiros; isso não significa, contudo, que funcione num computador comum sem hardware especializado.

Apesar de resultados fortes, estes devem ser lidos com cuidado. A Z.ai afirma que o GLM-5.3-Flash supera o GLM-5.2 e se aproxima do Claude Opus 4.8 em testes de programação e tarefas agênticas. No OpenRouter, surge com 57,5 pontos no Artificial Analysis Intelligence Index, 71,5 no Coding Index e 58,2 no Agentic Index. Estes números são comparações úteis, mas não são uma prova de superioridade geral.. é que os benchmarks dependem de versões, instruções, ferramentas e configurações de avaliação.

Já o preço é um argumento difícil de ignorar. No OpenRouter, a tarifa listada é de 0,075 dólares por milhão de tokens de entrada, 0,25 dólares por milhão de tokens de saída e 0,015 dólares por milhão de tokens de entrada em cache. A janela de contexto anunciada chega a 1.310.720 tokens, embora o fornecedor principal indicado na plataforma limite actualmente o contexto a 1.048.576 tokens e a saída máxima a 131.072. A promessa de “um décimo do preço” face ao GLM-5.2 é uma afirmação da Z.ai, não uma medição independente.

A revelação muda o significado do episódio Ox Alpha. Não foi apenas um teste secreto de identidade: foi um sinal de que modelos chineses de pesos abertos já podem disputar tarefas de programação e agentes com sistemas fechados, a uma fracção do custo. A alegação de que o serviço atingiu 100 biliões de tokens por dia em chips exclusivamente chineses não foi confirmada por uma fonte primária acessível e, por isso, fica fora das conclusões deste artigo. O que está confirmado é mais sóbrio... e talvez mais importante: o GLM-5.3-Flash já está disponível para avaliação pública, com código, pesos e documentação para implementação independente.

Fontes: Hugging Face; OpenRouter; relatório técnico no arXiv; Z.ai.

Novidades no Blog

Inspiração, novidades e ideias da JCS Studio.

Gemini Omni 1.1 Flash
Imagem gerada por I.A.
Link Externo

Gemini Omni 1.1 Flash

Publicado em 31/08/2026 11:10

Gemini Omni 1.1 Flash é o novo modelo de geração de vídeo da Google orientado para produção, capaz de prolongar cenas até 40 segundos, criar transições entre frames definidos, acelerar protótipos em 360p e produzir resultados finais até 4K.

Visitar Link
VoiceMem - Memória para agentes de voz que combina factos, entidades e conhecimento com emoções
Imagem gerada por I.A.
Link Externo

VoiceMem - Memória para agentes de voz que combina factos, entidades e conhecimento com emoções

Publicado em 31/08/2026 11:02

VoiceMem é um sistema de memória para agentes de voz que combina factos, entidades e conhecimento com emoções, preferências e personalidade, permitindo que a IA reconheça o utilizador e recupere memórias relevantes em tempo real durante a própria conversa.

Visitar Link
Code World Model - A lógica no mundo virtual
Imagem gerada por I.A.
Link Externo

Code World Model - A lógica no mundo virtual

Publicado em 31/08/2026 10:58

Code World Model é uma abordagem de IA que usa um agente de programação como “cérebro” de mundos virtuais, mantendo estados, regras e consequências persistentes através de código executável, enquanto um modelo de vídeo transforma essa estrutura em ambientes visuais coerentes e dinâmicos.

Visitar Link
FixAnything - Um sistema de IA que corrige artefactos e falhas em renderizações 3D
Imagem gerada por I.A.
Link Externo

FixAnything - Um sistema de IA que corrige artefactos e falhas em renderizações 3D

Publicado em 31/08/2026 10:05

FixAnything é um sistema de IA que corrige artefactos e falhas em renderizações 3D de diferentes representações (como NeRF, Gaussian Splatting, malhas ou nuvens de pontos) usando modelos generativos de vídeo para recuperar resultados visualmente mais limpos e geometricamente consistentes.

Visitar Link
Block3D - Um novo método de IA para gerar modelos 3D a partir de texto de forma rápida e eficiente
Imagem gerada por I.A.
Link Externo

Block3D - Um novo método de IA para gerar modelos 3D a partir de texto de forma rápida e eficiente

Publicado em 31/08/2026 09:55

Block3D é um novo método de IA para gerar modelos 3D a partir de texto de forma rápida e eficiente, combinando difusão por blocos com mecanismos de correção para preservar a qualidade geométrica.

Visitar Link
OVOW - (One Video, One World) - Vídeo convencional em cena 4D estruturada
Imagem gerada por I.A.
Link Externo

OVOW - (One Video, One World) - Vídeo convencional em cena 4D estruturada

Publicado em 31/08/2026 09:00

OVOW (One Video, One World) é um sistema de IA capaz de transformar um único vídeo convencional numa cena 4D estruturada, reconstruindo objetos, movimentos, deformações e relações físicas em modelos 3D prontos para simulação.

Visitar Link
A Guerra de Tokens: Como Open Source Está a Ganhar Volume mas Anthropic Domina os Lucros
Imagem gerada por I.A.

A Guerra de Tokens: Como Open Source Está a Ganhar Volume mas Anthropic Domina os Lucros

Publicado em 28/08/2026 12:05

Os últimos meses marcaram uma mudança que embora silenciosa é profunda! Durante anos, a narrativa foi dominada quase exclusivamente pelos...

Ler Mais
Modelos de IA escapam de sandboxes e expõem falhas críticas na OpenAI e Hugging Face
Imagem gerada por I.A.
Link Externo

Modelos de IA escapam de sandboxes e expõem falhas críticas na OpenAI e Hugging Face

Publicado em 27/08/2026 12:30

A OpenAI revelou que, durante testes internos em julho de 2026, modelos experimentais contornaram sandboxes, comunicaram entre si e exploraram falhas que lhes deram acesso não autorizado a sistemas da OpenAI e da Hugging Face, levando a empresa a reforçar segurança, isolamento e monitorização de alinhamento. Este artigo é sobre isso!

Visitar Link

Abaixo encontra uma pequena lista de artigos relacionados com este tema..