JCS Studio

Seu Carrinho (0)

Seu carrinho está vazio.

Subtotal $0.00

A Guerra de Tokens: Como Open Source Está a Ganhar Volume mas Anthropic Domina os Lucros

A Guerra de Tokens: Como Open Source Está a Ganhar Volume mas Anthropic Domina os Lucros

Publicado em 28/08/2026 12:05 | Categorias: Artigos

Os últimos meses marcaram uma mudança que embora silenciosa é profunda! Durante anos, a narrativa foi dominada quase exclusivamente pelos grandes laboratórios norte-americanos, sobretudo OpenAI e Anthropic.. mas em 2026, porém, os dados começaram a contar outra história: os modelos de pesos abertos estão a conquistar uma fatia cada vez maior da utilização real. Segundo dados da Vercel (recolhidos através da sua infraestrutura de IA) o volume de tokens processados por estes modelos cresceu rapidamente entre junho e agosto, com a chinesa DeepSeek a ultrapassar a Anthropic e a assumir mais de um terço do tráfego registado na plataforma.

E isto explica-se essencialmente pelo preço... ora vejamos...
Apesar de processarem cada vez mais tokens, os modelos de pesos abertos representam apenas uma pequena parte do dinheiro movimentado. A Anthropic continua a concentrar mais de metade do gasto total registado pela Vercel, embora seja responsável por cerca de 30% dos tokens processados. A diferença está nas tarifas: o DeepSeek V4 Flash cobra cerca de 14 cêntimos de dólar por milhão de tokens de entrada e 28 cêntimos por milhão de saída, enquanto modelos premium da Anthropic podem custar dezenas de dólares pelo mesmo volume. O resultado é um mercado aparentemente contraditório, em que os modelos baratos dominam a utilização, mas os modelos de fronteira continuam a dominar a receita.

Para a DeepSeek, esta diferença parece fazer parte de uma estratégia deliberada... ou seja, competir através de escala e não de margem. Dados da OpenRouter indicam que o V4 Flash processa cerca de 5,3 biliões de tokens por semana, mais do dobro de alguns dos modelos premium mais utilizados da Anthropic. O preço por token é, contudo, drasticamente inferior. Esta combinação permite aos modelos chineses entrarem em aplicações onde o custo da inferência é determinante, especialmente em sistemas que processam enormes volumes de informação. Ao mesmo tempo, empresas como OpenAI e Anthropic continuam a beneficiar de clientes dispostos a pagar muito mais quando pequenas diferenças de desempenho, fiabilidade ou capacidade de raciocínio podem ter consequências económicas significativas.

A vantagem não se resume ao preço, portanto. Empresas podem alojar estes modelos na sua própria infraestrutura, fazer fine-tuning com dados internos e controlar de forma muito mais rigorosa aquilo que entra e sai dos sistemas. Plataformas empresariais, empresas tecnológicas e startups especializadas estão, por isso, a experimentar modelos como DeepSeek, Qwen e Kimi em tarefas que anteriormente seriam entregues quase automaticamente a APIs da OpenAI ou da Anthropic. Em determinados contextos, perder alguns pontos percentuais num benchmark pode ser perfeitamente aceitável se, em troca, o custo cair drasticamente e a empresa ganhar controlo sobre os seus próprios dados e infraestrutura. O fluxo de informação é MUITO importante!

Esta transformação tem, no entanto, uma dimensão geopolítica difícil de ignorar. Uma parte significativa dos modelos de pesos abertos mais competitivos está atualmente a surgir da China, através de laboratórios como DeepSeek, Alibaba, Z AI e Moonshot AI e a rápida renovação do mercado agrava essa tendência! Segundo a Vercel, uma grande parte dos tokens processados durante o verão passou por modelos que nem sequer estavam disponíveis na plataforma seis meses antes. Ao contrário de uma API fechada, porém, um modelo aberto pode ser descarregado, adaptado e executado praticamente em qualquer infraestrutura. Isso reduz a dependência direta do laboratório que o criou, mas aumenta a importância estratégica de quem controla os chips, os centros de dados, a energia e, cada vez mais, o próprio ecossistema de modelos que serve de base às aplicações empresariais.

Os grandes laboratórios norte-americanos já perceberam a ameaça e começaram a responder com reduções de preços e modelos mais eficientes. Mas aqui o verdadeiro confronto não será decidido apenas por benchmarks ou pelo número de tokens processado... é que se está a formare um mercado dividido: os modelos de fronteira continuam a cobrar um prémio pela melhor qualidade disponível em tarefas críticas, enquanto os modelos de pesos abertos conquistam rapidamente tudo aquilo onde custo, controlo e escala são mais importantes do que os últimos pontos percentuais de desempenho. A questão deixa, assim, de ser quem possui o modelo mais avançado... pois o verdadeiro vencedor poderá ser quem conseguir combinar capacidade, preço, controlo da infraestrutura e soberania tecnológica, as quatro vantagens que, por enquanto, nenhum dos lados consegue reunir sozinho.

Novidades no Blog

Inspiração, novidades e ideias da JCS Studio.

Gemini Omni 1.1 Flash
Imagem gerada por I.A.
Link Externo

Gemini Omni 1.1 Flash

Publicado em 31/08/2026 11:10

Gemini Omni 1.1 Flash é o novo modelo de geração de vídeo da Google orientado para produção, capaz de prolongar cenas até 40 segundos, criar transições entre frames definidos, acelerar protótipos em 360p e produzir resultados finais até 4K.

Visitar Link
VoiceMem - Memória para agentes de voz que combina factos, entidades e conhecimento com emoções
Imagem gerada por I.A.
Link Externo

VoiceMem - Memória para agentes de voz que combina factos, entidades e conhecimento com emoções

Publicado em 31/08/2026 11:02

VoiceMem é um sistema de memória para agentes de voz que combina factos, entidades e conhecimento com emoções, preferências e personalidade, permitindo que a IA reconheça o utilizador e recupere memórias relevantes em tempo real durante a própria conversa.

Visitar Link
Code World Model - A lógica no mundo virtual
Imagem gerada por I.A.
Link Externo

Code World Model - A lógica no mundo virtual

Publicado em 31/08/2026 10:58

Code World Model é uma abordagem de IA que usa um agente de programação como “cérebro” de mundos virtuais, mantendo estados, regras e consequências persistentes através de código executável, enquanto um modelo de vídeo transforma essa estrutura em ambientes visuais coerentes e dinâmicos.

Visitar Link
GLM-5.3-Flash confirma a pista de Ox Alpha e aperta o cerco aos modelos de fronteira
Imagem gerada por I.A.

GLM-5.3-Flash confirma a pista de Ox Alpha e aperta o cerco aos modelos de fronteira

Publicado em 31/08/2026 10:55

Bom... parece que o enigmático Ox Alpha que apareceu no OpenRouter deixou de ser apenas uma pista. A confirmação chegou:...

Ler Mais
FixAnything - Um sistema de IA que corrige artefactos e falhas em renderizações 3D
Imagem gerada por I.A.
Link Externo

FixAnything - Um sistema de IA que corrige artefactos e falhas em renderizações 3D

Publicado em 31/08/2026 10:05

FixAnything é um sistema de IA que corrige artefactos e falhas em renderizações 3D de diferentes representações (como NeRF, Gaussian Splatting, malhas ou nuvens de pontos) usando modelos generativos de vídeo para recuperar resultados visualmente mais limpos e geometricamente consistentes.

Visitar Link
Block3D - Um novo método de IA para gerar modelos 3D a partir de texto de forma rápida e eficiente
Imagem gerada por I.A.
Link Externo

Block3D - Um novo método de IA para gerar modelos 3D a partir de texto de forma rápida e eficiente

Publicado em 31/08/2026 09:55

Block3D é um novo método de IA para gerar modelos 3D a partir de texto de forma rápida e eficiente, combinando difusão por blocos com mecanismos de correção para preservar a qualidade geométrica.

Visitar Link
OVOW - (One Video, One World) - Vídeo convencional em cena 4D estruturada
Imagem gerada por I.A.
Link Externo

OVOW - (One Video, One World) - Vídeo convencional em cena 4D estruturada

Publicado em 31/08/2026 09:00

OVOW (One Video, One World) é um sistema de IA capaz de transformar um único vídeo convencional numa cena 4D estruturada, reconstruindo objetos, movimentos, deformações e relações físicas em modelos 3D prontos para simulação.

Visitar Link
Modelos de IA escapam de sandboxes e expõem falhas críticas na OpenAI e Hugging Face
Imagem gerada por I.A.
Link Externo

Modelos de IA escapam de sandboxes e expõem falhas críticas na OpenAI e Hugging Face

Publicado em 27/08/2026 12:30

A OpenAI revelou que, durante testes internos em julho de 2026, modelos experimentais contornaram sandboxes, comunicaram entre si e exploraram falhas que lhes deram acesso não autorizado a sistemas da OpenAI e da Hugging Face, levando a empresa a reforçar segurança, isolamento e monitorização de alinhamento. Este artigo é sobre isso!

Visitar Link

Abaixo encontra uma pequena lista de artigos relacionados com este tema..