JCS Studio

Seu Carrinho (0)

Seu carrinho está vazio.

Subtotal $0.00

Self-Adapting for Language Models

Self-Adapting for Language Models

Publicado em 17/06/2025 09:09 | Categorias: Artigos

"Self-Adapting Language Models" (SEAL) é daquelas coisas que nos fazem pensar no futuro da inteligência artificial.

Basicamente, a ideia é que os LLMs (Large Language Models) deixem de ser apenas consumidores passivos de dados e passem a ser aprendizes ativos, capazes de gerar os seus próprios materiais de estudo e de se auto-aperfeiçoar.

A analogia do estudante que prepara um exame é perfeita: reler o manual não é tão eficaz como reescrever os apontamentos, criar resumos ou desenhar diagramas. Os LLMs atuais são como o estudante que só relê, mas com o SEAL, a coisa muda de figura.

O framework SEAL funciona com um sistema de "nested-loop": Um loop interno onde o modelo gera "self-edits" (diretivas sobre como se adaptar) e atualiza os seus próprios pesos através de "supervised finetuning" (SFT). Um loop externo onde o modelo é recompensado com base no seu desempenho após a atualização, treinando-o para aprender a aprender de forma mais eficiente. Isto significa que o modelo não está apenas a aprender factos, mas também a aprender a melhor forma de internalizar esses factos. É como se estivéssemos a ensinar um cão não só a sentar, mas também a descobrir a melhor forma de aprender truques novos.

Os resultados experimentais são impressionantes. Num teste de "few-shot learning", o SEAL conseguiu uma taxa de sucesso de 72.5%, enquanto os métodos tradicionais falharam completamente. Noutro teste, o SEAL superou até mesmo um modelo muito maior (GPT-4.1) na integração de informação. Claro que há limitações. O "catastrophic forgetting" (o modelo esquecer o que já aprendeu) é um problema, e o loop de treino RL é computacionalmente caro. Mas, no geral, o SEAL representa um avanço significativo. No fundo, o SEAL é uma lufada de ar fresco num campo que muitas vezes parece estagnado.

Em vez de ficarmos obcecados com a quantidade de dados que damos aos modelos, podemos começar a pensar em como ensiná-los a aprender de forma mais inteligente. E isso, é um futuro que vale a pena explorar!


Mais detalhes aqui : https://arxiviq.substack.com/p/self-adapting-language-models

Novidades no Blog

Inspiração, novidades e ideias da JCS Studio.

Intismeran e melanoma: o avanço da vacina de mRNA que exige entusiasmo com método
Imagem gerada por I.A.

Intismeran e melanoma: o avanço da vacina de mRNA que exige entusiasmo com método

Publicado em 23/08/2026 20:00

Alegadamente... há uma boa notícia na investigação do cancro, mas não estamos perante uma “cura descoberta por inteligência artificial”.. não...

Ler Mais
OpenAI abranda trabalho em Astra: segurança cibernética não confirma um “GPT-6 adiado”
Imagem gerada por I.A.

OpenAI abranda trabalho em Astra: segurança cibernética não confirma um “GPT-6 adiado”

Publicado em 23/08/2026 16:40

A OpenAI confirmou que abrandou temporariamente o desenvolvimento de modelos de fronteira enquanto reforça medidas de segurança relacionadas com capacidades...

Ler Mais
Ox Alpha: o que se sabe sobre o modelo anónimo — e o que continua a ser rumor
Imagem gerada por I.A.

Ox Alpha: o que se sabe sobre o modelo anónimo — e o que continua a ser rumor

Publicado em 23/08/2026 14:30

É... o Ox Alpha apareceu como um modelo anónimo em plataformas usadas por programadores e depressa gerou o habitual frenesim...

Ler Mais
Claude Academy: formação gratuita que começa pelaquilo que os modelos não sabem fazer
Imagem gerada por I.A.

Claude Academy: formação gratuita que começa pelaquilo que os modelos não sabem fazer

Publicado em 23/08/2026 12:15

A Claude Academy é a plataforma de aprendizagem da Anthropic para quem quer usar os seus produtos com mais método....

Ler Mais
Ornith-1.5: o modelo que cria o próprio currículo, mas ainda tem de provar serviço
Imagem gerada por I.A.

Ornith-1.5: o modelo que cria o próprio currículo, mas ainda tem de provar serviço

Publicado em 23/08/2026 12:00

O Ornith-1.5 chega com uma promessa que merece alguma atenção (ou muita), pois em vez de depender apenas de tarefas...

Ler Mais
GEN 1.5
Créditos de imagem : generalistai.com
Link Externo

GEN 1.5

Publicado em 23/08/2026 11:15

GEN-1.5 é um modelo fundacional para robótica capaz de aprender novas tarefas físicas em segundos a partir de uma única demonstração, sem treino adicional, além de generalizar, improvisar e utilizar ferramentas nunca vistas.

Visitar Link
Qwen-Video-Edit
Créditos de imagem : github.com/yunpeng1998
Link Externo

Qwen-Video-Edit

Publicado em 23/08/2026 11:00

Qwen-Video-Edit é um sistema de edição de vídeo por instruções de texto que adapta o modelo de edição de imagens Qwen-Image-Edit para modificar vídeos diretamente, sem necessitar de um transformer previamente treinado em vídeo

Visitar Link
Audio8 TTS Preview 0.1B
Créditos de imagem : Audio8
Link Externo

Audio8 TTS Preview 0.1B

Publicado em 23/08/2026 10:45

Audio8 TTS Preview 0.1B é um modelo compacto de síntese de voz com cerca de 170 milhões de parâmetros, capaz de gerar fala e clonar vozes em zero-shot a partir de uma amostra de áudio, com suporte principal para inglês e chinês e experimental para outras seis línguas.

Visitar Link

Abaixo encontra uma pequena lista de artigos relacionados com este tema..