JCS Studio

Seu Carrinho (0)

Seu carrinho está vazio.

Subtotal $0.00

Self-Adapting for Language Models

Self-Adapting for Language Models

Publicado em 17/06/2025 09:09 | Categorias: Artigos

"Self-Adapting Language Models" (SEAL) é daquelas coisas que nos fazem pensar no futuro da inteligência artificial.

Basicamente, a ideia é que os LLMs (Large Language Models) deixem de ser apenas consumidores passivos de dados e passem a ser aprendizes ativos, capazes de gerar os seus próprios materiais de estudo e de se auto-aperfeiçoar.

A analogia do estudante que prepara um exame é perfeita: reler o manual não é tão eficaz como reescrever os apontamentos, criar resumos ou desenhar diagramas. Os LLMs atuais são como o estudante que só relê, mas com o SEAL, a coisa muda de figura.

O framework SEAL funciona com um sistema de "nested-loop": Um loop interno onde o modelo gera "self-edits" (diretivas sobre como se adaptar) e atualiza os seus próprios pesos através de "supervised finetuning" (SFT). Um loop externo onde o modelo é recompensado com base no seu desempenho após a atualização, treinando-o para aprender a aprender de forma mais eficiente. Isto significa que o modelo não está apenas a aprender factos, mas também a aprender a melhor forma de internalizar esses factos. É como se estivéssemos a ensinar um cão não só a sentar, mas também a descobrir a melhor forma de aprender truques novos.

Os resultados experimentais são impressionantes. Num teste de "few-shot learning", o SEAL conseguiu uma taxa de sucesso de 72.5%, enquanto os métodos tradicionais falharam completamente. Noutro teste, o SEAL superou até mesmo um modelo muito maior (GPT-4.1) na integração de informação. Claro que há limitações. O "catastrophic forgetting" (o modelo esquecer o que já aprendeu) é um problema, e o loop de treino RL é computacionalmente caro. Mas, no geral, o SEAL representa um avanço significativo. No fundo, o SEAL é uma lufada de ar fresco num campo que muitas vezes parece estagnado.

Em vez de ficarmos obcecados com a quantidade de dados que damos aos modelos, podemos começar a pensar em como ensiná-los a aprender de forma mais inteligente. E isso, é um futuro que vale a pena explorar!


Mais detalhes aqui : https://arxiviq.substack.com/p/self-adapting-language-models

Novidades no Blog

Inspiração, novidades e ideias da JCS Studio.

Grok 4.6: a corrida da IA já não é a dois
Imagem gerada por I.A.

Grok 4.6: a corrida da IA já não é a dois

Publicado em 14/08/2026 11:15

É... durante demasiado tempo, a conversa sobre modelos de inteligência artificial de fronteira foi tratada como um duelo entre dois...

Ler Mais
Pensamentos roubados: a falha que expôs o raciocínio oculto dos modelos de IA
Imagem gerada por I.A.

Pensamentos roubados: a falha que expôs o raciocínio oculto dos modelos de IA

Publicado em 13/08/2026 12:10

Os modelos de raciocínio não respondem logo. Antes de devolverem uma resposta, percorrem passos intermédios: testam hipóteses, corrigem um cálculo,...

Ler Mais
Meta e Anthropic discutem o futuro da IA, mas a disputa real é pelo poder
Imagem gerada por I.A.

Meta e Anthropic discutem o futuro da IA, mas a disputa real é pelo poder

Publicado em 13/08/2026 12:05

Mark Zuckerberg publicou um texto longo sobre inteligência artificial e fez uma escolha política, não apenas técnica. A Meta quer...

Ler Mais
Bernard Sanders faz pedido urgente aos developers de IA americanos
Imagem gerada por I.A.
Link Externo

Bernard Sanders faz pedido urgente aos developers de IA americanos

Publicado em 12/08/2026 11:50

Trata-se de uma carta do senador norte-americano Bernie Sanders, dirigida a Sam Altman, Dario Amodei e Mark Zuckerberg, na qual pede uma pausa no desenvolvimento de sistemas de IA cada vez mais avançados.

Visitar Link
A marca invisível do Claude não prova autoria... e esse o ponto importa
Imagem gerada por I.A.

A marca invisível do Claude não prova autoria... e esse o ponto importa

Publicado em 11/08/2026 17:50

A Anthropic começou a introduzir marcas invisíveis em conteúdos produzidos pelo Claude. A ideia parece simples: permitir que sistemas automáticos...

Ler Mais
Engenharia de grafos: quando os agentes deixam de ser uma ferramenta e passam a ser uma organização
Imagem gerada por I.A.

Engenharia de grafos: quando os agentes deixam de ser uma ferramenta e passam a ser uma organização

Publicado em 11/08/2026 16:58

Durante grande parte da actual corrida à inteligência artificial, a discussão concentrou-se nos modelos: mais parâmetros, mais contexto, melhor raciocínio,...

Ler Mais
Solar Pro 4: uma estreia coreana que separa espectáculo de trabalho agentivo
Imagem gerada por I.A.

Solar Pro 4: uma estreia coreana que separa espectáculo de trabalho agentivo

Publicado em 11/08/2026 16:33

A sul-coreana Upstage apresentou o Solar Pro 4, um novo modelo proprietário de inteligência artificial orientado para tarefas agentivas, incluindo...

Ler Mais
OpenAI reforça o Daybreak enquanto a janela de defesa cibernética encolhe
Imagem gerada por I.A.

OpenAI reforça o Daybreak enquanto a janela de defesa cibernética encolhe

Publicado em 10/08/2026 15:20

A OpenAI está a ampliar o Daybreak, a sua iniciativa de defesa cibernética, num momento em que a inteligência artificial...

Ler Mais

Abaixo encontra uma pequena lista de artigos relacionados com este tema..