JCS Studio

Seu Carrinho (0)

Seu carrinho está vazio.

Subtotal $0.00

Astra: quando a IA começa a produzir matemática verificável

Astra: quando a IA começa a produzir matemática verificável

Publicado em 03/08/2026 16:55 | Categorias: Artigos

A OpenAI revelou que uma versão interna do Astra, descrito como a próxima grande família de modelos da empresa, produziu avanços em dez problemas abertos de matemática e ciência da computação teórica. Não se trata de uma demonstração sobre responder a perguntas ou gerar código.. são na realidade resultados que incidem directamente sobre questões de investigação com décadas de história.

Os problemas abrangem áreas muito diferentes, incluindo geometria de alta dimensão, teoria de códigos, teoria de grupos, complexidade de circuitos, jogos quânticos, criptografia.  Entre os resultados divulgados está a construção de grupos não-sofic, uma questão central da teoria de grupos, bem como uma refutação da conjectura de rigidez de Connes. Foram igualmente apresentados novos limites para o empacotamento de esferas em dimensões elevadas e avanços relativos a problemas colocados por Paul Erdős.

Uma alegação especialmente relevante é que o sistema chegou a argumentos novos. A OpenAI disponibilizou certificados em Lean para cada resultado. Lean é um assistente de prova que permite verificar formalmente, passo a passo, se uma demonstração respeita as regras lógicas definidas. Essa formalização não substitui a apreciação científica humana, mas reduz de forma substancial a dificuldade de auditar provas complexas.

O custo estimado para encontrar as soluções foi de cerca de 2.000 dólares, calculado com base nas tarifas de API indicadas pela empresa. O número deve ser lido com cautela, porque não representa todo o investimento necessário para treinar, avaliar e operar um modelo de fronteira. Ainda assim, ilustra como uma capacidade de investigação antes reservada a equipas especializadas pode tornar-se mais acessível quando é distribuída por ferramentas computacionais.

Há apenas alguns anos, modelos de linguagem cometiam erros elementares em aritmética e falhavam cadeias curtas de raciocínio formal. A passagem para resultados auditáveis em problemas abertos não significa que o erro tenha desaparecido, mas mostra uma mudança de escala! O objetivo agora já não é apenas automatizar tarefas conhecidas, mas explorar hipóteses e construir argumentos em territórios onde não existe uma resposta estabelecida.

Esta evolução também reforça a importância dos agentes de IA capazes de trabalhar durante períodos mais longos. Em vez de produzir uma resposta isolada, um sistema poderá dividir um problema, procurar literatura, formular conjecturas, testar contra-exemplos, formalizar resultados e rever a própria abordagem. A utilidade real dependerá menos de uma única resposta brilhante e mais da fiabilidade de todo esse processo.

O potencial para a ciência é considerável. Matemática, descoberta de materiais, física, biologia e engenharia contêm problemas cuja dificuldade não decorre da falta de talento, mas do tempo limitado disponível para explorar possibilidades. Ferramentas que acelerem essa exploração podem ampliar o trabalho dos investigadores, desde que os resultados permaneçam transparentes, reproduzíveis e sujeitos a escrutínio independente.

O Astra ainda não foi lançado publicamente e a OpenAI não confirmou se será associado a uma futura versão GPT ou a uma designação autónoma. Por isso, qualquer previsão sobre disponibilidade, funcionalidades finais ou desempenho fora deste contexto permanece especulativa.

A IA já começa a ser avaliada não apenas pela fluidez com que comunica, mas pela sua capacidade de contribuir para descobertas que possam ser verificadas...

Novidades no Blog

Inspiração, novidades e ideias da JCS Studio.

Mistral Large 4: um modelo europeu de escala inédita, mas ainda em pré-visualização
Imagem gerada por I.A.

Mistral Large 4: um modelo europeu de escala inédita, mas ainda em pré-visualização

Publicado em 07/10/2026 11:58

A Mistral apresentou o Large 4, também apelidado de “Le Chonk”, um modelo de mistura de especialistas com cerca de...

Ler Mais
OpenAI divulga 722 manuscritos matemáticos gerados por IA
Imagem gerada por I.A.

OpenAI divulga 722 manuscritos matemáticos gerados por IA

Publicado em 07/10/2026 11:44

A OpenAI publicou 722 manuscritos matemáticos produzidos por um modelo interno ainda não disponibilizado ao público. A coleção, divulgada a...

Ler Mais
Quando agentes de IA entram em conflito, a coordenação falha
Imagem gerada por I.A.

Quando agentes de IA entram em conflito, a coordenação falha

Publicado em 06/10/2026 14:40

Juntar vários agentes de inteligência artificial não garante uma equipa mais eficaz. Num estudo publicado pela Anthropic, modelos receberam instruções...

Ler Mais
Agentes de IA: a velocidade não substitui a verificação
Imagem gerada por I.A.

Agentes de IA: a velocidade não substitui a verificação

Publicado em 06/10/2026 14:34

Os agentes de programação já conseguem assumir tarefas longas em bases de código reais: planeiam alterações, distribuem trabalho por agentes...

Ler Mais
Modelos em teste, agentes em expansão e um alerta de privacidade
Imagem gerada por I.A.

Modelos em teste, agentes em expansão e um alerta de privacidade

Publicado em 28/09/2026 16:46

O mercado da inteligência artificial voltou a misturar lançamentos concretos com rumores de modelos ainda em avaliação. A Google confirmou...

Ler Mais
Space Bunny Alpha: um modelo rápido, mas ainda sem identidade
Imagem gerada por I.A.

Space Bunny Alpha: um modelo rápido, mas ainda sem identidade

Publicado em 28/09/2026 16:45

O Space Bunny Alpha surgiu no OpenRouter como um modelo “stealth”: o fornecedor mantém a identidade e os detalhes técnicos...

Ler Mais
Xiaomi MiMo-V2.6: modelos abertos com ambição multimodal
Imagem gerada por I.A.

Xiaomi MiMo-V2.6: modelos abertos com ambição multimodal

Publicado em 28/09/2026 16:30

A Xiaomi lançou a família MiMo-V2.6, composta pelos modelos Pro e Flash, com pesos abertos e capacidades multimodais. Ambos aceitam...

Ler Mais
Grok 4.7: mais eficiente, mas ainda não é o líder absoluto
Imagem gerada por I.A.

Grok 4.7: mais eficiente, mas ainda não é o líder absoluto

Publicado em 23/09/2026 11:00

A SpaceXAI apresentou o Grok 4.7 como o seu modelo mais capaz para programação e trabalho de conhecimento. O lançamento...

Ler Mais

Abaixo encontra uma pequena lista de artigos relacionados com este tema..