Foi revelado que o novo modelo Bel do ChatGPT foi pré-treinado com parâmetros de até 10 trilhões

📅 2026-08-31

Resumo:

O modelo mais poderoso da OpenAI, o Astra, foi revelado para ser lançado na próxima quinta-feira, e o escopo dos testes foi ampliado. Anteriormente, segredos internos foram vazados e o código subjacente do chip autodesenvolvido "Jalapeño" foi oficialmente assumido. O código principal escrito pela IA é executado 1,8 vezes mais rápido do que os melhores engenheiros humanos. Existem sinais de auto-recursão de IA no OpenAI!

OpenAI também possui uma carga de profundidade.

Há rumores de que o OpenAI executou com sucesso o modelo de pré-treinamento de 10 trilhões de parâmetros, codinome "Bel", apontando diretamente para o limite final do AGI. O pré-treinamento que ultrapassa até 10 trilhões de parâmetros é apenas o ponto de partida para Bel. Depois disso, Bel pode aprender em duas velocidades.

Ultraman disse: Deveríamos fazer outra festa para o lançamento do modelo da próxima geração.


Quais ambições estão ocultas no mundo após o GPT-6?

Bel: A fera abissal com 10 trilhões de parâmetros

Este ano, a OpenAI parece estar presa em um gargalo de expansão de escala, e até soou com urgência o alarme "Código Vermelho".


Para concentrar o poder de computação, a OpenAI até eliminou produtos como Sora e o navegador de IA Altas.


O modelo de IA de próxima geração Astra alcançou vários avanços matemáticos de uma só vez e surpreendeu o mundo, mas ainda não foi lançado.

Nas últimas semanas, a OpenAI passou por turbulências pessoais: o diretor de receitas Dennis Dresser, o diretor de operações Brad Lightcap e Fergie Simo, ex-adjunta do CEO Sam Altman, renunciaram.

Enquanto o mundo exterior especula se a OpenAI "esgotou os talentos", vários denunciantes de tecnologia radicais revelaram que a OpenAI acaba de concluir um pré-treinamento em grande escala, com o codinome "Bel".


Quão assustador é esse "Bel"?

Vejamos algumas palavras-chave principais:

1. Ultrapassando a marca do parâmetro 10T (10 trilhões)

O GPT-4 de trilhões de parâmetros permite que a IA tenha bom senso e lógica próximos aos estudantes de graduação humanos. Então, que tipo de “capacidades emergentes” Bel, com 10 trilhões de parâmetros, mostrará em termos de raciocínio complexo, associação de textos longos e compreensão multimodal interdisciplinar?

Esta é uma mudança qualitativa.

É equivalente a empacotar a capacidade cerebral de todos os maiores especialistas do mundo hoje e multiplicá-la por um amplificador exponencial. Neste nível de parâmetro, a compreensão do modelo mundial pela IA atingirá uma profundidade sem precedentes.


2. O sucessor de “Doug”, a base definitiva após GPT-6

A notícia apontava que antes disso, a OpenAI havia concluído o pré-treinamento com o codinome "Doug".

Doug está posicionado como o modelo básico do Projeto Astra e do suposto GPT-6 (que passará por um alinhamento de aprendizagem por reforço de intensidade extremamente alta posteriormente).

Como sucessor, Bel é a base da próxima geração para a "era pós-GPT-6" que vai além de Doug.


Bel tem como alvo direto o Santo Graal do mundo da tecnologia - AGI (Inteligência Geral Artificial).

É relatado que o modelo Bel supera o Astra em codificação, raciocínio e tarefas de agente de longo prazo.

O modelo pode funcionar de forma eficiente durante dias sem intervenção humana, pode auto-recuperar-se e coordenar centenas de subagentes paralelos, disseram as fontes.


3. Claude Fable Killer (O Assassino de Fábulas)

@ChrisGPT foi direto em seu tweet:

Bel é o modelo “monstro” da OpenAI, projetado para ser um assassino de fábulas.

Deve estar disponível antes do final do ano ou alguns meses após o lançamento do Astra.

Ele até recebeu o codinome há seis dias, confirmando a confiabilidade da fonte.


Em teoria, Bel pode ter ultrapassado o GPT-6 e até mesmo se aproximado do limite AGI definido pela OpenAI.

No lançamento oficial do GPT-5.6, eles introduziram o "Índice RSI", que integra os resultados de pesquisa e depuração, otimização de kernel e receita de treinamento, experimentos de aprendizado de máquina e autoaperfeiçoamento de modelo. No final, o modelo sol melhorou 16,2 pontos com base no GPT-5.5.


Sol então projetou centenas de experimentos arquitetônicos para seu modelo menor e começou o treinamento. E a intervenção humana só ocorrerá em caso de falha de hardware e treinamento instável. No final das contas, a eficiência de geração de tokens aumentou mais de 15%.

Bel se tornou uma existência que continua a evoluir no verdadeiro sentido.


A camada de ponderação rápida absorve lições aprendidas de provas validadas, testes de código, experimentos e trajetórias de ferramentas enquanto funciona. Loops mais lentos consolidam melhorias que sobrevivem à avaliação em pesos persistentes e receitas de treinamento.

Ele aprende rapidamente em memória rápida, solidifica melhorias comprovadas e eficazes em pesos lentos, ao mesmo tempo em que otimiza continuamente o mecanismo operacional da próxima rodada de aprendizado e destila os resultados finais em pequenos modelos que todos podem realmente usar.

O GPT-7 pode ser apenas um instantâneo de segurança do status de Bel em uma determinada semana.

No Reddit, a notícia de Leo gerou muita discussão. Afinal, as revelações de Leo sempre foram confiáveis.


Algumas pessoas especulam que os modelos internos podem superar os modelos externos em 4,5 a 6 meses.


OpenAI disse: "Anthropic não consegue mais acompanhar"

Se Bel é um golpe técnico na redução da dimensionalidade, então o poder da computação é um truque para aumentar o moral dentro da OpenAI.

De acordo com a análise cruzada de vários rastreadores, a OpenAI determina que não há dúvida de que manterá a liderança do segundo semestre de 2026 a 2027.

Por que você tem tanta certeza? Por causa do poder de computação.

A notícia mencionou que a avaliação interna da OpenAI acredita que seu maior rival, Antrópico, tem escassez de poder de computação e é incapaz de lidar com a IA de próxima geração da OpenAI.


Na corrida armamentista dos grandes modelos, o poder da computação é munição. Quando os parâmetros do modelo sobem para níveis de 10 trilhões, treinar uma vez fica muito caro.

Embora o Anthropic seja extremamente talentoso em arquitetura de modelos e tecnologia de alinhamento, ele é obviamente incapaz de lidar com a "estética da violência" absoluta.

Enfrentando a próxima estreia pública do Astra, a Anthropic está limitada por gargalos de poder computacional e pode ser difícil fornecer uma resposta forte este ano.


Enquanto outras empresas ainda lutam para reunir 100.000 chips H100/B200, a OpenAI já usou uma estética violenta para destruir "Doug" e "Bel".

Com o lançamento do chip Jalapeño, desenvolvido pela OpenAI, o fosso não foi preenchido, mas foi alargado.

O responsável pelo OpenAI Codex revela o “jogo final”

10 trilhões de parâmetros podem fazer você se sentir um pouco distante. Mas dentro da OpenAI, esses avanços violentos subjacentes apontam, em última análise, para o mesmo objetivo final da IA.

Recentemente, em uma entrevista com o conhecido podcaster de tecnologia Matthew Berman, o executivo da OpenAI, Tibo, revelou o roteiro futuro da OpenAI na camada de aplicação sem reservas.


Ele até disse com ousadia:

O modelo Codex atualmente extremamente poderoso parecerá um produto de uma era primitiva nos próximos 2 a 3 meses.


Com base nas revelações anteriores, Tibo apontou quatro mudanças perturbadoras.

O autoaperfeiçoamento recursivo (RSI) acontece todos os dias dentro do OpenAI.

Tibo confirmou que a “singularidade interna” não apenas existe, mas também rompeu o ciclo fechado do negócio.

A OpenAI usa há muito tempo os modelos mais fortes para otimizar sua pilha de inferência, kernel CUDA e até mesmo infraestrutura.

Ele deu um exemplo: OpenAI usa o modelo Sol internamente para otimizar o modelo Luna, reduzindo diretamente os custos operacionais em 80%!


"Ultra Fast" remodelará o fluxo humano.

Tibo revelou que o modo Ultra Fast atual alcançou internamente uma aceleração de até 14 vezes. Ele previu que em apenas 1 a 2 anos, essa latência ultrabaixa se tornará o padrão do setor.

Quando a velocidade de resposta da IA ​​se aproximar ou mesmo exceder a velocidade do pensamento humano, a interação se tornará em tempo real. O fluxo de trabalho retornará completamente ao “estado de fluxo” e a carga cognitiva humana diminuirá exponencialmente.

Mudança de paradigma da computação: seu computador está prestes a se tornar sucata.

Com a chegada dos modelos de próxima geração (como o Astra), Tibo apontou claramente: o futuro mainstream da IA ​​definitivamente não será mais executado localmente, mas mudará totalmente para clusters de agentes em grande escala na nuvem.

O golpe final: ChatGPT se funde com Codex para se transformar em "Personal AGI".

No futuro, "o mecanismo desaparecerá completamente". Você não precisa mais escrever manualmente prompts complexos, manter arquivos de habilidades ou gerenciar memória, e não há necessidade de agendar subagentes manualmente.

A AGI pessoal compreenderá contínua e passivamente seus objetivos, hábitos diários e dinâmica da equipe, além de fornecer ajuda de forma proativa.

O que é ainda mais incrível é a adaptação dinâmica da UI. A camada inferior é obviamente a mesma tecnologia multimodal que prioriza a voz, mas a interface se deformará automaticamente como água com base na sua identidade.

Conclusão: A singularidade chegou e será invisível

Não importa o quão exagerados sejam os rumores sobre "Bel", ou se o fato de Astra rasgar à mão o código do especialista humano ser realmente tão suave, esta revelação em grande escala enviou um sinal ao mundo que não pode ser ignorado:

O desenvolvimento da inteligência artificial não parou, apenas se prepara para uma tempestade que pode derrubar a mesa de pôquer.

No segundo semestre de 2026, a diversão apenas começou.

Tags relacionadas

Artigos relacionados

Comentários

0/500
Captcha (click to refresh)
Sem comentários