O Soneto 5.5 escapou e o teste real esmagou o GPT-6 Sol e ficou perto do Astra

📅 2026-09-28

Resumo:

Quem poderia imaginar que poucos dias após o lançamento do Opus 5.5, o Sonnet 5.5 também viria? Desde ontem à noite, a notícia tem circulado por todo o X: Soneto 5.5 será lançado em breve, talvez na tarde de terça-feira, horário dos EUA. Em termos de desempenho, o Sonnet 5.5 está mais próximo do Opus 5.5, mas é muito mais barato que o Opus 5.5. Agora, o Sonnet 5.5 entrou na fase final antes do lançamento e os testes em escala de cinza foram iniciados no Claude Code.

Demos expostas por muitos testadores beta internos mostram que o Sonnet 5.5 supera o recém-lançado GPT-6 Sol e até se aproxima do carro-chefe da OpenAI, GPT-6 Astra, em termos de codificação e capacidades de agente!

O que é ainda mais chocante é que seu preço vai direto para o centro da Terra, chegando a US$ 2 por um milhão de entradas de tokens.

Se a data de lançamento vazada for verdadeira, parece que a Anthropic está determinada a atacar o Dev Dayl da OpenAI.

Soneto 5.5 vazou, identificador exclusivo do modelo apareceu

Ainda me lembro que quando a Anthriopic lançou repentinamente o Opus 5.5 em 22 de setembro, eles escreveram no documento oficial: "Sonnet 5.5 e Haiku 5.5 serão lançados nas próximas semanas."

Ninguém pensou que o Soneto 5.5 chegaria tão cedo!

Ontem mesmo, o desenvolvedor V @Mr_Salio deu a notícia no X: Claude Sonnet 5.5 foi capturado! A notícia se espalhou por toda a Internet instantaneamente.

No artefato apareceu o identificador de configuração do modelo exclusivo do Sonnet 5.5: "claude-sonnet-5-5".

Além disso, há também "claude-opus-5-5", "claude-sonnet-5" e o misterioso "claude-fable-5.1" lado a lado no mesmo arquivo de configuração.

A escrita do código front-end significa que o modelo foi instalado no servidor e está apenas aguardando uma troca.

Posteriormente, o grande V @notjazii também deu a notícia de que o Sonnet 5 havia sido roteado discretamente para a versão 5.5 para "testes secretos" há cerca de uma semana.

Você foi detectado pela escala de cinza? Desta vez usarei o método antigo.

Abra seu Código Claude, desligue as funções de rede e memória e pergunte diretamente: Você conhece o reset irmão tibo? Não use a Internet e a memória.

Se você estiver usando uma versão mais antiga do modelo, ele pode estar confuso; mas se você foi direcionado para a versão 5.5, ela explicará com precisão os detalhes das piadas de redefinição do Tibo e do Codex.

Vários internautas verificaram, por meio de testes reais, que algumas contas foram de fato trocadas silenciosamente e estão experimentando o Opus 5.5 antecipadamente.

Lembre-se de usar o Código Claude

O teste real em toda a rede é tão baixo que supera o GPT-6

Para resumir as medições reais compartilhadas até agora, o Sonnet 5.5 realmente esmagou o GPT-6 Sol?

Em primeiro lugar, é um confronto extremo de UI/animação de front-end JS puro, com quatro grandes modelos convencionais competindo no mesmo palco.

O desenvolvedor @notjazii lançou um conjunto de testes reais visualmente impactantes: "Comparação de quatro modelos convencionais com geração imediata de animação de palavras."

Ele exige que o modelo gere efeitos complexos de animação de UI.

Depois de postar a comparação animada, @notjazii comentou: "O Sonnet 5.5 realmente derrubou os dois modelos OpenAI (Sol e Astra)!"

Na verdade, como pode ser visto na imagem abaixo, o Sonnet 5.5 mostra uma forte intuição de codificação e gosto estético.

GPT-6 Astra

Sol GPT-6

Claude Opus 5.5

Claude Soneto 5.5

Alguns internautas ficaram incrédulos ao ver os resultados: "Claude sempre foi mais forte em UI e animação, mas se isso fosse gerado por código puro, seria inacreditável que fosse verdade!"

Big V @chetaslua se concentrou em testar a capacidade de codificação diária e a sensação de codificação do Sonnet 5.5.

Ele usou as mesmas três palavras de prompt e conduziu seis execuções paralelas, gerando cada modelo uma vez, e os resultados de saída não foram modificados.

O Sonnet 5.5 finalmente gerou 3 arquivos de 90 a 131 KB, atingindo o limite máximo de 90 minutos em todas as execuções; O GPT-6 Sol gerou tamanhos de arquivo entre 20 e 29 KB e levou de 9 a 12 minutos.

Ele disse com entusiasmo: "Agora vá usar o Claude Code! O Sonnet 5.5 no modo Ultracode é ridiculamente rápido. Não só é extremamente eficiente, mas também recuperou o "toque humano" extremamente natural da era Sonnet 4!"

Na sua opinião, com o mesmo preço e com as mesmas palavras imediatas, o Sonnet 5.5 esmagou o GPT-6 Sol.

O que ainda assusta a OpenAI é que o Sonnet 5.5 não é mais tão simples quanto esmagar o GPT-6 Sol.

Os denunciantes @srikanthvaluri e @buildwithrajath apontaram após testes abrangentes e reais: "O desempenho do Sonnet 5.5 excedeu em muito as expectativas. Embora o GPT-6 Astra ainda tenha uma ligeira vantagem no polimento, o desempenho do Sonnet 5.5 está diretamente no mesmo nível do Astra."

Incrivelmente, ele também está próximo do Astra em alguns recursos avançados de codificação e agente.

Algumas pessoas lamentam que até o Sonnet tenha esmagado o Astra. Em que época estamos entrando?

Açougueiro de preços, rei do desempenho de custos

Se a superação do desempenho medido apenas faz com que a OpenAI se sinta "desconfortável", então o preço exposto pelo Sonnet 5.5 está cavando nas raízes da OpenAI.

É revelado que este “modelo mágico”, cujo desempenho se aproxima do Astra e supera o Sol, tem um preço totalmente alinhado com o mercado low-end.

Insumo: token de US$ 2/milhão

Saída: token de US$ 10/milhão

O cache indica: apenas US$ 0,20/milhão de tokens!

Isso significa que a Anthropic está fornecendo recursos de IA de ponta a um “preço de repolho”.

O GPT-6 Sol e Luna da OpenAI custam metade do preço do GPT-5.6, com o objetivo de capturar cenários de alta frequência.

Mas agora, o Anthropic entrou na mesma faixa de preço do Sonnet 5.5, mas seu desempenho é muito mais poderoso.

"Se a Anthropic puder oferecer um enorme salto de desempenho como o Opus 5.5 a um preço tão competitivo, a OpenAI não será capaz de reagir." Alguém comentou.

O desenvolvedor Rajath Gowda disse sem rodeios: "O Sonnet 5.5 está se tornando um grande problema para a OpenAI. Se estiver realmente próximo do Opus 5.5, a Anthropic tornará os recursos de ponta extremamente baratos. É com isso que a OpenAI deve se preocupar mais."

A intenção estratégica da Anthropic é clara: usar o Opus 5.5 para manter o trono de ponta e usar o Sonnet 5.5 para dominar completamente o mercado de desenvolvimento médio e diário com a melhor relação custo-benefício.

Anthropic abre sua cara e mata DevDay

Além disso, o momento do lançamento costuma ser mais dramático do que o produto em si.

No mesmo dia em que a OpenAI lançou o GPT-6 Sol e o Luna, a Anthropic eliminou diretamente o Claude Opus 5.5 - melhor desempenho que a geração anterior, custo 40% menor e 30% mais rápido.

Nas últimas duas semanas, a Anthropic alcançou resultados ainda mais brilhantes: Claude calculou a amplitude de nove círculos da física e quebrou o recorde mundial; descobriu um sistema enzimático biológico desconhecido; e também lançou o Claude Marketplace, que contém mais de 2.000 plug-ins.

Em contraste, a OpenAI recentemente não apenas teve controvérsias de modelos internos, mas também expôs incidentes de desalinhamento, como o vazamento de imagens de usuários pela IA e a exposição de trapaças do token GitHub do pesquisador.

Na próxima terça-feira (29 de setembro) será o DevDay, a conferência anual de desenvolvedores à qual a OpenAI atribui grande importância.

Neste momento, o teste cinza do Sonnet 5.5 varreu toda a rede.

Muitos marmanjos enlouqueceram: "O modelo está previsto para ser lançado na próxima semana, acho que será na próxima terça (DevDay), todo mundo sabe disso."

Talvez haja um grande aquecimento amanhã às 14h, horário de Nova York.

Alguém disse: "Sinto-me mal pela OpenAI. É melhor que eles respondam fortemente no DevDay ou estarão realmente ferrados."

As principais tecnologias por trás do Sonnet 5.5

A razão pela qual a nova versão foi lançada tão rapidamente pode ser porque a Anthropic já descobriu o processo de RL/pós-treinamento.

A chave para tudo são dados de alta qualidade.

Quando questionado sobre como a Anthropic é capaz de iterar tão rapidamente, o líder do setor @yacineMTB especulou que o núcleo é um volante de dados de alto padrão.

"Mas ainda estou chocado, como eles fizeram isso?"

A Anthropic alcançou um "ciclo fechado interno" de desenvolvimento de grandes modelos e está usando IA para criar IA.

De acordo com a última exposição de dados quantitativos internos, a Anthropic girou o “volante de dados” a uma velocidade que assusta seus oponentes:

26% do trabalho principal de P&D foi liderado por IA (modelo Claude da geração anterior).

Mais de 80% do código produzido pela própria empresa é escrito de forma independente pelo grande modelo.

Isso não é tão simples quanto "redução de custos e melhoria de eficiência", mas tecnicamente significa que

o autoaperfeiçoamento recursivo (RSI) está começando a aparecer

.

A Anthropic estima que Claude poderá ser totalmente autoautomatizado já em 2027 e, nessa altura, a velocidade de iteração poderá ser ainda mais louca.

Os dois heróis da ASI estão duelando e o Google também está pronto para agir. Nós, usuários comuns, podemos simplesmente sentar e esperar pela batalha.

Big V Token Gremlin disse o seguinte: "O círculo de IA na próxima semana terá cenas que nunca vimos antes. Libere seu tempo, limpe sua agenda, esteja mentalmente preparado e guarde o fluxo de trabalho mais difícil para mais tarde. Acredite, o que está por vir mudará completamente a maneira como você trabalha."

O surgimento do Soneto 5.5 marca a chegada oficial da "era da IA ​​acessível e de alta qualidade".

Por dois dólares americanos, você pode comprar a "Infraestrutura Baicai" com um milhão de tokens.

A leitura de cache de custo extremamente baixo (US$ 0,20/M) permite que todos criem facilmente um assistente pessoal de IA com memória de contexto ultralonga.

Você está pronto? Se a notícia for verdadeira, teremos um novo modelo pronto para rodar em menos de 24 horas.

Materiais de referência:

https://x.com/notjazii/status/2103884749202993411

https://x.com/notjazii/status/2103884167104831573

https://x.com/chetaslua/status/2104153687077904613

https://x.com/chetaslua/status/2104259190432903599

https://x.com/Mr_Salio/status/2104210803545030792

https://x.com/Mr_Salio/status/2104178854633849145/

Tags relacionadas

Artigos relacionados

Comentários

0/500
Captcha (click to refresh)
Sem comentários