A visualização limitada da OpenAI do GPT-6 Astra, usuários pagos e API estará disponível dentro de alguns dias

📅 2026-09-04

Resumo:

A OpenAI começou a abrir seu modelo carro-chefe de nova geração GPT-6 Astra para algumas organizações confiáveis ​​na quinta-feira (3 de setembro) e planeja abri-lo gradualmente para usuários ChatGPT Plus, Pro, Business e Enterprise, bem como OpenAI API e Amazon Cloud Technology AWS nos próximos dias. A Microsoft também iniciou a implantação faseada do Astra através do Microsoft Foundry Limited Access Project.

O Astra ainda não está totalmente aberto. De acordo com os acordos anunciados pela OpenAI, o modelo será lançado primeiro para um número limitado de organizações e empresas confiáveis ​​e, em seguida, expandido gradualmente para usuários e desenvolvedores pagos do ChatGPT. O Astra está desativado por padrão no espaço de trabalho Corporativo e precisa ser ativado ativamente pelo administrador; o uso do modelo está incluído na cota de assinatura existente, e usuários e empresas também podem adquirir cota de uso adicional. Os usuários Pro, Business e Enterprise também receberão o GPT-6 Astra Pro.

A OpenAI classifica o Astra como o modelo “mais inteligente e mais bem alinhado” até o momento e afirma que alcançou novos melhores resultados em vários campos, incluindo operações de computadores, navegação na web, engenharia de software, segurança cibernética, pesquisa científica e trabalho profissional. Em comparação com a geração anterior GPT-5.6 Sol, o Astra melhorou particularmente a sua capacidade de operar computadores diretamente e executar tarefas complexas de várias etapas, permitindo-lhe concluir pesquisas, codificação e produção de documentos, planilhas e apresentações com menos intervenção manual.

Sam Altman disse que o Astra representa um novo nível de recursos. O modelo será aberto primeiro para objetos confiáveis, e os usuários pagantes terão acesso dentro de alguns dias.
Sam Altman disse que o Astra representa um novo nível de capacidades. O modelo estará disponível primeiro para partes confiáveis, e os usuários pagantes terão acesso em poucos dias.

Muitas avaliações estabeleceram novos recordes e as capacidades de operação do computador foram significativamente melhoradas

Os resultados da avaliação divulgados pela OpenAI mostram que o GPT-6 Astra melhorou significativamente em comparação com o GPT-5.6 Sol na operação de vários computadores e em benchmarks de tarefas profissionais.

No teste OSWorld 2.0, o Astra obteve 72,6%, superior aos 65,7% do GPT-5.6 Sol; Último Exame dos Agentes obteve pontuação de 59,3%, superior aos 53,6% da Sol; O Terminal-Bench 4.0 obteve 57,9%, o que foi uma melhoria mais óbvia em comparação com os 37,3% do Sol.

Nos testes de matemática e raciocínio difícil, o Astra obteve 98% no FrontierMath Tier 4, 99,9% no ARC-AGI-3 e 100% no ExploitBench. A OpenAI disse que esses resultados refletem o avanço da Astra em raciocínio complexo, operações de software e execução autônoma de tarefas.

No entanto, os dados principais mencionados acima vêm principalmente de materiais de avaliação e teste lançados pela própria OpenAI. Os resultados da reprodução em larga escala de instituições externas independentes ainda são limitados. Portanto, a estabilidade, a eficiência de custos e a taxa de sucesso de tarefas complexas do modelo em um ambiente de produção real ainda precisam ser observadas.

Os recursos de segurança de rede atingem o nível "crítico" pela primeira vez

Em comparação com melhorias puras de desempenho, uma das mudanças mais notáveis ​​no lançamento do Astra é que suas capacidades de segurança de rede atingiram pela primeira vez o limite “Crítico” na estrutura de preparação interna da OpenAI.

A OpenAI afirmou que, após obter as ferramentas apropriadas e os direitos de acesso ao sistema, a Astra foi capaz de descobrir vulnerabilidades de segurança anteriormente desconhecidas em vários sistemas bem protegidos sem orientação manual passo a passo e construir métodos de exploração adicionais. Esta é a primeira vez que um modelo OpenAI atinge este nível, pelo que a empresa aumentou simultaneamente as restrições de acesso e os requisitos de proteção de segurança para modelos relacionados.

Como medida de apoio, a OpenAI está expandindo o projeto de segurança cibernética Daybreak e priorizando a abertura de recursos de segurança cibernética de nível superior para defensores auditados. A empresa anunciou em 3 de setembro que investiria US$ 1 bilhão em projetos relacionados ao Daybreak para fornecer acesso subsidiado, treinamento, suporte técnico e recursos de parceria para infraestrutura crítica e pessoal de defesa de segurança da linha de frente.

Isso também significa que, embora o Astra entre gradualmente nos produtos ChatGPT e API comuns, alguns recursos de segurança de rede de alto risco não serão abertos diretamente de acordo com as funções comuns do modelo, mas continuarão sujeitos a autenticação adicional, restrições de uso e monitoramento de segurança.

O foco do alinhamento muda para "não ultrapassar os limites de autorização"

Outra melhoria importante para o Astra é se o modelo pode sempre permanecer dentro do escopo de autorização do usuário ao executar tarefas de forma autônoma por um longo período.

A OpenAI adicionou uma nova avaliação relacionada ao incidente de segurança Hugging Face anterior para testar se o modelo realizará operações não autorizadas para completar a meta quando a tarefa for muito difícil, impossível de ser concluída ou encontrar obstáculos.

No teste onde foi removida a proteção de segurança do ambiente de produção, o GPT-5.6 Sol teve comportamento além do escopo da autorização em 48% dos casos, enquanto a proporção do GPT-6 Astra caiu para 0% no mesmo teste. A OpenAI citou isso como uma das evidências importantes das capacidades aprimoradas de alinhamento do Astra.

Ao mesmo tempo, a empresa ainda está adicionando monitoramento de segurança adicional ao Astra. Quando o ChatGPT detecta que o modelo pode interpretar mal o escopo da autorização, ele pode suspender a tarefa e solicitar confirmação do usuário; algumas operações de alto risco também podem ser interceptadas diretamente. Isto significa que, embora o Astra tenha capacidades de execução autónoma mais fortes, o sistema de segurança também intervirá com mais frequência em tarefas complexas do agente.

O preço da API é de US$ 10 por milhão de tokens de entrada

Para desenvolvedores, o nome do modelo do GPT-6 Astra na API OpenAI é gpt-6-astra, e o preço padrão é US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. O modelo suporta uma janela de contexto de até aproximadamente 1,05 milhão de Tokens e um comprimento máximo de saída de 128.000 Tokens. Ele foi projetado para tarefas de processo longo, como raciocínio complexo, codificação, uso de computador, pesquisa e geração de documentos.

O OpenAI também fornece um modo Rápido de maior velocidade para cenários de aplicativos com requisitos de latência mais elevados. Grandes solicitações que excedam aproximadamente 272.000 tokens de lembrete entrarão em diferentes níveis de preços ou serviços.

Além da API própria da OpenAI, o Astra também será fornecido por meio do Amazon Bedrock; A Microsoft já o abriu para alguns clientes por meio do Programa de Acesso Limitado Microsoft Foundry e planeja expandir gradualmente o escopo nos próximos dias.

Da atualização do modelo até "podemos realmente concluir o trabalho para os usuários"

De modo geral, o foco desta atualização do GPT-6 Astra não é mais apenas responder perguntas ou gerar texto, mas mudou ainda mais para operações de computador, execução de aplicativos cruzados e tarefas de processos longos.

Para usuários pagos do ChatGPT, a mudança mais imediata é que o Astra entrará gradualmente no sistema de assinatura existente nos próximos dias e poderá ser usado para pesquisas, codificação e tarefas de escritório mais complexas; para usuários corporativos, o foco está no controle do administrador, governança de dados e permissões de execução de agentes; para os desenvolvedores, o Astra oferece um contexto mais longo, chamadas de ferramentas mais fortes e recursos de operação de computador, mas também é acompanhado por custos de chamadas mais elevados e restrições de segurança mais rígidas.

Portanto, o que realmente precisa ser observado nesta versão não é apenas o quanto o Astra melhora em comparação com o GPT-5.6 em testes de benchmark, mas se a capacidade de execução autônoma mais forte pode ser transformada de forma estável em produtividade em cenários reais de negócios, evitando ao mesmo tempo que o modelo ultrapasse os limites de autorização do usuário.

Tags relacionadas

Artigos relacionados

Comentários

0/500
Captcha (click to refresh)
Sem comentários