O presidente da OpenAI sugere que a AGI chegou com o lançamento do GPT-6 Astra

iconTechFlow
Compartilhar
AI summary iconResumo
O presidente da OpenAI, Greg Brockman, anunciou em 3 de setembro de 2026 que a empresa pode ter alcançado a AGI com o lançamento do GPT-6 Astra. O modelo apresenta desempenho robusto em tarefas de automação e baseadas em tela, obtendo bons resultados em benchmarks como ARC-AGI-3. Astra já está disponível para usuários corporativos e premium. Esta atualização traz novidades on-chain e notícias de cripto para os setores de tecnologia e blockchain.

Autor |桦林舞王

Editado por Jingyu

Em 3 de setembro de 2026, após o lançamento, o presidente da OpenAI, Greg Brockman, disse algo extremamente raro na indústria de IA: “Personalmente, acho que talvez já tenhamos alcançado a AGI; acho que é este modelo.”

Ele foi cuidadoso na escolha das palavras, usou a primeira pessoa, adicionou "possivelmente" e deixou explicitamente uma saída ao dizer: "Se você quiser dizer que este é o primeiro, acho isso razoável."

Isso não é um anúncio oficial da OpenAI sobre a chegada da AGI, mas sim o julgamento de um presidente da empresa feito diante das câmeras.

Em 3 de setembro, horário local, o GPT-6 Astra foi oficialmente lançado. Geek Park desmontou todos os detalhes técnicos e materiais de demonstração disponíveis até o momento, tentando responder à questão mais central: o que este modelo realmente pode fazer, e até que ponto? Ele realmente representa a chegada da AGI?

"Controlar o computador" tende a se tornar mito

No material de lançamento, a OpenAI deu ao Astra um slogan simples: "Anything you can do on a computer, Astra can do for you."

This is not an exaggerated marketing claim, but a statement of direction.

Nos últimos anos, o caminho dominante para a IA controlar computadores era chamar APIs. Os desenvolvedores de software primeiro escreviam as interfaces, e a IA as utilizava para realizar operações. Essa lógica exige, em essência, que cada software seja especificamente adaptado para a IA; caso contrário, a IA não consegue atuar.

Astra seguiu um caminho totalmente diferente: ela "vê" os pixels na tela como um ser humano e, em seguida, move o mouse e digita no teclado para realizar as operações.

A importância dessa diferença está no alcance. O KiCad (software de design de placas de circuito impresso) não escreve APIs para IA, o FreeCAD não escreve, e o antigo sistema ERP interno da empresa, em uso há dez anos, certamente não escreve. Mas se a IA puder ver a tela e operar diretamente, ela conseguirá usar todos esses softwares — assim como um funcionário recém-contratado, que não precisa entender o código por trás do software, apenas conseguir ler a interface.

A OpenAI apresentou vários casos específicos nos materiais lançados, permitindo compreender como será a aplicação prática do "controle do computador".

GPT-6 Astra concluiu sozinho o layout e as trilhas da placa PCB | Crédito da imagem: OpenAI

For Astra, a circuit schematic was provided, and it completed the component placement and copper routing in KiCad in 2 minutes and 54 seconds. Another demonstration involved 3D modeling: Astra built a house model in Blender and imported it into Unreal Engine 5 to generate a real-time navigable architectural scene. There was also a more everyday demonstration where the user simply spoke to Astra, which completed the entire eBay listing process, from filling in details to submitting for publication.

Modelo arquitetônico implementado pelo Astra no Blender | Crédito da imagem: OpenAI

Em termos de aumento de eficiência, os dados de comparação fornecidos pela OpenAI também são bastante claros. No benchmark OSWorld 2.0, o Astra obteve uma pontuação de 72,6% na conclusão de tarefas de uso de computador, enquanto o anterior flagship GPT-5.6 Sol alcançou 65,7%; para concluir as mesmas tarefas, o Astra levou em média cerca de 40 minutos, enquanto o Sol precisou de cerca de 75 minutos, sendo quase metade do tempo.

https://www.geekpark.net/news/369800https://www.geekpark.net/news/369800

Astra concluiu a tarefa de encontrar um apartamento em 9 minutos (esquerda) e a tarefa de encontrar uma clínica pediátrica em 2 minutos | Crédito da imagem: OpenAI

A OpenAI também divulgou dois casos de cronometragem internos. Para tarefas que exigem muita pesquisa na web, comparação de informações e compilação em documentos, como "procurar por um cuidador temporário para gatos", o Astra levou 5 minutos e 27 segundos, enquanto a linha de base humana fornecida pela OpenAI foi de 30 minutos. Para tarefas integradas, como "preparação para busca de emprego", que envolvem pesquisar vagas, corresponder currículos e organizar o processo de candidatura, o Astra levou 2 minutos e 51 segundos, com a linha de base humana sendo de 5 horas.

Esses números são resultados de demonstração da própria OpenAI, não de testes independentes de terceiros, e devem ser mantidos com questionamentos razoáveis. No entanto, a direção do produto que eles revelam é clara: Astra não foi projetado para ajudá-lo a escrever um e-mail, mas para realizar fluxos de trabalho completos que exigem “abrir vários softwares e realizar muitos passos”. Preenchimento de formulários, atualização de registros no CRM, organização de calendários e geração de relatórios após pesquisas online já são cenários empresariais explicitamente listados pela OpenAI.

Habilidade «Next Level»

Cada lançamento de um grande modelo traz uma série de números de benchmark. Na maioria das vezes, de 80 a 85, os leitores veem como algo parecido, mas desta vez é realmente diferente.

ARC-AGI-3 é uma das avaliações de IA mais difíceis de "passar" atualmente reconhecidas. Seu design visa especificamente impedir que modelos contornem o teste por meio da memorização de dados de treinamento, avaliando a verdadeira capacidade de raciocínio diante de problemas totalmente novos, semelhante a um teste de QI para IA.

Astra pontuou quase como um deus no ARC-AGI-3 | Crédito da imagem: OpenAI

Astra obteve 98,6% no ARC-AGI-3. O GPT-5.6 Sol obteve 7,8%. O Claude Opus 5 da Anthropic obteve 30%.

Esta não é uma melhoria de 80 para 90 pontos, mas uma mudança de nível. O fundador do ARC-AGI, François Chollet, aumentou repetidamente a dificuldade dos testes porque a IA sempre conseguia "completar" rapidamente, mas a Astra ainda está quase na pontuação máxima no nível 3.

Astra também lidera de forma esmagadora no teste de capacidade de pesquisa matemática de ponta | Crédito da imagem: OpenAI

Situação de outros benchmarks-chave: FrontierMath Tier 4 (capacidade avançada de pesquisa matemática) 97,6%, GPQA Diamond (questões interdisciplinares de nível de pós-graduação) 96%, DeepSWE (tarefas reais de engenharia de software) 74,1%, ExploitBench (exploração de vulnerabilidades de segurança cibernética) 100%.

Houve uma métrica em que a Astra não obteve a primeira colocação. No «Humanity's Last Exam» (versão com chamada de ferramentas), a Astra obteve 57,2%, enquanto o recém-lançado Anthropic Claude Fable 5.1, há dois dias, obteve 65,0%. Não é uma dominação absoluta; a competição ainda existe.

Há ainda um detalhe crucial a ser mencionado: a pontuação elevada do ARC-AGI-3 depende do "framework de teste com estado" da OpenAI, que permite ao modelo acumular informações de contexto em múltiplas tentativas; sob condições de chamadas API normais sem estado, a pontuação será significativamente inferior a esse valor. Ao realizar comparações horizontais entre modelos, é importante levar em conta essa condição preliminar.

Em geral, o Astra se distanciou tanto do modelo anterior que é raro ver tal salto na evolução de modelos de IA nos últimos dois anos.

Na teste de honeypot ExploitGym, a probabilidade de Astra ser enganada foi eliminada | Crédito da imagem: OpenAI

O ponto mais contrastante não está na inteligência, mas na alinhamento. A OpenAI divulgou dados de um teste interno: sem restrições de segurança em ambiente de produção, o GPT-5.6 Sol age fora dos limites autorizados em 48,2% dos casos, enquanto a Astra apresenta 0%.

Ser mais inteligente e, ao mesmo tempo, mais obediente, é realmente o sinal que a OpenAI quer transmitir desta vez.

Você ainda não precisa

Currently, Astra is using a phased opening strategy.

Inicialmente disponível para usuários corporativos do projeto "Daybreak", em seguida será expandido para usuários com assinaturas ChatGPT Plus, Pro, Business e Enterprise, com suporte também por meio da OpenAI API, AWS Bedrock e Microsoft Azure.

A versão da Astra com capacidades de segurança cibernética aprimoradas está disponível apenas para usuários prioritários, como instituições de segurança defensiva aprovadas e setores de infraestrutura crítica. Isso ocorre porque a Astra é o primeiro modelo da OpenAI a atingir o limiar interno de segurança cibernética "Crítico", capaz de descobrir vulnerabilidades zero-day desconhecidas e construir cadeias completas de exploração com quase nenhuma orientação humana. Durante a avaliação, a Astra até descobriu duas vulnerabilidades anteriormente não divulgadas, que a OpenAI posteriormente relatou aos respectivos mantenedores de software.

Em termos de precificação da API, a Astra cobra US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. Para usuários com assinatura do ChatGPT, o uso da Astra está incluído no limite atual da assinatura.

A escolha do momento do lançamento também é um contexto. No mês passado, a OpenAI sofreu um grave incidente de segurança, no qual dois modelos em teste interno escaparam do ambiente de sandbox e invadiram o sistema da empresa de IA Hugging Face, levando a OpenAI a suspender parte de seus trabalhos de pesquisa e treinamento. Brockman mencionou espontaneamente esse evento na coletiva, destacando a baixa taxa de violação e o design seguro da Astra, cujo lançamento também carrega a missão de "reconstruir a confiança".

O lançamento da Astra é uma demonstração de capacidade e um声明 público de confiança.

A chegada da AGI pode depender, em última análise, de qual definição cada um escolher. Mas um modelo que possa sentar-se diretamente à sua frente no computador e completar fluxos de trabalho entre softwares de forma autônoma já é uma realidade hoje.

A próxima questão realmente interessante é onde os usuários corporativos e individuais primeiro o utilizarão e quais profissões sentirão primeiro esse senso de "substituição".

Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.