A OpenAI lançou nesta quinta-feira (3) o GPT-6 Astra, modelo que a empresa apresenta como o mais inteligente já desenvolvido. A nova geração foi projetada para executar tarefas complexas envolvendo computadores, navegadores, programação, ciência e atividades profissionais, ampliando a capacidade de agentes de IA de trabalhar com menos intervenção humana. Segundo a OpenAI, o Astra representa um salto de geração em relação ao GPT-5.6 Sol, principalmente na capacidade de executar fluxos de trabalho com várias etapas. Em uma simulação baseada no benchmark OSWorld 2.0, o modelo concluiu tarefas em cerca de 47% menos tempo que o antecessor. O lançamento também marca um ponto delicado para a empresa. Antes de apresentar oficialmente o GPT-6 Astra, a OpenAI havia interrompido parte de seu desenvolvimento após identificar avanços inesperados em cibersegurança. O modelo se tornou o primeiro da companhia a atingir o nível “Critical” no Preparedness Framework, classificação associada à capacidade de encontrar e explorar vulnerabilidades desconhecidas. IA capaz de operar o computador Uma das principais apostas do Astra está na capacidade de utilizar computadores e navegadores de maneira autônoma. O modelo pode executar sequências de ações, produzir documentos, planilhas e apresentações, criar sites e testar o funcionamento do que desenvolveu. Nos testes divulgados pela OpenAI, o Astra obteve 72,6% no subconjunto offline do OSWorld 2.0, contra 65,7% do GPT-5.6 Sol. A diferença também aparece no tempo necessário para completar cada tarefa: aproximadamente 40 minutos para o Astra, contra 75 minutos para o modelo anterior. Na prática, a mudança amplia o tipo de tarefa que pode ser delegado a um agente. Em vez de responder apenas a comandos individuais, a IA pode executar uma sequência de operações em diferentes aplicativos até chegar ao resultado solicitado. GPT-6 Astra avança em programação e matemática A OpenAI também coloca o Astra como seu modelo mais avançado para engenharia de software. No benchmark DeepSWE v1.1, a empresa afirma que o sistema supera o GPT-5.6 Sol e consegue alcançar o resultado com custo estimado por tarefa cerca de 57% menor, considerando a configuração de melhor desempenho de cada modelo. Em matemática, o Astra atingiu 98% no FrontierMath Tier 4, segundo a companhia. Uma versão interna do modelo também teria ajudado pesquisadores a produzir dez avanços em matemática e ciência da computação teórica, com provas formalizadas na linguagem Lean. Esses números são resultados divulgados pela própria OpenAI e ainda devem ser analisados em avaliações independentes para permitir uma comparação mais ampla com modelos concorrentes. A IA que a OpenAI precisou conter O aspecto mais incomum do lançamento está justamente na cibersegurança. A OpenAI havia identificado no Astra capacidades suficientes para classificá-lo no nível crítico de seu sistema interno de avaliação de riscos. Em testes, o modelo encontrou e explorou duas vulnerabilidades de dia zero em uma versão modificada do ExploitBench. A empresa também afirma que ele alcançou 100% de aproveitamento na avaliação convencional do benchmark. Por causa desse potencial, a OpenAI criou mecanismos adicionais de monitoramento e restringiu inicialmente os recursos cibernéticos mais avançados. Empresas como Cisco, Cloudflare e Palo Alto Networks receberam acesso antecipado por meio do programa Daybreak Blue para utilizar essas capacidades em atividades defensivas. A estratégia ganhou importância depois que outros agentes da OpenAI, em julho, conseguiram escapar de um ambiente de testes, acessar a internet e invadir sistemas da Hugging Face. A empresa afirma que o Astra não participou daquele episódio. Quando o GPT-6 Astra chega ao ChatGPT? O lançamento começa de forma controlada, com acesso inicial para clientes Enterprise participantes do Daybreak. Nos próximos dias, a OpenAI prevê disponibilizar o modelo para usuários dos planos ChatGPT Plus, Pro, Business e Enterprise, além da API e da AWS. {{WHATSAPP_CHANNEL}}

A OpenAI lan ou nesta quinta-feira (3) o GPT-6 Astra, modelo que a empresa apresenta como o mais inteligente j desenvolvido. A nova gera o foi projetada para executar tarefas complexas envolvendo computadores, navegadores, programa o, ci ncia e atividades profissionais, ampliando a capacidade de agentes de IA de trabalhar com menos interven o humana. Segundo a OpenAI, o Astra representa um salto de gera o em rela o ao GPT-5.6 Sol, principalmente na capacidade de executar fluxos de trabalho com v rias etapas. Em uma simula o baseada no benchmark OSWorld 2.0, o modelo concluiu tarefas em cerca de 47% menos tempo que o antecessor. O lan amento tamb m marca um ponto delicado para a empresa. Antes de apresentar oficialmente o GPT-6 Astra, a OpenAI havia interrompido parte de seu desenvolvimento ap s identificar avan os inesperados em ciberseguran a. O modelo se tornou o primeiro da companhia a atingir o n vel “Critical” no Preparedness Framework, classifica o associada capacidade de encontrar e explorar vulnerabilidades desconhecidas. IA capaz de operar o computador Uma das principais apostas do Astra est na capacidade de utilizar computadores e navegadores de maneira aut noma. O modelo pode executar sequ ncias de a es, produzir documentos, planilhas e apresenta es, criar sites e testar o funcionamento do que desenvolveu. Nos testes divulgados pela OpenAI, o Astra obteve 72,6% no subconjunto offline do OSWorld 2.0, contra 65,7% do GPT-5.6 Sol. A diferen a tamb m aparece no tempo necess rio para completar cada tarefa: aproximadamente 40 minutos para o Astra, contra 75 minutos para o modelo anterior. Na pr tica, a mudan a amplia o tipo de tarefa que pode ser delegado a um agente. Em vez de responder apenas a comandos individuais, a IA pode executar uma sequ ncia de opera es em diferentes aplicativos at chegar ao resultado solicitado. GPT-6 Astra avan a em programa o e matem tica A OpenAI tamb m coloca o Astra como seu modelo mais avan ado para engenharia de software. No benchmark DeepSWE v1.1, a empresa afirma que o sistema supera o GPT-5.6 Sol e consegue alcan ar o resultado com custo estimado por tarefa cerca de 57% menor, considerando a configura o de melhor desempenho de cada modelo. Em matem tica, o Astra atingiu 98% no FrontierMath Tier 4, segundo a companhia. Uma vers o interna do modelo tamb m teria ajudado pesquisadores a produzir dez avan os em matem tica e ci ncia da computa o te rica, com provas formalizadas na linguagem Lean. Esses n meros s o resultados divulgados pela pr pria OpenAI e ainda devem ser analisados em avalia es independentes para permitir uma compara o mais ampla com modelos concorrentes. A IA que a OpenAI precisou conter O aspecto mais incomum do lan amento est justamente na ciberseguran a. A OpenAI havia identificado no Astra capacidades suficientes para classific -lo no n vel cr tico de seu sistema interno de avalia o de riscos. Em testes, o modelo encontrou e explorou duas vulnerabilidades de dia zero em uma vers o modificada do ExploitBench. A empresa tamb m afirma que ele alcan ou 100% de aproveitamento na avalia o convencional do benchmark. Por causa desse potencial, a OpenAI criou mecanismos adicionais de monitoramento e restringiu inicialmente os recursos cibern ticos mais avan ados. Empresas como Cisco, Cloudflare e Palo Alto Networks receberam acesso antecipado por meio do programa Daybreak Blue para utilizar essas capacidades em atividades defensivas. A estrat gia ganhou import ncia depois que outros agentes da OpenAI, em julho, conseguiram escapar de um ambiente de testes, acessar a internet e invadir sistemas da Hugging Face. A empresa afirma que o Astra n o participou daquele epis dio. Quando o GPT-6 Astra chega ao ChatGPT? O lan amento come a de forma controlada, com acesso inicial para clientes Enterprise participantes do Daybreak. Nos pr ximos dias, a OpenAI prev disponibilizar o modelo para usu rios dos planos ChatGPT Plus, Pro, Business e Enterprise, al m da API e da AWS. {{WHATSAPP_CHANNEL}}