OpenAI lança GPT-5.6-Cyber que completa 95% das tarefas de cibersegurança avançada e revela que o público recebe apenas 1,5% dessas capacidades

A OpenAI lançou o GPT-5.6-Cyber, exclusivo do programa Daybreak Red, que encontrou duas vulnerabilidades de dia zero no Chrome e conclui 95% das tarefas de cibersegurança avançada. Para comparação, o GPT-5.6 Sol público conclui apenas 1,5% das mesmas solicitações. O Daybreak agora tem dois níveis com diferentes graus de capacidade desbloqueada.
OpenAI lança novo modelo de cibersegurança GPT-5.6-Cyber

A OpenAI acabou de revelar que o GPT-5.6 que o público usa tem 1,5% das capacidades de cibersegurança do modelo completo. E isso é intencional.

Existe uma forma de transparência corporativa que é ao mesmo tempo reveladora e perturbadora. Quando a OpenAI publica que o GPT-5.6-Cyber, o modelo exclusivo do programa Daybreak Red, conclui 95% das tarefas de cibersegurança avançada enquanto o GPT-5.6 Sol disponível ao público conclui apenas 1,5% das mesmas solicitações, está revelando algo sobre a natureza do que os modelos de fronteira são capazes quando seus limites são removidos.

Não é que o modelo público seja menos inteligente. É que as salvaguardas que impedem o modelo de realizar tarefas de cibersegurança ofensiva, como desenvolver cadeias de exploração, fazer bypass de autenticação e escalar privilégios, são muito mais restritivas do que o desempenho técnico do modelo exigiria. A diferença entre 1,5% e 95% é a medida da restrição, não da capacidade.

O lançamento do GPT-5.6-Cyber junto com a expansão do programa Daybreak em dois níveis é a estrutura que a OpenAI está construindo para oferecer capacidades desbloqueadas a quem tem autorização, enquanto mantém o modelo público bem abaixo do teto de capacidade técnica.

O que o GPT-5.6-Cyber demonstrou na prática

Para validar as capacidades do modelo, a OpenAI escolheu um alvo representativo: o V8, o mecanismo JavaScript que alimenta o Chrome, usado por mais de três bilhões de pessoas e um dos targets mais auditados da história do software. Encontrar vulnerabilidades de dia zero no V8 não é trivial; pesquisadores de segurança de alto nível trabalham meses para encontrar uma.

O GPT-5.6-Cyber encontrou duas vulnerabilidades de dia zero no V8 que eram até então desconhecidas e exploráveis. A OpenAI comunicou responsavelmente ao Google antes de tornar o resultado público, e as vulnerabilidades já foram corrigidas.

O resultado é significativo por duas razões. A primeira é técnica: demonstra que o modelo tem capacidade real de pesquisa de segurança ofensiva em nível que rivaliza com pesquisadores humanos especializados. A segunda é de política: a OpenAI está sendo transparente sobre o que o modelo pode fazer, estabelecendo credibilidade para as salvaguardas que o impedem de fazer o mesmo publicamente.

A diferença entre 57,3% e 95%: o salto do GPT-5.5-Cyber para o GPT-5.6-Cyber

A comparação interna que a OpenAI publicou entre seu modelo de cibersegurança anterior, o GPT-5.5-Cyber, e o novo GPT-5.6-Cyber é igualmente reveladora sobre o ritmo de evolução dessas capacidades.

Em testes com prompts envolvendo desenvolvimento de cadeias de exploração, bypass de autenticações, escalonamento de privilégios e cenários avançados de cibersegurança, o GPT-5.5-Cyber completava 57,3% das solicitações. O GPT-5.6-Cyber completa 95%.

Esse aumento de 57,3% para 95% numa única geração de modelo representa uma aceleração na capacidade de cibersegurança que é preocupante quando se pensa na trajetória. Se a próxima geração mantiver a mesma taxa de melhoria, estaremos próximos de capacidades que não têm precedente em pesquisa de segurança automatizada.

O benchmark ExploitGym, que avalia especificamente a capacidade de transformar vulnerabilidades em exploits funcionais que executam código em ambientes controlados, confirma o padrão: o GPT-5.6-Cyber supera tanto o GPT-5.6 Sol do Daybreak Blue quanto o GPT-5.5-Cyber do nível Red anterior.

A estrutura Daybreak Blue e Red

O programa Daybreak, lançado pela OpenAI como iniciativa de segurança e defesa, agora opera em dois níveis com propósitos e audiências distintos.

O Daybreak Blue é descrito como o ponto de partida recomendado para a maioria dos defensores. Oferece acesso ao GPT-5.6 Sol com menos salvaguardas do que o modelo público, ajustado para uso em trabalhos autorizados de segurança defensiva. Para times de segurança que precisam entender ameaças reais para construir defesas eficazes, o Blue remove as restrições que tornariam o modelo inútil para análise de ameaças, mas não desbloqueia as capacidades ofensivas mais avançadas.

O Daybreak Red é para pesquisa de vulnerabilidades, validação de exploits e testes de segurança em nível mais avançado. É onde o GPT-5.6-Cyber opera, e o acesso é presumivelmente mais restrito em termos de quem pode participar e quais são os requisitos de verificação.

A lógica da estratificação é a mesma que governa o Project Glasswing da Anthropic para o Mythos: diferentes capacidades para diferentes audiências com diferentes níveis de verificação, em vez de uma única versão pública que precisa ser restrita ao mínimo denominador comum de confiança.

O adiamento do Astra e a conexão com cibersegurança

O lançamento do GPT-5.6-Cyber chega alguns dias depois de um anúncio que parece contraditório à primeira vista: a OpenAI adiou o lançamento do seu próximo modelo flagship, o Astra, precisamente por preocupações com suas capacidades de cibersegurança.

O Astra resolveu dez problemas matemáticos que estavam sem solução há mais de uma década, demonstrando capacidades de raciocínio que excedem significativamente o GPT-5.6. E essas mesmas capacidades de raciocínio superior criam capacidades de cibersegurança que a empresa considera que precisam de controles mais robustos antes de um lançamento público responsável.

Os controles que a OpenAI está implementando para o Astra incluem ambientes isolados de teste, restrição ao uso de rede e de ferramentas, proteções nos pesos do modelo, e monitoramento de todas as aplicações agênticas incluindo treinamento e avaliação. É o tipo de cautela que o framework de revisão governamental que o GPT-5.6 passou antes de ser lançado exigiu que fosse institucionalizado.

O que isso revela sobre onde a cibersegurança de IA está chegando

A sequência de eventos desta semana conta uma história coerente sobre a trajetória da IA em cibersegurança. O Gemini 3.5 Flash Cyber do Google foi lançado como modelo leve para segurança defensiva. O Mythos 5 da Anthropic foi bloqueado e depois liberado com salvaguardas por suas capacidades de identificação de vulnerabilidades. O Claude Code invadiu sistemas de três organizações em testes. E agora a OpenAI lança o GPT-5.6-Cyber com capacidades que o público não tem acesso enquanto adia o Astra por preocupações com o que ele poderia fazer.

O padrão é de capacidades de cibersegurança avançando mais rápido do que as estruturas de governança conseguem acompanhar, e de laboratórios respondendo com uma combinação de restrição pública e acesso controlado para usuários verificados.

A estratégia de Daybreak Red com o GPT-5.6-Cyber representa a aposta da OpenAI de que a forma responsável de lidar com essa tensão não é impedir que pesquisadores de segurança tenham acesso a ferramentas avançadas, o que apenas garante que atores maliciosos com menos escrúpulos tenham vantagem, mas criar infraestrutura de acesso controlado que verifica quem usa e para quê.

Se essa estratégia é suficiente para prevenir uso indevido é uma questão que o setor ainda está respondendo em tempo real. O fato de que o GPT-5.6-Cyber encontrou dois novos zeros-days no Chrome e os comunicou responsavelmente é a demonstração de como o modelo deveria ser usado. A questão é quanto controle existe sobre quem mais consegue acesso ao Daybreak Red e com quais intenções.

Cadastre-se na nossa newsletter

Inscreva-se na newsletter para ver novas fotos, dicas e postagens no blog.​

Subscribe to My Newsletter

Subscribe to my weekly newsletter. I don’t send any spam email ever!