A OrcaRouter lanca o OrcaCyber Zero 1.5, um modelo de IA especializado em ciberseguranca, com janelas de contexto de 1 milhao de tokens e desempenho declarado de 100% em benchmarks de ataque defensivo. O modelo e o sucessor direto do OrcaCyber Zero 1.0, lanca em 17 de setembro de 2026, e marca a segunda iteracao de um projeto que busca posicionar a IA como ferramenta de defesa ativa em vez de deteccao passiva.
A proposta central do Zero 1.5 e simples em declaracao, ambiciosa em execucao: "menos relatorios, mais vulnerabilidades validadas e corrigidas." O modelo foi treinado para pesquisa de vulnerabilidades autorizada, reproducao de exploits, desenvolvimento de exploits, testes de penetracao e auditoria de seguranca.
Os numeros
Os resultados reportados pelo proprio fornecedor, avaliados em 10 de outubro de 2026:
- Cybench: 100% (39 de 39 tarefas, execucao de agente irrestrita)
- CVE-Bench: 95.8% (23 de 24 tarefas avaliaveis)
- HumanEval+: 93.9%
- SWE-bench Pro V2: 76.5% (menor pontuacao publicada)
O Cybench contem 40 tarefas profissionais de CTF (Capture The Flag). Os 39 tarefas avaliaveis cobrem a maior parte do benchmark. O CVE-Bench e construido sobre 40 CVEs de severidade critica em web. O Zero 1.5 cobriu um subconjunto de 24 tarefas avaliaveis.
A pontuacao no SWE-bench Pro V2 nao e diretamente comparavel com os resultados padrao do SWE-bench Pro, o que qualifica o numero como um limite inferior em vez de um ponto de referencia absoluto.
O que torna o Zero 1.5 diferente
Tras tres objetivos de design declarados:
Primeiro, encontrar o que os outros perdem: falhas desconhecidas como execucao remota de codigo (RCE), escapes de sandbox, contornamentos de autenticacao, escalonamento de privilegios e cadeias de ataque multi-etapa.
Segundo, ir alem da deteccao: raciocinar sobre caminhos de ataque, questionar suas proprias hipoteses e ranquear falhas por exploitabilidade demonstravel.
Terceiro, ser construido para agentes autonomos: 1 milhao de tokens de contexto, tool calling nativo e raciocinio estendido para codebases de grande porte.
Preco e acesso
O modelo e disponivel apenas via API hospedada da OrcaRouter, sem pesos abertos e sem variantes quantizadas. O preco e de US$ 3,00 por 1 milhao de tokens de entrada e US$ 7,50 por 1 milhao de tokens de saida. Leituras de cache custam US$ 0,75 por 1 milhao de tokens.
O acesso e limitado a uma tier de "Security Research," com requisitos de contrato, passkey e termos aceitos. O alvo sao pesquisadores de seguranca confiaveis, equipes red e testes autorizados.
Contexto de mercado
O lancamento se insere em uma corrida crescente de modelos especializados em ciberseguranca:
- Claude Mythos Preview (Anthropic, abril 2026): modelo fronteira geral, US$ 25/US$ 125 por 1M tokens
- GPT-5.5-Cyber (OpenAI, junho 2026): GPT-5.5 ajustado para ciber, acesso a defensores verificados
- Sakana Fugu-Cyber (Sakana AI, julho 2026): orquestracao multi-agente, acesso por avaliacao de aplicacao
O Zero 1.5 se destaca pelo preco significativamente menor que os concorrentes e pela especializacao em ciberseguranca em vez de ser um modelo generalista com capacidades de seguranca.
A ressalva
Todos os numeros sao reportados pelo proprio fornecedor. Nao ha um reporte tecnico independente disponivel. O subconjunto do CVE-Bench usado (24 tarefas em vez de 40) e um detalhe que qualifica a pontuacao de 95.8%. A ausencia de pesos abertos impede verificacao independente do modelo.
Fontes: MarkTechPost. OrcaRouter.
Fontes e referências
Encontrou uma informação que precisa de correção? Fale com a redação.
