Gasta muito token, embora tenha um sistema/harness de orquestração com um modelo com mais processamento como opus vs execução de tarefas com um menor / sonnet
Não gera muitos falsos positivos por que tem etapas de validação / autotriagem.
A grande questão que sinto em relação a ter skills que fazem esse debate entre as coisas encontradas e você ir direcionando é que sim, ele faz uma cobertura maior. E por consequência gasta muito mais tokens, por outro lado direcionando você consegue achar bugs muito mais sérios que a triagem talvez tenha deixado passar / algum bypass que você lembra, ou até alguns pensamentos durante o processo de exploração que se você tivesse digitado e entrado esse pensamento como prompt/input, teria encontrado a falha.
Outra questão é que quando estamos direcionando a exploração nós tendemos a dar mais contexto para aquele cenário, o que facilita inclusive a IA entender o impacto, entender o que olhar etc
Não gera muitos falsos positivos por que tem etapas de validação / autotriagem.
A grande questão que sinto em relação a ter skills que fazem esse debate entre as coisas encontradas e você ir direcionando é que sim, ele faz uma cobertura maior. E por consequência gasta muito mais tokens, por outro lado direcionando você consegue achar bugs muito mais sérios que a triagem talvez tenha deixado passar / algum bypass que você lembra, ou até alguns pensamentos durante o processo de exploração que se você tivesse digitado e entrado esse pensamento como prompt/input, teria encontrado a falha.
Outra questão é que quando estamos direcionando a exploração nós tendemos a dar mais contexto para aquele cenário, o que facilita inclusive a IA entender o impacto, entender o que olhar etc