AI-DLC · o método da LEVELHARD

Do sinalà loja

O ciclo que usamos para construir software com IA, explicado para quem não é da área.

Seis estações, um agente de IA trabalhando em cada uma e uma pessoa aprovando cada passagem. Nada sai sem prova. Aqui está o ciclo inteiro, os apps que saíram dele e de onde tiramos cada ideia.

010203040506SentirDecidirConstruirPublicarMedirEvoluiro ciclovolta 01
São Paulo, Brasil · hora localmedido em 23/09/2026
rolar
nível 01

O gargalo mudou de lugar

Escrever código ficou barato: a IA já escreve boa parte dele. Só que escrever código sempre foi a menor parte do trabalho. O que continua caro é saber o que construir, conferir se funciona, colocar no ar e ouvir quem usa. Um método que só acelera o código deixa todo o resto do mesmo tamanho.

Uma semana de trabalho numa mudança
antes
descobrirespecificarcódigoconferirouvir
com a IA escrevendo
descobrirespecificarcódigoconferirouvir

O bloco do código encolheu. Os outros continuam do mesmo tamanho, e quase ninguém mede o último.

Dar uma batedeira industrial a uma confeitaria não adianta se ninguém sabe qual bolo o cliente quer, nem prova a massa antes de entregar.

A IA amplifica o que já existe, o bom e o ruim. E a sensação engana: em 2026 o mesmo estudo viu sinal de ganho, ainda com evidência fraca. Só vale o que foi medido. DORA 2025 (abre em nova aba)METR 2026 (abre em nova aba)

nível 02

A ideia em uma frase

  1. A IA faz.

    Um agente de IA, um programa que trabalha sozinho, age em cada etapa: pesquisa, escreve, testa, prepara.

  2. A pessoa decide.

    Entre uma etapa e outra, alguém aprova. O agente propõe; quem aperta o botão é gente.

  3. A máquina confere.

    Antes de dizer "pronto", uma trava automática confere a prova. Faltou, não passa.

Guarde estes sinais. Eles aparecem em todos os desenhos daqui para baixo.

  • agente de IA
  • pessoa aprovando
  • documento que passa adiante
  • trava que confere
nível 03

O ciclo

Seis estações em volta de um anel. O fim de uma volta é o começo da próxima. Para ficar concreto, vamos acompanhar um app de verdade dando a volta inteira: o Placarito, um placar para truco, vôlei e outros jogos.

São duas rodas. A grande é esta, o ciclo do produto, que gira no ritmo de quem usa: dias e semanas. A pequena gira dentro da estação Construir, no ritmo da IA: horas.

01 · estação

Sentir

Ouvir antes de construir.

O agente
Lê avaliações de apps parecidos, rankings das lojas e o que as pessoas pedem em comunidades. Transforma tudo numa lista curta de oportunidades, cada uma com a fonte.
A pessoa
Escolhe qual oportunidade vira projeto. Sem essa escolha, nada avança.
O que sai daqui
sinais.md uma lista de hipóteses, com número e link

Parece comO restaurante que lê as reclamações do concorrente antes de montar o cardápio.

02 · estação

Decidir

A planta antes da obra.

O agente
Escreve dois documentos. A intenção: o problema, o sinal, o que não entra. A especificação: o que precisa ser verdade no fim, de um jeito que dá para conferir. Desenha três soluções diferentes e compara.
A pessoa
Lê os dois documentos e aprova. É a assinatura antes da obra.
O que sai daqui
intent.md · spec.md intenção e especificação, guardadas com histórico

Parece comA planta do arquiteto, aprovada antes de levantar a primeira parede.

03 · estação

Construir

Obra em etapas curtas, com fiscal em cada uma.

O agente
Constrói em etapas pequenas, de horas, cada uma citando a especificação. Escreve o teste junto, chama um revisor especialista e tira print do app em vários tamanhos de tela, no claro e no escuro.
A pessoa
Vê os prints e o resultado dos testes. Não é quem descobre o defeito.
O que sai daqui
commit → spec código testado, com a prova junto

Parece comA obra por etapas, com o fiscal passando em cada laje antes da próxima.

04 · estação

Publicar

A esteira até a vitrine, e a mão no botão.

O agente
Monta a página do app na loja em três idiomas a partir de um arquivo só, gera as imagens, publica a política de privacidade e deixa tudo pronto até o botão de enviar.
A pessoa
Aperta o botão. O agente nunca aperta.
O que sai daqui
store.config.json o app enviado para a revisão da loja

Parece comA loja embala e confere a encomenda. Quem abre a porta é o dono.

05 · estação

Operar e medir

O termômetro fica ligado depois da entrega.

O agente
Acompanha avaliações, nota, posição na busca, falhas, e se a versão da loja ficou para trás. Número sem data não entra; o que não foi medido aparece como "não medido", nunca como zero.
A pessoa
Olha o painel toda semana e decide o que merece atenção.
O que sai daqui
painel do ciclo um painel com data

Parece comO médico que acompanha o paciente depois da alta.

06 · estação

Evoluir

O fim vira começo.

O agente
Transforma o que as pessoas disseram numa nova intenção. Defeito que dá para reproduzir vira correção na mesma semana; o resto vira hipótese para a pessoa escolher.
A pessoa
Escolhe o que entra na próxima volta.
O que sai daqui
o próximo intent.md a intenção da próxima volta

Parece comO caderno de receitas que muda com o que o cliente pediu na semana.

nível 04

Onde a pessoa decide

Nem todo agente pode tudo. A autonomia sobe por degrau, e subir de degrau é uma decisão escrita num arquivo, não no calor de uma conversa.

  1. 01

    Observar

    Só lê. Não muda nada.

  2. 02

    Aconselhar

    Recomenda. A pessoa executa.

  3. 03

    Agir com aprovação

    Propõe, a pessoa aprova, o agente executa.

    hoje
  4. 04

    Agir com disjuntor

    Executa sozinho, e a pessoa pode desligar a qualquer momento.

    ainda não

Tudo o que vai para a loja ou para o ar fica no terceiro degrau.

O agente nunca apertaEnviar

É como o carro: o que só avisa que você saiu da faixa, o que corrige a direção, o que dirige com você de olho. Ninguém entrega o volante inteiro no primeiro dia.

O Gartner recomenda exatamente isso, governança de agentes em quatro níveis, e prevê que 40% das empresas vão rebaixar ou desligar agentes até 2027 por falta dela. Gartner 2026 (abre em nova aba)SAE J3016 (abre em nova aba)

nível 05

Pronto só com prova

Quando o agente diz "terminei", uma trava automática confere a lista daquela tecnologia. Faltou prova, a porta não abre.

A lista de um app de iPhone

  1. O projeto gera do zero
  2. Compila
  3. Os testes passam
  4. O revisor especialista aprovou
  5. Print em cada tamanho de tela, no claro e no escuro

pronto

É o checklist do piloto antes de decolar, e o cordão da fábrica da Toyota que qualquer pessoa pode puxar para parar a linha. Aqui, quem puxa é a própria máquina. Gawande 2009 (abre em nova aba)Toyota (abre em nova aba)

O erro que virou trava

Uma versão de um dos nossos apps foi para a loja sem três arquivos que não moravam junto com o código, e abriu quebrada para quem baixou. O conserto não ficou só no app: a publicação agora confere o conteúdo do pacote e se recusa a enviar sem eles.

Para quem quer saber mais

Uma trava que prende sempre acaba desligada na primeira semana. Por isso esta desiste depois de três recusas seguidas e vira aviso. E cada decisão dela fica registrada num arquivo que sobrevive à conversa, com a versão das regras que autorizou a entrega.

nível 06

Segurança em toda volta

Quando a IA escreve mais código, mais rápido, sobra mais lugar para uma falha passar despercebida. Por isso a segurança não é uma etapa no fim, antes de publicar: ela aparece nas seis estações. E quem faz os testes é uma ferramenta nossa, de código aberto: o RoqueShield.

A pergunta que guia tudo

Zero falhas encontradas quer dizer que está limpo, ou que o teste nem rodou?

Um scanner quebrado e um sistema limpo mostram a mesma tela: zero achados. O RoqueShield nasceu para separar os dois. Scanner que não conseguiu verificar entra no relatório como pulado, e a cobertura aparece incompleta. Nunca vira um zero calado.

É o detector de fumaça sem bateria: fica quieto igualzinho ao que está funcionando.

Onde ela aparece no ciclo

  1. 01

    Sentir

    Oportunidade que obrigaria a guardar dado de alguém num servidor nosso reprova antes de virar projeto.

  2. 02

    Decidir

    A especificação decide o que não vai existir: sem conta, sem servidor, dado só no aparelho. O que não existe não vaza.

  3. 03

    Construir

    Toda mudança passa pela varredura do RoqueShield antes do "pronto". Peça de terceiro com falha conhecida e correção publicada não passa, e pacote novo é conferido: existe, tem dono, não é nome de impostor.

  4. 04

    Publicar

    Senha e chave nunca vão dentro do app. As credenciais da loja entram por um cofre, sem aparecer na tela nem no histórico da conversa.

  5. 05

    Medir

    O que está no ar pode ser testado por fora, do jeito que um atacante veria: a aplicação rodando, a rede e o que o domínio deixa aparecer na internet.

  6. 06

    Evoluir

    Cada falha vira um pacote de conserto que o agente lê: arquivo, linha e como corrigir. O conserto só vale quando a varredura seguinte não acha mais a falha, com todos os scanners rodando.

RoqueShield

Teste de segurança contínuo que se recusa a ficar calado.

Ver no GitHub

O que ele faz, em cinco passos

  1. 01

    Varre

    Roda a ferramenta certa para cada tipo de alvo: código, dependência, aplicação no ar, rede.

  2. 02

    Junta

    O mesmo problema achado por duas ferramentas vira um só, com a gravidade maior.

  3. 03

    Tria

    Uma IA reordena a gravidade, marca o provável alarme falso e sugere o conserto, lendo a evidência já sem dado pessoal.

  4. 04

    Confirma

    Sob demanda, um agente tenta provar um achado de verdade, num ambiente de ataque controlado.

  5. 05

    Entrega

    Um pacote de conserto que outro agente lê e transforma em correção. Depois, varre de novo.

Os tipos de teste

  • SAST

    O código parado

    Semgrep

  • segredos

    Senha esquecida no código

    Gitleaks · Trufflehog

  • dependências e imagens

    Peça de terceiro com falha conhecida

    Trivy

  • infraestrutura como código

    Configuração de nuvem

    Checkov

  • DAST

    A aplicação rodando

    OWASP ZAP · Nuclei

  • rede

    A rede

    Nmap · Greenbone

  • exposição

    O que aparece na internet

    Shodan · subdomínios · domínios parecidos · vazamento no GitHub

A IA que ataca tem coleira em código

O agente que confirma um achado roda ferramenta de ataque de verdade, então o limite dele não é uma frase no prompt. É código conferido antes de cada comando: lista do que pode rodar em cada fase, alvo validado, sem shell, tempo máximo, e modo de laboratório ligado de fábrica. Toda decisão, inclusive toda recusa, fica na trilha de auditoria.

O dado não sai sem permissão

Dado pessoal e de cartão é apagado da evidência antes de qualquer IA ler. Com modelo local e a nuvem desligada, se o modelo local falha o teste falha, em vez de mandar o achado para fora.

Código aberto, licença Apache 2.0. Está em alfa, e o que ainda não está pronto está escrito no próprio README.

15 scanners atrás de um contrato só · 302 testes automáticos · varredura na lista de aceite de 11 das 11 tecnologias da família · medido em 23/09/2026

O cuidado não é teórico. Num estudo com 576 mil amostras de código gerado por IA, os modelos abertos citaram em média 21,7% de pacotes que não existem, e os comerciais, pelo menos 5,2%. Quem registra um desses nomes primeiro entra no projeto de quem confiou. USENIX 2025 (abre em nova aba)

nível 07

Custo também é requisito

Custo não aparece na fatura por acaso: ele é decidido na planta. Por isso a arquitetura é escolhida na estação Decidir, com o custo de operar na mesa, e cada estação cuida do que gasta, inclusive da própria IA.

O servidor mais barato é o que não existe.

Os apps novos nascem sem conta, sem servidor e com o processamento no aparelho, inclusive a IA. Não existe conta de nuvem que cresce com o número de usuários, e o dado pessoal fica fora do nosso alcance por desenho: custo e segurança saem da mesma decisão.

É o que a FinOps Foundation pede: todo mundo é dono do que usa, e o valor para o negócio decide a tecnologia. E é a definição da AWS para uma carga otimizada: o resultado no menor preço que ainda cumpre os requisitos. FinOps (abre em nova aba)AWS 2024 (abre em nova aba)

Cada tarefa no seu preço

Onde ele aparece no ciclo

  1. 01

    Sentir

    Oportunidade que só funciona com servidor, sincronização entre aparelhos ou IA que roda só na nuvem reprova antes de virar projeto.

  2. 02

    Decidir

    A arquitetura é escolhida aqui: três desenhos competem, e o conselheiro caro é chamado para a decisão, conferindo no mapa o que mais muda.

  3. 03

    Construir

    Cada tarefa usa o modelo do tamanho dela, e o que dá para conferir com um programa comum não gasta IA nenhuma.

  4. 04

    Publicar

    A lista de conferência roda na máquina, antes do envio, em vez de numa esteira paga na nuvem. E este site é estático: não tem servidor para pagar nem para cair.

  5. 05

    Medir

    O custo é medido como qualquer indicador. Quanto contexto o kit carrega em toda sessão é medido antes de fechar cada versão dele.

  6. 06

    Evoluir

    O que custa mais do que devolve é desligado com o número na mão. Foi assim com a esteira paga e com os processos de muitos agentes.

Como escolhemos a arquitetura

  1. 01

    Três desenhos antes de um.

    Quando há mais de um caminho, três projetos independentes competem, e o vencedor leva os melhores pedaços dos outros. A primeira ideia ancora as seguintes; o painel desfaz a âncora.

  2. 02

    O modelo caro só na hora cara.

    Três papéis, três preços: um modelo barato varre, um médio constrói o dia inteiro, e o mais caro só é chamado para arquitetura, ação sem volta ou trava que falhou duas vezes.

  3. 03

    Programa antes de IA.

    As 12 travas automáticas e as listas de conferência rodam como programa comum: custo zero de IA e resposta em milissegundos.

  4. 04

    Medir antes de cortar.

    A esteira de integração paga foi desligada depois de medida: reprovava sempre, pelo motivo errado. Os 7 processos de muitos agentes ficam parados, porque uma execução custa mais que um dia inteiro de trabalho.

nível 08

A caixa de ferramentas

Nada disso mora na cabeça de ninguém. Mora num plugin, um pacote que qualquer sessão de IA carrega ao abrir, e que leva a regra aprendida num app para todos os outros.

roqueos-kit
  • A–Z

    O manual da casa

    contexto

    O que já foi decidido e não se reabre, e o vocabulário de cada produto.

  • 5

    As receitas

    skills

    O passo a passo do que se repete: testar no simulador, montar a página da loja, medir o impacto de uma mudança.

  • 13

    Os especialistas

    agentes revisores

    Um para cada tecnologia, olhando só o que mudou.

  • 12

    As travas automáticas

    hooks

    Disparam sozinhas: segredo vazando, publicação por fora do caminho, fim sem prova, texto com cara de IA.

  • 101

    A lista de conferência

    gates · em 11 tecnologias

    O critério de aceite de cada tecnologia, escrito para a máquina executar.

  • 7

    As linhas de produção

    workflows

    Processos inteiros com vários agentes. Ficam desligados por custo, e só rodam quando alguém libera.

  • 14

    Os medidores

    ferramentas

    Sinal das lojas, mapa de dependências, cofre de segredos, painel do ciclo.

  • 34

    O mapa da casa

    34 peças ligadas por 45 dependências. Antes de mexer numa delas, o mapa diz o que mais precisa mudar, e em que ordem.

ClaudeCodex

Dois agentes, um método

O mesmo método roda com o Claude, pelo plugin no Claude Code e no Cowork, e com o Codex, pelo arquivo de instruções que ele lê. Não depende de fornecedor.

contado do disco em 23/09/2026 · kit 2.18.1 · desde 18/07/2026

nível 09

O que saiu do ciclo

A fábrica de apps passou a rodar o ciclo inteiro em 10/09/2026. O que está abaixo vem direto da App Store e do histórico do código.

  • 6
    apps começados
  • 6
    já na App Store
  • 14
    dias corridos
  • 2–8
    dias do início à loja
Do primeiro commit à App Store
  1. Placarito
    5 dias
  2. Qrie
    8 dias
  3. Arrumio
    2 dias
  4. Garfada
    7 dias
  5. Brindilo
    5 dias
  6. Zelipata
  • Placarito

    v1.0.0

    Placar para truco, vôlei e outros jogos, sem anúncio no meio da partida.

    de onde veio

    "As propagandas não fecham. Impossível usar o App." (avaliação de uma estrela de um marcador de truco com 10 mil avaliações)

    começou
    10/09/2026
    na loja
    15/09/2026
     
    5 dias
    Abrir na App Store
  • Qrie

    v1.0.0

    QR code com estilo, inclusive Pix, feito no próprio iPhone.

    de onde veio

    "Absurda a quantidade de propaganda ou $$ para algo tão simples." (avaliação do gerador de QR que liderava a busca da App Store)

    A Apple recusou uma vez porque a descrição citava outra loja. Corrigido no dia seguinte.

    começou
    10/09/2026
    na loja
    18/09/2026
     
    8 dias
    Abrir na App Store
  • Arrumio

    v1.2.0

    Checklist de mala que roda inteira no aparelho, com assistente local.

    de onde veio

    A escolha do fundador para testar o ciclo inteiro num app simples. Depois, nove voltas puxadas pelo uso dele.

    começou
    16/09/2026
    na loja
    18/09/2026
     
    2 dias
    Abrir na App Store
  • Garfada

    v1.0.0

    Diário alimentar que roda inteiro no iPhone, com a tabela brasileira de alimentos.

    de onde veio

    Anúncio e assinatura são as duas maiores reclamações em 50 mil avaliações de apps de dieta, e o app brasileiro mais conhecido está parado desde 2024.

    começou
    16/09/2026
    na loja
    23/09/2026
     
    7 dias
    Abrir na App Store
  • Brindilo

    v1.1.1

    Organizador de encontros pequenos: tarefas, compras e roteiro do anfitrião.

    de onde veio

    Os apps de convite cuidam de quem é convidado. Faltava cuidar de quem organiza.

    começou
    18/09/2026
    na loja
    23/09/2026
     
    5 dias
    Abrir na App Store
  • Zelipata

    v1.2.0

    Guia e rotina para quem deixa o pet com alguém, que o cuidador lê sem instalar nada.

    de onde veio

    Quem viaja precisa passar rotina, remédio e contatos do pet num guia claro, sem cadastro.

    na loja
    23/09/2026

    o histórico do código começa depois do trabalho

    Abrir na App Store

Chegar à loja é metade do ciclo. A outra metade é gente usando, e ela está começando agora: os 6 apps somam 0 avaliações até 23/09/2026. Ainda não dá para dizer se acertamos.

O mesmo fluxo também atualiza apps que já estavam na loja, como o Cadentia e o Letreo.

Esta página também passou pelo ciclo que ela explica.

nível 10

Não inventamos do zero

O ciclo é a soma de ideias públicas, algumas com décadas. O que fizemos foi montar a versão que roda, com trava, e publicar o que saiu dela.

Onde fomos além

  1. 01

    O ciclo começa no que o usuário diz, não no pedido de alguém.

  2. 02

    Pronto só com prova, e quem cobra a prova é uma trava automática.

  3. 03

    A autonomia de cada agente é um dado escrito, não uma conversa.

  4. 04

    Uma caixa de ferramentas só para todos os produtos, com mais de um agente de IA.

  5. 05

    O resultado está publicado, com data.

nível 11

Os limites, ditos por nós

  • O ciclo de mercado dos apps novos ainda não fechou. Com tão poucas avaliações, não dá para dizer se acertamos.

  • Simulador dá falsa confiança. Uma IA que respondia bem no computador disse "modelo não pronto" no iPhone de verdade.

  • Tentamos rodar tudo num modelo de IA local, na nossa máquina. Não deu: hoje ele serve de ferramenta numa etapa, não de motor do ciclo.

  • Liberação gradual por grupo, teste A/B e métrica de retenção ficam de fora. Os apps novos não coletam dados de uso, por decisão.

  • O RoqueShield está em alfa. O agente que confirma um achado e a coleira dele funcionam e têm teste; o contêiner que empacota esse agente ainda não vem pronto, e o README dele diz isso.

  • O custo ainda não tem painel por app. O que medimos hoje é o contexto que o kit carrega em toda sessão e o que foi desligado por custo.

nível 12

Glossário e perguntas

As palavras, sem jargão

Agente
Um programa de IA que executa tarefas sozinho: lê, escreve, testa, pesquisa.
Intenção (intent)
O documento que diz qual problema resolver, com qual sinal, e o que fica de fora.
Especificação (spec)
A planta: o que precisa ser verdade no fim, escrito de um jeito que dá para conferir.
Bolt
Uma etapa curta de construção, de horas, com começo, fim e teste.
Gate
A lista de conferência que a máquina executa antes de liberar.
Evidência
A prova: o resultado dos testes, o print da tela.
Hook
Uma trava automática que dispara num momento certo, como ao tentar encerrar sem prova.
Varredura (scan)
O teste automático que procura falha de segurança num código, num sistema ou numa rede.
CVE
O número público de uma falha conhecida num software, como a ficha de um recall.
SAST e DAST
O teste que lê o código parado, e o teste que ataca a aplicação rodando.
FinOps
Tratar custo de nuvem e de IA como responsabilidade de quem constrói, com dado, dono e data.
Plugin
O pacote que leva regras, receitas e travas para qualquer sessão de IA.
Skill
Uma receita: o passo a passo de uma tarefa que se repete.
Losango
O ponto do ciclo em que uma pessoa aprova.
Disjuntor
O botão que desliga o agente na hora, no degrau mais alto de autonomia.

Perguntas

A IA substitui o programador?

Aqui, não. Ela executa. A pessoa decide o que construir, aprova cada passagem e aperta o botão final.

Quanto tempo leva um app?

Os apps novos levaram de 2 a 8 dias do primeiro commit à App Store, contando a revisão da Apple.

Posso usar o método?

O esqueleto é público, e as fontes estão logo abaixo. O que a LEVELHARD mostra aqui é a versão que roda, com as travas e os números.

Funciona fora de app de celular?

Funciona. Este site foi feito assim, em rodadas com teste, print conferido e publicação só com ordem.

Fontes

Cada número de fora vem de uma fonte primária, conferida em 23/09/2026. Quando é número de fornecedor, está dito.

Não acreditamos em IA de slide.Acreditamos na que roda.

nível 13

Quer ver o ciclo rodando?

Os apps estão nas lojas e a conversa está aberta: IA no ciclo de desenvolvimento, um produto para construir junto, ou só curiosidade sobre como isso é feito.