Todas as verticais

schema_pack · ops

Operações e infraestrutura

Runbooks, postmortems e infra docs vivos, validados contra a realidade.

Times de ops mantêm runbooks, postmortems e documentação de infra. O problema clássico: documentação envelhece, divergem da realidade, e quem chega no on-call descobre na pior hora. ValorBrain combina canonical sources com reality probes: o documento canônico é re-validado periodicamente contra o sistema real.

O que muda

Mesmo trabalho, com e sem memória organizacional.

Sem
Com ValorBrain
Runbook de Janeiro fala de fluxo que mudou em Março. descoberto durante incidente
Schema pack "ops" estrutura: runbook, postmortem, sla, dependency, oncall, infra_change
Postmortems se perdem na pasta de docs e não são consultados em incidente parecido
Reality probes validam canonical docs contra realidade (cloudflared, systemd, k8s)
Diagrama de arquitetura desatualizado por meses sem ninguém perceber
Drift detection flagga quando INFRA.md diverge do estado real
On-call rotation muda mas o documento de "responsabilidades" continua antigo
Postmortems indexados com causes + actions, surface automaticamente em incidentes parecidos
Cross-agent: Hermes ingere logs, Claude Code escreve fix, Kiro registra postmortem

Na prática

Caminhos concretos que times já rodam.

Reality probe contra cloudflared

INFRA.md diz "22 subdomínios". Reality probe roda cloudflared list-tunnels semanalmente, encontra 25 hostnames. Drift proposal aparece com diff exato dos 3 hostnames novos.

Postmortem de outro time

On-call abre incidente parecido com um já resolvido por outro engenheiro 4 meses atrás. ValorBrain surface o postmortem antigo automaticamente com a fix aplicada e o tempo de resolução.

Runbook validado

Runbook diz "rodar systemctl restart valorbrain-watcher". Reality probe confirma o serviço existe e está enabled. Se mudar de nome, drift detecta antes de virar problema em incidente.

Schema pack ops

Tipos que o decision-extractor captura neste domain.

typecaptura
runbookProcedimentos com pré-requisitos, passos, validação
postmortemIncidentes com root cause, timeline, action items
slaSLAs com targets e medições reais
dependencyDependências entre serviços com health checks
oncallRotações com responsáveis e contatos atualizados
infra_changeMudanças aplicadas com data, autor, impacto

Agents

Clientes MCP em mcpbrain.valor.digital.

  • Claude Code
  • Hermes
  • Kiro CLI
  • agent custom monitoring

Rodar isto em operações e infraestrutura

Minutos pra conectar uma fonte. Crédito grátis no signup.