Confere-se por amostragem
Carga chega, o conferente abre alguns volumes, e o restante entra no sistema na confiança. O que não foi aberto vira estoque contábil — e só aparece meses depois, no inventário.
O seu WMS sabe o que deveria ter entrado. A câmera registra o que entrou de verdade — e ninguém assiste. O VWMS é o módulo que cruza os dois: roda inteligência artificial todos os dias sobre as gravações de segurança, conta os volumes de cada recebimento e cada expedição, e devolve as divergências direto para o seu WMS.
Sem trocar de câmera. Sem trocar de WMS. Sem treinar modelo — os conceitos auditados são definidos por texto.
Trecho real de uma das gravações auditadas, rodando sozinho e sem som. Alterne entre Câmera e VWMS para ver a mesma cena com e sem a saída do modelo — os rótulos e as confianças do painel vêm da análise executada nestes arquivos.
Não é falta de câmera nem falta de WMS. É que os dois nunca se olham.
Carga chega, o conferente abre alguns volumes, e o restante entra no sistema na confiança. O que não foi aberto vira estoque contábil — e só aparece meses depois, no inventário.
O DVR grava 24 horas por dia em todas as docas. Esse acervo só é aberto depois do prejuízo, para procurar um episódio já conhecido. Antes disso, é armazenamento parado.
Ele registra a intenção: a nota, o pedido, o apontamento. Se a contagem física divergiu e ninguém percebeu, o WMS repete a divergência com precisão perfeita por tempo indeterminado.
O VWMS não vive em tempo real e não disputa banda com a operação. Ele roda em lote — de madrugada, sobre o que já foi gravado — e entrega a auditoria pronta antes do primeiro turno.
RTSP, ONVIF, exportação do NVR/DVR ou uma pasta de arquivos. Qualquer câmera que já grave segurança serve — não há requisito de modelo, resolução mínima nem hardware embarcado.
Detecção de objetos de vocabulário aberto para achar a carga, e reconhecimento de ação para entender o que está acontecendo. Os alvos são descritos em texto, não treinados em dataset.
Rastreia cada volume por identidade própria, conta o que entrou e o que saiu por doca e janela de horário, mede tempo produtivo e marca os eventos que fogem do padrão.
Compara com o documento esperado e grava a ocorrência via API, webhook ou arquivo — com o trecho de vídeo anexado como evidência da divergência.
Os números abaixo saem da execução real do pipeline sobre — gravações de galpão, doca e separação. Nada aqui é estimativa de brochura: é a saída da rodada, e cada vídeo pode ser conferido um a um na página de detalhes.
Medições feitas em uma GPU NVIDIA RTX 3050 de desktop — placa de entrada, não de servidor. Em hardware de datacenter o custo por hora de câmera cai; nenhuma das contas desta página assume isso.
Mexa nos controles. A velocidade de processamento e a proporção de tempo improdutivo vêm da nossa medição real; o resto são as suas premissas, editáveis e explícitas.
Economia potencial por mês
Um recorte dos vídeos processados, que começam a rodar assim que entram na tela. Cada bloco mostra a mesma cena com e sem a saída do modelo, mais o que a rodada apurou naquele arquivo.
O mercado tem os dois extremos: câmera que conta pessoa cruzando linha, e WMS que registra o que foi digitado. Falta a camada do meio.
Entrou uma embalagem nova, um bag, um contentor de plástico? Descrever o alvo em texto basta para o modelo passar a procurá-lo. Em visão computacional tradicional isso seria coletar e rotular milhares de imagens e retreinar — semanas por item.
A diferença entre “tem gente na cena” e “essa pessoa está conferindo volume na doca” é o que transforma imagem em auditoria. O módulo classifica a ação em curso a cada janela de segundos.
Ninguém troca de WMS para ganhar auditoria. O VWMS se encaixa por API no que já está rodando — SAP EWM, Oracle, Totvs, WMS proprietário — e escreve ocorrência no formato que o sistema já entende.
Sem edge box em cada doca, sem rede dedicada, sem contrato de banda. O processamento acontece depois do expediente e a auditoria do dia anterior está pronta antes de a operação começar.
A rodada de testes usou gravações em 1080p, 1440p e 4K, na horizontal e na vertical, com 24 a 50 quadros por segundo — sem ajuste por arquivo.
O módulo publica ocorrência de divergência, contagem por doca e janela, e o link da evidência em vídeo. O WMS continua sendo a fonte da verdade — o VWMS só mostra onde ela não bate com o pátio.
Uma ocorrência por recebimento ou expedição auditada. Sem grau de confiança omitido e sem baixa automática: o módulo aponta, o time decide.
{
"tipo": "divergencia_recebimento",
"doca": "DOCA-03",
"janela": { "de": "2026-08-23T07:12:40Z", "ate": "2026-08-23T07:41:05Z" },
"documento": { "nf": "128744", "volumes_esperados": 96 },
"contagem_visual": {
"volumes_unicos": 93, // rastreados com identidade própria
"por_classe": { "caixa": 71, "palete_filmado": 22 },
"confianca_media": 0.82
},
"divergencia": { "volumes": -3, "severidade": "media" },
"evidencia": {
"video": "https://vwms.local/ev/9f3a2c.mp4",
"instantes": [ "00:07:11", "00:19:48", "00:26:02" ]
},
"acao_sugerida": "reconferencia_fisica"
}
Não. O módulo consome a gravação que a sua operação de segurança já produz. A rodada de testes rodou em resoluções e taxas de quadro diferentes, em horizontal e vertical, sem calibração por arquivo. Câmera melhor dá auditoria melhor — mas não é pré-requisito para começar.
Como não há treinamento de modelo, o prazo é de integração, não de ciência de dados: apontar para a gravação, descrever em texto os alvos daquele cliente e plugar a saída no WMS. O catálogo de conceitos usado nos testes foi escrito à mão, sem uma única imagem rotulada.
Errar faz parte, e por isso toda saída vem com o grau de confiança e com o trecho de vídeo que a originou. O VWMS não dá baixa em estoque nem bloqueia carga: ele aponta divergência para conferência humana. O ganho não é substituir o conferente — é dizer a ele quais das centenas de cargas do dia merecem ser reabertas.
O analytics de CFTV resolve perímetro: linha virtual, permanência, contagem de pessoas. Ele não sabe distinguir um palete filmado de um vazio, nem separar “movimentando carga” de “parado conversando”. E, principalmente, ele não conversa com o WMS — que é onde a divergência precisa aparecer.
Onde o cliente quiser: servidor no próprio galpão, nuvem privada ou nuvem pública. Como o processamento é em lote e fora do horário de pico, uma única GPU atende várias docas. A medição desta página foi feita em uma placa de desktop de entrada, justamente para não superestimar o resultado.
O módulo audita processo, não pessoa: a saída é contagem de volume, tempo de atividade e divergência de carga. Detecção de pessoas existe para entender a cena, e o produto suporta borrar rostos na evidência exportada e reter apenas os trechos ligados a uma ocorrência.
O piloto não exige instalação nem parada de operação: você exporta os arquivos de uma doca, nós processamos e apresentamos o que o vídeo diz que aconteceu — lado a lado com o que o seu WMS registrou no mesmo período.