Pular para o conteúdo
VWMS — auditoria visual Agendar piloto

A câmera que você já tem
vira auditor de estoque.

O seu WMS sabe o que deveria ter entrado. A câmera registra o que entrou de verdade — e ninguém assiste. O VWMS é o módulo que cruza os dois: roda inteligência artificial todos os dias sobre as gravações de segurança, conta os volumes de cada recebimento e cada expedição, e devolve as divergências direto para o seu WMS.

Sem trocar de câmera. Sem trocar de WMS. Sem treinar modelo — os conceitos auditados são definidos por texto.

vídeos analisados
conceitos por texto
imagens rotuladas

Trecho real de uma das gravações auditadas, rodando sozinho e sem som. Alterne entre Câmera e VWMS para ver a mesma cena com e sem a saída do modelo — os rótulos e as confianças do painel vêm da análise executada nestes arquivos.

O ponto cego

Entre a doca e o sistema existe um vão que ninguém audita.

Não é falta de câmera nem falta de WMS. É que os dois nunca se olham.

Confere-se por amostragem

Carga chega, o conferente abre alguns volumes, e o restante entra no sistema na confiança. O que não foi aberto vira estoque contábil — e só aparece meses depois, no inventário.

O vídeo existe, mas ninguém assiste

O DVR grava 24 horas por dia em todas as docas. Esse acervo só é aberto depois do prejuízo, para procurar um episódio já conhecido. Antes disso, é armazenamento parado.

O WMS só conhece o que foi digitado

Ele registra a intenção: a nota, o pedido, o apontamento. Se a contagem física divergiu e ninguém percebeu, o WMS repete a divergência com precisão perfeita por tempo indeterminado.

Conferência por amostragem · corredor de picking
Como funciona

Uma rotina diária, sobre a gravação de ontem.

O VWMS não vive em tempo real e não disputa banda com a operação. Ele roda em lote — de madrugada, sobre o que já foi gravado — e entrega a auditoria pronta antes do primeiro turno.

Lê a gravação

RTSP, ONVIF, exportação do NVR/DVR ou uma pasta de arquivos. Qualquer câmera que já grave segurança serve — não há requisito de modelo, resolução mínima nem hardware embarcado.

Aplica a IA

Detecção de objetos de vocabulário aberto para achar a carga, e reconhecimento de ação para entender o que está acontecendo. Os alvos são descritos em texto, não treinados em dataset.

Monta a auditoria

Rastreia cada volume por identidade própria, conta o que entrou e o que saiu por doca e janela de horário, mede tempo produtivo e marca os eventos que fogem do padrão.

Devolve ao WMS

Compara com o documento esperado e grava a ocorrência via API, webhook ou arquivo — com o trecho de vídeo anexado como evidência da divergência.

A economia, medida

O que os testes mostraram.

Os números abaixo saem da execução real do pipeline sobre gravações de galpão, doca e separação. Nada aqui é estimativa de brochura: é a saída da rodada, e cada vídeo pode ser conferido um a um na página de detalhes.

Medições feitas em uma GPU NVIDIA RTX 3050 de desktop — placa de entrada, não de servidor. Em hardware de datacenter o custo por hora de câmera cai; nenhuma das contas desta página assume isso.

Sua operação

Quanto isso vale no seu galpão.

Mexa nos controles. A velocidade de processamento e a proporção de tempo improdutivo vêm da nossa medição real; o resto são as suas premissas, editáveis e explícitas.

4
12 h
3
R$ 28
3.000
0,8%
R$ 120

Economia potencial por mês

Horas de câmera auditadas / mês
Custo de processamento estimado
Horas-homem de conferência liberadas
Valor das horas liberadas
Divergências recuperadas / mês
Valor recuperado em divergências

Esteira de volumes · doca de expedição
Amostra dos testes

Três cenas, três tipos de auditoria.

Um recorte dos vídeos processados, que começam a rodar assim que entram na tela. Cada bloco mostra a mesma cena com e sem a saída do modelo, mais o que a rodada apurou naquele arquivo.

Por que ainda não existe

Isto não é CFTV com analytics, e não é mais um WMS.

O mercado tem os dois extremos: câmera que conta pessoa cruzando linha, e WMS que registra o que foi digitado. Falta a camada do meio.

Vocabulário aberto: novo item é uma frase, não um projeto

Entrou uma embalagem nova, um bag, um contentor de plástico? Descrever o alvo em texto basta para o modelo passar a procurá-lo. Em visão computacional tradicional isso seria coletar e rotular milhares de imagens e retreinar — semanas por item.

Entende ação de galpão, não só movimento

A diferença entre “tem gente na cena” e “essa pessoa está conferindo volume na doca” é o que transforma imagem em auditoria. O módulo classifica a ação em curso a cada janela de segundos.

É módulo, não substituição

Ninguém troca de WMS para ganhar auditoria. O VWMS se encaixa por API no que já está rodando — SAP EWM, Oracle, Totvs, WMS proprietário — e escreve ocorrência no formato que o sistema já entende.

Em lote, na madrugada, sobre o que já existe

Sem edge box em cada doca, sem rede dedicada, sem contrato de banda. O processamento acontece depois do expediente e a auditoria do dia anterior está pronta antes de a operação começar.

Movimentação interna · corredores de armazenagem
Compatibilidade

Entra por onde já existe saída.

Do lado da câmera

RTSPONVIF NVR / DVR (exportação)Hikvision DahuaIntelbras Arquivos MP4 / MKVPasta de rede S3 / bucket

A rodada de testes usou gravações em 1080p, 1440p e 4K, na horizontal e na vertical, com 24 a 50 quadros por segundo — sem ajuste por arquivo.

Do lado do WMS

REST / JSONWebhook SOAPArquivo CSV / SFTP Fila (MQ / Kafka)Banco de dados SAP EWMTotvs WMS proprietário

O módulo publica ocorrência de divergência, contagem por doca e janela, e o link da evidência em vídeo. O WMS continua sendo a fonte da verdade — o VWMS só mostra onde ela não bate com o pátio.

O que o seu WMS recebe

Uma ocorrência por recebimento ou expedição auditada. Sem grau de confiança omitido e sem baixa automática: o módulo aponta, o time decide.

{
  "tipo": "divergencia_recebimento",
  "doca": "DOCA-03",
  "janela": { "de": "2026-08-23T07:12:40Z", "ate": "2026-08-23T07:41:05Z" },
  "documento": { "nf": "128744", "volumes_esperados": 96 },
  "contagem_visual": {
    "volumes_unicos": 93,          // rastreados com identidade própria
    "por_classe": { "caixa": 71, "palete_filmado": 22 },
    "confianca_media": 0.82
  },
  "divergencia": { "volumes": -3, "severidade": "media" },
  "evidencia": {
    "video": "https://vwms.local/ev/9f3a2c.mp4",
    "instantes": [ "00:07:11", "00:19:48", "00:26:02" ]
  },
  "acao_sugerida": "reconferencia_fisica"
}
Perguntas diretas

O que costumam perguntar antes do piloto.

Preciso trocar as câmeras?

Não. O módulo consome a gravação que a sua operação de segurança já produz. A rodada de testes rodou em resoluções e taxas de quadro diferentes, em horizontal e vertical, sem calibração por arquivo. Câmera melhor dá auditoria melhor — mas não é pré-requisito para começar.

Quanto tempo até estar rodando?

Como não há treinamento de modelo, o prazo é de integração, não de ciência de dados: apontar para a gravação, descrever em texto os alvos daquele cliente e plugar a saída no WMS. O catálogo de conceitos usado nos testes foi escrito à mão, sem uma única imagem rotulada.

A IA erra. Como vocês tratam isso?

Errar faz parte, e por isso toda saída vem com o grau de confiança e com o trecho de vídeo que a originou. O VWMS não dá baixa em estoque nem bloqueia carga: ele aponta divergência para conferência humana. O ganho não é substituir o conferente — é dizer a ele quais das centenas de cargas do dia merecem ser reabertas.

Isso não é o analytics que meu CFTV já tem?

O analytics de CFTV resolve perímetro: linha virtual, permanência, contagem de pessoas. Ele não sabe distinguir um palete filmado de um vazio, nem separar “movimentando carga” de “parado conversando”. E, principalmente, ele não conversa com o WMS — que é onde a divergência precisa aparecer.

Onde os vídeos são processados?

Onde o cliente quiser: servidor no próprio galpão, nuvem privada ou nuvem pública. Como o processamento é em lote e fora do horário de pico, uma única GPU atende várias docas. A medição desta página foi feita em uma placa de desktop de entrada, justamente para não superestimar o resultado.

E a privacidade das pessoas filmadas?

O módulo audita processo, não pessoa: a saída é contagem de volume, tempo de atividade e divergência de carga. Detecção de pessoas existe para entender a cena, e o produto suporta borrar rostos na evidência exportada e reter apenas os trechos ligados a uma ocorrência.

Piloto

Traga uma semana de gravação. Devolvemos a auditoria dela.

O piloto não exige instalação nem parada de operação: você exporta os arquivos de uma doca, nós processamos e apresentamos o que o vídeo diz que aconteceu — lado a lado com o que o seu WMS registrou no mesmo período.