1. Classificador e Latência Real
2. Projetor de Latência Teórica
Saída Diagnóstica do Modelo
MobileNet v2 ActiveScript de Inicialização LiteRT JS
{{ generatedCode }}
{{ generatedCode }}
O LiteRT (anteriormente conhecido como TensorFlow Lite) é a tecnologia padrão da Google para execução de alto desempenho de modelos pequenos em ambientes edge e on-device.
O novo runtime JavaScript do LiteRT implementa automaticamente delegates de aceleração para mapear pipelines matemáticos para a GPU nativa no Chrome e Edge, diminuindo em até 5x a latência em relação à execução pura de CPU.
Executar pré-processamentos (redimensionamento de imagens, normalização de RGB para floats entre -1 e 1) de forma síncrona consome muita CPU. O LiteRT permite carregar e preprocessar texturas diretamente na memória do shader.
Modelos leves como o MobileNet v2 operam offline no navegador do usuário de forma assíncrona. Isso elimina a necessidade de pagar por servidores GPU dedicados na nuvem e reduz drasticamente a latência de tráfego de rede.