Este código implementa um sistema simplificado de Segmentação de Objetos em Vídeos (VOS - Video Object Segmentation) utilizando uma rede neural baseada em ResNet18. A arquitetura combina um backbone convolucional pré-treinado para extração de características e uma etapa de decodificação para gerar máscaras de segmentação. Além disso, incorpora um mecanismo de atenção temporal para garantir consistência entre os frames do vídeo. O modelo é otimizado para execução em GPU, se disponível, e permite processar vídeos fornecidos pelo usuário ou um exemplo pré-definido. O código inclui funções para pré-processamento de imagens, exibição de vídeos no ambiente do Colab, e geração de um vídeo de saída com as máscaras segmentadas sobrepostas ao vídeo original.
| Number of pages | 115 |
| Edition | 1 (2025) |
| Format | A5 (148x210) |
| Binding | Paperback w/ flaps |
| Paper type | Estucado Mate 90g |
| Language | Portuguese |
Have a complaint about this book? Send an email to [email protected]
login Review the book.