A percepção de profundidade, antes restrita a sensores sofisticados como LiDARs ou câmeras estéreo, tornou-se possível apenas com imagens RGB comuns, graças ao avanço dos modelos de visão computacional baseados em redes neurais profundas. Este livro apresenta, de forma clara e acessível, como realizar estimativas de profundidade monocular utilizando o modelo MiDaS da Intel, um dos mais robustos disponíveis atualmente.
Ao longo das páginas, o leitor será guiado desde a obtenção de uma imagem diretamente da internet, passando pelo pré-processamento com torchvision, até a inferência da profundidade e sua visualização com matplotlib e OpenCV. O exemplo apresentado demonstra como é possível aplicar um modelo de aprendizado profundo para extrair informações tridimensionais de uma única imagem.
| Number of Pages | 108 |
| Edition | 1 (2025) |
| Format | A5 (148x210) |
| Binding | Paperback with Flaps |
| Paper Type | Estucado Mate 90g |
| Language | Portuguese |
Do you have complaints about this book? Send an email to [email protected]
Click Login to leave your comment on the book.