A percepção de profundidade, antes restrita a sensores sofisticados como LiDARs ou câmeras estéreo, tornou-se possível apenas com imagens RGB comuns, graças ao avanço dos modelos de visão computacional baseados em redes neurais profundas. Este livro apresenta, de forma clara e acessível, como realizar estimativas de profundidade monocular utilizando o modelo MiDaS da Intel, um dos mais robustos disponíveis atualmente.
Ao longo das páginas, o leitor será guiado desde a obtenção de uma imagem diretamente da internet, passando pelo pré-processamento com torchvision, até a inferência da profundidade e sua visualização com matplotlib e OpenCV. O exemplo apresentado demonstra como é possível aplicar um modelo de aprendizado profundo para extrair informações tridimensionais de uma única imagem.
| Seitenanzahl | 108 |
| Ausgabe | 1 (2025) |
| Format | A5 (148x210) |
| Einband | Taschenbuch mit Klappen |
| Papiertyp | Estucado Mate 90g |
| Sprache | Portugiesisch |
Haben Sie Beschwerden über dieses Buch? Sende eine Email an [email protected]
Klicken Sie auf Anmeldung und hinterlassen Sie Ihren Kommentar zum Buch.