A percepção de profundidade, antes restrita a sensores sofisticados como LiDARs ou câmeras estéreo, tornou-se possível apenas com imagens RGB comuns, graças ao avanço dos modelos de visão computacional baseados em redes neurais profundas. Este livro apresenta, de forma clara e acessível, como realizar estimativas de profundidade monocular utilizando o modelo MiDaS da Intel, um dos mais robustos disponíveis atualmente.
Ao longo das páginas, o leitor será guiado desde a obtenção de uma imagem diretamente da internet, passando pelo pré-processamento com torchvision, até a inferência da profundidade e sua visualização com matplotlib e OpenCV. O exemplo apresentado demonstra como é possível aplicar um modelo de aprendizado profundo para extrair informações tridimensionais de uma única imagem.
| Número de páginas | 108 |
| Edición | 1 (2025) |
| Formato | A5 (148x210) |
| Acabado | Tapa blanda (con solapas) |
| Tipo de papel | Estucado Mate 90g |
| Idioma | Portugués |
¿Tienes alguna queja sobre ese libro? Envía un correo electrónico a [email protected]
Haz el inicio de sesión deja tu comentario sobre el libro.