Comprensión automática de escenas en imágenes de entornos submarinos
Enviado: 01-03-2024
|Aceptado: 03-05-2024
|Publicado: 09-05-2024
Derechos de autor 2024 Cesar Borja, Ana Cristina Murillo Arnal

Esta obra está bajo una licencia internacional Creative Commons Atribución-NoComercial-CompartirIgual 4.0.
Descargas
Palabras clave:
Segmentación Semántica, Comprensión de escenas submarinas, Percepción y sensores
Agencias de apoyo:
Resumen:
La utilización de vehículos submarinos autónomos (AUV) representa un avance significativo en el campo de la monitorización del fondo marino. Sin embargo, el procesamiento de imágenes de datos adquiridos desde AUVs presenta un desafío único debido a las propiedades inherentes del entorno submarino, como la atenuación de la luz y la turbidez del agua. Este trabajo investiga técnicas para mejorar la comprensión automática del contenido de escenas submarinas a partir de imágenes monoculares. El sistema propuesto aprovecha modelos de aprendizaje profundo existentes junto con algoritmos simples de procesamiento de imágenes, eliminando la necesidad de entrenamiento supervisado adicional. El sistema estudia la combinación de un modelo de aprendizaje profundo pre-entrenado para la estimación de profundidad a partir de imágenes monoculares, con el algoritmo propuesto para distinguir regiones de agua del resto de elementos de la escena. El estudio presentado incluye una comparación detallada de la influencia en el resultado de varias alternativas y opciones de configuración del sistema. La validación experimental muestra cómo el sistema presentado obtiene resultados de segmentación más ricos en comparación con los algoritmos existentes utilizados como referencia. En particular, el sistema propuesto facilita la segmentación precisa de regiones de agua y facilita la detección de otros objetos de interés, incluyendo elementos suspendidos en el agua, que potencialmente pueden corresponder a peces u otros obstáculos móviles.
Citas:
Achanta, R., Shaji, A., Smith, K., Lucchi, A., Fua, P., Süsstrunk, S., 2012. Slic superpixels compared to state-of-the-art superpixel methods. IEEE transactions on pattern analysis and machine intelligence 34, 2274-2282. https://doi.org/10.1109/TPAMI.2012.120
Akkaynak, D., Treibitz, T., 2019. Sea-thru: A method for removing water from underwater images, in: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition, pp. 1682-1691. https://doi.org/10.1109/CVPR.2019.00178
Amitai, S., Klein, I., Treibitz, T., 2023. Self-supervised monocular depth underwater, in: IEEE International Conference on Robotics and Automation (ICRA), IEEE. pp. 1098-1104. https://doi.org/10.1109/ICRA48891.2023.10161161
Van den Bergh, M., Boix, X., Roig, G., de Capitani, B., Van Gool, L., 2012. Seeds: Superpixels extracted via energy-driven sampling. European Conference on Computer Vision, ECCV (7) 7578, 13-26. https://doi.org/10.1007/978-3-642-33786-4_2
Borja, C., Murillo, A.C., 2023. Análisis visual de escenas en entornos submarinos, in: XLIV Jornadas de Automática, Universidade da Corunña. Servizo de Publicacions. pp. 837-842. https://doi.org/10.17979/spudc.9788497498609.837
Feng, D., Haase-Schütz, C., Rosenbaum, L., Hertlein, H., Glaeser, C., Timm, F., Wiesbeck, W., Dietmayer, K., 2020. Deep multi-modal object detection and semantic segmentation for autonomous driving: Datasets, methods, and challenges. IEEE Transactions on Intelligent Transportation Systems 22, 1341-1360. https://doi.org/10.1109/TITS.2020.2972974
Girshick, R., Donahue, J., Darrell, T., Malik, J., 2014. Rich feature hierarchies for accurate object detection and semantic segmentation, in: Proceedings of the IEEE conference on computer vision and pattern recognition, pp. 580-587. https://doi.org/10.1109/CVPR.2014.81
Godard, C., Mac Aodha, O., Brostow, G.J., 2017. Unsupervised monocular depth estimation with left-right consistency, in: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR). https://doi.org/10.1109/CVPR.2017.699
Godard, C., Mac Aodha, O., Firman, M., Brostow, G.J., 2019. Digging into self- supervised monocular depth estimation, in: Proceedings of the IEEE/CVF international conference on computer vision, pp. 3828-3838. https://doi.org/10.1109/ICCV.2019.00393
Gutnik, Y., Avni, A., Treibitz, T., Groper, M., 2022. On the adaptation of an AUV into a dedicated platform for close range imaging survey missions. Journal of Marine Science and Engineering 10, 974. https://doi.org/10.3390/jmse10070974
Islam, M.J., Edge, C., Xiao, Y., Luo, P., Mehtaz, M., Morse, C., Enan, S.S., Sattar, J., 2020. Semantic segmentation of underwater imagery: Dataset and benchmark, in: 2020 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), IEEE. pp. 1769-1776. https://doi.org/10.1109/IROS45743.2020.9340821
Junayed, M.S., Sadeghzadeh, A., Islam, M.B., Wong, L.K., Aydın, T., 2022. Himode: A hybrid monocular omnidirectional depth estimation model, in: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp. 5212-5221. https://doi.org/10.1109/CVPRW56347.2022.00569
Kirillov, A., Mintun, E., Ravi, N., Mao, H., Rolland, C., Gustafson, L., Xiao, T., Whitehead, S., Berg, A.C., Lo, W.Y., et al., 2023. Segment anything. arXiv preprint arXiv:2304.02643 https://doi.org/10.1109/ICCV51070.2023.00371
Kumar, G.S., Painumgal, U.V., Kumar, M.C., Rajesh, K., 2018. Autonomous underwater vehicle for vision based tracking. Procedia computer science 133, 169-180. https://doi.org/10.1016/j.procs.2018.07.021
Oquab, M., Darcet, T., Moutakanni, T., Vo, H., Szafraniec, M., Khalidov, V., Fernandez, P., Haziza, D., Massa, F., El-Nouby, A., et al., 2023. Dinov2: Learning robust visual features without supervision. arXiv preprint arXiv:2304.07193
Yang, L., Kang, B., Huang, Z., Xu, X., Feng, J., Zhao, H., 2024. Depth anything: Unleashing the power of large-scale unlabeled data. arXiv preprint arXiv:2401.10891
Yang, R., Yu, Y., 2021. Artificial convolutional neural network in object detection and semantic segmentation for medical imaging analysis. Frontiers in oncology 11, 638182. https://doi.org/10.3389/fonc.2021.638182




