La extracción de objetos interactivos simples ( SIOX ) es un algoritmo para extraer objetos de primer plano de imágenes y vídeos en color con muy poca interacción del usuario. [1] Se ha implementado como herramienta de "selección de primer plano" en GIMP (desde la versión 2.3.3), como parte de la herramienta de trazado en Inkscape (desde 0.44pre3) y como función en ImageJ y Fiji (complemento). También se informaron implementaciones experimentales para Blender y Krita . Aunque el algoritmo fue diseñado originalmente para vídeos, prácticamente todas las implementaciones utilizan SIOX principalmente para la segmentación de imágenes fijas. De hecho, a menudo se dice que es el estándar de facto actual para esta tarea en el mundo del código abierto .
En primer lugar, se utiliza una herramienta de selección a mano alzada para especificar la región de interés. Debe contener todos los objetos del primer plano que se van a extraer y la menor cantidad posible de fondo. Los píxeles que se encuentran fuera de la región de interés forman el fondo seguro, mientras que la región interior define un superconjunto del primer plano, es decir, la región desconocida. A continuación, se utiliza un denominado pincel de primer plano para marcar las regiones de primer plano representativas. El algoritmo genera una máscara de selección. La selección se puede refinar añadiendo más marcas de primer plano o añadiendo marcas de fondo utilizando el pincel de fondo.
Técnicamente, el algoritmo realiza los siguientes pasos:
- Crear un conjunto de colores representativos para un primer plano seguro y un fondo seguro, las llamadas firmas de color.
- Asigne todos los puntos de la imagen al primer plano o al fondo mediante una búsqueda ponderada del vecino más cercano en las firmas de color.
- Aplique algunas operaciones de procesamiento de imágenes estándar como erosionar, dilatar y desenfocar para eliminar artefactos.
- Encuentre los componentes de primer plano conectados que sean lo suficientemente grandes o estén marcados por el usuario.
Para la segmentación de vídeo, las regiones seguras de fondo y primer plano se aprenden a partir de las estadísticas de movimiento. SIOX también cuenta con herramientas que permiten un refinamiento de bordes y áreas con mucha textura con precisión de subpíxeles, los llamados "pinceles de refinamiento de detalles".
Al igual que con todos los algoritmos de segmentación , siempre hay imágenes en las que el algoritmo no produce resultados perfectos. El inconveniente más crítico de SIOX es la dependencia del color. Aunque muchas fotos se pueden separar bien por color, el algoritmo no puede lidiar con el camuflaje. Si el primer plano y el fondo comparten muchos tonos idénticos de colores similares, el algoritmo puede dar un resultado con partes faltantes o con el primer plano clasificado incorrectamente. SIOX funciona aproximadamente igual de bien en diferentes puntos de referencia en comparación con los métodos de segmentación basados en gráficos, como Grabcut . Sin embargo, SIOX es más robusto al ruido y, por lo tanto, también se puede utilizar para la segmentación de videos. Los métodos de segmentación basados en gráficos buscan un corte mínimo y, por lo tanto, tienden a no funcionar de manera óptima con estructuras complejas.
El algoritmo se desarrolló inicialmente en el departamento de informática de la Universidad Libre de Berlín . El desarrollador principal, Gerald Friedland , es ahora profesor en el departamento de Ingeniería Eléctrica y Computación de la Universidad de California en Berkeley y también científico de datos principal en el Laboratorio Nacional Lawrence Livermore . Sigue apoyando el desarrollo a través de tutorías, por ejemplo, en el Google Summer of Code .
Notas
- ^ Friedland, G., Jantz, K., Lenz, T., Wiesel, F. y Rojas, R. (2006). "Un enfoque práctico para la extracción de múltiples objetos con precisión de límites a partir de imágenes fijas y vídeos". Octavo Simposio Internacional IEEE sobre Multimedia (ISM'06) . pp. 307–316. doi :10.1109/ISM.2006.9. ISBN
978-0-7695-2746-8.S2CID13938666 .
{{cite book}}: CS1 maint: varios nombres: lista de autores ( enlace )
Referencias
- G. Friedland, K. Jantz, R. Rojas: SIOX: Extracción interactiva simple de objetos en imágenes fijas, Actas del Simposio Internacional IEEE sobre Multimedia (ISM2005), págs. 253–259, Irvine (California), diciembre de 2005. Artículo en línea
- G. Friedland, K. Jantz, T. Lenz, F. Wiesel, R. Rojas: Object Cut and Paste in Images and Videos, International Journal of Semantic Computing Vol 1, No 2, pp. 221–247, World Scientific, EE. UU., junio de 2007. Artículo en línea
Enlaces externos
- www.siox.org
- Vídeo de demostración de SIOX en GIMP
- SIOX en Fiji y ImageJ
- www.gimp.org
- www.inkscape.org
- www.echalk.de