Document segmentation using Relative Location Features

Reconocimiento - No comercial - Sin obra derivada (by-nc-nd)Reconocimiento - No comercial - Sin obra derivada (by-nc-nd)Reconocimiento - No comercial - Sin obra derivada (by-nc-nd)

Editores

Otras autorías

Unidades organizativas

Compartir

Handle

https://riunet.upv.es/handle/10251/19219

Cita bibliográfica

Cruz Fernández, F. (2012). Document segmentation using Relative Location Features. Universitat Politècnica de València. https://riunet.upv.es/handle/10251/19219

Titulación

Máster Universitario en Inteligencia Artificial, Reconocimiento de Formas e Imagen Digital-Màster Universitari en Intel·ligència Artificial, Reconeixement de Formes i Imatge Digital

Resumen

[ES] Presentamos un método genérico para análisis de layout ideado para trabajar sobre documentos con layouts Manhattan y no-Manhattan. Proponemos la combinación de Relative Location Features junto con características de textura para codificar las relaciones entre las diferentes clases de entidades. Usando estas características construimos un Conditional Random Field que nos permite estimar el mejor etiquetado en términos de minimización de energía. Los experimentos realizados sobre ambos tipos de documentos demuestran que la utilización de Relative Location Features ayuda a mejorar los resultados de la segmentación en documentos altamente estructurados, así como ofrecer resultados a la altura del estado del arte sobre documentos sin una estructura aparente.


[EN] We present a generic layout analysis method devised to work in documents with both Manhattan and non-Mahnattan layouts. We propose to use Relative Location features combined with texture features to encode the relationships between the different class entities. Using these features we build a Conditional Random Field framework that allow us to obtain the best class configuration of an image in terms of energy minimization. The conducted experiments with Manhattan and non-Manhattan layouts prove that using Relative Location Features improves the segmentation results on highly structured documents, as well as results up to the state of the art on documents weakly structured.

Fuente

DOI

Versión del editor

Enlaces relacionados

URL