Uniterm es un sistema de indización temática introducido por Mortimer Taube en 1951. Su nombre es una contracción de "unidad" y "término", en referencia al uso de palabras individuales como base del índice, los "uniterms". Taube se refería al concepto general como "Indización Coordinada", pero hoy en día también se le conoce comúnmente como Uniterm.
Uniterm está diseñado para permitir búsquedas rápidas de palabras clave y, posteriormente, realizar referencias cruzadas de dichas palabras clave en múltiples temas para encontrar documentos que coincidan con todos los términos. El resultado de una búsqueda en Uniterm es un conjunto de números de acceso que pueden utilizarse para recuperar los documentos coincidentes. Uniterm se basa en números de acceso existentes, por lo que técnicamente es un sistema postcoordinado . Esto se contrapone a un sistema precoordinado, donde el tema del documento determina que se le asigne un número específico, como en la Clasificación Decimal Dewey . Uniterm fue uno de los sistemas de indexación postcoordinados más populares, aunque parte de su éxito se debió a que la empresa de Taube obtuvo contratos para indexar enormes bibliotecas técnicas.
Historia
El desarrollo de Uniterm y otros nuevos sistemas de indexación tiene sus orígenes en el final de la Segunda Guerra Mundial . Conscientes de las avanzadas tecnologías aeronáuticas y de cohetes desarrolladas en Alemania, Estados Unidos creó la Operación Lusty y el Reino Unido la similar Misión Fedden para recopilar la mayor cantidad posible de estos materiales. Junto con ejemplos de aeronaves y diversas armas, estos esfuerzos permitieron obtener millones de páginas de documentación técnica. El deseo de facilitar el acceso a estas enormes colecciones propició una gran expansión en el campo de la recuperación de información . [ 1 ]
En Estados Unidos, la colección aeronáutica se envió inicialmente a la Fuerza Aérea del Ejército de EE. UU. en Wright Field , pero con el tiempo se fusionó con colecciones similares de investigación estadounidense para formar una colección cada vez mayor de documentos técnicos. La colección creció tanto y se diversificó tanto que en 1951 se creó un nuevo grupo operativo, la Agencia de Información Técnica de los Servicios Armados (ASTIA), para gestionarla. Este grupo pasó a estar bajo la dirección de la Comisión de Energía Atómica . ASTIA comenzó a realizar experimentos de indexación de la colección, y fue a partir de este trabajo que surgió Uniterm. [ 2 ]
Taube introdujo el concepto de Uniterm en un artículo de 1951, "Indexación de coordenadas de campos científicos", que formaba parte del Simposio sobre ayudas mecánicas para la documentación química. Al año siguiente, en colaboración con Gerald Sophar, Taube fundó Documentation, Inc. La empresa ofrecía servicios comerciales de recuperación e indexación. Entre sus mayores logros se encuentra un contrato de 1958 con la recién creada NASA para indexar toda su biblioteca técnica y, posteriormente, realizar copias en microfilm de la misma. [ 3 ]
El artículo original de Taube indica que una ventaja significativa del concepto Uniterm es su capacidad de automatización. En esencia, el proceso de búsqueda Uniterm busca la intersección de varios términos, o como Taube lo denominó, las "coordenadas". [ a ] Con este fin, se asociaron con IBM para desarrollar el "Continuous Multiple Access Collator" (COMAC). Los usuarios seleccionaban los términos de búsqueda en una grabadora de tarjetas perforadas y luego los introducían en el COMAC, también conocido como IBM 9900. [ 4 ] El COMAC extraía esas tarjetas Uniterm y luego utilizaba sistemas ópticos para encontrar elementos coincidentes. A continuación, devolvía una nueva tarjeta con esos números, que se enviaba al IBM 305 RAMAC , el primer ordenador con disco duro , que devolvía la información completa del documento para esos números. [ 4 ]
Concepto
Uniterm se basa en el concepto de crear un catálogo de fichas independiente que hace referencia a los documentos de la colección mediante sus números de acceso . Los números de acceso no tienen significado en el índice Uniterm, por lo que pueden utilizar cualquiera de los sistemas comunes, como la Clasificación Decimal Dewey o la Clasificación Decimal Universal , o, en muchos casos, simplemente un número de serie incremental . [ 5 ] [ 2 ]
A medida que se añaden nuevas obras a la colección, el bibliotecario crea una ficha de índice normal para el fichero principal, como lo haría con cualquier otra obra. Además, selecciona un pequeño número de palabras clave del título o del cuerpo de la obra que se pueden usar para buscarla, y estas también se escriben en la ficha. Por ejemplo, un documento sobre la formación de hielo en los conductos de aire de las aeronaves podría archivarse bajo las categorías "aire", "conductos" y "formación de hielo", pero quizás no bajo "aeronave", que se encontraría en demasiados documentos. [ 6 ]
El bibliotecario busca entonces en el catálogo Uniterm fichas con esos términos. Si no las encuentra, las crea escribiendo la palabra clave en la parte superior de la ficha y dividiendo la parte inferior en diez secciones verticales, numeradas del 0 al 9. A continuación, se escribe el último dígito del número de acceso en la ficha, en la columna correspondiente; por ejemplo, si el último dígito es 5, se escribirá el número de acceso completo en la columna 5. Si se encuentra la ficha correspondiente a ese término en la colección, simplemente se añade el nuevo número de acceso a la columna correcta de la ficha existente. [ 7 ]
Para recuperar un documento, el usuario selecciona términos clave potencialmente útiles y extrae esas fichas del índice uniterm. Para encontrar este artículo, el usuario podría seleccionar "indexación" y "biblioteca", y recuperar esas fichas del catálogo uniterm. Estas fichas tendrán números para muchos documentos diferentes; por ejemplo, la ficha "biblioteca" podría contener una entrada para un libro sobre la Biblioteca de Alejandría . Sin embargo, solo los documentos sobre "indexación de bibliotecas" aparecerán en ambas fichas. [ 8 ]
El usuario escanea la tarjeta para comprobar si un número de acceso específico aparece en ambas; la división de las tarjetas en 10 columnas simplifica el proceso de escaneo visual. Los números que aparecen en ambas tarjetas suelen ser relevantes para la búsqueda y pueden consultarse directamente o en el catálogo principal de tarjetas si se utilizan números de acceso parciales. [ 8 ]
Las fichas del catálogo principal también contienen los uniterms utilizados para archivar cada entrada, formando un índice cruzado. Un usuario que seleccione las fichas de "hélice" y "avión" puede encontrar muchas obras coincidentes. Al regresar al índice principal, puede consultar los uniterms registrados en las fichas y descubrir que hay otros términos que aparecen con frecuencia, como "aerodinámica". Estos podrían sugerir términos adicionales que podrían utilizarse para acotar la búsqueda. Posteriormente, puede volver al catálogo de uniterms para aplicar estos nuevos términos y obtener documentos adicionales o enfocar aún más la búsqueda. [ 9 ]
Ventajas y críticas
Uniterm fue popular en Estados Unidos para grandes colecciones técnicas, lo que dio lugar a numerosos estudios sobre el sistema. Un esfuerzo particularmente útil fue el de la Agencia de Seguridad Nacional para catalogar su colección de 70 000 obras. [ 10 ]
Descubrieron que una de las principales ventajas del sistema Uniterm era que los bibliotecarios no necesitaban comprender el material para catalogarlo correctamente. Simplemente seleccionando términos que aparecían en el título o que eran obviamente importantes dentro del texto, a menudo se obtenía una entrada Uniterm útil. Esto contrastaba con los enfoques jerárquicos tradicionales, donde seleccionar el lugar adecuado dentro de la jerarquía a menudo requería cierto conocimiento, o incluso considerable, del campo subyacente. [ 10 ]
El mismo esfuerzo también reveló varios problemas y sugirió soluciones. Uno de ellos era que los sinónimos presentaban un problema: ¿era un artículo sobre "conductos de aire" igual o diferente a uno sobre "tomas de aire"? Sugirieron que esto podría abordarse dividiendo las obras en conjuntos de aproximadamente 1000 entradas y construyendo el catálogo por secciones. El primer conjunto de 1000 documentos podría producir 1000 términos unívocos, que luego se estudiaban para eliminar los sinónimos. Cuando se encontraban sinónimos, se añadían encabezados de "véase también" a esas fichas. A continuación, se añadía el segundo conjunto, utilizando esos sinónimos. Descubrieron que la adición de nuevos términos comenzaba a estabilizarse alrededor de las 4000 entradas, y después de las 10 000 solo se añadían términos técnicos muy específicos. [ 11 ]
Una preocupación que surgió al introducir el concepto fue que los términos podrían generar un gran número de falsos positivos debido a que se utilizaban para describir conceptos completamente diferentes. En particular, se creía que los términos que podían tener distintos significados según su orden representaban un problema. Si se buscaba "exportaciones estadounidenses a Canadá", "Canadá", "EE. UU." y "exportaciones" también arrojarían un gran número de documentos sobre exportaciones canadienses a EE. UU., lo que podría saturar el conjunto de resultados. [ 12 ]
Sin embargo, en la práctica se comprobó que esto no suponía un problema grave, y los pocos ejemplos que surgieron se resolvieron añadiendo «tarjetas delta», entradas de «véase también» que incorporaban una dirección. En este caso, la tarjeta «EE. UU.» tendría una entrada de «véase también» para «EE. UU.Δ», y dicha tarjeta solo contendría las entradas procedentes de EE. UU. Los uniterms de la página de EE. UU.Δ son únicamente los correspondientes a las exportaciones estadounidenses. [ 12 ]
Notas
- ↑ Como en "cosas que están coordinadas", no "un lugar físico".
Referencias
Citas
- ↑ Lesk, Michael . "Las siete edades de la recuperación de información" . Bellcore.
- 1 2 Sharma y Sharma 2007 , pág. 19.
- ↑ Times 1965 .
- 1 2 Taube 1962 .
- ↑ Instalación 1953 , pág. 1.
- ↑ Instalación 1953 , pág. 2.
- ↑ Instalación 1953 , págs. 6, 7.
- 1 2 Instalación 1953 , pág. 9.
- ↑ Instalación 1953 , pág. 11.
- 1 2 Sanford y Theriault 1956 , pág. 19.
- ↑ Sanford y Theriault 1956 , pág. 20.
- 1 2 Sanford y Theriault 1956 , pág. 23.
Bibliografía
- «Mortimer Taube fallece; fundó Data Service». The Washington Post and Times-Herald (1959–1973) . 1965. págs. A24.
- Manual de instalación del sistema Uniterm de indexación de coordenadas (PDF) (Informe técnico). ASTIA. Octubre de 1953.
- Taube, Mortimer (enero de 1962). "Experimentos con el IBM-9900 y una discusión sobre un COMAC mejorado según lo sugerido por estos experimentos" . Journal of Chemical Documentation . 2 (1): 22– 26. doi : 10.1021/c160004a007 .
- Sharma, CK; Sharma, AK (2007). Procesamiento y recuperación de la información . Atlantic Publishers. págs. 14–20 . ISBN 9788126906956.
- Sanford, John; Theriault, Frederick (enero de 1956). "Problemas en la aplicación de la indexación de coordenadas Uniterm" . Bibliotecas universitarias y de investigación . 17 : 19–23 . doi : 10.5860/crl_17_01_19 . hdl : 2142/36851 .
- Catalogación y clasificación de bibliotecas