Mostrando entradas con la etiqueta sistemas de recuperación de información. Mostrar todas las entradas
Mostrando entradas con la etiqueta sistemas de recuperación de información. Mostrar todas las entradas

Operadores de búsqueda

Demanda_documental

GÓMEZ DUEÑAS, Laureano Felipe. Demanda documental y estrategias de búsqueda. [término de búsqueda: operadores de búsqueda] [en línea – html].[consulta: 2011 – 05 – 25]. Disponible en: http://es.scribd.com/doc/22387132/Demanda-documental 
 

Perfil profesional

La implementación de las nuevas tecnologías en la gestión documental, conlleva a   reevaluar el perfil del profesional de información, puesto que el incremento de las tecnologías de información y comunicación, han facilitado la aparición de las bibliotecas digitales y centros documentales conformados por soportes magnéticos, electrónicos o virtuales.

La revolución tecnológica ha provocado enormes cambios en la producción de búsqueda, en la formación de riquezas a partir del conocimiento, la forma de vivir, trabajar y también en los planteamientos de dinámicas en el acceso a la información generando cambio en los centros de documentación y de igual forma en el personal que trabaja en dichos espacios.

A raíz de este nuevo escenario se observan modificaciones en el perfil del profesional de información, pues debe adquirir las competencias para el dominio de sistemas más sofisticados de recuperación de información; siendo competitivo  y riesgoso a partir de la capacitación constante  e innovadora.

De modo que el desafío representativo para el profesional de información se enmarca en la capacidad de adaptarse a la evolución acelerada de su entorno y servir de enlace, guía y orientador para sus usuarios fundamentado en su crecimiento para el posicionamiento de la profesión.

Neotake.com

¿Conocía Neotake.com? bueno si no es así,  éste es un motor de búsqueda y recuperación de libros electrónicos en todas las áreas del conocimiento, contiene cientos de libros gratis para examinar,  con sólo disponer de una conexión a internet puede acceder a la cultura en diversidad de idiomas. Conjuntamente tiene aplicaciones similares a las de redes sociales, pues está dotado con funciones  de valoración y comentarios hacia las publicaciones; asimismo permite comparar precios entre diferentes editoriales informando  para cada título si es o no gratuito, resulta ser muy útil y práctico a la hora de realizar búsquedas de información.

Como dato adicional Neotake.com tiene la posibilidad de filtrar las búsquedas por idioma y formato, brinda una estupenda oportunidad a la nueva generación de escritores para publicar sus libros, sin intermediarios, haciendo mucho más práctica la publicación de un libro en formato electrónico.

Pertinencia del documento

Como bibliotecólogos, archivistas ó profesionales de información es importante participar en los procesos de selección de un sistema de recuperación de información para monitorizar y evaluar la efectividad en la recuperación de documentos, analizando el tiempo de respuesta y rendimiento en la gestión de documentos recuperados; anteriormente mencionamos la relevancia como criterio de evaluación ahora, en segunda instancia  es valido referirse al término pertinencia. La pertinencia en un documento está representada en la calidad y oportunidad que el usuario ve en éste, por tanto,  está directamente relacionada con el criterio subjetivo, pues es el usuario quien evalúa si el documento es o no pertinente de acuerdo a su necesidad, fundamentado en si encuentra él la información solicitada en principio; así las cosas, un documento pertinente es un documento que resulta ser oportuno a la necesidad individual de información.

ReNamer

ReNamer es una eficiente aplicación de renombrado masivo de carpetas y archivos que permite utilizar comodines y expresiones regulares para adelantar búsquedas por nombre; de igual forma reemplazar caracteres en estos mismos, insertar números o nuevas letras, cambiar de mayúsculas a minúsculas; admite el reemplazos de texto, añadir sufijos o prefijos en pro de búsquedas semánticas, añadir secuencias numéricas y cambiar la extensión de los archivos.

También consiente cambiar atributos de archivos y carpetas, deshacer cualquier cambio que se haya realizado y pre visualizar el resultado en tiempo real previo a grabar, haciendo menos latosa la recuperación de información a partir de metadatos para usuarios más avanzados.

Relevancia

El diccionario de la Real Academia de la Lengua Española define la palabra relevancia como: "Cualidad o condición de relevante, importancia, significación"; articulando este concepto con los sistemas de recuperación acertamos al decir es criterio de evaluación para éstos mismos.

Sin embargo, la relevancia está asociada a la necesidad de información del usuario y su criterio, pues es éste en últimas quien establece si  el documento recuperado es o no relevante, en relación  a la pregunta hecha y el término hallado en éste, es decir, no hay criterios normalizados para su medición. Por consiguiente, la relevancia es subjetiva ya que ésta condición es definida por el usuario si encuentra importante el contenido del documento con su necesidad de información sin poder ser cuantificable.      

Alfresco

Estamos viviendo un reto para la búsqueda y recuperación de información en la web, momento en el que a las colecciones electrónicas no se les da el adecuado uso, siendo poco utilizadas; por otro lado los fondos documentales representan costos incalculables para las organizaciones dejando de lado la importancia y validez que tiene la unidad de archivo como soporte a las actividades diarias de una institución.  Alfresco es un sistema de recuperación de contenidos que se puede adaptar como repositorio de documentos electrónicos, ofreciendo grandes oportunidades para adelantar la recuperación, ajustándose a las necesidades de la organización.             

Recuperación de información

Un SRI puede ser definido como aquel sistema automatizado representado por medio de una interfaz sencilla para el usuario, que permite almacenar datos e información, con el objetivo de poder ser recuperados para satisfacer y llenar necesidades de información. Chowdhury (1996) al respecto menciona un sistema de recuperación de información debe  contener las siguientes características: 
 
  • Identificar las fuentes de información relevantes a las áreas de interés de las solicitudes de los usuarios.
  • Analizar los contenidos de los documentos.
  • Representar los contenidos de las fuentes analizadas de una manera que sea adecuada para compararlas con las preguntas de los usuarios.
  • Analizar las preguntas de los usuarios y representarlas de una forma que sea adecuada para compararlas con las representaciones de los documentos de la base de datos.
  • Realizar la correspondencia entre la representación de la búsqueda y los documentos almacenados en la base de datos.
  • Recuperar la información relevante.
  • Realizar los ajustes necesarios en el sistema basados en la retroalimentación con los usuarios.
En la historia y evolución de los SRI, son claros tres periodos que repercuten en el desarrollo actual alcanzado por éstos, Francisco Martínez los define así:

Desarrollos iniciales: En los inicios de la humanidad  existían métodos de recuperación de información en las antiguas colecciones de papiros, como los libros por medio del índice, tabla de contenidos de un libro, sustituida por otras estructuras más complejas a medida que ha crecido el volumen de información. El índice aún constituye el núcleo de los SRI actuales.

Recuperación de información en las bibliotecas: "Fueron las primeras instituciones en adoptar estos sistemas. Originalmente fueron desarrollados por ellas mismas y posteriormente se ha creado un mercado informático altamente especializado, en el que participan empresas e instituciones”

La World Wide Web: “La evolución lógica de los SRI ha sido hacia la web, donde han encontrado una alta aplicación práctica y un aumento del número de usuarios, especialmente en el campo de los directorios y motores de búsqueda” la consolidación de la web está siendo favorecido por la tecnología informática, junto con la implementación de las telecomunicaciones.
___________
GOBINDA G, Chowdhury. Text Retrieval Systems in Information Management. India, Limited Publishers, 1996. 226 p. ISBN: 81-224-0760-9.
MARTÍNEZ MÉNDEZ, Francisco Javier. Recuperación de información: modelos, sistemas y evaluación. Murcia, ELKIOSCO JMC, 2004. ISBN: 84-932537-7-4.

Google Squared

En nuestros días si preguntamos algo a Google, así la consulta no sea hecha de la mejor forma, sabemos que traerá de vuelta una frase muy conocida “quizás quiso decir”, es así como este buscador de información en Internet trae de vuelta documentos estructurados, semiestructurados o no estructurados relacionados con la cuestión; sin embargo como Google siempre está en constante investigación para desarrollar e innovar con nuevos productos en pro de la búsqueda y recuperación de información en internet, así damos a conocer uno de sus proyectos para la industria de información:

Google Squared es un producto que se encuentra en pleno desarrollo en Google Labs, basado en un algoritmo de búsqueda semántica promete encontrar los resultados más relevantes en relación con la necesidad del usuario. Google Squared extrae datos de documentos no estructurados, de igual forma lo hace con los semiestructurados, de la web y presenta sus resultados en un formato parecido al de una hoja de cálculo que muestra: nombre del ítem, imagen, descripción y país; es decir, cada búsqueda devolverá un cuadro de resultados de búsqueda que tiene su propio conjunto de columnas asociadas al tema de la búsqueda.

Este nuevo concepto de Google consiste en tomar la información en HTML, la cual en su gran mayoría se encuentra semi o no estructurada, y con su algoritmo toma como base la estructura semántica en dicha información para ser capaz de dotarla de metadatos para darle estructurarla y presentarla al usuario, sí este proyecto prospera  podríamos decir que Google es un aliado en la búsqueda y recuperación de información en internet. 

Batalla de navegadores

¿La batalla de los navegadores afecta la búsqueda y recuperación? Sin duda alguna para discutir sobre búsqueda y recuperación de información en la world wide web es ineludible acudir a navegadores como Internet Explorer, Mozilla Firefox, Google Chrome, Netscape Navigator, por mencionar algunos. Ahondando en éste tema poco tratado por la comunidad de profesionales de información surgen varias dudas al respecto: ¿Cuáles son los criterios que tiene en cuenta un buscador? cuando sabemos que Google hace poco tiempo cambió su algoritmo de búsqueda, con el ánimo de perfeccionar la tarea de recuperación de información relevante ¿Relevancia es sinónimo de subjetividad? Digo esto teniendo en cuenta que un documento puede ser o no relevante para un usuario dependiendo de la necesidad de información y su grado de experticia en temas relacionados con la búsqueda de información en Internet¿El posicionamiento en buscadores es únicamente logrado por quienes pagan? puesto que al ejecutar una misma búsqueda en diversos buscadores y equipos, varía la posición.

Son varias las dudas que asaltan como profesionales de información, con respecto al tratar de comprender el funcionamiento de un sistema de recuperación de información. Por ahora sabemos que los algoritmos de búsqueda son secretos; sin embargo indagar acerca de éstos mismos nos lleva a crear conclusiones propias. El presente vídeo ofrece una noción acerca de los principales navegadores, la constante batalla de innovación y perfeccionamiento para su posicionamiento en el mercado. Lo invitamos a observarlo y dejar sus comentarios enriqueciendo nuestro trabajo.

Puntos de acceso

Son las entradas hechas en un sistema automatizado que van a permitir efectuar la recuperación de información, pueden ser asientos principales o secundarios; también existe el asiento de referencia. El asiento principal contiene la información del asiento más las indicaciones de los secundarios y el de referencia. El secundario indica otro punto de acceso adicional. El asiento de referencia relaciona dos o más punto posibles.

El catalogador es quien determina cuál es el punto de acceso principal y cuáles son los secundarios. Estos pueden ser: Una persona, institución o un título como elemento individual de la obra. Los encabezamientos secundarios agotan toda posibilidad de acceso. Estas actividades clásicas de las bibliotecas se han enriquecido con el desarrollo de las tecnologías y la informática, implementando significativos cambios, pero la esencia sigue siendo la misma: la catalogación, clasificación, encabezamientos de materia, descriptores, el análisis y resumen de contenidos, sin dejar de lado el conocimiento del usuario; siguen siendo las tareas fundamentales para lograr el funcionamiento de los sistemas de recuperación de información.

Análisis Documental

El análisis de información y la descripción bibliográfica, son tareas propias del quehacer bibliotecológico, cuyo objetivo básico consiste en hacer accesible a su usuario información de alta calidad, sin embargo en la actualidad, la información es presentada en gran variedad de formatos y soportes; por tanto, el profesional de información debe incursionar más en el campo de la informática y las técnicas aplicadas al almacenamiento de información, convirtiéndose en desafío en pleno siglo XXI.

Los sistemas de información se encuentran en su punto máximo, pero deben involucrar una serie de actividades desarrolladas desde las unidades de información (bibliotecas, archivos y centros de documentación) para conocer las necesidades reales de información, así mismo lograr suplirlas. De igual forma desde el momento de  adquisición de material electrónico hasta su llegada al usuario.

La tarea fundamental de la catalogación  consiste  en el procesamiento técnico del material bibliográfico; expresado de la siguiente forma: ”se entiende por catalogación descriptiva, el conjunto de operaciones que se realizan sobre el documento con el fin de describirlo y de establecer los puntos de acceso que determinan los nombres (autorías) de los responsables del contenido intelectual o artístico de la obra”[1] justificando que dicha actividad se renueva para cumplir con las exigencias del mundo actual aplicándola a libros electrónicos, inclusive colecciones documentales digitales.
 
En este contexto, el análisis documental trasciende directamente en el diseño y planeación de productos, servicios y sistemas de recuperación de información, pues el análisis realizado por el profesional en el proceso de descripción es imprescindible para su posterior recuperación, especialmente a través de la web.
_________
[1]GARRIDO ARILLA, María Rosa. Teoría e Historia de la Catalogación de Documentos. Madrid; Editorial Síntesis, 1996. 190p. ISBN: 84-7738-344-8.

Búsqueda de información

Para ahondar en el concepto e importancia de los sistemas de recuperación de información (SRI), y su impacto en la sociedad del conocimiento el siguiente libro electrónico permite conocer mejores prácticas sobre uno de los temas tratados en éste blog; escrito por Chowdhury, G.G. ( Doctor en filosofía e investigador en Ciencias de la Información de la Universidad Tecnológica de Sydney) presenta la compilación de sus indagaciones, haciendo un valioso aporte para bibliotecólogos, archivístas  y gestores de información. Introduce nuevos acercamientos al concepto de búsqueda y recuperación en la modernidad, evidenciado en la evolución que han debido adoptar los sistemas convencionales  para las exigencias de usuarios, entonces surgen los sistemas de información basados en la tecnología web (web information system), como medio para la optimización de la recuperación, permitiendo la integración entre diversidad de sistemas. 

Fundamentos de búsqueda y recuperación de información

La búsqueda y recuperación de información es una actividad que se realiza a través de los motores de búsqueda como Google, y la mayoría de las veces las personas no tienen una idea clara que les permita realizar una búsqueda efectiva, de hecho los usuarios de internet no poseen un técnica de búsqueda, por esta razón estas grandes empresas de desarrollo de motores de búsqueda hacen mucho énfasis en identificar las necesidades de los usuarios.

Por esta razón es que día a día vemos cambios que nos facilitan la forma de búsqueda en Google, opciones como "quiso decir" o la indización de temas que muestra en forma de lista al momento de ingresar a la barra de búsqueda un término,  las opciones se reducen de manera significativa en la búsqueda. Teniendo en cuenta que la búsqueda y la recuperación de información inician con una necesidad insatisfecha de información y termina cuando la persona logra llenar ese vacío de necesidad, es importante interpretar el comportamiento del usuario y estudiar sus forma de ubicar o hallar  la información, de esta manera cuando el usuario realice una nueva búsqueda sus obstáculos se han reducido. Dentro de éste proceso también es indispensable reconocer las variables y los elementos que intervienen en el proceso de la búsqueda y recuperación de la información.

• El usuario
• La necesidad de información
• La consulta
• Los documentos
• La retroalimentación
• Las nociones de silencio y de ruido
___________
PÉREZ, Mario. Búsqueda y recuperación de la información. Barcelona  2009. Editorial UOC. 2009. p.97. ISBN: 978-84-9788-834-9.

Infoxicación

La infoxicación, término asociado a la intoxicación de información es una expresión que hace referencia a la sobresaturación de información en Internet, ocasionando que el usuario o lector llegue a sentir un estado de frustración al no encontrar información pertinente y de su interés, descubriéndola poco relevante sumándose a esto la pérdida de tiempo. 

Al respecto se menciona lo siguiente: “todo este fenómeno de multiplicación de la cantidad de información que existe en el mundo se ha venido a llamar la ‘explosión de la información’, aunque más bien debería llamarse la ‘explosión de la desinformación’, indigerible y confundidora”[1]

Esta tendencia es dada por el volumen excesivo de información que en la actualidad se encuentra a través de la web, ya que no basta únicamente con acceder a ella, se requiere de un análisis exhaustivo por parte del profesional, contando con tiempo y objetividad para procesarla adecuadamente en los sistemas de recuperación. 

Para profundizar en el tema y conocer otra perspectiva lo invitamos a leer el siguiente artículo de El tiempo.com
_____________
[1] COBO ROMANÍ, Cristóbal; PARDO KUKLINSKI, Hugo. Planeta Web 2.0. Inteligencia colectiva o medios fast food. Barcelona: Universidad de Vic, 2007. p. 74

Google CSE 2

El presente vídeo incide directamente en el contenido de éste blog,  demostrando  la configuración  de un motor de búsqueda personalizado gracias a la tecnología de Google CSE;  crear  motores de búsqueda especializados en un tema, da opción al creador de indexar las páginas en las cuales desea realicen la búsqueda de información los usuarios, garantizando la accesibilidad a información con contenido de alta calidad y la tarea de recuperación en dicho sistema mediante una interfaz sencilla.

Aproximaciones a la búsqueda y recuperación de información

El advenimiento de las tecnologías, la invención e implementación de Internet ocasionaron un colapso frente a la proliferación de información contenida en documentos electrónicos, siendo cada vez de mayor frecuencia encontrar documentos legibles en computador, bien sabido tenemos éstos representan información textual, numérica,  gráfica, imágenes fijas o en movimiento e incluso sonido.

No obstante, la denominada revolución multimedia[1] ha generado ante tal diversidad de documentos en formato electrónico (digital o virtual) la exclusión de algunos al no estar sujetos a una serie de normas que faciliten la gestión homogénea de los mismos (ver documentos estructurados), por tanto, la gestión de bibliotecólogos y archivistas se ha visto afectada. De igual forma, ha sido motivo de preocupación para profesionales de diversas disciplinas, obtener la estandarización de este tipo de documentos, así converge el lenguaje de marcado XML, al igual normas avaladas por la ISO como EAD Encoded Archival Description e ISAD (G) International Standard Archival Description, por mencionar algunas, con el propósito de asumir los desafíos en la gestión de información.

En este contexto, las unidades de información bibliotecas y archivos, ante el inadvertido aumento de información consignada en diferentes soportes han requerido para mejorar y optimizar sus procesos de administración, búsqueda y recuperación de información la implementación de técnicas propias de otras disciplinas, una de ellas la tecnología, coadyuvando al profesional de información a mejorar procesos para el desarrollo efectivo de su gestión.

Así las cosas, el crecimiento de productos y servicios de información electrónica como los sistemas de recuperación de información (SRI), son objeto de constante evolución y perfeccionamiento para cumplir con nuevos esquemas en la sociedad del conocimiento. En un comienzo Las bases de datos  resultaron ser la solución a problemas de almacenamiento y extracción de datos; sin embargo en la actualidad comienzan a ser relegadas al no suplir las necesidades de información de  usuarios, dificultando la recuperación.

Los sistemas de recuperación de información demandan estudio, análisis y perfeccionamiento para adaptarse a las necesidades de información, pues son éstos puente de comunicación  entre  el profesional y los usuarios en las unidades de información, por consiguiente, el experto tendría que evaluar el nivel de accesibilidad a la información de los SRI, conocer concretamente criterios de búsqueda, que inciden directamente en la recuperación de información. En la próxima entrada daremos a conocer aspectos a tener en cuenta para la  evaluación de un SRI.
_______________
[1] EDICIÓN ELECTRÓNICA: ¿con qué formato? El profesional de la Información. [término de búsqueda: edición electrónica de documentos][en línea – html]. [consulta: 2011-04-19] Disponible en: 
http://www.elprofesionaldelainformacion.com/contenidos/1995/febrero/edicin_electrnica_con_qu_formato.html 

MENDEZ RODRIGUEZ, Eva María. Metadatos y recuperación de información estándares, problemas y aplicabilidad en bibliotecas digitales. Barcelona: Ediciones Trea, 2002. 429 p. ISBN: 84497040554

Google Custom Search Engine

Google Custom Search Engine aliado en la búsqueda y recuperación de información
Google Custom Search Engine (CSE), anteriormente conocido como Google Co-op, es una plataforma desarrollada por Google que converge en 2006, principalmente  como sistema de ayuda para webmaster permitiendo crear buscadores personalizados que brinden información especializada por áreas del conocimiento, es decir, admite crear un motor de búsqueda específico.

Al ser un buscador personalizado, sólo contiene las  páginas en las cuales el autor desea se realicen las búsquedas, así la recuperación se ajusta más a las necesidades propias del grupo de usuarios, resultando ser más óptima. De igual forma, los lectores pueden sugerir otras páginas relevantes para ser añadidas al buscador, o en caso contrario elimina los portales web no deseados. También puede ser ajustado a un blog con la tecnología Google AdSense

El control del vocabulario

En una anterior entrada denominada: Objetivos del control de vocabulario en la recuperación de información;  habíamos hecho alusión a F.W. Lancaster, quien inició su carrera en 1963, siguiendo una línea de investigación surgida en la década del 60 en Sistemas de Información: la Recuperación de información.

En consecuencia y como resultado de una de sus investigaciones el libro titulado: El control del vocabulario en la recuperación de información, ahonda en la intención de éste blog: la generación de conocimiento en temas relacionados con búsqueda y recuperación. Si está interesado en conocer la importancia que tiene el vocabulario controlado o normalizado lo invitamos a leer el siguiente libro electrónico y haga conocer su punto de vista al respecto.

Portal Metabiblioteca

"La asignatura Recuperación de  Información busca y propone desarrollar en el estudiante, habilidades y conocimientos relacionados con la búsqueda, selección, organización, síntesis, análisis y evaluación de la información y los sistemas informáticos relacionados, vista esta como un activo para la toma de decisiones o investigaciones."

Por tal motivo, el desarrollo de clase del lunes 11 de abril de 2011, tuvo fundamento en las lecturas realizadas como introducción al tema: Repositorios Documentales y la Iniciativa de Archivos Abiertos en Latinoamérica. De tal forma, teniendo en cuenta los aportes hechos por cada uno de los grupos participantes en el desarrollo y configuración del metabuscador, se definió la ecuación de búsqueda para proceder con la recuperación y análisis de la información hallada.

Es así como el metabuscador contendrá las principales fuentes académicas documentales existentes en cada país de Iberoamérica y se busca domine contenidos de calidad provenientes de entidades académicas, culturales y de investigación que aporten en la gestión del conocimiento a nivel local e interno. Si es profesional Bibliotecólogo, Archvista, estudiante de Sistemas de Información, o sencillamente está interesado en conocer los adelantos efectuados observelos aquí y dé a conocer su opinión.