Mostrando entradas con la etiqueta Busqueda de informacion. Mostrar todas las entradas
Mostrando entradas con la etiqueta Busqueda de informacion. Mostrar todas las entradas

MODELO DE RECUPERACION LOGICA DIFUSA

Este modelo pertenece a los de coincidencia parcial basado en las características.   La coincidencia de un documento con una pregunta es aproximada.  Considera que cada término de la pregunta define un conjunto difuso y que cada documento tiene un grado de pertenencia.


Fuente:
[1] http://revistas.ucm.es/byd/11321873/articulos/RGID0808110365A.PDF
[Consultado 17/04/11]

MODELO DE RECUPERACION INDIZACION SEMANTICA LATENTE

En este sistema se extraen un conjunto de términos de índice, del contenido de los documentos y las preguntas a establecer para la recuperación. Un documento puede ser recuperado cuando comparte conceptos con otros documentos que son relevantes para la pregunta dada.
Fuente:
[Consultado 17/04/11]

CLUSTERING: RECUPERACION DE INFORMACION

Según Tryon en 1939, el término clustering se refiere a las técnicas de "agrupar objetos similares mediante algoritmos matemáticos. Estas técnicas aplicadas al ámbito de la recuperación de información consiguen crear de forma automática clasificaciones de documentos considerando ciertas similitudes en su contenido.  En el caso de bases de datos documentales como los catálogos de bibliotecas, quiere decirse que se agruparán dentro de un mismo clúster aquellos documentos en los que concurran mayor número de términos de indización, por ejemplo.

Si a estas técnicas de agrupación se suma una presentación gráfica de su resultado, se obtiene una nueva forma de ver los documentos de las bases de datos que facilita el ojeo y por tanto la recuperación de información" [1]


Fuente:
[Consultado 14/05/11]

SISTEMAS DE RECUPERACION DE INFORMACION WORLD WIDE WEB

Chang en Mining the World Wide Web, establece 4 tipos de sistemas de recuperación de información en Web basados en la recuperacion de informacion por medio de palabras clave:

       1- Motores de búsqueda: indexan los documentos o recursos web de forma automática por medio de robots y conforman una base de datos a la que posteriormente consultará el motor cuando se realiza una consulta.
    
       2-  Directorios o Índices temáticos: se trata de listas de recursos organizados por categorías temáticas y estructuradas de forma jerárquica que permiten visualizar los contenidos ofreciendo una lista de enlaces a las páginas que aparecen referenciadas en el buscador.
     
        3-  Metabuscadores: reúnen varios motores de búsqueda ejecutando la consulta en varios motores de forma simultánea y, por tanto, combinan los resultados de diversas fuentes, pero eliminando las referencias duplicadas y agrupando los resultados ordenándolos por pertinencia. 
     
       4- Técnicas de filtrado de información: se trata de un complemento de los motores de búsqueda, y no realmente de un sistema de recuperación distinto. El filtro permite determinar si un documento o recurso es o no relevante a priori para mantenerlo o eliminarlo de los resultados.

______________
[1] http://www.hipertexto.info/documentos/busq_rec.htm[consultado [consultado 13/05/11]

OPERACIONES DE RECUPERACION DE INFORMACION

El objetivo de la recuperacion de informacion es el estudio y desarrollo de los métodos, ya sean algorítmicos (preferentemente) o intelectuales (cuando no es posible su automatización), que faciliten al máximo el siguiente grupo de operaciones:

1.   Indización: Cuando esta operación  se ejecuta en modo intelectual,  se subdivide en:
1.1. Análisis: identificación de los temas o conceptos más relevantes del documento.
1.2. Normalización: transformación de los conceptos que expresan el contenido del documento en los términos de indización (descriptores) más adecuados. En oportunidades, esta segunda fase toma el nombre de indización, obviando o dando por supuesto a la primera.
La indización puede aplicarse también a la necesidad de información. Por lo tanto, indización de documentos y de indización de la pregunta. En ambos casos, el resultado es un conjunto de descriptores. En el caso de la necesidad de información.
 Selección: identificación del conjunto de documentos más relevante para una necesidad de información.

2.   Ordenación: determinación del orden más adecuado de presentación al usuario de los documentos seleccionados o recuperados (en caso que sean más de uno, claro). La idea es ofrecer la lista de los documentos en orden decreciente (el más relevante primero) de probabilidad de satisfacer la necesidad de información. También se denomina ranking.

3.   Interconexión: establecimiento de relaciones hipertextuales, caminos y, en general, estructuras de navegación entre secciones del mismo documento o entre documentos distintos.

4.   Categorización: asignación de cada documento a un grupo, clase o subclase de un cuadro de clasificación, taxonomía u ontología.

5.   Abstracción: producción de resúmenes de documentos que, en algunas circunstancias, puedan sustituir la lectura del documento completo.

6.   Visualización: representación en forma gráfica de informaciones no necesariamente icónicas, así como de conceptos o procesos.

Badal, E.; Codina, L. (2005). Recuperación de Información. En: Bases de Datos Documentales: Características, funciones y método. Capítulo 2. p. 29-92. Madrid: Síntesis, 2005.

 ______________________________
[1] http://www.lluiscodina.com/riv2.doc
[Consultado 13/05/11]

ANALISIS Y RECUPERACION DE INFORMACION


Fuente:
[Consultado 13 mayo de 2011]
Busqueda y recuperacion de informacion Recuperacion de informacion 

MODELO DE RECUPERACION BOOLEANO

En este modelo se establece una recuperación entre el contenido de un campo y un término concreto.   

Los términos se combinan mediante los operadores AND (intersección de conjuntos), OR (unión de conjuntos), NOT (complementario de un con junto) y paréntesis.

El modelo booleano esta implementado en la mayor parte de los sistemas de búsqueda bibliográfica.

En combinación con este modelo, se utilizan otra serie de operadores que dan flexibilidad al modelo, como son los operadores de comparación y los posicionales.

  • Operadores de comparación: aquellos que especifican la búsqueda dentro de unos límites dados, se utilizan en documentos que pueden contener datos numéricos y ellos son: mayor que “ >”, menor que “<”, igual a “=”, diferente de. 
  • Operadores posicionales: son los que tienen en cuenta la posición de un término determinado en relación con otros.
   


____________________________
[Consultado 17 abril de 2011]

METABUSCADORES

Herramienta que genera resultados de varios motores de busqueda o directorios para encontrar las páginas mas relevantes. No tiene base de datos propia y se caracteriza por la optimizacion de tiempos de respuesta. Actuan sobre algunos de los buscadores de informacion general más conocidos.

Los metabuscadores mas conocidos son:


·        BUSCA MULTIPLE: Meta Búsquedas simultaneas en otros Motores de Busqueda top premiando Sitios Web.

·         CLUSTY: Utiliza un algoritmo para agrupar contenido basado en similitudes textuales.


·         DOGPILE: Permite hallar noticias, videos, música e imágenes desde multiples buscadores, además de las ya conocidas páginas Web.

·         IXQUICK: Los resultados de busqueda son más completos y más exactos. Las capacidades únicas de Ixquick incluyen una Búsqueda avanzada universal, una búsqueda global y un refinamiento avanzado.


·         METACRAWLER: Permite acotar las búsquedas por fecha, idioma, dominio o restringir los contenidos para adultos.


_________________________________
Editor: Wiki pedía, La enciclopedia libre
Última versión: 7 marzo del 2011, 19:21 UTC
Fecha de consulta: 8 mayo de 2011, 13:56 UTC
URL permanente:
Código de versión de la página: 44647386

TECNICAS DE BUSQUEDA Y RECUPERACION DEL DOCUMENTO

Una de las tantas técnicas para usar en la búsqueda de documentos es la que expone Chang expone 5,  las cuales se exponen:  

Término simple: Es la búsqueda más fácil donde el motor de búsqueda despliega solamente aquellos documentos que donde aparece el término.

Término compuesto: Esta búsqueda es más complicadas, motivo por el cual los buscadores utilizan la lógica booleana o la combinación de diversos operadores lógicos.

Basadas en el contexto: En este caso en la búsqueda son utilizados los operadores de proximidad para analizar si los términos aparecen, inclusive en el propio documento, en la misma frase y en un orden previamente establecido.  

Lenguaje natural: Se refiere a la búsqueda más compleja de todas, pero la más simple para el usuario, ya que es el motor de búsqueda quien estudia y aclara el texto para responder la consulta.
Correspondencia de patrones: se maneja el operador de truncamiento utilizando una interfaz donde el usuario, introduce los parámetros paso a paso.
___________________________
[1] http://www.hipertexto.info/documentos/busq_rec.htm [en línea] [consultado 01/05/11]

RECUPERACION DE ARCHIVOS MP3 A PARTIR DE SU CONTENIDO

Una de las técnicas a utilizar para este proceso es con el software Dragon Naturally Speaker que permite el reconocimiento de voz y convertir los archivos formato Mp3 en texto, se puede integrar con un software como Sonic Stage, software que se utiliza para la gestión de los dispositivos portátiles cuando están conectados a un equipo que ejecute Microsoft Windows , que es un programa de catalogación, organización, reproducción y valoración de audio. El análisis y desarrollo debe darse en una herramienta de gestión de contenidos de audio, buscando automáticamente la información tal cual como sucede en empresas y en la Web con los archivos de imágenes.

Fuentes:

Page name: Sonic Stage
Author: Wikipedia contributors
Publisher: Wikipedia, The Free Encyclopedia
Date of last revision: 1 April 2011 2326 UTC
Date retrieved: 3 may 2011 05:05 UTC
Permanent link:
http://en.wikipedia.org/w/index.php?title=Special:Cite&page=SonicStage&id=421899588
Primary contributors: Revision history statistics
Page Version ID: 421899588

http://www.nuance.com/dragon/index.htm   [consultado 3 mayo de 2011]
Busqueda y recuperacion de informacion Recuperacion de informacion

DEFINICION DE RECUPERACION DE INFORMACION

1.  La naturaleza interdisciplinar de la Recuperación de información, ha revisado aspectos principalmente en la evolución y desarrollo de la recuperación de información como campo amplio relacionado con los procesos de representación, organización, almacenamiento, búsqueda y acceso a la información, en el que han intervenido investigadores de diferentes ciencias, como la informática, ciencia de la información, documentación, lingüística, inteligencia artificial, etc. Desde una perspectiva diferente, todos lo han hecho con el objetivo de diseñar o usar SRI que proporcionen información relevante al usuario.
2.  Analizado el completo de la recuperación de información para establecer la RI en tres ciencias:
a.    La informática: domina el diseño del SRI, en los componentes de hardware y software.
b.    Ciencia de Información y Documentación: se identifica por tres aspectos
1.    Recuperación experimental: que se ocupa del diseño de algoritmos, índices y programas para organizar, almacenar y representar la información automáticamente, por consiguiente, se encarga del diseño del SRI.
2.    Recuperación de información online: se relaciona con el proceso de búsqueda constituyendo el enfoque relacionado con la Ciencia de la Documentación.
3.    La perspectiva cognitiva: centrada en el estudio del comportamiento del usuario y en la comprensión de sus necesidades. Además tanto en Informática como en Ciencias de la Información existen otras disciplinas que contribuyen al diseño del SRI que son más eficaces como la Lingüística, Ciencias Cognitivas, Lógica y Psicología. 

3.  Los límites de la Recuperación de Información en el contexto de la Ciencia de la Documentación se identifica como la parte del proceso documental, el cual se relaciona con la búsqueda de la información, relacionada con la indización, descripción bibliográfica y organización de la información, las cuales son tareas automatizadas que son propias de la Ciencia de la información.


4.  La función del documentalista como especialista en Recuperación de Información, se direcciona en proporcionar la información al usuario de forma y en tiempo oportunos para satisfacer su necesidad de información.

Se define la Recuperación de información dentro del contexto de la Ciencia de la Documentación como la disciplina que se ocupa de la aplicación de un conjunto de técnicas, métodos y actividades para buscar, localizar y recuperar de manera eficiente en los SRI la información relevante que requiere el usuario y así satisfacer así su necesidad de información.

Fuente:
Recuperación de la información – Biblioteca Alfagrama. 2008.   

ETAPAS EN UN PROYECTO DE BUSQUEDA DE INFORMACION


El profesional en archivística y bibliotecología debe usar estrategias para realizar la búsqueda de información, generando un proyecto y desarrollando cada una de las etapas para alcanzar los objetivos propuestos en la investigación, utilizando las herramientas adecuadas que este mundo globalizado le ofrece para resolver la necesidad de información deseada. Un ejemplo del proyecto antes mencionado, se publica a continuación:



Etapas en un proyecto de búsqueda de información
Etapas en un proyecto de búsqueda de información

Fuente:
http://www.ebsi.umontreal.ca/jetrouve/projet/6_esp.htm [en línea] [consultado 24/04/11]

REPOSITORIO

Se refiere al sitio centralizado de documentos digitales que son almacenados, conservados en bases de datos o archivos informáticos, con el propósito de organizar, presentar y publicar toda la producción intelectual, proveniente de la actividad investigadora y académica de una comunidad

Fuente:
-       (1) Memorias de clase
-       Felipe Dueñas Gómez
-       Wikipedia, la enciclopedia libre
-       Última revisión: 18 de marzo del 2011, 13:37 UTC
-       Fecha de consulta: 25 de abril del 2011, 00:56 UTC
-       Código de versión de la página: 44914431

RECUPERACION DE INFORMACION TEXTUAL GOOGLE NOS AYUDA


Cuando se necesita  recuperar información textual que satisfaga la necesidad de información de un usuario, se observa que es compleja cuando es asociada al lenguaje natural según “[Baeza-Yates, 1999]”, motivo por el cual las técnicas de NLP se utilizan en la recuperación de información textual “[Allan, 2000],” para facilitar la descripción del contenido de los documentos, así como en la representación de la consulta que formula el usuario comparando ambas descripciones, de forma que el usuario obtenga una información que satisfaga su necesidad de información, de acuerdo a los conceptos de [Baeza-Yates, 2004]”
marcelita
Arquitectura de un sistema de recuperación de información
El sistema de recuperación de información textual realiza tareas para responder al usuario las consultas en:

1.   Indexación de la colección de documentos: genera un índice que contiene las descripciones de los documentos que representan mejor contenido.
2.   El sistema analiza la consulta formulada por el usuario y representa la necesidad del usuario al igual que el contenido de los documentos.
3.   El sistema presenta al usuario documentos con descripciones equivalentes a la descripción de la consulta.

Los resultados son ordenados y mostrados de acuerdo a su relevancia con la descripción de la consulta y los documentos.

_________________________________
[1] http://www.hipertext.net/web/pag277.htm#procesamiento-lenguaje-natural [consultado 06/04/11]
"Recuperación de Información”  “Programa de Sistemas de Información”