GOOGLE DESKTOP SEARCH: BUSCADOR PARA RECUPERACION DE INFORMACION

Google ofrece a todos los usuarios la valiosa herramienta Desktop Search, como herramienta especializada para la búsqueda de texto, imágenes, correos electrónicos entre otros.

Google indexa los archivos y documentos guardados que aparecen en el escritorio o simplemente se seleccionan aquellos que se desean indexar en la web, con el fin de recuperar aquella información relevante y útil para cada persona, lo cual se puede lograr en el momento deseado; esta búsqueda se logra por el tipo de archivo o por orden cronológico.

 Este es un excelente buscador ya que permite obtener vista previa de sus resultados sin salirse de la página, además, tiene la ventaja de proveer la interfaz de búsqueda y resultados similar a la web de Google.
La ventaja que Google ofrece es la muestra de los resultados en la versión actual, identificando los archivos que se mencionan a continuación, mediante iconos:

    -    Archivos de Microsoft Excel
-     Archivos de Microsoft Word
-      Archivos de Microsoft PowerPoint
-      Archivos PDF
-      Archivos de texto
-      Archivos de música
-      Archivos de video
-      Páginas web visitadas*
* Nota: Para este caso, los resultados muestran iconos únicamente del sitio web de la página.
Fuentes:
(1) Gómez, Dueñas Felipe 
 Memorias de Clase
(2) GOOGLE [en línea] [consultado 16/03/11].
Disponible en: http://www.desktop.google.co.il/en/index.html

METABIBLIOTECA

Es el desarrollo de un motor de búsqueda que ofrece a la comunidad el beneficio de acceder y ubicar desde internet muy fácilmente los diferentes recursos bibliográficos disponibles que se encuentran en las bibliotecas y los centros de documentación.

El proyecto de metabiblioteca de la Universidad de La Salle, liderado y dirigido por Ing. Laureano Gómez, desarrollado en el ámbito académico de recuperación de información, se basa en seguir la pista y encontrar información que incluya contenidos científicos, académicos y tecnológicos que garanticen su importancia y confiabilidad, en varios índices de las bibliotecas, institutos de investigación, de los países latinoamericanos. 

El fin de recopilar producción intelectual y respetando los derechos de autor, la metabiblioteca enlazara toda esa producción, para contribuir al desarrollo del conocimiento en una sola plataforma.     

Por lo tanto los profesionales de la información apoyan esta iniciativa, siendo esta la prioridad de crear en la web, una herramienta que es una nueva fuente de conocimiento para la actual sociedad y futuras generaciones utilizando las tecnologías de la información.

Fuente:
Felipe Gómez D.
Memoria de Clase

RECUPERACION DE INFORMACION SOFTWARE ANTCONC 3.2.1

Este programa permite realizar el análisis de concordancias, por lo tanto, muestra el contexto de aparición de las palabras clave en uno o varios textos.

Es un software libre, por lo tanto es gratuito, que se puede instalar en sistemas operativos como Linux, Mac y Windows.

Para utilizar el AntCon es necesario recopilar los archivos o varias fuentes documentales en formato *.txt y así generar una base de datos que será utilizada para realizar la búsqueda. Este programa realiza la búsqueda de un término elegido, el cual mostrara resultados y su concordancia para analizar los patrones lingüísticos y la frecuencia para ver la palabra en un contexto real y así analizar s uso.

Para realizar el análisis, el programa presenta varias herramientas, entre ellas:

  • Concordance: Pestaña que con el apartado “Search term” se introduce la palabra a utilizar como término clave.
  • Concordance Plot: Se puede realizar la búsqueda como en Concordance, pero a diferencia muestra los resultados en forma gráfica, mostrando la posición relativa en el texto y las ocurrencias del término seleccionado para la búsqueda.  
  • File View: Permite ver el archivo
  • Clusters: Presenta el término de búsqueda en forma agrupada, es decir en frases.
  • Collocates: Muestra el término de búsqueda en listado a la izquierda o a la derecha.  
  • Word List: Genera listas de palabras ordenadas que aparecen en los archivos a analizar
  • Keyword List: Compara las listas de palabras con otros corpus; generando listas de palabras frecuentes.

Al hacer uso de estas herramientas es necesario indicarle al programa cual es el conjunto de documentos al que se ve a realizar el estudio.

Referencia:
Memorias de clase 3
[1] Felipe Gómez Dueñas
[3] http://www.antlab.sci.waseda.ac.jp/software.html [en linea] [consultado: 30/0411]

WIKI - RECUPERACION DE INFORMACION


La expresión Wiki Wiki, de origen hawaiano, que significa "rápido". Su primer creador fue Ward Cunningham, quien en 1995 promovió la primera implementación de un servidor Wiki Wiki para el repositorio de patrones Portland (Portland Pattern Repository).

Es la base de datos en línea que fue constituida por varias páginas que son editadas en vivo por diversos usuarios a través de un navegador web.

La wiki es una colección de paginas hipertexto, además de ser una herramienta para escritura colaborativa, es decir, son bloques de comentarios realizados por los visitantes, quienes pueden introducir, cambiar, suprimir contenidos de una página web en forma rápida y fácil.

Son varias las características y utilidades de wiki: entre ellas, la creación y el mejoramiento de páginas en forma instantánea, escribir artículos en forma colectiva utilizando el lenguaje wiki texto el cual es editado mediante un navegador, se escriben en lenguaje HTML, permiten al publico acceder sin necesidad de registrarse con cuenta de usuario, es simplemente estar conectado a internet.

Hoy por hoy, el wiki más amplio que existe es la versión en inglés de Wiki pedía.

Wikipedía, La enciclopedia libre, 2011 [fecha de consulta: 21 de abril del 2011].
Disponible en  http://es.wikipedia.org/w/index.php?title=Wiki&oldid=45329478

RECUPERACION DE INFORMACION TEXTUAL GOOGLE NOS AYUDA


Cuando se necesita  recuperar información textual que satisfaga la necesidad de información de un usuario, se observa que es compleja cuando es asociada al lenguaje natural según “[Baeza-Yates, 1999]”, motivo por el cual las técnicas de NLP se utilizan en la recuperación de información textual “[Allan, 2000],” para facilitar la descripción del contenido de los documentos, así como en la representación de la consulta que formula el usuario comparando ambas descripciones, de forma que el usuario obtenga una información que satisfaga su necesidad de información, de acuerdo a los conceptos de [Baeza-Yates, 2004]”
marcelita
Arquitectura de un sistema de recuperación de información
El sistema de recuperación de información textual realiza tareas para responder al usuario las consultas en:

1.   Indexación de la colección de documentos: genera un índice que contiene las descripciones de los documentos que representan mejor contenido.
2.   El sistema analiza la consulta formulada por el usuario y representa la necesidad del usuario al igual que el contenido de los documentos.
3.   El sistema presenta al usuario documentos con descripciones equivalentes a la descripción de la consulta.

Los resultados son ordenados y mostrados de acuerdo a su relevancia con la descripción de la consulta y los documentos.

_________________________________
[1] http://www.hipertext.net/web/pag277.htm#procesamiento-lenguaje-natural [consultado 06/04/11]
"Recuperación de Información”  “Programa de Sistemas de Información”

BUENAS PRACTICAS EN ANALISIS DE LA COLECCION CORREOS EN RECUPERACION DE INFORMACION

Gráfico inicial para el análisis de la Colección Correos, donde se puede visualizar fácilmente el contenido y el detalle de cada carpeta, lo que permite conocer el tamaño, cantidad de archivos y cantidad de subcarpetas.