Vistas de página en total

Buscar este blog

Mostrando entradas con la etiqueta sistemas de recuperacion de informacion. Mostrar todas las entradas
Mostrando entradas con la etiqueta sistemas de recuperacion de informacion. Mostrar todas las entradas

miércoles, 4 de mayo de 2011

BÚSQUEDA DE INFORMACIÓN EN INTERNET - Búsqueda y Recuperación de Información

BÚSQUEDA DE INFORMACIÓN EN INTERNET



Margarita Lugo Rocha


Las TIC ofrecen una gran cantidad de recursos educativos que pueden ser utilizadas entre otras cosas, para la búsqueda de información en Internet.



1. Lo primero que tienes que hacer es que tu computadora tenga acceso a internet.

2. Después utilizarás un navegador que puede ser Mozilla Firefox o Internet Explorer o cualquier otro que tengas y que puedes identificar en tu computadora con los iconos:




3. Ahora vamos a entrar al buscador Google, esto lo haces escribiendo en la barra de direcciones: www.google.com.mx y aparecerá la siguiente ventana




4. Deberás tener claro ¿Que se debe hacer para realizar una búsqueda?


Objetivo claro de la búsqueda (qué y por qué) Saber dónde se va a buscar (cómo y dónde) Utilizar palabras clave adecuadas Confiabilidad de la información (qué he encontrado)


5. Durante la búsqueda es muy importante el uso de las comillas, así al digitar “10 de abril de 1919”, recibimos información únicamente de lo acontecido en esta fecha.


6. También podemos recurrir a la pestaña de imágenes de Google, para ubicar las que se requieran en el trabajo.


7. Una vez encontradas las imágenes que se quieren, ubicamos el cursor sobre la imagen, damos clic en botón derecho y clic en salvar la imagen como. Ubicamos el lugar de nuestra computadora en donde la queremos guardar, se le proporciona un nombre a la imagen y listo:


8. Es muy importante que la información que buscamos sea confiable, para ello buscaremos referencias de instituciones como la UNAM, o que en la liga tengan gob o de sitios que contienen información objetiva y fiable, es decir, se deben usar las direcciones propias de lo que estamos buscando, es decir si quiero algo sobre la UNAM, deberé buscar en su propia página.


9. En la búsqueda de información, para ir acotándola, también es necesario utilizar la búsqueda avanzada, en el cual se utilizan las palabras claves o indicadores de búsqueda y también es útil determinar los operadores lógicos (and, not, or) o los limitadores de campo que se van a emplear, los cuales nos sirven para unir o discriminar tipos de información.

A continuación se presentan algunos ejemplos:








10. Para entrar en la búsqueda avanzada das clic en donde dice búsqueda avanzada: a continuación se presenta la pantalla de la búsqueda avanzada con el buscador google.

lunes, 25 de abril de 2011

Búsqueda y Recuperación de Información - Indización Social

Indización Social y Recuperación de Información




HASAN, Montero Yusef. Indizacion social y recuperación de información. (Termino de busqueda: indización y recuperación de información). 2011-04-25. Disponible en: http://www.nosolousabilidad.com/indizacion_social.htm





Con la aparición en la Web de las herramientas de bookmarking social (como del.icio.us), se populariza un nuevo modelo para organizar, describir y compartir recursos web, denominado tagging o etiquetado social. Como primera definición operativa podemos decir que el tagging es aquel proceso distribuido en el que los recursos u objetos son descritos o caracterizados por medio de tags (términos o conjuntos de términos en lenguaje natural). Al resultado agregado de este proceso se le denomina folksonomía, que significaría “clasificación hecha por el pueblo” (Quintarelli; 2005).




El tagging tiene dos dimensiones interrelacionadas: la personal y la colectiva. En su dimensión personal, el tagging es un proceso de indización o categorización de recursos cuya principal motivación es de carácter egoísta: el usuario etiqueta los recursos para poder recuperarlos posteriormente (Cañada; 2006). Es decir, cada usuario confecciona su propio índice personal de tags (personomía) para su colección personal de recursos.



Puesto que el tagging suele llevarse a cabo en un entorno compartido, tiene además una dimensión social o colectiva: los usuarios comparten sus tags y recursos, generando mediante colaboración implícita un índice global de tags (folksonomía) a través del que cualquier persona podrá recuperar cualquier recurso descrito por otros usuarios. Esta dimensión social es la que le confiere al tagging su mayor potencial en áreas como la Recuperación de Información (entre otras).


A continuación se contextualiza y define el concepto de indización social, con el objetivo de poder abordar sus características, ventajas, desventajas e implicaciones para la recuperación de información.


Indización Social






La indización es el proceso de analizar el contenido de los documentos (recursos, imágenes, textos, etc.) y asignarle términos descriptivos, generando un índice de puntos de acceso a través del cual poder recuperar dichos documentos.



La distinción entre tipos de indización se suele realizar en función de cómo se realiza el proceso, dando pie a dos grandes categorías: indización humana e indización automática.


La indización humana es un proceso intelectual, donde es una persona (tradicionalmente un indizador profesional) quien, tras analizar el contenido del documento o parte del documento, le asigna aquellos términos de indización que considera identifican las temáticas principales de su contenido.



La indización automática, por el contrario, es realizada por algoritmos que mediante diversas técnicas o métodos determinan cuál es el peso con el que cada uno de los términos que aparecen en el documento representa su contenido temático.


La indización humana y la automática ofrecen resultados diferentes, aunque igualmente válidos (Anderson, Pérez-Carballo; 2001). Sin embargo, la automática posee una destacable ventaja frente a la humana: su menor coste. Por esta razón resulta la única opción plausible en colecciones de gigantesco volumen y constante crecimiento (como es la propia Web).



La indización humana únicamente puede aplicarse sobre colecciones dinámicas y de gran volumen a través de la distribución de la tarea de indizar entre el máximo número de individuos posibles. Un modelo de distribución del trabajo sería la indización realizada por los autores o creadores de los recursos. En la Web tenemos ejemplos claros de este modelo, como el empleo de las metaetiquetas en páginas HTML o el tagging de autor-creador (flickr).



La indización social representaría un nuevo modelo de indización, en el que son los propios usuarios o consumidores de los recursos los que llevan a cabo su descripción - lo que Mathes (2004) denomina metadatos generados por el usuario -. La descripción de cada recurso se obtendría por agregación, es decir, un mismo recurso sería indizado por numerosos usuarios, dando como resultado una descripción intersubjetiva y por tanto más fiable que la realizada por el autor del recurso, e incluso por un profesional.



Otra diferencia de la indización social frente a la individual es que ya que los recursos son indizados independientemente por varias personas, el resultado del proceso será más exhaustivo, es decir, se asignará un mayor número de términos de indización diferentes a cada recurso. Al ser más exhaustiva la indización, es más consistente, mitigando el tradicional problema de la inconsistencia en la indización profesional. Sin embargo, esta exhaustividad no será proporcional: habrá recursos con muchos tags asignados, y recursos con muy pocos tags (Hassan; 2006b).




Por ello, para explotar el verdadero potencial de la indización social en recuperación de información, este modelo de indización debe ser considerado un híbrido entre la indización humana y la automática. Por un lado es resultado de un proceso intelectual (humano) distribuido, pero al mismo tiempo si no se aplican algoritmos de ponderación, el resultado “en bruto” de la indización social contendrá excesivo ruido y ambigüedad semántica como para resultar de utilidad colectiva.


Palabras clave o Categorías




Cuando se trata de definir qué son los tags, algunos autores los asemejan a categorías mientras que otros a palabras clave. La distinción conceptual entre palabras clave y categorías, y por tanto entre descripción y clasificación, es básicamente una cuestión de especificidad.



Las categorías representan la temática global bajo la que se enmarca un recurso, mientras que las palabras clave describen aquellos conceptos que son tratados en el recurso (Hassan, Núñez-Peña; 2005).



Ya que es una cuestión de especificidad, podemos darle una interpretación estadística, partiendo de las medidas de especificidad del término (número de recursos web que representa) y exhaustividad de la indización (número de términos asociados al recurso) (Spärck Jones; 1972). Es decir, es una cuestión de proporcionalidad entre el número de recursos de la colección y el número de términos diferentes presentes en el índice.



Así, la descripción por palabras clave daría lugar a términos de indización más específicos e indizaciones de recursos más exhaustivas, mientras que su categorización daría lugar a términos más genéricos e indizaciones menos exhaustivas.



Distinguir entre palabras clave y categorías sería una cuestión completamente trivial si no fuera porque dependiendo de la naturaleza de la indización, ésta resultará de mayor utilidad para ofrecer sistemas de búsqueda (querying) o, por el contrario, sistemas de navegación (browsing). De este modo, la descripción por términos más específicos será más adecuada para sistemas de búsqueda, mientras que los términos más genéricos (categorización) son más apropiados para ofrecer sistemas de navegación.


¿Por qué es así?



El querying (interrogación de un buscador) es una estrategia de búsqueda que el usuario utiliza cuando tiene bastante claro qué está buscado (y sabe expresar sus necesidades de información mediante una consulta). El browsing (exploración o navegación), en cambio, es una estrategia para búsquedas de propósito general, en las que el usuario prefiere reconocer qué está buscando.


La indización por términos más específicos ofrece mayor precisión en los resultados, proporcionando al usuario pocos resultados pero relevantes, y satisfaciendo necesidades de información concretas.


En cambio, la indización por términos genéricos ofrece mayor exhaustividad, proporcionando mayor cantidad de resultados relevantes, pero también de no relevantes.



Naturaleza y utilidad de los tags


El tagging se encuentra en un término medio entre la descripción y la categorización. Si bien la indización social resulta más exhaustiva que la indización humana (individual), y por tanto genera un índice de términos más específicos, el tagging es un proceso mucho menos exhaustivo que la indización automática. Esto es así porque en la indización automática, a priori, todos los términos que aparecen en el cuerpo textual del documento son candidatos para formar parte de su descripción.


Esto significa que la indización social no resultará más pertinente que la automática para la recuperación de información por consulta mediante buscador (siempre y cuando estemos tratando recursos o documentos de naturaleza textual o con alguna descripción textual, y por tanto indizables automatizadamente). De hecho, la mayoría de sistemas basados en tagging ofrecen como opción primaria de búsqueda la basada en indización automática a texto completo, y no por tags.



Aún así, un buscador podría enriquecerse con el conocimiento subyacente en las folksonomías: relaciones semánticas entre tags (análisis de co-ocurrencias) y grados de relevancia, autoridad, o interés potencial de los recursos.



Conclusión


A modo de resumen, podemos concluir:



Sólo podemos hablar de un nuevo modelo en aquellos sistemas que permiten la indización social agregada, es decir, donde varios usuarios indizan un mismo recurso. El tagging de autor, donde son los creadores de los recursos los que asignan los tags (fotos en flickr, tags en blogs…) no representa un modelo innovador.



De cara a la recuperación de información, es esta dimensión social del tagging la que ofrece mayores expectativas: descripción intersubjetiva, mayor exhaustividad y consistencia en la indización, y posibilidad de extraer relaciones de semántica subyacente.



Ya que los tags se asignan de forma completamente libre y con diversas motivaciones, resulta necesario el empleo de algoritmos de ponderación y de eliminación de tags vacíos de significación colectiva.



Los tags tienen una naturaleza genérica, por lo que los índices de tags son más apropiados para ofrecer sistemas de navegación que sistemas de búsqueda. Esto no significa que los sistemas de búsqueda no puedan enriquecerse con el conocimiento latente de las folksonomías, pero sí que un sistema de búsqueda basado exclusivamente en los términos asignados por tagging ofrecerá unos ratios de precisión muy bajos, además de silencio en la recuperación (para muchas búsquedas no habrá resultados, o ninguno será relevante).



Los actuales sistemas de navegación basados en tagging tienen una utilidad y usabilidad bastante limitada. Tal es el caso de los Tag-Clouds o nubes de etiquetas.




Bibliografía


Abadal, E.; Codina, L. (2005). Recuperación de Información. En: Bases de Datos Documentales: Características, funciones y método. Capítulo 2. p. 29-92. Madrid: Síntesis, 2005. Disponible en:




Anderson, J.D.; Pérez-Carballo, J. (2001). The nature of indexing: how humans and machines analyze messages and texts for retrieval. Information Processing and Management, 37, 2001, pp. 231-254.

Baeza-Yates, R.; Ribeiro-Neto, B. (1999). Modern Information Retrieval. Addison-Wesley, Wokingham, UK, 1999.

Barrero, V.; Seoane, C. (2005-2006). Anotaciones publicadas sobre folksonomías y tagging. Deakialli DocuMental. Disponible en:


Blat, F. (2006). Tag relacionados: aproximaciones. In web we trust. Disponible en:


Cañada, J. (2006). Tipologías y estilos en el etiquetado social. Terremoto.net: Diseño de interacción desde el año 2000. Disponible en:


Hassan, Y. (2006a). Visualización y Recuperación de Información. II Encontro de Ciências e Tecnologias da Documentação e Informação. 27 Abril, 2006. Disponible en: http://www.nosolousabilidad.com/hassan/visualizacion_y_recuperacion_de_informacion.pdf

Hassan, Y. (2006b). Consistencia inter-tagging. VéaseAdemás. Disponible en:


Hassan, Y.; Herrero, V. (2006). Improving Tag-Clouds as Visual Information Retrieval Interfaces. InSciT2006: Mérida, Spain. 25-28 de Octubre, 2006. Disponible en:


Hassan, Y.; Núñez-Peña, A. (2005). Diseño de Arquitecturas de Información: Descripción y Clasificación. No Solo Usabilidad Magazine. 14 de Enero de 2005. Disponible en: http://www.nosolousabilidad.com/articulos/descripcion_y_clasificacion.htm




Mathes, A. (2004). Folksonomies - Cooperative Classification and Communication Through Shared Metadata. Unpublished paper. Disponible en:






Quintarelli, E. (2005). Folksonomies: power to the people. ISKO Italy-UniMIB meeting: Milan. June 24, 2005. Disponible en:






Rijsbergen, C.J. (1975). Information retrieval. London: Butterworths, 1975. Disponible en: http://www.dcs.gla.ac.uk/Keith/Preface.html



Sinha, R. (2005). A cognitive analysis of tagging. Rashmi Sinha Blog. Disponible en: http://www.rashmisinha.com/archives/05_09/tagging-cognitive.html



Spärck Jones, K. (1972). A statistical interpretation of term specificity and its application in retrieval. Journal of Documentation, 28 (1), 1972, 11-21.






miércoles, 20 de abril de 2011

El control del vocabulario en la recuperación de información - Búsqueda y Recuperación de Información


Búsqueda y Recuperación de Información

viernes, 15 de abril de 2011

Búsqueda y Recuperación de Información - Guia Promocional



Publicada una guía para promover la comunicación en las familias sobre uso adecuado internet, móvil y videojuegos


El consejero de Salud del Gobierno de La Rioja, José Ignacio Nieto, ha presentado esta mañana la nueva guía para padres 'Habla con ellos de las tecnologías: Internet, móviles y videojuegos', con el objetivo de facilitar la comunicación en las familias riojanas para promover un uso seguro y responsable de las nuevas tecnologías por parte de los hijos adolescentes.




La guía, de la que se han editado 2.000 ejemplares, se va a distribuir en las escuelas de padres, institutos, colegios, bibliotecas, asociaciones y ONGs del ámbito de las drogodependencias de La Rioja, así como a aquellas personas que soliciten información específica sobre este tema en el Servicio de Drogodependencias de la Consejería de Salud, que está ubicado en la calle Gran Vía, 18, de Logroño (y en el teléfono gratuito 900 714 110).

Este material se dirige a las familias interesadas en aprender pautas concretas de actuación con sus hijos con respecto al buen uso de las tecnologías.

En el caso de la presente guía, las tecnologías pueden causar problemas de abuso o adicciones denominadas 'no tóxicas', es decir, que determinadas personas sufren angustia, ansiedad, nerviosismo o irritabilidad una vez que dejan de jugar o utilizar el móvil o de usar Internet, ha destacado el consejero.

Importantes cambios en la sociedad

Salud ha editado la guía con el ánimo de abordar la problemática con la que muchos padres se enfrentan y por la cual demandan ayuda, de poder hablar y orientar a sus hijos adolescentes acerca del uso de las tecnologías.

Las Tecnologías de la Información y la Comunicación (TIC's) han generado importantes cambios en nuestra sociedad. Estas tecnologías consisten en una variada gama de instrumentos, herramientas, canales y soportes dedicados esencialmente al uso, manejo, presentación, comunicación, almacenamiento y recuperación de información. En cuanto a los adolescentes y jóvenes se refiere, al hablar de nuevas tecnologías la guía se centra, principalmente, en el uso de Internet, videojuegos y teléfonos móviles. Por esta razón, desde hace un tiempo, Salud está apostando por la prevención de este uso inadecuado de las nuevas tecnologías, dado que la mejor manera de evitar un problema es enseñar a los jóvenes a hacer un uso seguro y responsable de ellas.

El objetivo de la presente guía es ayudar a los padres en esta labor. Además, la guía incluye también pautas de actuación y recomendaciones concretas para fomentar que la familia sea un centro de referencia, un lugar que ofrezca apoyo y seguridad a los hijos para lograr este uso adecuado de las tecnologías.

La Guía sigue una metodología muy práctica a través de orientaciones clave para los padres sobre qué hacer y cómo actuar, ejemplos explicativos de situaciones concretas y cuadros resumen que resaltan las ideas más importantes de cada apartado.

En los anexos de la guía se puede encontrar información sobre los sistemas de clasificación de los videojuegos y el control de los padres. Asimismo, en la parte final de la guía hay un pequeño glosario que puede ayudar a conocer el significado de algunos términos importantes sobre las adicciones y las tecnologías. Toda esta información se completa con una recopilación de todos los organismos implicados en la asistencia a las drogodependencias, con el fin de facilitar a las personas interesadas en la guía direcciones y teléfonos a los que dirigirse en caso de dudas.



20 minutos.es. publicada guia promover la comunicacion en las familias sobre uso adecuado de internet, movil y videojuegos.2011-04-10. Disponible en: http://www.20minutos.es/noticia/1018452/0/



Mas Búsqueda y Recuperación de Información: http://informationrecuperation.blogspot.com/

lunes, 11 de abril de 2011

Búsqueda y Recuperación de Información - Protocolos de Transferencia

Los Sistemas de Información Documental (SID)


Corresponden a un tipo especial de sistema de información cuyo propósito principal es generar información útil a una necesidad específica de información suministrada por un usuario, con el fin de producir nuevo conocimiento.


La información generada por el sistema de información documental se representa mediante documentos que son manejados por el sistema como objetos de información digital (por ejemplo, en los Sistemas Integrados de Gestión de Bibliotecas (SIGB) y en las actuales bibliotecas digitales).


Son numerosos los protocolos desarrollados a través de los años con el fin de permitir la interoperabilidad entre Sistemas de Información Documental (SID):

• Z39.50 • Simple Digital Library Interoperability Protocol (SDLIP) • OAI (Open Archives Protocol) • Guildford protocol • Dienst protocol • ZING SRU/W • Starts (Stanford Protocol Proposal for Internet Retrieval and Search) • Dienst protocol • Lyceum Protocol • Harvest: A Distributed Search System

Sin embargo, sólo algunos de éstos se han consolidado internacionalmente como estándares aceptados por los profesionales de la información, son usados de manera masiva y su desarrollo y mantención se encuentra avalado por iniciativas tanto públicas como privadas: el Protocolo Z39.50 y el Protocolo OAI-PMH.


Protocolo Z39.50

El Z39.50 (Information Retrieval (Z39.50); Application Service Definition and Protocol Specification. ANSI/NISO Z39.50-2003) es un protocolo para la recuperación de información basado en la estructura cliente/servidor que facilita la interconexión de sistemas informáticos y que podría considerarse como la norma más relevante para el mundo de las bibliotecas y de la documentación desde la aparición del formato MARC.


Lo que hace el protocolo Z39.50 es especificar un conjunto de reglas para gestionar las formas y procedimientos de interconexión remota de computadoras, con el propósito de buscar y recuperar información, aunque su aplicación actual es más amplia pues incluye la consulta y el intercambio de datos bibliográficos, y la intercomunicación de índices y resúmenes, de información geoespacial, de documentos oficiales, de objetos digitales o de metadatos que describen los documentos de las bibliotecas electrónicas o digitales.


La estructura del Z39.50 utiliza:

• Un cliente u origin también conocido como Cliente Z, el que se comunica con procesos auxiliares que se encargan de establecer conexión con el servidor, enviar el pedido, recibir la respuesta, manejar las fallas y realizar actividades de sincronización y seguridad. El usuario interactúa con el cliente de forma gráfica.


• Un servidor o target conocido como Servidor Z, el que proporciona un servicio al cliente y entrega los resultados de una tarea específica, estableciendo procesos auxiliares que se encargan de recibir las solicitudes del cliente, verificar la protección, activar un proceso servidor para satisfacer el pedido, recibir su respuesta y enviarla al cliente.

• Una estructura de datos. • Reglas de intercambio. • Un transporte de información confiable como son TCP/IP (Transmission Control Protocol/Internet Protocol) y OSI (Open System Interconnection).

GUAJARDO Salinas, Aldo. Z39.50 y OAI-PMH: Protocolos de Transferencia y Recuperación de Información. 2010. p.1,2. Disponible en: http://www.bibliotecarios.cl/descargas/2010/11/guajardo_z3950.pdf

jueves, 31 de marzo de 2011

SISTEMAS DE RECUPERACIÓN DE INFORMACIÓN

La recuperación de información nace de la necesidad de resolver un problema, anteriormente cuando no habia maquinas y los procesos eran manuales en las bibliotecas se usaban ficheros e indices pero con el paso del tiempo y la evolución de las tecnologias, los volumenes de información aumentarón y se hizo necesaria la utilización de maquinas que permitan realizar el proceso de buscar, indizar, determinar relevancias, preguntas etc., de alli la creación de los Sistemas de Recuperación de Información (SRI).


Entonces recuperación de información a las luz de los SRI son todos los procesos automatizados que permiten solucionar una necesidad de información, en donde el usuario accede a documentos relevantes y le entrega resultados mas alla del termino exacto introducido en la búsqueda.


De esta manera un SRI recupera documentos Relevantes es decir, que son importantes dentro de un tema, aunque el estado ideal sería que el sistema entregara documentos pertinentes por los volumenes de información no es tan sencillo de hacer.

martes, 8 de marzo de 2011

sistemas de recuperacion de informacion

SISTEMAS DE RECUPERACION DE INFORMACIÓN
El diseño centrado en el usuario para la creación de productos y servicios de información digital

Jesús Tramullas Saz
Depto. CC. de la Documentación,
Univ. de Zaragoza
http://tramullas.com/

Resumen
Este trabajo estudia los conceptos básicos del diseño centrado en el usuario, aplicado aproductos y servicios de información digital. Revisa los contextos y diferentes enfoquespara su aplicación y desarrollo, así como las técnicas de usabilidad que puedenutilizarse. Detalla las fases de desarrollo de productos de información digital para elweb, desde la perspectiva del diseño centrado en el usuario. Por último, propone unmarco teórico-práctico de aplicación en los productos de información digital.
Abstract

This paper studies basic concepts for the user centered design, applied to digitalinformation products and services. Different context and approaches for application anddevelopment are revised, and the usability techniques that can be applied. From the usercentered design perspective, development phases for web information products aredetailed. Last, proposes a teoretical and practical framework to apply in digitalinformation products.
WooRank of informationrecuperation.blogspot.com