Máster Calsi

10 mayo 2008

Nº 13. Fin de InfoCalsi

El pasado 4 de noviembre comenzó la andadura de InfoCalsi, blog creado a partir de los trabajos de ciertas asignaturas del Master Calsi. Los objetivos que me propuse fueron tratar al blog como tipología documental y divagar en relación a diferentes aspectos de interés para los documentalistas, a la vez que aprendía el uso de todas estas nuevas herramientas de edición y recuperación de contenidos.

Los problemas de mantenimiento de blogs han sido ya reiteradamente expuestos y analizados por otros compañeros: falta de tiempo, de temas sobre los que hablar, pérdida de la ilusión inicial, etc. Además, creo firmemente que los blogs, como tantas otras cosas en la vida, deben tener un objetivo, pasado el cual, ya no tienen sentido, al menos en la forma actual.

Este blog nació como trabajo de clase. Las asignaturas por las cuales nació InfoCalsi ya han sido superadas y, por tanto, el blog ha cumplido el cometido por el que fue creado.

La creación y mantenimiento de un blog temático es algo que no descarto en el futuro pero, desde luego, no con el modelo y cobertura temática de InfoCalsi, esa es la razón principal por la cual creo que debo darle fin. Además, en su número 13, para tentar a la suerte.

Una de las conclusiones comentadas el último día de clase fue clara, los blogs de los alumnos debían tener una doble funcionalidad: por una parte aprender a manejarlos y, por otra, usarlos como herramienta de comunicación entre nosotros. La primera función la hemos aprobado todos, pero la segunda, claramente no.

En muchas ocasiones se ha utilizado el blog como herramienta para expresar nuestras dudas o inquietudes, pero sin ánimo de entablar conversación. Sin duda es una lección que deberé tener en cuenta.

Ya sólo me queda dar las gracias a todas aquellas personas que me hayan leído durante estos meses y pedir disculpas por el tiempo transcurrido desde la publicación del nº 12 hasta hoy.

Durante estos meses, sobre todo los dos primeros, viví unos momentos muy felices al comprobar cómo personalidades de la biblioblogsfera a los que admiraba, como Catuxa Seoane, Javier Leiva, Daniel Gil, Lara Rey…, me nombraban o dejaban algún que otro comentario en mi modesto blog. Muchas gracias a todos!

También me gustaría dar especialmente las gracias a Álvaro Cabezas por todos sus comentarios y ánimos y desearle suerte en su tesis, algo que yo espero comenzar en breve y en el que tengo puestas muchas ilusiones.

Espero que el futuro me permita conoceros a todos en persona. Nunca un blog podrá sustituir a un apretón de manos. Hasta ese momento:


UN ABRAZO, GRACIAS Y HASTA PRONTO!

03 febrero 2008

Nº 12. ¿Quién es quien?

Todo aquel incauto que haya llegado hasta aquí, pensará que yo soy Enrique. Los que me conocen no lo dudarán, los que no, gracias al perfil de usuario, lo creerán más o menos.

Pero, ¿y si no fuera Enrique?, podría ser Ramón, o incluso Laura, ¿estarían seguros?

Podría ser un mero invitado a este blog que no hubiese usado el necesario protocolo de presentación, o un cracker desocupado, pero ¿quién?

Lo más atrevido para eliminar incertidumbre sería el método que utiliza, entre otros, technorati, cuando una persona desea reclamar la autoría de un blog.

Al introducir unos datos de contacto, el sistema te proporciona un mensaje que debes insertar en el blog. De esta forma el sistema sabe –y ni siquiera es seguro- que la persona que reclama el blog es la misma que tiene acceso al mismo, pero nada más. Nada impide llamarme de otra forma.

Comprobando los datos del dueño de una cuenta de correo llegaríamos a la misma conclusión. Se podría conocer quién es el dueño de una dirección de correo, pero podría haber mentido en su nombre. Nada de eso asegura la identificación.

La identificación de las personas no es algo privativo de la era de la Web, ¿quién podría afirmar que el autor de un artículo en papel es quien dice ser?

Lo único que podría identificarme (dejando de lado la usurpación de este sitio por parte de informáticos ociosos) sería la firma digital.

La firma digital se instala en el ordenador y con ella puedes firmar correos electrónicos, realizar diversas transacciones con la Administración y firmar documentos.

En el Master Calsi, de hecho, hemos firmado documentos en Word y PDF mediante la firma digital.

Puesto que los profesores nos piden que, además de explayarnos mentalmente, usemos la bitácora para comunicar dudas, preguntas, etc. Yo tengo una:

¿Se puede usar la firma digital para firmar un blog, o una entrada concreta?

Yo, de momento, no lo sé. Creo que esto es un tema interesante de debate. Puede que en este blog no sea importante quién sea pero es algo que la 'Science 2.0' y 'Open access 2.0' sí debería, por ser tecnológicamente posible, resolver.

26 enero 2008

Nº 11. El responsable de la Información


Aunque se salga algo de la temática de Infocalsi, no me he podido resistir. Ayer se publicó la siguiente reseña cinematográfica, escrita por Juan Lacasa, en el semanario La Cartelera, núm. 896, pág. 9, publicado por el periódico Levante-emv:

Fuente: La Cartelera, Levante-emv

La bajada de la noticia (metadatos para los humanos) dice:

“Dejando de lado su parte más gamberra, el popular Álex de la Iglesia ha realizado un thriller convencional de consumo rápido, con una trama enrevesada y llena de altibajos”.

Mientras que, en el último párrafo de la noticia, se lee:

“…aunque muchos esperábamos más de esta cinta, tampoco nos encontramos ante el típico y manido thriller convencional de consumo rápido y digestión difícil”.

Seguramente no habrá sido el autor el responsable de la bajada y no estará muy contento, pues las personas que, a falta de tiempo, sólo hayan leído este resumen, pensarán que ha dicho algo que no ha dicho.

Más allá de la anécdota, esta nota me sirve para reflexionar; me pregunto cuántos fallos de este tipo (no sólo gramaticales, que ya es una batalla perdida) pasarán desapercibidos en semanarios, dominicales, prensa, etc. No sé si me asusta más que no lo hayan revisado o que sí lo hayan hecho.

Se podrá argüir que es un error sin importancia y puede que tengan razón, pero yo me pregunto, si los ingenieros y arquitectos (por ejemplo) tienen una responsabilidad ante los fallos de sus diseños y ésta se les exige, ¿qué ocurre con la responsabilidad de los profesionales cuya materia prima de trabajo es la información y la palabra?

Creo que el problema está en que, si el trabajo está bien hecho, se dice que se crea patrimonio cultural (en un sentido estricto, pues se suele separar la ciencia de la cultura, cuando en realidad la ciencia es una parte más de la cultura) y, si está mal hecho, pues que tampoco pasa nada, que no es importante, que no es para tanto.

Puede que la Web semántica deba nacer primero en nosotros mismos...

20 enero 2008

Nº 10. Etiquetas, descriptores y palabras clave

Los blogs, como cualquier otra tipología documental, deben ser descritos de alguna forma para poder elaborar catálogos que nos informen tanto de su existencia como de los contenidos que albergan, ahorrándonos la terrible y angustiosa tarea de consultar la web a ciegas.

La construcción de estos catálogos de blogs precisa de una recuperación previa de los mismos y de una descripción documental. Estos procesos pueden ser automáticos, manuales o mixtos. Dada la imposibilidad a día de hoy de conseguir automatismo y fiabilidad, parece que el combinado es el menos malo.

La descripción manual de recursos web ha sido tradicionalmente un criterio usado para otorgar prestigio a los contenidos reunidos (Intute, Infomine, Librarian’s Internet Index, etc.) y, por ello, restringido generalmente a contenido científico –donde el prestigio del contenido se valora-.

Estos directorios están destinados a proporcionar coberturas limitadas y sesgadas, ya existentes en los directorios impresos, pero ahora acentuadas al máximo, debido al frenético incremento e inestabilidad de los recursos web. Pensemos no sólo en la eliminación o falta de actualización de recursos, sino en qué ocurre cuando éstos son citados y posteriormente sus contenidos son modificados.

Dado que la existencia de un grupo de personas que evalúen manualmente los contenidos de los blogs es algo difícil y limitado, los creadores, junto a los contenidos de sus blogs, introducen información estructurada especialmente para que pueda ser recuperada automáticamente y describa, entre otras cosas, “aquello de lo que trata” el blog.

Esta información estructurada, en su visión más general, son los lenguajes de marcado y, en su más específica –de momento-, los microformatos, pasando por un intermedio que son los metadatos de descripción.

Esto no es nada nuevo, pues muchas de las operaciones de recuperación de información en web son calcos conceptuales de operaciones que ya se realizaban con anterioridad. Los artículos científicos vienen precedidos de un resumen y “palabras clave” que cumplen esa misma función. En este caso, el recuperador de información es el catalogador, que usa esa información para introducirla en una base de datos. En la web son los motores de búsqueda quienes hacen esa tarea automáticamente.

En esta época de incunables web, el marcado de los contenidos hace que la forma de recuperación de información se base en descriptores. Los motores de búsqueda funcionan para poder reconocerlos, recuperarlos y, a partir de ellos, localizar recursos.

Sin embargo, existe un cierto solapamiento entre los conceptos de descriptores, palabras clave y etiquetas (tags). Desempolvando mis apuntes de indización, obtengo lo siguiente:

  • Palabras clave: Colección no ordenada (sólo alfabéticamente) de palabras significativas (no vacías), extraídas de forma automática por el ordenador, a partir del título, resumen y cada vez más a menudo del texto.
  • Descriptores: Colección no ordenada (sino puesta por orden alfabético) de conceptos. Pueden partir de una lista cerrada a priori (controlados) o no (libres).
  • Etiqueta [wikipedia]: elemento que se adhiere a otro elemento para identificarlo o describirlo (*); por extensión, una etiqueta también puede ser una o más palabras que se asocian a algo con el mismo fin (**).

* Un ejemplo es la etiqueta de un lenguaje de marcado.
** Descriptores de recursos: las famosas tags de la Web 2.0.

De aquí extraigo varias conclusiones:

  1. Los descriptores son conceptos, mientras que las etiquetas son elementos formados por descriptores que se unen a los recursos para identificarlos.
  2. Lo que el motor de búsqueda extrae del contenido existente entre las metaetiquetas de marcado son palabras clave, pero lo que introduce el usuario son descriptores, que pueden, a su vez, servir para etiquetar otros recursos.
  3. En xml, el nombre de toda etiqueta de marcado es un metadescriptor de contenido.
  4. Una nube de tags es..en realidad depende! La herramienta de ZoomClouds es una lista de palabras clave (se analizan los textos completos). Sin embargo, la herramienta proporcionada por Technorati es una lista de descriptores (recoge las etiquetas que yo asigno y las ordena por frecuencia). La nube entera es una etiqueta para el blog.
  5. Las palabras clave que suelen preceder a un artículo científico son en realidad descriptores si no hay ningún proceso automático para la extracción de dichos términos del documento.

…y es que en el fondo seguimos con los mismos problemas: perfeccionamiento y comprensión de los lenguajes documentales. Ellos son los verdaderos pilares de la futura Web.

¿Desean los documentalistas seguir siendo sus responsables o estamos escurriendo el bulto?

Por cierto, tengo que arreglar mi nube de tags…quiero decir, de palabras clave…

12 enero 2008

Nº 9. La Web 3.0: los pilares de la Web ∞.∞ (v.β)

Puesto que despedí el año preguntando si en 2008 me encontraría con la Web 3.0, lo justo es comenzar el año nuevo con ella.

David Maniega nos pidió un doble trabajo: reflexionar acerca de la llamada Web 3.0 y, de paso, practicar la redacción de contenidos tomando como base el post de Hebe Bravo “La Web 3.0, añade significado”.

El siguiente texto es, pues, un resumen de aquél organizado bajo mi punto de vista, que espero que sirva para plasmar de forma sencilla qué es lo que se está cocinando en los hornos de la Web ∞.∞ (v.β).



Cuando todavía no se ha incorporado el cambio de actitud que implica la Web 2.0, ya se habla de Web 3.0 como de una realidad inminente que promete transformar, no sólo nuestra experiencia web, sino toda nuestra cotidianidad pero, ¿qué es la Web 3.0?

El desarrollador Andrés Richero define así las diferentes fases de la Web:

  • Web 1.0 - Personas conectándose a la Web.
  • Web 2.0 - Personas conectándose a personas.
  • Web 3.0 - Aplicaciones web conectándose a aplicaciones web.

Aunque se coincide en que esta última etapa añadirá significado a la web, ni existe consenso acerca de lo que significa Web 3.0 (término “abstracto”, según José Antonio del Moral) ni sobre cuáles son los caminos más apropiados para su desarrollo.

Salvador Pérez Crespo -Telefónica- considera que será una revolución si se logra una combinación efectiva entre la inclusión de contenido semántico en las páginas web y el uso de Inteligencia Artificial que saque partido de ella.

Como los avances en esta disciplina son demasiado lentos y dificultosos, la solución podría estar en la combinación de las técnicas de Inteligencia Artificial con el acceso a la capacidad humana de realizar tareas extremadamente complejas para un ordenador. Ejemplos de ello son Mechanical Turk de Amazon y Google Image Labeler.

En cualquier caso, el aumento de la interactividad y de la movilidad serán factores decisivos en esta nueva etapa de la web. Por ello, en torno a la definición de Web 3.0 comienzan a aparecer proyectos que tienden a una cada vez mayor y más eficiente incorporación de la web a la cotidianidad:

la Web 3.0 se concibe como un nivel a ser alcanzado en mayor o menor plazo, mientras que la Web Semántica es un proceso evolutivo en construcción permanente

a) Web 3D

Muchos la ven como una extensión de los mundos virtuales (Second Life o There.com). Se cree que en el futuro la web será una gran alternativa al mundo real donde se podrá recorrer el planeta a través de ella sin abandonar el escritorio.

b) La Web centrada en multimedia

Web que ofrecerá búsquedas por similitudes en la multimedia (imágenes, música y vídeos) con sólo mostrar al buscador el medio de referencia.

La compañía Polar Rose, entre otras, están trabajando en estos proyectos.

c) La Web permanente

La también llamada Web omnipresente (o pervasive web) es un concepto que se ha extendido a partir del pasaje de los PC a los teléfonos celulares y PDA. Es una web que está en todas partes, no sólo en el PC o celular sino en la ropa, joyas, automóviles, etc.

¿Es la Web Semántica sinónimo de Web 3.0?

No, aunque muchas veces estos términos son empleados como tales. Quizás la principal diferencia sea que la Web 3.0 se concibe como un nivel a ser alcanzado en mayor o menor plazo, mientras que la Web Semántica es un proceso evolutivo en construcción permanente, de forma que ya estamos inmersos en ella.

Berners-Lee señala que, quizás, debería haberla llamado ‘Web de los datos’, dado que la palabra semántica es utilizada para significar diferentes cosas.

Se trataría de una web capaz de interpretar e interconectar un número mayor de datos que, diseñada correctamente, podría asistir a la evolución del conocimiento humano, permitiendo su avance en infinidad de campos, como la investigación genética, el tratamiento farmacológico de enfermedades, etc.

Esta visión del Web semántico como substrato para la inteligencia colectiva fue tratada por Tom Gruber en la 5ª Conferencia Internacional de la Web Semántica, donde consideró que la idea popular que tiende a considerar la Web Semántica y la Web Social como dos mundos con ideologías alternativas y en oposición es falsa y absurda.

La implementación del modelo

La Web alcanzará su capacidad máxima, tal como anticipaban Berners-Lee y Eric Molinero, cuando se convierta en un ambiente donde los datos puedan ser compartidos y procesados tanto por las herramientas automatizadas como por la gente.

Así pues, el primer desafío de la Web Semántica es proporcionar una lengua que exprese los datos, unas reglas para razonar sobre éstos y, además, permitir que éstas sean exportadas sobre el Web. Para ello es necesaria la definición de estándares:

  • URI (Uniform Resource Identifier): la base de la web semántica.
  • XML (Extensible Markup Language): el fundamento sintáctico.
  • RDF (Resource Description Framework): la descripción del recurso.
  • OWL (Ontology Web Language): la función y relación de cada componente.

Establecidos los estándares, Berners-Lee cree que los nuevos desafíos deberán ser tratados en términos de utilidad y accesibilidad, por ello, el punto clave de la Web Semántica estará en su potencial para las nuevas aplicaciones de datos sobre el web y en la capacidad de generar búsquedas más precisas e “inteligentes”.

Algunos creen que eso será el fin de los grandes buscadores. Según Nicholas Carr, la Web 3.0 “convertirá en obsoletos a los buscadores de hoy”.

Sin embargo, Berners-Lee opina que el hecho de que se agregue algo no quiere decir que se esté sustituyendo. Del mismo modo, los motores de búsqueda podrán evolucionar y hacerse Web semántico-compatibles, en la medida en que los usuarios lo exijan.

Dificultades para su generalización

  1. Complejidad: la sintaxis RDF/XML no es muy fácil de leer: Berners-Lee conviene en ello, aunque cree que no debería ser una complicación ya que al tratarse de sistemas de escritura de datos, la codificación semántica podrá ser totalmente automatizada.

  2. Actitud: el desarrollo e implementación de la Web 3.0 (al igual que la Web 2.0) será en gran parte una cuestión de actitud.

  3. Trabajo: exige una completa reanotación de la web, como indica Mª Jesús Lamarca. Por ello, otros investigadores están construyendo nuevos agentes para que puedan entender mejor la web tal como está hoy en día. Las páginas web ya tienen información semántica y estos agentes –microformatos- tratan de entenderla, como los humanos.

  4. Compartición de información: Según Pérez Crespo, habrá una fuerte reacción de quienes ahora disponen de la información, que no querrán compartirla.

  5. Spam semántico: la hará poco utilizable.

  6. Uso de estándares semánticos y confiables: que las personas e instituciones los usen es algo prácticamente imposible, según Ricardo Baeza-Yates.

  7. Privacidad: fuerte oposición entre sus defensores.

Algunos proyectos que anticipan el modelo de la Web 3.0

  • RadarNetworks: busca explotar el contenido suministrado por los usuarios en las redes sociales.
  • Proyecto KnowItAll: desarrollado en la Universidad de Washington y financiado por Google. Busca obtener y agregar información de usuarios de productos.
  • Powerset y TextDigger: Trabajan en buscadores web semánticos basados en el proyecto académico open source WordNet.
  • BlueOrganizer: construcción de agentes más inteligentes.
  • Parakey: proyecto que persigue la idea de unificar el escritorio y la web, a partir de la creación de una especie de sistema operativo web.

Mis conclusiones

Es curioso cómo, cada vez que se hablan de evoluciones y cambios, éstos se centran en procesos y acciones y no en recursos y contenidos.

La web 3.0 intentará marcar más inteligentemente los contenidos para que sean más fácilmente recuperables (o que las máquinas sean más inteligentes y sepan marcar ellos mismos los contenidos), pero sobre los contenidos en sí mismos no se habla mucho.

Puede que la Web 3.0 cree metadatos perfectos que marquen los contenidos o agentes que entiendan perfectamente los metadatos de los contenidos, pero

¿nos ocupamos lo suficiente de pensar quién se ocupará de crear los contenidos perfectos?

¿Será la propia Web ∞.∞ (v.β) capaz de crearlos?

En ese caso sólo nos dedicaríamos a buscar y recuperar. Bueno, entonces puede que no hubiese mucha diferencia con nuestros hábitos actuales, ahora que pienso..

25 diciembre 2007

Nº 8. Feliz 2008

Os deseo a todos unas felices fiestas y todo lo mejor para el 2008!

Ya he comenzado a redactar mi lista de buenos propósitos para el próximo año, aunque tengo muchas dudas y preguntas...¿a quién deberé preguntar en 2008?


Bart Simpson will google

¿Hasta el año que viene, 3.0?

16 diciembre 2007

Nº 7. Redes sociales: cuando los directorios cobran vida

Hoy he recordado las palabras de un antiguo profesor: todo profesional ve la vida a través de un filtro, una parrilla intelectual, consecuencia de su formación académica.

Cada uno aplica un filtro para que todo concuerde con su estructura mental interna, construida por cada uno para explicarse el universo. Un documentalista, también. Por eso hace tiempo que veo la Web como un documentalista, es decir, llena de documentos.

Hubo un tiempo en que parecía una moda decir que la Web era como una biblioteca desordenada. Creo que actualmente parece claro que no es así. Un sitio web sí podría cumplir ese símil, siendo cada una de las páginas web equivalente a cada uno de los ejemplares de la colección (servicios aparte, claro).

Sin embargo, hay un tipo de sitios que no cumplen esta comparación: los relacionados con las obras de referencia (directorios, enciclopedias, bibliografías), donde el conjunto de páginas web forman la obra, no la colección.

Mi visión, como documentalista, de una red social, es como la de una obra de referencia: un directorio, que, gracias a la tecnología web, cobra vida. Ese es el punto de vista que he intentado aplicar a la hora de analizar las 3 redes sociales que Jorge Serrano nos pidió estudiar (Facebook, LinkedIn y Neurona).

Para pasar de ser meros directorios a convertirse en redes sociales, estos sistemas incorporan una serie de elementos, que suelen ser comunes a todos ellos:

Unos pocos usuarios tendrán un gran número de contactos y el resto tendrán pocos. Por lo tanto, con unos pocos buenos contactos se podría llegar potencialmente a muchos usuarios


1. Posibilidad de que cada usuario pueda añadir información, subir fotos, vídeos, en definitiva: personalización máxima.

2. Posibilidad de contactar con otros miembros.

3. Posibilidad de buscar y agrupar usuarios (formar una red) con preferencias o gustos comunes y poder visualizar las redes de las personas que están en mi red.

La posibilidad de buscar personas y de navegar entre contactos de contactos es la experiencia más atractiva, pues el resto ya se puede obtener con otro tipo de plataformas. De hecho, el correo electrónico es tedioso, pues debes entrar en la plataforma para poder leerlo, en lugar de poder hacerlo directamente desde tu cuenta personal.

Facebook es una red de amigos y, por tanto, su fin es el de entablar amistades (el nexo es la amistad), mientras LinkedIn y Neurona son redes profesionales (los nexos son las profesiones) y sus objetivos pasan por encontrar personas que interesen para tu negocio o simplemente encontrar un empleo.

Por eso, cada red social es útil en función de tus intereses. Facebook es perfecto para buscar viejos conocidos o crear un espacio para compartir con tu grupo de amigos (especialmente si es un grupo disperso geográficamente). Es una forma más de ocio.

Neurona y LinkedIn son perfectos si lo que deseas es darte a conocer como profesional de un determinado sector. En ese sentido, me quedo con Neurona, simplemente porque tiene más masa crítica de profesionales de mi interés.

Tanto las redes profesionales como las de amigos son redes libres de escala, y de su estudio se ha visto que la distribución de contactos sigue aproximadamente el llamado “principio de Pareto”.

Esto significa que unos pocos usuarios tendrán un gran número de contactos y el resto (la famosa larga cola) tendrán pocos. Por lo tanto, con unos pocos buenos contactos se podría llegar potencialmente a muchos usuarios.

De aquí surge la famosa teoría de los 6 grados de separación (existe un grupo en Facebook donde se intenta comprobar). Aplicado a la bibliometría, existe el llamado número de Erdös, del que ya nos habló “El Documentalista Enredado”.

Relacionado con el número de contactos está el “coleccionismo de huesos”: ante una invitación de un desconocido, el rechazo puede significar una descortesía y la aceptación puede significar tener una falsa y enorme red de amigos, lo cual te da poder en la red. Pero si nos quedamos con una red verdadera ¿tiene sentido usar una red social?

Las redes sociales son, ante todo, fuentes de información, por ello su uso debería ser, pasada la novedad, el mismo que hacemos del resto de fuentes: herramientas útiles para encontrar información. Definitivamente, estamos en la era del referencista.

09 diciembre 2007

Nº 6. Soportes, formatos y blogs

Una de las preguntas que me planteaba en textos anteriores acerca de los blogs era la de su catalogación. Uno de los problemas conceptuales que tengo al respecto es el relacionado con las DGMs.

Como Le Boeuf comenta: “algunas DGMs pertenecen al contenido, otras al soporte, otras al contenido y soporte a la vez (‘texto impreso’)”. Entonces me planteo una pregunta:

¿Podemos catalogar bien un blog si no sabemos designar qué tipo de documento es?


La denominación "documentos en línea", sin más, es obviar el soporte, que sí existe


El primer error que observo es el uso, cada vez mayor, de “electrónico” y “digital” como términos sinónimos, lo que es una auténtica barbaridad (todavía recuerdo con cariño mi asignatura de electrónica analógica).

El otro gran error (en mi opinión) es hablar de “soportes electrónicos”. El término no me acaba de convencer y creo que debería reconsiderarse.

Lo que se quiere decir es que se ha utilizado la electrónica para obtener una señal eléctrica análoga a un fenómeno natural (frecuencia, luminosidad, etc.) para fijar con ella una información (la correspondiente al fenómeno), codificada de una determinada forma (digital o no) y mediante unas determinadas marcas, en un soporte adecuado para ello.

El soporte tiene una existencia independiente a ese proceso (como ocurre con el papel y su impresión) y se está dejando de lado. Por ejemplo, el blog es un tipo de "documento electrónico" que se almacena, normalmente, en los discos duros de ordenadores que actúan como servidores –o no-.

Un disco duro ocupa un espacio, cuesta dinero comprarlo y mantenerlo y si me lo lanzan a la cabeza me hace daño. Es, por tanto, muy real. Otra cosa es que tengamos o no acceso directo a ellos. La denominación "documentos en línea", sin más, es obviar el soporte, que sí existe.

Con todo esto, para designar de forma completa un blog –y otros documentos- he pensado la siguiente codificación, formada por cuatro términos separados por guión:

TD-FLM [Tipo].extensión-FDP-Soporte [Tipo]

El primer término sería la Tipología Documental (TD): cómo está organizada la información para comunicar un mensaje. Así tendríamos un artículo, tesis, novela, etc. Serían independientes del soporte.

El segundo término sería el Formato Legible por Máquina (FLM), junto a la extensión utilizada. Aquí distinguiríamos un pdf, .doc, .jpg, .html, etc. Además, podríamos afinarlo con tipos. Por ejemplo, el blog es un tipo de página web.

El tercero sería el Formato de Presentación (FDP), dependiente del soporte. En este caso tendríamos una revista, un libro, un tríptico, y también un DVD, un CD, etc. Lo que representa el formato libro al soporte papel, lo representa el formato CD al policarbonato de plástico, que es el soporte real, aunque con CD denominemos generalmente a las dos cosas conjuntamente.

El último elemento sería el Soporte en sí mismo, distinguiendo el material y el tipo general.

Así, para el ejemplo del blog, una designación completa podría ser la siguiente:

Noticia-Página web [blog].xhtml-Disco Duro-Material magnético [Óxido de Cromo]

Para una noticia en una revista en papel, sería:

Noticia-[ ]-Revista–Material impreso [Papel]

La verdad es que veo esto muy complicado y cada 5 minutos lo pienso de forma diferente, pero creo que vale la pena reflexionar sobre ello, por si se puede llegar a alguna conclusión de interés.

Como dice Daniel Robles, el tiempo es un problema, cuánta razón…

02 diciembre 2007

Nº 5. ¿Servicios o herramientas?

Con todas las noticias que están surgiendo últimamente sobre los blogs y la Web 2.0, me da la sensación de que se están solapando dos términos que no son sinónimos: servicios y herramientas. Aunque por razones distintas, lo he notado con RSS y Twitter.

La mal llamada sindicación de contenidos (¿qué diablos significa sindicación en castellano?: coincido con Jorge Franganillo), es decir: la redifusión de un contenido web a través de un documento xml, estructurado en base a un esquema determinado (como RSS o Atom), que será leído a través del navegador o de un software instalado en tu ordenador o en línea, es uno de los servicios, desde mi punto de vista, más maduro e interesante, pero cuyo significado está comenzando a pervertirse.

Informar y preguntar antes de implementar es tener en cuenta a los usuarios
Una cosa es el servicio que se ofrece, es decir, la posibilidad de difundir el contenido de una página web entre los subscriptores que lo deseen, y otra son las herramientas que se utilicen para conseguirlo. No podemos llamar a ese servicio RSS, pues todos los danones son yogures, pero no todos los yogures son Danone.

Más allá de este error típico (yo lo cometo con muchas otras cosas como el pan Bimbo), lo que me preocupa es que parece que haya una tendencia a preferir herramientas frente a servicios. Eso lo veo claramente con Twitter.

Parece claro que Twitter es una herramienta y que, como tal, permite hacer una serie de cosas que podrán -o no- proporcionar un servicio a ciertos usuarios, aunque yo aún me estoy preguntando cuáles.

Si lo que se pretende es generar una comunicación y “romper la barrera web”, 140 caracteres no parecen muy adecuados para comunicarse sin pervertir el lenguaje. Siendo bibliotecarios y queriendo fomentar la cultura y la lectura parece un contrasentido.

Si lo que queremos es conocer qué es lo que está haciendo una persona en un momento, puede ser gracioso ponerlo en mi blog personal para comunicarme con mis amigos, pero si el blog pertenece a una institución (alguna pagada con nuestros impuestos), no sé qué interés puede tener que parte de la pantalla esté dedicada a mostrar mensajes del tipo “me estoy zampando un bocata de tortilla ahora vengo”, de hace tres días claro.

Sí puede tener sentido saber qué está haciendo el blogger si detrás hay un servicio. Si el blog de una biblioteca ofrece un servicio de mensajería instantánea, a través de un chat, para resolver dudas, realizar consultas, etc., cuando acceda me interesará saber si el blogger está atendiendo a otro usuario o está almorzando, para irme o quedarme, pero sabiendo que hay un servicio detrás de esa herramienta.

Puede que lo que se desee no sea ofrecer un servicio, sino usar una herramienta. Muchas webs las construyen geeks para ser usadas por geeks, pero ¿son geeks mis usuarios? ¿Quieren serlo? ¿Se lo estamos preguntando?

Nuestro trabajo debería ser informar de las herramientas que existen y de los posibles servicios que, gracias a ellas, se podrían ofrecer (el futuro post de Deakialli al respecto, sin duda, será interesante), y que los usuarios elijan si los desean o no.

Informar y preguntar antes de implementar es tener en cuenta a los usuarios, ¿cuántas veces nos preguntan si queremos ciertas herramientas?

Hay una famosa frase de Roy Tennant que dice: “Sólo a los bibliotecarios les deleita buscar; al resto le interesa encontrar”

A la que añadiría:

“Al resto le deleita participar -porque no lo ha hecho nunca-, al bibliotecario le interesa saber cuándo se cansará de hacerlo”.

No hay ninguna evidencia con base científica que asegure que los patrones de interacción y participación de los usuarios con el Web (de hoy día y de algunos) vayan a mantenerse en un futuro.

Si dejan de participar ¿Estaríamos entonces preparados para resolver sus preguntas? ¿Estarían nuestros servicios orientados a ese fin? ¿Servirían nuestras herramientas para proporcionar esos servicios? ¿Sirven ahora?

25 noviembre 2007

Nº 4. El Análisis Blogosférico

El pasado 15 de noviembre vino a España David Sifry, creador de Technorati, a impartir una conferencia en Madrid. El periódico “El País” le realizó una entrevista, de la que he intentado extraer las partes más importantes:

es una barbaridad y cuando las cosas alcanzan esa palabra ya no hay marcha atrás para la indiferencia

1. Cada día se crean 120.000 nuevos blogs (1.38 cada segundo!!), contabilizando alrededor de 120 millones de blogs totales creados.

2. Las referencias de los blogs en technorati son accesibles durante 6 meses. No se pueden buscar temas más anteriores en el tiempo.

3. Google te proporciona la simple búsqueda de un blog. Technorati te ofrece una información de valor añadido..

4. Elementos que tiene que tener un blogger para triunfar:

- Escribir sobre lo que te gusta.

- Escribir bien.

- Enlazar mucho.

- Escribir mucho y de manera constante.

- Saber qué quieres hacer con tu blog.

- No hacer un blog pensando en ganar dinero con él.

Vayamos por partes:

1. El problema de las cifras es que estoy comenzando a sufrir el síndrome de la cotidianidad. Si la cifra hubiera sido 10 al segundo (864.000 al día), ¿me habría quedado igual? Puede que sí porque es una barbaridad y cuando las cosas alcanzan esa palabra ya no hay marcha atrás para la indiferencia.

2. En este tema creo que entran en juego, entre otros, dos factores importantes:

- “Blog activo vs pasivo” ¿Damos acceso a blogs inactivos?

- El blog con contenido efímero, o de “usar y tirar”: El artículo carecerá de todo tipo de valor cuando acabes de leerlo: ¿Damos acceso a blogs “antiguos”?

3. Este valor añadido me está resultando de lo más interesante y estoy descubriendo diversos estudios y análisis que se realizan gracias a technorati:

State of the Blogosphere (publicado periódicamente por David Sifry).

Ranking de blogs en español

No los he analizado aún porque me está desbordando tanta información, pero poco a poco espero ir sacando conclusiones.

En cuanto a la parte de la blogosfera dedicada a nuestra profesión (biblioblogsfera), recomiendo la maravillosa serie de artículos de El Documentalista Enredado: Análisis de la biblioblogsfera hispana.

En cuanto a buscadores, acabo de descubrir Libworm. Me parece interesantísimo y no sé cómo no lo había descubierto antes. Espero poder estudiarlo pronto y saber qué análisis de blogs se podrían hacer a partir de él.

Por lo pronto, me parece que la posibilidad de que con un sólo click puedas agregarte a todos los comentarios que hablen sobre un determinado tema en la biblioblogsfera ya me parece intimidante..

4. En cuanto al último punto, aunque parece cierto, también habría que preguntarse qué es triunfar: ¿tener muchos lectores? o hay algo más..



18 noviembre 2007

Nº 3. Lo que un documentalista quiere saber sobre un blog

El pasado viernes 16 de noviembre se clausuraron las Jornadas CALSI 2007 con la mesa redonda titulada: “Web 2.0 aplicado a servicios de información: tecnologías emergentes, experiencias y tendencias futuras”, moderada por Catuxa Seoane.

Pese a que la jornada resultó interesante, de vuelta a casa me preguntaba si realmente esa información es la que necesita saber un documentalista sobre la Web 2.0 (y sobre el blog), en unas jornadas profesionales.

Muchos problemas no son tecnológicos, sino conceptuales. Tecnología no es sinónimo de Ciencia


Muchas presentaciones no pasan de mostrarnos el mayor o menor éxito en la implantación de blogs en determinadas instituciones o de enseñarnos nuevas herramientas (el famoso twitter), pero sin analizar sus ventajas e inconvenientes más allá del mero entretenimiento.

Por eso me gustó particularmente la ponencia de Jesús Castillo, pues aportó un grado de crítica, necesaria frente al “oh, milagro!” que parece que la tecnología todo lo soluciona, cuando muchos problemas no son tecnológicos, sino conceptuales. Tecnología no es sinónimo de Ciencia.

Esta idea me llevó a pensar en qué es lo que se está enseñando sobre blogs a los documentalistas hoy día en la Universidad (momento importante para recapacitar ante el inminente Espacio Europeo de Educación Superior) y qué es lo que deberían saber, teniendo en cuenta que el mero uso de esas herramientas ya será trivial para muchos adolescentes de hoy (futuros documentalistas o no), pues están creciendo con ellas.

Por eso, he intentado pensar qué cosas no sé y me gustaría saber, como documentalista, de un blog:

- ¿Cómo catalogarlos? ¿RDA y las ISBD unificadas son eficientes para catalogar blogs? Igual que hubo un intento de control bibliográfico universal (CBU), ¿es necesario un Control blogosfero Universal?

- ¿Alguien se plantea su almacenamiento y conservación a largo plazo y cómo se visualizarán si dentro de 10 años no existen ya las aplicaciones que hoy los abren?

- ¿Cómo los identificamos unívocamente? La iniciativa del IBSN es interesante, pero necesita normalizarse. ¿Debería parecerse al D.L. o al ISBN?

- ¿Cómo funcionan por dentro los buscadores de blogs? ¿Tienen en cuenta metadatos como RDF o DC? ¿Cómo interpreto sus listas de resultados si no sé qué criterios han usado en la recuperación?

- ¿Qué herramientas y aplicaciones tengo para estudiar "sitas" y otros indicadores cibermétricos entre blogs?

- Una página web cambia y hace perder el contexto en una referencia, pero además, ¿Cómo me aseguro de la autoridad de un texto en un blog?, podría haber creado el mío con datos falsos, ¿qué mecanismos de firma digital se pueden aplicar? ¿qué dice la legislación?

- En plantillas como blogger no se tiene acceso a todo el código de la página, así que estamos publicando páginas a las que no tenemos acceso completamente, ¿tiene el usuario verdaderamente en control?

- Se permiten etiquetas para que los robots de los buscadores no indicen una página, ¿blogs grises? ¿ocultación de información? ¿Qué opina el W3C?

- ¿Cómo representar redes de blogs? Herramientas como TouchGraph

- Análisis estadístico de blogs: Aprender de verdad Google Analytics y similares.

- ¿Categorías vs tags? o en realidad ¿clasificación vs indización, de toda la vida?

- ¿Se puede crear un blog con contenidos agregados automáticamente de entradas con etiquetas específicas de otros blogs, (blog como servicio de referencia automático) y proporcionar un buen servicio?

Aquí me atrevo a poner un ejemplo: veamos una noticia aparecida en ABC.es: "Adiós al mejor documentalista". Si no hay suficiente con leer la noticia, pinchemos en la etiqueta “documentalista” para consultar otras noticias relacionadas y observemos los resultados.

Mi opinión es que una simple enumeración de servicios 2.0 y webs “famosas”, que es en lo que se están convirtiendo muchas charlas y conferencias sobre blogs y Web 2.0, no ayuda a responder a casi nada de esto. Como usuarios hemos aprendido mucho, pero como profesionales… ¿qué os parece?

11 noviembre 2007

Nº 2. La conservación de un blog

Según Wikipedia:

“Un blog, o en español también una bitácora, es un sitio web periódicamente actualizado que recopila cronológicamente textos o artículos de uno o varios autores, apareciendo primero el más reciente, donde el autor conserva siempre la libertad de dejar publicado lo que crea pertinente.

Es, por tanto, una publicación periódica. Otra cosa es que su actualización sea instantánea y el software usado permita comentarios, suscripciones, modificaciones, hipervínculos, etc.

Un blog con un inicio y fin predeterminado y pensado produciría una obra acabada, que podría tener sentido ser almacenada completamente para su conservación

Entonces, como publicación periódica, debería analizarse como otros tipos de publicaciones periódicas lo son, pues le afectan los mismos fenómenos: se producen citas y referencias (pueden usarse métodos bibliométricos aplicados a la Web: cibermetría), se difunden, publicitan, tienen lectores, un contenido, unas etiquetas para cada artículo (palabras clave de toda la vida), y…también se les podría aplicar métodos de conservación a largo plazo.

La semana pasada, Daniel Gil, en [Bauen_Blog] (blog muy interesante dedicado a las bibliotecas de arquitectura), redactó un post titulado: “E-LIS per a la conservació del articles publicats al blog”.

Se habla de la posibilidad que brinda E-LIS (E-Prints in Library and Information Science) de poder depositar los artículos de un blog, de la misma forma que se depositan artículos científicos, libros y otros materiales documentales más tradicionales.

Ninguno de los tipos de documento que reconoce E-LIS es un blog como tal. En este caso, se han agrupado una serie de posts relacionados, se han convertido a PDF y se han depositado en el sistema como “preprints”.

En este caso se está considerando cada entrada del blog como un artículo independiente, como ocurre en cualquier publicación periódica, por lo que sí tendría sentido almacenar los artículos separados en PDF. De todas formas parece que se pierde toda la esencia del blog como tal, aunque realmente quede lo más interesante, es decir, su contenido.

Esto me hace pensar que la inmensa mayoría de blogs nacen sin un fin muy claro. He visto pocos en los que se hiciera explícito el deseo de durar un período determinado (en tiempo o posts). Un blog con un inicio y fin predeterminado y pensado produciría una obra acabada, que podría tener sentido ser almacenada completamente para su conservación.

Disponer de un servidor donde almacenar la sede completa (al estilo de archive.org) sería una idea interesante, aunque puede que sólo para aquellos blogs en los que todos los posts juntos tuviesen un sentido y formaran una obra completa única.

Otro de los temas comentados es la conveniencia o no de incluir los comentarios de los posts en el depósito. Yo creo que sólo deberían incluirse, siempre con la autorización de los autores, aquellos comentarios que hubiesen aportado realmente algo al texto original.

De todas formas, creo que es una iniciativa muy interesante, tanto para los bloggers, como para aquellas personas que desean estudiar toda la producción de contenidos que éstos están generando.

También será interesante saber qué piensan de esto los responsables de E-LIS (y otros repositorios). La posibilidad de establecer como categoría un post de un blog permitiría afinar ciertas búsquedas, estudiar links entre posts y artículos o libros, etc.

04 noviembre 2007

Nº 1. Presentación de InfoCalsi

Este es un momento bastante simbólico; tras muchas horas leyendo posts ajenos me encuentro ante mi primer “hello world” bloguero propio.

La primera vez que oí hablar de bitácoras fue allá por el 2004 durante una de mis primeras clases en la Universidad Politécnica de Valencia y en poco más de 3 años el panorama ha cambiado enormemente, aunque más en términos de popularidad que en aspectos tecnológicos.

Por otra parte, ser lector de blogs ha pasado de ser una curiosidad a convertirse en tarea fundamental en ciertas profesiones para poder estar al día. Muchos conocidos me comentan que han encontrado solución a sus problemas tras consultar ciertos blogs. Soluciones que podrían tardar meses en aparecer en otros formatos tradicionales de publicación como revistas, o incluso no aparecer nunca. Es por ello que el blog, como fuente de información, ya debería ser objeto de interés por sí mismo para un documentalista.

Pasar de lector de blogs a redactor es un paso difícil, que implica sobre todo dedicación. Este blog sólo pretende ser un lugar de reflexión y compartición de ideas acerca del Master CALSI (Contenidos y Aspectos Legales en la Sociedad de la Información) que estoy realizando en la actualidad.

Mi intención es publicar semanalmente un post acerca de los temas y contenidos más interesantes (o que más me preocupen) del Master, haciendo hincapié en el estudio del blog como tipología documental, para intentar generar un mínimo de debate en torno a ellos que nos pueda servir tanto para aprender como para comunicarnos.

Dicho esto, sólo me queda dar la bienvenida a aquellos que, bien por despiste, aburrimiento o incluso interés, me lean.


Un saludo,