8.1. Etiquetado con XML-TEI.

Sin ánimo de ser exhaustivo, pues no es ese el objeto de esta tesis, señalaremos que, con el objeto de unificar la codificación de textos por parte de diferentes proyectos de humanidades digitales, surgió el Text Encoding Initiative (TEI) a finales de los años 80 del siglo XX. Hasta entonces, se había constatado que no existía un estándar para que los diferentes investigadores y las diversas organizaciones que trabajaban con documentos pudieran intercambiar sus materiales y facilitar que los ordenadores pudiesen aprovechar el esfuerzo de cada uno de esos grupos de trabajo (de bibliotecas, archivos, universidades, etc.). Por ello, en un congreso celebrado en 1987 en el Vassar College distintas asociaciones y expertos comenzaron con esta iniciativa, cuyos primeros frutos tangibles aparecieron a partir del año 90, con las conocidas “guidelines” (o pautas) para poder codificar e intercambiar textos legibles por ordenadores. La conocida como versión P4 de estas “guidelines” data de 2002 y, a partir de entonces, TEI se basa en XML (anteriormente se había basado en SGML)[1]. De cualquier modo, el uso de estas tecnologías garantizan que nuestra edición pueda ser usada y revisada por otros investigadores, facilitando así el intercambio del conocimiento científico y crítico. Junto a ello, facilita el hecho de que en un futuro se puedan añadir más etiquetas al código existente para añadir otras funcionalidades que exija la investigación.

Veamos, ahora, algunos ejemplos de cómo se ha codificado esta edición con TEI:

A) Hemos creado un esquema básico a partir del cual poder determinar si la sintaxis de nuestro XML está bien formada y si además es válido con respecto a un esquema de validación Relax NG. A su vez, también lo hemos asociado a un esquema DTD. Ahora, somos conscientes de que crear un DTD privado dificulta la validación del XML por parte de otros investigadores, por lo que lo hemos solventado en el caso de la edición de Versioning Machine. En el caso de nuestra edición “personal”, facilitamos en la propia web, en la pestaña “Archivos xml”, una carpeta en la que están tanto el archivo XML como el esquema de validación Relax NG y el esquema DTD (esto también puede verse y descargarse en GitHub, como puede verse en la n. 264). Si se descarga esta carpeta completa en el ordenador del usuario, cualquier editor de XML, por ejemplo Oxygen, puede leer y validar el archivo XML. El empleo de una DTD privada, aunque válido, no es la opción óptima, sino resultado del desarrollo de un trabajo de investigador en desarrollo, como es la tesis doctoral, sin embargo, puede ser mejorado en una próxima versión con un esquema TEI estándar, tal y como hemos hecho en la edición de Versioning Machine. A su vez, también se podrá descargar el archivo XML de la edición con Versioning Machine en la web en la misma pestaña señalada, “Archivos xml”. Lo expuesto puede comprobarse aquí:

Ejemplo de “edición digital personal”

Ejemplo de edición digital con Versioning Machine

B) A continuación, creamos nuestro documento de XML con TEI siguiendo la estructura establecida en las “guidelines”. Tras la primera línea obligatoria <?xml version="1.0" encoding="UTF-8"?>, hemos puesto los esquemas asociados ya indicados tanto en una versión como en la segunda. En el futuro, ambos esquemas serán de TEI estándar, aunque con la posibilidad de descargar la carpeta con los tres archivos indicados, creemos haber aportado una solución para facilitar el intercambio de información entre investigadores. Tras esto, pasamos directamente a la estructura XML propiamente dicha, empezando por el elemento obligatorio <teiHeader>, que proporciona información descriptiva y declarativa de una página de título electrónico prefijada como un texto conforme a TEI (en la imagen de abajo, puede verse el título, el autor, el editor y otros elementos que consideremos relevantes para identificar nuestro documento en la edición “personal”. En la imagen anterior también puede verse esta información en el caso de la edición con Versioning Machine):

Ejemplo de edición digital personal

C)Seguidamente, establecimos el elemento <text>, que contiene un único texto de cualquier tipo, sea este unitario o combinado, para indicar que la obra con la que estamos trabajando es un texto único. Y después, usamos el elemento <body> (que contiene el cuerpo completo de un texto unitario) con el fin de determinar que nuestro texto es unitario y contiene el texto completo de las Coplas de los pecados mortales, excepto el título. En este sentido, las dos ediciones son similares, aunque muestran diferencias, como se ve en el hecho de que, tras la etiqueta <text>, aparezca en la edición con Versioning Machine la lista de los testimonios.

Ejemplo con Versioning Machine

Ejemplo con edición personal

D) Por último, usamos los elementos y los atributos más importantes para configurar nuestro texto, de acuerdo con las necesidades de nuestra edición. Tal como se ha señalado, algunos elementos usados para etiquetar nuestra edición personal, como <divGen>, que no son habituales en el estándar, son fruto del proceso de aprendizaje y se establecieron en la primera fase de edición, si bien se sustituirán en un futuro, como se ha hecho en el caso del etiquetado de la versión de Versioning Machine. En este sentido, el etiquetado de Versioning Machine puede considerarse como una segunda fase más avanzada que la anterior. Usamos <div> para establecer la división interna de cada una de las estrofas que componen las Coplas de Mena y el elemento <opener> (en el caso de la edición personal) para indicar el número de cada estrofa y la presencia de la rúbrica interestrófica en alguna de ellas. Sin embargo, este elemento queda eliminado en la segunda versión de Versioning Machine porque era innecesario Por otra parte, se usa el elemento <lg> para mostrar un grupo de versos que funciona como una unidad (en nuestro XML, cada una de las ciento seis coplas de arte menor de la obra y, a su vez, cada una de las dos redondillas que componen dicha estrofa) y el elemento <l> para indicar cada uno de los versos de las distintas estrofas. Además de lo expuesto, usamos elementos específicos como <lem> o <app>, entre otros, propios del
aparato crítico, para mostrar las diferentes lecciones de los versos correspondientes en los distintos testimonios consultados, o elementos como <rhyme> para indicar la rima específica de cada verso. Esto es común en ambas ediciones. Por último, también se ha usado el elemento <note> (o <label> en el caso de la edición personal) para escribir las diferentes notas críticas de nuestra edición de las Coplas.

Ejemplo con edición personal.

Ejemplo con Versioning Machine.

De cualquier modo, como ya se ha expuesto, es posible descargar los archivos xml de ambas ediciones para su consulta o su uso por parte de cualquier persona que desee investigar. Queremos reseñar que, en el caso de la edición con Versioning Machine, sin duda más eficiente en cuanto al etiquetado que la anterior, hemos usado la etiqueta de < title > para separar con nitidez el número de cada estrofa y la rúbrica interestrófica, pues de otro modo la visualización con Versioning Machine era deficitaria. En este sentido, se impone en una segunda fase futura trabajar con la hoja de estilos CSS de esta herramienta, aunque de momento todos nuestros intentos en esa línea han sido rotundos fracasos.