Ir al contenido
Menú principal
Menú principal
mover a la barra lateral
ocultar
Navegación
Página principal
Cambios recientes
Página aleatoria
Ayuda sobre MediaWiki
Buscar
Buscar
español
Apariencia
Crear una cuenta
Acceder
Herramientas personales
No has accedido
Discusión
Contribuciones
Crear una cuenta
Acceder
Edición de «
Text Encoding Initiative
»
Página
Discusión
español
Leer
Editar
Editar código
Ver historial
Herramientas
Herramientas
mover a la barra lateral
ocultar
Acciones
Leer
Editar
Editar código
Ver historial
General
Lo que enlaza aquí
Cambios relacionados
Información de la página
Apariencia
mover a la barra lateral
ocultar
Advertencia:
no has iniciado sesión. Tu dirección IP se hará pública si haces cualquier edición. Si
inicias sesión
o
creas una cuenta
, tus ediciones se atribuirán a tu nombre de usuario, además de otros beneficios.
Comprobación antispam. ¡
No
rellenes esto!
[[Archivo:TEI Logo 2024.svg|miniaturadeimagen|Logo oficial]] La '''Text Encoding Initiative''' ('''TEI''') es un consorcio que desarrolla y mantiene un estándar para la representación de los textos en forma digital. Se trata de un proyecto de investigación en [[humanidades digitales]] que goza de una amplia difusión y utilización en bibliotecas y colecciones de texto digitales y en la creación de corpora lingüísticos<ref>{{Cita web|url=https://companions.digitalhumanities.org/DLS/?chapter=content/9781405148641_chapter_25.html|título=The Text Encoding Initiative and the Study of Literature|autor=James Cummings|editor=Ray Siemens and Susan Schriebman|en=A Companion to Digital Literary Studies}}</ref> Se basa en el lenguaje [[XML]], una versión simplificada del [[SGML]]. == Las TEI Guidelines == Las ''TEI Guidelines'' en su conjunto lo que hacen es definir una gramática XML. Difiere de otros formatos textuales, como [[HTML]] y [[OpenDocument]], en que se trata un marcado o etiquetado semántico y no presentacional, es decir, se preocupa por lo que es el texto y establece el significado de cada elemento y atributo. Las pautas describen más de 500 elementos textuales agrupados en veinte módulos, a veces altamente especializados, como el módulo para diccionarios, teatro, [[corpus lingüístico]]s, transcripción de fuentes primarias, mientras que otros son generales y básicos para cualquier documento TEI.<ref name="teiAppendixC">{{Cita web |título = Appendix C Elements |sitioweb = tei-c.org |fecha = 2018 |fechaacceso = 8 de febrero de 2018 |url = https://www.tei-c.org/release/doc/tei-p5-doc/en/html/REF-ELEMENTS.html}}</ref> === Ejemplos === <syntaxhighlight lang="xml"> <?xml version="1.0" encoding="UTF-8"?> <TEI xmlns="http://www.tei-c.org/ns/1.0"> <teiHeader> <!–- obligatorio --> </teiHeader> <text> <front> <!–- opcional --> </front> <body> <!–- obligatorio --> </body> <back> <!–- opcional --> </back> </text> </TEI> </syntaxhighlight> === Ejemplo práctico === <syntaxhighlight lang="xml"> <?xml version="1.0" encoding="UTF-8"?> <teiHeader> <fileDesc> <titleStmt> <title>NACIMIENTO DE CRISTO</title> <author>Federico García Lorca</author> </titleStmt> <publicationStmt> <p>Ejemplo para Wikipedia</p> </publicationStmt> <sourceDesc> <p>Transcrito desde una vieja edición</p> </sourceDesc> </fileDesc> </teiHeader> <text> <body> <head>NACIMIENTO DE CRISTO</head> <lg> <l>Un pastor pide teta por la nieve que ondula</l> <l>blancos perros tendidos entre linternas sordas</l> <l>El Cristito de barro se ha partido los dedos</l> <l>En los filos eternos de la madera rota.</l> </lg> <lg> <l>¡Ya vienen las hormigas y los pies ateridos!</l> <l>Dos hilillos de sangre quiebran el cielo.</l> <l>Los vientres del demonio resuenan por los valles</l> <l>golpes y resonancias de carne de moluscos.</l> </lg> <lg> <l>Lobos y sapos cantan en las hogueras verdes</l> <l>coronadas por vivos hormigueros del alba</l> <l>La mula tienen un sueño de grandes abanicos</l> <l>y un toro sueña un toro de agujeros y agua.</l> </lg> <lg> <l>El niño llora con un tres en la frente.</l> <l>San José ve en el heno tres espinas de bronce</l> <l>los pañales exhalan un rumor de desierto</l> <l>con cítaras sin cuerdas y degolladas voces</l> </lg> <lg> <l>La nieve de Manhattan empuja los anuncios</l> <l>y lleva gracia pura por las falsas ojivas.</l> <l>Sacerdotes idiotas y querubes de pluma</l> <l>van detrás de Lutero por las altas esquinas.</l> </lg> </body> </text> </TEI> </syntaxhighlight> == Historia == === Antecedentes === Antes de la creación del TEI, los humanistas no tenían estándares comunes para codificar textos electrónicos. A lo largo de los años los académicos desarrollaron métodos variados con el objetivo de representar caracteres especiales y codificar divisiones lógicas de un texto, así como representar información analítica e interpretativa y reducir el aparato de texto crítico a una secuencia lineal única.{{sfn|Ide|Sperberg-McQueen|1995|p=5}} Debido a la falta de un formato estándar y unificado, entre 1960 y 1980 se empezaron a desarrollar esquemas de codificación desde cero y a partir de adaptaciones de los ya existentes. Los esquemas ya existentes reflejaban principalmente los intereses de sus desarrolladores y estaban adaptados a los programas que utilizaban. En su mayoría eran incompatibles con las investigaciones de otros humanistas, debido a que tenían que modificarlos sustancialmente para poder usarlos, siempre y cuando se pudiesen reutilizar.{{sfn|Ide|Sperberg-McQueen|1995|p=5}} Cuando la comunidad de [[Humanidades digitales|humanidades informáticas]] ({{lang-en|Computing humanities}}) reconoció esta problemática, se reunieron e intentaron en varias ocasiones (San Diego, 1977; Pisa, 1980) desarrollar estándares de codificación para los textos legibles por ordenadores. Sin embargo, no se llegó a ningún consenso y se interrumpieron.{{sfn|Ide|Sperberg-McQueen|1995|p=5}} === Origen === La ''Text Encoding Initiative'' nació en un congreso organizado por la [[Association for Computers and the Humanities]] (ACH) en el [[Vassar College]] en 1987, y fue financiado por la [[U.S. National Endowment for the Humanities]] ({{lang-es|Fundación Nacional de los Estados Unidos para las Humanidades}}). Al congreso asistieron alrededor de 30 representantes de diferentes archivos, centros de humanidades informáticas, proyectos de investigación y organizaciones profesionales para reconsiderar la viabilidad de la estandarización y realizar recomendaciones en relación con su ámbito de aplicación, estructura, contenido y redacción, conocidos actualmente como los «principios de Poughkeepsie» (''{{lang-en|Poughkeepsie Principles}}'').<ref group="n">[[Poughkeepsie]] ([[condado de Dutchess]], [[Nueva York]]) es la ciudad en la que se encuentra el ''Vassar College'', donde se celebró el primer congreso.</ref>{{sfn|Ide|Sperberg-McQueen|1995|p=5}}<ref name="teipcp1">{{Cita web |url=https://www.tei-c.org/Vault/SC/teipcp1.txt |título=The Preparation of Text Encoding Guidelines |fechaacceso=2 de enero de 2018 |fecha=13 de noviembre de 1987 |sitioweb=tei-c.org}}</ref> El congreso fue un éxito, ya que, por una parte, se supo más sobre los problemas de la codificación y se aclararon los principios que debían seguirse para resolver esta problemática. Por otra parte, el grupo de Vassar logró reunir y componerse de una mayor representación de organizaciones clave y centros de investigación activos que en anteriores reuniones. Además, el reciente desarrollo del [[Standard Generalized Markup Language]] aportó una herramienta para desarrollar un esquema de codificación sencillo, flexible y extensible que cumpliese con las diferentes necesidades de la investigación textual. El consenso que se alcanzó en el congreso fue que esta necesidad estaba creciendo y había que resolverla urgentemente.{{sfn|Ide|Sperberg-McQueen|1995|p=6}} === Desarrollo de las pautas de codificación === Tras el congreso, la ''[[Association for Computational Linguistics]]'' (ACL) y la ''[[Association for Literary and Linguistic Computing]]'' (ALLC) acordaron unirse a la ACH como patrocinadores para elaborar las pautas del estándar.<ref name="teiAbout">{{Cita web |url=https://www.tei-c.org/release/doc/tei-p5-doc/en/html/AB.html |título=iv. About These Guidelines - The TEI Guidelines |fechaacceso=31 de diciembre de 2017 |sitioweb=www.tei-c.org |idioma=en}}</ref> Estas tres organizaciones se comprometieron a guiar el esfuerzo y la búsqueda de financiación para apoyar la TEI como un proyecto a nivel internacional y multilingüe. Sin embargo, pronto se reconoció que este proyecto no solo era del interés de las humanidades, sino que también se podía aplicar a diversas aplicaciones de la industria del lenguaje.{{sfn|Ide|Sperberg-McQueen|1995|p=6}} En 1994, la TEI publicó su primera versión completa de las ''Guidelines for the Encoding and Interchange of Machine-Readable Texts'' ({{lang-es|Pautas para la codificación e intercambio de textos legibles por ordenadores}}), coeditada por [[Michael Sperberg-McQueen]] y [[Lou Bernard]].<ref name="teiedp01">{{Cita web |url=http://www.tei-c.org/Vault/ED/edp01.htm |título=Design Principles for Text Encoding Guidelines |fechaacceso=2 de enero de 2018 |fecha=14 de diciembre de 1988 |sitioweb=tei-c.org |idioma=en |urlarchivo=https://web.archive.org/web/20180104142751/http://www.tei-c.org/Vault/ED/edp01.htm |fechaarchivo=4 de enero de 2018 }}</ref>{{sfn|Sperberg-McQueen|Burnard|1994}}{{sfn|Ide|Sperberg-McQueen|1995|p=6}}{{refn|group=n|Estas pautas consiguieron establecer el estándar [[SGML]] como el [[framework|entorno de trabajo]] adecuado para su desarrollo; especificar las restricciones y recomendaciones al usar SGML; analizar e identificar categorías y características de la codificación de datos textuales; especificar un conjunto de definiciones generales efectivas, flexibles y extensibles para la estructura del texto; crear una especificación metodológica para la documentación en los archivos de los textos electrónicos, compatible con las convenciones de bibliotecas, con la función de servir como historial de los textos para poder validar su procedencia y las modificaciones que se hayan realizado; especificar convenciones para tipos de textos especiales o características textuales.{{sfn|Ide|Sperberg-McQueen|1995}}}} Durante sus primeras versiones, hasta la P3, la TEI se desarrolló sobre la base del SGML. En la versión P4, publicada en 2002, apareció la primera especificación en [[XML]].<ref name="teiP4">{{Cita web |título = TEI: P4 Guidelines |sitioweb = tei-c.org |fechaacceso = 8 de febrero de 2018 |url = https://www.tei-c.org/Vault/P4/index.html }}</ref> En 2007 se publicó la versión P5<ref name="teiP5">{{Cita web |título = TEI: P5 Guidelines |sitioweb = tei-c.org |fechaacceso = 8 de febrero de 2018 |url = https://www.tei-c.org/Guidelines/P5/}}</ref> La última versión de la P5 es la 3.3.0 y fue publicada el 31 de enero de 2018 bajo el nombre en clave [[Johnny Rotten]].<ref name="teiP5-ult">{{Cita web |título=TEI P5 version 3.3.0 release notes |sitioweb = tei-c.org |fechaacceso = 8 de febrero de 2018 |url = https://www.tei-c.org/Vault/P5/current/doc/tei-p5-doc/readme-3.3.0.html }}</ref> == Notas == {{listaref|group="n"}} == Referencias == {{Listaref}} == Bibliografía == * {{Cite book| publisher = Kluwer Academic Publishers| isbn = 978-94-011-0325-1| pages = 5–15| editors = Nancy M. Ide, Jean Véronis (eds.)| last1 = Ide| first1 = Nancy M.| last2 = Sperberg-McQueen| first2 = C. M.| title = Text encoding initiative : background and contexts| chapter = The Text Encoding Initiative: Its History, Goals, and Future Development| location = Dordrecht| date = 1995| chapterurl = https://www.cs.vassar.edu/~ide/papers/teiHistory.pdf}} * {{Cita libro |título=Guidelines for Electronic Text Encoding and Interchange |url=https://www.tei-c.org/Vault/GL/teip3doc.tar.gz |fechaacceso=8 de febrero de 2018 |año=1994 |editorial=Text Encoding Initiative |apellido-editor=Sperberg-McQueen |nombre-editor=C. M. |apellido-editor2=Burnard |nombre-editor2=Lou |lugar-publicación=Chicago}} <!-- Revisar bibliografía para comprobar que se ha citado con ella --> * Burnard, L. 2014. ''What is the Text Encoding Initiative? How to add intelligent markup to digital resources.'' Marseille: OpenEdition Press. Extraído de https://books.openedition.org/oep/426 ISBN 9782821834606. * Fradejas Rueda, J. M. 2009-2010. "La codificación XML/TEI de textos medievales". ''Memorabilia'' 12: 219–247. [https://parnaseo.uv.es/Memorabilia/Memorabilia12/PDFs/Codificacion.pdf]. == Enlaces externos == * [https://web.archive.org/web/20150612040042/http://www.tei-c.org/index.xml Sitio oficial de la Text Encoding Initiative]. {{Control de autoridades}} [[Categoría:Estándares basados en XML]] [[Categoría:Humanidades digitales]]
Resumen:
Al guardar los cambios aceptas los
términos de uso
y liberas de forma irrevocable tu contribución conforme a los términos de las licencias
licencia CC BY-SA 4.0
y
GFDL
. Aceptas igualmente que un hipervínculo o URL es atribución suficiente conforme a la licencia Creative Commons.
Cancelar
Ayuda de edición
(se abre en una ventana nueva)
Buscar
Buscar
Edición de «
Text Encoding Initiative
»
Añadir idiomas
Añadir tema