<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE article PUBLIC "-//NLM//DTD Journal Publishing DTD v3.0 20080202//EN" "http://dtd.nlm.nih.gov/publishing/3.0/journalpublishing3.dtd">
<article article-type="research-article" dtd-version="3.0" xml:lang="es" xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink">
	
	<front>
		
		<journal-meta>
			<journal-id journal-id-type="publisher-id">REDC</journal-id>
			<journal-title-group>
				<journal-title>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</journal-title>
				<abbrev-journal-title>Rev. Esp. Doc. Cient.</abbrev-journal-title>
			</journal-title-group>
			<issn pub-type="ppub">0210-0614</issn>
			<issn pub-type="epub">1988-4621</issn>
			<publisher>
				<publisher-name>Consejo Superior de Investigaciones Cient&#x00ED;ficas</publisher-name>
			</publisher>
		</journal-meta>
		
		<article-meta>
			<article-id pub-id-type="publisher-id">redc.2020.S1</article-id>
			<article-id pub-id-type="doi">10.3989/redc.2020.S1</article-id>
			
			<article-categories>
				<subj-group subj-group-type="heading">
				<subject>ESTUDIOS / RESEARCH STUDIES</subject>
				</subj-group>
			</article-categories>
			
			<title-group>
				<article-title>Enriqueciendo la investigaci&#x00F3;n en humanidades digitales. An&#x00E1;lisis de textos de claustros acad&#x00E9;micos de la Universidad de Valencia (1775-1779) con KH Coder</article-title>
				<trans-title-group xml:lang="en">
				<trans-title>Enriching research in digital humanities. Analysis of the University of Valencia scholar cloisters (1775-1779) with KH Coder</trans-title>
				</trans-title-group>
				<alt-title alt-title-type="running-head">Enriqueciendo la investigaci&#x00F3;n en humanidades digitales. An&#x00E1;lisis de textos de claustros acad&#x00E9;micos de la Universidad de Valencia (1775-1779) con KH Coder</alt-title>
			</title-group>
			
			<contrib-group>
		
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Blasco-Gil</surname>
					 <given-names>Yolanda</given-names>
					</name>
					<xref ref-type="aff" rid="U1"/>
					<xref ref-type="corresp" rid="cor1"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Gonz&#x00E1;lez</surname>
					 <given-names>Luis M.</given-names>
					</name>
					<xref ref-type="aff" rid="U2"/>
					<xref ref-type="corresp" rid="cor2"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Pav&#x00F3;n-Romero</surname>
					 <given-names>Armando</given-names>
					</name>
					<xref ref-type="aff" rid="U3"/>
					<xref ref-type="corresp" rid="cor3"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Mercado-Estrada</surname>
					 <given-names>Mariano</given-names>
					</name>
					<xref ref-type="aff" rid="U4"/>
					<xref ref-type="corresp" rid="cor4"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Pav&#x00F3;n-Romero</surname>
					 <given-names>Carlos</given-names>
					</name>
					<xref ref-type="aff" rid="U5"/>
					<xref ref-type="corresp" rid="cor5"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Cabrera</surname>
					 <given-names>Ana M.</given-names>
					</name>
					<xref ref-type="aff" rid="U6"/>
					<xref ref-type="corresp" rid="cor6"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Garz&#x00F3;n-Farin&#x00F3;s</surname>
					 <given-names>Fernanda</given-names>
					</name>
					<xref ref-type="aff" rid="U7"/>
					<xref ref-type="corresp" rid="cor7"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Peset</surname>
					 <given-names>Fernanda</given-names>
					</name>
					<xref ref-type="aff" rid="U8"/>
					<xref ref-type="corresp" rid="cor8"/>
				</contrib>
			</contrib-group>
					
			<aff id="U1">Departamento de Derecho Financiero e Historia del Derecho. Facultad de Derecho. Universitat de Val&#x00E8;ncia</aff>
			<aff id="U2">Departamento de Educaci&#x00F3;n F&#x00ED;sica y Deportiva Facultad de Ciencias de la Actividad F&#x00ED;sica y el Deporte. Universitat de Val&#x00E8;ncia</aff>
			<aff id="U3">&#x00C1;rea de Investigaci&#x00F3;n de Historia de la educaci&#x00F3;n y la cultura. Instituto de Investigaciones sobre la Universidad y la Educaci&#x00F3;n. Universidad Nacional Aut&#x00F3;noma de M&#x00E9;xico</aff>
			<aff id="U4">Archivo Hist&#x00F3;rico de la UNAM (AHUNAM). Instituto de Investigaciones sobre la Universidad y la Educaci&#x00F3;n. Universidad Nacional Aut&#x00F3;noma de M&#x00E9;xico</aff>
			<aff id="U5">Departamento de C&#x00F3;mputo. Instituto de Investigaciones sobre la Universidad y la Educaci&#x00F3;n. Universidad Nacional Aut&#x00F3;noma de M&#x00E9;xico</aff>
			<aff id="U6">Centro Sanitario Integrado Juan Llorens. Consorcio Hospital General Universitario</aff>
			<aff id="U7">Facultad de Fisioterapia y Podolog&#x00ED;a. Universidad Cat&#x00F3;lica de Valencia San Vicente M&#x00E1;rtir</aff>
			<aff id="U8">Instituto Universitario de Matem&#x00E1;tica Pura y Aplicada. Universitat Polit&#x00E8;cnica de Val&#x00E8;ncia</aff>
			
			<author-notes>
				<corresp id="cor1">Correo-e: <email xlink:href="Yolanda.blasco@uv.es">Yolanda.blasco@uv.es</email>
					ORCID iD: <ext-link ext-link-type="uri" xlink:href="https://orcid.org/0000-0002-9940-7454">https://orcid.org/0000-0002-9940-7454</ext-link>
				</corresp>
				
				<corresp id="cor2">Correo-e: <email xlink:href="Luis.m.gonzales@uv.es">Luis.m.gonzales@uv.es</email>
					ORCID iD: <ext-link ext-link-type="uri" xlink:href="https://orcid.org/0000-0002-6478-4014">https://orcid.org/0000-0002-6478-4014</ext-link>
				</corresp>
				
				<corresp id="cor3">Correo-e: <email xlink:href="apavon@unam.mx">apavon@unam.mx</email>
					ORCID iD: <ext-link ext-link-type="uri" xlink:href="https://orcid.org/0000-0003-4883-7099">https://orcid.org/0000-0003-4883-7099</ext-link>
				</corresp>
				
				<corresp id="cor4">Correo-e: <email xlink:href="marisandi72@yahoo.com.mx">marisandi72@yahoo.com.mx</email>
					ORCID iD: <ext-link ext-link-type="uri" xlink:href="https://orcid.org/0000-0002-6869-6046">https://orcid.org/0000-0002-6869-6046</ext-link>
				</corresp>
				
				<corresp id="cor5">Correo-e: <email xlink:href="cpavonr@unam.mx">cpavonr@unam.mx</email>
					ORCID iD: <ext-link ext-link-type="uri" xlink:href="https://orcid.org/0000-0002-1691-0653">https://orcid.org/0000-0002-1691-0653</ext-link>
				</corresp>
				
				<corresp id="cor6">Correo-e: <email xlink:href="acabrera@comv.es">acabrera@comv.es</email>
					ORCID iD: <ext-link ext-link-type="uri" xlink:href="https://orcid.org/0000-0003-0316-3596">https://orcid.org/0000-0003-0316-3596</ext-link>
				</corresp>
				
				<corresp id="cor7">Correo-e: <email xlink:href="fernanda.garzon@ucv.es">fernanda.garzon@ucv.es</email>
					ORCID iD: <ext-link ext-link-type="uri" xlink:href="https://orcid.org/0000-0002-8572-2664">https://orcid.org/0000-0002-8572-2664</ext-link>
				</corresp>
				
				<corresp id="cor8">Correo-e: <email xlink:href="mpesetm@upv.es">mpesetm@upv.es</email>
					ORCID iD: <ext-link ext-link-type="uri" xlink:href="https://orcid.org/0000-0003-3706-6532">https://orcid.org/0000-0003-3706-6532</ext-link>
				</corresp>
			</author-notes>
			
			<pub-date pub-type="epub">
				<day>31</day>
				<month>03</month>
				<year>2020</year>
			</pub-date>
			
			<pub-date pub-type="collection">
			<year>2020</year>
			</pub-date>
			
			<volume>43</volume>
			<issue>1</issue>
		
			<elocation-id>e257</elocation-id>
		
			<history>
			
				<date date-type="received">
					<day>24</day>
					<month>09</month>
					<year>2018</year>
				</date>
				<date date-type="rev-recd1">
					<day>24</day>
					<month>04</month>
					<year>2019</year>
				</date>
				<date date-type="accepted">
					<day>07</day>
					<month>05</month>
					<year>2019</year>
				</date>
			</history>
		 
			<permissions>
				<copyright-statement>&#x00A9; 2020 CSIC</copyright-statement>
				<copyright-year>2020</copyright-year>
				<license license-type="open-access" xlink:href="https://creativecommons.org/licenses/by/4.0/">
					<license-p>Este es un art&#x00ED;culo de acceso abierto distribuido bajo los t&#x00E9;rminos de la licencia de uso y distribuci&#x00F3;n Creative Commons Reconocimiento 4.0 Internacional (CC BY 4.0).</license-p>
				</license>
			</permissions>
		
			
			<abstract xml:lang="es">
			<title>RESUMEN</title>
			<p>La aplicaci&#x00F3;n de m&#x00E9;todos automatizados en cualquier investigaci&#x00F3;n ha facilitado el trasvase de metodolog&#x00ED;as de una disciplina a otra, permitiendo realizar an&#x00E1;lisis cuantitativos a textos con estructura o semiestructurados. El objeto de este trabajo es aplicar a un dataset en lenguaje natural -castellano del siglo XVIII- m&#x00E9;todos de an&#x00E1;lisis de la disciplina de documentaci&#x00F3;n. Pretende establecer una metodolog&#x00ED;a autom&#x00E1;tica de an&#x00E1;lisis cuantitativo y cualitativo de textos, que permita enriquecer en el futuro las conclusiones procedentes del an&#x00E1;lisis hist&#x00F3;rico tradicional. Este estudio construye los procedimientos necesarios para poder aplicar an&#x00E1;lisis de frecuencia, extracci&#x00F3;n y clasificaci&#x00F3;n de palabras y la construcci&#x00F3;n de cl&#x00FA;steres y redes neuronales con un <italic>dataset</italic> preexistente, de caracter&#x00ED;sticas muy singulares. Permite validar diferentes utilidades de herramientas y automatizar parte del trabajo de los historiadores, para la edici&#x00F3;n de los corpus documentales de los claustros universitarios.</p>
			</abstract>
						
			<trans-abstract xml:lang="en">
			<title>ABSTRACT</title>
			<p>Applying automated methods to documents allows performing quantitative analysis of structured or semi-structured texts. This work aims to establish an automatic methodology for the quantitative and qualitative analysis of texts that may, in the future, enrich the conclusions drawn from traditional historical analysis. This work establishes the necessary procedures to be able to apply word frequency analysis, extraction and classification of words and the construction of clusters and networks with a pre-existing dataset, with unique characteristics. It allows the validation of different tool utilities and the automation of part of the work of the historians for the edition of the next documentary corpus of cloisters.</p>
			</trans-abstract>
			
			<kwd-group xml:lang="es">
				<title>PALABRAS CLAVE</title> 
				<kwd>KH Coder</kwd>
				<kwd>an&#x00E1;lisis de lenguaje natural</kwd>
				<kwd>castellano antiguo</kwd>
				<kwd>claustros universitarios</kwd>
				<kwd>siglo XVIII</kwd>
			</kwd-group>
			
			<kwd-group xml:lang="en"> 
				<title>KEYWORDS</title> 
				<kwd>KH Coder</kwd>
				<kwd>natural language analysis</kwd>
				<kwd>old Castilian language</kwd>
				<kwd>university cloisters</kwd>
				<kwd>XVIII century</kwd>
			</kwd-group>
		
		</article-meta>
	</front>
	
	
	<body>

		<sec id="S0">
			<title/>
			<p>Trabajo presentado en el congreso INFO2018: Blasco Gil, Yolanda; Peset, Fernanda; Gonz&#x00E1;lez, Luis M.; Mercado, Mariano; Pav&#x00F3;n, Carlos; Cabrera, Ana; Brot&#x00F3;ns, Sim&#x00F3;n; Monta&#x00F1;ana, Pilar; Pav&#x00F3;n, Armando; Garz&#x00F3;n, Fernanda (2018). Enriqueciendo la investigaci&#x00F3;n en humanidades digitales. An&#x00E1;lisis de textos de claustros universitarios de la Universidad de Valencia (1775-1779) con KH Coder. En: INFO 2018 IDICT. IX Seminario Internacional sobre Estudios Cuantitativos y Cualitativos de la Ciencia y la Tecnolog&#x00ED;a “Prof. Gilberto Sotolongo”. La Habana, Cuba, 5-9 marzo 2018. Disponible en: <ext-link ext-link-type="uri" xlink:href="http://www.congreso-info.cu/index.php/info/info2018">http://www.congreso-info.cu/index.php/info/info2018</ext-link> [Fecha de consulta: 23/04/2019].</p>
		</sec>
		
		<sec id="S1">
			<title>1. INTRODUCCI&#x00D3;N</title>

					<p>La aplicaci&#x00F3;n de nuevas tecnolog&#x00ED;as a la investigaci&#x00F3;n ha revolucionado la manera de hacer ciencia, los m&#x00E9;todos. En el caso de las humanidades, entre ellas la historia, este nuevo escenario ha venido a llamarse humanidades digitales. Un t&#x00E9;rmino tan gen&#x00E9;rico incluye desde la distribuci&#x00F3;n de objetos de investigaci&#x00F3;n -ya sean textos o im&#x00E1;genes- a la aplicaci&#x00F3;n de nuevos m&#x00E9;todos de an&#x00E1;lisis.</p>

					<p>En el caso de la historia, al tratarse de objetos producidos antes de la era digital, las humanidades digitales pueden referirse a las ediciones digitales de fuentes, a modo de libros y manuscritos facs&#x00ED;miles. Una de las formas de trabajo de los historiadores ha sido, desde hace a&#x00F1;os, la edici&#x00F3;n de fuentes procedentes de material de archivo.</p>

					<p>Los materiales y m&#x00E9;todos tradicionales para la historia de las instituciones universitarias cuentan con una larga tradici&#x00F3;n de edici&#x00F3;n de fuentes de archivo, in&#x00E9;ditas, por ejemplo, de la Universidad de Valencia (Peset, <xref ref-type="bibr" rid="CIT17">1977</xref>; Peset y Febrer, <xref ref-type="bibr" rid="CIT18">1999</xref>; Marzal, <xref ref-type="bibr" rid="CIT10">2003</xref>; Mayans, <xref ref-type="bibr" rid="CIT12">2008</xref>). Sin duda, los libros de claustros o reuniones de doctores, profesores y consiliarios constituyen la serie documental m&#x00E1;s utilizada y abundante. Los claustrales se reun&#x00ED;an porque el Consejo de Castilla enviaba frecuentes &#x00F3;rdenes, que ten&#x00ED;an que ser o&#x00ED;das y cumplidas por los catedr&#x00E1;ticos. Aunque las decisiones se hallan en los acuerdos municipales, los claustros resultan la fuente m&#x00E1;s rica porque transmiten noticias y resuelven las cuestiones relacionadas con la Universidad. Existen diferentes tipos de claustros en el siglo XVIII. El claustro mayor es donde se aprueban las constituciones en las universidades, y el de examinadores se dirige a cada facultad. Por su parte, las reuniones de pavordes eclesi&#x00E1;sticos y los claustros de catedr&#x00E1;ticos administran las rentas, que son generales o particulares por facultad -medicina, teolog&#x00ED;a, filosof&#x00ED;a y leyes y c&#x00E1;nones-. Estos &#x00FA;ltimos son los &#x00F3;rganos que representan el sentir de la universidad y lo hacen llegar a instancias superiores. Los claustros de catedr&#x00E1;ticos son el reflejo de la vida universitaria hasta el siglo XIX, cuando el poder centralizado de los monarcas asfixia la vida acad&#x00E9;mica.</p>

					<p>El an&#x00E1;lisis de los claustros permite estudiar la gran variedad de temas que conforman una universidad, lo que se efectu&#x00F3; en la edici&#x00F3;n cr&#x00ED;tica de Blasco (<xref ref-type="bibr" rid="CIT02">2012</xref>). En general, los claustros permiten desde reconstruir la vida cotidiana -fiestas acad&#x00E9;micas y religiosas-, conocer las ense&#x00F1;anzas -planes de estudio, ex&#x00E1;menes, nuevas asignaturas-, analizar la econom&#x00ED;a de las universidades -matr&#x00ED;cula, salarios, gastos…-; a entender la organizaci&#x00F3;n universitaria o su relaci&#x00F3;n con el entorno: disciplina escolar, cargos acad&#x00E9;micos, grupos de influencia que muestran los juegos de poder interno y sus relaciones externas con los s&#x00ED;ndicos del ayuntamiento y el gobierno del rey a trav&#x00E9;s de sus disposiciones e incluso rogativas por los partos de las princesas...</p>

					<p>Las t&#x00E9;cnicas y m&#x00E9;todos que los historiadores aplican para el an&#x00E1;lisis de fuentes permiten reconstruir las historias a trav&#x00E9;s de la lectura cualitativa, extrayendo y comparando los temas. Una investigaci&#x00F3;n puede considerarse cr&#x00ED;tica cuando sigue cuatro etapas. En primer lugar, la elecci&#x00F3;n de la pregunta que se le hace al pasado desde el presente ha de estar explicitada en un tiempo y lugar. En segundo lugar, el plan de trabajo incluye los puntos a revisar y c&#x00F3;mo hacerlo, lo que tradicionalmente se ha basado en revisiones bibliogr&#x00E1;ficas y de fuentes de archivo o editadas. La obtenci&#x00F3;n de bibliograf&#x00ED;a y fuentes, as&#x00ED; como la compilaci&#x00F3;n de sus metadatos constituye el tercer paso, previo a una lectura en profundidad. Por &#x00FA;ltimo, en el caso de las fuentes es imprescindible la cr&#x00ED;tica externa, determinando su autenticidad, el autor, la fecha, lugar y tipo de documento, as&#x00ED; como la cr&#x00ED;tica interna que desentra&#x00F1;a el sentido del documento. Esta &#x00FA;ltima puede incluir la traducci&#x00F3;n o transcripci&#x00F3;n, el an&#x00E1;lisis del lenguaje y las ideas y una valoraci&#x00F3;n de su veracidad e intenci&#x00F3;n del autor. Su objetivo es relacionar las diferentes fuentes de conocimiento, contextualizarlas y completarlas.</p>

					<p>En estos momentos, la aplicaci&#x00F3;n de procesos automatizados en cualquier disciplina est&#x00E1; facilitando el trasvase de metodolog&#x00ED;as. Permite, por ejemplo, realizar an&#x00E1;lisis cuantitativos a textos con estructura o semiestructurados, lo que se conoce como miner&#x00ED;a de textos y datos. Ante la cantidad de informaci&#x00F3;n que se produce resulta imposible extraer todos sus significados con m&#x00E9;todos mediados por humanos, por lo que estas t&#x00E9;cnicas est&#x00E1;n en pleno auge. El conocimiento de un campo avanza ahora hacia la anal&#x00ED;tica de grandes masas de informaci&#x00F3;n y la aplicaci&#x00F3;n de inteligencia artificial. Esto se evidencia tanto en los proyectos que crean plataformas de an&#x00E1;lisis como <italic>OpenMindTeD</italic><xref ref-type="fn" rid="NOTE1">1</xref> como en las peticiones para deponer los obst&#x00E1;culos legales derivados de la protecci&#x00F3;n intelectual en Europa (<italic>Maximising</italic>…, <xref ref-type="bibr" rid="CIT11">2018</xref>).</p>

					<p>Este trabajo se inserta en el contexto experimental de an&#x00E1;lisis de textos y colaboran en &#x00E9;l perfiles de historia, tecnolog&#x00ED;a, ciencias de la salud, archivos y documentaci&#x00F3;n. Se aplican a un <italic>dataset</italic> en espa&#x00F1;ol del siglo XVIII m&#x00E9;todos procedentes de otras disciplinas, como la documentaci&#x00F3;n automatizada, con an&#x00E1;lisis de datos bibliogr&#x00E1;ficos estructurados -bibliometr&#x00ED;a- o lenguaje natural, cuando se clasifican documentos o conocimiento (Serrano-Bedia y otros, <xref ref-type="bibr" rid="CIT20">2013</xref>; Cruz-Ram&#x00ED;rez y otros, <xref ref-type="bibr" rid="CIT04">2014</xref>; Ortega, <xref ref-type="bibr" rid="CIT14">2015</xref>; Ramos-Sim&#x00F3;n, <xref ref-type="bibr" rid="CIT19">2017</xref>; Castillo-Rojas y Vega-Damke, <xref ref-type="bibr" rid="CIT03">2018</xref>). Su objetivo es establecer una metodolog&#x00ED;a autom&#x00E1;tica de an&#x00E1;lisis cuantitativo y cualitativo de textos que en el futuro enriquezca las conclusiones que derivan del an&#x00E1;lisis hist&#x00F3;rico tradicional. La hip&#x00F3;tesis a validar es si las herramientas procedentes del campo del an&#x00E1;lisis textual son &#x00FA;tiles para identificar hechos significativos en lenguaje natural. Pretende establecer los procedimientos necesarios para aplicar un an&#x00E1;lisis de frecuencia, extracci&#x00F3;n y clasificaci&#x00F3;n de palabras, y construcci&#x00F3;n de cl&#x00FA;steres y redes con un <italic>dataset</italic> de caracter&#x00ED;sticas muy singulares. Esta contribuci&#x00F3;n permite validar diferentes utilidades de herramientas y automatizar parte del trabajo de los historiadores para la edici&#x00F3;n de los pr&#x00F3;ximos <italic>corpus</italic> documentales de claustros.</p>
		</sec>

		<sec id="S2">					
			<title>2. M&#x00C9;TODOS </title>

					<p>El trabajo toma como base la edici&#x00F3;n del libro 78 de los claustros de catedr&#x00E1;ticos de la Universidad de Valencia, 1775-1779, publicado por Blasco (<xref ref-type="bibr" rid="CIT02">2012</xref>). El <italic>dataset</italic> utilizado procede de un archivo en formato Word proporcionado en fecha 30/09/2015 por la autora. “Corresponden: 59 a claustros generales de catedr&#x00E1;ticos; seis claustros particulares de catedr&#x00E1;ticos de la facultad de medicina; tres de teolog&#x00ED;a; tres de filosof&#x00ED;a y uno de leyes y c&#x00E1;nones”. Este archivo original conten&#x00ED;a los 72 claustros que analiz&#x00F3;: 360 p&#x00E1;ginas, con unas 92.000 palabras, que aumentaron hasta 93.520 palabras tras su preprocesamiento. Se efectuaron las pruebas para todo el <italic>dataset</italic> y para un <italic>subdataset</italic> que conten&#x00ED;a &#x00FA;nicamente los claustros particulares de medicina.</p>

					<p>La estructura de cada acta es similar. Se inicia con la fecha, se establece que hubo convocatoria previa y el lugar de la reuni&#x00F3;n. Posteriormente, se registra la lista de asistentes, con el nombre de los presentes y la c&#x00E1;tedra que rigen. A continuaci&#x00F3;n, el secretario establece el asunto a tratar y se consigna el desarrollo de la reuni&#x00F3;n y, en su caso, la votaci&#x00F3;n. Finalmente, el acta es certificada por el escribano, con su nombre y r&#x00FA;brica.</p>

					<p>De los 72 claustros, se ofrece un listado, donde se presenta la informaci&#x00F3;n de uno de los claustros de medicina para ver sus caracter&#x00ED;sticas:</p>

							<p>“Claustro 6 de septiembre de 1777 </p>

							<p>[Al margen izquierdo:] Septiembre 6</p>

							<p>Junta de Claustro particular de Cathedr&#x00E1;ticos de la facultad de Medicina de la Universidad literaria de la Ciudad de Valencia, selebrada en la Capilla de Nuestra Se&#x00F1;ora de la Sapiencia de la misma, el d&#x00ED;a seis del mes de setiembre de mil setecientos setenta y siete a&#x00F1;os, a que asistieron el Se&#x00F1;or D. Antonio Mayans, Can&#x00F3;nigo y Rector de dicha Universidad, los Doctores D. Joseph Gasc&#x00F3;, D. Manuel Ma&#x00F1;ez y D. Agust&#x00ED;n Vicens, todos Cathedr&#x00E1;ticos de la citada facultad de Medicina; juntos y congregados, mediante convocaci&#x00F3;n hecha ante diem con cedulillas impresas, practicada por dicho Se&#x00F1;or Rector, por Antonio Morera, Vedel de dicha Universidad. Expres&#x00E1;ndose en aquella se convocava para las diez horas de la ma&#x00F1;ana de este d&#x00ED;a, las que ya eran dadas, a fin de oh&#x00ED;r el informe que se ha de dar al Real Acuerdo, con Conminaci&#x00F3;n presisa; de la qual convocaci&#x00F3;n const&#x00F3; por relaci&#x00F3;n hecha del citado Antonio Morera, Vedel, al contenido Se&#x00F1;or Rector, a presencia de m&#x00ED;, el infrascrito Escrivano de su Magestad, uno de los Ayudantes de la Escrivan&#x00ED;a Mayor de Cavildo, asistiendo como Secretario, en lugar y por D. Thom&#x00E1;s Tinagero y Vilanova, Escrivano mayor de Ayuntamiento de esta Ilustre Ciudad de Valencia, que como tal lo es de aquella[…]”</p>

					<p>En la <xref ref-type="fig" rid="F1">Figura 1</xref> se muestra su final e inicio en im&#x00E1;genes.</p>

							<fig id="F1">
								<label>Figura 1</label>
								<caption>
									<title>Im&#x00E1;genes del final e inicio de un acta de claustro</title>
								</caption>
								<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F1.jpg"/>
							</fig>

					<p>El desaf&#x00ED;o que presenta este <italic>dataset</italic> en su an&#x00E1;lisis autom&#x00E1;tico es innegable. Se trata de textos transcritos no estructurados que, adem&#x00E1;s de estar escritos en lenguaje natural, utilizan graf&#x00ED;as antiguas que var&#x00ED;an. Blasco (<xref ref-type="bibr" rid="CIT02">2012</xref>) los transcribi&#x00F3; siguiendo la norma de edici&#x00F3;n de textos paleogr&#x00E1;ficos que intenta ser fiel al original, desarrollando las abreviaturas sin indicarlo, incluyendo las firmas y anotaciones de los laterales.</p>

					<p>Antes de poder aplicar algunas herramientas especializadas de an&#x00E1;lisis de textos, se han guardado dos versiones en texto plano (.txt), una de ellas estructur&#x00E1;ndola en los m&#x00ED;nimos campos que se identifican: NO, n&#x00FA;mero de claustro; TY, tipo de claustro; TC, indica la serie, entendida como libro original; FE, fecha; AN, a&#x00F1;o; TX o texto completo de cada claustro. Se utiliz&#x00F3; la herramienta Word de Microsoft Office para sustituir cadenas de caracteres. Para estructurar el <italic>dataset</italic> para BibExcel se a&#x00F1;adieron las terminaciones “|” y “||” (final de campo y registro, respectivamente); y para KH Coder (Higuchi, <xref ref-type="bibr" rid="CIT08">2015a</xref>), una cabecera (&lt;h1&gt;&lt;/h1&gt;) por cada claustro.</p>

					<p>Existen m&#x00FA;ltiples opciones para analizar textos, desde profesionales como Cogito Discover a utilidades de red como <italic>textalyser.net</italic>. Las herramientas utilizadas para analizar el <italic>dataset</italic> provienen del an&#x00E1;lisis de textos (Gonz&#x00E1;lez y Peset, <xref ref-type="bibr" rid="CIT07">2015</xref>) y del campo de la bibliometr&#x00ED;a (Garc&#x00ED;a-Garc&#x00ED;a y otros, <xref ref-type="bibr" rid="CIT06">2015</xref>). Para la extracci&#x00F3;n y almacenamiento de la informaci&#x00F3;n se emple&#x00F3; principalmente KH Coder (versi&#x00F3;n 2.00f; Higuchi, K., Ritsumeikan University, Japan), programa para el an&#x00E1;lisis cuantitativo y <italic>text mining</italic> para el lenguaje. Adicionalmente, el software BibExcel (Persson, <xref ref-type="bibr" rid="CIT16">2011</xref>) se utiliz&#x00F3; para la frecuencia de palabras y el programa Pajek (Batagelj y Mrvar, <xref ref-type="bibr" rid="CIT01">2008</xref>) para la representaci&#x00F3;n. De esta forma, tanto an&#x00E1;lisis como visualizaci&#x00F3;n pudieron comprobarse con herramientas de uso libre.</p>
		</sec>

		<sec id="S3">
			<title>3. RESULTADOS Y DISCUSI&#x00D3;N </title>

					<p>Sobre este <italic>dataset</italic> se ejecutaron diferentes an&#x00E1;lisis de frecuencia. La distribuci&#x00F3;n de los 72 claustros por a&#x00F1;os muestra una acumulaci&#x00F3;n en 1777 y una media de unas 1300 palabras para todos los a&#x00F1;os, tal y como se muestra en la <xref ref-type="table" rid="T1">Tabla I</xref> y la <xref ref-type="fig" rid="F2">Figura 2</xref>.</p>

							<fig id="T1">
								<label>Tabla I</label>
								<caption>
									<title>Distribuci&#x00F3;n de n&#x00FA;mero de claustros y palabras por a&#x00F1;os</title>
								</caption>
								<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/T1.jpg"/>
							</fig>

							<fig id="F2">
								<label>Figura 2</label>
								<caption>
									<title>Distribuci&#x00F3;n de n&#x00FA;mero de claustros por fechas</title>
								</caption>
								<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F2.jpg"/>
							</fig>

					<p>Para el an&#x00E1;lisis del contenido textual, el primer desaf&#x00ED;o fue la construcci&#x00F3;n de un diccionario de palabras vac&#x00ED;as como n&#x00FA;meros, preposiciones, adverbios, conjunciones, etc., que fuera adecuado a este <italic>dataset</italic>. Los programas de an&#x00E1;lisis de textos permiten introducir uno diferente al ingl&#x00E9;s. Se escogi&#x00F3; como base uno de los que existen para mejorar las b&#x00FA;squedas web, en este caso de la web <italic>Elwebmaster</italic><xref ref-type="fn" rid="NOTE2">2</xref>, con 344 palabras. Dado que el <italic>dataset</italic> estaba en castellano antiguo la lista de palabras vac&#x00ED;as ten&#x00ED;a que completarse con variantes y algunas otras que fueron identificadas expresamente. Para ello, se calcul&#x00F3; la frecuencia de todas las palabras de los textos con BibExcel, seg&#x00FA;n el procedimiento descrito en un trabajo anterior (Garc&#x00ED;a-Garc&#x00ED;a y otros, <xref ref-type="bibr" rid="CIT06">2015</xref>). Estos son los quince primeros puestos de las frecuencias calculadas para las palabras con BibExcel (<xref ref-type="table" rid="T2">Tabla II</xref>). A partir de la palabra n&#x00FA;mero 16, Universidad, se consideraron significativas.</p>

							<fig id="T2">
								<label>Tabla II</label>
								<caption>
									<title>Frecuencia de las 15 palabras vac&#x00ED;as de los claustros, en BibExcel</title>
								</caption>
								<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/T2.jpg"/>
							</fig>

					<p>La ventaja de KH Coder para identificar palabras vac&#x00ED;as es que las clasifica en subclases (<xref ref-type="table" rid="T3">Tabla III</xref>): <italic>Noun, Proper noun, Foreign</italic> y <italic>Verbs</italic>. Se utilizaron como palabras vac&#x00ED;as las categor&#x00ED;as de preposiciones, adjetivos, adverbios y verbos. Sin embargo, algunas palabras, no especialmente significativas que aparecieron en las categor&#x00ED;as nombres o nombres propios, no fueron introducidos como palabras vac&#x00ED;as (posiciones 9ª, 4ª y 101ª para <italic>Noun</italic>, <italic>ProperNoun</italic> y <italic>Foreign</italic>, respectivamente). En total, se obtuvo un fichero de 1026 palabras vac&#x00ED;as, que se introdujo en KH Coder.</p>

					<p>El diccionario de palabras vac&#x00ED;as sum&#x00F3; un total de 1370 palabras, con el que se analiz&#x00F3; todo el <italic>dataset</italic> de los claustros.</p>

							<fig id="T3">
								<label>Tabla III</label>
								<caption>
									<title>Frecuencias de las 5 primeras posiciones de todas las palabras vac&#x00ED;as de los claustros, clasificadas por tipopor KH Coder</title>
								</caption>
								<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/T3.jpg"/>
							</fig>

					<p>Para establecer las frecuencias y co-ocurrencias de palabras se puede utilizar tanto BibExcel como KH Coder, pero el primero solo calcula la matriz que luego ha de visualizarse con Pajek. Por el contrario, KH Coder analiza y representa la informaci&#x00F3;n, por lo que se opt&#x00F3; por utilizarlo. El procedimiento consisti&#x00F3; en cargar el archivo de texto plano, configurar las palabras vac&#x00ED;as desde el men&#x00FA; Proyecto y ejecutar el Preprocesamiento.</p>

					<p>La potencia del programa puede verse en su manual (Higuchi, <xref ref-type="bibr" rid="CIT09">2015b</xref>), aunque examinar todas sus posibilidades no es objeto de este texto. Se ha escogido utilizar los an&#x00E1;lisis m&#x00E1;s sofisticados para miner&#x00ED;a de textos: an&#x00E1;lisis jer&#x00E1;rquico de cl&#x00FA;ster, red de co-ocurrencias y mapas auto-organizados.</p>

				<sec id="S3.1">
						<title>3.1. An&#x00E1;lisis de cl&#x00FA;steres</title>

								<p>Es un m&#x00E9;todo estad&#x00ED;stico de an&#x00E1;lisis multivariante que permite identificar grupos similares, en este caso palabras. Esta t&#x00E9;cnica de clasificaci&#x00F3;n est&#x00E1; automatizada de la siguiente forma en KH Coder: se puede filtrar por la subclase de palabras a analizar. Para este caso, se ha limitado a <italic>Noun, Proper noun</italic> y <italic>Foreign</italic> (<xref ref-type="fig" rid="F3">Fig. 3</xref>).</p>

										<fig id="F3">
											<label>Figura 3</label>
											<caption>
												<title>Men&#x00FA; an&#x00E1;lisis jer&#x00E1;rquico de cluster y dendrograma completo con KH Coder</title>
											</caption>
											<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F3.jpg"/>
										</fig>

								<p>En esta ocasi&#x00F3;n se identifican 9 cl&#x00FA;steres, que se representan en el dendograma junto con la frecuencia. El cl&#x00FA;ster principal parece incluir los elementos formales de cada acta (<xref ref-type="fig" rid="F4">Fig. 4</xref>).</p>

										<fig id="F4">
											<label>Figura 4</label>
											<caption>
												<title>Cluster principal y frecuencias</title>
											</caption>
											<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F4.jpg"/>
										</fig>

								<p>La aglomeraci&#x00F3;n que parece m&#x00E1;s significativa se establece con el cuarto y m&#x00E1;s numeroso, que incluye nombres propios, como puede apreciarse en la <xref ref-type="fig" rid="F5">Figura 5</xref>.</p>

										<fig id="F5">
											<label>Figura 5</label>
											<caption>
												<title>Cuarto cluster y frecuencias</title>
											</caption>
											<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F5.jpg"/>
										</fig>

								<p>Se ha de reconocer que el cl&#x00FA;ster que agrupa los t&#x00E9;rminos m&#x00E1;s frecuentes corresponde a palabras inermes.</p>
				</sec>

				<sec id="S3.2">
						<title>3.2. Redes de co-ocurrencia</title>

								<p>Muestra una relaci&#x00F3;n entre las palabras, sea o no significativa: “In co-word analysis, content is explored through the co-occurrence of pairs of terms or lexemes (such as words or phrases) in a corpus of papers” (Olmeda-G&#x00F3;mez y otros, <xref ref-type="bibr" rid="CIT13">2017</xref>), en este caso cada acta de claustro. Este fen&#x00F3;meno puede representarse en un grafo estructurado en nodos -las palabras- y aristas -sus relaciones, que puede incluir en la misma visualizaci&#x00F3;n otras dimensiones, como la frecuencia, los cl&#x00FA;steres… Este tipo de representaciones se han popularizado en el an&#x00E1;lisis de redes sociales como <italic>Twitter</italic>.</p>

								<p>En este an&#x00E1;lisis, se reflejan las relaciones entre todas las palabras del <italic>dataset</italic> (<xref ref-type="fig" rid="F6">Fig. 6</xref>), pero excluyendo preposiciones y adjetivos.</p>

					
										<fig id="F6">
											<label>Figura 6</label>
											<caption>
												<title>Men&#x00FA; red de co-ocurrencias</title>
											</caption>
											<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F6.jpg"/>
										</fig>

								<p>El <italic>dataset</italic> ofrece las agrupaciones y relaciones y a&#x00F1;ade a los nodos un vector para representar la frecuencia de las palabras tomando como unidad el p&#x00E1;rrafo y la oraci&#x00F3;n (<xref ref-type="fig" rid="F7">Fig. 7</xref>).</p>

										<fig id="F7">
											<label>Figura 7</label>
											<caption>
												<title>Red de co-ocurrencias con base p&#x00E1;rrafo (izquierda) y base oraci&#x00F3;n (derecha)</title>
											</caption>
											<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F7.jpg"/>
										</fig>

								<p>Esta segunda visualizaci&#x00F3;n parece mostrar relaciones m&#x00E1;s significativas, por ejemplo, a la hora de identificar nombres (cl&#x00FA;ster verde azulado).</p>
				</sec>

				<sec id="S3.3">
						<title>3.3. Mapas auto-organizados</title>

								<p>Esta visualizaci&#x00F3;n se basa en un clasificador avanzado de caracter&#x00ED;sticas o vectores ideado por Teuvo Kohonen en la d&#x00E9;cada de los 80 (Peir&#x00F3;-Velert y otros, <xref ref-type="bibr" rid="CIT15">2014</xref>). Es una clase de algoritmos de redes neuronales competitivas de aprendizaje no supervisado. Esto significa que lo primero que construye es una red de nodos con un peso aleatorio de la caracter&#x00ED;stica para despu&#x00E9;s, de forma iterativa, resituar los casos en neuronas o zonas, de manera que la representaci&#x00F3;n topol&#x00F3;gica de las muestras, el mapa, se va modificando hasta analizar todas las caracter&#x00ED;sticas que se incluyan. Se pueden visualizar mapas de caracter&#x00ED;sticas individuales, pero a diferencia del an&#x00E1;lisis de cl&#x00FA;steres esta t&#x00E9;cnica de mapas auto-organizados o <italic>Self Organizing Maps</italic> es capaz de tomar en cuenta todas las variables al tiempo en la presentaci&#x00F3;n U-matrix (Garc&#x00ED;a-Garc&#x00ED;a y otros, <xref ref-type="bibr" rid="CIT05">2014</xref>). El resultado es un mapa de concordancias, donde la cercan&#x00ED;a entre palabras evidencia una relaci&#x00F3;n, mientras que la lejan&#x00ED;a indica diferencias. Este an&#x00E1;lisis es indudablemente muy sofisticado y necesita una gran potencia de computaci&#x00F3;n, dado que el algoritmo compara cada nueva palabra con la posici&#x00F3;n de las anteriormente analizadas.</p>

								<p>En KH Coder se ha ejecutado con una frecuencia m&#x00ED;nima o umbral de 100 para aligerar el c&#x00E1;lculo (<xref ref-type="fig" rid="F8">Fig. 8</xref>).</p>

										<fig id="F8">
											<label>Figura 8</label>
											<caption>
												<title>Men&#x00FA; mapa auto-organizado</title>
											</caption>
											<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F8.jpg"/>
										</fig>

								<p>En los resultados se muestra una concentraci&#x00F3;n en los cl&#x00FA;steres superior derecho e inferiores. Puede comprobarse el m&#x00E1;s significativo en la posici&#x00F3;n izquierda inferior, con los nombres de los claustrales (<xref ref-type="fig" rid="F9">Fig. 9</xref>).</p>

										<fig id="F9">
											<label>Figura 9</label>
											<caption>
												<title>Matrix con todas las variables y 20 clusters</title>
											</caption>
											<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F9.jpg"/>
										</fig>

								<p>Al tratarse del an&#x00E1;lisis m&#x00E1;s completo, se reprodujo solo para los claustros particulares de medicina. Esta es la <xref ref-type="fig" rid="F10">Figura 10</xref> que proporciona KH Coder, donde se observa la agrupaci&#x00F3;n de palabras formales en los cl&#x00FA;steres superior derecho e inferior izquierdo, mientras que aparecen otros con t&#x00E9;rminos significativos.</p>

										<fig id="F10">
											<label>Figura 10</label>
											<caption>
												<title>U-matrix de los claustros particulares de medicina</title>
											</caption>
											<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F10.jpg"/>
										</fig>

								<p>La comparaci&#x00F3;n de los res&#x00FA;menes de los claustros particulares de medicina ofrecidos por Blasco (<xref ref-type="bibr" rid="CIT02">2012</xref>) y el mapa auto-organizado para ese <italic>subdataset</italic> fue el m&#x00E1;s satisfactorio, encontr&#x00E1;ndose coincidencias de ciertas palabras, como jard&#x00ED;n bot&#x00E1;nico o c&#x00E1;tedras y censores, que se agrupan con coherencia en los cl&#x00FA;steres donde aparecen otras relacionadas como huerto o Consejo, respectivamente:</p>
								
										<list list-type="bullet">
											<list-item>
												<p>Claustro Particular de Catedr&#x00E1;ticos de Medicina, 6 de septiembre de 1777. Acerca del informe de las ordenanzas del colegio de boticarios e instancias del gremio de «adrogueros», fols. 125-126v, de esta edici&#x00F3;n pp. 139-140. […]</p>
											</list-item>
											<list-item>
												<p>Claustro Particular de Catedr&#x00E1;ticos de Medicina, 30 de septiembre de 1777. Acerca de la real orden en raz&#x00F3;n a si se han nombrado censores para propuesta de ternas en las c&#x00E1;tedras de medicina, fols. 142-143, de esta edici&#x00F3;n pp. 150-151.</p>
											</list-item>
											<list-item>
												<p>Claustro Particular de Catedr&#x00E1;ticos de Medicina, 3 de octubre de 1777. Informe al real consejo sobre nombramiento de censores a las ternas de las c&#x00E1;tedras de medicina, fols. 143v-144v, de esta edici&#x00F3;n pp. 151-152.</p>
											</list-item>
											<list-item>
												<p>Claustro Particular de Catedr&#x00E1;ticos de Medicina, 13 de mayo de 1778. Sobre el Jard&#x00ED;n Bot&#x00E1;nico, fols. 217-218, de esta edici&#x00F3;n pp. 200-201 […]</p>
											</list-item>
											<list-item>
												<p>Claustro Particular de Catedr&#x00E1;ticos de Medicina, 29 de julio de 1778. Informe sobre el Jard&#x00ED;n Bot&#x00E1;nico, fols. 226v-231, de esta edici&#x00F3;n pp. 208-211.</p>
											</list-item>
										</list>																		
				</sec>
		</sec>

		<sec id="S4">
			<title>4. CONCLUSIONES </title>

					<p>El objetivo que se plante&#x00F3; en el estudio fue la experimentaci&#x00F3;n con herramientas autom&#x00E1;ticas para extraer significados al <italic>dataset</italic>, en confrontaci&#x00F3;n con un an&#x00E1;lisis humano. Ambos m&#x00E9;todos desean extraer la ex&#x00E9;gesis de sus atributos o propiedades m&#x00E1;s interesantes por diferentes m&#x00E9;todos. La aplicaci&#x00F3;n de t&#x00E9;cnicas automatizadas facilita el an&#x00E1;lisis desde la perspectiva de las frecuencias y las similitudes. De las pruebas realizadas se derivan conclusiones referentes a las herramientas utilizadas, al diccionario de palabras vac&#x00ED;as, la t&#x00E9;cnica de an&#x00E1;lisis m&#x00E1;s adecuada y recomendaciones para la preparaci&#x00F3;n del <italic>dataset</italic>.</p>

					<p>Primera. De las herramientas comprobadas, se descart&#x00F3; realizar el tratamiento con BibExcel y Pajek, como herramientas principales. BibExcel resulta m&#x00E1;s adecuado para datos estructurados, ya que su mayor fortaleza es el an&#x00E1;lisis entre citas bibliogr&#x00E1;ficas como co-citas y emparejamiento bibliogr&#x00E1;fico. KH Coder se evidenci&#x00F3; m&#x00E1;s adaptado al an&#x00E1;lisis de textos en lenguaje natural, simplificando en extremo algoritmos muy sofisticados y la representaci&#x00F3;n est&#x00E1;tica de resultados. Sin embargo, KH Coder es menos potente que Pajek para la visualizaci&#x00F3;n din&#x00E1;mica. Uno de los problemas que plantea KH Coder es que guarda los resultados de las matrices en el programa estad&#x00ED;stico de c&#x00F3;digo abierto R, pero no se comunica directamente con Pajek, mientras que BibExcel s&#x00ED; lo hace.</p>

					<p>Segunda. Respecto a la creaci&#x00F3;n del diccionario de palabras vac&#x00ED;as fueron utilizadas ambas herramientas de an&#x00E1;lisis para generarlo <italic>ad hoc</italic>, dada la complejidad del <italic>dataset</italic> utilizado, con variantes gr&#x00E1;ficas y morfol&#x00F3;gicas de una misma palabra. Para la mejora de resultados en un futuro podr&#x00ED;a utilizarse la opci&#x00F3;n avanzada de KH Coder <italic>POS tagger</italic> (<italic>Part-of-speech tagger</italic>), asignando parte del texto a algunas palabras, con el fin de identificar correctamente su significado.</p>

					<p>Tercera. Las t&#x00E9;cnicas de an&#x00E1;lisis cualitativa y cuantitativa pueden ser complementarias. El mapa auto-organizado sobre claustros de medicina ofrece similitudes con los res&#x00FA;menes de Blasco (<xref ref-type="bibr" rid="CIT02">2012</xref>). Por ello, aplicar t&#x00E9;cnicas autom&#x00E1;ticas puede facilitar futuros trabajos de corte cualitativo o completar el arduo trabajo de investigaci&#x00F3;n en archivos, digitalizaci&#x00F3;n, traducci&#x00F3;n, transcripci&#x00F3;n y edici&#x00F3;n de fuentes.</p>

					<p>Cuarta. Por &#x00FA;ltimo, si esta metodolog&#x00ED;a fuera utilizada en el futuro para textos similares se recomendar&#x00ED;a modificar la forma de transcripci&#x00F3;n y almacenamiento de los textos. En primer lugar, la fidelidad al original no es beneficiosa, ya que una de las frecuencias m&#x00E1;s repetidas son anotaciones como [Al margen izquierdo]. Este tipo de indicaciones distorsionan la interpretaci&#x00F3;n de la frecuencia de los resultados. Por otra parte, se recomienda almacenar los textos de forma estructurada, para que la fase previa de sustituci&#x00F3;n y estructuraci&#x00F3;n pueda ser obviada.</p>

					<p>Por tanto, se puede afirmar que las herramientas de an&#x00E1;lisis de lenguaje natural se han aplicado con m&#x00E1;s &#x00E9;xito a textos homog&#x00E9;neos en su contenido, permitiendo incluso realizar comparaciones entre documentos diferentes como en el caso de los claustros de medicina. La metodolog&#x00ED;a aqu&#x00ED; expuesta indica, que para este tipo de <italic>datasets</italic>, los temas significativos aparecen en las menores frecuencias. Por el contrario, resulta dif&#x00ED;cil aconsejar el uso de este tipo de an&#x00E1;lisis cuando son textos dispares que presentan variaciones de base. En cualquier caso, solo se justificar&#x00ED;a utilizar m&#x00E9;todos autom&#x00E1;ticos cuando la cantidad de texto hace imposible la lectura, ya que la riqueza que un historiador identifica es siempre mayor.</p>
		</sec>
	</body>

	
	<back>
	
		<ack>
			<title>5. AGRADECIMIENTOS</title>
				<p>Este trabajo ha recibido financiaci&#x00F3;n del Plan nacional I+D+i, MINECO (Espa&#x00F1;a), DATASEA Models to publish, consume and measure the reuse of research data: across institutional and geographical boundaries CSO2015-65594-C2-1R &amp; 2R (MINECO/FEDER, UE) y Alma mater totius hispaniae: Proyecci&#x00F3;n social, historia y pervivencias de las universidades hisp&#x00E1;nicas (siglos XVI-XX). MCYT, DER2016-78166-R. Y de la Universidad Nacional Aut&#x00F3;noma de M&#x00E9;xico-PAPIIT IN 401417 La corona y las universidades en el mundo hisp&#x00E1;nico. Siglos XVI-XVIII.</p>
				
					
			<p><bold>ACKNOWLEDGEMENTS</bold></p>
				<p>This work has received funds from the Plan nacional I+D+i, MINECO (Espa&#x00F1;a), DATASEA Models to publish, consume and measure the reuse of research data: across institutional and geographical boundaries CSO2015-65594-C2-1R &amp; 2R (MINECO/FEDER, UE) and Alma mater totius hispaniae: Proyecci&#x00F3;n social, historia y pervivencias de las universidades hisp&#x00E1;nicas (siglos XVI-XX) DER2016-78166-R. This work has also received funding from Universidad Nacional Aut&#x00F3;noma de M&#x00E9;xico-PAPIIT IN 401417, La corona y las universidades en el mundo hisp&#x00E1;nico. Siglos XVI-XVIII.</p>
			
		</ack>		
	
		<sec id="notas">
			<title>6. NOTAS</title>
		
			<fn-group>
				<fn id="NOTE1"><label>1</label>
					<p>OpenMinTeD. Disponible en: <ext-link ext-link-type="uri" xlink:href="openminted.eu">openminted.eu</ext-link> [Fecha de consulta: 6/05/2018].</p>
				</fn>
				
				<fn id="NOTE2"><label>2</label>
					<p>Elwebmster. Disponible en: <ext-link ext-link-type="uri" xlink:href="http://www.elwebmaster.com/referencia/stopwords-en-espanol">http://www.elwebmaster.com/referencia/stopwords-en-espanol</ext-link> [Fecha de consulta: 6/05/2018].</p>
				</fn>				
			</fn-group>
		</sec>
	
	
	
		<ref-list>
			<title>7. REFERENCIAS</title>

			<ref id="CIT01">
			<element-citation publication-type="software">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Batagelj</surname>
					  <given-names>V.</given-names>	  
				  </name>
				  <name>
					  <surname>Mrvar</surname>
					  <given-names>A.</given-names>	  
				  </name>
			  </person-group>
			  <year>2008</year>
			  <source>Pajek Version 1.28</source>
			  <publisher-loc>Ljubljana</publisher-loc>
			  <publisher-name>University of Ljubljana</publisher-name>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://mrvar.fdv.uni-lj.si/pajek/">http://mrvar.fdv.uni-lj.si/pajek/</ext-link></comment>
			</element-citation>
			</ref>

			<ref id="CIT02"> 
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Blasco Gil</surname>
					  <given-names>Y.</given-names>	  
				  </name>
			  </person-group>
			  <year>2012</year>
			  <source>Claustros de Catedr&#x00E1;ticos de la Universidad de Valencia, 1775-1779</source>
			  <publisher-loc>Val&#x00E8;ncia</publisher-loc>
			  <publisher-name>Universitat de Val&#x00E8;ncia</publisher-name>
			</element-citation>
			</ref>

			<ref id="CIT03">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Castillo-Rojas</surname>
					  <given-names>W.</given-names>	  
				  </name>
				  <name>
					  <surname>Vega-Damke</surname>
					  <given-names>J.</given-names>	  
				  </name>
			  </person-group>
			  <year>2018</year>
			  <article-title>Visualizaci&#x00F3;n Interactiva para Modelos de Cl&#x00FA;steres</article-title>
			  <source>Ingeniare. Revista Chilena de Ingenier&#x00ED;a</source>
			  <volume>26</volume>
			  <issue>1</issue>
			  <fpage>130</fpage>
			  <lpage>141</lpage>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://dx.doi.org/10.4067/S0718-33052018000100130">http://dx.doi.org/10.4067/S0718-33052018000100130</ext-link></comment>
			</element-citation>
			</ref>

			<ref id="CIT04">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Cruz-Ram&#x00ED;rez</surname>
					  <given-names>M.</given-names>	  
				  </name>
				  <name>
					  <surname>Escalona-Reyes</surname>
					  <given-names>M.</given-names>	  
				  </name>
				  <name>
					  <surname>Cabrera-Garc&#x00ED;a</surname>
					  <given-names>S.</given-names>	  
				  </name>
				  <name>
					  <surname>Mart&#x00ED;nez-Cepena</surname>
					  <given-names>M. C.</given-names>	  
				  </name>
			  </person-group>
			  <year>2014</year>
			  <article-title>An&#x00E1;lisis cienciom&#x00E9;trico de las publicaciones educacionales cubanas en la WoS y Scopus (2003-2012)</article-title>
			  <source>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</source>
			  <volume>37</volume>
			  <issue>3</issue>
			  <elocation-id>e058</elocation-id>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://dx.doi.org/10.3989/redc.2014.3.1119">http://dx.doi.org/10.3989/redc.2014.3.1119</ext-link></comment> 
			</element-citation>
			</ref>

			<ref id="CIT05">
			<element-citation publication-type="conf-proc">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Garc&#x00ED;a-Garc&#x00ED;a</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Garc&#x00ED;a-Mass&#x00F3;</surname>
					  <given-names>X.</given-names>	  
				  </name>
				  <name>
					  <surname>Ferrer-Sapena</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Gonz&#x00E1;lez</surname>
					  <given-names>L. M.</given-names>	  
				  </name>
				  <name>
					  <surname>Peset</surname>
					  <given-names>F.</given-names>	  
				  </name>
				  <name>
					  <surname>Villam&#x00F3;n-Herrera</surname>
					  <given-names>M.</given-names>	  
				  </name>
				  <name>
					  <surname>Aleixandre-Benavent</surname>
					  <given-names>R.</given-names>	  
				  </name>
			  </person-group>
			  <year>2014</year>
			  <article-title>Text mining versus redes neuronales. Dos m&#x00E9;todos de an&#x00E1;lisis aplicados al caso de las pol&#x00ED;ticas de las revistas sobre datos</article-title>
			  <conf-name>4ª Conferencia internacional sobre calidad de revistas de ciencias sociales y humanidades (CRECS 2014)</conf-name>
			  <publisher-loc>Madrid</publisher-loc>
			  <publisher-name>El Profesional de la Informaci&#x00F3;n</publisher-name>
			  <publisher-name>Biblioteca de la Universidad Complutense de Madrid</publisher-name>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://eprints.rclis.org/23152/1/pesetcrecs14.pdf">http://eprints.rclis.org/23152/1/pesetcrecs14.pdf</ext-link></comment>
			  <date-in-citation content-type="access-date">[Fecha de consulta: 10/11/2017]</date-in-citation>
			</element-citation>
			</ref>
			
			<ref id="CIT06">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Garc&#x00ED;a-Garc&#x00ED;a</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Pardo-Iba&#x00F1;ez</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Ferrer</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Peset</surname>
					  <given-names>F.</given-names>	  
				  </name>
				  <name>
					  <surname>Gonz&#x00E1;lez</surname>
					  <given-names>L. M.</given-names>	  
				  </name>
			  </person-group>
			  <year>2015</year>
			  <article-title>Herramientas de an&#x00E1;lisis de datos bibliogr&#x00E1;ficos y construcci&#x00F3;n de mapas de conocimiento: BibExcel y Pajek</article-title>
			  <source>BiD: textos universitaris de biblioteconomia i documentaci&#x00F3;</source>
			  <issue>34</issue>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://dx.doi.org/10.1344/BiD2015.34.22">http://dx.doi.org/10.1344/BiD2015.34.22</ext-link></comment>
			</element-citation>
			</ref>

			<ref id="CIT07">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Gonz&#x00E1;lez</surname>
					  <given-names>L. M.</given-names>	  
				  </name>
				  <name>
					  <surname>Peset</surname>
					  <given-names>F.</given-names>	  
				  </name>
			  </person-group>
			  <year>2015</year>
			  <article-title>Reflexiones sobre las herramientas imprescindibles en la red para la explotaci&#x00F3;n de datos</article-title>
			  <source>Anuario ThinkEPI</source>
			</element-citation>
			</ref>

			<ref id="CIT08">
			<element-citation publication-type="software">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Higuchi</surname>
					  <given-names>K.</given-names>	  
				  </name>
			  </person-group>
			  <year>2015a</year>
			  <source>KH Coder v. 2.00</source>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://KHCoder.net/en/">http://KHCoder.net/en/</ext-link></comment>
			  <date-in-citation content-type="access-date">[Fecha de consulta: 17/4/2019]</date-in-citation>
			</element-citation>
			</ref>

			<ref id="CIT09">
			<element-citation publication-type="report">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Higuchi</surname>
					  <given-names>K.</given-names>	  
				  </name>
			  </person-group>
			  <year>2015b</year>
			  <source>KH Coder 2.x Reference Manual</source>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://khc.sourceforge.net/en/manual_en_v2.pdf">http://khc.sourceforge.net/en/manual_en_v2.pdf</ext-link></comment>
			  <date-in-citation content-type="access-date">[Fecha de consulta: 1/11/2017]</date-in-citation>
			</element-citation>
			</ref>

			<ref id="CIT10"> 
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Marzal Rodr&#x00ED;guez</surname>
					  <given-names>P.</given-names>	  
				  </name>
			  </person-group>
			  <year>2003</year>
			  <source>Los Claustros de doctores y catedr&#x00E1;ticos del Estudio General de Valencia (1675-1741)</source>
			  <publisher-loc>Val&#x00E8;ncia</publisher-loc>
			  <publisher-name>Universitat de Val&#x00E8;ncia</publisher-name>
			</element-citation>
			</ref>

			<ref id="CIT11">
			<element-citation publication-type="report">
			  <year>2018</year>
			  <source>Maximising the benefits of Artificial Intelligence through future-proof rules on Text and Data Mining</source>
			  <comment>Disponible en:<ext-link ext-link-type="uri" xlink:href="http://eare.eu/assets/uploads/2018/03/OpenLetter-to-European-Commission-on-AI-and-TDM_9April2018.pdf">http://eare.eu/assets/uploads/2018/03/OpenLetter-to-European-Commission-on-AI-and-TDM_9April2018.pdf</ext-link></comment>
			  <date-in-citation content-type="access-date">[Fecha de consulta: 6/05/2018]</date-in-citation>
			</element-citation>
			</ref>
			
			<ref id="CIT12">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Mayans i Siscar</surname>
					  <given-names>G.</given-names>	  
				  </name>
			  </person-group>
			  <year>2008</year>
			  <source>Epistolario XXIII. Mayans y Nebot/2 (1742-1744). Te&#x00F3;rica human&#x00ED;stica y pr&#x00E1;ctica en el foro</source>
			  <publisher-loc>Valencia</publisher-loc>
			  <publisher-name>Ayuntamiento de Oliva (Valencia)</publisher-name>
			  <comment>Estudio preliminar, transcripci&#x00F3;n y notas de Mariano Peset</comment>
			</element-citation>
			</ref>

			<ref id="CIT13">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Olmeda-G&#x00F3;mez</surname>
					  <given-names>C.</given-names>	  
				  </name>
				  <name>
					  <surname>Ovalle-Perandones</surname>
					  <given-names>M. A.</given-names>	  
				  </name>
				  <name>
					  <surname>Perianes-Rodr&#x00ED;guez</surname>
					  <given-names>A.</given-names>	  
				  </name>
			  </person-group>
			  <year>2017</year>
			  <article-title>Co-word analysis and thematic landscapes in Spanish information science literature, 1985–2014</article-title>
			  <source>Scientometrics</source>
			  <volume>113</volume>
			  <issue>1</issue>
			  <fpage>195</fpage>
			  <lpage>217</lpage>
			  <comment><ext-link ext-link-type="uri" xlink:href="https://doi.org/10.1007/s11192-017-2486-8">https://doi.org/10.1007/s11192-017-2486-8</ext-link></comment>
			</element-citation>
			</ref>
			
			<ref id="CIT14">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Ortega</surname>
					  <given-names>J. L.</given-names>	  
				  </name>
 			  </person-group>
			  <year>2015</year>
			  <article-title>Diferencias y evoluci&#x00F3;n del impacto acad&#x00E9;mico en los perfiles de Google Scholar Citations: Una aplicaci&#x00F3;n de &#x00E1;rboles de decisi&#x00F3;n</article-title>
			  <source>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</source>
			  <volume>38</volume>
			  <issue>4</issue>
			  <elocation-id>e102</elocation-id>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://dx.doi.org/10.3989/redc.2015.4.1225">http://dx.doi.org/10.3989/redc.2015.4.1225</ext-link></comment>
			</element-citation>
			</ref>

			<ref id="CIT15">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Peir&#x00F3;-Velert</surname>
					  <given-names>C.</given-names>	  
				  </name>
				  <name>
					  <surname>Valencia-Peris</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Gonz&#x00E1;lez</surname>
					  <given-names>L. M.</given-names>	  
				  </name>
				  <name>
					  <surname>Garc&#x00ED;a-Mass&#x00F3;</surname>
					  <given-names>X.</given-names>	  
				  </name>
				  <name>
					  <surname>Serra-A&#x00F1;&#x00F3;</surname>
					  <given-names>P.</given-names>	  
				  </name>
				  <name>
					  <surname>Dev&#x00ED;s-Dev&#x00ED;s</surname>
					  <given-names>J.</given-names>	  
				  </name>
			  </person-group>
			  <year>2014</year>
			  <article-title>Screen Media Usage, Sleep Time and Academic Performance in Adolescents: Clustering a Self-Organizing Maps Analysis</article-title>
			  <source>PLoS ONE</source>
			  <volume>9</volume>
			  <issue>6</issue>
			  <elocation-id>e99478</elocation-id>
			  <comment><ext-link ext-link-type="uri" xlink:href="https://doi.org/10.1371/journal.pone.0099478">https://doi.org/10.1371/journal.pone.0099478</ext-link></comment>
			</element-citation>
			</ref>

			<ref id="CIT16">
			<element-citation publication-type="software">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Persson</surname>
					  <given-names>O.</given-names>	  
				  </name>
			  </person-group>
			  <year>2011</year>
			  <source>BibExcel. Version 2011-02-03</source>
			  <publisher-loc>Ume&#x00E5;</publisher-loc>
			  <publisher-name>Ume&#x00E5; University</publisher-name>
			  <comment><ext-link ext-link-type="uri" xlink:href="https://homepage.univie.ac.at/juan.gorraiz/bibexcel/">https://homepage.univie.ac.at/juan.gorraiz/bibexcel/</ext-link></comment>
			</element-citation>
			</ref>

			<ref id="CIT17">
			<element-citation publication-type="book">
			  <person-group person-group-type="editor">
				  <name>
					  <surname>Peset</surname>
					  <given-names>M.</given-names>	  
				  </name>
			  </person-group>
			  <year>1977</year>
			  <source>Bulas, constituciones y documentos de la Universidad de Valencia</source>
			  <publisher-loc>Val&#x00E8;ncia</publisher-loc>
			  <publisher-name>Universitat de Val&#x00E8;ncia</publisher-name>
			</element-citation>
			</ref>

			<ref id="CIT18">
			<element-citation publication-type="book">
			  <person-group person-group-type="editor">
				  <name>
					  <surname>Peset</surname>
					  <given-names>M.</given-names>	  
				  </name>
				  <name>
					  <surname>Febrer</surname>
					  <given-names>M. V.</given-names>	  
				  </name>
			  </person-group>
			  <year>1999</year>
			  <source>Bulas, constituciones y estatutos de la universidad de Valencia</source>
			  <size units="volume">2</size>
			  <publisher-loc>Val&#x00E8;ncia</publisher-loc>
			  <publisher-name>Universitat de Val&#x00E8;ncia</publisher-name>
			</element-citation>
			</ref>

			<ref id="CIT19">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Ramos-Sim&#x00F3;n</surname>
					  <given-names>L.F.</given-names>	  
				  </name>
			  </person-group>
			  <year>2017</year>
			  <article-title>El uso de las licencias libres en los datos p&#x00FA;blicos abiertos</article-title>
			  <source>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</source>
			  <volume>40</volume>
			  <issue>3</issue>
			  <elocation-id>e179</elocation-id>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://dx.doi.org/10.3989/redc.2017.3.1376">http://dx.doi.org/10.3989/redc.2017.3.1376</ext-link></comment>
			</element-citation>
			</ref>

			<ref id="CIT20">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Serrano-Bedia</surname>
					  <given-names>A. M.</given-names>	  
				  </name>
				  <name>
					  <surname>L&#x00F3;pez-Fern&#x00E1;ndez</surname>
					  <given-names>M. C.</given-names>	  
				  </name>
				  <name>
					  <surname>P&#x00E9;rez-P&#x00E9;rez</surname>
					  <given-names>M.</given-names>	  
				  </name>
			  </person-group>
			  <year>2013</year>
			  <article-title>An&#x00E1;lisis de la relaci&#x00F3;n entre flexibilidad en operaciones y performance empresarial mediante t&#x00E9;cnicas bibliom&#x00E9;tricas</article-title>
			  <source>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</source>
			  <volume>36</volume>
			  <issue>4</issue>
			  <elocation-id>e022</elocation-id>
			  <comment><ext-link ext-link-type="uri" xlink:href="http://dx.doi.org/10.3989/redc.2013.4.1007">http://dx.doi.org/10.3989/redc.2013.4.1007</ext-link></comment>
			</element-citation>
			</ref>

		</ref-list>
		
	</back>
</article>
