<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE article PUBLIC "-//NLM//DTD Journal Publishing DTD v3.0 20080202//EN" "journalpublishing3.dtd">
<article article-type="research-article" dtd-version="3.0" xml:lang="es" xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink">
	
	<front>
		
		<journal-meta>
			<journal-id journal-id-type="publisher-id">REDC</journal-id>
			<journal-title-group>
				<journal-title>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</journal-title>
				<abbrev-journal-title>Rev. Esp. Doc. Cient.</abbrev-journal-title>
			</journal-title-group>
			<issn pub-type="ppub">0210-0614</issn>
			<issn pub-type="epub">1988-4621</issn>
			<publisher>
				<publisher-name>Consejo Superior de Investigaciones Cient&#x00ED;ficas</publisher-name>
			</publisher>
		</journal-meta>
		
		<article-meta>
			<article-id pub-id-type="publisher-id">redc.2016.3.1328</article-id>
			<article-id pub-id-type="doi">10.3989/redc.2016.3.1328</article-id>
			
			<article-categories>
				<subj-group subj-group-type="heading">
				<subject>ESTUDIOS / RESEARCH STUDIES</subject>
				</subj-group>
			</article-categories>
			
			<title-group>
				<article-title>Medici&#x00F3;n de la presencia de la lengua espa&#x00F1;ola en la Internet: m&#x00E9;todos y resultados</article-title>
				<trans-title-group xml:lang="en">
				<trans-title>Measuring the presence of the Spanish language on the Internet: methods and results</trans-title>
				</trans-title-group>
				<alt-title alt-title-type="running-head">Medici&#x00F3;n de la presencia de la lengua espa&#x00F1;ola en la Internet: m&#x00E9;todos y resultados</alt-title>
			</title-group>
			
			<contrib-group>
		
				<contrib contrib-type="author" corresp="no">
					<name>
					 <surname>Pimienta</surname>
					 <given-names>Daniel</given-names>
					</name>
					<xref ref-type="aff" rid="U1"/>
					<xref ref-type="corresp" rid="cor1"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Prado</surname>
					 <given-names>Daniel</given-names>
					</name>
					<xref ref-type="aff" rid="U2"/>
					<xref ref-type="corresp" rid="cor2"/>
				</contrib>
				
				<aff id="U1">Presidente de la Fundaci&#x00F3;n Redes y Desarrollo (Funredes) y Secretario Ejecutivo de la Red mundial por la diversidad ling&#x00FC;&#x00ED;stica (Maaya)</aff>
				<aff id="U2">Consultor y miembro del Comit&#x00E9; Ejecutivo de la Red mundial por la diversidad ling&#x00FC;&#x00ED;stica (Maaya)</aff>
				
			</contrib-group>
			
			<author-notes>
				<corresp id="cor1">e-mail: <email xlink:href="pimienta@funredes.org">pimienta@funredes.org</email></corresp>
				<corresp id="cor2">e-mail: <email xlink:href="dhprado@gmail.com">dhprado@gmail.com</email></corresp>
			</author-notes>
			
			<pub-date pub-type="epub">
				<day>30</day>
				<month>09</month>
				<year>2016</year>
			</pub-date>
			
			<pub-date pub-type="collection">
			<year>2016</year>
			</pub-date>
			
			<volume>39</volume>
			<issue>3</issue>
		
			<elocation-id>e141</elocation-id>
		
			<history>
			
				<date date-type="received">
					<day>13</day>
					<month>08</month>
					<year>2015</year>
				</date>
				<date date-type="rev-recd1">
					<day>21</day>
					<month>12</month>
					<year>2015</year>
				</date>
				<date date-type="accepted">
					<day>22</day>
					<month>01</month>
					<year>2016</year>
				</date>
			</history>
		 
			<permissions>
				<copyright-statement>&#x00A9; 2016 CSIC</copyright-statement>
				<copyright-year>2016</copyright-year>
				<license license-type="open-access" xlink:href="http://creativecommons.org/licenses/by/3.0/es/deed.en">
					<license-p>Este es un art&#x00ED;culo de acceso abierto distribuido bajo los t&#x00E9;rminos de la licencia Creative Commons Attribution (CC BY) Espa&#x00F1;a 3.0.</license-p>
				</license>
			</permissions>
		
			
			<abstract xml:lang="es">
			<title>RESUMEN</title>
			<p>En esta comunicaci&#x00F3;n se resumen estudios recientes que exploran y analizan la situaci&#x00F3;n de la lengua espa&#x00F1;ola en la Internet e infiere lecciones metodol&#x00F3;gicas que podr&#x00ED;an ser &#x00FA;tiles para estudios similares para otros idiomas. El m&#x00E9;todo ha sido utilizado por primera vez para obtener resultados acerca de la situaci&#x00F3;n de la lengua francesa en la Internet, en un estudio financiado por la <italic>Organisation internationale de la Francophonie</italic>. Al tomarse en cuenta una selecci&#x00F3;n de espacios y aplicaciones de mucho uso, la lengua espa&#x00F1;ola podr&#x00ED;a ser considerada entre la tercera y la cuarta lengua dentro de los usos de la Internet (cuando es la tercera en n&#x00FA;mero de internautas) ocupando los primeros lugares en materia de P2P, videos y blogs, apreci&#x00E1;ndose un rol menor en materia de libros, p&#x00E1;ginas web y aplicaciones. Es as&#x00ED; como el espa&#x00F1;ol en la Internet parece actuar m&#x00E1;s din&#x00E1;micamente como vector de comunicaci&#x00F3;n que como vector de informaci&#x00F3;n.</p>
			</abstract>
						
			<trans-abstract xml:lang="en">
			<title>ABSTRACT</title>
			<p>This paper summarizes recent studies that explore and analyze the situation of the Spanish language on the Internet and infers methodological lessons that could be useful for similar studies for other languages. The method was first used to obtain results for the state of French on the Internet in a study funded by the <italic>Organisation internationale de la Francophonie</italic>. By taking into account a selection of web spaces and commonly used applications, Spanish could be ranked between third and fourth place in terms of Internet usage (whereas it is third in terms of Internet users), occupying the top positions for P2P, videos and blogs, but having a minor role in terms of books, webpages and applications. Thus Spanish on the Internet appears to act more dynamically as a vector for communication than for information.</p>
			</trans-abstract>

			<kwd-group xml:lang="es">
				<title>PALABRAS CLAVE</title> 
				<kwd>Cibermetr&#x00ED;a de lenguas</kwd>
				<kwd>diversidad ling&#x00FC;&#x00ED;stica</kwd>
				<kwd>medici&#x00F3;n de lenguas</kwd>
				<kwd>multiling&#x00FC;ismo en el ciberespacio</kwd>
				<kwd>espa&#x00F1;ol en la Internet</kwd>
				<kwd>presencia de lenguas en la Internet</kwd>
			</kwd-group>

			<kwd-group xml:lang="en"> 
				<title>KEYWORDS</title> 
				<kwd>Cybermetric language</kwd>
				<kwd>Linguistic diversity</kwd>
				<kwd>measuring languages</kwd>
				<kwd>multilingualism in cyberspace</kwd>
				<kwd>Spanish on the Internet</kwd>
				<kwd>presence of languages on the Internet</kwd>
			</kwd-group>
		
		</article-meta>
	</front>
	
	<body>

		<sec id="S1">
				<title>1. INTRODUCCI&#x00D3;N</title>

				<p>La Red Mundial por la diversidad ling&#x00FC;&#x00ED;stica, Maaya (Maaya, <xref ref-type="bibr" rid="CIT11">2015</xref>), ya sea directamente o a trav&#x00E9;s de algunos de sus miembros, como Funredes (Funredes, <xref ref-type="bibr" rid="CIT07">2014</xref>), el <italic>Language Observatory Project</italic> (LOP, <xref ref-type="bibr" rid="CIT10">2012</xref>) o Uni&#x00F3;n Latina (Uni&#x00F3;n Latina, <xref ref-type="bibr" rid="CIT23">2015</xref>), ha llevado a cabo una serie de estudios para analizar la situaci&#x00F3;n de las lenguas en la Internet desde 1988 hasta el presente. </p>

				<p>Por un lado, Funredes y la Uni&#x00F3;n Latina desarrollaron inicialmente una metodolog&#x00ED;a de medici&#x00F3;n espec&#x00ED;fica para un grupo de lenguas<xref ref-type="fn" rid="NOTE1">1</xref>, permitiendo realizar una serie de campa&#x00F1;as de medici&#x00F3;n en diferentes espacios de la Internet, entre 1988 y 2008 (Estudio lenguas y ciberespacio, <xref ref-type="bibr" rid="CIT05">2012</xref> y Observatorio de lenguas y culturas en la Internet, <xref ref-type="bibr" rid="CIT14">2012</xref>). </p>

				<p>Por otro lado, el <italic>Language Observatory Project</italic> (LOP, <xref ref-type="bibr" rid="CIT10">2012</xref>) estudi&#x00F3;, en la segunda parte del mismo periodo, el comportamiento de las lenguas en la mayor&#x00ED;a de los dominios de Internet de nivel superior (conocidos como ccTLD) de pa&#x00ED;ses de Asia y &#x00C1;frica, con la intenci&#x00F3;n de medir la situaci&#x00F3;n particular de las lenguas minoritarias. </p>

				<p>Mientras el <italic>Language Observatory Project</italic> basaba sus estudios en el rastreo sistem&#x00E1;tico de las p&#x00E1;ginas Web del dominio elegido mediante un algoritmo de reconocimiento de idiomas, Funredes y la Uni&#x00F3;n Latina utilizaban los dispositivos de conteo de n&#x00FA;mero de ocurrencias de los motores de b&#x00FA;squeda, con un muestreo de palabras suficientemente espec&#x00ED;ficas que pudiesen permitir comparaci&#x00F3;n entre ciertos idiomas.</p>

				<p>Pero en 2008 Funredes / Uni&#x00F3;n Latina dejaron de utilizar dicha metodolog&#x00ED;a como consecuencia del cambio de comportamiento de los motores de b&#x00FA;squeda (porcentajes bajos de indexaci&#x00F3;n, cifras diferentes en funci&#x00F3;n del usuario, preferencia por los sitios que m&#x00E1;s beneficios econ&#x00F3;micos aportan al motor, ninguna confiabilidad en los conteos propuestos, etc.) y el <italic>Language Observatory Project</italic> dej&#x00F3; de realizar su medici&#x00F3;n sistem&#x00E1;tica, impidiendo as&#x00ED; contar con medios serios de supervisi&#x00F3;n de la evoluci&#x00F3;n de las lenguas en la Internet, dejando lugar a la circulaci&#x00F3;n de cifras provenientes de fuentes poco fiables, de car&#x00E1;cter promocional o comercial (Pimienta y otros, <xref ref-type="bibr" rid="CIT18">2009</xref>).</p>

				<p>Para superar esta situaci&#x00F3;n, Maaya dise&#x00F1;&#x00F3; un proyecto de investigaci&#x00F3;n muy ambicioso, Dilinet (Dilinet, <xref ref-type="bibr" rid="CIT04">2014</xref>), aun en espera de financiaci&#x00F3;n, sin la cual no se puede pretender una investigaci&#x00F3;n profunda del cada vez m&#x00E1;s <italic>insondable</italic> ciberespacio. En paralelo, edit&#x00F3; un compendio de art&#x00ED;culos con grandes nombres mundiales especializados en la diversidad ling&#x00FC;&#x00ED;stica en Internet, algunos de cuyos art&#x00ED;culos han facilitado y orientado la investigaci&#x00F3;n aqu&#x00ED; presentada (Net.Lang, <xref ref-type="bibr" rid="CIT13">2012</xref>).</p>

				<p>En espera del &#x00E9;xito del proyecto Dilinet, se exponen en este trabajo estudios cuyos m&#x00E9;todos representan una alternativa, quiz&#x00E1;s menos ambiciosa, pero v&#x00E1;lida para alcanzar un nivel aceptable de estimaci&#x00F3;n sobre la situaci&#x00F3;n de las lenguas estudiadas en las zonas m&#x00E1;s visibles de la Internet, y emprender as&#x00ED; una sistematizaci&#x00F3;n en la observaci&#x00F3;n de la situaci&#x00F3;n de las lenguas.</p>

				<p>El m&#x00E9;todo descrito aqu&#x00ED; se ha utilizado por primera vez para la lengua francesa (OIF, <xref ref-type="bibr" rid="CIT15">2014</xref>), solicitado por la Organizaci&#x00F3;n Internacional de la Francofon&#x00ED;a (<italic>Organisation internationale de la Francophonie – </italic>www.francophonie.org) y podr&#x00ED;a servir de inspiraci&#x00F3;n para estudios sobre otros idiomas con un gran n&#x00FA;mero de hablantes, como el portugu&#x00E9;s, el ruso, el &#x00E1;rabe o el alem&#x00E1;n. Los resultados mostrados aqu&#x00ED; han sido los obtenidos para la lengua espa&#x00F1;ola.</p>
		</sec>
		
		<sec id="S2">

				<title>2. ANTECEDENTES Y ENFOQUE</title>

				<p>Aunque diversos indicadores podr&#x00ED;an evaluar de forma precisa la presencia de la lengua espa&#x00F1;ola (en educaci&#x00F3;n, en ciencia, en organismos internacionales, en materia de traducci&#x00F3;n de idiomas, en materia de edici&#x00F3;n, etc. [Uni&#x00F3;n Latina, <xref ref-type="bibr" rid="CIT24">2010</xref>]), quedan dudas al hablar de la presencia espa&#x00F1;ola en el ciberespacio, a pesar de que los medios de comunicaci&#x00F3;n le atribuyen, sin mayor reflexi&#x00F3;n, un hipot&#x00E9;tico tercer lugar que ocupar&#x00ED;a la lengua espa&#x00F1;ola en la Internet.</p>

				<p>La voluntad, aparentemente simple, de medici&#x00F3;n de la “presencia” de una lengua en la Internet choca con un malentendido permanente, que es la consecuencia de la escasez de datos sobre el tema, causa de discrepancias en las cifras facilitadas por diversas fuentes. </p>

				<p>Dos indicadores diferentes suelen confundirse en los resultados publicados:</p>
				
					<list list-type="bullet">
						<list-item>
							<p>El porcentaje estimado <italic>de usuarios de la Internet</italic> en una lengua determinada;</p>
						</list-item>
						
						<list-item>
							<p>El porcentaje estimado <italic>de contenidos en la Internet</italic> para un determinado idioma.</p>
						</list-item>
					</list>


				<p>La medici&#x00F3;n del n&#x00FA;mero de usuarios de la Internet hispanohablantes o la del n&#x00FA;mero de p&#x00E1;ginas web en espa&#x00F1;ol son fundamentalmente diferentes, y reflejan diferentes realidades que merecen una mirada tambi&#x00E9;n diferente: la primera medida est&#x00E1; relacionada con lo que llamamos <italic>brecha digital</italic> (es decir, el acceso f&#x00ED;sico a la Internet) y el segundo, con <italic>la brecha de contenidos </italic>(es decir la presencia de informaci&#x00F3;n en el idioma estudiado), una brecha mucho menos conocida pero m&#x00E1;s decisiva. </p>

				<p>Es as&#x00ED;, cuando se encuentran en los peri&#x00F3;dicos o en algunos informes, las cifras de la “presencia del espa&#x00F1;ol”, se debe entender y diferenciar si se refiere a la lengua del internauta o a la de los contenidos. Por lo tanto, la afirmaci&#x00F3;n de que el espa&#x00F1;ol es la tercera lengua de la Internet, informaci&#x00F3;n ampliamente difundida por los medios de comunicaci&#x00F3;n, s&#x00F3;lo tiene sentido si se especifica que la tercera poblaci&#x00F3;n de usuarios de Internet es la hispanohablante. De ninguna manera eso implica que el espa&#x00F1;ol es el tercero en t&#x00E9;rminos de contenidos como veremos adelante: nuestro estudio establece que, en t&#x00E9;rminos de p&#x00E1;ginas web, el espa&#x00F1;ol ser&#x00ED;a la quinta lengua y si se ponderan debidamente todos los factores de presencia relacionados con la Internet (el acceso, los contenidos y los m&#x00FA;ltiples usos posibles) llegar&#x00ED;amos a una posici&#x00F3;n mediana entre 3 y 4.</p>

				<p>Desde luego, este nuevo estudio introduce una nueva variable que no hab&#x00ED;a sido estudiada en los trabajos anteriores (m&#x00E1;s centrados en contar p&#x00E1;ginas web), la de medir los usos en funci&#x00F3;n de aplicaciones.</p>
				
		<sec id="S2.1">

				<title>Medici&#x00F3;n de usuarios de Internet por idioma</title>

				<p>Los datos sobre el n&#x00FA;mero de internautas por lengua provienen de la fuente m&#x00E1;s consultada en este &#x00E1;mbito: InternetWorldStats (InternetWorldStats, <xref ref-type="bibr" rid="CIT09">2013</xref>), fuente que, si bien est&#x00E1; lejos de satisfacer las expectativas de estad&#x00ED;sticas rigurosas, al menos tiene el m&#x00E9;rito de ser la &#x00FA;nica que existe (para medir los usuarios por lenguas) y de actualizarse peri&#x00F3;dicamente. Su metodolog&#x00ED;a consiste en determinar los principales idiomas que se utilizan en cada pa&#x00ED;s y cruzar esta informaci&#x00F3;n con los datos de la Uni&#x00F3;n Internacional de Telecomunicaciones sobre el n&#x00FA;mero total de usuarios de Internet en cada pa&#x00ED;s. Es de notar que las cifras dejaron de ser actualizadas entre mayo del 2011 y finales del a&#x00F1;o 2013, tomadas como referencia para este estudio.</p>

				<p>Sin embargo, los datos de la Uni&#x00F3;n Internacional de Telecomunicaciones son producidos por los gobiernos, lo que no es necesariamente un criterio de fiabilidad y de homogeneidad, puesto que algunos pa&#x00ED;ses tienden a inflar las cifras dadas a la Uni&#x00F3;n Internacional de Telecomunicaciones para demostrar el &#x00E9;xito de sus esfuerzos para luchar contra la brecha digital (UIT, <xref ref-type="bibr" rid="CIT22">2010</xref>). Por otra parte, no hay ninguna menci&#x00F3;n de la metodolog&#x00ED;a utilizada por InternetWorldStats para contar el n&#x00FA;mero de usuarios de Internet para las lenguas estudiadas. Al parecer, el &#x00FA;nico criterio es el del (o los) idioma(s) oficial(es) de cada pa&#x00ED;s. InternetWorldStats tambi&#x00E9;n utiliza, para cada pa&#x00ED;s, diversas fuentes de mercadeo, sin metodolog&#x00ED;a com&#x00FA;n entre los pa&#x00ED;ses. Por &#x00FA;ltimo, este estudio se limita a los diez principales idiomas de los usuarios de Internet, en contraste con la compa&#x00F1;&#x00ED;a que proporcionaba cifras comparables antes de 2007 (GlobalStats, desaparecida hoy d&#x00ED;a), consultable solo mediante el <italic>Wayback Machine</italic> del sitio <uri>https://archive.org</uri>.</p>
				
		</sec>
				
		<sec id="S2.2">

				<title>Medici&#x00F3;n de contenidos por idioma</title>
				
				 <p> En materia de medici&#x00F3;n de la lengua de los contenidos a nivel mundial, hay, y ha habido, profusi&#x00F3;n de publicaciones (por lo general, originadas por empresas de mercadotecnia) con cifras diversas cuyo m&#x00E9;todo ha sido raramente revelado, lo que imposibilita validar los resultados. S&#x00F3;lo un estudio puntual realizado en los albores del siglo manten&#x00ED;a un rigor cierto y debidamente documentado, de la sociedad Xerox (Grefenstette y Nioche, <xref ref-type="bibr" rid="CIT08">2001</xref>).</p>
				 
				 <p>M&#x00E1;s recientemente, las “Encuestas de Tecnolog&#x00ED;a W3Techs” (W3Techs, <xref ref-type="bibr" rid="CIT25">2014</xref>), probablemente la fuente de informaci&#x00F3;n m&#x00E1;s fiable y completa sobre los usos de Internet, tiene la ventaja de ofrecer datos sobre la lengua de los contenidos<xref ref-type="fn" rid="NOTE2">2</xref>. W3Techs calcula sus estad&#x00ED;sticas a partir de los elementos suministrados por Alexa (Alexa, <xref ref-type="bibr" rid="CIT01">2014</xref>), una empresa capaz de proporcionar estad&#x00ED;sticas sobre la frecuentaci&#x00F3;n de sitios o p&#x00E1;ginas web a trav&#x00E9;s de una barra de herramientas que los internautas aceptan instalar en su navegador y que reporta a Alexa las etapas de su navegaci&#x00F3;n. Se trata de un muestreo compuesto por un n&#x00FA;mero de usuarios selectos. Alexa presenta as&#x00ED; los 25 millones de sitios m&#x00E1;s visitados sorteados por el n&#x00FA;mero de visitas. A sabiendas de que la web cuenta (en marzo 2015) con casi 877 millones de sitios Internet (Netcraft, <xref ref-type="bibr" rid="CIT12">2015</xref>), de los cuales se considera que casi 177 millones son sitios realmente en funcionamiento, esa muestra solo representa la punta de una pir&#x00E1;mide. De esos 25 millones clasificados por Alexa, W3Techs toma los primeros 10 millones y determina los idiomas identificados en los metadatos o por algoritmo de reconocimiento de la lengua. Lo interesante es notar que W3Techs actualiza diariamente sus datos, lo que permite apreciar la evoluci&#x00F3;n desde la fecha de inicio del servicio, junio de 2013, hasta hoy d&#x00ED;a<xref ref-type="fn" rid="NOTE3">3</xref>.</p>

				<p>Otro elemento de inter&#x00E9;s en el trabajo de W3Techs es su capacidad de cruzar diferentes datos:</p>
				
						<list list-type="bullet">
							<list-item>
								<p><uri>http://w3techs.com/technologies/cross/top_level_domain/content_language</uri> permite cruzar los nombres de dominio y las lenguas de la p&#x00E1;gina (por ejemplo, se sabe que el 30% de los sitios en franc&#x00E9;s pertenecer&#x00ED;an al dominio de nivel superior .fr<xref ref-type="fn" rid="NOTE4">4</xref>, datos que no existen desafortunadamente para ning&#x00FA;n pa&#x00ED;s hispanohablante);</p>
							</list-item>
							
							<list-item>
								<p><uri>http://w3techs.com/technologies/cross/content_language/top_level_domain</uri> realiza el cruce rec&#x00ED;proco (as&#x00ED; el 93% de los sitios de dominio .fr estar&#x00ED;an en franc&#x00E9;s);</p>
							</list-item>
							
							<list-item>
								<p><uri>http://w3techs.com/technologies/cross/content_language/ranking</uri> cruza la clasificaci&#x00F3;n jer&#x00E1;rquica con el par&#x00E1;metro de idioma (as&#x00ED; el 60% de los sitios clasificados en los 1.000 primeros rangos estar&#x00ED;an redactados en ingl&#x00E9;s).</p>
							</list-item>
						</list>
				
				
				<p>Hoy d&#x00ED;a, la estimaci&#x00F3;n de W3Techs sobre el lugar del ingl&#x00E9;s (55,5% de todas las p&#x00E1;ginas Web) es mucho m&#x00E1;s alta que la indicada por el estudio de Funredes / Uni&#x00F3;n Latina en 2007 (44%) y mucho m&#x00E1;s alta que lo que ser&#x00ED;a nuestra proyecci&#x00F3;n actual (en torno al 34%). Y es que hay varias razones para obtener, con ese m&#x00E9;todo, cifras de la lengua inglesa muy por encima de la realidad:</p>
				
				
						<list list-type="order">
							<list-item>
								<p>Funredes / Uni&#x00F3;n Latina (Paolillo, <xref ref-type="bibr" rid="CIT16">2015</xref>) o el <italic>Language Observatory Project</italic> (Suzuki y otros, <xref ref-type="bibr" rid="CIT21">2002</xref>) centraban su investigaci&#x00F3;n en el contenido de <italic>las p&#x00E1;ginas web</italic>, lo que permit&#x00ED;a medir, dentro de cada sitio web, el idioma de cada p&#x00E1;gina y no solo de la principal (<italic>home page</italic>); en cambio W3Techs centra su investigaci&#x00F3;n <italic>en los sitios web</italic>, lo que provoca la toma en cuenta para el sitio entero de la p&#x00E1;gina principal, muchas veces conteniendo ingl&#x00E9;s (lengua de entrada principal de muchos sitios multiling&#x00FC;es), incluso si el resto est&#x00E1; escrito en otros idiomas.</p>
							</list-item>
							
							<list-item>
								<p>Dado que Alexa se instala voluntariamente por el usuario, es un buen instrumento para medir los sitios que visitan los usuarios que lo han instalado, pero es un instrumento muy utilizado en ciertas regiones del planeta, y mucho menos en otras, lo que introduce muchos sesgos en materia de poblaciones estudiadas. </p>
							</list-item>
							
							<list-item>
								<p>Alexa, por su naturaleza, mide el uso y no la existencia; de modo que las p&#x00E1;ginas no visitadas o poco visitadas por sus usuarios no llegan a ser identificadas y, por lo tanto, contabilizadas por W3Techs.</p>
							</list-item>
							
							<list-item>
								<p>Pero la principal raz&#x00F3;n es que W3Techs s&#x00F3;lo considera los 10 millones de sitios web m&#x00E1;s visitados seg&#x00FA;n Alexa, es decir, un poco m&#x00E1;s del 1 % de los sitios existentes o, para ser m&#x00E1;s justos, un poco menos del 6% de los sitios considerados v&#x00E1;lidos. Por lo tanto, los sitios visitados incluir&#x00E1;n necesariamente los medios de comunicaci&#x00F3;n y los sitios comerciales m&#x00E1;s reputados de los diferentes pa&#x00ED;ses, mayoritariamente los pa&#x00ED;ses occidentales, con los Estados Unidos en primer lugar. Es as&#x00ED; como aquellos sitios que presentan un inter&#x00E9;s mundial menor (sitios cient&#x00ED;ficos, culturales, administrativos nacionales, sitios localizados en lenguas menos utilizadas, etc.), no figurar&#x00E1;n en dicha clasificaci&#x00F3;n. Entre los posibles sesgos ling&#x00FC;&#x00ED;sticos de este estudio, cabe se&#x00F1;alar que la Rep&#x00FA;blica Checa tendr&#x00ED;a m&#x00E1;s p&#x00E1;ginas que Corea, o bien que habr&#x00ED;a menos p&#x00E1;ginas en chino, que en alem&#x00E1;n o en ruso, con una poblaci&#x00F3;n en l&#x00ED;nea casi 10 veces m&#x00E1;s grande.</p>
							</list-item>
						</list>

				<p>A pesar de sus limitaciones, W3Techs representa la fuente m&#x00E1;s atractiva entre los indicadores disponibles en la actualidad y se deben aceptar con satisfacci&#x00F3;n los progresos que representa para el campo de estudio.</p>
				
		</sec>
				
		<sec id="S2.3">

				<title>Evoluci&#x00F3;n de los motores de b&#x00FA;squeda desde 2008</title>

				<p>A partir de 2008 se ha reducido el n&#x00FA;mero de motores de b&#x00FA;squeda y aquellos que han quedado (Google, Yahoo, Bing / Live Search, Ask, AOL, Lycos, Excite, Exalead, Teoma<xref ref-type="fn" rid="NOTE5">5</xref>) han evolucionado de la misma manera:</p>
				
				
						<list list-type="bullet">
							<list-item>
								<p>reducci&#x00F3;n significativa del porcentaje de la parte indexada de la Web (m&#x00E1;s del 80% a menos del 5% del espacio total);</p>
							</list-item>
							
							<list-item>
								<p>p&#x00E9;rdida total de credibilidad de las cifras publicadas por el n&#x00FA;mero de apariciones de una palabra clave determinada;</p>
							</list-item>
							
							<list-item>
								<p>implementaci&#x00F3;n de la <italic>“b&#x00FA;squeda inteligente”</italic> por palabra-clave dando lugar a la p&#x00E9;rdida de asociaci&#x00F3;n entre palabras-clave y resultados (ya sea causada por la traducci&#x00F3;n autom&#x00E1;tica, o por algoritmos de sinonimia o de correcci&#x00F3;n ortogr&#x00E1;fica).</p>
							</list-item>
						</list>
				
				<p>A partir de 2008, y de manera gradualmente amplificada, el tama&#x00F1;o de la Web se ha convertido en incontrolable y puede considerarse en t&#x00E9;rminos pr&#x00E1;cticos, como tendente hacia el infinito. Es decir que los motores de b&#x00FA;squeda no pueden, por razones de costo, llevar a cabo un rastreo sistem&#x00E1;tico integral de toda la web, content&#x00E1;ndose con un aproximado 5% de p&#x00E1;ginas indexadas en total<xref ref-type="fn" rid="NOTE6">6</xref>. Si hay un &#x00E1;rea en donde la falta de transparencia es la regla, es en el tama&#x00F1;o de los &#x00ED;ndices. En funci&#x00F3;n del motor de b&#x00FA;squeda, se utilizan varios trucos para ocultar esta limitaci&#x00F3;n de exploraci&#x00F3;n de todas las p&#x00E1;ginas de un sitio web, la cual no se aplica de la misma manera a todos los idiomas en clara desventaja de las lenguas minoritarias, menos susceptibles de atraer publicidad o audiencia.</p>

				<p>Junto con el auge de la Web 2.0 la naturaleza de la Internet ha cambiado y las p&#x00E1;ginas est&#x00E1;ticas (HTML de base) han dejado un mayor espacio para las p&#x00E1;ginas din&#x00E1;micas. En el mismo per&#x00ED;odo, la topolog&#x00ED;a de la Internet en materia de lenguas ha cambiado radicalmente (Prado y otros, <xref ref-type="bibr" rid="CIT19">2010</xref>), con una reducci&#x00F3;n en t&#x00E9;rminos de crecimiento de las lenguas inicialmente bien representadas (lenguas occidentales y japon&#x00E9;s, en particular) y crecimientos exponenciales para los idiomas de Asia y, m&#x00E1;s recientemente, de la lengua &#x00E1;rabe. Al mismo tiempo, la naturaleza del contenido ha evolucionado mediante la reducci&#x00F3;n de la proporci&#x00F3;n de informaci&#x00F3;n textual y un aumento masivo de documentos multimedia, significando, para el video en particular, un 79% por ciento de todo el tr&#x00E1;fico estimado en 2018, cuando representaba un 66% en 2013. Ver <italic>Cisco Visual Networking Index</italic> para las predicciones 2014-2019 (CISCO, <xref ref-type="bibr" rid="CIT03">2014</xref>).</p>

				<p>En tales condiciones, el porcentaje de p&#x00E1;ginas textuales sigue siendo un indicador de cierta importancia pero, frente a una realidad m&#x00E1;s compleja, se deben crear otros indicadores que reflejen mejor dicha complejidad y aceptar que se deben tratar separadamente elementos parciales de un mosaico, en lugar de tratar con un n&#x00FA;mero limitado de indicadores integrales.</p>

				<p>En 2010, la Uni&#x00F3;n Latina, en colaboraci&#x00F3;n con Funredes, llev&#x00F3; a cabo un primer intento de captar la percepci&#x00F3;n de la realidad compleja de las lenguas en diferentes espacios de la Web, y aunque dicha experiencia no dio pie a una publicaci&#x00F3;n espec&#x00ED;fica, permiti&#x00F3; contribuir indirectamente a algunas publicaciones (Pimienta, <xref ref-type="bibr" rid="CIT17">2011</xref>, UIT, <xref ref-type="bibr" rid="CIT22">2010</xref>).</p>

				<p>El trabajo del a&#x00F1;o 2010 explor&#x00F3; la presencia de un gran n&#x00FA;mero de lenguas en las aplicaciones m&#x00E1;s conocidas (redes sociales, blogosfera, peer-to-peer, motores de b&#x00FA;squeda, VOIP<xref ref-type="fn" rid="NOTE7">7</xref>, Wikipedia, Youtube, etc.). A menudo, en ausencia de otras alternativas, los datos se construyeron a partir del origen geogr&#x00E1;fico del tr&#x00E1;fico de dichas aplicaciones, cruzando los datos por pa&#x00ED;s con fuentes demo-ling&#x00FC;&#x00ED;sticas. Estos principios que han contribuido a perfilar un nuevo enfoque metodol&#x00F3;gico se ampliaron y extendieron en este nuevo estudio.</p>
				
		</sec>
		
		</sec>
		
		<sec id="S3">

				<title>3. METODOLOG&#x00CD;A</title>

				<p>La metodolog&#x00ED;a propuesta se basa en dicho enfoque del 2010 y se aplica a un determinado idioma, el espa&#x00F1;ol en este caso, compar&#x00E1;ndolo con los principales idiomas utilizados en la Internet, extendi&#x00E9;ndola al mayor n&#x00FA;mero posible de espacios y de aplicaciones. El enfoque inicial que estaba basado a menudo en el tr&#x00E1;fico por pa&#x00ED;s se complementa con la investigaci&#x00F3;n intensa y sistem&#x00E1;tica sobre el contenido ling&#x00FC;&#x00ED;stico de esas aplicaciones.</p>

				<p>La metodolog&#x00ED;a se basa entonces en un trabajo amplio y abierto de colecta de datos sobre el uso de las lenguas en diferentes aplicaciones y espacios de Internet, a partir de fuentes diversas y m&#x00FA;ltiples, seguido por una recopilaci&#x00F3;n y organizaci&#x00F3;n de esos datos, luego, su evaluaci&#x00F3;n y validaci&#x00F3;n, finalmente el cruce de los datos organizados con diferentes estudios de referencia considerados como fiables, y en &#x00FA;ltima instancia, la puesta en perspectiva de los resultados obtenidos con el fin de comprobar las tendencias y los indicadores compuestos que dan cuenta sobre los nuevos acontecimientos.</p>

				<p>Los elementos metodol&#x00F3;gicos clave de este enfoque son:</p>
				
						<list list-type="bullet">
							<list-item>
								<p>espacios y aplicaciones seleccionados;</p>
							</list-item>
							
							<list-item>
								<p>b&#x00FA;squeda, selecci&#x00F3;n y an&#x00E1;lisis de fuentes de informaci&#x00F3;n ofreciendo datos sobre el lugar del espa&#x00F1;ol en relaci&#x00F3;n con esos espacios y aplicaciones;</p>
							</list-item>
							
							<list-item>
								<p>cruce con datos demo-ling&#x00FC;&#x00ED;sticos que permiten poner en perspectiva los datos recogidos;</p>
							</list-item>
							
							<list-item>
								<p>s&#x00ED;ntesis a partir del conjunto de datos dispersos obtenidos permitiendo informar, de manera significativa, sobre el lugar del espa&#x00F1;ol en la Internet en comparaci&#x00F3;n con otras lenguas.</p>
							</list-item>
						</list>
				
				<p>Se deber&#x00ED;a advertir que: </p>
				
						<list list-type="bullet">
							<list-item>
								<p>Los datos expuestos son extra&#x00ED;dos de fuentes analizadas entre finales del 2013 e inicios del 2014 y no reflejan la situaci&#x00F3;n de hoy ni el espacio abrumador que ha tomado la Internet m&#x00F3;vil y sus aplicaciones propias en el 2015.</p>
							</list-item>
							
							<list-item>
								<p>Como sea, la confianza que se le puede atribuir a las numerosas fuentes procesadas no es homog&#x00E9;nea seg&#x00FA;n las aplicaciones o espacios, y en muchos casos no es muy alta. Se deben entonces tomar los resultados espec&#x00ED;ficos con cierta precauci&#x00F3;n, a&#x00FA;n m&#x00E1;s cuando una de las categor&#x00ED;as comporta muy pocas fuentes.</p>
							</list-item>
						</list>

				<p>Lo que s&#x00ED; consideramos es que el conjunto de todas esas fuentes ofrece globalmente una estimaci&#x00F3;n relativamente confiable sobre lo que es la situaci&#x00F3;n del espa&#x00F1;ol en la Internet.</p>

				<p>Se han identificado un centenar de aplicaciones y espacios de Internet como los m&#x00E1;s apropiados para informar sobre el espacio de las lenguas en la Internet. Treinta de ellos no ofrec&#x00ED;an datos fiables o utilizables de manera uniforme, por lo que han sido excluidos provisoriamente y se integrar&#x00E1;n tan pronto como lo permitan. Igualmente, ciertos espacios utilizados estudiados no presentan datos utilizables para el objetivo de este art&#x00ED;culo por lo que se han descartado, como ha sucedido con los navegadores y los motores de b&#x00FA;squeda.</p>

				<p>La <xref ref-type="table" rid="T1">tabla I</xref> muestra la lista inicial de los espacios y aplicaciones elegidos (incluyendo los que se desecharon), organizada seg&#x00FA;n el tipo de aplicaci&#x00F3;n o el espacio estudiados. </p>
				
				
					<fig id="T1">
						<label>Tabla I</label>
						<caption>
							<title>Espacios y aplicaciones de Internet seleccionados para analizar la presencia de las lenguas en Internet. En cursiva, las fuentes que han sido descartadas en las ponderaciones finales para la lengua espa&#x00F1;ola o que no han sido utilizadas en el presente art&#x00ED;culo</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/T1.jpg"/>
					</fig>
				
		</sec>
				
		<sec id="S4">

				<title>4. LAS FUENTES ANALIZADAS</title>

				<p>Se necesit&#x00F3; un importante esfuerzo para recopilar fuentes sobre la presencia de las lenguas en la Internet en general, y en espa&#x00F1;ol, en particular. Este cap&#x00ED;tulo est&#x00E1; dedicado a las fuentes que alimentaron los resultados presentados.</p>

				<p>La falta de producci&#x00F3;n de datos en materia de cibermetr&#x00ED;a de lenguas ha creado un vac&#x00ED;o en donde la gran mayor&#x00ED;a de las fuentes provienen de empresas de negocios o de mercadeo en l&#x00ED;nea, que filtran informaci&#x00F3;n parcial de forma gratuita (y por lo general sin revelar la metodolog&#x00ED;a) como medio para promover sus servicios de pago. Fuera de las estad&#x00ED;sticas tradicionales y confiables que proporcionan cierta informaci&#x00F3;n &#x00FA;til sobre las lenguas (Organizaci&#x00F3;n de las Naciones Unidas, UNESCO, Uni&#x00F3;n Internacional de Telecomunicaciones, Organizaci&#x00F3;n para la Cooperaci&#x00F3;n y Desarrollo Econ&#x00F3;micos, Uni&#x00F3;n Europea, etc.), no sin dificultades en el momento de discriminar el aspecto ling&#x00FC;&#x00ED;stico en la Internet, algunos consultores o expertos difunden la recopilaci&#x00F3;n de informaci&#x00F3;n sobre un espacio o aplicaci&#x00F3;n determinados, con el fin de promover sus conocimientos. Es el an&#x00E1;lisis del conjunto de esos sitios profesionales, aunque a menudo imperfectos, lo que permite, no sin cierta dificultad, recopilar un n&#x00FA;mero interesante de datos relativamente confiables segmentados por aplicaci&#x00F3;n (Wikipedia, Twitter, Youtube, Facebook, etc.) o por espacio (motores de b&#x00FA;squeda, correo electr&#x00F3;nico, VoIP, etc.).</p>

				<p>Otra limitaci&#x00F3;n a tener en cuenta en este tipo de an&#x00E1;lisis es que el grado de globalizaci&#x00F3;n de los espacios y aplicaciones es cada d&#x00ED;a m&#x00E1;s variable, puesto que hay pa&#x00ED;ses o regiones que adoptan aplicaciones locales espec&#x00ED;ficas en detrimento de las principales aplicaciones con vocaci&#x00F3;n mundial (Baidu en lugar de Google en China y Vkontakte y Odnoklassniki en lugar de Facebook en Rusia, por ejemplo). Es importante tener en cuenta este factor cuando se establecen los datos cuantitativos sobre el uso de las lenguas (o sobre el uso por pa&#x00ED;ses) para cada aplicaci&#x00F3;n o espacio determinado. </p>

				<p>Por ejemplo, concluir que en las redes sociales no profesionales, el franc&#x00E9;s ser&#x00ED;a la cuarta o la primera lengua a partir de sus resultados respectivos en Facebook o Viadeo, debe interpretarse de manera relativa puesto que ninguna de estas aplicaciones tiene una penetraci&#x00F3;n geo-equilibrada o <italic>linguo-equilibrada</italic>. Para obtener un indicador cre&#x00ED;ble sobre el lugar que cada lengua ocupa en una jerarqu&#x00ED;a de uso, cada aplicaci&#x00F3;n debe ser ponderada en funci&#x00F3;n de su distribuci&#x00F3;n en el mundo (peso total y presencia relativa de un pa&#x00ED;s).</p>

				<p>Una visi&#x00F3;n r&#x00E1;pida permite apreciar que las aplicaciones m&#x00E1;s globalizadas son Wikipedia, Twitter y YouTube<xref ref-type="fn" rid="NOTE8">8</xref>; otras son relativamente globalizadas, como Facebook y Google (&#x00E9;sta, con competencias de motores locales en China, Rusia, Kazajst&#x00E1;n, Corea, etc.), o que muestran diferentes h&#x00E1;bitos (en Jap&#x00F3;n, Yahoo! es mucho m&#x00E1;s utilizado que Google, por ejemplo).</p>

				<p>Para la mayor&#x00ED;a de las aplicaciones y espacios estudiados se debe tener cuidado y matizar las conclusiones ling&#x00FC;&#x00ED;sticas de los resultados en funci&#x00F3;n de posibles sesgos en los usos.</p>

				<p>Desde 2010, se han analizado y almacenado varios cientos de fuentes potenciales, y se ha mantenido una observaci&#x00F3;n permanente mediante b&#x00FA;squeda de palabras clave o consultando los enlaces externos de las fuentes ya seleccionadas. Muchas fuentes han sido excluidas por alguna o algunas de las causas siguientes:</p>
				
							<list list-type="bullet">
								<list-item>
									<p>el campo de estudio es demasiado peque&#x00F1;o o parcial</p>
								</list-item>
								
								<list-item>
									<p>los datos parecen ser demasiado parciales</p>
								</list-item>
								
								<list-item>
									<p>las estad&#x00ED;sticas no han sido actualizadas, o bien no hab&#x00ED;a diferencias significativas entre dos fechas de consulta</p>
								</list-item>
								
								<list-item>
									<p>la metodolog&#x00ED;a utilizada no permite comparar los datos</p>
								</list-item>
								
								<list-item>
									<p>la metodolog&#x00ED;a utilizada es poco pertinente, no adecuada o poco cre&#x00ED;ble</p>
								</list-item>
								
								<list-item>
									<p>quedan dudas sobre la fiabilidad de la fuente.</p>
								</list-item>
							</list>

				<p>Finalmente se han seleccionado, clasificado, evaluado y valorado cerca de 200 fuentes diferentes (URL, art&#x00ED;culos, libros u otros) que permitir&#x00ED;an identificar distintos indicadores sobre la presencia de las lenguas en diferentes &#x00E1;reas.</p>
				
		<sec id="S4.1">

				<title>Clasificaci&#x00F3;n de las fuentes</title>

				<p>Cada elemento de este muestreo de fuentes fue notado y clasificado de 5 (promedio) a 10 (excelente) y aqu&#x00E9;llos que obten&#x00ED;an menos puntaje fueron rechazados autom&#x00E1;ticamente. Las notas han sido asignadas en base a varios criterios: relevancia, confianza, alcance, transparencia de m&#x00E9;todo, etc.</p>

				<p>Para cada fuente se registraron los siguientes par&#x00E1;metros:</p>
				
						<list list-type="bullet">
							<list-item>
								<p>El &#x00FA;ltimo a&#x00F1;o de publicaci&#x00F3;n</p>
							</list-item>
							
							<list-item>
								<p>El &#x00E1;mbito (mundial, Am&#x00E9;rica Latina, Espa&#x00F1;a ...)</p>
							</list-item>
							
							<list-item>
								<p>Si la fuente se actualiza con frecuencia o no</p>
							</list-item>
							
							<list-item>
								<p>El tipo de fuente (por ejemplo, meta-informaci&#x00F3;n)</p>
							</list-item>
							
							<list-item>
								<p>El &#x00E1;rea de aplicaci&#x00F3;n de la fuente (por ejemplo, Facebook)</p>
							</list-item>
							
							<list-item>
								<p>Si es espec&#x00ED;fica para el idioma estudiado o no.</p>
							</list-item>
						</list>

				
				<p>Las diferentes fuentes consultadas ser&#x00E1;n divulgadas pr&#x00F3;ximamente en un metasitio con los par&#x00E1;metros correspondientes a fin de mantener un observatorio permanente. Mientras tanto, el grado de r&#x00E1;pida obsolescencia de las fuentes y la din&#x00E1;mica de creaci&#x00F3;n y eliminaci&#x00F3;n de p&#x00E1;ginas de Internet es tal que no es apropiado citarlas, puesto que esta encuesta se termin&#x00F3; de realizar a finales del a&#x00F1;o 2013. Es el caso, por ejemplo, del sitio Socialbakers (Socialbakers, <xref ref-type="bibr" rid="CIT20">2015</xref>), utilizado para medir la utilizaci&#x00F3;n de algunas redes sociales (LinkedIn, Facebook, Twitter, Google+), que ha cambiado la disposici&#x00F3;n de sus p&#x00E1;ginas desde entonces.</p>
				
		</sec>
		
		<sec id="S4.2">

				<title>Datos demogr&#x00E1;ficos y demo-ling&#x00FC;&#x00ED;sticos</title>

				<p>Como bien se sabe, los pa&#x00ED;ses monoling&#x00FC;es son excepci&#x00F3;n, siendo el multiling&#x00FC;ismo la regla, incluso si la adopci&#x00F3;n de una lengua oficial en la mayor&#x00ED;a de los pa&#x00ED;ses pueda crear confusi&#x00F3;n. Ya sea en Espa&#x00F1;a, M&#x00E9;xico, Estados Unidos, China o Camer&#x00FA;n, o incluso en micro-estados como M&#x00F3;naco, Malta o Singapur, el multiling&#x00FC;ismo est&#x00E1; siempre presente.</p>

				<p>La mayor&#x00ED;a de los estudios que han sido consultados proporcionan datos por pa&#x00ED;s o regi&#x00F3;n y tienden a extrapolar los resultados a la lengua oficial de cada pa&#x00ED;s, sin tomar en cuenta las otras lenguas habladas<xref ref-type="fn" rid="NOTE9">9</xref>, lo que es una simplificaci&#x00F3;n que conlleva a errores importantes. Repartir los datos de n&#x00FA;mero de hablantes proporcionalmente a su presencia en el pa&#x00ED;s ser&#x00ED;a otra simplificaci&#x00F3;n, por supuesto, porque la brecha digital no se distribuye uniformemente en la poblaci&#x00F3;n y los inmigrantes a menudo tienen menos acceso a la Internet. Sin embargo es un error m&#x00E1;s aceptable, pues as&#x00ED; se asegura una mejor toma en cuenta de los idiomas de un pa&#x00ED;s, en vez de ocultar totalmente esta diversidad.</p>

				<p>En la mayor&#x00ED;a de los pa&#x00ED;ses del mundo se necesita contar los hablantes de diferentes lenguas si se quiere transformar los datos por pa&#x00ED;s (los cuales son las fuentes primarias en la mayor&#x00ED;a de los casos) en datos por idioma (necesarios para este estudio).</p>

				<p>Para poder comparar una lengua (en este caso el espa&#x00F1;ol) con las otras, es necesario establecer estad&#x00ED;sticas fiables, no necesariamente para todos los idiomas del mundo, pero por lo menos aquellos que son hablados por una amplia mayor&#x00ED;a. Existen estad&#x00ED;sticas confiables para algunas lenguas habladas en territorios bien definidos y que conocen un importante desarrollo (por ejemplo, en Europa), siempre que tengan un estatus oficial o instituciones de tutela<xref ref-type="fn" rid="NOTE10">10</xref> y que la di&#x00E1;spora que a&#x00FA;n lo habla est&#x00E9; bien estudiada (es el caso del espa&#x00F1;ol en los Estados Unidos, en Francia, en Brasil, por ejemplo). Pero esta tarea se complica para los idiomas que no cumplen ninguna de estas condiciones.</p>
		</sec>
				
		<sec id="S4.3">
				<title>Dificultades con lenguas sin organismo de tutela</title>
				
				<p>Podemos, por ejemplo, se&#x00F1;alar el caso de lenguas como el occitano (hablado en Espa&#x00F1;a, Francia e Italia), el piemont&#x00E9;s (hablado en Italia) o el franco-provenzal (hablado en Francia, Italia y Suiza), para los cuales, a pesar de que se hablan en zonas desarrolladas y en territorios bastante bien definidos, la falta de instituci&#x00F3;n de tutela para el conjunto de la lengua<xref ref-type="fn" rid="NOTE11">11</xref> afecta a la calidad de las cifras sobre el n&#x00FA;mero de hablantes.</p>
		</sec>
		
		<sec id="S4.4">

				<title>Dificultades con lenguas habladas en territorios extensos</title>

				<p>Para algunos idiomas hablados en extensos territorios y diversas condiciones socioecon&#x00F3;micas, hay estad&#x00ED;sticas relativamente fiables; este es el caso del franc&#x00E9;s o espa&#x00F1;ol, por ejemplo, no as&#x00ED; para otros idiomas con caracter&#x00ED;sticas similares, tales como el ingl&#x00E9;s, el chino, el portugu&#x00E9;s<xref ref-type="fn" rid="NOTE12">12</xref> o el &#x00E1;rabe para los cuales hay diferencias muy importantes entre las fuentes, en particular en el conteo de los que lo hablan como segundo idioma.</p>
		</sec>
		
		<sec id="S4.5">

				<title>Fuentes demo-ling&#x00FC;&#x00ED;sticas en conflicto</title>

				<p>A las complicaciones ya mencionadas se suman las divergencias en las metodolog&#x00ED;as de conteo de los hablantes en los numerosos estudios demo-ling&#x00FC;&#x00ED;sticos. Poder comparar todos los estudios disponibles sobre el n&#x00FA;mero de hablantes de todas las lenguas en el mundo para crear una tabla comparativa completa es una tarea enorme, por encima de los recursos de este estudio. Por lo tanto, es impensable poner en paralelo los resultados de diferentes estudios sin un an&#x00E1;lisis detallado, porque pondr&#x00ED;a al mismo nivel cifras obtenidas por definiciones no comparables o m&#x00E9;todos no homog&#x00E9;neos.</p>
				
		</sec>
		
		<sec id="S4.6">

				<title>Tipolog&#x00ED;a de lenguas</title>

				<p>Un problema adicional que hay que resolver es la tipolog&#x00ED;a de las lenguas. ¿Debe ser tomado el idioma alem&#x00E1;n como un todo incluyendo los distintos dialectos, a veces muy distantes unos de otros? ¿Debemos considerar el &#x00E1;rabe literario -o s&#x00F3;lo el cl&#x00E1;sico- o todos los &#x00E1;rabes dialectales (&#x00E1;rabe argelino, &#x00E1;rabe levantino, &#x00E1;rabe egipcio, etc.)?</p>

				<p>Algunos especialistas aprobar&#x00E1;n unas, otros aprobar&#x00E1;n otras, pero no est&#x00E1;n calificados los autores de este estudio para tomar decisiones al respecto.</p>
		</sec>
		
		<sec id="S4.7">
				<title>Segunda lengua (L2)</title>
				
				<p>Pero sin duda, el dilema m&#x00E1;s agudo es la forma de tener en cuenta los hablantes “L2” (quienes, sin ser su lengua materna, la utilizan seguido o la dominan en un grado satisfactorio) para las lenguas vehiculares. En este estudio, anotamos L1 para los hablantes de lengua materna y L2 para los hablantes que utilizan con fluidez ese idioma, no materno para ellos.</p>

				<p>Este aspecto es particularmente importante para una serie de lenguas que permiten un mayor acceso a la informaci&#x00F3;n o su utilizaci&#x00F3;n posibilita una mayor difusi&#x00F3;n de ideas, puesto que aquellos que la dominan suficientemente, sin que sea su propia lengua, la utilizar&#x00E1;n en prioridad en ciertos contextos espec&#x00ED;ficos, e Internet no escapa a dicha situaci&#x00F3;n. </p>

				<p>Hay muchas lenguas vehiculares en el mundo, pero son aqu&#x00E9;llas que han tenido un pasado colonial o imperial importante las que han adquirido un lugar relativo de <italic>prestigio</italic> (entendido como la influencia o autoridad que le confiere la comunidad a dicha lengua) y, por lo tanto, interesa medir la poblaci&#x00F3;n que pueda utilizarla en la Internet como lengua de comunicaci&#x00F3;n. Es por dicha raz&#x00F3;n que el ingl&#x00E9;s se posiciona en primer lugar entre las lenguas mundiales (a pesar de tener muchos menos hablantes vern&#x00E1;culos que el mandar&#x00ED;n o el espa&#x00F1;ol) y que el franc&#x00E9;s, el portugu&#x00E9;s, el ruso, el alem&#x00E1;n, el mandar&#x00ED;n o el malayo indonesio son porcentualmente mucho m&#x00E1;s utilizados de lo que el n&#x00FA;mero de hablantes vern&#x00E1;culos dejar&#x00ED;a suponer.</p>

				<p>Ahora bien, el n&#x00FA;mero de hablantes vern&#x00E1;culos es consecuencia del grado de penetraci&#x00F3;n de una lengua en el territorio que fuera dominado. Es sabido que el espa&#x00F1;ol tuvo un grado de penetraci&#x00F3;n mucho mayor en los territorios colonizados que el ingl&#x00E9;s, el franc&#x00E9;s o el portugu&#x00E9;s, por ejemplo. Es as&#x00ED; como habr&#x00ED;a unos 400 millones de hablantes de espa&#x00F1;ol lengua materna en los pa&#x00ED;ses en que la misma es oficial (en los que viven unos 440 millones de habitantes), mientras que el franc&#x00E9;s, por ejemplo, es lengua materna de unos 70 millones de individuos, pero es oficial en pa&#x00ED;ses en los cuales viven unos 800 millones de habitantes, lo que le permite ser lengua primera y segunda (entendida esta &#x00FA;ltima como lengua de uso sostenido) de unos 230 millones de individuos.</p>

				<p>Es as&#x00ED; que para lenguas como el ingl&#x00E9;s, el portugu&#x00E9;s, el ruso o el alem&#x00E1;n (aun muy utilizado como lengua segunda en el Este de Europa), es importante el n&#x00FA;mero de hablantes vehiculares a la hora de medir su uso en la Internet. Es mucho menos pertinente su c&#x00E1;lculo para la lengua espa&#x00F1;ola, puesto que el n&#x00FA;mero de hablantes de lengua segunda (L2) es poco significante (aunque numeroso en cifras) con respecto al n&#x00FA;mero de hablantes de lengua materna (segunda lengua materna en el mundo luego del mandar&#x00ED;n).</p>

				<p>Por esta raz&#x00F3;n, al realizar mediciones que comparen los hablantes de lengua materna exclusivamente, los resultados muestran una neta predominancia del espa&#x00F1;ol con respecto a otras lenguas (como el franc&#x00E9;s, el portugu&#x00E9;s, el alem&#x00E1;n, el ruso, etc.), pero no as&#x00ED; en ciertos segmentos especializados en los cuales otras lenguas pueden ser m&#x00E1;s utilizadas por su car&#x00E1;cter vehicular en grandes regiones (y el reservorio de hablantes de lengua segunda que eso representa) y la lengua espa&#x00F1;ola puede retroceder en uso global. Es importante notar que este aspecto es v&#x00E1;lido para segmentos especializados pero mucho menos para segmentos en los cuales el discurso es informal y familiar, en los cuales el uso de la lengua materna se afianzar&#x00E1;.</p>
				
		</sec>
		
		<sec id="S4.8">

				<title>Opciones demo-ling&#x00FC;&#x00ED;sticas</title>

				<p>Para tomar mejor cuenta de todos estos elementos se ha seleccionado una serie de opciones para el mejor equilibrio entre la homogeneidad y fiabilidad de los datos demo-ling&#x00FC;&#x00ED;sticos.</p>
				
		<sec id="S4.8.1">
				
				<title>1) Ethnologue para contabilizar los hablantes de lengua materna (L1)</title>
				
				<p>Al contabilizar los hablantes de la lengua materna, la elecci&#x00F3;n se hizo de forma natural en Ethnologue (Ethnologue, <xref ref-type="bibr" rid="CIT06">2013</xref>), la &#x00FA;nica fuente que proporciona cifras actualizadas continuamente sobre todas las lenguas del mundo. Esta fuente es a menudo inexacta en sus cifras, frecuentemente incompleta y sus actualizaciones no son homog&#x00E9;neas, sin embargo es la &#x00FA;nica que puede proporcionar datos din&#x00E1;micos de todos los idiomas del mundo mediante la aplicaci&#x00F3;n de una metodolog&#x00ED;a relativamente consistente<xref ref-type="fn" rid="NOTE13">13</xref>. La resoluci&#x00F3;n expuesta y explicada<xref ref-type="fn" rid="NOTE14">14</xref> por los autores del “Bar&#x00F3;metro Calvet” (Calvet, <xref ref-type="bibr" rid="CIT02">2012</xref>) inspir&#x00F3; esa decisi&#x00F3;n.</p>

				<p>Wikipedia (Wikipedia, lista de pa&#x00ED;ses por poblaci&#x00F3;n, 2014) era una opci&#x00F3;n, pero la famosa enciclopedia no ofrece una metodolog&#x00ED;a estable para el recuento de los hablantes (y por una buena raz&#x00F3;n, ya que la naturaleza de la Wikipedia no es proporcionar informaci&#x00F3;n centralizada, cada art&#x00ED;culo es independiente de los otros). Mientras que Wikipedia est&#x00E1; tomando Ethnologue como su fuente principal para la mayor&#x00ED;a de los idiomas inventariados, para otros idiomas toma como fuentes diversos estudios, ofreciendo diferentes metodolog&#x00ED;as y, por tanto, no comparables entre s&#x00ED;. Por otra parte, para algunos idiomas, Wikipedia es cauteloso y da rangos y figuras no precisas<xref ref-type="fn" rid="NOTE15">15</xref>. El caso de Albania, por citar una lengua que podr&#x00ED;a tener datos m&#x00E1;s precisos debido a la antig&#x00FC;edad de los estudios que se han dedicado, es esclarecedor. Ethnologue menciona 15.000 hablantes en Turqu&#x00ED;a, mientras que el art&#x00ED;culo de Wikipedia, en diciembre de 2013, mencionaba cerca de tres millones de hablantes en este pa&#x00ED;s, al mismo tiempo que inclu&#x00ED;a Ethnologue entre las fuentes.</p>

				<p>Los profesionales de la lengua son, a menudo, muy cr&#x00ED;ticos con los datos de Ethnologue<xref ref-type="fn" rid="NOTE16">16</xref> y haberlo elegido para este estudio no acarrea, obviamente, s&#x00F3;lo ventajas; sin embargo, los inconvenientes afectan solo marginalmente este estudio porque se aplican sobre todo en idiomas identificados en estad&#x00ED;sticas para las lenguas que no son objeto de este estudio.</p>
		</sec>
		
		<sec id="S4.8.2">

				<title>2) Wikipedia para los datos demogr&#x00E1;ficos</title>

				<p>Despu&#x00E9;s de estudiar varias fuentes para obtener buenas cifras de datos demogr&#x00E1;ficos de todos los pa&#x00ED;ses del mundo, se utiliz&#x00F3; Wikipedia en franc&#x00E9;s, que parec&#x00ED;a federar (a fines de 2013) las mejores y m&#x00E1;s actualizadas fuentes<xref ref-type="fn" rid="NOTE17">17</xref>. </p>
				
		</sec>
		
		<sec id="S4.8.3">

				<title>3) Situaciones espec&#x00ED;ficas</title>

				<p>Se tomaron ciertas decisiones arbitrarias en determinados casos espec&#x00ED;ficos, por falta de precisiones por parte de las fuentes consultadas, puesto que algunas de ellas tuvieron en cuenta la macrolengua, mientras que otras s&#x00F3;lo una de las lenguas de la familia. A modo de ejemplo, el alem&#x00E1;n, el &#x00E1;rabe, el chino, etc. En este caso la macrolengua se ha tomado como &#x00FA;nica referencia con el fin de permitir la comparaci&#x00F3;n. Por lo tanto, cuando hablamos de chino, ser&#x00E1; todos los idiomas hablados en China, as&#x00ED; como para el &#x00E1;rabe, alem&#x00E1;n, malayo, etc.</p>

				<p>Aunque estas consideraciones tienen un impacto peque&#x00F1;o en los resultados de este estudio, centrado en el espa&#x00F1;ol, se reportan desde un punto de vista cr&#x00ED;tico porque estas decisiones podr&#x00ED;an parecer contradictorias con un proceso normal de tratamiento de variantes ling&#x00FC;&#x00ED;sticas.</p>
		</sec>
		
		</sec>
		
		</sec>
		
		<sec id="S5">
				
				<title>5. M&#x00C9;TODO DE EVALUACI&#x00D3;N GLOBAL</title>
				
				<p>En las p&#x00E1;ginas precedentes se han presentado muchos registros diferentes y, en general, independientes, de la presencia del espa&#x00F1;ol en la Internet en relaci&#x00F3;n con una selecci&#x00F3;n de espacios o aplicaciones. Lo que sigue es un intento de dar un resultado significativo y completo sobre el lugar que ocupar&#x00ED;a el espa&#x00F1;ol en la Internet, a partir de esta amplia colecci&#x00F3;n de datos. En otras palabras, la intenci&#x00F3;n de ese cap&#x00ED;tulo es la de ofrecer una evaluaci&#x00F3;n global de la presencia de la lengua espa&#x00F1;ola en la Internet, tratando de resumir el conjunto de datos en un resultado &#x00FA;nico, a sabiendas de que cada dato, tomado individualmente, s&#x00F3;lo expresa el rango que la lengua espa&#x00F1;ola tiene en el espacio o aplicaci&#x00F3;n estudiado.</p>

				<p>Una aproximaci&#x00F3;n simplista de determinar un coeficiente com&#x00FA;n consistir&#x00ED;a en calcular el <bold>promedio del rango</bold> de la presencia del espa&#x00F1;ol a partir de la suma de datos y tomarlo como la expresi&#x00F3;n resumida y global del rango del espa&#x00F1;ol en la Internet.</p>

				<p>Una aproximaci&#x00F3;n m&#x00E1;s satisfactoria consistir&#x00ED;a en atribuir a cada espacio o aplicaci&#x00F3;n un peso relativo, de acuerdo con su importancia como indicador de la presencia de la lengua en la Internet, y calcular el <bold>promedio ponderado de los rangos</bold>, lo que dar&#x00ED;a m&#x00E1;s sentido a una estimaci&#x00F3;n global. </p>

				<p>Una &#x00FA;ltima posibilidad, m&#x00E1;s satisfactoria a&#x00FA;n, ser&#x00ED;a la de establecer una serie de par&#x00E1;metros de calificaci&#x00F3;n para cada resultado de la serie de datos, en base a elementos de credibilidad, y calcular as&#x00ED; el <bold>promedio ponderado multi-criterio</bold> a partir de una ecuaci&#x00F3;n que tome debidamente en cuenta este conjunto de par&#x00E1;metros.</p>

				<p>Se decidi&#x00F3; entonces mostrar las tres aproximaciones, para poder compararlas entre s&#x00ED;, dando paso a una clasificaci&#x00F3;n global que pudiese integrar todos los resultados y reflejar con mayor precisi&#x00F3;n el lugar estimado del espa&#x00F1;ol en la Internet.</p>

				<p>Las clasificaciones obtenidas se presentan en la tabla de presentaci&#x00F3;n de los resultados (tabla II), ordenadas por aplicaci&#x00F3;n o espacio. La clasificaci&#x00F3;n del espa&#x00F1;ol en la Internet var&#x00ED;a, seg&#x00FA;n la aplicaci&#x00F3;n o espacio estudiado, <bold>entre la posici&#x00F3;n 1 y la 7</bold> con un <bold>promedio simple de 3,12</bold>, lo que, en definitiva, no la aleja mucho de su posici&#x00F3;n de tercera lengua en t&#x00E9;rminos de n&#x00FA;mero de internautas. Esto est&#x00E1; graficado en la columna L1 de la tabla II, la cual expresa el rango medido del espa&#x00F1;ol en relaci&#x00F3;n con cada espacio o aplicaci&#x00F3;n. As&#x00ED;, por ejemplo, 1 indica que el espa&#x00F1;ol es la primera lengua para la aplicaci&#x00F3;n Gigasize o 7 indica que el espa&#x00F1;ol es la s&#x00E9;ptima lengua, en el caso de Amazon.</p>

				<p>Una ponderaci&#x00F3;n simple permitir&#x00ED;a asignar un peso para cada elemento (indicada “<bold>P</bold>” en la tabla de presentaci&#x00F3;n de los resultados), para reflejar la importancia relativa de tal espacio o aplicaci&#x00F3;n como indicador de la presencia de la lengua en la Internet. As&#x00ED;, por ejemplo, se ha asignado una nota de 10 a los estudios espec&#x00ED;ficos que analicen directamente la lengua de los usuarios de Internet o a aqu&#x00E9;llos que mencionen un “porcentaje de p&#x00E1;ginas en espa&#x00F1;ol” y un peso de 3, a aplicaciones como Hi5 o ccSearch, que no cuentan con especificaci&#x00F3;n ling&#x00FC;&#x00ED;stica espec&#x00ED;fica.</p>

				<p>Con los valores propuestos, se puede establecer un <bold>promedio ponderado</bold>, suma de los productos (peso x rango) dividido por la suma de los pesos. En este caso, el <bold>promedio ponderado ser&#x00ED;a de 3,27</bold>.</p>

				<p>Una ponderaci&#x00F3;n relativamente m&#x00E1;s complicada (que llamamos <bold>multi-criterio</bold>) y que aporta una mayor precisi&#x00F3;n sobre la importancia de los par&#x00E1;metros, ser&#x00ED;a la de calcular “<bold>I</bold>” (indicador del lugar de la lengua espa&#x00F1;ola en la Internet) a partir de la ecuaci&#x00F3;n: <bold>I</bold> = A x B x C x D / 100, graficada en la <xref ref-type="table" rid="T2">tabla II</xref>, en donde:</p>

				<p>A = Grado de globalizaci&#x00F3;n del espacio o la aplicaci&#x00F3;n considerado (0 a 10). Par&#x00E1;metro que refleja la relevancia del espacio o aplicaci&#x00F3;n en cualquier lugar del globo. As&#x00ED;, Viadeo, red social especialmente usada en Francia tiene una nota de 2 en este estudio sobre la lengua espa&#x00F1;ola mientras que Facebook que es utilizado a nivel casi mundial (con las excepciones notables de China y Rusia, entre otros), llega a una nota de 8.</p>

				<p>B = Grado de fiabilidad de los valores de este par&#x00E1;metro (0 a 10).</p>

				<p>C = Nivel de confianza de los datos obtenidos para el espa&#x00F1;ol (0 a 10).</p>

				<p>D = Relevancia del par&#x00E1;metro para la lengua espa&#x00F1;ola (de 0 a 10).</p>

				<p>L1 = Clasificaci&#x00F3;n del espa&#x00F1;ol para cada espacio o aplicaci&#x00F3;n estudiada.</p>

				<p>P = Ponderaci&#x00F3;n simple del espacio o aplicaci&#x00F3;n.</p>

				
					<fig id="T2">
						<label>Tabla II</label>
						<caption>
							<title>Posici&#x00F3;n de la lengua espa&#x00F1;ola en Internet. Evaluaci&#x00F3;n general por espacios y aplicaciones</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/T2.jpg"/>
					</fig>
				
				
				<p>En este caso, el promedio resultando de la ecuaci&#x00F3;n ser&#x00ED;a de 3,52. Por tanto, es razonable concluir que, en base a los par&#x00E1;metros establecidos y los resultados reunidos, el lugar relativo del espa&#x00F1;ol respecto a las otras lenguas en la Internet, seg&#x00FA;n todos los criterios incluidos, ser&#x00ED;a <bold>entre la tercera y la cuarta lengua</bold>.</p>

				<p>Si se comparan estos resultados con el lugar que ocupa la lengua espa&#x00F1;ola respecto a otras lenguas en el concierto mundial, se aprecia una situaci&#x00F3;n aparentemente holgada gracias tanto a la importancia demogr&#x00E1;fica como a la relativa buena penetraci&#x00F3;n de Internet en los pa&#x00ED;ses en los cuales se habla. </p>

				<p>Sin embargo, incluso si la lengua espa&#x00F1;ola es la segunda en t&#x00E9;rminos demogr&#x00E1;ficos, y tercera tanto en n&#x00FA;mero de pa&#x00ED;ses en los cuales es oficial como en cuanto lengua de ense&#x00F1;anza, se encuentra a&#x00FA;n rezagada en t&#x00E9;rminos relativos en el mundo virtual y queda trabajo si se desea que haya una coherencia entre uso y contenido. </p>

				<p>Incluso si las instituciones encargadas de su tutela afirman sostenidamente un presunto segundo rol en el concierto de lenguas internacionales, es dif&#x00ED;cil poder afirmarlo en materia de relaciones internacionales o econ&#x00F3;micas, de comunicaci&#x00F3;n cient&#x00ED;fica, de normativa internacional o de patentes industriales, as&#x00ED; como en materia de n&#x00FA;mero de traducciones tanto literarias como especializadas, de industrias culturales o de turismo. Las lenguas francesa, alemana, china, rusa o japonesa ocupan muchas veces una situaci&#x00F3;n superior a la castellana en esos sectores. Lo mismo pasa con la posici&#x00F3;n del espa&#x00F1;ol en la Internet, potencialmente importante como vector de comunicaci&#x00F3;n pero que requiere mas esfuerzos en t&#x00E9;rminos de producci&#x00F3;n de contenidos especialmente en materia de presencia de libros y de p&#x00E1;ginas web como lo muestra la <xref ref-type="table" rid="T3">tabla III</xref>.</p>
				
				
					<fig id="T3">
						<label>Tabla III</label>
						<caption>
							<title>Posici&#x00F3;n de la lengua espa&#x00F1;ola en Internet. Valores por tipo de segmento</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/T3.jpg"/>
					</fig>
					

				<p>El control regular de todos estos resultados permitir&#x00ED;a una observaci&#x00F3;n del lugar del espa&#x00F1;ol por Internet, muy &#x00FA;til para determinar las pol&#x00ED;ticas a seguir por el apoyo y la mejora de su presencia.</p>
		</sec>
		
		<sec id="S6">
				
				<title>6. CONCLUSI&#x00D3;N</title>
				
				<p>Los enfoques metodol&#x00F3;gicos, propuestos en un campo caracterizado por una crisis prolongada, permiten superar parcialmente las lagunas existentes en la informaci&#x00F3;n sobre la presencia de las lenguas en la Internet y dan una contribuci&#x00F3;n original al tema. Hay una probabilidad razonable de que puedan adaptarse, sin muchos cambios, para otros idiomas fuera del franc&#x00E9;s y el espa&#x00F1;ol. </p>

				<p>Los resultados del espa&#x00F1;ol en la Internet son prometedores dada la gran proporci&#x00F3;n de internautas hispanohablantes,<xref ref-type="fn" rid="NOTE18">18</xref> pero la presencia de contenidos en lengua espa&#x00F1;ola parecer&#x00ED;a no estar acorde con el n&#x00FA;mero de utilizadores. Es probable que sean necesarias ciertas acciones voluntaristas (digitalizaci&#x00F3;n de libros, incentivos a la creaci&#x00F3;n de art&#x00ED;culos cient&#x00ED;ficos en espa&#x00F1;ol, incentivos a crear art&#x00ED;culos Wikipedia, alfabetizaci&#x00F3;n digital, e-gobierno o e-administraci&#x00F3;n, etc.) tal como lo han promovido ciertos grupos ling&#x00FC;&#x00ED;sticos (franc&#x00E9;s, lenguas n&#x00F3;rdicas, lenguas minoritarias, etc.) permitiendo una presencia ling&#x00FC;&#x00ED;stica proporcional o superior a la de usuarios.</p>
		
		</sec>
			

	</body>

	<back>
	
		<ack>
			<title>7. AGRADECIMIENTOS / ACKNOWLEDGEMENTS</title>
				
				<p>Esta investigaci&#x00F3;n se realiz&#x00F3; en base a un trabajo espec&#x00ED;fico para la lengua francesa, financiado originalmente por la <italic>Organisation internationale de la Francophonie</italic> (OIF) y consultable en l&#x00ED;nea. &#x00C1;lvaro Blanco colabor&#x00F3; en la etapa inicial de recopilaci&#x00F3;n de fuentes.</p>
				
				<p>This research is a result of a specific work for the French language, originally funded by the Organisation internationale de la Francophonie (OIF) and avialable online. Álvaro Blanco contributed in the initial stage of gathering sources.</p>
			
		</ack>
	
		<sec id="notas">
			<title>8. NOTAS</title>
		
			<fn-group>
		
				<fn id="NOTE1"><label>1</label>
					<p>Lenguas romances (catal&#x00E1;n, espa&#x00F1;ol, franc&#x00E9;s, italiano, portugu&#x00E9;s, rumano) as&#x00ED; como el ingl&#x00E9;s y el alem&#x00E1;n.</p>
				</fn>
				
				<fn id="NOTE2"><label>2</label>
					<p>Ver la r&#x00FA;brica «Usage of content languages for websites».</p>
				</fn>
				
				<fn id="NOTE3"><label>3</label>
					<p>Ver la secuencia del espa&#x00F1;ol en <uri>http://w3techs.com/technologies/details/cl-es-/all/all</uri> o tambi&#x00E9;n la de las lenguas con m&#x00E1;s de 0,1% de presencia en: <uri>http://w3techs.com/technologies/history_overview/content_language</uri></p>
				</fn>
				
				<fn id="NOTE4"><label>4</label>
					<p>En 2007, el trabajo de Funredes / Uni&#x00F3;n Latina calcula un valor de poco m&#x00E1;s de 26% para este indicador, y un valor de poco m&#x00E1;s de 57% para el porcentaje de franc&#x00E9;s en las p&#x00E1;ginas situadas en Francia (incluyendo las del .fr tanto como las de los dominios gen&#x00E9;ricos como .com o .org).</p>
				</fn>
				
				<fn id="NOTE5"><label>5</label>
					<p>Seg&#x00FA;n Netmarketshare Google ser&#x00ED;a, en abril 2015, el motor de b&#x00FA;squedas m&#x00E1;s utilizado con 62% pero con tendencia a la baja desde 2010: <uri>http://marketshare.hitslink.com/search-engine-market-share.aspx?qprid=4&amp;qpcustomd=0&amp;qpcustom=</uri></p>
			
				</fn>
				
				<fn id="NOTE6"><label>6</label>
					<p>En 2008, varias fuentes mencionaban unas 127 mil millones de p&#x00E1;ginas indexadas (en particular el motor de b&#x00FA;squeda CUIL, ahora desaparecido, que afirmaba explorar la Web entera: <uri>http://web.archive.org/web/20100916001435</uri> / <uri>http://www.cuil.com/</uri>) y se puede encontrar f&#x00E1;cilmente varias fuentes que mencionan la cifra de 40 mil millones para las p&#x00E1;ginas indexadas por Google (<uri>http://www.openinnova.es/como-hace-google-para-indexar-las-paginas-web/</uri>), cuando esta cifra es de 2008.</p>
			
				</fn>
				
				<fn id="NOTE7"><label>7</label>
					<p>Voz por Internet</p>
			
				</fn>
				
				<fn id="NOTE8"><label>8</label>
					<p>Aunque Youtube tiene un competidor en segunda posici&#x00F3;n, Dailymotion, con fuerte presencia francesa, puesto que pertenece a capitales franceses.</p>
			
				</fn>
				
				<fn id="NOTE9"><label>9</label>
					<p>Es el caso de InternetWorldStats, por ejemplo, y uno de los escasos contraejemplos es una vez m&#x00E1;s Wikipedia que provee datos ling&#x00FC;&#x00ED;sticos de calidad en <uri>http://meta.wikimedia.org/wiki/List_of_Wikipedias/sortable</uri></p>
			
				</fn>
				
				<fn id="NOTE10"><label>10</label>
					<p>Entendemos por organismos de tutela, toda aquella entidad p&#x00FA;blica, parap&#x00FA;blica o asociativa que tenga por misi&#x00F3;n la de promover la difusi&#x00F3;n, promoci&#x00F3;n y/o desarrollo de la lengua en conjunto, como lo pueden ser diferentes direcciones de pol&#x00ED;ticas ling&#x00FC;&#x00ED;sticas, academias de la lengua, asociaciones locales o regionales de promoci&#x00F3;n cultural, etc.</p>
			
				</fn>
				
				<fn id="NOTE11"><label>11</label>
					<p>Mencionamos la falta de organismo de tutela para el conjunto de la lengua, dado que muchas veces hay entidades que cumplen con dicha funci&#x00F3;n, pero a nivel local y no global. Es el caso del aran&#x00E9;s en Espa&#x00F1;a, variante del occitano, que cuenta con una protecci&#x00F3;n de parte de las autoridades de Catalu&#x00F1;a, pero no existen entidades de tutela para el conjunto de la lengua occitana.</p>
			
				</fn>
				
				<fn id="NOTE12"><label>12</label>
					<p>El instituto Cam&#x00F5;es ofrece desde hace poco cifras con un margen de error aceptable.</p>
			
				</fn>
				
				<fn id="NOTE13"><label>13</label>
					<p>Ethnologue public&#x00F3; una nueva versi&#x00F3;n en l&#x00ED;nea con muchos cambios en los datos estad&#x00ED;sticos despu&#x00E9;s que terminamos ese estudio. Debe quedar claro que los datos demoling&#x00FC;&#x00ED;sticos de Ethnologue tomadas en este estudio son aquellos publicados en mayo 2013.</p>
			
				</fn>
				
				<fn id="NOTE14"><label>14</label>
					<p><uri>http://wikilf.culture.fr/barometre2012/tmpl.php?data=doc/methodologie/index</uri></p>
			
				</fn>
				
				<fn id="NOTE15"><label>15</label>
					<p>Es el caso el ingl&#x00E9;s por el cual indica 309 &lt; L1 &lt; 380 millones.</p>
			
				</fn>
				
				<fn id="NOTE16"><label>16</label>
					<p>Varios problemas tambi&#x00E9;n han sido identificados y registrados durante el curso de este estudio.</p>
			
				</fn>
				
				<fn id="NOTE17"><label>17</label>
					<p><uri>http://fr.wikipedia.org/wiki/Liste_des_pays_par_population</uri></p>
			
				</fn>
				
				<fn id="NOTE18"><label>18</label>
					<p>Seg&#x00FA;n InternetWorldStats, el porcentaje de hispanohablantes conectados ser&#x00ED;a de 50,6% en 2013 a comparar con las cifras de 39% por la poblaci&#x00F3;n mundial, de 58,4% para el ingl&#x00E9;s, 46,7% para el portugu&#x00E9;s y de 20,9% para el franc&#x00E9;s.</p>
			
				</fn>
				
			</fn-group>
		</sec>
	
	
	
		<ref-list>
			<title>REFERENCIAS</title>

			<ref id="CIT01">
			<element-citation publication-type="webpage">
			  <source>Alexa</source>
			  <comment><uri>http://alexa.com</uri> [diciembre 2014]</comment>
			</element-citation>
			</ref>

			<ref id="CIT02"> 
			<element-citation publication-type="webpage">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Calvet</surname>
					  <given-names>L.-J.</given-names>	  
				  </name>
			  </person-group>
			  <year>2012</year>
			  <source>Poids des langues (Barom&#x00E8;tre Calvet)</source>
			  <comment><uri>http://wikilf.culture.fr/barometre2012/</uri> [marzo 2014]</comment>
			</element-citation>
			</ref>

			<ref id="CIT03">
			<element-citation publication-type="webpage">
			  <source>CISCO, Cisco Visual Networking Index</source>
			  <comment><uri>http://www.cisco.com/c/en/us/solutions/service-provider/visual-networking-index-vni/</uri> [diciembre 2014]</comment>
			</element-citation>
			</ref>

			<ref id="CIT04">
			<element-citation publication-type="webpage">
			  <source>Dilinet</source>
			  <comment><uri>http://dilinet.org</uri> [diciembre 2014]</comment>
			</element-citation>
			</ref>

			<ref id="CIT05">
			<element-citation publication-type="webpage">
			  <source>Estudio lenguas y ciberespacio en Uni&#x00F3;n Latina</source>
			  <comment><uri>http://dtil.unilat.org/LI/2007/index_es.htm</uri> [julio 2012]</comment>
			</element-citation>
			</ref>

			<ref id="CIT06">
			<element-citation publication-type="webpage">
			  <source>Ethnologue: Languages of the World</source>
			  <comment><uri>http://www.sil.org/ethnologue</uri> [mayo 2013]</comment>
			</element-citation>
			</ref>

			<ref id="CIT07">
			<element-citation publication-type="webpage">
			  <source>Funredes, Fundaci&#x00F3;n Redes y Desarrollo</source>
			  <comment><uri>http://funredes.org</uri> [diciembre 2014]</comment>
			</element-citation>
			</ref>

			<ref id="CIT08">
			<element-citation publication-type="report">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Grefenstette y Nioche</surname>
					  <given-names>J.</given-names>	  
				  </name>
			  </person-group>
			  <year>2001</year>
			  <source>Estimation of English and non English Language use on the WWW. Technical report from Xerox Corporation Center Europe</source>
			  <comment><uri>http://arxiv.org/ftp/cs/papers/0006/0006032.pdf</uri> [marzo 2014]</comment>
			</element-citation>
			</ref>

			<ref id="CIT09">
			<element-citation publication-type="webpage">
			  <source>InternetWorldStats</source>
			  <comment><uri>http://www.internetworldstats.com/stats7.htm</uri> [diciembre 2013]</comment>
			</element-citation>
			</ref>

			<ref id="CIT10"> 
			<element-citation publication-type="webpage">
			  <source>LOP, Language Observatory Project</source>
			  <comment><uri>http://gii2.nagaokaut.ac.jp/gii/blog/lopdiary.php</uri> [julio 2012]</comment>
			</element-citation>
			</ref>

			<ref id="CIT11">
			<element-citation publication-type="webpage">
			  <source>Maaya, Red Mundial por la diversidad ling&#x00FC;&#x00ED;stica</source>
			  <comment><uri>http://maaya.org</uri> [mayo 2015]</comment>
			</element-citation>
			</ref>

			<ref id="CIT12">
			<element-citation publication-type="webpage">
			  <source>Netcraft</source>
			  <comment><uri>http://news.netcraft.com/archives/category/web-server-survey/</uri> [mayo 2015]</comment>
			</element-citation>
			</ref>

			<ref id="CIT13">
			<element-citation publication-type="webpage">
			  <year>2012</year>
			  <source>Net.Lang : R&#x00E9;ussir le cyberespace multilingue / Towards a multilingual cyberspace</source>
			  <publisher-loc>Paris</publisher-loc>
			  <publisher-name>C&#x0026;F &#x00C9;ditions</publisher-name>			  			  
			  <comment>Consultable igualmente en <uri>http://net-lang.net/</uri> [diciembre 2014]</comment>
			</element-citation>
			</ref>

			<ref id="CIT14">
			<element-citation publication-type="webpage">
			  <source>Observatorio de lenguas y culturas en la Internet en Funredes</source>
			  <comment><uri>http://funredes.org/lc</uri> [julio 2012]</comment>
			</element-citation>
			</ref>

			<ref id="CIT15">
			<element-citation publication-type="book">
			  <collab>OIF (Organisation internationale de la francophonie)</collab>
			  <source>La langue fran&#x00E7;aise dans le monde (2014)</source>
			  <comment><uri>http://www.francophonie.org/Langue-Francaise-2014/</uri> [junio 2016]</comment>
			</element-citation>
			</ref>

			<ref id="CIT16">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Paolillo</surname>
					  <given-names>J.</given-names>	  
				  </name>
				  <name>
					  <surname>Pimienta</surname>
					  <given-names>D.</given-names>	  
				  </name>
				  <name>
					  <surname>Prado</surname>
					  <given-names>D.</given-names>	  
				  </name>
				  <name>
					  <surname>Mikami</surname>
					  <given-names>Y.</given-names>	  
				  </name>
				  <name>
					  <surname>Zaki abu Bakar</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Sonlertlamvanich</surname>
					  <given-names>V.</given-names>	  
				  </name>
				  <name>
					  <surname>Vikas</surname>
					  <given-names>O.</given-names>	  
				  </name>
				  <name>
					  <surname>Pavol</surname>
					  <given-names>Z.</given-names>	  
				  </name>				  				  				  
				  <name>
					  <surname>Zaidi abdul Rozan</surname>
					  <given-names>M.</given-names>	  
				  </name>
				  <name>
					  <surname>Nagy J&#x00E1;nos</surname>
					  <given-names>G.</given-names>	  
				  </name>
				  <name>
					  <surname>Takahashi</surname>
					  <given-names>T.</given-names>	  
				  </name>				  
				  <name>
					  <surname>Fantognan</surname>
					  <given-names>X.</given-names>	  
				  </name>				  				  				  				  
			  </person-group>
			  <year>2005</year>
			  <source>Mesurer la diversit&#x00E9; linguistique dans l’Internet</source>
			  <publisher-loc>Paris</publisher-loc>
			  <publisher-name>UNESCO</publisher-name>
			  <comment>Consultable igualmente en <uri>http://unesdoc.unesco.org/images/0014/001421/142186f.pdf</uri> [diciembre 2014]</comment>		  
			</element-citation>
			</ref>

			<ref id="CIT17">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Pimienta</surname>
					  <given-names>D.</given-names>	  
				  </name>
			  </person-group>
			  <year>2011</year>
			  <chapter-title>Chapter 12, Language and Content</chapter-title>
			  <person-group person-group-type="editor">
				  <name>
					  <surname>Sadowsky</surname>
					  <given-names>Gorge</given-names>	  
				  </name>
			  </person-group>
			  <source>Accelerating Development Using the Web</source>
			  <publisher-name>Word Wide Web Foundation</publisher-name>
			  <fpage>183</fpage>
			  <lpage>197</lpage>
			   <comment><uri>http://g3ict.org/download/p/fileId_928/productId_241</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT18">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Pimienta</surname>
					  <given-names>D.</given-names>	  
				  </name>			  
				  <name>
					  <surname>Prado</surname>
					  <given-names>D.</given-names>	  
				  </name>		  
				  <name>
					  <surname>Blanco</surname>
					  <given-names>A.</given-names>	  
				  </name>				  
			  </person-group>
			  <year>2009</year>
			  <source>Douze ans de mesure de la diversit&#x00E9; linguistique dans l’Internet: bilan et perspectives</source>
			  <publisher-loc>Paris</publisher-loc>
			  <publisher-name>UNESCO</publisher-name>
			  <comment>Consultable igualmente en <uri>http://unesdoc.unesco.org/images/0018/001870/187016f.pdf</uri> [diciembre 2014]</comment>			  
			</element-citation>
			</ref>

			<ref id="CIT19">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">			  
				  <name>
					  <surname>Prado</surname>
					  <given-names>D.</given-names>	  
				  </name>
				  <name>
					  <surname>Pimienta</surname>
					  <given-names>D.</given-names>	  
				  </name>		  
				  <name>
					  <surname>Lemoulinier</surname>
					  <given-names>A.</given-names>	  
				  </name>				  
			  </person-group>
			  <year>2010</year>
			  <source>Diversit&#x00E9; linguistique et cyberespace : &#x00E9;tat de l'art, enjeux et opportunit&#x00E9;s en Cosmopolis</source>
			  <comment><uri>http://agora.qc.ca/cosmopolis.nsf/Articles/no2010_1_Diversite_linguistique_et_cyberespace___etat_de_l?OpenDocument</uri> [diciembre 2014]</comment>			  
			</element-citation>
			</ref>

			<ref id="CIT20">
			<element-citation publication-type="webpage">
			  <source>Socialbakers</source>
			  <comment><uri>http://www.socialbakers.com/statistics/</uri> [diciembre 2015]</comment>
			</element-citation>
			</ref>

			<ref id="CIT21">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Suzuki</surname>
					  <given-names>I.</given-names>	  
				  </name>
				  <name>
					  <surname>Mikami</surname>
					  <given-names>Y.</given-names>	  
				  </name>
				  <name>
					  <surname>Ohsato</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Chubachi</surname>
					  <given-names>Y.</given-names>	  
				  </name>				  				  				  
			  </person-group>
			  <year>2002</year>
			  <article-title>A Language and Character Set Determination Method based on N-gram Statistics</article-title>
			  <source>ACM Trans. on Asian Language Information Processing</source>
			  <volume>1</volume>
			  <issue>3</issue>
			  <fpage>270</fpage>
			  <lpage>279</lpage>
			  <comment><uri>http://dx.doi.org/10.1145/772755.772759</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT22">
			<element-citation publication-type="report">
				<collab>UIT</collab>
			  <year>2010</year>
			  <chapter-title>Monitoring the WSIS Targets. A mid-term review, Target 9 (content)</chapter-title>
			  <source>World Telecommunication/ICT Development Report 2010</source>
			  <publisher-loc>Ginebra</publisher-loc>
			  <publisher-name>UIT</publisher-name>
			  <fpage>175</fpage>
			  <lpage>192</lpage>			  
			  <comment>Consultable igualmente en  <uri>http://www.itu.int/pub/D-IND-WTDR-2010</uri> [diciembre 2014]</comment>
			</element-citation>
			</ref>

			<ref id="CIT23">
			<element-citation publication-type="webpage">
			  <source>Uni&#x00F3;n Latina</source>
			  <comment><uri>http://unilat.org/</uri> (consultado en mayo 2015)</comment>
			</element-citation>
			</ref>
			
			<ref id="CIT24">
			<element-citation publication-type="book">
				  <collab>Union latine</collab>
			  <year>2010</year>
			  <source>Pr&#x00E9;sence, poids et valeur des langues romanes dans la soci&#x00E9;t&#x00E9; de la connaissance, actes de la journ&#x00E9;e d’&#x00E9;tude du 30 avril 2010 (sous la direction de Daniel Prado)</source>
			  <publisher-loc>Paris</publisher-loc>
			  <publisher-name>Uni&#x00F3;n Latina</publisher-name>
			</element-citation>
			</ref>

			<ref id="CIT25">
			<element-citation publication-type="webpage">
			  <source>W3Techs</source>
			  <comment><uri>http://w3techs.com/technologies/overview/content_language/all</uri> [diciembre 2014]</comment>
			</element-citation>
			</ref>

			<ref id="CIT26">
			<element-citation publication-type="webpage">
			  <source>Wikipedia, lenguas del mundo</source>
			  <comment><uri>https://es.wikipedia.org/wiki/Familia_de_lenguas</uri> [diciembre 2014]</comment>
			</element-citation>
			</ref>
			
		</ref-list>
		

	</back>
</article>
