<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE article PUBLIC "-//NLM//DTD Journal Publishing DTD v3.0 20080202//EN" "journalpublishing3.dtd">
<article article-type="research-article" dtd-version="3.0" xml:lang="es" xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink">
	
	<front>
		
		<journal-meta>
			<journal-id journal-id-type="publisher-id">REDC</journal-id>
			<journal-title-group>
				<journal-title>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</journal-title>
				<abbrev-journal-title>Rev. Esp. Doc. Cient.</abbrev-journal-title>
			</journal-title-group>
			<issn pub-type="ppub">0210-0614</issn>
			<issn pub-type="epub">1988-4621</issn>
			<publisher>
				<publisher-name>Consejo Superior de Investigaciones Cient&#x00ED;ficas</publisher-name>
			</publisher>
		</journal-meta>
		
		<article-meta>
			<article-id pub-id-type="publisher-id">redc.2016.2.1262</article-id>
			<article-id pub-id-type="doi">10.3989/redc.2016.2.1262</article-id>
			
			<article-categories>
				<subj-group subj-group-type="heading">
				<subject>ESTUDIOS / RESEARCH STUDIES</subject>
				</subj-group>
			</article-categories>
			
			<title-group>
				<article-title>CALIMACO: desarrollo de un servicio de bibliotecario virtual para la interacci&#x00F3;n multimodal con dispositivos m&#x00F3;viles</article-title>
				<trans-title-group xml:lang="en">
				<trans-title>CALIMACO: Application of multimodal dialog systems and mobile devices to provide enhanced library services</trans-title>
				</trans-title-group>
				<alt-title alt-title-type="running-head">CALIMACO: desarrollo de un servicio de bibliotecario virtual para la interacci&#x00F3;n multimodal con dispositivos m&#x00F3;viles</alt-title>
			</title-group>
			
			<contrib-group>
		
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Griol</surname>
					 <given-names>David</given-names>
					</name>
					<xref ref-type="aff" rid="U1"/>
					<xref ref-type="corresp" rid="cor1"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Patricio</surname>
					 <given-names>Miguel &#x00C1;ngel</given-names>
					</name>
					<xref ref-type="aff" rid="U1"/>
					<xref ref-type="corresp" rid="cor2"/>
				</contrib>
				
				<contrib contrib-type="author" corresp="yes">
					<name>
					 <surname>Molina</surname>
					 <given-names>Jos&#x00E9; Manuel</given-names>
					</name>
					<xref ref-type="aff" rid="U1"/>
					<xref ref-type="corresp" rid="cor3"/>
				</contrib>
		
				<aff id="U1">Grupo de Inteligencia Artificial Aplicada (GIAA), Departamento de Ciencias de la Computaci&#x00F3;n. Universidad Carlos III de Madrid</aff>
				
			</contrib-group>
			
			<author-notes>
				<corresp id="cor1">e-mail: <email xlink:href="david.griol@uc3m.es">david.griol@uc3m.es</email></corresp>
				<corresp id="cor2">e-mail: <email xlink:href="miguelangel.patricio@uc3m.es">miguelangel.patricio@uc3m.es</email></corresp>
				<corresp id="cor3">e-mail: <email xlink:href="josemanuel.molina@uc3m.es">josemanuel.molina@uc3m.es</email></corresp>
			</author-notes>
			
			<pub-date pub-type="epub">
				<day>30</day>
				<month>06</month>
				<year>2016</year>
			</pub-date>
			
			<pub-date pub-type="collection">
			<year>2016</year>
			</pub-date>
			
			<volume>39</volume>
			<issue>2</issue>
		
			<elocation-id>e129</elocation-id>
		
			<history>
			
				<date date-type="received">
					<day>07</day>
					<month>02</month>
					<year>2015</year>
				</date>
				<date date-type="rev-recd1">
					<day>20</day>
					<month>07</month>
					<year>2015</year>
				</date>
				<date date-type="accepted">
					<day>25</day>
					<month>07</month>
					<year>2015</year>
				</date>
			</history>
		 
			<permissions>
				<copyright-statement>&#x00A9; 2016 CSIC</copyright-statement>
				<copyright-year>2016</copyright-year>
				<license license-type="open-access" xlink:href="http://creativecommons.org/licenses/by-nc/3.0/">
					<license-p>Este es un art&#x00ED;culo de acceso abierto distribuido bajo los t&#x00E9;rminos de la licencia Creative Commons Attribution-Non Commercial (by-nc) Spain 3.0.</license-p>
				</license>
			</permissions>
		
			
			<abstract xml:lang="es">
			<title>RESUMEN</title>
			<p>Los dispositivos m&#x00F3;viles inteligentes han fomentado en los &#x00FA;ltimos a&#x00F1;os nuevos escenarios de interacci&#x00F3;n que requieren interfaces persona-m&#x00E1;quina m&#x00E1;s sofisticados. Los principales desarrolladores de sistemas operativos para estos dispositivos proporcionan actualmente APIs (<italic>Application Programming Interfaces</italic>) para que los desarrolladores puedan implementar sus propias aplicaciones, incluyendo diferentes soluciones para el desarrollo de interfaces gr&#x00E1;ficas, el control de sensores y proveer interacci&#x00F3;n oral. A pesar de la utilidad de este tipo de recursos, no se han definido a&#x00FA;n estrategias para desarrollar interfaces multimodales que aprovechen las posibilidades que ofrecen estos dispositivos para identificar y adaptarse a las necesidades de los usuarios. De este modo, las aplicaciones suelen desarrollarse ad-hoc y la interfaz oral posibilita &#x00FA;nicamente la comunicaci&#x00F3;n mediante comandos simples. En este art&#x00ED;culo proponemos la aplicaci&#x00F3;n pr&#x00E1;ctica de agentes conversacionales multimodales sensibles al contexto para proporcionar servicios bibliotecarios avanzados que incorporen din&#x00E1;micamente necesidades espec&#x00ED;ficas del usuario y sus preferencias, as&#x00ED; como las caracter&#x00ED;sticas espec&#x00ED;ficas del entorno en el que se produce interacci&#x00F3;n, con el fin de mejorar y personalizar el servicio que se proporciona mediante un dispositivo m&#x00F3;vil con acceso a Internet. Nuestra propuesta integra funcionalidades de APIs de Android en una arquitectura modular que enfatiza la gesti&#x00F3;n de la interacci&#x00F3;n y la sensibilidad al contexto para crear aplicaciones robustas, de f&#x00E1;cil actualizaci&#x00F3;n y adaptadas al usuario.</p>
			</abstract>
						
			<trans-abstract xml:lang="en">
			<title>ABSTRACT</title>
			<p>In recent years smart mobile devices have bolstered new interaction scenarios that require more sophisticated human-machine interfaces. The leading developers of operating systems for these devices now provide APIs (Application Programming Interface) for developers to implement their own applications, including different solutions for developing graphical interfaces, control sensors and providing oral interaction. Despite the usefulness of these resources, defined strategies are still needed for developing multimodal interfaces to take greater advantage of these devices for identifying and meeting the needs of users. Currently, these applications are typically ad-hoc and facilitate oral communication only through simple commands. In this paper we propose the practical application of context-sensitive multimodal conversational agents to provide advanced library services that dynamically consider specific user needs and preferences, as well as the specific characteristics of the environment in which the interaction occurs. Such agents would improve and customize the service provided by a mobile device with Internet access. Our proposal integrates features of Android APIs on a modular architecture emphasizing the management of interactions and context awareness in order to create robust applications that can be easily updated and adapted to the user.</p>
			</trans-abstract>

			<kwd-group xml:lang="es">
				<title>PALABRAS CLAVE</title> 
				<kwd>Sistemas de Di&#x00E1;logo</kwd>
				<kwd>interacci&#x00F3;n multimodal</kwd>
				<kwd>reconocimiento y s&#x00ED;ntesis de voz</kwd>
				<kwd>asistente</kwd>
				<kwd>servicios bibliotecarios avanzados</kwd>
				<kwd>dispositivos m&#x00F3;viles</kwd>
				<kwd>Android</kwd>
			</kwd-group>

			<kwd-group xml:lang="en"> 
				<title>KEYWORDS</title> 
				<kwd>Dialog systems</kwd>
				<kwd>multimodal interaction</kwd>
				<kwd>automatic speech recognition and synthesis</kwd>
				<kwd>automatic assistants</kwd>
				<kwd>advanced library services</kwd>
				<kwd>mobile devices</kwd>
				<kwd>Android</kwd>
			</kwd-group>
		
		</article-meta>
	</front>
	
	<body>

		<sec id="S1">
			<title>1. INTRODUCCI&#x00D3;N</title>

			<p>El incremento de uso de los dispositivos m&#x00F3;viles, tales como los tel&#x00E9;fonos inteligentes (<italic>smartphones</italic>) y tablet-PCs, ha propiciado que un n&#x00FA;mero continuamente creciente de personas lleven siempre consigo un dispositivo con numerosas modalidades de presentaci&#x00F3;n de la informaci&#x00F3;n, sensores y posibilidades de conectividad. Ello ha generado nuevos escenarios de interacci&#x00F3;n que requieren interfaces persona-m&#x00E1;quina m&#x00E1;s sofisticadas (McTear y Callejas, <xref ref-type="bibr" rid="CIT22">2013</xref>; Becker y otros, <xref ref-type="bibr" rid="CIT02">2013</xref>).</p>

			<p>Los sistemas de di&#x00E1;logo multimodales van un paso m&#x00E1;s all&#x00E1; de las interfaces gr&#x00E1;ficas de usuario tradicionales (GUI), posibilitando la comunicaci&#x00F3;n con estos dispositivos a trav&#x00E9;s de otros modos de interacci&#x00F3;n, como el habla, de forma t&#x00E1;ctil y/o visual (McTear y Callejas, <xref ref-type="bibr" rid="CIT22">2013</xref>; Pieraccini, <xref ref-type="bibr" rid="CIT30">2012</xref>; P&#x00E9;rez-Mar&#x00ED;n y Pascual-Nieto, <xref ref-type="bibr" rid="CIT29">2011</xref>).</p>

			<p>Estos sistemas son programas de ordenador desarrollados para emular las capacidades de comunicaci&#x00F3;n de los seres humanos mediante diferentes modalidades, con la finalidad de proporcionarles informaci&#x00F3;n o servicios automatizados de una forma m&#x00E1;s natural. La interacci&#x00F3;n se lleva a cabo mediante turnos de un tipo de di&#x00E1;logo que los investigadores intentan que se parezca lo m&#x00E1;s posible al di&#x00E1;logo real que se lleva a cabo entre las personas, en lo que se refiere a naturalidad, inteligencia e incluso contenido afectivo.</p>

			<p>Sin embargo, los sistemas de di&#x00E1;logo se dise&#x00F1;an generalmente ad-hoc para su dominio espec&#x00ED;fico de aplicaci&#x00F3;n, utilizando modelos y est&#x00E1;ndares en los que los desarrolladores deben especificar las reglas a seguir que debe seguir el sistema tras cada intervenci&#x00F3;n del usuario (Larson, <xref ref-type="bibr" rid="CIT18">2002</xref>). De este modo, la adaptaci&#x00F3;n del sistema teniendo en cuenta las preferencias espec&#x00ED;ficas de los usuarios o la aplicaci&#x00F3;n del sistema a nuevos dominios de interacci&#x00F3;n es un proceso que requiere un tiempo y esfuerzo considerables (Paek y Pieraccini, <xref ref-type="bibr" rid="CIT27">2008</xref>).</p>

			<p>Adem&#x00E1;s, los dispositivos m&#x00F3;viles han originado un nuevo paradigma que posibilita recopilar informaci&#x00F3;n del usuario de modo no intrusivo. Ello permite construir modelos de usuario m&#x00E1;s complejos que pueden emplearse no s&#x00F3;lo para proporcionar la funcionalidad espec&#x00ED;fica del sistema, sino tambi&#x00E9;n para mejorar su rendimiento. Sin embargo, esta informaci&#x00F3;n no se suele considerar al dise&#x00F1;ar el modelo de di&#x00E1;logo del sistema (Seneff y otros, <xref ref-type="bibr" rid="CIT37">2007</xref>). Por esta raz&#x00F3;n, en la mayor&#x00ED;a de sistemas de di&#x00E1;logo, la respuesta proporcionada por el sistema en cada uno de los casos definidos es la misma para todos los usuarios, de forma que &#x00E9;stos normalmente no tienen ning&#x00FA;n control sobre el contenido o la presentaci&#x00F3;n del servicio prestado.</p>

			<p>Para resolver este problema, es necesario dise&#x00F1;ar cuidadosamente tanto el modelo de usuario como la estrategia de gesti&#x00F3;n del di&#x00E1;logo. La aplicaci&#x00F3;n de metodolog&#x00ED;as estad&#x00ED;sticas para lograr este prop&#x00F3;sito posibilita que ambos modelos puedan entrenarse a partir de di&#x00E1;logos reales, modelando la variabilidad de comportamientos de los usuarios (Griol y otros, <xref ref-type="bibr" rid="CIT14">2014</xref>). Aunque la parametrizaci&#x00F3;n de los modelos estad&#x00ED;sticos depende del conocimiento experto de la tarea, los sistemas de di&#x00E1;logo resultantes tienen un comportamiento m&#x00E1;s robusto, una mayor portabilidad, y son m&#x00E1;s f&#x00E1;ciles de adaptarse a diferentes perfiles de usuario o tareas (Schatzmann y otros, <xref ref-type="bibr" rid="CIT36">2006</xref>).</p>

			<p>En este trabajo, proponemos una arquitectura para el desarrollo de sistemas multimodales adaptados al contexto de la interacci&#x00F3;n y orientados a su funcionamiento en dispositivos m&#x00F3;viles. Nuestra propuesta se basa en la definici&#x00F3;n de una metodolog&#x00ED;a estad&#x00ED;stica para el modelado de usuario que estima la intenci&#x00F3;n del usuario durante el di&#x00E1;logo, modelando &#x00E9;sta el siguiente paso que debe llevar a cabo el usuario tras cada una de las intervenciones del sistema.</p>

			<p>En nuestra propuesta, la informaci&#x00F3;n proporcionada por el modelo de usuario se enriquece al considerar tambi&#x00E9;n informaci&#x00F3;n correspondiente al contexto externo de la interacci&#x00F3;n. Esta informaci&#x00F3;n se adquiere por medio de los sensores integrados en los dispositivos m&#x00F3;viles. Actualmente el 75% de los tel&#x00E9;fonos inteligentes y las tablet-PCs integran el sistema operativo Android (McTear y Callejas, <xref ref-type="bibr" rid="CIT22">2013</xref>). Adem&#x00E1;s, existe una comunidad activa de desarrolladores que utilizan el proyecto Android Open Source y que han desarrollado ya m&#x00E1;s de un mill&#x00F3;n de aplicaciones disponibles actualmente en la Play Store oficial, muchas de ellas totalmente gratuitas. Por estas razones, nuestra propuesta utiliza diferentes funcionalidades integradas actualmente en los dispositivos m&#x00F3;viles Android.</p>

			<p>El contexto interno y externo, respectivamente, en relaci&#x00F3;n con la predicci&#x00F3;n de la intenci&#x00F3;n del usuario por el modelo de usuario y la informaci&#x00F3;n proporcionada por los sensores, permiten adaptar el sistema de forma din&#x00E1;mica teniendo en cuenta estas valiosas fuentes de informaci&#x00F3;n. Para ello, se utiliza un modelo de di&#x00E1;logo estad&#x00ED;stico basado en redes neuronales, que tiene en cuenta la informaci&#x00F3;n contextual y la historia de di&#x00E1;logo hasta el momento actual para decidir la siguiente respuesta del sistema. La codificaci&#x00F3;n de la informaci&#x00F3;n y la definici&#x00F3;n de una estructura de datos que tiene en cuenta la historia del di&#x00E1;logo posibilitan el aprendizaje del modelo de di&#x00E1;logo de los datos de entrenamiento y dominios pr&#x00E1;cticos y manejables.</p>

			<p>El resto del art&#x00ED;culo se estructura de la siguiente forma. La Secci&#x00F3;n 2 describe brevemente la motivaci&#x00F3;n de nuestra propuesta y el estado del arte relacionado con la misma. La Secci&#x00F3;n 3 describe la arquitectura propuesta para desarrollar interfaces multimodales adaptados al contexto para interfaces m&#x00F3;viles. La Secci&#x00F3;n 4 describe la aplicaci&#x00F3;n pr&#x00E1;ctica de nuestra propuesta para el desarrollo de una aplicaci&#x00F3;n multimodal sensible al contexto que proporciona servicios bibliotecarios avanzados que incorporan din&#x00E1;micamente necesidades espec&#x00ED;ficas del usuario y sus preferencias, as&#x00ED; como caracter&#x00ED;sticas propias del entorno en el que est&#x00E1;n interactuando con la aplicaci&#x00F3;n. La Secci&#x00F3;n 5 muestra los resultados de la evaluaci&#x00F3;n de dicho sistema con usuarios reales. Finalmente, la Secci&#x00F3;n 6 presenta las conclusiones del trabajo y las l&#x00ED;neas de trabajo futuro.</p>
		</sec>	

		<sec id="S2">

			<title>2. ESTADO DEL ARTE</title>

			<p>La informaci&#x00F3;n digital permite el almacenamiento, acceso y transmisi&#x00F3;n de millones de recursos de forma sencilla, casi instant&#x00E1;nea y desde pr&#x00E1;cticamente cualquier lugar gracias a los dispositivos m&#x00F3;viles. Las bibliotecas digitales constituyen un ejemplo muy importante de estos recursos, pudi&#x00E9;ndose definir como una extensi&#x00F3;n de las bibliotecas cl&#x00E1;sicas donde la informaci&#x00F3;n sobre las diferentes tem&#x00E1;ticas puede consultarse a trav&#x00E9;s de la web (Balagu&#x00E9; y otros, <xref ref-type="bibr" rid="CIT01">2014</xref>; Ross y Sennyey, <xref ref-type="bibr" rid="CIT34">2008</xref>). La aparici&#x00F3;n de estas bibliotecas ha cambiado la percepci&#x00F3;n tradicional de las mismas (D&#x00ED;az-Valenzuela y otros, <xref ref-type="bibr" rid="CIT09">2013</xref>; Liu, <xref ref-type="bibr" rid="CIT20">2006</xref>).</p>

			<p>En nuestro trabajo estamos especialmente interesados en las Bibliotecas Digitales Universitarias (<italic>University Digital Libraries</italic>, UDL) (Vassilakaki y Garoufallou, <xref ref-type="bibr" rid="CIT43">2013</xref>). Este tipo de bibliotecas almacenan informaci&#x00F3;n sobre libros, art&#x00ED;culos cient&#x00ED;ficos en revistas y congresos, diarios oficiales, y usuarios registrados (Renda y Straccia, <xref ref-type="bibr" rid="CIT33">2005</xref>; Smeaton y Callan, <xref ref-type="bibr" rid="CIT40">2005</xref>; Calhoun, <xref ref-type="bibr" rid="CIT03">2002</xref>). Los avances tecnol&#x00F3;gicos asociados con la denominada Web 2.0 (O’Reilly, <xref ref-type="bibr" rid="CIT25">2005</xref>) han posibilitado la aparici&#x00F3;n de un gran n&#x00FA;mero de nuevos paradigmas y servicios relacionados con las UDL, en los que el usuario es el actor principal y puede crear, modificar y publicar de forma sencilla nuevos contenidos web en colaboraci&#x00F3;n con otros usuarios a trav&#x00E9;s de nuevas aplicaciones y dispositivos como los blogs, wikis, chats, podcasts, gestores RSS (formato para compartir contenido en la web, abreviado del ingl&#x00E9;s: <italic>Really Simple Syndication</italic>), las redes sociales o los nuevos dispositivos m&#x00F3;viles inteligentes (Fagan, <xref ref-type="bibr" rid="CIT12">2014</xref>). Ello ha originado la aparici&#x00F3;n del t&#x00E9;rmino Bibliotecas 2.0 (Library 2.0) (Casey y Savastinuk, <xref ref-type="bibr" rid="CIT05">2007</xref>).</p>

			<p>La aplicaci&#x00F3;n de estas tecnolog&#x00ED;as y uso de estos nuevos dispositivos es uno de los objetivos de nuestro trabajo para extender el concepto de Biblioteca 2.0. Para ello, nos hemos basado en las recomendaciones para el desarrollo de las bibliotecas de la era Web recopiladas por estudios y trabajos tan importantes como (Ordu&#x00F1;a-Malea, <xref ref-type="bibr" rid="CIT26">2013</xref>; Chen y Albee, <xref ref-type="bibr" rid="CIT07">2012</xref>), (Calhoun y Cellentani, <xref ref-type="bibr" rid="CIT04">2009</xref>; Mann, <xref ref-type="bibr" rid="CIT21">2008</xref>) en los que se proponen aspectos como:</p>
			
						<list list-type="bullet">
							<list-item>
								<p>Incrementar la eficiencia en la producci&#x00F3;n de recursos bibliogr&#x00E1;ficos mediante la cooperaci&#x00F3;n entre las bibliotecas a trav&#x00E9;s de la aplicaci&#x00F3;n de las nuevas tecnolog&#x00ED;as, posicionando a las bibliotecas a trav&#x00E9;s del reconocimiento de las posibilidades que ofrece la WWW (World Wide Web).</p>
							</list-item>
							
							<list-item>
								<p>Expandir los servicios y n&#x00FA;mero de usos posibles de las bibliotecas mediante la incorporaci&#x00F3;n de nuevos contenidos y tipos de accesos a los mismos.</p>
							</list-item>
							
							<list-item>
								<p>Adaptar la provisi&#x00F3;n de los contenidos y servicios de acuerdo a los requisitos, preferencias y perfiles de usuario.</p>
							</list-item>
							
							<list-item>
								<p>Incrementar el n&#x00FA;mero de usuarios y el grado de satisfacci&#x00F3;n de los mismos a trav&#x00E9;s de las nuevas tecnolog&#x00ED;as y servicios asociados.</p>
							</list-item>
							
							<list-item>
								<p>Facilitar la supervivencia de las bibliotecas incrementando los beneficios t&#x00E9;cnicos, de personal y financieros para su personal y usuarios.</p>
							</list-item>
						</list>
			
			<p>Un gran n&#x00FA;mero de trabajos han aplicado estas recomendaciones bas&#x00E1;ndose en aspectos tan importantes como el uso de programas y aplicaciones de c&#x00F3;digo y acceso libre para la colaboraci&#x00F3;n y creaci&#x00F3;n de consorcios bibliotecarios con un bajo coste econ&#x00F3;mico (Park y otros, <xref ref-type="bibr" rid="CIT28">2009</xref>; Chen y Albee, <xref ref-type="bibr" rid="CIT07">2012</xref>; Helling, <xref ref-type="bibr" rid="CIT16">2010</xref>; Evergreen, <xref ref-type="bibr" rid="CIT11">2010</xref>); la utilizaci&#x00F3;n de dispositivos RFID (<italic>Radio Frequency IDentification</italic>) para facilitar los servicios de inventariado, catalogaci&#x00F3;n y pr&#x00E9;stamo (Moreno y otros, <xref ref-type="bibr" rid="CIT24">2014</xref>; Dwivedi y otros, <xref ref-type="bibr" rid="CIT10">2013</xref>; Sanz-Santacruz y otros, <xref ref-type="bibr" rid="CIT35">2013</xref>); la utilizaci&#x00F3;n de tecnolog&#x00ED;as de realidad virtual y realidad aumentada, conjuntamente con los nuevos dispositivos m&#x00F3;viles, para el desarrollo de aplicaciones bibliotecarias inmersivas (Shatte y otros, <xref ref-type="bibr" rid="CIT39">2014</xref>; Chen y Tsai, <xref ref-type="bibr" rid="CIT08">2012</xref>; Gonz&#x00E1;lez-Fern&#x00E1;ndez-Villavicencio, <xref ref-type="bibr" rid="CIT13">2014</xref>); o la incorporaci&#x00F3;n de los sistemas de recomendaci&#x00F3;n para proveer servicios bibliotecarios adaptados a los requerimientos y preferencias de los usuarios (Tejeda-Lorente, y otros, <xref ref-type="bibr" rid="CIT41">2014</xref>; Tsuji y otros, <xref ref-type="bibr" rid="CIT42">2014</xref>; Porcel y Herrera-Viedma, <xref ref-type="bibr" rid="CIT31">2010</xref>; Porcel y otros, <xref ref-type="bibr" rid="CIT32">2009</xref>; Renda y Straccia, <xref ref-type="bibr" rid="CIT33">2005</xref>; Serrano-Guerrero y otros, <xref ref-type="bibr" rid="CIT38">2011</xref>).</p>

			<p>En el caso especial de aplicaci&#x00F3;n de nuevas tecnolog&#x00ED;as para el apoyo de los servicios de una biblioteca destaca el trabajo realizado por Casta&#x00F1;o y otros, <xref ref-type="bibr" rid="CIT06">2013</xref>. En el trabajo se utiliza tecnolog&#x00ED;a RFID para la localizaci&#x00F3;n de los libros y la orientaci&#x00F3;n en el edificio de la Biblioteca Municipal de Meco (Madrid). En l&#x00ED;nea con estos sistemas, y tal y como se ha descrito en la introducci&#x00F3;n del art&#x00ED;culo, nuestro trabajo se centra en la aplicaci&#x00F3;n de los sistemas de di&#x00E1;logo multimodal para la consecuci&#x00F3;n de las recomendaciones descritas para proporcionar servicios bibliotecarios avanzados. El diccionario de la Real Academia Espa&#x00F1;ola de la Lengua define el di&#x00E1;logo como la pl&#x00E1;tica entre dos o m&#x00E1;s personas que alternativamente muestran sus ideas o afectos. La acci&#x00F3;n de conversar es el modo m&#x00E1;s natural para resolver un gran n&#x00FA;mero de acciones cotidianas entre los seres humanos: obtener una determinada informaci&#x00F3;n, contratar un servicio, solicitar un pedido, conocer el estado de un determinado proceso, etc.</p>

			<p>Por este motivo, un inter&#x00E9;s hist&#x00F3;rico dentro del campo de las Tecnolog&#x00ED;as del Habla ha sido utilizar estas tecnolog&#x00ED;as en aplicaciones reales, especialmente en aplicaciones que permitan a una persona utilizar su voz para obtener informaci&#x00F3;n mediante la interacci&#x00F3;n directa con una m&#x00E1;quina o para controlar un determinado sistema. El objetivo es disponer de sistemas que faciliten la comunicaci&#x00F3;n persona-m&#x00E1;quina del modo m&#x00E1;s natural posible, es decir, a trav&#x00E9;s de la conversaci&#x00F3;n.</p>

			<p>Construir una aplicaci&#x00F3;n inform&#x00E1;tica que pueda mantener una conversaci&#x00F3;n con una persona de manera natural sigue siendo hoy en d&#x00ED;a un reto, dada la gran cantidad de fuentes de conocimiento que son necesarias y las limitaciones de las tecnolog&#x00ED;as utilizadas para obtener informaci&#x00F3;n del usuario. No obstante, los constantes avances de la investigaci&#x00F3;n en Tecnolog&#x00ED;as del Habla han permitido que sean factibles actualmente sistemas de comunicaci&#x00F3;n persona-m&#x00E1;quina mediante la voz, capaces de interactuar con cierto grado de flexibilidad. A nuestro entender, no existen trabajos previos que hayan aplicado el desarrollo de sistema de di&#x00E1;logo multimodal para la provisi&#x00F3;n de servicios bibliotecarios, posibilitando adem&#x00E1;s que estos servicios sean accesibles de forma personalizada para cada uno de los usuarios y mediante los requisitos y posibilidades que ofrecen actualmente los dispositivos m&#x00F3;viles avanzados.</p>
		</sec>	

		<sec id="S3">

			<title>3. PROPUESTA PARA EL DESARROLLO DE SISTEMAS DE DI&#x00C1;LOGO MULTIMODAL PARA DISPOSITIVOS M&#x00D3;VILES ANDROID</title>

			<p>La <xref ref-type="fig" rid="F1">Figura 1</xref> muestra la arquitectura propuesta para el desarrollo de sistemas de di&#x00E1;logo multimodales adaptados al usuario y orientados a dispositivos m&#x00F3;viles. Un sistema de di&#x00E1;logo hablado integra cinco m&#x00F3;dulos fundamentales: Reconocedor Autom&#x00E1;tico del Habla, M&#x00F3;dulo de Comprensi&#x00F3;n del Habla, Gestor de Di&#x00E1;logo, Generador de Lenguaje Natural y Sintetizador de Texto a Voz.</p>
			
			
					<fig id="F1">
						<label>Figura 1</label>
						<caption>
							<title>Arquitectura propuesta para la generaci&#x00F3;n de sistemas de di&#x00E1;logo multimodales en dispositivos m&#x00F3;viles Android</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F1.jpg"/>
					</fig>
						
						

			<p>Durante el proceso de comunicaci&#x00F3;n, el sistema genera un mensaje inicial, normalmente para dar la bienvenida o informar al usuario sobre las caracter&#x00ED;sticas y funcionalidades del sistema. Tras cada intervenci&#x00F3;n del usuario, el sistema debe realizar un conjunto de acciones b&#x00E1;sicas que se repiten c&#x00ED;clicamente como respuesta a cada acci&#x00F3;n del usuario: reconocer la secuencia de palabras mencionadas por el usuario; extraer el significado de dichas palabras (es decir, comprender qu&#x00E9; informaci&#x00F3;n es &#x00FA;til en el dominio del sistema), realizar operaciones de acceso a base de datos u otros repositorios del sistema, en los que se almacena la informaci&#x00F3;n que solicita el usuario o se registran las operaciones que desea conocer; decidir qu&#x00E9; acci&#x00F3;n o acciones deben realizarse a continuaci&#x00F3;n de cada solicitud del usuario, es decir, qu&#x00E9; respuesta debe suministrar el sistema, reproducir un mensaje hablado que informe al usuario qu&#x00E9; acci&#x00F3;n ha seleccionado el sistema.</p>


		<sec id="S3.1">

			<title>3.1. Reconocimiento Autom&#x00E1;tico del Habla</title>

			<p>El reconocimiento de voz es el proceso de obtenci&#x00F3;n del texto que corresponde a una entrada ac&#x00FA;stica. Nuestra propuesta integra la API (interfaz de programaci&#x00F3;n de aplicaciones, abreviado del ingl&#x00E9;s: <italic>Application Programming Interface</italic>) de voz de Google para incluir la funcionalidad de reconocimiento de voz en un sistema multimodal. La funcionalidad de reconocimiento de voz est&#x00E1; disponible en los dispositivos Android para enviar mensajes, llamar a contactos, mostrar mapas de Google Maps, visitar un sitio web, iniciar una ruta con Google Navigation, completar una b&#x00FA;squeda en Google, escribir una nota, enviar un correo electr&#x00F3;nico, o escuchar m&#x00FA;sica, a por mencionar algunos de sus integraciones actuales.</p>

			<p>Adem&#x00E1;s de las utilidades de reconocimiento del habla que se integran dentro de los sistemas operativos Android, existe la posibilidad de desarrollar aplicaciones Android con entrada y salida oral utilizando la API Google Speech (paquete <italic>android.speech</italic>). Con esta API, el reconocimiento de voz puede llevarse a cabo mediante la definici&#x00F3;n de un <italic>Intent</italic> (descripci&#x00F3;n abstracta que utiliza Android para requerir una operaci&#x00F3;n a realizar), o mediante la creaci&#x00F3;n de una instancia de la clase <italic>SpeechRecognizer</italic>. En ambos casos, los resultados se presentan en forma de una lista con los N-mejores resultados y sus respectivas medidas de confianza.</p>
		</sec>	

		
		<sec id="S3.2">

			<title>3.2. Compresi&#x00F3;n del Habla y Adquisici&#x00F3;n del Contexto Externo</title>

			<p>Una vez que el agente conversacional ha reconocido la elocuci&#x00F3;n del usuario, es necesario comprender lo que ha mencionado. El Procesamiento del Lenguaje Natural conlleva considerar conocimiento morfol&#x00F3;gico, l&#x00E9;xico, sint&#x00E1;ctico, sem&#x00E1;ntico, pragm&#x00E1;tico y de discurso (Wu y otros, <xref ref-type="bibr" rid="CIT44">2010</xref>). En nuestra contribuci&#x00F3;n, modelamos adem&#x00E1;s el contexto de la interacci&#x00F3;n como una fuente de informaci&#x00F3;n adicional muy valiosa que puede considerarse conjuntamente con la representaci&#x00F3;n sem&#x00E1;ntica de la entrada del usuario. </p>

			<p>Proponemos la adquisici&#x00F3;n del contexto externo por medio de los sensores integrados actualmente en dispositivos m&#x00F3;viles Android. La mayor parte de estos dispositivos incorporan sensores que miden el movimiento, la orientaci&#x00F3;n y otras condiciones ambientales. Estos sensores son capaces de proporcionar datos con una alta precisi&#x00F3;n y exactitud, y son &#x00FA;tiles para monitorear el movimiento del dispositivo en tres dimensiones o su localizaci&#x00F3;n, as&#x00ED; como cambios en el entorno cerca del dispositivo.</p>
		</sec>	

		
		<sec id="S3.3">

			<title>3.3. Adquisici&#x00F3;n del contexto interno: modelado de la intenci&#x00F3;n del usuario</title>

			<p>En cuanto al contexto interno, nuestra propuesta se basa en la visi&#x00F3;n tradicional proporcionada por la teor&#x00ED;a de actos de di&#x00E1;logo, que define los actos comunicativos como intenciones u objetivos que deben cumplirse durante el di&#x00E1;logo. Nuestra t&#x00E9;cnica se basa en el aprendizaje autom&#x00E1;tico, a partir de un corpus de di&#x00E1;logos, de un modelo estad&#x00ED;stico para predecir la intenci&#x00F3;n del usuario durante el di&#x00E1;logo. El sistema de di&#x00E1;logo utiliza este modelo para anticiparse a las necesidades del usuario, adaptando din&#x00E1;micamente sus objetivos y proporcion&#x00E1;ndoles sugerencias, as&#x00ED; como respondiendo inmediatamente a sus interrupciones y generando preguntas para clarificar dudas detectadas durante el di&#x00E1;logo. El modelo considera tanto la historia completa del di&#x00E1;logo hasta el instante actual, como tambi&#x00E9;n la informaci&#x00F3;n almacenada en perfiles de usuario.</p>

			<p>El modelo de usuario simula la intenci&#x00F3;n de usuario proporcionando el siguiente acto de di&#x00E1;logo de usuario en el mismo formato definido para el m&#x00F3;dulo de comprensi&#x00F3;n del habla. Definimos una estructura de datos, que denominamos Registro de Usuario (<italic>UR</italic>), para almacenar la informaci&#x00F3;n proporcionada por el usuario durante la historia previa del di&#x00E1;logo. Para cada instante <italic>i</italic>, el modelo de usuario estima la intenci&#x00F3;n del usuario teniendo en cuenta la secuencia de actos de di&#x00E1;logo que precede al instante <italic>i</italic> (<italic>UR<sub>i-1</sub></italic>), la respuesta del sistema en dicho instante (A<sub>i</sub>) y el objetivo del di&#x00E1;logo (). La selecci&#x00F3;n de la respuesta m&#x00E1;s probable del usuario viene dada por la ecuaci&#x00F3;n:</p>
			
			
						<fig id="E1">
							<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/E1.jpg"/>
						</fig>
						
						

			<p>donde <italic>U</italic> hace referencia al conjunto de posibles respuestas definidas para el usuario, en t&#x00E9;rminos de informaci&#x00F3;n sem&#x00E1;ntica que se proporciona al sistema.</p>

			<p>La informaci&#x00F3;n contenida en <italic>UR<sub>i</sub></italic> es un resumen de la informaci&#x00F3;n proporcionada por el usuario hasta el instante <italic>i</italic>, es decir, la interpretaci&#x00F3;n sem&#x00E1;ntica de las elocuciones del usuario durante el di&#x00E1;logo y la informaci&#x00F3;n contenida en un perfil de usuario. Este perfil incluye informaci&#x00F3;n general del usuario, datos relativos a su nivel de habilidad utilizando la aplicaci&#x00F3;n, as&#x00ED; como estad&#x00ED;sticas de uso de la misma.</p>
		</sec>	

		
		<sec id="S3.4">

			<title>3.4. Gesti&#x00F3;n de la Interacci&#x00F3;n</title>

			<p>El gestor de di&#x00E1;logo decide la siguiente acci&#x00F3;n del sistema, interpretando la representaci&#x00F3;n sem&#x00E1;ntica de la entrada del usuario en el contexto del di&#x00E1;logo. La metodolog&#x00ED;a que proponemos para los procesos de fusi&#x00F3;n de datos y de gesti&#x00F3;n de di&#x00E1;logo multimodal considera el conjunto de las fuentes de entrada de informaci&#x00F3;n (interacci&#x00F3;n oral, interacci&#x00F3;n visual, contexto externo, y el modelado de la intenci&#x00F3;n usuario) mediante una t&#x00E9;cnica de aprendizaje autom&#x00E1;tico. De igual modo que en nuestros trabajos previos sobre gesti&#x00F3;n de di&#x00E1;logo estad&#x00ED;stica (Griol y otros, <xref ref-type="bibr" rid="CIT14">2014</xref>), proponemos la definici&#x00F3;n de una estructura de datos similar a la del Registro de Usuario para almacenar los valores de los actos de di&#x00E1;logo proporcionados por medio de las diferentes modalidades de entrada a lo largo de la historia de di&#x00E1;logo, que hemos denominado Registro de la Interacci&#x00F3;n (<italic>IR</italic>).</p>

			<p>La informaci&#x00F3;n contenida en el <italic>IR</italic> se actualiza teniendo en cuenta los valores proporcionados por los m&#x00F3;dulos de entrada del sistema a lo largo de la historia de di&#x00E1;logo. Cada posici&#x00F3;n del <italic>IR</italic> puede completarse normalmente por medio de m&#x00E1;s de una modalidad de entrada. Las medidas de confianza proporcionadas por los m&#x00F3;dulos de procesamiento de cada modalidad de entrada se utilizan en caso de conflicto entre los valores proporcionados para una misma posici&#x00F3;n del registro. La selecci&#x00F3;n de la siguiente respuesta del sistema se lleva a cabo mediante la ecuaci&#x00F3;n:</p>
			
			
						<fig id="E2">
							<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/E2.jpg"/>
						</fig>
						
						

			<p>donde <italic>A</italic> hace referencia al conjunto de respuestas definidas para el sistema, <italic>IR<sub>i</sub></italic> se corresponde con el contenido del Registro de la Interacci&#x00F3;n en el instante actual (<italic>i</italic>) y A<sub>i-1</sub><italic></italic> indica la &#x00FA;ltima respuesta proporcionada por el sistema (instante <italic>i-1</italic>).</p>
		</sec>	

		
		<sec id="S3.5">

			<title>3.5. Generaci&#x00F3;n de la salida del sistema: Fisi&#x00F3;n, Generaci&#x00F3;n de Lenguaje Natural y S&#x00ED;ntesis de Texto a Voz</title>

			<p>El m&#x00F3;dulo de Fisi&#x00F3;n de la Informaci&#x00F3;n recibe como entrada una representaci&#x00F3;n abstracta, independiente de las modalidades, del objetivo seleccionado por el gestor de di&#x00E1;logo. Este m&#x00F3;dulo utiliza estrategias de presentaci&#x00F3;n que descomponen el objetivo marcado por el gestor en tareas de presentaci&#x00F3;n. Tambi&#x00E9;n decide si una descripci&#x00F3;n de objeto debe ser presentado al usuario oralmente o gr&#x00E1;ficamente. El resultado es un script de comandos de presentaci&#x00F3;n que se transmite a los m&#x00F3;dulos de Generaci&#x00F3;n de Lenguaje Natural e Informaci&#x00F3;n Visual.</p>

			<p>El M&#x00F3;dulo de Generaci&#x00F3;n Visual genera la disposici&#x00F3;n visual de la salida del sistema utilizando elementos de dise&#x00F1;o gr&#x00E1;ficos creados din&#x00E1;micamente. La estructura visual del interfaz de usuario (<italic>User Interface</italic>, UI) se define en una aplicaci&#x00F3;n multimodal Android a trav&#x00E9;s de <italic>layouts</italic>. Los layouts pueden definirse declarando elementos UI en XML o creando instancias de layouts en tiempo de ejecuci&#x00F3;n. </p>

			<p>La generaci&#x00F3;n de lenguaje natural es una de las tareas m&#x00E1;s importantes del Procesamiento de Lenguaje Natural, que trata de la producci&#x00F3;n autom&#x00E1;tica de textos en lenguaje natural a partir de una representaci&#x00F3;n interna no-ling&#x00FC;&#x00ED;stica utilizada por el sistema de di&#x00E1;logo (Lemon, <xref ref-type="bibr" rid="CIT19">2011</xref>). La aproximaci&#x00F3;n m&#x00E1;s sencilla consiste en utilizar mensajes predefinidos a modo de plantillas de texto. </p>

			<p>Finalmente, el sintetizador de texto a voz (<italic>text-to-speech synthesizer</italic>, TTS) genera la se&#x00F1;al de voz para transmitir este mensaje al usuario. Proponemos la utilizaci&#x00F3;n de la API Google TTS para incorporar la funcionalidad de s&#x00ED;ntesis de voz en una aplicaci&#x00F3;n Android. El paquete <italic>android.speech.tts</italic> proporciona las clases e interfaces necesarios para integrar esta funcionalidad. Todo dispositivo Android incorpora un motor TTS. Adem&#x00E1;s, Android permite la instalaci&#x00F3;n y personalizaci&#x00F3;n de varios motores.</p>
		</sec>
		</sec>

		<sec id="S4">

			<title>4. CALIMACO: SISTEMA DE DI&#x00C1;LOGO MULTIMODAL PARA LA PROVISI&#x00D3;N DE SERVICIOS BIBLIOTECARIOS ADAPTADOS MEDIANTE DISPOSITIVOS M&#x00D3;VILES</title>

			<p>La aplicaci&#x00F3;n Android desarrollada consiste en un asistente virtual multimodal cuya funci&#x00F3;n es la de proporcionar, a trav&#x00E9;s de un sistema de di&#x00E1;logo multimodal, informaci&#x00F3;n relativa a un servicio de biblioteca digital atendiendo a los gustos y preferencias del usuario. La aplicaci&#x00F3;n recibe el nombre de Calimaco en honor a Calimaco de Cirene, director de la Biblioteca de Alejandr&#x00ED;a hasta el 240 A.C. y creador de los <italic>pinakes</italic> en el 260 A.C. (primeros cat&#x00E1;logos de libros que sirvieron como &#x00ED;ndices de contenidos de la biblioteca).</p>

			<p>Al ser una aplicaci&#x00F3;n multimodal, la aplicaci&#x00F3;n permite al usuario introducir su petici&#x00F3;n mediante el modo t&#x00E1;ctil, mediante la voz o combinando ambos modos. Las siguientes subsecciones describen las tecnolog&#x00ED;as utilizadas para desarrollar la aplicaci&#x00F3;n y principales funcionalidades que ofrece.</p>


		<sec id="S4.1">

			<title>4.1. Tecnolog&#x00ED;as utilizadas</title>

			<p>La aplicaci&#x00F3;n se ha desarrollado de acuerdo a la arquitectura descrita en la <xref ref-type="fig" rid="F1">Figura 1</xref>. En cuanto al reconocimiento autom&#x00E1;tico del habla, tal y como se ha comentado anteriormente, la mayor parte de asistentes de voz existentes utilizan el servicio de voz ofrecido por Google, ya que ofrece altas prestaciones adem&#x00E1;s de tener una f&#x00E1;cil integraci&#x00F3;n en las aplicaciones Android. </p>

			<p>A la hora de elegir el motor de s&#x00ED;ntesis de voz integrado en la aplicaci&#x00F3;n se ha tenido en cuenta la calidad de las voces que ofrece, los idiomas que tiene disponibles para Android, el tama&#x00F1;o de la descarga, la disponibilidad y el precio. Tras el estudio de los motores existentes, se ha decidido emplear el motor de s&#x00ED;ntesis IVONA TTS HQ, ya que ofrece multitud de voces femeninas y masculinas de gran calidad y es actualmente gratuito.</p>

			<p>Los modelos estad&#x00ED;sticos para los m&#x00F3;dulos del reconocimiento de la intenci&#x00F3;n del usuario y de gesti&#x00F3;n de di&#x00E1;logo se aprendieron a partir de un corpus adquirido por medio de una t&#x00E9;cnica de generaci&#x00F3;n autom&#x00E1;tica de di&#x00E1;logo desarrollada previamente (Griol y otros, <xref ref-type="bibr" rid="CIT15">2013</xref>). La aplicaci&#x00F3;n permite adem&#x00E1;s que el usuario registre su nombre de usuario y contrase&#x00F1;a. Adem&#x00E1;s, puede completar un formulario con sus gustos y preferencias. Posteriormente, la aplicaci&#x00F3;n Android (cliente) env&#x00ED;a dicha informaci&#x00F3;n a un servidor web que accede a una base de datos MySQL remota con el objetivo de almacenar los datos de usuario en una tabla de usuarios registrados. </p>

			<p>La aplicaci&#x00F3;n utiliza diferentes bases de datos adicionales a modo de repositorio de la informaci&#x00F3;n, varias de ellas dispuestas en un servidor web externo para posibilitar as&#x00ED; el acceso a la aplicaci&#x00F3;n y la identificaci&#x00F3;n del usuario desde m&#x00E1;s de un terminal m&#x00F3;vil. </p>

			<p>Actualmente, la API de Android no provee ning&#x00FA;n mecanismo que permita acceder directamente a trav&#x00E9;s de Internet a una base de datos MySQL remota y ejecutar una consulta dentro de ella. Para ello, ha sido necesario desarrollar un servicio web espec&#x00ED;fico. Mediante este servicio, la aplicaci&#x00F3;n Android env&#x00ED;a una consulta mediante HTTP a un servidor web que devuelve la informaci&#x00F3;n solicitada en formato JSON (JavaScript Object Notation). </p>

			<p>La aplicaci&#x00F3;n incluye adem&#x00E1;s funcionalidades que requieren la consulta de informaci&#x00F3;n contenida en p&#x00E1;ginas web (por ejemplo, para acceder al cat&#x00E1;logo de libros o consultar la regulaci&#x00F3;n de la biblioteca). Para realizar esta consulta, la aplicaci&#x00F3;n Android se conecta mediante HTTP al servidor web que contiene dicha informaci&#x00F3;n y la extrae del contenido HTML mediante la utilizaci&#x00F3;n de la librer&#x00ED;a de Java JSoup. Finalmente, la aplicaci&#x00F3;n desarrollada utiliza adem&#x00E1;s las API Google Maps, Google Directions y Google Places.</p>
		</sec>	

		
		<sec id="S4.2">

			<title>4.2. Funcionalidades del sistema</title>

			<p>Mediante la arquitectura y tecnolog&#x00ED;as descritas en las secciones anteriores, la aplicaci&#x00F3;n desarrollada proporciona cuatro bloques fundamentales de funcionalidades:</p>
						
						<list list-type="bullet">
							<list-item>
								<p><italic>Registro en la aplicaci&#x00F3;n e Informaci&#x00F3;n general</italic>: Este primer bloque posibilita registrarse en la aplicaci&#x00F3;n (necesario para realizar la adaptaci&#x00F3;n al usuario y recopilar las consultas m&#x00E1;s frecuentes realizadas por cada uno de ellos) y configurar una amplia gama de opciones relacionadas con sus funcionalidades (ver <xref ref-type="fig" rid="F2">Figura 2</xref>). Adem&#x00E1;s, es posible acceder a los recursos de la Web 2.0 utilizados por la Universidad Carlos III de Madrid (p&#x00E1;gina web de la Biblioteca de la UC3M, cuenta Twitter, p&#x00E1;gina de Facebook y repositorio institucional de noticias, agenda semanal y novedades).</p>
							</list-item>
							
							<list-item>
								<p><italic>Acceso al Cat&#x00E1;logo de la Biblioteca</italic>: La aplicaci&#x00F3;n facilita el acceso al cat&#x00E1;logo de la biblioteca almacenado en las bases de datos MySQL correspondientes. Los usuarios pueden proporcionar el t&#x00ED;tulo, autor o materia que desea consultar. Como respuesta, la aplicaci&#x00F3;n proporciona la ficha completa del recurso solicitado, la informaci&#x00F3;n correspondiente a su estado (en pr&#x00E9;stamo, prestado o en lista de espera) e im&#x00E1;genes disponibles en el repositorio web de la biblioteca de la universidad (ver <xref ref-type="fig" rid="F3">Figura 3</xref>).</p>
							</list-item>
							
							<list-item>
								<p><italic>Guiado por la Biblioteca</italic>: La aplicaci&#x00F3;n adem&#x00E1;s gu&#x00ED;a al usuario por la Biblioteca de la Universidad Carlos III de Madrid en el Campus de Legan&#x00E9;s. Para ello, se debe proporcionar la ubicaci&#x00F3;n a la que desea ser guiado (sala concreta o servicio, materia del cat&#x00E1;logo o t&#x00ED;tulo del recurso). La aplicaci&#x00F3;n usa planos, fotograf&#x00ED;as y texto sintetizado que transmiten las indicaciones para localizar la ubicaci&#x00F3;n requerida. La <xref ref-type="fig" rid="F4">Figura 4</xref> muestra diferentes capturas de pantalla de esta funcionalidad de la aplicaci&#x00F3;n.</p>
							</list-item>
							
							<list-item>
								<p><italic>Preguntas frecuentes</italic>: Para el dise&#x00F1;o de la aplicaci&#x00F3;n se consult&#x00F3; las preguntas m&#x00E1;s frecuentes realizadas por los usuarios de las bibliotecas universitarias de la Universidad de Le&#x00F3;n<xref ref-type="fn" rid="NOTE01">1</xref>, Universidad de Alcal&#x00E1;<xref ref-type="fn" rid="NOTE02">2</xref>, Universidad de Granada<xref ref-type="fn" rid="NOTE03">3</xref>, Universidad Carlos III de Madrid<xref ref-type="fn" rid="NOTE04">4</xref>, Universidad de Almer&#x00ED;a<xref ref-type="fn" rid="NOTE05">5</xref>, Universidad de Murcia<xref ref-type="fn" rid="NOTE06">6</xref>, Universidad Aut&#x00F3;noma de Barcelona<xref ref-type="fn" rid="NOTE07">7</xref>, Universidad de C&#x00F3;rdoba<xref ref-type="fn" rid="NOTE08">8</xref> y la Universidad de Alicante<xref ref-type="fn" rid="NOTE09">9</xref>. El conjunto de preguntas se han clasificado en 13 categor&#x00ED;as (General, Carn&#x00E9; Universitario, Servicios e Infraestructuras, Cat&#x00E1;logo, Pr&#x00E9;stamo, B&#x00FA;squeda de Informaci&#x00F3;n y Acceso a los Recursos, Buscador, Revistas electr&#x00F3;nicas, Libros electr&#x00F3;nicos, Repositorio Institucional, Cursos de Formaci&#x00F3;n, Impacto y Citas, Adquisiciones), que engloban un total de m&#x00E1;s de 250 consultas frecuentes distintas efectuadas por los usuarios de dichas bibliotecas.</p>
								
								<p>Para cada una de dichas consultas, se ha redactado una respuesta adaptada a las infraestructuras y regulaciones de la Biblioteca de la Universidad Carlos III de Madrid, almacenadas en una de las bases de datos MySQL de la aplicaci&#x00F3;n. La <xref ref-type="fig" rid="F5">Figura 5</xref> muestra un ejemplo de consulta y la respuesta correspondiente proporcionada por la aplicaci&#x00F3;n. La <xref ref-type="fig" rid="F6">Figura 6</xref> recopila diferentes capturas de pantalla dise&#x00F1;adas para que el usuario pueda acceder de forma multimodal a esta funcionalidad de la aplicaci&#x00F3;n.</p>
							</list-item>
							
							<list-item>
								<p><italic>Contacto con la biblioteca</italic>: Esta funcionalidad proporciona el acceso a un formulario web en el que los usuarios pueden solicitar informaci&#x00F3;n directamente al personal de la universidad sobre consultas que no hayan podido resolver a trav&#x00E9;s del conjunto de funcionalidades descritas anteriormente, adem&#x00E1;s de servir para la transmisi&#x00F3;n de sugerencias, quejas o felicitaciones. La <xref ref-type="fig" rid="F7">Figura 7</xref> muestra tres capturas de pantalla correspondientes a esta funcionalidad de la aplicaci&#x00F3;n.</p>
							</list-item>
							
							<list-item>
								<p><italic>Ayuda y B&#x00FA;squeda R&#x00E1;pida</italic>: Este &#x00FA;ltimo bloque de la aplicaci&#x00F3;n muestra una ayuda detallada sobre las diferentes funcionalidades de la aplicaci&#x00F3;n. Esta informaci&#x00F3;n se proporciona multimodalmente mediante capturas de pantalla de la aplicaci&#x00F3;n, v&#x00ED;deos did&#x00E1;cticos con ejemplos pr&#x00E1;cticos de uso de cada una de las funcionalidades descritas y textos sintetizados a voz. La <xref ref-type="fig" rid="F8">Figura 8</xref> muestra capturas de pantalla de esta funcionalidad de la aplicaci&#x00F3;n.</p>
							</list-item>
						</list>
						
					<fig id="F2">
						<label>Figura 2</label>
						<caption>
							<title>Capturas de pantalla de la funcionalidad de Configuraci&#x00F3;n de la aplicaci&#x00F3;n e Informaci&#x00F3;n general</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F2.jpg"/>
					</fig>
					
					<fig id="F3">
						<label>Figura 3</label>
						<caption>
							<title>Capturas de pantalla de la funcionalidad de Acceso al Cat&#x00E1;logo</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F3.jpg"/>
					</fig>
					
					<fig id="F4">
						<label>Figura 4</label>
						<caption>
							<title>Capturas de pantalla de la funcionalidad de Guiado por la Biblioteca</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F4.jpg"/>
					</fig>
					
					<fig id="F5">
						<label>Figura 5</label>
						<caption>
							<title>Ejemplo de consulta frecuente y respuesta proporcionada por el sistema</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F5.jpg"/>
					</fig>
					
					<fig id="F6">
						<label>Figura 6</label>
						<caption>
							<title>Capturas de pantalla de la funcionalidad de Preguntas Frecuentes</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F6.jpg"/>
					</fig>
					
					<fig id="F7">
						<label>Figura 7</label>
						<caption>
							<title>Capturas de pantalla de la funcionalidad Contacto con la biblioteca</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F7.jpg"/>
					</fig>
					
					<fig id="F8">
						<label>Figura 8</label>
						<caption>
							<title>Capturas de pantalla de la funcionalidad Ayuda y B&#x00FA;squeda R&#x00E1;pida</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/F8.jpg"/>
					</fig>
		</sec>
		</sec>

		
		<sec id="S5">	
		
			<title>5. EVALUACI&#x00D3;N</title>

			<p>La metodolog&#x00ED;a utilizada para evaluar la aplicaci&#x00F3;n multimodal se basa en un conjunto de estudios relativos a la evaluaci&#x00F3;n fiable de sistemas de di&#x00E1;logo multimodales (Metze y otros, <xref ref-type="bibr" rid="CIT23">2009</xref>). Seg&#x00FA;n dichos estudios, todo desarrollo y evaluaci&#x00F3;n de un sistema de di&#x00E1;logo multimodal requiere valorar el rendimiento del sistema en sus distintas modalidades. Para ello, se propone un an&#x00E1;lisis de la usabilidad del sistema a trav&#x00E9;s de cuestionarios de opini&#x00F3;n, cuyas preguntas est&#x00E1;n orientadas a evaluar el sistema multimodal adem&#x00E1;s de la interacci&#x00F3;n mediante el modo t&#x00E1;ctil o mediante la voz. La <xref ref-type="table" rid="T1">Tabla I</xref> muestra el cuestionario que hemos elaborado para evaluar la aplicaci&#x00F3;n en sus diferentes modalidades.</p>
			
			
					<fig id="T1">
						<label>Tabla I</label>
						<caption>
							<title>Cuestionario de evaluaci&#x00F3;n utilizado para la evaluaci&#x00F3;n de la aplicaci&#x00F3;n</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/T1.jpg"/>
					</fig>
						

			<p>El cuestionario consta de 9 preguntas, en las que las preguntas 3-9 se han evaluado para usuarios interactuando con la aplicaci&#x00F3;n mediante el modo t&#x00E1;ctil, el modo oral y el modo multimodal combinando ambas modalidades de entrada y de salida. Cada pregunta tiene 5 posibles respuestas de las que s&#x00F3;lo se puede elegir una de ellas. Tal y como se observa, los aspectos que se han querido analizar para las distintas modalidades del sistema son: el grado en el cual el usuario valora que es entendido por el sistema y entiende los mensajes del mismo, la velocidad percibida de la de interacci&#x00F3;n, el nivel de dificultad del sistema, la presencia de errores, la seguridad de lo que se debe hacer en cada momento, y el nivel de satisfacci&#x00F3;n con el sistema global. Adem&#x00E1;s, la informaci&#x00F3;n adicional de los usuarios sobre su grado de conocimiento y experiencia previa con los interfaces multimodales y los interfaces orales sirve para hacerse una idea del perfil de los usuarios.</p>

			<p>En la evaluaci&#x00F3;n han participado 25 usuarios hispanoparlantes (12 hombres, 13 mujeres) con edad comprendida entre 22 y 54 a&#x00F1;os. En primer lugar, los usuarios evaluaron el sistema utilizando el modo t&#x00E1;ctil. Posteriormente, evaluaron el sistema utilizando los interfaces orales. Finalmente, evaluaron el sistema multimodal combinando la utilizaci&#x00F3;n de los interfaces tradicionales (pantalla y teclado) con los interfaces orales. Los usuarios eligieron libremente las acciones a realizar durante la evaluaci&#x00F3;n de la aplicaci&#x00F3;n por lo que los m&#x00F3;dulos y subm&#x00F3;dulos a los que accedieron fueron variados.</p>

			<p>La <xref ref-type="table" rid="T2">Tabla II</xref> recopila las estad&#x00ED;sticas correspondientes a las distintas preguntas y aspectos evaluados. En cuanto a los resultados obtenidos en las preguntas referidas a la evaluaci&#x00F3;n del nivel de experiencia previa de los usuarios con interfaces orales y multimodales, se concluye que el nivel de conocimiento de los usuarios a los que se les ha realizado la encuesta es variado, siendo mayor el n&#x00FA;mero de usuarios que poseen un conocimiento medio en la utilizaci&#x00F3;n de ambos modos de acceso. Se ha intentado seleccionar tanto a usuarios familiarizados con los interfaces multimodales y orales como a usuarios que no ten&#x00ED;an experiencia previa con el objetivo de extraer conclusiones m&#x00E1;s fiables.</p>
			
			
					<fig id="T2">
						<label>Tabla II</label>
						<caption>
							<title>Resultados de la evaluaci&#x00F3;n</title>
						</caption>
						<graphic xmlns:xlink="http://www.w3.org/1999/xlink" xlink:href="../images/T2.jpg"/>
					</fig>
						

			<p>En cuanto al grado en el cual el usuario valora que es entendido por el sistema, para el modo t&#x00E1;ctil se esperaba obtener estos resultados de antemano. Para el modo oral y el modo multimodal estos resultados han sido posibles gracias a la eficacia del sistema de reconocimiento de voz de Google, que est&#x00E1; en continua evoluci&#x00F3;n y es capaz en la actualidad, de reconocer perfectamente cualquier secuencia de voz que el usuario emita. Adem&#x00E1;s, para mejorar esta caracter&#x00ED;stica en el m&#x00F3;dulo b&#x00FA;squeda de material bibliogr&#x00E1;fico, se ha tenido en cuenta que el t&#x00ED;tulo pueda no estar traducido, por lo que se permite al usuario pronunciar el t&#x00ED;tulo en su idioma original, seleccionando por adelantado dicho idioma.</p>

			<p>Con respecto al grado en el cual el usuario valora que entiende los mensajes generados por el sistema, antes de la evaluaci&#x00F3;n de esta caracter&#x00ED;stica, se esperaba que el modo multimodal obtuviese los mejores resultados de la encuesta ya que permite combinar el modo t&#x00E1;ctil con el oral y por lo tanto aprovechar las ventajas de ambos. Sin embargo, a pesar de que los usuarios hayan valorado en general que entienden muy bien los mensajes generados por el sistema en el modo multimodal, el modo que ha obtenido los mejores resultados ha sido el modo t&#x00E1;ctil, seguido del modo multimodal y finalmente del modo oral, siendo este &#x00FA;ltimo el que ha obtenido los peores resultados.</p>

			<p>En cuanto al modo t&#x00E1;ctil no se esperaba obtener tan buenos resultados, ya que se presupon&#x00ED;a de antemano que los usuarios con problemas de visi&#x00F3;n iban a tener mayores dificultades para leer la informaci&#x00F3;n en la pantalla del dispositivo y que les fuese m&#x00E1;s c&#x00F3;modo por lo tanto utilizar el modo oral o el modo multimodal. Sin embargo, al dise&#x00F1;ar la aplicaci&#x00F3;n se intent&#x00F3; que los resultados se mostrasen de forma clara por pantalla, utilizando un tama&#x00F1;o de fuente grande, por lo que todos los usuarios han entendido a la perfecci&#x00F3;n los mensajes que ha generado el sistema. El modo oral ha obtenido resultados satisfactorios aunque peores que los esperados. Los resultados en el modo oral se han visto afectados negativamente por dos factores:</p>
			
						
						
						
						
						<list list-type="bullet">
							<list-item>
								<p><p>El grado en el cual el usuario valora que entiende los mensajes generados por el sistema depende de la calidad de las voces que el usuario tenga instaladas en el dispositivo. Tal y como se ha visto en el estudio efectuado al principio de este proyecto, el sintetizador de voz IVONA TTS HQ es el que ofrece las voces de mayor calidad. Sin embargo, algunos usuarios no han optado por descargarse sus voces y han mantenido la voz que les viene por defecto en su dispositivo o la que pide instalar Google por defecto si no encuentra ninguna voz en la aplicaci&#x00F3;n.</p></p>
							</list-item>
							
							<list-item>
								<p><p>Cuando el sintetizador est&#x00E1; leyendo un texto en un determinado idioma, no diferencia las cadenas dentro del texto que est&#x00E1;n en otro idioma por lo que las pronuncia en el idioma en el que se estaba efectuando la s&#x00ED;ntesis de texto a voz. Esto se podr&#x00ED;a solucionar ya que el dise&#x00F1;ador puede especificar la pronunciaci&#x00F3;n de determinadas cadenas de texto. Sin embargo, es muy dif&#x00ED;cil tener en cuenta todas las posibles cadenas existentes y el texto podr&#x00ED;a escucharse entrecortado. El m&#x00F3;dulo recomendaci&#x00F3;n de material bibliogr&#x00E1;fico tambi&#x00E9;n se ve afectado por el problema de pronunciaci&#x00F3;n en un idioma incorrecto cuando se encuentran t&#x00ED;tulos no traducidos. No obstante, en el m&#x00F3;dulo b&#x00FA;squeda de material bibliogr&#x00E1;fico, el sintetizador de voz lee la informaci&#x00F3;n del recurso en el idioma especificado por el usuario, evitando este problema.</p></p>
							</list-item>
						</list>
			
			<p>En cuanto a la velocidad percibida de la interacci&#x00F3;n, los usuarios han valorado que la velocidad de la interacci&#x00F3;n en el modo multimodal ha sido muy r&#x00E1;pida, en el modo t&#x00E1;ctil ha sido buena y en el modo oral ha sido adecuada. Cabe destacar que la velocidad en interacci&#x00F3;n oral entre el usuario y la aplicaci&#x00F3;n se ha visto dificultada al no existir un mecanismo en Android para que la s&#x00ED;ntesis de voz se detenga cuando el usuario desee comenzar a hablar. Esto resulta inc&#x00F3;modo para el usuario considerando que este va aprendiendo c&#x00F3;mo funciona la aplicaci&#x00F3;n seg&#x00FA;n va utiliz&#x00E1;ndola, y no le resulta necesario esperar a que termine de hablar la aplicaci&#x00F3;n para emitirle sus peticiones a trav&#x00E9;s del reconocedor de voz. El modo multimodal ha obtenido los mejores resultados para esta caracter&#x00ED;stica ya que el usuario puede seleccionar la modalidad que le resulte m&#x00E1;s c&#x00F3;moda y r&#x00E1;pida de utilizar en todo momento. Adem&#x00E1;s, puede pulsar un bot&#x00F3;n para pausar la s&#x00ED;ntesis y un bot&#x00F3;n para iniciar el reconocimiento de voz, evitando por lo tanto la desventaja principal del modo oral.</p>

			<p>Con respecto al nivel de dificultad del sistema, los usuarios han valorado que la utilizaci&#x00F3;n de la aplicaci&#x00F3;n en modo multimodal ha sido la m&#x00E1;s f&#x00E1;cil de utilizar. Tambi&#x00E9;n han valorado la interacci&#x00F3;n con la aplicaci&#x00F3;n en modo t&#x00E1;ctil como muy f&#x00E1;cil y la interacci&#x00F3;n en modo oral como f&#x00E1;cil. El modo multimodal ha obtenido los mejores resultados para esta caracter&#x00ED;stica ya que el usuario puede seleccionar la modalidad que le resulte m&#x00E1;s c&#x00F3;moda y f&#x00E1;cil de utilizar en todo momento, sin estar restringido a las dificultades que pueda encontrar en un &#x00FA;nico modo y evitar de esta forma quedarse atascado sin saber qu&#x00E9; decisi&#x00F3;n tomar. En el modo multimodal y oral se emiten por voz instrucciones de utilizaci&#x00F3;n de la aplicaci&#x00F3;n lo que facilita la interacci&#x00F3;n con la misma. El modo t&#x00E1;ctil no muestra por pantalla las instrucciones de utilizaci&#x00F3;n por lo que el usuario ha de apoyarse &#x00FA;nicamente en su intuici&#x00F3;n a la hora de decidir qu&#x00E9; decisi&#x00F3;n tomar.</p>

			<p>En cuanto a la presencia de errores, los usuarios no han percibido en general errores en su interacci&#x00F3;n con la aplicaci&#x00F3;n en modo t&#x00E1;ctil. En el modo multimodal y oral han percibido algunos errores pero que no han dificultado en absoluto su interacci&#x00F3;n con la aplicaci&#x00F3;n. A&#x00FA;n as&#x00ED;, el modo oral es el que se ha visto m&#x00E1;s afectado ante la presencia de errores ya que el usuario puede sentirse m&#x00E1;s inseguro a la hora de tomar una decisi&#x00F3;n despu&#x00E9;s de la ocurrencia de un error al no haber aun un mecanismo de retroalimentaci&#x00F3;n lo suficientemente logrado en el modo oral. Por lo general, el usuario valora que es m&#x00E1;s f&#x00E1;cil apoyarse en lo que ve por pantalla cuando ha sucedido alg&#x00FA;n error.</p>

			<p>Con respecto a la seguridad del usuario en lo que debe hacer en cada momento, los usuarios han sentido una mayor seguridad en lo que deb&#x00ED;an hacer en cada momento con la interacci&#x00F3;n en modo multimodal, seguido de la interacci&#x00F3;n en modo oral y finalmente del modo t&#x00E1;ctil. A pesar de ello, ha sido f&#x00E1;cil tomar decisiones en los tres modos de acceso a la aplicaci&#x00F3;n. El motivo principal por el cual el modo multimodal y el modo oral resultan m&#x00E1;s ventajosos en comparativa con el modo t&#x00E1;ctil en cuanto a esta caracter&#x00ED;stica es que, tal y como se ha explicado anteriormente, la aplicaci&#x00F3;n en estos modos emite instrucciones de utilizaci&#x00F3;n de la aplicaci&#x00F3;n y cuenta con m&#x00E1;s mecanismos de ayuda. El modo t&#x00E1;ctil se apoya &#x00FA;nicamente en la intuici&#x00F3;n que tiene el usuario a la hora de decidir qu&#x00E9; acci&#x00F3;n tomar. Aun as&#x00ED;, el usuario se siente m&#x00E1;s c&#x00F3;modo utilizando el modo multimodal que el modo oral ya que si no entiende alguna instrucci&#x00F3;n u ocurre alg&#x00FA;n error puede apoyarse tambi&#x00E9;n en lo que ve por pantalla.</p>

			<p>Finalmente, con respecto al nivel de satisfacci&#x00F3;n con el sistema global, los usuarios de la aplicaci&#x00F3;n encuestados se han sentido muy satisfechos con el modo multimodal y t&#x00E1;ctil, y satisfechos con el modo oral. El modo multimodal ha sido el mejor valorado por los usuarios ya que como se desprende de las conclusiones extra&#x00ED;das del resto de preguntas de la encuesta, el usuario prefiere combinar el modo t&#x00E1;ctil y el modo oral seg&#x00FA;n le resulte m&#x00E1;s eficaz, aprovechando todas las ventajas y evitando todas las desventajas de ambos modos.</p>
		</sec>	

		<sec id="S6">

			<title>6. CONCLUSIONES Y TRABAJO FUTURO</title>

			<p>Los sistemas interactivos multimodales ofrecen al usuario una combinaci&#x00F3;n de modalidades de entrada y salida para interactuar con sus dispositivos, pudiendo aprovechar las ventajas que proporcionan modalidades m&#x00E1;s naturales de acceso a la informaci&#x00F3;n como es el habla. Diferentes proveedores ofrecen APIs para el desarrollo de aplicaciones que utilizan el habla como una posible modalidad de entrada y de salida, pero los desarrolladores tienen que dise&#x00F1;ar soluciones ad-hoc para poner en pr&#x00E1;ctica la gesti&#x00F3;n de la interacci&#x00F3;n. En nuestro trabajo aportamos una arquitectura para desarrollar agentes conversacionales multimodales sensibles al contexto que se pueden integrar f&#x00E1;cilmente en dispositivos m&#x00F3;viles Android. La arquitectura engloba un conjunto de m&#x00F3;dulos que cooperan para proporcionar servicios adaptados y definen un modo de representaci&#x00F3;n para el intercambio de conocimiento entre los diferentes componentes de la arquitectura.</p>

			<p>En nuestra propuesta, la interacci&#x00F3;n se gestiona din&#x00E1;micamente mediante un proceso de clasificaci&#x00F3;n que selecciona la mejor respuesta para el agente, teniendo en cuenta la historia previa de la interacci&#x00F3;n. Hemos adaptado esta metodolog&#x00ED;a para desarrollar un gestor de di&#x00E1;logo sensible al contexto que utiliza una estructura de datos que almacena no s&#x00F3;lo la informaci&#x00F3;n proporcionada por el usuario con respecto a la tarea espec&#x00ED;fica del sistema, sino adem&#x00E1;s la informaci&#x00F3;n proporcionada por un reconocedor de la intenci&#x00F3;n del usuario y el contexto externo proporcionado por los sensores en el dispositivo m&#x00F3;vil. Para almacenar la informaci&#x00F3;n de contexto y la intenci&#x00F3;n hemos definido una estructura de datos que tambi&#x00E9;n permite gestionar perfiles de usuario. Estos perfiles incluyen informaci&#x00F3;n acerca de sus preferencias y necesidades, algunas de ellas extra&#x00ED;das autom&#x00E1;ticamente de las interacciones previas con la aplicaci&#x00F3;n. Mediante la arquitectura propuesta es posible desarrollar interfaces multimodales que optimizan la gesti&#x00F3;n de la interacci&#x00F3;n e integran diferentes fuentes de informaci&#x00F3;n que posibilitan que la aplicaci&#x00F3;n se adapte al usuario y al contexto de la interacci&#x00F3;n. </p>

			<p>Para mostrar el potencial de nuestra propuesta, hemos implementado una aplicaci&#x00F3;n multimodal Android que proporciona servicios bibliotecarios avanzados, que incorporan din&#x00E1;micamente necesidades espec&#x00ED;ficas del usuario y sus preferencias, as&#x00ED; como las caracter&#x00ED;sticas espec&#x00ED;ficas del entorno en el que se produce interacci&#x00F3;n, con el fin de mejorar y personalizar el servicio que se proporciona mediante un dispositivo m&#x00F3;vil con acceso a Internet. Para desarrollar este sistema, hemos definido los requisitos completos para la tarea y desarrollado los diferentes m&#x00F3;dulos, y la informaci&#x00F3;n necesaria incorporada en los perfiles de usuario.</p>

			<p>Hemos completado una evaluaci&#x00F3;n del agente desarrollado para evaluar los beneficios de la interacci&#x00F3;n multimodal y la sensibilidad al contexto. En cuanto a la interacci&#x00F3;n multimodal, los usuarios han evaluado la aplicaci&#x00F3;n utilizando &#x00FA;nicamente el interfaz t&#x00E1;ctil-visual, s&#x00F3;lo la voz y el modo multimodal. Los resultados muestran que las tasas m&#x00E1;ximas de satisfacci&#x00F3;n se alcanzan con el modo multimodal.</p>

			<p>Como trabajo futuro, estamos ampliando actualmente las funcionalidades de adaptaci&#x00F3;n de la aplicaci&#x00F3;n al usuario, utilizando un registro para almacenar las interacciones previas con la misma y utilizando esta informaci&#x00F3;n para adaptar el funcionamiento de la aplicaci&#x00F3;n seg&#x00FA;n las preferencias espec&#x00ED;ficas de cada usuario, errores detectados en la interacci&#x00F3;n y consultas m&#x00E1;s frecuentes. Con los resultados de estas actividades, optimizaremos el sistema para posibilitar su disponibilidad en Google Play, as&#x00ED; como en el repositorio de herramientas multimedia de nuestra universidad. Queremos adem&#x00E1;s ampliar la aplicaci&#x00F3;n para posibilitar su uso en dispositivos m&#x00F3;viles con otros sistemas operativos, especialmente iOS y Windows Phone.</p>
		</sec>	

	</body>

	
	<back>
	
		<ack>
			<title>7. AGRADECIMIENTOS</title>

			<p>Trabajo parcialmente financiado por los proyectos MINECO TEC2012-37832-C02-01, CICYT TEC2011-28626-C02-02, CAM CONTEXTS (S2009/TIC-1485).</p>
			
			<p>ACKNOWLEDGEMENTS</p>

			<p>Work partially funded by Projects MINECO TEC2012-37832-C02-01, CICYT TEC2011-28626-C02-02, CAM CONTEXTS (S2009/TIC-1485).</p>
			
		</ack>
	
		<sec id="notas">
			<title>6. NOTAS</title>
		
			<fn-group>
		
				<fn id="NOTE01"><label>1</label>
					<p><uri>http://biblioteca.unileon.es/</uri></p>
				</fn>
				
				<fn id="NOTE02"><label>2</label>
					<p><uri>http://www.uah.es/biblioteca/</uri></p>
				</fn>
				
				<fn id="NOTE03"><label>3</label>
					<p><uri>http://biblioteca.ugr.es/</uri></p>
				</fn>
				
				<fn id="NOTE04"><label>4</label>
					<p><uri>http://biblioteca.uc3m.es/</uri></p>
				</fn>
				
				<fn id="NOTE05"><label>5</label>
					<p><uri>http://www.ual.es/biblioteca</uri></p>
				</fn>
				
				<fn id="NOTE06"><label>6</label>
					<p><uri>http://www.um.es/web/biblioteca/contenido/informacion/preguntas-mas-frecuentes</uri></p>
				</fn>
				
				<fn id="NOTE07"><label>7</label>
					<p><uri>http://www.uab.cat/web/recursos-de-informacion/preguntas-mas-frecuentes-y-guias-1260947893092.html</uri></p>
				</fn>
				
				<fn id="NOTE08"><label>8</label>
					<p><uri>http://www.uco.es/servicios/biblioteca/buco/faq.index.html</uri></p>
				</fn>
				
				<fn id="NOTE09"><label>9</label>
					<p><uri>http://biblioteca.ua.es/es/faqs/preguntas-mas-frecuentes.html</uri></p>
				</fn>
				
			</fn-group>
		</sec>

	
		<ref-list>
			<title>REFERENCIAS</title>
			
			<ref id="CIT01">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Balagu&#x00E9;</surname>
					  <given-names>N.</given-names>	  
				  </name>
				  <name>
					  <surname>D&#x00FC;ren</surname>
					  <given-names>P.</given-names>	  
				  </name>
				  <name>
					  <surname>Juntunen</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Saarti</surname>
					  <given-names>J.</given-names>	  
				  </name>				  				  				  
			  </person-group>
			  <year>2014</year>
			  <article-title>Quality Audits as a Tool for Quality Improvement in Selected European Higher Education Libraries</article-title>
			  <source>The Journal of Academic Librarianship</source>
			  <volume>40</volume>
			  <issue>5</issue>
			  <fpage>529</fpage>
			  <lpage>533</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.acalib.2014.01.002</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT02"> 
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
			  	  <name>
					  <surname>Becker</surname>
					  <given-names>R.</given-names>	  
				  </name>
				  <name>
					  <surname>C&#x00E1;ceres</surname>
					  <given-names>R.</given-names>	  
				  </name>
				  <name>
					  <surname>Hanson</surname>
					  <given-names>K.</given-names>	  
				  </name>
				  <name>
					  <surname>Isaacman</surname>
					  <given-names>S.</given-names>	  
				  </name>
				  <name>
					  <surname>Loh</surname>
					  <given-names>J.</given-names>	  
				  </name>
				  <name>
					  <surname>Martonosi</surname>
					  <given-names>M.</given-names>	  
				  </name>
				  <name>
					  <surname>Rowland</surname>
					  <given-names>J.</given-names>	  
				  </name>
				  <name>
					  <surname>Urbanek</surname>
					  <given-names>S.</given-names>	  
				  </name>
				  <name>
					  <surname>Varshavsky</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Volinsky</surname>
					  <given-names>C.</given-names>	  
				  </name>
			  </person-group>
			  <year>2013</year>
			  <article-title>Human mobility characterization from cellular network data</article-title>
			  <source>Communications of the ACM</source>
			  <volume>56</volume>
			  <issue>1</issue>
			  <fpage>74</fpage>
			  <lpage>82</lpage>
			  <comment><uri>http://dx.doi.org/10.1145/2398356.2398375</uri></comment>
			</element-citation>
			</ref>
 
			<ref id="CIT03">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Calhoun</surname>
					  <given-names>K.</given-names>	  
				  </name>
			  </person-group>
			  <year>2002</year>
			  <article-title>From information gateway to digital library management system: a case analysis</article-title>
			  <source>Library Collections, Acquisitions, and Technical Services</source>
			  <volume>26</volume>
			  <issue>2</issue>
			  <fpage>141</fpage>
			  <lpage>150</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/S1464-9055(02)00226-9</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT04">
			<element-citation publication-type="report">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Calhoun</surname>
					  <given-names>K.</given-names>	  
				  </name>
				  <name>
					  <surname>Cellentani</surname>
					  <given-names>D.</given-names>	  
				  </name>				  
			  </person-group>
			  <year>2009</year>
			  <article-title>Online catalogers: What users and librarians want</article-title>
			  <source>OCLC report</source>
			  <publisher-loc>Dublin, OH</publisher-loc>
			  <publisher-name>OCLC</publisher-name>
			</element-citation>
			</ref>

			<ref id="CIT05">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Casey</surname>
					  <given-names>M.E.</given-names>	  
				  </name>
				  <name>
					  <surname>Savastinuk</surname>
					  <given-names>L.C.</given-names>	  
				  </name>
			  </person-group>
			  <year>2007</year>
			  <article-title>Library 2.0. A Guide to Participatory Library Service</article-title>
			  <source>Information Today</source>
			</element-citation>
			</ref>

			<ref id="CIT06">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Casta&#x00F1;o</surname>
					  <given-names>B.</given-names>	  
				  </name>
				  <name>
					  <surname>E-Mart&#x00ED;n</surname>
					  <given-names>Y.</given-names>	  
				  </name>
				  <name>
					  <surname>R-Moreno</surname>
					  <given-names>M.D.</given-names>	  
				  </name>
				  <name>
					  <surname>Usero</surname>
					  <given-names>L.</given-names>	  
				  </name>				  				  				  
			  </person-group>
			  <year>2013</year>
			  <article-title>Sistema Inteligente de Detecci&#x00F3;n y Orientaci&#x00F3;n de usuarios en Bibliotecas</article-title>
			  <source>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</source>
			  <volume>36</volume>
			  <issue>1</issue>
			  <fpage>en003</fpage>
			  <comment><uri>http://dx.doi.org/10.3989/redc.2013.1.916</uri></comment>  			  
			</element-citation>
			</ref>

			<ref id="CIT07">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Chen</surname>
					  <given-names>H.L.</given-names>	  
				  </name>
				  <name>
					  <surname>Albee</surname>
					  <given-names>B.</given-names>	  
				  </name>
			  </person-group>
			  <year>2012</year>
			  <article-title>An open source library system and public library users: Finding and using library collections</article-title>
			  <source>Library &#x0026; Information Science Research</source>
			  <volume>34</volume>
			  <issue>3</issue>
			  <fpage>220</fpage>
			  <lpage>227</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.lisr.2011.12.001</uri></comment>  
			</element-citation>
			</ref>

			<ref id="CIT08">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Chen</surname>
					  <given-names>C.M.</given-names>	  
				  </name>
				  <name>
					  <surname>Tsai</surname>
					  <given-names>Y.N.</given-names>	  
				  </name>
			  </person-group>
			  <year>2012</year>
			  <article-title>Interactive augmented reality system for enhancing library instruction in elementary schools</article-title>
			  <source>Computers &#x0026; Education</source>
			  <volume>59</volume>
			  <issue>2</issue>
			  <fpage>638</fpage>
			  <lpage>652</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.compedu.2012.03.001</uri></comment> 
			</element-citation>
			</ref>

			<ref id="CIT09">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>D&#x00ED;az-Valenzuela</surname>
					  <given-names>I.</given-names>	  
				  </name>
				  <name>
					  <surname>Mart&#x00ED;n-Bautista</surname>
					  <given-names>M.J.</given-names>	  
				  </name>
				  <name>
					  <surname>Vila</surname>
					  <given-names>M.A.</given-names>	  
				  </name>
				  <name>
					  <surname>Campa&#x00F1;a</surname>
					  <given-names>J.R.</given-names>	  
				  </name>
			  </person-group>
			  <year>2013</year>
			  <article-title>An automatic system for identifying authorities in digital libraries</article-title>
			  <source>Expert Systems with Applications</source>
			  <volume>40</volume>
			  <issue>10</issue>
			  <fpage>3994</fpage>
			  <lpage>4002</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.eswa.2013.01.010</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT10"> 
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Dwivedi</surname>
					  <given-names>Y.K.</given-names>	  
				  </name>
				  <name>
					  <surname>Kapoor</surname>
					  <given-names>K.K.</given-names>	  
				  </name>
				  <name>
					  <surname>Williams</surname>
					  <given-names>M.D.</given-names>	  
				  </name>
				  <name>
					  <surname>Williams</surname>
					  <given-names>J.</given-names>	  
				  </name>				  				  				  
			  </person-group>
			  <year>2013</year>
			  <article-title>RFID systems in libraries: An empirical examination of factors affecting system use and user satisfaction</article-title>
			  <source>International Journal of Information Management</source>
			  <volume>33</volume>
			  <issue>2</issue>
			  <fpage>367</fpage>
			  <lpage>377</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.ijinfomgt.2012.10.008</uri></comment>			  
			</element-citation>
			</ref>

			<ref id="CIT11">
			<element-citation publication-type="webpage">
				  <collab>Evergreen </collab>
			  <year>2010</year>
			  <article-title>Evergreen Indiana: Resource &#x0026; sharing cooperative of Evergreen libraries</article-title>
			  <comment>Disponible en: <uri>http://rscel.evergreen-ils.org/node/1457</uri></comment>	
			</element-citation>
			</ref>

			<ref id="CIT12">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Fagan</surname>
					  <given-names>J.C.</given-names>	  
				  </name>
			  </person-group>
			  <year>2014</year>
			  <article-title>The Suitability of Web Analytics Key Performance Indicators in the Academic Library Environment</article-title>
			  <source>The Journal of Academic Librarianship</source>
			  <volume>40</volume>
			  <issue>1</issue>
			  <fpage>25</fpage>
			  <lpage>34</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.acalib.2013.06.005</uri></comment> 
			</element-citation>
			</ref>

			<ref id="CIT13">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Gonz&#x00E1;lez-Fern&#x00E1;ndez-Villavicencio</surname>
					  <given-names>N.</given-names>	  
				  </name>
				  <name>
					  <surname>C&#x00E1;novas-&#x00C1;lvarez</surname>
					  <given-names>E.</given-names>	  
				  </name>
				  <name>
					  <surname>Arahal-Junco</surname>
					  <given-names>C.</given-names>	  
				  </name>
			  </person-group>
			  <year>2014</year>
			  <article-title>Evaluaci&#x00F3;n del servicio de referencia de una biblioteca universitaria: Biblioteca de la Universidad de Sevilla</article-title>
			  <source>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</source>
			  <volume>37</volume>
			  <issue>2</issue>
			  <fpage>e045</fpage>
			  <comment><uri>http://dx.doi.org/10.3989/redc.2014.2.1072</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT14">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Griol</surname>
					  <given-names>D.</given-names>	  
				  </name>
				  <name>
					  <surname>Callejas</surname>
					  <given-names>Z.</given-names>	  
				  </name>
				  <name>
					  <surname>L&#x00F3;pez-C&#x00F3;zar</surname>
					  <given-names>R.</given-names>	  
				  </name>
				  <name>
					  <surname>Riccardi</surname>
					  <given-names>G.</given-names>	  
				  </name>
			  </person-group>
			  <year>2014</year>
			  <article-title>A domain-independent statistical methodology for dialog management in spoken dialog systems</article-title>
			  <source>Computer Speech and Language</source>
			  <volume>28</volume>
			  <issue>3</issue>
			  <fpage>743</fpage>
			  <lpage>768</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.csl.2013.09.002</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT15">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Griol</surname>
					  <given-names>D.</given-names>	  
				  </name>
				  <name>
					  <surname>Carb&#x00F3;</surname>
					  <given-names>J.</given-names>	  
				  </name>
				  <name>
					  <surname>Molina</surname>
					  <given-names>J.</given-names>	  
				  </name>
			  </person-group>
			  <year>2013</year>
			  <article-title>An Automatic Dialog Simulation Technique to Develop and Evaluate Interactive Conversational Agents</article-title>
			  <source>Applied Artificial Intelligence</source>
			  <volume>27</volume>
			  <issue>9</issue>
			  <fpage>759</fpage>
			  <lpage>780</lpage>
			  <comment><uri>http://dx.doi.org/10.1080/08839514.2013.835230</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT16">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Helling</surname>
					  <given-names>J.</given-names>	  
				  </name>
			  </person-group>
			  <year>2010</year>
			  <article-title>A case study of one library's decision to migrate to an open source ILS</article-title>
			  <source>Library Review</source>
			  <volume>59</volume>
			  <issue>9</issue>
			  <fpage>707</fpage>
			  <lpage>707</lpage>
			</element-citation>
			</ref>

			<ref id="CIT17">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Kaufmann</surname>
					  <given-names>T.</given-names>	  
				  </name>
				  <name>
					  <surname>Pfister</surname>
					  <given-names>B.</given-names>	  
				  </name>
			  </person-group>
			  <year>2012</year>
			  <article-title>Syntactic language modeling with formal grammars</article-title>
			  <source>Speech Communication</source>
			  <volume>54</volume>
			  <issue>6</issue>
			  <fpage>715</fpage>
			  <lpage>731</lpage>
			</element-citation>
			</ref>

			<ref id="CIT18">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Larson</surname>
					  <given-names>J.A.</given-names>	  
				  </name>
			  </person-group>
			  <year>2002</year>
			  <source>VoiceXML Introduction to Developing Speech Applications</source>
			  <publisher-name>Prentice Hall</publisher-name>
			</element-citation>
			</ref>

			<ref id="CIT19">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Lemon</surname>
					  <given-names>O.</given-names>	  
				  </name>
			  </person-group>
			  <year>2011</year>
			  <article-title>Learning what to say and how to say it: Joint optimisation of spoken dialogue management and natural language generation</article-title>
			  <source>Computer Speech &#x0026; Language</source>
			  <volume>25</volume>
			  <issue>2</issue>
			  <fpage>210</fpage>
			  <lpage>221</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.csl.2010.04.005</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT20">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Liu</surname>
					  <given-names>Z.</given-names>	  
				  </name>
			  </person-group>
			  <year>2006</year>
			  <article-title>Print vs. electronic resources: a study of user perceptions, preferences, and use</article-title>
			  <source>Information Processing and Management</source>
			  <volume>42</volume>
			  <issue>2</issue>
			  <fpage>583</fpage>
			  <lpage>592</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.ipm.2004.12.002</uri></comment>
			</element-citation>
			</ref>
			
			<ref id="CIT21">
			<element-citation publication-type="report">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Mann</surname>
					  <given-names>T.</given-names>	  
				  </name>
			  </person-group>
			  <year>2008</year>
			  <source>On the record but off the track: A review of the report of the Library of Congress Working Group on Bibliographic Control, with a further examination of Library of Congress cataloging tendencies</source>
			  <comment>Disponible en: <uri>http://www.guild2910.org/WorkingGrpResponse2008.pdf </uri></comment>
			</element-citation>
			</ref>
			
			<ref id="CIT22">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>McTear</surname>
					  <given-names>M.</given-names>	  
				  </name>
				  <name>
					  <surname>Callejas</surname>
					  <given-names>Z.</given-names>	  
				  </name>
			  </person-group>
			  <year>2013</year>
			  <source>Voice Application Development for Android</source>
			  <publisher-name>Packt Publishing</publisher-name>
			</element-citation>
			</ref>
			
			<ref id="CIT23">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Metze</surname>
					  <given-names>F.</given-names>	  
				  </name>
				  <name>
					  <surname>Wechsung</surname>
					  <given-names>I.</given-names>	  
				  </name>
				  <name>
					  <surname>Schaffer</surname>
					  <given-names>S.</given-names>	  
				  </name>
				  <name>
					  <surname>Seebode</surname>
					  <given-names>J.</given-names>	  
				  </name>
				  <name>
					  <surname>M&#x00F6;ller</surname>
					  <given-names>S.</given-names>	  
				  </name>				  
			  </person-group>
			  <year>2009</year>
			  <chapter-title>Human-Computer Interaction. Novel Interaction Methods and Techniques</chapter-title>
			  <source>Reliable Evaluation of Multimodal Dialogue Systems</source>
			  <publisher-name>Springer-Verlag</publisher-name>
			  <fpage>75</fpage>
			  <lpage>83</lpage>
			  <comment><uri>http://dx.doi.org/10.1007/978-3-642-02577-8_9</uri></comment>
			</element-citation>
			</ref>
			
			<ref id="CIT24">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Moreno</surname>
					  <given-names>M.D.</given-names>	  
				  </name>
				  <name>
					  <surname>Casta&#x00F1;o</surname>
					  <given-names>B.</given-names>	  
				  </name>
				  <name>
					  <surname>Barrero</surname>
					  <given-names>D.F.</given-names>	  
				  </name>
				  <name>
					  <surname>Hell&#x00ED;n</surname>
					  <given-names>A.M.</given-names>	  
				  </name>
			  </person-group>
			  <year>2014</year>
			  <article-title>Efficient Services Management in Libraries using AI and Wireless techniques</article-title>
			  <source>Expert Systems with Applications</source>
			  <volume>41</volume>
			  <issue>17</issue>
			  <fpage>7904</fpage>
			  <lpage>7913</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.eswa.2014.06.047</uri></comment>
			</element-citation>
			</ref>
			
			<ref id="CIT25">
			<element-citation publication-type="webpage">
			  <person-group person-group-type="author">
				  <name>
					  <surname>O’Reilly</surname>
					  <given-names>T.</given-names>	  
				  </name>
			  </person-group>
			  <year>2005</year>
			  <source>What is Web 2.0. Design Patterns and Business Models for the Next Generation of Software</source>
			</element-citation>
			</ref>
			
			<ref id="CIT26">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Ordu&#x00F1;a-Malea</surname>
					  <given-names>E.</given-names>	  
				  </name>
			  </person-group>
			  <year>2013</year>
			  <article-title>Espacio universitario espa&#x00F1;ol en la Web (2010): estudio descriptivo de instituciones y productos acad&#x00E9;micos a trav&#x00E9;s del an&#x00E1;lisis de subdominios y subdirectorios</article-title>
			  <source>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</source>
			  <volume>36</volume>
			  <issue>3</issue>
			  <fpage>e017</fpage>
			  <comment><uri>http://dx.doi.org/10.3989/redc.2013.3.958</uri></comment>
			</element-citation>
			</ref>
			
			<ref id="CIT27">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Paek</surname>
					  <given-names>T.</given-names>	  
				  </name>
				  <name>
					  <surname>Pieraccini</surname>
					  <given-names>R.</given-names>	  
				  </name>
			  </person-group>
			  <year>2008</year>
			  <article-title>Automating spoken dialogue management design using machine learning: An industry perspective</article-title>
			  <source>Speech Communication</source>
			  <volume>50</volume>
			  <issue>8–9</issue>
			  <fpage>716</fpage>
			  <lpage>729</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.specom.2008.03.010</uri></comment>
			</element-citation>
			</ref>
			
			<ref id="CIT28">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Park</surname>
					  <given-names>N.</given-names>	  
				  </name>
				  <name>
					  <surname>Roman</surname>
					  <given-names>R.</given-names>	  
				  </name>
				  <name>
					  <surname>Lee</surname>
					  <given-names>S.</given-names>	  
				  </name>
				  <name>
					  <surname>Chung</surname>
					  <given-names>J.E.</given-names>	  
				  </name>
			  </person-group>
			  <year>2009</year>
			  <article-title>User acceptance of a digital library system in developing countries: An application of the Technology Acceptance Model</article-title>
			  <source>International Journal of Information Management</source>
			  <volume>29</volume>
			  <issue>3</issue>
			  <fpage>196</fpage>
			  <lpage>209</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.ijinfomgt.2008.07.001</uri></comment>
			</element-citation>
			</ref>
			
			<ref id="CIT29">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>P&#x00E9;rez-Mar&#x00ED;n</surname>
					  <given-names>D.</given-names>	  
				  </name>
				  <name>
					  <surname>Pascual-Nieto</surname>
					  <given-names>I.</given-names>	  
				  </name>
			  </person-group>
			  <year>2011</year>
			  <source>Conversational Agents and Natural Language Interaction: Techniques and Effective Practices</source>
			  <comment>IGI Global. <uri>http://dx.doi.org/10.4018/978-1-60960-617-6</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT30">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Pieraccini</surname>
					  <given-names>R.</given-names>	  
				  </name>
			  </person-group>
			  <year>2012</year>
			  <source>The Voice in the Machine: Building Computers that Understand Speech</source>
			  <publisher-name>MIT Press</publisher-name>
			</element-citation>
			</ref>

			<ref id="CIT31">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Porcel</surname>
					  <given-names>C.</given-names>	  
				  </name>
				  <name>
					  <surname>Herrera-Viedma</surname>
					  <given-names>E.</given-names>	  
				  </name>
			  </person-group>
			  <year>2010</year>
			  <article-title>Dealing with incomplete information in a fuzzy linguistic recommender system to disseminate information in university digital libraries</article-title>
			  <source>Knowledge-Based Systems</source>
			  <volume>23</volume>
			  <issue>1</issue>
			  <fpage>32</fpage>
			  <lpage>39</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.knosys.2009.07.007</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT32">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Porcel</surname>
					  <given-names>C.</given-names>	  
				  </name>
				  <name>
					  <surname>Moreno</surname>
					  <given-names>J.M.</given-names>	  
				  </name>
				  <name>
					  <surname>Herrera-Viedma</surname>
					  <given-names>E.</given-names>	  
				  </name>
			  </person-group>
			  <year>2009</year>
			  <article-title>A multi-disciplinar recommender system to advice research resources in University Digital Libraries</article-title>
			  <source>Expert Systems with Applications</source>
			  <volume>36</volume>
			  <issue>10</issue>
			  <fpage>12520</fpage>
			  <lpage>12528</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.eswa.2009.04.038</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT33">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Renda</surname>
					  <given-names>M.E.</given-names>	  
				  </name>
				  <name>
					  <surname>Straccia</surname>
					  <given-names>U.</given-names>	  
				  </name>
			  </person-group>
			  <year>2005</year>
			  <article-title>A personalized collaborative digital library environment: a model and an application</article-title>
			  <source>Information Processing and Management</source>
			  <volume>41</volume>
			  <issue>1</issue>
			  <fpage>5</fpage>
			  <lpage>21</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.ipm.2004.04.007</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT34">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Ross</surname>
					  <given-names>L.</given-names>	  
				  </name>
				  <name>
					  <surname>Sennyey</surname>
					  <given-names>P.</given-names>	  
				  </name>
			  </person-group>
			  <year>2008</year>
			  <article-title>The library is dead, long live the library! the practice of academic librarianship and the digital revolution</article-title>
			  <source>The Journal of Academic Librarianship</source>
			  <volume>34</volume>
			  <issue>2</issue>
			  <fpage>145</fpage>
			  <lpage>152</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.acalib.2007.12.006</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT35">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Sanz-Santacruz</surname>
					  <given-names>V.</given-names>	  
				  </name>
				  <name>
					  <surname>Serrano-Vicente</surname>
					  <given-names>R.</given-names>	  
				  </name>
				  <name>
					  <surname>Iturbide-Tellechea</surname>
					  <given-names>M.A.</given-names>	  
				  </name>
			  </person-group>
			  <year>2013</year>
			  <article-title>La estancia en bibliotecas extranjeras como instrumento de formaci&#x00F3;n bibliotecaria: la experiencia de la Universidad de Navarra (2003-2010)</article-title>
			  <source>Revista Espa&#x00F1;ola de Documentaci&#x00F3;n Cient&#x00ED;fica</source>
			  <volume>36</volume>
			  <issue>1</issue>
			  <fpage>en001</fpage>
			  <comment><uri>http://dx.doi.org/10.3989/redc.2013.1.896</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT36">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Schatzmann</surname>
					  <given-names>J.</given-names>	  
				  </name>
				  <name>
					  <surname>Weilhammer</surname>
					  <given-names>K.</given-names>	  
				  </name>
				  <name>
					  <surname>Stuttle</surname>
					  <given-names>M.</given-names>	  
				  </name>
				  <name>
					  <surname>Young</surname>
					  <given-names>S.</given-names>	  
				  </name>
			  </person-group>
			  <year>2006</year>
			  <article-title>A Survey of Statistical User Simulation Techniques for Reinforcement-Learning of Dialogue Management Strategies</article-title>
			  <source>Knowledge Engineering Review</source>
			  <volume>21</volume>
			  <issue>2</issue>
			  <fpage>97</fpage>
			  <lpage>126</lpage>
			  <comment><uri>http://dx.doi.org/10.1017/S0269888906000944</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT37">
			<element-citation publication-type="book">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Seneff</surname>
					  <given-names>S.</given-names>	  
				  </name>
				  <name>
					  <surname>Adler</surname>
					  <given-names>M.</given-names>	  
				  </name>
				  <name>
					  <surname>Glass</surname>
					  <given-names>J.</given-names>	  
				  </name>
				  <name>
					  <surname>Sherry</surname>
					  <given-names>B.</given-names>	  
				  </name>
				  <name>
					  <surname>Hazen</surname>
					  <given-names>T.</given-names>	  
				  </name>
				  <name>
					  <surname>Wang</surname>
					  <given-names>C.</given-names>	  
				  </name>
				  <name>
					  <surname>Wu</surname>
					  <given-names>T.</given-names>	  
				  </name>				  
			  </person-group>
			  <year>2007</year>
			  <chapter-title>Exploiting Context Information in Spoken Dialogue Interaction with Mobile Devices</chapter-title>
			  <source>Proc. IMUx’07</source>
			  <fpage>1</fpage>
			  <lpage>11</lpage>
			</element-citation>
			</ref>
			
			<ref id="CIT38">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Serrano-Guerrero</surname>
					  <given-names>J.</given-names>	  
				  </name>
				  <name>
					  <surname>Herrera-Viedma</surname>
					  <given-names>E.</given-names>	  
				  </name>
				  <name>
					  <surname>Olivas</surname>
					  <given-names>J.A.</given-names>	  
				  </name>
				  <name>
					  <surname>Cerezo</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Romero</surname>
					  <given-names>F.P.</given-names>	  
				  </name>				  					  
			  </person-group>
			  <year>2011</year>
			  <article-title>A Google wave-based fuzzy recommender system to disseminate information in University Digital Libraries 2.0.</article-title>
			  <source>Information Sciences</source>
			  <volume>181</volume>
			  <issue>9</issue>
			  <fpage>1503</fpage>
			  <lpage>1516</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.ins.2011.01.012</uri></comment>
			</element-citation>
			</ref>
			
			<ref id="CIT39">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Shatte</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Holdsworth</surname>
					  <given-names>J.</given-names>	  
				  </name>
				  <name>
					  <surname>Lee</surname>
					  <given-names>I.</given-names>	  
				  </name>				  				  
			  </person-group>
			  <year>2014</year>
			  <article-title>Mobile augmented reality based context-aware library management system</article-title>
			  <source>Expert Systems with Applications</source>
			  <volume>41</volume>
			  <issue>5</issue>
			  <fpage>2174</fpage>
			  <lpage>2185</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.eswa.2013.09.016</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT40">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Smeaton</surname>
					  <given-names>A.F.</given-names>	  
				  </name>
				  <name>
					  <surname>Callan</surname>
					  <given-names>J.</given-names>	  
				  </name>				  
			  </person-group>
			  <year>2005</year>
			  <article-title>Personalisation and recommender systems in digital libraries</article-title>
			  <source>International Journal on Digital Libraries</source>
			  <volume>5</volume>
			  <issue>4</issue>
			  <fpage>299</fpage>
			  <lpage>308</lpage>
			  <comment><uri>http://dx.doi.org/10.1007/s00799-004-0100-1</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT41">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Tejeda-Lorente</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Porcel</surname>
					  <given-names>C.</given-names>	  
				  </name>
				  <name>
					  <surname>Peis</surname>
					  <given-names>E.</given-names>	  
				  </name>
				  <name>
					  <surname>Sanz</surname>
					  <given-names>R.</given-names>	  
				  </name>
				  <name>
					  <surname>Herrera-Viedma</surname>
					  <given-names>E.</given-names>	  
				  </name>				  				  				  				  
			  </person-group>
			  <year>2014</year>
			  <article-title>A quality based recommender system to disseminate information in a university digital library</article-title>
			  <source>Information Sciences</source>
			  <volume>261</volume>
			  <fpage>52</fpage>
			  <lpage>69</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.ins.2013.10.036</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT42">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Tsuji</surname>
					  <given-names>K.</given-names>	  
				  </name>
				  <name>
					  <surname>Takizawa</surname>
					  <given-names>N.</given-names>	  
				  </name>
				  <name>
					  <surname>Sato</surname>
					  <given-names>S.</given-names>	  
				  </name>
				  <name>
					  <surname>Ikeuchi</surname>
					  <given-names>U.</given-names>	  
				  </name>
				  <name>
					  <surname>Ikeuchi</surname>
					  <given-names>A.</given-names>	  
				  </name>
				  <name>
					  <surname>Yoshikane</surname>
					  <given-names>F.</given-names>	  
				  </name>
				  <name>
					  <surname>Itsumura</surname>
					  <given-names>H.</given-names>	  
				  </name>				  				  				  				  				  				  
			  </person-group>
			  <year>2014</year>
			  <article-title>Book Recommendation Based on Library Loan Records and Bibliographic Information</article-title>
			  <source>Procedia - Social and Behavioral Sciences</source>
			  <volume>147</volume>
			  <fpage>478</fpage>
			  <lpage>486</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.sbspro.2014.07.142</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT43">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Vassilakaki</surname>
					  <given-names>E.</given-names>	  
				  </name>
				  <name>
					  <surname>Garoufallou</surname>
					  <given-names>E.</given-names>	  
				  </name>				  
			  </person-group>
			  <year>2013</year>
			  <article-title>Multilingual Digital Libraries: A review of issues in system-centered and user-centered studies, information retrieval and user behavio</article-title>
			  <source>The International Information &#x0026; Library Review</source>
			  <volume>45</volume>
			  <issue>1-2</issue>
			  <fpage>3</fpage>
			  <lpage>19</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.iilr.2013.07.002</uri> / <uri>http://dx.doi.org/10.1080/10572317.2013.10766367</uri></comment>
			</element-citation>
			</ref>

			<ref id="CIT44">
			<element-citation publication-type="journal">
			  <person-group person-group-type="author">
				  <name>
					  <surname>Wu</surname>
					  <given-names>W.L.</given-names>	  
				  </name>
				  <name>
					  <surname>Lu</surname>
					  <given-names>R.Z.</given-names>	  
				  </name>
				  <name>
					  <surname>Duan</surname>
					  <given-names>J.Y.</given-names>	  
				  </name>	
				  <name>
					  <surname>Liu</surname>
					  <given-names>H.</given-names>	  
				  </name>
				  <name>
					  <surname>Gao</surname>
					  <given-names>F.</given-names>	  
				  </name>	
				  <name>
					  <surname>Chen</surname>
					  <given-names>Y.Q.</given-names>	  
				  </name>				  				  				  
			  </person-group>
			  <year>2010</year>
			  <article-title>Spoken language understanding using weakly supervised learning</article-title>
			  <source>Computer Speech &#x0026; Language</source>
			  <volume>24</volume>
			  <issue>2</issue>
			  <fpage>358</fpage>
			  <lpage>382</lpage>
			  <comment><uri>http://dx.doi.org/10.1016/j.csl.2009.05.002</uri></comment>
			</element-citation>
			</ref>	
			
		</ref-list>
		
	</back>
</article>
