Hernández-Pupo, Luis GabrielYzquierdo-Herrera, RaykenlerAlvarado-Acuña, Luis SegundoPiñero-Pérez, Pedro YobanisPérez-Pupo, IlianaBello-Pérez, Rafael2026-08-262026-08-262025-03-259783031836435https://doi.org/10.1007/978-3-031-83643-5_12https://repositorio.ucn.cl/handle/20.500.14729/10293The increase in the number of conversational systems (chatbots) applied to different scenarios in society is notable. However, the development of metrics and evaluation methods for chatbots still remains an open line of research. The aim is to create evaluation methods that are less and less invasive and that do not reduce the participation of users or other human agents. In this work, in the methods section, a systematic review is carried out on different evaluation methods for chatbots. Then, in the same section, new metrics for the evaluation of conversations with chatbots inspired by the neutrosophic theory are presented. In the results section, the validation of the proposed model is carried out. The applicability of the model is evaluated and the proposal is subjected to expert triangulation methods. In the work, it is possible to demonstrate that the application of neutrosophic logic can contribute to achieving a more natural response from chatbots. This effect can be useful to mitigate the presence of false responses or hallucinations.El aumento en el número de sistemas conversacionales (chatbots) aplicados a distintos escenarios de la sociedad es notable. Sin embargo, el desarrollo de métricas y métodos de evaluación para chatbots continúa siendo una línea de investigación abierta. El objetivo es crear métodos de evaluación cada vez menos invasivos y que no reduzcan la participación de los usuarios ni de otros agentes humanos. En este trabajo, en la sección de métodos, se realiza una revisión sistemática de distintos métodos de evaluación de chatbots. Posteriormente, en la misma sección, se presentan nuevas métricas para la evaluación de conversaciones con chatbots, inspiradas en la teoría neutrosófica. En la sección de resultados se lleva a cabo la validación del modelo propuesto. Se evalúa la aplicabilidad del modelo y la propuesta se somete a métodos de triangulación por expertos. El trabajo demuestra que la aplicación de la lógica neutrosófica puede contribuir a lograr respuestas más naturales por parte de los chatbots. Este efecto puede ser útil para mitigar la aparición de respuestas falsas o alucinaciones.pp. 359–383enchatbot evaluationconversational system evaluationLLMneutrosophic theoryuncertaintyevaluación de chatbotsevaluación de sistemas conversacionalesLLMteoría neutrosóficaincertidumbreMeasurement of Perceived Quality in Conversational Systems (Chatbots)Book chapter