Wayground logo

Free Printable Worksheets

Font size

S
M
L
XL
Worksheets

Repaso DAI P4

Total questions: 30

Worksheet time: 20mins

Name
Class
Date
1.

¿Cuál es la principal característica de un chatbot basado en reglas?

a)

Aprende de las interacciones con Machine Learning.

b)

Responde a preguntas directas según un guion predefinido.

c)

Necesita grandes cantidades de datos para su entrenamiento.

d)

Utiliza la lematización con spaCy.

2.

En un chatbot básico, ¿qué representa el concepto de "Intención" (Intent)?

a)

La respuesta aleatoria que devuelve el chatbot.

b)

El algoritmo de clasificación utilizado.

c)

La categoría o propósito de la entrada del usuario.

d)

El conjunto de palabras vacías (stop words).

3.

¿Qué se utiliza para convertir una frase o texto en unidades más pequeñas como palabras, que luego son procesadas por el modelo?

a)

Lematización

b)

Stemming

c)

Tokenización

d)

Vectorización

4.

¿Cuál es el objetivo principal del proceso de Stemming en el procesamiento de lenguaje natural?

a)

Garantizar que la palabra resultante sea un lema válido.

b)

Reducir las palabras a su raíz morfológica, aunque no sea una palabra real.

c)

Eliminar las palabras comunes del texto.

d)

Clasificar la intención del usuario.

5.

¿Cuál es la principal diferencia entre Stemming y Lematización?

a)

La Lematización es más rápida.

b)

El Stemming utiliza un diccionario.

c)

C) La Lematización garantiza que la forma base sea una palabra.

d)

El Stemming se usa solo para el español.

6.

¿Qué tipo de palabras se recomienda eliminar en el preprocesamiento de texto por no aportar un contenido significativo para el análisis?

a)

Palabras clave

b)

Stop Words

c)

C) Patrones (Patterns)

d)

D) Lemas

7.

Después de entrenar el modelo en el script chatty.py, ¿en qué formato de archivo se guarda el objeto del modelo entrenado?

a)

.txt

b)

B) .json

c)

C) .csv

d)

D) .pkl

8.

En el código de Python, ¿qué módulo se usa para seleccionar una respuesta aleatoria de la lista de respuestas asociadas a una intención?

a)

sys

b)

B) random

c)

C) os

d)

D) time

9.

Para la lematización en español utilizando spaCy, ¿cuál es el diccionario o modelo lingüístico que se menciona en el repaso?

a)

en_core_web_sm

b)

B) es_core_news_sm

c)

C) es_wordnet_dict

d)

D) spanish_stemmer

10.

¿Qué librería de Python se utiliza frecuentemente para las tareas básicas de NLP como tokenización y manejo de stop words, especialmente antes de usar el modelo?

a)

Matplotlib

b)

NLTK

c)

Twilio

d)

Seaborn

11.

¿Qué técnica de preprocesamiento de Stop Words sugiere eliminar las palabras que aparecen con una frecuencia extremadamente alta en un corpus específico?

a)

Eliminación por listas predefinidas

b)

Eliminación basada en longitud

c)

Eliminación basada en frecuencia

d)

Lematización inversa

12.

¿Qué comando de terminal se utiliza para iniciar el túnel de Ngrok si tu aplicación Flask se ejecuta en el puerto predeterminado (5000)?

a)

ngrok start 5000

b)

ngrok run http

c)

ngrok http 5000

d)

ngrok connect web

13.

¿Qué tipo de chatbot fue entrenado con grandes cantidades de datos para entender palabras clave y aprender de las interacciones?

a)

Basado en Reglas

b)

De Menú

c)

Intelectualmente Independiente

d)

De Patrones Fijos

14.

¿Qué se hace con el token generado por Twilio al registrarse para usar Ngrok?

a)

Se usa para conectar Flask.

b)

Se coloca en el comando add-authtoken de Ngrok.

c)

Se guarda en el intents.json.

d)

Se utiliza para la lematización.

15.

¿Cómo se llama el proceso de reducir una palabra a su raíz morfológica, aunque el resultado no sea una palabra real?

(a)  

16.

¿Cuál es el algoritmo de stemming más utilizado en inglés?

(a)  

17.

¿Qué técnica de preprocesamiento elimina palabras comunes como artículos y preposiciones?

(a)  

18.

¿Qué biblioteca de Python es recomendada en las guías para la lematización en español usando es_core_news_sm?

(a)  

19.

¿Qué librería de Python se utiliza frecuentemente para las tareas básicas de tokenización y stemming?

(a)  

20.

¿Qué método de solicitud HTTP se usa en la ruta /chat para recibir la entrada del usuario?

(a)  

21.

¿Qué herramienta se utiliza para exponer un servidor local a internet?

(a)  

22.

¿Cómo se le llama al entorno de prueba temporal de Twilio para WhatsApp donde se configura la URL?

(a)  

23.

¿Cuál es el principal objetivo del preprocesamiento de texto antes de entrenar un modelo de chatbot?

a)

Reducir el tamaño de las respuestas.

b)

Disminuir la cantidad de datos en el intents.json

c)

Reducir la complejidad y variabilidad del texto de entrada.

d)

Aumentar el número de épocas de entrenamiento.

24.

¿Cómo se obtiene el token que se utiliza para autorizar y autenticar el uso de Ngrok?

a)

Se genera automáticamente al iniciar el servidor Flask.

b)

Se obtiene al registrarse en la plataforma de Ngrok.

c)

Se genera por el algoritmo Ngrokt-token.

d)

Se genera al ejecutar un archivo descargable de la plataforma Ngrok

25.

¿Qué concepto de PNL se utiliza para asignar "corr" a las palabras: "correr", "corrí"?

(a)  

26.

¿Cuál es el propósito de la tokenización en el procesamiento de lenguaje natural?

a)

Dividir el texto en oraciones.

b)

D) Eliminar caracteres especiales del texto.

c)

B) Convertir palabras en números.

d)

C) Separar el texto en unidades más pequeñas

27.

¿Cuál es el propósito de la lematización en el procesamiento de lenguaje natural?

a)

Convertir palabras en su forma base.

b)

B) Eliminar palabras irrelevantes del texto.

c)

C) Clasificar el texto en categorías.

d)

D) Aumentar la complejidad del texto.

28.

¿Qué función cumple el módulo spaCy en el procesamiento de lenguaje natural?

a)

Enviar mensajes de texto.

b)

A) Generar gráficos de datos.

c)

B) Procesar y analizar texto.

d)

C) Crear bases de datos.

29.

¿Cuál es la diferencia principal entre un chatbot basado en reglas y uno que utiliza aprendizaje automático?

a)

El primero sigue un guion predefinido, mientras que el segundo aprende de las interacciones.

b)

B) El primero es más rápido que el segundo.

c)

C) El segundo no necesita datos para entrenarse.

d)

D) El primero puede manejar más intenciones, en cambio el segundo todo lo hace por medio de texto ya establecido.

30.

Si un chatbot basado en la arquitectura de Intenciones/Entidades recibe la frase "¿Cuál es el precio del café?", ¿qué representa la palabra "café" en este contexto?

a)

Intención principal

b)

Entidad

c)

No es necesario para el contexto

d)

Es una stop word