WorksheetsPreprocesamiento del texto
Total questions: 10
Worksheet time: 5mins
¿Cuál paso de preprocesamiento transforma palabras a su forma base conservando la categoría gramatical?
Lematización para formas canónicas
Normalización con minúsculas y signos
Eliminación de stopwords frecuentes
Tokenización y segmentación de oraciones
Al diseñar un pipeline, ¿qué combinación es más adecuada para reducir variaciones superficiales sin perder demasiada información semántica?
Lematización junto con normalización
POS tagging sin normalización previa
Solo tokenización y segmentación
Stemming agresivo con eliminación de stopwords
¿Qué describe mejor la tokenización en el preprocesamiento de texto?
Convertir todas las palabras a minúsculas obligatoriamente
Separar el texto en unidades analizables llamadas tokens
Eliminar signos de puntuación y símbolos irrelevantes
Unir frases similares para reducir la dimensionalidad
Dado el texto: "¡El Gato COME! :) #mascotas", ¿cuál podría ser el resultado tras una normalización básica?
"El Gato COME :) #mascotas" intacto
"el gato come" sin emojis ni hashtags
"gato come mascotas" con signos añadidos
"el gato" con emojis y hashtags
Se quiere preparar la frase "El gato come" para análisis. ¿Cuál es una secuencia razonable de pasos?
Detectar idioma, luego reemplazar por sinónimos aleatorios
Lematizar primero, luego añadir puntuación extra
Tokenizar en palabras y después mezclar caracteres
Normalizar eliminando símbolos y minúsculas, luego tokenizar
¿Cuál es el propósito principal de eliminar stopwords en un preprocesamiento de texto?
Detectar entidades con mayor precisión morfológica
Traducir automáticamente términos a su idioma base
Aumentar vocabulario añadiendo conectores frecuentes
Reducir ruido manteniendo contenido semántico relevante
¿Cuál de las siguientes palabras es más probable que sea una stopword en español en un análisis de texto general?
tópicos
algoritmo
minería
de
Tienes los tokens: "corriendo", "corrí", "corre". Si aplicas lematización, ¿qué representación única elegirías y por qué?
Usar "correr" porque agrupa variaciones flexionadas
Usar "corre" porque refleja tercera persona singular
Usar "corrí" porque conserva tiempo pasado explícito
Usar "corriendo" porque mantiene aspecto progresivo
¿Cuál es la mejor descripción de stemming en procesamiento de lenguaje natural?
Detectar dependencias sintácticas entre oraciones
Asignar etiquetas de sustantivo o verbo a palabras
Traducir automáticamente textos entre diferentes idiomas
Reducir palabras a la raíz eliminando sufijos
Dado el texto: "Los niños felices cantan", ¿qué salida corresponde al etiquetado gramatical (POS tagging)?
[(Los, DET), (niños, NOUN), (felices, ADJ), (cantan, VERB)]
[(Los, NOUN), (niños, VERB), (felices, NOUN), (cantan, ADJ)]
[(Los, ADJ), (niños, ADJ), (felices, VERB), (cantan, NOUN)]
[(Los, PRON), (niños, PRON), (felices, ADV), (cantan, AUX)]
