NEW
Font size
WorksheetsWebscraping - conocimientos previos
Total questions: 10
Worksheet time: 5mins
¿Qué es el web scraping?
a) Un programa antivirus
b) Una técnica para extraer información de sitios web
c) Un tipo de lenguaje de programación
d) Un navegador web
¿Qué herramienta se utiliza comúnmente para realizar web scraping en Python?
a) BeautifulSoup
b) jQuery
c) Django
d) Ruby on Rails
¿Cuál de las siguientes bibliotecas de Python es más adecuada para realizar solicitudes HTTP y extraer datos de una página web?
a) Pandas
b) NumPy
c) Requests
d) Matplotlib
¿Qué es robots.txt en el contexto del web scraping?
a) Un archivo utilizado para bloquear a los usuarios de un sitio web
b) Un estándar que indica qué partes de un sitio web pueden ser rastreadas por los motores de búsqueda
c) Una biblioteca de Python para web scraping
d) Un tipo de formato de archivo para almacenar datos extraídos de sitios web
¿Cuál de las siguientes declaraciones es cierta sobre el web scraping ético?
a) Es aceptable realizar web scraping en cualquier sitio web sin restricciones
b) Solo se permite el web scraping en sitios web que no tengan un archivo robots.txt
c) Es importante respetar los términos de servicio de un sitio web y obtener el permiso del propietario antes de realizar web scraping
d) El web scraping ético no existe
¿Qué es XPath en el contexto del web scraping?
a) Un tipo de lenguaje de programación
b) Una técnica para realizar solicitudes HTTP
c) Una expresión para localizar elementos en un documento XML o HTML
d) Un protocolo de comunicación en la web
¿Cuál de las siguientes afirmaciones es cierta sobre el web scraping?
a) Siempre es fácil y rápido extraer datos de cualquier sitio web
b) Los sitios web nunca cambian su estructura, por lo que los scripts de web scraping nunca necesitan actualizaciones
c) Es posible que los sitios web bloqueen a los bots de web scraping y dificulten la extracción de datos
d) El web scraping solo se puede realizar en sitios web en inglés
¿Cuál es el propósito principal del archivo robots.txt en un sitio web?
a) Mostrar un mapa del sitio web
b) Bloquear el acceso a los usuarios
c) Indicar a los motores de búsqueda qué partes del sitio pueden ser rastreadas
d) Proporcionar información de contacto del administrador del sitio web
¿Cuál de las siguientes bibliotecas de Python se utiliza comúnmente para interactuar con sitios web dinámicos y realizar web scraping?
a) BeautifulSoup
b) Selenium
c) Requests
d) Flask
¿Qué tipo de datos se pueden extraer utilizando web scraping?
a) Solo imágenes
b) Solo texto
c) Solo números
d) Texto, imágenes, números y otros tipos de datos
