Font size
WorksheetsDL Test
Total questions: 60
Worksheet time: 52mins
Какой архитектуры нейронных сетей не существует?
ResNet
AlexNext
VGG
LeNet5
Какие параметры определяют модель линейной регрессии
Вектор
свободных коэффициентов
Вектор коэффициента наклона
Зависимые переменные
Независимые переменные
Какой метрики качества модели машинного обучения не существует?
F1 мера
Accuracy
Latency
ROC AUC
Какие типы задач решаются в классическом машинном обучении?
Классификация
Кластеризация
Ассоциация
Поиск
Что такое Мультиколлинеарность?
Наличие линейной зависимости между независимыми переменными
Наличие полиномиальной зависимости между независимыми переменными
Отсутствие линейной зависимости между независимыми переменными
Отсутствие полиномиальной зависимости между независимыми переменными
Что такое Регуляризация?
способ предотвратить недообучение модели
способ предотвратить переобучение модели
один из гиперпараметров модели
независимая переменная
К чему в большей степени чувствителен метод SVM?
к углу наклона опорного вектора
к прохождению гиперплоскости к исследуемым данным
к длине зазора
к масштабированию данных
Какие функции активации для нейронных сетей вы знаете?
сигмоида
tanh
ReLu
Elu
Работа в основном с какими объектами удобна в библиотеке pyTorch?
с базой данных
с тензорами
с текстом
с большими данными
В каких сферах деятельности (доменах) можно применить библиотеку nltk?
Sentiment Analysis
Chatbots
Social Media monitoring
Document Analysis
Выберите существующие этапы в рамках работы с текстом в NLP.
Токенизация
Tagging
Parsing
Information Extraction
Что происходит в рамках этапа - Deep Learning NLP?
Применение алгоритмов Data Mining для различных задач NLP
Применение глубоких нейронных сетей для различных задач NLP
Применение алгоритмов регрессивного анализа для различных задач NLP
Применение алгоритмов прогнозирования для различных задач NLP
Метод "приведение текста к нижнему регистру" к какому этапу NLP относится?
Tokenization
Parsing
Word Sense Disambiguation
Text Preprocessing
Для каких целей из текста мы удаляем стоп-слова?
Убрать лишний шум при последующем анализе текста в NLP
Стоп слова являются неверными и мы должны их удалять
Стоп слова являются лишними для алгоритмов Data Mining
Стоп слова являются дополнительным стимулом для их анализа в отдельном блоке
Что такое TF-IDF?
Алгоритм кластеризации текста
Статическая мера
Нейронная сетевая модель
Алгоритм Data Mining
Какие плюсы у векторизация текста Word2Vec?
улавливает семантические и синтаксические отношения между словами
прост в понимании и имплементации
обучение требует значительно меньше времени
хорошо работает для задач поиска документов
Какие два основных подхода лежат в основе векторного представления текста Word2Vec ?
CBOW
(Continuous Bag of Words)
IDF мера
Skip-gram
Neural Network
Какой основной плюс у ELMo (Embeddings from Language Models) ?
улучшает обычные методы векторного представления слов
использует ChatGPT для распознования контекста
использует GRU нейронные сети
использует алгоритм PageRank для ранжирования текста
Что такое BERT трансформер?
библиотека Python, дающие простые методы обработки текста
база данных, содержащая большие объемы текста
трансформер, предобученный на большом корпусе текста
фреймворк Python с набором библиотек и правил их использования
Какую библиотеку Python используют для работы с табличными данными в Data Science?
NumPy
Matplotlib
Pandas
OpenCV
Нахождение неизвестных значений функции вне интервала по имеющемуся набору известных значений - это?
Классификация
Линейная регрессия
Экстраполяция
Интерполяция
Что из этого не является примером применения Computer Vision в ML?
Распознавание объектов
Распознавание жестов
Распознавания рукописного ввода
Распознавание речи
Что такое "переобучение" (overfitting) в контексте машинного обучения?
Модель слишком проста и не способна обобщать данные
Модель идеально соответствует обучающим данным, но плохо работает на новых данных
Модель никогда не обучается из-за недостаточного количества данных
Модель перегрета от пересыщенности информацией
На какие составляющие раскладывает ETS декомпозиция временной ряд?
(выберите верные варианты)
компонент тренда
интеграционный
компонент
сезонный компонент
остаток
Какой метод вам поможет подобрать параметры модели для алгоритма SARIMA?
auto_arima
find_correlation
auto_fit
fit
Для каких целей необходима библиотека tsfresh?
вычисляет признаки временных
рядов
обучает модель данных с минимальной ошибкой
предлагает параметры модели для SARIMA
подбирает эффективный алгоритм для временных рядов
Что такое стационарный временной ряд?
среднее значение не изменяется во времени
временной ряд который имеет тренд
среднее значение изменяется во времени
временной ряд в котором среднее совпадает с медианой
Какие фреймворки Python удобны для создания REST API
модели машинного обучения?
Angular
Django
Flask
Hibernate
В основном для какой цели используется RandomForestRegressor?
Для построения модели классификации
Для построения модели регрессии
Для определения важности признаков
Для построения модели кластеризации
В каких сферах деятельности (доменах) можно применить библиотеку nltk?
Sentiment Analysis
Chatbots
Social Media monitoring
Document Analysis
Выберите существующие этапы в рамках работы с текстом в NLP.
Токенизация
Tagging
Parsing
Information Extraction
Что происходит в рамках этапа - Deep Learning NLP?
Применение алгоритмов Data Mining для различных задач NLP
Применение глубоких нейронных сетей для различных задач NLP
Применение алгоритмов регрессивного анализа для различных задач NLP
Применение алгоритмов прогнозирования для различных задач NLP
Метод "приведение текста к нижнему регистру" к какому этапу NLP относится?
Tokenization
Parsing
Word Sense Disambiguation
Text Preprocessing
Для каких целей из текста мы удаляем стоп-слова?
Убрать лишний шум при последующем анализе текста в NLP
Стоп слова являются неверными и мы должны их удалять
Стоп слова являются лишними для алгоритмов Data Mining
Стоп слова являются дополнительным стимулом для их анализа в отдельном блоке
Что такое TF-IDF?
Алгоритм кластеризации текста
Статическая мера
Нейронная сетевая модель
Алгоритм Data Mining
Какие плюсы у векторизация текста Word2Vec?
улавливает семантические и синтаксические отношения между словами
прост в понимании и имплементации
обучение требует значительно меньше времени
хорошо работает для задач поиска документов
Какие два основных подхода лежат в основе векторного представления текста Word2Vec ?
CBOW
(Continuous Bag of Words)
IDF мера
Skip-gram
Neural Network
Какой основной плюс у ELMo (Embeddings from Language Models) ?
улучшает обычные методы векторного представления слов
использует ChatGPT для распознования контекста
использует GRU нейронные сети
использует алгоритм PageRank для ранжирования текста
Что такое BERT трансформер?
библиотека Python, дающие простые методы обработки текста
база данных, содержащая большие объемы текста
трансформер, предобученный на большом корпусе текста
фреймворк Python с набором библиотек и правил их использования
Какой архитектуры нейронных сетей не существует?
ResNet
AlexNext
VGG
LeNet5
Какого процесса в Дата Аналитике не существует?
Cleaning
Evaluation
Integration
Truncating
Какие алгоритмы по исследованию социальных графов и взаимосвязей web страниц существуют?
HITS
PageRank
SALSA
Google Dance
Какую тему в данный момент мы проходим по курсу лекций? :)
Linear Regression
RNN-LTSM
Word2Vec
LLM модели
По какому обычно закону распределения распределены данные?
Распределение Кристофенсона
Нормальное распределение
Равномерное распределение
Распределение Пуассона
Какие параметры определяют модель линейной регрессии
Вектор
свободных коэффициентов
Вектор коэффициента наклона
Зависимые переменные
Независимые переменные
Какой метрики качества модели машинного обучения не существует?
F1 мера
Accuracy
Latency
ROC AUC
Какие типы задач решаются в классическом машинном обучении?
Классификация
Кластеризация
Ассоциация
Поиск
Что такое Мультиколлинеарность?
Наличие линейной зависимости между независимыми переменными
Наличие полиномиальной зависимости между независимыми переменными
Отсутствие линейной зависимости между независимыми переменными
Отсутствие полиномиальной зависимости между независимыми переменными
Что такое Регуляризация?
способ предотвратить недообучение модели
способ предотвратить переобучение модели
один из гиперпараметров модели
независимая переменная
К чему в большей степени чувствителен метод SVM?
к углу наклона опорного вектора
к прохождению гиперплоскости к исследуемым данным
к длине зазора
к масштабированию данных
Какие задачи решает метод "Дерево решений"?
Классификация
Скраппинг
Регрессия
Майнинг
Какого алгоритма для метода "Дерево решений" не существует?
ID3
C4.5
CART
PageRank
Какую задачу решает алгоритм Principal Component Analysis?
Классификации данных
Неточный поиск данных
Точный поиск данных
Уменьшение размерности данных
Какие виды расстояний между объектами вы знаете?
Евклидово расстояние
Расстояние Манхэттена
Энтропное Расстояние
Расстояние Чебышева
С какого шага начинается алгоритм k-means?
Пересчитывается центр самого приоритетного кластера
произвольно выбираются центры кластеров k точек
Пересчитывается центр каждого кластера
произвольно выбираются центры кластеров k-2 точек
Какие виды алгоритмов существуют для метода "Иерархической кластеризации"?
Нисходящие алгоритмы
Прямые алгоритмы
Восходящие алгоритмы
Косвенные алгоритмы
Какие ансамбли моделей машинного обучения вы знаете?
Стекинг
Форматтинг
Бэггинг
Бустинг
Какие функции активации для нейронных сетей вы знаете?
сигмоида
tanh
ReLu
Elu
Работа в основном с какими объектами удобна в библиотеке pyTorch?
с базой данных
с тензорами
с текстом
с большими данными
Что такое Автокодировщики в нейронных сетях?
Специальная архитектура искусственных нейронных сетей
Способ преобразования данных
Способ трансформации данных
Способ применения масштабирования к данным
