РЕАЛЬНОЕ собеседование на Data Scientist. Алгоритмы + Python
Разбор интервью Data Scientist с вопросами по Python и SQL, статистике, деревьям и ансамблям. Включает алгоритмические задачи и обсуждение нейросетей.
Вадим Новосёлов | Карьера в IT
Открыть на YouTube- Опубликовано на YouTube:
- Просмотры на YouTube: 16,2 тыс.
- Лайки на YouTube: 391
Таймлайн
Коротко о видео
Интервью последовательно проверяет SQL, устройство Python, статистику, классические ансамбли и основы нейросетей. Задачи требуют не вспомнить термин, а объяснить механику: как устроен словарь, на чём учатся деревья бустинга и почему одинаковая инициализация весов ломает обучение.
Затронутые темы
Что взять на заметку
- Медиану в SQL можно искать через оконную нумерацию и брать один или два центральных элемента в зависимости от чётности числа строк.
- У словаря доступ по ключу в среднем константный благодаря хеш-таблице, но ответ должен учитывать коллизии и требование хешируемости ключа.
- В Random Forest деревья обучаются независимо на бутстрэп-выборках и подмножествах признаков, а в бустинге новое дерево исправляет ошибки текущего ансамбля.