Мы начали собирать summary по собесам 👨💻
Готовы поделиться с вами наиболее интересными вопросами по Spark на разные грейды:
- В чём разница между методами repartition()и coalesce()? Когда какой использовать?
- Что такое перетасовка (Shuffling) в Spark? Почему она считается дорогой операцией и как её минимизировать?
- Какие уровни сохраняемости (persistence levels) есть в Spark? Как выбрать подходящий?
- Как обеспечить обработку «ровно один раз» (exactly-once) в структурированной потоковой передаче?
- Какие параметры конфигурации Spark чаще всего настраивают для оптимизации производительности?
Готовы поделиться с вами наиболее интересными вопросами по Spark на разные грейды:
- В чём разница между методами repartition()и coalesce()? Когда какой использовать?
- Что такое перетасовка (Shuffling) в Spark? Почему она считается дорогой операцией и как её минимизировать?
- Какие уровни сохраняемости (persistence levels) есть в Spark? Как выбрать подходящий?
- Как обеспечить обработку «ровно один раз» (exactly-once) в структурированной потоковой передаче?
- Какие параметры конфигурации Spark чаще всего настраивают для оптимизации производительности?