Дата-инженерские заметки


Гео и язык канала: Россия, Русский
Категория: Карьера


Пытаюсь выжить в корпоративных реалиях, делюсь вопросами с дата-инженерских собеседований и ссылочками для подготовки к ним
Написать мне: @aylin_gee

Связанные каналы  |  Похожие каналы

Гео и язык канала
Россия, Русский
Категория
Карьера
Статистика
Фильтр публикаций


✍🏽✍🏽✍🏽


океей


Забыла рассказать, что у меня закончился испытательный срок и теперь я работаю в X5.

В целом впечатления положительные: мне нравится руководитель - хороший баланс между готовностью помочь, заинтересованностью и доверием к подчинённым.

В команде современный стек: Trino, ClickHouse, S3 и Iceberg и, в теории, реально выпросить развивающие
технически задачи.

Отбор был в два этапа: лайвкодинг и микс технички и фита: было интересно - давали кейсы, банальных вопросов было мало. Проблем с моей вилкой на этапе оффера тоже не возникло.
Ранее X5 Tech проводили транляцию собеседования на дата инженера, так вот у меня было почти также, и вопросы мне задавал тот же собеседующий.

Не хватает мне только возможности зимовки на Бали и коллег повайбовей, но это терпимо.


смирились с оверэмплойментом получается

с другой стороны, это интересный ход — так можно найти квалифицированных кандидатов, которым нужна 2-3ья работа, за зп ниже рынка


спите?


Как вы оцениваете изменение зарплат на российском IT(data) рынке?
Опрос
  •   зарплаты не изменились
  •   зарплаты повысились
  •   зарплаты понизились
2 голосов


хочу

974 0 21 6 27

Собеседование в Авито: как после 5 собеседований я не получила оффер

Сейчас отбор в Авито состоит из двух техничек и финалов в команды.
Оба технических этапа длятся примерно час. На первом — одна задача на Python и несколько на SQL. На втором — одна на Python и одна на SQL.
Интервьюеры были приятными — излишне не душнили, а задачи реалистичными — биты двигать не просили.

Финалов было два:
⭕️На первом не дотянула грейдом — им нужен был DE на грейд выше.

🟣Второй финал прошел хорошо. После созвона несколько раз уточнили в чате, точно ли мне нравятся их задачи (на первом финале все, чем занимается эта команда, я отнесла в категорию «чем заниматься не хочу» ахахах). После долгого игнора прислали отказ.
* Был еще финал с командой, у которой открытой вакансии нет, но может открыться (так и не появилась).

Не понравились долгие ответы HR и команды, долгий перерыв между техничками и финалом.
Заниматься таким думаю стоит только если прям очень хотите в Авито или же если проходите отбор в рамках One day offer.
Возможно, если ищите работу и не целитесь в определенную команду/компанию, игра не стоит свеч. Однако это все же мой личный опыт и у вас все может проходить иначе.

Что думаете?


Influence назвали оттенок помады ‘потоком данных’😭

жду выхода оттенка ‘ETL’


даже самой Grimes пришлось создать Linkedin аккаунт

ну, и времена


как вам такое?🤭🙏🏽

1.5k 0 15 22 51

Дорогие девушки этого канала, с праздником! 🌟

Не забывайте, какие вы крутые профессионалки и сколько всего уже достигли!

Продолжайте верить в себя и в друг друга!💗


Русское слово «сложно» на английский можно перевести как difficult или hard.
Однако эти два прилагательных не взаимозаменяемы.

Для примера возьмём процесс набора мышечной массы хаха. Алгоритм действий понятен — следить за КБЖУ и заниматься силовыми тренировками. То есть всё вполне ясно и оттого вовсе не difficult, но при этом hard, потому что требует много дисциплины и мотивации.

Надеюсь, аналогия понятна.

Так вот, дата-инжиниринг для меня не hard, но действительно difficult. И прежде всего из‑за «солянки» технологий, которые постоянно меняются и быстро устаревают.
Чтобы оставаться востребованным на рынке труда, нужно постоянно разбираться в новом дата‑стеке. Но и этого недостаточно — работодатель ждёт не только понимания требуемых технологий, но и подтверждённого промышленного опыта работы с ними.
Чего, например, не наблюдается у тех же самых бэкендеров.

Что делаете вы?
Изучаете всё самостоятельно и приукрашиваете опыт, рассказывая о якобы реализованных проектах, или честно признаётесь, надеясь на адекватность потенциального работодателя?


Уже все телеграм каналы обсудили эту плашку у Ozon’a, но мне все равно хочется кое-что отметить.

Забавляет не сама плашка, а то, что она у Ozon’a.

Забавляет, потому что ни одна компания не отказывала мне так часто именно по причине нехватки опыта, как Ozon (те же самые Авито и Яндекс, например, резюме рассматривают),
и из-за того, сколько знакомых накрутчиков там работают.

Эта зацикленность на количестве лет в итоге работает как «самоисполняющееся пророчество» — чем жестче это требование, тем больше кандидатов добавляют себе годы опыта.

В любом случае, факта, что Ozon — классный работодатель, это не отменяет.


у меня нет слов, одни эмоции

1.2k 0 36 21 25

Репост из: что-то на инженерном
В продолжение вчерашней темы делюсь серией статей - Mastering Trino and Apache Iceberg: The Modern Data Stack Explained.

Коротко: серия объясняет, как Trino и Iceberg вместе решают проблемы масштабирования, производительности и управления данными, заменяя устаревшие подходы (вроде Hive) и открывая путь к modern data stack 💅🏼

Будет очень полезно тем, кто планировал основательно разобраться с Trino и Iceberg, но откладывал это. На мой взгляд, в этой серии лучшая выжимка базы по этим инструментам.

Статьи серии:
1️⃣ Parquet и Iceberg: Фундамент Data-Архитектур
→ Зачем нужны колоночные форматы (Parquet) и табличные (Iceberg).

2️⃣ Apache Iceberg: Будущее управления данными
→ ACID, версионирование, time travel — как Iceberg решает большие проблемы data lakes.

3️⃣ Архитектура Trino и интеграция Trino и Iceberg
→ Как Trino взаимодействует с Iceberg-таблицами на уровне метаданных и данных.

4️⃣ Распределенная обработка запросов в Trino
→ Из чего состоит Trino Workflow и конфигурация источников данных

5️⃣ Мульти-источники данных в Trino
→ Как Trino обрабатывает запросы к разным БД и файловым системам одновременно.

6️⃣ Trino vs Файловые системы
→ Особенности работы со структурированными данными (PostgreSQL, Oracle) и файлами (Parquet в MinIO).

7️⃣ Практика: Запросы к Iceberg через Trino
→ Примеры создания таблиц

8️⃣ Партиционирование в Iceberg
→ Виды партиций и польза от их использования

9️⃣ Джойны и агрегации на Iceberg-таблицах
→ Оптимизация сложных запросов: как избежать «узких мест» в Trino.

1️⃣0️⃣ Iceberg vs Hive: Что лучше?
→ Чем метаданные Iceberg лучше Hive, и как это влияет на производительность.

1️⃣1️⃣ Разбор мифа «Создание таблиц Iceberg дублирует данные?»
→ Как Iceberg управляет данными через метаданные без копирования.




вы любите свою работу?
Опрос
  •   нет
  •   да
  •   не сказать, что ненавижу, но и удовольствия особого не получаю
19 голосов


признавайтесь
кто?

1.6k 0 22 14 31

Который раз читаю посты, в которых авторы гордятся, что на этапе скрининга резюме отклонили менторов, которые сливают вопросы или учат накрутке.
Я могу еще понять отказ самим накрутчикам, но менторам…

Более яркого примера синдрома вахтера я не встречала. Понятное дело, что при отборе оцениваются не только навыки, и что вам вполне могут отказать по высосанным из пальца причинам, но вот так открыто это признавать…

К тому же, если ваш отбор может разрушится от слива вопросов, то может проблема не в ужасных кандидатах, а в том как проводятся собеседования?
Может стоит перестать задавать однотипные вопросы и мучить кандидатов оконками?

Если это новая норма, то я срочно становлюсь лидом и отбираю исключительно по вайбам и стилю.
После пишу пост о том, что не пропустила дата-инженера в скинни джинсах, а вы в комментах восхищаетесь, какой я крутой лидер!

PS: накрутку не поддерживаю, сама не накручиваю

Что думаете на этот счет?
❤️ - не поддерживаю такой отбор
😭 - считаю такой отбор абсолютно правильным

Показано 20 последних публикаций.