📮 От воронки любви до браузера с локальными AI-агентами: почему версия данных спасает ML, а коммуникация ценнее кода? Разбираем 12 свежих идей — открой, пока они не убежали.
📆 Data Science – сводка за 9 июля
Версионирование данных и моделей — залог стабильности ML-процессов
🗂 Без грамотного версионирования датасетов и ML-моделей эксперименты становятся непредсказуемыми, а отладка — мучительной. В “Библиотека дата-сайентиста” советуют внедрять DVC, LakeFS, MLflow или Weights & Biases, хранить метаданные и интегрировать версионирование в CI/CD. Такой подход ускоряет отладку, повышает надежность и облегчает деплой.
Hugging Face ускоряет мультимодальное обучение с помощью MMDP
⚙️ Новый инструмент MMDP от Hugging Face, по мнению “Анализ данных”, позволяет эффективнее загружать данные и формировать батчи для мультимодальных моделей. Это сокращает простои GPU, уменьшает количество бесполезных токенов и оптимизирует паддинг, что особенно важно для обучения VLM и LLM с изображениями.
Как писать быстрые SQL-запросы в PostgreSQL: советы из книги Домбровской
📚 В “Аналитика данных / Data Study” рассказывают о книге “Оптимизация запросов в PostgreSQL”, где подробно объясняется, как анализировать планы выполнения и применять техники оптимизации для ускорения работы баз данных. Автор учит смотреть на запросы глазами оптимизатора и создавать действительно эффективные приложения.
📆 Data Science – сводка за 9 июля
Версионирование данных и моделей — залог стабильности ML-процессов
🗂 Без грамотного версионирования датасетов и ML-моделей эксперименты становятся непредсказуемыми, а отладка — мучительной. В “Библиотека дата-сайентиста” советуют внедрять DVC, LakeFS, MLflow или Weights & Biases, хранить метаданные и интегрировать версионирование в CI/CD. Такой подход ускоряет отладку, повышает надежность и облегчает деплой.
Hugging Face ускоряет мультимодальное обучение с помощью MMDP
⚙️ Новый инструмент MMDP от Hugging Face, по мнению “Анализ данных”, позволяет эффективнее загружать данные и формировать батчи для мультимодальных моделей. Это сокращает простои GPU, уменьшает количество бесполезных токенов и оптимизирует паддинг, что особенно важно для обучения VLM и LLM с изображениями.
Как писать быстрые SQL-запросы в PostgreSQL: советы из книги Домбровской
📚 В “Аналитика данных / Data Study” рассказывают о книге “Оптимизация запросов в PostgreSQL”, где подробно объясняется, как анализировать планы выполнения и применять техники оптимизации для ускорения работы баз данных. Автор учит смотреть на запросы глазами оптимизатора и создавать действительно эффективные приложения.