Google тестирует рекламу в ИИ-чатах через AdSense — теперь реклама появится прямо в диалогах
📢 В “Machinelearning” отмечают, что Google уже тестирует размещение рекламы в чатах Ask и Liner, а AdSense для Поиска теперь доступен сайтам, желающим показывать релевантные объявления в своих AI-диалогах. Это может изменить привычный опыт общения с чат-ботами. Другие посты об этом же: один
Facebook-research ужесточил правила конфиденциальности для умных очков Ray-Ban — голосовые записи теперь сохраняются в облаке
🔒 В “Machinelearning” сообщают, что с 29 апреля отключить сохранение голосовых записей в облаке нельзя, а удалить их можно только вручную. Аудиозаписи и их транскрипты будут храниться до года для улучшения продуктов. Другие посты об этом же: один
ReasonIR: новый инструмент для обучения ИИ глубоким рассуждениям и поиску информации
📚 В “Machinelearning” представили ReasonIR, который учит ретриверы отличать полезную информацию с помощью синтетических данных и “ложных” документов. Модель ReasonIR-8B показала заметный рост точности в RAG-сценариях.
CSV не сдаёт позиций: формат данных, который пережил десятки конкурентов за 50 лет
🗂 В “Left Join” объясняют, почему CSV до сих пор популярен: он прост, открыт, легко редактируется в любом текстовом редакторе, требует минимум ресурсов и невероятно гибок.
Chatbot Arena под подозрением: исследование выявило предвзятость рейтинга чат-ботов
⚠️ В “Data Secrets” рассказывают, что крупные провайдеры получают нечестное преимущество из-за приватного тестирования и разного количества диалогов, что приводит к завышенным результатам их моделей в рейтинге Chatbot Arena.
Как анализировать конкурентов в Telegram с помощью ChatGPT: пошаговый алгоритм
🔍 В “Клуб анонимных аналитиков” делятся методом анализа контента конкурентов с помощью экспорта истории чата и серии промтов. Это позволяет выявить самые вовлекающие посты, темы и стиль автора.
5 библиотек для разведочного анализа данных в Python — ускорьте EDA в разы
📊 В “Библиотека дата-сайентиста” советуют использовать pandas_profiling, Sweetviz, D-Tale, Skimpy и AutoViz для быстрой генерации отчетов, визуализации и интерактивного анализа данных.
McKinsey: дата-продукты должны быть масштабируемыми и переиспользуемыми
🏗 В “Инжиниринг Данных” обсуждают, что дата-продукты — это компоненты для сбора и управления данными, которые должны решать несколько бизнес-задач и легко масштабироваться.
DeepWiki-Open: автоматическая генерация интерактивной вики-документации прямо из кода
📖 В “Анализ данных” представили DeepWiki-Open — инструмент, который анализирует исходный код, создает документацию, визуальные диаграммы и структурирует информацию для удобной навигации по проекту.
💌 Кому из ваших знакомых эти новости тоже будут полезны? Перешлите им почитать!
Data Science. Подписаться на ежедневную svodka.ai
📢 В “Machinelearning” отмечают, что Google уже тестирует размещение рекламы в чатах Ask и Liner, а AdSense для Поиска теперь доступен сайтам, желающим показывать релевантные объявления в своих AI-диалогах. Это может изменить привычный опыт общения с чат-ботами. Другие посты об этом же: один
Facebook-research ужесточил правила конфиденциальности для умных очков Ray-Ban — голосовые записи теперь сохраняются в облаке
🔒 В “Machinelearning” сообщают, что с 29 апреля отключить сохранение голосовых записей в облаке нельзя, а удалить их можно только вручную. Аудиозаписи и их транскрипты будут храниться до года для улучшения продуктов. Другие посты об этом же: один
ReasonIR: новый инструмент для обучения ИИ глубоким рассуждениям и поиску информации
📚 В “Machinelearning” представили ReasonIR, который учит ретриверы отличать полезную информацию с помощью синтетических данных и “ложных” документов. Модель ReasonIR-8B показала заметный рост точности в RAG-сценариях.
CSV не сдаёт позиций: формат данных, который пережил десятки конкурентов за 50 лет
🗂 В “Left Join” объясняют, почему CSV до сих пор популярен: он прост, открыт, легко редактируется в любом текстовом редакторе, требует минимум ресурсов и невероятно гибок.
Chatbot Arena под подозрением: исследование выявило предвзятость рейтинга чат-ботов
⚠️ В “Data Secrets” рассказывают, что крупные провайдеры получают нечестное преимущество из-за приватного тестирования и разного количества диалогов, что приводит к завышенным результатам их моделей в рейтинге Chatbot Arena.
Как анализировать конкурентов в Telegram с помощью ChatGPT: пошаговый алгоритм
🔍 В “Клуб анонимных аналитиков” делятся методом анализа контента конкурентов с помощью экспорта истории чата и серии промтов. Это позволяет выявить самые вовлекающие посты, темы и стиль автора.
5 библиотек для разведочного анализа данных в Python — ускорьте EDA в разы
📊 В “Библиотека дата-сайентиста” советуют использовать pandas_profiling, Sweetviz, D-Tale, Skimpy и AutoViz для быстрой генерации отчетов, визуализации и интерактивного анализа данных.
McKinsey: дата-продукты должны быть масштабируемыми и переиспользуемыми
🏗 В “Инжиниринг Данных” обсуждают, что дата-продукты — это компоненты для сбора и управления данными, которые должны решать несколько бизнес-задач и легко масштабироваться.
DeepWiki-Open: автоматическая генерация интерактивной вики-документации прямо из кода
📖 В “Анализ данных” представили DeepWiki-Open — инструмент, который анализирует исходный код, создает документацию, визуальные диаграммы и структурирует информацию для удобной навигации по проекту.
💌 Кому из ваших знакомых эти новости тоже будут полезны? Перешлите им почитать!
Data Science. Подписаться на ежедневную svodka.ai