Видео недоступно для предпросмотра
Смотреть в Telegram
✔️ США освободили китайские открытые модели от обязательного тестирования
Белый дом вывел китайские модели с открытыми весами из-под действия нового регламента ИИ-безопасности. Администрация США отказалась от их обязательного тестирования, о чем сообщила представителям OpenAI, Anthropic и Google на закрытом брифинге.
Регулятор ужесточил контроль после апрельского предупреждения от Anthropic перед релизом Mythos. Дополнительным поводом послужили недавние инциденты, когда системы OpenAI и Anthropic выходили за пределы тестовых сред в инфраструктуру сторонних организаций.
Исключение для китайских решений противоречит позиции CEO Anthropic Дарио Амодеи, который требовал внедрить обязательные проверки для всех разрабатываемых моделей.
zaobao.com.sg
✔️ В Google DeepMind произошли кадровые перестановки
Демис Хассабис перешел с поста главы DeepMind на позицию Chief Scientist материнской компании Alphabet. Он сфокусируется на стратегии AGI и развитии медицинского ИИ в Isomorphic Labs. Повседневное управление DeepMind и разработка семейства Gemini перешли к Кораю Кавукчуоглу, бывшему техническому директору подразделения.
Одновременно Google покинул Джефф Дин, проработавший в корпорации 27 лет. Вместе с Санджаем Гемаватом, Ориолом Виньялсом и Куоком Ле он основал стартап Discovery Loop, который планирует заниматься автоматизацией ML-экспериментов. Проект привлек инвестиции от крупных фондов и самой Alphabet.
blog.google
✔️ Black Forest Labs открыла доступ к FLUX 3 Video
Модель доступна через собственный API немецкого стартапа и платформы партнеров. Она генерирует ролики до 20 секунд в HD и Full HD со звуковой дорожкой, фоновыми шумами, спецэффектами и речью.
Модель поддерживает text-to-video, image-to-video и video-to-video и работает с ключевыми кадрами, а также может менять сцену и ракурс внутри одного видео, продолжать видеоряд и рендерить текст в кадре. Для речи заявлен липсинк на 14 языках. По внутренним бенчмаркам Elo FLUX 3 обходит Gemini Omni Flash, Minimax H3 и Seedance 2.0.
Тарификация в API посекундная, генерация звука включена в стоимость. В HD-режиме T2V и I2V обойдутся в $0,06/сек, а обработка видео - в $0,12/сек. В Full HD цены составляют $0,29 и $0,53 за секунду соответственно.
bfl.ai
✔️ ByteDance представила полнодуплексную аудиовизуальную модель с проактивным взаимодействием
Китайский техногигант выпустил мультимодальную модель SeedRealtime для взаимодействия в реальном времени, которая параллельно обрабатывает аудио, видео и текст.
Технической фишкой стал отказ от систем обнаружения голосовой активности. Очередность реплик контролируется через совместное непрерывное моделирование звука, визуальных данных и временных параметров. Модель самостоятельно определяет, когда вступить в диалог, сделать паузу или отфильтровать фоновый шум.
SeedRealtime не ждёт команд, она фоном анализирует визуальный контекст, отслеживает нескольких спикеров и способна инициировать общение, реагируя на события или объекты в кадре.
ByteDance заявляет, что система уже развернута на практике, но сведения о доступности в пресс-релизе не приводятся.
bytedance.com
✔️ Mixture-of-Kittens: инструмент для ускорения обучения MoE-моделей на NVIDIA Blackwell
Cursor выложила инструмент Mixture-of-Kittens (MoK) для ускорения обучения MoE-моделей на архитектуре NVIDIA Blackwell.
MoK решает проблему задержек при обмене данными между GPU - в MoE-сетях этот процесс может занимать более половины времени обучения. Инструмент объединяет маршрутизацию токенов и вычисления в единый низкоуровневый массив для их параллельного выполнения и минимизации простоя оборудования.
В тестах на кластере из 512 GB300 общая пропускная способность выросла на 41%, а обработка MoE-слоев ускорилась в 2,37 раза по сравнению с аналогами. По словам Cursor, компания применяет MoK для обучения модели Composer.
Инструмент работает исключительно с архитектурой NVIDIA Blackwell и открыт под лицензией Apache 2.0.
cursor.com
@ai_machinelearning_big_data
#news #ai #ml
Белый дом вывел китайские модели с открытыми весами из-под действия нового регламента ИИ-безопасности. Администрация США отказалась от их обязательного тестирования, о чем сообщила представителям OpenAI, Anthropic и Google на закрытом брифинге.
Регулятор ужесточил контроль после апрельского предупреждения от Anthropic перед релизом Mythos. Дополнительным поводом послужили недавние инциденты, когда системы OpenAI и Anthropic выходили за пределы тестовых сред в инфраструктуру сторонних организаций.
Исключение для китайских решений противоречит позиции CEO Anthropic Дарио Амодеи, который требовал внедрить обязательные проверки для всех разрабатываемых моделей.
zaobao.com.sg
✔️ В Google DeepMind произошли кадровые перестановки
Демис Хассабис перешел с поста главы DeepMind на позицию Chief Scientist материнской компании Alphabet. Он сфокусируется на стратегии AGI и развитии медицинского ИИ в Isomorphic Labs. Повседневное управление DeepMind и разработка семейства Gemini перешли к Кораю Кавукчуоглу, бывшему техническому директору подразделения.
Одновременно Google покинул Джефф Дин, проработавший в корпорации 27 лет. Вместе с Санджаем Гемаватом, Ориолом Виньялсом и Куоком Ле он основал стартап Discovery Loop, который планирует заниматься автоматизацией ML-экспериментов. Проект привлек инвестиции от крупных фондов и самой Alphabet.
blog.google
✔️ Black Forest Labs открыла доступ к FLUX 3 Video
Модель доступна через собственный API немецкого стартапа и платформы партнеров. Она генерирует ролики до 20 секунд в HD и Full HD со звуковой дорожкой, фоновыми шумами, спецэффектами и речью.
Модель поддерживает text-to-video, image-to-video и video-to-video и работает с ключевыми кадрами, а также может менять сцену и ракурс внутри одного видео, продолжать видеоряд и рендерить текст в кадре. Для речи заявлен липсинк на 14 языках. По внутренним бенчмаркам Elo FLUX 3 обходит Gemini Omni Flash, Minimax H3 и Seedance 2.0.
Тарификация в API посекундная, генерация звука включена в стоимость. В HD-режиме T2V и I2V обойдутся в $0,06/сек, а обработка видео - в $0,12/сек. В Full HD цены составляют $0,29 и $0,53 за секунду соответственно.
bfl.ai
✔️ ByteDance представила полнодуплексную аудиовизуальную модель с проактивным взаимодействием
Китайский техногигант выпустил мультимодальную модель SeedRealtime для взаимодействия в реальном времени, которая параллельно обрабатывает аудио, видео и текст.
Технической фишкой стал отказ от систем обнаружения голосовой активности. Очередность реплик контролируется через совместное непрерывное моделирование звука, визуальных данных и временных параметров. Модель самостоятельно определяет, когда вступить в диалог, сделать паузу или отфильтровать фоновый шум.
SeedRealtime не ждёт команд, она фоном анализирует визуальный контекст, отслеживает нескольких спикеров и способна инициировать общение, реагируя на события или объекты в кадре.
ByteDance заявляет, что система уже развернута на практике, но сведения о доступности в пресс-релизе не приводятся.
bytedance.com
✔️ Mixture-of-Kittens: инструмент для ускорения обучения MoE-моделей на NVIDIA Blackwell
Cursor выложила инструмент Mixture-of-Kittens (MoK) для ускорения обучения MoE-моделей на архитектуре NVIDIA Blackwell.
MoK решает проблему задержек при обмене данными между GPU - в MoE-сетях этот процесс может занимать более половины времени обучения. Инструмент объединяет маршрутизацию токенов и вычисления в единый низкоуровневый массив для их параллельного выполнения и минимизации простоя оборудования.
В тестах на кластере из 512 GB300 общая пропускная способность выросла на 41%, а обработка MoE-слоев ускорилась в 2,37 раза по сравнению с аналогами. По словам Cursor, компания применяет MoK для обучения модели Composer.
Инструмент работает исключительно с архитектурой NVIDIA Blackwell и открыт под лицензией Apache 2.0.
cursor.com
@ai_machinelearning_big_data
#news #ai #ml