Репост из: ИИ — svodka.ai: краткие сводки каналов
📮 «Золотые» слои нейросетей, 128k-контекст из Китая, видеогенерация fp8 и дрон, экономящий 90% времени — разбор главных ИИ-новостей дня за минуту.
📆 Искусственный интеллект – сводка за 28 июля
Серединные слои нейросетей — источник самых ценных эмбеддингов
🧠 В посте “Неискусственный интеллект” рассказывается, как именно серединные слои современных трансформеров формируют наиболее информативные и стабильные эмбеддинги для задач поиска и смыслового анализа. Благодаря self-attention, feedforward-блокам и residual-соединениям, эти слои обеспечивают глубокое понимание данных, а сами эмбеддинги создаются на лету и сразу идут в работу.
GLM 4.5: китайская MoE LLM с рекордным контекстом и прокачанными агентными навыками
🚀 Канал “эйай ньюз” делится подробностями о новой GLM 4.5: модель поддерживает контекст до 128к токенов, function calling, стриминг и batching прямо «из коробки». Она тренирована на 22 триллионах токенов, использует глубокую архитектуру с множеством attention heads, а посттрейнинг с self-distillation и RL-обучением экспертов усиливает навыки поиска и программирования. Модель доступна по MIT-лицензии и совместима с vLLM/SGLang.
Wan 2.2 от Alibaba: видеогенерация нового уровня с MoE и fp8-весами
🎥 В “Psy Eyes” пишут, что видеогенератор Wan 2.2 теперь поддерживает ComfyUI, работает в двух вариантах (5B и 14B), а качество и детализация видео заметно выросли. Новые fp8-веса и поддержка сообществом расширяют возможности оптимизации, а творческий конкурс Wan Muse подогревает интерес к продукту.
📆 Искусственный интеллект – сводка за 28 июля
Серединные слои нейросетей — источник самых ценных эмбеддингов
🧠 В посте “Неискусственный интеллект” рассказывается, как именно серединные слои современных трансформеров формируют наиболее информативные и стабильные эмбеддинги для задач поиска и смыслового анализа. Благодаря self-attention, feedforward-блокам и residual-соединениям, эти слои обеспечивают глубокое понимание данных, а сами эмбеддинги создаются на лету и сразу идут в работу.
GLM 4.5: китайская MoE LLM с рекордным контекстом и прокачанными агентными навыками
🚀 Канал “эйай ньюз” делится подробностями о новой GLM 4.5: модель поддерживает контекст до 128к токенов, function calling, стриминг и batching прямо «из коробки». Она тренирована на 22 триллионах токенов, использует глубокую архитектуру с множеством attention heads, а посттрейнинг с self-distillation и RL-обучением экспертов усиливает навыки поиска и программирования. Модель доступна по MIT-лицензии и совместима с vLLM/SGLang.
Wan 2.2 от Alibaba: видеогенерация нового уровня с MoE и fp8-весами
🎥 В “Psy Eyes” пишут, что видеогенератор Wan 2.2 теперь поддерживает ComfyUI, работает в двух вариантах (5B и 14B), а качество и детализация видео заметно выросли. Новые fp8-веса и поддержка сообществом расширяют возможности оптимизации, а творческий конкурс Wan Muse подогревает интерес к продукту.