TGStat
TGStat
Введите текст для поиска
Расширенный поиск каналов
  • flag Russian
    Язык сайта
    flag Russian flag English flag Uzbek
  • Вход на сайт
  • Каталог
    Каталог каналов и чатов Региональные подборки Тематические подборки Платные каналы Поиск каналов
    Добавить канал/чат
  • Рейтинги
    Рейтинг каналов Рейтинг чатов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Telegram
  • Продвижение
    Реклама через Яндекс Бизнес Реклама в каналах через TGStat Agency Реклама на сайте TGStat.ru
Все о блокчейн/мозге/space/WEB 3.0 в России и мире

12 Mar, 11:10

Открыть в Telegram Поделиться Пожаловаться

Nvidia раздаёт агентов бесплатно. Вы понимаете, зачем?

NVIDIA выпустила опен сорс модель Nemotron - Super. У нее 120 млрд параметров суммарно, но активных при инференсе только 12млрд - суть всей истории: мощь большой модели при стоимости маленькой.

Щедро? На самом деле, это классический их манёвр.
Они уже делали это с CUDA. Бесплатный инструмент для разработчиков, а потом все пишут под их железо, а продажи GPU становятся безальтернативными. Теперь та же логика, но ставка - экономика ИИ-агентов. Еще они объявили, что потратят $26млрд в опен сорс.

Nemotron - Super решает 2 реальные проблемы агентных систем:

1. мультиагентные системы генерируют до 15x больше токенов, чем обычные чаты, и агенты постепенно теряют связь с исходной задачей.

2. большие рассуждающие модели слишком дороги, чтобы гонять их на каждом шаге агентного пайплайна.

Super отвечает на оба: гибридная архитектура Mamba-Transformer даёт контекстное окно в 1млн токенов при линейной стоимости, а Latent MoE активирует только нужных "экспертов" в нужный момент.

Но главное не в модели, а в стеке. Вместе с Super NVIDIA выпускает NeMo Gym (среды для обучения агентов), NeMo RL (reinforcement learning), собственный бенчмарк PinchBench, заточенный под OpenClaw. Кто строит агентов на этом стеке, тот постепенно думает об агентах на языке NVIDIA.

А нативная оптимизация под Blackwell делает остальное: на H100 работает, на B200 в 4 раза быстрее.

Открытый исходный код - это не конкуренция за пользователей. Это борьба за то, на чьём железе будет работать множество агентов.

Больше полезных материалов у нас на Patreon
All about AI, Web 3.0, BCI
Nvidia introduced Nemotron 3 Super — 120B total / 12B active, Hybrid SSM Latent MoE, designed for Blackwell. The entire post-training stack is open (Apache 2.0). Blog post. Scaling RL software, infra, and data keeps yielding major capability gains. Nvidia trained across 30 RL environments with ...

3.1k 3 74 4 28
Каталог
Каталог каналов и чатов Подборки каналов Поиск каналов Добавить канал/чат
Рейтинги
Рейтинг каналов Telegram Рейтинг чатов Telegram Рейтинг публикаций Рейтинги брендов и персон
API
API статистики API поиска публикаций API Callback
Наши каналы
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Почитать
Академия TGStat Исследование Telegram 2019 Исследование Telegram 2021 Исследование Telegram 2023
Контакты
Справочный центр Поддержка Почта Вакансии
Всякая всячина
Пользовательское соглашение Политика конфиденциальности Публичная оферта
Наши боты
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot