Маск хочет конкурировать с Цукербергом по созданию крупнейшей вычислительной системы для обучения ИИ
Но как показывает время, часто Маск много говорит, а результаты не успевают за его обещаниями. Дочитайте до конца.
Для начала про Цукерберга.
Марк во вторник заявил, что для обучения Llama 4 нужно в 10 раз больше мощностей, чем для Llama 3. Намерен сделать Llama 4 самой продвинутой моделью в отрасли в 2025 году.
А вот, что Маск.
В июле он написал в своем X (twitter) о планах выпустить ИИ Grok-3 к 2024 года, для обучения которой потребуется кластер из 100 000 GPU Nvidia H100.
А Grok-2 планировалась к обучению на 24 000 GPU Nvidia H100, предположительно используя облачную инфраструктуру Oracle.
Он говорил, что она будет готова в августе.
Между тем, стало известно, что сделка на $10 млрд между xAI и Oracle по использованию GPU-кластеров сорвалась 3 недели назад.
В ответ на это Маск решил построить собственный вычислительный центр Gigafactory of Compute в Мемфисе, штат Теннесси, используя бывшую фабрику Electrolux.
Планируется, что этот центр будет использовать 150 мегаватт электроэнергии, хотя в настоящее время доступно только 8 мегаватт.
Маск назвал проект SuperCluster, что похоже на термин, использованный Meta (запрещенная организация в России) для своей ИИ-системы.
Ожидается, что полная мощность в 100 000 GPU может быть достигнута только к концу 2025 года, а к декабрю 2024 года может быть доступно около 25 000 GPU.
Supermicro, вероятно, поставляет серверную инфраструктуру для проекта.
Nvidia, похоже, обеспечивает сетевое оборудование для внутренней коммуникации кластера (east-west), а Juniper Networks - для внешней (north-south).
Пока нет информации о системе хранения данных для суперкластера, но предполагается возможное участие Vast Data.
Но как показывает время, часто Маск много говорит, а результаты не успевают за его обещаниями. Дочитайте до конца.
Для начала про Цукерберга.
Марк во вторник заявил, что для обучения Llama 4 нужно в 10 раз больше мощностей, чем для Llama 3. Намерен сделать Llama 4 самой продвинутой моделью в отрасли в 2025 году.
А вот, что Маск.
В июле он написал в своем X (twitter) о планах выпустить ИИ Grok-3 к 2024 года, для обучения которой потребуется кластер из 100 000 GPU Nvidia H100.
А Grok-2 планировалась к обучению на 24 000 GPU Nvidia H100, предположительно используя облачную инфраструктуру Oracle.
Он говорил, что она будет готова в августе.
Между тем, стало известно, что сделка на $10 млрд между xAI и Oracle по использованию GPU-кластеров сорвалась 3 недели назад.
В ответ на это Маск решил построить собственный вычислительный центр Gigafactory of Compute в Мемфисе, штат Теннесси, используя бывшую фабрику Electrolux.
Планируется, что этот центр будет использовать 150 мегаватт электроэнергии, хотя в настоящее время доступно только 8 мегаватт.
Маск назвал проект SuperCluster, что похоже на термин, использованный Meta (запрещенная организация в России) для своей ИИ-системы.
Ожидается, что полная мощность в 100 000 GPU может быть достигнута только к концу 2025 года, а к декабрю 2024 года может быть доступно около 25 000 GPU.
Supermicro, вероятно, поставляет серверную инфраструктуру для проекта.
Nvidia, похоже, обеспечивает сетевое оборудование для внутренней коммуникации кластера (east-west), а Juniper Networks - для внешней (north-south).
Пока нет информации о системе хранения данных для суперкластера, но предполагается возможное участие Vast Data.