Репост из: Noname Research
#AI #LLMs
В голову сейчас пришла интересная мысль. Мысль пришла пока парсил Х для дайджеста. Пока я парсил я обнаружил то, что если вы не платите подписку на Х - у вас в Grok, который встроен Х теперь отсутствует режим усиленного мышления (закрыт доступ к более продвинутой модели Grok, которая юзает более продвинутые чипы для Inference).
Более того - я заметил, что обычный режим, которым я всегда пользовался, теперь стал больше глючить.
Отсюда мысль - по мере развития ИИ люди все больше понимают, что они могут реально упростить и ускорить жизнь - начинают больше пользоваться ИИ - растет нагрузка на серверные мощности LLMок - разработчики LLMок закупают больше серверных мощностей - это приводит к ебейшему ИИ-циклу, который мы с вами наблюдаем
НО сейчас все больше и больше новостей появляется о том, что скоро мы можем увидеть объявления о переносах дата центров. Пишут, что из 12 ГВт ЦОДов которые должны в этом году сдать только треть находится в активной стадии строительства, пишут, что 40% дата-центров могут перенести даты ввода мощностей.
Разработчики LLM видят эти новости, более того, они знают гораздо больше нас и понимают гораздо нас. Соответственно они понимают, что скоро вводы новых серверных мощностей снизятся, а спрос при этом продолжает расти и они не смогут его удовлетворить.
Что они делают? Они начинают отдавать самые новые и самые сильные серверные мощности на Inference только платящим пользователям. А те кто не платит - им достаются только слабые серверные мощности, самые старые, которые есть в арсенале - соотвественно и качество Inference для этих пользователей сильно падает.
Если спрос будет еще больше, то самые хорошие мощности будут уходить только премиум подписчикам. А слабые серверные мощности будут уходить только базовым платящим подписчикам - бесплатники перестанут получать доступ к LLM.
В таком случае конкретный разработчик может потерять рыночную долю - так как пользователи начнут уходить к конкурентам. НО у конкурентов такие же проблемы. Соотвественно дальше если мы увидим реально новости о переносе ЦОДов (а мы их скорее всего реально увидим). - то сейчас базовое мнение что начнется жесткая коррекция всего того что связана с Semiconductors — так как спрос сместится вправо — финансовые прогнозы ближайших лет снизятся потому что цены на чипы скорректируются и успокоятся — мульты резко вырастут — станут неинтересны по таким ценам инвесторам — их распродадут.
Это скорее всего корректный прогноз для тех кто делает чипы и оборудование.
НО ГЛАВНАЯ ФИШКА В ТОМ, что при таком раскладе ТЕ КТО ДЕЛАЮТ САМИ LLM - НАОБОРОТ СМОГУТ НАРАСТИТЬ ВЫРУЧКУ И РЕНТАБЕЛЬНОСТЬ потому что на те же мощности при растущем спросе они смогут повышать ценник, так как их предложение ограничено, а спрос продолжает расти.
В голову сейчас пришла интересная мысль. Мысль пришла пока парсил Х для дайджеста. Пока я парсил я обнаружил то, что если вы не платите подписку на Х - у вас в Grok, который встроен Х теперь отсутствует режим усиленного мышления (закрыт доступ к более продвинутой модели Grok, которая юзает более продвинутые чипы для Inference).
Более того - я заметил, что обычный режим, которым я всегда пользовался, теперь стал больше глючить.
Отсюда мысль - по мере развития ИИ люди все больше понимают, что они могут реально упростить и ускорить жизнь - начинают больше пользоваться ИИ - растет нагрузка на серверные мощности LLMок - разработчики LLMок закупают больше серверных мощностей - это приводит к ебейшему ИИ-циклу, который мы с вами наблюдаем
НО сейчас все больше и больше новостей появляется о том, что скоро мы можем увидеть объявления о переносах дата центров. Пишут, что из 12 ГВт ЦОДов которые должны в этом году сдать только треть находится в активной стадии строительства, пишут, что 40% дата-центров могут перенести даты ввода мощностей.
Разработчики LLM видят эти новости, более того, они знают гораздо больше нас и понимают гораздо нас. Соответственно они понимают, что скоро вводы новых серверных мощностей снизятся, а спрос при этом продолжает расти и они не смогут его удовлетворить.
Что они делают? Они начинают отдавать самые новые и самые сильные серверные мощности на Inference только платящим пользователям. А те кто не платит - им достаются только слабые серверные мощности, самые старые, которые есть в арсенале - соотвественно и качество Inference для этих пользователей сильно падает.
Если спрос будет еще больше, то самые хорошие мощности будут уходить только премиум подписчикам. А слабые серверные мощности будут уходить только базовым платящим подписчикам - бесплатники перестанут получать доступ к LLM.
В таком случае конкретный разработчик может потерять рыночную долю - так как пользователи начнут уходить к конкурентам. НО у конкурентов такие же проблемы. Соотвественно дальше если мы увидим реально новости о переносе ЦОДов (а мы их скорее всего реально увидим). - то сейчас базовое мнение что начнется жесткая коррекция всего того что связана с Semiconductors — так как спрос сместится вправо — финансовые прогнозы ближайших лет снизятся потому что цены на чипы скорректируются и успокоятся — мульты резко вырастут — станут неинтересны по таким ценам инвесторам — их распродадут.
Это скорее всего корректный прогноз для тех кто делает чипы и оборудование.
НО ГЛАВНАЯ ФИШКА В ТОМ, что при таком раскладе ТЕ КТО ДЕЛАЮТ САМИ LLM - НАОБОРОТ СМОГУТ НАРАСТИТЬ ВЫРУЧКУ И РЕНТАБЕЛЬНОСТЬ потому что на те же мощности при растущем спросе они смогут повышать ценник, так как их предложение ограничено, а спрос продолжает расти.