Forward from: ТехноЛоджия
🤖 Интересная дискуссия развернулась по поводу open-weights моделей – после того, как стало известно об инициативах в правительстве США по запрету использования китайских моделей в американских компаниях.
Дженсен Хуанг (CEO NVIDIA) – с еще семью десятками ИТ- и ИИ-лидерами – написал открытое письмо, в котором заявил, что open source – это, вообще-то, замечательно, да и open-weight тоже, так что не надо, пожалуйста, ничего и нигде запрещать.
🔹В этой связи хорошо вспомнить, что open source – это практически никогда не про благотворительность. Все самые большие проекты – они про деньги, просто не деньги за сам код.
— Большая часть контрибьюторов в ядро Linux и спонсоров Linux Foundation – это компании и их сотрудники. Intel вкладывается в Linux, потому что это помогает продавать больше серверов.
— Facebook (организация ужасная и запрещенная, потому что ужасная) вложился в PyTorch, чтобы Google со своим TensorFlow не монополизировал нейронки и все не сидели на их облаках.
— На карточках NVIDIA, конечно же, гоняется огромное количество open-weights ИИ-моделей – тут коммерческий ущерб от их запрета пошел бы на миллиарды. Да, на тех же карточках можно гонять и американские модели, но перестройка существующих бизнес-процессов была бы катастрофической.
— Perplexity и другие подписавшиеся тоже хотят использовать в своих продуктах open-weights: не все хотят переплачивать за дорогой ChatGPT, так как в этом случае конкурентоспособность сервисов радикально снизится.
🔹Почему же Anthropic отказалась подписывать это все? Скорее всего, у них самый независимый стек технологий, где open-weights используется немного, и проблемы зажравшейся NVIDIA и компаний, которые делают более дешевые, но не такие хорошие продукты, им на руку. Ну а про кибербез и репрессии китайского народа в их заявлении – для того, чтобы эгоизм не выглядывал.
🔹Есть и более позитивная сторона open source: иногда ребята открывают проекты, потому что хотят, чтобы технологии развивались в целом, и чтобы кадры росли, и чтобы экономика двигалась вперед. А где деньги заработать – это уже потом придумаем. Или не придумаем, но карму точно заработаем🌟
Так, Т-шники на TurboML выкатили пару очень прикольных релизов – T-Search и Perseus.
T-Search – агентный фреймворк для многошагового поиска на английском и русском языках. Многошаговый поиск нужен, чтобы агент сначала понял контекст из всего поверхностно найденного, а потом постепенно улучшал запросы. Получилось очень круто с точки зрения сотношения полноты найденного и потраченных ресурсов. Допиленный Qwen работает на одной карточке. Всем страдающим от невозможности закупить мощностей, но страждущим сделать агентный поиск – крайне рекомендую.
А штука с романтичным названием Perseus – это фреймворк для построения рекомендательной системы на потоке данных о человеке без каких-либо специальных обработок этих самых данных. То есть если у вас есть поток данных, вы хотите что-то рекомендовать человеку, и вам при этом не хочется учиться на кафедре РЭСИК два года, можно просто поставить Персея – он сам разберется и все порекомендует.
Дженсен Хуанг (CEO NVIDIA) – с еще семью десятками ИТ- и ИИ-лидерами – написал открытое письмо, в котором заявил, что open source – это, вообще-то, замечательно, да и open-weight тоже, так что не надо, пожалуйста, ничего и нигде запрещать.
🔹В этой связи хорошо вспомнить, что open source – это практически никогда не про благотворительность. Все самые большие проекты – они про деньги, просто не деньги за сам код.
— Большая часть контрибьюторов в ядро Linux и спонсоров Linux Foundation – это компании и их сотрудники. Intel вкладывается в Linux, потому что это помогает продавать больше серверов.
— Facebook (организация ужасная и запрещенная, потому что ужасная) вложился в PyTorch, чтобы Google со своим TensorFlow не монополизировал нейронки и все не сидели на их облаках.
— На карточках NVIDIA, конечно же, гоняется огромное количество open-weights ИИ-моделей – тут коммерческий ущерб от их запрета пошел бы на миллиарды. Да, на тех же карточках можно гонять и американские модели, но перестройка существующих бизнес-процессов была бы катастрофической.
— Perplexity и другие подписавшиеся тоже хотят использовать в своих продуктах open-weights: не все хотят переплачивать за дорогой ChatGPT, так как в этом случае конкурентоспособность сервисов радикально снизится.
🔹Почему же Anthropic отказалась подписывать это все? Скорее всего, у них самый независимый стек технологий, где open-weights используется немного, и проблемы зажравшейся NVIDIA и компаний, которые делают более дешевые, но не такие хорошие продукты, им на руку. Ну а про кибербез и репрессии китайского народа в их заявлении – для того, чтобы эгоизм не выглядывал.
🔹Есть и более позитивная сторона open source: иногда ребята открывают проекты, потому что хотят, чтобы технологии развивались в целом, и чтобы кадры росли, и чтобы экономика двигалась вперед. А где деньги заработать – это уже потом придумаем. Или не придумаем, но карму точно заработаем🌟
Так, Т-шники на TurboML выкатили пару очень прикольных релизов – T-Search и Perseus.
T-Search – агентный фреймворк для многошагового поиска на английском и русском языках. Многошаговый поиск нужен, чтобы агент сначала понял контекст из всего поверхностно найденного, а потом постепенно улучшал запросы. Получилось очень круто с точки зрения сотношения полноты найденного и потраченных ресурсов. Допиленный Qwen работает на одной карточке. Всем страдающим от невозможности закупить мощностей, но страждущим сделать агентный поиск – крайне рекомендую.
А штука с романтичным названием Perseus – это фреймворк для построения рекомендательной системы на потоке данных о человеке без каких-либо специальных обработок этих самых данных. То есть если у вас есть поток данных, вы хотите что-то рекомендовать человеку, и вам при этом не хочется учиться на кафедре РЭСИК два года, можно просто поставить Персея – он сам разберется и все порекомендует.