TGStat
TGStat
Введите текст для поиска
Расширенный поиск каналов
  • Язык сайта
    flag Russian flag English flag Uzbek
  • Вход на сайт
  • Каталог
    Каталог каналов и чатов Региональные подборки Тематические подборки Платные каналы Поиск каналов
    Добавить канал/чат
  • Рейтинги
    Рейтинг каналов Рейтинг чатов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Telegram
  • Продвижение
    Реклама через Яндекс Бизнес Реклама в каналах через TGStat Agency Реклама на сайте TGStat.ru
Библиотека дата-сайентиста | Data Science, Machine learning, анализ данных, машинное обучение

11 May, 13:38

Открыть в Telegram Поделиться Пожаловаться

🧠 How to Train Your GPT: практический open-source гайд по созданию LLM с нуля

Это проект с GitHub, который учит, как устроены современные языковые модели (в духе ChatGPT, LLaMA, Mistral), но делает это максимально доступно — через код и объяснения.

Полный учебник (12 глав, ~3900 строк кода), где вы с нуля реализуете:
• токенизацию (BPE)
• embeddings (представление слов как векторов)
• attention-механизм (Q, K, V)
• RoPE (позиционное кодирование)
• Transformer-блоки (RMSNorm, SwiGLU)
• полный GPT-модельный стек
• обучение (AdamW, cross-entropy, warmup)
• инференс (KV-cache, sampling)

🔗 Ссылка на ресурс

📍 Навигация: Вакансии • Задачи • Собесы

Библиотека дата-сайентиста

#буст

1.9k 1 99 12
Каталог
Каталог каналов и чатов Подборки каналов Поиск каналов Добавить канал/чат
Рейтинги
Рейтинг каналов Telegram Рейтинг чатов Telegram Рейтинг публикаций Рейтинги брендов и персон
API
API статистики API поиска публикаций API Callback
Наши каналы
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Почитать
Академия TGStat Исследование Telegram 2019 Исследование Telegram 2021 Исследование Telegram 2023
Контакты
Справочный центр Поддержка Почта Вакансии
Всякая всячина
Пользовательское соглашение Политика конфиденциальности Публичная оферта
Наши боты
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot