TGStat
TGStat
Введите текст для поиска
Расширенный поиск каналов
  • flag Russian
    Язык сайта
    flag Russian flag English flag Uzbek
  • Вход на сайт
  • Каталог
    Каталог каналов и чатов Региональные подборки Тематические подборки Платные каналы Поиск каналов
    Добавить канал/чат
  • Рейтинги
    Рейтинг каналов Рейтинг чатов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Telegram
  • Продвижение
    Реклама через Яндекс Бизнес Реклама в каналах через TGStat Agency Реклама на сайте TGStat.ru
На опыте // Канал Леонида Бирюлина

2 Jun, 16:57

Открыть в Telegram Поделиться Пожаловаться

01:02
Видео недоступно для предпросмотра
Смотреть в Telegram
Как мы с сыном за неделю собрали то, чего нет на российском рынке

По оценке MarketsandMarkets, рынок распознавания речи вырастет с $9,66 млрд в 2025 году до $23,11 млрд к 2030-му. Почти 19% роста в год. Отдельно рынок speech-to-text API, оценивается в $3,8 млрд в 2024 году и может дойти до $8,6 млрд к 2030-му.

То есть деньги идут не в «прикольную нейросеточку для субтитров», а в инфраструктуру: распознавание речи, потоковую расшифровку, поиск по сказанному, автоматизацию работы с текстом.

В мире для этого есть Otter, Trint, Descript — сервисы, которые превращают живую речь в рабочий текст. Журналисты, редакторы, продюсеры, пресс-службы и маркетологи могут не переслушивать часы записей, а сразу работать с содержанием.

Но всё это — рынок недружественных стран.
С русским работают плохо. Стоят дорого. В России нормально не работают. Для корпоративных и государственных задач есть ещё один скучный, но железобетонный нюанс: данные. Отправлять звук с конференции, где люди названы по именам, на зарубежный сервис — это просто юридическое самоубийство.

Российские сервисы закрывают только часть задачи. Где-то можно расшифровать загруженный файл постфактум. Где-то подключить бота в Zoom. Но полноценной связки «живой эфир + русская расшифровка + поиск + цитаты + итоговый документ» на одной странице я не нашёл.

Дыра на рынке — это не повод ныть. Об этом всегда твержу своему сыну. В итоге за неделю мы собрали такую платформу.

Максиму 14. Продукт он написал на Python сам, под моим руководством: я помогал с логикой, архитектурой и ограничениями, он собирал рабочий инструмент.

Стек выбрали не по красоте презентации, а по смыслу. Распознавание — Yandex SpeechKit: сильный русский язык, данные остаются в РФ, оплата по договору. Видео — Kinescope. Поверх — Yandex GPT, который чистит оговорки прямо в потоке. Дальше — поиск по расшифровке, таймкоды, избранные цитаты в один клик и итоговый документ, который собирается автоматически.

Проверили не в песочнице, а на живом событии — технофестиваль Startup Village.

4 параллельные сцены. Пресс-служба и СМИ, которым нужно не просто смотреть эфир, а быстро вытаскивать смысл, цитаты и материалы для публикаций.

Платформу никто отдельно не заказывал. Мы принесли её сверху — как решение проблемы, которую обычно даже не формулируют в ТЗ.

Клиент просил трансляцию.
Получил инструмент, которого не хватало рынку.

Вот за этот зазор и платят

70 0 0 1 11
Каталог
Каталог каналов и чатов Подборки каналов Поиск каналов Добавить канал/чат
Рейтинги
Рейтинг каналов Telegram Рейтинг чатов Telegram Рейтинг публикаций Рейтинги брендов и персон
API
API статистики API поиска публикаций API Callback
Наши каналы
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Почитать
Академия TGStat Исследование Telegram 2019 Исследование Telegram 2021 Исследование Telegram 2023
Контакты
Справочный центр Поддержка Почта Вакансии
Всякая всячина
Пользовательское соглашение Политика конфиденциальности Публичная оферта
Наши боты
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot