TGStat
TGStat
Введите текст для поиска
Расширенный поиск каналов
  • flag Russian
    Язык сайта
    flag Russian flag English flag Uzbek
  • Вход на сайт
  • Каталог
    Каталог каналов и чатов Региональные подборки Тематические подборки Платные каналы Поиск каналов
    Добавить канал/чат
  • Рейтинги
    Рейтинг каналов Рейтинг чатов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Telegram
  • Продвижение
    Реклама через Яндекс Бизнес Реклама в каналах через TGStat Agency Реклама на сайте TGStat.ru
Все о блокчейн/мозге/space/WEB 3.0 в России и мире

2 Oct, 15:02

Открыть в Telegram Поделиться Пожаловаться

Про новую макроэкономику ИИ

Один из крупных разметчиков данных для ИИ-лабораторий Mercor сравнил работу бухгалтеров с ИИ-моделями на реальных задачах и предлагает иначе мерить момент, когда модель обходит человека.

Вообще сейчас пошел тренд на ИИ-бухгалтерию, тут кейсы

Компания наняла 12 бухгалтеров, в среднем с 5,5 годами опыта, и дала им 4 задачи. Те же задания прогнали через модели разных лет.

Люди работали без ИИ и им дали 3 часа на каждую задачу.

Авторы исследования говорят, если в мае 2025 бухгалтеры были сильнее ИИ-моделей, то сейчас модели на этих заданиях почти идеальны, быстрее и на порядок дешевле даже лучшего специалиста из выборки.

Из этого видно противоречие, что баллы на бенчмарках за пару лет взлетели, а в статистике, например, США вклад ИИ в рост производительности пока почти не виден.

Чтобы это разобрать, нужно понимать, как тест соотносится с настоящей работой, и как её сделал бы человек.

Отсюда вытекает второй вывод - пока модель слабее человека, логично спрашивать на бенчмарках, когда она его догонит.

Но когда она упирается в потолок своих возможностей, тогда такой бенчмарк ничего не различает.

Дальше полезнее смотреть на задачи, которые раньше были слишком дорогими или невозможными.

Mercor ставит вопрос: в какой момент на конкретной работе модель проходит человеческий уровень?

Что из этого следует для рынка труда - отдельный вопрос, и он не заменяет подсчёт экономики ИИ.
AI vs. Accountants: Frontier Models Outscore CPAs | Mercor
We tested 12 licensed CPAs against frontier AI on APEX-Accounting tasks. AI was faster, more accurate, and 10x cheaper. Here's what we found.

1.8k 4 32 11
Каталог
Каталог каналов и чатов Подборки каналов Поиск каналов Добавить канал/чат
Рейтинги
Рейтинг каналов Telegram Рейтинг чатов Telegram Рейтинг публикаций Рейтинги брендов и персон
API
API статистики API поиска публикаций API Callback
Наши каналы
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Почитать
Академия TGStat Исследование Telegram 2019 Исследование Telegram 2021 Исследование Telegram 2023
Контакты
Справочный центр Поддержка Почта Вакансии
Всякая всячина
Пользовательское соглашение Политика конфиденциальности Публичная оферта
Наши боты
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot