TGStat
TGStat
Введите текст для поиска
Расширенный поиск каналов
  • Язык сайта
    flag Russian flag English flag Uzbek
  • Вход на сайт
  • Каталог
    Каталог каналов и чатов Региональные подборки Тематические подборки Платные каналы Поиск каналов
    Добавить канал/чат
  • Рейтинги
    Рейтинг каналов Рейтинг чатов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Telegram
  • Продвижение
    Реклама через Яндекс Бизнес Реклама в каналах через TGStat Agency Реклама на сайте TGStat.ru
Все о блокчейн/мозге/space/WEB 3.0 в России и мире

26 Feb, 12:00

Открыть в Telegram Поделиться Пожаловаться

Google нашли способ, как LLM учить алгоритму обучения, как у людей

Google DeepMind опубликовали две работы(тут и тут), которые говорят о том, как работает обучение языковых моделей.

Больше полезных материалов у нас на Patreon.

Вот в чём проблема:

Такие модели как GPT-5 и Gemini 2.5 Pro плохо адаптируются в процессе диалога. Дай им подсказку, укажи на ошибку, и они просто повторят тот же неверный ответ. Снова. И снова.
Это не баг конкретной модели. Это системное следствие того, как всё обучение построено на статичных текстах. Модель хорошо запоминает, но не умеет учиться в моменте.

Исследователи назвали это отсутствием in-context plasticity - способности менять мышление в ответ на новую информацию прямо внутри разговора.

Решение DeepMind - они превратили обычные задачи (математика, код) в педагогические диалоги, где одна копия модели играет роль учителя, а другая — студента.

Ключевая идея - учителю не нужно быть умнее. Достаточно знать правильный ответ. Асимметрия информации заменяет асимметрию интеллекта.

После такого обучения через RL происходит кое-что неожиданное: Gemini 2.5 Flash догоняет по адаптивности Gemini 2.5 Pro.

А модели, обученные на математике, начинают лучше играть в покер и проходить лабиринты.

Но самое странное — это самосовершенствование. Если обучить модель также предсказывать реплики учителя, она начинает сама себя критиковать и исправлять. Без внешней помощи. И результат превосходит работу с реальным учителем.

Суть - не учить ответам, а учить алгоритму обучения.
Это то, что люди делают с детства и называют социальным интеллектом. У ИИ это только начинается.

Больше полезных материалов у нас на Patreon.

2.8k 1 63 37
Каталог
Каталог каналов и чатов Подборки каналов Поиск каналов Добавить канал/чат
Рейтинги
Рейтинг каналов Telegram Рейтинг чатов Telegram Рейтинг публикаций Рейтинги брендов и персон
API
API статистики API поиска публикаций API Callback
Наши каналы
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Почитать
Академия TGStat Исследование Telegram 2019 Исследование Telegram 2021 Исследование Telegram 2023
Контакты
Справочный центр Поддержка Почта Вакансии
Всякая всячина
Пользовательское соглашение Политика конфиденциальности Публичная оферта
Наши боты
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot