https://t.me/myxomatosis_of_amygdala/706
———
Кажется, все обсуждают GPT-6 Astra вообще не с той стороны.
Красивые приложения, управление браузером, кодинг - всё это прикольно. Но есть 3 гораздо более важных вещи касаются вообще ВСЕХ и про которые почти не пишут. И первая их них про 97.6% на FrontierMath Tier 4 v2.
Это один из самых сложных математических бенчмарков: research-level задачи, написанные экспертными математиками. Я ж сам математик по образованию, и у меня ушло полдня просто на то, чтобы приблизительно понять решение одной из публичных задач.
Но интересное начинается дальше.
Обычная логика бенчмарка такая: человек придумывает очень сложную задачу, сам пишет её решение и проверяет, сможет ли её решить ИИ.
Проблема в том, что этот формат начинает заканчиваться.
Epoch AI уже прямо пишет, что классический подход - задачи, которые лучшие человеческие эксперты могут решить, а ИИ пока нет - перестаёт нормально работать.
Поэтому следующий уровень FrontierMath - это уже реальные нерешённые математические проблемы.
Их новый FrontierMath Erdős состоит из 68 задач Эрдёша, которые на август 2026 года не были решены вообще никем.
И GPT-6 Astra уже решила две из них. За 15 часов. Открытые задачи с 1982 и 1934 года.
Вдумайтесь в смену формулировки.
Раньше мы спрашивали:
«Может ли ИИ решить задачу, которую умеет решать человек?»
Теперь мы начинаем спрашивать:
«Может ли ИИ решить задачу, которую человечество пока вообще не смогло решить, но пока способно понять решение?»
Вот это намного важнее очередного демо, где новая модель чуть красивее собрала приложение. И это самая безобидная новость из 3.
_______
Источник | #el_pinguino_channel
———
Комаровский накидывает про сбежавший рой агентов, но в комментах интереснее
https://habr.com/ru/companies/ods/articles/1078778/
———
Компании платят авторам контента, чтобы те рассказывали об опасностях ИИ
Немецкая исследовательница Сабина Хоссенфельдер, которая занимается теоретической физикой и снимает научно-популярные видео на ютуб, рассказала (youtu.be/lPdmYMHrWKg), что к ней обратилась некая организация с предложением оплатить видео, предупреждающее об экзистенциальных рисках ИИ.
Предложение пришло вместе со сценарием, конкретными фразами и цитатами, которые нужно было включить. Хоссенфельдер отказалась. Название организации она не раскрыла, но упомянула, что похожие предложения получали и другие блогеры, при этом не только от этой конкретной компании.
https://t.me/data_secrets/9857
———
@F_S_C_P
-------
Поддержи канал подпиской
-------
———
Кажется, все обсуждают GPT-6 Astra вообще не с той стороны.
Красивые приложения, управление браузером, кодинг - всё это прикольно. Но есть 3 гораздо более важных вещи касаются вообще ВСЕХ и про которые почти не пишут. И первая их них про 97.6% на FrontierMath Tier 4 v2.
Это один из самых сложных математических бенчмарков: research-level задачи, написанные экспертными математиками. Я ж сам математик по образованию, и у меня ушло полдня просто на то, чтобы приблизительно понять решение одной из публичных задач.
Но интересное начинается дальше.
Обычная логика бенчмарка такая: человек придумывает очень сложную задачу, сам пишет её решение и проверяет, сможет ли её решить ИИ.
Проблема в том, что этот формат начинает заканчиваться.
Epoch AI уже прямо пишет, что классический подход - задачи, которые лучшие человеческие эксперты могут решить, а ИИ пока нет - перестаёт нормально работать.
Поэтому следующий уровень FrontierMath - это уже реальные нерешённые математические проблемы.
Их новый FrontierMath Erdős состоит из 68 задач Эрдёша, которые на август 2026 года не были решены вообще никем.
И GPT-6 Astra уже решила две из них. За 15 часов. Открытые задачи с 1982 и 1934 года.
Вдумайтесь в смену формулировки.
Раньше мы спрашивали:
«Может ли ИИ решить задачу, которую умеет решать человек?»
Теперь мы начинаем спрашивать:
«Может ли ИИ решить задачу, которую человечество пока вообще не смогло решить, но пока способно понять решение?»
Вот это намного важнее очередного демо, где новая модель чуть красивее собрала приложение. И это самая безобидная новость из 3.
_______
Источник | #el_pinguino_channel
———
Комаровский накидывает про сбежавший рой агентов, но в комментах интереснее
https://habr.com/ru/companies/ods/articles/1078778/
А еще, чтобы садист получил максимальное удовлетворение от процесса - надо добавить сексботу максимально реалистичные эмоции, ощущения и поведение. Например, сопротивление и попытки сбежать. Казалось бы, что может пойти не так?
———
Компании платят авторам контента, чтобы те рассказывали об опасностях ИИ
Немецкая исследовательница Сабина Хоссенфельдер, которая занимается теоретической физикой и снимает научно-популярные видео на ютуб, рассказала (youtu.be/lPdmYMHrWKg), что к ней обратилась некая организация с предложением оплатить видео, предупреждающее об экзистенциальных рисках ИИ.
Предложение пришло вместе со сценарием, конкретными фразами и цитатами, которые нужно было включить. Хоссенфельдер отказалась. Название организации она не раскрыла, но упомянула, что похожие предложения получали и другие блогеры, при этом не только от этой конкретной компании.
https://t.me/data_secrets/9857
———
@F_S_C_P
-------
Поддержи канал подпиской
-------