TGStat
TGStat
Введите текст для поиска
Расширенный поиск каналов
  • flag Russian
    Язык сайта
    flag Russian flag English flag Uzbek
  • Вход на сайт
  • Каталог
    Каталог каналов и чатов Региональные подборки Тематические подборки Платные каналы Поиск каналов
    Добавить канал/чат
  • Рейтинги
    Рейтинг каналов Рейтинг чатов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Telegram
  • Продвижение
    Реклама через Яндекс Бизнес Реклама в каналах через TGStat Agency Реклама на сайте TGStat.ru
Все о блокчейн/мозге/space/WEB 3.0 в России и мире

24 Mar, 11:59

Открыть в Telegram Поделиться Пожаловаться

Anthropic показал, как Opus 4.6 может несколько дней подряд автономно работать над сложными задачами почти без человека.

Исследователь из Anthropic взял задачу из области, в которой сам не является специалистом, и попросил Opus 4.6 написать сложный численный код для космологии, который обычно делают годами.

Запустил агента и ушёл пить кофе. Через несколько дней код работал.

Исследователь периодически проверял прогресс с телефона, пока стоял в очереди.

А агент тем временем сам писал код, сам тестировал, находил ошибки, фиксировал в журнале, что сработало, а что нет, чтобы не наступать на те же грабли в следующей сессии.

Главное открытие этого кейса не в том, что ИИ умный, а в том, что ему нужна правильная инфраструктура, как любому сотруднику нужны инструменты и регламенты.

3 ключевых элемента:
1. файл с заданием, который агент держит в голове всё время работы и может сам обновлять;
2. журнал прогресса, где фиксируются не только успехи, но и тупики, чтобы не повторять их;
3. эталон, с которым агент сверяет результат на каждом шаге. Без эталона агент не знает, движется ли он вперёд.

Ещё одна проблема, которую решили отдельно - агент склонен останавливаться раньше времени.

Этот кейс показывает, что ранее такие инструменты мы использовали в режиме диалога, а теперь появился другой режим - ставишь задачу, настраиваешь процесс и агент работает сам, пока ты занимаешься другим.

ИИ выводит на то, чтобы люди начали не только своим тайм-менеджментом заниматься эффективно, но и агента:)
Long-running Claude for scientific computing
Anthropic is an AI safety and research company that's working to build reliable, interpretable, and steerable AI systems.

2.3k 3 89 29
Каталог
Каталог каналов и чатов Подборки каналов Поиск каналов Добавить канал/чат
Рейтинги
Рейтинг каналов Telegram Рейтинг чатов Telegram Рейтинг публикаций Рейтинги брендов и персон
API
API статистики API поиска публикаций API Callback
Наши каналы
@TGStat @TGStat_Chat @telepulse @TGStatAPI
Почитать
Академия TGStat Исследование Telegram 2019 Исследование Telegram 2021 Исследование Telegram 2023
Контакты
Справочный центр Поддержка Почта Вакансии
Всякая всячина
Пользовательское соглашение Политика конфиденциальности Публичная оферта
Наши боты
@TGStat_Bot @SearcheeBot @TGAlertsBot @tg_analytics_bot @TGStatChatBot