Видео недоступно для предпросмотра
Смотреть в Telegram
📎 Machinelearning
🌟 Ai2 выпустила открытую модель для научных отчётов
AstaBrief 8B - файнтюн Qwen3-8B от Института Аллена, который по исследовательскому запросу и найденным фрагментам научных статей пишет отчёт со ссылками на источники.
Модель уже работает в Asta, сервисе Ai2, где она стала быстрым режимом в дополнение к Thinking с Claude под капотом.
Сама AstaBrief ничего не ищет, отрывки статей ей нужно подать вместе с вопросом. Из них модель отбирает нужное, сводит в связный текст и расставляет ссылки на отрывки, из которых взят каждый факт. Отчёт она пишет целиком за один проход.
🟡Тесты
На наборе ScholarQA-CS2 из 200 вопросов по информатике AstaBrief набрала в среднем 87 баллов, по полноте ключевых элементов ответа 90,2, по точности ответа 89, по точности ссылок 90,5, по их полноте 78,2.
По этому набору и по DeepScholarBench Ai2 называет модель сопоставимой с конвейером на Claude и со своим исследовательским агентом DR Tulu.
🌟 Ai2 выпустила открытую модель для научных отчётов
AstaBrief 8B - файнтюн Qwen3-8B от Института Аллена, который по исследовательскому запросу и найденным фрагментам научных статей пишет отчёт со ссылками на источники.
Модель уже работает в Asta, сервисе Ai2, где она стала быстрым режимом в дополнение к Thinking с Claude под капотом.
Сама AstaBrief ничего не ищет, отрывки статей ей нужно подать вместе с вопросом. Из них модель отбирает нужное, сводит в связный текст и расставляет ссылки на отрывки, из которых взят каждый факт. Отчёт она пишет целиком за один проход.
🟡Тесты
На наборе ScholarQA-CS2 из 200 вопросов по информатике AstaBrief набрала в среднем 87 баллов, по полноте ключевых элементов ответа 90,2, по точности ответа 89, по точности ссылок 90,5, по их полноте 78,2.
По этому набору и по DeepScholarBench Ai2 называет модель сопоставимой с конвейером на Claude и со своим исследовательским агентом DR Tulu.