Видео недоступно для предпросмотра
Смотреть в Telegram
Это нереально.
Qwen 3.8 27B, запущенная локально на моей RTX 5090, ОБГОНЯЕТ Opus 4.8 в моих бенчмарках.
Что забавно, Opus 4.6 она немного проигрывает.
Скорость такая же хорошая, а иногда НАМНОГО выше. В некоторых тестах я получал до 200 токенов/с.
Мы живём уже в другом мире. Безлимитный бесплатный суперинтеллект прямо у нас на столе.
Никакого интернета, подписок или API.
Всего полгода назад для четверти такой производительности вам понадобилось бы 500 ГБ VRAM.
А теперь я получаю интеллект уровня Opus 4.8 на одной RTX 5090. Даже Spark не нужен.
Теперь эта модель работает у меня внутри Hermes-агента, который выполняет задачи для меня 24/7 бесплатно.
У меня НОЛЬ сомнений, что к этому времени в следующем году на Mac mini будут работать модели мощнее Fable. НОЛЬ сомнений.
Если вы послушали меня в начале года, когда я требовал начинать покупать железо, сейчас вы в полном выигрыше.
Будущее уже не за углом. Оно здесь.
Qwen 3.8 27B, запущенная локально на моей RTX 5090, ОБГОНЯЕТ Opus 4.8 в моих бенчмарках.
Что забавно, Opus 4.6 она немного проигрывает.
Скорость такая же хорошая, а иногда НАМНОГО выше. В некоторых тестах я получал до 200 токенов/с.
Мы живём уже в другом мире. Безлимитный бесплатный суперинтеллект прямо у нас на столе.
Никакого интернета, подписок или API.
Всего полгода назад для четверти такой производительности вам понадобилось бы 500 ГБ VRAM.
А теперь я получаю интеллект уровня Opus 4.8 на одной RTX 5090. Даже Spark не нужен.
Теперь эта модель работает у меня внутри Hermes-агента, который выполняет задачи для меня 24/7 бесплатно.
У меня НОЛЬ сомнений, что к этому времени в следующем году на Mac mini будут работать модели мощнее Fable. НОЛЬ сомнений.
Если вы послушали меня в начале года, когда я требовал начинать покупать железо, сейчас вы в полном выигрыше.
Будущее уже не за углом. Оно здесь.