Репост из: AI Metropolis
Видео недоступно для предпросмотра
Смотреть в Telegram
Связка Kimiko 3 + DeepSeek V4 Flash: пишем код на уровне топовых ИИ за копейки
Открытые нейросети вплотную подобрались к закрытым платным моделям для написания кода. Разрыв в качестве теперь измеряется парой процентов, а на бенчмарках опенсорс уже обходит флагманы, за которые просят $200 в месяц. Обычная ошибка при работе с кодом — использовать одну модель для абсолютно всех задач. Гораздо эффективнее разделить работу между двумя разными ИИ.
Ключевые факты с тестов King Bench:
• Открытая Qwen 3.8 Max (81.25%) обошла Opus 4.8 (80%). Kimiko 3 идет наравне с Opus 5 (77.5%).
• DeepSeek V4 Flash версии 0731 побил абсолютный рекорд на самой сложной задаче бенчмарка (3D-часы), уничтожив Fable 5 и Opus 5.
• После апдейта V4 Flash набрала в Terminal Bench 82.7 баллов, отстав от дорогущей Opus 4.8 всего на доли процента.
Суть воркфлоу в разделении ролей: Kimiko 3 (K3) работает как планировщик архитектуры, а DeepSeek V4 Flash — как кодер-исполнитель. K3 круто мыслит на длинные дистанции. Модель читает всю кодовую базу, находит пограничные случаи и пишет пошаговый план реализации с проверкой. Ошибка на этапе архитектуры стоит дорого, поэтому тут думает самая тяжелая модель. План съедает мало токенов, лимиты не страдают.
Само написание кода сжигает основную массу токенов. Тут вступает V4 Flash. Это MoE-модель всего на 13 млрд активных параметров — она невероятно быстрая и легкая. Получив четкий план от K3, она просто идет по файлам, создает компоненты, прокидывает роуты и сама исправляет ошибки компиляции без лишней отсебятины.
Весь зоопарк этих моделей сейчас доступен в агрегаторе Klein Pass. Стандартный тариф $9.99 в месяц дает доступ к Kimiko 2/3, V4 Flash, GLM 5.2, Qwen и Minimax M3 (K3 здесь дешевле в 5 раз от базовой цены API). Со скидками ценник падает до $2 в месяц или $16 за год.
Настройка связки в VS Code:
1. Находим и ставим расширение Klein.
2. При онбординге выбираем Klein Pass и подключаем аккаунт.
3. В настройках включаем разные модели для режимов. Для Plan mode ставим Kimiko 3, для Act mode — DeepSeek V4 Flash.
Для работы через терминал с тем же аккаунтом:
npm i -g Klein
Klein
Агрегатор отдает обычный API-ключ. Его можно закинуть в любой привычный интерфейс, например в Hermes или Open Code, добавив базовый URL Klein как кастомный эндпоинт.
Практический вывод: переходите на раздельный флоу. Делегируйте архитектуру K3, а генерацию кода — V4 Flash. Есть нюанс по задачам: если нужно сделать сложную фронтенд-анимацию с визуальным лоском, на роль исполнителя лучше переключить GLM 5.2. А для самых примитивных скриптов в Act mode ставьте легкую Minimax M3.
AICodeKing
Переводы видео, саммари новостей про AI
Открытые нейросети вплотную подобрались к закрытым платным моделям для написания кода. Разрыв в качестве теперь измеряется парой процентов, а на бенчмарках опенсорс уже обходит флагманы, за которые просят $200 в месяц. Обычная ошибка при работе с кодом — использовать одну модель для абсолютно всех задач. Гораздо эффективнее разделить работу между двумя разными ИИ.
Ключевые факты с тестов King Bench:
• Открытая Qwen 3.8 Max (81.25%) обошла Opus 4.8 (80%). Kimiko 3 идет наравне с Opus 5 (77.5%).
• DeepSeek V4 Flash версии 0731 побил абсолютный рекорд на самой сложной задаче бенчмарка (3D-часы), уничтожив Fable 5 и Opus 5.
• После апдейта V4 Flash набрала в Terminal Bench 82.7 баллов, отстав от дорогущей Opus 4.8 всего на доли процента.
Суть воркфлоу в разделении ролей: Kimiko 3 (K3) работает как планировщик архитектуры, а DeepSeek V4 Flash — как кодер-исполнитель. K3 круто мыслит на длинные дистанции. Модель читает всю кодовую базу, находит пограничные случаи и пишет пошаговый план реализации с проверкой. Ошибка на этапе архитектуры стоит дорого, поэтому тут думает самая тяжелая модель. План съедает мало токенов, лимиты не страдают.
Само написание кода сжигает основную массу токенов. Тут вступает V4 Flash. Это MoE-модель всего на 13 млрд активных параметров — она невероятно быстрая и легкая. Получив четкий план от K3, она просто идет по файлам, создает компоненты, прокидывает роуты и сама исправляет ошибки компиляции без лишней отсебятины.
Весь зоопарк этих моделей сейчас доступен в агрегаторе Klein Pass. Стандартный тариф $9.99 в месяц дает доступ к Kimiko 2/3, V4 Flash, GLM 5.2, Qwen и Minimax M3 (K3 здесь дешевле в 5 раз от базовой цены API). Со скидками ценник падает до $2 в месяц или $16 за год.
Настройка связки в VS Code:
1. Находим и ставим расширение Klein.
2. При онбординге выбираем Klein Pass и подключаем аккаунт.
3. В настройках включаем разные модели для режимов. Для Plan mode ставим Kimiko 3, для Act mode — DeepSeek V4 Flash.
Для работы через терминал с тем же аккаунтом:
npm i -g Klein
Klein
Агрегатор отдает обычный API-ключ. Его можно закинуть в любой привычный интерфейс, например в Hermes или Open Code, добавив базовый URL Klein как кастомный эндпоинт.
Практический вывод: переходите на раздельный флоу. Делегируйте архитектуру K3, а генерацию кода — V4 Flash. Есть нюанс по задачам: если нужно сделать сложную фронтенд-анимацию с визуальным лоском, на роль исполнителя лучше переключить GLM 5.2. А для самых примитивных скриптов в Act mode ставьте легкую Minimax M3.
AICodeKing
Переводы видео, саммари новостей про AI