Фильтр публикаций


Репост из: Русский ИТ бизнес
Видео недоступно для предпросмотра
Смотреть в Telegram
Фантастика. Просто нет слов. Это же будущее, во всех сферах человечества. Ведь не зря их делают по размерам плюс- минус похожими на людей, т.к. все что нас окружает сделано под нас.

tg / max


Репост из: Русский ИТ бизнес
Вайбкодеры, а вы видели результаты Grok 4.6?! Он только что занял #1 место в CursorBench 3.2.....и эффективность просто безумная!

Вот сравнение затрат:

• Grok 4.6 Extra High — 70.8% | $2.81/задание
• Fable 5 Max — 70.5% | $17.32/задача
• Opus 5 Max — 70.0% | $8.23/задача
• GPT-5.6 Sol Max — 67.2% | $5.69/задача


Я рботаю с GPT-5.6 Sol - но видимо надо присмотреться к товарищу Гроку :)

tg / max


Репост из: Русский ИТ бизнес
Китай практически догнал Соединенные Штаты в плане как уровня развития, так и мощности своих моделей искусственного интеллекта

tg / max


Репост из: Русский ИТ бизнес
Видео недоступно для предпросмотра
Смотреть в Telegram
Вышел инструмент Rejudge для независимой проверки кода — три разных агента отдельно исследуют код, а судья сравнивает результаты и выдаёт один готовый отчёт.

1. Каждая модель получает один и тот же запрос и разбирает его в изолированном контексте: ни одна не видит, что делают другие.
2. ИИ-судья проверяет все три отчёта и задаёт уточняющие вопросы там, где независимые проверки расходятся.
3. Судья отдаёт один готовый отчёт с ошибками, рисками и уязвимостями в коде.


Где? тут. Зачем? Не знаю.

tg / max


Репост из: Метаверсище и ИИще
На OpenRouter бесплатно бахнули неизвестную frontier-модель Ox Alpha

https://openrouter.ai/stealth/ox-alpha

Шняга явно заточена под кодинг и агентов: миллион токенов контекста, до 131К на выходе, reasoning, tools, плюс она понимает не только текст и картинки, но и видео. Типа мультимодальная.
На маленьком 10-задачном прогоне DeepSWE получила 80% против 65% у Fable и 52% у Sol. Выборка крошечная, и твитторские пишут, что до Фаблика ей далековато.

А дальше начинается детектив. Реддитские прогнали Ox Alpha через fingerprint-тесты и обнаружили, что подсчет токенов совпадает с GLM-5.3, причем разница стабильно составляет всего 75 токенов, которые очень похожи на скрытый системный промпт. Еще интереснее видео: расход токенов на разных роликах практически повторяет GLM-5V-Turbo. Совпадают и некоторые ошибки API, режимы reasoning и характерные ответы. Поэтому основной подозреваемый сейчас Z.ai, бывшая Zhipu AI.

Но вот версия про конкретно GLM-5.3 Flash пока скорее пальцем в небо: Ox Alpha может оказаться вообще новым мультимодальным GLM-5.x, который еще не анонсировали.

Ништяк в том, что Ox Alpha пока отдают бесплатно, а OpenCode заявляет квоту до 100 триллионов! токенов в сутки. Похоже, вместо закрытой беты китайцы просто вынесли новую модель в интернет - такой маркетинг нам нравицца!

@cgevent


Репост из: AI Product | Igor Akimov
Deepseek выкатил мультимодальную модель!

deepseek-v4-flash-vision-exp – принимает картинки вместе с текстом: описание изображений, чтение скриншотов, анализ графиков.
По тексту (агенты, reasoning, знания) – на уровне обычного V4-Flash, а на мультимодальных агентских бенчмарках – большой скачок, близко к Opus 4.8
Картинка стоит максимум 384 токена – всё, что больше ~800×800, сжимается до этого размера. 2000×2000 и 5000×5000 съедят одинаково
– тарификация – по ценам V4-Flash: при $0.14/1M input это ~18 тысяч изображений на доллар (в off-peak часы – вдвое дешевле)
– до 600 изображений в одном запросе, форматы JPEG/PNG/GIF/WebP, есть Files API для переиспользования
– работает через три интерфейса сразу: OpenAI Chat Completions, Responses API и Anthropic-совместимый /messages

Короче, надо пробовать. Стоит как обычно копейки вообще. Должна быть сильно и в обработке документов, и в обработке графики (кроме совсем уж плотных текстов)

https://api-docs.deepseek.com/news/news260821/


Репост из: RouterAI
DeepSeek ввёл новые тарифы на модели deepseek-v4-flash и deepseek-v4-pro и разделил цены по времени суток

Что изменилось:
🔸 В пиковые часы (04:00–07:00 и 09:00–13:00 МСК) тарифы вдвое выше, чем в непиковые
🔸 Входящие токены подорожали примерно в 1,5 раза, исходящие — в 2,3 раза
🔸 В пиковые часы рост ещё сильнее: входящие — в 3 раза, исходящие — в 4,7 раза

Это решение самого DeepSeek — мы публикуем новость, чтобы вы узнали об изменении от нас, а не из статистики расходов. Цены deepseek-моделей в каталоге уже пересчитаны, расчёты идут по новым тарифам.

Если рост цен критичен — есть альтернативы:
GLM 5.2 — быстрый и недорогой вариант для программирования
Qwen3.8 27B — близкое качество рассуждений
MiniMax M3 — замена для чата и генерации текста

Достаточно указать другой model в запросе

Актуальные цены — на routerai.ru/models


Репост из: Русский ИТ бизнес
Видео недоступно для предпросмотра
Смотреть в Telegram
Qwen3.8-27B теперь работает со скоростью 70 токенов/с прямо на ноутбуке.

Вышел DFlash 2 — новое поколение спекулятивного декодирования на основе блочной диффузии.

DFlash 2 разгоняет Qwen3.8-27B до 70 токенов/с на MacBook Pro с M5 Max. Ускорение авторегрессионного декодирования достигает 4,6 раза, а итоговый вывод остаётся полностью идентичным исходной модели — буквально ни одного отличающегося токена. Уже доступны новые черновые модели для Qwen3.8-27B с нативной поддержкой SGLang, vLLM, llama.cpp и oMLX.

Суть подхода: https://inco.ai/blog/dflash2/

А я напомню, что уже есть модель без цензуры :)

tg / max


Репост из: Русский ИТ бизнес
BentoPDF — это мощный клиентский инструментарий для работы с PDF-файлами, ориентированный на конфиденциальность. Он не требует хостинга и позволяет манипулировать, редактировать, объединять и обрабатывать PDF-файлы прямо в браузере.

Обработка на стороне сервера не требуется, что обеспечивает безопасность и конфиденциальность ваших файлов. Мы попробуем у себя развернуть...

tg / max


Репост из: Из окопов IT-бизнеса
Если мучаетесь с прокси на windows. Одна тулза заворачивает трафик любого приложения в прокси без танцев с бубном.

Держите мини-гайд, как я завёл через прокси Google Antigravity.

Инструмент: ProxyBridge
https://github.com/InterceptSuite/ProxyBridge/releases

Как сделать:

1) Открываем ProxyBridge, жмём на шестерёнку (Settings) и добавляем свой прокси: тип HTTP или SOCKS5, IP, порт, логин с паролем если есть.

2) Идём в раздел с иконкой листа (Process Rules), жмём «Добавить приложение».

3) В поле Applications указываем экзешники нужной программы. Для Antigravity это Antigravity.exe и language_server.exe (второй процесс отвечает за языковой сервер, без него работать не будет).

4) Target Hosts и Target Ports оставляем со звёздочкой (*), протокол TCP.

5) В Action выбираем свой прокси из списка, жмём Save Rule.


После настройки обязательно перезапустите компьютер, оба процесса Antigravity теперь ходят через ваш прокси. Работает по такому же принципу с любым другим приложением, просто добавляйте


Репост из: Метаверсище и ИИще
Видео недоступно для предпросмотра
Смотреть в Telegram
Hyperion 2.5: Довольно огненная модель от Топазянского.

TLDR: это немного больше, чем просто «Topaz научился сохранять в 10-bit».

Topaz выпустил Hyperion 2.5 - модель SDR→HDR, специально заточенную в том числе под 8-битное AI-видео. Она принимает обычный SDR/GenAI ролик и не просто перекладывает его в 10-битный контейнер, а пытается реконструировать дополнительный диапазон яркости и цвета, после чего может вывести результат в(!): ProRes 10-bit, H.265 10-bit или 16-bit half-float EXR.

Все эти ваши\наши видеогенераторы отдают сильно пережатый 8-bit материал. Если потом начать агрессивно красить его, например, в Resolve, вытягивать свет, делать маски, композ или HDR-master, быстро вылезают бендинг и ступеньки в градиентах и разваливающиеся цвета. Hyperion пытается восстановить недостающую информацию *до* грейда, чтобы материал вел себя ближе к нормальному high-bit-depth-исходнику. Topaz уже показывает production-кейс студии Primordial Soup Даррена Аронофски: они прогоняли GenAI через Hyperion 2.5 в 10-bit ProRes именно перед тяжелым цветокором, а в другом шоте использовали его для подавления заметного бендинга.

Но важная оговорка: Hyperion не может физически вернуть цвета, которые генератор никогда не в жизни не видел. Это AI-реконструкция/предсказание дополнительной информации. То есть это скорее «умный HDR remaster», чем магическое превращение 8-bit в настоящий camera RAW. Галлюцинация в более пригодный для поста dynamic range.

Из любопытного: с новым 16-bit EXR пока есть вопросы к color management. Юзеры уже обнаружили несоответствие между заявленным ACES2065-1 и метаданными Linear Rec.2020, плюс жалуются на пересвеченный результат во Fusion.

Но процесс адаптации убогого генератива для лухари-поста уже пошел, это очень круто. Ждем нативные 4К во всех генераторах и ну композить.

Hyperion 2.5 доступен в актуальном Topaz Video, не в старом прекращенном Topaz Video AI. Работать можно локально или через облачный рендер. Сейчас отдельный план Topaz Video указан как $19/месяц по акции вместо $39, в него входит 400 cloud credits, дополнительные кредиты стоят $0.10 за штуку. Есть и Topaz Studio за $34/месяц при оплате $399 за год, куда также входит Video и ежемесячные кредиты.

https://developer.topazlabs.com/video-models/video-utilities/hyperion-2.5-sdr-to-hdr-new
https://www.topazlabs.com/news/primordial-soup-uses-topaz-hyperion-2-5-to-bring-8-bit-genai-into-10-bit-pro-video-finishing-workflows

Видос полезный, кстати, там Сиденский, Астра и прочие инструменты.

@cgevent


Репост из: Русский ИТ бизнес
С 17 августа цены на DeepSeek API взлетают. Итак:

Вне пика: input дорожает на 50%, output — на 125%.
В пик: input дорожает в 3 раза, output — в 4.5 раза.

tg / max


Репост из: Програмысли - Михаил Фленов
Мы стали забывать, как выглядит ИТ-шный голый четверг.

Что-то мне надоело, что мне не хватает 500 гигабайт у Razer и решил посмотреть в интернете, сложно ли добраться к SSD у Razer Blade 2020 Base модели. Открываю первое же видео и вижу, что оказывается Razer поддерживает два SSD. Справа видно свободный слот.

А у меня как раз от Surface Pro единственное что осталось, так это M.2 NVMe PCIe на 256 гигабайт. Достаточно, чтобы туда игры закачивать. Основной будет использоваться под систему и мои файлы, а дополнительный на 256 под игры.

Установил второй SSD, а загрузка не идёт. Пришлось отключать Secure Boot, снова готовить флешку и обновлять сертификаты. Я только недавно это делал и рассказывал тут. После этого ноут завёлся и теперь можно не держать постоянно подключённый внешний диск.

P.S. А в четверг ешё выйдут Програмысли, где я подробно расскажу про железки на моём рабочем столе


Репост из: PRO РОБОТОВ КАНАЛ
Видео недоступно для предпросмотра
Смотреть в Telegram
Роботизированная птица BionicSwift впечатляет легкостью (42 г) и маневренностью при 68-сантиметровых крыльях.

Инженеры наделили её возможностью выполнять сальто и крутые развороты, а система позиционирования на основе сверхширокополосной связи (UWB) позволяет устройству летать стаей до пяти штук включительно.
—————————
✔️Подписывайтесь на лучший  канал PRO Роботов

🥲Мы в Max


Репост из: AI Product | Igor Akimov
Google выкатил Gemini 3.7 Flash

Их прорвало что ли? Или летние нагрузки меньшие освободили GPU для тренинга?

– Цена не изменилась: $0.75 / $3.75 за 1M токенов. Для сравнения: Claude Sonnet 5 – $2 / $10, GPT-5.6 Terra – $2 / $12 (он типа круче Луны) То есть Flash в 2.5–3 раза дешевле конкурентов. Но это промо-цена до конца 2026. С января – $1.50 / $7.50. Хах, тут каждые 2 недели выходят новые модели, а они рассказывают, что будет через 5 месяцев :)
– FrontierCode 43.6% – лучший результат среди всех, включая Sonnet 5 и GPT-5.6. Огоняет флагманы конкурентов в production-коде
– AutomationBench (автоматизация enterprise-процессов): 30.4% против 10.7% у Sonnet 5
– Длинный контекст: 97% на MRCR при 128k.
– Понимание PDF (GDP.pdf): 34% – тоже лучший результат, хотя абсолютные цифры показывают, что до "решённой задачи" всем ещё далеко

Слабые места тоже есть: агентские задачи (Terminal-bench 3.0, OSWorld) – GPT-5.6 заметно впереди, а в знаниевой работе (GDPVal) лидирует Muse Spark.

Короче, перейти с 3.5/3.6 наверное стоит после тестов, для больших доков, обработок и кодовых баз должно быть норм.

https://deepmind.google/models/model-cards/gemini-3-7-flash/


Репост из: Русский ИТ бизнес
⚡️ Google выпустил Gemini 3.7 Flash

Новая модель заметно сильнее 3.6 Flash в кодинге и агентах. Google снизил цену вдвое: $0.75 за миллион входных токенов и $3.75 за миллион выходных. По бенчмаркам 3.7 Flash уже очень близка к Claude Sonnet 5, а стоит почти в 3 раза дешевле.

Делать сайты в ai studio станет еще проще…


tg / max


Источник: Хабр.
https://share.google/d80l1vemVjAPAawOd


Репост из: Русский ИТ бизнес
Скачал Handy чтобы мой блоггерский вайб-кодинг сделать еще тупее и проще. Программа расшифровки того, что надиктовал. Работает локально, бесплатно. Попробую - отпишусь. Это я команды в Cline хочу так делать :)

tg / max


Репост из: Русский ИТ бизнес
Ставьте Alipay приложение. Дальше вам нужен загранпаспорт чтобы пройти верификацию с помощью nfc (прикладываете телефон). Еще немного бюрократии и у вас базовый уровень и верифицированный аккаунт.

Потом заходите в свой банк (у меня втб) и там есть перевод в Китай на Alipay. Все. И вам открывается дивный мир поклонников огнедышащих драконов :) куча сервисов на выбор.

tg / max


Репост из: AI Product | Igor Akimov
Grok 4.6 вышел

Главный фокус – долгоживущие агенты и интерактивная/визуальная работа: модель должна держать задачу на много шагов, а не выдавать один хороший ответ.

– AA Intelligence Index: 61 против 56 у Grok 4.5. Это ровно уровень GPT-5.6 Sol Max (61) и почти Fable 5 Max (62). Скачок за месяц серьёзный. Прикольно, что в табличке в скриншоте не боятся показывать бенчмарки, на которых не занимают 1 места. Сейчас все в тройке, но при этом цена вообще мизерная - $2 / $6 за 1M токенов, есть fast-вариант вдвое дороже. Первую неделю – 2x включённого лимита в Grok Build и Cursor.
– Доступ сразу везде: Cursor, Grok Build, API, OpenRouter, Vercel, Cloudflare.
– Тренировали интересно: Grok 4.5 использовали, чтобы перегенерировать SFT-траектории для 4.6, а мусорные трейсы отфильтровали модельными проверками. Модель учит модель.

В кодинге пока чуть отстает, а вот в работе белых воротничков - лидер: GDPval-AA v2 — 1753 (у Fable 1741, у GPT 1728), AA-Briefcase – 1577, и особенно Harvey LAB на юридических задачах: 15.8% против 11.3% у Fable и 2.5% у GPT-5.6. Разрыв в шесть раз.

Кажется это сейчас лучший вариант для длинных агентов над документами и офисной работой: разбор договоров, заявок, отчётности.

x.ai/news/grok-4-6

Показано 20 последних публикаций.