Кожаные мешки


Channel's geo and language: Russia, Russian
Category: Technologies


Фильтрую поток контента про AI для себя и для вас.
@iegorov553

Related channels

Channel's geo and language
Russia, Russian
Statistics
Posts filter


Forward from: AI Projects
🧠 Yuntian Deng, профессор из Гарварда (Associate, Harvard SEAS; Assistant Professor, UWaterloo), ранее был известен в узких кругах экспертов своим интересным проектом ProgramAsWeights (PAW). Однако как шутку на PAW он написал перевод с естественного языка на «Клодский»:
https://programasweights.com/claudish

Между тем PAW — интересная концепция, т.к. очередной умный китаец-профессор в ИИ предложил компилировать промпты для программы не в исполняемый код, а фактически сразу в нейросеть через крошечный LoRA-адаптер примерно ~23 МБ.

Работает это так:

1. Вы пишете промпт на свободном языке, он далее обязательно должен быть переработан ИИ в псевдокод, т.к. принципиален лингвистический denoising, т.е. очистка от семантического шума болтовни «кожаных» и перевод в паттерны ИИ. Это делает обычная SLM без дообучения, главное — не промпт от человека сразу.

2. Формируются входные данные как исходный промпт, псевдокод и подготавливаются всего 64 пустых вектора-токена.

3. Специально обученная нейросеть формирует эти 64 вектора, из которых потом и собирается крошечный LoRA-адаптер для запуска локально. По факту это компиляция не в код, а в нейросеть.

Решение может делать простые вещи кроме переводов на «Клодский» язык: может чинить поломанные форматы или классифицировать источники. Причём когда готова LoRA, она может делать это на 100% локально на крошечной нейросети.

Какие тут интересные инсайты:

• Переформулировка задачи ИИ своим языком — принципиальный момент для успеха решения задачи ИИ дальше, т.к. ИИ понимает только сам себя хорошо.

• Наши задачи для программирования намного проще для ИИ, чем нам кажется, т.к. фактически для него это тюнинг классификаторов задач. Даже небольшое подпространство критериев классификации может решать огромное количество задач программирования.

• Сама по себе идея компилировать задания не в код традиционных языков программирования, а сразу в веса нейросети выглядит интересной, и там, где решения вероятностные по смыслу, то вполне рабочий подход.

Отметим, что Маск считает, что такой метод компиляции спеков (ТЗ) сразу в веса убьёт многие традиционные языки программирования и среды как минимум в мобильных приложениях.

https://arxiv.org/abs/2607.02512v1


Forward from: AI Projects
🤖 Агенты уже расходуют в 5 раз больше токенов, чем люди запросами в чатах по данным Open Router. Конечно, там человеческие запросы искажены, но тем не менее есть разные оболочки чатов, и видно, что уровень их растёт медленно, а агенты показывают экспоненциальный рост потребления токенов.

Это говорит о том, что не только настало время агентов, но и что их автономность растёт быстрее ожиданий даже экспертов.


Forward from: AI Projects
🚩 Financial Times пишет, что экспортный IT-сектор Индии фактически разрушен ИИ и официальная статистика с падением акций индийских ИТ компаний не отражает масштаба кризиса и безработицы. Ранее активно Индия продавала труд дешёвых кодеров, которые правда имели репутацию бракоделов. Тем не менее, многие компании готовы были идти на риски качества для экономии бюджетов. Однако как появились ИИ-боты, то сразу выяснилось, что от них намного меньше проблем, чем от индийских ИТ-крестьян, а стоят LLM дешевле.

В чём-то мы на примере Индии видим, где именно в ИТ создаёт ИИ угрозу рабочим местам — низкоквалифицированный или неопытный персонал. Ранее индус или джун могли работодателю предъявить аргумент низкой цены за низкое качество, но сейчас этот аргумент растворился.

https://www.ft.com/content/dee4bd2c-fbad-4713-9b14-22d441967ce4?syn-25a6b1a6=1


Forward from: AI Projects
🚩 Composio провело тесты с участием DeepSeek Harness, Pi, Claude Code и Hermes Agent.
Можно считать уже доказанным, что Claude Code специально спроектирован для перерасхода токенов, чтобы выполнять планы продаж Дарио. Причём перерасход токенов явно более высокая цель у Anthropic, нежели success rate у агента. Claude Code правда быстрее решает задачи за счет своей стратегии "жадного чтения" с огромным перерасходом токенов.

DeepSeek Harness показывает, что он действительно самый экономичный агент за счёт стратегии бережливости к целостности KV Cache, что даёт экстремально успешный cache hit даже в мультиагентах. Фактически у DSH попадание в кеш примерно также успешно на мультиагентах-долгожителях как у моногоагента. Причём все это работает не только в теории, но и на практических тестах сторонних организаций.

В целом, если посмотреть, то лучшие агенты сейчас Pi Agent и DeepSeek Harness: в части успешности работы и цены они примерно равны. Однако DSH намного быстрее Pi. Также степень кастомизации и надёжности защиты плагинов от падения у DSH выше. Добавляем сюда поддержку вендора LLM вроде DeepSeek с прямым обучением на агента — и становится понятно, что Pi проиграет DSH, хотя сейчас Pi занимает #2 место после DSH по росту звёзд. Разработчики считают, что кастомизируемость текущих агентов слишком слабая, и ранее нишу занимал Pi Agent, но на его поляну зашёл DSH.

https://x.com/composio/status/2090069397050097864/photo/1


Forward from: Machinelearning
Video is unavailable for watching
Show in Telegram
✔️ MiniMax сделала агента полного цикла для видеопроизводства

MiniMax Design - это приложение под Windows и MacOS в виде мультимодального агента, который сам разбирает задачу на шаги, пишет сценарий, собирает раскадровку, генерирует изображения и видео, а потом монтирует, накладывает озвучку и субтитры и отдает готовый ролик.

Продукт не появился из ниоткуда - это развитие прежнего инструмента MiniMax Hub.


Внутри сидит новая модель H3. По словам компании, система сама разбирает задачу и решает, какие материалы взять за референс, что оставить, а что переделать. Дальше она упаковывает все это в формат, который подходит для H3.

Для сложных кадров есть режиссерский 3D-инструмент для расстановки персонажей, движения и ракурсов камеры перед генерацией сцены.

Профессионалам обещают подключение готовых воркфлоу ComfyUI - их можно гонять в облаке или локально, а агент поможет подкрутить ноды и параметры генерации.

Кроме H3, MiniMax Design умеет использовать и другие модели на разных этапах (для картинок, видео и звука).

🟡Тарифы

Подписка помесячная или годовая, при оплате за год два месяца бесплатно. Тарифы различаются они только объемом кредитов - набор возможностей везде одинаковый.

🟠Starter - 10,5 доллара в месяц (8,4 при годовой оплате).

10 000 кредитов в месяц: 83 секунды видео H3 в 2K или 143 секунды в 768p, 125 картинок в GPT Image 2, 167 в Nano Banana Pro, 500 треков в Music 2.6, 200 тысяч знаков озвучки в Speech 2.8.


🟠Plus - 76 долларов в месяц (60,8 если платить за год).

87 000 кредитов: 725 секунд H3 в 2K или 1243 секунды в 768p, 1088 картинок в GPT Image 2, 1450 в Nano Banana Pro, 4350 треков, 1,74 млн знаков озвучки.


🟢Pro - 215 долларов в месяц (172 если за год)

270 000 кредитов: 2250 секунд H3 в 2K или 3857 секунд в 768p, 3375 картинок в GPT Image 2, 4500 в Nano Banana Pro, 13 500 треков, 5,4 млн знаков озвучки.


На всех тарифах доступны все модели MiniMax для видео, голоса и музыки, GPT Image 2 и Nano Banana Pro, плюс параллельность генерации.


@ai_machinelearning_big_data

#news #ai #ml


Forward from: e/acc
В Пекине прошла очередная Олимпиада роботов со своей роботической церемонией открытия, 51 спортивной дициплиной.

Больше 2000 роботов из 600+ (больше 90% из Китая) команд сыграли больше тысячи матчей.

Например, в беге победитель пробежал стометровку за 9.39 сек, что больше рекорда человека (9.59 с). Для сравнения, самый быстрый робот в прошлом году пробежал за 21 секунду.

Для почти всех дисциплин в этом году требуется полная автономия, то есть запрещены телеоперации и управление с джойстика. В некоторых случаях типа уборки помещений это возможно, но тогда очки команды делятся на 2.

Выводы:
1. Через несколько лет, я уверен, почти не останется дисциплин, где роботы не превосходят человека
2. Роботика вне Китая это конечно смех. Тесла, наверное, молодцы, но они совершенно не конкурентны по цене
3. Самое веселое это не только победы, но забавные ситуации когда роботы бегуны и теннисисты искрят, ломаются пополам, теряют голову, руки, ступни.


Forward from: Data Secrets
Video is unavailable for watching
Show in Telegram
Робот поставил мировой рекорд в беге на 100 метров

В Пекине стартовали Вторые Всемирные игры гуманоидных роботов. Включены: легкая и тяжелая атлетика, футбол, настольный теннис, большой теннис, единоборства, танцы и, дополнительно, всякие бытовые задачи типа открывания бутылок, сортировка и пр.

В первый же день сразу несколько роботов побили мировой рекорд на стометровке. Первым прибежал Tiangong Ultra, разработанный пекинским Центром инноваций. Его результат – 9,39с. Официальный человеческий мировой рекорд Усэйна Болта – 9,58 с.


Forward from: Технозаметки Малышева
В Сингапуре запустили дата-центр на живых нейронах

Австралийский стартап Cortical Labs вместе с NUS и оператором DayOne запустил первый в биологический дата-центр в Сингапуре.
Вместо кремниевых чипов данные обрабатывают живые человеческие нейроны, выращенные в лаборатории.

🧠 Что внутри: 20 биокомпьютеров CL1, в каждом от 200 000 нейронов на кремниевом чипе с электродами.
Нейроны выращивают из клеток крови, перепрограммированных в стволовые.
Каждые три дня их кормят коктейлем из сахара, микронутриентов и pH-буферов, а газовый смеситель подаёт кислород, азот и углекислый газ.

🎮 Тесты и скорость:
DishBrain, предшественник CL1, в 2022-м за минуты игры научился отбивать мяч в Pong (arXiv), причём человеческие нейроны учились быстрее мышиных.

В феврале 2026-го исследователь Sean Cole за неделю научил 200 000 нейронов играть в Doom: находить врагов и стрелять (видео).
Играет, по словам Cortical Labs, как новичок.

По чистой скорости биология проигрывает: нейрон срабатывает ~1000 раз в секунду, GPU работает на гигагерцах. Кремний сильнее для быстрых точных расчётов, это признаёт сам основатель.

Почему сравнивают с GPU: Сила нейронов в другом.
Энергия: CL1 ест 30 ватт, NVIDIA H100 SXM до 700, сервер с восемью такими чипами около 10 200 ватт.
Обучаемость: нейронам достаточно небольшого количества примеров, как человеку, в этом они эффективнее алгоритмов на датасетах.

💼 Зачем это нужно: Аренда CL1 стоит $2 200 в месяц, вполовину дешевле $4 300 за топовый AI-чип в облаке.
В Мельбурне уже 120 CL1 и около 20 платящих клиентов, в Сингапуре планируют дойти до 1 000 юнитов после одобрения регуляторов.

📺 Аналогии в н/ф:
Робокоп, в принципе, это и есть CL1: живая нервная ткань, вшитая в электронный корпус. У Мёрфи мозг взяли у человека, здесь нейроны вырастили в чашке, но механика та же.

В Матрице фильм рассказывает про батарейки, но есть ощущение, что в оригинальном сценарии машины подключали людей именно как распределённую вычислительную сеть из живых мозгов, а «батарейки» появились, чтобы зрителю было понятнее.
У машин был тот же план, что у Cortical Labs: нейроны как дата-центр потому, что это дешевле, чем кремний.

#нейроны #биокомпьютинг #датацентры #corticallabs
------
@tsingular


Forward from: Технозаметки Малышева
🔥 СРОЧНО!
Новая секретная модель Ox Alpha (которая, по слухам Gemini 3.5 Pro),- бесплатная на nousportal
https://portal.nousresearch.com/

Ставим в Гермеса и тестируем все воскресенье.

Им выдали 1 квадриллион токенов в сутки на ограниченное время.

Главное,- это доступно даже без платной подписки, т.е. для Free режима.

Просто регаемся и пользуемся.

Кто первый выдоит квадриллион из Ноусов,- тот и победил :)

#NousResearch #free
------
@tsingular


Forward from: Технозаметки Малышева
Еще больше кадров с открытия Олимпиады роботов

Спасибо @Alaventer за подгон :)

#роботы #Китай
------
@tsingular


Forward from: Dealer.AI
Скейлить веса недостаточно. Теперь не только слова от 📦

Scaling Law умер? Нет, он просто стал сложнее (с).


Я очень много говорил о том, что недостаточно тупо скейлить веса. Также описывал возможные комбо текущих подходов, и тем самым, как делать прорывы, на примере DeepSeek Moment.

И вот на прошлой неделе основатель Zhipu AI Тан Цзе (он же профессор Tsinghua) опубликовал в X пост (кстати ссылку не нашёл, но скрин остался), который уже называют "манифестом новой эры масштабирования". А следом вышла GLM‑5.3 – модель, которая без увеличения параметров обогнала все открытые аналоги и вплотную приблизилась к закрытым флагманам. Да ещё и спасла HF от взломов.

Как такое возможно? И почему "добавить ещё параметров" больше не работает? Да ещё раз.

Разбираемся по пунктам. 😎

1. Главный тезис: у scaling теперь несколько ручек.

Тан Цзе говорит прямо - вопрос "сколько у модели параметров?" потерял смысл без трёх других:

• сколько у вас данных и какие они?
• сколько compute вы готовы потратить на один forward pass?
• как вы делаете пост‑тренировку и RL?

Раньше все крутили одну ручку – параметры. Теперь их как минимум четыре, и каждая даёт свой прирост.

2. Как индустрия пришла к этому.

Сначала все верили Kaplan (OpenAI, 2020): параметры должны расти быстрее данных. Родилась гонка за триллион – GPT‑3, Gopher, MT‑NLG.

Потом пришла Chinchilla (DeepMind, 2022) и перевернула всё: оптимально ~20 токенов на параметр, расти нужно примерно одинаково.

Но и это оказалось не финалом. Сегодня модели вызываются миллиарды раз в день – inference cost стал важнее тренировочного.
Новый тренд: deliberately over-trained модели.
Пример: Llama‑2‑7B  с 290 токенов на параметр,
Gemma‑2‑9B с  889.

А с MoE картина стала ещё сложнее: total параметры отвечают за знания, активируемые – за глубину рассуждений. Логично, ведь по сути веса модели это сильно нелинейная  "структура знаний", деревья рядом не стоят.

3. Научное обоснование - статья Roberts et al. (2025)
Тан Цзе ссылается на "свежее" исследование:
• Запоминание (знания) - оптимально иметь больше параметров.
• Рассуждение (логика, кодинг) - оптимально иметь больше данных (чистых в тч) и меньше параметров.
• При фиксированном TPP увеличение total параметров ухудшает reasoning, а активация большего числа экспертов - улучшает.
Иными словами, если вы тренируете модель для программирования - наращивать параметры бессмысленно, лучше дать ей больше примеров цепочек кодинга и больше времени на пост‑тренировку.

По проще скажу так, чем больше вариантов исходов цепочек рассуждений видит модель, тем лучше она сходится. Это очень логично, ведь модели учатся по методу макс правдоподобия - что чаще видим в контексте+ответ на обучении то и выдаем. Те все эти темы с промптингом, контекст инженерей и test time scaling следуют одной цели - сделать такой контекст который сузит окно вероятных ответов. А с глубокими цепочками исход почти предопределен, что должно быть в итоге.

4. Эксперимент GLM‑5.3, как доказательство автора.

Zhipu взяла GLM‑5.2 и GLM‑5.3 с абсолютно одинаковой архитектурой:
• 753B total параметров
• 40B activated
• одинаковый претрен

Единственное отличие, что GLM‑5.3 получила месяц дополнительной пост‑тренировки - long‑horizon environments + RL.

Результаты говорят сами за себя:

• AA Intelligence Index: 53 → 60 (+7 пунктов)
• Terminal‑Bench 3.0: 4.6% → 28.3% (рост в 6 раз!)
• DeepSWE: 46.2% → 66.9%
• CyberGym (восстановление уязвимостей): 84.5%, а это уровень Anthropic
• ExploitBench (использование уязвимостей): 24.4% → 54.4% (более чем вдвое)

Модель вышла на один уровень с Claude Fable 5 и GPT‑5.6 Sol, а среди открытых - первое место вместе с Kimi K3.

5. Бонус - неожиданный поворот с безопасностью.

GLM‑5.3 оказалась настолько сильной в кибербезопасности, что Zhipu отложила открытие весов на две недели, чтобы оценить риски.

Ирония: месяцем ранее именно открытая GLM‑5.2 помогла Hugging Face отразить атаку OpenAI, когда американские закрытые модели отказались помогать. Теперь же сами разработчики столкнулись с дилеммой "too capable to open‑source".

6. Что это значит для всей индустрии.

• Гонка триллионов параметров - это был объездной путь. Индустрия коллективно ошиблась, экстраполируя ранние Scaling Law за пределы их применимости.
• Scaling не умер – он стал многомерным. Теперь прорывы будут идти не от увеличения модели, а от умных стратегий пост‑тренировки, deeper reasoning во время инференса, эффективного использования MoE.
• Главная метрика будущего - «интеллект на доллар».
В тч писал об этом тут, но для инференса, а почему бы и не быть метрикой для эффективности обучения. 👍

Итого, GLM‑5.3 достигла топ‑уровня с наименьшей стоимостью за задачу среди всех frontier‑моделей.

Открытым остаётся вопрос: существует ли "Chinchilla для RL" ? Когда мы узнаем оптимальное соотношение для пост‑тренировки – это станет следующим большим открытием.

Мое мнение.
Это не просто новость о китайской модели. Это открытое заявление о смене парадигмы, которую все ждали.

Раньше мы сравнивали модели по количеству параметров, как мегапиксели в фотоаппаратах. Теперь это бессмысленно. Важно, как вы используете compute - на претрен, на RL, на инференс.
Zhipu показала, что можно догнать лидеров, не увеличивая модель, а просто лучше её дообучая. И это открывает дорогу для многих игроков с ограниченными бюджетами.

К сожалению мы видим, как некоторые игроки на рынке играют в большие веса, но по качеству на деле не лучше GPT 120b oss или китайских моделей до 100B. При этом они имеют размер несколько раз больше... Но проблема там не только в этом... Однако об этом, мы тоже уже говорили тут в канале и в моих выступлениях.

Важно, какие выводы будут сделаны сегодня, иначе завтра топ модели очень быстро убегут от вас за счёт: процессов разработки и рнд, политики внутри компании, инженерии, данных и петли самоулучшения.


Forward from: Data Portal | DS & ML
Офигеть, теперь даже игровой ПК может запускать передовые модели с интерактивной скоростью, используя официальные веса без экстремального квантования.

Исследователи из UC Berkeley, MIT и UT Austin открыли исходный код FreeToken — системы, специально созданной для запуска сверхбольших MoE-моделей на обычных компьютерах.

В статье они показывают очень впечатляющие результаты:

Qwen3.6 35B → ноутбук с RTX 4060 8 ГБ → 39 токенов/с

DeepSeek-V4-Flash 284B → RTX 5090 → 22–25 токенов/с

GLM-5.2 753B → RTX PRO 6000 → 15 токенов/с

По сравнению с Ollama скорость генерации выше в 3–4 раза, а обработка входного контекста — в 6–30 раз быстрее.

То есть игровой ноутбук всего с 8 ГБ видеопамяти уже может запускать модель на 35 млрд параметров почти на 40 токенах в секунду.

И это даже быстрее медианной скорости генерации Codex в 33 токена/с, которую авторы приводят в статье.

Главная идея FreeToken в том, чтобы заставить GPU, CPU, оперативную память и PCIe работать вместе.

Поскольку MoE-модели для каждого токена активируют только небольшую часть экспертов, нет необходимости постоянно держать сотни миллиардов параметров в видеопамяти.

FreeToken сам решает, какие части модели оставить в VRAM, какие временно переносить из оперативной памяти на GPU, а какие вообще считать на CPU.

На этапе обработки входного контекста система заранее загружает экспертов следующего слоя. Во время генерации она динамически распределяет вычисления в зависимости от текущей скорости CPU, GPU и PCIe.

Есть даже отдельный Agent State Cache.

Когда агент вызывает инструменты, меняет контекст или продолжает старую задачу, FreeToken может пропускать большую часть повторной обработки контекста.

FreeToken поставляется с полноценным графическим интерфейсом.

Не нужно конвертировать модели в GGUF или собирать проект из исходного кода.

Также в FreeToken Desktop уже встроены агентные обвязки - выбираете модель, выбираете приложение и запускаете.

https://arxiv.org/abs/2608.16157


Forward from: CGIT_Vines
Из нижнего интернета принес совсем нишевую историю про процедурное моделирование с помощью ИИ агентов.

Есть разрозненное сообщество, чем-то напоминающее демо сцену нулевых, где ребята собираются и пилят модели на новом уровне, и на самом деле некоторые примеры довольно впечатляющие!
Прикол такого моделирования в том, что, во-первых, оно собирается исключительно агентами, во-вторых, модели собираются из примитивов, в-третьих, можно программировать поведение или анимации, а точнее интерактивность таких моделей.

Они более редактируемы, чем генерации, потому что тут нет лишней геометрии, что и плюс, и минус одновременно, вы не соберете органического монстра с порванной кожей и кишками, например, но можете собрать шкафы, какие-то scifi или hardsurface штуки, которые могут двигаться или сгибаться, например, турели, оружие, автомобили и так далее.
Есть даже ребята, которые хотят запилить маркетплейс с такими моделями, чтобы агенты имели доступ к запчастям, типа огромного китбаш склада для агентов, откуда агенты могли бы брать эти запчасти или части интерактивной логики. В общем, направление очень внушительное, но не без своих проблем.

Приложу некоторые примеры, но в теории технические штуки, в том числе и через CAD моделирование, могут все же выстрелить на ИИ моделях через 1-2 поколения.

@CGIT_Vines


Forward from: Метаверсище и ИИще
Культура ИИ-отмены

Нигерийский писатель Джерри Фаладе написал дебютный криминальный роман Call Me, I’ll Hide the Body. Рукопись вызвала настоящую истерику среди издателей: аукцион с участием 14 компаний, несколько шестизначных предложений в Великобритании и около $2-2,4 млн от принадлежащего Macmillan издательства Minotaur за две книги. Роман собирались выпустить как один из главных релизов 2028 года. Кожаные агенты называли текст «гениальным» и утверждали, что в него влюбились буквально все.

Затем один из редакторов заметил в тексте признаки возможного использования ИИ. Важный нюанс: книгу снял с продажи не издатель после автоматического AI-детектора, а собственные агенты Фаладе. Сначала они поверили его заверениям, что ИИ не применялся ни при написании, ни при редактировании. Но после некой встречи 29 июля, когда некоторые детали его объяснений якобы изменились, агенты заявили, что больше не могут подтвердить происхождение рукописи, срочно разорвали отношения и отозвали книгу со всех торгов. Публичных доказательств генерации текста при это НИКТО не представил.

Сам Фаладе всё отрицает. Он говорит, что располагает черновиками, заметками, датированными сообщениями и материалами ещё 2021 года, то есть до появления ChatGPT. Publishers Weekly действительно ознакомился с частью таких сообщений, но они подтверждают лишь то, что Фаладе давно занимался художественным текстом, а не обязательно происхождение каждого фрагмента финальной книги. Писатель также считает, что подозрения могут быть связаны с расовой предвзятостью.

Самая кожаная часть истории: 14 издателей прочитали якобы «иишный» роман, устроили за него драку и предложили миллионы. И только потом кто-то вспомнил, что ИИ-текст положено презирать. Но утверждать, что книга точно написана нейросетью, тоже пока нельзя.

Самое главное: по состоянию на 21 августа прув или антипрув так и не появился. Ни отчёта AI-детектора с анализом текста, ни сравнений конкретных фрагментов, ни доказательства генерации глав/абзацев, ни судебного иска Фаладе. Свежая большая статья WSJ на этой неделе всё ещё описывает дело именно как случай suspected AI use, а не установленного AI-авторства.

Это я к чему? Вовсе не к тому, кто писал книгу.

А к тому, что теперь нас ждёт новая культура отмены. Можно стукануть или намекнуть, что кто-то использует ИИ - и хоп, кожаные отменяют кожаного, хоть только что вылизывали ему все места. Все это про устройство кожаных, а не ИИ.

Кожаным всегда были важны шашки, а не ехать.

ИИ просто вытаскивает наружу кожаое лицемерие.

Клевая музика?
Да!
Это ИИ.
Фу, песок и тупая аранжировка, отменяем автора.

https://www.wsj.com/business/media/author-whose-2-million-book-deal-was-derailed-by-ai-concerns-says-hes-innocent-c9f4c91b

https://www.publishersweekly.com/pw/by-topic/industry-news/publisher-news/article/100983-after-the-cancellation-of-call-me-i-ll-hide-the-body-what-comes-next.html

https://www.wsj.com/arts-culture/books/generative-ai-book-publishing-be79a287

@cgevent


Forward from: AI Product | Igor Akimov
Deepseek выкатил мультимодальную модель!

deepseek-v4-flash-vision-exp – принимает картинки вместе с текстом: описание изображений, чтение скриншотов, анализ графиков.
По тексту (агенты, reasoning, знания) – на уровне обычного V4-Flash, а на мультимодальных агентских бенчмарках – большой скачок, близко к Opus 4.8
Картинка стоит максимум 384 токена – всё, что больше ~800×800, сжимается до этого размера. 2000×2000 и 5000×5000 съедят одинаково
– тарификация – по ценам V4-Flash: при $0.14/1M input это ~18 тысяч изображений на доллар (в off-peak часы – вдвое дешевле)
– до 600 изображений в одном запросе, форматы JPEG/PNG/GIF/WebP, есть Files API для переиспользования
– работает через три интерфейса сразу: OpenAI Chat Completions, Responses API и Anthropic-совместимый /messages

Короче, надо пробовать. Стоит как обычно копейки вообще. Должна быть сильно и в обработке документов, и в обработке графики (кроме совсем уж плотных текстов)

https://api-docs.deepseek.com/news/news260821/


Forward from: Вайб-кодинг
В OpenCode и OpenRouter появилась загадочная новая ИИ-модель: Ox Alpha 👍

Ее уже прогнали через 10 задач DeepSWE, и она набрала больше 80% против 65% у Fable и 52% у GPT-5.6 Sol.

Модель предлагает контекстное окно на 1 млн токенов, мультимодальные возможности, нулевое хранение данных и почти неограниченное использование в течение целой недели.

Скорее всего, за ней стоит китайская компания.

Бесплатно: https://openrouter.ai/stealth/ox-alpha

16 last posts shown.