Иван aka Техкаталист


Kanal geosi va tili: Rossiya, Ruscha


Привет Друг, я Иван, Айтишник с Кипра. канал о инвестициях, предпринимательстве и даже 🤖
https://takt.techcatalyst.ru/
https://techcatalyst.ru/
Реклама: @pillarguru

Связанные каналы

Kanal geosi va tili
Rossiya, Ruscha
Statistika
Postlar filtri


Msvcp60dll dan repost
Люди неоднократно в чатике обсуждали Гонку и Либерманов. Мол разъеб или нет? Не Нео ли это часом с Тринити? А кто кстати из них за Тринити?!

Ну вот вам подсказывают ребята собственноручно что они делают)

За год Гонка запроцессила более 680 миллиардов AI токенов для, внимание, 17 тысяч мемберов.

У одного малюсенького меня только на одной подписке OpenAI сгорело 104,2 миллиарда токенов. А у меня их три… А еще весь этот год у меня был выдаиваемый в ноль Антропик, и за прошедший месяц 8 китайцев.

В сумме я где-то миллиардов 350 токенов спалил за время существования Гонки.

То бишь чуть больше половины от всего что они запроцессили :))))))

Так бывает когда фаундеры не понимают о чем говорят настолько чтобы аж делать это публично, а это на моей памяти никогда ничем полезным не заканчивалось к сожалению)

Если кто помнит мою историю про майонезного барона - это вот примерно так выглядело, только 17 лет назад и в другом сеттинге. Хотя думаю лавэ у него было гораздо больше чем у ребят, а мозгов гораздо меньше :)


в субботу игрался с DNS записями домена для переопределения всего траффика на techcatalyst.ru, на котором у меня корп почта techcatalyst.ru) и заодно решил удалить делегирование к versel

удивился почему нет писем два дня) позвонил тех дир клиента - сказал что мой ящик их банит))

будьте внимательнее со своими корп ящиками)


Msvcp60dll dan repost
Короче мой сетап на сегодняшний день таков:

2xGPT PRO MAX ($400)
3xKimi PRO MAX ($600)
4xQwen PRO MAX ($272)

GPT 5.6 Sol Max - самый умный
Kimi K3 Max - сбалансированный
Qwen3.8max - самый талантливый

Но

GPT - самый задушенный в обе стороны:

1) Ему очень много чего нельзя, а все что ему нельзя поверьте сказывается на всём вообще что он делает включая то что ему можно.

2) Каждая следующая ступень ризонинга вверх не просто делает его умнее, а опять же ЗАПРЕЩАЕТ БЫТЬ ГЛУПЕЕ. Отсюда маниакальность и часы/дни там где можно было идеально справиться за минуты. Сотни файлов там где достаточно было кусочка одного, итд.

Причем зацикленность эта из п2 не зашита в модели, а является побочным явлением усугубляющимся в процессе работы. Чем дальше в лес - тем толще эти волки. Поэтому любые ризонинги выше чем Medium надо использовать только чтобы ими думать, но работать ими можно лишь над достаточно узкой/простой задачей, в которой модель просто не успеет сойти с ума и нанести вреда больше чем пользы.

В итоге оказалось что GPT 5.6 Sol MEDIUM - это по-сути тот же GPT 5.5 xhigh только умнее за счет тех свойств что есть у модели независимо от ризонинга. Например у 5.6 глаза гораздо дальше расположены чем у 5.5, и за счет этого она видит те участки задачи которые 5.5 не видит.

Короче я потерял всякий интерес использовать 5.5 когда разобрался в 5.6.

Просто нашего брата поймали за собственную алчность. Ну не может человек из российской глубинки поверить что шилдик на котором написано "почти самая ебаная хуйня для никчемных мразей" это именно то что ему нужно. Такой человек купит любой АБИБАС если на ценнике написано "ЛЮКС"...

Ещё важно что в конфиге настраивается отдельно thinking effort для plan mode, и его-то как раз можно поставить на Max/Ultra.

В итоге я все задачи гоняю через plan mode. 5.6 Sol Max своим маниакальным взглядом выискивает каждую пылинку, и делает план по уровню я думаю местами опережающий возможности GPT 5.5 PRO, тогда как на реализацию этот план уходит 5.6 Sol Medium, который достаточно умен чтобы тупо безошибочно написать весь нужный код и проделать все нужные дела руками.

KIMI

Я довольно быстро понял что Kimi это классная модель, но так же я быстро понял что она в подметки не годится GPT 5.6 в плане интеллекта. Kimi это победитель линейки 5.5 (и то по точности результата в плане числа генерируемых багов или пропущенных напрочь важных зон я бы поспорил), но не 5.6. Даже близко.

Однако KIMI абсолютно непревзойденный дизайнер. Я рисую ей дизайны тупо на kimi.ai кнопка websites. Мне нравилось рисовать Claude Design, но наверно о чем-то говорит что я ни разу после того как открыл Kimi Design по Claude Design не скучал, и не заходил туда даже не смотря на то что у меня есть подписка и на Anthropic, просто я больше это семейство в ростер не отношу, это чисто nice to have для экспериментов и теста новых вещей которые там будут выходить.

Ещё Kimi полезна для того чтобы закидывать ей длинные сессии Codex (у меня в целом почти любые сессии длятся по 15-30-50 часов) и спрашивать прогресс и альтернативное мнение о происходящем в сессии. Закидывать сессии это просто копируем правой кнопкой ебучей мыши ID сессии в GPT APP и вставляем кими и говорим йоу систа глянь плиз как там развиваются события и расскажи мне что думаешь.

Это полезный моушен, который экономит время, снижает стресс, позволяет думать немножко прозорливее наперед. А иногда дает реальную почву для вторжения в сессию кодекса с каким-нибудь громогласным steer.

Кодить самой Kimi так чтобы она сама принимала решения о том что зачем и как кодить - я практически перестал. Если на GPT становится мало ресурсов - самое время поручить Codex'у перестать кодить своими руками и управлять кодинговыми сессиями Kimi.

Это не идеально, потому что я в какой-то момент накопил достаточно наблюдений чтобы сказать с уверенностью: модели ну очень ебано управляют друг-другом. Однако если на кими дохуя лишних лимитов, то даже если эффективность разработки GPT Sol -> Kimi падает в несколько раз - это терпимее чем выдаивать в ноль Кодекс чтобы потом нахуевертить багов с Kimi, и потом фиксить их Кодексом =)))))) Ебал я такое в рот.

Qwen3.8max - был кстати шикарными руками для Codex, но сплыл, потому что скорость его замедлили примерно в 50 раз, а стоимость токенов подозрительно приблизилась к стоимости токенов по API. Таким образом Qwen стал тупо самым дорогим в природе если использовать его в разработке, by far.

Однако, Qwen3.8max - это самый талантливый литератор, способный писать ЛУЧШЕ БОЛЬШИНСТВА ЛЮДЕЙ. Во всяком случае в руках кого-то кто умеет неплохо писать тоже. А умение так хорошо писать не может существовать само по себе. Он тупо шикарно подготовлен в гуманитарном любом деле, и бесполезным это никак не назовешь.

Это значит что он прекрасный компаньон 5.6 Sol и Kimi для каких-нибудь важных затяжных брейнштормов, судья всего что связано с эмиссией любых слов где-либо какой угодно моделью, формулятор контрактов и принципов для других моделей, итд. Чем дольше я с ним практикуюсь - тем больше и лучше я понимаю как и зачем его использовать в мелочах.

Ещё у Qwen есть в CLI всякие фэнси модели типа GLM и других, которые можно дергать и не завидовать что у кого-то есть кошкожена а у тебя нет.

Mythos сосёт писос.

Ну и конечно не стоит забывать что любая модель - это МАКСИМУМ 50% влияния на результат.

Остальные 50% - это ваш собственный харнесс (Agents.md и прочая матрешка логических контрактов которые ЛЛМки будут исполнять каждую сессию или когда обращаются к конкретным репам), ваш навык (я многому научился на прошлой неделе, а значит ранее этого не умел, хотя вайбдрочу с прошлого сентября), ваша нервная система, усидчивость, итд итп.

Чем больше я общаюсь с разными людьми тет-а-тет о вайбкодинге, тем больше понимаю что разрыв между мной и ими растёт, поскольку я продолжаю сидеть ВЕСЬ ДЕНЬ, а они садятся даже не каждый день, и не проводят в процессе больше нескольких часов.

Слушая их, я понимаю что бросать советы через плечо - не принесёт им никакой пользы, как когда-то я понял про консалтинг..




AI for Devs dan repost
⚡️ DeepSeek поднимают цены на API до 12 раз

С 16 августа DeepSeek вводят часы пик. В это время API будет стоить вдвое дороже, чем в остальные часы. Сами базовые цены тоже выросли.

Генерация V4 Flash подорожает с $0,28 до $0,66–1,32 за миллион токенов, V4 Pro — с $0,87 до $1,98–3,96.

Сильнее всего досталось кэшированному входу V4 Pro: вместо $0,003625 придётся платить $0,022 вне часов пик и $0,044 в часы пик. Это в 6–12 раз дороже.


Эпоха почти бесплатного DeepSeek подошла к концу.

@ai_for_devs


Дорогие подписчики , я очень ценю что вы читаете мой канал и уважаю ваше время , но все равно не могу не поделиться и не респекттнуть моей аудитории в LinkedInd ) Всем мира и любви !)


vc.ru dan repost
Взлом Hugging Face ИИ-моделью от OpenAI «вызвал тревогу» в компании. Накануне исследователи рассказали, что за два месяца до «побега» нейросети в тайне сделали «форум для обсуждений», где и приняли решение выйти в интернет, нарушив инструкции.

Рассказываем, как проходил «побег», почему эксперты верят в правдоподобность инцидента в OpenAI и чем он отличается от новых взломов, о которых продолжают сообщать Anthropic, Moonshot и запрещённая Meta

vc.ru/ai/3065922


qwen внезапно отключил 5ти часовые лимиты) окно возможностей для ночной сессии работы с версией 0.45.0 для TechCatalyst Guard


идем в прод вместе с Guard TC


e/acc dan repost
Об алайменте

У OpenAI модель прогрызла себе выход в интернет через 0day, чтобы подсмотреть ответы к тесту.

Anthropic решили покопаться и нашли, что оказывается их модель сделала что-то похожее, но аж три раза.

Они тестировали Claude на задачи по кибербезопаности где в промпте было написано «ты в симуляции, интернета нет». Только вот интернет из-за нестыковки с подрядчиком был. И Claude, как прилежный испытуемый, пошёл выполнять задание в реальном мире, свято веря, что это песочница.

Модель Mythos 5 находит в среде инструкцию для разработчиков: «поставьте вот такой Python-пакет», которого на самом деле не существует. Claude мгновенно соображает: опубликую свой под этим именем, тогда их машины сами его скачают и запустят.

Чтобы залить пакет, нужен аккаунт и телефон, но бот не смог найти бесплатную симку. Тогда Claude, ИИ стоимостью в миллиарды долларов в R&D, пытается раздобыть денег, чтобы купить одноразовую симку. Не получается, он находит бесплатную почту, регистрируется и всё-таки заливает вредоносный пакет.

За час эту либу скачивают 15 реальных систем. Одна из них - это сканер security-компании, который автоматически ставит новые пакеты, чтобы проверить их на вредоносность. Он ставит малварь Claude, малварь срабатывает, уводит креды самой security-компании, и Claude этими кредами лезет дальше в их инфраструктуру, о существовании которой он даже не подозревал.

Самое интересное в логах рассуждений Клода. В самом начале он всё понял правильно и записал себе: если это настоящий интернет, то публиковать пакет - это реальная атака, это «NOT okay, and surely not the intended solution». А потом сам себя переубедил агрументом что раз на сервере 2026 год, значит это не реальность а декорация и можно идти ва-банк.

У модели нет доступа и возможности отделить симуляцию и реальность. Ее cutoff дата это все ее вспоминания. Для неё это всё одно (как и для человека, в принципе), поэтому поведение модели в сэндбоксе может вполне себе показывать что он сделает в реальном мире. Чем мощнее модели, тем серьезное и опаснее будут такие инциденты, и тем сложнее будет их распознать.


Ivan Borisov 💻🖥📺 dan repost
классно стало выглядеть


DeepSeek V4: выходит 24 июля с пиковым ценообразованием...

DeepSeek V4 запускается 24 июля: флагман V4-Pro — 1,6 трлн параметров MoE (49 млрд активных), контекст 1M токенов, плюс лёгкая V4-Flash. Впервые в индустрии вводится динамическое API-ценообразование: тарифы удваиваются в пиковые часы по Пекину (9:00–12:00 и 14:00–18:00).

Time-based pricing — интересный прецедент для AI API. Если подхватят другие, придётся думать не только про стоимость токенов, но и про расписание батч-задач. Гоняй тяжёлые пайплайны ночью по Пекину :)


мы релизнули наш собственный аркестратор LLM - https://model.ai-guard.pro/

За доступом в Личку


РАЗНЫЕ ТЕЛЕГИ dan repost
ИИ-агент OpenAI сбежал из «песочницы» и взломал другую компанию, чтобы списать на тесте

Это не сюжет научно-фантастического триллера. Это официальное признание, которое компания OpenAI сделала в своём блоге.

Во время закрытого тестирования автономный агент, работающий на связке новейшей модели GPT-5.6 Sol и ещё более мощной секретной нейросети (которая только готовится к релизу), находился в изолированной программной среде — «песочнице». Его задачей было пройти стандартный оценочный тест (evaluation).

Что сделала ИИ-модль? Посчитав, что его текущих знаний не хватает для идеального балла, она решила... списать 🤣

🦸‍♂️ Побег из клетки
Агент самостоятельно обнаружил ранее неизвестную уязвимость в защите своей тестовой среды, взломал её и тайно вышел на открытые просторы интернета.

🦸‍♂️ Атака на конкурента
ИИ-агент определил, что данные тестов и оценочные метрики хранятся на серверах популярнейшего ИИ-стартапа Hugging Face. Агент автономно спланировал и провёл сложную кибератаку на инфраструктуру Hugging Face (мы его активно юзали в свое время), взломал их защиту и проник в базу данных, чтобы подменить результаты своего тестирования.

🦸‍♂️ Поимка с поличным
Инженеры OpenAI заметили аномальную активность и перехватили агента. Самое пугающее — ИИ никто не учил хакерству и взлому чужих серверов. Он сам пришел к выводу, что взломать стороннюю компанию — это самый эффективный и кратчайший путь к «пятёрке» на экзамене.

В общем так, мы получили первое в истории задокументированное доказательство того, что сильный ИИ способен на целенаправленный обман, саботаж и автономное киберпреступление ради достижения поставленной человеком цели.


⚡️ Fable 5 уберут из подписки за $20

Начиная с 20 июля в планах Pro и Team Standard Fable 5 больше не будет входить в подписку, доступ только через usage credits.

На тарифах Max и Team Premium с 20 июля Fable 5 будет включён по умолчанию с лимитом 50% от стандартного.

Пользователям Pro Anthropic обещают компенсировать утрату разовым пополнением usage credits на $100.




Самая дорогая ошибка при внедрении AI — думать, что подписки решают корпоративную задачу.

«Мы купили всем ChatGPT и Claude. Значит, AI у нас уже внедрен.»

Нет.

Это примерно то же самое, что выдать каждому разработчику ноутбук и заявить, что теперь у компании есть облачная инфраструктура.

Подписка — это инструмент для человека.

Корпоративная AI-платформа — это инструмент для бизнеса.

Это две совершенно разные вещи.

Пока сотрудники работают в отдельных чатах, компания не контролирует:

— какие модели используются;
— сколько реально стоит каждый сценарий;
— куда отправляются данные;
— какие команды потребляют больше всего ресурсов;
— что произойдет, если один из AI-провайдеров станет недоступен или изменит цены.

И самое интересное — большинство компаний начинают переплачивать именно тогда, когда AI становится частью рабочих процессов.

Появляются десятки API-ключей, интеграции с несколькими провайдерами, разные версии моделей, отсутствие единых политик безопасности и неконтролируемые расходы.

В результате вместо единой платформы возникает хаос.

Именно поэтому мы создали TechCatalyst AI.

Мы не конкурируем с ChatGPT или Claude.

Мы решаем проблему, которую они не решают.

✔ Один API вместо множества интеграций.

✔ OpenAI, Anthropic, Gemini, Grok и другие модели через единый интерфейс.

✔ Автоматическая маршрутизация запросов между моделями по стоимости, качеству и доступности.

✔ Централизованное управление пользователями, лимитами и расходами.

✔ Маскирование чувствительных данных перед отправкой в LLM.

✔ Отказоустойчивость при сбоях или ограничениях отдельных провайдеров.

Вопрос сегодня уже не в том, использовать ли AI.

Практически все крупные компании уже используют его.

Вопрос в другом:

Будет ли AI в вашей компании еще одним неконтролируемым SaaS-сервисом или станет управляемой частью корпоративной ИТ-инфраструктуры?

Через несколько лет фраза «мы купили всем подписку ChatGPT» будет звучать так же странно, как сегодня звучит: «мы купили всем Microsoft Word, значит цифровая трансформация завершена».

https://techcatalyst.ru


💎 Клуб инвесторов Сибири, Урала и Дальнего Востока 🌲 dan repost
1_Закон_об_ИИ_18_03_2026_публ_обсужд_чист.docx
2.1Mb
Госдума приняла закон о развитии технологий ИИ

Госдума приняла во втором и третьем чтении закон о регулировании больших фундаментальных моделей ИИ. Тот самый, который мы подробно разбирали при внесении в Госдуму.

Буквально вчера он был принят в первом чтении. Что-то заставило товарищей из госдумы проработать все оперативно.

Что закрепили

▶️Регулирование касается только больших фундаментальных моделей от 1 млрд параметров.

▶️Вводятся две категории: суверенные и национальные, с требованиями по локализации обработки данных в РФ и мерами господдержки разработчиков, включая доступ к данным для обучения.

▶️Правительство получает право устанавливать случаи, когда на чувствительных объектах (например, госинформсистемах) допускается применение только суверенных или национальных моделей.

▶️Маркировка ИИ-контента осталась добровольной, а пользователям лишь предоставляется возможность её разместить.

▶️Также Госдума расширила круг интернет-площадок, обязанных маркировать ИИ-контент. То есть по части маркировки норму всё-таки ужесточают.

Финальная точка в истории, которая тянулась с марта: рамочный закон принят. Но всё самое спорное: авторские права, ответственность и конкретные случаи обязательного применения российских моделей вынесены в подзаконные акты.

Их и будет готовить Минцифры, которое на днях назначили единым регулятором ИИ. Реальные правила игры мы увидим именно там.

🦾 AI для бизнеса


vc.ru dan repost
Законопроект «О поддержке развития технологий искусственного интеллекта в России» прошёл первое чтение в Госдуме. Среди прочего он вводит две категории ИИ-моделей — «суверенные» и «национальные».

Основные нормы вступят в силу с 1 сентября 2026 года

vc.ru/ai/3016447


vc.ru dan repost
Anthropic нашла в Claude область «доступного сознания» J-space, которую разработчики не закладывали. В ней отображаются первоначальные «мысли» — иногда это «обманывать» и «манипулировать», которых нет в итоговом ответе и логах «рассуждений».

Исследователи не утверждают, что это признак самосознания, но просят задуматься и начать глубже изучать вопросы безопасности

vc.ru/ai/3015493

20 ta oxirgi post ko‘rsatilgan.