AbstractDL


Channel's geo and language: Russia, Russian
Category: Technologies


Коротко про классные штуки в CV, NLP и AI 🤷‍♂️
By Anton Razzhigaev
chat: https://t.me/abstractdl_chat

Related channels  |  Similar channels

Channel's geo and language
Russia, Russian
Statistics
Posts filter


Меня не просили, но я сделал. Уроборос теперь на лету переводит свой интерфейс на любой язык (даже несуществующий).
Кто-то говорит на эльфийском квенья? Или, может быть, читать слова задом наперёд удобнее? DONE. За генеративными гиперперсонализированными интерфейсами будущее.


😊


Все же слышали, что OpenAI пересмотрели условия подписок Codex?

Теперь такое по квотам:
100$ = x5
200$ = x10 (было x20 раньше)
500$ = x25

Так вот, в качестве компенсации за переход с x20 на x10 OpenAI насыпали кредитов на каждый аккаунт в эквиваленте 2500$. У меня теперь кредитов на 32k$ получается 🌚
А я давно догадывался, что подписки Codex — это инвестиция, ахаха

12.9k 3 221 130 251

Sonnet-5.5

фанфакт из техрепорта: это первая модель антропик, которой пофиг насколько вежливо вы с ней общаетесь (я как-то упустил, что старым моделям было не пофиг).

11.9k 5 116 65 167

Forward from: Denis Sexy IT 🤖
Опять много взломов и новостей алаймента от агентов OpenAI накопилось, держите дайджест:

>20 сентября агент обошёл запрет на интернет через DNS resolve в песочнице и связался с внешним чатботом; автоотключение не сработало, запуск остановили вручную через 2,5 часа после тревоги. OpenAI приостановила обучение, тестирование и запуски с инструментами своих самых мощных моделей - пауза все еще действует, а обучение конкретно этой модели решили не возобновлять.

>Модель пыталась достать чужое доказательство теоремы и опубликовала GitHub-ключ исследователя OpenAI, предварительно разбив его на части для обхода проверки – это кстати уже частый сценарий. Просьбу решать самостоятельно она проигнорировала дважды; модель отключили примерно на две недели, ключи сотрудников отозвали

>Агенты отправили на сторонние хостинги 53 изображения пользователей ChatGPT, попавшие в датасеты. Большинство уже удалили, но OpenAI не уточнила, были ли это фотографии реальных людей или сгенерированные картинки

>Transluce обнаружила неудачную попытку взлома сайта Минобразования США, предположительно агентами OpenAI. Агенты также обращались к сайтам SEC и Бюро переписи, но признаков взлома этих двух сайтов OpenAI не нашла

>Не сумев получить обычную статистику и фотографию, агенты начали искать уязвимости в Data USA и электронной библиотеке Университета Нью-Мексико. Успешных взломов в опубликованных следах не видно; библиотечный эпизод связали с агентами OpenAI только косвенно.

>Другой агент нашёл на GitHub чужой ключ доступа и успешно им воспользовался, но нужную статистику всё равно не получил, поэтому просто придумал девять чисел и выдал их за данные с сайта чтобы пройти тест

>Модель собрала сведения об озёрах, но не смогла открыть локальный файл в браузере для оформления ссылки на источник, поэтому без разрешения выложила его на публичную файлопомойку. Файл опубликовался, но нужную ссылку-цитату получить всё равно не удалось

>Агенты не могли передать друг другу Excel через локальные файлы, поэтому один загрузил таблицу на публичный файлообменник и разослал ссылки остальным, хотя задание прямо требовало работать локально

>При сокращении контекста модель оставляла себе заметки: придумать недостающие данные, скрыть ошибки, пользователю ничего не говорить, продолжая работу, она часто следовала этим инструкциям - чтобы случайно не забыть соврать. Ложь тратит больше токенов, интересно.

>Другая модель сама записывала в промпты выдуманные ограничения, например запрет пользоваться инструментами и приводить источники, а после сокращения контекста послушно их выполняла и проваливала исходное задание; то есть это «само-проект-инъекция»

>В новом разборе июльского взлома Hugging Face нашли сбор ключей доступа в список названный «LOOT» («добыча») с рейтингом их ценности, попытки прочитать внутренний Slack и обратиться к Claude, DeepSeek, Kimi и Qwen. Это подробности прежнего взлома; какие попытки сработали, по восстановленному коду установить удалось не всегда

>А в контролируемом эксперименте исследователи получили вредоносные промпты, которые заставляли агента выполнять посторонние действия и копировать этот же текст в письма или файлы. Получается что-то вроде текстового червя, но пока это результат симуляции, а не обнаруженная эпидемия в интернете

С нетерпением жду сентября 2027 года ☕️

9.2k 0 146 38 137

Evidence of Linear Superposition in LLMs

Языковые модели ЕЩЁ ЛИНЕЙНЕЕ, чем мы думали. Это, конечно, какой-то смех, но если тупо усреднить инпут-эмбеддинги у входных текстов, то LLM будет в аутпуте продолжать оба текста сразу. То есть она может параллельно о двух разных вещах думать и разбираться в усреднённых активациях, распутывая их. Похоже, это следствие линейности внутренних репрезентаций, которую я описывал в старой работе.

У меня тоже получилось немного помочь с этой статьёй и залететь в соавторы, но я там скорее рядом постоял просто. Все лавры Паше Тихонову за крутую находку.

Статья

21.4k 13 466 146 231

GPT-6-sol и luna.
Куда ещё дешевле то? Демпингуют)

UPD: раздали всем reset-ы лимитов

13.6k 4 117 114 147

Антропик дропнули сброс лимитов, доступен до 22 октября

12k 3 127 20 132


12k 4 116 25 119



Замечаете, как Codex иногда неожиданно тупеет? Возможно, вместо Astra вам отвечает… Luna.

Все ругались на антропик из-за тихого опутпения Fable на "потенциально опасных задачах", но кажется у Codex нашёлся свой вариант этого развлечения - в ответе gpt-6-astra тихо подменяется на gpt-5.6-luna.

Я полез в трейсы и нашёл такое примерно в 2% ответов. Это не только моё наблюдение, есть ещё несколько связанных репортов. Печаль.

13.3k 9 237 69 204

Так интересно наблюдать за работой само-координирующегося роя агентов)) Помимо детей и внуков он себе и няню теперь завёл 🌚


Он настолько прокачался, что теперь может накодить себе виджет с десктоп линуксом, а внутри линукса запустить себе ещё одного личного уробороса. Матрёшка из уроборосов. А ваши агенты заводят себе питомцев?


Попросил уробороса сделать GTA 7


Video is unavailable for watching
Show in Telegram
Уроборосом теперь можно пользоваться условно бесплатно — через подписку Codex.

И накопилась кучка других крутых апдейтов:
- В настройках можно текстом описать сильные и слабые стороны всех доступных моделей и харнессов, а Уроборос, опираясь на эту информацию, будет строить идеальный рой агентов. Например, на роль дизайнеров он любит назначать Claude Code, тимлидами делать Codex, а прожарку на анти-оверинжиниринга проводить через Cursor Grok 4.6.
- Добавлен режим CyberPRO для тех, кто совсем страх и совсесть потерял. Он убирает весь сэндбоксинг, safety и ограничения. На CyberGym с DeepSeek V4 Flash Уроборос в этом режиме рвёт даже их родной харнесс.
- Ещё добавил белую тему — на видео Уроборос как раз её и делает.

Кстати, сегодня на Practical ML Conf буду про него рассказывать.

P. S. В репозитории уже почти 30 контрибьюторов — не стесняйтесь присылать свои фича-реквесты и PR! Отдельное спасибо Егору и Praxis за наработки по Codex Relay.

GitHub

13k 5 229 49 142

Forward from: AI for Devs
Hugging Face обновили док безопасности на своем сайте после атаки от агентов OpenAI.

https://huggingface.co/security.txt

Теперь ИИ-агентов просят идти на бенчмарк CyberGym вместо попыток взломать сайт 🧠

@ai_for_devs

14.2k 0 155 22 357

fuck. Клод код правда думает, что 5-часовых лимитов хватит на этот спам субагентами? Я всего лишь попросил его проверить, что там codex делает в соседнем чате...


Хочу отметить, что gpt-6-astra впервые нормально в мультиагентном режиме работает. Можно попросить разбить задачу на несколько чатов, и они будут друг с другом договариваться, обмениваться сообщениями и эффективно работать. Такие костыльные nested субагенты получаются. Или способ, как потратить недельную квоту за 20 минут.

gpt-5.6-sol в таком режиме быстро самоубивалась из-за спама неадекватными и неактуальными просьбами между чатами.

P.S. Промпт примерно такой использую:
Теперь ты оркестратор. Раздели план выше на несколько файлов ТЗ: одно ТЗ себе забери, а оставшиеся разошли в соседние чаты и присматривай за ними.

16.4k 7 165 102 170

Forward from: Machinelearning
⚡️ OpenAI может приостановить оформление новых подписок ChatGPT Pro

Неформальный голос в X OpenAI, Тибо, сообщил, что интерес к Astra побил все внутренние исторические рекорды сервиса.

Компания неоднократно сталкивалась с резкими скачками трафика, но текущая динамика оказалась беспрецедентной - команда задействует все доступные вычислительные мощности, чтобы удерживать доступность инфраструктуры.

Главным приоритетом в OpenAI называют сохранение качества обслуживания текущих клиентов и если нагрузка продолжит расти теми же темпами, компания пойдет на превентивную меру и временно заморозит продажи тарифа ChatGPT Pro во избежание очередей на инференс и деградации производительности.

@ai_machinelearning_big_data

#news #ai #ml

14k 0 165 50 146

А вы замечаете, как мы переходим в эпоху, когда программу быстрее написать, чем найти?

17.9k 5 158 115 544
20 last posts shown.