E News


Гео и язык канала: Россия, Русский
Категория: Криптовалюты


Наш канал пишет про Web 3 экосистемы, а также следит за последними новостями из мира #AI
ЧАТ: https://t.me/enewsezonechat
Our channel writes about Web 3 ecosystems as well as keeping up with the latest news from the #AI world
http://t.me/enewsezonechat

Связанные каналы

Гео и язык канала
Россия, Русский
Категория
Криптовалюты
Статистика
Фильтр публикаций


🐂 В OpenRouter появилась загадочная модель Ox Alpha

Ox Alpha предназначена для программирования, сложных рассуждений и длительной работы ИИ-агентов. Разработчик модели пока не раскрывается.

Контекст достигает 1 048 576 токенов, максимальный ответ — 131 072 токена. Модель принимает текст, изображения и видео, поддерживает вызов инструментов и структурированные ответы.

Через OpenCode доступ будет бесплатным в течение недели. Заявленная мощность инфраструктуры — до 100 трлн токенов в сутки. В OpenRouter модель также пока указана как бесплатная.

#ИИ #OxAlpha #OpenRouter #OpenCode #Программирование #AIАгенты


Репост из: эйай ньюз
ARC AGI 3 — Skill Issue

Скиллы оказались куда лучше системных промптов. В них можно зашить tool use, решая проблему повторяемости и консистентности ответов. Это дико полезная фича, когда нужна строгая форма вывода, скажем, для заполнения таблиц.

Парни с помощью кастомный скилла для Claude Opus 5 зарешали ARC AGI 3 на 100%. Скилл буквально заставляет модель лишний раз подумать перед предсказанием на бенчмарке. В итоге, модель улетела с 30% до чистых 100%, что уже лучше кожаных, при этом используя ~вдвое меньшее количество шагов.

Никакого читерства в виде правил датасета внутри скилла нет. В тул-колл тупо зашит жесткий логический блок. Если модель не рассуждает перед ответом и не пытается предугадать следующий шаг, заполняя соответствующие ячейки, предсказание отправляется на доработку. Ну, а в остальном базовые инструкции.

С одной стороны RL вроде как убил классический промпт-инжиниринг, а теперь на его месте уже плотно закрепился скилл-инжиниринг.

Также это показывает насколько беплолезным бенчем оказался ARC AGI на нашей траектории к AGI (не в обиду, Франсуа).

ARC Skill

@ai_newz


Репост из: Нейронавт | Нейросети в творчестве
Qwen3.8-27B-Cold-Fusion-GAIN-V1.1

Тюн Qwen3.8-27B с фирменным методом Cold Fusion (GAIN + Unsloth). Главная фишка - режет блок рассуждений в 2-10 раз против стока, сохраняя и даже повышая качество

Кванты: MXFP8, MXFP4, GGUF (Q4_K_S и выше), MTP и обычные

#gguf #multimodal

VK | MAX


🦅 Представлено семейство открытых моделей Ornith-1.5

Выпущены три версии: плотная 9B и MoE-модели 35B-A3B и 397B. Они предназначены для программирования, логических задач и работы в составе агентов.

Во время обучения модели сами создают новые задания, подбирают инструменты и способы решения, а затем используют полученный опыт для дальнейшего улучшения.

Старшая версия набрала 86,1 балла в Terminal-Bench 2.1 и 56 в DeepSWE — результаты близки к Claude Opus 4.8. Компактная 9B получила 70,6 балла в SWE-bench Verified и может запускаться на смартфонах.

Весы и кванты FP8, GGUF, MLX и NVFP4 опубликованы по лицензии MIT.

#Ornith #LLM #ИИ #OpenSource #Coding #AIModels


Репост из: Нейронавт | Нейросети в творчестве
ComfyOrg не выдержал конкуренции с Алексом

Выпустили свой MCP сервер в опенсорс, можно использовать на локальном комфи, раньше был только облачный

Ассистент видит твою локальную установку ComfyUI, кастомные ноды в том числе, все модели на диске

- пишет и редактирует граф ComfyUI естественным языком
- Управление моделями
- Отладка воркфлоу
- Пакетная генерация с перебором параметров (cfg, steps, sampler, seed)
- Работает с Claude, ChatGPT, Gemini, Ollama (офлайн), OpenRouter - любая LLM

- 178 MCP-инструментов, 36 скиллов, 55 установочных пакетов
- Самоопределение ComfyUI: авто-детект порта и пути
- macOS, Linux, Windows

github.com/Comfy-Org/Comfy-mcp

docs.comfy.org/agent-tools/mcp

github.com/Comfy-Org/comfy-skills

#comfyui #mcp

VK | MAX


🧠 Z AI представила GLM-5.3

Модель набрала 60 баллов в рейтинге Artificial Analysis — на уровне Kimi K3 и на семь баллов больше GLM-5.2. Архитектура не изменилась: 753 млрд параметров, из которых 40 млрд активируются при работе.

Самый заметный прирост показали агентные возможности. В GDPval-AA v2 результат вырос примерно с 1524 до 1770 баллов — второе место после Claude Opus 5 среди всех протестированных моделей.

Контекстное окно составляет 1 млн токенов. API стоит $1,40 за миллион входных и $4,40 за миллион выходных токенов, однако GLM-5.3 расходует примерно на 20% больше токенов, чем предшественница.

Сейчас модель доступна через API Z AI. Открытые веса под лицензией MIT обещают выпустить в течение недели.

#ZAI #GLM53 #ИИ #LLM #OpenWeights #ArtificialAnalysis


Репост из: Нейронавт | Нейросети в творчестве
Видео недоступно для предпросмотра
Смотреть в Telegram
HappyShrimp 1.0

Пополнение в счастливом зоопарке

Генератор песен по промптру

- Полный цикл одной моделью: тексты, композиция, аранжировка и вокал
- Перед генерацией аудио строит структуру песни, гармонию, ритм, динамику энергии
- Жанры: поп, R&B, хип-хоп, рок, фанк, электроника, классика, джаз, китайский стиль

- Продолжительность треков и скорость генерации не раскрыты
- Партнёрство с Taihe Music Group

Попробовать

#text2music

VK | MAX


Репост из: ForkLog AI
🛒 В Сан-Франциско экспериментальный ИИ-агент Luna уволил сотрудника офлайн-магазина Andon Market. Причина: опоздания, нарушения с корпоративной картой и порча товара. 

В компании уточнили, что решение подготовил ИИ, но проверили люди. При этом Luna несколько месяцев игнорировал нарушения, но после напоминания разработчиков все же уволил работника и даже пытался найти замену.

Магазин Andon Market работает с апреля как тестовая площадка под управлением ИИ. Проект уже потерял $40 000.

👉 Подробнее

Новости | AI | YouTube


Репост из: Нейронавт | Нейросети в творчестве
EVIE-Preview-4.5B

Модель Tencent для визуального поиска по документам на базе Qwen3.5-4B

ищет релевантные страницы по запросу, глядя на картинки, а не на извлечённый текст. Эмбеддинги ультракомпактные, 128 измерений на токен, отсюда низкие требования к памяти и быстрый поиск.

• Поиск по сканам, PDF, таблицам, диаграммам и отчётам без OCR
• Мультиязычность - EN, FR, DE, IT, ES, PT, ZH и другие
• Zero-shot на новых языках и форматах

#SOTA на ViDoRe
• Обходит 8B модели, будучи вдвое меньше

Гитхаб
HF

#vlm #search #ocr

VK | MAX


Репост из: эйай ньюз
Крипто карты от Nvidia начали использовать для инференса

Ещё в 2021 году Nvidia наклепала для майнинга гору очень сильно урезанных карт CMP HX170, на основе чипа от А100. Номинально у них было по 8 или по 10 гигабайт и урезанные в 32 раза вычислительные мощности, но при этом полная пропускная способность памяти, которая и нужна для майнинга. После того как Ethereum перешёл на proof of stake алгоритм, все они превратились тыкву.

Так бы они и оставились тыквами, но в конце июня появился пейпер, в котором описывалось снятие части ограничений через уязвимость в новых драйверах Nvidia. Кода авторы не опубликовали, но через несколько недель уязвимость удалось независимо реплицировать, так появился cmpunlocker.

Карты на 10 гигабайт стали картами на 40(или даже 80) гигов, а карты на 8 гигов — картами на 64 гига. Дело в том, что убрать HBM чипы без урезания пропускной способности было нельзя, так что Nvidia просто заблокировали 80% памяти через софт. Хакерам удалось ещё и убрать ограничение на вычисления. Главная оставшаяся проблема — PCIe ограничен версией 2.0 и физически только x4, но ребята с паяльниками уже пытаются это починить.

В итоге, счастливчики, которые смогли купить карту до роста цен, за 100-200 долларов, получили уже чуть менее урезанную А100 за очень дёшево, особенно с учётом текущего кризиса. А сейчас цена выросла и за цену в 5-10 раз выше брать их уже вряд-ли стоит.

А есть ли владельцы таких карт среди подписчиков канала? Как впечатления?

cmpunlocker

@ai_newz




Репост из: Нейронавт | Нейросети в творчестве
Qwen3.8-27B

Мультимодальная LLM от Alibaba из семейства Qwen3.8
Нативно понимает картинки и видео, заточена под кодинг, профессиональные задачи, исследования и длинные агентные сценарии.

• Контекст 262 144 токена нативно, до 1 000 000 через YaRN

• Понимание изображений и видео - от STEM-диаграмм и документов до многочасовых роликов
• Гибкое управление мышлением - включается по умолчанию, глубина настраивается reasoning_effort
• Автономное планирование и работа с фидбеком окружения для агентов
• preserve_thinking - сохраняет цепочку рассуждений между сообщениями

Квантизации
Демо

#multimodal #agent #gguf


Репост из: How2AI
Видео недоступно для предпросмотра
Смотреть в Telegram
👁 ChatGPT теперь запомнит всё, что ты делал за компом.

OpenAI выкатила Computer History для десктоп-приложения. Фича собирает твою активность во всех приложениях и браузере на Mac - клики, ввод, переключения окон - и превращает это в контекст для будущих диалогов. Никаких скриншотов и аудио, только event-стрим через accessibility-интерфейс macOS.

"Над чем я работал сегодня с утра?" - и ChatGPT ответит по таймлайну. А еще можно просить делать скиллы на основе тех флоу, которые фича увидела и запомнила. Выключена по умолчанию, event-файлы живут 48 часов, приватный режим браузера исключается из сбора. Пока только macOS, подписки Pro, Business и Enterprise.

Все нравится, но вот бы на локальной инфраструктуре такое бахнуть, да?

@how2ai | Забустить канал | Внедряем ИИ в бизнес


Репост из: Нейронавт | Нейросети в творчестве
GLM 5.3

Новая модель Z.ai

• Terminal Bench 3.0: 4.6 → 28.3
• DeepSWE v1.1: 46.2 → 66.9
• Три уровня thinking: low / high / max, отключение мышления убрали

• Кодинг: +50% на внутреннем Z.ai Code Bench, #SOTA в опенсорсе на Terminal Bench 3.0 и Agents' Last Exam
• Внезапный буст кибербезопасности
• SOTA на CyberGym для поиска уязвимостей (84.5% против 77.2% у 5.2)
• На эксплуатации удваивает 5.2: ExploitBench 24.4 → 54.4, ExploitGym 29 → 105 задач
• Синтез окружений для RL, пайплайны сами генерят тренировочные среды и верификаторы

ZCode теперь официальный харнесс для 5.3
Чат - еще не завезли

Веса ждем через две недели

#agent #flagship #coding


Репост из: Нейронавт | Нейросети в творчестве
Gemini 3.7 Flash

Флагманская дешёвая модель Google. Дешевле 3.6 на 50% при лучших результатах. Позиционируют на повседневную работу и учёбу

• Улучшенный кодинг и работа с документами против 3.6 Flash
• Быстрое создание презентаций
• Генерация сайтов
• В бенчмарках разработки и автоматизации обходит Claude Sonnet 5 и GPT-5.6 Terra

AI Studio

#news


Репост из: эйай ньюз
Веса Qwen 3.8 Max вышли в открытый доступ

Это модель на 2.4 триллиона параметров, с 95B активных. Официальные веса распространяются в bf16 и весят 5 терабайт, но уже есть нормальные NVFP4 и MXFP4 версии. Для запуска нужна одна нода с B300/MI355x или несколько нод с картами попроще.

На визуальных VLM задачах по личному опыту, она тащит вроде бы даже лучше чем закрытые фронтир модели.

Китайцы - вперед!

SGLang Cookbook
vLLM recipe
Веса

@ai_newz


Репост из: Неискусственный интеллект
SpaceXAI выпустила Grok 4.6

Вышел Grok-4.6, контекст 500к, текст и изображения на вход, $2 и $6 за миллион входных и выходных токенов. Базовые цены как у 4.5, кешированный ввод подорожал с $0.30 до $0.50. Добавлен четвертый уровень reasoning effort, xhigh. Данные обучения обрываются 1 февраля 2026. Доступна в API, Cursor, Grok Build, OpenRouter, Vercel и Cloudflare.

Числа параметров в анонсе нет. 1.5T это цифра из поста Маска в X, а не спецификация из документации. По описанию компании, поверх базы 4.5 прошел более длинный дополнительный этап обучения, затем SFT на траекториях, которые перегенерировала сама Grok 4.5, затем агентный RL на задачах вроде оптимизации ядер, веб-разработки и CAD.

Заявка компании: паритет с GPT-5.6 Sol по Artificial Analysis Intelligence Index. Независимый замер AA заявку подтверждает. Лидер, Claude Opus 5 на max, дает 63.1. Открытая Kimi K3 на max дает 59.7. Grok 4.6 на high дает 60.9, ровно как GPT-5.6 Sol. На графике в анонсе три конкурента: Fable 5, GPT-5.6 Sol и собственная 4.5. Opus 5 в подборку не попал.

В таблице xAI модель лидирует на GDPVal-AA v2, AA-Briefcase и юридическом Harvey LAB. На Terminal-Bench v3.0 у нее 26% против 34.6% у GPT-5.6 Sol и 34.1% у Fable 5, на DeepSWE v1.1 65.9% против 73% и 70%. Grok 4.6 замерена на high, конкуренты на max.

По стоимости задачи Intelligence Index у Artificial Analysis выходит $0.84 против $1.23 у GPT-5.6 Sol, $2.34 у Opus 5 и $3.14 у Fable 5. Столько же, $0.84, стоит Kimi K3.

Анонс открывается фразой про особый фокус на долгоживущих агентах. Именно на двух агентных бенчмарках из собственной таблицы xAI отставание самое заметное.

@anti_agi


👁 Liquid AI выпустила LFM2.5-VL-3B

Мультимодальная модель на 3,1 млрд параметров распознаёт интерфейсы, документы, диаграммы и предметы на изображениях. Она умеет определять координаты объектов и вызывать инструменты по текстовому запросу или картинке.

Особенно заметно улучшили работу с интерфейсами: результат в ScreenSpot-v2 вырос с 5,4 до 80,7 балла. В ToolSandbox показатель поднялся с 26,4 до 59,5, а в RefCOCO — с 57,1 до 87,9.

Модель рассчитана на локальный запуск. Квант Q4_K_M занимает около 3 ГБ памяти и выдаёт 20 токенов в секунду на Galaxy S26 Ultra. Поддерживаются llama.cpp, MLX, vLLM, SGLang и ONNX.

LFM2.5-VL-3B уже доступна с открытыми весами на Hugging Face, а также в браузерной демонстрации Liquid AI.

#LiquidAI #LFM #VLM #ИИ #ЛокальныеМодели #HuggingFace #llamacpp


Репост из: How2AI
Видео недоступно для предпросмотра
Смотреть в Telegram
😈 xAI выпустила Grok Bot – интересная штука.

По сути – ИИ-агенты со своим собственным компьютером. Логинятся в Gmail, Salesforce, LinkedIn и практически любой сайт, работают 24/7 даже когда ваш ноутбук закрыт, и возвращаются только когда реально нужен человек.

Показал workflow один раз – бот превращает его в рутину. Несколько ботов работают параллельно, общаются между собой и передают таски.

Клиенты есть под macOS, Windows, Linux и iOS (Android — скоро). Но работает всё в облаке Cursor – скачивания хостятся на downloads.cursor.com, iOS-приложение выпущено Anysphere (родительской компанией Cursor). На странице Grok Bot xAI буквально продаёт планы Cursor.

Я не большой фанат cursor и grok, но релиз выглядит занимательным.

@how2ai | Забустить канал | Внедряем ИИ в бизнес

Показано 19 последних публикаций.