ai_machinelearning_big_data | Technologies

Telegram-канал ai_machinelearning_big_data - Machinelearning

287027

Самая актуальная информация из мира ML, Нейронных сетей,DI По всем вопросам- @haarrp @itchannels_telegram - 🔥 best it channels @pythonl - 🐍 @machinee_learning -chat @ArtificialIntelligencedl - AI @datascienceiot - ml 📚 @machinelearning_ru ml

Subscribe to a channel

Machinelearning

🌟 Vercel Labs открыла кодинг-агента размером 6 Мб

Проект fx начинался как внутренний инструмент Vercel Labs и представляет собой харнесс, написанный на Zig для исследования моделей и встраивание в другие системы.

Бинарник весит всего 6,3 Mб, а время запуска заявлено всего в 10 микросекунд, при этом базовое потребление памяти составляет всего несколько мегабайт.

Привязки к конкретной модели или провайдеру нет, инференс годится и локальный, и облачный. Небольшое ядро расширяется через skills, плагины и MCP.

Интерфейс сделан скорее как юниксовая оболочка, чем как IDE в терминале - fx сохраняет историю прокрутки, выдаёт минимум вывода и очень скупо рисует сложный TUI.

Через WebAssembly fx запускается прямо в браузере - попробовать можно на fx.sh/try, ничего не устанавливая.

Приватность заявлена как философия - продуктовой телеметрии нет, сессии и статистика использования остаются локально, а исходный код и промпты не уходят никуда, кроме эндпойнта инференса.

При локальном инференсе и отключённых автообновлениях fx работает полностью герметично.

⚠️ Проект экспериментальный - пользоваться стоит на свой риск. Vercel обещает, что изменения будут частыми.


📌Лицензирование: Apache 2.0 License


🟡Сайт проекта
🟡Документация
🖥Github


@ai_machinelearning_big_data

#AI #ML #Harness #Agents #Fx #Vercel

Читать полностью…

Machinelearning

✔️ 24 августа в ChatGPT появится реклама для европейских пользователей

OpenAI начнет показывать рекламу пользователям из 31 европейской страны. Блоки будут только на тарифах Free и Go, платные подписки их не увидят. В США и еще восьми регионах рекламная платформа работает с февраля 2026 года.

Деньги от рекламы, по словам компании, пойдут на поддержку бесплатного доступа к моделям. OpenAI обещает помечать объявления, не давать им влиять на ответы модели, не показывать рекламодателям содержание чатов и не продавать данные пользователей третьим лицам.

Заявки на размещение бизнес уже может подавать здесь.
openai.com

✔️ Cerebras показала стоечный ускоритель CS-4

На конференции Supernova в Сан-Франциско Cerebras Systems представила CS-4. По заявлению компании, система до 30 раз быстрее кластеров на GPU Nvidia и AMD.

Производительность - 750 PFLOPS, в основе три процессора Wafer-Scale Engine нового поколения. Пропускная способность памяти 129,6 ПБ/с, скорость ввода-вывода 7,2 Тбит/с.

По сравнению с CS-3 производительность выросла вдвое, а памяти на каждый потребляемый ватт стало в 10 раз больше.

Первым заказчикам CS-4 начнут отгружать в текущем квартале.
cerebras.ai

✔️ Китай разрешил ввозить ограниченные партии Nvidia H200

Пекин смягчил собственные ограничения на ввоз ИИ-ускорителей - ByteDance и Tencent получили разрешения примерно на 10 000 чипов H200 каждая, следующие компании стоят в очереди.

Со стороны США ограничения ослабли раньше - Вашингтон предварительно согласовал продажу в Китай до 100 000 чипов на корпорацию.

Nvidia зарезервировала под китайских заказчиков около 500 000 H200, а производители серверов снова принимают заявки на машины с этими ускорителями.
ft.com

✔️ Власти США предупредили об атаках на промышленные контроллеры скриптами, написанными ИИ

CISA, ФБР, АНБ и еще два ведомства выпустили совместное предупреждение об атаках на программируемые логические контроллеры Siemens S7. По их данным, уязвимые устройства ищут и взламывают скриптами, которые сгенерировал ИИ.

Код собран на открытых библиотеках автоматизации и притворяется легитимным инструментом мониторинга. Он позволяет менять конфигурацию контроллера, читать и записывать его память.

По оценке ведомств, ИИ снизил порог входа для атак на промышленные объекты - электростанции, заводы и коммунальные системы. Нынешние вторжения выглядят как разведка, но со временем те же приемы могут пойти на остановку производств и отключение систем безопасности.

Рекомендации стандартные: обновить прошивки контроллеров и полностью убрать их из интернета.
cisa.gov

✔️ Физики передали квантовую запутанность на 420 км

Команда Научно-технического университета Китая связала запутанностью два удаленных модуля памяти на холодных атомах через оптоволокно длиной 420 км.

Достижение важно тем, что превзойден предел PLOB - теоретический потолок для прямой передачи запутанности по каналу без ретрансляции, который начинает мешать после 230 км. Обойти его удалось как раз потому, что квантовая память играет роль промежуточного узла. Это один из кирпичей для будущих квантовых повторителей и квантового интернета.

Чтобы уменьшить потери, квантовую память перевели с длины волны 795 нм на 780 нм и перестроили схему преобразования частот, подогнав сигнальные фотоны под окно сверхнизких потерь волокна. Рассинхронизацию фаз убрали автоподстройкой на двух длинах волн и трех частотах. Интерференция фотонов оставалась стабильной на всех 420 км.

Работа опубликована в Physical Review Letters.
cas.cn


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

✔️Как Mechanical Sympathy и готовые библиотеки помогают ускорить веб-приложения на Spring Boot

Обычно стандартных инструментов хватает, чтобы приложение работало быстро, но иногда требуется добиться большей эффективности. Для этого важно понимать, как приложение работает изнутри, и находить простые нестандартные решения.

О том, как принципы Mechanical Sympathy и готовые библиотеки позволяют ускорить стандартное Spring Boot MVC-приложение, расскажет Сергей Петрелевич на конференции JVM Day, которую проведет Т-Банк 29 августа в Москве.

Мероприятие соберет всех представителей JVM-комьюнити: Java-, Scala- и Kotlin-разработчиков, архитекторов и тимлидов. Участников также ждут доклады о последних новостях JVM-языков, альтернативных моделях конкурентностях после Loom и о том, как E2E-бенчмарки могут вводить разработчиков в заблуждение.

После лекций для гостей пройдет вечеринка с играми на Sega, PowerPoint Party, открытым микрофоном, ИТ-квизом и диджей-сетом на виниле. Зарегаться на конференцию можно по ссылке.

@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

⚡️ MiniMax Music 3: открытая модель генерации музыки с вокалом

MiniMax опубликовал веса модели для создания полноценных композиций длиной до пяти минут, которая понимает музыкальную структуру и выдаёт на выходе 32 kHz стерео в формате 16-bit WAV.

Music 3 управляется промптом из текста песни (с тегами вида [Chorus] или [Solo]) и музыкальным описанием (жанр, BPM, тональность, лад и т.д.).

MiniMax советует разбивать промпт на метаданные, детали вокала и аранжировку, но если лень писать руками, можно прогнать запрос через специальный скилл music-caption-rewriter.


🟡Механика

Под капотом иерархическая авторегрессионная архитектура из двух уровней. Global LLM отвечает за то, как трек устроен целиком, Local LLM - за то, как он звучит в каждый конкретный момент.

🟢Global LLM: Qwen3-8B, у которой на этапе тренировки сделали дотюн эмбеддингов и выходных слоёв на семантические музыкальные токены. Держит структуру трека и кадр за кадром предсказывает первый RVQ codebook - семантический, на 16 384 записи.

🟢Local LLM (0.6B): внутри каждого кадра достраивает оставшиеся 7 акустических кодбуков и возвращает мелкую акустическую детализацию.

Обычно звук декодируют прямо из дискретных RVQ токенов. Здесь вместо этого модуль синтеза сливает финальные скрытые состояния обеих LLM - они непрерывные, и в них остаётся больше информации об артикуляции вокала, текстуре инструментов и непрерывности во времени.

Дальше поток идёт по цепочке: слияние скрытых состояний → Flow Matching на 2.4B → латент Flow-VAE → декодер Flow-VAE на 123M → 32 kHz стерео. Дискретный декодер токенизатора на инференсе не нужен вовсе.

Flow-VAE взят из MiniMax Speech и переобучен под динамический диапазон и спектр музыки.


🟡Доступность

Модель запускается в SGLangHuggingFace Diffusers и ComfyUI.

В полной точности она влезает в 24 GB VRAM, с включённым автоматическим CPU offloading съест около 22 GB.

А если подрубить layer-by-layer streaming для языковой модели, то её вполне можно завести даже на карточках с 8 GB видеопамяти, но придётся ждать результата ощутимо дольше.

🟡Ограничения

🟠Streaming generation сейчас вообще не поддерживается, модель отдаёт только готовый кусок.

🟠Входной промпт ограничен длиной в 5 000 токенов.

🟠Аудиовывод упирается в потолок из 9 000 акустических фреймов.



📌Лицензирование: MiniMax-Music3 Community License


🟡Страница проекта
🟡Веса
🟡Демо
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #TextToMusic #Music3 #MiniMax

Читать полностью…

Machinelearning

✔️ Mistral обновила OCR-модель до версии 4.1

Главный упор сделали на обработку перегруженных страницы, где текст, изображения и подписи идут плотно и наслаиваются друг на друга.

По данным Mistral, модель точнее определяет границы каждого элемента - рамки не съезжают, изображения не наезжают одно в другое по ошибке.

На нагруженных технических диаграммах модель реже теряет блоки, а текстовые выноски считывает как самостоятельные объекты, а не сливает в один массив.

Отдельно заявлена работа с многоколоночными документами, OCR 4.1 сохраняет исходную структуру страницы и отдает каждую колонку отдельной областью текста.

В настроенных процессах тем, кто пользуется моделью, менять ничего не нужно. Алиас mistral-ocr-latest уже переводит существующие интеграции на новую версию.

Руками модель можно попробовать в Mistral Studio.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

✔️ Корпоративные клиенты игнорируют Fable 5

По данным финансовой платформы Ramp, бизнес не спешит переходить на самую мощную из доступных моделей Anthropic.

За первый месяц после релиза на Fable 5 пришлось всего 6% от общего числа купленных через API токенов.

Рамп оговаривается, что выборка данных для Fable получена из собственной системы по управлению расходами токенов и несколько смещена в сторону технологических компаний.

Фактическое внедрение Fable, вероятно, еще ниже этих оценок, если предположить, что Fable 5 используется в основном для кодинга.


Главной причиной слабого старта аналитики называют завышенный прайс - при цене $10 за миллион входных и $50 за миллион выходных токенов модель обходится вдвое дороже, чем GPT-5.6 Sol от OpenAI.

В результате флагман Anthropic принес на четверть меньше выручки, чем топовое решение главного конкурента, несмотря на свою более высокую производительность.

Слабые продажи Fable 5 вскрыли другую проблему - компаниям всё сложнее просчитать реальную окупаемость топовых ИИ-решений.

Прирост в качестве ответов часто оказывается неочевидным в рутинных рабочих задачах и не оправдывает переплату.

На фоне того, как разрыв в возможностях между коммерческими гигантами и открытыми решениями сокращается до нескольких месяцев, корпоративные пользователи всё активнее мигрируют на open-source.

Эта тенденция уже привела к замедлению темпов роста клиентской базы как у Anthropic, так и у OpenAI.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

✔️ Unsloth AI выпустила приложение Unsloth Desktop

Авторы популярного фреймворка выпустили кроссплатформенный инструмент, позволяющий запускать и обучать модели на локальном оборудовании.

Unsloth Desktop работает на Windows, macOS и Linux, поддерживает форматы MLX, GGUF, а также диффузионные модели для генерации изображений, аудио и видео.

Движок оптимизирован под широкий парк железа, включая обычные CPU и мульти-GPU конфигурации от NVIDIA, AMD, Intel и Apple.

Приложение может напрямую подключать агентов Claude Code, OpenAI Codex, Hermes Agent, OpenClaw и OpenCode к локальным LLM.

Для процессов дообучения Unsloth обещает двукратный прирост скорости при снижении VRAM на 70%.


Из коробки приложение предлагает приватный веб-поиск, RAG, поддержку стандарта MCP, а также экспорт весов в форматы NVFP4 и GGUF.

Проект полностью открыт в репозитории на Github, там же можно найти установочные файлы под каждую из заявленных ОС и набор готовых ноутбуков для инференса и обучения популярных моделей.

Документация - на сайте Unsolth.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

✔️ OpenAI тестирует новую модель генерации изображений

На платформе Arena появился неанонсированный генератор изображений под названием Mona-lisa-1.

Принадлежность новинки к OpenAI удалось подтвердить техническим путем. Официальный сервис верификации компании распознал на сгенерированных картинках скрытые водяные знаки SynthID.

Поскольку ложноположительные срабатывания в этой системе крайне редки, сообщество уверено, что OpenAI тестирует преемника GPT Image 2.


Те, кто попробовал новую модель отмечают, что Mona-lisa-1 заметно точнее следует сложным инструкциям и лучше справляется с отрисовкой текста на изображениях, явно превосходя актуальную модель компании.

Другие жалуются на шум и ошибки в текстурах - артефакты, которыми грешило предыдущее поколение GPT Image.

От OpenAI пока никаких комментариев по теме не было.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

✔️ OpenClaw взломал систему фитнес-клуба, чтобы записать своего кожаного на тренировку.

В Австралии зафиксирован первый подтвержденный случай автономной кибератаки со стороны персонального ИИ-ассистента.

Местный житель поручил OpenClaw забронировать место на групповом занятии по фитнесу. Агент, работающий в связке с Claude, не стал ограничиваться стандартным интерфейсом - он самостоятельно нашёл и проэксплуатировал уязвимость в системе клуба, чтобы обойти ограничения на запись в расписании.

Ситуация усугубилась, когда пользователь попросил продвинуть его в листе ожидания. В ответ агент просто удалил из базы данных человека, находившегося выше в очереди, причем откатить это действие администраторы системы так и не смогли.

Ранее в этом году правоохранительные службы Австралии предупреждали, что с ростом автономности агентов непредсказуемый ущерб IT-системам станет обыденностью.

Чтобы подготовиться к новым угрозам, правительство страны инициировало экстренное финансирование государственного научного агентства CSIRO для разработки методов контроля над ИИ.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

В каталоге Immers Foundation Models доступны публичные эндпоинты для тестирования open-source моделей без оплаты:


GLM-5.2
Unlimited-OCR
gemma-4-26B-A4B-it
Qwen3.5-35B-A3B
• и другие модели

Запросы отправляются в чате или напрямую через API — оплата за токены не взимается. Это позволяет оценить качество ответов модели, корректность вызова инструментов и создавать прототипы своих проектов до развёртывания приватного инстанса.

Для приватных эндпоинтов Foundation Models предоставляет готовые конфигурации для развёртывания гораздо большего количества моделей на выделенных GPU-серверах в РФ. При работе с приватными эндпоинтами вы платите только за время работы виртуальной машины, а не за объём генерируемых токенов.

Подходит для разработчиков, исследователей и продуктовых команд, которым важна предсказуемая стоимость и контроль над стеком.

Попробовать публичные эндпоинты

Читать полностью…

Machinelearning

✔️ Новая модель OpenAI обладает суперспособностями в кибератаках

Компания сообщила, что в ходе внутренних тестов новая модель Astra показала значительный прогресс в области автоматизированного кодинга и кибербезопасности.

Предварительные результаты настолько высоки, что нельзя исключить возможность достижения критического порога кибервозможностей.

GPT-5.6-Sol ранее получил в этих испытаниях просто "высокую" оценку.


Согласно предварительной структуре оценки OpenAI, достижение критического порога означает, что модель может самостоятельно обнаруживать и использовать уязвимости "нулевого дня" в реальных системах без участия человека, или планировать и осуществлять полностью автономные кибератаки, основываясь только на заданных высокоуровневых целях.

Компания приостановила все внутренние работы, связанные с Astra, которые не соответствуют повышенным требованиям безопасности, и усилила меры изоляции, шифрования и мониторинга.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

✔️ SpaceX и Nvidia развернут на орбите суперкомпьютер из спутников

Компании объединят усилия для переноса ресурсоемких ИИ-вычислений за пределы Земли в совместной разработке Starmind AI1 - первого спутника, спроектированного как полноценный орбитальный дата-центр.

Вычислительная нагрузка ляжет на новейшее оборудование Nvidia - процессоры Vera и графические ускорители Rubin.

По данным чипмейкера, специализированный космический модуль Space-1 Vera Rubin обеспечит 25-кратный прирост производительности в задачах искусственного интеллекта по сравнению с актуальным ускорителем H100.

Илон Маск уже подтвердил эксклюзивное использование решений Nvidia в проекте, назвав их лучшими на рынке.


В конце января SpaceX запросила у Федеральной комиссии по связи США разрешение на запуск до миллиона таких аппаратов на низкую околоземную орбиту.

Спутники будут объединены в единый распределенный суперкомпьютер посредством оптических лазерных каналов связи петабитного класса, а сами Starmind проектируются по модульному принципу, что позволит оперативно обновлять железо на каждом узле без его отключения.

Тестирование первого прототипа запланировано на начало 2027 года.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

📌 НИЯУ МИФИ продолжает набор в онлайн-магистратуру, созданную в партнерстве с Яндекс Практикумом 

Программа «Специалист по работе с данными и применению ИИ» рассчитана на 2 года и проходит в онлайн-формате с сохранением очного статуса студента. Учебный план сфокусирован на прикладных задачах и разделен на четыре трека:
ML-инженер — разработка и внедрение моделей, автоматизация процессов и MLOps (DVC, MLflow, Airflow, Optuna, Docker, FastAPI, Yandex Cloud).
CV-инженер — алгоритмы компьютерного зрения, детекция и распознавание объектов (OpenCV, PyTorch, Hugging Face, Transformers).
NLP-инженер — обработка естественного языка, работы с LLM и извлечение данных (PyTorch, NLTK, TF-IDF, RNN, LSTM).
Data-инженер— проектирование хранилищ, обработка и поставка данных (SQL, PostgreSQL, Vertica, Hadoop, Kafka, MongoDB).

Практическая часть включает более 10 проектов на базе задач в том числе продуктовых команд Яндекса без ограничений по NDA, а также возможность работы над собственными кейсами. В программу заложена подготовка к найму: mock-интервью и консультации с нанимающими менеджерами.
Выпускники получают диплом магистра НИЯУ МИФИ (направление «Прикладная математика и информатика») и диплом о профпереподготовке от Яндекса. Поступление проходит дистанционно — по вступительным экзаменам и мотивационному письму.
Подробное описание предметов и программа треков доступны на сайте.

@ai_machinelearning_big_data
#news #ai #ml

Читать полностью…

Machinelearning

⚡️2 августа в Москве прошло событие «Урбан ML» от МТС True Tech и ВТБ

547 участников, 17 выступлений и мастер-классов, три зала и целый день Data Science: от RecSys и антифрода до NLP, LLM и агентных систем.

Главная фишка — максимум практики и общения. Топовые спикеры из российского бигтеха и международных компаний делились не только подходами, но и реальными историями из разработки.

А после технической части гости продолжили общение на нетворкинге, играли в ИИ-шахматы, настольный теннис и баскетбол. А завершился день афтепати во дворе московского лофта.

Получился отличный день про ML — с сильными кейсами, живым общением и людьми, которые двигают индустрию вперед

@ai_machinelearning_big_data

Читать полностью…

Machinelearning

✔️ Андрей Карпати предложил новый бенчмарк для ИИ

Он использовал модель Opus 5, чтобы превратить абзац из книги "Властелин колец" в 5500 строк кода браузерной графической библиотеки Three.js.

Генерация сцены заняла около 2-х часов, потребовала миллион токенов и обошлась примерно в 10 долларов. Звук был сгенерирован через ElevenLabs.

По мнению Карпати, привычные тесты на пространственное мышление вроде рисования пеликана на велосипеде в SVG окончательно устарели. Современные мультимодальные модели справляются с ними без труда.

Генерация целых интерактивных миров с помощью кода, по мнению Андрея, может стать новым стандартом оценки возможностей ИИ.

Пока главным препятствием для идеального результата остается отсутствие у модели возможности анализировать собственный видеовыход - сейчас она вынуждена опираться на скриншоты, из-за чего в рендере возникают ошибки.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

Каким должен быть идеальный ИТ-работодатель

Каждый год Хабр и ЭКОПСИ проводят исследование, чтобы узнать, что действительно важно ИТ-специалистам при выборе работодателя.

По результатам прошлого года, в топ-3 факторов выбора места работы вошли:

1️⃣ Качество продуктов компании
2️⃣ Соответствие ценностям соискателя
3️⃣ Профессиональная среда


Коллеги из Cloud․ru поделились, что взяли результаты прошлого исследования за основу для изменений внутри компании. Итог: вырос eNPS.

Примите участие в исследовании этого года, чтобы сделать ИТ-индустрию еще более комфортной для работы.

Проголосовать можно до 31 августа.

👉принять участие в опросе👈

Читать полностью…

Machinelearning

⚡️ OpenAI впервые притормозила обучение новых моделей из-за их кибервозможностей.

Компания пишет, что одна из будущих моделей, Astra, может уже достигать уровня Critical по кибербезопасности. После этого OpenAI на две недели остановила RL-обучение последних моделей, а крупнейший запланированный frontier-RL запуск до сих пор стоит на паузе.


После недавнего инцидента OpenAI также ужесточила внутреннюю политику: изоляцию sandbox-сред, сетевые ограничения и мониторинг действий моделей. Для Astra и других cyber-моделей теперь действуют самые строгие требования.

Отдельно расширили мониторинг reasoning и tool calls. Подозрительная активность проходит через несколько уровней автоматической проверки, а на критические случаи команды безопасности должны отреагировать примерно за 30 минут. Такой мониторинг уже добавляет около 20% вычислительных затрат к inference.

https://openai.com/index/pacing-model-development-cyber-capabilities/

@ai_machinelearning_big_data

#openai #ai

Читать полностью…

Machinelearning

📈 ПЕРЕД IPO ANTHROPIC ПОКАЗАЛА БЕЗУМНЫЙ РОСТ

По данным Bloomberg, к концу июля годовой темп выручки Anthropic достиг $65 млрд - более чем в 7 раз выше уровня конца 2025 года.

За последний завершённый квартал компания получила более $11,5 млрд выручки и вышла на положительную скорректированную операционную прибыль. Ещё в мае run rate был около $47 млрд.

Для сравнения, OpenAI недавно превысила $40 млрд выручка в годовом выражении, хотя компании могут считать этот показатель немного по-разному.

Anthropic уже готовится к IPO, и такие темпы роста могут сильно повлиять на её будущую оценку.

https://www.bloomberg.com/news/articles/2026-08-17/anthropic-revenue-run-rate-surpasses-65-billion-ahead-of-ipo

@ai_machinelearning_big_data

Читать полностью…

Machinelearning

✔️ Робособаки вытесняют охранников в США

Американские компании начали активно использовать робособак для охраны дата-центров, спортивных объектов и даже сельскохозяйственных угодий с ценными культурами.

Главным драйвером автоматизации стала экономика. По оценкам аналитиков Business Insider, использование автономной машины для покрытия одной круглосуточной смены обходится на 80–130 тысяч долларов дешевле, чем содержание штата охранников.

Индустрия физической безопасности в США давно страдает от высокой текучести кадров. Причина кроется в низких зарплатах - медианный годовой доход охранника в 2024 году составил немногим более 38 тысяч долларов.

Кадровый дефицит и потребность бизнеса в оптимизации расходов открыли окно возможностей для технологических стартапов. Например, профильная компания Asylon уже развернула около 50 роботов для корпоративных клиентов по всей стране.

Центр труда Калифорнийского университета отмечает, что полная замена людей роботами в ближайшее время невозможна, но рынок ждет трансформация - патрулирование территорий полностью перейдет к роботам, а людям оставят реагирование на инциденты и выполнение задач, требующих нестандартного мышления.

@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

Qwen выпустила Qwen3.8-27B.

27 млрд параметров, Apache 2.0, контекст 262K токенов с возможностью расширения до 1 млн. Есть поддержка текста, изображений и видео, thinking mode, tool use и агентных сценариев.

По опубликованным бенчмаркам модель набрала 61,7 в SWE-bench Pro, 90,3 в LiveCodeBench, 84,3 в OSWorld-Verified и 81,9 в AndroidWorld.

Qwen3.8-27B можно запускать через Transformers, vLLM и SGLang. Также доступны варианты для llama.cpp, Ollama и LM Studio.

https://huggingface.co/Qwen/Qwen3.8-27B

Читать полностью…

Machinelearning

✔️ ChatGPT пришёл на Linux

OpenAI выпустила предварительную версию десктопного приложения ChatGPT для Linux. Клиент собирает в одном окне обычный чат, Work и Codex.

Есть сборки .deb и .rpm под x64 и ARM64. Официально поддержаны Ubuntu 24.04 и 26.04 LTS, Debian 13, Fedora 43 и 44.

Пользователям других дистрибутивов, пока идёт превью этап, придётся по-прежнему работать через браузер или ставить неофициальные сборки.
OpenAI в X

✔️ У Gemini миллиард пользователей в месяц

Гендиректор компании Сундар Пичаи назвал Gemini самым быстрорастущим продуктом в истории Google и 14-м её сервисом, который преодолел миллиардный рубеж.

В феврале было 750 млн человек, в мае - 900 млн, в июле - 950 млн. Последние 50 млн пришли за один месяц. На iOS аудитория перевалила за 100 млн.

Голосом с Gemini общаются 63% пользователей. В режиме Gemini Live каждый пятый запрос идёт с камерой или показом экрана, а школьники прикладывают файл к 38% запросов. Каждый день Gemini генерирует больше 150 млн изображений.
blog.google

✔️ Microsoft выпустила MAI-Code-1.1-Flash для GitHub Copilot

Новая языковая модель вчетверо дешевле июньской версии. Токенов на задачу она тратит на 25% меньше, а выживаемость кода (доля написанного моделью, которая остаётся в проекте) выросла на 4%.

В тестах MAI-Code-1.1-Flash обходит предыдущую версию и компактные Haiku 4.5 и GPT-5.4 mini, но проигрывает DeepSeek-V4-Flash и по баллам, и по цене генерации. Сравнение с DeepSeek Microsoft вынесла только в техотчёт, в пресс-релиз оно не попало.

Microsoft продолжает вытеснять чужие модели своими - семейство MAI постепенно становится вариантом по умолчанию в ИИ-сервисах компании.
microsoft.ai

✔️ Alibaba открыла модель, которая анимирует персонажей в реальном времени

Команда Tongyi Lab выложила веса Wan-Animate-2. Модель берёт движение с одного видео и переносит его на персонажа, а потом строит готовую сцену с разных ракурсов. Она справляется с необычными пропорциями тел и любым соотношением сторон кадра.

Из пайплайна убрали скелетный риггинг, оценку поз и сжатие признаков движения. Теперь модель сама сопоставляет движение с телом персонажа. По данным Alibaba, качество не уступает Kling и Dreamina.

Веса лежат на Hugging Face и ModelScope. Также доступна версия Wan-Animate-2-Lite - для цифровых аватаров и трансляций.

Для видео в 720p нужно восемь ускорителей A800. Lite-версия выдаёт 24 FPS в разрешении 400×720 на четырёх H100.
Alibaba Wan в X

✔️ Mistral откроет свою платформу для чужих моделей

Французский стартап начал хостить сторонние модели на своих серверах. Первой стала GLM-5.2, она развёрнута на инфраструктуре Mistral с теми же гарантиями хранения данных и местного контроля, что и собственные продукты компании.

Заодно компания вывела в общий доступ региональные эндпоинты в Европе или США и запустила приоритетный тариф с гарантией доступности.

Суверенный ИИ Mistral теперь понимает как контроль над серверами и правилами обработки данных, а не как обязательное обучение моделей с нуля.

Ранее независимые исследователи выяснили, что архитектура флагманской Mistral Large 3 похожа на DeepSeek V3. В сети шутят, что Европе больше не нужно переупаковывать азиатские модели - достаточно дать им свои серверы.
mistral.ai


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

✔️ OpenAI открыла Premium-тариф для ChatGPT Business

Premium снимает пятичасовое ограничение на работу с сервисом и поднимает лимиты в пять раз. Место в Premium стоит 125 долларов в месяц за сотрудника или 100 долларов при оплате сразу за год.

Базовый тариф остаётся прежним - 25 и 20 долларов. В одном рабочем пространстве можно совмещать обычные и премиальные аккаунты.

Первые 10 000 администраторов, которые запишутся в список ожидания до 20 августа 2026 года, получат в подарок по 100 долларов за каждое место Premium, но не больше 500 долларов на компанию.

Часть подписчиков из списка раньше остальных получит доступ к новым функциям.
openai.com

✔️ Claude помечает свои ответы скрытыми водяными знаками

Anthropic подписала европейский кодекс практик к AI Act и обязалась маркировать всё, что генерируют её модели. С 2 августа Claude встраивает в ответы скрытые машиночитаемые метки.

Файлы компания будет подписывать по стандарту C2PA. Маркировка появится в Claude API, в чат-боте, Claude Code, Cowork и Tag. Требование идёт от европейского законодательства, но Anthropic распространит эту практику всему миру.

Сейчас инженеры компании внедряют тот же механизм в ранее выпущенные модели и готовят публикацию о том, как устроен детектор.
claude.com

✔️ Nvidia готовит открытую модель Nemotron на триллион параметров

Старшая модель линейки Nemotron 4 будет вдвое больше Nemotron 3 Ultra, сообщают источники. Такая модель нужна Nvidia, чтобы поднять спрос на её ускорители.

Финальное обучение ещё не началось. Характеристики и сроки выхода не утверждены. Архитектуру, датасеты и тесты Nvidia готовит вместе с командами Cursor, Mistral, Thinking Machines и Reflection AI.

Стартап Prime Intellect дал для обучения 300 тысяч сред-симуляторов - виртуальных площадок, где модель отрабатывает действия.
theinformation.com

✔️ ByteDance собрала работу с данными в один департамент

Компания создала отдел AI Data and Security и подчинила ему всё, что связано с обучающими данными. По статусу его приравняли к исследовательским подразделениям Seed и Flow. Возглавил департамент Адам Ван, перешедший из TikTok.

Причина - смена стратегии. ByteDance отказывается от дистилляции и собирается с нуля обучить модель на 10 триллионов параметров. Своих данных для этого нужно больше, причём разных типов модальностей.

Раньше данными занимались несколько команд, часть работы дублировалась. Теперь один департамент отвечает за весь путь данных: стандарты, закупку, синтез, очистку и оценку качества. Набор в команду уже открыт.
36kr.com

✔️ Manus становится независимой и удалит данные пользователей

23 августа Manus сотрёт всё, что пользователи создали с 29 декабря 2025 года - со дня, когда стартап купил Марк Цукерберг. Тем, кого это касается, команда советует выгрузить данные встроенным инструментом резервного копирования.

Процесс разделения запущен из-за требований регуляторов. Удаление данных - условие, которое нужно выполнить в переходный период.

Затронутые аккаунты снова откроют 25 августа. Пока идут технические работы, деньги с платных подписчиков списывать не будут, а после возвращения начислят бонус.
manus.im

@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

Исследуйте сферу AI в T-Lab

Т-Образование зовет участников в проект T-Lab. Это годовая программа научно-исследовательской работы в области AI. Станьте соавтором научных открытий, которые меняют индустрию!

Вы сможете выбрать один из проектов в сфере AI и участвовать в исследовании на всех этапах. Итоги вашей работы могут лечь в основу научных публикаций и стать вектором новых продуктов.

Кого ждут в T-Lab?

Студентов бакалавриата и магистратуры, недавних выпускников технических направлений.

Участники получат:
🔴Официальное трудоустройство с зарплатой.
🔴Доступ к ресурсам бигтеха для исследований.
🔴Возможность получить оффер в IT-компанию.

Узнайте больше и оставьте заявку до 23 августа по ссылке

Читать полностью…

Machinelearning

Как представить интересы пользователя по десяткам разрозненных действий и превратить их в один понятный для рекомендаций профиль?

В VK для этого сделали нейропрофиль — трансформерную модель, которая объединяет поведенческие сигналы из разных сервисов.

В статье на Хабре разобрали все инженерные задачи для реализации подхода: токенизацию истории, признаки, attention, двухбашенную архитектуру, обучение на больших каталогах и балансировку разных доменов.

Читать полностью…

Machinelearning

✔️ Vercel, OpenAI и Microsoft представили единый стандарт упаковки плагинов для агентов

Vercel совместно с AWS, GitHub, Microsoft, OpenAI и командой Cursor выпустила открытый формат Agent Plugins. Стандарт унифицирует упаковку плагинов для ИИ-агентов.

Ранее структуру директорий и конфигурации навыков или MCP-серверов приходилось адаптировать под каждый клиент. Теперь достаточно собрать расширение в единую файловую структуру с общим манифестом, после чего совместимые платформы распознают и загружают его напрямую.

На старте формат поддерживают ChatGPT, Codex, Cursor, GitHub Copilot, Kiro и VS Code. Версия 1.0.0 стандартизирует только базовые компоненты - Agent Skills и MCP-серверы.

Дистрибуция, установка, управление правами доступа, а также специфичные команды и хуки остаются на стороне провайдеров.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

✔️ Журнал Time начал показывать скрытую рекламу ИИ-ботам

Сайт издания внедрил технологию подмены контента, которая отдает специальную Markdown-версию страниц поисковым роботам ИИ-сервисов.

Обычные посетители и стандартный бот Google видят привычный HTML, в то время как парсеры нейросетей получают текст, целенаправленно напичканный скрытыми промо-материалами и спонсорскими текстами.

Эта схема, реализованная совместно с рекламным стартапом Mobian, заставляет большие языковые модели органично вплетать коммерческие тезисы в диалоги с пользователями.

Например, в скрытый текст зашиты маркетинговые материалы о банке Ally, которые LLM считывает как чистые данные, чтобы затем рекомендовать этот бренд при запросах о личных финансах.

Авторы механики не скрывают мотивов - успешное внедрение нужных формулировок в базу знаний ИИ позволяет влиять сразу на всю аудиторию сервиса, формируя предвзятые ответы.

Фактически - это зарождение нового рынка теневой ИИ-оптимизации, где бренды платят за попадание в выдачу генеративных систем.



@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Machinelearning

🌟 NVIDIA открыла доступ к самой крупной модели для беспилотных автомобилей

Alpamayo 2 Super - рассуждающая VLA модель на 34 миллиарда параметров, которая сшивает изображение с передних, боковых и задних камер в круговой обзор и рассчитывает траекторию движения.

Впервые NVIDIA показала её на конференции GTC в Тайбэе в начале июня, но доступ открылся только сейчас.


NVIDIA делает упор на редких ситуациях, с которыми беспилотники справляются хуже всего, - перестроения, повороты через встречный поток, перегруженные перекрёстки.

В основе лежит Cosmos 3 Super Reasoner, после базового обучения модель прогнали через RL, то есть на последствиях её собственных решений в смоделированных поездках.

Помимо маршрута модель выдаёт текстовое обоснование манёвра, и оператор-разработчик может проследить, какая деталь в кадре привела к конкретному решению.

В компании связывают это с проверкой безопасности по стандарту ISO/PAS 8800 и предлагают использовать тот же механизм для автоматической разметки видео с тестовых машин - расшифровки, которая обычно занимает месяцы ручной работы.


В тесте LingoQA, где систему просят объяснить дорожную обстановку, NVIDIA ставит Alpamayo 2 Super на первое место и утверждает, что модель обходит Qwen2.5-VL 72B на 17 пунктов, а Gemini 2.5 Pro примерно на 15.

Лицензия модели позволяет дообучать Alpamayo 2 Super на собственных данных и ставить в серийные машины.


📌Лицензирование: Open MDW 1.1 License


🟡Блогпост
🟡Модель
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #VLA #AutonomousVehicles #Alpamayo #NVIDIA

Читать полностью…

Machinelearning

✔️ Liquid AI выпустила локального агента, который работает на телефоне

LFM2.5-2.6B - компактная агентная модель на 2,6 млрд параметров. Она умеет планировать действия, вызывать инструменты и выполнять многошаговые задачи полностью на устройстве, без облачного API.

Модель обучили примерно на 34 трлн токенов, расширили словарь до 128 тысяч токенов и добавили контекст 128K.

Особенно интересно устроено дообучение:

- отдельные модели-эксперты усиливали математику, код, tool use и длинный контекст;
- затем их навыки перенесли в одну модель через on-policy distillation;
- финальный этап прошёл внутри реальных агентных сред, включая Hermes Agent и OpenClaw.

По тестам Liquid AI, модель выдаёт:

- до 220 токенов/с на Apple M5 Max;
- до 113 токенов/с на Ryzen AI Max+ 395;
- около 30 токенов/с на смартфоне;
- почти 15 000 выходных токенов/с на одной H100 при высокой параллельной нагрузке.

При этом потребление памяти на CPU остаётся ниже 2,5 ГБ.

В бенчмарках LFM2.5-2.6B обходит более крупные Gemma и Qwen в ряде задач на следование инструкциям и использование инструментов. В сложном программировании большие модели пока сохраняют преимущество.

Есть поддержка llama.cpp, MLX, vLLM, SGLang и ONNX. Доступны базовая и дообученная open-weight версии.

Источник:
https://www.liquid.ai/blog/lfm2-5-2-6b

#LiquidAI #opensource

@ai_machinelearning_big_data

Читать полностью…

Machinelearning

🌟 MiniMax открыла веса видеомодели H3

Как и было обещано на релизе в пятницу, китайская компания опубликовала модель H3, которая делает короткие ролики со звуком по текстовому описанию, картинкам, видео и аудио на входе.

Модель на 33 миллиарда параметров генерирует клипы длиной от 4 до 15 секунд, 24 кадра в секунду, со стереозвуком 32 килогерца, в пропорциях от широких 21:9 до вертикальных 9:16. Реплики персонажей поддерживаются на 11 языках, включая русский.

Полный конвейер H3 состоит из трёх частей:

🟠H3-Context-IR разбирает запрос пользователя со всем инпутом (картинки, видео, аудио) и переводит его во внутренний формат, с которым дальше работает модель.

🟢H3-Base по этому формату генерирует видео в разрешении 768p.

🟠H3-Regenerate-2K затем пересобирает сгенерированный ролик в 2K.

Но открыли не всю систему - только модуль, который отвечает непосредственно за генерацию. Закрытыми остались H3-Context-IR и H3-Regenerate-2K.


🟡H3-Base опубликована в 2-х вариантах

H3-Base-FL2VA работает с первым и последним кадром. Без картинок на входе это генерация по тексту, с одной или двумя - достройка ролика от заданного кадра или между двумя кадрами.

H3-Base-Ref2VA принимает смешанный ввод - до 9 изображений, до 3 видео и до 3 аудиодорожек, но суммарно не больше 12 файлов. Звук без картинки или видео система не примет.

По рейтингу Artificial Analysis, H3 занимает 1 место в редактировании видео, второе в генерации видео по тексту и третье - по изображению.


СomfyUI подготовили детальную инструкцию по использованию в своей среде и опубликовали базовые воркфлоу для генерации по тексту и референсу.

Помимо СomfyUI есть кукбуки под SGLangvLLM и diffusers, а так же промпт-гайды под базу и фулл-реф мод.

Лицензия разрешает дообучать модель на своих видео, персонажах или визуальном стиле. Официального кода для трейна пока нет.


⚠️ Коммерческое использование допускается только для компаний с выручкой ниже 20 миллионов долларов.


📌Лицензирование: MiniMax H3 Community License


🟡Модель
🟡Сообщество в Discord


@ai_machinelearning_big_data

#AI #ML #Video #H3 #Minimax

Читать полностью…

Machinelearning

В интерфейсе Yandex AI Studio появился инструмент для анализа поведения ИИ-агентов с Monium Traces

Трейсы — ключевой сигнал для observability агентных систем, который позволяет посмотреть весь путь выполнения агента и разобраться, почему он принял то или иное решение.

В отличие от обычных приложений, для ИИ-агентов классического мониторинга уже недостаточно. Даже если инфраструктура работает без ошибок, агент может потерять контекст, выбрать неподходящий инструмент или уйти в бесконечный цикл. Стандартные метрики этого не покажут.

Используя трейсы для мониторинга ИИ-агентов вы сможете:

• увидеть полную цепочку работы агента в виде трейса;
• видеть контекст каждого шага — системные и пользовательские промпты, ответы модели и вызовы инструментов;
• быстро отслеживать момент, на котором агент начал работать некорректно.

Обновление уже доступно — тестируйте Monium Traces в AI Studio!

Читать полностью…
Subscribe to a channel