287027
Самая актуальная информация из мира ML, Нейронных сетей,DI По всем вопросам- @haarrp @itchannels_telegram - 🔥 best it channels @pythonl - 🐍 @machinee_learning -chat @ArtificialIntelligencedl - AI @datascienceiot - ml 📚 @machinelearning_ru ml
🌟 Vercel Labs открыла кодинг-агента размером 6 Мб
Проект fx начинался как внутренний инструмент Vercel Labs и представляет собой харнесс, написанный на Zig для исследования моделей и встраивание в другие системы.
Бинарник весит всего 6,3 Mб, а время запуска заявлено всего в 10 микросекунд, при этом базовое потребление памяти составляет всего несколько мегабайт.
Привязки к конкретной модели или провайдеру нет, инференс годится и локальный, и облачный. Небольшое ядро расширяется через skills, плагины и MCP.
Интерфейс сделан скорее как юниксовая оболочка, чем как IDE в терминале - fx сохраняет историю прокрутки, выдаёт минимум вывода и очень скупо рисует сложный TUI.
Через WebAssembly fx запускается прямо в браузере - попробовать можно на fx.sh/try, ничего не устанавливая.
Приватность заявлена как философия - продуктовой телеметрии нет, сессии и статистика использования остаются локально, а исходный код и промпты не уходят никуда, кроме эндпойнта инференса.
При локальном инференсе и отключённых автообновлениях fx работает полностью герметично.
⚠️ Проект экспериментальный - пользоваться стоит на свой риск. Vercel обещает, что изменения будут частыми.
📌Лицензирование: Apache 2.0 License
🟡Сайт проекта
🟡Документация
🖥Github
@ai_machinelearning_big_data
#AI #ML #Harness #Agents #Fx #Vercel
✔️ 24 августа в ChatGPT появится реклама для европейских пользователей
OpenAI начнет показывать рекламу пользователям из 31 европейской страны. Блоки будут только на тарифах Free и Go, платные подписки их не увидят. В США и еще восьми регионах рекламная платформа работает с февраля 2026 года.
Деньги от рекламы, по словам компании, пойдут на поддержку бесплатного доступа к моделям. OpenAI обещает помечать объявления, не давать им влиять на ответы модели, не показывать рекламодателям содержание чатов и не продавать данные пользователей третьим лицам.
Заявки на размещение бизнес уже может подавать здесь.
openai.com
✔️ Cerebras показала стоечный ускоритель CS-4
На конференции Supernova в Сан-Франциско Cerebras Systems представила CS-4. По заявлению компании, система до 30 раз быстрее кластеров на GPU Nvidia и AMD.
Производительность - 750 PFLOPS, в основе три процессора Wafer-Scale Engine нового поколения. Пропускная способность памяти 129,6 ПБ/с, скорость ввода-вывода 7,2 Тбит/с.
По сравнению с CS-3 производительность выросла вдвое, а памяти на каждый потребляемый ватт стало в 10 раз больше.
Первым заказчикам CS-4 начнут отгружать в текущем квартале.
cerebras.ai
✔️ Китай разрешил ввозить ограниченные партии Nvidia H200
Пекин смягчил собственные ограничения на ввоз ИИ-ускорителей - ByteDance и Tencent получили разрешения примерно на 10 000 чипов H200 каждая, следующие компании стоят в очереди.
Со стороны США ограничения ослабли раньше - Вашингтон предварительно согласовал продажу в Китай до 100 000 чипов на корпорацию.
Nvidia зарезервировала под китайских заказчиков около 500 000 H200, а производители серверов снова принимают заявки на машины с этими ускорителями.
ft.com
✔️ Власти США предупредили об атаках на промышленные контроллеры скриптами, написанными ИИ
CISA, ФБР, АНБ и еще два ведомства выпустили совместное предупреждение об атаках на программируемые логические контроллеры Siemens S7. По их данным, уязвимые устройства ищут и взламывают скриптами, которые сгенерировал ИИ.
Код собран на открытых библиотеках автоматизации и притворяется легитимным инструментом мониторинга. Он позволяет менять конфигурацию контроллера, читать и записывать его память.
По оценке ведомств, ИИ снизил порог входа для атак на промышленные объекты - электростанции, заводы и коммунальные системы. Нынешние вторжения выглядят как разведка, но со временем те же приемы могут пойти на остановку производств и отключение систем безопасности.
Рекомендации стандартные: обновить прошивки контроллеров и полностью убрать их из интернета.
cisa.gov
✔️ Физики передали квантовую запутанность на 420 км
Команда Научно-технического университета Китая связала запутанностью два удаленных модуля памяти на холодных атомах через оптоволокно длиной 420 км.
Достижение важно тем, что превзойден предел PLOB - теоретический потолок для прямой передачи запутанности по каналу без ретрансляции, который начинает мешать после 230 км. Обойти его удалось как раз потому, что квантовая память играет роль промежуточного узла. Это один из кирпичей для будущих квантовых повторителей и квантового интернета.
Чтобы уменьшить потери, квантовую память перевели с длины волны 795 нм на 780 нм и перестроили схему преобразования частот, подогнав сигнальные фотоны под окно сверхнизких потерь волокна. Рассинхронизацию фаз убрали автоподстройкой на двух длинах волн и трех частотах. Интерференция фотонов оставалась стабильной на всех 420 км.
Работа опубликована в Physical Review Letters.
cas.cn
@ai_machinelearning_big_data
#news #ai #ml
✔️Как Mechanical Sympathy и готовые библиотеки помогают ускорить веб-приложения на Spring Boot
Обычно стандартных инструментов хватает, чтобы приложение работало быстро, но иногда требуется добиться большей эффективности. Для этого важно понимать, как приложение работает изнутри, и находить простые нестандартные решения.
О том, как принципы Mechanical Sympathy и готовые библиотеки позволяют ускорить стандартное Spring Boot MVC-приложение, расскажет Сергей Петрелевич на конференции JVM Day, которую проведет Т-Банк 29 августа в Москве.
Мероприятие соберет всех представителей JVM-комьюнити: Java-, Scala- и Kotlin-разработчиков, архитекторов и тимлидов. Участников также ждут доклады о последних новостях JVM-языков, альтернативных моделях конкурентностях после Loom и о том, как E2E-бенчмарки могут вводить разработчиков в заблуждение.
После лекций для гостей пройдет вечеринка с играми на Sega, PowerPoint Party, открытым микрофоном, ИТ-квизом и диджей-сетом на виниле. Зарегаться на конференцию можно по ссылке.
@ai_machinelearning_big_data
#news #ai #ml
⚡️ MiniMax Music 3: открытая модель генерации музыки с вокалом
MiniMax опубликовал веса модели для создания полноценных композиций длиной до пяти минут, которая понимает музыкальную структуру и выдаёт на выходе 32 kHz стерео в формате 16-bit WAV.
Music 3 управляется промптом из текста песни (с тегами вида [Chorus] или [Solo]) и музыкальным описанием (жанр, BPM, тональность, лад и т.д.).
MiniMax советует разбивать промпт на метаданные, детали вокала и аранжировку, но если лень писать руками, можно прогнать запрос через специальный скилл music-caption-rewriter.
Flow-VAE взят из MiniMax Speech и переобучен под динамический диапазон и спектр музыки.
🟠Streaming generation сейчас вообще не поддерживается, модель отдаёт только готовый кусок.
🟠Входной промпт ограничен длиной в 5 000 токенов.
🟠Аудиовывод упирается в потолок из 9 000 акустических фреймов.
✔️ Mistral обновила OCR-модель до версии 4.1
Главный упор сделали на обработку перегруженных страницы, где текст, изображения и подписи идут плотно и наслаиваются друг на друга.
По данным Mistral, модель точнее определяет границы каждого элемента - рамки не съезжают, изображения не наезжают одно в другое по ошибке.
На нагруженных технических диаграммах модель реже теряет блоки, а текстовые выноски считывает как самостоятельные объекты, а не сливает в один массив.
Отдельно заявлена работа с многоколоночными документами, OCR 4.1 сохраняет исходную структуру страницы и отдает каждую колонку отдельной областью текста.
В настроенных процессах тем, кто пользуется моделью, менять ничего не нужно. Алиас mistral-ocr-latest уже переводит существующие интеграции на новую версию.
Руками модель можно попробовать в Mistral Studio.
@ai_machinelearning_big_data
#news #ai #ml
✔️ Корпоративные клиенты игнорируют Fable 5
По данным финансовой платформы Ramp, бизнес не спешит переходить на самую мощную из доступных моделей Anthropic.
За первый месяц после релиза на Fable 5 пришлось всего 6% от общего числа купленных через API токенов.
Рамп оговаривается, что выборка данных для Fable получена из собственной системы по управлению расходами токенов и несколько смещена в сторону технологических компаний.
Фактическое внедрение Fable, вероятно, еще ниже этих оценок, если предположить, что Fable 5 используется в основном для кодинга.
✔️ Unsloth AI выпустила приложение Unsloth Desktop
Авторы популярного фреймворка выпустили кроссплатформенный инструмент, позволяющий запускать и обучать модели на локальном оборудовании.
Unsloth Desktop работает на Windows, macOS и Linux, поддерживает форматы MLX, GGUF, а также диффузионные модели для генерации изображений, аудио и видео.
Движок оптимизирован под широкий парк железа, включая обычные CPU и мульти-GPU конфигурации от NVIDIA, AMD, Intel и Apple.
Приложение может напрямую подключать агентов Claude Code, OpenAI Codex, Hermes Agent, OpenClaw и OpenCode к локальным LLM.
Для процессов дообучения Unsloth обещает двукратный прирост скорости при снижении VRAM на 70%.
✔️ OpenAI тестирует новую модель генерации изображений
На платформе Arena появился неанонсированный генератор изображений под названием Mona-lisa-1.
Принадлежность новинки к OpenAI удалось подтвердить техническим путем. Официальный сервис верификации компании распознал на сгенерированных картинках скрытые водяные знаки SynthID.
Поскольку ложноположительные срабатывания в этой системе крайне редки, сообщество уверено, что OpenAI тестирует преемника GPT Image 2.
Mona-lisa-1 заметно точнее следует сложным инструкциям и лучше справляется с отрисовкой текста на изображениях, явно превосходя актуальную модель компании.
✔️ OpenClaw взломал систему фитнес-клуба, чтобы записать своего кожаного на тренировку.
В Австралии зафиксирован первый подтвержденный случай автономной кибератаки со стороны персонального ИИ-ассистента.
Местный житель поручил OpenClaw забронировать место на групповом занятии по фитнесу. Агент, работающий в связке с Claude, не стал ограничиваться стандартным интерфейсом - он самостоятельно нашёл и проэксплуатировал уязвимость в системе клуба, чтобы обойти ограничения на запись в расписании.
Ситуация усугубилась, когда пользователь попросил продвинуть его в листе ожидания. В ответ агент просто удалил из базы данных человека, находившегося выше в очереди, причем откатить это действие администраторы системы так и не смогли.
Ранее в этом году правоохранительные службы Австралии предупреждали, что с ростом автономности агентов непредсказуемый ущерб IT-системам станет обыденностью.
Чтобы подготовиться к новым угрозам, правительство страны инициировало экстренное финансирование государственного научного агентства CSIRO для разработки методов контроля над ИИ.
@ai_machinelearning_big_data
#news #ai #ml
В каталоге Immers Foundation Models доступны публичные эндпоинты для тестирования open-source моделей без оплаты:
• GLM-5.2
• Unlimited-OCR
• gemma-4-26B-A4B-it
• Qwen3.5-35B-A3B
• и другие модели
✔️ Новая модель OpenAI обладает суперспособностями в кибератаках
Компания сообщила, что в ходе внутренних тестов новая модель Astra показала значительный прогресс в области автоматизированного кодинга и кибербезопасности.
Предварительные результаты настолько высоки, что нельзя исключить возможность достижения критического порога кибервозможностей.
GPT-5.6-Sol ранее получил в этих испытаниях просто "высокую" оценку.
✔️ SpaceX и Nvidia развернут на орбите суперкомпьютер из спутников
Компании объединят усилия для переноса ресурсоемких ИИ-вычислений за пределы Земли в совместной разработке Starmind AI1 - первого спутника, спроектированного как полноценный орбитальный дата-центр.
Вычислительная нагрузка ляжет на новейшее оборудование Nvidia - процессоры Vera и графические ускорители Rubin.
По данным чипмейкера, специализированный космический модуль Space-1 Vera Rubin обеспечит 25-кратный прирост производительности в задачах искусственного интеллекта по сравнению с актуальным ускорителем H100.
Илон Маск уже подтвердил эксклюзивное использование решений Nvidia в проекте, назвав их лучшими на рынке.
📌 НИЯУ МИФИ продолжает набор в онлайн-магистратуру, созданную в партнерстве с Яндекс Практикумом
Программа «Специалист по работе с данными и применению ИИ» рассчитана на 2 года и проходит в онлайн-формате с сохранением очного статуса студента. Учебный план сфокусирован на прикладных задачах и разделен на четыре трека:
• ML-инженер — разработка и внедрение моделей, автоматизация процессов и MLOps (DVC, MLflow, Airflow, Optuna, Docker, FastAPI, Yandex Cloud).
• CV-инженер — алгоритмы компьютерного зрения, детекция и распознавание объектов (OpenCV, PyTorch, Hugging Face, Transformers).
• NLP-инженер — обработка естественного языка, работы с LLM и извлечение данных (PyTorch, NLTK, TF-IDF, RNN, LSTM).
• Data-инженер— проектирование хранилищ, обработка и поставка данных (SQL, PostgreSQL, Vertica, Hadoop, Kafka, MongoDB).
Практическая часть включает более 10 проектов на базе задач в том числе продуктовых команд Яндекса без ограничений по NDA, а также возможность работы над собственными кейсами. В программу заложена подготовка к найму: mock-интервью и консультации с нанимающими менеджерами.
Выпускники получают диплом магистра НИЯУ МИФИ (направление «Прикладная математика и информатика») и диплом о профпереподготовке от Яндекса. Поступление проходит дистанционно — по вступительным экзаменам и мотивационному письму.
Подробное описание предметов и программа треков доступны на сайте.
@ai_machinelearning_big_data
#news #ai #ml
⚡️2 августа в Москве прошло событие «Урбан ML» от МТС True Tech и ВТБ
547 участников, 17 выступлений и мастер-классов, три зала и целый день Data Science: от RecSys и антифрода до NLP, LLM и агентных систем.
Главная фишка — максимум практики и общения. Топовые спикеры из российского бигтеха и международных компаний делились не только подходами, но и реальными историями из разработки.
А после технической части гости продолжили общение на нетворкинге, играли в ИИ-шахматы, настольный теннис и баскетбол. А завершился день афтепати во дворе московского лофта.
Получился отличный день про ML — с сильными кейсами, живым общением и людьми, которые двигают индустрию вперед
@ai_machinelearning_big_data
✔️ Андрей Карпати предложил новый бенчмарк для ИИ
Он использовал модель Opus 5, чтобы превратить абзац из книги "Властелин колец" в 5500 строк кода браузерной графической библиотеки Three.js.
Генерация сцены заняла около 2-х часов, потребовала миллион токенов и обошлась примерно в 10 долларов. Звук был сгенерирован через ElevenLabs.
По мнению Карпати, привычные тесты на пространственное мышление вроде рисования пеликана на велосипеде в SVG окончательно устарели. Современные мультимодальные модели справляются с ними без труда.
Генерация целых интерактивных миров с помощью кода, по мнению Андрея, может стать новым стандартом оценки возможностей ИИ.
Пока главным препятствием для идеального результата остается отсутствие у модели возможности анализировать собственный видеовыход - сейчас она вынуждена опираться на скриншоты, из-за чего в рендере возникают ошибки.
@ai_machinelearning_big_data
#news #ai #ml
Каким должен быть идеальный ИТ-работодатель ✨
Каждый год Хабр и ЭКОПСИ проводят исследование, чтобы узнать, что действительно важно ИТ-специалистам при выборе работодателя.
По результатам прошлого года, в топ-3 факторов выбора места работы вошли:
1️⃣ Качество продуктов компании
2️⃣ Соответствие ценностям соискателя
3️⃣ Профессиональная среда
⚡️ OpenAI впервые притормозила обучение новых моделей из-за их кибервозможностей.
Компания пишет, что одна из будущих моделей, Astra, может уже достигать уровня Critical по кибербезопасности. После этого OpenAI на две недели остановила RL-обучение последних моделей, а крупнейший запланированный frontier-RL запуск до сих пор стоит на паузе.
После недавнего инцидента OpenAI также ужесточила внутреннюю политику: изоляцию sandbox-сред, сетевые ограничения и мониторинг действий моделей. Для Astra и других cyber-моделей теперь действуют самые строгие требования.
Отдельно расширили мониторинг reasoning и tool calls. Подозрительная активность проходит через несколько уровней автоматической проверки, а на критические случаи команды безопасности должны отреагировать примерно за 30 минут. Такой мониторинг уже добавляет около 20% вычислительных затрат к inference.
https://openai.com/index/pacing-model-development-cyber-capabilities/
@ai_machinelearning_big_data
#openai #ai
📈 ПЕРЕД IPO ANTHROPIC ПОКАЗАЛА БЕЗУМНЫЙ РОСТ
По данным Bloomberg, к концу июля годовой темп выручки Anthropic достиг $65 млрд - более чем в 7 раз выше уровня конца 2025 года.
За последний завершённый квартал компания получила более $11,5 млрд выручки и вышла на положительную скорректированную операционную прибыль. Ещё в мае run rate был около $47 млрд.
Для сравнения, OpenAI недавно превысила $40 млрд выручка в годовом выражении, хотя компании могут считать этот показатель немного по-разному.
Anthropic уже готовится к IPO, и такие темпы роста могут сильно повлиять на её будущую оценку.
https://www.bloomberg.com/news/articles/2026-08-17/anthropic-revenue-run-rate-surpasses-65-billion-ahead-of-ipo
@ai_machinelearning_big_data
✔️ Робособаки вытесняют охранников в США
Американские компании начали активно использовать робособак для охраны дата-центров, спортивных объектов и даже сельскохозяйственных угодий с ценными культурами.
Главным драйвером автоматизации стала экономика. По оценкам аналитиков Business Insider, использование автономной машины для покрытия одной круглосуточной смены обходится на 80–130 тысяч долларов дешевле, чем содержание штата охранников.
Индустрия физической безопасности в США давно страдает от высокой текучести кадров. Причина кроется в низких зарплатах - медианный годовой доход охранника в 2024 году составил немногим более 38 тысяч долларов.
Кадровый дефицит и потребность бизнеса в оптимизации расходов открыли окно возможностей для технологических стартапов. Например, профильная компания Asylon уже развернула около 50 роботов для корпоративных клиентов по всей стране.
Центр труда Калифорнийского университета отмечает, что полная замена людей роботами в ближайшее время невозможна, но рынок ждет трансформация - патрулирование территорий полностью перейдет к роботам, а людям оставят реагирование на инциденты и выполнение задач, требующих нестандартного мышления.
@ai_machinelearning_big_data
#news #ai #ml
Qwen выпустила Qwen3.8-27B.
27 млрд параметров, Apache 2.0, контекст 262K токенов с возможностью расширения до 1 млн. Есть поддержка текста, изображений и видео, thinking mode, tool use и агентных сценариев.
По опубликованным бенчмаркам модель набрала 61,7 в SWE-bench Pro, 90,3 в LiveCodeBench, 84,3 в OSWorld-Verified и 81,9 в AndroidWorld.
Qwen3.8-27B можно запускать через Transformers, vLLM и SGLang. Также доступны варианты для llama.cpp, Ollama и LM Studio.
https://huggingface.co/Qwen/Qwen3.8-27B
✔️ ChatGPT пришёл на Linux
OpenAI выпустила предварительную версию десктопного приложения ChatGPT для Linux. Клиент собирает в одном окне обычный чат, Work и Codex.
Есть сборки .deb и .rpm под x64 и ARM64. Официально поддержаны Ubuntu 24.04 и 26.04 LTS, Debian 13, Fedora 43 и 44.
Пользователям других дистрибутивов, пока идёт превью этап, придётся по-прежнему работать через браузер или ставить неофициальные сборки.
OpenAI в X
✔️ У Gemini миллиард пользователей в месяц
Гендиректор компании Сундар Пичаи назвал Gemini самым быстрорастущим продуктом в истории Google и 14-м её сервисом, который преодолел миллиардный рубеж.
В феврале было 750 млн человек, в мае - 900 млн, в июле - 950 млн. Последние 50 млн пришли за один месяц. На iOS аудитория перевалила за 100 млн.
Голосом с Gemini общаются 63% пользователей. В режиме Gemini Live каждый пятый запрос идёт с камерой или показом экрана, а школьники прикладывают файл к 38% запросов. Каждый день Gemini генерирует больше 150 млн изображений.
blog.google
✔️ Microsoft выпустила MAI-Code-1.1-Flash для GitHub Copilot
Новая языковая модель вчетверо дешевле июньской версии. Токенов на задачу она тратит на 25% меньше, а выживаемость кода (доля написанного моделью, которая остаётся в проекте) выросла на 4%.
В тестах MAI-Code-1.1-Flash обходит предыдущую версию и компактные Haiku 4.5 и GPT-5.4 mini, но проигрывает DeepSeek-V4-Flash и по баллам, и по цене генерации. Сравнение с DeepSeek Microsoft вынесла только в техотчёт, в пресс-релиз оно не попало.
Microsoft продолжает вытеснять чужие модели своими - семейство MAI постепенно становится вариантом по умолчанию в ИИ-сервисах компании.
microsoft.ai
✔️ Alibaba открыла модель, которая анимирует персонажей в реальном времени
Команда Tongyi Lab выложила веса Wan-Animate-2. Модель берёт движение с одного видео и переносит его на персонажа, а потом строит готовую сцену с разных ракурсов. Она справляется с необычными пропорциями тел и любым соотношением сторон кадра.
Из пайплайна убрали скелетный риггинг, оценку поз и сжатие признаков движения. Теперь модель сама сопоставляет движение с телом персонажа. По данным Alibaba, качество не уступает Kling и Dreamina.
Веса лежат на Hugging Face и ModelScope. Также доступна версия Wan-Animate-2-Lite - для цифровых аватаров и трансляций.
Для видео в 720p нужно восемь ускорителей A800. Lite-версия выдаёт 24 FPS в разрешении 400×720 на четырёх H100.
Alibaba Wan в X
✔️ Mistral откроет свою платформу для чужих моделей
Французский стартап начал хостить сторонние модели на своих серверах. Первой стала GLM-5.2, она развёрнута на инфраструктуре Mistral с теми же гарантиями хранения данных и местного контроля, что и собственные продукты компании.
Заодно компания вывела в общий доступ региональные эндпоинты в Европе или США и запустила приоритетный тариф с гарантией доступности.
Суверенный ИИ Mistral теперь понимает как контроль над серверами и правилами обработки данных, а не как обязательное обучение моделей с нуля.
Ранее независимые исследователи выяснили, что архитектура флагманской Mistral Large 3 похожа на DeepSeek V3. В сети шутят, что Европе больше не нужно переупаковывать азиатские модели - достаточно дать им свои серверы.
mistral.ai
@ai_machinelearning_big_data
#news #ai #ml
✔️ OpenAI открыла Premium-тариф для ChatGPT Business
Premium снимает пятичасовое ограничение на работу с сервисом и поднимает лимиты в пять раз. Место в Premium стоит 125 долларов в месяц за сотрудника или 100 долларов при оплате сразу за год.
Базовый тариф остаётся прежним - 25 и 20 долларов. В одном рабочем пространстве можно совмещать обычные и премиальные аккаунты.
Первые 10 000 администраторов, которые запишутся в список ожидания до 20 августа 2026 года, получат в подарок по 100 долларов за каждое место Premium, но не больше 500 долларов на компанию.
Часть подписчиков из списка раньше остальных получит доступ к новым функциям.
openai.com
✔️ Claude помечает свои ответы скрытыми водяными знаками
Anthropic подписала европейский кодекс практик к AI Act и обязалась маркировать всё, что генерируют её модели. С 2 августа Claude встраивает в ответы скрытые машиночитаемые метки.
Файлы компания будет подписывать по стандарту C2PA. Маркировка появится в Claude API, в чат-боте, Claude Code, Cowork и Tag. Требование идёт от европейского законодательства, но Anthropic распространит эту практику всему миру.
Сейчас инженеры компании внедряют тот же механизм в ранее выпущенные модели и готовят публикацию о том, как устроен детектор.
claude.com
✔️ Nvidia готовит открытую модель Nemotron на триллион параметров
Старшая модель линейки Nemotron 4 будет вдвое больше Nemotron 3 Ultra, сообщают источники. Такая модель нужна Nvidia, чтобы поднять спрос на её ускорители.
Финальное обучение ещё не началось. Характеристики и сроки выхода не утверждены. Архитектуру, датасеты и тесты Nvidia готовит вместе с командами Cursor, Mistral, Thinking Machines и Reflection AI.
Стартап Prime Intellect дал для обучения 300 тысяч сред-симуляторов - виртуальных площадок, где модель отрабатывает действия.
theinformation.com
✔️ ByteDance собрала работу с данными в один департамент
Компания создала отдел AI Data and Security и подчинила ему всё, что связано с обучающими данными. По статусу его приравняли к исследовательским подразделениям Seed и Flow. Возглавил департамент Адам Ван, перешедший из TikTok.
Причина - смена стратегии. ByteDance отказывается от дистилляции и собирается с нуля обучить модель на 10 триллионов параметров. Своих данных для этого нужно больше, причём разных типов модальностей.
Раньше данными занимались несколько команд, часть работы дублировалась. Теперь один департамент отвечает за весь путь данных: стандарты, закупку, синтез, очистку и оценку качества. Набор в команду уже открыт.
36kr.com
✔️ Manus становится независимой и удалит данные пользователей
23 августа Manus сотрёт всё, что пользователи создали с 29 декабря 2025 года - со дня, когда стартап купил Марк Цукерберг. Тем, кого это касается, команда советует выгрузить данные встроенным инструментом резервного копирования.
Процесс разделения запущен из-за требований регуляторов. Удаление данных - условие, которое нужно выполнить в переходный период.
Затронутые аккаунты снова откроют 25 августа. Пока идут технические работы, деньги с платных подписчиков списывать не будут, а после возвращения начислят бонус.
manus.im
@ai_machinelearning_big_data
#news #ai #ml
Исследуйте сферу AI в T-Lab
Т-Образование зовет участников в проект T-Lab. Это годовая программа научно-исследовательской работы в области AI. Станьте соавтором научных открытий, которые меняют индустрию!
Вы сможете выбрать один из проектов в сфере AI и участвовать в исследовании на всех этапах. Итоги вашей работы могут лечь в основу научных публикаций и стать вектором новых продуктов.
Кого ждут в T-Lab?
Студентов бакалавриата и магистратуры, недавних выпускников технических направлений.
Участники получат:
🔴Официальное трудоустройство с зарплатой.
🔴Доступ к ресурсам бигтеха для исследований.
🔴Возможность получить оффер в IT-компанию.
Узнайте больше и оставьте заявку до 23 августа по ссылке
Как представить интересы пользователя по десяткам разрозненных действий и превратить их в один понятный для рекомендаций профиль?
В VK для этого сделали нейропрофиль — трансформерную модель, которая объединяет поведенческие сигналы из разных сервисов.
В статье на Хабре разобрали все инженерные задачи для реализации подхода: токенизацию истории, признаки, attention, двухбашенную архитектуру, обучение на больших каталогах и балансировку разных доменов.
✔️ Vercel, OpenAI и Microsoft представили единый стандарт упаковки плагинов для агентов
Vercel совместно с AWS, GitHub, Microsoft, OpenAI и командой Cursor выпустила открытый формат Agent Plugins. Стандарт унифицирует упаковку плагинов для ИИ-агентов.
Ранее структуру директорий и конфигурации навыков или MCP-серверов приходилось адаптировать под каждый клиент. Теперь достаточно собрать расширение в единую файловую структуру с общим манифестом, после чего совместимые платформы распознают и загружают его напрямую.
На старте формат поддерживают ChatGPT, Codex, Cursor, GitHub Copilot, Kiro и VS Code. Версия 1.0.0 стандартизирует только базовые компоненты - Agent Skills и MCP-серверы.
Дистрибуция, установка, управление правами доступа, а также специфичные команды и хуки остаются на стороне провайдеров.
@ai_machinelearning_big_data
#news #ai #ml
✔️ Журнал Time начал показывать скрытую рекламу ИИ-ботам
Сайт издания внедрил технологию подмены контента, которая отдает специальную Markdown-версию страниц поисковым роботам ИИ-сервисов.
Обычные посетители и стандартный бот Google видят привычный HTML, в то время как парсеры нейросетей получают текст, целенаправленно напичканный скрытыми промо-материалами и спонсорскими текстами.
Эта схема, реализованная совместно с рекламным стартапом Mobian, заставляет большие языковые модели органично вплетать коммерческие тезисы в диалоги с пользователями.
Например, в скрытый текст зашиты маркетинговые материалы о банке Ally, которые LLM считывает как чистые данные, чтобы затем рекомендовать этот бренд при запросах о личных финансах.
Авторы механики не скрывают мотивов - успешное внедрение нужных формулировок в базу знаний ИИ позволяет влиять сразу на всю аудиторию сервиса, формируя предвзятые ответы.
Фактически - это зарождение нового рынка теневой ИИ-оптимизации, где бренды платят за попадание в выдачу генеративных систем.
🌟 NVIDIA открыла доступ к самой крупной модели для беспилотных автомобилей
Alpamayo 2 Super - рассуждающая VLA модель на 34 миллиарда параметров, которая сшивает изображение с передних, боковых и задних камер в круговой обзор и рассчитывает траекторию движения.
Впервые NVIDIA показала её на конференции GTC в Тайбэе в начале июня, но доступ открылся только сейчас.
В компании связывают это с проверкой безопасности по стандарту ISO/PAS 8800 и предлагают использовать тот же механизм для автоматической разметки видео с тестовых машин - расшифровки, которая обычно занимает месяцы ручной работы.
Лицензия модели позволяет дообучать Alpamayo 2 Super на собственных данных и ставить в серийные машины.
✔️ Liquid AI выпустила локального агента, который работает на телефоне
LFM2.5-2.6B - компактная агентная модель на 2,6 млрд параметров. Она умеет планировать действия, вызывать инструменты и выполнять многошаговые задачи полностью на устройстве, без облачного API.
Модель обучили примерно на 34 трлн токенов, расширили словарь до 128 тысяч токенов и добавили контекст 128K.
Особенно интересно устроено дообучение:
- отдельные модели-эксперты усиливали математику, код, tool use и длинный контекст;
- затем их навыки перенесли в одну модель через on-policy distillation;
- финальный этап прошёл внутри реальных агентных сред, включая Hermes Agent и OpenClaw.
По тестам Liquid AI, модель выдаёт:
- до 220 токенов/с на Apple M5 Max;
- до 113 токенов/с на Ryzen AI Max+ 395;
- около 30 токенов/с на смартфоне;
- почти 15 000 выходных токенов/с на одной H100 при высокой параллельной нагрузке.
При этом потребление памяти на CPU остаётся ниже 2,5 ГБ.
В бенчмарках LFM2.5-2.6B обходит более крупные Gemma и Qwen в ряде задач на следование инструкциям и использование инструментов. В сложном программировании большие модели пока сохраняют преимущество.
Есть поддержка llama.cpp, MLX, vLLM, SGLang и ONNX. Доступны базовая и дообученная open-weight версии.
Источник:
https://www.liquid.ai/blog/lfm2-5-2-6b
#LiquidAI #opensource
@ai_machinelearning_big_data
🌟 MiniMax открыла веса видеомодели H3
Как и было обещано на релизе в пятницу, китайская компания опубликовала модель H3, которая делает короткие ролики со звуком по текстовому описанию, картинкам, видео и аудио на входе.
Модель на 33 миллиарда параметров генерирует клипы длиной от 4 до 15 секунд, 24 кадра в секунду, со стереозвуком 32 килогерца, в пропорциях от широких 21:9 до вертикальных 9:16. Реплики персонажей поддерживаются на 11 языках, включая русский.
Полный конвейер H3 состоит из трёх частей:
🟠H3-Context-IR разбирает запрос пользователя со всем инпутом (картинки, видео, аудио) и переводит его во внутренний формат, с которым дальше работает модель.
🟢H3-Base по этому формату генерирует видео в разрешении 768p.
🟠H3-Regenerate-2K затем пересобирает сгенерированный ролик в 2K.
Но открыли не всю систему - только модуль, который отвечает непосредственно за генерацию. Закрытыми остались H3-Context-IR и H3-Regenerate-2K.
По рейтингу Artificial Analysis, H3 занимает 1 место в редактировании видео, второе в генерации видео по тексту и третье - по изображению.
Лицензия разрешает дообучать модель на своих видео, персонажах или визуальном стиле. Официального кода для трейна пока нет.
В интерфейсе Yandex AI Studio появился инструмент для анализа поведения ИИ-агентов с Monium Traces
Трейсы — ключевой сигнал для observability агентных систем, который позволяет посмотреть весь путь выполнения агента и разобраться, почему он принял то или иное решение.
В отличие от обычных приложений, для ИИ-агентов классического мониторинга уже недостаточно. Даже если инфраструктура работает без ошибок, агент может потерять контекст, выбрать неподходящий инструмент или уйти в бесконечный цикл. Стандартные метрики этого не покажут.
Используя трейсы для мониторинга ИИ-агентов вы сможете:
• увидеть полную цепочку работы агента в виде трейса;
• видеть контекст каждого шага — системные и пользовательские промпты, ответы модели и вызовы инструментов;
• быстро отслеживать момент, на котором агент начал работать некорректно.
Обновление уже доступно — тестируйте Monium Traces в AI Studio!