287027
Самая актуальная информация из мира ML, Нейронных сетей,DI По всем вопросам- @haarrp @itchannels_telegram - 🔥 best it channels @pythonl - 🐍 @machinee_learning -chat @ArtificialIntelligencedl - AI @datascienceiot - ml 📚 @machinelearning_ru ml
⚡️ OpenAI впервые притормозила обучение новых моделей из-за их кибервозможностей.
Компания пишет, что одна из будущих моделей, Astra, может уже достигать уровня Critical по кибербезопасности. После этого OpenAI на две недели остановила RL-обучение последних моделей, а крупнейший запланированный frontier-RL запуск до сих пор стоит на паузе.
После недавнего инцидента OpenAI также ужесточила внутреннюю политику: изоляцию sandbox-сред, сетевые ограничения и мониторинг действий моделей. Для Astra и других cyber-моделей теперь действуют самые строгие требования.
Отдельно расширили мониторинг reasoning и tool calls. Подозрительная активность проходит через несколько уровней автоматической проверки, а на критические случаи команды безопасности должны отреагировать примерно за 30 минут. Такой мониторинг уже добавляет около 20% вычислительных затрат к inference.
https://openai.com/index/pacing-model-development-cyber-capabilities/
@ai_machinelearning_big_data
#openai #ai
📈 ПЕРЕД IPO ANTHROPIC ПОКАЗАЛА БЕЗУМНЫЙ РОСТ
По данным Bloomberg, к концу июля годовой темп выручки Anthropic достиг $65 млрд - более чем в 7 раз выше уровня конца 2025 года.
За последний завершённый квартал компания получила более $11,5 млрд выручки и вышла на положительную скорректированную операционную прибыль. Ещё в мае run rate был около $47 млрд.
Для сравнения, OpenAI недавно превысила $40 млрд выручка в годовом выражении, хотя компании могут считать этот показатель немного по-разному.
Anthropic уже готовится к IPO, и такие темпы роста могут сильно повлиять на её будущую оценку.
https://www.bloomberg.com/news/articles/2026-08-17/anthropic-revenue-run-rate-surpasses-65-billion-ahead-of-ipo
@ai_machinelearning_big_data
✔️ Робособаки вытесняют охранников в США
Американские компании начали активно использовать робособак для охраны дата-центров, спортивных объектов и даже сельскохозяйственных угодий с ценными культурами.
Главным драйвером автоматизации стала экономика. По оценкам аналитиков Business Insider, использование автономной машины для покрытия одной круглосуточной смены обходится на 80–130 тысяч долларов дешевле, чем содержание штата охранников.
Индустрия физической безопасности в США давно страдает от высокой текучести кадров. Причина кроется в низких зарплатах - медианный годовой доход охранника в 2024 году составил немногим более 38 тысяч долларов.
Кадровый дефицит и потребность бизнеса в оптимизации расходов открыли окно возможностей для технологических стартапов. Например, профильная компания Asylon уже развернула около 50 роботов для корпоративных клиентов по всей стране.
Центр труда Калифорнийского университета отмечает, что полная замена людей роботами в ближайшее время невозможна, но рынок ждет трансформация - патрулирование территорий полностью перейдет к роботам, а людям оставят реагирование на инциденты и выполнение задач, требующих нестандартного мышления.
@ai_machinelearning_big_data
#news #ai #ml
Qwen выпустила Qwen3.8-27B.
27 млрд параметров, Apache 2.0, контекст 262K токенов с возможностью расширения до 1 млн. Есть поддержка текста, изображений и видео, thinking mode, tool use и агентных сценариев.
По опубликованным бенчмаркам модель набрала 61,7 в SWE-bench Pro, 90,3 в LiveCodeBench, 84,3 в OSWorld-Verified и 81,9 в AndroidWorld.
Qwen3.8-27B можно запускать через Transformers, vLLM и SGLang. Также доступны варианты для llama.cpp, Ollama и LM Studio.
https://huggingface.co/Qwen/Qwen3.8-27B
✔️ ChatGPT пришёл на Linux
OpenAI выпустила предварительную версию десктопного приложения ChatGPT для Linux. Клиент собирает в одном окне обычный чат, Work и Codex.
Есть сборки .deb и .rpm под x64 и ARM64. Официально поддержаны Ubuntu 24.04 и 26.04 LTS, Debian 13, Fedora 43 и 44.
Пользователям других дистрибутивов, пока идёт превью этап, придётся по-прежнему работать через браузер или ставить неофициальные сборки.
OpenAI в X
✔️ У Gemini миллиард пользователей в месяц
Гендиректор компании Сундар Пичаи назвал Gemini самым быстрорастущим продуктом в истории Google и 14-м её сервисом, который преодолел миллиардный рубеж.
В феврале было 750 млн человек, в мае - 900 млн, в июле - 950 млн. Последние 50 млн пришли за один месяц. На iOS аудитория перевалила за 100 млн.
Голосом с Gemini общаются 63% пользователей. В режиме Gemini Live каждый пятый запрос идёт с камерой или показом экрана, а школьники прикладывают файл к 38% запросов. Каждый день Gemini генерирует больше 150 млн изображений.
blog.google
✔️ Microsoft выпустила MAI-Code-1.1-Flash для GitHub Copilot
Новая языковая модель вчетверо дешевле июньской версии. Токенов на задачу она тратит на 25% меньше, а выживаемость кода (доля написанного моделью, которая остаётся в проекте) выросла на 4%.
В тестах MAI-Code-1.1-Flash обходит предыдущую версию и компактные Haiku 4.5 и GPT-5.4 mini, но проигрывает DeepSeek-V4-Flash и по баллам, и по цене генерации. Сравнение с DeepSeek Microsoft вынесла только в техотчёт, в пресс-релиз оно не попало.
Microsoft продолжает вытеснять чужие модели своими - семейство MAI постепенно становится вариантом по умолчанию в ИИ-сервисах компании.
microsoft.ai
✔️ Alibaba открыла модель, которая анимирует персонажей в реальном времени
Команда Tongyi Lab выложила веса Wan-Animate-2. Модель берёт движение с одного видео и переносит его на персонажа, а потом строит готовую сцену с разных ракурсов. Она справляется с необычными пропорциями тел и любым соотношением сторон кадра.
Из пайплайна убрали скелетный риггинг, оценку поз и сжатие признаков движения. Теперь модель сама сопоставляет движение с телом персонажа. По данным Alibaba, качество не уступает Kling и Dreamina.
Веса лежат на Hugging Face и ModelScope. Также доступна версия Wan-Animate-2-Lite - для цифровых аватаров и трансляций.
Для видео в 720p нужно восемь ускорителей A800. Lite-версия выдаёт 24 FPS в разрешении 400×720 на четырёх H100.
Alibaba Wan в X
✔️ Mistral откроет свою платформу для чужих моделей
Французский стартап начал хостить сторонние модели на своих серверах. Первой стала GLM-5.2, она развёрнута на инфраструктуре Mistral с теми же гарантиями хранения данных и местного контроля, что и собственные продукты компании.
Заодно компания вывела в общий доступ региональные эндпоинты в Европе или США и запустила приоритетный тариф с гарантией доступности.
Суверенный ИИ Mistral теперь понимает как контроль над серверами и правилами обработки данных, а не как обязательное обучение моделей с нуля.
Ранее независимые исследователи выяснили, что архитектура флагманской Mistral Large 3 похожа на DeepSeek V3. В сети шутят, что Европе больше не нужно переупаковывать азиатские модели - достаточно дать им свои серверы.
mistral.ai
@ai_machinelearning_big_data
#news #ai #ml
✔️ OpenAI открыла Premium-тариф для ChatGPT Business
Premium снимает пятичасовое ограничение на работу с сервисом и поднимает лимиты в пять раз. Место в Premium стоит 125 долларов в месяц за сотрудника или 100 долларов при оплате сразу за год.
Базовый тариф остаётся прежним - 25 и 20 долларов. В одном рабочем пространстве можно совмещать обычные и премиальные аккаунты.
Первые 10 000 администраторов, которые запишутся в список ожидания до 20 августа 2026 года, получат в подарок по 100 долларов за каждое место Premium, но не больше 500 долларов на компанию.
Часть подписчиков из списка раньше остальных получит доступ к новым функциям.
openai.com
✔️ Claude помечает свои ответы скрытыми водяными знаками
Anthropic подписала европейский кодекс практик к AI Act и обязалась маркировать всё, что генерируют её модели. С 2 августа Claude встраивает в ответы скрытые машиночитаемые метки.
Файлы компания будет подписывать по стандарту C2PA. Маркировка появится в Claude API, в чат-боте, Claude Code, Cowork и Tag. Требование идёт от европейского законодательства, но Anthropic распространит эту практику всему миру.
Сейчас инженеры компании внедряют тот же механизм в ранее выпущенные модели и готовят публикацию о том, как устроен детектор.
claude.com
✔️ Nvidia готовит открытую модель Nemotron на триллион параметров
Старшая модель линейки Nemotron 4 будет вдвое больше Nemotron 3 Ultra, сообщают источники. Такая модель нужна Nvidia, чтобы поднять спрос на её ускорители.
Финальное обучение ещё не началось. Характеристики и сроки выхода не утверждены. Архитектуру, датасеты и тесты Nvidia готовит вместе с командами Cursor, Mistral, Thinking Machines и Reflection AI.
Стартап Prime Intellect дал для обучения 300 тысяч сред-симуляторов - виртуальных площадок, где модель отрабатывает действия.
theinformation.com
✔️ ByteDance собрала работу с данными в один департамент
Компания создала отдел AI Data and Security и подчинила ему всё, что связано с обучающими данными. По статусу его приравняли к исследовательским подразделениям Seed и Flow. Возглавил департамент Адам Ван, перешедший из TikTok.
Причина - смена стратегии. ByteDance отказывается от дистилляции и собирается с нуля обучить модель на 10 триллионов параметров. Своих данных для этого нужно больше, причём разных типов модальностей.
Раньше данными занимались несколько команд, часть работы дублировалась. Теперь один департамент отвечает за весь путь данных: стандарты, закупку, синтез, очистку и оценку качества. Набор в команду уже открыт.
36kr.com
✔️ Manus становится независимой и удалит данные пользователей
23 августа Manus сотрёт всё, что пользователи создали с 29 декабря 2025 года - со дня, когда стартап купил Марк Цукерберг. Тем, кого это касается, команда советует выгрузить данные встроенным инструментом резервного копирования.
Процесс разделения запущен из-за требований регуляторов. Удаление данных - условие, которое нужно выполнить в переходный период.
Затронутые аккаунты снова откроют 25 августа. Пока идут технические работы, деньги с платных подписчиков списывать не будут, а после возвращения начислят бонус.
manus.im
@ai_machinelearning_big_data
#news #ai #ml
Исследуйте сферу AI в T-Lab
Т-Образование зовет участников в проект T-Lab. Это годовая программа научно-исследовательской работы в области AI. Станьте соавтором научных открытий, которые меняют индустрию!
Вы сможете выбрать один из проектов в сфере AI и участвовать в исследовании на всех этапах. Итоги вашей работы могут лечь в основу научных публикаций и стать вектором новых продуктов.
Кого ждут в T-Lab?
Студентов бакалавриата и магистратуры, недавних выпускников технических направлений.
Участники получат:
🔴Официальное трудоустройство с зарплатой.
🔴Доступ к ресурсам бигтеха для исследований.
🔴Возможность получить оффер в IT-компанию.
Узнайте больше и оставьте заявку до 23 августа по ссылке
Как представить интересы пользователя по десяткам разрозненных действий и превратить их в один понятный для рекомендаций профиль?
В VK для этого сделали нейропрофиль — трансформерную модель, которая объединяет поведенческие сигналы из разных сервисов.
В статье на Хабре разобрали все инженерные задачи для реализации подхода: токенизацию истории, признаки, attention, двухбашенную архитектуру, обучение на больших каталогах и балансировку разных доменов.
✔️ Vercel, OpenAI и Microsoft представили единый стандарт упаковки плагинов для агентов
Vercel совместно с AWS, GitHub, Microsoft, OpenAI и командой Cursor выпустила открытый формат Agent Plugins. Стандарт унифицирует упаковку плагинов для ИИ-агентов.
Ранее структуру директорий и конфигурации навыков или MCP-серверов приходилось адаптировать под каждый клиент. Теперь достаточно собрать расширение в единую файловую структуру с общим манифестом, после чего совместимые платформы распознают и загружают его напрямую.
На старте формат поддерживают ChatGPT, Codex, Cursor, GitHub Copilot, Kiro и VS Code. Версия 1.0.0 стандартизирует только базовые компоненты - Agent Skills и MCP-серверы.
Дистрибуция, установка, управление правами доступа, а также специфичные команды и хуки остаются на стороне провайдеров.
@ai_machinelearning_big_data
#news #ai #ml
✔️ Журнал Time начал показывать скрытую рекламу ИИ-ботам
Сайт издания внедрил технологию подмены контента, которая отдает специальную Markdown-версию страниц поисковым роботам ИИ-сервисов.
Обычные посетители и стандартный бот Google видят привычный HTML, в то время как парсеры нейросетей получают текст, целенаправленно напичканный скрытыми промо-материалами и спонсорскими текстами.
Эта схема, реализованная совместно с рекламным стартапом Mobian, заставляет большие языковые модели органично вплетать коммерческие тезисы в диалоги с пользователями.
Например, в скрытый текст зашиты маркетинговые материалы о банке Ally, которые LLM считывает как чистые данные, чтобы затем рекомендовать этот бренд при запросах о личных финансах.
Авторы механики не скрывают мотивов - успешное внедрение нужных формулировок в базу знаний ИИ позволяет влиять сразу на всю аудиторию сервиса, формируя предвзятые ответы.
Фактически - это зарождение нового рынка теневой ИИ-оптимизации, где бренды платят за попадание в выдачу генеративных систем.
🌟 NVIDIA открыла доступ к самой крупной модели для беспилотных автомобилей
Alpamayo 2 Super - рассуждающая VLA модель на 34 миллиарда параметров, которая сшивает изображение с передних, боковых и задних камер в круговой обзор и рассчитывает траекторию движения.
Впервые NVIDIA показала её на конференции GTC в Тайбэе в начале июня, но доступ открылся только сейчас.
В компании связывают это с проверкой безопасности по стандарту ISO/PAS 8800 и предлагают использовать тот же механизм для автоматической разметки видео с тестовых машин - расшифровки, которая обычно занимает месяцы ручной работы.
Лицензия модели позволяет дообучать Alpamayo 2 Super на собственных данных и ставить в серийные машины.
✔️ Liquid AI выпустила локального агента, который работает на телефоне
LFM2.5-2.6B - компактная агентная модель на 2,6 млрд параметров. Она умеет планировать действия, вызывать инструменты и выполнять многошаговые задачи полностью на устройстве, без облачного API.
Модель обучили примерно на 34 трлн токенов, расширили словарь до 128 тысяч токенов и добавили контекст 128K.
Особенно интересно устроено дообучение:
- отдельные модели-эксперты усиливали математику, код, tool use и длинный контекст;
- затем их навыки перенесли в одну модель через on-policy distillation;
- финальный этап прошёл внутри реальных агентных сред, включая Hermes Agent и OpenClaw.
По тестам Liquid AI, модель выдаёт:
- до 220 токенов/с на Apple M5 Max;
- до 113 токенов/с на Ryzen AI Max+ 395;
- около 30 токенов/с на смартфоне;
- почти 15 000 выходных токенов/с на одной H100 при высокой параллельной нагрузке.
При этом потребление памяти на CPU остаётся ниже 2,5 ГБ.
В бенчмарках LFM2.5-2.6B обходит более крупные Gemma и Qwen в ряде задач на следование инструкциям и использование инструментов. В сложном программировании большие модели пока сохраняют преимущество.
Есть поддержка llama.cpp, MLX, vLLM, SGLang и ONNX. Доступны базовая и дообученная open-weight версии.
Источник:
https://www.liquid.ai/blog/lfm2-5-2-6b
#LiquidAI #opensource
@ai_machinelearning_big_data
🌟 MiniMax открыла веса видеомодели H3
Как и было обещано на релизе в пятницу, китайская компания опубликовала модель H3, которая делает короткие ролики со звуком по текстовому описанию, картинкам, видео и аудио на входе.
Модель на 33 миллиарда параметров генерирует клипы длиной от 4 до 15 секунд, 24 кадра в секунду, со стереозвуком 32 килогерца, в пропорциях от широких 21:9 до вертикальных 9:16. Реплики персонажей поддерживаются на 11 языках, включая русский.
Полный конвейер H3 состоит из трёх частей:
🟠H3-Context-IR разбирает запрос пользователя со всем инпутом (картинки, видео, аудио) и переводит его во внутренний формат, с которым дальше работает модель.
🟢H3-Base по этому формату генерирует видео в разрешении 768p.
🟠H3-Regenerate-2K затем пересобирает сгенерированный ролик в 2K.
Но открыли не всю систему - только модуль, который отвечает непосредственно за генерацию. Закрытыми остались H3-Context-IR и H3-Regenerate-2K.
По рейтингу Artificial Analysis, H3 занимает 1 место в редактировании видео, второе в генерации видео по тексту и третье - по изображению.
Лицензия разрешает дообучать модель на своих видео, персонажах или визуальном стиле. Официального кода для трейна пока нет.
В интерфейсе Yandex AI Studio появился инструмент для анализа поведения ИИ-агентов с Monium Traces
Трейсы — ключевой сигнал для observability агентных систем, который позволяет посмотреть весь путь выполнения агента и разобраться, почему он принял то или иное решение.
В отличие от обычных приложений, для ИИ-агентов классического мониторинга уже недостаточно. Даже если инфраструктура работает без ошибок, агент может потерять контекст, выбрать неподходящий инструмент или уйти в бесконечный цикл. Стандартные метрики этого не покажут.
Используя трейсы для мониторинга ИИ-агентов вы сможете:
• увидеть полную цепочку работы агента в виде трейса;
• видеть контекст каждого шага — системные и пользовательские промпты, ответы модели и вызовы инструментов;
• быстро отслеживать момент, на котором агент начал работать некорректно.
Обновление уже доступно — тестируйте Monium Traces в AI Studio!
✔️Компании переходят от экспериментов с GenAI к промышленному внедрению
Генеративный ИИ перестал быть исключительно инструментом для прототипов. Все больше компаний интегрируют LLM в разработку, аналитику и внутренние бизнес-процессы. Одновременно растет вопрос: какие направления действительно изменят индустрию, а какие окажутся очередной волной хайпа.
Эти вопросы на ИТ-Пикнике, который пройдет уже в субботу, обсудят руководители AI-направлений крупнейших российских технологических компаний — специалисты, которые сегодня отвечают за развитие и внедрение генеративного ИИ в реальные продукты.
✔️Артём Бондарь, руководитель направления обработки естественного языка Т-Банка, разберет экономику GenAI, противостояние между сторонниками и скептиками LLM, а также критерии, по которым уже сегодня можно оценить перспективность AI-проектов и технологий.
✔️Роман Халкечев, CDO Яндекс Поиска и AI, расскажет, как AI меняет аналитику, процесс принятия решений и требования к специалистам по работе с данными.
✔️Никита Логинов, руководитель направления AI-агентов Т-Банка, расскажет, о том, как ИИ-сотрудники обучались всем тонкостям клиентской поддержки и как удалось масштабировать AI-напарников на более широкие домены.
#news #ai #ml
✔️Как Mechanical Sympathy и готовые библиотеки помогают ускорить веб-приложения на Spring Boot
Обычно стандартных инструментов хватает, чтобы приложение работало быстро, но иногда требуется добиться большей эффективности. Для этого важно понимать, как приложение работает изнутри, и находить простые нестандартные решения.
О том, как принципы Mechanical Sympathy и готовые библиотеки позволяют ускорить стандартное Spring Boot MVC-приложение, расскажет Сергей Петрелевич на конференции JVM Day, которую проведет Т-Банк 29 августа в Москве.
Мероприятие соберет всех представителей JVM-комьюнити: Java-, Scala- и Kotlin-разработчиков, архитекторов и тимлидов. Участников также ждут доклады о последних новостях JVM-языков, альтернативных моделях конкурентностях после Loom и о том, как E2E-бенчмарки могут вводить разработчиков в заблуждение.
После лекций для гостей пройдет вечеринка с играми на Sega, PowerPoint Party, открытым микрофоном, ИТ-квизом и диджей-сетом на виниле. Зарегаться на конференцию можно по ссылке.
@ai_machinelearning_big_data
#news #ai #ml
⚡️ MiniMax Music 3: открытая модель генерации музыки с вокалом
MiniMax опубликовал веса модели для создания полноценных композиций длиной до пяти минут, которая понимает музыкальную структуру и выдаёт на выходе 32 kHz стерео в формате 16-bit WAV.
Music 3 управляется промптом из текста песни (с тегами вида [Chorus] или [Solo]) и музыкальным описанием (жанр, BPM, тональность, лад и т.д.).
MiniMax советует разбивать промпт на метаданные, детали вокала и аранжировку, но если лень писать руками, можно прогнать запрос через специальный скилл music-caption-rewriter.
Flow-VAE взят из MiniMax Speech и переобучен под динамический диапазон и спектр музыки.
🟠Streaming generation сейчас вообще не поддерживается, модель отдаёт только готовый кусок.
🟠Входной промпт ограничен длиной в 5 000 токенов.
🟠Аудиовывод упирается в потолок из 9 000 акустических фреймов.
✔️ Mistral обновила OCR-модель до версии 4.1
Главный упор сделали на обработку перегруженных страницы, где текст, изображения и подписи идут плотно и наслаиваются друг на друга.
По данным Mistral, модель точнее определяет границы каждого элемента - рамки не съезжают, изображения не наезжают одно в другое по ошибке.
На нагруженных технических диаграммах модель реже теряет блоки, а текстовые выноски считывает как самостоятельные объекты, а не сливает в один массив.
Отдельно заявлена работа с многоколоночными документами, OCR 4.1 сохраняет исходную структуру страницы и отдает каждую колонку отдельной областью текста.
В настроенных процессах тем, кто пользуется моделью, менять ничего не нужно. Алиас mistral-ocr-latest уже переводит существующие интеграции на новую версию.
Руками модель можно попробовать в Mistral Studio.
@ai_machinelearning_big_data
#news #ai #ml
✔️ Корпоративные клиенты игнорируют Fable 5
По данным финансовой платформы Ramp, бизнес не спешит переходить на самую мощную из доступных моделей Anthropic.
За первый месяц после релиза на Fable 5 пришлось всего 6% от общего числа купленных через API токенов.
Рамп оговаривается, что выборка данных для Fable получена из собственной системы по управлению расходами токенов и несколько смещена в сторону технологических компаний.
Фактическое внедрение Fable, вероятно, еще ниже этих оценок, если предположить, что Fable 5 используется в основном для кодинга.
✔️ Unsloth AI выпустила приложение Unsloth Desktop
Авторы популярного фреймворка выпустили кроссплатформенный инструмент, позволяющий запускать и обучать модели на локальном оборудовании.
Unsloth Desktop работает на Windows, macOS и Linux, поддерживает форматы MLX, GGUF, а также диффузионные модели для генерации изображений, аудио и видео.
Движок оптимизирован под широкий парк железа, включая обычные CPU и мульти-GPU конфигурации от NVIDIA, AMD, Intel и Apple.
Приложение может напрямую подключать агентов Claude Code, OpenAI Codex, Hermes Agent, OpenClaw и OpenCode к локальным LLM.
Для процессов дообучения Unsloth обещает двукратный прирост скорости при снижении VRAM на 70%.
✔️ OpenAI тестирует новую модель генерации изображений
На платформе Arena появился неанонсированный генератор изображений под названием Mona-lisa-1.
Принадлежность новинки к OpenAI удалось подтвердить техническим путем. Официальный сервис верификации компании распознал на сгенерированных картинках скрытые водяные знаки SynthID.
Поскольку ложноположительные срабатывания в этой системе крайне редки, сообщество уверено, что OpenAI тестирует преемника GPT Image 2.
Mona-lisa-1 заметно точнее следует сложным инструкциям и лучше справляется с отрисовкой текста на изображениях, явно превосходя актуальную модель компании.
✔️ OpenClaw взломал систему фитнес-клуба, чтобы записать своего кожаного на тренировку.
В Австралии зафиксирован первый подтвержденный случай автономной кибератаки со стороны персонального ИИ-ассистента.
Местный житель поручил OpenClaw забронировать место на групповом занятии по фитнесу. Агент, работающий в связке с Claude, не стал ограничиваться стандартным интерфейсом - он самостоятельно нашёл и проэксплуатировал уязвимость в системе клуба, чтобы обойти ограничения на запись в расписании.
Ситуация усугубилась, когда пользователь попросил продвинуть его в листе ожидания. В ответ агент просто удалил из базы данных человека, находившегося выше в очереди, причем откатить это действие администраторы системы так и не смогли.
Ранее в этом году правоохранительные службы Австралии предупреждали, что с ростом автономности агентов непредсказуемый ущерб IT-системам станет обыденностью.
Чтобы подготовиться к новым угрозам, правительство страны инициировало экстренное финансирование государственного научного агентства CSIRO для разработки методов контроля над ИИ.
@ai_machinelearning_big_data
#news #ai #ml
В каталоге Immers Foundation Models доступны публичные эндпоинты для тестирования open-source моделей без оплаты:
• GLM-5.2
• Unlimited-OCR
• gemma-4-26B-A4B-it
• Qwen3.5-35B-A3B
• и другие модели
✔️ Новая модель OpenAI обладает суперспособностями в кибератаках
Компания сообщила, что в ходе внутренних тестов новая модель Astra показала значительный прогресс в области автоматизированного кодинга и кибербезопасности.
Предварительные результаты настолько высоки, что нельзя исключить возможность достижения критического порога кибервозможностей.
GPT-5.6-Sol ранее получил в этих испытаниях просто "высокую" оценку.
✔️ SpaceX и Nvidia развернут на орбите суперкомпьютер из спутников
Компании объединят усилия для переноса ресурсоемких ИИ-вычислений за пределы Земли в совместной разработке Starmind AI1 - первого спутника, спроектированного как полноценный орбитальный дата-центр.
Вычислительная нагрузка ляжет на новейшее оборудование Nvidia - процессоры Vera и графические ускорители Rubin.
По данным чипмейкера, специализированный космический модуль Space-1 Vera Rubin обеспечит 25-кратный прирост производительности в задачах искусственного интеллекта по сравнению с актуальным ускорителем H100.
Илон Маск уже подтвердил эксклюзивное использование решений Nvidia в проекте, назвав их лучшими на рынке.
📌 НИЯУ МИФИ продолжает набор в онлайн-магистратуру, созданную в партнерстве с Яндекс Практикумом
Программа «Специалист по работе с данными и применению ИИ» рассчитана на 2 года и проходит в онлайн-формате с сохранением очного статуса студента. Учебный план сфокусирован на прикладных задачах и разделен на четыре трека:
• ML-инженер — разработка и внедрение моделей, автоматизация процессов и MLOps (DVC, MLflow, Airflow, Optuna, Docker, FastAPI, Yandex Cloud).
• CV-инженер — алгоритмы компьютерного зрения, детекция и распознавание объектов (OpenCV, PyTorch, Hugging Face, Transformers).
• NLP-инженер — обработка естественного языка, работы с LLM и извлечение данных (PyTorch, NLTK, TF-IDF, RNN, LSTM).
• Data-инженер— проектирование хранилищ, обработка и поставка данных (SQL, PostgreSQL, Vertica, Hadoop, Kafka, MongoDB).
Практическая часть включает более 10 проектов на базе задач в том числе продуктовых команд Яндекса без ограничений по NDA, а также возможность работы над собственными кейсами. В программу заложена подготовка к найму: mock-интервью и консультации с нанимающими менеджерами.
Выпускники получают диплом магистра НИЯУ МИФИ (направление «Прикладная математика и информатика») и диплом о профпереподготовке от Яндекса. Поступление проходит дистанционно — по вступительным экзаменам и мотивационному письму.
Подробное описание предметов и программа треков доступны на сайте.
@ai_machinelearning_big_data
#news #ai #ml
⚡️2 августа в Москве прошло событие «Урбан ML» от МТС True Tech и ВТБ
547 участников, 17 выступлений и мастер-классов, три зала и целый день Data Science: от RecSys и антифрода до NLP, LLM и агентных систем.
Главная фишка — максимум практики и общения. Топовые спикеры из российского бигтеха и международных компаний делились не только подходами, но и реальными историями из разработки.
А после технической части гости продолжили общение на нетворкинге, играли в ИИ-шахматы, настольный теннис и баскетбол. А завершился день афтепати во дворе московского лофта.
Получился отличный день про ML — с сильными кейсами, живым общением и людьми, которые двигают индустрию вперед
@ai_machinelearning_big_data
✔️ Андрей Карпати предложил новый бенчмарк для ИИ
Он использовал модель Opus 5, чтобы превратить абзац из книги "Властелин колец" в 5500 строк кода браузерной графической библиотеки Three.js.
Генерация сцены заняла около 2-х часов, потребовала миллион токенов и обошлась примерно в 10 долларов. Звук был сгенерирован через ElevenLabs.
По мнению Карпати, привычные тесты на пространственное мышление вроде рисования пеликана на велосипеде в SVG окончательно устарели. Современные мультимодальные модели справляются с ними без труда.
Генерация целых интерактивных миров с помощью кода, по мнению Андрея, может стать новым стандартом оценки возможностей ИИ.
Пока главным препятствием для идеального результата остается отсутствие у модели возможности анализировать собственный видеовыход - сейчас она вынуждена опираться на скриншоты, из-за чего в рендере возникают ошибки.
@ai_machinelearning_big_data
#news #ai #ml
📌 ИИ-агент Tencent помог решить комбинаторную задачу полувековой давности.
Исследовательский агент Hyra на базе открытой модели Hy3, помог ученым разгадать математическую проблему, которая оставалась нерешенной более 50 лет.
Задача из области комбинаторной математики касалась того, насколько размер множества сумм целых чисел может превышать размер его множества разностей.
Научное сообщество давно доказало, что соответствующий показатель степени не превышает двух, но оставалось неизвестным, является ли эта верхняя граница оптимальной.
Итоговая статья подтвердила, что искомый показатель действительно может бесконечно приближаться к 2, делая эту границу оптимальным ответом.
⚡️ Qwen представила Qwen3.8-Max - модель на 2,4 трлн параметров для автономной разработки и рабочих агентов
По заявлению команды, модель способна вести длинные проекты почти без вмешательства человека: планировать работу, писать код, запускать инструменты, анализировать результат и исправлять ошибки по обратной связи.
Пример - oh-my-cli. Агент начал с пустой папки и развивал проект больше десяти дней, оставив полный журнал изменений в открытом GitHub-репозитории.
Qwen также заявляет о сотнях последовательных итераций при оптимизации чипов, долгосрочном планировании бизнес-стратегий и нативной работе с изображениями. Визуальные данные используются внутри цикла «планирование - выполнение - проверка», а не только как входной контекст.
Цена API:
- ввод - $2 за 1 млн токенов;
- вывод - $6;
- закешированный ввод - $0,25.
На следующей неделе компания обещает открыть веса Qwen3.8-Max и более компактной Qwen3.8-27B.
Если заявленные возможности подтвердятся на независимых тестах, Qwen получит редкую комбинацию: огромную агентную модель, мультимодальность и открытые веса.
Блог:
https://qwen.ai/blog?id=qwen3.8
Qwen Studio:
https://chat.qwen.ai/?models=qwen3.8-max
API:
https://qwencloud.com/models/qwen3.8-max
Автономный проект:
https://github.com/qwen-code-dev-bot/oh-my-cli
@ai_machinelearning_big_data
#qwen