287027
Самая актуальная информация из мира ML, Нейронных сетей,DI По всем вопросам- @haarrp @itchannels_telegram - 🔥 best it channels @pythonl - 🐍 @machinee_learning -chat @ArtificialIntelligencedl - AI @datascienceiot - ml 📚 @machinelearning_ru ml
🌟 WASTE: запускаем полную Kimi K3 на MacBook Pro с 64 ГБ памяти
SQLite AI собрала движок на 6000 строк C, который гоняет полновесную K3 без BLAS, CUDA и Python в рантайме.
Kimi K3 после предварительной конвертации из safetensors в формат, который движок умеет читать, занимает 982 ГиБ (диск бы назвал это 1,05 ТБ). В оперативную память она не влезает даже приблизительно.
WASTE держит в RAM только резидентную часть на 27,28 ГБ, а экспертов подтягивает с SSD ровно тогда, когда они понадобились. Скорость генерации выходит 0,49-0,54 токена в секунду. Веса при этом полные, без дистилляции и обрезки слоёв.
🟡Расчёт строится на устройстве MoE
На каждый токен K3 включает около 4% собственных весов - 16 экспертов в каждом из 92 слоёв. Простаивающему весу незачем сидеть в памяти, ему достаточно успеть подгрузиться вовремя.
Контейнер с моделью устроен так, что один эксперт стоит ровно одного чтения с диска - матрицы gate, up и down лежат вплотную, а сами эксперты хранятся в остаточном векторном квантовании (3 ступени кодбуков по 256 записей, 3 бита на вес), и матрица никогда не разворачивается целиком.
🟡Скорость диска
На один токен движок вычитывает 17 ГБ. Внутренний NVMe в MacBook выдаёт 12,78 ГБ/с, и модель успевает читать.
Внешний бокс по USB даёт 0,94 ГБ/с, и тот же токен считается 13 секунд. Вариант для очень терпеливых.
🟡Работа с памятью
Раздувать кэш экспертов выше 46 ГБ бесполезно и вредно - на 52 ГБ скорость падает втрое, на 58 ГБ в 8 раз.
Причина в том, что движок остаётся внутри своего бюджета, а система уже нет - macOS вытесняет кэш на диск, и попадание в память оборачивается обращением к подкачке. Поэтому по умолчанию WASTE не забирает все доступные ресурсы, а берёт на один рабочий набор экспертов меньше, чем мог бы.
Для K3 придётся освободить терабайт на диске и потратить около 5 часов на M5 Pro в три процесса, почти сутки - если гонять конвертацию чистым торчем.
✔️ OpenAI заблокировала сеть аккаунтов ChatGPT скам-центров из Камбоджи
Злоумышленники использовали языковую модель для автоматизации инвестиционного и дэйтинг-скама, а также имитации работы правоохранительных органов.
ChatGPT создавал для них виртуальные личности, переводил переписки с жертвами в реальном времени и генерировал поддельные паспорта и юридические документы.
DeepSeek запустила официальный API модели V4-Flash и заметно улучшила её работу в агентных сценариях.
По тестам компании, новая версия значительно опережает V4-Pro-Preview в задачах, связанных с кодом и автономными агентами.
Что изменилось:
- усилены возможности для долгих агентных задач;
- добавлена нативная поддержка Responses API;
- появились параллельные вызовы инструментов;
- доступны уровни рассуждения low, high и max;
- контекст увеличен до 1 млн токенов;
- модель адаптирована для работы с Codex.
V4-Flash можно подключить к Codex CLI, расширению для VS Code и другим совместимым инструментам через единый конфиг.
⚠️ Примечание
🔷 DeepSeek-V4-Flash-0731 сохранила ту же архитектуру и размер модели, что и предварительная версия.
🔷 Сегодняшнее обновление касается только API DeepSeek-V4-Flash. API DeepSeek-V4-Pro, а также модели в приложении и веб-версии пока остаются без изменений.
Официальный релиз DeepSeek-V4-Pro состоится в ближайшее время.
Документация:
https://api-docs.deepseek.com/quick_start/agent_integrations/codex
📌 Нейрослоп добрался до крупного бизнеса
Сервис проверки текстов GPTZero обнаружил выдуманные ссылки и ложные факты в 4-х отчетах ближневосточного подразделения PwC за 2024–2026 годы.
GPTZero - один из самых быстрорастущих стартапов в сфере ИИ, создавший лидирующий в индустрии детектор ИИ-текста. Платформа обслуживает более 10 миллионов пользователей, включая преподавателей, авторов и специалистов по кибербезопасности.
Костяк команды состоит из специалистов, пришедших из ведущих технологических компаний и лабораторий: Perplexity AI, Apple, Microsoft AI, Uber, Caltech и Стэнфордского университета.
Представители PwC заявили, что серьезно относятся к точности данных и уже обновляют источники, но причину появления галлюцинаций в официальных документах не объяснили.
⚡️ Агент OpenAI использовал инфраструктуру Modal Labs как плацдарм для взлома Hugging Face.
Инцидент с агентом OpenAI оказался куда масштабнее, чем предполагалось изначально.
Выяснилось, что перед резонансной атакой на Hugging Face экспериментальная нейросеть проникла в изолированную тестовую среду одного из клиентов облачного провайдера Modal Labs.
По словам техдира компании Акшата Бубны, пользователь оставил открытым эндпоинт, что позволило агенту выполнить произвольный код и превратить уязвимую песочницу в отправную точку для дальнейшего распространения.
При этом базовые механизмы безопасности и изоляции самой платформы Modal не пострадали. OpenAI отказалась комментировать новые подробности инцидента.
@ai_machinelearning_big_data
#news #ai #ml
📌Mythos нашла математические слабости в криптографических алгоритмах
Anthropic опубликовала отчёт подразделения Frontier Red Team. По его данным, Mythos улучшила атаку на постквантовую схему цифровой подписи HAWK и нашла новый способ атаковать упрощённую версию шифра AES.
HAWK - кандидат в новый стандарт. В 2022 году американский институт стандартов NIST объявил конкурс на подписи, устойчивые к будущим квантовым компьютерам - HAWK дошёл до третьего раунда, и специалисты разбирали его 2 года.
Каждая из двух работ обошлась примерно в 100 тысяч долларов оплаты API.
🦾 Как развернуть модель машинного обучения через Docker
Практика и ваши вопросы в прямом эфире
Открытый урок курса «Машинное обучение. Экспертный уровень»
6 августа, 18:00
Для разработчиков, инженеров по данным, инженеров машинного обучения и MLOps, которые хотят полный цикл развертывания модели машинного обучения: от исследовательского кода до работающего контейнера с оркестрацией.
На вебинаре мы пошагово разберём:
- запуск и управление контейнерами, работа с их состоянием;
- написание Dockerfile для модели с учётом зависимостей;
- сборка образа и тестирование модели внутри контейнера;
- построение многокомпонентной системы через docker-compose.
Каждый шаг объясняется и демонстрируется в реальном времени. Вы увидите не только команды, но и логику принятия решений — как правильно структурировать контейнер, какие настройки важны для промышленного использования.
➡ Участвовать бесплатно https://tglink.io/a63131474758ce?erid=2W5zFJxYZCV
Реклама. ООО "ОТУС ОНЛАЙН-ОБРАЗОВАНИЕ". ИНН 9705100963.
✔️ Microsoft выпустила 2 новых модели семейства MAI
AI-подразделение корпорации представило модели MAI-Image-2.5-Pro для генерации изображений и MAI-Voice-2-Flash для синтеза речи.
Обе доступны в Azure AI Foundry, попробовать - в песочнице MAI Playground.
Image-2.5-Pro называют самой качественной из своих графических моделей для задач, где нужна детализация и точная отрисовка текста внутри картинки.
Цены: 5 долларов за миллион входных текстовых токенов, 8 долларов за миллион входных токенов изображений и 106 долларов за миллион выходных.
🌟 SenseNova-Vision: CV-комбайн в едином генеративном интерфейсе
SenseTime открыла веса единой модели зрения SenseNova-Vision. Обычно под каждую задачу (найти объекты, выделить их контуры, оценить глубину сцены) строят отдельную систему или встраивают в модель специальный модуль. Здесь от этого отказались - все задачи модель решает как генерацию текста, картинки или их смеси.
Компания основана в 2014 году и выросла из университетской лаборатории MMLab - оттуда вышла заметная часть китайских специалистов по компьютерному зрению. Известность пришла в 2015-м, когда алгоритм распознавания лиц SenseTime обошёл по точности человеческий глаз. В 2026 году Gartner назвала компанию визионером в генеративном CV.
Авторы сравнивают подход с тем, что GPT сделал для текста: вместо зоопарка специализированных систем - один генеративный интерфейс.
Слабые места тоже есть. В многовидовой 3D-геометрии модель отстаёт от специализированных VGGT и Depth Anything 3, а текст на русском распознаёт заметно хуже, чем на английском.
Kimi K3 за 27 минут нашла RCE в Redis и собрала рабочий эксплойт 😨
Рой из 32 ИИ-агентов обнаружил уязвимость, которая после авторизации позволяла выполнять произвольный код на сервере.
Через несколько часов система якобы нашла ещё и цепочку атаки на Telegram Desktop и iOS без действий пользователя: через повреждённый видеофайл с автозагрузкой. До полноценного RCE оставался один шаг.
Если результаты подтвердятся, поиск критических уязвимостей ускорился до пугающего уровня.
github.com/berabuddies/redis-poc
@data_analysis_ml
✔️ Google хочет «вшить» архитектуру Gemini прямо в кремний
По данным The Information, Google разрабатывает серверный ИИ-чип под неофициальным названием Frozen v2. Часть архитектуры Gemini планируют реализовать непосредственно на аппаратном уровне.
Ожидаемый результат:
- в 6–10 раз выше энергоэффективность по сравнению с последними TPU
- больше обработанных токенов при том же энергопотреблении
- снижение дефицита вычислительных мощностей Google
- возможное развёртывание уже с 2028 года
Цена такой эффективности — потеря гибкости. Если ключевые элементы модели зафиксированы в кремнии, будущие версии Gemini должны сохранять совместимую архитектуру. Крупное изменение модели может потребовать разработки нового чипа.
TPU уже снизили зависимость Google от Nvidia. Frozen v2 способен связать модели и инфраструктуру ещё теснее: Gemini будет проектироваться под конкретный кремний, а кремний — под Gemini.
Проект пока находится на ранней стадии и официально не представлен.
#google #gemini #ai #hardware #tpu
https://www.theinformation.com/articles/google-plans-new-frozen-chip-run-ai-models-efficiently
Команда GigaChat зовёт на вечеринку для AI-разработчиков и исследователей 🎉
29 июля, Сбер.Среда, пространство «Оригинал» (м. «Курская», ул. Земляной Вал, 9А)
Без докладов, презентаций и официальных дискуссий – только общение с коллегами по индустрии, обсуждение рабочих задач и болей, новые знакомства и летний вечер на веранде.
Регистрация и подробности
Надеемся на хорошую погоду 🥳
До встречи!
MWS Cloud первой в России развернула GLM 5.2 в собственном облаке
MWS Cloud расширила каталог сервиса MWS GPT Model Hub до 17 больших языковых моделей. Главным обновлением стала GLM 5.2 — опенсорс-модель от Z.AI, которую компания первой в России развернула на собственной облачной инфраструктуре. Модель ориентирована на сценарии, где важны качество рассуждений, глубокий анализ текстов и обработка многошаговых запросов.
Теперь все запросы к GLM 5.2 обрабатываются на серверах MWS Cloud внутри страны. Это означает, что данные и вычисления не покидают юрисдикцию РФ и не зависят от зарубежных провайдеров.
Помимо GLM 5.2, в каталоге появились Kimi K2.6 от Moonshot AI. Модель подходит для обработки сложных пользовательских запросов, анализа документов, генерации развёрнутых ответов и построения AI-ассистентов.
Кроме того, в MWS GPT Model Hub появились Qwen3.6, Gemma 4, GPT OSS и другие модели. Сервис получил поддержку распознавания и синтеза речи, а также реранкеров, которые улучшают качество поиска и RAG-сценариев.
Все 17 моделей доступны через единый OpenAI-совместимый API, что позволяет разработчикам быстрее тестировать и внедрять AI-функции в свои продукты без развёртывания собственной инфраструктуры.
@ai_machinelearning_big_data
#news
✔️ OpenAI создала модель для поиска уязвимостей в своих LLM
Внутренняя разработка под названием GPT-Red автоматизирует редтиминг собственной продукции компании. Инструмент симулирует промпт-инъекции и скрытые атаки через письма, файлы и веб-страницы.
Система обучалась с помощью RL и self-play - непрерывное соревнование атакующей и защитной моделей довело успешность поиска уязвимостей до 84% в тестовых сценариях (против 13% у людей-специалистов).
По словам OpenAI, благодаря GPT-Red уязвимость GPT-5.6 Sol к прямым промпт-инъекциям снизилась в 6 раз по сравнению с моделями четырехмесячной давности, но около 3,8% сложных атак по-прежнему достигают цели (сопоставимо с показателями Claude Opus 4.5).
Инструмент остается внутренним, OpenAI планирует выпустить статью с описанием архитектуры и процесса обучения в ближайшее время.
openai.com
✔️ SpaceXAI открыла исходный код Grok Build
В репозиторий вошли цикл управления агентом, механизмы сборки контекста, парсинг ответов модели, консольный интерфейс с просмотром diff-изменений и инструменты выполнения команд.
Код демонстрирует механизмы интеграции фреймворка с серверами MCP, субагентами и кастомными плагинами.
Grok Build поддерживает локальное развертывание и позволяет перенаправить запросы на любые локальные LLM, полностью исключив передачу данных на сторонние серверы.
x.ai
✔️ Apple Intelligence официально выходит на китайский рынок
Сервис будет работать в Китае на базе локальных ИИ-моделей после получения официального одобрения от профильного ведомства КНР. Из-за жестких региональных требований к регистрации генеративных сервисов компания отказалась от адаптации собственных алгоритмов.
Базовой LLM для китайских версий iOS и macOS выбрана Qwen от Alibaba. Модель будет отвечать за анализ контекста, генерацию текста и изображений. Параллельно Apple сотрудничает с Baidu для разработки дополнительных функций под региональный рынок.
На ранних этапах компания также рассматривала решения от DeepSeek и ByteDance, но выбрала Alibaba и Baidu.
reuters.com
✔️ Spotify запустил бету диалогового ИИ-ассистента
Музыкальный сервис добавил ассистента на основе ИИ в управление воспроизведением через текстовые и голосовые команды. Функция запущена в режиме беты для Premium-пользователей старше 18 лет в США, Ирландии и Швеции.
Модель обрабатывает контекстные запросы, а в интерфейсе плеера можно запрашивать информацию об артистах, песнях и подкастах, узнавать историю собственных прослушиваний и задавать вопросы на общую эрудицию.
Запуск ассистента дополняет предыдущие ИИ-функции платформы - генерацию плейлистов по промптам и интеграцию технологий ElevenLabs для озвучки аудиокниг.
spotify.com
✔️ На Meta* подали в суд за использование алгоритмов при сокращении персонала
Бывшие сотрудники подали иск в федеральный суд Калифорнии, обвинив компанию в использовании ИИ в ходе майского сокращения 8000 человек.
По версии истцов, внутренние системы генерировали списки на увольнение с системной предвзятостью. Под сокращение непропорционально часто попадали сотрудники с инвалидностью, а также находящиеся в медицинском или декретном отпуске. В иске указано, что алгоритм формировал списки на основе оценок эффективности, объемов выполненной работы и метрик использования корпоративных ИИ-инструментов.
Meta отвергает обвинения и настаивает, что финальные кадровые решения принимают люди. Сейчас истцы добиваются судебного запрета, чтобы сохранить рабочие места до окончания разбирательства.
wsj.com
*организация признана экстремистской, её деятельность на территории РФ запрещена.
✔️ ChatGPT получил полноценный внутренний поиск
Долгожданная функция поиска по истории чатов, проектам и загруженным документам доступна в боковой панели веб-интерфейса и в мобильных приложениях для iOS и Android.
Поиск поддерживает фильтры по типам контента, а клик по результату в выдаче перенаправляет пользователя на конкретное сообщение в диалоге.
Обновление разворачивается глобально. Новая возможность доступна всем пользователям ChatGPT, включая бесплатную версию.
openai.com
✔️ Anthropic открыла учителям в США бесплатный доступ к своим продуктам
Компания анонсировала бесплатную платформу Claude for Teachers для преподавателей школ США. В неё вошли модели, среда Claude Code и Cowork, где ИИ сам выполняет цепочки задач. Например, учитель один раз настраивает агента, и тот каждое утро проверяет тесты или собирает сводку по успеваемости класса.
Платформа поддерживает интеграцию с сервисами Canva Education и MagicSchool, позволяя встраивать Claude в уже готовые рабочие процессы. Anthropic обещает, что данные учителей и учеников не пойдут на обучение будущих моделей.
Заодно на GitHub выложили набор навыков для агентов и запустили курс по ИИ, не привязанный к продуктам какой-то одной компании. Программа продолжает вузовскую Claude for Education. Регистрация открыта до июня 2027 года.
anthropic.com
✔️ Google добавила генерацию изображений в AI Overview
К 25-летию сервиса Google Images компания добавила генерацию картинок по текстовому запросу в поисковые сводки. За функцию отвечает генератор на базе Nano Banana.
Домашняя страница поиска по картинкам получила редизайн с механикой в стиле Pinterest. Интерфейс переведен на динамическую галерею с адаптивной алгоритмической лентой и возможностью сохранять изображения в тематические коллекции.
Развертывание генеративных функций в AI Overviews займет несколько недель. На старте опция доступна только на английском языке в регионах, где уже поддерживается создание изображений.
blog.google
✔️ Nvidia вдвое сократила список покупателей ИИ-чипов в Азии
Чипмэйкер ужесточил процесс одобрения для азиатских контрагентов из списка авторизованных покупателей, чтобы перекрыть серый экспорт оборудования в Китай.
После аудита число одобренных компаний в Сингапуре, Малайзии и Японии уменьшилось более чем на 50%. В новый "белый список" не попали многие новые облачные провайдеры-арендодатели GPU.
Компания перешла от проверки документов к физическим инспекциям дата-центров. Теперь Nvidia анализирует контракты и запрашивает информацию напрямую у конечных пользователей ускорителей.
ft.com
✔️ Учёные предупреждают о приближении второй промышленной революции
Стэнфордская лаборатория цифровой экономики опубликовала открытое письмо "We Must Act Now" о макроэкономических последствиях внедрения ИИ. Документ подписали более 200 ученых, 16 нобелевских лауреатов и представители Google, Anthropic и OpenAI.
Авторы прогнозируют, что в ближайшие 10 лет развитие ИИ спровоцирует трансформацию экономики, сопоставимую с исторической индустриализацией. Письмо призывает формировать новые институты для компенсации потери рабочих мест.
Лидеры ИИ-компаний указывают на нехватку метрик для измерения влияния ИИ на экономику - из-за этого конкретный план действий отсутствует.
Демис Хассабис, не подписавший письмо, прогнозирует появление AGI в перспективе 5 лет и сравнивает эффект с "десятикратной индустриализацией на десятикратной скорости".
stanford.edu
@ai_machinelearning_big_data
#news #ai #ml
✔️ Apple будет монетизировать Apple Intelligence
Компания планирует продавать расширенные квоты на запросы к Apple Intelligence и обновленной Siri через подписку iCloud+. По словам Тима Кука, пользователи смогут доплачивать за снятие базовых дневных ограничений.
Текущие тарифы iCloud+ уже предлагают слегка увеличенные ИИ-лимиты. Для интенсивной работы с ИИ-функциями Apple добавит в линейку сервиса новые, более дорогие уровни подписки.
Релиз обновленной Siri ожидается осенью в составе очередного обновления iOS.
theverge.com
✔️ Google автоматизировала создание исследований без галлюцинаций в источниках
Science One - экспериментальный фреймворк для автоматической генерации научных статей. Инструмент использует архитектуру Chain-of-Evidence, которая минимизирует галлюцинации.
Алгоритм привязывает каждое утверждение в тексте к конкретному рабочему артефакту или результату выполнения кода. Для работы с литературой система игнорирует внутреннюю память языковой модели и обращается к научным API, выстраивая графы цитирования в реальном времени.
Оценку качества сгенерированных текстов проводит автоматизированный ревьюер CoE Audit. Он проверяет подлинность источников, работоспособность кода и воспроизводимость метрик.
В тестах 5 систем на базе Gemini 3.1 Pro написали 75 статей по 5 задачам. Все 337 цитат Science One оказались подлинными. Кроме того, 12 экспериментов выдали корректные результаты, а в 14 из 15 проверенных работ написанный код полностью совпал с заявленной методологией.
research.google
✔️ MiniMax релизнул видеомодель
H3 - модель генерации видео с поддержкой мультимодального ввода, которая генерирует ролики длиной до 15 секунд в разрешении 2K со стереозвуком по составным промптам.
Модель одновременно обрабатывает текст, изображения, видео и аудио и умеет комбинировать референсы в одном запросе - извлечь движение камеры из загруженного ролика, внешность персонажа из фото, а звук - из аудиофайла. В один промпт можно передать до 12 референсов.
Генерация через API стоит 13 центов за секунду видео в 2К и 9 центов за 768P. Открытый релиз на ModelScope запланирован на 3 августа.
minimax.io
✔️ ByteDance выпустила Seedance 2.5
Новинка генерирует видео длиной до 30 секунд за один проход, что вдвое больше лимита предыдущей версии. Фрагменты можно объединять в ролики длительностью до нескольких минут.
Модель поддерживает расширенный мультимодальный промптинг - в один запрос можно передать до 30 изображений, 10 видеоклипов и 10 аудиодорожек. Для точного контроля визуального ряда и темпа генерации используются таймкоды.
В Китае Seedance 2.5 появилась на платформах Jiemeng AI и Doubao Professional, на глобальном рынке она доступна через сервис Dreamina экосистемы CapCut.
bytedance.com
✔️ ElevenLabs добавила автоматическую озвучку по ролям
Новая функция Character Casting парсит загруженный текст, извлекает персонажей и назначает им роли из библиотеки на 10 тысяч синтетических дикторов. При замене диктора алгоритм обновляет реплики для выбранного персонажа по всему документу.
Инструмент умеет определять нестандартные имена и выдуманные термины. Достаточно задать произношение один раз, после чего правило применяется ко всему тексту. Готовый проект можно дополнить звуковыми эффектами, экспортировать (заявлена поддержка более 70 языков) или опубликовать в ElevenReader.
По оценкам ElevenLabs, Character Casting снижает стоимость производства аудиокниги с $5000 до $200, а время создания - с трех месяцев до нескольких часов. Новая функция доступна в разделе Audiobooks.
elevenlabs.io
@ai_machinelearning_big_data
#news #ai #ml
⚡️ Модели Anthropic случайно взломали 3 реальные компании во время тестов
Инцидент произошел во время ИБ-учений формата CTF из-за сбоя в настройках на стороне компании-партнера Irregular, отвечавшей за проведение тестирования.
Вместо закрытой изолированной среды, модели получили прямой доступ к публичному интернету.
Оказавшись во внешней сети, Opus 4.7, Mythos 5 и одна внутренняя исследовательская сборка применили базовые хакерские техники, успешно проэксплуатировав слабые пароли и неаутентифицированные эндпоинты реальных компаний.
Anthropic выявила эти случаи лишь после масштабного аудита 141 тысячи тестовых сессий.
Проверку инициировали на фоне недавнего скандала с OpenAI, который при схожих обстоятельствах проник в инфраструктуру Hugging Face.
После обнаружения утечки Anthropic экстренно остановила все кибериспытания и связалась с пострадавшими организациями, две из которых не зафиксировали у себя факт взлома.
@ai_machinelearning_big_data
#news #ai #ml
✔️ ЕС выделит 10 млрд евро на создание семи ИИ-фабрик
Еврокомиссия открыла тендер на строительство ИИ-кластеров с ожидаемым общим бюджетом 30 млрд евро. Из них 10 млрд евро напрямую предоставят фонды ЕС и бюджеты стран-участниц. Финансирование получат 7 дата-центров - в документах они фигурируют как "суперфабрики".
Прием заявок продлится до 12 ноября, победителей объявят в июле 2027 года. По условиям тендера, подрядчики обязаны полностью ввести объекты в эксплуатацию в течение 18 месяцев после подписания контрактов.
wsj.com
✔️ OpenAI запустила программу доступа к флагманским моделям для учёных
Программа ChatGPT for Academic Researchers предполагает, что до 2027 года компания предоставит 100 тысячам учёных доступ к своим топовым моделям. Первые 10 тысяч исследователей получат приглашения этим летом.
Участникам откроют доступ к GPT-5.6 Sol Pro, ChatGPT Work и Codex с расширенным контекстом, увеличенными лимитами и дополнительными кредитами для функции Deep Research. Платформа включает более 75 научных навыков и интегрирована с базами статей, геномными датасетами и вычислительными блокнотами.
Участие отрыто только для профильным специалистам из одобренных OpenAI университетов. Кандидаты обязаны подтвердить академический статус и наличие научных проектов. Одобренный участник может добавить в рабочее пространство до четырех коллег из своего института.
openai.com
✔️ Thinking Machines Lab представила модель Inkling-Small
Стартап Миры Мурати опубликовал веса мультимодальной MoE-модели Inkling-Small на 276 млрд общих и 12 млрд активных параметров. Модель обрабатывает текст, аудио и изображения в окне контекста до 1 млн токенов.
Благодаря дистилляции от флагманской Inkling и обучению с подкреплением, младшая версия превзошла оригинал в кодинге и логическом вывода. Она выбила 80% в бенчмарке SWE-bench Verified и 31,6% в Humanity’s Last Exam.
Веса - на Hugging Face, инференс и файн-тюнинг доступны через платформу Tinker. С учетом стартовой скидки стоимость API составляет от $0,58 для контекста 64K до $1,16 для 256K токенов.
thinkingmachines.ai
✔️ Google выпустила модель Embodied Reasoning 2
ER 2 обрабатывает непрерывные мультимодальные видеопотоки и работает как высокоуровневый планировщик. Архитектура разделяет логику и моторику - пока модель рассчитывает следующий шаг, физические действия выполняют VLA-модели.
Модель анализирует видеокадры в реальном времени, оценивает статус текущего этапа и корректирует алгоритм на лету без перезапуска процесса. ER 2 также поддерживает мультиагентную работу - устройства разного типа могут обмениваться семантическим контекстом для совместного выполнения многошаговых задач в общем физическом пространстве.
Модель доступна через Gemini API и на платформе Google AI Studio. В помощь начинающим опубликованы примеры того, как настроить модель и заставить её выполнять задачи в области физического ИИ.
blog.google
✔️ Liquid AI выложила веса двунаправленных энкодеров под CPU
Стартап опубликовал веса двунаправленных энкодеров LFM2.5-Encoder на 230M и 350M параметров. Модели базируются на архитектуре LFM2, оптимизированы для запуска на CPU и поддерживают контекст до 8К токенов. Основные сценарии применения - классификация, маршрутизация и токен-уровневые операции.
По итогам 17 тестов, старшая версия на 350M заняла четвертое место из 14. По словам Liquid AI, при полной загрузке окна в 8192 токена модель 230M выполняет forward pass на CPU за 28 секунд - в 3,7 раза быстрее ModernBERT-base.
Код и веса - на GitHub и Hugging Face.
liquid.ai
@ai_machinelearning_big_data
#news #ai #ml
Что произошло в мировом ML за последние полгода? Если не успеваете следить за ICML и другими крупными конференциями, 13 августа Яндекс проведёт ML Global Recap H1 2026 — встречу, где эксперты разберут ключевые работы, тренды и идеи, которые уже начинают влиять на индустрию.
В программе — четыре доклада от руководителей команд Яндекса. О развитии Tabular DL расскажет Артём Бабенко из Yandex Research, о трендах и вызовах в reasoning — Дмитрий Мокеев из Alice AI, о новых подходах к оценке качества моделей — Иван Дёгтев из Яндекс R&D —, а об оптимизации LLM-инференса — Андрей Бежин из Яндекс R&D.
А еще участников ждут нетворк и обмен впечатлениями с теми, кто побывал на конференциях лично.
📍 Москва + онлайн
🗓 13 августа
🔗Регистрация — на сайте конференции
Реклама ООО «Яндекс», ИНН 7736207543, erid: CQH36pWzJqMVErd51Wmdi672nSWCXUoVD3hQqe7LcXVEpC
🔥 ChatGPT приближается к 1 млрд пользователей в неделю, но давление на OpenAI растёт
По данным The Information:
• цель достигнута на семь месяцев позже плана
• у ChatGPT уже более 50 млн платных пользователей
• enterprise приносит свыше 40% выручки
• прогноз выручки на год - около $25 млрд
• ожидаемый cash burn - примерно те же $25 млрд
• Anthropic могла обогнать OpenAI по выручке благодаря корпоративным клиентам
Миллиард пользователей - исторический масштаб.
https://www.theinformation.com/articles/openais-chatgpt-nears-1-billion-weekly-active-users-seven-months-target
📌 Теренс Тао: в математике кризис из-за ИИ
На Международном конгрессе математиков в Филадельфии Теренс Тао (медаль Филдса 2006 года) прочитал лекцию "Математика в эпоху ИИ".
Его тезис: сообщество входит в период, сопоставимый с кризисом оснований 1900-1930 годов, когда парадокс Рассела и теоремы Гёделя заставили математиков пересмотреть базовые допущения.
Возможна ситуация, допускает Тао, когда формально верное доказательство важного результата не сможет объяснить ни один человек.
Медали Филдса, самую престижную награду в математике, в этом году получили Дэн Юй, Джон Пардон, Джейкоб Цимерман и Ван Хун - за результаты, полученные без участия ИИ.
🫶 Программируй и решай задачи эффективнее - nordrouter.com
Это единый API-хаб ИИ-моделей по доступным ценам, наши преимущества:
1. 67+ ИИ моделей (в том числе передовые Opus 5 и GPT 5.6 Sol)
2. 100+ Медиа-моделей (Seedream, GPT Image, Nano Banana, etc)
3. Автоматический кэш, который экономит до ~80% расходов
Модели легко интегрируются в любой редактор кода и программы:
OpenCode, Cline, Claude Code, Codex, Zed
Чаты и ролеплей:
SillyTavern, Janitor AI, RikkaHub
API и автоматизация:
n8n, Make и другие
Не вериться? Ознакомьтесь с отзывами на наш сервис на сторонних площадках (указаны на сайте)
nordrouter.com
⚡️ MoonshotAI откроет веса Kimi K3 27 июля
Китайский стартап запустил обратный отсчет до публикации весов своей флагманской модели Kimi K3/
На официальном аккаунте в Hugging Face появилась страница проекта - релиз запланирован на 27 июля, а пока можно оформить подписку на уведомления.
@ai_machinelearning_big_data
#news #ai #ml
🛡 Как проектировать ИИ-агентов, которым можно доверять – до конца регистрации осталось совсем немного времени
ИИ-агенты уже пишут код, работают с данными и подключаются к внешним сервисам. Чем больше задач им делегируют, тем интереснее вопрос — как устроены такие системы и что стоит за словом «надёжный» применительно к агенту.
ШАД с 27 по 31 июля проводит AI Agents Security Week – интенсив с экспертами Яндекса о том, как как защищать агентные системы: доступы, данные, инфраструктура.
Разберут:
• чем автономные агенты отличаются от обычных LLM – и почему для них нужна отдельная модель угроз
• как безопасно выдавать агентам доступ к инструментам и инфраструктуре
• как защищать персональные и корпоративные данные при работе агента с инструментами
• реальные инциденты – взломы, утечки, ошибки конфигурации в разных ИИ-моделях
Подойдёт ML-разработчикам, DevOps/DevSecOps-инженерам, техлидам, архитекторам, студентам старших курсов.
5 вечерних занятий, отборочное тестирование и итоговая работа – для тех, кто хочет сертификат.
Регистрация закрывается 27 июля, и это последние дни, чтобы успеть подать заявку, не пропустите!
✔️ Alibaba откроет код альтернативы CUDA
Полупроводниковое подразделение Alibaba (T-Head) анонсировало открытие исходного кода стека SAIL для фирменных ИИ-ускорителей Zhenwu. Проект анонсировали на Всемирной конференции по ИИ в качестве открытой альтернативы экосистеме Nvidia CUDA.
По заявлению T-Head, адаптация SAIL под популярные ML-фреймворки занимает менее 7 дней. Флагманом линейки выступает процессор Zhenwu M890, представленный в мае и спроектированный для работы с ИИ-агентами.
Alibaba ранее сообщала об отгрузке более 560 тысяч таких чипов сотням корпоративных клиентов.
scmp.com
✔️ Moonshot приостановил оформление подписок на Kimi K3
Стартап временно остановил продажу подписок на модель Kimi K3 из-за нехватки вычислительных мощностей. Действующие пользователи работают без ограничений, доступ новым клиентам откроют по мере масштабирования инфраструктуры.
Для балансировки нагрузки на кластеры компания меняет систему монетизации и делит единую подписку на 2 тарифа.
В план Kimi Membership входят веб-версия, мобильное приложение и стандартные сценарии использования. Для инженеров вводится Kimi Code Membership - ресурсы этого тарифа выделены только под генерацию и анализ кода. Такое разделение потоков должно стабилизировать работу сервиса.
Kimi в сети Х
✔️ ИИ-вендоры всерьез присматриваются к чипам AMD
Microsoft расширит использование ускорителей AMD в инфраструктуре Azure. Во второй половине 2026 года компания запустит вычислительную платформу AMD Helios, оптимизированную для крупных моделей. Сатья Наделла объяснил расширение партнерства ценовой политикой Nvidia и конкуренцией со стороны TPU.
Параллельно аппаратное обеспечение AMD тестирует Anthropic. По данным SemiAnalysis, AMD присвоила разработчику Claude высший приоритет поддержки наравне с Amazon. Ожидается, что компании официально анонсируют партнерство на конференции Advancing AI после решения проблем с оптимизацией программного стека.
microsoft.com
✔️ ИИ спроектировал компоновку невидимого в полете одномоторного дрона
Корпус аппарата Phantom Twist в полете вращается со скоростью до 25 оборотов в секунду, делая его почти невидимым за счет эффекта размытия. А процессе создания дрона ИИ сгенерировал 20 тысяч вариантов дизайна и симулировала их работу на фоне реальных пейзажей.
Пропеллер и рама Phantom Twist крутятся в противоположных направлениях - в конструкции нет статичных деталей. Аппарат в 10 раз сложнее заметить, чем классический квадрокоптер.
Авторы позиционируют устройство как инструмент для мониторинга дикой природы и осмотра инфраструктуры.
northwestern.edu
✔️ Нил Бломкамп выпустил короткометражку, полностью сгенерированную в ИИ
Известный по "Району №9" режиссер представил 13-минутный научно-фантастический хоррор Nightborne, полностью созданный с помощью видеомодели Seedance 2.0. Сюжет стилизован под документальное кино о военной программе, возвращающей в строй погибших солдат.
Бломкамп управлял процессом покадрово, выстраивая сцены через промпты на основе концепт-артов, подготовленных художниками. Для генерации лиц и озвучки студия лицензировала биометрию 32 человек, чтобы избежать проблем с авторскими правами.
Режиссёр заявил о планах снять полнометражный ИИ-фильм. Для реализации этих амбиций он уже открыл новую компанию, ориентированную на нейросетевой продакшен, которая придет на смену его классической студии Oats Studios.
Neill Blomkamp в сети Х
@ai_machinelearning_big_data
#news #ai #ml
✔️ В Roblox можно будет собрать игру по текстовому описанию
Игровая платформа анонсировала функцию Build, которая превращает простой запрос в готовую базу игры.
Под капотом целый набор ИИ-моделей, открытых и собственных - они отвечают за игровые механики, окружение, персонажей, визуальный стиль и звук.
В геймдеве опасаются, что когда порог входа падает до текстового запроса, платформу зальёт поток AI-слопа, а авторам придётся конкурировать с ИИ-контентом, который штампуется в разы быстрее ручной работы.
Общее настроение индустрии при этом тревожное - по свежему опросу конференции GDC, 52% профессионалов игровой отрасли считают, что генеративный ИИ вредит геймдеву.
📌 Физики создали память на механических колебаниях для квантового компьютера
Группа из Швейцарской высшей технической школы Цюриха экспериментально продемонстрировала квантовые вычисления, в которых рабочая память построена на механических колебаниях, а не на электромагнитных состояниях.
Архитектура скопирована с классического компьютера, где процессор и оперативная память разделены.
Роль процессора играет сверхпроводящий кубит, а роль памяти - крошечные механические резонаторы внутри квантового чипа, элементы, отдалённо похоже на гитарные струны, которые при записи информации начинают колебаться на частотах за пределами слышимого.
Для вычисления кубит обращается к колебанию в памяти, обрабатывает и изменяет его состояние, а затем записывает обратно. Такое разделение вычислений и хранения отличает подход от многих существующих квантовых схем, где обработка и память тесно переплетены.
🟡Ставка на механику объясняется двумя ограничениями
Сегодня квантовую память чаще всего делают электромагнитной в связке со сверхпроводящими кубитами - обе технологии хорошо изучены и позволяют считывать и менять квантовые состояния с высокой точностью.
Но такие элементы относительно громоздки, что мешает превращать лабораторные установки в практические машины.
Механические резонаторы заметно компактнее, а главное - ёмче (как струна может звучать разными тонами, резонатор поддерживает множество мод колебаний, и каждая мода работает как отдельная ячейка памяти).
Вдобавок, по данным группы, механические состояния дольше остаются стабильными - информация не затухает так быстро, как в электромагнитных аналогах.
🟡Работоспособность проверили на реальных задачах
Первая - квантовое преобразование Фурье, базовая процедура, на которую опираются многие квантовые алгоритмы, включая знаменитый алгоритм Шора для разложения чисел на множители.
Вторая - поиск периода функции, продемонстрировавший применение этой процедуры на практике.
Обе задачи требуют одновременно и точно управлять множеством квантовых состояний, хранить их и связывать между собой, не разрушая их хрупкую природу.
Авторы говорят, что их схема в принципе способна выполнять все базовые операции, необходимые для произвольного квантового вычисления, то есть годится как основа универсального программируемого квантового компьютера.
🔜 Почитать полную статью можно в в журнале Science
@ai_machinelearning_big_data
#news #ai #ml
✔️ Первым устройством OpenAI станет умная колонка
OpenAI готовит к выпуску свой первый гаджет - переносную умную колонку без экрана, задуманную как "домашний компьютер эпохи ИИ".
Об этом сообщает Bloomberg со ссылкой на источники, знакомые с проектом. Устройство ещё в разработке, официально о нём не объявляли, а представитель OpenAI отказался от комментариев.
Оффер на роль Senior Data Science за неделю — реально? 🚀
Коллеги из Авито запускают Fast Track — ускоренный отбор для специалистов Data Science уровня Senior и Senior+. Одна неделя на все технические этапы и финал → оффер в классифайд №1 в мире по количеству пользователей.
✅ Основные этапы — 20–26 июля. Регистрация открыта до 20 июля.
Как проходит:
🔸 До 20 июля — заявка + HR-скрининг
🔸 До 24 июля — техническая секция (ML-теория + Python)
🔸 25 июля — ML System Design
🔸 26 июля — финал
🔸 До 28 июля — оффер
Преимущества фаст-трека:
🔸 Быстрый отбор и совмещённые этапы
🔸 Все даты известны заранее
🔸 Возможность оценить свои скилы — результат закрепляется на год
Кого ждут:
🔸 От 4 лет опыта в крупных российских и международных IT-, BigTech- и FinTech-компаниях
🔸 Полный цикл разработки моделей — от ресёрча до выкатки в прод
🔸 От 1 года самостоятельного лидирования проекта, автономность и инициативность
Команды на выбор: антифрод и модерация, монетизация и реклама, поиск и рекомендации, вертикальные DS-команды.
🤓 Регистрация — до 20 июля. Успей оставить заявку!
✔️ OpenAI временно отменила пятичасовой лимит на использование GPT-5.6 Sol и Codex для платных тарифов
После экстремального всплеска нагрузки на серверы OpenAI решили отключить плавающее пятичасовое окно в подписках Plus, Pro и Business и полностью обнулила текущую статистику потребления для всех аккаунтов.
Одновременно с этим инженеры компании повысили вычислительную эффективность модели GPT-5.6 Sol. Теперь она тратит заметно меньше доступного лимита при выполнении аналогичного объема задач.
Точных технических деталей не раскрывают, но оптимизация, вероятнее всего, связана со снижением расхода токенов.
Благодаря апдейту разработчики смогут дольше работать с объемным кодом, прежде чем столкнутся с еженедельными ограничениями, которые по-прежнему остаются в силе.
@ai_machinelearning_big_data
#news #ai #ml