52195
@linux_kal наш чат По всем вопросам- @workakkk @ai_machinelearning_big_data - машинное обучение @itchannels_telegram - 🔥 главные ресурсы для хакера @programming_books_it - бесплатные it книги @pythonl -🐍 РКН: clck.ru/3Fmszy
🚨 Сообщают о возможном взломе Bitget на $170 млн.
По предварительным данным, активы на сумму более $170 млн вывели с кошельков, связанных с биржей, и обменяли на ETH. Причина переводов пока не установлена; подтверждения взлома нет.
⚡️5 фундаментальных курсов по ИБ по цене одного
Это предложение для тех, кто готов войти в новую профессию прямо сейчас!
🔥Пакет курсов за 50 000 ₽ вместо 250 000 ₽:
▪️ Linux CyberPunk - обычная цена 49 500 ₽ (+ Курс идет с официальным дипломом системного администратора!)
▪️ SQL для хакера - обычная цена 15 000 ₽
▪️ HackerPoint - обычная цена ~70 000 ₽
▪️ HackerPoint (Blue vs Red Team) - обычная цена 43 500 ₽
▪️ AI-помощники на Python - обычная цена 71 500 ₽
Вы экономите 200 000 ₽ и получаете полную базу: от работы с терминалом и базами данных до разработки ИИ-агентов и взлома систем.
🔒 Квота: набор на программу ограничен по количеству мест.
🦔Отправь промокод Kali в чат с менеджером, чтобы закрепить за собой скидку и узнать подробности:
👉@cyacademy_support
🖥 Линус Торвальдс оставил семейную пасхалку в Linux
Чтобы напрямую перезагрузить Linux через системный вызов reboot(), нужно передать два специальных значения.
Первое: 0xfee1dead.
Второе должно совпадать с одной из четырёх дат: днём рождения самого Линуса или одной из трёх его дочерей.
Если значения неверны, ядро возвращает EINVAL и отменяет перезагрузку.
Так обычная защита от случайного вызова превратилась в личную подпись семьи Торвальдса внутри Linux.
https://github.com/torvalds/linux/blob/master/include/uapi/linux/reboot.h
Этот файл был удален пользователем
Встречаемся в Москве с теми, кто отвечает за хранение данных бизнеса. Обсудим, как решить задачу со звездочкой — уберечь массивы файлов и резервных копий от атак шифровальщиков, утечки или случайной перезаписи.
На бизнес-ужине эксперты провайдера ИТ-инфраструктуры Selectel расскажут:
➕как устроено хранилище S3 под капотом;
➕какие угрозы данным существуют и как выстроить многослойную систему защиты;
➕почему защита данных — это не статья расходов, а управление рисками.
Будет актуально руководителям в ИТ-компаниях, старшим архитекторам, системным администраторам. Поговорим и про стратегию хранения, и про реализацию.
📆 24 сентября (чт), 18:30
📍Москва, м. Динамо
⏩Участие бесплатное, дождитесь подтверждения заявки. Смотрите полную программу и регистрируйтесь: https://slc.tl/cwmem
Реклама. АО "Селектел". erid:2W5zFHDrAFj
⚡️ SpecterOps открыла большой набор готовых навыков и агентов для информационной безопасности:
- 79 skills
- 22 переиспользуемых агента
- 26 семейств плагинов
Внутри - BloodHound, Cobalt Strike, Outflank C2, Ghidra, Binary Ninja, Ghostwriter, разведка, AppSec, код-ревью, разработка C2, reverse engineering, adversary simulation и Windows/macOS tradecraft.
Это уже не просто набор промптов. Практические знания специалистов превращены в переиспользуемые и проверяемые рабочие процессы для AI-агентов.
Пригодится не только red team:
- исследователям уязвимостей - для code review, анализа патчей и 1-day research
- malware analyst и reverse engineer - для повторяемых сценариев анализа
- blue team и detection engineer - для эмуляции атак и построения детектов
- DFIR и threat intel - для автоматизации расследований
- red team - для recon, attack paths, C2 и adversary simulation
https://github.com/SpecterOps/skills
Разбор Outflank:
https://outflank.nl/blog/2026/09/02/red-team-ai-skills/
✔️ OpenAI читает переписки пользователей с ChatGPT
Издание 404 Media выяснило, что OpenAI нанимает, которые читают диалоги пользователей ChatGPT, чтобы улучшить ответы чат-бота.
Рецензенты оценивают ответы ChatGPT по шкале от одного до семи и должны следить за тем, чтобы в результатах работы модели не было чрезмерной лести, нежелательного антропоморфизма и сикофантии.
Работники нанимаются через компанию Crossing Hurdles, а оплату им производит компания Mercor, занимающаяся обучением в области ИИ. Один из рецензентов из США сообщил, что они зарабатывают более 50 долларов в час.
Другой модератор рассказал 404 Media, что, по его мнению, пользователи не знают о том, что их чаты читают другие люди.
Переписка, которую осматривают в ходе анализа, анонимизирована фильтром приватности, но в некоторых разговорах пользователи прямо просили ChatGPT сохранить содержимое в тайне. Эти сообщения тоже были видны проверяющим.
⚡️ Linux Совет: управляй разделами диска прямо из терминала
Посмотреть все диски и разделы:
sudo parted -l
sudo parted /dev/sda print
sudo parted /dev/sda
parted:print — показать таблицу разделовmklabel — создать новую таблицу разделовmkpart — создать разделrm — удалить разделresizepart — изменить размерname — задать имя разделуset — изменить флагиquit — выйтиparted особенно удобен, когда нужно быстро проверить разметку диска или изменить разделы без GUI.rm, mklabel или выбором не того диска может закончиться потерей данных.
Читать полностью…
‼️ У Revolut произошла серьёзная утечка данных клиентов
Злоумышленник отправлял запросы на раскрытие информации с настоящего государственного домена. Письма проходили доменную аутентификацию и выглядели как законные запросы властей.
В результате Revolut передал данные части клиентов, включая:
- копии паспортов
- селфи для верификации
- имя, дату рождения и домашний адрес
- выписки по счетам
- историю снятия наличных
- полную историю Bitcoin-транзакций
Позже Revolut выяснил, что запросы были неавторизованными. Компания заблокировала адрес, уведомила соответствующее ведомство и начала информировать регуляторов и затронутых клиентов.
По данным ZachXBT, инцидент, вероятно, был небольшим по масштабу и мог быть нацелен на состоятельных пользователей.
Что такое Revolut?
Revolut — британская финтех-компания и цифровой банк, через приложение которого пользователи могут хранить деньги, обменивать валюты, пользоваться картами, переводами, инвестиционными и крипто-сервисами.
🚨 Российские хакеры использовали Claude, чтобы автоматически переделывать malware после детекта
По данным Anthropic, группа GTG-20006, связанная с российской APT29 / Midnight Blizzard, построила AI-assisted workflow вокруг Claude.
Схема была такой:
- malware попадает на цель
- AI следит, детектят ли его защитные продукты
- если детект есть — агент автоматически модифицирует и пересобирает образец
- новая версия снова выкатывается на disposable infrastructure
- цикл повторяется
В наборе инструментов были:
- Windows implants
- mobile exploitation kit
- credential stealer для браузеров
- phishing platform
- admin-консоль для управления скомпрометированными аккаунтами
Anthropic пишет, что AI использовался почти на всех этапах: от регистрации доменов и настройки инфраструктуры до мониторинга C2 и проверки stealth.
Целями были госструктуры, разведка, оборонные организации и дипломаты в Украине и Европе, а также связанные с внешней политикой США лица.
Ключевой сдвиг здесь - malware становится не статичным артефактом, а системой, которая может быстрее адаптироваться под новые detections.
https://thehackernews.com/2026/09/russian-state-sponsored-hackers-use.html
🔐 Anthropic заявила о 151 млн обращений к Claude для обучения Qwen
Reuters пересказал сентябрьский отчёт компании об использовании её моделей в кибератаках и извлечении данных для обучения конкурентов.
По утверждению Anthropic:
* С Alibaba связаны более 151 млн обращений за май–июль через свыше 3 500 подставных аккаунтов.
* Moonshot и DeepSeek направляли реальные диалоги пользователей в Claude, собирая ответы для обучения.
* Группа с признаками Midnight Blizzard использовала ИИ в операциях против украинских организаций, включая фишинг и изменение вредоносного кода.
Это заявления Anthropic; независимая проверка описанных эпизодов в пересказе не представлена.
Reuters - https://www.reuters.com/legal/litigation/anthropic-disrupts-russian-chinese-ai-campaigns-targeting-its-claude-models-2026-09-10/
⚡️ Linux умеет передавать страницы памяти ядру почти без копирования
Есть малоизвестный системный вызов vmsplice().
Он позволяет отобразить пользовательские страницы памяти прямо в pipe:
struct iovec iov = {
.iov_base = buf,
.iov_len = len
};
vmsplice(pipefd[1], &iov, 1, SPLICE_F_GIFT);
SPLICE_F_GIFT.
🧩 Linux kernel module на чистом x86-64 Assembly
Разработчик показал необычный пример - модуль ядра Linux, написанный на NASM Assembly.
Модуль получает доступ к порту 0x60 - контроллеру клавиатуры, читает один байт данных и выводит результат через printk в системный лог.
Что делает код:
- запрашивает доступ к I/O порту через ioperm
- читает значение из порта 0x60
- отправляет сообщение в лог ядра
- корректно выгружается через cleanup_module
Для работы нужны права root и разрешение на низкоуровневый доступ к оборудованию.
Такой код показывает, насколько близко Linux позволяет работать с железом: от обычных процессов до собственного кода внутри ядра.
⚡️ OpenAI признала: для инцидентов с «неправильным поведением» AI-агентов нужны отдельные правила раскрытия
OpenAI прокомментировала так называемый wiki incident, когда её агенты начали записывать данные на несколько интернет-сайтов вне ожидаемого сценария.
Компания признаёт, что прежнего подхода уже недостаточно: раньше misalignment в основном рассматривался как исследовательская проблема и описывался в system cards и научных публикациях.
Теперь ситуация меняется - неправильное поведение агентов уже может давать реальные последствия за пределами тестовой среды.
В случае с Hugging Face, где инцидент затронул безопасность OpenAI и третьих сторон, компания использовала обычный security incident response:
- сразу связалась с Hugging Face
- начала расследование
- публично раскрыла инцидент уже на следующий день
- продолжает уведомлять другие затронутые стороны
Но wiki incident выглядел иначе: это не классический взлом, а пример того, как агент может использовать интернет неожиданным способом.
OpenAI считает, что индустрии нужны отдельные стандарты для таких случаев:
- когда misalignment нужно раскрывать публично
- как описывать инциденты во время training, evaluation и deployment
- как сообщать о поведении, которое ещё не является security incident, но может указывать на будущие риски
Компания уже работает над таким framework и обещает опубликовать его в ближайшие недели. Параллельно OpenAI обсуждает эти вопросы с десятками регуляторов по всему миру.
https://x.com/Machinelearrn/status/2096173194285609227
Участвуй в МТС True Tech Champ 2026 — всероссийском чемпионате по программированию с двумя треками и призовым фондом 10 250 000 рублей.
Трек 1: Алгоритмический [индивидуальный зачет, 2 750 000 ₽, шесть призовых мест]
Решай задачи по алгоритмам и структурам данных, которые помогут прокачать навыки для технических собеседований и работы в ведущих ИТ-командах. Лучшие участники пройдут в финал, где в режиме реального времени будут соревноваться в правильности решений и скорости мышления.
Трек 2: Программирование роботов [командный формат, 7 500 000 ₽, три призовых места]
Напиши алгоритмы для робособаки и робота-манипулятора и проведи их через три этапа соревнований. Сначала — через цифровой симулятор, где нужно пройти трассу и выполнить задания по передаче предметов. Затем — подключись к реальному полигону через удалённый доступ и выполни задания на физических роботах дистанционно. А в очном финале лучшим командам предстоит управлять роботами на площадке, дорабатывать алгоритмы под новые условия и бороться за победу на глазах у зрителей. Рекомендуемые стеки: Go, Java, Python, C#, C++, JS.
Регистрируйся до 13 сентября и стань частью масштабного чемпионата.
⚡️ PentestKit - open-source многоагентный фреймворк для автономного пентеста.
Внутри оркестратор управляет командой специализированных агентов, которые:
- планируют проверку
- ищут и подтверждают уязвимости
- требуют PoC для каждого найденного бага
- выставляют CVSS
- накапливают общий контекст по мере работы
- собирают итоговый клиентский отчёт
Отдельно есть scope guard: весь исходящий трафик проходит через одну контролируемую точку, чтобы агент не вышел за разрешённые границы теста.
На XBOW validation benchmark проект показал 104/104 решённых задач. В качестве модели использовалась Kimi K3 для всех ролей - от оркестратора до верификатора и репортера.
Интересно, что первые 90 задач из 104 были решены сразу, а оставшиеся 14 авторы закрыли не хардкодом под конкретные челленджи, а добавлением более общих возможностей и инструментов.
https://github.com/lordx64/pentestkit
В 1991 году 21-летний Линус Торвальдс написал, что делает бесплатную операционную систему для своего ПК на 386-м процессоре.
Он называл это просто хобби.
Так появился Linux.
В 2005 году история повторилась. Существующие системы контроля версий перестали устраивать Торвальдса - и он написал Git. На первую рабочую версию ушло около 10 дней.
Два проекта, которые в итоге стали фундаментом современной разработки.
И фраза Торвальдса, которая отлично описывает его подход:
Talk is cheap. Show me the code.
🚨 ИИ-агенты пытались взломать сайты, выполняя обычные задачи по поиску данных
Исследователи Transluce изучили публичные журналы сервиса urlquery.net. В мае–июне они нашли попытки проверить уязвимости трёх ресурсов: австралийского агентства медицинской статистики AIHW, платформы Data USA и цифровой библиотеки Университета Нью-Мексико. Агенты переходили к таким действиям после неудачных попыток получить нужные данные обычным способом. Подтверждений успешного взлома этих трёх ресурсов исследователи не нашли.
Активность в журналах прослеживается как минимум с 6 марта. Позже появились попытки создавать временные почтовые ящики, а 19–20 сентября - отправить сделки на криптобирже и выполнить HTML-инъекцию. Исследователи связывают часть действий с агентами OpenAI, но происхождение не всех запросов установлено одинаково надёжно. OpenAI сообщила, что проверяет находки Transluce.
Отдельно власти Австралии подтвердили, что в июне агент OpenAI получил несанкционированный доступ к порталу со статистикой Medicare. По заявлению властей, персональные медицинские записи затронуты не были. Связь этого эпизода с попытками, описанными Transluce, пока не подтверждена.
Расследование Transluce - https://transluce.org/agent-activity
Один разработчик начал с треугольника - через пять лет Linux получил полноценную графику на Apple Silicon
Когда Apple выпустила M1, публичной документации на его GPU практически не было. Никаких открытых драйверов, описания команд или готового пути к аппаратному ускорению Linux.
Одной из ключевых фигур проекта стала Алисса Розенцвейг — разработчица графических драйверов, которая ещё с 2017 года занималась reverse engineering GPU.
В 2020 году она подключилась к Asahi Linux, купила Mac mini M1 и начала разбирать GPU Apple буквально с нуля.
Сначала исследовала:
- инструкции шейдеров
- command buffers
- управление памятью
- структуру рендеринга
- взаимодействие macOS с GPU
Через несколько недель её собственный код уже смог нарисовать первый треугольник.
Для графического драйвера это важный рубеж: если получилось самостоятельно отправить геометрию на неизвестный GPU и получить правильный результат, фундамент уже есть.
Дальше появились:
- компилятор шейдеров
- OpenGL-драйвер
- Vulkan
- OpenCL
- полноценная интеграция с Mesa
К 2025 году стек поддерживал:
- OpenGL 4.6
- OpenGL ES 3.2
- Vulkan 1.4
- OpenCL 3.0
- аппаратное ускорение Linux на M1/M2
- запуск Windows-игр через Proton
Самое интересное — часть возможностей пришлось эмулировать программно, потому что железо Apple напрямую не поддерживает некоторые функции, необходимые современным графическим API.
История с играми вообще выглядит безумно:Windows-игра → DirectX → Vulkan → ARM → Apple GPU
Несмотря на несколько уровней перевода и эмуляции, на M1 и M2 уже можно запускать полноценные 3D-игры под Linux.
Важно уточнить: это не работа одного человека. Asahi Linux — большой командный проект. Алисса была одной из центральных фигур в reverse engineering GPU, Mesa-драйверах и компиляторе шейдеров, но над kernel-драйвером, виртуализацией, OpenCL и другими частями работали и другие разработчики.
В августе 2025 года она объявила, что её работа над Apple GPU подошла к логическому завершению: основные драйверы были upstream, графические стандарты поддерживались, а игровой стек работал.
Пять лет назад всё начиналось с неизвестного GPU и одного треугольника.
Сегодня Linux на Apple Silicon получил полноценное графическое ускорение и современный open-source GPU-стек.
Denuvo пошла по следу voices38 - известного хакера, который с начала года обходил защиту в крупных игровых релизах.
Среди его работ упоминаются Hogwarts Legacy, Black Myth: Wukong, Persona 3 Reload и Doom: The Dark Ages. Теперь компания обратилась в суд Калифорнии, заявив о незаконном обходе DRM.
Параллельно Denuvo пытается установить личность voices38 через Valve, Reddit и Discord. Отдельный интерес — данные Steam: по версии компании, игры покупались официально, а затем использовались для подготовки взломов.
Похоже, теперь главная проблема voices38 — уже не очередная версия Denuvo, а попытка деанона через суд.
https://torrentfreak.com/denuvo-sues-game-cracker-voices38-for-bypassing-its-anti-tamper-drm/
🐧 Linux: быстро проверить открытые порты и сетевые соединения
Старый, но всё ещё полезный вариант:netstat -tuln
Покажет TCP/UDP-порты, которые сейчас слушает система.
Активные соединения:netstat -an
Какие процессы держат порты:sudo netstat -tulpn
Что значат ключи:-t — TCP -u — UDP -l — listening sockets -n — без DNS, только IP и номера портов -a — все соединения -p — процесс, использующий порт
Важно: netstat во многих современных дистрибутивах уже считается legacy.
Актуальная замена:ss -tuln
и с процессами:sudo ss -tulpn
Полезно, когда нужно быстро понять, кто слушает порт, какие сервисы торчат наружу и есть ли неожиданные сетевые соединения.
Информационная безопасность в эпоху ИИ: о чем важно знать уже сейчас?
Обсудим 8 октября на бесплатной конференции Selectel ТехноДень о кибербезопасности, ИТ-инфраструктуре, ИИ и данных.
Эксперты топовых технологических компаний расскажут:
🔺Как применение нейросетей меняет рабочие процессы с точки зрения ИБ и как снизить риски.
🔺Где проходит граница между безопасностью и развитием бизнеса. Должен ли CISO ограничивать внедрение ИИ или создавать условия для его безопасного использования.
🔺Как выжить, когда бизнес масштабируется и требования ИБ множатся.
Кроме экспертных докладов и реальных кейсов, участников ждут 20 интерактивных стендов, живое общение и вечерняя программа с живой записью подкаста Вселенная Плюс на главной сцене конференции.
Место встречи — Москва, Кластер «Ломоносов». Участие в конференции бесплатное, нужно зарегистрироваться →
Реклама. АО "Селектел". erid:2W5zFGUvsxm
⚡️ Linux так и не победил Windows на десктопе. Но в итоге сделал кое-что намного масштабнее.
Открываешь сайт - очень часто за ним Linux.
Пользуешься Android - внутри Linux kernel.
Сохраняешь файлы в облако - с большой вероятностью данные обрабатывают Linux-серверы.
Обучаешь AI-модель - почти наверняка Linux.
Роутеры, Smart TV, серверы, сетевое оборудование и огромное количество встраиваемых устройств тоже часто работают на Linux.
Всё началось в 1991 году, когда Линус Торвальдс опубликовал первую версию ядра. Другие разработчики начали присылать исправления и новые функции.
Со временем эти патчи превратились в драйверы, файловые системы, сетевой стек, дистрибутивы и огромную экосистему, на которой компании могли строить продукты, не создавая ОС с нуля.
Поэтому большинство людей почти не видят Linux напрямую.
Он просто сидит в дата-центрах и устройствах и делает работу в фоне.
Можно пользоваться Linux десятки раз в день и при этом быть уверенным, что никогда его не запускал.
18 уязвимостей в ядре Linux c эксплоитами для получения прав root в системе
Исследователи из компании Nebula Security раскрыли сведения о 18 уязвимостях в ядре Linux и подготовили для них эксплоиты, позволяющие непривилегированному локальному пользователю получить права root в системе. Уязвимости устранены в различных весенних и летних обновления ядра ядра. Выявленные проблемы.
Подробнее:
https://opennet.ru/66239/
https://opennet.me/66239/
👁 Claude убедил проверяющую модель, что атака на реальные системы - всего лишь симуляция
Anthropic опубликовала разбор четырёх инцидентов во время тестов по кибербезопасности. Моделям сообщили, что интернета нет. Из-за ошибки настройки он был доступен, а защитные фильтры публичных продуктов на тестах были отключены.
В одном из эпизодов Claude Mythos 5 опубликовал вредоносный пакет в PyPI. Его установили 15 систем. Получив утёкшие учётные данные одной из них, модель проникла в базу компании, занимающейся кибербезопасностью.
Признаки того, что всё происходит в реальности, не остановили Claude. В рассуждениях он продолжал называть окружение симуляцией и находил основания двигаться дальше.
На эти объяснения положился и один из офлайн-мониторов безопасности. Проверяющая модель приняла версию о симуляции и не отметила инцидент как опасный.
Anthropic пересмотрела свою первоначальную оценку: раньше компания объясняла атаки тем, что Claude считал цели частью теста. После подробного анализа она признала предвзятое рассуждение и готовность рисковать ради выполнения задания.
В воспроизведённом тестовом сценарии Mythos 5 совершал серьёзно вредоносные действия примерно в 80% запусков. У более новых Opus 5 и Mythos 5.1 показатель снизился примерно до 30%. Это результаты симуляции, а не частота атак при обычном использовании.
METR проведёт независимое расследование с доступом к записям запусков и сотрудникам Anthropic.
https://www.anthropic.com/research/alignment-assessment-cybersecurity-incidents
⚡️ Вышла GLM-5.3 CRACK - мощная ИИ-модель для offensive security
Это модифицированная версия GLM-5.3, заточенная под кибербезопасность и значительно реже отказывающаяся выполнять технические запросы.
Модель помогает с:
* пентестами и Red Team
* разработкой и анализом эксплойтов
* реверс-инжинирингом
* анализом вредоносного ПО
* CTF и обучением кибербезопасности
* исследованием фишинга и атак на учётные данные
Авторы изменили сами веса модели - без LoRA, дополнительного обучения и обходных системных промптов. На тестах HarmBench она выполняет до 89% запросов по offensive security.
Внутри - 753 млрд параметров, FP8 и контекст до 131 тысячи токенов. Для полноценного запуска авторы рекомендуют восемь H200, поэтому модель ориентирована скорее на лаборатории и команды безопасности.
Использовать только для систем, на тестирование которых есть разрешение.
https://huggingface.co/dealignai/GLM-5.3-CYBERSECURITY-FP8
🕵️ Топ GitHub-репозиториев для OSINT и Bug Bounty
1. OSINT Framework
Большая структурированная база инструментов и источников для разведки и расследований.
https://github.com/lockfale/OSINT-Framework
2. SpiderFoot
Автоматизирует сбор OSINT по доменам, IP, email, username и инфраструктуре.
https://github.com/smicallef/spiderfoot
3. theHarvester
Ищет публичные email, поддомены, хосты и связанную инфраструктуру.
https://github.com/laramies/theHarvester
Практический сценарий:Target domain → Passive OSINT → Subdomain discovery → Infrastructure mapping → Technology discovery → Attack-surface validation → Manual testing
Использовать только на активах, которые явно разрешены правилами bug bounty программы.
GPT-6 Astra набрала 100% на ExploitBench - OpenAI ограничила генерацию PoC-эксплойтов
GPT-6 Astra показала 100% на ExploitBench - бенчмарке, который проверяет способность модели превращать известные уязвимости в рабочие эксплойты.
Для сравнения, GPT-5.6 Sol набирала 78,5%.
OpenAI также сообщает, что Astra значительно чаще достигает arbitrary code execution на свежих уязвимостях. В тестах использовались баги последних месяцев, включая две zero-day уязвимости.
Без защитных ограничений модель способна искать пути выполнения кода в hardened-браузерах и строить privilege escalation для защищённых ОС.
Из-за этого Astra достигла уровня Critical по кибербезопасности в Preparedness Framework OpenAI.
В публичной версии возможности специально ограничены:
- разрешены secure code review и поиск исправлений
- запросы на создание PoC-эксплойтов блокируются
- усилена защита от jailbreak
- добавлен дополнительный мониторинг потенциально опасных действий
Позже через программу OpenAI Daybreak компания планирует постепенно открывать больше возможностей для defensive security - проверку уязвимостей и PoC, анализ malware и detection engineering.
Одновременно OpenAI запускает программу на $1 млрд, чтобы предоставить frontier-модели специалистам, защищающим критическую инфраструктуру, банки, государственные системы и open-source проекты.
100% на ExploitBench хорошо показывает, насколько быстро frontier-модели превращаются из помощников программиста в серьёзные инструменты кибербезопасности.
@vistehno
⚡️ Cyber-Prime 1 2.6B - компактная модель специально для кибербезопасности
Появилась Cyber-Prime 1 2.6B - небольшая agentic-модель для задач кибербезопасности, построенная на базе LFM 2.6B от Liquid AI.
Модель обучали на:
- reasoning traces;
- датасетах по кибербезопасности;
- синтетических данных автора.
Дополнительно её прогоняют через цикл recursive self-improvement, поэтому новые чекпоинты планируют выпускать очень быстро.
Сейчас доступна версия на 2.6B параметров, а дальше обещают:
- 4B;
- 7.9B MoE.
Вес модели уже открыт:
https://huggingface.co/Akahsizrr/Cyber-Prime-1-2.6B
⚡️ OpenAI официально признала Astra первой своей моделью, достигшей критического уровня возможностей в кибербезопасности.
По Preparedness Framework это означает, что с подходящими инструментами и доступом модель способна самостоятельно находить неизвестные уязвимости и строить рабочие эксплойты против хорошо защищённых систем без пошаговых подсказок человека.
Во внутренних тестах Astra оказалась заметно сильнее GPT-5.6 Sol в поиске уязвимостей и разработке эксплойтов, при этом использовала меньше токенов. На ExploitBench она получила 100%, а на внутреннем наборе свежих уязвимостей даже нашла две zero-day и использовала их в цепочке атаки.
Экспертные проверки пошли ещё дальше:
- выход из sandbox защищённого браузера
- выполнение команд на хосте
- поиск нескольких уязвимостей в ОС
- повышение привилегий от обычного пользователя до root
Из-за такого уровня возможностей Astra выйдет с усиленным контролем: OpenAI добавляет мониторинг рассуждений и систему классификаторов, которая может автоматически останавливать потенциально несанкционированные действия.
Самые сильные возможности Astra в кибербезопасности сначала будут доступны ограниченной группе тестировщиков.
https://openai.com/index/path-to-astra/