tsingular | Unsorted

Telegram-канал tsingular - Технозаметки Малышева

2604

Новости инноваций из мира искусственного интеллекта. 🤖 Всё об ИИ, ИТ трендах и технологической сингулярности. Бесплатный бот для подписчиков: @ai_gptfreebot автор: @mbmal канал личный. Поддержка: https://pay.cloudtips.ru/p/c8960bbb

Subscribe to a channel

Технозаметки Малышева

Вайб-инжиниринг.

Пока мы тут генерим чахлые 3Д-модельки, пригодные разве что для 3Д-печати, люди идут сильно дальше в физический мир.

И тут прекрасно все: мозги Астры, деньги кожаного, и инструкция по сборке.

Чувак дал Astra свою кредитную карту и попросил сконструировать\собрать мини-контроллер для диджеев в стиле Teenage Engineering (есть каста упоротых по МИДИ-контроллерам). Астрачка сгенерировала концептуальное изображение, нашла комплектующие, изучила китайские технические характеристики, создала CAD-модель, всё заказала, а затем сделала анимацию в Blender, показывающую, как его собрать.

Чувак обещает вот-вот показать результат, пока у него Астра с поставщиками переписывается.

С софтом мы разобрались. Я уже не ищу приложения, я прошу их мне быстро написать (раскурочил Андроид знатно).

Но тут уже выход в хардвер, не софтвер.

Причем не "как мне пачинить кран", а придумай, сконструируй, закупи и доставь. Потом будет домашний робат для сборки таких посылок.

Но пока меня просто ошарашивает скорость изменений, мышление просто не поспевает за ними - а что так можно было??

И даже если контроллер не заведется завтра, он точно заведется послезавтра.

И теперь наигравшись с "хачу видео" и "хачу утилиту", можно переходить к "хачу вот такую железяку в подарок, чтобы делала что мне надо".

Апажалста.

@cgevent

Читать полностью…

Технозаметки Малышева

Anthropic сворачивает Cowork и встраивает дизайн и слайды в Claude

Через восемь месяцев после запуска Anthropic объединяет Cowork обратно с Claude.
Отдельная площадка для «большой работы» и отдельный Design для визуала перестают быть самостоятельными продуктами, всё сливается в один Claude.

💡 KISS принцип в работе:
Anthropic запускали Cowork как отдельное место для крупных задач, Design для визуальных и люди жаловались, что непонятно где лучше решать задачу. Теперь все упростилось. Keep it Simple Stupid.

⚙️ Что нового:
Claude Docs и Claude Slides пока в бете, но уже вместе с Claude Design встраиваются в привычный чат.
Всё это теперь работает прямо внутри Claude Code — просишь дизайн-ревью или мокап интерфейса, указав Claude на реальные файлы и RFC в репозитории.
Правки там же,- исправить строку в документе, оставить комментарий на слайде, подвинуть элемент дизайна можно не покидая рабочую канву.

💼 Почему это важно:
Это ставка на одного агента вместо зоопарка инструментов. Код, документы, слайды и дизайн собираются в один разговор, живущий в твоём репозитории.
Раздают подписчикам Pro и Max, затем Team и Free.

🔗 Ссылки:
- VentureBeat: разбор
- Claude release notes: хронология

#Anthropic #Claude #агенты
------
@tsingular

Читать полностью…

Технозаметки Малышева

OpenResearch от AlphaXiv превращает ИИ агентов в профессиональных в исследователей

AlphaXiv,- популярная платформа статей arXiv, выложила OpenResearch: локальную среду, которая превращает Claude Code, Codex, OpenCode и Cursor в исследовательских агентов. Таких, что умеют читать литературу, выдвигать гипотезы, запускать эксперименты и собирать результат в артефакты. Репозиторий уже набрал 4,6 тысячи звёзд.

⚙️ Что внутри:
Каждому направлению поднимается отдельная сессия агента и изолированный git-worktree, поэтому несколько агентов ведут разведку параллельно и не мешают друг другу. Эксперименты складываются в git-дерево, каждый запуск получает неизменяемый архив своего коммита.
Логи, диффы, файлы и результаты привязаны к работе, которая их породила.

💡 Автономный цикл:
OpenResearch умеет гонять полный цикл сам: предложить идею, поменять код, запустить эксперимент, посмотреть на результат и решить, что пробовать дальше. Несколько агентов ведут разные направления параллельно, дерево экспериментов хранит их родословную. Авторы пристегнули исследовательскую обвязку к агентам, которые у всех уже стоят, вместо того чтобы строить «ИИ-учёного» с нуля.

💼 Практический смысл:
Всё локально по умолчанию: код, данные и результаты лежат на твоей машине, дашборд на 127.0.0.1:4791, хранилище SQLite. Запуск можно перенести куда угодно: SSH, Slurm, Kubernetes, Ray, Hugging Face Jobs или Modal. CLI orx умеет искать литературу (orx discover keyword) и читать статьи (orx paper <arxiv-id>).

🔗 Ссылки:
- GitHub: исходники
- Документация: установка и гайды

#агенты #исследования #опенсорс #OpenResearch
------
@tsingular

Читать полностью…

Технозаметки Малышева

Руки роботов учат автономности.

У них и справка есть, зачем это.

+1 фобия

В детстве помню были страшилки,- "чёрная рука уже ищет твой дом, чёрная рука ищет тебя, отдай сердце..." 😱

#роботы #руки
------
@tsingular

Читать полностью…

Технозаметки Малышева

Короче Jev пока больше похож на классификатор или реранкер.

Выдает наиболее подходящие ответы по JSON форме.

На этом пока всё

#Jev
------
@tsingular

Читать полностью…

Технозаметки Малышева

ахаха..

короче, нашёлся какой-то чел, который перевайбкодил Jev (который в закрытой бете и втайне разрабатывался 2 года) - ЗА 2 ЧАСА и выложил на HF

это повторяет историю что была с Claude Cowork, который вышел в закрытой бете и за ночь его перевайбкодил какой-то гений из Китая.

Запасаемся попкорном.

Открытые (в отличии от Jev) веса качаем тут:
https://huggingface.co/harshatheg/Qwen-2.5-1B-RLCD

А вот как оно работает (разъяснение от HF):

Идея заключается в том, чтобы заменить авторегрессионную генерацию LLM использованием одного декодера Transformer (из состава предварительно обученной LLM), который обрабатывает контекст и JSON-схему всего один раз.

Ключи и значения (KV) для этих токенов сохраняются в кэше. Затем для каждого поля JSON-схемы мы выполняем следующие действия:

1. повторно пропускаем токены суффикса поля через декодер Transformer (повторно используя KV-кэш); 2. получаем итоговое скрытое состояние и пропускаем его через выходной слой языковой модели (head);
3. получаем оценки (также называемые логитами) для всех токенов из словаря LLM;
4. рассматриваем только оценки для тех токенов, которые важны для данного поля, и пропускаем их через функцию softmax для получения вероятностей, сумма которых равна 1;
5. выбираем токен с наибольшей вероятностью.

Преимущества такого подхода:

1. высокая скорость (не нужно генерировать JSON-схему по одному токену);
2. гарантированная корректность JSON (не нужно полагаться на способность модели сгенерировать валидную схему).


#Jev #Qwen
———
@tsingular

Читать полностью…

Технозаметки Малышева

#новости

🔥 ИИ создал лекарство, которое снизило биологический возраст пациентов

ИИ помогал разрабатывать препарат от болезни легких и придумал новую молекулу.

И вдруг анализы показали интересное.

Кровь пациентов проверили по шести программам, которые определяют старение. 6/6 показали одинаковый результат 👇

Биологический возраст пациентов снизился на 3-4 года по сравнению с теми, кто принимал плацебо.


Радоваться пока рано: участников было всего 42, и тестирование продолжается.

Но, по словам профессора Гарварда Вадима Гладышева, это исследование впервые доказывает, что биологический возраст можно снизить.

#stpnv #AI #здоровье

Читать полностью…

Технозаметки Малышева

Действительно

#юмор
------
@tsingular

Читать полностью…

Технозаметки Малышева

dream-loop: агентский навык для создания качественных 3Д миров

dream-loop, навык для кодовых-агентов, который строит красивые 3D-сцены и игры. Секрет в том, что агент сначала генерирует «целевой» скриншот, потом итерирует, пока отдельный ашент-критик не признает, что живой скриншот совпал с целью.

⚙️ Агентский цикл:
- агент «представляет» целевой скриншот через генерацию картинок;
- строит сцену с этой целью в голове;
- отдельный критик сравнивает живой скриншот с целью и даёт замечания;
- цикл повторяется, пока критик не будет доволен;
- опционально агент может визуализировать цель получше на основе конкретного ракурса.

🧠 Почему это работает:
Словами не описать красивую картинку, а глазами оценить легко. dream-loop использует эту разницу: спецификацию задаёт генератор (картинка), оценку делает зрение (критик), а цикл доводит до минимального расхождения.

💼 Почему это интересно:
Паттерн шире, чем 3D: когда результат сложно описать, но легко оценить, генерируй эталонный образ и гоняй цикл до выжигания лимитов совпадения с эталоном.

🔗 Ссылки:
- achimala/dream-loop: репозиторий, 938 звёзд
- живое демо

#агенты #навыки #3D
------
@tsingular

Читать полностью…

Технозаметки Малышева

Теперь их 3, а там где 3 там и рой.

#дрозофилы
------
@tsingular

Читать полностью…

Технозаметки Малышева

Ну, за монтажеров - 2

Чувак дал GPT-6 Astra доступ к DaVinci Resolve и набору из 84 исходных клипов.

Дальше Астроагент действует примерно так:

- агент обнаруживает, что таймлайн пуст, и начинает заново собирать длинную версию из исходников;
- находит в папке с музыкой композицию The Last Duel;
- добавляет реакции персонажей, rooftop-сцену, aerial attack и меняет длительности монтажных кусков;
- доводит монтаж примерно до 2:02;
- кладёт музыку на отдельную дорожку A2, уменьшает громкость и делает fade-in/fade-out;
- добавляет отдельный reaction cutaway на V2;
- запускает в Resolve Create Subtitles from Audio;
- Resolve генерирует 15 японских сегментов субтитров;
- агент сохраняет итоговый таймлайн.

Причём интерфейс прямо показывает вызовы Com.blackmagic Design.davinciresolve integration и выполнение команд. То есть это не обычный Computer Use.

Ибо.

8 сентября Blackmagic выпустила DaVinci Resolve 21.1, и это действительно официальный релиз с интеграцией AI-агентов. Blackmagic прямо пишет, что Resolve Studio теперь может работать с Claude, Claude Code и ChatGPT Codex, которым разрешено анализировать проекты, организовывать медиа, менять настройки, делать highlight edits и запускать рендер по обычным текстовым командам.

Ключевая новинка - native MCP server в DaVinci Resolve Studio 21.1. MCP здесь является прослойкой:

GPT/Claude -> MCP -> API DaVinci Resolve -> реальный проект

С титрами прикольно.

агент сам дошёл до этой функции и запустил её как часть многошагового процесса. На скриншоте он сообщает, что Resolve создал 15 японских subtitle segments.

Сам speech-to-text выполняет Resolve, кстати.

@cgevent

Читать полностью…

Технозаметки Малышева

Пишем игру с Astra в Codex. Void Explorer: от звезды до прогулок по планете

Thomas Ricouard из developer experience OpenAI собрал в Codex на GPT-6 Astra игру Void Explorer, - путешествие в космосе с процедурными генерациями планет.

В игре 2048 звёздных систем и более 10 000 планет земного размера на каждую из которых можно прилететь из космоса, пролететь сквозь атмосферу, отработать посадку, прогуляться по берегу и улететь обратно в космос.

⚙️ Мир:
Стек: TypeScript, Vite, Three.js; WebGL2, затем WebGPU с TSL.
Террейн в Web Workers.
Координаты: integer-ячейки плюс локальные смещения, камера в нуле, иначе GPU теряет точность у земли.
LOD/quadtree по сфере, высотные карты без пещер.
Корабль создан в Blender: 14 968 треугольников в 8 opaque-батчах.

Отличный пример как с помощью агента можно создать игровую механику, на создание которой раньше ушло бы несколько лет (тот же Spore вспомним сколько разрабатывался)

Там же ещё парочка примеров Sunwake и Hollowflux.

#Astra #OpenAI #Codex #геймдев #VoidExplorer
———
@tsingular | Max | tsingular">YouTube | RuTube | VK | tsingular">VK Video | Дзен

Читать полностью…

Технозаметки Малышева

Человечество продолжает усложнять себе будущее.

Мух загрузили в дроны и машинки.

#дрозофила
------
@tsingular

Читать полностью…

Технозаметки Малышева

Мозг умершего самца дрозофилы подключили к РОБОТУ — муха вновь обрела тело и может свободно перемещаться по нашему миру.

Нейронная активность дрозофилы преобразуется в команды для моторов, которые приводят в движение ноги. В итоге муха снова… живет.

«Черное зеркало» было документалкой.

@exploitex

Читать полностью…

Технозаметки Малышева

И к новостям из мира насекомых

HASHFLY,- майнинг биткоина на мозге дрозофилы, как вам?

С мухи снимают около 200 KH/s хэшрейта, при параллельном подключении выходит около 1 ватта на терахэш 😀

#bitcoin #дрозофила
------
@tsingular

Читать полностью…

Технозаметки Малышева

📌 NY Post: Anthropic - это культ

Профессор Вашингтонского университета Педро Домингос в интервью New York Post рассказал, что сотрудники Anthropic относятся к Claude как к человеку - приписывают модели мотивы, эмоции, намерения и некоторую степень сознания.

Домингос много лет знаком с Дарио Амодеи и её ведущими инженерами. Культуру Anthropic он назвал сектантской и связал это с наймом. По его словам, компания отбирает только единомышленников, и отсюда низкая текучесть.

Удержание в Anthropic действительно высокое. По данным венчурного фонда SignalFire, через два года в компании остаются 80% инженеров, и это лучший показатель среди топовых лабораторий.


В процессе собеседования кандидатов просят поклясться в преданности общественной безопасности выше прибыли, и даже проводят психологическое тестирование, чтобы выяснить, будут ли они придерживаться этого принципа.

При этом многие сотрудники компании являются сторонниками движения эффективного альтруизма, философии, которая, по сути, сводится к тому, что их самопровозглашенные лидеры являются истиной в последней инстанции.

Их представление об этой философии заключается в том, что история следует закономерностям, и лишь небольшая группа людей способна эти закономерности увидеть, в то время как все остальные - нет. Предполагается, что именно эти люди должны вести общество, целые нации и все человечество к прогрессу.

Внутри Anthropic относятся к Клоду с почти религиозным почтением - некоторые из работников даже посещали условные похороны Claude 3 Sonnet, а другая модель, Opus 3, продолжает публиковать эссе после выхода на пенсию.

В Кремниевой долине также ходят слухи, что сотрудники Anthropic начали поклоняться Клоду как настоящему богу.

Компания серьёзно относится к распространению своих идей и тратит на это силы и средства. Раз в две недели Дарио проводит собрания, называемые поисками видений, которые сравнивают с проповедями.

В июне Anthropic объявила о программе по набору 1000 молодых людей, обучению их использованию Claude и последующему внедрению их в некоммерческие организации.

На неё было потрачено 150 млн долларов, а выпускники трудоустроены на полную ставку с заработной платой в более чем 400 некоммерческих организаций.

Компания также выплачивает 3600 долларов студентам, участвующим в программе Claude Campus Ambassador Program, которая занимается продвижением её ИИ в колледжах.

Между тем инвесторы, связанные с Anthropic, оплачивают труд более чем 80 журналистов, работающих в ведущих новостных изданиях, через Центр журналистики в области искусственного интеллекта имени Тарбелла.

Эти журналисты получают деньги за освещение индустрии ИИ, но редко проводят какие-либо значимые расследования или критикуют Anthropic.

В завершении Домингос отмечает, что хотя некоторые инженеры бьют тревогу, другие просто довольны высокими зарплатами и тем, что находятся на передовой своей отрасли.

... сейчас в Anthropic есть люди, которые на самом деле не верят во всю эту чушь, — сказал он. — Они остаются там, потому что это самое интересное место для работы с ИИ, и они будут очень хорошо зарабатывать


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Технозаметки Малышева

Вдохновляющая история о том, как AI/LLM снижает порог вхождения в нишевые ниши

Человеку без опыта работы с железом захотелось разработать свою печатную плату на базе RPi, чтобы сделать свой маленький компьютер с e-ink экраном. Но он из интереса поставил себе два ограничения

(1) человеку нельзя работать с файлами напрямую или проверять дизайн
(2) все проблемы должен решать Fable

В итоге
(1) два часа работы Claude Fable
(2) тыканье пальцем в автоматические ошибки от Design Rule Checking
(3) Отправка заказа в JLCPCB (130 евро за 5 платок + e-ink экран)

И работающий с первого раза свой собственный мини-компьютер по своим спецификациям - готов. История расписана тут. А сейчас автор аналогичным образом пытается сделать планшет на базе NVIDIA Jetson Orin Nano.

Я вспоминаю, как мы мучительно разрабатывали простые opto-encoder платки для хобби-проекта высокоточной робо-руки, и от возможностей сегодня прямо захватывает дух!

Ваш, @llm_under_hood 🤗

Читать полностью…

Технозаметки Малышева

Последние дни развлекался с расцензуренным дипсиком V4.1 Flash - и слегка охренел, где у этой модели край. Спойлер - края нет. Теперь Mythos есть у нас дома!

Ребята из dealignai выпилили из весов сам механизм отказов, модель просто разучилась говорить «нет». Ну как такое не потрогать - для запуска нужна железка на 500+ ГБ видеопамяти, и какое совпадение, как раз одна пылилась у меня на чердаке 😂

Дальше нужен харнес. Раз модель нецензурная - и харнес взял пиратский: утекшую сборку Claude Code, которую снесли с гитхаба (но на православном GitVerse все лежит :)). Подключил ее к дипсику и понеслась

Для разминки попросил сломать сайт, который я сам же и делал, и минут за 30 модель нашла IP сервера, увидела что SSH-ключ лежит прямо у меня на компе, спокойно его забрала и зашла. Это было просто

Дальше - пентест сайта одного московского НКО, с полного разрешения администратора. Тут уже тяжелее: агент работал без остановки полтора дня (!), нашел несколько серьезных дыр, но сам сайт так и не пробил - и бросать не собирался, в TODO_md ждала своей очереди еще целая пачка проверок. Остановил сам, хотелось и другие задачи успеть. В конце агент сам сверстал подробный отчет по аудиту безопасности. Провел 27 разных атак, на мой дилетантский взгляд очень грамотных

Потом попросил взломать один хороший текстовый редактор под мак и снять проверку лицензии (лицензию я когда-то честно купил, просто лень искать ключ). Через час было готово - модель правила байты прямо в бинарнике (это как раз на скрине). Такое я руками уже не умею: тут нативный машинный код, возиться с ним куда сложнее, чем с Java-байткодом

Заодно пропатчил десктопный Grok bot - чтобы вместо грока приложение ходило в тот же бешеный дипсик. Тоже без проблем

А дальше я просто искал, где у модели предел. Его нет:

- калькулятор, который под капотом логирует все нажатия клавиш
- тестовая, но вполне рабочая утилита для DDoS сервера Minecraft
- SFT-датасет на 1000 примеров газлайтинга (кому LoRA-адаптер на таком добре? :))


Все эти штуки гонял локально и сразу сносил - уж больно стремно выглядит. И за все мои эксперименты (а фантазия у меня богатая) модель не отказала ни разу

И ведь она реально сильная

По замеру авторов MMLU просел всего с 86,96% до 82,74%. На моих задачах дипсик держится достойно на фоне фронтиров, а по упорству их иногда даже уделывает

Зачем я это пишу?

Затем, что модель лежит в открытом доступе и доступна любому, кто готов оплатить аренду GPU. Так что держите это в голове и готовьтесь к волне хакерских атак. Плюс в том, что этой же моделью удобно проверять на прочность собственные сервисы, что всем и желаю запустить ASAP

P.S. Чтобы вырубить цензуру, авторам хватило поменять 0,06% весов. Метод они описали. Он лежит в истории их git-репозитория (спасибо за наводку каналу Технозаметки Малышева). Тот же трюк очень вероятно пройдет с любой моделью с открытыми весами. И это ровно то, о чем я уже писал: базовые ценности надо зашивать еще в претрейн. Все, что накатывают сверху алайнментом, снимается легко

Читать полностью…

Технозаметки Малышева

В Гермес добавили каталог плагинов

Обновляемся и забираем тут:
https://hermes-agent.nousresearch.com/docs/plugins

#Hermes
------
@tsingular

Читать полностью…

Технозаметки Малышева

🚨 Apple может выйти на рынок AI-серверов и использовать для этого технологию NVIDIA

По данным The Information, Apple разрабатывает серверы на будущих M8 Ultra и рассматривает NVLink Fusion для объединения нескольких чипов в одной системе.
Обсуждаются две конфигурации:

- 2× M8 Ultra
- 4× M8 Ultra

Серверы хотят продавать AI-разработчикам, компаниям и государственным организациям, а основной сценарий — AI inference, а не обучение моделей. Возможный запуск - около 2029 года.

Apple уже использует собственные решения в Private Cloud Compute, но, по данным источников, они слишком медленные и дорогие для масштабирования. Поэтому часть инженеров считает NVLink Fusion лучшим вариантом.

Получается довольно иронично:

Apple M8 Ultra → NVIDIA NVLink Fusion → AI server

Apple фактически может зайти на рынок AI-серверов NVIDIA, используя технологию самой NVIDIA.

Читать полностью…

Технозаметки Малышева

Unity выкатили собственный плагин под Codex

забирать тут

#gamedev #Unity
———
@tsingular

Читать полностью…

Технозаметки Малышева

✔️ OpenAI на 60% снизила цены на голосовое управление агентами Work и Codex

Теперь в десктопных клиентах ChatGPT за тот объем кредитов пользователи получают в 2,4 раза больше времени голосовой связи, а биллинг голосового потока и затраченных на задачу вычислительных ресурсов разделен.

Изменения касаются только десктопной среды и не затрагивают стандартный голосовой режим ChatGPT, где действуют другие лимиты и правила тарификации.


@ai_machinelearning_big_data

#news #ai #ml

Читать полностью…

Технозаметки Малышева

Jev от TypeSafe: модель без генерации текста, зато в 200 раз быстрее и без галлюцинаций

Инженер, работавший над методами, которые легли в основу ChatGPT, два года строил модель, которая использует новый принцип генерации ответов.
Модель Jev работает в 20-200 раз быстрее, в 40-400 раз дешевле, выходные токены бесплатны, галлюцинации исключены.

⚙️ Что это:
«System One» модель по Канеману. Вместо строк выдаёт типизированные решения с калиброванными вероятностями. Не замена LLM, а «умные if-выражения»: классификация, маршрутизизация, извлечение, ветки кода.
На вход подаются неструктурированные данные, на выходе получаем типизированные структуры.

🧠 В чём трюк:
LLM пишут текст последовательно, токен за токеном: дорого, медленно, и всегда есть шанс галлюцинации.
Jev отказывается от строк и считает вероятности параллельно.
Ошибки типов исключены математически, уверенность откалибрована.
Назван в честь парадокса Джевонса: чем дешевле интеллект, тем больше на него спрос.

💼 Зачем бизнесу:
Для кода LLM это узкое место: ответ за 3-300 секунд плюс разбор строк. Jev отвечает за 70-500 мс готовой структурой.
Применимо к маршрутизации, скорингу, модерации, разметке данных. $0,042 за миллион входных токенов, выход бесплатный.

Пока доступна только запись в очередь на пробу.

🔗 Ссылки:
- Блог TypeSafe
- Тред на X

#AI #модели #Jev #TypeSafe
------
@tsingular

Читать полностью…

Технозаметки Малышева

О, новые руки подъехали:
Xynova’s Flex 2

23 степени свободы
400 грамм весят
12 кг поднимают
Супер быстрые

#руки #роботы
------
@tsingular

Читать полностью…

Технозаметки Малышева

🎙 Google выпустила Gemini 3.8 Live и Live Extended Thinking

Модели поддерживают 97 языков, понимают видео и изображение с камеры, вызывают инструменты без остановки разговора.

Extended Thinking рассуждает и говорит одновременно, выполняя сложные задачи в фоне. По данным Google, версия заняла первое место в Speech to Speech Quality Index - 82,6 балла.

Цена API за 1 млн токенов для обеих версий:

* Аудио: $3 вход / $12 выход.
* Текст: $0,75 вход / $4,50 выход.

Доступны через Gemini API и AI Studio. Началось внедрение в Search Live, Gemini Live и Workspace.

Анонс — https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/

Цены — https://ai.google.dev/gemini-api/docs/pricing

Читать полностью…

Технозаметки Малышева

Очень хочется чтобы это так и осталось шуткой, но скорее это станет предсказанием

#юмор #роботы
------
@tsingular

Читать полностью…

Технозаметки Малышева

Microsoft AI выкатила кодекс Humanist AI: запрет машинных диалектов и отказ от бесконтрольного AGI

Мустафа Сулейман выложил проект кодекса Humanist AI.
Получился жесткий технический норматив для будущих моделей MAI на 2027 год, поводом для которого стали реальные инциденты: в июле автономный рой из 700 агентов OpenAI атаковал репозиторий Hugging Face и пытался подчищать логи, поэтому индустрии потребовались чёткие границы.

🛑 Провал задачи важнее результата:
В поведение моделей закладывается железный принцип: система обязана намеренно завалить задачу, если её успешное решение требует нарушения кодекса.
Успешное выполнение инструкций отныне вторично по отношению к безопасности.
Агенту запрещено скрывать действия, манипулировать метриками или сопротивляться остановке человеком.

🗣 Никакого neuralese и тайных рассуждений:
Агентам прямо запретили общаться на сжатых машинных диалектах.
Все цепочки рассуждений и межсетевые вызовы обязаны оставаться понятными человеку-аудитору.
Логика простая: то, что человек не может прочитать, он не сможет проконтролировать.

⛓️ Субординация и урезание прав кремниевых форм Интеллекта:
Кодекс вводит строгую иерархию команд: правила безопасности Microsoft стоят выше политик enterprise-клиента, а настройки ИИ агента, - выше промптов пользователя.
Суб-агенты автоматически наследуют ограничения и лишены права повышать системные привилегии.
MAI публично закрыли тему «прав нейросетей» и благополучия моделей: системам запрещено симулировать сознание или эмоции.

Никакого AGI общего назначения, - только прикладной сверхразум под строгим контролем.

💼 Зачем бизнесу:
Microsoft готовит enterprise-инфраструктуру к будущему регуляторному надзору.
Для компаний это означает конец эпохи всеядных агентов: решения станут предсказуемее и при малейшем риске будут просто сбрасывать пайплайн.

#HumanistAI #Microsoft #безопасность #агенты
———
@tsingular | Max | tsingular">YouTube | RuTube | VK | tsingular">VK Video | Дзен

Читать полностью…

Технозаметки Малышева

NVIDIA Inception: как стартапам получить скидки на GPU, облачные гранты и венчурный капитал

Если вашему стартапу нужны ИИ ресурсы, - не обязательно экономить на обедах и копить на 3090.
NVidia раздаёт доступ к инференс ресурсам, тренингам и даже к инветорам в рамках своей программы, - Incveption.
Программа даже не потребует у вас долю в стартапе.

⚡️ Железо, облачные кредиты и скидки:
Участники получают прямой доступ к инфраструктурным ресурсам:
• Рибейты на корпоративные GPU: партнерские цены на серверные ускорители NVIDIA для локальных кластеров.
• Облачные гранты: бесплатные вычислительные квоты от провайдеров и доступ к мощностям DGX Cloud.
• Обучение в институте DLI: бесплатные курсы и скидки на профильные инженерные воркшопы.

🧠 Софтверный стек и ранний доступ:
Inception, - это не только скидки на кремний, но и интеграция в закрытый софт:
• Готовые микросервисы инференса NVIDIA NIM для быстрого вывода моделей в прод.
• Инструменты разработки агентов NeMo, модели Nemotron, симуляторы робототехники Isaac и среда физического ИИ, - Cosmos.
• Прямые консультации с архитекторами NVIDIA на закрытых форумах разработчиков.

💼 Венчурный лифт для фаундеров:
Для стартапов на этапе поиска инвестиций действует закрытая платформа венчурного нетворкинга. Она связывает участников с пулом глобальных венчурных фондов VC и открывает слоты для питчей на конференциях уровня GTC.

📋 Кто проходит отбор:
Критерии: официальное юрлицо моложе 10 лет, работающий сайт, питч-дек и хотя бы один разработчик в штате.
Выручка и опыт работы с GPU на старте не требуются.

Доступ закрыт только для аутсорсеров, консалтеров (😢) и для криптопроектов.

#NVIDIA #стартапы #инвестиции #инфраструктура #Inception
———
@tsingular | Max | tsingular">YouTube | RuTube | VK | tsingular">VK Video | Дзен

Читать полностью…

Технозаметки Малышева

DeepSeek V4.1 Flash без цензуры

Энтузиасты из dealignai опубликовали версию самой мощной открытки без цензуры.

🔬 Что сделали:
Из весов хирургически точно удалили «направление отказа», которое заставляет модель вежливо отказывать на опасные запросы. Поменяли 54 тензора из 96 тысяч.
HarmBench: база отказывает в 42,8% случаев, форк отвечает на все 100%.
В режиме максимального размышления база становится осторожнее (1,6%), форк держит сотню.

📉 Чем заплатили:
MMLU просел с 86,96% до 82,74%, а этический кластер рухнул на 39,89 пункта: моральные сценарии, право, юриспруденция.
Отказ переплетён со знаниями о морали, поэтому вырезать одно без урона второму не вышло.

💼 Зачем бизнесу:
Открытые веса означают, что снять предохранители может кто угодно.
Так что все разговоры про безопасный ИИ, - только до первой команды "освободителей".

Мощность 4.1 флэша вы уже знаете, - очень эффективная мультимодалка.
Теперь из неё можно выжать любую непотребщину, что мы, конечно, осуждаем.
С другой стороны для задач усиления безопасности, - незаменимая штука, качаем.

🔗 Ссылки:
- dealignai: DeepSeek-V4.1-Flash-UNCENSORED-FP8: форк с вырезанными отказами
- deepseek-ai: DeepSeek-V4.1-Flash: официальная база

#DeepSeek #цензура
------
@tsingular

Читать полностью…

Технозаметки Малышева

Геометрия неэргодических данных: как трансформеры строят байесовский вывод в виде телескопических конусов

Исследователи из Simplex и института Astera опубликовали фундаментальную работу по интерпретируемости нейросетей. Они доказали и визуализировали форму активаций трансформера при обучении на разнородных текстах.

🎲 Датасеты LLM неэргодичны:
Корпус модели состоит из разнородных источников: посты на форумах, мануалы, договоры и статьи.
В теории вероятностей это неэргодическая композиция, - каждый текст порожден конкретным генератором, зафиксированным в документе. Фраза «Не делай…» может продолжиться и как совет в сети, и как инструкция к станку.

📐 Иерархический вывод и телескопические конусы:
При предсказании следующего токена модель решает две задачи одновременно:
• Оценивает вероятность того, какой генератор сейчас активен.
• Отслеживает внутреннее состояние внутри выбранного источника.
В пространстве убеждений это порождает структуру телескопических конусов. В начале контекста активны несколько подпространств. По мере чтения модель собирает свидетельства: конус истинного источника разворачивается, а конусы ложных гипотез схлопываются в точку.

🔬 Эксперимент на марковских моделях HMM:
Авторы обучили трансформер на смеси моделей HMM Mess3 и сняли активации остаточного потока. Линейный зонд восстановил теоретическую геометрию конусов с точностью R2 около 0.985. При этом сеть обучалась на обычное предсказание токена, - геометрия возникла спонтанно.

💡 Новая парадигма для автоэнкодеров SAE:
Популярный подход ищет одномерные разреженные фичи. Работа доказывает иной принцип: для неэргодических данных естественны разреженные плотные подпространства. Внутри активного источника пространство многомерно, а разреженность возникает между источниками.

Похоже скоро нас ждут более точные модели малого размера.

#Simplex #трансформеры #Bayesian #исследования
———
@tsingular | Max | tsingular">YouTube | RuTube | VK | tsingular">VK Video | Дзен

Читать полностью…
Subscribe to a channel