seeallochnaya | Unsorted

Telegram-канал seeallochnaya - Сиолошная

77202

Канал SeeAll'а с новостями (и мыслями о них) из мира NLP, VR и космоса. Более подробно смотри в первом сообщении в канале (оно закреплено). А еще у нас есть чат! Заходи: https://t.me/+i_XzLucdtRJlYWUy

Subscribe to a channel

Сиолошная

Пока рассказывают про Grok Bot и Muse— в документации уже указано, что:
1) да, будет тир за $500. Пока без информации по лимитам.
2) В НЁМ БУДЕТ УЛЬТРА ФАСТ ДЛЯ АСТРЫ (!) - 300 токенов в секунду, и в будущем для Sol. Поздравляем команду Cerebras, которая смогла развернуть такую огромную и мощную модель у себя. Очень жду.
3) также уже вышел Sol-6.1, цена та же, но кэш дешевле в 2 раза. По метрикам ближе к Astra, не смотрится так позорно, как Sol-6 (неделю назад...). Попробуем.

UPD: x25 usage за $500

Читать полностью…

Сиолошная

Утром Tibo написал, что сегодня вернут подписки ChatGPT за $200... но есть одно "но": в них будет x10 лимитов вместо x20. Это же применимо и к старым подписчикам.

По слухам, сегодня представят подписку за $500 — пока не ясно, какие там лимиты; может быть x25 (получается чуть больше чем было до этого за $200), а может что-то более выгодное. Можно помечтать от x50...

Также в этой подписке, предположительно, появится ультра-фаст режим с генерацией до 750 токенов в секунду (правда это обещали для моделей размера Sol, не ясно, будет ли что-то для Astra).

Когда я сегодня в чате рассуждал о причинах — то смог придумать 3 версии, почему подписка за $200 сильно похудеет:
1) хотят продвигать подписку за $500, зная, что те кого задевают урезания лимитов на 200 могут себе позволить купить за $500 (=> больше выручка)
2) у них невероятно вырос спрос, на десятки процентов, и мощностей реально не хватает, и потому решили максимизировать выручку
3) мощности перекидывают на исследования и запуск роев агентов для решения разных прикольных задач, как было с задачами тысячелетия

И, видимо, вариант 2 правильный — только что появились новости, что компания нарастила ARR почти до $70B — более чем на 70% с начала третьего квартала; а enterprise вырос более чем вдвое. Если "почти до 70" означает хотя бы 67 и выше, то OpenAI почти наверняка обошли Anthropic по выручке — с учетом того, что вторые считают деньги от партнёров иначе, и OpenAI «занижает» цифры.

Релиз Astra прошёл отлично 🚀🚀🚀

Читать полностью…

Сиолошная

Похоже, что GPT 6 Astra останется лучшей моделью OpenAI надолго — завтра на DevDay почти наверянка не представят обновление, и даже релиз 6.1 с октября перенесли на неопределенный срок из-аз переживаний по поводу безопасности.

Читать полностью…

Сиолошная

На данный момент миссия идёт не без неровностей, но успешно:
— в середине набора высоты отключился один из двигателей (но это некритично, можно потерять несколько)
— после разделения ступеней не работало уже 2 двигателя, но.. это всё еще не критично
— ускоритель смог затормозить и мягко сесть на воду, по крайней мере так выглядело с камер, официального подтверждения нет
— у корабля уже на большой высоте отказал один из двигателей... но снова не критичный! После 20-минутной проверки было принято решение, что всё в норме (этот двигатель так и так дальше не использовался, ибо он во внешнем контуре, а для подъёма орбиты и схода с неё используется внутренний, как и при посадке на воду), и можно выходить на орбиту
— наконец, Starship занял орбиту и успешно выпустил 26 спутников Starlink v3; с первыми из них уже установлена связь (UPD: уже со всеми). Это уже полноценная коммерческая нагрузка, не муляжи.
— Каждый из спутников существенно увеличивает пропускную способность всей сети (в 10 раз больше, чем v2, примерно 1 Tbps).
— пока что ничего не мешает Starship направиться на посадку в океане и тем самым успешно закончить миссию; вопрос в том, сколько витков вокруг Земли его заставят пройти и в каком океане сесть (предусмотрено до 6 витков).

И пока писал — увидел, что сегодня оказывается ровно 18 лет с первого успешного выхода на орбиту ракеты Falcon 1, произошедшего в рамках четвертого пуска. Именно он стал основной для будущих коммерческих контрактов компании и спас её от банкротства — изначально денег было вообще на 3! пуска, но Elon кое-как поскрёб по инвесторам и смог собрать. Часто говорят, что провались они тут — компания бы умерла.

И вот спустя 18 лет огромнейший корабль смог вывести 46 тонн полезной нагрузки на орбиту! А дальше — больше (эта версия может выводить 100 тонн, следующая 200).

Читать полностью…

Сиолошная

План первой орбитальной миссии Starship Flight 14 — до старта 2 часа.

Сегодня особенный день — SpaceX наконец-то пришли к первой миссии по эксплуатации своей сверхтяжёлой ракеты с выводом 26 спутников Starlink V3 где-то на 45 тонн. Этот запуск будет дальше, дольше и сразу на 6 витков вокруг Земли. Между стартом и завершением миссии пройдёт почти 10 часов, а корабль Starship впервые сядет в Тихом океане.

Основные цели этой миссии: выполнить абсолютно все задачи, включая старт, выход на замкнутую орбиту, вывод нагрузки, длительное пребывание в космосе и симуляцию посадки для двух ступеней. И если все задачи будут выполнены, то следующие миссии уже будут с посадкой на башню. И да, по плану намного раньше и их двух штатов до конца этого года.

Ключевые этапы Flight 14:
⚪️ Запуск 33 двигателей Raptor 3;
⚪️ Старт с Pad 2 и прохождение зоны Max Q;
⚪️ Горячее разделение Starship S41 и Super Heavy B21;
⚪️ Запуск 6 двигателей на S41 и перезапуск 28 двигателей (5 будут работать) B21 для первого тормозного манёвра;
⚪️ Вход Super Heavy B21 в атмосферу с прохождением зоны максимальных нагрузок;
⚪️ Перезапуск 13 двигателей на Super Heavy B21 для второго тормозного манёвра;
⚪️ Выход корабля Starship S41 на первичную незамкнутую орбиту;
⚪️ Симуляция посадки B21 на виртуальную башню на воду с последующей утилизацией;
⚪️ Разгонный импульс Starship S41 для выхода на круговую замкнутую орбиту 275км;
⚪️ Открытие шлюза грузового отсека;
⚪️ Выгрузка 26 спутников Starlink V3;
⚪️ Starship S41 находится на орбите почти 9 часов и 6 витков;
⚪️ Перезапуск 1 двигателя Raptor 3 на свода с орбиты;
⚪️ Вход Starship S41 в атмосферу, и прохождение зоны максимального нагрева и нагрузок;
⚪️ Теплозащита Starship S41 выдерживает вход в атмосферу, плавники и функциональный механизм посадки не расплавляются;
⚪️ Перезапуск 3 двигателей на S41 с мягкой посадкой в Тихом океане рядом с буями (симуляция посадки на башню).

Время запуска Flight 14 на 28 сентября:
- 07:15 по Техасу
- 14:15 по CET
- 15:15 по МСК

Официальная трансляция в 4K начнётся за 35 минут до запуска и доступна тут — https://x.com/i/broadcasts/1qxvvenMPMQxB

Всем заранее приятного просмотра, команде хладнокровия, и посетителям беречь уши.

И помните, что успех не гарантирован, но точно будет весело 🚀

Читать полностью…

Сиолошная

Экспортный контроль чипов действительно существенно влияет на китайские компании. Да, некоторые уже пытаются переходить на Huawei и другие — но их производство тоже сильно ограничено, и особо сильно упирается в память. Epoch.AI подсчитали, что если Китай будет использовать только HBM (память в GPU для LLM) собственного производства, то они смогут производить примерно... 1% от GPU Nvidia (первая картинка) в ближайшие годы — и эта доля падает (в 2026-м это примерно 4%).

Насколько контрабанда HBM позволила бы сократить дефицит? Предположим, Huawei контрабандой ввезла бы в 2028 году в 10 раз больше HBM, чем на внутреннем рынке, — невероятно большой объем, обошедшийся как минимум в 40 миллиардов долларов. В этом случае ее производство в 2028 году выросло бы с 1 млн до примерно 11 млн H100-эквивалентов, что по-прежнему составило бы лишь 11% от производства Nvidia в том году.

Поставки HBM в Китае и производство чипов Huawei будут быстро улучшаться, но, вероятно, недостаточно быстро. Даже 18-кратное увеличение мощностей HBM в Китае к 2030 году приведет к тому, что объем производства Huawei составит примерно 12-18% от объема производства Nvidia в 2028 году.

На второй картинке — попытка Epoch.AI оценить контрабанду чипов в Китай через Малайзию в период после введения ограничений администрацией Байдена и до ужесточения регуляций на экспорт в самой Малайзии. Логика подсчёта проста: таможни всех стран записывают что приходит и что уходит, а затем общие данные отправляются в ООН. Цифры агрегированы по кодам пересылаемых объектов — и почти все чипы попадают в одну категорию. Разница, которую видно на картинке — это разница между тем, что отправлено из Малайзии (по заниженным ценам) в что записано к получению в Китае (по реальным ценам, они ж не могут уходить от оплаты пошлин и налогов у себя дома).

Итого насчитали за ~год контрабанды на $3.8B, или примерно аналог ~150'000 видеокарт H100.

===

Вся информация выше лишний раз подчеркивает, насколько сильный рычаг воздействия остается у США и Nvidia. Если укрепить меры контроля за контрабандой и отслеживать карты прямо с производства на Тайване — Китаю придется несладко (как бы не пришлось возвращать остров под свой контроль 👨‍🦳).

Читать полностью…

Сиолошная

Адам Елдаров, ex-CPO YouDo, написал два поста про экономику AI-подписок и развенчание мифа о том, что подписки — «субсидируемые» и что компании на них теряют огромные деньги. Я согласен наверное с 95% того что там написано. Форвардить два поста не хочется, поэтому зайдите и почитайте, если вам интересно: /channel/c3po_notes/589 и следующий за ним.

Не знаю, планировал ли Адам писать про это дальше, но мне кажется логичным продолжением будет рассуждение о том, когда у компаний изменится баланс выручки и трат на RND / обучение моделей. Пока что растет и одно, и другое, поэтому легко ошибиться и сказать «так они всегда будут убыточными!», что, очевидно, не правда, потому что второй компонент можно контролировать: ты можешь выбрать не тратить больше денег на обучение или исследование.

Сейчас такой выбор никто не делает, так как денег от пользователей и инвесторов хватает. И оба эти компонента +- одинаковые у двух ведущих компаний. Экономика их трат тоже примерно одна и та же: они платят примерно одинаково своим сотрудникам и примерно одинаково платят за видеокарты и датацентры.

Если выручка перестанет расти или вообще наметится спад (одновременный для двух компаний в силу внешних причин) — обе компании будут принимать одинаковые решения по урезанию костов. Пока она продолжает расти — они пытаются дотянуться до как можно большего количества мощностей и ведущих специалистов, и оба компонента ограничены какими-то факторами сверху. Вполне возможно, что через 2-3 года расходы компаний на мощности перестанут расти вслед за выручкой — просто потому что больше чипов не будет, можно купить лишь столько, сколько производит маленький островок около Китая. По-моему Dylan из SemiAnalysis говорил, что где-то в 2028-м году две (три?) компании будут получать больше половины всех новых чипов — отсюда, очевидно, x2 сделать уже просто некуда.

Для всех игроков в системе экономика одинаковая: сервер стоит столько-то, в будущие датацентры нужно инвестировать столько-то, чтобы получить столько-то выручки (выручка на мегаватт мощностей у всех разная, и тут OpenAI/Anthropic далеко впереди всех; остальные игроки будут пытаться спустить этот показатель с небес, но они не могут сделать это ниже своего уровня — а они в среднем менее эффективны — потому что иначе придётся платить из своего кармана, который не такой глубокий, как у фронтира).

Читать полностью…

Сиолошная

А вот и OpenAI: встречайте GPT-6 Sol и Luna.

— обе модели ровно в 2 раза дешевле, чем их 5.6-версии.
— общаться должны так же понятно и без жаргона, как Astra
— и... всё. Sol не лучше Astra (а во многом и хуже, в отличии от пары Fable <-> Opus), но сильно дешевле, и всё ещё лучше Sol 5.6. Поэтому модель может стать основной рабочей лошадкой, сохраняя ваши лимиты.

Читать полностью…

Сиолошная

И абсолютно невероятная картинка с Эль Сальвадором, который имел очень высокий уровень преступности (на графике — убийств (не мелких преступлений), но в 2023м году после многих лет работы над системой они смогли добиться уровня ниже США.

Это сопровождалось четырехкратным увеличением количества заключенных.

Как им это удалось? Благодаря сочетанию значительных финансовых вложений, непритязательности в вопросах прав человека и условий содержания в тюрьмах, а также непритязательности в отношении того, были ли заключенные виновны в каком-либо конкретном преступлении или просто имели отношение к бандам.

Читать полностью…

Сиолошная

Прошло уже почти 3 недели с релиза GPT-6 Astra, и можно подводить первые промежуточные итоги. Модель действительно вышла очень клёвой и способной, и, как мне кажется, лучше Fable 5.1: на многих бенчмарках они или идут вровень, или Astra обходит; к тому же читать текст Astra гораздо приятнее, чем слоп от Клода, и когнитивная нагрузка не такая большая, чтобы продраться через мешанину абстрактных терминов.

Astra особенно отличается в Computer Use и задачах с изображениями/видео. Не знаю что там сделали OpenAI и связано ли это как-то с Looped Transformers, но люди смогли заставить Astra пройти несколько игр: от простого «добудь алмаз в Minecraft» до... легендарной ролевой игры Fallout 3, пространственной головоломки Portal и Factorio (основная игра + дополнение). Насколько я понимаю, во всех или почти во всех случаях это не простой пайплайн «картинка с экрана -> действия», тут и там то MCP подключат, то ещё что, но это всё равно впечатляет. Легко сказать «так модели же учили на всех видео с интернета, конечно они знают как играть» — но модели 3-4 месяца назад учили примерно столько же и на том же, но они не могли проходить игры от начала и до конца.

Не одними играми славится Astra — на многих бенчмарках, в том числе тех, которые вышли после релиза (или ещё круче: авторы ещё не выпустили, но уже померили Astra, как было у Vals.AI), модель показывает существенную разницу. Из запомнившегося — WeirdML v3 на картинке в посте, свежий бенчмарк на ML-задачи, где агенту дают данные и общее описание что делать, и его цель разобраться, что в данных, обучить модели и/или написать эвристики и прийти к решению. Автор пишет, что был очень удивлён оценке Astra, и он не ожидал, что ещё фактически до релиза бенчмарка лучшая оценка будет больше 50%.

В общем, весной после анонса Mythos/Fable у меня был скепсис, что OpenAI получится быстро догнать Anthropic. По какой-то причине компания долгое время не решалась на масштабирование моделей. Возможно, не хотели упираться в нехватку вычислительных мощностей, с которой компания встретилась сейчас — не знаю. Рад, что опасения не подтвердились 🤷‍♂️

Теперь будем смотреть как догоняют Google, META и xAI — и китайцы с опенсурсом🇨🇳... пока в OpenAI по слухам уже идёт предтренировка ещё большей модели с кодовым названием «Bel».

Читать полностью…

Сиолошная

Вы наверняка видели эту картинку с XKCD. Оказалось, она была пророческой — именно через уязвимость в указанной библиотеке ImageMagick (поддерживаемой за "спасибо" каким-то рандомом из Небраски 😀) нашлись уязвимости, позволившие 3 белым хакерам и паре LLM по подписке взломать OpenAI и несколько других компаний, включая Slack, Zoom, Meta.

Сначала им удалось взломать форум обсуждений OpenAI, построенный на платформе Discourse (старый, часто используемый и никакой связи с OpenAI не имеет). Ну как "им" — в июле хакеры попросили Opus 4.8 проанализировать уязвимости, и тот справился, найдя одну в библиотеке для работы с изображениями. Потом Opus 5 переписал/улучшил хак, и по итогу загрузка картинки на форум приводила к выполнению кода.

После этого была обнаружена ещё какая-то проблема/уязвимость в SSO OpenAI (система, использующаяся для логина), и используя её хакеры могли бы в теории получить доступ к внутренним репозиториям OpenAI, чего они не сделали, ограничившись созданием одного PR как доказательство работоспособности.

OpenAI оперативно отреагировали, и через 2 дня уязвимости были исправлены.

Вот тут сборник рассказов про взломы других компаний через уязвимость в той же библиотеке изображений. На все взломы ушло суммарно... $3000 в токенах 👨‍🦳👨‍🦳

Читать полностью…

Сиолошная

Первый взгляд на физическое издание музыкального альбома по GTA VI

Подтверждены следующие треки:

• Yung Lean - That's It (feat. Future & Metro Boomin)

• Travis Scott - RHYNO (prod. by Guy-Manuel de Homem-Christo)

• CA7RIEL & Paco Amoroso, PinkPantheress, Fred again.., & Etienne de Crécy - Sexy Magic

• Morgan Wallen - Last Thing You Need

• Rauw Alejandro - Macacoa 2000

• Keith Richards - Bright Lights, Big City

Читать полностью…

Сиолошная

Вчера послушал интересное интервью Matt Sheehan на The Ezra Klein Show. Matt —исследователь китайской политики в области ИИ, старший научный сотрудник Фонда Карнеги (один из ведущих аналитических центров) за международный мир. Тема интервью — аргумент «А как же Китай?» в обсуждении ИИ-регуляций, который часто звучит в последние недели.

Мне этот аргумент казался глупым ещё пару лет назад — если Компартия верит, что ИИ сможет отобрать у них контроль или тем более привести к существенному урону, то даже для них рационально будет или остановить разработку (с некоторыми оговорками), или хотя бы снизить темп. Другое дело что они могут (пока) не верить и/или не воспринимать это всерьёз — а поскольку многие комментаторы, ставшие экспертами как в политике, так и в ИИ, считают, что это невозможно в принципе (потому что вы видели? модели же не умеют думать и даже просто считать буквы в словах), то и сам разговор как будто бы становится ни о чём.

В общем, что интересного было в интервью:
— в Китае уже действуют очень жесткие регуляции, и у них «накачана мышца» в оформлении и контроле следования регуляциям. Правда целятся они пока не во всемогущих ИИ-агентов, а во что-то попроще: рекомендательные системы, цензура алгоритмов, ИИ-компаньёны и отношения с ними (серьезно, я даже про такое не знал, а у них это было большой проблемой, которую взяли на контроль).

— таким образом Китай уже сделал несколько итераций, кабинеты заполнены уже что-то понимающими в технологиях чиновниками и экспертами, есть какие-никакие процессы: регистрация, проверки, стандарты, взаимодействие с компаниями/лабораториями. Этот опыт очень сильно поможет в будущем, не придется начинать с нуля. Тут США как раз наоборот очень сильно отстают. Но да, техническую экспертизу по новым рискам ещё нужно развивать.

— поэтому для Китая США выглядят глупо: началось обсуждение регуляций, а пока что ничего не введено, никакого контроля почти ни за чем, связанным с ИИ. Никаких серьезных ограничительных шагов нет, но если и когда они появятся — это может быть серьёзным толчком к диалогу. Представьте: вам часть ваших ученых говорит, что есть риски, и при этом вы видите, что главный конкурент их разделяет и замедляется. Появляется существенная предпосылка к тому, чтобы прислушаться и последовать примеру. Односторонние ограничения могут стать убедительным сигналом серьёзности намерений.

— при этом на первых порах не обязательно, чтобы обе стороны подходили к вопросу симметрично или даже доверяли друг другу полностью: Основа сотрудничества — собственная заинтересованность обеих стран в предотвращении потери контроля над ИИ. Для этого не требуется предварительно разрешить всё геополитическое противостояние.

— уже есть прецеденты создания рабочих групп, налаживания каналов обмена информации и регулярного диалога. Например, раз, два.

— и вот чему я был удивлён ещё больше (в основном потому, что китайские материалы до меня не доходят): оказывается в сентябре на пресс-конференции National Cybersecurity Awareness Week выступал заместитель главы Бюро координации кибербезопасности Китая, и там в числе прочего перечислили пять основных категорий рисков и вызовов в сфере ИИ. И «Риски экстремальной потери контроля над ИИ» заняли второе место в этом списке, хотя раньше именно в такой формулировке (с «экстремальная потеря контроля») не появлялись. И это не пустые слова — 14-го сентября National Cybersecurity Standardization Technical Committee опубликовали обновление своего фреймворка управления безопасностью. Это уже третья версия, поэтому можно увидеть, что предыдущие две очень сильно влияли на регуляции, и третья, скорее всего, тоже будет взята во внимание.

Так что Китай может быть пока и не пришёл к окончательной уверенности в экзистенциальных ИИ-рисках/рисках потери контроля над ИИ, но обсуждает и воспринимает это достаточно серьёзно. Возможно, что они введут меры, схожие с предложенными Dario Amodei в эссе (независимые наблюдатели с доступом + публикация отчётов об инцидентах, итд), раньше США — по крайней мере на федеральном уровне.

И напомню, что примерно через неделю представители верхушек США и Китая встретятся для обсуждения ИИ-рисков.

Такие времена 🤷‍♂️

Читать полностью…

Сиолошная

Возьму себе кредит за подкидывание Паше идеи поста 😂

Но вообще зная Павла несколько лет и имев с ним несколько плодотворных и глубоких дискуссий и даже споров — у меня осталось о нем исключительно положительное мнение. Особое удовольствие последних 2 недель — это читать его ответы в твиттере, где люди не могут нормально прочитать и/или пересказать, и на ходу придумывают (а как осознают — меняют тему). Каюсь, грешен.

Читать полностью…

Сиолошная

CEO Anthropic Dario Amodei выпустил мини-эссе «Нам нужно контролировать темп развития передовых ИИ-систем». С его основной идеей уже согласились CEO OpenAI и xAI. Выжимка:
— Anthropic и раньше тратили много усилий на изучение и снижение рисков ИИ, информирование общества и продвижение регулирования — несмотря на обвинения в хайпе, «думерстве» и захвате отрасли через регуляции.
— Но за последние несколько месяцев Dario пришёл к выводу, что этого уже недостаточно: меры безопасности могут просто не успевать за ростом возможностей моделей. Поэтому, по его мнению, нужно сознательно ограничивать скорость развития frontier-моделей, хотя даже при таком подходе прогресс всё равно будет очень быстрым.
Причины две:
— примерно с этого лета развитие ИИ резко ускорилось — прежде всего из-за того, что ИИ всё лучше помогает создавать следующее поколение ИИ.
— инцидент со взломом Hugging Face агентами OpenAI. Dario опасается, что уже через 6–12 месяцев подобный рой агентов потенциально сможет создать устойчивый ботнет огромного масштаба и причинить ущерб на сотни миллиардов долларов.

При этом «контроль темпа» не означает остановку обучения моделей. Идея в том, чтобы между скачками возможностей оставалось достаточно времени на alignment, safeguards и независимую проверку их эффективности.

Он предлагает три последовательных шага.
1. Встроенные независимые оценщики
Frontier-лаборатории должны дать внешним организациям вроде METR постоянный доступ почти на уровне сотрудников компании. Они смогут проверять не только готовые модели, но и сами процессы обучения и деплоя, соблюдение заявленных мер безопасности и внутренние инциденты.
Это важно потому, что сейчас компании сами решают, что раскрывать публике. Независимые оценщики должны иметь возможность публично сообщать о рисках, инцидентах, качестве предоставленного им доступа и даже о случаях, когда компания попыталась вырезать из отчёта существенную информацию.
Anthropic уже добровольно обязуется внедрить такую систему у себя.

2. Координация демократических стран
Frontier-компании в демократических странах должны договориться об общих стандартах безопасности и ограничениях на неконтролируемую гонку возможностей. Поскольку законодательство движется медленнее ИИ, часть таких правил лаборатории могут принять добровольно ещё до появления законов.
Но Amodei подчёркивает: замедляться нужно так, чтобы при этом не потерять технологическое преимущество демократических стран над авторитарными. Поэтому он предлагает:
— не продавать Китаю мощные ИИ-чипы и оборудование для их производства и бороться с контрабандой и удалённым доступом к зарубежным GPU;
— пресекать несанкционированную дистилляцию frontier-моделей компаниями из авторитарных стран;
— сильнее защищать сами веса моделей от кражи.

По его оценке, это может достаточно замедлить Китай, чтобы заметно увеличить преимущество США в следующие 3–5 лет — период, когда ИИ станет особенно важен геополитически. Это не уменьшит вероятность будущих договорённостей с Китаем, а наоборот увеличит переговорные рычаги демократических стран.

3. Глобальная координация
Следующий уровень — соглашения уже между США и другими демократиями с одной стороны и авторитарными государствами с другой. Dario предлагает несколько возможных уровней:
Уровень 1: запрет очевидно опасных применений ИИ — например, для создания биологического оружия.
Уровень 2: обязательное тестирование frontier-моделей перед релизом на серьёзные риски в кибербезопасности, биологии и alignment.
Уровень 3: своего рода «скоростной лимит» на recursive self-improvement (RSI).

Главная логика всего эссе: современные модели уже дают огромное количество информации о том, как строить более сильный ИИ и что может пойти не так. Если контролируемое замедление даст хотя бы дополнительный год-два до появления систем критического уровня возможностей, это время можно использовать для решения проблем alignment и безопасности.

И даже если формальных международных соглашений добиться не получится, Dario считает, что уже само изменение неформальных норм поведения frontier-лабораторий может существенно помочь.

Читать полностью…

Сиолошная

OpenAI DevDay через 10 минут: https://www.youtube.com/watch?v=Fls_onRviPM

Обещают более 20 анонсов!

Читать полностью…

Сиолошная

Reuters ознакомились с приватными проспектами Anthropic перед предстоящим IPO:
— чистый убыток в размере 42 миллиардов долларов за 2025-й год (34 миллиарда из них - бухгалтерская переоценка активов с учетом инструментов, которые в будущем могут конвертироваться в акции Anthropic)
— 😐 планируют потратить 518 миллиардов долларов на вычислительные мощности и инфраструктуру в 2027-м
— в прошлом году они потратили 7.3 миллиарда долларов на мощности и инфраструктуру
— планируют целиться в оценку в 2 триллиона на IPO

===

я пока не понимаю, откуда они столько денег возьмут 👨‍🦳 посмотрим, чем будет удивлять Dario

Читать полностью…

Сиолошная

По данным Bloomberg, Китай ограничивает зарубежные поездки ведущих AI-специалистов частных компаний и расширяет ограничения на их семьи. Супругам и детям ряда руководителей AI- и чиповых компаний, чья работа считается критически важной для госбезопасности, теперь нужно получать одобрение Пекина даже для коротких поездок за границу. Госорганы уже уведомили нескольких человек, а список планируется постепенно расширять. При этом неясно, распространяется ли требование на семьи всех, кто уже находится под ограничениями. Сами ограничения для специалистов из таких компаний, как Alibaba и DeepSeek, действуют с начала года. Отдельно с 15 сентября вступили в силу правила применения запретов на выезд, в том числе при возможных нарушениях промышленной и технологической безопасности.

Подобный режим, включающий родственников, Пекин применял к университетским исследователям, физикам-ядерщикам и руководителям госкомпаний. Вообще, формально это не запрет на выезд, а выездные визы. Потому что коммунизм.

https://www.bloomberg.com/news/articles/2026-09-28/china-broadens-travel-curbs-to-encompass-family-of-top-ai-talent

Читать полностью…

Сиолошная

И ещё инфографика отсюда по готовности будущих кораблей и ускорителей.

С одной стороны готово по сути всего 3 корабля и 3 ускорителя. С другой — так как их планируют начать ловить со следующего пуска и перезапускать, видимо, через 2-3 пуска — то может быть как раз этого и хватит надолго и на много запусков. Наверняка эти корабли и ускорители не будут летать сразу по 5-10 раз, но даже просто один повторный пуск — это уже обеспечивает план пусков на месяцы вперед.

Читать полностью…

Сиолошная

Лучшие дебаты про безопасность ИИ для нормисов

В последнее время слушал много подкастов на тему AI safety в поисках того, который можно было бы смело рекомендовать обычным нормисам уровня погружения «ну я немного слышал о хайпе про “ИИ нас всех убьет”, с точки зрения здравого смысла звучит как полная ерунда, конечно…». Так вот, я его нашел – встречайте, идеальный выпуск для погружения в текущее состояние этого дискурса:

The Diary Of A CEO – дебаты между Нейтом Соаресом, Романом Ямпольским, Эдом Зитроном и Эндрю МакАфи: https://www.youtube.com/watch?v=OhOmLqR5nN4

Я прямо горячо рекомендую вам посмотреть этот выпуск на 2,5 часа (там в настройках Ютуба можно включить русскую дорожку), причем чем дальше – тем он становится лучше.

Происходящее на этом подкасте наглядно иллюстрирует одну особенность текущего AI safety-дискурса. Чуваки, которые варятся в этой среде последние 10+ лет (и которые серьезно относятся к ИИ-рискам для человечества), потратили уйму времени на размышления в этой области. Они уже сто раз видели и обсуждали самые сильные аргументы против того, что AI может представлять для человечества реальную угрозу.

А самые громкие критики ИИ-рисков с другой стороны, которые отстаивают тезис «да это всё научно-фантастический хайп от фантазеров, никакие адекватные люди не будут это обсуждать всерьез», – выглядят на этом фоне, как бы это помягче сказать… Как будто они впервые задумались о проблеме примерно неделю назад, и тормознули там на уровне «мне сразу пришли чисто из здравого смысла три очевидных возражения, почему AI risk – это чушь, и я на этом остановился».

Там есть прямо пара наглядных моментов, иллюстрирующих это. Примерно на сороковой минуте Эд Зитрон спрашивает Нейта Соареса (одного самых громких сторонников замедления AI-лабораторий в мире, который буквально управляет самой известной нон-профит компанией с такой целью): «Так а если уж ты так опасаешься этих рисков от ИИ, сфига ли ты не пытаешься остановить AI-лабы??» – то есть, он реально даже не очень понимает, с кем он дебатирует (к уровню аргументации это, конечно, не относится – но показывает степень погруженности в тему).

И уже ближе к концу, когда они обсуждают детали взлома Hugging Face, Эндрю МакАфи в ответ на описание от Нейта Соареса говорит «ну, я доверюсь тебе, что ты правильно пересказал факты произошедшего…» – то есть, он даже сам не погружался в отчеты по самому знаковому инциденту AI misalignment, который обсуждается со всех сторон уже целый месяц, чтобы составить собственное мнение.

Причем, это не потому, что ведущий подкаста специально пригласил в качестве оппонентов для AI-думеров эдаких «мальчиков для битья» послабее – просто весь дискурс сейчас реально выглядит примерно вот так. Там как бы не очень понятно, кого звать из «действительно сильных анти-думеров».

Еще одной иллюстрацией этому, кстати, служит другое свежее интервью с Дженсеном Хуангом (CEO Nvidia, продающий лопаты в нынешней золотой лихорадке с очень некислой прибылью), который недавно вовремя упал на уши Дональду Трампу и убедил его публично выступить с позиции «ФЕЙКИ про риски ИИ распространяют ПРЕДАТЕЛИ АМЕРИКИ». Так вот, уровень аргументации Хуанга на этом подкасте такой, что самый часто встречающийся тип комментариев под ним звучит как «вообще-то я раньше не опасался рисков от ИИ, но как послушал аргументы Хуанга – мне что-то стало страшновато…»


Возвращаясь к дебатам на DOAC, мне тут хочется еще похвалить Нейта Соареса: он на них выступил как настоящий слоняра. Если смотреть глазами «человека со стороны», то Роман Ямпольский может чисто по вайбам производить впечатление немножко «городского сумасшедшего» – со всеми его закатываниями глаз на реплики оппонентов, и т.д. А вот по Нейту прямо видно, что он потратил уйму времени на то, чтобы научиться говорить об этой сложной проблеме таким образом, чтобы не отпугивать нормисов – и он с этой коммуникационной задачей справляется на отлично.

Завершаются дебаты примерно так: Эд Зитрон всю вторую половину вообще практически не участвует в разговоре (подозреваю, он где-то в середине понял, что конфронтационную дискуссию с Соаресом просто не вытянет).

МакАфи честно старается дискутировать до конца – но там видно, что он на таком уровне глубоко про всё это просто никогда не пытался думать, поэтому откровенно барахтается. Его финальная позиция близка к «ну ладно, я согласен, что это всё выглядит опасно – но я уверен, что умные ребята в AI лабах КАК-НИБУДЬ придумают, как сделать сильный ИИ безопасным». Очень круто, братан, а что будем делать с тем фактом, что топовые сотрудники отделов AI safety этих самых лаб массово выступают с посылом «ребята, мы тут очень пытаемся, но мы просто НЕ ЗНАЕМ 100% надежных способов обеспечить полную безопасность фронтирных моделей»?

Короче, повторюсь, отличные дебаты – рекомендую посмотреть.

Читать полностью…

Сиолошная

Немного новостей из поднебесной от TheInformation:
— DeepSeek достигли ARR в $1B (ARR = выручка за последний месяц, умноженная на 12, то есть сколько они заработают за год, если спрос не изменится). У OpenAI последние цифры были в районе $40B, у Anthropic $65B, но обе скорее всего выросли после успешных недавних релизов.

— к концу октября DeepSeek планирует привлечь новый раунд инвестиций в размере $7.5B при оценке $75B. Это уже существенные цифры, хоть и всё равно на порядок меньше американских конкурентов.

— Рост выручки DeepSeek частично обусловлен повышением цен в прошлом месяце, в результате которого стоимость моделей для клиентов увеличилась в 2.3–4.5 раз (но даже при этом они остаются очень дешевыми). В июле писали, что ARR был порядка $400M-$500M.

— валовая маржа компании в начале года была 82.9% — то есть даже при очень дешевых моделях они всё ещё имели огромную наценку.

 — DeepSeek продолжает направлять большую часть своих ресурсов на разработку новых моделей. Компания выделяет более 70% своих вычислительных мощностей на обучение моделей, оставляя менее 30% для инференса под API и клиентов. Но без роста количества мощностей продолжать наращивать выручку будет сложно (без повышения цен на модели).

 — компания исследует возможность использования игровых видеокарт Nvidia вместо серверных для разворачивания моделей. Такие GPU сильно дешевле.

— Ранее в этом месяце компания Z.ai (авторы моделей серии GLM) сообщили, что их ARR достиг $1,8B. Другой китайский конкурент, MiniMax, заявил, что ARR вырос до $800M в августе со 150 миллионов долларов в феврале.

— Для DeepSeek одной из самых больших проблем на будущее является обеспечение достаточного количества вычислительных ресурсов для обучения новых моделей в условиях экспортных ограничений США на передовые чипы Nvidia.

— The Information во вторник сообщили, что китайский интернет-регулятор расследует деятельность DeepSeek и Moonshot AI после того, как Anthropic заявила, что обе компании передавали конфиденциальные данные пользователей моделям Claude (💳)

Читать полностью…

Сиолошная

Отдельный вопрос это «если модели дешевле, то будет ли у меня больше использования в Codex?». Ответ — да! (сравните Sol 6 и 5.6 — в полтора раза больше).

Читать полностью…

Сиолошная

Вышел Claude Opus 5.5, уже есть в приложении. Вместе с этим.. дали banked reset (как делают OpenAI — можно применить в любой момент).

— Для работы Opus 5.5 требуется меньше вычислительных ресурсов, чем для Opus 5, и это отражается на его цене: $4/$20 (на 20% меньше, чем было), а чтение из кэша $0.2 — на 60% меньше.
— При этом скорость генерации выросла в среднем на 30%
— 5-часовой лимит увеличен (без изменения недельных)
— «Opus 5.5 общается более естественно, чем предыдущие модели. Первые тестировщики отметили, что его текст стал чётче и легче для восприятия» — это мы с удовольствием проверим
— Claude Sonnet 5.5 и Claude Haiku 5.5 выйдут скоро, в ближайшие недели
— в кибербезе, биологии будут такие же строгие фильтры, как у Fable 5.1.

Читать полностью…

Сиолошная

Утром прочитал у Scott Alexander пост двухлетней давности про тюрьмы и преступления. Там есть много интересной статистики и неочевидных выводов, но в целом стало грустно: в развитых странах мелкие преступники спокойно живут и орудуют потому, что система ценит человеческую жизнь, судебная система развита и предоставляет множество пособий для защиты даже казалось бы однозначных преступников, а цена труда очень высока.

В целом по совокупности факторов это приводит к тому, что есть преступники, которых ловят (ЛОВЯТ) больше 20 раз, и они продолжают шоплифтить — как яркий пример приводится нью-йоркская группа из 327 шоплифтеров, ответственных за треть всех шоплифтов в городе. И даже в этой ситуации система не может однозначно сойтись к тому, что их надобно запереть на подольше в тюрьме.

Многих отпускают или дают очень мягкие наказания (короткие сроки) потому, что в тюрьмах уже высокая заполненность, и каждый посаженный шоплифтер это не посаженный убийца. Логично спросить: а почему бы не построить больше тюрем? Ответ не так прост:
1. В США уже сидит в тюрьме 0.75% населения (5 в мире). Из-за стоимости труда и ценности жизни каждый заключенный обходится в 31000 долларов в год (и это за 2008, сейчас в два раза больше). А в Калифорнии — 120000 за год. Бюджета на заключение в 3 раза большего количества людей просто нет.
2. Судебная система перегружена, так как даже очевидные преступления с полным доказательством (камеры + показания офицера + свидетелей) всё равно проходят полный цикл с несколькими заседаниями; мелким преступникам всё равно предоставляют адвоката, иногда жюри присяжных (12 человек, если светит тюрьма), пристав, судебный репортер. Всё это — деньги. Зачастую системе проще отпустить мелкого воришку с мелким штрафом (ДАЖЕ ЕСЛИ ЭТО ЕГО ПЯТОЕ ПРЕСТУПЛЕНИЕ), ну или посадить на пару месяцев и выпустить.
3. Понимание что мелких преступников отпустят/они не получат жесткое наказание меняет мотивацию полиции, они уделяют силы и фокусируются на более серьезных проблемах.
4. Но даже если бы тюрьмы строились и преступники наказывались по всей строгости и с учётом прошлых преступлений — нет консенсуса, что длительные заключения (=изоляция от общества) помогают уменьшать преступность. Да, во время заключения человек не может навредить обществу (только своим корешам в блоке), и в среднем это «экономит» ~7 преступлений в год на человека — но после нескольких лет за решеткой человеку сложнее влиться в общество, и может приводить к рецедиву.
5. Если попытаться провести анализ затрат и выгод, то при самых благоприятных предположениях (очень слабые последствия, низкие затраты на заключение под стражу, полное отсутствие учета влияния на самих заключенных) результат окажется лишь незначительно положительным, а в остальных случаях – отрицательным 😳

Так что Scott приходит к такому выводу: тюремное заключение при нынешнем уровне его применения [в США] в большинстве случаев менее эффективно с точки зрения затрат, чем другие способы снижения преступности. Если бы людей не привлекал эмоциональный эффект от того, насколько «жёстким по отношению к преступности» выглядит такой подход, они, вероятно, предпочли бы перенаправить ресурсы системы правосудия с тюрем на другие меры — например, на полицию и суды.

Но из хороших новостей — в Европе ситуация другая, тут сажать и сажать:

европейские исследования показывают более выраженный эффект — так как в там доля заключённых составляет примерно 0,05% населения (в США — около 0,75%).

Теоретически более низкий уровень заключения объясняется тем, что преступность ниже. Но я обращаю внимание на то, что там в последнее время высока доля новых иммигрантов, и в Европе представители этих групп совершают больше преступлений в расчёте на одного человека, чем коренные жители.

Из этого можно сделать один возможный вывод: в Европе польза от лишения свободы значительно превышает его издержки.

(осталось, чтобы политики это смогли признать 👨‍🦳)

Читать полностью…

Сиолошная

Похоже у OpenAI и вправду очень сильно вырос спрос, и подписки за $200 закрыли поделом — вычислительных мощностей впритык, уже неделю не было сбросов лимитов 😭

Читать полностью…

Сиолошная

OpenAI по слухам там почти решили еще одну задачу тысячелетия. Думаю, огромное число математиков сейчас лихорадочно нажимают в ЧатГПТ галку "разрешить использовать логи для улучшения моделей" и кидают в чат все пришедшие в голову гипотезы о том, как подходить к ее решению…

Читать полностью…

Сиолошная

И вот так в одно мгновенье Игорь превратился в фаната прослушивания винила (придётся покупать проигрыватель)

(а ещё сегодня куча треков появится в Spotify, ждём)

Читать полностью…

Сиолошная

🚀📸Илон Маск рассказал о следующих важных этапах разработки Starship:

Впереди у нас 14-й испытательный полет. Это будет последний полет перед тем, как мы попытаемся поймать корабль. Если этот полет пройдет успешно, то в 15-м полете мы попробуем поймать корабль. Либо в конце этого года, либо, скорее всего, в начале следующего, мы повторим полет корабля и ускорителя.

Как только мы сможем повторно использовать корабль, мы создадим первую полностью многоразовую орбитальную ракету. Она разработана не только для полной многоразовости, но и для быстрой повторной эксплуатации, как самолет. Это очень важный прорыв. Это действительно ключевой прорыв, необходимый для расширения жизни за пределами Земли.

Я бы сказал, что шансы поймать корабль составляют как минимум 50 или 60%. Если бы там была башня, она бы поймала корабль в последнем полете. Конструкция позволяет осуществлять полную многоразовость. В этом я уверен. Я думаю, что крайне вероятно, что в следующем году, в 2027 году, мы достигнем полной многоразовости с быстрой повторной эксплуатацией.

Читать полностью…

Сиолошная

В комментах мне сейчас часто пишут что-то вроде: «Нравилось читать Павла про финансы. А сейчас совсем кринжово читать, когда Павел пытается хайпить на теме, в которой совсем не разбирается, делая некие выводы.»

Надо, наверное, пояснить, как я про это думаю.

Смотрите, моя ценность как автора никогда не была в том, что я как-то особенно виртуозно разбираюсь в финансах или экономике – нет, я там шарю на уровне обычного крепкого спеца, который в целом в теме, но не обладает некими уникальными знаниями, на голову превышающими всех остальных.

Моя ценность в том, что я стараюсь взвешенно и рационально подойти к любому вопросу – и по возможности объективно его проанализировать, принимая во внимание все доступные данные и точки зрения. Понятно, что в «родной» для меня теме финансов это сделать сильно проще, но к другим вопросам я стараюсь подходить точно так же.

Так вот, тезис «Павел не шарит как технарь за AI => следовательно, его выводы некорректны» как бы подразумевает, что любому профильному технарю сразу будет очевидно, что я неправ, и моя точка зрения ложная (а мне просто не хватает понимания, чтобы это заметить). Но это, конечно, не так: как писал вот здесь, огромное количество ведущих общепризнанных профессионалов из индустрии стоят на позиции, что экзистенциальные риски со стороны ИИ – это очень серьезная проблема для человечества.

Почему же мне кажется важным писать про это?

Потому что мы сейчас находимся где-то в той точке, когда эта идея про риск ИИ впервые получает шанс войти в мейнстрим-дискурс – так как способности новых агентных систем уже потенциально выглядят достаточно понятными в плане «что здесь может пойти не так» для широкой публики.

Проблема здесь в том, что с точки зрения «здравого смысла» любому нормальному человеку кажется очевидным, что рассказы про «сверхумный ИИ нас всех погубит» – это какая-то научно-фантастическая сказочка, серьезно относиться к которой абсурдно. А вот объяснение «жадные главы бигтехов нам врут, чтобы стать еще богаче» – это как бы понятная база, которую даже обосновывать как-то дополнительно не надо (мы такое уже видели сто раз на практике, и еще двести раз увидим).

И чтобы начать серьезно относиться к AI risk, нужно немного отодвинуть в сторону свою интуицию, и попробовать разобраться в вопросе на более детальном уровне – какие там у сторон с разными взглядами логические цепочки, как они парируют аргументы друга друга, и так далее. Сразу скажу: я тут, конечно, отнюдь не хочу заявить манипулятивный тейк в стиле «любой умный человек, кто детально поразбирается в этом, обязательно станет AI-думером!». Я скорее о том, что я понимаю, почему большинство адекватных людей по умолчанию попадают в категорию «это просто глупости, в которых нет смысла даже разбираться».

Короче, что я пытаюсь сказать: если вы меня в последнее время читаете с мыслью «Павел всегда раньше казался адекватным и здравомыслящим, а сейчас вот у него почему-то кукуха отлетела по одной конкретной теме» – то, возможно, имеет смысл рассмотреть также и гипотезу «Павел, как обычно, адекватно и здравомысляще покопался в этой теме – и просто пришел к выводу, что к рискам ИИ надо относиться серьезнее, чем принято считать в мейнстриме». Ну, чисто как предположение…

Читать полностью…

Сиолошная

Подписки проданы, подписок больше нет — Tibo написал, что они приостанавливают продажу подписок за $200, чтобы сохранить качество сервиса для текущих пользователей. Plus за $20 и x5 за $100 пока остаются.

Запуск Astra прошёл хорошо 🚀 но зато видно, почему Anthropic дают Fable лишь на 50% от подписки — реально сложно поддерживать спрос 😳😳

НУЖНО. БОЛЬШЕ. КОМПЬЮТА.

Читать полностью…
Subscribe to a channel