13183
Используем ИИ строго не по назначению. Заметки про ИИ, IT, компьютерные игры, и всякие инженерные интересности.
Там исследователи из MIT выкатили свежий препринт. И препринт этот на мою любимую тему — симуляции для нейроночек.
Идея была такая: взять кучу изначально одинаковых LLM-агентов, засунуть их в общий виртуальный мир и проверить, смогут ли они сами организоваться и начать коллективно изобретать технологии, если не выдавать им готовые роли и не указывать конкретно кто чем должен заниматься.
Специально для этого запилили SwarmWorld, песочницу, где до 200 агентов ходят по карте, добывают и перерабатывают ресурсы, экспериментируют с материалами, строят всякие штуковины и даже могут писать код для автоматизации этих штуковин. Причём всё понастроенное одним агентом остаётся в мире и может быть найдено и улучшено другими агентами.
Главная фича: этому симулятору пофиг на на фантазии и галлюцинации модели: если скрипт кривой или не хватает ресурсов, ничего работать не будет.
Самое интересное, что устроили нейронки:
— Спонтанное разделение труда: без внешних указаний роботы сами разбились на группы. Одни всю жизнь бродили по карте разведчиками, а другие превратились в оседлых инженеров (сидели на базах и крафтили всякие нужные для выживания ништяки).
— От чата нет почти никакого толка: 95% культурного обмена происходило не через разговоры, а по принципу "шарился по миру, увидел чужую работающую установку/постройку, разобрался в устройстве и нагло спиздил форкнул код". Как на гитхабе.
— Наследование: скрипты передавались агентами из рук в руки, постепенно обрастая правками.
Итого мораль: чтобы у нейронок появилась какая-никакая цивилизация, им похоже, даже не нужно много разговаривать между собой. Достаточно общего мира, где каждый может оставить после себя что-нибудь полезное для следующего кремниевого болванчика.
Не успел выйти Qwen3.8-flash-next,
Unsloth уже грузит кванты :D
(upload in progress)
https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF
Полгода работы прошли не зря!
У нас (Keenable) публичный запуск.
Новый сайт: https://keenable.ai/
Новый бенч: https://keenableai.github.io/needle/
Твит: https://x.com/styskin/status/2092265673041084505
Пост про бенч будет на неделе. Ещё будет одна прикольная штука, которая называется Web Query Language.
Таким должен был быть трейлер к Red Alert 2!
Ладно, забирайте эту вашу оперативку. 6 минут 1080р.
Отдельно доставляет советская озвучка в исполнении китайских моделей.
x
автор:
https://www.douyin.com, lyxw1327
Pixar logo achieved internally
Индусы упоролись и запилили роболампу
5 моторов, 45 светодиодов, rgb-d камера, мозги в виде raspberry pi
Пока это заскриптованные анимации, так что будем подождать.
Можно просто сделать из нее аватар для вашего чатбота, который будет поднимать свой плафон и пристально смотреть вам в глаза после особенно тупых вопросов.
Теплый ламповый ии.
Х
Как заставить фанатов Вархаммера мыться.
Надо ещё аниме и марвел фигурки так же продавать, и на комик кон можно будет ходить без химзащиты
MiniMax-H3 Turbo 4-Step
Вы просили турбированный H3?
Держите турбированный и запруненный четырех шаговый.
По ссылке есть воркфлоу и ссылка на оригинальный Minimax H3 Turbo.
https://huggingface.co/drbaph/MiniMax-H3-Turbo-Lora-ComfyUI
@cgevent
#unrealneural #вайбмоделирование
TRELLIS 2 опубликовали в open source ⚡️
Microsoft открыли исходный код модели на 4 миллиарда параметров 👍🏻
Главное что открыты не только веса, но и весь код обучения. Можно дообучить на своей библиотеке ассетов и получить генерацию точно в стиле вашей студии.
Ещё один мощный шаг к настоящему AI 3D-продакшену ⚡️
https://github.com/microsoft/TRELLIS.2
YC теперь при подаче предлагает просканить свой код чтобы набрать классы.
Сам скрипт\докер который они запускают явной малвари не содержит, но закидывает все ваши кодинг сессии куда-то в ллм через YC прокси, и потом заливает результат в бд YC, который там хранится, а не просто выдает вам модные карточки.
Ключи фильтруются по общим паттернам, но сам продукт, конечно, сомнительный, так как помимо саммари может закидывать куски чата целиком.
Финальный пейлоад несет куда больше, чем простую стату:
- До 2 000 символов LLM-сгенерированного описания для каждой сессии
- Первые 200 символов первого запроса каждой сессии
- До 10 000 символов тщательно отобранных ллм ключевых фрагментов для каждой сессии
- События сессии, включая текст, сообщения и команды, с ограничением до 2 000 символов на событие
- Поведенческие паттерны, включая повторяющиеся запросы и эмоционально окрашенные сообщения
- Временные метки сессий и названия моделей
- Git remote (если не используется агрегированный режим)
- Метаданные последних коммитов и их темы
- Метрики активности Git, включая количество изменённых строк и статистику по файлам
- Показатели качества кода
- Отредактированные (с удалением конфиденциальных данных) цепочки принятия решений и описания
- Информация об использовании инструментов, а также метаданные агентов и подагентов
- Базовая телеметрия, включая версию Ruby, продолжительность выполнения pipeline и суммарную статистику использования LLM- Если это форк VSCode или это agentic slack bot, пропускает в YC автоматом.
тык
Не для слабонервных: Жительница Польши довела робота-пылесоса до самоубийства.
Читать полностью…
Фебловские жалкие 53.5 и опусовские неповторимые 53.4
Читать полностью…
FLUX 3 political satire: ✅
a comics style flat video of an interview of donald trump on cnn. Trump says: "Nobody knows text-to-video models better than me, believe me. The engineers come up to me with tears in their eyes and say, Sir, we've never seen prompts this incredible,' and I say, That's because we make the videos tremendous. Everyone else is generating clips—I'm generating masterpieces, folks. Absolute masterpieces."
Есть доступ к Flux3 text2video, кидайте промты на английском в комменты
лайк, шер, алишер
контент может быть спижжен в канал :D
GLM-5.3-flash (320b): выходит
Qwen-3.8-flash-next (125+51b A6b):
Huggingface у нас дома (в Поднебесной) - modelscope тизерит новый qwen3.8-next-flash.
На хф анонс тоже есть, но детали с китайского они перевести поленились 🫠
Судя по всему это будет мультимодальный МоЕ на архитектуре qwen4.
Возможно, 125b A6b + 51b ngram embedding - возможно будет нативная поддержа видео.
Хотя ее заявляют как тизер новой архитектуры, так что может будет и что-то мелкое на 9-13-27б.
X
Hf
git
DFlash2 Qwen3.8-27b: 36.77 t/s / 100k ctx -> 52.15 t/s / 95k ctx
+40% скорости за 5% контекста
Еще интересный подход - взять драфтер токенов не из самого чекпоинта, а DFlash2 отсюда -
Qwen3.8-27B-DFlash2-GGUF
Для этого придется собрать llama.cpp:
git clone https://github.com/ggml-org/llama.cpp.git
cd llama.cpp
git fetch origin pull/27342/head:pr-27342
git switch pr-27342
# NVIDIA CUDA
cmake -B build -DCMAKE_BUILD_TYPE=Release -DGGML_CUDA=ON
cmake --build build -j
# Apple Silicon
cmake -B build -DCMAKE_BUILD_TYPE=Release -DGGML_METAL=ON
cmake --build build -j
llama-server.exe -m "Qwen3.8-27B-UD-Q3_K_XL.gguf" -md "Qwen3.8-27B-DFlash2-Q4_K_M.gguf" --alias qwen38 --port 8080 --ctx-size 95536 -ngl 99 -ngld 99 -fa on --cache-type-k q4_0 --cache-type-v q4_0 --jinja --reasoning-effort medium --no-context-shift --cache-reuse 256 --spec-type draft-dflash --spec-draft-n-max 3 -b 2048 -ub 512 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --tools all --parallel 1
Читать полностью…
Наконец дошли руки поковырять Qwen 3.8-27b
Как говорится, мое увожение.
На мои 16гб комфортно влез Qwen3.8-27B-UD-Q3_K_XL от unsloth --ctx-size 100535 -ngl 99 -fa on --cache-type-k q4_0 --cache-type-v q4_0 --jinja --reasoning-effort medium --no-context-shift --cache-reuse 256 --spec-type draft-mtp --spec-draft-n-max 1 -b 2048 -ub 512 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --tools all
выдает 36.77 t/s с контекстом 100535
Еще есть интересный дистилл Qwen3.8-2.4T-A95B -> Qwen 3.5 9b
Понятно, что сильно умнее qwen 3.5 не стал, это скорее тюн для тулколлинга.
С Qwen3.8-9B-Q8_0 и конфигом --ctx-size 262144 -ngl 99 -fa on --cache-type-k q8_0 --cache-type-v q8_0 --jinja --reasoning-effort low --no-context-shift --cache-reuse 256 --spec-type draft-mtp --spec-draft-n-max 3 -b 2048 -ub 512 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --tools all
выдает 85-110 t/s с контекстом 262144 (I'm stupid faster)
В llama.cpp ui / aider ваншотят игры вроде scorched earth, но 9b модель чаще спотыкается и любит заloopиться.
Можно гонять и через claude code/codex, но codex тыкается в новый более сырой апи как слепой котенок и одним своим системным промтом сжирает 20к+ токенов :D
Можно генерить план имплементации с Qwen3.8-27B-UD-Q3_K_XL а потом имплементировать Qwen3.8-9B-Q8_0
llama.cpp тут
Кто такой этот ваш майор Аутаж и почему он мешает мне вайбкодить
Читать полностью…
На самом деле во вселенной Warhammer 40k нет никакого карго культа утраченного знания. Просто 23 тысячи лет все человечество вайбкодило в прод без гита, с документацией, которую никто не читал.
/goal design a warp drive for space travel make no mistakes
Потом клод код отключили, понабрали джунов-сервиторов и теперь пытаются разобраться в этом нейрослопе, чтобы понять, как все на самом деле работает.
Парень вернул курицам хвосты, чтобы они снова ходили как динозавры.
Современные птицы, включая кур, являются единственными ныне живущими динозаврами. Их предки имели длинный костный хвост, который в ходе эволюции сильно укоротился и почти исчез.
Поэтому изобретатель Аллен Пэн решил это исправить и создал для курицы специальный киберхвост. Благодаря этому она сразу начала держать корпус ровнее, компенсируя смещённый центр тяжести, и передвигаться почти как динозавр. Причём наличие хвоста она даже не замечала.
Теперь у нас есть кибердинозавровые курицы. Потрясающе
r/#nextfuckinglevel
Интервью с СТО Skyeng
Вы не понимаете, это другое
твит
Build Formula 1 car, make no mistakes
Твитторские снова упоролись и натравили Claude 5 Opus Ultrathink на блендер mcp
Совсем кад это конечно не заменит, потому что кому охота потом переделывать косяки, но для энтузиастов и хобби пойдет.
10 часов, 50 агентов и 10 миллионов токенов спустя:
твит
софткор порно с цветами в жалком стремлении уподобиться /channel/heyshvets : чек
Читать полностью…
По итогам первого дня тестирования FLUX 3
Главное - цензура очень вялая. В сравнении с релизным seedance2, который отказывался генерить при слове gun, ее практически нет.
Явно есть какой-то промт- фильтр\препроцессор, так как в политических промтах добавляются всякие сгенеренные вотермарки, может пропасть звук (явно на уровне промта)
Иногда звука нет, иногда он в рассинхроне - не понятно, генерится он той же моделью или в отдельный проход.
Генерация text2video+speech работает хорошо на разных языках.
Вчера были доступны генерации только в 480р, сегодня уже можно 720р
Лимитов на количество генераций нет, муахахах.
За промты спасибо папищекам
Llm providers circle jerk, family friendly edition
Читать полностью…