derplearning | Unsorted

Telegram-канал derplearning - Derp Learning

13183

Используем ИИ строго не по назначению. Заметки про ИИ, IT, компьютерные игры, и всякие инженерные интересности.

Subscribe to a channel

Derp Learning

Там исследователи из MIT выкатили свежий препринт. И препринт этот на мою любимую тему — симуляции для нейроночек.

Идея была такая: взять кучу изначально одинаковых LLM-агентов, засунуть их в общий виртуальный мир и проверить, смогут ли они сами организоваться и начать коллективно изобретать технологии, если не выдавать им готовые роли и не указывать конкретно кто чем должен заниматься.

Специально для этого запилили SwarmWorld, песочницу, где до 200 агентов ходят по карте, добывают и перерабатывают ресурсы, экспериментируют с материалами, строят всякие штуковины и даже могут писать код для автоматизации этих штуковин. Причём всё понастроенное одним агентом остаётся в мире и может быть найдено и улучшено другими агентами.

Главная фича: этому симулятору пофиг на на фантазии и галлюцинации модели: если скрипт кривой или не хватает ресурсов, ничего работать не будет.

Самое интересное, что устроили нейронки:

— Спонтанное разделение труда: без внешних указаний роботы сами разбились на группы. Одни всю жизнь бродили по карте разведчиками, а другие превратились в оседлых инженеров (сидели на базах и крафтили всякие нужные для выживания ништяки).

— От чата нет почти никакого толка: 95% культурного обмена происходило не через разговоры, а по принципу "шарился по миру, увидел чужую работающую установку/постройку, разобрался в устройстве и нагло спиздил форкнул код". Как на гитхабе.

— Наследование: скрипты передавались агентами из рук в руки, постепенно обрастая правками.


Итого мораль: чтобы у нейронок появилась какая-никакая цивилизация, им похоже, даже не нужно много разговаривать между собой. Достаточно общего мира, где каждый может оставить после себя что-нибудь полезное для следующего кремниевого болванчика.

Читать полностью…

Derp Learning

Не успел выйти Qwen3.8-flash-next,
Unsloth уже грузит кванты :D
(upload in progress)

https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF

Читать полностью…

Derp Learning

Полгода работы прошли не зря!
У нас (Keenable) публичный запуск.

Новый сайт: https://keenable.ai/
Новый бенч: https://keenableai.github.io/needle/
Твит: https://x.com/styskin/status/2092265673041084505

Пост про бенч будет на неделе. Ещё будет одна прикольная штука, которая называется Web Query Language.

Читать полностью…

Derp Learning

люблю когда есть свобода выбора

Читать полностью…

Derp Learning

Таким должен был быть трейлер к Red Alert 2!
Ладно, забирайте эту вашу оперативку. 6 минут 1080р.
Отдельно доставляет советская озвучка в исполнении китайских моделей.

x
автор:
https://www.douyin.com, lyxw1327

Читать полностью…

Derp Learning

Pixar logo achieved internally

Индусы упоролись и запилили роболампу

5 моторов, 45 светодиодов, rgb-d камера, мозги в виде raspberry pi

Пока это заскриптованные анимации, так что будем подождать.

Можно просто сделать из нее аватар для вашего чатбота, который будет поднимать свой плафон и пристально смотреть вам в глаза после особенно тупых вопросов.

Теплый ламповый ии.

Х

Читать полностью…

Derp Learning

🪿 Fast Food Memes

Читать полностью…

Derp Learning

Как заставить фанатов Вархаммера мыться.
Надо ещё аниме и марвел фигурки так же продавать, и на комик кон можно будет ходить без химзащиты

Читать полностью…

Derp Learning

MiniMax-H3 Turbo 4-Step


Вы просили турбированный H3?

Держите турбированный и запруненный четырех шаговый.

По ссылке есть воркфлоу и ссылка на оригинальный Minimax H3 Turbo.

https://huggingface.co/drbaph/MiniMax-H3-Turbo-Lora-ComfyUI

@cgevent

Читать полностью…

Derp Learning

#unrealneural #вайбмоделирование
TRELLIS 2 опубликовали в open source ⚡️

Microsoft открыли исходный код модели на 4 миллиарда параметров 👍🏻

Главное что открыты не только веса, но и весь код обучения. Можно дообучить на своей библиотеке ассетов и получить генерацию точно в стиле вашей студии.
Ещё один мощный шаг к настоящему AI 3D-продакшену ⚡️

https://github.com/microsoft/TRELLIS.2

Читать полностью…

Derp Learning

YC теперь при подаче предлагает просканить свой код чтобы набрать классы.

Сам скрипт\докер который они запускают явной малвари не содержит, но закидывает все ваши кодинг сессии куда-то в ллм через YC прокси, и потом заливает результат в бд YC, который там хранится, а не просто выдает вам модные карточки.

Ключи фильтруются по общим паттернам, но сам продукт, конечно, сомнительный, так как помимо саммари может закидывать куски чата целиком.

Финальный пейлоад несет куда больше, чем простую стату:
- До 2 000 символов LLM-сгенерированного описания для каждой сессии
- Первые 200 символов первого запроса каждой сессии
- До 10 000 символов тщательно отобранных ллм ключевых фрагментов для каждой сессии
- События сессии, включая текст, сообщения и команды, с ограничением до 2 000 символов на событие
- Поведенческие паттерны, включая повторяющиеся запросы и эмоционально окрашенные сообщения
- Временные метки сессий и названия моделей
- Git remote (если не используется агрегированный режим)
- Метаданные последних коммитов и их темы
- Метрики активности Git, включая количество изменённых строк и статистику по файлам
- Показатели качества кода
- Отредактированные (с удалением конфиденциальных данных) цепочки принятия решений и описания
- Информация об использовании инструментов, а также метаданные агентов и подагентов
- Базовая телеметрия, включая версию Ruby, продолжительность выполнения pipeline и суммарную статистику использования LLM
- Если это форк VSCode или это agentic slack bot, пропускает в YC автоматом.

тык

Читать полностью…

Derp Learning

Не для слабонервных: Жительница Польши довела робота-пылесоса до самоубийства.

Читать полностью…

Derp Learning

Фебловские жалкие 53.5 и опусовские неповторимые 53.4

Читать полностью…

Derp Learning

FLUX 3 political satire: ✅

a comics style flat video of an interview of donald trump on cnn. Trump says: "Nobody knows text-to-video models better than me, believe me. The engineers come up to me with tears in their eyes and say, Sir, we've never seen prompts this incredible,' and I say, That's because we make the videos tremendous. Everyone else is generating clips—I'm generating masterpieces, folks. Absolute masterpieces."

Читать полностью…

Derp Learning

Есть доступ к Flux3 text2video, кидайте промты на английском в комменты
лайк, шер, алишер

контент может быть спижжен в канал :D

Читать полностью…

Derp Learning

GLM-5.3-flash (320b): выходит
Qwen-3.8-flash-next (125+51b A6b):

Читать полностью…

Derp Learning

Huggingface у нас дома (в Поднебесной) - modelscope тизерит новый qwen3.8-next-flash.
На хф анонс тоже есть, но детали с китайского они перевести поленились 🫠

Судя по всему это будет мультимодальный МоЕ на архитектуре qwen4.

Возможно, 125b A6b + 51b ngram embedding - возможно будет нативная поддержа видео.

Хотя ее заявляют как тизер новой архитектуры, так что может будет и что-то мелкое на 9-13-27б.

X
Hf
git

Читать полностью…

Derp Learning

DFlash2 Qwen3.8-27b: 36.77 t/s / 100k ctx -> 52.15 t/s / 95k ctx
+40% скорости за 5% контекста


Еще интересный подход - взять драфтер токенов не из самого чекпоинта, а DFlash2 отсюда -
Qwen3.8-27B-DFlash2-GGUF

Для этого придется собрать llama.cpp:

git clone https://github.com/ggml-org/llama.cpp.git
cd llama.cpp
git fetch origin pull/27342/head:pr-27342
git switch pr-27342

# NVIDIA CUDA
cmake -B build -DCMAKE_BUILD_TYPE=Release -DGGML_CUDA=ON
cmake --build build -j

# Apple Silicon
cmake -B build -DCMAKE_BUILD_TYPE=Release -DGGML_METAL=ON
cmake --build build -j


Зато потом получаем вместо 36.77 t/s / 100k ctx -> 52.15 t/s / 95k ctx
+40% скорости за 5% контекста

llama-server.exe -m "Qwen3.8-27B-UD-Q3_K_XL.gguf" -md "Qwen3.8-27B-DFlash2-Q4_K_M.gguf" --alias qwen38 --port 8080 --ctx-size 95536 -ngl 99 -ngld 99 -fa on --cache-type-k q4_0 --cache-type-v q4_0 --jinja --reasoning-effort medium --no-context-shift --cache-reuse 256 --spec-type draft-dflash --spec-draft-n-max 3 -b 2048 -ub 512 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --tools all --parallel 1

Читать полностью…

Derp Learning

Наконец дошли руки поковырять Qwen 3.8-27b

Как говорится, мое увожение.

На мои 16гб комфортно влез Qwen3.8-27B-UD-Q3_K_XL от unsloth

--ctx-size 100535 -ngl 99 -fa on --cache-type-k q4_0 --cache-type-v q4_0 --jinja --reasoning-effort medium --no-context-shift --cache-reuse 256 --spec-type draft-mtp --spec-draft-n-max 1 -b 2048 -ub 512 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --tools all

выдает 36.77 t/s с контекстом 100535

Еще есть интересный дистилл Qwen3.8-2.4T-A95B -> Qwen 3.5 9b
Понятно, что сильно умнее qwen 3.5 не стал, это скорее тюн для тулколлинга.
С Qwen3.8-9B-Q8_0 и конфигом

--ctx-size 262144 -ngl 99 -fa on --cache-type-k q8_0 --cache-type-v q8_0 --jinja --reasoning-effort low --no-context-shift --cache-reuse 256 --spec-type draft-mtp --spec-draft-n-max 3 -b 2048 -ub 512 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --tools all

выдает 85-110 t/s с контекстом 262144 (I'm stupid faster)

В llama.cpp ui / aider ваншотят игры вроде scorched earth, но 9b модель чаще спотыкается и любит заloopиться.
Можно гонять и через claude code/codex, но codex тыкается в новый более сырой апи как слепой котенок и одним своим системным промтом сжирает 20к+ токенов :D

Можно генерить план имплементации с Qwen3.8-27B-UD-Q3_K_XL а потом имплементировать Qwen3.8-9B-Q8_0

llama.cpp тут

Читать полностью…

Derp Learning

Кто такой этот ваш майор Аутаж и почему он мешает мне вайбкодить

Читать полностью…

Derp Learning

🍿 Fast Food Memes

Читать полностью…

Derp Learning

прислал(а) vlad | chiki через @svejaquebot

Читать полностью…

Derp Learning

На самом деле во вселенной Warhammer 40k нет никакого карго культа утраченного знания. Просто 23 тысячи лет все человечество вайбкодило в прод без гита, с документацией, которую никто не читал.
/goal design a warp drive for space travel make no mistakes

Потом клод код отключили, понабрали джунов-сервиторов и теперь пытаются разобраться в этом нейрослопе, чтобы понять, как все на самом деле работает.

Читать полностью…

Derp Learning

Парень вернул курицам хвосты, чтобы они снова ходили как динозавры.

Современные птицы, включая кур, являются единственными ныне живущими динозаврами. Их предки имели длинный костный хвост, который в ходе эволюции сильно укоротился и почти исчез.

Поэтому изобретатель Аллен Пэн решил это исправить и создал для курицы специальный киберхвост. Благодаря этому она сразу начала держать корпус ровнее, компенсируя смещённый центр тяжести, и передвигаться почти как динозавр. Причём наличие хвоста она даже не замечала.

Теперь у нас есть кибердинозавровые курицы. Потрясающе
r/#nextfuckinglevel

Читать полностью…

Derp Learning

Интервью с СТО Skyeng

Вы не понимаете, это другое

твит

Читать полностью…

Derp Learning

Build Formula 1 car, make no mistakes

Твитторские снова упоролись и натравили Claude 5 Opus Ultrathink на блендер mcp

Совсем кад это конечно не заменит, потому что кому охота потом переделывать косяки, но для энтузиастов и хобби пойдет.

10 часов, 50 агентов и 10 миллионов токенов спустя:

твит

Читать полностью…

Derp Learning

софткор порно с цветами в жалком стремлении уподобиться /channel/heyshvets : чек

Читать полностью…

Derp Learning

По итогам первого дня тестирования FLUX 3

Главное - цензура очень вялая. В сравнении с релизным seedance2, который отказывался генерить при слове gun, ее практически нет.

Явно есть какой-то промт- фильтр\препроцессор, так как в политических промтах добавляются всякие сгенеренные вотермарки, может пропасть звук (явно на уровне промта)

Иногда звука нет, иногда он в рассинхроне - не понятно, генерится он той же моделью или в отдельный проход.

Генерация text2video+speech работает хорошо на разных языках.

Вчера были доступны генерации только в 480р, сегодня уже можно 720р
Лимитов на количество генераций нет, муахахах.

За промты спасибо папищекам

Читать полностью…

Derp Learning

Llm providers circle jerk, family friendly edition

Читать полностью…

Derp Learning

Когда нечего почитать перед сном

Читать полностью…
Subscribe to a channel