21623
Авторский канал про сервисы и технологии IT и AI, которые могут упростить (или не совсем) жизнь. Пишу только то, что сам считаю интересным. Автор: @igortru Информация по рекламе: @tipsprbot
Я тоже получил доступ к Jev, потестил, и выглядит он действительно интересно
Сразу решил попробовать плагин fast-jev-compaction, чтобы ускорять и удешевлять компакцию чата в Claude Code
Вы же знаете да, что у каждого чата есть контекстное окно, которое забивается вызовами тулов (прочитанные файлы, вывод grep, логи и тд)
Соответственно когда окно кончилось агент запускает компакцию, то есть просит отдельную модель сделать саммари чата
Минусы: медленно, дорого, плюс LLM может выкинуть что-то важное, или наооборот забить саммари лишним контекстом
Вот тут идеально подходит принцип работы Jev!!
Гляньте видео к посту с визуализацией. Он проходится по каждому вызову в чате, и оценивает вероятность "на сколько это важно"
Если вероятность выше порога, то оставляет, ниже — выкидывает (или меняет на заглушку)
То есть это:
1 Быстрее. Ибо Jev генерит числа а не текст, и оценивает все вопросы параллельно
2 Дешевле. Например контекст в 1M токенов будет стоить около $0.04
Если что у них на сайте даются бесплатные $5, как месячная квота для API вызовов
Сразу дисклеймер: насколько такая компакция лучше обычной, сказать не могу, ибо Jev видит только сами вызовы, без их результатов
+ надо учитывать, что у самого Jev маленькое контекстное окно, 32к, так что чаты 150к+ токенов придется разбивать на куски
Но как тест было неплохо) Теперь вот думаю что еще можно с ним ускорить 🌟
@tips_ai #tools
30 сентября приглашаем на АЛЬФА ВААА{АИ}ЙЙЙБ МИТАП — масштабное событие про нейросети и вайб-кодинг. Узнаем, кто из финалистов АЛЬФА ВААА{АИ}ЙЙЙБ ХАКАТОНА получит миллион за проект высоконагруженного прокси.
В программе — техно-рейв с группой ЛАУД и ток-шоу про ИИ. Встречаемся в Москве на модной площадке Альфа-Кристалле или онлайн — главное зарегистрироваться.
Уже видели что там вышла какая-то новая ии-модель Jev?
Не мог такое пропустить, потратил время чтобы самому разобраться и пересказать вам понятным языком:
TL;DR Вышла новая ИИ-модель, которая вместо текста выдаёт готовые решения с оценкой уверенности, в 200 раз быстрее и дешевле обычных LLM, но это скорее очень умный классификатор, чем замена GPT и Claude.
claude plugin marketplace add typesafe-ai/skills
Забавный факт: macOS хранит на локальном диске инфу о всей вашей активности за компом
С точностью до секунды, какие приложения открываете, какие уведомления приходят, какие устройства подключены и тд
Можно покопаться с агентом и найти для себя какие-то полезные инсайты:
[MACOS] Посмотри ~/Library/Application Support/Knowledge/knowledgeC.db и расскажи мне несколько интересных фактов
[WINDOWS] Разбери UserAssist, папку Recent, историю PowerShell, базу уведомлений и журнал System, а если ты от администратора, то ещё и SRUM, и расскажи мне несколько интересных фактов о том, как я пользуюсь этим компьютером
Наткнулся на сайт с интерактивной картой мира, где расположены все YC стартапы запущенные за последние 20 лет
Можно искать по нише, локации, статусу, университету и прошлому месту работы
Ссылка: dashboard.vclense.ch/ycglobe
Если вдруг захочется поресерчить свою нишу или найти коннект с соседними фаундерами 🌎
@tips_ai #tools
OpenAI обновили свой генератор картинок, Images 2.5
Теперь там две разные модели:
1/ Flare — быстрая универсальная модель которая сейчас доступна в ChatGPT
2/ Sunburst — более качественная и точная, доступна только по API
Улучшили генерацию текста, лучше сохраняет лица и объекты и стабильнее переживает длинные цепочки правок
В 1,5 раза быстрее прошлой Image 2
У обеих моделей теперь есть 6 режимов качества: low, medium, high, xhigh, max, auto
Теперь можно настраивать кастомное разрешение, например 1536x864 (и максимум 3840 px)
Но большинство этих фич пока только в API(
Прикрепил несколько черрипиков, что думаете?
Если сравнивать то что получается в ChatGPT с той же нанобананой, то лично мне не очень понятно в чем апгрейд..
@tips_ai #news
Давно хотел поставить себе прогу которая показывает лимиты и когда они сбрасываются
Но всё что видел либо перегружено кучей лишний фич, либо привязано к физической чёлке мака, а у меня там уже другая прога
Вот наконец-то: codenotch
Легкий опенсурс, с понятным интерфейсом, и что самое главное для меня, можно менять положение (сверху, снизу, справа, слева)
Для каждого ии показывает:
- сколько лимита использовано
- когда будет сброс
- какие агенты сейчас работают
- несколько аккаунтов Claude отдельно
Я один только сегодня узнал что Codex по дефолту может запускать максимум 3 субагента одновременно?
Хотя помню что в презентации Astra, она оркестрировала сразу 64 субагента
Так что скопируйте это в config.toml:
[agents]
max_concurrent_threads_per_session = 64
Кстати у Gemini же вышел новый режим обработки видео, и вот как подключить его к Codex или Claude:
1. Создайте бесплатный апи-ключ в Google AI Studio
2. Попросите своего агента создать скилл с этим промтом (не помещается в пост)
Теперь если скинуть клоду или кодексу видео, он используя этот скилл вызовет официальный google-genai SDK, отправит Gemini видео и промт что нужно сделать, а Gemini обработает видео и отдаст обратно результат
@tips_ai #tools
Cloud.ru подготовили бесплатный гайд «ИИ на практике: от чата до агента» для тех, кто хочет перейти от простых запросов в чат к созданию собственного ИИ-агента.
Гайд подойдет менеджерам, маркетологам, аналитикам, предпринимателям, HR и всем, кто хочет понять ИИ без погружения в код:
▶️ИИ, LLM, RAG, MCP простыми словами
▶️как правильно писать промпты
▶️как собрать простого ИИ-агента без кода
▶️как передать ИИ рутину
▶️Бонус: инструкция по созданию ИИ-агента
📌 Гайд можно скачать бесплатно здесь
Пока Claude и Codex не работает, хочу сказать, что совсем скоро я буду выступать на большой конференции по AI-юзкейсам и AI-скиллам
Формат простой и интересный для меня: расскажем про свой опыт использования AI в работе и бизнесе, где будут продакты, маркетологи, инженеры и основатели из:
• Revolut
• DoorDash
• Yandex
• Т-банк
• Nebius
• Plata
• Whisper AI
• и другие
Старт 8 сентября в 17:00 CET (18:00 МСК), идёт три дня. Всё бесплатно и без подписок на десяток каналов ради доступа ;)
Регистрация и расписание тут ☕️
@tips_ai
Так, давайте еще поговорим про GEO (Generative Engine Optimization) - продвижение бренда в ответах нейросетей, аналог SEO для ИИ.
Но попасть в ответы нейросетей — только половина задачи. Ещё нужно понимать, где и как часто бренд там появляется.
Каждый раз прогонять бренд по ChatGPT, Perplexity, Claude и остальным моделям, отслеживая позиции, муторно.
Нашел интересный проект ГЕОранк. Он собирает аналитику по основным нейросетям в один дашборд. Видно, по каким запросам всплывает бренд, на фоне каких конкурентов, откуда модели берут о нем информацию и где позиционирование считывается криво. Из приятного, в списке есть локальные модели, которые западные сервисы не покрывают, а для бизнеса в СНГ это половина картины.
Механика простая. Заводишь свой продукт, добавляешь конкурентов и сегменты аудитории, а дальше загружаешь пользовательские запросы, хоть сотню, придуманные руками или нейронкой. Сервис прогоняет их по моделям и показывает, на какие вопросы нейросети рекомендуют людям тебя, а на какие только конкурентов. Рядом отдельная вкладка с подсказками, как это присутствие нарастить.
Волшебной кнопки там нет, залить бренд в нейросети не получится. Сервис показывает дыры, а закрывать их придется контентом и упоминаниями. Но без замера вся эта GEO-возня превращается в гадание.
Так что если хочется узнать, что нейросети рассказывают о вашем бренде, начать мониторинг можно тут
Тут новые графики у Антропиков, красиво ☕️
Выкатили Claude Fable 5.1 и Mythos 5.1.
Fable так же будет доступен всем, а Mythos выдают по программам проверенного доступа для кибербезопасности и биологии.
Работа с Fable 5.1 подешевела примерно на 25% на обычных задачах и до 45% на агентных.
При этом сами тарифы не трогали: вход как был $10 за миллион токенов, выход $50. Подешевело только чтение из кэша, было $1 за миллион, стало $0.25.
Разница в итоговом счёте будет заметная, потому что кэш и есть основная его часть: на обычных задачах около 40%, а на агентных все 65%. Агент же таскает с собой один и тот же контекст на каждом шаге.
@tips_ai #news
Пятница, самое время посмотреть куда мы тратили больше всего токенов на этой неделе 😏
Для Claude Code есть супер скилл, который разбирает логи сессий и на основе API запросов считает расход токенов
Собирает всё это в красивый понятный HTML отчётик
С разбивкой по времени, проектам, моделям, файлам, MCP-серверам, скиллам, субагентам и тд
Несколько примеров как юзать:/tare report [дней] — отчёт с графиками/tare usage — аналог клодовского /usage/tare share [дней] — обезличенная .md сводка чтобы шерить
Есть еще интересная статистика amplified tokens, когда изначально маленький файл переиспользовался внутри контекста столько раз что в итоге стал дорогим
Установка (GitHub):
npx skills add kelviq/tare
Знаете, я пишу про инструменты ИИ, но никогда не пишу, что при этом происходит с компаниями и людьми внутри.
Ведь даже в эру ИИ (и тем более в эру ИИ) компании делают сильные люди и культура.
Интересный пост в этом контексте увидел у Лены Черниковой: /channel/heyho_chernikova/1517
Всё меняется так быстро, что планы на годы вперёд не работают. Поэтому ценят людей, готовых переучиваться и менять роль.
Вообще рекомендую её канал. Она основатель Invisible Force, PhD и исследователь.
Делится управленческим опытом, до которого сложно дотянуться самостоятельно, и даёт практики и инструменты, которые можно унести себе в работу.
Курсов и продаж там нет, и фасада безупречного эксперта тоже: пишет, как не смогла уйти в саббатикал и как иногда хочется просто пострадать.
Подписывайтесь: @heyho_chernikova
#промо
Поставил себе на iPhone новое приложение для уведомлений от CLI-агентов
Это опенсурс, называется Buzz (не перепутайте с их другим продуктом)
Через него клод, кодекс и другие агенты могут отправлять на телефон пуши:
- когда выполнил задачу
- если нужен апрув или есть вопрос
- вылезла ошибка (timeout, API rate limit и тд)
И отдельно агенты могут спавнить виджет с прогресс-баром и статусом на заблокированном экране и в островке
По HTTP, то есть агенту и телефону не обязательно быть в одной сети
Уведомления приходят автоматом, а вот когда обновлять прогресс агент решает сам, так что попросите его еще:
Поставь скилл для Buzz, включи "finished": true, и всегда показывай/обновляй прогресс через скилл buzz.
Оказывается у Google Chrome есть неплохой набор скиллов для агентов, чтобы улучшить качество ваших сайтов
https://developer.chrome.com/docs/modern-web-guidance
Там описаны знания по типу:
- как юзать нативные HTML/CSS-фичи вместо лишнего JS
- делать быстрый и адаптивный UI
- не ломать кроссбраузерность
- модернизировать легаси без лишних костылей и тд.
В общем 100+ сценариев использования
Установить скилл:
npx modern-web-guidance@latest install
В Claude Code теперь можно создавать кастомные моды
Похоже это следующая версия уже существующих внешних скриптов (хуков)
Только в отличии от хуков, моды интегрированы внутрь CC, могут рисовать свои интерфейсы прям внутри терминала и влиять почти на любое действие агента
Судя по issue на github антропиков, фича всё еще готовится, в релизе её пока нет
Но попробовать всё равно можно, включите в settings.json этот экспериментальный флаг:
CLAUDE_CODE_ENABLE_FUNCTION_HOOKS": "1"
Очередной гига-апдейт в Claude Code: теперь /diff показывается как отдельная боковая панель
Если вы читаете код который пишут агенты, то удобно
Я например даже чат с агентом не читаю ☹️
@tips_ai
Возможно помните, недавно хайпил мужик создавший под мак прогу, которая издает звуки когда шлепаешь корпус
Используя встроенный акселерометр
Так вот уже другой парень создал то же самое, только вместо звуков можно забиндить что угодно 😌
Например, стукнул 1 раз, сделал скриншот, стукнул 2 раза, запустил shell-команду, а стукнул по левой части, то включил Lock Screen
Короче похоже на задний тап на iPhone, только на маке автоматизация практически не ограничена
Скачать приложение тут, GitHub тут
Только сильно не бейте.. 🙂
@tips_ai
Тем временем, 5 дней после релиза:
Астра рисует канье в гугл календаре 🤷♂️
@tips_ai
лол, не лезьте к нам в хип-хоп (ой вернее наооборот)
но вообще прикольно
@tips_ai
Мы сейчас много чего делаем сами с AI, но часть задач всё равно уходит на сторону (в моей компании так же): продвижение, дизайн или крупная разработка.
Хочу поделиться большим исследованием, которое с этим помогает.
Рейтинг Рунета в этом году выложил 49 рейтингов в маркетинге, диджитале и ИТ.
Всего 1094 компании: 125520 проектов для 66738 заказчиков из 82 отраслей.
Из нового мне было интересно глянуть GEO/AEO: оптимизация под ответы ИИ. Так же появились чат-боты, а отдельно лежит рейтинг по ИИ.
Место считают по десяткам параметров, так что одной выручкой или наградами наверх не попасть. Услуги ещё и подтверждают документами.
Искать кого-то нового необязательно.
Можно вбить агентство, которое вам посоветовали, и посмотреть где оно в рейтинге или собрать список под тендер или просто для себя.
Выбирать всё равно придется самому, но искать уже не по всему рынку, а среди десятка компаний.
Так что советую заглянуть, чтобы не искать подрядчика по чатам и знакомым.
Рейтинги [тут]
NVIDIA всё таки купила HuggingFace, но не ровно за 13 млрд как хотела, а за $12 930 300 000 💲
Дженсен Хуанг сэкономил 70 млн (69,7 если точнее) для дорогой пасхалки:
Если убрать нули и перевести число 129303 в шестнадцатеричную систему, получится 1F917 - это unicode для эмодзи которое так и называется, Hugging Face 🤗
А если перед теми же цифрами поставить решетку, получится цвет 🟩 #129303 - тёмно-зелёный оттенок как отсылка к фирменному цвету NVIDIA
Неплохая скидка ради эмодзи 🙂
@tips_ai
Вчера OpenAI показали Astra, но мне доступ пока не приехал, раскатывают постепенно, и возможно растянется это на несколько дней.
Зато вместо доступа прилетел сброс лимитов. За каждый день без Astra на платном плане будут начислять по одному сбросу.
Еще стало известно, что Astra сейчас живёт только в режиме Pro, а привычные Instant, Medium и High остались на GPT-5.6 Sol. То есть отдельного GPT-6 просто нет.
А квота на Pro режиме такая: 200 сообщений в неделю на тарифе за 200$ и всего 50 на тарифе за 100$
Так что можно не торопиться, я потерплю ☕️
@tips_ai #news
В последняя время было много проблем с тем в каком стиле отвечают модели антропиков, в частности Opus 5 и Fable 5
Решил почитать их промт-гайд для новой Fable 5.1, так что вот главные советы как улучшить письмо:
1.
Да, у неё текст стал чище, меньше шаблонных фраз и тд, но из того что я и сам заметил, она теперь отвечает сплошным текстом из длинных предложений и кучи стилистических оборотов
Например, вместо "этот параметр стоит менять" модель может написать "это ручка, которую стоит покрутить"
Решается прямым запретом на манерный текст:
Mannered prose substitutes metaphor and flourish for direct statement. Instead of "a parameter worth varying," the mannered writer produces "a dial worth turning." Instead of "this point still matters," they write "this point earns its keep." The phrases exist to display the writer, not to convey the idea, and readers can tell. That is why mannered prose irritates: it makes the reader work harder so the writer can perform. It is also imprecise. Metaphors drag in connotations the writer did not choose and cannot control. The fix is to say what you mean. When a literal phrase is available, use it.
thinking.display, и выбрать "updates" или "summarized", или через /btw просить коротко объяснить что происходитFirst privately list what you need next; then request every item that doesn't depend on another's result in this one response.
If, while working or testing, you find a pre-existing bug, a performance concern, or behavior the task doesn't mention, don't fix, optimize or extend it in this change unless the requested behavior cannot work without it; report it as a follow-up in your summary. Where the task is ambiguous, implement the reading its wording and the surrounding code most directly support, state that assumption in your summary, and don't build for the other readings as well. Verify your work however you like; scratch scripts and quick checks need not be kept. Commit tests only where the task asks for them or this repository already keeps tests for this kind of change, sized like the neighboring test files — roughly one focused test per stated behavior — and don't turn scratch checks into additional permanent test files. This is about extras only: implement every behavior the task asks for, completely.
finish the task, stay within scope, search fresh/unknown entities, batch independent tool calls, prefer targeted edits.
Так же Google выпустили новый агентный режим обработки видео в Gemini
В этом режиме у модели теперь есть больше свободы выбора и тулов для понимания видео:
- Анализировать одновременно картинку, аудио и транскрипт
- Менять FPS и разрешение
- Переходить к нужному таймкоду и запрашивать отдельные кадры
- Делать транскрипт отдельных участков
- Повторять несколько циклов анализа подряд
Для контекста, раньше Gemini просто заранее семплировал видео целиком, примерно 1 кадр/сек + аудио, и просто читал размеченные таймстемпы
Поэтому новый режим дешевле, быстрее и точнее (гляньте видео)
Сейчас только по API, для моделей Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite.
Позже они хотят еще интегрировать его в Ask YouTube
Да, у Google не самые умные модели, но для агентного понимания видео как будто ничего лучше сейчас не существует ☕️
@tips_ai #news
Если у вас телек на Android TV, то скорее всего вас как и меня тоже задолбали постоянные лаги, медленная работа и тд
Так что делюсь как сегодня с клодом оптимизировали и почистили лишний мусор:
Использовал этот готовый промт (не помещается в пост)
Вообще, агент сам должен провести вас по всем этапам, но на всякий случай там еще есть гайд как включить режим разработчика
Для него не нужен рут, и он ничего не удаляет, только отключает
У меня было так:
- Агент подключился по WIFI-debug к телеку
- Узнал что из 1.9 гб RAM свободно только 650 мб
- Обнаружил что телеметрия жрет 101, страница рекомендаций еще 208, и другие бесполезные функции
- Отключил весь этот мусор (20 пакетов, 386 мб)
- И задно отключил автозапуск приложений, которые каждое включение сжирали еще 900 мб памяти
После этого мой телевизор наконец то стал юзабелен 👍
Eще можно накатить вот этот легковесный лаунчер, и вообще Apple TV будет)
@tips_ai #tools
Нашел интересный проект, с помощью которого из старенького iPhone можно сделать бесплатный OCR-сервер:
Это опен-сурс приложение для iOS, которое использует Vision - эпловский бесплатный on-device фреймворк
(мы его знаем как функцию выделения текста на картинках)
Всё очень просто:
1/ На айфоне поднимается мини-HTTP-сервер и показывается IP для подключения
2/ По API серверу отправляется картинка
4/ И передается в Vision как RecognizeTextRequest
5/ Vision делает свою работу и отдает текст, размеры картинки и координаты в JSON
Простенький скилл который добавляет ASCII прогресс-бары в вывод агента, которые он обновляет по мере выполнения задачи:
💀💀💀💀💀💀💀💀💀💀💀
Считает прогресс по 3–7 проверяемым контрольным точкам, а не по времени (например пройденный тест, созданный артефакт, принятый ревью и тп)
Установка:
npx skills add tjcages/skills --skill progress-check