Forwarded from Поляков считает: AI, код и кейсы
Туту проводит хакатон: хороший способ познакомиться с командой
Помните я рассказывал, что запустили MCP для сервиса путешествий Туту. Самый популярный запрос в личку по итогам анонса был про то, как я нашел проект и договорился с командой. Ответ простой, команду я уже знал, прототип приготовил за вечер. Сделал демо, оно зашло.
Вчера Туту анонсировали хакатон с призами: https://hackathon2026.tutu.ru
Призы символические — деньги на покупку внутри сервиса. Но принципиально это предложение почелленджить интересные идеи для тревел-сервиса на живом API компании.
🙋🏻♂️ Сижу в жюри, буду оценивать решения
Ваш покорный слуга приглашён в качестве судьи. На прошлой неделе проходило аналогичное мероприятие со студентами центрального университета. Лично мне зашло два решения. Одни ребята сделали ассистента, который управлял фильтрами на сайте (как Elevenlabs у себя), другие сделали Тиндер предлоджений.
🤔 Кому бы я советовал принять участие
Если интересуетесь карьерой в тревелтехе, ИИ-агентами, в т.ч. как владелец продукта — хакатон однозначно для вас.
Кроме призов организаторы совершенно точно заинтересованы в формировании кадрового резерва + с удовольствием реализуют вместе интересные проекты.
Если собираетесь участвовать — напишите в комментариях, в какую сторону копаете: подбор поездки, интерфейсное решение или свой агент поверх MCP.
----
Поляков считает — AI, код и кейсы
Помните я рассказывал, что запустили MCP для сервиса путешествий Туту. Самый популярный запрос в личку по итогам анонса был про то, как я нашел проект и договорился с командой. Ответ простой, команду я уже знал, прототип приготовил за вечер. Сделал демо, оно зашло.
Вчера Туту анонсировали хакатон с призами: https://hackathon2026.tutu.ru
Призы символические — деньги на покупку внутри сервиса. Но принципиально это предложение почелленджить интересные идеи для тревел-сервиса на живом API компании.
🙋🏻♂️ Сижу в жюри, буду оценивать решения
Ваш покорный слуга приглашён в качестве судьи. На прошлой неделе проходило аналогичное мероприятие со студентами центрального университета. Лично мне зашло два решения. Одни ребята сделали ассистента, который управлял фильтрами на сайте (как Elevenlabs у себя), другие сделали Тиндер предлоджений.
🚀 Если бы я участвовал в таком челлендже, я бы наверное сделал тиндер-механику в целом для тревела. Типа поле ввода: путешествие на двоих с семьёй и варианты, которые обучаются в зависимости от сделанных человеком лайков. Тут отлично вписываются и агенты и рексис и спецпроекты для маркетинга.
🤔 Кому бы я советовал принять участие
Если интересуетесь карьерой в тревелтехе, ИИ-агентами, в т.ч. как владелец продукта — хакатон однозначно для вас.
Кроме призов организаторы совершенно точно заинтересованы в формировании кадрового резерва + с удовольствием реализуют вместе интересные проекты.
Если собираетесь участвовать — напишите в комментариях, в какую сторону копаете: подбор поездки, интерфейсное решение или свой агент поверх MCP.
----
Поляков считает — AI, код и кейсы
👍3
⚪️ DeepSeek V4 Flash 0731
ДипСик выпустила очередной чекпоинт своего флеша - и у него довольно фантастический прогресс на бенчмарках. Местами до Опуса 4.8 почти допрыгивает - но цены то дипсиковские, почти даром.
Очень впечатляет, даже если это бенчмаксинг. Явно достойный кандидат для воркера на кодинг.
Табличка ожиданий этого лета потихоньку начинает заполняться.
@deksden_notes
ДипСик выпустила очередной чекпоинт своего флеша - и у него довольно фантастический прогресс на бенчмарках. Местами до Опуса 4.8 почти допрыгивает - но цены то дипсиковские, почти даром.
Очень впечатляет, даже если это бенчмаксинг. Явно достойный кандидат для воркера на кодинг.
Табличка ожиданий этого лета потихоньку начинает заполняться.
@deksden_notes
🔥8👀6🤣5👍4🤡3❤2💯2
⚪️ SuperGrok Plus
В полку $100 подписок прибыло! Грок придумал промежуточную подписку.
У меня пока ее не видно
Целесообразность - пока тоже не ясна, за 30 подписка более-менее щедрая. Хотя Грок 4.5 неплох. Прыжок от 30 к 300 в месяц мне всегда представлялся сомнительным.
В общем, больше подписок - хороших и разных! В любом случае, выбор всегда здорово.
@deksden_notes
В полку $100 подписок прибыло! Грок придумал промежуточную подписку.
У меня пока ее не видно
Целесообразность - пока тоже не ясна, за 30 подписка более-менее щедрая. Хотя Грок 4.5 неплох. Прыжок от 30 к 300 в месяц мне всегда представлялся сомнительным.
В общем, больше подписок - хороших и разных! В любом случае, выбор всегда здорово.
@deksden_notes
👍7
⚪️ CLI: json vs args
Пока мы ждем ресетов от Тибо, небольшой технический пост про архитектуру CLI, которая удобна для агентов. MS написала небольшой, но практически полезный пост. Обратил на него внимание благодаря тому, что интуитивно сам так делаю.
Кейс простой: если делаешь свое CLI (а я под любой сой облачный сервис стараюсь такой делать), как передать в cli сложные параметры?
Есть два способа:
1️⃣ давать аргументами вида :
2️⃣ а можно передать json структуру :
Есть разспространенное заблуждение, что JSON лучше и понятнее для агентов.
MS протестировала - нет, не лучше. Сложнее, чем линейный список аргументов. Несмотря на то, что линейный список выглядит громоздким - он простой и понятный. А для json модели требуется понять схему, сформирвоать иерархию значений, соблюсти синтаксис json и правильно подать в аргументах. Задач кратно больше.
🔗 Подробнее с тестами тут : https://developer.microsoft.com/blog/dont-rewrite-your-cli-for-agents/
👉 Вывод немного очевиден. Для сильных моделей разницы нету, но это не значит что на такую задачу не уйдет ресурс внимания, которое лучше потратить на более созидательную часть задачи.
В общем, передаем параметры в CLI обычными плоскими аргументами, а
👉 Обновил кусочек флоу с правилами "как мы пишем cli".
▶️ В целом, их блог полистать можно - местами полезно.
@deksden_notes
Пока мы ждем ресетов от Тибо, небольшой технический пост про архитектуру CLI, которая удобна для агентов. MS написала небольшой, но практически полезный пост. Обратил на него внимание благодаря тому, что интуитивно сам так делаю.
Кейс простой: если делаешь свое CLI (а я под любой сой облачный сервис стараюсь такой делать), как передать в cli сложные параметры?
Есть два способа:
1️⃣ давать аргументами вида :
my-cli --some-argument value \
--some-other-argument one-more-value \
...
2️⃣ а можно передать json структуру :
my-cli --json '{
"some-argument": "value",
"some-other-argument": "value",
...
}'
Есть разспространенное заблуждение, что JSON лучше и понятнее для агентов.
MS протестировала - нет, не лучше. Сложнее, чем линейный список аргументов. Несмотря на то, что линейный список выглядит громоздким - он простой и понятный. А для json модели требуется понять схему, сформирвоать иерархию значений, соблюсти синтаксис json и правильно подать в аргументах. Задач кратно больше.
🔗 Подробнее с тестами тут : https://developer.microsoft.com/blog/dont-rewrite-your-cli-for-agents/
👉 Вывод немного очевиден. Для сильных моделей разницы нету, но это не значит что на такую задачу не уйдет ресурс внимания, которое лучше потратить на более созидательную часть задачи.
В общем, передаем параметры в CLI обычными плоскими аргументами, а
--json оставляем ДЛЯ ВЫДАЧИ из CLI. Понимать информацию в виде структурированного json модели, мне кажется, будет немного легче чем "плоским" дампом. 👉 Обновил кусочек флоу с правилами "как мы пишем cli".
▶️ В целом, их блог полистать можно - местами полезно.
@deksden_notes
👍10🔥4❤3🥴1
⚪️ Omnigent - обзор проекта
Найден такой кодинговый агент, opensource, python, TUI / web / dekstop / mobile / slack, claude/codex/pi/opencode/cursor/hermes
🔗 Оффсайт : https://omnigent.ai/
🔗 Блог : https://omnigent.ai/blog
🔗 Гитхаб : https://github.com/omnigent-ai/omnigent
Особенность проекта - это мета-агент, он работает поверх других агентов. Например, берем CC/codex cli/pi или чего то по api.
Какие сценарии работы возможны:
• начинаем сессию, в середине форкаем сессию и продолжаем другим агентом
• аннотированные комменты к выводу агента: можно выделить чего написал агент, и прокомментировать; агент поймет к чему относится коммент; (я называю это аннотациями, как Agentation делает для UI или в некоторый Ии браузерах в ADE есть аннотации UI, но тут для выдачи агента)
• файлы редактируем прямо внутри ADE, то есть это не только просмотр
• Polly: встроенный агент-оркестратор, который раздает задачи другим агентам (claude/codex например); смотрим сессию оркестратора, переключаемся на запущенных им субагентов, отправляем субагентам сообщения если нужно; субагенты могут делать разные кусочки задачи параллельно с ревью третьим агентом;
• Поддерживает Goal
• Режимы: /fanout - запуск субагентов на каждую задачу в отдельном рабочем дереве с созданием отдельных PR; /cross-review для проверки диффа агента через агента другого вендора; /investigate для исследовательских задач (баши, аудит, исследования кода) с синтезом итогов;
• Debby: мульти-агентный брейнсторм; /debate работает с клодом/гпт;
• можно задеплоить сервер с агентом на Railway и рулить им с мобилки/ноута; облачный агент в sandbox работает автономно от ноута;
• политики сессий: мягкие и жесткие бюджеты трат в сессии на модель;
• многопользовательская работа: несколько пользователей могут управлять одной сессией (если вы ее зашарите с коллегой - Co-Drive);
• компоненты системы: сервер, раннер, UI
• сервер деплоится: railway, render, fly.io, HF spaces
• раннер: daytona, modal
• ui: tui, web ui (+desktop app), mobile
• для работы нужна БД: postgres / sqlite
• у сервера есть REST API
Авторы - Databricks / Neon. Довольно большие и солидные, кстати
В итоге: не поделка, большой и интересный проект. Буду ковырять, наблюдать за развитием
Я себе примерно такое же и скрутил, правда чуток другой стек
@deksden_notes
Найден такой кодинговый агент, opensource, python, TUI / web / dekstop / mobile / slack, claude/codex/pi/opencode/cursor/hermes
🔗 Оффсайт : https://omnigent.ai/
🔗 Блог : https://omnigent.ai/blog
🔗 Гитхаб : https://github.com/omnigent-ai/omnigent
Особенность проекта - это мета-агент, он работает поверх других агентов. Например, берем CC/codex cli/pi или чего то по api.
Какие сценарии работы возможны:
• начинаем сессию, в середине форкаем сессию и продолжаем другим агентом
• аннотированные комменты к выводу агента: можно выделить чего написал агент, и прокомментировать; агент поймет к чему относится коммент; (я называю это аннотациями, как Agentation делает для UI или в некоторый Ии браузерах в ADE есть аннотации UI, но тут для выдачи агента)
• файлы редактируем прямо внутри ADE, то есть это не только просмотр
• Polly: встроенный агент-оркестратор, который раздает задачи другим агентам (claude/codex например); смотрим сессию оркестратора, переключаемся на запущенных им субагентов, отправляем субагентам сообщения если нужно; субагенты могут делать разные кусочки задачи параллельно с ревью третьим агентом;
• Поддерживает Goal
• Режимы: /fanout - запуск субагентов на каждую задачу в отдельном рабочем дереве с созданием отдельных PR; /cross-review для проверки диффа агента через агента другого вендора; /investigate для исследовательских задач (баши, аудит, исследования кода) с синтезом итогов;
• Debby: мульти-агентный брейнсторм; /debate работает с клодом/гпт;
• можно задеплоить сервер с агентом на Railway и рулить им с мобилки/ноута; облачный агент в sandbox работает автономно от ноута;
• политики сессий: мягкие и жесткие бюджеты трат в сессии на модель;
• многопользовательская работа: несколько пользователей могут управлять одной сессией (если вы ее зашарите с коллегой - Co-Drive);
• компоненты системы: сервер, раннер, UI
• сервер деплоится: railway, render, fly.io, HF spaces
• раннер: daytona, modal
• ui: tui, web ui (+desktop app), mobile
• для работы нужна БД: postgres / sqlite
• у сервера есть REST API
Авторы - Databricks / Neon. Довольно большие и солидные, кстати
В итоге: не поделка, большой и интересный проект. Буду ковырять, наблюдать за развитием
Я себе примерно такое же и скрутил, правда чуток другой стек
@deksden_notes
🔥11❤6👍3
⚪️ Opencode Go -> Luna
Неожиданно!
В "китайский заповедник" opencode go завезли ChatGPT Luna
Бывает же))
—-
Upd 1️⃣ : новый дипсик туда же завезли! И в Zen как free модель он же
@deksden_notes
Неожиданно!
В "китайский заповедник" opencode go завезли ChatGPT Luna
Бывает же))
—-
Upd 1️⃣ : новый дипсик туда же завезли! И в Zen как free модель он же
@deksden_notes
🔥16👍2👻1
⚪️Codex reset
Ну, блин! Наконец то
«… но нервы вымотали все!»
Хоть бы объявлял заранее - надо же понимать когда спать))
Кстати, 5h лимиты так и не появились!
В общем, «пляшем!»
——
Upd 1️⃣ : сообщают о новой волне борьбы с фродом - у меня некоторые аккаунты в CPA потребовали повторного добавления в пул, инвалидировали сессии.
@deksden_notes
Ну, блин! Наконец то
«… но нервы вымотали все!»
Хоть бы объявлял заранее - надо же понимать когда спать))
Кстати, 5h лимиты так и не появились!
В общем, «пляшем!»
——
Upd 1️⃣ : сообщают о новой волне борьбы с фродом - у меня некоторые аккаунты в CPA потребовали повторного добавления в пул, инвалидировали сессии.
@deksden_notes
🔥11👍7🎉2
⚪️ Gpt 5.4 уйдет из подписок вместе с летом
... в закат!
На самом деле - с 31 августа через подписку больше не будут давать модели поколения 5.4: это gpt-5.4 и gpt-5.4-mini
Я до сих пор использую кое в каких проектах mini: или переводим на api, или заменяем. Предлагается на Terra/Luna - даром что ли тарифы меняли
🔗 Почитать эпитафию на сайте : https://learn.chatgpt.com/docs/changelog#codex-2026-07-31
@deksden_notes
... в закат!
На самом деле - с 31 августа через подписку больше не будут давать модели поколения 5.4: это gpt-5.4 и gpt-5.4-mini
Я до сих пор использую кое в каких проектах mini: или переводим на api, или заменяем. Предлагается на Terra/Luna - даром что ли тарифы меняли
🔗 Почитать эпитафию на сайте : https://learn.chatgpt.com/docs/changelog#codex-2026-07-31
@deksden_notes
🤝4👍1
⚪️ Гипотеза
❓ Вам не кажется что фронтирные лабы потихоньку двигают идею того, что нам стоит сменить нашу манеру кодинга на оркестрацию моделей?
Сейчас много людей используют простую схему: берём самую способную моделью, и все ею делаем
Драконовские цены и лимиты у клода на фублю конечно заставляют переключаться на опус. Да и из простых тиров Антропики просто убрали топовую модель. Но в целом люди склонны подходить просто.
👉 Реального понимания какой модели ДОСТАТОЧНО для выполнения разных задач / этапов флоу, я уверен, мало кто достигал.
Текущая политика клозедов по лимитам SOL ясно показывает мне: то, что работало с зимы - поставить текущий фронтир на высокий ризонинг (5.2 high, 5.4high, 5.5 high) и все им делать - сейчас уже абсолютно не укладывается ни в какие лимиты. Даже 20 аккаунтов сгорают под весьма умеренной нагрузкой.
Думаю на Клоде работа опусом тоже станет весьма дорогой.
Текущий подход фронтира со свармом агентов на топовой модели - по лимитам это катастрофа.
👉В общем, думаем как грамотно заюзать младшие модели, кмк.
LunaMaxxing - тренд текущего момента
❓ Что думаете? Я нагнетаю?
@deksden_notes
❓ Вам не кажется что фронтирные лабы потихоньку двигают идею того, что нам стоит сменить нашу манеру кодинга на оркестрацию моделей?
Сейчас много людей используют простую схему: берём самую способную моделью, и все ею делаем
Драконовские цены и лимиты у клода на фублю конечно заставляют переключаться на опус. Да и из простых тиров Антропики просто убрали топовую модель. Но в целом люди склонны подходить просто.
👉 Реального понимания какой модели ДОСТАТОЧНО для выполнения разных задач / этапов флоу, я уверен, мало кто достигал.
Текущая политика клозедов по лимитам SOL ясно показывает мне: то, что работало с зимы - поставить текущий фронтир на высокий ризонинг (5.2 high, 5.4high, 5.5 high) и все им делать - сейчас уже абсолютно не укладывается ни в какие лимиты. Даже 20 аккаунтов сгорают под весьма умеренной нагрузкой.
Думаю на Клоде работа опусом тоже станет весьма дорогой.
Текущий подход фронтира со свармом агентов на топовой модели - по лимитам это катастрофа.
👉В общем, думаем как грамотно заюзать младшие модели, кмк.
LunaMaxxing - тренд текущего момента
❓ Что думаете? Я нагнетаю?
@deksden_notes
❤10💯7👍4
⚪️ Упряжка DeepSeek набирает тестеров
Закрытая бэта тестирование упряжки от DeepSeek - пишем в твиттер @tianyi
👉 Указываем GitHub ID и свой значимый опенсорс
@deksden_notes
Закрытая бэта тестирование упряжки от DeepSeek - пишем в твиттер @tianyi
👉 Указываем GitHub ID и свой значимый опенсорс
@deksden_notes
🔥5
Forwarded from tae zori
🧹 claude-mac-storage-cleanup — скилл для Claude Code, который находит мусор на маке и не даёт себе удалить лишнее
Этот скилл устроен наоборот: сначала read-only аудит, потом отчёт, и только после вашего явного одобрения — удаление.
Что меряет: кеши приложений, логи, Xcode DerivedData и симуляторы, Android AVD, Docker, кеши brew/npm/pnpm/yarn/pip/uv/Cargo/Go/Gradle/Maven/CocoaPods, индексы JetBrains, node_modules и build-артефакты по всем проектам, локальные веса моделей, iOS-бэкапы, крупные файлы и старые инсталляторы.
Безопасность:
Первый проход вообще ничего не пишет. Никогда даже не сканируются: ~/.claude, ~/.codex, SSH/GPG-ключи, Keychain, Mail, Messages, iCloud Drive, Photos. Приоритет очистки: родная чистилка инструмента → Корзина (обратимо, с манифестом отката) → rm только по проверенным кеш/build-путям. Без sudo, если явно не попросить.
Живой прогон на моём маке:
Было 20 GiB свободно из 460 (96% занято). Аудит — 156 секунд, нашёл 167 GB кандидатов. Освобождено 122 GiB: 66 GB Android-эмуляторов (среди них три копии одного устройства), 25 GB симуляторов iOS, 24 GB кешей приложений, остальное — Gradle, DerivedData, build/target по 17 проектам.
Установка:
git clone https://github.com/aistae/claude-mac-storage-cleanup
cp -R claude-mac-storage-cleanup/skill ~/.claude/skills/mac-storage-cleanup
Дальше просто просите словами: «просканируй мак на предмет занятого впустую места».
Скрипты standalone — Claude для запуска не обязателен, хватит python3 и системного Python.
Порт codex-mac-storage-cleanup (https://github.com/Kappaemme-git/codex-mac-storage-cleanup) Francesco Mistero, переписанный под Claude с более аккуратным движком аудита и обратимой очисткой. MIT.
👉 https://github.com/aistae/claude-mac-storage-cleanup
#opensource
Этот скилл устроен наоборот: сначала read-only аудит, потом отчёт, и только после вашего явного одобрения — удаление.
Что меряет: кеши приложений, логи, Xcode DerivedData и симуляторы, Android AVD, Docker, кеши brew/npm/pnpm/yarn/pip/uv/Cargo/Go/Gradle/Maven/CocoaPods, индексы JetBrains, node_modules и build-артефакты по всем проектам, локальные веса моделей, iOS-бэкапы, крупные файлы и старые инсталляторы.
Безопасность:
Первый проход вообще ничего не пишет. Никогда даже не сканируются: ~/.claude, ~/.codex, SSH/GPG-ключи, Keychain, Mail, Messages, iCloud Drive, Photos. Приоритет очистки: родная чистилка инструмента → Корзина (обратимо, с манифестом отката) → rm только по проверенным кеш/build-путям. Без sudo, если явно не попросить.
Живой прогон на моём маке:
Было 20 GiB свободно из 460 (96% занято). Аудит — 156 секунд, нашёл 167 GB кандидатов. Освобождено 122 GiB: 66 GB Android-эмуляторов (среди них три копии одного устройства), 25 GB симуляторов iOS, 24 GB кешей приложений, остальное — Gradle, DerivedData, build/target по 17 проектам.
Установка:
git clone https://github.com/aistae/claude-mac-storage-cleanup
cp -R claude-mac-storage-cleanup/skill ~/.claude/skills/mac-storage-cleanup
Дальше просто просите словами: «просканируй мак на предмет занятого впустую места».
Скрипты standalone — Claude для запуска не обязателен, хватит python3 и системного Python.
Порт codex-mac-storage-cleanup (https://github.com/Kappaemme-git/codex-mac-storage-cleanup) Francesco Mistero, переписанный под Claude с более аккуратным движком аудита и обратимой очисткой. MIT.
👉 https://github.com/aistae/claude-mac-storage-cleanup
#opensource
GitHub
GitHub - aistae/claude-mac-storage-cleanup
Contribute to aistae/claude-mac-storage-cleanup development by creating an account on GitHub.
👍3🔥1🤮1
⚪️ LunaMaxxing
Переключил часть длинно работающих флоу на Луну в max/xhigh ризонинге - и, о чудо, лимиты перестали тратится вообще! несколько часов едет пара сессий, а лимиты на пару процентов проседают по пулу.. Раньше на sol medium все довольно стремительно сгорало.
Удивительное, конечно
Не уверен что оно со всем-всем справится норм, но тестов оно определенно заслуживает.
(ц) Кто еще не - лучше таки да.
——
Upd 1️⃣ : кстати, еще со времен deepseek-moment вывели одно следствие - цена имеет значение. Достаточно умная модель весьма дешево - это сильное предложение. Фронтир-фронтиром, но тут ИИ в экономику отправляют, а для реальных дел это важно
В общем, продолжаю накидывать)
@deksden_notes
Переключил часть длинно работающих флоу на Луну в max/xhigh ризонинге - и, о чудо, лимиты перестали тратится вообще! несколько часов едет пара сессий, а лимиты на пару процентов проседают по пулу.. Раньше на sol medium все довольно стремительно сгорало.
Удивительное, конечно
Не уверен что оно со всем-всем справится норм, но тестов оно определенно заслуживает.
(ц) Кто еще не - лучше таки да.
——
Upd 1️⃣ : кстати, еще со времен deepseek-moment вывели одно следствие - цена имеет значение. Достаточно умная модель весьма дешево - это сильное предложение. Фронтир-фронтиром, но тут ИИ в экономику отправляют, а для реальных дел это важно
В общем, продолжаю накидывать)
@deksden_notes
👍14🔥9