Forwarded from bishx devlog
Пару недель назад я делал пост о том, что не всегда оптимально использовать сложные пайплайны для работы с нейросетями
Недавно была задача взять одну систему за основу и усовершенствовать её – кое-что выпилить, кое-что допилить, что-то оставить
Был выбор:
1. Использовать сложный пайплайн (публичный вариант) с трехчасовым планированием, 20+ часами исполнением плана, декомпозицией задач в YouTrack и ветками в системе контроля версий. Жесть, в общем
2. Использовать обычный чатик с ручными итерациями "перепиши и проверь"
3. Взять что-то между п.1 и п.2: адаптивный полуавтономный пайплайн под среднебытовую задачу с приоритизацией общения в чатике
По сложному названию и ссылке на гит можно догадаться, что я выбрал третий вариант. Мои два промпта кодексу звучали так:
1. "$bx-dev"
2. "/goal возьми из репы Х все python исходники. Перепиши весь проект на go в более сопровождаемый вид. В каждой итерации используй нужные скиллы из skill-library. Следуй протоколу $bx-dev. Критерий завершения – система полностью перенесена на go и проверена на отсутствие потерь бизнес-логики при миграции"
Отличный промпт? Да! Сейчас разберём
Написав $bx-dev, мы задали рабочий контур: исследование перед изменениями, реализация, проверки, ревью и DDD классификация там, где она действительно нужна
А написав "/goal ..." – мы зафиксировали задачу, критерий завершения и требования к процессу. Агенту сложнее закончить раньше времени: при попытке остановиться его возвращает к цели, проверкам и требованиям из $bx-dev и напоминанию использовать skill-library (буст +16 п.п. к эффективности)
Получается, что у нейронки нет нормального выхода из цикла, пока она не сверится с критерием завершения: полностью перенести систему и не потерять бизнес-логику. При каждой попытке останова её пинают и говорят следовать промпту из /goal, который отлично напоминает про задачу и требования к её исполнению
Отправили всё в кодекс и ушли заниматься своими делами, – спустя 8 часов имеем ваншотом полностью перенесенный проект на другой яп. Запустили, проверили – есть пара мелких недочетов, но фиксятся они за 5-10 минут
Суть в том, что $bx-dev сам по себе вполне автономен и хорошо справляется с большинством задач. А в связке с /goal мы это дополнительно усилили, исключив потерю контекста с течением времени
Теперь самое интересное... Я решил в паблик выложить свой bx-dev skill и встроенную skill-library с механизмом ленивой загрузки 105 скиллов, которые использую в повседневных задачах
В репе описал, как устроен скилл и как с ним работать в разных сценариях
Скилл самодостаточен и готов к работе из коробки, нужны лишь утилиты gh (для git репы проекта) и jq (для записи состояний)
☁️ Исходный код: GitHub
#opensource
Недавно была задача взять одну систему за основу и усовершенствовать её – кое-что выпилить, кое-что допилить, что-то оставить
Был выбор:
1. Использовать сложный пайплайн (публичный вариант) с трехчасовым планированием, 20+ часами исполнением плана, декомпозицией задач в YouTrack и ветками в системе контроля версий. Жесть, в общем
2. Использовать обычный чатик с ручными итерациями "перепиши и проверь"
3. Взять что-то между п.1 и п.2: адаптивный полуавтономный пайплайн под среднебытовую задачу с приоритизацией общения в чатике
По сложному названию и ссылке на гит можно догадаться, что я выбрал третий вариант. Мои два промпта кодексу звучали так:
1. "$bx-dev"
2. "/goal возьми из репы Х все python исходники. Перепиши весь проект на go в более сопровождаемый вид. В каждой итерации используй нужные скиллы из skill-library. Следуй протоколу $bx-dev. Критерий завершения – система полностью перенесена на go и проверена на отсутствие потерь бизнес-логики при миграции"
Отличный промпт? Да! Сейчас разберём
Написав $bx-dev, мы задали рабочий контур: исследование перед изменениями, реализация, проверки, ревью и DDD классификация там, где она действительно нужна
А написав "/goal ..." – мы зафиксировали задачу, критерий завершения и требования к процессу. Агенту сложнее закончить раньше времени: при попытке остановиться его возвращает к цели, проверкам и требованиям из $bx-dev и напоминанию использовать skill-library (буст +16 п.п. к эффективности)
Получается, что у нейронки нет нормального выхода из цикла, пока она не сверится с критерием завершения: полностью перенести систему и не потерять бизнес-логику. При каждой попытке останова её пинают и говорят следовать промпту из /goal, который отлично напоминает про задачу и требования к её исполнению
Отправили всё в кодекс и ушли заниматься своими делами, – спустя 8 часов имеем ваншотом полностью перенесенный проект на другой яп. Запустили, проверили – есть пара мелких недочетов, но фиксятся они за 5-10 минут
Суть в том, что $bx-dev сам по себе вполне автономен и хорошо справляется с большинством задач. А в связке с /goal мы это дополнительно усилили, исключив потерю контекста с течением времени
Теперь самое интересное... Я решил в паблик выложить свой bx-dev skill и встроенную skill-library с механизмом ленивой загрузки 105 скиллов, которые использую в повседневных задачах
В репе описал, как устроен скилл и как с ним работать в разных сценариях
Скилл самодостаточен и готов к работе из коробки, нужны лишь утилиты gh (для git репы проекта) и jq (для записи состояний)
#opensource
Please open Telegram to view this post
VIEW IN TELEGRAM
👍19🔥10❤6
Forwarded from Циничный AI (Anton Goncharenko)
https://t.me/deksden_notes/1027
Продолжение к вчерашнему посту про skill
Я решил его строго проверить. Взял реальные планы (включая те, что уже были ранее без проблем реализованы), прогнал через разные версии скиллов (от 600 до 50 строк) на моделях Sol и Opus.
⚠️ В том числе сравнивал с моделями, которые делали проверки вообще без skill.
Привлёк независимых судей-верификаторов Sol и Fable. Сравнил количество подтверждённых находок, мусор, вердикты и затраты токенов.
Главный вывод: скилл не делает модели умнее – они и так всё умеют.
Никакой когнитивной активации с помощью premortem техники не происходит, никаких дополнительных возможностей модель не получает.
Но skill всё равно работет, он убирает панические блокировки, режет мусор и дисциплинирует формулировки.
Краткий разбор в 4-х постах + сам skill + сравнение и различие в поведении Sol vs Opus/Fable
https://t.me/cinicai/116
https://t.me/cinicai/117
https://t.me/cinicai/118
https://t.me/cinicai/119
#opensource
Продолжение к вчерашнему посту про skill
technical-premortemЯ решил его строго проверить. Взял реальные планы (включая те, что уже были ранее без проблем реализованы), прогнал через разные версии скиллов (от 600 до 50 строк) на моделях Sol и Opus.
⚠️ В том числе сравнивал с моделями, которые делали проверки вообще без skill.
Привлёк независимых судей-верификаторов Sol и Fable. Сравнил количество подтверждённых находок, мусор, вердикты и затраты токенов.
Главный вывод: скилл не делает модели умнее – они и так всё умеют.
Никакой когнитивной активации с помощью premortem техники не происходит, никаких дополнительных возможностей модель не получает.
Но skill всё равно работет, он убирает панические блокировки, режет мусор и дисциплинирует формулировки.
Краткий разбор в 4-х постах + сам skill + сравнение и различие в поведении Sol vs Opus/Fable
https://t.me/cinicai/116
https://t.me/cinicai/117
https://t.me/cinicai/118
https://t.me/cinicai/119
#opensource
🔥8👍4
⚪️ Codex reset (!!!)
Несмотря на завершение "фестиваля миллионов" - кто помнит, мы таки достигли 10м пользователей, и дальше клозеды не обещали ресетов за каждый миллион, но зато сегодня был сбой - и у нас снова ресет!
Ура) Вовремя
Но надо думать чего делать с флоу/аккаунтами - категорически нехватает квот
@deksden_notes
Несмотря на завершение "фестиваля миллионов" - кто помнит, мы таки достигли 10м пользователей, и дальше клозеды не обещали ресетов за каждый миллион, но зато сегодня был сбой - и у нас снова ресет!
Ура) Вовремя
Но надо думать чего делать с флоу/аккаунтами - категорически нехватает квот
@deksden_notes
1👍15💯8🔥5👻2
⚪️ Статья - почему Software factories не работают
Тут нужно прочитать статью, аж в двух частях:
🔗 Начало: https://x.com/dexhorthy/status/2080697380379427275?s=46
🔗 часть 2: https://x.com/dexhorthy/status/2081058573556306030?s=46
Чел пишет про то, в чем сейчас лажают модели в кодинг. Аргументированно, правда СИЛЬНО развернуто.
Но тема поднята сильная. Надо будет обсудить!
Если много народа ниосилят, буду писать пересказ - но мне кажется тут и агент растолкует если что.
Прочитайте! Обсудим
❓ Ну и кто чего думает? В комменты ⬇️
@deksden_notes
Тут нужно прочитать статью, аж в двух частях:
🔗 Начало: https://x.com/dexhorthy/status/2080697380379427275?s=46
🔗 часть 2: https://x.com/dexhorthy/status/2081058573556306030?s=46
Чел пишет про то, в чем сейчас лажают модели в кодинг. Аргументированно, правда СИЛЬНО развернуто.
Но тема поднята сильная. Надо будет обсудить!
Если много народа ниосилят, буду писать пересказ - но мне кажется тут и агент растолкует если что.
Прочитайте! Обсудим
❓ Ну и кто чего думает? В комменты ⬇️
@deksden_notes
👍11🔥11❤🔥2
Forwarded from ProTraffic | Арбитраж трафика
Пока все продают курсы по AI, Иванов просто каждый день что-то вайб кодит.
За последние месяцы он навайбкодил десятки проектов: автозалив в Fb, Telegram-сетку на 3000+ каналов, парсеры абсолютно всего и они работают, AI-агентов и автоматизацию для спайки.
Без инфоцыганства и мотивации. Только процесс, ошибки, промпты, удачные решения и мысли человека, который каждый день живёт внутри арбитражного рынка и AI.
Если интересно не смотреть, а реально строить - вам сюда:
👉 @CPACoder
За последние месяцы он навайбкодил десятки проектов: автозалив в Fb, Telegram-сетку на 3000+ каналов, парсеры абсолютно всего и они работают, AI-агентов и автоматизацию для спайки.
Без инфоцыганства и мотивации. Только процесс, ошибки, промпты, удачные решения и мысли человека, который каждый день живёт внутри арбитражного рынка и AI.
Если интересно не смотреть, а реально строить - вам сюда:
👉 @CPACoder
👎11😁5👍4🔥2👀2
Forwarded from Владимир П.
Привет! Написал ru-marketplace-mcp — опенсорсные коннекторы для российских маркетплейсов: Wildberries, Ozon, Яндекс Маркет и Детский мир.
Если коротко - это глаза для Claude, Opencode и любого другого AI-клиента. Подключаешь, и агент сам отвечает на «где этот увлажнитель дешевле», «что пишут в отзывах» и «кто вообще этот продавец».
Внутри 22 инструмента. Из любимого:
— реквизиты продавца на WB: юрлицо, ИНН, ОГРН. Сразу видно, официальный это магазин или перекуп с похожим названием
— вопросы покупателей и ответы продавца: там часто единственный ответ на «а кабель в комплекте?»
— разбивка оценок по звёздам на Маркете: честная там 4.8 или за ней прячется пачка единиц
— наличие в офлайн-магазинах Детского мира по городам
— сравнение цен по всем площадкам одним вызовом
Регистрация не нужна: только публичные эндпоинты, только чтение. Ozon с серверных IP упрямится - для него есть режим через ваш собственный Chrome.
Активно пилю дальше, в планах Авито, Taobao и другие площадки Китая.
https://github.com/Vladimir-Human/ru-marketplace-mcp
Зацените! Нужен фидбек, идеи и звёзды :)
#opensource
Если коротко - это глаза для Claude, Opencode и любого другого AI-клиента. Подключаешь, и агент сам отвечает на «где этот увлажнитель дешевле», «что пишут в отзывах» и «кто вообще этот продавец».
Внутри 22 инструмента. Из любимого:
— реквизиты продавца на WB: юрлицо, ИНН, ОГРН. Сразу видно, официальный это магазин или перекуп с похожим названием
— вопросы покупателей и ответы продавца: там часто единственный ответ на «а кабель в комплекте?»
— разбивка оценок по звёздам на Маркете: честная там 4.8 или за ней прячется пачка единиц
— наличие в офлайн-магазинах Детского мира по городам
— сравнение цен по всем площадкам одним вызовом
Регистрация не нужна: только публичные эндпоинты, только чтение. Ozon с серверных IP упрямится - для него есть режим через ваш собственный Chrome.
Активно пилю дальше, в планах Авито, Taobao и другие площадки Китая.
https://github.com/Vladimir-Human/ru-marketplace-mcp
Зацените! Нужен фидбек, идеи и звёзды :)
#opensource
GitHub
GitHub - Vladimir-Human/ru-marketplace-mcp: MCP-серверы для российских маркетплейсов: Wildberries, Ozon, Яндекс Маркет, Детский…
MCP-серверы для российских маркетплейсов: Wildberries, Ozon, Яндекс Маркет, Детский мир и сравнение цен по всем сразу. Только чтение, ключи не нужны. - Vladimir-Human/ru-marketplace-mcp
👍36🔥22❤🔥5❤2
⚪️ Релиз Kimi K3
Уже скоро! Вот вот
Веса будут доступны, надеюсь много независимых провайдеров поднимит свой инференс этой модели - будет или быстрее, или дешевле, или просто больше выбор
В любом случае - хорошая новость!
🔗 Обнимашки: https://huggingface.co/moonshotai/Kimi-K3
Спасибо за напоминание @Ilya_ru_de
🔗 Техрепорт : https://github.com/MoonshotAI/Kimi-K3/blob/main/k3_tech_report.pdf
🔗 Блог: https://www.kimi.com/blog/kimi-k3
🔗 FlashKDA : https://github.com/MoonshotAI/FlashKDA
@deksden_notes
Уже скоро! Вот вот
Веса будут доступны, надеюсь много независимых провайдеров поднимит свой инференс этой модели - будет или быстрее, или дешевле, или просто больше выбор
В любом случае - хорошая новость!
🔗 Обнимашки: https://huggingface.co/moonshotai/Kimi-K3
Спасибо за напоминание @Ilya_ru_de
🔗 Техрепорт : https://github.com/MoonshotAI/Kimi-K3/blob/main/k3_tech_report.pdf
🔗 Блог: https://www.kimi.com/blog/kimi-k3
🔗 FlashKDA : https://github.com/MoonshotAI/FlashKDA
@deksden_notes
🔥9👍5
⚪️ Codex Reset анонсирован
Ждём в ближайшее!
В честь быстрого распространения ChatGPT work )) причина ж!)
——
Upd 1️⃣ : У меня докатился на все аккаунты
@deksden_notes
Ждём в ближайшее!
В честь быстрого распространения ChatGPT work )) причина ж!)
——
Upd 1️⃣ : У меня докатился на все аккаунты
@deksden_notes
🔥10👍2
⚪️ Антропики НЕ против открытых моделей
И не призывали к их бану!
⚪️ Дарио телеграфирует : https://www.anthropic.com/news/position-open-weights-models
Почитайте, на случай если вы переживали
@deksden_notes
И не призывали к их бану!
⚪️ Дарио телеграфирует : https://www.anthropic.com/news/position-open-weights-models
Почитайте, на случай если вы переживали
@deksden_notes
😁11
Forwarded from Данила
Для тех, кто хочет:
дополнить свое базовое образование востребованной IT-профессией.
В новом учебном году вас ждут как уже знакомые программы, так и абсолютно новые:
Кто ведет
Для кого
Остались вопросы? Пишите нам в бот: @digital_mephi_bot
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥5👍3👌3❤1💅1
This media is not supported in your browser
VIEW IN TELEGRAM
⚪️ Imagine Omni от SpaceX.ai на горизонте!
Из интересного: image + video + audio в одном флаконе, с референциями и обещанной консистентностью
Интересно
Imagine немного уже устарел на фоне - посмотрим что такое следующее поколение контентного Gen AI от Маска! Надеюсь в grok build будут норм лимиты на SuperGrok подписках для попробовать
@deksden_notes
Из интересного: image + video + audio в одном флаконе, с референциями и обещанной консистентностью
Интересно
Imagine немного уже устарел на фоне - посмотрим что такое следующее поколение контентного Gen AI от Маска! Надеюсь в grok build будут норм лимиты на SuperGrok подписках для попробовать
@deksden_notes
👍2🔥2🤔2
⚪️ Grok Build
Да, нейминг - топ, никакой путаницы!
На grok.com появился режим build - аналог как в Google AI Studio есть режим Build. Тут тоже на сайте можно собрать приложение и опубликовать его на хостинге.
Вот такое веб приложение - билдер.
🔗 Видео презентация : https://x.com/grok/status/2082134072793637196/video/1
@deksden_notes
Да, нейминг - топ, никакой путаницы!
На grok.com появился режим build - аналог как в Google AI Studio есть режим Build. Тут тоже на сайте можно собрать приложение и опубликовать его на хостинге.
Вот такое веб приложение - билдер.
🔗 Видео презентация : https://x.com/grok/status/2082134072793637196/video/1
@deksden_notes
👍4🔥2❤1👌1
⚪️ MCP - Новая версия стандарта, 2026-07-28
Да, вот такая вот версия. Предыдущая выходали аж в ноябре 2025. Добавки довольно важные:
• ядро MCP становится stateless - вместо двунаправленнного протокола с состоянием, мы приходим к системе stateless запрос/ответ; это позволяет запускать сервера как на edge средах, так и за load balancers;
• расширения стандарта (extentions): MCP apps (это UI с сервера), Tasks (для длительных операций), Enterprise Auth
• дальнейшее развитие системы авторизации в рамках стандарта
CLI конечно здорово, но коннекторов в формате MCP сделано масса, для web приложений опять же - самое оно. Рад что стандарт развивается.
Подробнее все описано в блоге:
🔗 Блог : https://blog.modelcontextprotocol.io/posts/2026-07-28/
(кстати - на хроме у меня блог подглючивает - смотрел сафари. эпоха вайбкодинга)
Живьем все на Клоде работает. Все четыре SDK первого тира (которые самим комитетом стандарта поддержаны) тоже выпущены и доступны - TypeScript, Python, Go, C#. Rust SDK поддерживает эту версию в бэта.
🔗 Гитхаб: https://github.com/modelcontextprotocol
🔗 Официальная дока : https://modelcontextprotocol.io/docs/2026-07-28/getting-started/intro
@deksden_notes
Да, вот такая вот версия. Предыдущая выходали аж в ноябре 2025. Добавки довольно важные:
• ядро MCP становится stateless - вместо двунаправленнного протокола с состоянием, мы приходим к системе stateless запрос/ответ; это позволяет запускать сервера как на edge средах, так и за load balancers;
• расширения стандарта (extentions): MCP apps (это UI с сервера), Tasks (для длительных операций), Enterprise Auth
• дальнейшее развитие системы авторизации в рамках стандарта
CLI конечно здорово, но коннекторов в формате MCP сделано масса, для web приложений опять же - самое оно. Рад что стандарт развивается.
Подробнее все описано в блоге:
🔗 Блог : https://blog.modelcontextprotocol.io/posts/2026-07-28/
(кстати - на хроме у меня блог подглючивает - смотрел сафари. эпоха вайбкодинга)
Живьем все на Клоде работает. Все четыре SDK первого тира (которые самим комитетом стандарта поддержаны) тоже выпущены и доступны - TypeScript, Python, Go, C#. Rust SDK поддерживает эту версию в бэта.
🔗 Гитхаб: https://github.com/modelcontextprotocol
🔗 Официальная дока : https://modelcontextprotocol.io/docs/2026-07-28/getting-started/intro
@deksden_notes
👍12❤2
⚪️ Visa Vulnerability Agentic Harness — Agentic SAST Pipeline
О, чего бывает! Открытый софт от Visa - упряжка для агентного поиска уязвимостей, аж целый оркестратор с пайплайном
🔗 Сабж: https://github.com/visa/visa-vulnerability-agentic-harness
Буду изучать, чего они там накрутили! Любопытное...
@deksden_notes
О, чего бывает! Открытый софт от Visa - упряжка для агентного поиска уязвимостей, аж целый оркестратор с пайплайном
🔗 Сабж: https://github.com/visa/visa-vulnerability-agentic-harness
Буду изучать, чего они там накрутили! Любопытное...
@deksden_notes
👍8
⚪️ Slop Code Bench - третья часть статьи
Я уже писал про первые две части ранее : https://t.me/deksden_notes/1032
Там вроде бы ничего сильно прорывного для людей в теме агентного кодинга нет, хотя и интересное.
Но третья часть - в каком то смысле совсем другая и даже интереснее предудущих.
Поднята тема слопа и как его рождают модели. Рассказывают про SlopCodeBench. Много текста, графиков, наблюдений. Конечно, хотелось бы получше систематизировать и структурировать, но за поднятую тему - огромный респект, это было как минимум оригинально.
По мне - так обязательное чтение
🔗 Прочитайте : https://x.com/dexhorthy/status/2081797628552270027
@deksden_notes
Я уже писал про первые две части ранее : https://t.me/deksden_notes/1032
Там вроде бы ничего сильно прорывного для людей в теме агентного кодинга нет, хотя и интересное.
Но третья часть - в каком то смысле совсем другая и даже интереснее предудущих.
Поднята тема слопа и как его рождают модели. Рассказывают про SlopCodeBench. Много текста, графиков, наблюдений. Конечно, хотелось бы получше систематизировать и структурировать, но за поднятую тему - огромный респект, это было как минимум оригинально.
По мне - так обязательное чтение
🔗 Прочитайте : https://x.com/dexhorthy/status/2081797628552270027
@deksden_notes
🔥9👍5