DEKSDEN notes
2.85K subscribers
545 photos
10 videos
2 files
614 links
Мои заметки на разные темы, уровень - "для продолжающих")
Vibe Coding -> AI SWE, AI Coding Tools, Agents: Claude Code, Codex, news, links
Чат (!!!): https://t.me/+B1fB3sZbaVthMDhi

(с) 2025-2026, @deksden
Download Telegram
Opus 5


Да, вот так вот - в пятницу вечером!) Совсем на гиков рассчитывают что ли?! «Мадам, это к вам не относится, но, мальчик …»


А вот модель как раз выглядит по бенчам бодро! Практически уровень Фубли за цену Опуса. Супер!

Оч сильная агентность. Очевидно что модель тренировали как агента-оркестратора. Линейка так и выстраивается: фубля на оракула тянет, опус оркестрирует сварм соннетов, хайку на подхвате по мелким поручениям.

Бенчи это конечно хорошо, но тут надо тестить.

(Ц) фронтир двигается, господа!

@deksden_notes
🔥17👍21🤡1
Forwarded from bishx devlog
Пару недель назад я делал пост о том, что не всегда оптимально использовать сложные пайплайны для работы с нейросетями

Недавно была задача взять одну систему за основу и усовершенствовать её – кое-что выпилить, кое-что допилить, что-то оставить

Был выбор:
1. Использовать сложный пайплайн (публичный вариант) с трехчасовым планированием, 20+ часами исполнением плана, декомпозицией задач в YouTrack и ветками в системе контроля версий. Жесть, в общем
2. Использовать обычный чатик с ручными итерациями "перепиши и проверь"
3. Взять что-то между п.1 и п.2: адаптивный полуавтономный пайплайн под среднебытовую задачу с приоритизацией общения в чатике

По сложному названию и ссылке на гит можно догадаться, что я выбрал третий вариант. Мои два промпта кодексу звучали так:
1. "$bx-dev"
2. "/goal возьми из репы Х все python исходники. Перепиши весь проект на go в более сопровождаемый вид. В каждой итерации используй нужные скиллы из skill-library. Следуй протоколу $bx-dev. Критерий завершения – система полностью перенесена на go и проверена на отсутствие потерь бизнес-логики при миграции"

Отличный промпт? Да! Сейчас разберём
Написав $bx-dev, мы задали рабочий контур: исследование перед изменениями, реализация, проверки, ревью и DDD классификация там, где она действительно нужна
А написав "/goal ..." – мы зафиксировали задачу, критерий завершения и требования к процессу. Агенту сложнее закончить раньше времени: при попытке остановиться его возвращает к цели, проверкам и требованиям из $bx-dev и напоминанию использовать skill-library (буст +16 п.п. к эффективности)

Получается, что у нейронки нет нормального выхода из цикла, пока она не сверится с критерием завершения: полностью перенести систему и не потерять бизнес-логику. При каждой попытке останова её пинают и говорят следовать промпту из /goal, который отлично напоминает про задачу и требования к её исполнению

Отправили всё в кодекс и ушли заниматься своими делами, – спустя 8 часов имеем ваншотом полностью перенесенный проект на другой яп. Запустили, проверили – есть пара мелких недочетов, но фиксятся они за 5-10 минут

Суть в том, что $bx-dev сам по себе вполне автономен и хорошо справляется с большинством задач. А в связке с /goal мы это дополнительно усилили, исключив потерю контекста с течением времени


Теперь самое интересное... Я решил в паблик выложить свой bx-dev skill и встроенную skill-library с механизмом ленивой загрузки 105 скиллов, которые использую в повседневных задачах

В репе описал, как устроен скилл и как с ним работать в разных сценариях
Скилл самодостаточен и готов к работе из коробки, нужны лишь утилиты gh (для git репы проекта) и jq (для записи состояний)

☁️ Исходный код: GitHub

#opensource
Please open Telegram to view this post
VIEW IN TELEGRAM
👍19🔥106
Forwarded from Циничный AI (Anton Goncharenko)
https://t.me/deksden_notes/1027

Продолжение к вчерашнему посту про skill technical-premortem

Я решил его строго проверить. Взял реальные планы (включая те, что уже были ранее без проблем реализованы), прогнал через разные версии скиллов (от 600 до 50 строк) на моделях Sol и Opus.
⚠️ В том числе сравнивал с моделями, которые делали проверки вообще без skill.
Привлёк независимых судей-верификаторов Sol и Fable. Сравнил количество подтверждённых находок, мусор, вердикты и затраты токенов.

Главный вывод: скилл не делает модели умнее – они и так всё умеют.

Никакой когнитивной активации с помощью premortem техники не происходит, никаких дополнительных возможностей модель не получает.

Но skill всё равно работет, он убирает панические блокировки, режет мусор и дисциплинирует формулировки.

Краткий разбор в 4-х постах + сам skill + сравнение и различие в поведении Sol vs Opus/Fable

https://t.me/cinicai/116
https://t.me/cinicai/117
https://t.me/cinicai/118
https://t.me/cinicai/119

#opensource
🔥8👍4
⚪️ Codex reset (!!!)


Несмотря на завершение "фестиваля миллионов" - кто помнит, мы таки достигли 10м пользователей, и дальше клозеды не обещали ресетов за каждый миллион, но зато сегодня был сбой - и у нас снова ресет!

Ура) Вовремя

Но надо думать чего делать с флоу/аккаунтами - категорически нехватает квот

@deksden_notes
1👍15💯8🔥5👻2
⚪️ Статья - почему Software factories не работают


Тут нужно прочитать статью, аж в двух частях:

🔗 Начало: https://x.com/dexhorthy/status/2080697380379427275?s=46
🔗 часть 2: https://x.com/dexhorthy/status/2081058573556306030?s=46

Чел пишет про то, в чем сейчас лажают модели в кодинг. Аргументированно, правда СИЛЬНО развернуто.

Но тема поднята сильная. Надо будет обсудить!

Если много народа ниосилят, буду писать пересказ - но мне кажется тут и агент растолкует если что.

Прочитайте! Обсудим

Ну и кто чего думает? В комменты ⬇️

@deksden_notes
👍11🔥11❤‍🔥2
Пока все продают курсы по AI, Иванов просто каждый день что-то вайб кодит.

За последние месяцы он навайбкодил десятки проектов: автозалив в Fb, Telegram-сетку на 3000+ каналов, парсеры абсолютно всего и они работают, AI-агентов и автоматизацию для спайки.

Без инфоцыганства и мотивации. Только процесс, ошибки, промпты, удачные решения и мысли человека, который каждый день живёт внутри арбитражного рынка и AI.

Если интересно не смотреть, а реально строить - вам сюда:
👉 @CPACoder
👎11😁5👍4🔥2👀2
Forwarded from Владимир П.
Привет! Написал ru-marketplace-mcp — опенсорсные коннекторы для российских маркетплейсов: Wildberries, Ozon, Яндекс Маркет и Детский мир.
Если коротко - это глаза для Claude, Opencode и любого другого AI-клиента. Подключаешь, и агент сам отвечает на «где этот увлажнитель дешевле», «что пишут в отзывах» и «кто вообще этот продавец».
Внутри 22 инструмента. Из любимого:
— реквизиты продавца на WB: юрлицо, ИНН, ОГРН. Сразу видно, официальный это магазин или перекуп с похожим названием
— вопросы покупателей и ответы продавца: там часто единственный ответ на «а кабель в комплекте?»
— разбивка оценок по звёздам на Маркете: честная там 4.8 или за ней прячется пачка единиц
— наличие в офлайн-магазинах Детского мира по городам
— сравнение цен по всем площадкам одним вызовом
Регистрация не нужна: только публичные эндпоинты, только чтение. Ozon с серверных IP упрямится - для него есть режим через ваш собственный Chrome.
Активно пилю дальше, в планах Авито, Taobao и другие площадки Китая.
https://github.com/Vladimir-Human/ru-marketplace-mcp
Зацените! Нужен фидбек, идеи и звёзды :)
#opensource
👍36🔥22❤‍🔥52
⚪️ Релиз Kimi K3


Уже скоро! Вот вот

Веса будут доступны, надеюсь много независимых провайдеров поднимит свой инференс этой модели - будет или быстрее, или дешевле, или просто больше выбор

В любом случае - хорошая новость!

🔗 Обнимашки: https://huggingface.co/moonshotai/Kimi-K3

Спасибо за напоминание @Ilya_ru_de

🔗 Техрепорт : https://github.com/MoonshotAI/Kimi-K3/blob/main/k3_tech_report.pdf

🔗 Блог: https://www.kimi.com/blog/kimi-k3

🔗 FlashKDA : https://github.com/MoonshotAI/FlashKDA

@deksden_notes
🔥9👍5
⚪️ Codex Reset анонсирован


Ждём в ближайшее!

В честь быстрого распространения ChatGPT work )) причина ж!)

——

Upd 1️⃣ : У меня докатился на все аккаунты


@deksden_notes
🔥10👍2
⚪️ Антропики НЕ против открытых моделей

И не призывали к их бану!

⚪️ Дарио телеграфирует : https://www.anthropic.com/news/position-open-weights-models

Почитайте, на случай если вы переживали

@deksden_notes
😁11
Forwarded from Данила
🚀Открыт основной набор на Цифровую кафедру НИЯУ МИФИ ‘ 26

Для тех, кто хочет:

🔵бесплатно
🔵онлайн
🔵с дипломом о профессиональной переподготовке

дополнить свое базовое образование востребованной IT-профессией.

🤩Регистрация до 6 сентября.

В новом учебном году вас ждут как уже знакомые программы, так и абсолютно новые:

🔹Управление IT проектами
🔹Прикладной анализ данных
🔹Графический дизайн
🔹Вайб-кодинг: разработка приложений с помощью AI
🔹Бизнес-аналитика и BI-системы

Кто ведет⁉️
🔵Практикующие специалисты в своих областях, выпускники и преподаватели НИЯУ МИФИ.

Для кого⁉️
🔵Обучение доступно студентам любого университета — обучающимся очной и очно-заочной формы обучения (на момент 1 сентября 2026 г.) бакалавриата и специалитета (за исключением 1 курса), а также магистратуры, аспирантуры и ординатуры, не проходившим ранее обучение на Цифровой кафедре.

Остались вопросы? Пишите нам в бот: @digital_mephi_bot
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥5👍3👌31💅1
This media is not supported in your browser
VIEW IN TELEGRAM
⚪️ Imagine Omni от SpaceX.ai на горизонте!


Из интересного: image + video + audio в одном флаконе, с референциями и обещанной консистентностью

Интересно

Imagine немного уже устарел на фоне - посмотрим что такое следующее поколение контентного Gen AI от Маска! Надеюсь в grok build будут норм лимиты на SuperGrok подписках для попробовать

@deksden_notes
👍2🔥2🤔2
⚪️ Grok Build


Да, нейминг - топ, никакой путаницы!

На grok.com появился режим build - аналог как в Google AI Studio есть режим Build. Тут тоже на сайте можно собрать приложение и опубликовать его на хостинге.

Вот такое веб приложение - билдер.

🔗 Видео презентация : https://x.com/grok/status/2082134072793637196/video/1


@deksden_notes
👍4🔥21👌1
⚪️ MCP - Новая версия стандарта, 2026-07-28


Да, вот такая вот версия. Предыдущая выходали аж в ноябре 2025. Добавки довольно важные:

• ядро MCP становится stateless - вместо двунаправленнного протокола с состоянием, мы приходим к системе stateless запрос/ответ; это позволяет запускать сервера как на edge средах, так и за load balancers;
• расширения стандарта (extentions): MCP apps (это UI с сервера), Tasks (для длительных операций), Enterprise Auth
• дальнейшее развитие системы авторизации в рамках стандарта

CLI конечно здорово, но коннекторов в формате MCP сделано масса, для web приложений опять же - самое оно. Рад что стандарт развивается.

Подробнее все описано в блоге:

🔗 Блог : https://blog.modelcontextprotocol.io/posts/2026-07-28/

(кстати - на хроме у меня блог подглючивает - смотрел сафари. эпоха вайбкодинга)

Живьем все на Клоде работает. Все четыре SDK первого тира (которые самим комитетом стандарта поддержаны) тоже выпущены и доступны - TypeScript, Python, Go, C#. Rust SDK поддерживает эту версию в бэта.

🔗 Гитхаб: https://github.com/modelcontextprotocol

🔗 Официальная дока : https://modelcontextprotocol.io/docs/2026-07-28/getting-started/intro

@deksden_notes
👍122
⚪️ Visa Vulnerability Agentic Harness — Agentic SAST Pipeline


О, чего бывает! Открытый софт от Visa - упряжка для агентного поиска уязвимостей, аж целый оркестратор с пайплайном

🔗 Сабж: https://github.com/visa/visa-vulnerability-agentic-harness

Буду изучать, чего они там накрутили! Любопытное...


@deksden_notes
👍8