melikhov.dev
4.74K subscribers
123 photos
2 videos
2 files
233 links
Фронтенд, фронт-бек и около. Всё, что в голову пришло.

нейрорак за нейроруку
нейрогреку нейрослоп
Download Telegram
Браузерный AI-агент в Datalens

В #ГриненкоПро №16 поговорили с Андреем Мелиховым, разработчиком Яндекс Облака и автором @melikhov_dev о его опыте создания AI-агента прямо в браузере: как он вызывает тулы, строит чарты, работает с данными, проверяет себя через eval harness и почему нельзя просто так взять и прикрутить LLM в продакшне.

https://www.youtube.com/watch?v=chiexp7ncfg

В выпуске:
— почему готовых фреймворков не хватает;
— как устроены AI-агенты в браузере;
— SSE-стриминг, BFF, tool calling и agent loop;
— проблемы разных моделей и инференсов;
— evals, LLM-as-a-judge и железный пользователь;
— доверие к числам в BI и проверяемые чарты;
— заменит ли GenBI аналитиков;
— MCP, серверные агенты и будущие API;
— как Claude Code, Codex, OpenCode и другие coding agents меняют разработку;
— почему AI ускоряет разработчика в 3–5 раз, но задач становится только больше;
— безопасность и корпоративные ограничения;
— AI вне работы: ремонт, ресёрч, медицина, презентации, NotebookLM и новостной бот Андрея;
— bus factor, spec-driven development и контекст для агентов.

Искренне рекомендую канал Андрея @melikhov_dev как минимум всем фронтендерам, сам читаю его давным-давно.

Приходите обсудить выпуск в чат сообщества — @grinenko_pro.

И, конечно, не забудьте подписаться на канал на YouTube — я уже монтирую совершенно огненный выпуск с настоящим AI-продактом!

@devspotting
🔥32👍9❤6🥱5😱1
Как дотерпеть до вечера? Fable мне недоступен, так хоть Sol пощупаю (надеюсь).
🔥18😁9🥰3💯2👎1
melikhov.dev
Замечательный тул от Umputun который позволяет совсем не вылазить из консоли https://github.com/umputun/revdiff Ответ на вопрос «а как вы у себя там в консоли диффы смотрите-то?»
Жил счастливо (почти) с revdiff, но тут мне показали herdr.dev. Это такой tmux на стероидах. Умеет красиво в вертикальных вкладках собирать все запущенные агенты. Умеет в богатую мышку (для тех, кто не помнит тмуксовские хоткеи). О счастье, из коробки именует вкладки с 1, а не с нуля. Кто вообще в тмуксе придумал с нуля? Кто этот преступник? Человек с нампадом?

Умеет подключаться по ssh к запущенной сессии на удалённой машинке. И тогда можно тягать картинки в чатик без scp. Встроенная интеграция со всеми популярными агентами.

И последнее, но не по важности — там есть плагины. А в плагинах есть herdr-reviewr который полностью заменил мне revdiff. Вы скажете, тащить целый мультиплексор ради диффа? Так и revdiff по ssh без тмукса не работает.

В общем herdr сила, tmux могила. Рекомендую (хотя бы попробовать).
🔥20💊6🦄5❤2👍1🎉1🙊1
github показал очередную полезную штуку — Stacked pull requests. Даже жалко, что как обычно в последнее время у Гитхаба эта штука почти неработает. Прямо как новая страница All pull requests. Как пошутили в чате @webstandards_ru: гитхаб живёт в балансе. У него плохо работают новые штуки, но зато старые тоже работают плохо.

При этом штука нужная. Я в своих AI PR тоже пришёл к необходимости дробить их на множество мелких, чтобы у ревьюверов не вытекали глаза вместе с мозгом. Но тут начинаются вопросы оркестрации этого добра. Надо каждый кусочек вручную вливать в main и дальше ребейзить всех потомков по цепочке. И ревьюверу как-то подсказать, что вот она, цепочка пиаров. А тут вроде бы из коробки всё есть. Здорово! Но не работает.

Проверили на нескольких репозиториях — мёрдж стека зависает. И ничего не происходит. Отдельный минус, что менеджерить это добро надо через gh, выходить из привычной среды обитания. Но тут ладно, агент справится сам.

Но хорошо, что понимают, что ревью изменилось. Будем ждать, пока стабилизируют.
👍24❤8
Как же хорошо перечитывается сейчас «Трилогия Муравейника» Гибсона (она же Sprawl trilogy). Хотя, конечно, по моему мнению прямо перечитывать стоит только Нейроманта и рассказы(тот же «Сожжение Хром»), а «Мона Лиза Овердрайв» и «Граф Ноль» достаточно скучны и вторичны. Но не настолько плохи, как вторая и третья «Матрицы», определённое удовольствие принести могут.

Где-то в Apple тоже это ощутили и бросились снимать экранизацию. Наконец-то мы увидим как выглядит небо над портом цвета экрана телевизора, настроенного на мёртвый канал.

Это я к чему — в невыносимо неоднозначное время вы живём.
❤22👍8🤔2😐2
Вы могли наверное заметить что как-то мало меня стало в последнее время. Не видно на конференциях, не слышно в подкастах, мало пишу в канале.

Маленький ребёнок забирает всё свободное время, как газ заполняет всё свободное пространство. Остаётся ещё немного на семью, работу и сон. С другой стороны, острее ощущаешь ценность тех промежутков времени, когда ребёнок спит или играет с женой и старшей. Стараешься сделать максимум. Очень воспитывает.

Так что по, большей части, контент сейчас не генерирую, а потребляю, в основном через уши. Заряжаю с утра свою dark software factory работать над тикетами и ухожу гулять под подкасты (в том числе от NotebookLM), стримы и книги (художка, конечно, чтобы мозг отдыхал). Иногда и просто в тишине набираю свои 15к шагов в день с коляской. И это прекрасная часть дня.

Максимум возможного стараюсь перенести на телефон. В ботиков, в Обсидиан, в мобильный гитхаб. Ну, кстати, здорово в Обсидиане вычитывать текстовые разборы PR и планы работ (но не спеки, хах, чур меня снова в третий раз SDD пробовать, хотя кто знает).

Проклятье и спасение наше LLM. Работать нужно больше, но за тебя работают роботы, но ты всё равно работаешь больше. Просто иначе.
❤76💯15🕊6🔥2
Разобрал своего питонячего новостного бота и собрал нового, уже на Гермесе. Ну как собрал — поднял Гермеса в облаке, зацепил на Deepseek v4 Flash (потому что в Яндексовом AI Studio пока(!) лучше нет) и дал ему топик в нашем с ним чатике, где он отгружает дайджесты. И это супер удобно, потому что Гермес самообучаемый и способен сам рыть источники, в отличии от моего простейшего ботика, который требовал редеплой на каждое изменение.

Вот он мне нарыл, что классификатор Auto Mode в Claude Code пробивается только так. И сами Антропики не считают это проблемой, потому что auto mode это мол просто удобная штука, но не гарании безопасности
Anthropic closed the report as Informative and that the behavior is working as designed.

Anthropic’s (or the security team’s) position is that Auto Mode is a convenience feature backed by a best-effort classifier, not a security guarantee.


А значит, продолжаем помнить, что запускать агентов (особенно автономных!) нужно в виртуалках и/или контейнерах, а не на рабочей машине.
🔥14😁3🤔1🎉1
Какой он — личный харнес?

Вот мы и пришли в точку, когда уже бизнес не устраивает медленная последовательная работа (запустил агента, он пошуршал полчасика, открываем PR и идём за следующей задачей). Раз у разработчиков есть в руках AI, то какого они ускорились не x5/x10? А ну давай в параллельность!

И мы такие — да ёшкин крот, и так голова пухнет! Уже непонятно, что там происходит в 10 терминальных окнах сразу. НЕВОЗМОЖНО!

А раз пухнет, то надо голове помочь. Как я это вижу: нам нужен удобный интерфейс, через который мы будем контролировать: а что там вообще происходит в мире агентов? И снижать когнитивную нагрузку от параллельности хорошим UI. Плюс, автоматизации! Зачем следить как двигается твой PR или куда там тебя ещё призвали? Пусть запущенный демон отслеживает эвенты и сам передаёт их в очереди агентам. Зачем поднимать стенды вручную? Пусть этим занимаются готовые скиллы, а демон поможет им следить за бережным обращением с ресурсами.

Т.е. буквально нужен сервер, который будет хранить стейты и мету задач и управлять агентами, их git worktrees, PR и поднятыми стендами и контейнерами. Сводить всё воедино.

Открываешь такой контрол центр и видишь, в каких чужих пиарах сейчас работают твои агенты, какие свои пиары они сопровождают, какие задачи разрботки бегут (и, конечн,о артефакты планов и спецификаций к этим задачам). Диффы опять же можно там же вычитывать. Если надо — проваливаешься в конкретного агента.

Есть ли готовое такое решение? Я не встретил пока. Верю ли я в то, что чем-то таким может стать тот же Codex? Вполне. Но мне не нужно решение, завязанное на одно конкретное семейство моделей одного провайдера. Этот центр упраления должен быть на другом уровне абстракции. И, конечно, я не хочу запускать агентов на своей машине.

К счастью, у нас есть веб-технологии. Можно собрать свою dark software factory и прикрутить к ней самописный web UI. И именно этим я и занимаюсь по вечерам, точу свой тёмный заводик. И уверен, что многие из вас тоже.

И я никак не могу для себя оценить, насколько это нормально, что каждый пилит своё собственное решение. Но, кажется, удобное общее тут тоже не может быть.
❤35💩32👍15😭11💊6💯4🤔2
Блин, ну нравятся мне TUI решения, сил нет. Просто, красиво и понятно (для меня). Продолжаю кайфовать от herdr, тем более после того, как они добавили machine и стало совсем удобно.

Но я искренне считаю, что для головы полезно постоянно пробовать что-то новое — менять IDE, менять iOS на Android и ломать привычки. Так что посижу следующую неделю на Orca, тем более ребята в нашей команде форкнули её и докинули поддержку Трекера и Сорскрафта. И не раз на презентации ткнули меня палочкой, мол Андрей сидит в консоли и не хочет пробовать красивый GUI

Что же, попробую! Всё равно я всё ещё в поисках идеальной ADE (Agent Development Environment).

Кстати, как предлагали в комментариях под прошлым постом — запихнул весь стейт задачи в комментарии Трекера. А чего бы и нет, работает и работает хорошо. Если тут меня кто-то из трекера читает — вы это, не пропустите момент, сделайте хранилище для AI артефактов в задачах, это прямо нужно.
👍25❤9😱3🤮3
https://www.aymannadeem.com/artificial/intelligence,/developer/tools/2026/09/24/plan-mode-is-dead.html

Вот Айман Надим расписал то же, что и я почуствовал попробовав плотно посидеть на SDD. Схема с расписываение сверхподробного плана и последующей реализацией по нему — у автора (и у меня) не работает. Мы получаем этап утомительного выписывания спек, вычитывание тонн отвратительного текстового слопа и всё ради того, чтобы в конце понять, что надо всё стоит сделать немного иначе. Айман успел даже софт написать, расписывающий спеку человеческим языком (я тоже думал о таком).

Но факт в том, что модели уже прекрасно справляются без плана. Точнее, они сами умеют ставить себе план, когда это нужно. Гораздо важнее, чтобы модель поняла, в какой момент нужно привлечь человека, чтобы уточнить, идём ли мы туда, куда нужно идти. В последнее время я вижу, что на гриллинг сессиях я чаще просто принимаю всё, что предложила модель, но в процессе реализации мы всё равно уходим на множество итераций вылизывания финального результата — вопросы которые появились ПОСЛЕ первой реализации на гриллинге даже и не возникали. И это нормально, мы так и жили всегда (уф, как меня вымораживали всегда попытки заранее спланировать и оценить командой всего слона целиком).

Но вывод всё равно печальный. Да, планы/спеки может быть не нужны. Но как эффективно оставаться в контексте быстро изменяемого нейронкой проекта всё равно непонятно.
🔥20👍17🥴3❤1👎1💯1