Agentic World
1.1K subscribers
30 photos
3 videos
2 files
33 links
Про AI, LLM, агентов, продукты и людей
Download Telegram
Channel photo updated
Пока писал - понял, что не могу взять это и отпустить просто так 😀
5😁4👍3
Привет! Канал не заброшен 🤩

Еще перед новым годом я вписался в личный Манхэттенский проект - хочу полностью переосмыслить свой рабочий процесс и максимально его агентизировать. Что-то типа того, чем является Claude Code, но персонально под себя и без жесткой привязки к конкретному вендору. Планировал закончить за новогодние, но (спасибо оливье и рому) что-то пошло не так 🥹 До результатов Манхэттена мы еще доберемся, а пока интересная заметка:

Cursor + ChatGPT 5.2:
Хотя я хотел отказаться от курсора, полноценно у меня не вышло, потому что мои хотелки выжрали целиком все платные лимиты claude code и тот отправил меня на недельку отдохнуть. Курсором пользуюсь, но уже не по любви 💔

Gpt 5.2 прекрасна в написании кода и по ощущениям в целеполагании/планировании/коде не уступает даже Опусу. Но все порет сам Cursor - для задач НЕ написания кода напрямую он под капотом делает слишком много оптимизаций, и я прям физически ощущаю, как он пытается сделать контекст поменьше - где-то недогрепать, где-то выйти из поиска раньше нужного, ленится посмотреть весь файл, хотя он небольшой. На масштабах курсора такие оптимизации экономят миллионы долларов, но проблемы ̶н̶е̶г̶р̶о̶в̶ ̶(̶н̶а̶ ̶с̶а̶м̶о̶м̶ ̶д̶е̶л̶е̶ ̶и̶н̶д̶у̶с̶о̶в̶)̶ не волнуют, мне дела надо делать 😅

Под такими не по написанию кода задачами я имею ввиду нечто вроде "вот у тебя csv, возьми из третьей колонки значения и переложи их в базу вот в такую таблицу" - все это у курсора вызывает проблемы. А Claude Code переваривает такое хорошо! Поэтому задумываюсь попробовать gpt5.2 в его нативном исполнении и, вероятно, что будущее все же именно за нативными кодописцами.

У меня накопилось огромное количество идей для контента, что-то уже даже начато и его нужно дооформить. Елку выкидываем, а с понедельника - на лыжи! 🫡🏂

Stay tuned, как говорится!
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🔥5
Channel photo updated
Всем доброе утро и хорошей продуктивной недели

2014 - Синьор
2020 - Техлид
2025 - Вайб-кодер
2026 - Мастер-погонщик AI-агентов
2027 - Безработный
🤣16😢7🤔3💯3🤡1
Когда лопнет пузырь AI?

Я написал драфт еще на новогодних, но решил, что статье нужно как следует "настояться" и полировал уже спустя время в более холодном настроении. Изначальным поводом к ней стало большое количество интервью и подкастов с макро-финансистами, которые неизбежно затрагивали тему AI и были совершенно не так радужно настроены, как кажется внутри индустрии.

Всем очевидно, что мы внутри большого пузыря. Но лопнет ли он? Или в этот раз все будет по другому? Я попытался разобраться в технологических маниях и переложить это все на AI.

Получилось шесть вайб-школ разных отношений, 4 слоя AI со своими рисками и экскурс в железные дороги, электричество и доткомы.

Приятного чтения! Если у вас есть лайки на хабре, буду раз принять их в статью 🥰

https://habr.com/ru/articles/993078/
👍1254🔥1🤔1
Недавно я писал, что хочу полностью пересобрать свой рабочий процесс. У меня почти получилось, я наконец-то дособрал и дотолкал до своего прода AI-ассистента, который работает по голосовухам.

Раскрыл все детали и процесс в статье на хабре, если у вас есть плюсики - буду им очень рад 🤗

Писать код голосовухами через тг - это невероятно круто 🤖🫡

https://habr.com/ru/articles/994454/
🔥1353😱2
Вчера просмотрел интервью с создателем Claude Code (крутым технарем по имени Борис с лицом чувака из соседнего подъезда). Интервью одновременно легкое и инженерное, но при этом очень емко упакованное смыслами.

https://www.youtube.com/watch?v=AmdLVWMdjOk

Свои полные заметки с комментариями хочу отрефлексировать и превратить в статью позже, но почти с первых минут была произнесена мысль, максимально резонирующая со мной и агентизацией. Борис говорит, что ему очень нравится работать с "универсалами". Сейчас в основном иерархия в мире построена на разделении ролей, и многие вообще не знают (и не хотят знать!) что делают парни в соседней комнате и их специфику. Универсалы же могут как поделать что-то в инфре, так и в продукте, да и в столовой покастдевить коллег. Да, за пределами ключевой компетенеции будет хуже, но это вообще не важно, тем более сейчас.

Я всю жизнь занимался всем подряд: и фронт, и бэк и продуктами и железо банкомата поковырял, и чего только не было. Когда-то лет 9 назад я захотел сделать еще и мобильную аппку, но вообще ничего про них не знал. Месяца за два кое-как разобрался, причем отфоркался от maps.me, где была как куча легаси из c++, завернутого в objective-c и java, так и бридж от них на свежий код на swift и многое другое. Мой код был очень так себе, а помимо него пришлось поделать ASO, юнитку, изучить аппстор, изучать картографию, писать тексты, искать иллюстраторов, переводчика и много всего неприятного, чего я не знал и не умел. Но аппка в итоге была сделана, даже Apple в свой московский офис на закрытую вечеринку позвал.

Я многое делал сам, но были вещи, которые невозможно было доделать самому просто в силу экспертных навыков. Сейчас "найти подходящие спецов" - уже больше не преграда и не стопер, а огромное количество задач агентизируются и смещаются из уровня "невозможно" на "ну да, придется позаморачиваться и посидеть недельку". При должной технической сноровке, желании и дисциплине, конечно же.

Иногда я все же задавал себе грустный вопрос "ну как у людей получается заниматься ТОЛЬКО Х столько лет, а я постоянный оркестр из всего и вся", но сейчас...Сейчас универсальность превратилась в супер силу, и я давно не испытывал такого воодушевления, это что-то феноменальное. А интервью - очень хорошее, рекомендую! Про сам Claude Code там не супер много, но майндсет у гостя интересный 👍
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🔥2🤔21🤡1🌚1
Пятничное

p.s.: мое мнение таково, что какая именно циферка у opus, glm или gpt роли особо не играет, все это вкусовщина и достаточно минорные улучшения - у каждой флагманской модели есть свой вайб и "характер" и под него надо подстраиваться, но каждая из них хороша уже продолжительное время. Появление Cursor - вот это был феномен, появление Claude Code/Codex (т.е. нативки) - феномен, а посты "OPUS 4.6 ИЗМЕНИЛ ВСЕ" - индуцированный техношум и повод для отписки 😀

Всем хороших выходных и много хорошо сгенеренного кода 🤙
👍8😁5👨‍💻2👀1
Идеальный DX
Одна из самых мощных фичей агентов, за которую мы их так любим, - это планирование. Можно проектировать законченные по смыслу фичи (двигаясь итерациями) или же просто бабахнуть верхнеуровневое описание чего-либо и затем получить нечто готовое, что надо аккуратно довести до ума. Любой более-менее умный агент имеет функцию предварительной оценки поставленной задачи - "мне идти ее делать сейчас или сначала стоит немного подумать".

Как правило, с планом результат получается сильно лучше, но я люблю разрабатывать именно фичами, поэтому даже если планирование и включается, то требует лишь визуального ревью и с которым я сходу согласен.

Но тут я влез в большой рефакторинг и наткнулся на феноменальную фичу в Claude Code. CC разработал план, но в некоторых пунктах он засомневался над тем, как сделать лучше - и прерывается на обратную связь, предлагаю варианты и кратко описывания плюсы/минусы каждого из них.

Это очень круто само по себе, но я обратил там внимание на не самую заметную штуку "Chat about this" и это просто нереальный DX (это как UX, только именно developer experience): вот CC спрашивает у меня хочу ли я дропнуть какую-то таблицу в рефакторинге. А? Что? Какая таблица? Я вообще не помню что это за таблица и когда была заведена.

Мы переходим в "chat about this" без отрыва от производства и дальше временно создается отдельный чистенький тред, в который прокинута основная инфа и заполнен контекст по теме, и который готов к тому, что вы можете углубиться в данный вопрос вот прям сразу. Как только вопрос решен - тред удаляется, а решение по выбору следующего шага уже в сто раз более осмысленное.

Все это настолько круто, что возвращаться во времена IDE уже решительно не хочется. Но есть огромный минус - мы не заметили, как наше любимое программирование сделали платным, а на 23 февраля теперь хочется попросить уже не носки и бритву, а подписку на CC Max с безлимитным овердрафтом 🤩
Please open Telegram to view this post
VIEW IN TELEGRAM
5😁5🤔3👨‍💻21
sam-khinkaltman.mp4
8.6 MB
Пока готовлю большой пост о своих экспериментах с промышленным агентик кодингом (будет интересно!), поделюсь забавностью - в какой-то момент ChatGPT-5.3-Codex решил частично перейти на грузинский. Эта штука зовется language leakage и случается из-за того, что трансформеры мультиязычны и в одном и том же эмбединг-пространстве живут одинаковые по смыслу слова из разных языков. В какой-то момент LLM решила ̶с̶ъ̶е̶с̶т̶ь̶ ̶х̶и̶н̶к̶а̶л̶е̶й̶ провалиться в грузинский, а потом резко вернулась обратно. Регулярно вижу китайский и прочий миссленгвидж во внутреннем ризонинге многих моделей, но грузинский - вижу первый раз.

Решил погенерить, что могло быть за кадром: Qwen-Image и Seedance 1.5 😅 Как же это все чертовски увлекательно, а 🤖💥
🔥6😁62🐳1💅1
Context automatically compacted 🦾

Все мы знаем, что у модели есть контекстное окно, но это - очень непростая вещь. Заявляется, что оно, например, один миллион токенов, но на деле только около половины из них эффективны, поскольку после этого начинается контекстный дрейф или вообще деградация. Это ожидаемое поведение трансформеров, но замеры там очень интересные - у меня есть в бэклоге перевод классной статьи, где такое замеряли, скоро доберусь.

При работе с фанатичной кодогенерацией контекст забивается достаточно быстро, поэтому для продолжения работы требуется процесс, который называется компактизация - это когда все накопленное сжимается до определенного уровня. Существуют разные механизмы компактизации: вычленение фактов, суммаризация, скользящее окно, грубое обрезание и многие другие под задачу. Очень важно знать, какая именно компактизация происходит, а в идеале - не доводить до этого, либо контролировать процесс самостоятельно.

Когда мы заканчиваем задачу и переходим к новой, проблем зачастую не возникает, так как у нас нет предыдущего контекста. Самый жесткий случай компактизации, который у меня был, произошел, когда я так увлекся, что накидал много мелких задачек в чатике и затем дал делать сложную задачу про шифрование сообщений. Агент пыхтел 12 минут, дозабил все окно, затем сделал сжимание контекста, а затем благополучно продолжил работать над задачей еще 14 минут.

Он изменил 31 файл, но на выходе сообщил, что изменил цвет кнопки и увеличил шрифт. Я сначала не мог понять о чем речь, но потом все быстро понял: я действительно в самом начале чата просил это сделать и на сломе контекстного окна эта задача стала самой важной и приоритетной и в итоге получилось не шифрование, а мусор.

Поэтому лучше не доводить до компактизации, особенно до той, про которую мы детально не знаем как именно она делается.

P.S.: мем с собаками - один из моих любимых, обожаю вставлять его в серьезные презы 😀
💯3👍2🤔2🌚1
HIGH EFFORT и за все надо платить
Вчера Антропику поплохело - в их датацентр в ОАЭ что-то прилетело. Об этом я узнал достаточно интересным образом: я делал микро-задачку в вебе - вот прям буквально заменить пару блоков в верстке. Это была финальная микро-правка и поэтому режим "high effort" уже снимать не стал. Написал задачу, отправил, и переключился на дела в кодексе. Вернувшись минут через 10 я увидел до сих пор крутящийся слайдер. Обновил - крутится. Гугланул новости - "в aws что-то прилетело", ну ок, ждем, я никуда не спешил. Спустя еще какое-то время выдалось сообщение о проблемах с контейнером (на их стороне бэка), после чего слайдер опять начал безмолвно крутиться.

Я очень увлеченно делал дела с кодексом, и спустя, наверное, еще минут 20 решил проверить что же там было.

"Бро, у меня проблема с докером, проблему так и не починил, правки внести не могу и я их потерял, перепробовал все что мог. Кстати, я на эту микро-правку в процессе добил 30% твоего недельного лимита, приходи в субботу теперь"

P.S.: я нашел для вас эксклюзивные фотографии объекта, прилетевшего в ДЦ
😁9🤯2🐳1🤣1
Дописал большую статью, которую пытался дописать последние 2 недели 🍺

В ней рассуждения на тему того, как изменится продуктовая разработка после появления инструментов типа Claude Code/Codex и похожих. Просто рассуждать - скучно, поэтому я провел эксперимент по созданию продукта с нуля, немного позалезал внутрь claude code, обвесил телеметрией и замерил - но не все собранное пока переварил, потому что все ожидаемо оказалось не просто, но на эту тему точно буду писать дальше.

Следующий заход будет про стоимость фичеразработинга и вообще экономику AI-assisted кодинга 🤖💸

В безумно интересное время живем, оторваться просто невозможно

Приятного чтения, буду рад лайкам на хабре и тут 🤗
https://habr.com/ru/articles/1006912/
👍175🐳41🔥1
Парсинг тех, кто этого очень не хочет, или внутренности Cloudflare

Решил на выходных реанимировать один проектик, который потрошит целиком большой сайт с футбольной статистикой. Они поставили Cloudflare в максимально жестком режиме и пройти его — по-настоящему сложный квест. Клаудфлер стронг.

Большую часть защиты на роботность в мире можно обойти заранее прогретой фабрикой браузеров. То есть, когда мы серверно запускаем браузер, ходим в гугл, гуляем из него по сайтам, двигаем по ним мышкой — в общем, создаём "историю", как будто мы человек. Но большая часть защиты построена на принципе "чтоб не мешали": сначала нас чекают мягко и пропускают даже с высоким скором роботности, а затем по мере нарастания подозрения повышают чекалку до максимальной. Прогрев и малый объем парсинга в таких ситуациях отводит большинство подозрений, и всё работает замечательно.

История с просто хождением через прокси, открытием в инкогнито и прочими трюками — работает, но на по-настоящему больших сайтах оно пускает лишь потому, что это разрешили. Если проблема роботов стоит остро, то под каждого юзера собирается сложный слепок его данных (т.н. "ml-фингерпринт"), который в себя включает как настоящие браузерный fingerprint на пару с ссетевым fingerpint, так и большое множество параметров юзера вообще. При желании найти того, кого уже задетектили, но он открыл еще один браузер — не очень сложно.

Клаудфлер особо силен тем, что у него такие фингерпринты сквозные через весь интернет — они делают слепки юзеров со всей своей базы и могут с ней же сверяться.

Это больно! Большинство вариантов обрубает даже до чекбокса (он не показывается, только загрузка). Если пробиться, то просто кликнуть мало — там очень хитрый shadow DOM.

Что пробовал
Перепробовал практически все стандартные подходы, которые обычно используют для обхода антиботов:
— Headless браузеры со stealth-патчами (Playwright + stealth, Camoufox)
— TLS-имперсонация с куками без браузера (curl_cffi)
— Альтернативные библиотеки автоматизации (DrissionPage + Chromium)
— Запуск через виртуальный дисплей (xvfb)
— undetected-chromedriver
— Клики по экрану через xdotool
— Полностью чистый Chrome без CDP/WebDriver вообще
— Попытки исправить WebGL окружение (SwiftShader)

Результат у всех вариантов по сути одинаковый: страница крутит "Just a moment...", либо чекбокс появляется, но не реагирует на клики (точнее клик как js-событие случается, но это не тот клик). Что-то из этого завелось, но на один раз - следующая показ чекбокса через несколько страниц уже снова отсекал такого клиента.

Вывод
Главный урок из всей этой истории — современные антиботы ушли ооочень далеко вперед и это огромная система корреляции сигналов, где одновременно анализируются: сетевой и браузерный fingerprint, tls, gpu/webgl, canvas, ip-репутация (не дай боже вам иметь подсеть IP хетцнера) и многое-многое другое.

Каждый сигнал можно подделать, но когда они начинают их склеивать и играть в вероятности - это становится инженерно очень больно и, честно говоря, никому с таким столкнуться не желаю 🤗😀
👍93😱2👾1
This media is not supported in your browser
VIEW IN TELEGRAM
Кто узнал себя? Всех с пятницей и побольше сгенеренного кода на выходных 🤙

P.S.: Claude Code/Codex вышли совсем недавно, а уже непонятно, как вообще без них жили 😀 и готовлю материал про телеметрию и экономику agentic разработки, скоро 🚀
Please open Telegram to view this post
VIEW IN TELEGRAM
😁8👍5🤣4🥱1🐳1
Channel photo updated