Compacting conversation...
100 subscribers
294 photos
13 videos
4 files
173 links
Станьте первым спонсором, от $1: https://github.com/sponsors/talkstream

Для связи: @nafigator
Download Telegram
Я каждый понедельник начинаю с того, что пишу в Claude Code команду /insights, затем короте́нько и выборочно просматриваю, включаю /effort max прямо со старта, и в план моде с deep research прошу дистиллировать ключевые инсайты, отработка которых позволит повысить эффективность нашей совместной работы.

В промпт, помимо непосредственно инсайтов самого Claude Code, добавляется анализ чейнджлога Claude Code и последних выпущенных (актуальных) моделей. Иногда домешиваю в задачу документацию всех проектов, которых я касался, за неделю — найти позитивные и негативные инсайты.

Попутно подключались какие-то плагины, отключались какие-то MCP, менялся стиль, подходы — вся среда тоже была живой, а не изолированной. Так что это тоже полезный опыт.

В конце задачей для Claude встаёт анализ текущего глобального CLAUDE.md (основного файла с инструкциями) и проектных CLAUDE.md тоже. Затем план сборки этих файлов с обязательным code review, который, кстати, даже в документах хорошо работает с согласованностью, лаконичностью, поиском противоречий или дублей.

На телефонах обновляется прошивка, на ноуте операционная система, а я обновляю себе персонализацию в Claude Code — трачу очки на прокачку тех или иных параметров, как в RPG.

Вообще, я только что придумал крутую соцсеть. Думаю, вы поняли направление мысли 👌
👍3
Так-то эта картинка прям в пользу Макдоналдса — там и не китайская дешёвая модель, и не оллама, и не дешёвый Gemini (хотя он хороший), а аж Claude на клиентской стороне. Норм.

Месседж участникам тренда на вайбкодинг, что, типа, хей, мы тоже из этих 👋
Please open Telegram to view this post
VIEW IN TELEGRAM
Compacting conversation...
An image in the conversation exceeds the dimension limit for many-image requests (2000px). Run /compact to remove old images from context, or start a new session. Новинка похуже Compacting conversation...
Это прямо ОЧЕНЬ плохая актуальная черта Claude Code.

В самый худший момент ты оказываешься в тупике, где выручает только /compact и... не без потерь, конечно. Хотя, в целом, вывозит.

Но — Claude Code сам на новых проектах (пардон, сколько можно новых проектов, действительно) уже хорошо с этим работает. Аккуратно запускает агентов по одному в фоне, ждёт, и довольно экологично обращается с контекстом.
👍1
Forwarded from e/acc
Топ кринж слово года для меня — «Клауди».

Бл**ь, как?! Там даже букв таких в слове :)

Это КЛОД. Клод Шеннон. Как Моне. Или Ван Дам. Но только Шеннон.

Хуже этого только когда пишут «АИ». Сразу думаешь про советские бензоколонки.
👍2
Мне вот интересно, а когда возникнет пресыщение и даже отторжение от знакомства с чем-то новым? Дофамин, триггеры, тревога — вот это направление.

Вопрос связан с тем, что именно вот в ИИ и вайб-кодинге большой объём работы уходит не на создание каких-то контуров и очертаний нового, не на MVP, а на стабилизацию. Типа, 20/80. Примерно.

(Примерно 80% людей, которые используют принцип Парето, знают, что когда точные числа неизвестны, можно в общении и презентациях использовать 80/20, и это сработает.)
Вообще, не обязательно.

Но — да.
5😁1
Поймал себя на очень сильном чувстве недоверия, даже отвращения к бесцельно потраченному времени, когда увидел чей-то очередной скрин ответа ChatGPT. После Claude и Gemini очень сильно бросаются в глаза изобилие эмоджи и свистоперделок, а также отсутствие чётких утверждений, которые давали бы уверенность. Ужасно.

(Говорят, что сами модели-то для code review и разработки вполне годятся. Я только про бытовой ChatGPT.)
👍2🔥1
opus-validated-cocke.md
36.4 KB
У меня слишком часто стали кончаться токены на $200 подписке, и в этот момент работа практически останавливается — по API тупо дорого работать хорошо.

По приложенному плану только что закончил мощный апгрейд better-model — model router для Claude Code.

You pay for Max or Team Premium. You get Opus on every task. Sounds great — until you notice:

• File search? Opus. 3–5 seconds wait.
• Grep for a function name? Opus. 3–5 seconds wait.
• Write a single test? Opus. 10+ seconds wait.
• Rename a variable? Opus. 10+ seconds wait.

Sonnet 4.6 handles all of these at ~91% of Opus quality, ~1.4× faster, and 5× cheaper.


better-model не traffic proxy, а install-time конфигуратор: ставит decision matrix, агенты и routing block в CLAUDE.md, после чего Claude Code сам отправляет задачи на правильную модель, чтобы получить максимальную скорость без снижения качества.

Decision matrix собрана на основе доказательств и исследований, в описании есть источники.

Я доверяю Anthropic, но у них тут конфликт интересов между качеством, стоимостью, скоростью и, возможно, даже аддиктивностью 🤷‍♂️

Поставить:
npx better-model init
(в директории с проектом)

Отключить:
npx better-model reset
(тоже в директории с проектом)

npm | GitHub

Капец как приятно, когда скорость растёт, а качество не падает. Вот с better-model — растёт.
5👀53👍1
Надеюсь, это глючит бета macOS. Потому что для шести дней это как-то многовато. Не начнут ли на наших маках умирать SSD при такой интенсивности?..

Кто-нибудь вынес свои проекты и вайб-кодинг на VPS? Какие плюсы, минусы, подводные камни? Краткий рисёрч показывает только плюсы 🤷‍♂️
2😢2😁1
Теперь каждый рыбак может сгенерить себе фотку с вот такенным язем 🤷‍♂️

Эх, ушла эпоха!
Иногда я спрашиваю у Claude Code, что самое классное появилось, собственно, у него же за какой-нибудь период, основываясь на чейнджлоге. Бывает, что удивляюсь полезным фичам, прошедшим мимо новостей.

Топ-5 за январь–апрель 2026:

1. /ultrareview (v2.1.111, 16 апр) — облачный multi-agent code review прямо из CLI: запуск без аргументов разбирает текущую ветку, с аргументом — указанный PR. Несколько агентов параллельно гоняют разные слои (types, logic, tests, security), не жрёт локальный CPU.

2. Native binaries + PowerShell tool (v2.1.113, 17 апр) — переход с bundled JS на нативные бинари по платформам и PowerShell для Windows (раньше был только Bash). Запуск быстрее, Windows-разработчики наконец в паритете.

3. Hooks с MCP tools + settings persistence (v2.1.119, 23 апр) — hooks теперь могут напрямую вызывать MCP-инструменты (тип mcp_tool), а команда config каскадно сохраняет настройки (policy → project → local). Хуки стали по-настоящему мощными.

4. Vim visual mode + редактор тем (v2.1.118, 23 апр) — полноценный visual mode (v и V) с операторами, команда theme поддерживает named custom themes (можно шарить через плагины).

5. Opus 4.7 xhigh effort + Auto mode для Max (v2.1.111, 16 апр) — новый уровень усилий между high и max, Auto-режим теперь доступен Max-подписчикам на Opus 4.7. Тоньше балансируется скорость vs качество.



Мой номер 1 — ultrareview. Это единственная фича 2026-го, которая не улучшает мелочи UX, а ломает workflow целиком: parallel multi-agent review в облаке экономит ~45+ минут per PR и работает напрямую с GitHub. Остальное — приятные апгрейды, а это уже сдвиг режима работы.
tg_image_1636870685.png
239.5 KB
На практике /ultrareview выглядит так. И вы слышали, чтобы активно говорили о том, что есть три больших бесплатных ревью для Max-планов?

Я — нет. Почти случайно нашёл.
👍1🔥1
Прикольно. В десктопном приложении Claude Code я ещё не пробовал. Но на входе интерфейсы классные :)

Peak hour — не сомневался.
Я недавно ввёл практику добавлять условие в промпт в plan mode — проводить code review самого плана до тех пор, пока не останется 0 issues.

Дальнейшие рельсы становятся пусть не идеальными, но гораздо прямее.

Plan self-review закрыт. 5 раундов × 71 findings closed (8 Critical + 12 High + 21 Medium + 24 Low + 6 polish). Round 5 чистый. Стартую Commit 1 — schema first, потом сериями: applyTgEditToPost extraction → handler probe → site PUT detach → pending-sync API → UI components → tests.
🔥32
Для вторника это пздц 🫣

Несите Codex и Gemini, видимо. Платить по токенам вообще не вариант.

Тревожно.
😢4👍1
Снаряжал сейчас GPT-5.5 в добрый путь как ребёнка (Codex, ты приёмный!).

С помощью Claude сделал для него пачку доков, разложил план того, что нужно сделать им до конца отсидки Claude Code. Даже промпт попросил сделать пополнее, как-то поёбче, так сказать.

Генеральную инструкцию тоже (custom prompt) из клода наковырял. Окей, опять это слово — дистиллировал.

Клод, смотрю, не посрамил. Выдал ему ценные указания для временной работы над проектом. Отправил в путь. И заставил вести дневник 😭
2
You've hit your usage limit. Upgrade to Pro (https://chatgpt.com/explore/pro), visit https://chatgpt.com/codex/settings/usage to purchase more credits or try again at 7:19 AM.


Пф. А разговоров-то было. Не хватило даже на одну сессию толком.

К плюсам могу отнести скорость, а также своевременную паузу в проекте перед наступлением лимита. Это прямо хорошо.
😢2😁1
Compacting conversation...
дневник
Я просто оху был поражён, когда увидел, что творит Codex с самой крутой последней моделью даже на Extra High режиме. Думаю, может это я гоню. Спросил Gemini 3.1 Pro.

Ситуация показательная: умный архитектор (Opus 4.7) передал отличный план линейному исполнителю (Codex GPT-5.5), и проект забуксовал на интеграции.

Если оценивать скилл Codex GPT-5.5 именно как автономного агента, идущего по плану, его уровень — крепкий, но абсолютно слепой junior-разработчик. Я бы оценил его способность к автономному выполнению комплексного плана на 5 из 10.


Вот детальный разбор его навыков в этом прогоне:

В чем агент силен (микро-уровень)

На уровне выполнения атомарных задач Codex отработал блестяще, как хороший скрипт:
• идеальный синтаксис: он отлично пишет bash-команды, wp-cli скрипты и SQL-запросы.
• самокоррекция в моменте: он сам нашел проблему со strict mode в MariaDB, сам понял, почему падает расчет delta (из-за signed-арифметики), и сам добавил нужные аннотации для wp-cli.
• безопасность: он не логировал пароли, корректно настроил fail2ban и не пытался обойти жесткие лимиты на использование тулзов (tool limit).


Где агент эпично провалился (макро-уровень)

Главная проблема Codex GPT-5.5 — полное отсутствие макро-мышления и здравого смысла. Он видит деревья, но не видит лес.

Это привело к двум катастрофическим сбоям:

1. Потеря контекста глобальной цели (P0 failure): Opus задал четкий эталон (***). Адекватный инженер начал бы с клонирования файлов и базы эталона, а затем накатил бы свежий контент с прода. Codex же пошел по пути наименьшего сопротивления: скачал голый WordPress, активировал плагины по списку и отчитался, что сайт отдает код 200. Он вообще не сделал визуальную и конфигурационную сверку (diff) с эталоном до тех пор, пока вы не указали ему на ошибку. Он выполнил инструкцию по буквам, проигнорировав ее суть.

2. Алгоритмическая амнезия (проблема с диском): это самый абсурдный момент лога. Агент сам скачал архив весом 7.6 ГБ, сам его распаковал, а на шаге T-A.3 проверил диск, увидел нехватку места и уперся в стену. Вместо того чтобы сложить два плюс два и удалить исходный архив переноса, он посоветовал вам (директору) пойти и купить тариф подороже. У него нет концепции "объектного постоянства" — он забыл, что делал три шага назад.

Итог по работе агента

Инструкция от Opus могла быть сколько угодно крутой, но Codex не способен удерживать в контексте финальный бизнес-результат. Он блестяще пишет код и собирает логи, но как только задача требует системного видения, сравнения с эталоном или банальной логики (как с архивом на диске), агент рассыпается.

Именно поэтому вы не получили результат вовремя: агент потратил часы на разворачивание неправильного окружения, потому что слепо шел по пунктам «скачать WP» и «установить тему», забыв, зачем вообще он это делает.
А помните?
2