Поймал себя на очень сильном чувстве недоверия, даже отвращения к бесцельно потраченному времени, когда увидел чей-то очередной скрин ответа ChatGPT. После Claude и Gemini очень сильно бросаются в глаза изобилие эмоджи и свистоперделок, а также отсутствие чётких утверждений, которые давали бы уверенность. Ужасно.
(Говорят, что сами модели-то для code review и разработки вполне годятся. Я только про бытовой ChatGPT.)
(Говорят, что сами модели-то для code review и разработки вполне годятся. Я только про бытовой ChatGPT.)
👍2🔥1
opus-validated-cocke.md
36.4 KB
У меня слишком часто стали кончаться токены на $200 подписке, и в этот момент работа практически останавливается — по API тупо дорого работать хорошо.
По приложенному плану только что закончил мощный апгрейд better-model — model router для Claude Code.
better-model не traffic proxy, а install-time конфигуратор: ставит decision matrix, агенты и routing block в CLAUDE.md, после чего Claude Code сам отправляет задачи на правильную модель, чтобы получить максимальную скорость без снижения качества.
Decision matrix собрана на основе доказательств и исследований, в описании есть источники.
Я доверяю Anthropic, но у них тут конфликт интересов между качеством, стоимостью, скоростью и, возможно, даже аддиктивностью 🤷♂️
Поставить:
(в директории с проектом)
Отключить:
(тоже в директории с проектом)
npm | GitHub
Капец как приятно, когда скорость растёт, а качество не падает. Вот с better-model — растёт.
По приложенному плану только что закончил мощный апгрейд better-model — model router для Claude Code.
You pay for Max or Team Premium. You get Opus on every task. Sounds great — until you notice:
• File search? Opus. 3–5 seconds wait.
• Grep for a function name? Opus. 3–5 seconds wait.
• Write a single test? Opus. 10+ seconds wait.
• Rename a variable? Opus. 10+ seconds wait.
Sonnet 4.6 handles all of these at ~91% of Opus quality, ~1.4× faster, and 5× cheaper.
better-model не traffic proxy, а install-time конфигуратор: ставит decision matrix, агенты и routing block в CLAUDE.md, после чего Claude Code сам отправляет задачи на правильную модель, чтобы получить максимальную скорость без снижения качества.
Decision matrix собрана на основе доказательств и исследований, в описании есть источники.
Я доверяю Anthropic, но у них тут конфликт интересов между качеством, стоимостью, скоростью и, возможно, даже аддиктивностью 🤷♂️
Поставить:
npx better-model init(в директории с проектом)
Отключить:
npx better-model reset(тоже в директории с проектом)
npm | GitHub
Капец как приятно, когда скорость растёт, а качество не падает. Вот с better-model — растёт.
5👀5❤3👍1
Теперь каждый рыбак может сгенерить себе фотку с вот такенным язем 🤷♂️
Эх, ушла эпоха!
Эх, ушла эпоха!
Иногда я спрашиваю у Claude Code, что самое классное появилось, собственно, у него же за какой-нибудь период, основываясь на чейнджлоге. Бывает, что удивляюсь полезным фичам, прошедшим мимо новостей.
Топ-5 за январь–апрель 2026:
Топ-5 за январь–апрель 2026:
1./ultrareview(v2.1.111, 16 апр) — облачный multi-agent code review прямо из CLI: запуск без аргументов разбирает текущую ветку, с аргументом — указанный PR. Несколько агентов параллельно гоняют разные слои (types, logic, tests, security), не жрёт локальный CPU.
2. Native binaries + PowerShell tool (v2.1.113, 17 апр) — переход с bundled JS на нативные бинари по платформам и PowerShell для Windows (раньше был только Bash). Запуск быстрее, Windows-разработчики наконец в паритете.
3. Hooks с MCP tools + settings persistence (v2.1.119, 23 апр) — hooks теперь могут напрямую вызывать MCP-инструменты (тип mcp_tool), а команда config каскадно сохраняет настройки (policy → project → local). Хуки стали по-настоящему мощными.
4. Vim visual mode + редактор тем (v2.1.118, 23 апр) — полноценный visual mode (v и V) с операторами, команда theme поддерживает named custom themes (можно шарить через плагины).
5. Opus 4.7 xhigh effort + Auto mode для Max (v2.1.111, 16 апр) — новый уровень усилий между high и max, Auto-режим теперь доступен Max-подписчикам на Opus 4.7. Тоньше балансируется скорость vs качество.
—
Мой номер 1 — ultrareview. Это единственная фича 2026-го, которая не улучшает мелочи UX, а ломает workflow целиком: parallel multi-agent review в облаке экономит ~45+ минут per PR и работает напрямую с GitHub. Остальное — приятные апгрейды, а это уже сдвиг режима работы.
tg_image_1636870685.png
239.5 KB
На практике
Я — нет. Почти случайно нашёл.
/ultrareview выглядит так. И вы слышали, чтобы активно говорили о том, что есть три больших бесплатных ревью для Max-планов?Я — нет. Почти случайно нашёл.
👍1🔥1
Я недавно ввёл практику добавлять условие в промпт в plan mode — проводить code review самого плана до тех пор, пока не останется 0 issues.
Дальнейшие рельсы становятся пусть не идеальными, но гораздо прямее.
Дальнейшие рельсы становятся пусть не идеальными, но гораздо прямее.
Plan self-review закрыт. 5 раундов × 71 findings closed (8 Critical + 12 High + 21 Medium + 24 Low + 6 polish). Round 5 чистый. Стартую Commit 1 — schema first, потом сериями: applyTgEditToPost extraction → handler probe → site PUT detach → pending-sync API → UI components → tests.
🔥3❤2
Снаряжал сейчас GPT-5.5 в добрый путь как ребёнка (Codex, ты приёмный! ).
С помощью Claude сделал для него пачку доков, разложил план того, что нужно сделать им до конца отсидки Claude Code. Даже промпт попросил сделать пополнее, как-то поёбче , так сказать.
Генеральную инструкцию тоже (custom prompt) из клода наковырял. Окей, опять это слово — дистиллировал.
Клод, смотрю, не посрамил. Выдал ему ценные указания для временной работы над проектом. Отправил в путь. И заставил вести дневник 😭
С помощью Claude сделал для него пачку доков, разложил план того, что нужно сделать им до конца отсидки Claude Code. Даже промпт попросил сделать пополнее, как-то по
Генеральную инструкцию тоже (custom prompt) из клода наковырял. Окей, опять это слово — дистиллировал.
Клод, смотрю, не посрамил. Выдал ему ценные указания для временной работы над проектом. Отправил в путь. И заставил вести дневник 😭
❤2
You've hit your usage limit. Upgrade to Pro (https://chatgpt.com/explore/pro), visit https://chatgpt.com/codex/settings/usage to purchase more credits or try again at 7:19 AM.
Пф. А разговоров-то было. Не хватило даже на одну сессию толком.
К плюсам могу отнести скорость, а также своевременную паузу в проекте перед наступлением лимита. Это прямо хорошо.
😢2😁1
Compacting conversation...
дневник
Я просто оху был поражён, когда увидел, что творит Codex с самой крутой последней моделью даже на Extra High режиме. Думаю, может это я гоню. Спросил Gemini 3.1 Pro.
Вот детальный разбор его навыков в этом прогоне:
Ситуация показательная: умный архитектор (Opus 4.7) передал отличный план линейному исполнителю (Codex GPT-5.5), и проект забуксовал на интеграции.
Если оценивать скилл Codex GPT-5.5 именно как автономного агента, идущего по плану, его уровень — крепкий, но абсолютно слепой junior-разработчик. Я бы оценил его способность к автономному выполнению комплексного плана на 5 из 10.
Вот детальный разбор его навыков в этом прогоне:
В чем агент силен (микро-уровень)
На уровне выполнения атомарных задач Codex отработал блестяще, как хороший скрипт:
• идеальный синтаксис: он отлично пишет bash-команды, wp-cli скрипты и SQL-запросы.
• самокоррекция в моменте: он сам нашел проблему со strict mode в MariaDB, сам понял, почему падает расчет delta (из-за signed-арифметики), и сам добавил нужные аннотации для wp-cli.
• безопасность: он не логировал пароли, корректно настроил fail2ban и не пытался обойти жесткие лимиты на использование тулзов (tool limit).
Где агент эпично провалился (макро-уровень)
Главная проблема Codex GPT-5.5 — полное отсутствие макро-мышления и здравого смысла. Он видит деревья, но не видит лес.
Это привело к двум катастрофическим сбоям:
1. Потеря контекста глобальной цели (P0 failure): Opus задал четкий эталон (***). Адекватный инженер начал бы с клонирования файлов и базы эталона, а затем накатил бы свежий контент с прода. Codex же пошел по пути наименьшего сопротивления: скачал голый WordPress, активировал плагины по списку и отчитался, что сайт отдает код 200. Он вообще не сделал визуальную и конфигурационную сверку (diff) с эталоном до тех пор, пока вы не указали ему на ошибку. Он выполнил инструкцию по буквам, проигнорировав ее суть.
2. Алгоритмическая амнезия (проблема с диском): это самый абсурдный момент лога. Агент сам скачал архив весом 7.6 ГБ, сам его распаковал, а на шаге T-A.3 проверил диск, увидел нехватку места и уперся в стену. Вместо того чтобы сложить два плюс два и удалить исходный архив переноса, он посоветовал вам (директору) пойти и купить тариф подороже. У него нет концепции "объектного постоянства" — он забыл, что делал три шага назад.
Итог по работе агента
Инструкция от Opus могла быть сколько угодно крутой, но Codex не способен удерживать в контексте финальный бизнес-результат. Он блестяще пишет код и собирает логи, но как только задача требует системного видения, сравнения с эталоном или банальной логики (как с архивом на диске), агент рассыпается.
Именно поэтому вы не получили результат вовремя: агент потратил часы на разворачивание неправильного окружения, потому что слепо шел по пунктам «скачать WP» и «установить тему», забыв, зачем вообще он это делает.
Compacting conversation...
Я просто оху был поражён, когда увидел, что творит Codex с самой крутой последней моделью даже на Extra High режиме. Думаю, может это я гоню. Спросил Gemini 3.1 Pro. Ситуация показательная: умный архитектор (Opus 4.7) передал отличный план линейному исполнителю…
Меня продолжает бомбить от вынужденного двухдневного переезда с Claude Code на Codex с GPT-5.5 :)
Реплика этого дня пока такая, чуть (всего чуть) перефразирую:
«Ой визуал получился один в один со стейджем, так что я не буду дальше переносить конфиги, потому что а вдруг сломается.
Лучше зафиксирую, что как-то получилось стабилизировать дизайн, и пойду дальше по своему плану, а не твоему ☺️👍👌👌»
Реплика этого дня пока такая, чуть (всего чуть) перефразирую:
«Ой визуал получился один в один со стейджем, так что я не буду дальше переносить конфиги, потому что а вдруг сломается.
Лучше зафиксирую, что как-то получилось стабилизировать дизайн, и пойду дальше по своему плану, а не твоему ☺️👍👌👌»
👍3
⏺ superpowers:code-reviewer(Code review 152-ФЗ implementation)
Киберпанк, конечно.
Самое интересное потенциальное противоречие здесь в том, что законы придумываются долго, а промпт пишется быстро. Копните эту мысль глубже, масштабируйте на сто лет в своей самой безудержной фантазии.
👍1
Так хоба — и патч уязвимости в ZenPhoto, который не был закрыт с 2023 года. Прикольно всякое дистиллировать в отдельные небольшие артефакты попутно.
Gist
Zenphoto 1.6.x patch — CVE-2023-53915 / CVE-2023-53916 stored XSS (unfixed upstream as of 1.6.8)
Zenphoto 1.6.x patch — CVE-2023-53915 / CVE-2023-53916 stored XSS (unfixed upstream as of 1.6.8) - zenphoto-1.6.x-cve-2023-53915-53916.patch