Compacting conversation...
100 subscribers
294 photos
13 videos
4 files
173 links
Станьте первым спонсором, от $1: https://github.com/sponsors/talkstream

Для связи: @nafigator
Download Telegram
Мне вот интересно, а когда возникнет пресыщение и даже отторжение от знакомства с чем-то новым? Дофамин, триггеры, тревога — вот это направление.

Вопрос связан с тем, что именно вот в ИИ и вайб-кодинге большой объём работы уходит не на создание каких-то контуров и очертаний нового, не на MVP, а на стабилизацию. Типа, 20/80. Примерно.

(Примерно 80% людей, которые используют принцип Парето, знают, что когда точные числа неизвестны, можно в общении и презентациях использовать 80/20, и это сработает.)
Вообще, не обязательно.

Но — да.
5😁1
Поймал себя на очень сильном чувстве недоверия, даже отвращения к бесцельно потраченному времени, когда увидел чей-то очередной скрин ответа ChatGPT. После Claude и Gemini очень сильно бросаются в глаза изобилие эмоджи и свистоперделок, а также отсутствие чётких утверждений, которые давали бы уверенность. Ужасно.

(Говорят, что сами модели-то для code review и разработки вполне годятся. Я только про бытовой ChatGPT.)
👍2🔥1
opus-validated-cocke.md
36.4 KB
У меня слишком часто стали кончаться токены на $200 подписке, и в этот момент работа практически останавливается — по API тупо дорого работать хорошо.

По приложенному плану только что закончил мощный апгрейд better-model — model router для Claude Code.

You pay for Max or Team Premium. You get Opus on every task. Sounds great — until you notice:

• File search? Opus. 3–5 seconds wait.
• Grep for a function name? Opus. 3–5 seconds wait.
• Write a single test? Opus. 10+ seconds wait.
• Rename a variable? Opus. 10+ seconds wait.

Sonnet 4.6 handles all of these at ~91% of Opus quality, ~1.4× faster, and 5× cheaper.


better-model не traffic proxy, а install-time конфигуратор: ставит decision matrix, агенты и routing block в CLAUDE.md, после чего Claude Code сам отправляет задачи на правильную модель, чтобы получить максимальную скорость без снижения качества.

Decision matrix собрана на основе доказательств и исследований, в описании есть источники.

Я доверяю Anthropic, но у них тут конфликт интересов между качеством, стоимостью, скоростью и, возможно, даже аддиктивностью 🤷‍♂️

Поставить:
npx better-model init
(в директории с проектом)

Отключить:
npx better-model reset
(тоже в директории с проектом)

npm | GitHub

Капец как приятно, когда скорость растёт, а качество не падает. Вот с better-model — растёт.
5👀53👍1
Надеюсь, это глючит бета macOS. Потому что для шести дней это как-то многовато. Не начнут ли на наших маках умирать SSD при такой интенсивности?..

Кто-нибудь вынес свои проекты и вайб-кодинг на VPS? Какие плюсы, минусы, подводные камни? Краткий рисёрч показывает только плюсы 🤷‍♂️
2😢2😁1
Теперь каждый рыбак может сгенерить себе фотку с вот такенным язем 🤷‍♂️

Эх, ушла эпоха!
Иногда я спрашиваю у Claude Code, что самое классное появилось, собственно, у него же за какой-нибудь период, основываясь на чейнджлоге. Бывает, что удивляюсь полезным фичам, прошедшим мимо новостей.

Топ-5 за январь–апрель 2026:

1. /ultrareview (v2.1.111, 16 апр) — облачный multi-agent code review прямо из CLI: запуск без аргументов разбирает текущую ветку, с аргументом — указанный PR. Несколько агентов параллельно гоняют разные слои (types, logic, tests, security), не жрёт локальный CPU.

2. Native binaries + PowerShell tool (v2.1.113, 17 апр) — переход с bundled JS на нативные бинари по платформам и PowerShell для Windows (раньше был только Bash). Запуск быстрее, Windows-разработчики наконец в паритете.

3. Hooks с MCP tools + settings persistence (v2.1.119, 23 апр) — hooks теперь могут напрямую вызывать MCP-инструменты (тип mcp_tool), а команда config каскадно сохраняет настройки (policy → project → local). Хуки стали по-настоящему мощными.

4. Vim visual mode + редактор тем (v2.1.118, 23 апр) — полноценный visual mode (v и V) с операторами, команда theme поддерживает named custom themes (можно шарить через плагины).

5. Opus 4.7 xhigh effort + Auto mode для Max (v2.1.111, 16 апр) — новый уровень усилий между high и max, Auto-режим теперь доступен Max-подписчикам на Opus 4.7. Тоньше балансируется скорость vs качество.



Мой номер 1 — ultrareview. Это единственная фича 2026-го, которая не улучшает мелочи UX, а ломает workflow целиком: parallel multi-agent review в облаке экономит ~45+ минут per PR и работает напрямую с GitHub. Остальное — приятные апгрейды, а это уже сдвиг режима работы.
tg_image_1636870685.png
239.5 KB
На практике /ultrareview выглядит так. И вы слышали, чтобы активно говорили о том, что есть три больших бесплатных ревью для Max-планов?

Я — нет. Почти случайно нашёл.
👍1🔥1
Прикольно. В десктопном приложении Claude Code я ещё не пробовал. Но на входе интерфейсы классные :)

Peak hour — не сомневался.
Я недавно ввёл практику добавлять условие в промпт в plan mode — проводить code review самого плана до тех пор, пока не останется 0 issues.

Дальнейшие рельсы становятся пусть не идеальными, но гораздо прямее.

Plan self-review закрыт. 5 раундов × 71 findings closed (8 Critical + 12 High + 21 Medium + 24 Low + 6 polish). Round 5 чистый. Стартую Commit 1 — schema first, потом сериями: applyTgEditToPost extraction → handler probe → site PUT detach → pending-sync API → UI components → tests.
🔥32
Для вторника это пздц 🫣

Несите Codex и Gemini, видимо. Платить по токенам вообще не вариант.

Тревожно.
😢4👍1
Снаряжал сейчас GPT-5.5 в добрый путь как ребёнка (Codex, ты приёмный!).

С помощью Claude сделал для него пачку доков, разложил план того, что нужно сделать им до конца отсидки Claude Code. Даже промпт попросил сделать пополнее, как-то поёбче, так сказать.

Генеральную инструкцию тоже (custom prompt) из клода наковырял. Окей, опять это слово — дистиллировал.

Клод, смотрю, не посрамил. Выдал ему ценные указания для временной работы над проектом. Отправил в путь. И заставил вести дневник 😭
2
You've hit your usage limit. Upgrade to Pro (https://chatgpt.com/explore/pro), visit https://chatgpt.com/codex/settings/usage to purchase more credits or try again at 7:19 AM.


Пф. А разговоров-то было. Не хватило даже на одну сессию толком.

К плюсам могу отнести скорость, а также своевременную паузу в проекте перед наступлением лимита. Это прямо хорошо.
😢2😁1
Compacting conversation...
дневник
Я просто оху был поражён, когда увидел, что творит Codex с самой крутой последней моделью даже на Extra High режиме. Думаю, может это я гоню. Спросил Gemini 3.1 Pro.

Ситуация показательная: умный архитектор (Opus 4.7) передал отличный план линейному исполнителю (Codex GPT-5.5), и проект забуксовал на интеграции.

Если оценивать скилл Codex GPT-5.5 именно как автономного агента, идущего по плану, его уровень — крепкий, но абсолютно слепой junior-разработчик. Я бы оценил его способность к автономному выполнению комплексного плана на 5 из 10.


Вот детальный разбор его навыков в этом прогоне:

В чем агент силен (микро-уровень)

На уровне выполнения атомарных задач Codex отработал блестяще, как хороший скрипт:
• идеальный синтаксис: он отлично пишет bash-команды, wp-cli скрипты и SQL-запросы.
• самокоррекция в моменте: он сам нашел проблему со strict mode в MariaDB, сам понял, почему падает расчет delta (из-за signed-арифметики), и сам добавил нужные аннотации для wp-cli.
• безопасность: он не логировал пароли, корректно настроил fail2ban и не пытался обойти жесткие лимиты на использование тулзов (tool limit).


Где агент эпично провалился (макро-уровень)

Главная проблема Codex GPT-5.5 — полное отсутствие макро-мышления и здравого смысла. Он видит деревья, но не видит лес.

Это привело к двум катастрофическим сбоям:

1. Потеря контекста глобальной цели (P0 failure): Opus задал четкий эталон (***). Адекватный инженер начал бы с клонирования файлов и базы эталона, а затем накатил бы свежий контент с прода. Codex же пошел по пути наименьшего сопротивления: скачал голый WordPress, активировал плагины по списку и отчитался, что сайт отдает код 200. Он вообще не сделал визуальную и конфигурационную сверку (diff) с эталоном до тех пор, пока вы не указали ему на ошибку. Он выполнил инструкцию по буквам, проигнорировав ее суть.

2. Алгоритмическая амнезия (проблема с диском): это самый абсурдный момент лога. Агент сам скачал архив весом 7.6 ГБ, сам его распаковал, а на шаге T-A.3 проверил диск, увидел нехватку места и уперся в стену. Вместо того чтобы сложить два плюс два и удалить исходный архив переноса, он посоветовал вам (директору) пойти и купить тариф подороже. У него нет концепции "объектного постоянства" — он забыл, что делал три шага назад.

Итог по работе агента

Инструкция от Opus могла быть сколько угодно крутой, но Codex не способен удерживать в контексте финальный бизнес-результат. Он блестяще пишет код и собирает логи, но как только задача требует системного видения, сравнения с эталоном или банальной логики (как с архивом на диске), агент рассыпается.

Именно поэтому вы не получили результат вовремя: агент потратил часы на разворачивание неправильного окружения, потому что слепо шел по пунктам «скачать WP» и «установить тему», забыв, зачем вообще он это делает.
А помните?
2
Forwarded from Мемофора
😁6
Compacting conversation...
Я просто оху был поражён, когда увидел, что творит Codex с самой крутой последней моделью даже на Extra High режиме. Думаю, может это я гоню. Спросил Gemini 3.1 Pro. Ситуация показательная: умный архитектор (Opus 4.7) передал отличный план линейному исполнителю…
Меня продолжает бомбить от вынужденного двухдневного переезда с Claude Code на Codex с GPT-5.5 :)

Реплика этого дня пока такая, чуть (всего чуть) перефразирую:

«Ой визуал получился один в один со стейджем, так что я не буду дальше переносить конфиги, потому что а вдруг сломается.

Лучше зафиксирую, что как-то получилось стабилизировать дизайн, и пойду дальше по своему плану, а не твоему ☺️👍👌👌»
👍3
Github, дай кнопку перехода к пополнению. Я что, должен тебя упрашивать взять денег? :)

В письме ни одной ссылки. Ни отписки, ни просто на главную. Понять этих мейл-параноиков можно, но параноики ж.
👍2