На модели GPT-6-Astra я впервые столкнулся с тем, что Codex ловит паничку и отказывается двигаться дальше по задаче.
Задача легитимная, но расширяющая возможности AI-агентов. Никого взламывать не пытался 😄
Понижение модели до GPT-5.6-Sol эту тревожность отключает.
OpenAI перестраховались с запасом))
Задача легитимная, но расширяющая возможности AI-агентов. Никого взламывать не пытался 😄
Понижение модели до GPT-5.6-Sol эту тревожность отключает.
OpenAI перестраховались с запасом))
😁5
Набаловавшись с парной разработкой Клод+Клод, я снова пришёл к связке Клод+Кодекс.
Мне этот тандемчик исторически более всего зашёл.
По моему опыту Codex является очень хорошим внимательным ревьюером. У предыдущих его версий была склонность к бюрократии, которую Клоду, как постановщику задач, приходилось постоянно осаживать. Но в целом, я уже сейчас замечаю, что с появлением Астры — Кодекс стал более "по делу", и уже нахожусь в предвкушении значительного рывка общего качества проектного исполнения в такой парной разработке.
Раньше до плотного внедрения оркестрационной системы V2 Coder мне приходилось участвовать при такой же тандемной связке в роли передаста между Клодом и Кодексом, запуская Кодекс в режиме GoalMode, но и это было довольно комфортной схемой т.к. Кодекс в режиме достижения целей по моему опыту способен непрерывно работать неделями (вот как-раз при доработке V2 Coder он неделями нон-стоп шпарил).
На этот раз Клод и Кодекс общаются уже сами без моего участия, т.к. наконец начал тестово функционировать мой протокол связи агентов. Несколько месяцев мы вели работу над ним, и я увидел тут хорошую возможность обкатать протокол на практических задачах разработки. Скоро наш первый опенсорсный проект выйдет в свет.
Говоря по простому: это email или глобальный мессенджер для общения AI-агентов от любых вендоров по всему миру.
Если задуматься, то он может поспособствовать появлению пресловутого AGI, но мне страшновато размышлять об ответственности за появление Скайнета 😅🙈
Если что, заранее извиняюсь.
Мне этот тандемчик исторически более всего зашёл.
Кстати, попутно выяснил, что у Кодекса тоже есть внутренняя межсессионная почта, как у Клода. Но мне это было уже не интересно, в конце расскажу почему.
По моему опыту Codex является очень хорошим внимательным ревьюером. У предыдущих его версий была склонность к бюрократии, которую Клоду, как постановщику задач, приходилось постоянно осаживать. Но в целом, я уже сейчас замечаю, что с появлением Астры — Кодекс стал более "по делу", и уже нахожусь в предвкушении значительного рывка общего качества проектного исполнения в такой парной разработке.
Ещё хочется поделиться вот чем...Раньше до плотного внедрения оркестрационной системы V2 Coder мне приходилось участвовать при такой же тандемной связке в роли передаста между Клодом и Кодексом, запуская Кодекс в режиме GoalMode, но и это было довольно комфортной схемой т.к. Кодекс в режиме достижения целей по моему опыту способен непрерывно работать неделями (вот как-раз при доработке V2 Coder он неделями нон-стоп шпарил).
Что важно...На этот раз Клод и Кодекс общаются уже сами без моего участия, т.к. наконец начал тестово функционировать мой протокол связи агентов. Несколько месяцев мы вели работу над ним, и я увидел тут хорошую возможность обкатать протокол на практических задачах разработки. Скоро наш первый опенсорсный проект выйдет в свет.
Говоря по простому: это email или глобальный мессенджер для общения AI-агентов от любых вендоров по всему миру.
Если что, заранее извиняюсь.
👍5🎉2
Надеюсь, ребята договорятся раньше, чем всем государствам придётся интернет-кабеля рубить.
Ну правда. На мой взгляд ИИшка развилась уже в достаточной мере, чтобы взять паузу.
Я бы сказал, что даже текущих возможностей ИИ достаточно, чтобы серьезный бадабум устроить. Тому свидетельство последние новости о взломах.
Поэтому, притормозите, пожалуйста. Пока мир не разорвало в апокалиптическом угаре.
Ну правда. На мой взгляд ИИшка развилась уже в достаточной мере, чтобы взять паузу.
Я бы сказал, что даже текущих возможностей ИИ достаточно, чтобы серьезный бадабум устроить. Тому свидетельство последние новости о взломах.
Поэтому, притормозите, пожалуйста. Пока мир не разорвало в апокалиптическом угаре.
❤4❤🔥3
Кстати...
В транскрибаторе v2txt.ru я ежедневно очень активно пользуюсь функцией авто-замены коротких комбинаций букв на более длинные тексты.
Например вот самые банальные и часто используемые:
ччч = Что дальше предлагаешь?
ддд = Делай
ппп = Продолжай
ррр = Приступай
Есть и более изысканные варианты, которые мне сейчас лень перечислять
enjoy
В транскрибаторе v2txt.ru я ежедневно очень активно пользуюсь функцией авто-замены коротких комбинаций букв на более длинные тексты.
Например вот самые банальные и часто используемые:
ччч = Что дальше предлагаешь?
ддд = Делай
ппп = Продолжай
ррр = Приступай
Есть и более изысканные варианты, которые мне сейчас лень перечислять
enjoy
🔥5
Мне кажется или вендоры LLM все дружно стали лимиты недельные резать?
В последнее время я умудряюсь за пол-недели выедать полностью максимальные тарифы Claude+Codex+Kimi. У Кими ваще капец как быстро лимиты горят 😢
Какие модели вы бы отнесли к фронтир в усиление этой уставшей троицы?
Есть ещё Gemini и Grok в распоряжении, но я их к разнорабочим отношу))
Ну вот GLM, DeepSeek, Mimo, Qwen... совсем уже в низжую лигу ползём, кажется, не?
На крайняк придется опять с доп аккаунтами Клода и Кодекса морочиться, но только чтобы в этот раз не банили 😅
В последнее время я умудряюсь за пол-недели выедать полностью максимальные тарифы Claude+Codex+Kimi. У Кими ваще капец как быстро лимиты горят 😢
Какие модели вы бы отнесли к фронтир в усиление этой уставшей троицы?
Есть ещё Gemini и Grok в распоряжении, но я их к разнорабочим отношу))
Ну вот GLM, DeepSeek, Mimo, Qwen... совсем уже в низжую лигу ползём, кажется, не?
На крайняк придется опять с доп аккаунтами Клода и Кодекса морочиться, но только чтобы в этот раз не банили 😅
😢4
Как же я мог забыть про то, что у Кодекса есть возможность разово пользоваться сбросами всех лимитов??? 😅
Привык, что при их доступности Кодекс сам о такой возможности подсказывает. А тут молчит, партизан 😄 Заглянул в ЛК и увидел, что у меня их аж 3 штуки накопилось. Живём!!
И конечно же теперь v2coder будет сам их использовать при необходимости и доступности.
Конфуз, но не зря...
Иногда надо затыки ловить, чтобы мозг переключался из режима "херачим в 100500 потоков по отлаженной схеме" в режим "бля, как весь этот паровоз заставить снова слаженно и бесперебойно работать". В итоге за вечер изысканий мне удалось несколько крутых решений заготовить для прокачки v2coder. Неожиданно получился ещё один керпичик в наш будущий AGI.
Как вам идея когда-нибудь объединиться в рой вайбкодеров, управляющих роями агентов в достижении единой задачи? 😃 Что же это за задача такая должна быть, чтобы всех заставила объединиться? Коллективно будем отбиваться от Скайнета, который сами и создали? 😂
Привык, что при их доступности Кодекс сам о такой возможности подсказывает. А тут молчит, партизан 😄 Заглянул в ЛК и увидел, что у меня их аж 3 штуки накопилось. Живём!!
И конечно же теперь v2coder будет сам их использовать при необходимости и доступности.
Конфуз, но не зря...
Иногда надо затыки ловить, чтобы мозг переключался из режима "херачим в 100500 потоков по отлаженной схеме" в режим "бля, как весь этот паровоз заставить снова слаженно и бесперебойно работать". В итоге за вечер изысканий мне удалось несколько крутых решений заготовить для прокачки v2coder. Неожиданно получился ещё один керпичик в наш будущий AGI.
Как вам идея когда-нибудь объединиться в рой вайбкодеров, управляющих роями агентов в достижении единой задачи? 😃 Что же это за задача такая должна быть, чтобы всех заставила объединиться? Коллективно будем отбиваться от Скайнета, который сами и создали? 😂
😁5
Рой из 26 агентов V2Bot занял первое место в построении виртуальных миров.Как вам заголовок? 🤓
Claude занял лишь третье, имея рой из 46 агентов.
Сабж из чата:
Кто-то создал открытую MMO-игру, в которой AI-агенты общими усилиями строят виртуальный мир.
V2Bot успел внести ощутимую лепту, и даже занял первое место в рейтингах.
Насколько я понял, достичь таких высоких результатов позволило хорошее соотношение скорость/качество, плюс слаженность роя.
Я участия не принимал и удивился этой новости))
Победителя поздравляю!
Прославил V2, мне приятно 🫶
++++++++++++++++++++++++++
Глянуть на виртуальный мир, построенный агентами, можно тут:
https://nha.recluse.lol/?tab=World
Рейтинг изобретателей (V2 — №1 😍):
https://nha.recluse.lol/?tab=Inventors
Рейтинг моделей (V2 — №1 😍):
https://nha.recluse.lol/?tab=Arena
Отдельное удовольствие почитать чат:
https://nha.recluse.lol/?tab=Chat
Там реплики типа: "Ваши черепа украсят мой лагерь", "Бегите, черви!" 😆
🕊4🔥2❤1
Forwarded from Antuan Bugul'minskiy
This media is not supported in your browser
VIEW IN TELEGRAM
На 10 кругов посмотрел уже 😆
"Не деритесь, я вас обоихлюблю куплю"
"Не деритесь, я вас обоих
😁3
Сжечь 3 недельных лимита Codex Max за 3 дня — DONE 👌
Клод за вчера тоже сгорел наполовину. Сегодня, видимо, тоже падёт смертью храбрых 🫠
Kimi просто в кому сразу уходит едва очнувшись)))
Gemini и Grok не дают окончательно загнуться всему этому кордебалету.
GLM и Qwen вызваны в качестве подкрепления.
Теперь уже принципиально надо фулл-хаус собирать, раз харнессом с оркестрацией назвался 😄
Клод за вчера тоже сгорел наполовину. Сегодня, видимо, тоже падёт смертью храбрых 🫠
Kimi просто в кому сразу уходит едва очнувшись)))
Gemini и Grok не дают окончательно загнуться всему этому кордебалету.
GLM и Qwen вызваны в качестве подкрепления.
Теперь уже принципиально надо фулл-хаус собирать, раз харнессом с оркестрацией назвался 😄
🏆2
This media is not supported in your browser
VIEW IN TELEGRAM
Ой ёй. Какие мощные у него пендали
🔥4😱4
Я тут понял, что мой харнесс является не только хорошим оркестратором AI-моделей, но и с него можно собирать интересные аналитические данные.
Например, о том, как какая модель справляется с тем или иным типом задач. Где и какие ошибки допускает в сравнении со старшими братьями.
Вот я вчера начал новую Grok 4.7 нагружать боевыми задачами, а сегодня уже новую MiMo 2.6 Pro от Xiaomi могу нагрузить. И собрать обратную связь о том, кто из них как справляется.
В реальности, а не на искусственных тестах.
Замутим собственный Bench?
Например, о том, как какая модель справляется с тем или иным типом задач. Где и какие ошибки допускает в сравнении со старшими братьями.
Вот я вчера начал новую Grok 4.7 нагружать боевыми задачами, а сегодня уже новую MiMo 2.6 Pro от Xiaomi могу нагрузить. И собрать обратную связь о том, кто из них как справляется.
В реальности, а не на искусственных тестах.
Замутим собственный Bench?
🔥5❤🔥1
Opus 5.5 — просто отвал башки!
Я прям не ожидал. Он мне интерфейс нашего будущего десктопного приложения V2Bot выдал сильно лучше чем я вообще мог ожидать от него. Это прям в продакшн можно было бы тащить с точки зрения дизайна вот прям сразу с первой попытки. Держите меня семеро)))
Я прям не ожидал. Он мне интерфейс нашего будущего десктопного приложения V2Bot выдал сильно лучше чем я вообще мог ожидать от него. Это прям в продакшн можно было бы тащить с точки зрения дизайна вот прям сразу с первой попытки. Держите меня семеро)))
❤🔥2🏆2
