https://github.com/uzairansaruzi/hermex
Для Hermes выпустили нативный мобильный клиент.
что удивительно написан даже не на электроне, а на свифте.
Если можно повесить на боковую кнопку айфона, начать диктовать сразу ему что-то в чат и потом отправить, это прям будет бомбическая штука, чтобы я слез со своего агента на Pi на Hermes.
Для Hermes выпустили нативный мобильный клиент.
что удивительно написан даже не на электроне, а на свифте.
Если можно повесить на боковую кнопку айфона, начать диктовать сразу ему что-то в чат и потом отправить, это прям будет бомбическая штука, чтобы я слез со своего агента на Pi на Hermes.
❤4👍1🔥1
Чувак из твиттера попросил Kimi K3 сделать Mac OS 27
Я установил и поиграл в шахматы. Потыкал почту. Поменял волпепер. Охереть.
https://macos27.kimi.page
build a macos 27 system in my browser here that has all of the default apps and mimics liquid glass nearly perfectly and all of teh elementsare actually usable
Я установил и поиграл в шахматы. Потыкал почту. Поменял волпепер. Охереть.
https://macos27.kimi.page
🔥6👍2😁1
This media is not supported in your browser
VIEW IN TELEGRAM
https://neat-annotations.syabro.com/
https://github.com/syabro/neat-annotations
Зарелизил свою CSS-only микролибу для аннотирования всего подряд в HTML стрелочками.
С вас как обычной стар, шер, репост 🙂
#opensorce
https://github.com/syabro/neat-annotations
Зарелизил свою CSS-only микролибу для аннотирования всего подряд в HTML стрелочками.
С вас как обычной стар, шер, репост 🙂
#opensorce
❤21🔥16
Удивлен, что Валера со своим зоопарком агентов и выпускающий 1 продукт в неделю пишет про контроль.
У меня абсолютно такое же. Я вижу что агент пишет, и пока не получается «обмазать гейтами» - либо что-то новое всплывает, либо обходит. Больше правил - больше агент натыкается на взаимоисключающие пересечения и делает не так как надо.
Кстати психологически это тоже давит что «вокруг все на автомате херачат, а ты как бумер все ещё контролируешь». Даже начал сомневаться правильно ли я все делаю. Такая дихотомия скорость-качество, которая не делает тебя спокойнее
https://t.me/neuraldeep/2245
У меня абсолютно такое же. Я вижу что агент пишет, и пока не получается «обмазать гейтами» - либо что-то новое всплывает, либо обходит. Больше правил - больше агент натыкается на взаимоисключающие пересечения и делает не так как надо.
Кстати психологически это тоже давит что «вокруг все на автомате херачат, а ты как бумер все ещё контролируешь». Даже начал сомневаться правильно ли я все делаю. Такая дихотомия скорость-качество, которая не делает тебя спокойнее
https://t.me/neuraldeep/2245
Telegram
Валера Ковальский
Я посмотрел на 1069 своих коммитов и понял, где именно ломается AI-разработка
Вчера Рефат написал вещь, которая меня зацепила
"Чем умнее агенты, тем дороже ваша поверхностность"
"Что сильные инженеры всё чаще скользят по поверхности приносят ответ агента…
Вчера Рефат написал вещь, которая меня зацепила
"Чем умнее агенты, тем дороже ваша поверхностность"
"Что сильные инженеры всё чаще скользят по поверхности приносят ответ агента…
👍8❤6❤🔥1
Fellow Opus 2
https://fellowproducts.com/products/opus-2-conical-burr-grinder
Странно что я не этот
гриндер себе взял 🙂 штош
https://fellowproducts.com/products/opus-2-conical-burr-grinder
Странно что я не этот
гриндер себе взял 🙂 штош
😁8😱1
https://github.com/humanlayer/advanced-context-engineering-for-coding-agents/blob/main/benchmarking-opus-5-on-slop-code-bench.md#the-slop-meter
самое интересное начинается со второй половины
самое интересное начинается со второй половины
🔥4
Forwarded from Тимур Хахалев про AI Coding
This media is not supported in your browser
VIEW IN TELEGRAM
Способ ответа на вопросы в Codex App
Рекомендую :)
кстати, можно ещё и голосом надиктовывать заметки
подсмотрел у @etechlead
Лайк, репост,
✔ ️ Тимур Хахалев про AI Coding, подписывайтесь!
Рекомендую :)
кстати, можно ещё и голосом надиктовывать заметки
подсмотрел у @etechlead
Лайк, репост,
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥5
caffeinate — встроенная в macOS утилита, которая не дает маку уйти в сон, пока ваши агенты зарабатывают вам отрицательный баланс токенов.CLI лечится через
caffeinate -is claude — блок сна на время пока живет клод.С GUI чуток через одно место.
caffeinate -is open -a Claude не работает ибо open отдаёт управление мгновенно, кафеинейт сразу дохнет. Цепляться нужно к PID:
caffeinate -isw $(pgrep -x Claude) держит машину ровно до завершения процесса.Поэтому тупо можно открыть терминал и запустить голый
caffeinate -is на время работы, Ctrl-C по завершении. Или с таймаутом: caffeinate -ist 7200 на два часа, чтобы не забыть.PS Посмотреть, кто именно не даёт машине уснуть:
pmset -g assertions.PSS Если вам с закрытой крышечкой то ставьте Amphetamine
PSSS В комментах добавили "У Raycast есть удобный плагин, чтобы терминал не дергать"
❤8
Forwarded from Growth Marketing штуки 🦄
GOLD
Ответ на вопрос - как продовать себя в качестве фрилансера
На самом деле, на вопрос - как продавать
Ответ на вопрос - как продовать себя в качестве фрилансера
На самом деле, на вопрос - как продавать
❤17👎1
Амадей, ты совсем охренел там?
Модель косячит, делает не то что конкретно укзаано, а когда начинаешь матом разговаривать закрывает диалог.
Причем это только в Claude Desktop. К Claude Code претензий нет.
В очередной раз убеждаюсь что харнесс который ты не контролируешь - хороший способ выстрелить в ногу.
Модель косячит, делает не то что конкретно укзаано, а когда начинаешь матом разговаривать закрывает диалог.
Причем это только в Claude Desktop. К Claude Code претензий нет.
В очередной раз убеждаюсь что харнесс который ты не контролируешь - хороший способ выстрелить в ногу.
😁35👍6🤯2❤1
This media is not supported in your browser
VIEW IN TELEGRAM
Rejudge — независимая проверка для ИИ-агентов.
https://rejudge.syabro.com/ru/
https://github.com/syabro/rejudge
Выкатываю еще один свой инструмент в паблик
Код, который написал агент, можно проверить четырьмя способами, где каждый следующий способ ловит больше предыдущего:
I. Та же сессия, та же модель.
Агент перечитывает свой код. Он уже решил, что код правильный, и повторное чтение это решение не меняет.
II. Новая сессия, та же модель.
Контекст чистый, модель прежняя. У неё то же обучение и те же привычки, поэтому она пропускает ошибки, которые написала бы сама.
III. Другая модель.
Другая модель действительно находит настоящие ошибки. Но теперь у вас два мнения, и когда они расходятся, решать, кто прав, приходится вам.
Я сделал дальше:
IV. Rejudge: три модели и судья.
Все три модели получают один и тот же вопрос одновременно. Каждая работает в изолированном контексте и сама вызывает инструменты, поэтому ни одна не видит, что делают другие. Судья читает все три отчёта, задаёт уточняющие вопросы там, где они расходятся, и пишет один ответ.
Плюс агент может отправить дозапрос по
Внутри pi-sdk с поддержкой все провайдеров которые поддерживает Pi.
У меня rejudge работает на OpenCode Go (линк реферальный, $5 вам, $5 мне) за $10. Но честно перестало хватать, ибо стал юзать на любой чих, докупил еще один акк. Если есть альтернатива интереснее подскажите в комментах.
А, и воткните DeepSeek V4 Flash - у меня по работе нельзя использовать модели которые хостятся в китае :(
В комплекте
•
•
• Pi-extension с
В комментах отвечу на вопросы.
В планах
• Прогнать на DeepSWE, посмотреть что получится
• Дополировать и выкатить
• Интегрировать мой
Установка тут:
https://rejudge.syabro.com/ru/#install
Как обычно с вас звездочка репе, лайк, шер, репост, подписка, поглатить ближайшего котика, вот это все.
Ваш, @syabro_notes
#opensource #mit
https://rejudge.syabro.com/ru/
https://github.com/syabro/rejudge
Выкатываю еще один свой инструмент в паблик
Код, который написал агент, можно проверить четырьмя способами, где каждый следующий способ ловит больше предыдущего:
I. Та же сессия, та же модель.
Агент перечитывает свой код. Он уже решил, что код правильный, и повторное чтение это решение не меняет.
II. Новая сессия, та же модель.
Контекст чистый, модель прежняя. У неё то же обучение и те же привычки, поэтому она пропускает ошибки, которые написала бы сама.
III. Другая модель.
Другая модель действительно находит настоящие ошибки. Но теперь у вас два мнения, и когда они расходятся, решать, кто прав, приходится вам.
Я сделал дальше:
IV. Rejudge: три модели и судья.
Все три модели получают один и тот же вопрос одновременно. Каждая работает в изолированном контексте и сама вызывает инструменты, поэтому ни одна не видит, что делают другие. Судья читает все три отчёта, задаёт уточняющие вопросы там, где они расходятся, и пишет один ответ.
Плюс агент может отправить дозапрос по
session-id в Rejudge если есть что-то что не понравилось.Внутри pi-sdk с поддержкой все провайдеров которые поддерживает Pi.
У меня rejudge работает на OpenCode Go (линк реферальный, $5 вам, $5 мне) за $10. Но честно перестало хватать, ибо стал юзать на любой чих, докупил еще один акк. Если есть альтернатива интереснее подскажите в комментах.
{
"reviewers": [
"opencode-go/deepseek-v4-pro@xhigh",
"opencode-go/minimax-m3@xhigh",
"opencode-go/mimo-v2.5-pro@xhigh"
],
"judge": "opencode-go/glm-5.2@medium"
}
А, и воткните DeepSeek V4 Flash - у меня по работе нельзя использовать модели которые хостятся в китае :(
В комплекте
•
rejudge CLI тулза для всех агентов•
/rejudge и /rejudge-diff скиллы для работы с Rejudge в целом и проверки диффов, например перед коммитом или на PR• Pi-extension с
rejudge tool для красивого UI и более кошерной коммуникации агенту.В комментах отвечу на вопросы.
В планах
• Прогнать на DeepSWE, посмотреть что получится
• Дополировать и выкатить
/rejudge-dx-review skill• Интегрировать мой
websearchУстановка тут:
https://rejudge.syabro.com/ru/#install
Как обычно с вас звездочка репе, лайк, шер, репост, подписка, поглатить ближайшего котика, вот это все.
Ваш, @syabro_notes
#opensource #mit
🔥25❤9👍1