very vibe coding
120 subscribers
462 photos
126 videos
13 files
986 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Делал тут сегодня исследовательскую задачку с кодексом и дошел почти до белого каления. Переключился на Клода - на соннет - ничего, норм. Дальше уже сел на привычный опус и в режиме жесткой экономии конеткста стал разбирать вопрос.

В общем, если тщательно экономить, можно и за 20 баксов получать вменяемый результат от опуса, но эта экономия, конечно убивает - к чему привык на большом тарифе, можно спрашивать что угодно, и не париться, кто и как тебе отвечает.

И, все-таки, для таких задач Кодекс туповат - программирует он хорошо, а вот смутные томления людей разбирает плохо. Антропик в этом преуспел гораздо лучше.

Пробую дипсик с Гермесом - но тоже надежды особой не питаю. Ощущения, конечно, на фоне Клода - так себе. Выглядит все так, что постановку задачи надо разбирать с Клодом, а всю работу - поручать другим.
👍1🔥1
Любите ли вы Офис так, как люблю его я?

https://x.com/mom_agency_/status/2054909371071582501/video/1?s=46
Сегодня все внимание соцсетей - на запуске мобильного приложения Codex. Но у нас оно не работает, да и кайфа в программировании с телефона, прямо скажем, маловато. Но в целом стремление иметь общую среду на всех устройствах - похвальное, так все и должно работать. В этом плане удивительно, что сессии в терминале и сессии в приложении никак не видят друг друга, ни у Клода, ни у Кодекса
Claude code постоянно обновляется, и работать с ним удобнее, чем с Codex. Как минимум, таблички нормально отрисовываются в диалоге - не понимаю, почему OpenAI с этим справить не может. А еще появилась опция отражать внизу диалога тех субагентов, которые работают - очень удобно и полезно для понимания процесса. На шаг впереди идут Антропики
🔥2
В ближайшие дни нас могут ждать большие новости о создании новой архитектуры сетей от компании с говорящим названием SubQ - обещают, что будет решена проблема квадратичного роста компьюта при увеличении контекста. Все больше свидетельств, что это не фейк, а реальный прорыв

https://subq.ai/introducing-subq
🎉1
This media is not supported in your browser
VIEW IN TELEGRAM
Mythos обошёл защиту, в которую Apple вложила 5 лет и миллиарды

Три исследователя использовали Anthropic Mythos, чтобы собрать рабочий exploit для macOS kernel. По их словам, он обходит Apple M5 Memory Integrity Enforcement - систему защиты, которую Apple строила годами и продвигала как один из главных барьеров против memory corruption атак.

Таймлайн выглядит жёстко:

- 25 апреля нашли баг
- 1 мая уже был рабочий exploit
- отчёт понесли лично в Apple Park

MIE была флагманской security-фичей для M5 и A19. Apple описывала её как защиту, которая должна резко усложнить целый класс атак на память. По их же исследованиям, MIE ломала все известные публичные exploit chains против современных iOS-устройств.

Исследователи не «сломали» MIE напрямую. Они её обошли. По описанию, атака была data-only: без манипуляций с указателями, через стандартные syscalls, от обычного непривилегированного пользователя до root.

Проблема уже не только в том, что уязвимости всё ещё находятся. Проблема в том, что frontier-модели начинают ускорять самую сложную часть offensive security: связывать баги, проверять гипотезы, искать обходные маршруты и собирать рабочую цепочку быстрее, чем это делала бы обычная команда вручную.

55-страничный технический отчёт обещают выпустить после патча Apple.

Если всё подтвердится, это одна из самых важных cybersecurity-историй года.

https://blog.calif.io/p/first-public-kernel-memory-corruption
🔥1
У меня сейчас в качестве пвмяти используется claude-mem - штука хорошая, работает, но на рынке появляются все более продвинутые продукты. Поставил себе попробовать agentmemory - работает со всеми агентами, на всех моих компьютерах, есть графовая база, рефлексия на полученный опыт. Посмотрим, как будет работать. Это есь и в том же Гермесе, но пока ланирую сидеть на Codex + Claude-code, так что отдельня память не помешает.
Из нового - что еще себе поставил. Во-первых, CodexBar - это проект, который делает создатель OpenClaw. Учитывая, что его команда палит на токены в OpenAI 1,3 млн баксов в месяц, а результаты - ложатся в опенсорс, продукты качественные. По смыслу - это простая иконка сверху, при клике на которую показываются лимиты Codex, Claude, Gemini. То, что нужно, когда сидишь на этих лимитах - Клода я использую активно, а при лимите в 20 баксов приходится за расходом токенов следить. Выглядит отлично, рекомендую.

Как мне эта панелька говорит, за сегодня, если считать токены по апи, а не по подписке, за вечер я сжег их на 130 баксов. А за месяц - на 3 тысячи. Люди, не пользуйтесь нейронками по апи. Разве что deepseek - он дешевый и унего других вариантов нет.
Вторая история - поставил себе бесплатный внешний поиск для агентов TinyFish. Писал о нем раньше. Дает агентам более чистый результат, особенно, когда много страниц надо лопатить. Экономит токены - поработаю, расскажу подбробнее о впечатлениях.
Теперь, когда надо разобраться в новой программке, статье, посте, я всегда бросаю ссылку в телеграмме OpenClaw, и он мне кратко описывает, что это и дает рекомендации. Очень к этому привык.

С утречка получил он него положительную рецензию на еще одну программку ClawPatch - буду ставить. Это тоже от создателя OpenClaw, так что положительный ответ меня не удивляет )
Режимом /goal на Codex пользуюсь уже две недели, и это потрясно. подробно объясняешь модельке что нужно, и она уходит колбасить проект. Может работать пару часов, может - пару десятков часов, пашет как проклятая. Понятно, что получается не всегда точно то, что задумывал, но работает очень хорошо. И даже лимитов хватает (видимо, только пока).

Еще в этот цикл встраиваю такие задачки - как получить обратную связь от Gemini и Claude - кодекс подключается к ним по протоколу acpx, те отсматривают созданный функционал и дают комментарии, что надо поправить. Тоже весьма полезно.

Удивительно, но чудеса с ИИ не заканчиваются. Судя по всему, только начинаются.

https://t.me/llm_under_hood/838
🔥1
Forwarded from Machinelearning
🌟 Raindrop открыла исходный код локального отладчика агентов Workshop

Инструмент интегрируется с Claude Code, Cursor и другими кодинг-агентами.

Raindrop - стартап из 9 человек, основанный в 2023 году, который позиционирует себя одним из первых, кто оформил мониторинг для ИИ-агентов как отдельный продуктовый класс.


При использовании Workshop модель получает прямой доступ к трассировкам выполнения, читает их, пишет оценочные тесты и правит код, замыкая цикл самовосстановления.

Если агент в проде отклоняется от ожидаемого поведения, разработчик вызывает кодинг-агента прямо в терминале. Тот читает трассу через Workshop, пишет оценку под падающий сценарий, правит код и перезапускает прогон.

Цикл повторяется автоматически, пока не пройдут все проверки.


Workshop работает локально и стримит данные в реальном времени. Каждый токен, вызов инструмента и шаг рассуждения попадает в интерфейс по мере выполнения, без поллинга.

Есть режим воспроизведение, который берёт трассу из продакшена и прогоняет её через ваш экземпляр агента, запущенный локально.

Заявлена поддержка TypeScript, Python, Go и Rust, а также фреймворков Vercel AI SDK, OpenAI Agents SDK, Anthropic SDK, Claude Agent SDK, LangChain, LangGraph, CrewAI, Mastra, Pydantic AI и DSPy.


📌 Лицензирование: MIT License


🟡Документация
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #Agents #Workshop #RaindropAI
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Data Secrets
CEO YCombinator Гэрри Тэн опенсорснул собственный модуль памяти для агентов

github.com/garrytan/gbrain

Гэрри пишет, что это продакшен-мозг, на котором работают его личные агенты OpenClaw и Hermes. Ну а на практике это что-то вроде живой базы знаний, которая сама себя обогащает.

Если обычные агенты не помнят контекст между сессиями или записывают что-то в MEMORY.md очень примитивным способом, то здесь предлагается многоуровневая архитектура построения глубокой памяти. Кратко:

– Вся база состоит из markdown файлов. Каждый человек, компания, концепция, встреча – это отдельный файл. Каждый файл – это саммари, которое перезаписывается при поступлении новых данных, и хронологический журнал упоминаний.

– По этой базе работает гибридный поиск. Когда агент что-то ищет, работают одновременно: векторный поиск, поиск по ключевым словам и поиск на графе.

– Граф связей, по которому осуществляется графовый поиск, тоже формируется автоматически и при этом даже без вызова LLM (с помощью регулярок и прописанных правил). То есть система сама себе рисует сеть: кто где работает, кто был на какой стрече, кто во что инвестирует и тд.

Обновляется все это с помощью одного файла RESOLVER.md, в котором прописаны 29 специальных скиллов. Например, meeting-ingestion: транскрипты митингов перерабатываются в режиме сна, чтобы обогощать файлы участников.

Конечно, пользоваться прямо всей этой махиной необязательно. Базовую версию можно поставить себе за 30 минут и использовать как MCP. Лицензия MIT.
Forwarded from Tips AI | IT & AI
Месяц назад установил Impeccable, пока это лучший скилл, чтобы перестать генерить AI слоп в дизайне.

Это набор из 23 команд, который ставится в Claude Code, Cursor, Codex, Gemini CLI и др.

Примеры команд:
/impeccable audit — поиск проблем по вёрстке и контрастам
/impeccable polish — финальная зачистка перед релизом
/impeccable typeset — починить шрифты и типографику
/impeccable distill — убрать всё лишнее


Внутри 7 справочников: типографика, цвет, анимация, адаптивность и другое.

Загружаются они в каждую команду, а агент опирается на них и не придумывает свое.

Ещё есть CLI детектор: npx impeccable detect <папка или URL> — без API сканирует код и выявляет больше 25+ видов слопа в дизайне.

Так же Chrome расширение, можете проверять им любой сайт на эту же проблему.

Советую попробовать: Сайт | GitHub

@tips_ai #tools
❤3
Одной строкой:
Cursor хвастается новой моделью на уровне Opus 4.7;
К Zoom прикрутили Codex. Или наоборот?
Unsloth ускорили Qwen 3.6 раза в полтора;
Завтра Gemini 3.2? А может и новенький Claude?
🤔1
Forwarded from Вайб-кодинг
Open Design теперь работает прямо внутри Codex.

Самое сложное в вайб-дизайне это не создать один экран, а сохранить замысел дизайна на всём пути: когда ты итеративно правишь, строишь и выпускаешь продукт.

Теперь ваш агент может работать напрямую с канвой. Дизайн → код → анимация, в одном рабочем процессе.

Вот короткая демонстрация:

1/ Сначала попросите Codex запустить Open Design локально:
«Помоги мне развернуть локально и запустить Open Design внутри Codex: https://github.com/nexu-io/open-design»

Codex поможет клонировать репозиторий, установить зависимости, запустить локальное приложение и открыть его в встроенном браузере.

2/ Затем опишите, что вы хотите спроектировать.
Вы можете писать прямо в чат, вставлять контекст продукта, загружать референсы или выбрать дизайн-систему/шаблон в качестве отправной точки.
Open Design даёт Codex визуальное полотно, с которым он может работать, а не только текст.

3/ Дальше просто продолжайте общаться с агентом.
Попросите его создавать экраны, изменять макеты, редактировать выбранные компоненты, генерировать варианты или превращать дизайн в код/анимацию.

Процесс дизайна превращается в диалог прямо внутри Codex. 🐈
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
У GitHub появилась стандартная документация для агентской разработки программ - https://github.com/github/spec-kit. Уже 102К звезд.

Берем этот подход, накладываем сверху Symphony от OpenAI для оркестрации, запускаем /goal - и разработка идет сама по себе, на основе заданных стандартов...

На практике все-равно надо будет кучу всего исправлять, но что сейчас происходит - это переход от кастомных сборок к построению работы на основе стандартных кирпичиков промышленного качества.
👍1🔥1