AI da Code
169 subscribers
222 photos
16 videos
2 files
414 links
Канал про то, как ускорить разработку продуктов с AI
Download Telegram
Сегодня полдня пытался сделать одну поделку, но она так и не получилась. Не вышел каменный цветок.

А именно, что хотел? Я хотел иметь один harness, но использовать разные модели.

То есть использовать Claude Code с подпиской Claude, с подпиской Codex, чтобы можно было еще погонять open source модели на GroqQ или на Cerebras.

В итоге нашел несколько решений, погонял каждое, но они так и не заработали. И пробовал и LiteLLM, и CCProxyAPI, и CLIProxy, ничего так не заработало.

В итоге сейчас остановился на варианте, что Claude code я использую нативно, а для кодекса open source использую OpenCode, потому что в последних версиях он хотя бычастично совместим с тем, что у меня уже прописано в claude.md и в скиллах. Минимальна миграция. А вот я смотрел Codex CLI, там пришлось бы сильно повозиться.

Пока такой стэк, что Claude Code и OpenCode для всего остального. Посмотрим, как это заработает.
Это промежуточные результаты по моему эксперименту с YouTube Shorts и Afte Research Карпаты. Все видео генерились при помощи Remotion с Claude Code. Дополнительно использовалась фоновая музыка, но при всем при этом, когда я докидывал еще гипотезы для экспериментов по поводу озвучки или другой музыки, оказалось, что варианты с озвучкой на самом деле хуже работают, и точно так же с другой фоновой музыкой видео тоже хуже работали, так что вернулись на изначальное состояние.
❤2👌1
ffprobe -v error -show_entries format=duration -of csv=p=0 video.mp4
# Сравниваешь с expected duration из props. Mismatch >100ms = ошибка.

ffmpeg -i video.mp4 -af silencedetect=noise=-40dB:d=0.5 -f null - 2>&1 | grep silence
# Если silence detected в Hook section (где BGM должен играть с frame 1) = ошибка.

ffmpeg -i video.mp4 -af ebur128=peak=true -f null - 2>&1
# Получаешь LUFS integrated/momentary. Резкие провалы = audio dropout.

ffmpeg -i video.mp4 -vf "freezedetect=n=0.001:d=0.3" -map 0:v:0 -f null - 2>&1
# Нативный фильтр. Любой freeze >0.3s = ошибка.

ffmpeg -i video.mp4 -vf "select='gt(scene,0.3)',showinfo" -f null - 2>&1
# Получаешь timestamps всех scene changes. Сравниваешь с expected (transitions between Hook/Setup/Payload/CTA).

ffmpeg -i video.mp4 -af "asetnsamples=1024,astats=metadata=1:reset=1,ametadata=print:key=lavfi.astats.Overall.Peak_level" -f null -
# Извлекаешь аудио peaks. Совпадают ли peaks SFX с твоими expected visual timestamps?


Я тут закинул в ChatGPT и Claude момент с autoresearch для YouTube Shorts и в итоге выяснил, что оказывается еще до отправки в Gemini видео результирующего, можно добавить проверки через ffmpeg на всякие артефакты, где есть косяки в самом видео. Типа слишком долго видео идет, слишком короткое звуковое сопровождение и так далее.

Так что у меня получилось еще создать еще один уровень проверки перед отправкой видео в Gemini и получение фидбэка.
https://github.com/coleam00/Archon
https://bernstein.run/

🚀 Интересные проекты и мой собственный подход

Нашел несколько интересных проектов — настоящий фундамент для темной фабрики кода. 🤖

Попробовал оба, но они показались мне избыточными. В итоге я начал писать своё решение: закрытое, но гораздо проще и точно под мои кейсы. 🛠️

Да, я позаимствовал несколько идей у этих проектов, однако они всё ещё выглядели слишком сложными, поэтому решил создать своё решение. 📚

Для тех, кто хочет «засэтапить» темную фабрику, можно начать с этих проектов, посмотреть, как они работают, и взять оттуда полезные части. 🔍
👍3
https://github.com/nexu-io/open-design

Вот ещё один новый инструмент, вдохновлённый тем же Claude Design.

Единственное отличие — теперь он оснащён дополнительным визуальным интерфейсом.
👍2
https://github.com/juliusbrussee/caveman

🚀 Кейвмен 2.0: Ультра Фул Лайт

Новый релиз – несколько вариантов Ultra Full Light. Выбирай, что нужно, и ставь под себя. 🛠️

🔗 Ссылка на статью: чем короче отвечает LLM, тем правдивее ответ. https://arxiv.org/abs/2604.00025
https://www.openui.com/

🚀 Новые виджеты и открытый стандарт

Только завершил интеграцию виджетов в ассистенте – и как отдельные виджеты, так и в чате.

А ребята сделали open‑source стандарт для генеративного UI. 😎
❤1
https://github.com/safishamsi/graphify

🚀 Новый тул для анализа репо

Тестировал недавно один прикольный инструмент – выглядит супер, но у меня проекты небольшие, так что пользы пока мало. По отзывам в сети, он реально расцветает на больших, запутанных проектах – чем масштабнее, тем лучше.

Что он делает? Строит граф зависимости из разных источников в репозитории: код, файлы, документацию, даже видео. 📊

Если у вас монстр‑проект – стоит попробовать, иначе будет как «плюшки без сахара». 😅
👍1
https://github.com/getagentseal/codeburn

🛠️ Новый тул для анализа кодовых агентов

🚀 Дашборд: быстрый обзор, что, когда и где использовалось. Выводим инсайты → какие команды в проектах можно оптимизировать.

🔧 Инструмент оптимизации: на основе анализа предлагает правки – отключить лишние MCP, скиллы, добавить описания в MD‑код для корректной работы кода‑агентов.

💡 Пример: отключаем ненужные MCP, выключаем скиллы, дополняем slash‑команды или нужным описанием в Claude.MD, чтобы Claude code (или любой другой агент) исполнялся без сбоев.
https://github.com/alifanov/runyaml

Начал писать новый тул под концепцию темного кода ( dark code ) и темного ПО ( dark software ). Собственно основные моменты концепции - в следующем это код который не писал человек и который не ревьюил человек

Соответственно, тут момент такой, что нужно последовательно вызывать определенных агентов с определенными настройками и с определенными промтами, в идеале, чтобы они еще были разные. Чтобы план писал, например, Claude opus, а имплементировал Claude sonnet, а верифицировал, что все правильно написано Codex.

Многих еще моментов нет. Как на примере в Archon или Bernstein. Но я специально начинал с нуля, чтобы разобраться в этой концепции и фактически ее воспроизвести только самый минимум, потому что те инструменты, которые я упомянул, мне показались слишком избыточными для меня.

Что касается концепции dark software, то это по сути то же самое, но к нему добавлены самопроверки по логам, мониторингу и т.д.

Кроме того, введён элемент самоулучшения на основе полученных метрик.e
❤‍🔥4
https://spokenly.app/

Последнее время я часто пользуюсь этим приложением. Два полезных момента оказались особенно удобными.

Первое — локальная работа моделей с моделью Parakeet от Nvidia. Я получаю практически мгновенную транскрипцию и сразу её вставку.

Второй момент — дополнительные функции, такие как запрос к ChatGPT или к Claude. В итоге я произношу текст, он сразу транскрибируется, и открывается ChatGPT и Claude. Да, в принципе, это небольшое улучшение, но поскольку я часто переключаюсь и задаю вопросы, оно закрывает часть рутины.
👍1
https://www.nanocorp.so/

У ребят UX пока выглядит довольно странно, но как концепция он вполне приемлем.

Многие аспекты, связанные с запуском рекламы, созданием продукта, задачами и электронными письмами, очень похожи на то, как это реализовано у меня или у Piperclip.
https://github.com/fathah/hermes-desktop

У агента Гермес появилось приложение для десктопа.

Особенно мне понравилась визуализация агентов в виртуальном офисе.
👏1
https://spokenly.app/

Нашёл ещё один интересный use‑case. Оказывается, можно настроить пост‑процессинг так, чтобы он вызывал определённые скрипты. В результате я создал пост‑процессинг, который переводит текст в JSON, а JSON передаёт в bash‑скрипт, распознающий его и отправляющий на сервер в мой личный task‑tracker.

Теперь я просто включаю spoken, выбираю режим, произношу задачу, и она сразу попадает в мой task‑трекер, без необходимости делать это вручную. Всё стало значительно проще.
⚡1
https://vercel.com/docs/agent-resources/vercel-mcp

Как-то тихо прошло обновление, в результате которого у Vercel появился MCP для настройки своих приложений.

Я уже давно перешёл на Coolify, но некоторые знакомые всё ещё используют Vercel, потому что для их задачи он значительно проще.

Соответственно, то, что раньше требовалось настраивать через UI, теперь можно спокойно передать Claude code, подключив этот MCP.
❤1
Продолжаю работать над своим персональным ассистентом, точнее — над платформой для него. Недавно я создал мобильное приложение для iOS, чтобы было удобнее общаться в любой момент, а не только за компьютером.

Вчера я также добавил приложение для Apple Watch, чтобы можно было, находясь вдали от телефона, продиктовать задачи, и ассистент мог их выполнять.
🔥1
claude agents view

в claude code теперь можно управлять сразу несколькими агентами параллельно.

запустил задачу фоном (/bg), она работает, а ты переключился на другую. нужно глянуть статус? левая стрелка → видишь все сессии в одном месте. каждая с её статусом, последний ответ, когда была активна.

типовой сценарий: запустил 5 разных PR-ревьюеров, вернулся к готовым, остальные ещё в процессе. не нужно переключаться туда-сюда.

research preview на Pro/Max/Team/Enterprise. opt-in: claude agents.
🧵 Needle — LLM, которая работает на микроустройствах

Компания Cactus Compute выпустила Needle — компактную модель на 26 миллионов параметров, способную выполнять функции на устройствах размером с коробок спичек.

Проект открыт (GitHub: cactus-compute/needle) и нацелен на запуск LLM прямо на edge-устройствах — IoT, встраиваемые системы, мобильники с ограничениями памяти.

Что интересного:
• Минималистичная архитектура — 26M параметров против миллиардов в GPT
• Поддержка function calling — может вызывать функции для взаимодействия с системой
• Предназначена для offline-first сценариев без облака

Для девелопера на edge-computing или микроконтроллерах — это может быть реальная альтернатива облачным LLM.
🔥1
У проекта Open Design теперь есть выделенный сайт: open-design.ai

Что важно:
• 107 готовых навыков (skills), а не плагины — просто папки на диске
• 149 дизайн-систем в Markdown — Linear, Vercel, Stripe, Apple, Figma и др.
• 12 адаптеров под любые coding‑agents: Claude, Codex, Gemini, Cursor, Devin, Qwen
• Вся работа локальная, с полным BYOK — DeepSeek, Groq, OpenRouter, свой vLLM

Рабочий цикл: 4 этапа
1. Детект: демон сканирует /usr/local/bin:/usr/bin:/bin:/usr/local/sbin:/usr/sbin:/sbin, подгружает 107 навыков и 149 систем
2. Обнаружение: форма вопроса (30 сек.) — поверхность, аудитория, тон, масштаб
3. Направление: выбор одного из 5 визуальных направлений, палитра в OKLch, шрифты
4. Доставка: агент пишет на диск, превью в iframe, экспорт в HTML/PDF/PPTX/ZIP/Markdown

Скорость: 3 команды pnpm tools-dev и можно запускать. Лицензия Apache‑2.0.

Сайт сделан как отсылка к дизайнерским журналам — с номерами томов, нумерацией страниц и географическими координатами (52.5200°N, 13.4050°E — Берлин).

GitHub: github.com/nexu-io/open-design
👍2
Нашёл Terax — AI‑терминал на Rust и Tauri. Весит ~7 MB, работает на macOS, Linux, Windows.

🧠 Что внутри:
- Мультитабовый терминал с WebGL‑рендерингом
- Нативный PTY‑бэкенд через portable‑pty
- Встроенный редактор кода
- AI‑панель с поддержкой OpenAI, Anthropic, Google, Groq, xAI
- Локальные модели через LM Studio
- Ключи в системном keychain
- Нет телеметрии
- Просмотр файлов и дифов (как в IDE, но фокус на терминале)

🔧 Запустил на Mac, работает ровно. Удобно — AI‑ассистент прямо в терминале, без лишнего веса.

🔗 Ссылки:
- GitHub: https://github.com/crynta/terax-ai
- Сайт: https://terax.app
Telegram горячие клавиши (рабочие)

🖥️ Проверенные команды для Telegram Desktop:

• Ctrl+1‑Ctrl+4 / ⌘+1‑⌘+4 — переключение по папкам чатов
• Ctrl+K / ⌘+K — поиск по всем сообщениям (основная команда)
• Ctrl+F / ⌘+F — поиск по текущему чату
• Ctrl+Tab / ⌘+Tab — следующий чат (переключение вкладок)

📋 Полный список: https://core.telegram.org/faq#telegram-desktop-hotkeys

👨‍💻 Рабочие сочетания: переключение по папкам (Ctrl/⌘+1-4) и поиск (Ctrl/⌘+K) — самые полезные. Остальное в документации может не совпадать с реальным поведением.