AI da Code
168 subscribers
220 photos
16 videos
2 files
412 links
Канал про то, как ускорить разработку продуктов с AI
Download Telegram
🌍 Симулятор спутника-шпиона, но данные настоящие

Для тех, у кого OSINT — это десять вкладок: Flightradar в одной, MarineTraffic в другой, пожары NASA в третьей. God's Eye View склеивает всё в один фотореалистичный 3D-глобус.

• 13 живых слоёв: самолёты, суда, спутники, пожары, ~800 CCTV 🛰
• 10 из 13 заводятся без единого ключа
• клик по самолёту → COCKPIT, летишь в кабине с NVG/FLIR
• голосом: «нарисуй маршрут и пролети его» 🎙

Автор — экс-PM Google Maps, 3D-тайлы ему родные. 12.2k за 5 дней, MIT.

Честно: хостед-демо нет, только npm run dev + ключ Google Maps. И сцена намеренно на 15–30 с позади реальности.

Сигналы и так были публичные. Не хватало окна, в которое на них смотреть.

https://github.com/bilawalsidhu/gods-eye-view
🔥1
🆕 Claude Code стучит сам на себя

Проблема: агент накосячил, ты психанул и пошёл дальше — баг-репорт не написал никто. Решение: тул SendFeedback из v2.1.247.

Когда в сессии что-то ломается, Claude молча кладёт черновик отчёта в ~/.claude/feedback/drafts/. Никуда не шлёт. Потом /feedback — очередь черновиков из всех сессий: правишь и отправляешь сам 🧠

Фишка в таксономии: 16 типов провала, которыми модель размечает саму себя.
overconfidence — уверенно соврал
stopping_short — бросил на полпути
subagent_overspawn — наплодил субагентов
tone_or_preachiness — читал морали

⚠️ Тумблер транскрипта по дефолту yes, а транскрипты лежат у Anthropic 5 лет. Выключить всё: feedbackDrafts: "off".

Первый тул, где LLM ведёт протокол собственных факапов.

https://code.claude.com/docs/en/tools-reference
🎬 OpenMontage — видеостудия внутри кодинг-агента

Мой пайплайн для роликов — пять своих скриптов. Тут заход другой: кода-оркестратора нет вообще — 12 пайплайн-манифестов, 734 markdown-скилла, а оркестратор сам Claude Code. Открыл папку и сказал словами, что хочешь.

• explainer, cinematic, clip-factory, дубляж 🎞
• скоринг провайдеров по 7 осям
• QA-гейт: ffprobe, кадры, «slideshow risk score» 🔍
• прогон за $0: Piper + ffmpeg + Archive.org

54.8k за 5 месяцев, AGPL-3.0. Но публиковать не умеет: export_bundle.py, «no upload», аплоадеров ноль.

Всё есть, кроме кнопки «выложить».

https://github.com/calesthio/OpenMontage
📐 Диаграмма, которую можно проверить

Проблема: просишь агента нарисовать архитектуру — получаешь мермейд-слоп: слипшиеся стрелки, обрезанные подписи и ноль гарантий, что схема вообще про твою систему. Решение: Archify. Пригодится, когда схему надо не в чат кинуть, а положить в доку.

Фишка в том, что агент не рисует SVG руками: пишет типизированный JSON IR, а Node-компилятор детерминированно собирает из него один интерактивный HTML.

• 5 типов: архитектура, workflow, sequence, dataflow 🔍
• гейт validate → deliver: не прошёл — старый файл цел
• на провале отдаёт не стектрейс, а список фиксов
• route probe, поиск по узлам, экспорт в PNG/WebM

Автор выложил свой провалившийся эксперимент с Mermaid: «layout is the product, not CSS». И честный бенчмарк — 66.7% годных схем с первой попытки.

40.5k за 4.5 месяца, MIT 💪

https://github.com/tt-a1i/archify
🔍 Semrush за $139/мес или свой ключ за $0.05

Для тех, кто платит подписку за SEO-комбайн, а открывает три отчёта из тридцати.

OpenSEO — self-hosted воркспейс: ключевики, бэклинки, rank tracking, аудит сайта, AI-визибилити. MIT, 16k за полгода жизни репо.

Фишка в том, что подписки нет вообще — данные идут через твой ключ DataForSEO, платишь по факту 💰
• запрос по ключевику — $0.05
• бэклинки с историей за год — $0.08
• проверка бренда в ChatGPT — $1.09

Сверху MCP-сервер и 9 готовых скиллов: npx skills add every-app/open-seo — и Claude Code сам делает конкурентный анализ 🚀

Минусы честные: v0.1.7, 486 коммитов из 520 от одного человека, своего индекса бэклинков нет.

Пригодится, если SEO нужно раз в неделю, а не каждый день. Платишь за запросы, а не за право войти в дашборд.

https://github.com/every-app/open-seo
🎬 Монтаж по транскрипту, а не по кадрам

Проблема: скормить агенту сырое видео — это ~45M токенов мусора. Решение: video-use от команды browser-use.

Один прогон ElevenLabs Scribe — и все дубли пакуются в 12 КБ текста с пословными таймкодами. Агент это читает и решает, где резать; вейвформу дёргает только в спорных местах.

• вход — папка с дублями и фраза «смонтируй» 🚀
• выход — final.mp4 + edl.json, воспроизводимо
• 23.7k, MIT, весь репо — 42 файла и один SKILL.md

Пригодится, если снимаешь говорящую голову и задолбался вырезать «эээ» между дублями 🔍

Рядом OpenMontage (55.8k, AGPL, 2571 файл) — но он генерит ролик из воздуха. video-use не генерит ничего, только режет твоё.

Монтажка на 42 файла против студии на две с половиной тысячи.

https://github.com/browser-use/video-use
🧠 Память агента лежит папкой Markdown

OpenHuman — десктопный агент (Rust + Tauri), который тянет контекст о твоей жизни: почта, календарь, Slack, репы. И складывает не в векторный суп, а в обычный Obsidian-vault.

Пригодится, если бесит, что агент каждый раз стартует холодным, а контекст живёт в чужом облаке.

• память — ~/.openhuman/wiki/: правишь руками, агент видит правки 💾
• ретрив без LLM — entity-граф + саммари, один тул memory_tree
• флоты агентов на чекпойнченных графах, переживают рестарт 🔄
• 39.4k, GPL-3, brew install --cask openhuman

Но: «local-first» с оговоркой — OAuth и веб-поиск по умолчанию идут через их бэкенд. Полностью локально только руками: Privacy Mode + Ollama.

Главный аргумент не в фичах: снесёшь приложение — личная вики останется твоей.

https://github.com/tinyhumansai/openhuman
🧠 Сорс-контрол для агентов

Для тех, кто гоняет Claude Code и Codex по одному репо, а через неделю не помнит, почему агент написал именно так.

Atlas — десктоп на Rust + Tauri: запускает агентов через ACP и пишет всё в локальную SQLite .atlas/sessions.db.

• промпты, tool-call'ы, тронутые файлы, патчи
• коммит привязан к сессии — без git-хуков, репо не трогается 💾
• общая память между агентами: решение Claude Code видит Codex 🔄

Фишка в том, что коммиты не перехватываются, а наблюдаются по движению рефов. Закоммитил из терминала при закрытом Atlas — он всё равно найдёт свою сессию.

Но: alpha, только macOS, dmg не подписан. 3.2k и MIT — при этом dmg скачали 1022 раза за 30 релизов, звездят охотнее, чем ставят.

Git хранит «что изменилось». Atlas — «почему».

https://github.com/pacifio/atlas
🧩 Claude Code, но с любой моделью

Проблема: терминальный агент отличный, но прибит к Anthropic — модель, биллинг, телеметрия. Решение: OpenClaude — та же кодовая база, но с шимом под чужих провайдеров.

Пригодится, если хочется опыт Claude Code поверх локальной Ollama или дешёвого OpenRouter.

• 16 профилей: OpenAI, Gemini, Bedrock, xAI, ollama 🔄
• пер-агентный роутинг: дешёвая модель на субагентов, дорогая на основную
• 3 рантайм-зависимости, весь CLI — один файл
• CI валит сборку, если в бандл просочился звонок домой к Anthropic 🔍

Но: репо создан на следующий день после утечки исходников Claude Code, и LICENSE прямым текстом пишет — «разрешения Anthropic у нас нет». MIT покрывает только правки контрибьюторов.

32.7k за пять месяцев. Посмотреть — да, тащить в компанию — на свой страх.

https://github.com/Gitlawb/openclaude
🩺 Скиллы, за которые платишь молча

/skill-doctor — команда Claude Code из v2.1.261: показывает, какие скиллы загружены, какие ты ни разу не использовал и сколько контекста каждый съедает.

Фишка в том, что описания всех скиллов уезжают в системный промпт каждым запросом — включая те, что висят мёртвым грузом с прошлого месяца.

• сканирует транскрипты сессий — факт использования, а не догадки 🔍
• считает цену каждого скилла в токенах
• включена по умолчанию, отдельной доки пока нет

Прогнал у себя: 41 глобальный скилл, 13.5k символов одних описаний ≈ 3.4k токенов в каждом запросе. Половина не вызывалась ни разу.

Это для тебя, если ставил скиллы пачками «пусть будут» 🧹

Инвентаризация контекста — та же гигиена, что чистка node_modules.

https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
3
🦆 RL-робот, которого щупаешь в браузере

Для тех, кто живёт в кодинг-агентах и железо не трогал ни разу: Microduck от Pollen Robotics (это Hugging Face) — 25-см робот-утка, у которого весь sim-to-real стек лежит в открытых репо.

Пробовать можно без робота и без GPU:
• симулятор крутится прямо в браузере, $0 🚀
uv run play — политика на CPU-MuJoCo, управление с клавиатуры
• чужие походки и трюки качаются с HF Hub
• своя политика — 1–2 часа на 4096 параллельных средах

Честно про «open»: железо закрыто. Ни CAD, ни BOM, 3D-модели под CC BY-SA-NC, хотя бейдж репо кричит Apache-2.0. Комьюнити уже реверсит CAD из MJCF — 549 за 10 дней 🔍

7.7k за 6 недель, $2.6M предзаказов за сутки. Sim-to-real перестал быть привилегией лабы: вход стоит один uv run, а не $50k стенда.

https://github.com/pollen-robotics/microduck_rl
📄 Скормить модели офисный файл

Проблема: LLM нужен текст, а данные лежат в docx, xlsx, pptx и pdf — на каждый формат своя библиотека и свой ад с зависимостями. Решение: MarkItDown от Microsoft, один вызов на всё.

Это для тебя, если пилишь RAG или устал копипастить из документов в чат.

• PDF, Word, Excel, PowerPoint, .msg, EPub, ZIP рекурсивно, YouTube → транскрипт 🚀
• тип файла определяет нейросетью Magika, а не по расширению 🧠
• MCP-сервер — ровно один тул: convert_to_markdown(uri)
pip install 'markitdown[all]'claude mcp add markitdown -- markitdown-mcp

Почему Markdown, а не голый текст: модели на нём обучены и он токен-эффективен — так в README и написано.

Минус честный: PDF — слабое место. В независимом бенчмарке таблицы 0.27 против 0.88 у docling, заголовки вообще 0.00. OCR в коробке нет.

182k, MIT, 727k скачиваний в сутки. Бери на офисные файлы, а сканы неси в docling 💪

https://github.com/microsoft/markitdown
🥰1
🦊 Браузер, который не палится

camofox-browser — HTTP-сервер вокруг Camoufox, форка Firefox, где спуфинг вшит прямо в C++: WebGL, шрифты, AudioContext, WebRTC. Не stealth-плагин поверх Chrome — сами плагины давно стали фингерпринтом.

Пригодится, если агент упирается не в модель, а в Cloudflare.

• accessibility-снапшот вместо сырого HTML — клик по ref e1 🎯
• 14 макросов поиска: @google_search, @reddit_subreddit
• MCP-адаптер, прокси с GeoIP, 10.8k, MIT

Честно: «drop-in замена Playwright» из описания репо — миф, CDP-эндпоинта нет, только свой REST. TLS-фингерпринт и репутацию IP не прикрывает, капчу не решает, телеметрия по умолчанию шлёт домены наружу ⚠️

Боты — уже 57% трафика Cloudflare, и с июня в белом списке только подписанные агенты. Маскировка пока работает, но дорога сужается.

https://github.com/jo-inc/camofox-browser
2
🧩 Конспект System Design за вечер

Проблема: два тома Alex Xu «System Design Interview» — 754 страницы, платные и не грепаются.

Решение: system-design-notes — обе книги сжаты в 28 маркдаун-глав с 392 диаграммами. Форкаешь, грепаешь, скармливаешь агенту. 📋

Это для тебя, если готовишься к System Design интервью или хочешь освежить базу без покупки книги.

• глава = задача: rate limiter, consistent hashing, key-value store, платежи, биржа
• +5.1k за две недели, сейчас 19.1k 🌟
• лицензии нет вообще — форки и переводы в серой зоне ⚠️
• таблица задержек честно подписана «Latency (2020)»

Забавно: на 52 500 слов про архитектуру — ноль упоминаний LLM, RAG, GPU и векторных БД. Слово vector встречается 10 раз, и 8 из них — vector clock из статьи 2007-го. 🧠

База не устарела. Просто половину такой системы агент теперь набросает сам — а спрашивают на собесе всё ещё тебя.

https://github.com/liquidslr/system-design-notes
🚫 Тулы без «оставьте ваш email»

Для тех, кто устал заводить аккаунт ради того, чтобы один раз сжать картинку или склеить PDF.

NoSignups (бывш. FckSignups) — каталог опенсорсных браузерных тулов: открыл вкладку и они сразу работают. 262 штуки в 10 категориях, 4.2k за четыре месяца.

• PDF: Stirling-PDF, BentoPDF, PaperKnife 📄
• конвертеры: VERT, Pandoc WASM, ffmpeg.wasm
• картинки: Squoosh, SVGOMG, Piskel
• приватность: CyberChef, Cryptgeon, метадата-скрабер 🔍

Пригодится, когда файл надо обработать разово и не заливать его на чужой сервер.

Фишка — поле notRecommendedReason: тул остаётся в каталоге с публичной пометкой, за что наказан. У Stirling-PDF стоит skippable-signup. 🧠

Минус честный: bus factor = 1, 551 заявка висит в очереди, у 34 тулов лицензия «?».

Разовая задача не стоит аккаунта.

https://nosignups.net
🧩 MCP на весь флот одной настройкой

Для тех, кто раздаёт команде MCP-серверы руками: в Claude Code v2.1.259 завезли managed-настройку managedMcpServers.

Раньше это значило разложить managed-mcp.json по машинам через MDM, и файл забирал эксклюзивный контроль — свои серверы уже не добавить.

Теперь админ кидает сервер в claude.ai → Admin Settings → Claude Code, и он прилетает всем:
• аддитивно — личные серверы остаются 🆕
• применяется без рестарта сессии
• только https и http/sse — stdio (npx) не раздать
command/env запрещены: админка не может запустить процесс на твоей машине 🔒

Пригодится, если у вас Team/Enterprise и общий MCP-зоопарк на команду.

Осторожно при апгрейде: allowedMcpServers сменил смысл — сервер, который он раньше отфильтровывал, теперь загрузится сам, молча.

Конфиг больше не требует админа на каждой машине — но это удобство, а не граница безопасности.

https://code.claude.com/docs/en/managed-mcp
🧠 166 скиллов, которые делают из агента учёного

Проблема: просишь агента разобрать эксперимент — код он напишет, а какой статтест принят в поле и какая база авторитетная, не знает. Решение: Scientific Agent Skills — библиотека, которая кодирует именно эту процедурную часть.

Агент сам ходит в PubMed, ChEMBL, UniProt, AlphaFold, ClinVar — 80+ баз с готовыми контрактами к API. Без MCP-рантайма, просто папка с markdown 📋

• геномика, хемоинформатика, drug discovery, клиника
npx skills add K-Dense-AI/scientific-agent-skills
• 44.8k, MIT — но лицензия у каждого скилла своя

Пригодится, даже если ты далёк от биологии: внутри ещё SEC EDGAR, USPTO, FRED и архив экзопланет NASA.

Честная деталь: в своей же arXiv-статье авторы признают — что агент со скиллами работает лучше, они не доказывали 🔍

Домен агенту теперь выдают папкой, а не файнтюном. Только не ставь все 166 сразу — README сам об этом просит.

https://github.com/K-Dense-AI/scientific-agent-skills
📱 Настоящий iOS на маке — одной командой

Для тех, кто упирался в симулятор Xcode: там нет ядра, нет SEP, нет boot chain — ни .ipa поставить, ни ядро подебажить. vphone-cli поднимает на Apple Silicon настоящую iOS как VM.

Дикая деталь: виртуальный iPhone собрала сама Apple. В research-образе Private Cloud Compute лежит идентити iPhone99,11 — эмулятор не написали, его нашли внутри серверной прошивки 🔍

brew install zqxwce/tap/vphone-cli и одна команда
• шкала патчей 4 → 42 → 113 → 141: от «митигации живы» до Sileo
• 12.4k, MIT, iOS до 27.0

Пригодится, если ковыряешь iOS-безопасность или гоняешь E2E: у Corellium это $3 за device-hour, тут ноль.

Цена честная: SIP и AMFI выключить, App Store внутри не работает. Рабочий мак не подставляй — только отдельная машина 💪

https://github.com/Lakr233/vphone-cli
🎙 Локальный ElevenLabs в одном окне

VoiceStudio склеивает 17 TTS- и 11 ASR-движков в один десктоп-апп: клонирование голоса, voice design, дубляж видео, аудиокниги. Всё локально, ничего не улетает в облако 🔒

• zero-shot клон с сэмпла 3–10 сек, ~6 ГБ VRAM
• CUDA / ROCm / Apple Silicon, GGUF для CPU
• русский — 7-й по объёму обучающих данных
• внутри MCP-сервер: синтез дёргается прямо из агента 🧠

Пригодится, если пачками озвучиваешь ролики и устал платить за символы.

Но два слоя мелким шрифтом: «646 языков» — это ISO-охват, у 82% из них меньше 20 часов данных. А веса дефолтного движка — CC-BY-NC, в коммерческий продукт не заберёшь.

31k за 5 месяцев, топ-1 тренда. Бесплатный по деньгам — но не по лицензии 💪

https://github.com/debpalash/VoiceStudio
1
🧩 Агент «упал», а он доработал

Проблема: сабагент дожал задачу, но родитель пометил его failed и выбросил результат — потому что в финальном ответе не было блока с подсчётом токенов 🔄

В Claude Code v2.1.273 закрыли три бага ровно про автономку:

• сабагенты не фейлятся из-за пустого usage или model id
• SDK и stream-json не теряют хвост фонового таска
• авто-компакт срабатывал на половине окна: advisor-ходы считались вдвое дороже 🧠

Последнее висело в трекере с апреля: 7 авто-компакций из 16 приходились на advisor-ход при реальных 82–100k токенов.

Это для тебя, если гоняешь агента в фоне или через SDK и потом не находишь его отчёт.

Метаданные биллинга не должны решать, жив агент или нет.

https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
🔍 Аудитор, который сам себя опровергает

Для тех, кто просил агента «найди уязвимости» и потом выкидывал половину отчёта: Cloudflare выложила свой внутренний рецепт аудита.

Главное правило: кто нашёл баг — тот его не подтверждает. Кандидат уходит свежему агенту, который пытается его опровергнуть и чужих вердиктов не видит 🧠

• 6 фаз: разведка → охота → опровержение → отчёт
• вердикты confirmed / needs_validation / rejected
• coverage-ledger честно пишет, что НЕ смотрели 📋
• профили quick / standard / deep

С их харнесса: 128 репо, false positive упал с 40% до 11%. Слепой сторонний замер — precision 90%.

Минус жирный: на HN жалуются на 150k–1M токенов за прогон.

Пригодится, если перед релизом нужен аудит, а платить за внешний не хочется.

11.5k и MIT за репу из маркдауна и двух валидаторов. Скилл теперь дистрибутив методологии, а не код.

https://github.com/cloudflare/security-audit-skill