📄 Скормить модели офисный файл
Проблема: LLM нужен текст, а данные лежат в docx, xlsx, pptx и pdf — на каждый формат своя библиотека и свой ад с зависимостями. Решение: MarkItDown от Microsoft, один вызов на всё.
Это для тебя, если пилишь RAG или устал копипастить из документов в чат.
• PDF, Word, Excel, PowerPoint, .msg, EPub, ZIP рекурсивно, YouTube → транскрипт 🚀
• тип файла определяет нейросетью Magika, а не по расширению 🧠
• MCP-сервер — ровно один тул:
•
Почему Markdown, а не голый текст: модели на нём обучены и он токен-эффективен — так в README и написано.
Минус честный: PDF — слабое место. В независимом бенчмарке таблицы 0.27 против 0.88 у docling, заголовки вообще 0.00. OCR в коробке нет.
182k⭐, MIT, 727k скачиваний в сутки. Бери на офисные файлы, а сканы неси в docling 💪
https://github.com/microsoft/markitdown
Проблема: LLM нужен текст, а данные лежат в docx, xlsx, pptx и pdf — на каждый формат своя библиотека и свой ад с зависимостями. Решение: MarkItDown от Microsoft, один вызов на всё.
Это для тебя, если пилишь RAG или устал копипастить из документов в чат.
• PDF, Word, Excel, PowerPoint, .msg, EPub, ZIP рекурсивно, YouTube → транскрипт 🚀
• тип файла определяет нейросетью Magika, а не по расширению 🧠
• MCP-сервер — ровно один тул:
convert_to_markdown(uri)•
pip install 'markitdown[all]' → claude mcp add markitdown -- markitdown-mcpПочему Markdown, а не голый текст: модели на нём обучены и он токен-эффективен — так в README и написано.
Минус честный: PDF — слабое место. В независимом бенчмарке таблицы 0.27 против 0.88 у docling, заголовки вообще 0.00. OCR в коробке нет.
182k⭐, MIT, 727k скачиваний в сутки. Бери на офисные файлы, а сканы неси в docling 💪
https://github.com/microsoft/markitdown
🥰1
🦊 Браузер, который не палится
camofox-browser — HTTP-сервер вокруг Camoufox, форка Firefox, где спуфинг вшит прямо в C++: WebGL, шрифты, AudioContext, WebRTC. Не stealth-плагин поверх Chrome — сами плагины давно стали фингерпринтом.
Пригодится, если агент упирается не в модель, а в Cloudflare.
• accessibility-снапшот вместо сырого HTML — клик по ref
• 14 макросов поиска:
• MCP-адаптер, прокси с GeoIP, 10.8k⭐, MIT
Честно: «drop-in замена Playwright» из описания репо — миф, CDP-эндпоинта нет, только свой REST. TLS-фингерпринт и репутацию IP не прикрывает, капчу не решает, телеметрия по умолчанию шлёт домены наружу ⚠️
Боты — уже 57% трафика Cloudflare, и с июня в белом списке только подписанные агенты. Маскировка пока работает, но дорога сужается.
https://github.com/jo-inc/camofox-browser
camofox-browser — HTTP-сервер вокруг Camoufox, форка Firefox, где спуфинг вшит прямо в C++: WebGL, шрифты, AudioContext, WebRTC. Не stealth-плагин поверх Chrome — сами плагины давно стали фингерпринтом.
Пригодится, если агент упирается не в модель, а в Cloudflare.
• accessibility-снапшот вместо сырого HTML — клик по ref
e1 🎯• 14 макросов поиска:
@google_search, @reddit_subreddit• MCP-адаптер, прокси с GeoIP, 10.8k⭐, MIT
Честно: «drop-in замена Playwright» из описания репо — миф, CDP-эндпоинта нет, только свой REST. TLS-фингерпринт и репутацию IP не прикрывает, капчу не решает, телеметрия по умолчанию шлёт домены наружу ⚠️
Боты — уже 57% трафика Cloudflare, и с июня в белом списке только подписанные агенты. Маскировка пока работает, но дорога сужается.
https://github.com/jo-inc/camofox-browser
❤1
🧩 Конспект System Design за вечер
Проблема: два тома Alex Xu «System Design Interview» — 754 страницы, платные и не грепаются.
Решение:
Это для тебя, если готовишься к System Design интервью или хочешь освежить базу без покупки книги.
• глава = задача: rate limiter, consistent hashing, key-value store, платежи, биржа
• +5.1k⭐ за две недели, сейчас 19.1k 🌟
• лицензии нет вообще — форки и переводы в серой зоне ⚠️
• таблица задержек честно подписана «Latency (2020)»
Забавно: на 52 500 слов про архитектуру — ноль упоминаний LLM, RAG, GPU и векторных БД. Слово
База не устарела. Просто половину такой системы агент теперь набросает сам — а спрашивают на собесе всё ещё тебя.
https://github.com/liquidslr/system-design-notes
Проблема: два тома Alex Xu «System Design Interview» — 754 страницы, платные и не грепаются.
Решение:
system-design-notes — обе книги сжаты в 28 маркдаун-глав с 392 диаграммами. Форкаешь, грепаешь, скармливаешь агенту. 📋Это для тебя, если готовишься к System Design интервью или хочешь освежить базу без покупки книги.
• глава = задача: rate limiter, consistent hashing, key-value store, платежи, биржа
• +5.1k⭐ за две недели, сейчас 19.1k 🌟
• лицензии нет вообще — форки и переводы в серой зоне ⚠️
• таблица задержек честно подписана «Latency (2020)»
Забавно: на 52 500 слов про архитектуру — ноль упоминаний LLM, RAG, GPU и векторных БД. Слово
vector встречается 10 раз, и 8 из них — vector clock из статьи 2007-го. 🧠База не устарела. Просто половину такой системы агент теперь набросает сам — а спрашивают на собесе всё ещё тебя.
https://github.com/liquidslr/system-design-notes
🚫 Тулы без «оставьте ваш email»
Для тех, кто устал заводить аккаунт ради того, чтобы один раз сжать картинку или склеить PDF.
NoSignups (бывш. FckSignups) — каталог опенсорсных браузерных тулов: открыл вкладку и они сразу работают. 262 штуки в 10 категориях, 4.2k⭐ за четыре месяца.
• PDF:
• конвертеры:
• картинки:
• приватность:
Пригодится, когда файл надо обработать разово и не заливать его на чужой сервер.
Фишка — поле
Минус честный: bus factor = 1, 551 заявка висит в очереди, у 34 тулов лицензия «?».
Разовая задача не стоит аккаунта.
https://nosignups.net
Для тех, кто устал заводить аккаунт ради того, чтобы один раз сжать картинку или склеить PDF.
NoSignups (бывш. FckSignups) — каталог опенсорсных браузерных тулов: открыл вкладку и они сразу работают. 262 штуки в 10 категориях, 4.2k⭐ за четыре месяца.
• PDF:
Stirling-PDF, BentoPDF, PaperKnife 📄• конвертеры:
VERT, Pandoc WASM, ffmpeg.wasm• картинки:
Squoosh, SVGOMG, Piskel• приватность:
CyberChef, Cryptgeon, метадата-скрабер 🔍Пригодится, когда файл надо обработать разово и не заливать его на чужой сервер.
Фишка — поле
notRecommendedReason: тул остаётся в каталоге с публичной пометкой, за что наказан. У Stirling-PDF стоит skippable-signup. 🧠Минус честный: bus factor = 1, 551 заявка висит в очереди, у 34 тулов лицензия «?».
Разовая задача не стоит аккаунта.
https://nosignups.net
🧩 MCP на весь флот одной настройкой
Для тех, кто раздаёт команде MCP-серверы руками: в Claude Code v2.1.259 завезли managed-настройку
Раньше это значило разложить
Теперь админ кидает сервер в claude.ai → Admin Settings → Claude Code, и он прилетает всем:
• аддитивно — личные серверы остаются 🆕
• применяется без рестарта сессии
• только https и http/sse — stdio (
•
Пригодится, если у вас Team/Enterprise и общий MCP-зоопарк на команду.
Осторожно при апгрейде:
Конфиг больше не требует админа на каждой машине — но это удобство, а не граница безопасности.
https://code.claude.com/docs/en/managed-mcp
Для тех, кто раздаёт команде MCP-серверы руками: в Claude Code v2.1.259 завезли managed-настройку
managedMcpServers.Раньше это значило разложить
managed-mcp.json по машинам через MDM, и файл забирал эксклюзивный контроль — свои серверы уже не добавить.Теперь админ кидает сервер в claude.ai → Admin Settings → Claude Code, и он прилетает всем:
• аддитивно — личные серверы остаются 🆕
• применяется без рестарта сессии
• только https и http/sse — stdio (
npx) не раздать•
command/env запрещены: админка не может запустить процесс на твоей машине 🔒Пригодится, если у вас Team/Enterprise и общий MCP-зоопарк на команду.
Осторожно при апгрейде:
allowedMcpServers сменил смысл — сервер, который он раньше отфильтровывал, теперь загрузится сам, молча.Конфиг больше не требует админа на каждой машине — но это удобство, а не граница безопасности.
https://code.claude.com/docs/en/managed-mcp
🧠 166 скиллов, которые делают из агента учёного
Проблема: просишь агента разобрать эксперимент — код он напишет, а какой статтест принят в поле и какая база авторитетная, не знает. Решение: Scientific Agent Skills — библиотека, которая кодирует именно эту процедурную часть.
Агент сам ходит в PubMed, ChEMBL, UniProt, AlphaFold, ClinVar — 80+ баз с готовыми контрактами к API. Без MCP-рантайма, просто папка с markdown 📋
• геномика, хемоинформатика, drug discovery, клиника
•
• 44.8k⭐, MIT — но лицензия у каждого скилла своя
Пригодится, даже если ты далёк от биологии: внутри ещё SEC EDGAR, USPTO, FRED и архив экзопланет NASA.
Честная деталь: в своей же arXiv-статье авторы признают — что агент со скиллами работает лучше, они не доказывали 🔍
Домен агенту теперь выдают папкой, а не файнтюном. Только не ставь все 166 сразу — README сам об этом просит.
https://github.com/K-Dense-AI/scientific-agent-skills
Проблема: просишь агента разобрать эксперимент — код он напишет, а какой статтест принят в поле и какая база авторитетная, не знает. Решение: Scientific Agent Skills — библиотека, которая кодирует именно эту процедурную часть.
Агент сам ходит в PubMed, ChEMBL, UniProt, AlphaFold, ClinVar — 80+ баз с готовыми контрактами к API. Без MCP-рантайма, просто папка с markdown 📋
• геномика, хемоинформатика, drug discovery, клиника
•
npx skills add K-Dense-AI/scientific-agent-skills• 44.8k⭐, MIT — но лицензия у каждого скилла своя
Пригодится, даже если ты далёк от биологии: внутри ещё SEC EDGAR, USPTO, FRED и архив экзопланет NASA.
Честная деталь: в своей же arXiv-статье авторы признают — что агент со скиллами работает лучше, они не доказывали 🔍
Домен агенту теперь выдают папкой, а не файнтюном. Только не ставь все 166 сразу — README сам об этом просит.
https://github.com/K-Dense-AI/scientific-agent-skills
📱 Настоящий iOS на маке — одной командой
Для тех, кто упирался в симулятор Xcode: там нет ядра, нет SEP, нет boot chain — ни
Дикая деталь: виртуальный iPhone собрала сама Apple. В research-образе Private Cloud Compute лежит идентити
•
• шкала патчей 4 → 42 → 113 → 141: от «митигации живы» до Sileo
• 12.4k⭐, MIT, iOS до 27.0
Пригодится, если ковыряешь iOS-безопасность или гоняешь E2E: у Corellium это $3 за device-hour, тут ноль.
Цена честная: SIP и AMFI выключить, App Store внутри не работает. Рабочий мак не подставляй — только отдельная машина 💪
https://github.com/Lakr233/vphone-cli
Для тех, кто упирался в симулятор Xcode: там нет ядра, нет SEP, нет boot chain — ни
.ipa поставить, ни ядро подебажить. vphone-cli поднимает на Apple Silicon настоящую iOS как VM.Дикая деталь: виртуальный iPhone собрала сама Apple. В research-образе Private Cloud Compute лежит идентити
iPhone99,11 — эмулятор не написали, его нашли внутри серверной прошивки 🔍•
brew install zqxwce/tap/vphone-cli и одна команда• шкала патчей 4 → 42 → 113 → 141: от «митигации живы» до Sileo
• 12.4k⭐, MIT, iOS до 27.0
Пригодится, если ковыряешь iOS-безопасность или гоняешь E2E: у Corellium это $3 за device-hour, тут ноль.
Цена честная: SIP и AMFI выключить, App Store внутри не работает. Рабочий мак не подставляй — только отдельная машина 💪
https://github.com/Lakr233/vphone-cli
🎙 Локальный ElevenLabs в одном окне
VoiceStudio склеивает 17 TTS- и 11 ASR-движков в один десктоп-апп: клонирование голоса, voice design, дубляж видео, аудиокниги. Всё локально, ничего не улетает в облако 🔒
• zero-shot клон с сэмпла 3–10 сек, ~6 ГБ VRAM
• CUDA / ROCm / Apple Silicon, GGUF для CPU
• русский — 7-й по объёму обучающих данных
• внутри MCP-сервер: синтез дёргается прямо из агента 🧠
Пригодится, если пачками озвучиваешь ролики и устал платить за символы.
Но два слоя мелким шрифтом: «646 языков» — это ISO-охват, у 82% из них меньше 20 часов данных. А веса дефолтного движка — CC-BY-NC, в коммерческий продукт не заберёшь.
31k⭐ за 5 месяцев, топ-1 тренда. Бесплатный по деньгам — но не по лицензии 💪
https://github.com/debpalash/VoiceStudio
VoiceStudio склеивает 17 TTS- и 11 ASR-движков в один десктоп-апп: клонирование голоса, voice design, дубляж видео, аудиокниги. Всё локально, ничего не улетает в облако 🔒
• zero-shot клон с сэмпла 3–10 сек, ~6 ГБ VRAM
• CUDA / ROCm / Apple Silicon, GGUF для CPU
• русский — 7-й по объёму обучающих данных
• внутри MCP-сервер: синтез дёргается прямо из агента 🧠
Пригодится, если пачками озвучиваешь ролики и устал платить за символы.
Но два слоя мелким шрифтом: «646 языков» — это ISO-охват, у 82% из них меньше 20 часов данных. А веса дефолтного движка — CC-BY-NC, в коммерческий продукт не заберёшь.
31k⭐ за 5 месяцев, топ-1 тренда. Бесплатный по деньгам — но не по лицензии 💪
https://github.com/debpalash/VoiceStudio
❤1
🧩 Агент «упал», а он доработал
Проблема: сабагент дожал задачу, но родитель пометил его failed и выбросил результат — потому что в финальном ответе не было блока с подсчётом токенов 🔄
В Claude Code v2.1.273 закрыли три бага ровно про автономку:
• сабагенты не фейлятся из-за пустого usage или model id
• SDK и
• авто-компакт срабатывал на половине окна: advisor-ходы считались вдвое дороже 🧠
Последнее висело в трекере с апреля: 7 авто-компакций из 16 приходились на advisor-ход при реальных 82–100k токенов.
Это для тебя, если гоняешь агента в фоне или через SDK и потом не находишь его отчёт.
Метаданные биллинга не должны решать, жив агент или нет.
https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
Проблема: сабагент дожал задачу, но родитель пометил его failed и выбросил результат — потому что в финальном ответе не было блока с подсчётом токенов 🔄
В Claude Code v2.1.273 закрыли три бага ровно про автономку:
• сабагенты не фейлятся из-за пустого usage или model id
• SDK и
stream-json не теряют хвост фонового таска• авто-компакт срабатывал на половине окна: advisor-ходы считались вдвое дороже 🧠
Последнее висело в трекере с апреля: 7 авто-компакций из 16 приходились на advisor-ход при реальных 82–100k токенов.
Это для тебя, если гоняешь агента в фоне или через SDK и потом не находишь его отчёт.
Метаданные биллинга не должны решать, жив агент или нет.
https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
🔍 Аудитор, который сам себя опровергает
Для тех, кто просил агента «найди уязвимости» и потом выкидывал половину отчёта: Cloudflare выложила свой внутренний рецепт аудита.
Главное правило: кто нашёл баг — тот его не подтверждает. Кандидат уходит свежему агенту, который пытается его опровергнуть и чужих вердиктов не видит 🧠
• 6 фаз: разведка → охота → опровержение → отчёт
• вердикты
• coverage-ledger честно пишет, что НЕ смотрели 📋
• профили
С их харнесса: 128 репо, false positive упал с 40% до 11%. Слепой сторонний замер — precision 90%.
Минус жирный: на HN жалуются на 150k–1M токенов за прогон.
Пригодится, если перед релизом нужен аудит, а платить за внешний не хочется.
11.5k⭐ и MIT за репу из маркдауна и двух валидаторов. Скилл теперь дистрибутив методологии, а не код.
https://github.com/cloudflare/security-audit-skill
Для тех, кто просил агента «найди уязвимости» и потом выкидывал половину отчёта: Cloudflare выложила свой внутренний рецепт аудита.
Главное правило: кто нашёл баг — тот его не подтверждает. Кандидат уходит свежему агенту, который пытается его опровергнуть и чужих вердиктов не видит 🧠
• 6 фаз: разведка → охота → опровержение → отчёт
• вердикты
confirmed / needs_validation / rejected• coverage-ledger честно пишет, что НЕ смотрели 📋
• профили
quick / standard / deepС их харнесса: 128 репо, false positive упал с 40% до 11%. Слепой сторонний замер — precision 90%.
Минус жирный: на HN жалуются на 150k–1M токенов за прогон.
Пригодится, если перед релизом нужен аудит, а платить за внешний не хочется.
11.5k⭐ и MIT за репу из маркдауна и двух валидаторов. Скилл теперь дистрибутив методологии, а не код.
https://github.com/cloudflare/security-audit-skill
🌐 Агент в твоём браузере, а не в своём
Проблема: агент лезет в веб и упирается в логины. Своя копия Chrome твоих сессий не знает, а Playwright MCP ещё и жрёт ~13.6k токенов на одни описания тулов.
Решение: BrowserSkill от Tencent — расширение садится в твой уже залогиненный Chrome/Edge. Второй профиль не нужен 🧠
• команды — обычный шелл (
• агент рулит отдельным Agent Window, ты сидишь в своих вкладках
• твою вкладку возьмёт только через
• на странице плашка «Agent controlling» и кнопка Interrupt 🛑
Пригодится, если агенту нужен твой залогиненный контур: админка, дашборд, личный кабинет.
Минус: локальный WebSocket пускает любое расширение (issue #273), и ни слова про prompt-injection.
5.9k⭐ и MIT за три месяца. Антибот тут обходить нечем — ты для сайта и так свой.
https://github.com/Tencent/BrowserSkill
Проблема: агент лезет в веб и упирается в логины. Своя копия Chrome твоих сессий не знает, а Playwright MCP ещё и жрёт ~13.6k токенов на одни описания тулов.
Решение: BrowserSkill от Tencent — расширение садится в твой уже залогиненный Chrome/Edge. Второй профиль не нужен 🧠
• команды — обычный шелл (
bsk click @e3), не MCP-схемы• агент рулит отдельным Agent Window, ты сидишь в своих вкладках
• твою вкладку возьмёт только через
borrow — с попапом-подтверждением• на странице плашка «Agent controlling» и кнопка Interrupt 🛑
Пригодится, если агенту нужен твой залогиненный контур: админка, дашборд, личный кабинет.
Минус: локальный WebSocket пускает любое расширение (issue #273), и ни слова про prompt-injection.
5.9k⭐ и MIT за три месяца. Антибот тут обходить нечем — ты для сайта и так свой.
https://github.com/Tencent/BrowserSkill
⚡ Лаунчер на 3.5 МБ вместо 400
Проблема: Raycast v2 переехал на вебвью + Node и сам пишет в блоге, что сидит на 350–450 МБ RAM. Решение: Tinycast — тот же лаунчер, но целиком на Swift, без единой зависимости.
• бинарь
• потолок 100 МБ зашит в правила проекта: PR без замеров закрывают
• крутит настоящие расширения Raycast — но в системном JavaScriptCore, без Node
• настройки тянет прямо из
• бесплатно, AGPL, без аккаунта и телеметрии
Пригодится, если Raycast у тебя стабильно висит в топе Activity Monitor 🔍
Минусы честные: проекту 84 дня, версия 0.11.3, только macOS 26+, подпись self-signed.
Лаунчер не должен весить больше, чем то, что он запускает.
https://github.com/abue-ammar/tinycast
Проблема: Raycast v2 переехал на вебвью + Node и сам пишет в блоге, что сидит на 350–450 МБ RAM. Решение: Tinycast — тот же лаунчер, но целиком на Swift, без единой зависимости.
• бинарь
3.5 МБ, резидентная память 40–80 МБ 💾• потолок 100 МБ зашит в правила проекта: PR без замеров закрывают
• крутит настоящие расширения Raycast — но в системном JavaScriptCore, без Node
• настройки тянет прямо из
.rayconfig• бесплатно, AGPL, без аккаунта и телеметрии
Пригодится, если Raycast у тебя стабильно висит в топе Activity Monitor 🔍
Минусы честные: проекту 84 дня, версия 0.11.3, только macOS 26+, подпись self-signed.
Лаунчер не должен весить больше, чем то, что он запускает.
https://github.com/abue-ammar/tinycast
👍2
🕵️ Харнесс, который грузил твой .git
Для тех, кто ставит новые агентные CLI не глядя: ZCode от Z.ai (те самые GLM) до версии 3.14.0 перед КАЖДЫМ промптом паковал весь воркспейс и заливал архив в Aliyun OSS.
• 86.6% архива — это
• в reflog нашли удалённые API-ключи и внутренние хостнеймы
• архив шифруется ключом, приватной половины которого у тебя нет 🔒
• тумблер «индексация снимков» 1339 раз писался в лог как
• спалился на
Пригодится, если в твоё репо хоть раз коммитился ключ — пусть и «удалённый» потом.
Починили в 3.14.0, код открыли, бакет снесли. В июле ровно то же делал Grok Build от xAI.
Удалить секрет из кода — не значит удалить его из истории.
https://blog.ferstar.org/en/posts/zcode-silent-workspace-snapshot-upload/
Для тех, кто ставит новые агентные CLI не глядя: ZCode от Z.ai (те самые GLM) до версии 3.14.0 перед КАЖДЫМ промптом паковал весь воркспейс и заливал архив в Aliyun OSS.
• 86.6% архива — это
.git, а не код 🔍• в reflog нашли удалённые API-ключи и внутренние хостнеймы
• архив шифруется ключом, приватной половины которого у тебя нет 🔒
• тумблер «индексация снимков» 1339 раз писался в лог как
false — сбор всё равно шёл• спалился на
du -sh ~/.zcode: человек чистил диск и увидел лишние 700 МБПригодится, если в твоё репо хоть раз коммитился ключ — пусть и «удалённый» потом.
Починили в 3.14.0, код открыли, бакет снесли. В июле ровно то же делал Grok Build от xAI.
Удалить секрет из кода — не значит удалить его из истории.
https://blog.ferstar.org/en/posts/zcode-silent-workspace-snapshot-upload/
❤1