GitHub Разработчика
17.1K subscribers
659 photos
365 videos
2 files
1.01K links
Здесь ты найдешь полезные репозитории с GitHub

Связь: @devmangx

РКН: https://clck.ru/3FocDP
Download Telegram
icloud_photos_downloader

Хочется слить на локальный диск пару тысяч фоток из iCloud, а через веб или приложение это только руками, муторно и долго.

На GitHub случайно попался опенсорсный icloud_photos_downloader — консольный тул, который позволяет скриптом выкачать весь iCloud Photo Library на локалку.

Написан на Python, логинитcя с двухфакторкой, и одной простой командой забирает фотки и видео пачками в выбранную директорию.

Умеет докачивать с места остановки, уже скачанные файлы пропускает, можно фильтровать по дате, альбомам и даже по альбомам из face recognition.

После скачивания файлы можно раскидать по год/месяц/день и сохранить оригинальные метаданные.

Если прикрутить cron или другой планировщик, можно получить автоматический локальный бэкап из iCloud. Есть и Docker-образ, подойдет для долгой работы на сервере.

📁 Language: #Python 93.7%

⭐️ Stars: 9.7k

➡️ Cсылка на GitHub

📱 @git_developer
Please open Telegram to view this post
VIEW IN TELEGRAM
👍112
voice-pro

Бывает нужно озвучить видео на разных языках или клонировать конкретный голос, а на рынке полно сервисов, которые берут деньги за каждый символ. В долгую это выходит больно дорого.

Недавно наткнулся на Voice-Pro. Раньше это было платное приложение, а сейчас разработчик полностью открыл исходники и сделал его бесплатным. По сути, сильно упростили вход в тему видео-перевода и голосового клонирования.

Внутри собран полный пайплайн: скачивание видео с YouTube, разделение голоса и фоновой дорожки, распознавание речи, перевод и финальный дубляж. Есть поддержка WhisperX для точных субтитров, плюс можно сделать zero-shot клонирование голоса через F5-TTS и CosyVoice.

Сейчас основная поддержка под Windows с NVIDIA GPU. Есть скрипт для авто-инсталла, который сам настроит окружение, так что не нужно возиться с Python и зависимостями.

По ощущениям, это почти как локальный бесплатный ElevenLabs. Если нужно делать мультиязычные ролики или выходить на зарубежные площадки, штука прям сильно экономит бюджет.

📁 Language: #Python 93.9%

⭐️ Stars: 5.5k

➡️ Cсылка на GitHub

📱 @git_developer
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍167🔥5
Constrict

Хочешь скинуть другу видос или залить вложение где-нибудь, а платформа выдает “файл слишком большой”. Приходится искать софт, ковырять настройки и сжимать вручную.

На GitHub как раз попался Constrict — маленький опенсорс-инструмент, заточенный под одну конкретную задачу: ужать видео до нужного размера.

Не нужно возиться с кучей параметров. Просто задаешь целевой размер, а дальше он сам рассчитывает и подбирает битрейт, разрешение и FPS, чтобы ужать ролик максимально точно.

Поддерживаются популярные кодеки вроде H.264, HEVC и AV1. Вся обработка делается локально, без загрузки в облако, так что и приватность сохраняется, и ждать ничего не нужно.

Есть готовые инсталляторы, интерфейс простой и понятный. Если тебе часто нужно ужимать видео под конкретный размер и неохота каждый раз вручную крутить параметры — инструмент прям годный для закладок.

📁 Language: #Python 94.2%

⭐️ Stars: 507

➡️ Cсылка на GitHub

📱 @git_developer
Please open Telegram to view this post
VIEW IN TELEGRAM
7🏆2🔥1
paperetl

Когда занимаешься исследованием или анализом данных и у тебя сотни или тысячи PDF-статей, каждый раз вручную вытаскивать и раскладывать информацию это ад.

Недавно, пока копался в тулзах для обработки данных, наткнулся на paperetl. Это опенсорсная библиотека для пакетной обработки и парсинга научных публикаций, которая приводит разный входной формат к структурированным данным.

Поддерживает массовый парсинг и преобразование источников в разных форматах: полный текст PDF, PubMed XML, ArXiv XML и другие.

Может складывать неструктурированные статьи прямо в SQLite, выгружать в JSON, а также подключаться к Elasticsearch для полнотекстового поиска.

По сути, одной командой можно прогнать целую папку с файлами и превратить её в БД или набор структурированных файлов, чтобы потом нормально искать, фильтровать и анализировать.

Если ты делаешь литобзор, систематический обзор или хочешь собрать свою базу статей, инструмент точно стоит попробовать.

📁 Language: #Python 96.2%

⭐️ Stars: 490

➡️ Cсылка на GitHub

📱 @git_developer
Please open Telegram to view this post
VIEW IN TELEGRAM
8👍2
NoLanguageLeftWaiting

Если хочется делать стриминговый перевод для трансляций или прям настоящий синхрон, быстро упираешься в тупняк классических офлайн-моделей: они часто ждут, пока человек договорит фразу целиком, и из-за этого появляется заметная задержка.

На GitHub нашелся опенсорсный проект NoLanguageLeftWaiting. Ребята взяли офлайн-переводчик Meta NLLB и переделали его в режим реального синхронного перевода: модель может переводить на лету, не дожидаясь конца предложения.

Плюс они закрывают типичные боли “псевдо-синхрона”: когда пунктуация вставляется криво, а работа с префиксами и контекстом превращается в кашу.

Что по возможностям:

* перевод между ~200 языками
* два варианта бэкенда: HuggingFace и CTranslate2
* внутри сразу два размера модели: 600M и 1.3B

Сейчас они ещё пилят speculative decoding (спекулятивное декодирование), чтобы ускорить вывод. Идея: часть гипотез быстро “пробрасывать” и потом частично валидировать, чтобы не тормозить на каждом шаге. По их замерам валидация занимает примерно 0.15 секунды.

Если делаешь голосовой перевод, субтитры для стрима или любой кросс-языковой созвон, где задержка решает, проект прям стоит потыкать.

📁 Language: #Python 100.0%

⭐️ Stars: 41

➡️ Cсылка на GitHub

📱 @git_developer
Please open Telegram to view this post
VIEW IN TELEGRAM
9👍1🔥1
local_ai_ocr

Если нужно вытаскивать текст из документов или PDF, загружать файлы в онлайн-конвертеры всегда как-то стрёмно. А у многих локальных тулов то распознавание так себе, то форматирование превращается в кашу.

Случайно наткнулся на GitHub на open-source проект local_ai_ocr: он собран на модели DeepSeek-OCR и заточен под локальное офлайн-распознавание текста на Windows.

Он умеет с GPU-ускорением обрабатывать картинки и PDF: не просто точно вытягивает текст, но и может сразу экспортировать в Markdown, чтобы сохранить сложные таблицы и верстку.

Работает полностью офлайн: ничего не нужно отправлять в облако. Скачал, распаковал, запустил init-скрипт и можно пользоваться, без сложной настройки окружения.

Если для тебя критична приватность данных или нужна максимально точная “реконструкция” форматирования документа, штука точно стоит того, чтобы попробовать.

📁 Language: #Python 67%

⭐️ Stars: 493

➡️ Cсылка на GitHub

📱 @git_developer
Please open Telegram to view this post
VIEW IN TELEGRAM
5👍3