[PYTHON:TODAY]
64K subscribers
2.36K photos
1.17K videos
320 files
1.48K links
Python скрипты, нейросети, боты, автоматизация. Всё бесплатно!

Приват: https://boosty.to/pythontoday
YouTube: https://clck.ru/3LfJhM
Канал админа: @akagodlike
Чат: @python2day_chat

Сотрудничество: @web_runner

Канал в РКН: https://clck.ru/3GBFVm
Download Telegram
🎙 CosyVoice 3 — открытая нейросеть, которая умеет озвучивать текст, клонировать голос по короткому примеру и говорить сразу на нескольких языках — включая русский. Причем всё это можно запускать локально.

Возможности:
🎤 Клонирование голоса по короткому аудиофрагменту (Zero-Shot Voice Cloning).

🌍 Поддержка различных языков, включая русский, английский, немецкий, французский, испанский, японский и другие.

🗣 Генерация речи с управлением:
* эмоциями;
* скоростью;
* громкостью;
* стилем;
* акцентом;
* языком.

⚡️ Потоковая генерация голоса с задержкой около 150 мс, что позволяет использовать модель для голосовых ассистентов и общения в реальном времени.

🧠 Корректно читает:
* числа;
* даты;
* валюты;
* специальные символы;
* сложные текстовые конструкции без дополнительных модулей нормализации текста.

🎧 Поддерживает кросс-языковое клонирование — например, можно использовать образец голоса на одном языке и синтезировать речь на другом.

Где может пригодится:
Голосовые боты.
Создание подкастов.
AI-ассистенты.
Игры.
Собственные голосовые интерфейсы.
Озвучка книг.
Дубляж видео.

Установка

Клонируем репозиторий:
git clone --recursive https://github.com/FunAudioLLM/CosyVoice.git
cd CosyVoice
git submodule update --init --recursive


Создаем окружение:
conda create -n cosyvoice python=3.10
conda activate cosyvoice


Устанавливаем зависимости:
pip install -r requirements.txt


Пример запуска:
python example.py


Или сразу поднимаем WebUI:
python webui.py --port 50000


После запуска откроется удобный веб-интерфейс для генерации речи.

♎️ GitHub/Инструкция

😳 Лайф | 📲 Зеркало Max

#python #soft #github
Please open Telegram to view this post
VIEW IN TELEGRAM
👍44🔥2313
This media is not supported in your browser
VIEW IN TELEGRAM
🔥 Создание реалистичных AI-видео постепенно становится доступным каждому.

LongCat-Video — открытая нейросеть с 13,6 млрд параметров, которая умеет не только генерировать видео по тексту, но и создавать говорящих аватаров, анимировать фотографии, продолжать существующие ролики и синхронизировать речь с движением губ. Всё это можно запускать локально.

Возможности:
🔣Text-to-Video — создание видео по текстовому описанию.
🔣Image-to-Video — оживляет обычные изображения.
🔣AI-аватары — создание говорящих персонажей по фотографии и аудио.
🔣Липсинк высокого качества — синхронизация речи и движения губ с использованием Whisper Large в новой версии Avatar 1.5.
🔣Поддержка нескольких персонажей и нескольких аудиодорожек одновременно.
🔣Работает не только с людьми, но и с аниме, животными и стилизованными персонажами.
🔣Генерирует длинные ролики без заметной деградации качества и «дрейфа» цветов — одна из ключевых особенностей проекта.
🔣Генерация видео 720p, 30 FPS с оптимизированной архитектурой и ускоренным инференсом.

Где пригодится?
🟢Создание AI-блогеров.
🟢Виртуальные ведущие.
🟢Озвучка фотографий.
🟢Дубляж видео.
🟢Контент для YouTube, TikTok и Reels.
🟢Игровые NPC.
🟢Маркетинговые ролики.
🟢AI-персонажи для Telegram-ботов и сайтов.

⚙️ Установка

Клонируем проект:
git clone https://github.com/meituan-longcat/LongCat-Video
cd LongCat-Video


Создаем окружение:
conda create -n longcat-video python=3.10
conda activate longcat-video


Устанавливаем зависимости:
pip install -r requirements.txt
pip install -r requirements_avatar.txt


Скачиваем модели:
pip install "huggingface_hub[cli]"
huggingface-cli download meituan-longcat/LongCat-Video --local-dir ./weights/LongCat-Video
huggingface-cli download meituan-longcat/LongCat-Video-Avatar --local-dir ./weights/LongCat-Video-Avatar
huggingface-cli download meituan-longcat/LongCat-Video-Avatar-1.5 --local-dir ./weights/LongCat-Video-Avatar-1.5


▶️ Запуск

Генерация видео:
torchrun run_demo_text_to_video.py


Оживление изображения:
torchrun run_demo_image_to_video.py


Создание говорящего аватара:
torchrun run_demo_avatar_single_audio_to_video.py


Несколько персонажей:
torchrun run_demo_avatar_multi_audio_to_video.py


Веб-интерфейс:
python run_streamlit.py


Один из самых интересных открытых проектов. В одном репозитории объединены генерация видео по тексту, анимация изображений, создание говорящих аватаров и продолжение существующих роликов. При этом разработчики делают упор на длительные видео, стабильность персонажей и качественную синхронизацию речи, что приближает проект к возможностям коммерческих сервисов.

♎️ GitHub/Инструкция

😳 Лайф | 📲 Зеркало Max

#python #soft #github
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4721🔥19
Media is too big
VIEW IN TELEGRAM
💬 Scryptian — крутая утилита, которая работает поверх любых приложений и мгновенно переводит текст на понятный вам язык.

Достаточно выделить текст, нажать горячую клавишу — и ИИ мгновенно выполнит нужную задачу прямо там, где вы работаете. Никаких вкладок, браузеров и копирования текста в ChatGPT.

Возможности
💬 Перевод текста прямо в Telegram, Discord, Word, PDF, браузере и любых других приложениях.
💬 Исправление орфографии, пунктуации и грамматики.
💬 Улучшение стиля текста и повышение читаемости.
💬 Мгновенное создание краткого саммари длинных документов.
💬 Изменение тона текста — дружелюбный, официальный, деловой и другие.
💬 «Очеловечивание» текста, написанного нейросетью.

Где пригодится?
🟢Переписка с иностранными заказчиками.
🟢Работа с технической документацией.
🟢Перевод PDF любого объема.
🟢Написание писем.
🟢Проверка английского текста.
🟢Учеба и работа с большими статьями.
🟢Любые задачи, где приходится постоянно переключаться между приложениями.

👍 Сохраняем и пробуем бесплатно!

😳 Лайф | 📲 Зеркало Max

#python #soft #github
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3214🔥13
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ CyberScraper 2077 — веб-скрапер, который словно веб-разведчик на стероидах, агрегирующий в себе последние достижения ИИ от таких гигантов, как OpenAI, Gemini и Ollama.

Зачем оно вам? — чтобы ловко обходить капчи, защиту и глубже понимать контент, который вы собираетесь парсить.

Среди приятных особенностей:

💬 Кроссплатформенный, работает под Windows/Linux, можно запустить через Docker(инструкции по запуску на GitHub);
💬 Интуитивно понятный интерфейс;
💬 Возможность экспорта данных в форматах JSON, CSV, HTML, SQL или Excel;
💬 Точное структурирование извлеченной информации, где ИИ проявляет себя на все сто;
💬 Режим скрытности, чтобы оставаться незамеченным.

И это далеко не все мелочи, которыми может похвастаться этот продвинутый инструмент.

⚙️ GitHub/Инструкция

😳 Лайф | 📲 Зеркало Max

#python #github #soft
Please open Telegram to view this post
VIEW IN TELEGRAM
👍217🔥2
⚡️ HunyuanOCR — это не обычный OCR, который путает буквы и плачет от плохого качества.

Распознаёт текст на фото, сканах и даже кривых телефонных снимках с точностью, что ставит Google Vision в неловкое положение.

Что умеет:
📸 Считывает текст на любых изображениях — документы, фото, меню, вывески, рукописные заметки.
🧠 Мощная модель от Tencent — понимает структуру, расположение блоков, выделяет зоны текста.
🌚 Работает даже на плохих фото — шум, тени, наклон, бликующий экран — распознаёт всё.
😰 Есть Python-интерфейс — можно встроить в бота, сервис или свою автоматизацию.
🗂 Разбирает сложные макеты — таблицы, колонки, многостраничные файлы.
🆓 Полностью бесплатно и open-source.

▶️ Пример использования:
from vllm import LLM, SamplingParams
from PIL import Image
from transformers import AutoProcessor

def clean_repeated_substrings(text):
"""Clean repeated substrings in text"""
n = len(text)
if n<8000:
return text
for length in range(2, n // 10 + 1):
candidate = text[-length:]
count = 0
i = n - length

while i >= 0 and text[i:i + length] == candidate:
count += 1
i -= length

if count >= 10:
return text[:n - length * (count - 1)]

return text

model_path = "tencent/HunyuanOCR"
llm = LLM(model=model_path, trust_remote_code=True)
processor = AutoProcessor.from_pretrained(model_path)
sampling_params = SamplingParams(temperature=0, max_tokens=16384)

img_path = "/path/to/image.jpg"
img = Image.open(img_path)
messages = [
{"role": "system", "content": ""},
{"role": "user", "content": [
{"type": "image", "image": img_path},
{"type": "text", "text": "检测并识别图片中的文字,将文本坐标格式化输出。"}
]}
]
prompt = processor.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
inputs = {"prompt": prompt, "multi_modal_data": {"image": [img]}}
output = llm.generate([inputs], sampling_params)[0]
print(clean_repeated_substrings(output.outputs[0].text))


♎️ GitHub/Инструкция

Где будет полезно:
🟢делай сервис распознавания чеков и документов;
🟢автоматизируй ввод данных для бизнеса;
🟢продавай обработку сканов на фрилансе;
🟢собирай «умного» Telegram-бота для OCR;
🟢создавай SaaS под маркетплейсы и бухгалтерию.

😳 Лайф | 📲 Зеркало Max

#python #soft #github
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥32👍116
5_AI_проектов_которые_ты_можешь_собрать_за_выходные_на_Python.pdf
2.5 MB
😰 5 AI-проектов, которые ты можешь собрать за выходные на Python

💬 Голосовой AI-ассистент (Whisper + GPT) – ассистент, который понимает речь и отвечает голосом.
💬 Чат-бот для документов (LangChain + LLM) – бот, отвечающий на вопросы по вашим PDF/ текстам.
💬 Генератор изображений (Stable Diffusion) – приложение для генерации картинок по текстовому запросу.
💬 Автоописание изображений (BLIP Captioning) – модель, которая сама подписывает/ описывает загруженное изображение.
💬 Суммаризация текста (BART/GPT) – инструмент, автоматически составляющий краткое резюме статьи или видео.

👆 Статья на русском + код в PDF

😳 Лайф | 📲 Зеркало Max

#python #soft #code
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3613🔥12
This media is not supported in your browser
VIEW IN TELEGRAM
💻 Auto-Py-To-Exe — удобная графическая оболочка, которая помогает собрать готовое Windows-приложение прямо из Python-проекта.

💬 Конвертирует .py в .exe с использованием PyInstaller.
💬 Позволяет выбрать режим сборки:
* однофайловое приложение;
* папка с файлами.
💬 Добавляет иконку, дополнительные файлы и ресурсы без ручного редактирования параметров.
💬 Настраивает параметры сборки через понятный графический интерфейс.
💬 Поддерживает дополнительные аргументы PyInstaller для более тонкой настройки.
💬 После настройки может сгенерировать готовую команду PyInstaller — удобно для автоматизации и CI/CD.

⚙️ Простая установка:
pip install auto-py-to-exe


▶️ Запуск:
auto-py-to-exe


Откроется локальный веб-интерфейс, где можно выбрать скрипт, настроить параметры и собрать готовый .exe буквально за несколько минут.

💻 Отличный инструмент для разработчиков, которые хотят быстро распространять свои Python-приложения среди пользователей без установленного Python.

♎️ GitHub/Инструкция

😳 Лайф | 📲 Зеркало Max

#python #github #soft
Please open Telegram to view this post
VIEW IN TELEGRAM
👍44🔥198🫡4🤯3
This media is not supported in your browser
VIEW IN TELEGRAM
💀 Одна фотография — и у вас появляется живой AI-аватар для стримов

PersonaLive — открытый инструмент для анимации портретов в реальном времени. Загружаете фотографию человека, включаете веб-камеру или подаёте управляющее видео — и персонаж начинает повторять мимику, движения головы и выражение лица.

В отличие от обычных генераторов «говорящих фото», проект рассчитан на непрерывную потоковую генерацию: аватар может работать длительное время без постоянной нарезки ролика на отдельные фрагменты.

Что умеет:
🔣 Оживляет портрет по движениям человека из видео или веб-камеры.
🔣 Переносит мимику, повороты головы, положение и масштаб лица.
🔣 Генерирует длинные анимации в потоковом режиме.
🔣 Позволяет менять исходное изображение прямо в WebUI.
🔣 Поддерживает офлайн-обработку готовых видео и онлайн-режим для трансляций.
🔣 Может работать через ComfyUI.
🔣 Поддерживает ускорение через TensorRT, которое, по данным авторов, способно примерно вдвое ускорить инференс, хотя возможна небольшая потеря качества.


⚙️ Установка
git clone https://github.com/GVCLab/PersonaLive
cd PersonaLive

conda create -n personalive python=3.10
conda activate personalive

pip install -r requirements_base.txt
python tools/download_weights.py


▶️ Запуск офлайн-генерации:
python inference_offline.py \
--reference_image avatar.jpg \
--driving_video motion.mp4


Запуск WebUI:
source web_start.sh


PersonaLive выглядит как заготовка для собственного виртуального блогера: одна фотография, камера и мощная NVIDIA — и цифровой персонаж начинает двигаться вместе с вами.

♎️ GitHub/Инструкция

Где пригодится:
🟢Виртуальные ведущие и стримеры.
🟢AI-блогеры и цифровые персонажи.
🟢Аватары для трансляций и видеочатов.
🟢Персонажи для игр, ботов и интерактивных сервисов.
🟢Создание роликов из одной фотографии без ручной анимации.

😳 Лайф | 📲 Зеркало Max

#python #soft #github
Please open Telegram to view this post
VIEW IN TELEGRAM
👍25🔥147
This media is not supported in your browser
VIEW IN TELEGRAM
🚨 Wi-Fi больше не просто раздает интернет. Теперь он может "видеть" людей, дыхание и даже сердцебиение.

RuView — open-source проект, который превращает обычные Wi-Fi-сигналы в своеобразный радар. Система анализирует отражения радиоволн от человеческого тела и восстанавливает картину происходящего в помещении, даже без прямой видимости.

Репозиторий уже собрал 8️⃣5️⃣ 0️⃣0️⃣0️⃣ звезд!

Возможности:
🔣Определяет положение человека по 17 ключевым точкам тела.
🔣Отслеживает частоту дыхания (примерно 6–30 вдохов в минуту).
🔣Измеряет пульс на расстоянии (около 40–120 BPM).
🔣Обнаруживает людей через стены, мебель и завалы на дистанции до 5 метров.
🔣Поддерживает одновременное отслеживание нескольких человек.

⚙️ Как это работает?
Wi-Fi-сигналы постоянно отражаются от окружающих объектов. Даже крошечные движения грудной клетки при дыхании или удары сердца немного изменяют характеристики отражённого сигнала.
RuView анализирует эти изменения и восстанавливает положение человека, его движения и жизненные показатели.

Где пригодится?
🟢Поиск людей после землетрясений и обрушений.
🟢Мониторинг пожилых людей без носимых датчиков.
🟢Научные исследования и разработка новых систем компьютерного зрения.
🟢Эксперименты с беспроводным зондированием пространства.

Проект полностью open-source, код доступен на GitHub.

♎️ GitHub/Инструкция

😳 Лайф | 📲 Зеркало Max

#github #python #soft
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥58👍1711🤯5🫡1
🦊 Camoufox — модифицированный Firefox для автоматизации, парсинга и работы ИИ-агентов с сайтами, которые быстро вычисляют обычные Playwright- и Selenium-скрипты.

Обычные Selenium и Playwright часто палятся по браузерному отпечатку: сайт видит странный WebGL, подозрительный экран, признаки автоматизации — и отправляет скрипт в капчу или бан.

Camoufox работает хитрее:
маскирует автоматизацию внутри Firefox;
подменяет согласованный цифровой отпечаток устройства;
настраивает WebGL, экран, язык, часовой пояс и геолокацию;
совместим с кодом Playwright;
подходит для каталогов, цен, объявлений и других открытых данных;
запускается локально и на сервере.

Простая установка:
pip install -U "camoufox[geoip]"
python -m camoufox fetch


▶️ Пример использования:
from camoufox.sync_api import Camoufox

with Camoufox(fingerprint_preset=True) as browser:
page = browser.new_page()
page.goto("https://example.com", wait_until="domcontentloaded")

title = page.locator("h1").first.text_content()
print(title)


Где пригодится:
🖱 сбор открытых данных с динамических сайтов;
🖱 мониторинг цен и ассортимента;
🖱 парсинг каталогов и объявлений;
🖱 SEO- и конкурентная аналитика;
🖱 автоматизация личных кабинетов;
🖱 браузерные ИИ-агенты;
🖱 тестирование собственных антибот-систем.

♎️ GitHub/Инструкция

😳 Лайф | 📲 Зеркало Max

#python #soft #github
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥38👍146🫡2🤯1
🛡 TLG_JoinCaptchaBot — щит от спама в телеграм чатах.

Если вы собираетесь администрировать Telegram-группу то самое время задуматься о защите от спам-ботов присоединяющихся к чату.

TLG_JoinCaptchaBot — мощный инструмент для защиты вашего TG сообщества с различными видами капчей.

🔍 Что делает бот?

➡️ При каждом новом участнике бот отправляет изображение с капчей.
➡️ Если пользователь не решает капчу в установленное время, он удаляется из группы.
➡️ Поддерживает настройку сложности капчи, времени на решение и других параметров.

❗️Особенности

🟢Полностью открытый исходный код под лицензией GPL-3.0.
🟢Легко настраивается и разворачивается на собственном сервере.
🟢Поддерживает множество языков и адаптирован для различных сценариев использования.

⚙️ Как начать?

1. Клонируйте репозиторий:

   git clone https://github.com/J-Rios/TLG_JoinCaptchaBot.git


2. Установите зависимости:

   pip install -r requirements.txt


3. Настройте переменные окружения и запустите бота.

⚠️ Почему это важно?

С ростом числа спам-ботов в Telegram, особенно в крупных группах, наличие надежной системы верификации становится критически важным. Подобные боты предоставляют простое и эффективное решение для этой проблемы.

5️⃣ GitHub/Инструкция

👇 Код готового бота

😳 Лайф | 📲 Зеркало Max

#python #soft #github
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥188👍7
💻 Model Trader — интересный проект для создания торговых ботов. Способен анализировать видео, статьи и посты трейдера, вытаскивает из них торговую стратегию и превращает её в алгоритм.

Например, можно загрузить несколько роликов трейдера с YouTube. Claude проанализирует их и подготовит два документы.

Что умеет:
💬 извлекает правила торговли с помощью Claude;
💬 превращает их в готовые торговые фильтры;
💬 прогоняет стратегию на истории;
💬 сканирует рынок в реальном времени;
💬 рассчитывает точки входа, стопы и цели;
💬 ведет журнал сделок и объясняет, почему каждая сделка была принята или отклонена.

▶️ Простой старт:
git clone https://github.com/tonbistudio/model-trader
cd model-trader
pip install -r requirements.txt

python -m pipeline.scaffold_trader my_trader


⬇️ Загрузка расшифровок:
python -m pipeline.fetch_youtube_transcripts \
traders/my_trader/transcripts VIDEO_ID


💀 И просим Claude собрать стратегию:
export ANTHROPIC_API_KEY=sk-ant-...

python -m pipeline.extract_strategy \
traders/my_trader/transcripts \
traders/my_trader


По сути, это конструктор, который помогает оцифровать опыт трейдера и проверить, работает ли его стратегия на практике.

♎️ GitHub/Инструкция

⚠️ По умолчанию работает в режиме paper trading — реальные сделки не открывает. Только для образовательных целей. Авторы софта не несут никакой ответственности за ваши действия.

😳 Лайф | 📲 Зеркало Max

#python #soft #github
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥24👍87
⚡️Крутая шпаргалка по Selenium на русском с примерами и объяснением кода!

Selenium — инструмент для автоматизации тестирования веб-приложений, который также широко используется для парсинга веб-страниц.

Позволяет автоматизировать взаимодействие с браузером, что делает его полезным для сбора данных с динамических сайтов, где контент генерируется с помощью JavaScript.

Selenium может имитировать действия пользователя, такие как клики, ввод текста, навигация по страницам, что позволяет обходить защиту от ботов и парсить сайты, требующие авторизации.


➡️ Работа с аргументами для настройки браузера.
➡️ Подробный разбор парсинга информации по элементам разными способами.
➡️ Перемещение по вкладкам.
➡️ Скрытый режим, полноэкранный, сворачивание окон и т.д.
➡️ Работа с cookie.
➡️ Взаимодействие с фреймами, всплывающими окнами.
➡️ Выполнение JavaScript в браузере и много всего интересного.

Часть шпаргалки:
python
# Создание объекта ChromeOptions для дополнительных настроек браузера
options_chrome = webdriver.ChromeOptions()
# Добавление аргумента '--headless' для запуска браузера в фоновом режиме
options_chrome.add_argument('--headless')
# отключает использование графического процессора для рендеринга, что может быть
полезным на машинах с проблемными или отсутствующими графическими драйверами
options_chrome.add_argument('--disable-gpu')
# если вам потребуется запустить браузер в режиме --headless и с расширениями(используются
для модификации поведения браузера)
options_chrome.add_argument('--headless=chrome')
options_chrome.add_extension('coordinates.crx')
# Перенос профиля пользователя из основного браузера Chrome в браузер, управляемый через
Selenium
options_chrome.add_argument('user-data-dir=C:\\Users\\user\\AppData\\Local\\Google\\Chrome\\User
Data')
# запрос через прокси
chrome_options.add_argument('--proxy-server=%s' % proxy)
# Запускает браузер без дополнительных мер безопасности
options.add_argument('--no-sandbox')
...


С тебя лойс
👍

#python #cheatsheet #doc
Please open Telegram to view this post
VIEW IN TELEGRAM
👍52🔥1
Шпаргалка_по_Selenium_на_русском.pdf
55.4 KB
🔥 Шпаргалка по Selenium на русском — бери и автоматизируй всё!

💻 Selenium — твой инструмент для управления браузером, парсинга и автоматизации: клики, ввод текста, авторизация, сбор данных с динамических сайтов.

Внутри:
💬 Настройка браузера.
💬 Поиск элементов разными способами.
💬 Работа с вкладками, cookie, фреймами.
💬 Запуск JavaScript прямо из Python и многое другое.

💾 Обязательно сохрани, пригодится!
Всё с примерами и пояснениями — открыл и работаешь!

Спасибо за поддержку! 👍

#python #cheatsheet #doc #soft
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🔥1