Источник КодХаб
6.3K subscribers
822 photos
81 videos
865 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
🔵 LLPlayer — видео-плеер с AI-субтитрами для языкового обучения

📌 Описание:
LLPlayer — это open-source плеер для Windows, созданный специально для тех, кто учит язык. Он отображает две дорожки субтитров одновременно и использует AI—Whisper от OpenAI для автоматической генерации текста и перевода в реальном времени.

🎯 Основные фишки:
🟢Двойные субтитры: показ двух языков сразу, с гибкими настройками размера и положения.
🟢AI-субтитры: Whisper (whisper.cpp или faster-whisper) понимает до 100 языков и работает на CUDA/Vulkan/OpenVINO для ускорения.
🟢Реальный перевод: перевод в 134 языках через Google, DeepL, Ollama, OpenAI, Claude с учетом контекста.
🟢OCR-тексты: распознаёт bitmap‑субтитры с помощью Tesseract или MS OCR.
🟢Поиск слов и панель субтитров: клик — и слово всплывает с переводом; можно искать внутри субтитров.
🟢Поддержка онлайн-видео: через yt-dlp плеер показывает видео с YouTube и сразу vчит субтитры/перевод.


⚙️ Технические детали:
🟢Написан на C#/WPF, открыт под GPL‑3.0.
🟢Бесплатный и работает локально — никакие серверы не лезут в твои субтитры.
🟢Версия 0.2.2 (май 2025) добавила поддержку LLM‑переводов (Qwen3, DeepSeek), интерфейсные улучшения и поиск по субтитрам.
🟢На VideoHelp плеер хвалят как нишевый и ценный инструмент для изучения языков.


🔗 Попробовать: LLPlayer
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🔥21
Genspark AI — ИИ-агент для автопродакшна видео на русском языке

Genspark AI теперь умеет монтировать видео по запросу — и поддерживает русский язык. Бесплатная версия даёт до 100 кредитов в день (обычно хватает на один ролик), а для продвинутых задач доступны платные подписки от $25 в месяц.

Что умеет Genspark в плане видео:
обрабатывает видео дольше часа или сразу несколько трансляций (например, спортивные матчи),
выбирает ключевые моменты и автоматически генерирует монтаж,
создаёт расшифровку и накладывает субтитры (включая на русском, английском, японском),
находит и вырезает нужный фрагмент по текстовому запросу без таймкодов,
позволяет сэкономить часы рутины — в примере из интервью с Сэмом Альтманом сделал 10-минутную выжимку за пару минут.


Genspark Super Agent — это целая экосистема нейронных сетей (включая ChatGPT, DeepSeek, Kling и другие) под капотом, которая умеет длину видео анализировать, фрагменты монтировать и субтитры генерировать автоматически.

📎 Попробовать: Genspark AI
🔥2
🔵 OpenHands — платформа для AI-ассистентов, которые кодят вместо вас
OpenHands (ранее OpenDevin) — open-source фреймворк, который превращает LLM-модель в полноценного AI-инженера: редактирует код, запускает команды, работает с вебом и API, берёт примеры с StackOverflow. Всё — локально, конфиденциально и бесплатно.

📌 Почему это может быть интересно:
- Автономные агенты: могут модифицировать репозиторий, выполнять terminal-команды, браузить документацию и вызывать API.
- Быстрый старт: запускается через Docker за пару команд или работает headless в CLI режиме.
- Работает с любыми LLM: Claude 3.5 Sonnet, OpenAI GPT, Mistral и др. работают превосходно в тандеме с OpenHands.


⚙️ Техническая мощность и производительность:
- Результаты benchmark’ов: агент OpenHands CodeAct 2.1 закрывает более 50 % задач на SWE‑Bench и 41,7 % на SWE‑Bench Lite.
- OpenHands‑Versa — универсальный агент для code-editing, web browsing и multi-modal задач, улучшает результаты SWE‑Bench Multimodal и GAIA на 9+ баллов.


⁉️ Ограничения и нюансы:
- Некоторые пользователи сообщают о сложностях с установкой через Docker и проблемах с повторением операций при сложных проектах (agents могут застревать в loop'ах).
- Лучше подходит для небольших и средних репозиториев — на больших проектах возможны сбои и контекстные ограничения.


🔗 Попробовать: OpenHands
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥1
🔥 DeepL Agent — универсальный корпоративный AI, который понимает и действует

📌 DeepL Agent — это автономный AI-помощник от DeepL, который умеет взаимодействовать с вашими приложениями, анализировать данные, создавать таблицы, отправлять письма и локализовать продукты — и всё это по обычным текстовым инструкциям. Он фактически управляет компьютером как вы: печатает, кликает и работает через браузер и мышь.

📌 Благодаря опыту DeepL в задачах переводов и обработке языка, новый агент сочетает в себе точность, безопасность и гибкость. Он уже проходит закрытое бета-тестирование для избранных корпоративных клиентов, а полноценный запуск ожидается в ближайшие месяцы по подписке.

🔢 Главные фичи:
🟢Автоматизация рутинных бизнес-задач (финансы, маркетинг, локализация, поддержка и др.) повышает продуктивность и освобождает время для важных решений
🟢Встроенные механизмы безопасности: контроль над действиями, возможность остановки в любой момент и человек в цикле (human-in-the-loop) обеспечивают надёжность и прозрачность


🔗 Попробовать: DeepL Agent
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2
🖥 ClickUpгибкая и масштабируемая платформа для управления проектами

ℹ️ ClickUp объединяет задачи, чаты, доски, документы и таблицы в одном рабочем пространстве, обеспечивая высокую кастомизацию под разные сценарии. Особенно полезны настраиваемые представления и автоматизация — выстраиваете процессы, где каждый шаг работает сам.

🔍 ИИ-ассистент платформы (ClickUp Brain) помогает планировать проекты без лишних усилий: он генерирует повестки, автоматом превращает встречи в задачи и заметки, создаёт планы и резюме на основе входящих данных. Очень удобно, когда нужно быстро подготовить обзоры или отчёты после совещания.

🛒 ClickUp предлагает бесплатный план, достаточный для старта — с неограниченным числом пользователей и базовыми инструментами. Для расширенной работы доступен Unlimited-план от ~$10 в месяц за пользователя (около $10 при помесячной оплате или $7 при годовой подписке), подойдёт для небольших команд.

🔗 Подробнее: ClickUp
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2
🌐 Mirage: Новый стандарт в AI-коротких видео

📌 Mirage — это не просто ребрендинг платформы Captions. Это обновлённый стартап, переориентированный на создание фундаментальных multimodal AI-моделей для вертикальных видео: TikTok, Reels и Shorts. Компания привлекла более $100 млн инвестиций и оценивается в $500 млн — значительный шаг за рамки обычных инструментов для авторов контента.

ℹ️ Что умеет Mirage Studio?
🟢Автоматическая генерация видео из аудио: отправляете аудиофайл или текст, AI создаёт полноценный ролик — включая аватары, фон и мимику. Можно загрузить селфи и получить видео с собственным виртуальным "я", без использования актёров или стоков.
🟢Платформа позиционируется как лидер среди разработчиков AI-решений, не полагаясь на voice-cloning, lip-sync или шаблонные материалы. Mirage генерирует всё с нуля, делая процесс максимально оригинальным и масштабируемым.


🧑‍💻 Mirage понимает, что реалистичные AI-видео несут риск deepfake. Компания уже внедрила технологические меры — модерацию, защиту от несанкционированного использования чужих лиц и требует согласия, где это необходимо. Mirage более того, призывает к развитию медиаграмотности наряду с технологиями.

🔗 Попробовать: Mirage
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥21
🔥 Midjourney запускает Style Explorer V1 — визуальный браузер стилей в прямом эфире

📌 Midjourney представил Style Explorer V1, инновацию, которая меняет способ работы с визуальным стилем. Это интерактивный инструмент в веб-интерфейсе Explore → Styles, где вы можете:
🟢Просматривать галерею миниатюр — каждый показывает результат вашего промта с уникальным кодом стиля (sref).
🟢Наводите курсор — сразу видите, как каждый стиль изменит ваш изображение.
🟢С помощью кнопки "Try Style" единственным кликом применяете стиль к вашему текущему промту.
🟢Сохраняйте понравившиеся стили в избранное — удобно возвращаться к любимым эффектам.
🟢Воспользуйтесь fuzzy-поиском: вбейте «photographic» или «anime», и инструмент сам найдёт подходящий стиль.


📌 Style Explorer V1 — это как музыкальный плеер, но для визуального вайба: листаете, пробуете, сохраняете, а не записываете коды вручную. Отличный способ исследовать мир визуальных настроек Midjourney.

🔗 Попробовать: Style Explorer V1
Please open Telegram to view this post
VIEW IN TELEGRAM
🌐 Alibaba представила Qwen3-Max-Preview (Instruct): флагман с триллионом параметров

📌 Qwen3-Max-Preview — это крупнейшая на сегодня языковая модель от Alibaba с более чем триллионом параметров. Она появилась 5 сентября 2025 года и теперь доступна через веб-чата Qwen, API Alibaba Cloud, OpenRouter и AnyCoder на Hugging Face.

📌 Модель выделяется выдающейся производительностью. Внутренние бенчмарки показывают, что Qwen3-Max-Preview превосходит предыдущую топ-модель Qwen3-235B и конкурирует наравне с лучшими на рынке: Claude Opus 4 и DeepSeek-V3.1 по таким задачам, как программирование, решение математических задач и логика.

📌 Кроме того, Qwen3-Max-Preview поддерживает гигантский контекст — до 262 144 токенов — что позволяет обрабатывать широкие документы и коды без потери контекста.

🔗 Попробовать: Qwen3-Max-Preview (Instruct)
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
🌐 Daisy — единое окно для всех топовых LLM

📌 Daisy — это не просто чат-бот, а полноценный AI-сервис, который объединяет в одном интерфейсе разные языковые модели и мультимодальные инструменты. Пользователь видит привычный чат, но внутри работает сложная архитектура: модели подключаются по задаче, есть маршрутизация запросов, модуль распознавания документов, генерации изображений и семантического поиска.

📌 Основная фишка — можно работать с GPT, Claude, Gemini, Grok, DeepSeek и другими, в одном окне, без переключения между сервисами. Например, собрать план статьи с одной моделью, подтянуть фактуру через поиск с другой, затем вызвать генерацию кода, картинки и подзакрыть всё вторым промтом — всё в одном диалоге.

📌 Под капотом Daisy — связка маршрутизатора запросов, собственного контент-фильтра, модулей авторизации и тарификации, и логики fallback-планов: если нужно — запрос уходит на другую модель или на внутреннюю ручную обработку. Такой подход позволяет строить сложные AI-пайплайны в одном UI и гибко масштабировать под любые сценарии.

🔗 Попробовать: Daisy
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍2
💻 Apertus — швейцарский open-source LLM

ℹ️ Apertus — это полностью открытая языковая модель, разработанная EPFL, ETH Zurich и Швейцарским национальным суперкомпьютерным центром (CSCS) в рамках Swiss AI Initiative. Название с латиницы переводится как «открытый» — и модель оправдывает своё имя: полностью прозрачная архитектура, данные и рецепты обучения доступны сообществу.

🧑‍💻 Apertus выпускается в двух вариантах: небольшой (8 B параметров) для локального или исследовательского использования, и крупной (70 B) — для коммерческих приложений и систем. Обучена на 15 трлн токенов данных, поддерживает более 1 800 языков, включая мало представленные: швейцарский диалект немецкого, ратороманский и др.

🖥 Модель ориентирована на прозрачность и доверие: при её обучении соблюдались правила GDPR, швейцарского авторского права и EU AI Act. Использовались только данные из публичного домена и сайты, которые явно не возражали против включения в тренинг (opt-out).

ℹ️ Попробовать: Apertus
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍2
🔵 Recon AI — инструмент от Protect AI для автоматического red teaming LLM-систем. Использует более 450 сценариев атак (jailbreak, prompt injection и др.) для тестирования безопасности AI-приложений. Поддерживает кастомные атаки, экспортирует отчёты (CSV, JSON) и интегрируется с OWASP LLM, CVSS и другими стандартами.

🎯 Особенности:
🟢450+ встроенных атак (prompt injection, jailbreak и др.)
🟢Поддержка кастомных payload’ов
🟢Экспорт отчётов (JSON, CSV)
🟢Интеграция с OWASP LLM и CVSS


⚙️ Архитектура и параметры:
🟢AI-агент с движком атак
🟢Работает через CLI и API
🟢Контекстное и семантическое тестирование
🟢Поддерживает ручной и автоматический режим


👍 Преимущества:
🟢Ускоряет поиск уязвимостей
🟢Интегрируется в DevSecOps
🟢Гибкий, настраиваемый подход


🔗 Попробовать: Recon AI
Please open Telegram to view this post
VIEW IN TELEGRAM
2
🌐 Droplet3D — генерация 3D из видео и текста

ℹ️ Droplet3D — новый генеративный 3D-модельный фреймворк, который учится на огромном видео-датасете Droplet3D-4M с четырьмя миллионами 3D-объектов и плотными текстовыми описаниями вида под разными углами. Суть идеи: использовать видео как источник пространственной информации и "commonsense priors" — движения камер и объектов дают естественные ориенти­ры для создания реалистичных 3D-форм.

📌 Модель поддерживает вход как в виде текста, так и в виде изображения, выравнивает перспективу входного вида, генерирует мультивью siri surround-view изображения (85 кадров 360°) и из этого строит либо Gaussian splatting 3D-сцену, либо текстурированную сетку — всё в open-source.

🔗 Все компоненты открыты: датасет, код, архитектура и веса модели доступны на Hugging Face, GitHub и сайте проекта.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
🌐 EmbeddingGemma — компактная многоязыковая модель поиска от Google

ℹ️ EmbeddingGemma — новая легковесная модель текстовых эмбеддингов от Google DeepMind и Gemma 3, рассчитанная на работу прямо на ноутбуке или смартфоне без облака.
Она содержит около 308 миллионов параметров и поддерживает более 100 языков.

📌 Главная фишка — Matryoshka Representation Learning: модель может выдавать векторы разного размера (от 128 до 768 измерений) в зависимости от задачи и ресурсов устройства, без необходимости переобучения.

📌 Это позволяет балансировать скорость, точность и использование памяти, делая EmbeddingGemma универсальным инструментом для локального поиска, RAG-пайплайнов и кластеризации текстов.
Google также подчёркивает, что модель работает быстро (генерация эмбеддингов менее чем за 22 мс на EdgeTPU) и требует меньше 200 МБ RAM благодаря квантованию.

📌 При этом по эффективности в задачах поиска и семантического сходства EmbeddingGemma демонстрирует лучшие показатели среди всех моделей до 500M параметров.

🔗 Попробовать: EmbeddingGemma
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1🔥1
🔵 BackAnt — AI-сервис, который по описанию задачи на естественном языке генерирует полноценный REST API: включая код, базу данных, документацию и тесты. Можно сразу развернуть или скачать исходники.

🎯 Особенности:
🟢Генерация backend за 1–2 минуты
🟢Чистый, читаемый код
🟢Поддержка Swagger, тестов и миграций
🟢Визуальный редактор запросов
🟢Экспорт и деплой в один клик


⚙️ Архитектура и параметры:
🟢Язык: Node.js (Express)
🟢База данных: PostgreSQL
🟢Авторизация: JWT
🟢Формат API: REST + JSON
🟢Выход: исходники и документация


👍 Преимущества:
🟢Ускоряет MVP и прототипы
🟢Не требует глубоких знаний backend
🟢Нет vendor-lock, можно развернуть на любом сервере
🟢Поддержка кастомной логики через promt-инструкции


🔗 Попробовать: BackAnt
Please open Telegram to view this post
VIEW IN TELEGRAM
🌐 Jules

Что такое Jules?
Jules — AI-ассистент от Google для автоматизации задач в GitHub: исправление багов, обновление зависимостей, создание pull-запросов.

📌 Основные возможности
⭐️Автономный анализ и изменение кода
⭐️Интеграция с GitHub
⭐️Поддержка Python и JavaScript

⚙️ Примеры использования
⭐️Автообновление библиотек
⭐️Рефакторинг кода
⭐️Автосоздание pull-запросов

👀 Кому подойдёт
⭐️Разработчикам и командам
⭐️Менеджерам проектов
⭐️Обучающимся программированию

📎 Подробнее: Jules
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥1
🌐 BitNet b1.58 2B4T — первая в мире открытая 1-битная LLM на 2 млрд параметров

📌 BitNet b1.58 2B4T — это новая модель Microsoft Research, где веса обучаются изначально в тернарной форме (−1, 0, +1), то есть фактически занимают 1.58 бита. Она была обучена на 4 триллионах токенов и показывает сопоставимую с полноточечными моделями эффективность, но с впечатляюще малыми затратами памяти, энергии и времени вывода.

📌 Главное преимущество BitNet — её экстремальная компактность и производительность. Внедрена quantized архитектура BitLinear, активации в 8-битах, и специальная реализация bitnet.cpp, которая позволяет очень быстро запускать модель на CPU и устройствах с низкими ресурсами. По оценкам, модель занимает всего около 0.4 ГБ в памяти и работает быстрее и экономичнее аналогов из-за низкоточных весов.

📌 Модель находится в открытом доступе на Hugging Face (microsoft/bitnet-b1.58-2B-4T), и её можно запускать через bitnet.cpp или библиотеку transformers, хотя в последней полная эффективность quantization ещё не реализована.

🔗 Попробовать: BitNet b1.58 2B4T
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥4👍2
🔥 Baidu представила ERNIE X1.1 и ERNIE 4.5-21B-A3B-Thinking

ℹ️ ERNIE X1.1 — усиленная версия reasoning-модели, которая по фактам (factual accuracy) стала сильнее на 34.8 %, а по следованию инструкциям — на 12.5 % по сравнению с ERNIE X1.

🧑‍💻 Baidu утверждает, что X1.1 обходит DeepSeek R1-0528 и в ряде задач почти достигает уровня GPT-5 и Gemini 2.5 Pro. Модель доступна через ERNIE Bot, Wenxiaoyan и на платформе MaaS от Baidu AI Cloud.

🖥 ERNIE 4.5-21B-A3B-Thinking — это стратегически компактная MoE-модель: общая архитектура 21 млрд параметров, но активируется всего 3 млрд параметров на токен, что повышает эффективность использования ресурсов. Она поддерживает чрезвычайно длинный контекст — до 128К токенов, интегрирована с инструментами (tool usage) и лицензирована под Apache-2.0, что делает её подходящим вариантом как для исследований, так и коммерческого применения.

🔗 Попробовать:
Модель ERNIE 4.5-21B доступна на Hugging Face
Попробовать X1.1 можно на сайте бота от Baidu
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍1🔥1
⚡️ Hailuo AI — 7-дневный безлимит на Start/End Frames

ℹ️ Hailuo запустил новую акцию: целую неделю можно генерировать видео с неограниченным контролем начального и конечного кадров (Start/End Frames) — то есть буквально «рискуйте»: задавайте движение, композицию и переходы, сколько хотите. Такая опция даёт полный творческий контроль над тем, как кадр начинается и заканчивается, что особенно круто для сторителлинга и визуальной динамики.

🖥 Веб-интерфейс Hailuo прост — на сайте можно зайти в раздел генерации видео, выбрать Start/End Frame, загрузить изображение-референс или просто ввести текстовый промт, и система сама построит анимацию, начиная и заканчивая там, где вы хотите. Пользователи отмечают, что можно делать кинематографичные ролики без огромных вычислительных мощностей.

🧑‍💻 Акция проходит в рамках челленджа: помимо бесплатного доступа Hailuo предлагает призы и подписки участникам, которые делают интересный визуальный контент. Отличная возможность протестировать Start/End фреймы на практике — и, если понравится, потом можно подумать о подписке или использовать продвинутые модели от Hailuo.

🔗 Попробовать: Hailuo AI
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥1👨‍💻1
📸 Seedream 4.0 — новый уровень AI-картинок от ByteDance

📌 Seedream 4.0 — это объединённый движок генерации и редактирования изображений, разработанный в ByteDance Seed. Он умеет работать с текстовыми промптами, загруженными референсами и правками по описанию, всё в одной модели.

📌 Модель поддерживает разрешения до 4K (4096×4096 пикселей), работает очень быстро и конкурентоспособна с Google-моделями вроде Nano Banana по внутренним оценкам ByteDance. Также она умеет парой фраз удалить или добавить объект, изменить фон или цвет, перестроить композицию — в тихом режиме prompt-based editing.

📌 Seedream 4.0 доступен на Higgsfield.ai — в разделе advanced image editing (можно выбрать Seedream как движок). Также её можно запустить через Fal.ai или на Imagine.Art в разделе multi-modal generation.

🔗 Попробовать: Seedream 4.0
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🎨 Reve Image 1.0: когда AI понимает ваши промты

📌 Reve Image (кодовое имя Halfmoon) — это новая генеративная модель с большим акцентом на точное выполнение промтов, эстетическое качество и работу с текстом внутри картинки. Модель обучена с нуля и предназначена для авторов, дизайнеров и тех, кто хочет создавать визуальный контент без “гаданий” и лишнего хаоса в выдаче.

📌 Первые отзывы крайне позитивные: Reve хвалят за реалистичную анатомию, особенно руки и жесты, стабильную цветопередачу и способность создавать читаемый текст (логотипы, стикеры, подписи) прямо на изображении. Пользователи отмечают, что запускать Reve намного проще, чем Midjourney или Flux, и что она быстрее “догоняет” задумку без десятков уточнений.

Reve доступна в бесплатной preview-версии.

🔗 Попробовать: Reve Image 1.0
Please open Telegram to view this post
VIEW IN TELEGRAM