Источник КодХаб
6.3K subscribers
821 photos
80 videos
863 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
📢 MiMo-Audio — новая речь от Xiaomi в мире LLM

📌 Xiaomi представила MiMo-Audio — продвинутую модель для генерации и понимания речи. Она обучена на колоссальном датасете — более 100 миллионов часов аудио, что позволило ей научиться обрабатывать голосовые запросы максимально точно и гибко. В основе лежит уникальная схема токенизации, которая делает работу модели более быстрой и экономной.

📌 Обучение MiMo-Audio проходит в два этапа: сначала модель занимается реконструкцией звука, а затем — генерацией речи. Такой подход обеспечивает естественное звучание и высокую разборчивость аудио, что выводит её в один ряд с топовыми системами. В бенчмарках Xiaomi отмечает, что MiMo-Audio показывает результаты, сопоставимые с Gemini 2.5 Flash от Google, что делает её одним из самых сильных игроков в сегменте speech-to-speech и speech-to-text моделей.

🖥 Модель уже доступна исследователям и разработчикам: исходники и веса можно найти на GitHub и HuggingFace. Это открывает простор для экспериментов — от голосовых ассистентов до систем генерации аудио-контента нового поколения.

🔗 Попробовать: MiMo-Audio
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1🤔1
🖥 Dreamina AI — генератор фото и видео от ByteDance для соцсетей и контентмейкеров

📌 Dreamina AI — это встроенный в экосистему CapCut инструмент от ByteDance, который позволяет превращать текстовые описания или картинки в изображения, короткие видеоролики и анимации.

📌 Модель ориентирована на быструю генерацию визуального контента: картинок для постов, обложек, превью, анимаций и коротких клипов — всё, что может пригодиться для Reels, TikTok, сторис и прочих форматов.

ℹ️ Кроме генерации с нуля, Dreamina даёт инструменты для редактирования: апскейл, улучшение качества, встройку изображений в видео, анимацию фото, подкрутку ракурсов и световых эффектов.

🔗 Попробовать: Dreamina AI
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
🖥 GigaChat 3 — открытая мощная LLM-семейство под MIT-лицензией

📌 GigaChat 3 — набор моделей, которые выпущены с открытым исходным кодом и разрешением коммерческого использования. В релиз вошли две ключевые версии:
🟢GigaChat 3 Ultra Preview — флагманская MoE-модель (~702 млрд параметров, с ~36 млрд активных на токен), обученная с нуля, с поддержкой длинного контекста (~131k токенов).
🟢GigaChat 3 Lightning — более лёгкая, компактная и быстрая модель, подходящая для локального запуска, чат-ботов и высоконагруженных задач.


📌 Что даёт GigaChat 3 для разработчиков и исследователей:
🟢Благодаря лицензии MIT и открытым весам — можно запускать модели локально, дообучать их под свои задачи, интегрировать в свои продукты, не покупая подписки.
🟢Архитектура MoE + специфические оптимизации (включая MLA и MTP) делают возможным эффективный инференс даже при огромном размере модели — это реально большой шаг для LLM-экосистемы с открытым кодом.
🟢Универсальность: модели уместны как для генерации текста, так и для кода, математических задач, анализа больших документов, мультиязычных задач и пр.


🔗 Попробовать: GigaChat 3
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21🔥1
🖥 DeepSeek-Math-V2 — ИИ, который реально решает серьёзную математику

📌 DeepSeek-Math-V2 — новая открытая модель от DeepSeek, с уклоном под задачи математического рассуждения и доказательств.

📌 Главная фишка — схема генератор + верификатор: сначала модель предлагает решение, потом сама проверяет каждый шаг, исправляя ошибки до 16 раз. Это даёт не просто ответ, а проверяемое, логически выстроенное доказательство.

ℹ️ Результаты впечатляют: золото на International Mathematical Olympiad (IMO 2025), высокие баллы на других престижных соревнованиях и приличные показатели на математических бенчмарках.

🔗 Попробовать: DeepSeek-Math-V2
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥21
🌐 Droplet3D — генерация 3D из видео и текста

ℹ️ Droplet3D — новый генеративный 3D-модельный фреймворк, который учится на огромном видео-датасете Droplet3D-4M с четырьмя миллионами 3D-объектов и плотными текстовыми описаниями вида под разными углами. Суть идеи: использовать видео как источник пространственной информации и "commonsense priors" — движения камер и объектов дают естественные ориенти­ры для создания реалистичных 3D-форм.

📌 Модель поддерживает вход как в виде текста, так и в виде изображения, выравнивает перспективу входного вида, генерирует мультивью siri surround-view изображения (85 кадров 360°) и из этого строит либо Gaussian splatting 3D-сцену, либо текстурированную сетку — всё в open-source.

🔗 Все компоненты открыты: датасет, код, архитектура и веса модели доступны на Hugging Face, GitHub и сайте проекта.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
⚡️ VARCO-VISION-2.0-1.7B — легкая мультимодальная модель от NCSOFT

📌 Модель VARCO-VISION-2.0-1.7B — это облегчённая версия флагманской системы NCSOFT, нацеленная на задачи визуального понимания и текстового взаимодействия. Она способна обрабатывать несколько изображений одновременно, извлекать текст с их пространственными границами (layout-aware OCR) и отвечать на вопросы по визуальному контенту, при этом оставаясь компактной и пригодной для запусков на устройствах с ограниченными ресурсами.

📌 Одним из ключевых усилений VARCO-VISION-2.0 по сравнению с предыдущей версией является улучшенное понимание корейского языка и культурного контекста, более точная генерация текстов и расширенная способность работать с многокадровыми и комплексными изображениями, такими как схемы, таблицы и макеты. Также реализована оптимизация, благодаря которой модель может работать на локальных устройствах — это делает её пригодной не только для облака, но и для приложений с ограниченными ресурсами.

🔗 Попробовать: VARCO-VISION-2.0-1.7B
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3
🔍 NotebookLM обновился — Deep Research и графика теперь в одном инструменте

📌 NotebookLM получил масштабное обновление: теперь появляется режим Deep Research, который способен самостоятельно собирать информацию из множества источников (веб-сайты, документы, таблицы, PDF и др.), анализировать её и формировать структурированные отчёты.

📌 Помимо этого, в NotebookLM встроена графическая нейросеть Nano Banana Pro — она позволяет быстро превращать полученные данные в визуальные материалы: инфографику, слайды, стильные иллюстрации или схемы, прямо внутри инструмента.

ℹ️ Теперь один инструмент покрывает весь цикл: от поиска и сбора информации, до её визуализации и упаковки в готовую презентацию.

🔗 Попробовать: NotebookLM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍43
😎 Kira.art — ИИ-редактор изображений

📌 Kira.art — веб-сервис, который позволяет работать с изображениями через обычный чат: загружаете картинку, описываете, что хотите изменить (фоны, цвета, объекты, стиль) — и нейросеть делает всё сама, без слоёв, кистей и сложных инструментов.

📌 Он предлагает функции вроде удаления/смены фона, удаления или добавления объектов, стилизации (арт-стиль, аниме, ретро и др.), а также апскейлинга — повышение качества изображения, устранение шума и чёткости, чтобы результат выглядел аккуратно.

ℹ️ Главное преимущество Kira.art — простота и скорость. Неважно, новичок вы или опытный дизайнер: не нужно изучать Photoshop; достаточно написать в чат «сделай фон морем» или «убери человека из кадра» — и получить изображение под цель, будь то соцсети, портфолио или просто арт.

🔗 Попробовать: Kira.art
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍3🔥2
🎧 Image to Music AI — превращаем картинку в мелодию одним кликом

📌 Image to Music V2 — бесплатный онлайн-инструмент, который анализирует загруженное изображение и генерирует музыку, подходящую по настроению, цветам и атмосфере картинки.

📌 Загружаете фото — ИИ распознаёт визуальные паттерны (цвет, свет, объекты, общую атмосферу) и на их основе создаёт аудиотрек. Это может быть фоновая музыка, эмбиент, атмосферный трек — всё под изображение.

ℹ️ Особенно удобно для креативщиков, видео-клипов, сторис или просто для музыкальных открыток.

🔗 Попробовать: Image to Music AI
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥32🤯2
🎨 Weavy — бесконечный холст для создания сложных AI-воркфлоу

📌 Weavy предлагает бесконечную холст-среду, где каждый шаг творческого процесса превращается в узел: загрузите промт – получите изображение; на его основе генерируйте текстуру и фон; затем превратите результат в 3D-модель и анимируйте. Всё это — в едином интерфейсе с возможностью ветвления и управления процессом.

📌 Платформа использует нод-ориентированную структуру: от каждого узла можно ответвить отдельный путь, изменить направление, подключить новую модель — например, AI-генератор изображений, 3D-анимацию или видео-эффекты. Weavy интегрирует топ-AI-модели вроде Veo 3, Imagen 3 и Stable Diffusion 3.5 и позволяет комбинировать их в одном сессии.

ℹ️ Weavy недавно был приобретён Figma и станет частью её экосистемы под именем Figma Weave — что указывает на стратегию использования инструментов объединения AI-моделей и дизайн-редакторов в одном интерфейсе.

🔗 Попробовать: Weavy
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🐟 Fish Audio S1 — TTS для видео, подкастов и озвучки

📌 Fish Audio S1 — нейросеть, которая превращает текст в речь с реалистичным голосом, позволяя клонировать голоса, добавлять эмоции и озвучивать ролики, книги, подкасты или любые другие медиа.

📌 Система поддерживает десятки языков — английский, китайский, японский, корейский и др. — и умеет озвучивать на любом из них, сохраняя естественность и интонацию.

ℹ️ Бесплатный старт: можно получить час озвучки и попробовать функцию клонирования голоса без подписки. При желании доступны премиум-настройки: управление эмоциональностью, тембром, паузами, скоростью речи — всё, чтобы итог звучал максимально профессионально.

🔗 Попробовать: Fish Audio S1
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥1🤔1
⭐️ Runable — универсальный ИИ-агент для любых задач

📌 Runable — это AI-агент, который может взять на себя массу рутинной и творческой работы: от создания сайтов и презентаций до автоматизации документов, медиапроектов и рабочих процессов.

📌 Он анализирует ваш запрос и сам выбирает подходящие модели и инструменты — будь то генерация изображений, видео, текста, лендингов, отчётов, подкастов и пр. То есть вместо переключения между десятком сервисов — достаточно одного интерфейса.

ℹ️ Runable поддерживает интеграции с популярными приложениями и может автоматизировать повторяющиеся задачи: от рассылок и обработки данных до создания контента и сборки отчетов.

🔗 Попробовать: Runable
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🖥 ClickUpгибкая и масштабируемая платформа для управления проектами

ℹ️ ClickUp объединяет задачи, чаты, доски, документы и таблицы в одном рабочем пространстве, обеспечивая высокую кастомизацию под разные сценарии. Особенно полезны настраиваемые представления и автоматизация — выстраиваете процессы, где каждый шаг работает сам.

🔍 ИИ-ассистент платформы (ClickUp Brain) помогает планировать проекты без лишних усилий: он генерирует повестки, автоматом превращает встречи в задачи и заметки, создаёт планы и резюме на основе входящих данных. Очень удобно, когда нужно быстро подготовить обзоры или отчёты после совещания.

🛒 ClickUp предлагает бесплатный план, достаточный для старта — с неограниченным числом пользователей и базовыми инструментами. Для расширенной работы доступен Unlimited-план от ~$10 в месяц за пользователя (около $10 при помесячной оплате или $7 при годовой подписке), подойдёт для небольших команд.

🔗 Подробнее: ClickUp
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥21
🔥 DeepL Agent — универсальный корпоративный AI, который понимает и действует

📌 DeepL Agent — это автономный AI-помощник от DeepL, который умеет взаимодействовать с вашими приложениями, анализировать данные, создавать таблицы, отправлять письма и локализовать продукты — и всё это по обычным текстовым инструкциям. Он фактически управляет компьютером как вы: печатает, кликает и работает через браузер и мышь.

📌 Благодаря опыту DeepL в задачах переводов и обработке языка, новый агент сочетает в себе точность, безопасность и гибкость. Он уже проходит закрытое бета-тестирование для избранных корпоративных клиентов, а полноценный запуск ожидается в ближайшие месяцы по подписке.

🔢 Главные фичи:
🟢Автоматизация рутинных бизнес-задач (финансы, маркетинг, локализация, поддержка и др.) повышает продуктивность и освобождает время для важных решений
🟢Встроенные механизмы безопасности: контроль над действиями, возможность остановки в любой момент и человек в цикле (human-in-the-loop) обеспечивают надёжность и прозрачность


🔗 Попробовать: DeepL Agent
Please open Telegram to view this post
VIEW IN TELEGRAM
4
⚡️ Kling O1 — нейросеть для видео: от генерации до продакшна

📌 Kling O1 — мультимодальный ИИ-генератор от Kuaishou, который умеет создавать и редактировать видео, изображения и анимации на базе текста, фото или видео-референсов.

📌 Модель даёт полный контроль: можно превратить текстовое описание в 1080p-видео, а можно загрузить картинку — и получить живую анимацию. Также поддерживаются многореференсная генерация (до 10 изображений), стилизация, консистентность персонажей/объектов между сценами, смена ракурсов и даже редактирование существующего видео (добавление/удаление объектов, замена фона, изменение освещения).

ℹ️ Kling O1 подходит для самых разных задач: от социальных сетей и рекла­мы до визуальных концептов, сторибордов, коротких клипов и прототипов. Вся цепочка: генерация, правка, экспорт — может пройти через один инструмент, без затратного VFX-процесса.

🔗 Попробовать: Kling O1
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2
🔓 Petri от Anthropic: инструмент для проверки безопасности ИИ

📌 Anthropic представила Petri — новый инструмент, который позволяет быстро тестировать модели искусственного интеллекта на безопасность. Раньше подобная проверка занимала недели, теперь Petri справляется за минуты, прогоняя тысячи сценариев и анализируя поведение моделей в реальном времени.

📌 Petri симулирует диалоги с ИИ, проверяя, как он реагирует на сложные, провокационные или потенциально опасные запросы. Встроенный «судья» оценивает ответы и выявляет рискованные реакции: попытки обмана, склонность угождать ценой правды, стремление к контролю или выполнение вредных инструкций. В тестах Petri проверил 14 моделей — включая GPT-5 и Claude 4.5. Все показали уязвимости, но Claude оказался немного безопаснее конкурентов.

ℹ️ Petri уже доступен бесплатно на GitHub и активно используется исследователями для улучшения безопасности ИИ. Это важный шаг в сторону создания более надежных систем — где сами ИИ помогают находить слабые места других моделей.

🔗 Попробовать: Petri
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
🖥 Seedream 4.5 — новый ИИ-фотошоп от ByteDance

📌 Seedream 4.5, свежий релиз от ByteDance, представляет серьёзный шаг вперёд: модель обещает стабильность, консистентность и качество, необходимое для профессионального дизайна, постеров, макетов и брендовых визуалов.

📌 Главные плюсы: Seedream 4.5 удерживает лицо, стиль, освещение и детали персонажей/объектов при мульти-изображениях — что раньше было слабым местом у многих ИИ-генераторов. Модель умеет работать и с текстом: шрифты, оформление, верная типографика — это даёт преимущество при создании баннеров, плакатов, UI-макетов.

ℹ️ А ещё Seedream 4.5 даёт гибкость: генерация по тексту, редактирование фото, мульти-референсы, точный контроль композиции, свет, стили и даже 4K-разрешение — всё это делает её актуальным инструментом для дизайнеров, маркетологов, контент-разработчиков и брендов, которые хотят готовый визуал без долгих доработок.

🔗 Попробовать: Seedream 4.5
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2
⭐️ VibeVoice-Realtime-0.5B — лёгкий и быстрый TTS-агент от Microsoft

📌 VibeVoice-Realtime-0.5B — открытая модель синтеза речи (TTS), способная преобразовывать текст в речь практически мгновенно — первая слышимая фраза появляется примерно за 0.3 секунды после запуска.

📌 Модель весит всего ~0.5 млрд параметров, что делает её лёгкой и удобной для локального запуска даже на слабых видеокартах. При этом она создаёт вполне естественную речь — с плавной артикуляцией, тянущейся генерацией, и работает в режиме стриминга: текст можно подавать потоком, и голос проговорит его без значительных задержек.

ℹ️ Сейчас VibeVoice-Realtime поддерживает только английский язык; у неё нет клонирования голоса и возможности множественных спикеров — это базовая версия для тех, кто ценит скорость и простоту. Тем не менее её идея — дать быстрый TTS с минимальными ресурсами — может быть полезна для озвучки чатов, ботов, коротких роликов, скриптов и других задач, где важна оперативность.

🔗 Попробовать: VibeVoice-Realtime-0.5B
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1🔥1
🖥 Kling 2.6 — AI-генератор видео со встроенным звуком

📌 Kling 2.6, выпущенный компанией Kuaishou (разработчик Kling AI), стал первой моделью, которая генерирует видео и аудио одновременно — диалоги, звуки, окружение, эффекты — всё из одного промпта.

📌 Видео создаётся в формате 1080p, длительностью примерно 5–10 секунд, с полной синхронизацией — губы персонажей совпадают с речью, окружающие звуки, музыка, шумы и эффекты автоматически подгоняются под сцену.

ℹ️ Kling 2.6 работает как в режиме "текст в видео", так и в режиме "картинка в видео" — можно начать с описания сцены или загруженного изображения, указать, что должно звучать, добавить эмоции, окружение, эффекты — и получить готовый клип без монтажа, озвучки и редактирования.

🔗 Попробовать: Kling 2.6
Please open Telegram to view this post
VIEW IN TELEGRAM
3
🤖 LMArena — площадка для сравнения и оценки ИИ

📌 LMArena — публичная онлайн-платформа, где тысячи пользователей ежедневно тестируют и сравнивают ИИ-модели: чат-ботов, генераторы кода, изображений и мультимодальных систем.

📌 Суть процесса — задаёте запрос → смотрите два ответа от случайных моделей (их имена скрыты) → выбираете лучший → голос влияет на рейтинг моделей в системе по схеме ELO. Так создаётся рейтинг, отражающий реальные человеческие предпочтения, а не бенчмарки.

ℹ️ На LMArena появляются новинки быстрее, чем где-либо — многие модели проходят проверку ещё до официального релиза. Можно сравнить как крупные модели (например, GPT, Gemini, Claude и др.), так и экспериментальные/открытые — удобно понять, что реально работает сейчас.

🔗 Попробовать: LMArena
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1