Источник КодХаб
6.3K subscribers
822 photos
81 videos
865 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
🎨 Stability AI — генеративный ИИ для творчества и бизнеса

📌 Технологическая база Stability AI — это не просто «изображения из текста», а сложные системы с несколькими уровнями: автокодировщики, латентные пространства, диффузионные процессы, трансформеры. В модели Stable Diffusion 3 (SD3) используется архитектура Multimodal Diffusion Transformer (MMDiT) — она разбивает обработку текста и изображения на отдельные веса/модули, затем объединяет через механизм внимания, чтобы обе модальности (текст и изображение) могли взаимодействовать.

📌 Кроме того, Stable Diffusion работает в латентном пространстве: сначала изображение кодируется в компактное представление через вариационный автокодировщик (VAE) — таким образом размерность обработки падает.

ℹ️ SD3 и сопутствующие версии используют масштабируемость моделей от ~800 млн до ~8 млрд параметров, а также потоковое обучение с “flow matching” и диффузионной трансформер-архитектурой, что улучшает качество результата (типографика, соответствие запросу) и делает процесс генерации более гибким.

🔗 Попробовать: Stability AI
Please open Telegram to view this post
VIEW IN TELEGRAM
1
🤖 Denario — ассистент нового поколения

📌 Denario — модульная AI-система, которая способна взять на себя весь цикл научного исследования: от генерации идеи до написания и рецензии статьи.

📌 Система построена как набор агентов: «Idea Maker» формирует гипотезу, «Idea Hater» её критикует, затем модули анализируют литературу, пишут код, строят графики и генерируют рукопись — и всё это автономно.

ℹ️ Пока около 90% результатов считаются непригодными, система может «нагнать» фиктивные данные или ошибочные выводы, поэтому человеческий контроль остаётся обязательным.

Попробовать: Denario
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥1
🖥 Создание персонажей с AI: как работать с видео в Jay Flow

📌 Jay Flow — платформа от Just AI, построенная на идее мультиагентных рассуждений: агенты внутри системы взаимодействуют между собой, подключают нейросети и внешние сервисы, создавая результат без лишней боли с инфраструктурой и настройками. В интерфейсе похожем на холст (типа Figma/Miro) ты размещаешь карточки — текст, изображения, видео, — связываешь их между собой и задаёшь логику: “агент A преобразует эту картинку, агент B добавляет речь, агент C клеит всё в видео”.

📌 В контексте создания персонажа и видео тебе пригодится следующий рабочий подход: сначала создаёшь черновой промпт — описываешь, как выглядит герой, как он двигается, где находится, что говорит и в каком стиле видео должно быть. Затем ты вставляешь этот черновик в Jay Flow, просишь агента подправить его, перевести на английский (если нужно моделью), уточнить детали (время, ракурс, эмоции). В Jay Flow есть API-доступ к агенту, агенты могут принимать файлы в запросе (референсы) и работать с мультимодальными задачами.

ℹ️ Минусы: такие системы пока что не идеальны в точном воспроизведении мимики, синхронизации речи и движений тела. Часто приходится несколько итераций править промпт, корректировать голос и жесты. Да и ограничения моделей (видео по времени, детализация) всё ещё дают о себе знать. Но в рамках концептов, роликов для соцсетей или тизеров Jay Flow уже даёт впечатляющий уровень результата при гораздо меньших усилиях, чем вручную монтировать всё самому.

🔗 Попробовать: Jay Flow
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21
🤖 Aimylogic — no-code платформа для умных ботов

📌 Aimylogic позволяет создавать чат-ботов и голосовых ассистентов без программирования — всё с помощью визуальных блоков и логики. Платформа интегрируется с текстовыми и голосовыми каналами, поддерживает сценарии диалога, подключение внешних API и обработку пользовательских запросов.

📌 В 2025 году Aimylogic получила обновления: добавлена интеграция с ElevenLabs TTS (озвучивание), прямое подключение LLM в телефонию и возможность вызывать функции из бота во время разговора. Это делает её гибче для бизнес-кейсов — от customer support до внутренних ассистентов.

ℹ️ Многие пользователи отмечают удобство: с Aimylogic можно построить базового чат-бота за час. Но есть и минусы — визуальный редактор иногда кривой, поддержка не всегда оперативная, и за более расширенные функции придётся заплатить.

🔗 Попробовать: Aimylogic
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
🌐 EmbeddingGemma — компактная многоязыковая модель поиска от Google

ℹ️ EmbeddingGemma — новая легковесная модель текстовых эмбеддингов от Google DeepMind и Gemma 3, рассчитанная на работу прямо на ноутбуке или смартфоне без облака.
Она содержит около 308 миллионов параметров и поддерживает более 100 языков.

📌 Главная фишка — Matryoshka Representation Learning: модель может выдавать векторы разного размера (от 128 до 768 измерений) в зависимости от задачи и ресурсов устройства, без необходимости переобучения.

📌 Это позволяет балансировать скорость, точность и использование памяти, делая EmbeddingGemma универсальным инструментом для локального поиска, RAG-пайплайнов и кластеризации текстов.
Google также подчёркивает, что модель работает быстро (генерация эмбеддингов менее чем за 22 мс на EdgeTPU) и требует меньше 200 МБ RAM благодаря квантованию.

📌 При этом по эффективности в задачах поиска и семантического сходства EmbeddingGemma демонстрирует лучшие показатели среди всех моделей до 500M параметров.

🔗 Попробовать: EmbeddingGemma
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1🔥1
🐈 SpikingBrain1.0 — эффективная альтернатива трансформерам

📌 SpikingBrain1.0 — это новая модель от Китайской академии наук, которая использует вдохновение из нейробиологии, чтобы решить одну из главных проблем современных больших языковых моделей: огромные требования к вычислениям и памяти при обработке длинных контекстов. Вместо классического “глобального внимания”, SpikingBrain применяет localized attention и “спайкинг-нейроны” (event-driven вычисления), которые отвечают только тогда, когда нужно — экономя ресурсы.

📌Модель доступна в двух вариантах: SpikingBrain-7B и SpikingBrain-76B. Одна из ключевых заявленных фич — скорость: на ультра-длинных контекстах SpikingBrain1.0 утверждает, что может быть 25-100× быстрее традиционных трансформеров по времени до первого токена (Time to First Token), особенно когда нужно обработать большие объёмы текста. Кроме того, модель обучается на значительно меньшем объёме данных по сравнению с аналогами (менее 2% от объёмов, которые часто используются) и работает на китайском железе MetaX вместо Nvidia-GPU.

🔗 Попробовать: SpikingBrain1.0
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1🔥1
😶 MindOmni — как модель «видит» и думает над изображениями

📌 MindOmni — это унифицированная мультимодальная модель, которая объединяет понимание изображений и генерацию визуального контента с навыками рассуждения. Она способна не просто описывать, что на картинке, но и рассуждать: делать пошаговые выводы, отвечать на сложные вопросы по сцене, редактировать изображение, сохраняя детали, и генерировать новую визуальную информацию с учётом логики композиции.

📌 Ключевой «фишкой» модели является алгоритм RGPO (Reasoning Generation Policy Optimization), который добавляет механизм обучения с подкреплением к этапам рассуждения. Благодаря этому MindOmni может лучше выстраивать цепочки рассуждений, делать логические выводы и отвечать на визуальные задачи, которые требуют “думать, а не угадывать”.

🔗 Попробовать: MindOmni
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍1🔥1
🎙 April — голосовой ассистент для бизнеса, который управляет почтой и календарём без рук

📌 April — iOS-приложение, разработанное стартапом Cosmoverse, демонстрирует, как голосовой AI может превратиться в виртуального помощника-«Джарвиса». Запущенное в рамках Y Combinator летом 2025 года, приложение позволяет обрабатывать почту, планировать события, отменять встречи и подготавливаться к звонкам — исключительно голосом, без переключения вкладок.

📌 Ассистент умеет выявлять важные письма, отправлять ответы — причём в нужном тоне и стиле, на основе вашего голоса. Он также очищает почту от спама, организует почтовые папки, сообщает контекст перед встречей и позволяет создавать или переносить события по команде. Всё это действует hands-free, при этом ваш голос заменяет десятки кликов.

📌 Приложение доступно на iPhone и iPad с трёхдневным бесплатным периодом, затем — подписка $14.99/мес. Пользователи отмечают, что April существенно ускоряет рабочий ритм, особенно по дороге на работу: "До приезда на работу я уже догнал свой график", — пишет один из тестировавших.

🔗 Попробовать: April
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🔵 Hunyuan3D от Tencent: 3D-модель из картинки за 25 секунд

📌 2-ступенчатый пайплайн: сначала Hunyuan3D-DiT создаёт геометрию по картинке, затем Hunyuan3D-Paint наносит текстуры — модель выходит детализированной и готовой к использованию. Результат за 10–25  секунд, в зависимости от версии (Turbo — быстрее).

📈 Дерзкий прогресс перед другими
🟢 Hunyuan3D 2.0 показывает лучшие показатели geometric accuracy, FID и CLIP-score — превосходит доступные аналоги.
🟢 "Turbo" модели выдают результат всего за 30 секунд — они выгодно обгоняют конкурентов.
🟢 Открытый исходник на GitHub: есть предобученные модели, код, описания и даже Blender-addon.
🟢 Модели адаптированы под Gradio, ComfyUI и даже Windows-инсталлер — все удобно для разработчиков и дизайнеров.


🔍 Что внутри?
🟢 Hunyuan3D-DiT: Генерирует неокрашенный меш (геометрию) из одной картинки
🟢 Hunyuan3D-Paint: Накладывает текстуры высокого разрешения (PBR, цвет, рельеф)
🟢 Версии Turbo & Mini: Ускоренные модели с меньшим количеством параметров и VRAM


📌 Возможности
🟢GLB, OBJ, FBX экспорт, PBR-текстуры, готовые meshes для VR/AR/игр
🟢Поддержка мультивида в 2.1/2.5 — можно качать детализацию, если есть несколько ракурсов.


🔗 Репозиторий на GitHub
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
⭐️ Lipsync-2-Pro — дипфейки голливудского уровня прямо в браузере

📌 Lipsync-2-Pro от Sync Labs — это AI-инструмент для профессионального синхронного движения губ, который работает через браузер и API, без ручной настройки.
🟢Студийное качество в минуту, а не недели: модель синхронизирует речь с видео максимально естественно, сохраняя уникальные особенности голоса и лица, включая бороду, веснушки и грим благодаря диффузионной суперрезолюции.
🟢Поддержка 4K видео и любые форматы: работает с живыми съемками, 3D-анимацией и AI-генерацией — железный инструмент для современных видеокреаторов.
🟢Доступность и гибкость: доступен в студийном и API интерфейсах. Требуется план Scale или выше для API, а в Studio доступ открыт для всех, плата только за использование.


🔗 Где можно попробовать? Все модели, включая lipsync-2-pro, доступны для тестирования по ссылке
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2😁1
This media is not supported in your browser
VIEW IN TELEGRAM
👨‍💻 Second Brain: локальный ИИ-поисковик

📌 Second Brain позволяет индексировать локальные файлы — документы, изображения, PDF и другие форматы — не только по названиям, но и по содержанию. Он объединяет семантический поиск и ключевые слова, даёт возможность искать через текст и изображения, работает офлайн с локальными моделями.

📌 ИИ индексирует всё — документы, PDF, картинки, заметки, даже текст внутри изображений. Комбинирует семантический и ключевой поиск, распознаёт контент на многих языках и форматах: .pdf, .docx, .png, .gif и др. Всё это работает прямо на устройстве, без интернета и передачи данных в облако.

🔗 Попробовать: Second Brain
Please open Telegram to view this post
VIEW IN TELEGRAM
🖥 Tweeks by NextByte — кастомизация веб-сёрфинга под себя

📌 Tweeks позволяет настроить отображение сайтов по своему усмотрению: удалять рекламу и всплывающие баннеры, скрывать куки-плашки и даже трансформировать интерфейс с помощью кратких текстовых команд.

📌 Основные особенности:
🟢 создание и применение модификаций для любых страниц с помощью ввода команд.
🟢 редактирование, включение/отключение созданных модификаций, хранение изменений локально.
🟢 поддержка всех URL-адресов, что даёт свободу настройки почти любого сайта.
🟢 политика конфиденциальности: данные страницы используются только при явном запросе генерации скрипта; генерируемые скрипты хранятся локально.


ℹ️ Инструмент будет полезен как тем, кто любит настраивать браузер под себя, так и тем, кто работает с кодом и занимается парсингом веб-страниц.

🔗 Попробовать: Tweeks
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
📢 Whisper — профессиональный speech2text сервис на базе ИИ

📌 Whisper — веб-сервис, реализующий автоматическую транскрипцию аудио- и видеозаписей через ИИ-модели (в основе — технология Whisper от OpenAI).

📌 Сервис подходит для конвертации встреч, интервью, лекций и подкастов: он работает с многоязычными аудио, распознаёт речь на разных акцентах и в шумной обстановке.

🔗 Попробовать: Whisper
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
📑 Transor AI — универсальный ИИ‑переводчик для браузера и документов

📌 Transor AI — бесплатный инструмент, который позволяет переводить сайты, документы, картинки и даже видео‑субтитры прямо в браузере или через расширение.

📌 Он поддерживает такие форматы, как веб‑страницы, PDF и изображения с OCR, работает с YouTube/Netflix‑субтитрами, и предлагает расширения для популярных браузеров.

ℹ️ Инструмент ориентирован на широкий круг задач: от быстрого перевода контента для личного пользования до обработки документов и мультимедиа без сложной настройки.

🔗 Попробовать: Transor AI
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
🌐 GPT-5.1 — новая модель от OpenAI.

📌 Модель GPT-5.1 была представлена 12 ноября 2025 года, она включает две основные версии: Instant и Thinking.

📌 В версии Instant приоритет отдан скорости, естественному разговору и улучшенному следованию инструкциям, в версии Thinking — больше времени на «обдумывание», лучшая логика и планирование.

ℹ️ Также введена маршрутизация запросов через режим Auto: система сама выбирает, какая версия лучше справится с конкретным вопросом. Добавлена настройка «тональности» ответа (Professional, Quirky, Friendly и др.) и улучшена адаптивность к стилю.

🔗 Попробовать: GPT-5.1
Please open Telegram to view this post
VIEW IN TELEGRAM
🎅31
🖥 Marble — генератор 3D-миров от World Labs

📌 World Labs запустили Marble — инструмент, который позволяет создавать полноценные 3D-сцены по тексту, фото, видео или даже 3D-макету.

📌 Система поддерживает много режимов: генерация из одного изображения или текста, мульти-изображения для большей точности, затем редактор Chisel, где можно вручную задать макет (стены, коробки, плиты) — дальше ИИ дорабатывает детали.

ℹ️ Также можно расширять миры (expansion mode) и комбинировать несколько сцен в один большой мир (composer mode) — удобно для игр, визуальных эффектов, архитектуры или виртуальной реальности.

🔗 Попробовать: Marble
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
🖥 ALLWEONE — ИИ-генератор презентаций за пару минут

📌 ALLWEONE — веб-сервис, который позволяет создавать полноценные презентации: достаточно ввести тему, выбрать язык и стиль, а слайды автоматически генерируются с картинками, графиками и готовым оформлением.

📌 Сервис поддерживает редактирование результата: можно менять оформление, переставлять слайды, добавлять новые элементы и работать с темами. Есть выбор из нескольких шаблонов и настройка стиля (например, «профессиональный» или «неформальный»).

ℹ️ ALLWEONE работает с русским языком (и другими), подходит студентам и специалистам, чьи задачи связаны с подготовкой презентаций. Базовая версия бесплатна.

🔗 Попробовать: ALLWEONE
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥1