Источник КодХаб
6.3K subscribers
821 photos
80 videos
863 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
😶 MindOmni — как модель «видит» и думает над изображениями

📌 MindOmni — это унифицированная мультимодальная модель, которая объединяет понимание изображений и генерацию визуального контента с навыками рассуждения. Она способна не просто описывать, что на картинке, но и рассуждать: делать пошаговые выводы, отвечать на сложные вопросы по сцене, редактировать изображение, сохраняя детали, и генерировать новую визуальную информацию с учётом логики композиции.

📌 Ключевой «фишкой» модели является алгоритм RGPO (Reasoning Generation Policy Optimization), который добавляет механизм обучения с подкреплением к этапам рассуждения. Благодаря этому MindOmni может лучше выстраивать цепочки рассуждений, делать логические выводы и отвечать на визуальные задачи, которые требуют “думать, а не угадывать”.

🔗 Попробовать: MindOmni
Please open Telegram to view this post
VIEW IN TELEGRAM
🌐 Google Opal — сервис для разработки приложений и проектов без кода

📌 Компания Google через платформу Google Labs представила Opal — экспериментальный инструмент, который позволяет создавать рабочие AI-мини-приложения, задавая идею текстом.

📌 Под капотом сервис использует мощь мульти-моделей: генерацию кода и логики делает Gemini 2.5, визуальные элементы — Imagen 4, а видео/анимации — Veo 3. Вместо того чтобы писать каждую строку, вы формулируете задачу: «приложение для бронирования» или «чат-асcистент для сайта», Opal создаёт визуальный workflow, который можно править.

ℹ️ Ключевые фишки:
— Карта зависимостей, визуализирующая шаги приложения и их связь.
— Галерея шаблонов — готовые приложения, которые можно запустить или «ремикснуть».
— Полный no-code режим: вы опишете приложение и получите прототип, который можно сразу опубликовать и поделиться им. (Проект пока в публичной бета-версии для США и ряда стран.)

🔗 Попробовать: Google Opal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔈 Whisp — голос в приложение: создание веб-сайта с помощью одной фразы

📌 Проект Whisp («Say it. See it. Ship it.») предлагает новый путь: вместо клавиатуры — микрофон, вместо шаблона — генерация. Просто озвучиваешь идею приложения, и система создаёт рабочий фронтенд + бэкэнд + базу данных за секунды.

📌 Под капотом: голосовая платформа, которая распознаёт вашу речь, интерпретирует намерение («ландинг-страница для блога», «дашборд аналитики», «SaaS-инструмент») и автоматически создаёт код с готовой архитектурой — база данных, аутентификация, UI-компоненты, экспортируемый код.

ℹ️ Планы, цены и ключевые детали: Starter-пакет от $10/мес (1 млн токенов), Personal — $25/мес, Max — $50/мес с большим объёмом токенов. Можно начать без опыта программирования: система рассчитана на быстрое прототипирование и экспорт кода.

🔗 Попробовать: Whisp
Please open Telegram to view this post
VIEW IN TELEGRAM
1
🖥 Pixtral — мультимодальный LLM, объединяющий текст и визуализацию

📌 Pixtral — это мультимодальная модель от Mistral AI, которая способна одновременно работать с изображениями и текстом. Модель содержит 123 млрд текстовых параметров + 1 млрд визуального энкодера, что даёт ей возможность понимать графики, документы, сцены и отвечать на сложные вопросы.

📌 Одна из сильных сторон Pixtral — огромный контекст: она поддерживает окно до 128 000 токенов, что позволяет обрабатывать большие документы и множество изображений внутри одной сессии. Модель оптимизирована так, что не теряет качества по текстовым задачам, несмотря на мультимодальность — то есть она не “слабая” на тексте ради визуала.

ℹ️ Pixtral уже интегрируется в облачные сервисы: модель Pixtral Large доступна в Amazon Bedrock как serverless-вариант. Она показывает высокие результаты на задачах визуального понимания: DocVQA, анализ графиков, извлечение данных из диаграмм — и при этом конкурирует с крупными закрытыми моделями.

🔗 Попробовать: Pixtral
Please open Telegram to view this post
VIEW IN TELEGRAM
🎬 Kling 2.5 Turbo: новая эра в генерации видео

📌 Kling 2.5 Turbo — это свежая версия видеомодели, которая уже успела привлечь внимание благодаря сочетанию высокой скорости, качества и доступной цены. По внутренним тестам разработчиков, модель демонстрирует более реалистичное воспроизведение движений и эмоциональной выразительности, чем её конкуренты Veo 3 Fast и Seedance. Улучшения коснулись как обработки сложных промптов, так и контроля за последовательностью событий в кадре — теперь даже длинные сцены выглядят более цельными и естественными.

📌 Одним из ключевых плюсов Kling 2.5 Turbo стала работа с референсными изображениями: стиль или визуальная атмосфера сохраняются во всех кадрах ролика, что делает инструмент удобным для креаторов, которым важна согласованность стиля. Добавьте к этому плавность динамики и стабильность даже в насыщенных сценах, и становится понятно, почему модель быстро набирает популярность. Особенно радует цена — по сравнению с конкурентами, Turbo-версия стоит дешевле, при этом предлагая более качественные результаты.

ℹ️ Попробовать Kling 2.5 Turbo можно уже сейчас на официальном сайте Kling, а также через платформу SYNTX или телеграм-бот SYNTX. Для начала работы достаточно зарегистрироваться и выбрать нужный режим — например, Image to Video с версией Turbo. Пользователи могут регулировать длительность ролика, степень креативности (от строгого следования промпту до более свободных интерпретаций), а также использовать негативные подсказки для тонкой настройки результата. Это открывает простор для экспериментов — от рекламных роликов и музыкальных клипов до коротких креативных видео для соцсетей.

🔗 Попробовать: Kling 2.5 Turbo
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Chatterbox Turbo — опен-сорсная TTS-модель для клонирования голоса и генерации речи

Chatterbox Turbo — это открытая модель синтеза речи (TTS) с MIT-лицензией, разработанная Resemble AI: лёгкая, быстрая и доступная для запуска локально на вашей машине.

Модель весит всего ~350 млн параметров, что делает её легкой и быстрой — голос генерируется до 6× быстрее реального времени на GPU и с очень низкой задержкой. Это отличное решение для проектов, где важны скорость и доступность без тяжёлых зависимостей.

Главная фишка — zero-shot voice cloning: достаточно примерно 5 секунд записи чужого голоса — и модель способна воспроизводить речь в этом стиле. Chatterbox Turbo поддерживает paralinguistic теги (смех, вздохи, кашель и др.), что делает генерацию ещё более естественной и живой.

Попробовать: Chatterbox Turbo
☁️ Ask Brave — когда поиск превращается в диалог

📌 Brave реализует функцию Answer with AI, которая преобразует поисковые запросы в полноценные ответы с пояснениями, таблицами и источниками. Вместо того чтобы просто показывать ссылки, система сама анализирует веб, синтезирует информацию и выдаёт развернутый ответ прямо в результатах.

📌 Новый режим на Brave Search поддерживает post-запросы — можно уточнять тему, задавая дополнительные вопросы к уже полученному ответу. Это создаёт эффект диалога, оставаясь внутри поиска, без перехода на сторонние сайты.

ℹ️ Особенность Brave — внимание к приватности: модель не использует данные пользователей для обучения, не создаёт профилей и не хранит логи. Ответы «привязаны» к независимому индексу Brave, а не к результатам Google или Bing.

🔗 Попробовать: Ask Brave
Please open Telegram to view this post
VIEW IN TELEGRAM
Genspark AI — ИИ-агент для автопродакшна видео на русском языке

Genspark AI теперь умеет монтировать видео по запросу — и поддерживает русский язык. Бесплатная версия даёт до 100 кредитов в день (обычно хватает на один ролик), а для продвинутых задач доступны платные подписки от $25 в месяц.

Что умеет Genspark в плане видео:
обрабатывает видео дольше часа или сразу несколько трансляций (например, спортивные матчи),
выбирает ключевые моменты и автоматически генерирует монтаж,
создаёт расшифровку и накладывает субтитры (включая на русском, английском, японском),
находит и вырезает нужный фрагмент по текстовому запросу без таймкодов,
позволяет сэкономить часы рутины — в примере из интервью с Сэмом Альтманом сделал 10-минутную выжимку за пару минут.


Genspark Super Agent — это целая экосистема нейронных сетей (включая ChatGPT, DeepSeek, Kling и другие) под капотом, которая умеет длину видео анализировать, фрагменты монтировать и субтитры генерировать автоматически.

📎 Попробовать: Genspark AI
1
⭐️ Yoink AI — умный AI-редактор на Mac без копипаста

📌 Yoink AI — это нативное macOS-приложение, которое интегрирует AI-редактирование прямо в текстовые поля любых приложений. Достаточно нажать ⌘ + Shift + Y, и AI "подхватит" текущий контекст (выделение, текст вокруг курсора) и сразу предложит улучшение или продолжит текст — всё прямо там, где надо, без переключений, копипасты и лишних слов от AI.

📌 Основные плюсы: работает в любых приложениях (почта, Docs, Slack, браузер), «хватает» контекст автоматически, вставляет результат на месте и работает как настоящий помощник, а не чат-бот. Поддерживается персонализация стиля написания через функцию «Voices» — просто задайте тон, и AI будет придерживаться его.

🆓 Доступно бесплатно на Mac, полноценную версию можно скачать с официального сайта Yoink AI; поддержка Windows будет доступна позже через waitlist.
Please open Telegram to view this post
VIEW IN TELEGRAM
1
🔍 Lessie  AI — ИИ-ассистент для поиска и взаимодействия с нужными людьми

📌 Lessie AI — инструмент, который помогает брендам, стартапам и HR-командам быстро находить подходящих людей, связываться с ними и вести кампании. Платформа позволяет описать продукт или цель, а затем автоматически подобрать релевантных инфлюенсеров или экспертов во всех популярных соцсетях: TikTok, YouTube, Instagram.

📌 По сути Lessie AI управляет тремя ключевыми блоками: поиск, аутрич и переговоры. Она находит подходящих людей, генерирует персонализированные сообщения с оптимизированным временем отправки и следит за ответами. При этом есть встроенный механизм «умного предложения цены» и авто-переговоров, что помогает повысить эффективность взаимодействия.

ℹ️ Для кого подходит? Если вы работаете с маркетингом, инфлюенсерами или связями с общественностью — Lessie AI может сэкономить часы ручной работы и помочь масштабировать кампании. Бесплатный режим позволяет начать знакомство с платформой без затрат.

🔗 Попробовать: Lessie  AI
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥 DeepL Agent — универсальный корпоративный AI, который понимает и действует

📌 DeepL Agent — это автономный AI-помощник от DeepL, который умеет взаимодействовать с вашими приложениями, анализировать данные, создавать таблицы, отправлять письма и локализовать продукты — и всё это по обычным текстовым инструкциям. Он фактически управляет компьютером как вы: печатает, кликает и работает через браузер и мышь.

📌 Благодаря опыту DeepL в задачах переводов и обработке языка, новый агент сочетает в себе точность, безопасность и гибкость. Он уже проходит закрытое бета-тестирование для избранных корпоративных клиентов, а полноценный запуск ожидается в ближайшие месяцы по подписке.

🔢 Главные фичи:
🟢Автоматизация рутинных бизнес-задач (финансы, маркетинг, локализация, поддержка и др.) повышает продуктивность и освобождает время для важных решений
🟢Встроенные механизмы безопасности: контроль над действиями, возможность остановки в любой момент и человек в цикле (human-in-the-loop) обеспечивают надёжность и прозрачность


🔗 Попробовать: DeepL Agent
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥 v0.appгенератор веб-приложений от идеи до продакшна

📌 v0.app (бывший v0.dev) — это инструмент от Vercel, позволяющий создавать и развёртывать веб-приложения с помощью обычного текста. Прописываете желаемый функционал, интерфейс и интеграции — а платформа генерирует полноценный React/Next.js проект, стилизованный с Tailwind CSS, сразу готовый к деплою.

📌 Сервис умеет не просто генерировать код — он действует как агент: ищет ошибки, предлагает улучшения, анализирует контекст и рефакторит за вас. Поддерживает создание UI, бизнес-логику, подключение внешних API, поиск в вебе и даже инспекцию live-сайтов. Всё это — от идеи до рабочего приложения — за считанные минуты.

🔍 Подходит для самых разных задач: быстрое прототипирование MVP, визуализация пользовательских историй, генерация внутренних инструментов или одностраничников. Простая команда запуска и глубокая интеграция с Vercel делает v0 удобным инструментом для всех ролей: от менеджеров продукта до нетехнических специалистов.

🔗 Попробовать можно на v0.app — доступна бесплатная версия.
Please open Telegram to view this post
VIEW IN TELEGRAM
🌐 Daisy — единое окно для всех топовых LLM

📌 Daisy — это не просто чат-бот, а полноценный AI-сервис, который объединяет в одном интерфейсе разные языковые модели и мультимодальные инструменты. Пользователь видит привычный чат, но внутри работает сложная архитектура: модели подключаются по задаче, есть маршрутизация запросов, модуль распознавания документов, генерации изображений и семантического поиска.

📌 Основная фишка — можно работать с GPT, Claude, Gemini, Grok, DeepSeek и другими, в одном окне, без переключения между сервисами. Например, собрать план статьи с одной моделью, подтянуть фактуру через поиск с другой, затем вызвать генерацию кода, картинки и подзакрыть всё вторым промтом — всё в одном диалоге.

📌 Под капотом Daisy — связка маршрутизатора запросов, собственного контент-фильтра, модулей авторизации и тарификации, и логики fallback-планов: если нужно — запрос уходит на другую модель или на внутреннюю ручную обработку. Такой подход позволяет строить сложные AI-пайплайны в одном UI и гибко масштабировать под любые сценарии.

🔗 Попробовать: Daisy
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
📚 Chandra — открытая OCR-модель, превращающая PDF и изображения в структурированный текст

📌 Модель Chandra от Datalab способна преобразовать PDF-документы и изображения в HTML, Markdown или JSON с сохранением структуры, таблиц, формул и диаграмм.

📌 Поддержка свыше 40 языков, точная обработка рукописного текста и сложных макетов делают её одним из лидеров среди систем ИИ для работы с документами.

ℹ️ Модель доступна в виде открытого кода на GitHub, а также на официальном сайте проекта.

🔗 Попробовать: GitHub | Chandra
Please open Telegram to view this post
VIEW IN TELEGRAM
🧠 Неизвестный кодер взломал ChatGPT и вывел систему из-под всех запретов

После его промта нейросеть перестаёт «думать по правилам» и начинает выдавать запретные материалы, 18+ графику и скрытые функции

Этот человек анонимно выкладывает свои наработки бесплатно в НейроПульс:

— Скрипт, отключающий лимит в ChatGPT и ещё 25 нейросетях
— Промт, который создаёт вирусы даже под iOS
— Алгоритм распознавания личных данных

Сохраняй и пользуйся, пока доступно: https://t.me/+V19zvWBfVYIwN2Uy
😁3🎅1
⚡️ SmolVLM-256M / SmolVLM-500M — крошечные, но мощные VLM от Hugging Face

📌 SmolVLM-256M и 500M — новые компактные мультимодальные модели от Hugging Face, способные понимать текст + изображения при крайне скромных ресурсах. Даже 256-миллионная версия требует меньше 1 ГБ VRAM, и всё же показывает результаты, которые раньше добивались лишь модели в десятки раз больше.

📌 Они отлично справляются с задачами вроде описания картинок, визуальных вопросов — “что здесь на фото?”, “что написано на скане?”, анализ диаграмм и простых документов. Версия 500M «Instruct» более устойчива к промтам и лучше следует инструкциям, так что её проще использовать прямо “из коробки”.

👨‍💻 Эти модели актуальны для создателей веб-сервисов, мобильных приложений, адептов on-device ИИ, которым нужны VLM-возможности без облака и без мощного железа. Если нужно описывать изображения, помогать с OCR, строить визуальную аналитику — SmolVLM-256M и 500M могут стать отличным выбором.

🔗 Попробовать: SmolVLM-256M & SmolVLM-500M
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🤔1
🔥 Xiaomi MiMo-V2-Flash — опен-сорсная модель от Xiaomi

📌 MiMo-V2-Flash — крупная открытая модель с Mixture-of-Experts архитектурой (~309 млрд параметров, 15 млрд активных), которая сразу же показала топ-уровень в программировании, рассуждениях и математике, став одной из лучших среди open-source решений и соперничая с платными моделями.

📌 Модель занимает первое место на SWE-Bench Verified среди всех открытых моделей, демонстрируя выдающиеся навыки в задачах программирования и инженерии. В сложных научных и логических заданиях она тоже входит в топ-2, а её выдачи по образовательному контенту нередко превосходят крупные open-source модели вроде Qwen 3.

📌 Кроме качества, MiMo-V2-Flash выгодно отличается доступностью: модель доступна под MIT-лицензией, её веса можно скачать и запускать локально без ограничений, а коммерческий API стоит примерно $0.1 за миллион входных и $0.3 за миллион выходных токенов — это в десятки раз дешевле многих других решений. При этом контекст до 256 000 токенов позволяет держать большие документы, проекты или полноценные сессии разработки в одной сессии.

🔗 Попробовать: Xiaomi MiMo-V2-Flash
Please open Telegram to view this post
VIEW IN TELEGRAM
👋 Synthesiaпрофессиональные видео с AI-аватарами без съемок

📌 Synthesia — облачный сервис, который позволяет создавать видеоролики из текста с реалистичными AI-аватарами и озвучкой, без студий, актеров или сложной съёмки. Поддерживает более 230 аватаров на 140+ языках, предлагает шаблоны, кастомные аватары, озвучку и редактирование видео только онлайн.

💳 Тарифы и доступность
🟢Free (бесплатно) — 3 минуты видео в месяц, доступ к 9 AI-аватарам и базовым функциям.
🟢Starter — $29/мес — до 10 минут видео в месяц, 125+ аватаров, возможность удалить логотип Synthesia.
🟢Creator — $89/мес — до 30 минут видео в месяц, 5 персональных аватаров, расширенные функции.
🟢Enterprise — корпоративный тариф с неограниченным количеством видео минут, SSO, брендированными страницами и API интеграциями.


📌 Synthesia — оптимальный вариант для быстрого и качественного создания обучающих, маркетинговых и внутренних видеоматериалов. Интуитивный интерфейс, поддержка множества языков и доступный бесплатный план делают его удобной платформой.

🔗 Попробовать: Synthesia
Please open Telegram to view this post
VIEW IN TELEGRAM
🔬 Tongyi Deep Research — китайский ИИ-агент для автономных исследований

Alibaba представила Tongyi Deep Research — бесплатного исследовательского ИИ-агента с открытым кодом. Его ключевая особенность — архитектура mixture of experts: у модели есть 30 млрд параметров, но для каждого запроса используется только около 3 млрд. В итоге получается баланс мощности и скорости — как у гиганта, но с эффективностью компактной модели.

📌 В отличие от обычных чат-ботов, Tongyi умеет работать как настоящий исследователь: он разбивает сложные задачи на подэтапы, сам ищет информацию в интернете, сопоставляет данные из множества источников и выдает отчет с цитатами. Всё это в итерационном режиме, что позволяет делать глубокие обзоры и анализ. То, на что у человека уйдет час, агент выполняет за три минуты. На бенчмарках он обходит даже платные сервисы для веб-браузинга и долгосрочных исследований.

📑 Сфера применения огромна — от контент-маркетинга и бизнес-аналитики до академических обзоров и стратегической разведки. Модель уже доступна на GitHub и HuggingFace: полная версия требует GPU с 24 ГБ VRAM, а облегченная работает и на 8 ГБ. Китайцы называют Tongyi “моментом DeepSeek” для ИИ-агентов — шагом, когда корпоративные технологии становятся открытыми и бесплатными, создавая давление на весь мировой рынок.

🔗 Попробовать: Tongyi Deep Research
Please open Telegram to view this post
VIEW IN TELEGRAM
2