Источник КодХаб
6.3K subscribers
822 photos
81 videos
865 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
🔥 Baidu представила ERNIE X1.1 и ERNIE 4.5-21B-A3B-Thinking

ℹ️ ERNIE X1.1 — усиленная версия reasoning-модели, которая по фактам (factual accuracy) стала сильнее на 34.8 %, а по следованию инструкциям — на 12.5 % по сравнению с ERNIE X1.

🧑‍💻 Baidu утверждает, что X1.1 обходит DeepSeek R1-0528 и в ряде задач почти достигает уровня GPT-5 и Gemini 2.5 Pro. Модель доступна через ERNIE Bot, Wenxiaoyan и на платформе MaaS от Baidu AI Cloud.

🖥 ERNIE 4.5-21B-A3B-Thinking — это стратегически компактная MoE-модель: общая архитектура 21 млрд параметров, но активируется всего 3 млрд параметров на токен, что повышает эффективность использования ресурсов. Она поддерживает чрезвычайно длинный контекст — до 128К токенов, интегрирована с инструментами (tool usage) и лицензирована под Apache-2.0, что делает её подходящим вариантом как для исследований, так и коммерческого применения.

🔗 Попробовать:
Модель ERNIE 4.5-21B доступна на Hugging Face
Попробовать X1.1 можно на сайте бота от Baidu
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍1🔥1
⚡️ Hailuo AI — 7-дневный безлимит на Start/End Frames

ℹ️ Hailuo запустил новую акцию: целую неделю можно генерировать видео с неограниченным контролем начального и конечного кадров (Start/End Frames) — то есть буквально «рискуйте»: задавайте движение, композицию и переходы, сколько хотите. Такая опция даёт полный творческий контроль над тем, как кадр начинается и заканчивается, что особенно круто для сторителлинга и визуальной динамики.

🖥 Веб-интерфейс Hailuo прост — на сайте можно зайти в раздел генерации видео, выбрать Start/End Frame, загрузить изображение-референс или просто ввести текстовый промт, и система сама построит анимацию, начиная и заканчивая там, где вы хотите. Пользователи отмечают, что можно делать кинематографичные ролики без огромных вычислительных мощностей.

🧑‍💻 Акция проходит в рамках челленджа: помимо бесплатного доступа Hailuo предлагает призы и подписки участникам, которые делают интересный визуальный контент. Отличная возможность протестировать Start/End фреймы на практике — и, если понравится, потом можно подумать о подписке или использовать продвинутые модели от Hailuo.

🔗 Попробовать: Hailuo AI
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥1👨‍💻1
📸 Seedream 4.0 — новый уровень AI-картинок от ByteDance

📌 Seedream 4.0 — это объединённый движок генерации и редактирования изображений, разработанный в ByteDance Seed. Он умеет работать с текстовыми промптами, загруженными референсами и правками по описанию, всё в одной модели.

📌 Модель поддерживает разрешения до 4K (4096×4096 пикселей), работает очень быстро и конкурентоспособна с Google-моделями вроде Nano Banana по внутренним оценкам ByteDance. Также она умеет парой фраз удалить или добавить объект, изменить фон или цвет, перестроить композицию — в тихом режиме prompt-based editing.

📌 Seedream 4.0 доступен на Higgsfield.ai — в разделе advanced image editing (можно выбрать Seedream как движок). Также её можно запустить через Fal.ai или на Imagine.Art в разделе multi-modal generation.

🔗 Попробовать: Seedream 4.0
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🎨 Reve Image 1.0: когда AI понимает ваши промты

📌 Reve Image (кодовое имя Halfmoon) — это новая генеративная модель с большим акцентом на точное выполнение промтов, эстетическое качество и работу с текстом внутри картинки. Модель обучена с нуля и предназначена для авторов, дизайнеров и тех, кто хочет создавать визуальный контент без “гаданий” и лишнего хаоса в выдаче.

📌 Первые отзывы крайне позитивные: Reve хвалят за реалистичную анатомию, особенно руки и жесты, стабильную цветопередачу и способность создавать читаемый текст (логотипы, стикеры, подписи) прямо на изображении. Пользователи отмечают, что запускать Reve намного проще, чем Midjourney или Flux, и что она быстрее “догоняет” задумку без десятков уточнений.

Reve доступна в бесплатной preview-версии.

🔗 Попробовать: Reve Image 1.0
Please open Telegram to view this post
VIEW IN TELEGRAM
🌐 Phi-4: новая эра компактных reasoning-моделей от Microsoft

📌 Phi-4 — это 14-миллиардная модель из семейства Phi Small Language Models (SLM), созданная Microsoft Research для задач сложного рассуждения, математики, кодинга и логики. Особенность Phi-4 в том, что она показывает производительность, сравнимую с гораздо более крупными моделями, но при этом остаётся эффективной даже в условиях ограниченных ресурсов.

📌 Модель обучалась не просто на web-данных, но и на тщательно подобранных синтетических reasoning-датасетах, а затем дообучена через supervised fine-tuning на демонстрациях рассуждений и цепочек вычислений. В некоторых вариациях (Phi-4-reasoning, Phi-4-reasoning-plus) используется reinforcement learning для усиления качества долгих рассуждений и построения логически связных ответов.

📌 Благодаря высокому уровню reasoning-способностей и умеренным ресурсным требованиям, Phi-4 отлично подойдёт для создания агентов, RAG-пайплайнов и сценариев, где требуются "умные ответы" с вычислительной нагрузкой, но без гигантского железа.

🔗 Попробовать: Phi-4
Please open Telegram to view this post
VIEW IN TELEGRAM
4🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
🧠 Genspark AI Browser — браузер, который сам работает за вас

🌐 Разработчики Genspark запустили AI-браузер, в котором можно запускать локальные LLM прямо на устройстве — без облака, без подписок и с максимальной приватностью.

🧑‍💻 Под капотом — 169 открытых моделей (Gemma, DeepSeek, даже GPT-семейства), плюс встроенные агенты, которые умеют автоматизировать рутинные задачи: анализ веб-страниц, заполнение таблиц, сравнение цен, поиск информации и многое другое.

ℹ️ В Genspark есть “Autopilot Mode” — режим, когда браузер сам прокручивает сайты, собирает нужный материал, переходит по ссылкам и может даже управлять формами без вашего вмешательства. А встроенный блокировщик рекламы делает серфинг быстрее и чище.

🔗 Попробовать: Genspark AI Browser
Please open Telegram to view this post
VIEW IN TELEGRAM
👍42
⚡️ Falcon 3 — эффективная open-source LLM от TII

📌 Falcon 3 — семейство трансформерных языковых моделей с параметрами от 1 B до 10 B, разработанное Technology Innovation Institute (Абу-Даби). Модели выпускаются в вариантах Base и Instruct, и оптимизированы под задачи reasoning, генерации кода, математики и краткого диалога.

📌 Falcon 3 тренирована на массивном корпусе — около 14 триллионов токенов (более чем вдвое больше предыдущих поколений), что помогло улучшить качество на задачах «понимания текста» и «следования инструкциям». Контекст может доходить до 32 К токенов (в зависимости от варианта модели), что позволяет работать с объемными документами и кодом.

📌 Falcon 3 часто упоминается в обзорах как одна из самых быстрых и «доступных» open-source моделей на 2025 год. Её легко запустить локально через Hugging Face.

🔗 Попробовать: Falcon 3
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥1
🧠 Manus AI — автономный агент, который превращает идеи в действия

ℹ️ Manus AI, разработанная стартапом Monica.im (Butterfly Effect), — это первый в мире полноценный автономный агент общего назначения, запущенный в марте 2025 года. Он создан не просто чтобы «отвечать на запросы», а чтобы сам планировать, запускать инструменты и достигать конечного результата — будь то построение аналитического отчёта, генерация кода, маркетинговая стратегия или организация поездки.

🖥 В основе стоит модульная архитектура с динамическим планированием: Manus разбирает запрос, создаёт пошаговый план, вызывает нужные инструменты (браузер, редакторы, базы данных, API-интеграции) и контролирует выполнение каждой задачи. В среднем Manus делает около 50 вызовов инструментов за задачу, перерабатывая свой список дел (TODO) в реальном времени, чтобы не отвлекаться от цели.

🧑‍💻 Одной из последних новинок стала функция Wide Research — Manus может запускать одновременно сотни независимых агентов, каждый из которых изучает часть сложной задачи (например, продуктовый анализ, веб-скрапинг, автоматическая генерация отчётов и презентаций) и возвращает свои выводы, из которых главный агент формирует итоговый результат.

🔗 Попробовать: Manus AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🔥1
🔥 Genie 3 — текст в живой виртуальный мир от DeepMind

📌 Genie 3 — первая в своём роде генеративная world model, которая создаёт интерактивные 3D-среды в реальном времени на основе текстового промта.

📌 Вы можете буквально «зайти» в созданный мир (например, лавовый ландшафт, тропический лес или промышленное помещение), перемещаться по нему с видом от первого лица и взаимодействовать с объектами — всё это в 720p, 24fps, с сохранением логики и памяти мира на протяжении нескольких минут. Мир реагирует, если вы изменяете что-то — например, добавить дождь, переместить предмет или изменить погоду.

🧑‍💻 С технической точки зрения Genie 3 обучалась на видеоданных из Интернета и сама вывела физику объектов, динамику освещения и многослойную долговременную память сцены — без явного кодирования законов природы или заданных физических моделей.

🔗 Попробовать: Genie 3
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1
🎹 Mozart AI — co-producer в вашем браузере

📌 Mozart AI — это скорее интеллектуальная музыкальная DAW (Digital Audio Workstation), а не просто генератор лупов. Платформа работает как полноценная студия: вы даёте промт или загружаете фото/мелодию — и AI помогает сгенерировать трек, добавить вокал, подобрать семплы и даже сделать сведение одним кликом.

📌 У Mozart AI есть несколько интересных фич — TAB Mode, когда AI подсказывает мелодию, гармонию и ударные с учётом контекста, semantic sample search из вашей библиотеки (AI подбирает подходящий звук под настроение), а один промт может сразу привести к сведению (compression, side-chain и другие эффекты).

📌 Судя по отзывам, Mozart AI пока не полностью убила Suno, но идея серьёзна — сюда не просто “вбиваешь текст и получаешь песню”, а получаешь творческого партнёра, который может слушать, отвечать и редактировать с учётом музыкального контекста.

🔗 Попробовать: Mozart AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
🚀 Qwen3-Next от Alibaba — новая планка эффективности в LLM

ℹ️ Alibaba представила Qwen3-Next — модель на 80 млрд параметров, из которых активно работает только 3 млрд на запрос. Это делает её сверхэффективной: в некоторых тестах новая архитектура даёт 10× скорость вывода при в 10 раз меньшей стоимости обучения по сравнению с предыдущими версиями.

🧑‍💻 Что особенно интересно — Qwen3-Next-80B-A3B-Thinking (рассуждающий режим) превосходит Gemini-2.5-Flash-Thinking от Google на ряде benchmark-ов: LiveCodeBench (код), AIME25 (математика), SuperGPQA и LiveBench (общие знания). А если нужен “простой” режим, есть версия -Instruct, которая работает без “thinking-тегов” и быстрее.

🖥 Модель доступна открыто: на Hugging Face есть как Thinking, так и Instruct версии (Qwen/Qwen3-Next-80B-A3B-Thinking, Qwen/Qwen3-Next-80B-A3B-Instruct) — можно запустить локально, попробовать через OpenRouter или в Alibaba Cloud ModelScope. Использование через API обещает низкую стоимость — около $0.5 за миллион входных токенов и $6 за выходные (для thinking-версии), что делает её выгодной даже для продвинутых приложений.

🔗 Попробовать: Qwen3-Next
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍3
📷 Ebsynth — мощный инструмент стилизации видео

ℹ️ Ebsynth — это программа, которая позволяет превратить любое видео в стилизованную картину: вы редактируете один ключевой кадр, задаёте стиль, и Ebsynth автоматически переносит его на все остальные кадры. Он особенно полезен при ретуши, цветокоррекции, стилизации и создании визуального арта без ручной покадровой обработки.

⭐️ Среди особенностей версии, актуальной на сайте, есть бесплатный тариф, который включает основные функции и экспорт в 720p HD. За дополнительные возможности — более высокое разрешение (до 4K), экспорт в PNG-последовательностях и приоритет обработки — придётся платить по подписке Pro. Также существует студийная версия для тех, кто хочет полностью офлайн-использование и работу через командную строку.

Ebsynth не использует генеративные сети для распространения стиля по видео, это алгоритм синтеза текстур с ключевыми фреймами и оптическим потоком. При работе важны качественные кадры-референсы, правильное освещение и детали, иначе могут возникать артефакты. Интерфейс простой и понятный, подходит и для новичков, и для профессионалов.

🔗 Попробовать: Ebsynth
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🔊 SongR — весь процесс создания песни в пару кликов

📌 SongR — это web-сервис “текст → песня”, где всё, что нужно — ввести ключевые слова или идею, выбрать жанр и получить готовый трек с вокалом и аккордами. Он ориентирован на простоту и тем, кто не хочет или не может разбираться с музыкальной теорией.

📌 Платформа доступна как через браузер (songr.ai), так и в виде приложения. При этом есть бесплатный режим, позволяющий опробовать генерацию песни и текста, а дополнительные функции (например, жанры, экспорт) — через in-app покупки.

⭐️Важно также знать, что созданный контент в бесплатном режиме предназначен только для личного, некоммерческого использования — это указано в условиях использования SongR.

🔗 Попробовать: SongR
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍2🔥2
⭐️ DeepSeek Janus-Pro — универсальный мультимодальный смысловой генератор

📌 DeepSeek представила Janus-Pro — новую версию своей мультимодальной серии Janus, объединяющую понимание изображений и их генерацию. Модель ориентирована на задачи, где нужно одновременно распознавать визуальный контент и создавать новый по текстовому описанию.

📌 Версии Janus-Pro представлены в 1B и 7B параметров. В версии 7B заметно выше точность при генерации, особенно по сложным промтам, а также улучшения в стабильности и согласованности изображения. У модели декомпозирован визуальный энкодер, что позволяет раздельно обрабатывать задачи визуального понимания и генерации.

⭐️ По бенчмаркам Janus-Pro-7B превосходит DALL-E 3 и Stable Diffusion по GenEval и DPG-Bench в задачах text-to-image и плотных (dense) промтов. Модель уже доступна на Hugging Face: deepseek-ai/Janus-Pro-7B, с возможностью использования для генерации изображений, анализа изображений и мультимодальных задач.

📎 Попробовать: DeepSeek Janus-Pro
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍3🔥2
⚡️ SmolVLM-256M / SmolVLM-500M — крошечные, но мощные VLM от Hugging Face

📌 SmolVLM-256M и 500M — новые компактные мультимодальные модели от Hugging Face, способные понимать текст + изображения при крайне скромных ресурсах. Даже 256-миллионная версия требует меньше 1 ГБ VRAM, и всё же показывает результаты, которые раньше добивались лишь модели в десятки раз больше.

📌 Они отлично справляются с задачами вроде описания картинок, визуальных вопросов — “что здесь на фото?”, “что написано на скане?”, анализ диаграмм и простых документов. Версия 500M «Instruct» более устойчива к промтам и лучше следует инструкциям, так что её проще использовать прямо “из коробки”.

👨‍💻 Эти модели актуальны для создателей веб-сервисов, мобильных приложений, адептов on-device ИИ, которым нужны VLM-возможности без облака и без мощного железа. Если нужно описывать изображения, помогать с OCR, строить визуальную аналитику — SmolVLM-256M и 500M могут стать отличным выбором.

🔗 Попробовать: SmolVLM-256M & SmolVLM-500M
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥1
🔍 Gamma 3.0 — эволюция визуального сторителлинга

📌 Gamma представила версию 3.0, в которой инструмент презентаций превратился в полноценную платформу визуальных историй. Она работает не просто как сборка слайдов, а как партнёр-дизайнер: вы вводите идею, добавляете контент — ссылки, скриншоты, тезисы — а Gamma Agent сразу предлагает стили, визуальные диаграммы, оформление, и может переработать весь музыкальный тон дизайна по команде.

📌 В числе нововведений — API автоматизации, которое позволяет интегрировать Gamma в рабочие процессы: например, автоматически превращать CRM-данные в презентации, делать отчёты, визуализировать исследования. Также расширились шаблоны, темы, диаграммы и функции для команд — брендинг, совместная работа, единый стиль.

ℹ️ Gamma 3.0 сохраняет бесплатный уровень: при регистрации даётся набор кредитов, с которым можно попробовать Agent, создавать презентации, документы, сайты, экспорт в разные форматы. Платные подписки дают больше возможностей, снятие ограничений, приоритетный доступ и расширенные возможности дизайна.

🔗 Попробовать: Gamma 3.0
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
🐈 SpikingBrain1.0 — эффективная альтернатива трансформерам

📌 SpikingBrain1.0 — это новая модель от Китайской академии наук, которая использует вдохновение из нейробиологии, чтобы решить одну из главных проблем современных больших языковых моделей: огромные требования к вычислениям и памяти при обработке длинных контекстов. Вместо классического “глобального внимания”, SpikingBrain применяет localized attention и “спайкинг-нейроны” (event-driven вычисления), которые отвечают только тогда, когда нужно — экономя ресурсы.

📌Модель доступна в двух вариантах: SpikingBrain-7B и SpikingBrain-76B. Одна из ключевых заявленных фич — скорость: на ультра-длинных контекстах SpikingBrain1.0 утверждает, что может быть 25-100× быстрее традиционных трансформеров по времени до первого токена (Time to First Token), особенно когда нужно обработать большие объёмы текста. Кроме того, модель обучается на значительно меньшем объёме данных по сравнению с аналогами (менее 2% от объёмов, которые часто используются) и работает на китайском железе MetaX вместо Nvidia-GPU.

🔗 Попробовать: SpikingBrain1.0
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍2🔥2
🖱 Lucy Edit Dev — видео-редактор по промту, теперь с открытыми весами

📌 Lucy Edit Dev от Decart AI — это open-source модель, основанная на Wan 2.2 (версия 5B), которая позволяет редактировать любые видео по описанию. Нужно изменить одежду, фон, добавить эффект — просто пишешь, что ты хочешь, загружаешь ролик, и модель применит изменения ко всему видео.

🖥 Она доступна на Hugging Face под именем decart-ai/Lucy-Edit-Dev вместе с весами и примерами использования. Можно запускать локально либо через интерфейс Decart AI, а также через Fal.ai, где Lucy Edit Dev доступен для “Video to Video” трансформаций.

ℹ️ Для работы нужна видеокарта с минимум ~8 ГБ памяти — модель достаточно тяжёлая из-за видеоданных и Wan 2.2 архитектуры. Онлайн-версия позволяет попробовать изменить видео сразу в браузере, без установки.

🔗 Попробовать: Lucy Edit Dev
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1🔥1
⚡️ SAIL-VL2 — новый SOTA в мультимодальных моделях

📌 SAIL-VL2 — новая модель от Douyin / ByteDance совместно с LV-NUS Lab, которая сочетает обработку изображений и текстовых задач в одном модуле. Она представлена в версиях около 2B и 8B параметров, и показывает отличные результаты не только на простых задачах вроде описания изображений, но и в сложной логике, OCR, анализе диаграмм и документации.

🔑Ключевая сила SAIL-VL2 — её “thinking-fusion” архитектура + продуманная предварительная обработка данных: модель обучалась на огромном датасете с качественной фильтрацией, включающем задания с изображениями, текстами, документами и видео. Это позволяет ей сохранять детали визуальных объектов, точно отвечать на вопросы по контенту и справляться с визуально-текстовыми задачами, где другие VLM-модели часто “спотыкаются”.

🖥 SAIL-VL2 уже доступна на Hugging Face (са­мые лёгкие модели), что позволяет тестировать её локально или через облачные сервисы. Это отличный выбор, если нужно работать с визуальным содержанием (картинки, сканы, диаграммы) и вести диалог с AI о том, что на изображении, без огромных ресурсов.

🔗 Попробовать: SAIL-VL2
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🎨 Lexica Art — не просто генератор, а мастерская визуальной идеи

📌 Lexica Art сочетает в себе мощный генератор изображений и огромную галерею готовых AI-картинок, где видно не просто результат, а весь путь: промт, параметры, seed. Это позволяет не просто брать “красивые картинки”, а учиться видеть, почему они выглядят так, как выглядят — полезно и для новичков, и для профи.

📌 Интерфейс Lexica Art удобен: можно сразу видеть примеры работ в нужном стиле, нажав на галерею, изучить параметры генерации, скопировать промт и адаптировать под свою задачу. Генерация работает прямо в браузере, промты легко изменить, и почти нет барьеров входа — нет сложных настроек, всё визуально и понятно.

ℹ️ Lexica Art особенно хороша для тех, кто делает визуальный контент — маркетологи, дизайнеры, художники, создатели соцсети. Если нужен быстрый поиск вдохновения, подбор стиля или визуализация идеи — Lexica ускорит этот процесс. Плюс полезно в обучении, когда хочется понять, как детали промта влияют на итог: цвета, композиция, стилизация — всё видно.

🔗 Попробовать: Lexica Art
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2👍1
🍿 VoxDeck — интерактивные и динамичные презентации с помощью ИИ

📌 VoxDeck — это AI-сервис, который превращает простые идеи или документы в визуально убедительные презентации: двигающиеся обложки, 3D-диаграммы, аватары, готовые шаблоны. Всё, что требуется — описать тему, добавить детали, и VoxDeck создаёт дизайн, структуру слайдов и визуальную подачу.

🔑 Бесплатный план даёт лимит на количество слайдов/cлайдов-блоков на проект, а также кредиты, позволяющие начать экспериментировать без вложений. Платные тарифы расширяют возможности: больше слайдов за раз, приоритетный доступ к эффектам, возможность использования 3D-элементов, настройки шаблонов и аватаров.

🖥 VoxDeck особенно полезен тем, кто хочет быстро и без дизайнера подготовить презентацию, учебный материал или маркетинговую презентацию — визуально богатую, с движением, интерактивностью, которая удерживает внимание.

🔗 Попробовать: VoxDeck
Please open Telegram to view this post
VIEW IN TELEGRAM