Источник КодХаб
6.3K subscribers
822 photos
81 videos
865 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
🔥 Midjourney запускает Style Explorer V1 — визуальный браузер стилей в прямом эфире

📌 Midjourney представил Style Explorer V1, инновацию, которая меняет способ работы с визуальным стилем. Это интерактивный инструмент в веб-интерфейсе Explore → Styles, где вы можете:
🟢Просматривать галерею миниатюр — каждый показывает результат вашего промта с уникальным кодом стиля (sref).
🟢Наводите курсор — сразу видите, как каждый стиль изменит ваш изображение.
🟢С помощью кнопки "Try Style" единственным кликом применяете стиль к вашему текущему промту.
🟢Сохраняйте понравившиеся стили в избранное — удобно возвращаться к любимым эффектам.
🟢Воспользуйтесь fuzzy-поиском: вбейте «photographic» или «anime», и инструмент сам найдёт подходящий стиль.


📌 Style Explorer V1 — это как музыкальный плеер, но для визуального вайба: листаете, пробуете, сохраняете, а не записываете коды вручную. Отличный способ исследовать мир визуальных настроек Midjourney.

🔗 Попробовать: Style Explorer V1
Please open Telegram to view this post
VIEW IN TELEGRAM
🌐 Alibaba представила Qwen3-Max-Preview (Instruct): флагман с триллионом параметров

📌 Qwen3-Max-Preview — это крупнейшая на сегодня языковая модель от Alibaba с более чем триллионом параметров. Она появилась 5 сентября 2025 года и теперь доступна через веб-чата Qwen, API Alibaba Cloud, OpenRouter и AnyCoder на Hugging Face.

📌 Модель выделяется выдающейся производительностью. Внутренние бенчмарки показывают, что Qwen3-Max-Preview превосходит предыдущую топ-модель Qwen3-235B и конкурирует наравне с лучшими на рынке: Claude Opus 4 и DeepSeek-V3.1 по таким задачам, как программирование, решение математических задач и логика.

📌 Кроме того, Qwen3-Max-Preview поддерживает гигантский контекст — до 262 144 токенов — что позволяет обрабатывать широкие документы и коды без потери контекста.

🔗 Попробовать: Qwen3-Max-Preview (Instruct)
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
🌐 Daisy — единое окно для всех топовых LLM

📌 Daisy — это не просто чат-бот, а полноценный AI-сервис, который объединяет в одном интерфейсе разные языковые модели и мультимодальные инструменты. Пользователь видит привычный чат, но внутри работает сложная архитектура: модели подключаются по задаче, есть маршрутизация запросов, модуль распознавания документов, генерации изображений и семантического поиска.

📌 Основная фишка — можно работать с GPT, Claude, Gemini, Grok, DeepSeek и другими, в одном окне, без переключения между сервисами. Например, собрать план статьи с одной моделью, подтянуть фактуру через поиск с другой, затем вызвать генерацию кода, картинки и подзакрыть всё вторым промтом — всё в одном диалоге.

📌 Под капотом Daisy — связка маршрутизатора запросов, собственного контент-фильтра, модулей авторизации и тарификации, и логики fallback-планов: если нужно — запрос уходит на другую модель или на внутреннюю ручную обработку. Такой подход позволяет строить сложные AI-пайплайны в одном UI и гибко масштабировать под любые сценарии.

🔗 Попробовать: Daisy
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍2
💻 Apertus — швейцарский open-source LLM

ℹ️ Apertus — это полностью открытая языковая модель, разработанная EPFL, ETH Zurich и Швейцарским национальным суперкомпьютерным центром (CSCS) в рамках Swiss AI Initiative. Название с латиницы переводится как «открытый» — и модель оправдывает своё имя: полностью прозрачная архитектура, данные и рецепты обучения доступны сообществу.

🧑‍💻 Apertus выпускается в двух вариантах: небольшой (8 B параметров) для локального или исследовательского использования, и крупной (70 B) — для коммерческих приложений и систем. Обучена на 15 трлн токенов данных, поддерживает более 1 800 языков, включая мало представленные: швейцарский диалект немецкого, ратороманский и др.

🖥 Модель ориентирована на прозрачность и доверие: при её обучении соблюдались правила GDPR, швейцарского авторского права и EU AI Act. Использовались только данные из публичного домена и сайты, которые явно не возражали против включения в тренинг (opt-out).

ℹ️ Попробовать: Apertus
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍2
🔵 Recon AI — инструмент от Protect AI для автоматического red teaming LLM-систем. Использует более 450 сценариев атак (jailbreak, prompt injection и др.) для тестирования безопасности AI-приложений. Поддерживает кастомные атаки, экспортирует отчёты (CSV, JSON) и интегрируется с OWASP LLM, CVSS и другими стандартами.

🎯 Особенности:
🟢450+ встроенных атак (prompt injection, jailbreak и др.)
🟢Поддержка кастомных payload’ов
🟢Экспорт отчётов (JSON, CSV)
🟢Интеграция с OWASP LLM и CVSS


⚙️ Архитектура и параметры:
🟢AI-агент с движком атак
🟢Работает через CLI и API
🟢Контекстное и семантическое тестирование
🟢Поддерживает ручной и автоматический режим


👍 Преимущества:
🟢Ускоряет поиск уязвимостей
🟢Интегрируется в DevSecOps
🟢Гибкий, настраиваемый подход


🔗 Попробовать: Recon AI
Please open Telegram to view this post
VIEW IN TELEGRAM
2
🌐 Droplet3D — генерация 3D из видео и текста

ℹ️ Droplet3D — новый генеративный 3D-модельный фреймворк, который учится на огромном видео-датасете Droplet3D-4M с четырьмя миллионами 3D-объектов и плотными текстовыми описаниями вида под разными углами. Суть идеи: использовать видео как источник пространственной информации и "commonsense priors" — движения камер и объектов дают естественные ориенти­ры для создания реалистичных 3D-форм.

📌 Модель поддерживает вход как в виде текста, так и в виде изображения, выравнивает перспективу входного вида, генерирует мультивью siri surround-view изображения (85 кадров 360°) и из этого строит либо Gaussian splatting 3D-сцену, либо текстурированную сетку — всё в open-source.

🔗 Все компоненты открыты: датасет, код, архитектура и веса модели доступны на Hugging Face, GitHub и сайте проекта.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
🌐 EmbeddingGemma — компактная многоязыковая модель поиска от Google

ℹ️ EmbeddingGemma — новая легковесная модель текстовых эмбеддингов от Google DeepMind и Gemma 3, рассчитанная на работу прямо на ноутбуке или смартфоне без облака.
Она содержит около 308 миллионов параметров и поддерживает более 100 языков.

📌 Главная фишка — Matryoshka Representation Learning: модель может выдавать векторы разного размера (от 128 до 768 измерений) в зависимости от задачи и ресурсов устройства, без необходимости переобучения.

📌 Это позволяет балансировать скорость, точность и использование памяти, делая EmbeddingGemma универсальным инструментом для локального поиска, RAG-пайплайнов и кластеризации текстов.
Google также подчёркивает, что модель работает быстро (генерация эмбеддингов менее чем за 22 мс на EdgeTPU) и требует меньше 200 МБ RAM благодаря квантованию.

📌 При этом по эффективности в задачах поиска и семантического сходства EmbeddingGemma демонстрирует лучшие показатели среди всех моделей до 500M параметров.

🔗 Попробовать: EmbeddingGemma
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1🔥1
🔵 BackAnt — AI-сервис, который по описанию задачи на естественном языке генерирует полноценный REST API: включая код, базу данных, документацию и тесты. Можно сразу развернуть или скачать исходники.

🎯 Особенности:
🟢Генерация backend за 1–2 минуты
🟢Чистый, читаемый код
🟢Поддержка Swagger, тестов и миграций
🟢Визуальный редактор запросов
🟢Экспорт и деплой в один клик


⚙️ Архитектура и параметры:
🟢Язык: Node.js (Express)
🟢База данных: PostgreSQL
🟢Авторизация: JWT
🟢Формат API: REST + JSON
🟢Выход: исходники и документация


👍 Преимущества:
🟢Ускоряет MVP и прототипы
🟢Не требует глубоких знаний backend
🟢Нет vendor-lock, можно развернуть на любом сервере
🟢Поддержка кастомной логики через promt-инструкции


🔗 Попробовать: BackAnt
Please open Telegram to view this post
VIEW IN TELEGRAM
🌐 Jules

Что такое Jules?
Jules — AI-ассистент от Google для автоматизации задач в GitHub: исправление багов, обновление зависимостей, создание pull-запросов.

📌 Основные возможности
⭐️Автономный анализ и изменение кода
⭐️Интеграция с GitHub
⭐️Поддержка Python и JavaScript

⚙️ Примеры использования
⭐️Автообновление библиотек
⭐️Рефакторинг кода
⭐️Автосоздание pull-запросов

👀 Кому подойдёт
⭐️Разработчикам и командам
⭐️Менеджерам проектов
⭐️Обучающимся программированию

📎 Подробнее: Jules
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥1
🌐 BitNet b1.58 2B4T — первая в мире открытая 1-битная LLM на 2 млрд параметров

📌 BitNet b1.58 2B4T — это новая модель Microsoft Research, где веса обучаются изначально в тернарной форме (−1, 0, +1), то есть фактически занимают 1.58 бита. Она была обучена на 4 триллионах токенов и показывает сопоставимую с полноточечными моделями эффективность, но с впечатляюще малыми затратами памяти, энергии и времени вывода.

📌 Главное преимущество BitNet — её экстремальная компактность и производительность. Внедрена quantized архитектура BitLinear, активации в 8-битах, и специальная реализация bitnet.cpp, которая позволяет очень быстро запускать модель на CPU и устройствах с низкими ресурсами. По оценкам, модель занимает всего около 0.4 ГБ в памяти и работает быстрее и экономичнее аналогов из-за низкоточных весов.

📌 Модель находится в открытом доступе на Hugging Face (microsoft/bitnet-b1.58-2B-4T), и её можно запускать через bitnet.cpp или библиотеку transformers, хотя в последней полная эффективность quantization ещё не реализована.

🔗 Попробовать: BitNet b1.58 2B4T
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥4👍2
🔥 Baidu представила ERNIE X1.1 и ERNIE 4.5-21B-A3B-Thinking

ℹ️ ERNIE X1.1 — усиленная версия reasoning-модели, которая по фактам (factual accuracy) стала сильнее на 34.8 %, а по следованию инструкциям — на 12.5 % по сравнению с ERNIE X1.

🧑‍💻 Baidu утверждает, что X1.1 обходит DeepSeek R1-0528 и в ряде задач почти достигает уровня GPT-5 и Gemini 2.5 Pro. Модель доступна через ERNIE Bot, Wenxiaoyan и на платформе MaaS от Baidu AI Cloud.

🖥 ERNIE 4.5-21B-A3B-Thinking — это стратегически компактная MoE-модель: общая архитектура 21 млрд параметров, но активируется всего 3 млрд параметров на токен, что повышает эффективность использования ресурсов. Она поддерживает чрезвычайно длинный контекст — до 128К токенов, интегрирована с инструментами (tool usage) и лицензирована под Apache-2.0, что делает её подходящим вариантом как для исследований, так и коммерческого применения.

🔗 Попробовать:
Модель ERNIE 4.5-21B доступна на Hugging Face
Попробовать X1.1 можно на сайте бота от Baidu
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍1🔥1
⚡️ Hailuo AI — 7-дневный безлимит на Start/End Frames

ℹ️ Hailuo запустил новую акцию: целую неделю можно генерировать видео с неограниченным контролем начального и конечного кадров (Start/End Frames) — то есть буквально «рискуйте»: задавайте движение, композицию и переходы, сколько хотите. Такая опция даёт полный творческий контроль над тем, как кадр начинается и заканчивается, что особенно круто для сторителлинга и визуальной динамики.

🖥 Веб-интерфейс Hailuo прост — на сайте можно зайти в раздел генерации видео, выбрать Start/End Frame, загрузить изображение-референс или просто ввести текстовый промт, и система сама построит анимацию, начиная и заканчивая там, где вы хотите. Пользователи отмечают, что можно делать кинематографичные ролики без огромных вычислительных мощностей.

🧑‍💻 Акция проходит в рамках челленджа: помимо бесплатного доступа Hailuo предлагает призы и подписки участникам, которые делают интересный визуальный контент. Отличная возможность протестировать Start/End фреймы на практике — и, если понравится, потом можно подумать о подписке или использовать продвинутые модели от Hailuo.

🔗 Попробовать: Hailuo AI
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥1👨‍💻1
📸 Seedream 4.0 — новый уровень AI-картинок от ByteDance

📌 Seedream 4.0 — это объединённый движок генерации и редактирования изображений, разработанный в ByteDance Seed. Он умеет работать с текстовыми промптами, загруженными референсами и правками по описанию, всё в одной модели.

📌 Модель поддерживает разрешения до 4K (4096×4096 пикселей), работает очень быстро и конкурентоспособна с Google-моделями вроде Nano Banana по внутренним оценкам ByteDance. Также она умеет парой фраз удалить или добавить объект, изменить фон или цвет, перестроить композицию — в тихом режиме prompt-based editing.

📌 Seedream 4.0 доступен на Higgsfield.ai — в разделе advanced image editing (можно выбрать Seedream как движок). Также её можно запустить через Fal.ai или на Imagine.Art в разделе multi-modal generation.

🔗 Попробовать: Seedream 4.0
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🎨 Reve Image 1.0: когда AI понимает ваши промты

📌 Reve Image (кодовое имя Halfmoon) — это новая генеративная модель с большим акцентом на точное выполнение промтов, эстетическое качество и работу с текстом внутри картинки. Модель обучена с нуля и предназначена для авторов, дизайнеров и тех, кто хочет создавать визуальный контент без “гаданий” и лишнего хаоса в выдаче.

📌 Первые отзывы крайне позитивные: Reve хвалят за реалистичную анатомию, особенно руки и жесты, стабильную цветопередачу и способность создавать читаемый текст (логотипы, стикеры, подписи) прямо на изображении. Пользователи отмечают, что запускать Reve намного проще, чем Midjourney или Flux, и что она быстрее “догоняет” задумку без десятков уточнений.

Reve доступна в бесплатной preview-версии.

🔗 Попробовать: Reve Image 1.0
Please open Telegram to view this post
VIEW IN TELEGRAM
🌐 Phi-4: новая эра компактных reasoning-моделей от Microsoft

📌 Phi-4 — это 14-миллиардная модель из семейства Phi Small Language Models (SLM), созданная Microsoft Research для задач сложного рассуждения, математики, кодинга и логики. Особенность Phi-4 в том, что она показывает производительность, сравнимую с гораздо более крупными моделями, но при этом остаётся эффективной даже в условиях ограниченных ресурсов.

📌 Модель обучалась не просто на web-данных, но и на тщательно подобранных синтетических reasoning-датасетах, а затем дообучена через supervised fine-tuning на демонстрациях рассуждений и цепочек вычислений. В некоторых вариациях (Phi-4-reasoning, Phi-4-reasoning-plus) используется reinforcement learning для усиления качества долгих рассуждений и построения логически связных ответов.

📌 Благодаря высокому уровню reasoning-способностей и умеренным ресурсным требованиям, Phi-4 отлично подойдёт для создания агентов, RAG-пайплайнов и сценариев, где требуются "умные ответы" с вычислительной нагрузкой, но без гигантского железа.

🔗 Попробовать: Phi-4
Please open Telegram to view this post
VIEW IN TELEGRAM
4🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
🧠 Genspark AI Browser — браузер, который сам работает за вас

🌐 Разработчики Genspark запустили AI-браузер, в котором можно запускать локальные LLM прямо на устройстве — без облака, без подписок и с максимальной приватностью.

🧑‍💻 Под капотом — 169 открытых моделей (Gemma, DeepSeek, даже GPT-семейства), плюс встроенные агенты, которые умеют автоматизировать рутинные задачи: анализ веб-страниц, заполнение таблиц, сравнение цен, поиск информации и многое другое.

ℹ️ В Genspark есть “Autopilot Mode” — режим, когда браузер сам прокручивает сайты, собирает нужный материал, переходит по ссылкам и может даже управлять формами без вашего вмешательства. А встроенный блокировщик рекламы делает серфинг быстрее и чище.

🔗 Попробовать: Genspark AI Browser
Please open Telegram to view this post
VIEW IN TELEGRAM
👍42
⚡️ Falcon 3 — эффективная open-source LLM от TII

📌 Falcon 3 — семейство трансформерных языковых моделей с параметрами от 1 B до 10 B, разработанное Technology Innovation Institute (Абу-Даби). Модели выпускаются в вариантах Base и Instruct, и оптимизированы под задачи reasoning, генерации кода, математики и краткого диалога.

📌 Falcon 3 тренирована на массивном корпусе — около 14 триллионов токенов (более чем вдвое больше предыдущих поколений), что помогло улучшить качество на задачах «понимания текста» и «следования инструкциям». Контекст может доходить до 32 К токенов (в зависимости от варианта модели), что позволяет работать с объемными документами и кодом.

📌 Falcon 3 часто упоминается в обзорах как одна из самых быстрых и «доступных» open-source моделей на 2025 год. Её легко запустить локально через Hugging Face.

🔗 Попробовать: Falcon 3
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥1
🧠 Manus AI — автономный агент, который превращает идеи в действия

ℹ️ Manus AI, разработанная стартапом Monica.im (Butterfly Effect), — это первый в мире полноценный автономный агент общего назначения, запущенный в марте 2025 года. Он создан не просто чтобы «отвечать на запросы», а чтобы сам планировать, запускать инструменты и достигать конечного результата — будь то построение аналитического отчёта, генерация кода, маркетинговая стратегия или организация поездки.

🖥 В основе стоит модульная архитектура с динамическим планированием: Manus разбирает запрос, создаёт пошаговый план, вызывает нужные инструменты (браузер, редакторы, базы данных, API-интеграции) и контролирует выполнение каждой задачи. В среднем Manus делает около 50 вызовов инструментов за задачу, перерабатывая свой список дел (TODO) в реальном времени, чтобы не отвлекаться от цели.

🧑‍💻 Одной из последних новинок стала функция Wide Research — Manus может запускать одновременно сотни независимых агентов, каждый из которых изучает часть сложной задачи (например, продуктовый анализ, веб-скрапинг, автоматическая генерация отчётов и презентаций) и возвращает свои выводы, из которых главный агент формирует итоговый результат.

🔗 Попробовать: Manus AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🔥1
🔥 Genie 3 — текст в живой виртуальный мир от DeepMind

📌 Genie 3 — первая в своём роде генеративная world model, которая создаёт интерактивные 3D-среды в реальном времени на основе текстового промта.

📌 Вы можете буквально «зайти» в созданный мир (например, лавовый ландшафт, тропический лес или промышленное помещение), перемещаться по нему с видом от первого лица и взаимодействовать с объектами — всё это в 720p, 24fps, с сохранением логики и памяти мира на протяжении нескольких минут. Мир реагирует, если вы изменяете что-то — например, добавить дождь, переместить предмет или изменить погоду.

🧑‍💻 С технической точки зрения Genie 3 обучалась на видеоданных из Интернета и сама вывела физику объектов, динамику освещения и многослойную долговременную память сцены — без явного кодирования законов природы или заданных физических моделей.

🔗 Попробовать: Genie 3
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1
🎹 Mozart AI — co-producer в вашем браузере

📌 Mozart AI — это скорее интеллектуальная музыкальная DAW (Digital Audio Workstation), а не просто генератор лупов. Платформа работает как полноценная студия: вы даёте промт или загружаете фото/мелодию — и AI помогает сгенерировать трек, добавить вокал, подобрать семплы и даже сделать сведение одним кликом.

📌 У Mozart AI есть несколько интересных фич — TAB Mode, когда AI подсказывает мелодию, гармонию и ударные с учётом контекста, semantic sample search из вашей библиотеки (AI подбирает подходящий звук под настроение), а один промт может сразу привести к сведению (compression, side-chain и другие эффекты).

📌 Судя по отзывам, Mozart AI пока не полностью убила Suno, но идея серьёзна — сюда не просто “вбиваешь текст и получаешь песню”, а получаешь творческого партнёра, который может слушать, отвечать и редактировать с учётом музыкального контекста.

🔗 Попробовать: Mozart AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2