Источник КодХаб
6.3K subscribers
821 photos
80 videos
863 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
🌐 QTune: open-source студия для файнтюнинга без кода

📌 QTune — это не просто набор утилит, а полноценное десктопное приложение с графическим интерфейсом, которое превращает файнтюнинг в управляемый процесс, доступный даже новичкам. В отличие от классических пайплайнов, требующих кучи скриптов и терминальных команд, QTune разбивает всё на логические этапы: подготовка датасета, выбор модели, настройка обучения, запуск и финальная конвертация. За счёт QLoRA технология становится реально доступной на потребительских видеокартах — для задач, где раньше требовались серверные GPU.

📌 Подготовка данных реализована через "Conversation Builder" — интерактивный чат, где можно быстро собрать датасет под конкретный стиль общения. Далее пользователь выбирает базовую модель с Hugging Face и задаёт параметры обучения. Опытные разработчики получают полный контроль над QLoRA-конфигурацией (rank, alpha, dropout, выбор модулей), а новички могут просто оставить дефолтные значения. Логи обучения отображаются в реальном времени, позволяя отслеживать метрики и процесс.

📌 После обучения QTune автоматически объединяет LoRA-адаптер с базовой моделью и предлагает удобные инструменты для финальной упаковки: квантизацию в формат GGUF или прямую интеграцию с Ollama. В результате пользователь получает готовую к работе локальную модель, которую можно запустить одной командой в терминале. Таким образом, QTune превращает процесс файнтюнинга из сложного инженерного квеста в понятный и практически «одно-кнопочный» процесс.

🔗 Попробовать: QTune
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
This media is not supported in your browser
VIEW IN TELEGRAM
⚠️ VibeTest — ИИ-агент для автоматического тестирования сайтов и QA

📌 VibeTest — это инструмент, который запускает множество ИИ-агентов через Browser-Use и проверяет ваш сайт на UI-баги, битые ссылки, проблемы с доступностью и другие технические недочёты.

📌 Агенты работают параллельно и могут тестировать как живые сайты, так и локальные разработки, что делает VibeTest удобным для использования в CI или перед релизом.

ℹ️ Схема запуска: вы устанавливаете Python-в виртуальное окружение, добавляете MCP-сервер VibeTest и подключаете его к Claude или Cursor — после этого просто даёте команду вроде Vibetest my website with 5 agents и получаете отчет.

🔗 Попробовать: VibeTest
Please open Telegram to view this post
VIEW IN TELEGRAM
2
⭐️ Goblin Tools — AI-ассистент, который разбивает хаос на понятные шаги

📌 Goblin Tools — веб-сервис и мобильное приложение, состоящее из набора простых «мини-инструментов», призванных помочь справляться с перегрузкой задач. Он особенно популярен среди людей с ADHD и теми, кому тяжело структурировать большие проекты — его часто упоминают как способ превратить “слишком много” в конкретные понятные шаги.

📌 Один из ключевых модулей — Magic ToDo — превращает одну общую задачу в список подзадач, которые вы можете настроить детализацию (“сколько мелких шагов”). Есть и другие инструменты: Compiler превращает мозговой штурм (бездумные записи) в план действий, Estimator оценивает время выполнения, Formalizer меняет стиль текста, Judge анализирует тон и намерения текста и др.

ℹ️ С точки зрения UX, Goblin Tools доступен онлайн бесплатно, а также как мобильное приложение под iOS и Android (приложения содержат покупки, но веб-версия обещает оставаться бесплатной). Это делает его удобным выбором для тех, кто хочет начать без обязательств, но получить помощь в управлении задачами прямо сейчас.

🔗 Попробовать: Goblin Tools
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
🖥 Dazl — полноценные приложения с помощью ИИ

📌 Dazl — это платформа, которая превращает простые текстовые промпты в работающие веб-приложения. ИИ-агент понимает вашу идею, генерирует интерфейсы, логику и структуру — и всё это остаётся под вашим контролем: вы можете править дизайн, структуру и код через чат и визуальный редактор.

📌 Платформа обеспечивает полную прозрачность — вы можете смотреть, как устроена ваша система: иерархия компонентов, логика, код, текущее состояние приложения доступны для просмотра и редактирования.

ℹ️ Бесплатный тариф Dazl предлагает 5 генераций в день (до 150 в месяц) и неограниченные визуальные правки.

🔗 Попробовать: Dazl
Please open Telegram to view this post
VIEW IN TELEGRAM
5🔥2
📷 Изменяем ракурс на фото: ИИ-инструмент для виртуальной камеры

📌 На Hugging Face вышла модель Qwen-Edit-2509 Multiple-Angles, которая позволяет поворачивать виртуальную камеру вокруг объекта на уже готовом изображении — менять угол, приближать, менять перспективу.

📌 Вот что она может:
🟢 Поворот камеры на ±45°, зум (приближение/удаление), вертикальный наклон (сверху или снизу), а также режим широкого угла или крупного плана.
🟢 При изменении ракурса нейросеть сама «дорисовывает» скрытые части сцены — фон, текстуры, тени — чтобы результат выглядел естественно.
🟢 Можно использовать в ComfyUI или других пайплайнах с LoRA; инструкция по работе с промптами и настройке есть у автора.


🔗 Попробовать: Qwen-Edit-2509 Multiple-Angles
Please open Telegram to view this post
VIEW IN TELEGRAM
11🔥1
🤖 MiroThinker — новая мощная нейронка для глубоких исследований

📌 MiroThinker v1.0 — открытая модель-агент от MiroMind AI, которая оптимизирована для сложного, многошагового исследования: планирования, поиска информации, анализа и действий.

📌 Ключевая особенность — interactive scaling: модель работает в цикле подумать → действовать → наблюдать и способна вести до 600 последовательных шагов взаимодействия с инструментами, сохраняя контекст до 256 000 токенов.

ℹ️ По данным разработчиков, MiroThinker хорошо справляется с бенчмарками глубоких исследований (например, GAIA-Text-103), достигая 60,2%, при этом полностью открыта: доступны модельные веса, код фреймворка MiroFlow и среда для агентного использования.

🔗 Попробовать: MiroThinker
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21
⚡️ Nano Banana Pro теперь безлимитно и бесплатно на LMarena

📌 Теперь есть возможность использовать Nano Banana Pro полностью бесплатно через платформу LMarena — никаких подписок, лимитов или регистрации.

📌 С помощью этой версии можно генерировать фотореалистичные изображения, создавать презентации, писать код и тексты — всё на базе одной мощной нейросети.

🔗 Попробовать: Nano Banana Pro
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯54🔥3
🔵 Napkin AI — когда мысли становятся картинками

📌 У тебя есть идея, концепт или просто абзац текста — а хочется, чтобы это выглядело как презентация, инфографика или понятная схема? Napkin AI превращает слова в визуал. Прямо в браузере. Без дизайнеров, фигм и шрифтовой боли.

📌 Что это вообще такое?
Napkin — это веб-сервис, который превращает текст в визуальные слайды, инфографику, mind map'ы или диаграммы. Выглядит как если бы Google Docs, Miro и PowerPoint слились в одного удобного нейро-монстра.

✍️ Как работает:
🟢Вводишь идею, описание, план или даже просто поток мыслей
🟢Нажимаешь одну кнопку
🟢Получаешь чистую визуалку, где всё логично, красиво и структурировано


📊 Что именно можно получить:
🟢Инфографику по своему тексту
🟢Слайды в минималистичном или корпоративном стиле
🟢Умные карты, диаграммы, схемы
🟢Экспорт в PDF / PPT / PNG / SVG
🟢Возможность редактировать всё: от цвета до иконок


🌍 Поддержка 50+ языков
👥 Совместная работа с коллегами
🔗 Можно делиться, комментировать, собирать фидбек прямо в проекте

⚠️ Минусы
🟢Иногда выходит скучновато или не в тему — всё равно править придётся.
🟢Но как заготовка или старт — топ.


🔗 Попробовать можно тут: Napkin AI
Please open Telegram to view this post
VIEW IN TELEGRAM
3
🖥 Claude Opus 4.5 от Anthropic — апгрейд для кода, агентов и сложных задач

📌 Anthropic выпустила модель Claude Opus 4.5, которую называют наиболее интеллектуальной в своём портфеле — с улучшенным кодированием, долгосрочным рассуждением и агентскими способностями.

📌 По данным Anthropic, Opus 4.5 показывает высочайшие результаты в тестах разработки: код, планирование, отладка — модель может работать автономно над сложными проектами. Она также эффективнее расходует токены — по данным компании, потребляет значительно меньше, сохраняя при этом высокое качество.

ℹ️ Модель доступна через чат Claude (для подписок Pro, Max и выше), а также по API. Стоимость — $5 за миллион входных токенов и $25 за миллион выходных.

🔗 Попробовать: Claude Opus 4.5
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
📦 FLUX 2 — новый конкурент Nano Banana

📌 FLUX 2 — новая модель от Black Forest Labs (разработчиков Stable Diffusion), которая выводит генерацию изображений на новый уровень: фотореализм, продвинутое освещение, физически корректные тени и реалистичные детали делают результаты почти неотличимыми от настоящих фото.

📌 У FLUX 2 заметно улучшена стабильность: модель умеет работать с несколькими референс-изображениями, сохранять консистентность персонажей и объектов при повторных генерациях и делать выверенную композицию, что критично для визуалов, рекламы и коммерческих макетов.

ℹ️ Кроме генерации с нуля, FLUX 2 поддерживает редактирование и доработку — можно комбинировать изображения, править свет, фон, текстуры, цветокоррекцию. Это уже не просто арт-инструмент, а полноценное решение для продакшн-визуала.

🔗 Попробовать: FLUX 2
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2
📢 MiMo-Audio — новая речь от Xiaomi в мире LLM

📌 Xiaomi представила MiMo-Audio — продвинутую модель для генерации и понимания речи. Она обучена на колоссальном датасете — более 100 миллионов часов аудио, что позволило ей научиться обрабатывать голосовые запросы максимально точно и гибко. В основе лежит уникальная схема токенизации, которая делает работу модели более быстрой и экономной.

📌 Обучение MiMo-Audio проходит в два этапа: сначала модель занимается реконструкцией звука, а затем — генерацией речи. Такой подход обеспечивает естественное звучание и высокую разборчивость аудио, что выводит её в один ряд с топовыми системами. В бенчмарках Xiaomi отмечает, что MiMo-Audio показывает результаты, сопоставимые с Gemini 2.5 Flash от Google, что делает её одним из самых сильных игроков в сегменте speech-to-speech и speech-to-text моделей.

🖥 Модель уже доступна исследователям и разработчикам: исходники и веса можно найти на GitHub и HuggingFace. Это открывает простор для экспериментов — от голосовых ассистентов до систем генерации аудио-контента нового поколения.

🔗 Попробовать: MiMo-Audio
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1🤔1
🖥 Dreamina AI — генератор фото и видео от ByteDance для соцсетей и контентмейкеров

📌 Dreamina AI — это встроенный в экосистему CapCut инструмент от ByteDance, который позволяет превращать текстовые описания или картинки в изображения, короткие видеоролики и анимации.

📌 Модель ориентирована на быструю генерацию визуального контента: картинок для постов, обложек, превью, анимаций и коротких клипов — всё, что может пригодиться для Reels, TikTok, сторис и прочих форматов.

ℹ️ Кроме генерации с нуля, Dreamina даёт инструменты для редактирования: апскейл, улучшение качества, встройку изображений в видео, анимацию фото, подкрутку ракурсов и световых эффектов.

🔗 Попробовать: Dreamina AI
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
🖥 GigaChat 3 — открытая мощная LLM-семейство под MIT-лицензией

📌 GigaChat 3 — набор моделей, которые выпущены с открытым исходным кодом и разрешением коммерческого использования. В релиз вошли две ключевые версии:
🟢GigaChat 3 Ultra Preview — флагманская MoE-модель (~702 млрд параметров, с ~36 млрд активных на токен), обученная с нуля, с поддержкой длинного контекста (~131k токенов).
🟢GigaChat 3 Lightning — более лёгкая, компактная и быстрая модель, подходящая для локального запуска, чат-ботов и высоконагруженных задач.


📌 Что даёт GigaChat 3 для разработчиков и исследователей:
🟢Благодаря лицензии MIT и открытым весам — можно запускать модели локально, дообучать их под свои задачи, интегрировать в свои продукты, не покупая подписки.
🟢Архитектура MoE + специфические оптимизации (включая MLA и MTP) делают возможным эффективный инференс даже при огромном размере модели — это реально большой шаг для LLM-экосистемы с открытым кодом.
🟢Универсальность: модели уместны как для генерации текста, так и для кода, математических задач, анализа больших документов, мультиязычных задач и пр.


🔗 Попробовать: GigaChat 3
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21🔥1
🖥 DeepSeek-Math-V2 — ИИ, который реально решает серьёзную математику

📌 DeepSeek-Math-V2 — новая открытая модель от DeepSeek, с уклоном под задачи математического рассуждения и доказательств.

📌 Главная фишка — схема генератор + верификатор: сначала модель предлагает решение, потом сама проверяет каждый шаг, исправляя ошибки до 16 раз. Это даёт не просто ответ, а проверяемое, логически выстроенное доказательство.

ℹ️ Результаты впечатляют: золото на International Mathematical Olympiad (IMO 2025), высокие баллы на других престижных соревнованиях и приличные показатели на математических бенчмарках.

🔗 Попробовать: DeepSeek-Math-V2
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥21
🌐 Droplet3D — генерация 3D из видео и текста

ℹ️ Droplet3D — новый генеративный 3D-модельный фреймворк, который учится на огромном видео-датасете Droplet3D-4M с четырьмя миллионами 3D-объектов и плотными текстовыми описаниями вида под разными углами. Суть идеи: использовать видео как источник пространственной информации и "commonsense priors" — движения камер и объектов дают естественные ориенти­ры для создания реалистичных 3D-форм.

📌 Модель поддерживает вход как в виде текста, так и в виде изображения, выравнивает перспективу входного вида, генерирует мультивью siri surround-view изображения (85 кадров 360°) и из этого строит либо Gaussian splatting 3D-сцену, либо текстурированную сетку — всё в open-source.

🔗 Все компоненты открыты: датасет, код, архитектура и веса модели доступны на Hugging Face, GitHub и сайте проекта.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
⚡️ VARCO-VISION-2.0-1.7B — легкая мультимодальная модель от NCSOFT

📌 Модель VARCO-VISION-2.0-1.7B — это облегчённая версия флагманской системы NCSOFT, нацеленная на задачи визуального понимания и текстового взаимодействия. Она способна обрабатывать несколько изображений одновременно, извлекать текст с их пространственными границами (layout-aware OCR) и отвечать на вопросы по визуальному контенту, при этом оставаясь компактной и пригодной для запусков на устройствах с ограниченными ресурсами.

📌 Одним из ключевых усилений VARCO-VISION-2.0 по сравнению с предыдущей версией является улучшенное понимание корейского языка и культурного контекста, более точная генерация текстов и расширенная способность работать с многокадровыми и комплексными изображениями, такими как схемы, таблицы и макеты. Также реализована оптимизация, благодаря которой модель может работать на локальных устройствах — это делает её пригодной не только для облака, но и для приложений с ограниченными ресурсами.

🔗 Попробовать: VARCO-VISION-2.0-1.7B
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3
🔍 NotebookLM обновился — Deep Research и графика теперь в одном инструменте

📌 NotebookLM получил масштабное обновление: теперь появляется режим Deep Research, который способен самостоятельно собирать информацию из множества источников (веб-сайты, документы, таблицы, PDF и др.), анализировать её и формировать структурированные отчёты.

📌 Помимо этого, в NotebookLM встроена графическая нейросеть Nano Banana Pro — она позволяет быстро превращать полученные данные в визуальные материалы: инфографику, слайды, стильные иллюстрации или схемы, прямо внутри инструмента.

ℹ️ Теперь один инструмент покрывает весь цикл: от поиска и сбора информации, до её визуализации и упаковки в готовую презентацию.

🔗 Попробовать: NotebookLM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍43
😎 Kira.art — ИИ-редактор изображений

📌 Kira.art — веб-сервис, который позволяет работать с изображениями через обычный чат: загружаете картинку, описываете, что хотите изменить (фоны, цвета, объекты, стиль) — и нейросеть делает всё сама, без слоёв, кистей и сложных инструментов.

📌 Он предлагает функции вроде удаления/смены фона, удаления или добавления объектов, стилизации (арт-стиль, аниме, ретро и др.), а также апскейлинга — повышение качества изображения, устранение шума и чёткости, чтобы результат выглядел аккуратно.

ℹ️ Главное преимущество Kira.art — простота и скорость. Неважно, новичок вы или опытный дизайнер: не нужно изучать Photoshop; достаточно написать в чат «сделай фон морем» или «убери человека из кадра» — и получить изображение под цель, будь то соцсети, портфолио или просто арт.

🔗 Попробовать: Kira.art
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍3🔥2
🎧 Image to Music AI — превращаем картинку в мелодию одним кликом

📌 Image to Music V2 — бесплатный онлайн-инструмент, который анализирует загруженное изображение и генерирует музыку, подходящую по настроению, цветам и атмосфере картинки.

📌 Загружаете фото — ИИ распознаёт визуальные паттерны (цвет, свет, объекты, общую атмосферу) и на их основе создаёт аудиотрек. Это может быть фоновая музыка, эмбиент, атмосферный трек — всё под изображение.

ℹ️ Особенно удобно для креативщиков, видео-клипов, сторис или просто для музыкальных открыток.

🔗 Попробовать: Image to Music AI
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥32🤯2
🎨 Weavy — бесконечный холст для создания сложных AI-воркфлоу

📌 Weavy предлагает бесконечную холст-среду, где каждый шаг творческого процесса превращается в узел: загрузите промт – получите изображение; на его основе генерируйте текстуру и фон; затем превратите результат в 3D-модель и анимируйте. Всё это — в едином интерфейсе с возможностью ветвления и управления процессом.

📌 Платформа использует нод-ориентированную структуру: от каждого узла можно ответвить отдельный путь, изменить направление, подключить новую модель — например, AI-генератор изображений, 3D-анимацию или видео-эффекты. Weavy интегрирует топ-AI-модели вроде Veo 3, Imagen 3 и Stable Diffusion 3.5 и позволяет комбинировать их в одном сессии.

ℹ️ Weavy недавно был приобретён Figma и станет частью её экосистемы под именем Figma Weave — что указывает на стратегию использования инструментов объединения AI-моделей и дизайн-редакторов в одном интерфейсе.

🔗 Попробовать: Weavy
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🐟 Fish Audio S1 — TTS для видео, подкастов и озвучки

📌 Fish Audio S1 — нейросеть, которая превращает текст в речь с реалистичным голосом, позволяя клонировать голоса, добавлять эмоции и озвучивать ролики, книги, подкасты или любые другие медиа.

📌 Система поддерживает десятки языков — английский, китайский, японский, корейский и др. — и умеет озвучивать на любом из них, сохраняя естественность и интонацию.

ℹ️ Бесплатный старт: можно получить час озвучки и попробовать функцию клонирования голоса без подписки. При желании доступны премиум-настройки: управление эмоциональностью, тембром, паузами, скоростью речи — всё, чтобы итог звучал максимально профессионально.

🔗 Попробовать: Fish Audio S1
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥1🤔1