Источник КодХаб
6.3K subscribers
821 photos
80 videos
863 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
🌐 Droplet3D — генерация 3D из видео и текста

ℹ️ Droplet3D — новый генеративный 3D-модельный фреймворк, который учится на огромном видео-датасете Droplet3D-4M с четырьмя миллионами 3D-объектов и плотными текстовыми описаниями вида под разными углами. Суть идеи: использовать видео как источник пространственной информации и "commonsense priors" — движения камер и объектов дают естественные ориенти­ры для создания реалистичных 3D-форм.

📌 Модель поддерживает вход как в виде текста, так и в виде изображения, выравнивает перспективу входного вида, генерирует мультивью siri surround-view изображения (85 кадров 360°) и из этого строит либо Gaussian splatting 3D-сцену, либо текстурированную сетку — всё в open-source.

🔗 Все компоненты открыты: датасет, код, архитектура и веса модели доступны на Hugging Face, GitHub и сайте проекта.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21
💬 OnlyGPT Humanizer — делает AI-текст неузнаваемым

📌 OnlyGPT Humanizer — это веб-инструмент, входящий в экосистему AidetectPlus. Он позволяет переписать AI-сгенерированные тексты (например, эссе, блоги, статьи) так, чтобы они проходили проверку на оригинальность и звучали "по-человечески".

📌 Инструмент адаптирован для всех версий GPT (2, 3, 4 и др.) и утверждает до 96 % точности в обходе AI-детекторов, при этом сохраняя грамматику и стиль.

📌 Многие отмечают, что OnlyGPT Humanizer действительно улучшает текст, при этом внося минимум изменений. Некоторые сравнивают его с аналогами, и говорят, что этот инструмент "хуманизирует текст без каких-либо грамматических/пунктуационных ошибок"

🔗 Попробовать: OnlyGPT Humanizer
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥2
📑 STORM — ИИ-система от Стэнфорда для создания структурированных статей с фактами

📌 STORM (Synthesis of Topic Outlines through Retrieval and Multi-perspective Question Asking) — это инструмент, разработанный в лаборатории OVAL Стэнфордского университета, который помогает создавать статьи в стиле Википедии “с нуля”. Он ориентирован не просто на генерацию текста, а на этап pre-writing — исследование темы, сбор источников и составление логичной структуры перед написанием.

📌 Принцип работы STORM включает несколько ключевых шагов. Сначала система добывает релевантные данные из внешних источников (поисковые системы, Интернет) и генерирует вопросы с разных перспектив, имитируя беседы “писателя” и “экспертов” для углубления темы. Затем собранные ответы обрабатываются и структурируются в конспект / план статьи, который задаёт каркас будущего текста. На финальном этапе STORM использует план и источники, чтобы написать полноценную статью с цитатами.

ℹ️ Проект открыт: код доступен на GitHub под MIT-лицензией (репозиторий stanford-oval/storm), и можно установить через пакет knowledge-storm (pip install knowledge-storm). Также есть демо-версия на сайте проекта, где можно опробовать генерацию статьи по теме.

🔗 Попробовать: STORM
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥1
🖥 SteloCoder — LLM, переводящий код на Python

📌 SteloCoder — это специализированная модель, основанная на StarCoder, которая фокусируется на переводе кода с разных языков на Python. В отличие от многих универсальных LLM-моделей, SteloCoder не пытается “всё и сразу” — её задача чётко задана: взять код на C++, JavaScript, Java, PHP или C# и преобразовать его в корректный Python.

📌 Технически модель использует архитектуру MoE (Mixture-of-Experts) поверх StarCoder: для каждого исходного языка создаётся “эксперт” через LoRA-адаптацию. При вводе модель сама определяет, какой эксперт активировать, через gating network, так что вам не нужно явно указывать исходный язык. В экспериментах SteloCoder показал средний CodeBLEU ~ 73.76 на множестве языков, что выше лидеров на XLCoST-лидерборде на 3-3.5 пункта.

ℹ️ Код модели уже доступен в публичном репозитории: sade-adrien/SteloCoder на GitHub. Там есть примеры использования, ноутбуки для тренировки и инструкции по интеграции с transformers.

🔗 Попробовать: SteloCoder
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1
🧠 Pokee AI — платформа-убийца ручной работы: автоматизация через агентов

📌 Появилась новая бесплатная платформа для автоматизации любых задач — Pokee AI. По сути, это «n8n наоборот»: вы пишете задачу в чат, а ИИ-агент подбирает инструменты, запускает процесс и делает работу за вас.

📌 Система поддерживает подключение к Google Workspace, GitHub, Slack, Notion, соцсетям (Instagram, X/Twitter) и многому другому. Вы можете автоматизировать: обработку почты, генерацию контента, постинг в соцсетях, разбор данных — и всё это запланировать, повторить и забыть.

ℹ️ Платформа уже прошла стадию публичной беты и получила финансирование: стартап из Сиэтла привлёк $12 млн, а сам продукт позиционируется как рабочий инструмент для автоматизации рутинных процессов силами ИИ-агентов.

🔗 Попробовать: Pokee AI
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2
This media is not supported in your browser
VIEW IN TELEGRAM
🧠 Genspark AI Browser — браузер, который сам работает за вас

🌐 Разработчики Genspark запустили AI-браузер, в котором можно запускать локальные LLM прямо на устройстве — без облака, без подписок и с максимальной приватностью.

🧑‍💻 Под капотом — 169 открытых моделей (Gemma, DeepSeek, даже GPT-семейства), плюс встроенные агенты, которые умеют автоматизировать рутинные задачи: анализ веб-страниц, заполнение таблиц, сравнение цен, поиск информации и многое другое.

ℹ️ В Genspark есть “Autopilot Mode” — режим, когда браузер сам прокручивает сайты, собирает нужный материал, переходит по ссылкам и может даже управлять формами без вашего вмешательства. А встроенный блокировщик рекламы делает серфинг быстрее и чище.

🔗 Попробовать: Genspark AI Browser
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
🔥 Suno v5 — новое дыхание музыки на базе ИИ

📌 Команда Suno только что анонсировала версию v5, теперь доступную для пользователей с планом Pro и Premier. Эта версия обещает более иммерсивное аудио, натуральные голоса и расширенный контроль над композицией — всё, чтобы генеративная музыка звучала ближе к настоящей.

📌 Что важно, Suno v5 улучшает способность смешивать музыкальные жанры и добавляет гибкость кастомизации: метатеги теперь можно применять к целым частям песни, а не прописывать перед каждой строчкой. Пользователи уже делятся примерами: вокал звучит выразительнее, атмосфера треков — пластичнее.

Хотя скидок «25% при переходе» прямо не упоминают в официальных источниках, обновление действительно доступно в бета-версии на официальном сайте Suno.

🔗 Попробовать: Suno v5
Please open Telegram to view this post
VIEW IN TELEGRAM
1😁1
🤖 Dyad — локальный билд AI-приложений без “lock-in”

📌 Dyad — бесплатный, локальный и открытый инструмент для создания AI-приложений прямо на вашем компьютере, без зависимости от облачных платформ. Вы пишете приложение через чат и визуальный интерфейс — все файлы остаются у вас, вы не отдаёте контроль над проектом кому-то стороннему.

📌 Он поддерживает Windows и macOS, а также даёт свободу выбора модели: можно подключить локальные модели либо через API ключи таких систем, как Gemini 2.5 Pro, GPT-4.1 и др. Через Supabase интеграцию Dyad позволяет делать не просто интерфейс, но полноценный backend — аутентификация, база данных, серверные функции — всё внутри приложения.

ℹ️ Проект открыт на GitHub (лицензия Apache-2.0) и активно развивается: в версиях уже добавлены такие функции, как Ask mode (чатовый режим планирования), гибкая интеграция с GitHub, возможность создавать библиотеку промптов и экономия AI-кредитов.

🔗 Попробовать: Dyad
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥2👍1
🔍 Happenstance — ИИ-поиск людей, который раскрывает силу вашей сети

📌 Happenstance — инструмент для профессиональной сети, который позволяет искать нужных людей не вручную, а по запросу: «найти стартап-основателя из финтеха в Сан-Франциско» — и система сразу выдаёт результат.

📌 Технически Happenstance подключает ваши аккаунты (Gmail, LinkedIn, X/Twitter), импортирует контакты, а затем аналізирует их с помощью LLM и эмбеддингов: поиск работает по тематике, навыкам, связям и контексту. Он визуализирует результаты: цветовые индикаторы показывают, насколько контакт соответствует запросу, и откуда именно пришёл мэтч.

ℹ️ Инструмент будет особенно полезен для рекрутеров, HR-специалистов, стартапов, B2B-продаж и нетворкинга: он превращает вашу сеть в поисковую систему, экономит часы ручной работы и помогает находить «теплые» контакты, а не холодные. Бесплатный тариф разрешает базовые запросы, Pro-версия открывает неограниченные поиски и экспорт результатов.

🔗 Попробовать: Happenstance
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2
🅰️ Firefly от Adobe — креативный ИИ-генератор, уже встроенный в дизайн-workflow

📌 Firefly — это семейство генеративных инструментов от Adobe, позволяющее создавать изображения, видео, векторную графику и аудио через текстовые подсказки и AI-технологии.

📌 Одна из ключевых особенностей Firefly — «коммерческая безопасность»: Adobe утверждает, что обучает модели только на материалах, на которые у них есть права, или из общественного достояния, чтобы пользователи могли безопасно использовать изображения в своих проектах без риска нарушения авторских прав.

ℹ️ Firefly предлагает режимы «Text to Image» и «Image to Image», где вы можете описать желаемую картинку или загрузить референс, а система создаст несколько версий для выбора. Кроме того, Adobe недавно запустил мобильное приложение, чтобы генерация изображений и видео была доступна прямо с телефона.

🔗 Попробовать: Firefly
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
🌐 Rover AI - Проходите собеседования уверенно и получите работу мечты

ℹ️ Появилось идеальное приложение-помощник для собесов — Rover AI. Есть два режима: «шпаргалка» с заранее подготовленным контентом и «реши прямо на экране». Приложение работает незаметно, и всё можно подстроить под себя — от промпта и языка до шрифта и прозрачности

💳 Тарифы:
Бесплатный
Про Годовой (10 €/месяц)
Про Месячный (19 €/месяц)


🔗 Попробовать: Rover
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥2
🖥 Cognitive Kernel-Pro — фреймворк для обучения и оценки агентных ИИ-моделей

📌 Cognitive Kernel-Pro — это открытый мульти-модульный фреймворк, который предлагает полный стек для разработки и тестирования агентов, способных работать с веб-данными, файлами, кодом и общим рассуждением. Он ориентирован на демократизацию агентных моделей: чтобы исследователи могли создавать и сравнивать решения без зависимости от проприетарных APIs или закрытых систем.

📌 Ключевые идеи Cognitive Kernel-Pro включают сбор высококачественных тренировочных данных для агентов (запросы, траектории, проверяемые ответы) в четырёх доменах: веб, файлы, код и общие рассуждения. Важное отличие — внедрение техник test-time reflection (агент анализирует свои ошибки и корректирует ответы) и voting между вариантами вывода, что повышает надёжность и устойчивость модели. В экспериментальных результатах 8B-модель Cognitive Kernel-Pro превосходит открытые системы вроде WebDancer и WebSailor по стандартному бенчмарку GAIA.

ℹ️ Код фреймворка доступен в GitHub-репозитории от Tencent: Tencent/CognitiveKernel-Pro. Там можно найти инструкции по запуску и настройке модулей (веб-агент, файловый агент и др.).

🔗 Попробовать: Cognitive Kernel-Pro
Please open Telegram to view this post
VIEW IN TELEGRAM
1
😱 Octave 2 — новый уровень генерации речи от Hume AI

📌 Компания Hume AI представила Octave 2 — текст-в-речь модель, которая поднимает качество синтеза голоса на новый уровень. Это не просто TTS-движок, а полноценный инструмент для создания максимально живого звучания, в том числе на русском языке.

📌 Octave 2 умеет работать с деталями, которые раньше были недоступны: можно задать акцент, тембр, манеру речи, добавить эмоции или даже шёпот. Модель не только воспроизводит естественное произношение, но и запоминает сленг, позволяя «обучить» голос говорить в стиле конкретного человека. При этом поддерживается как клонирование голоса по образцу, так и создание нового с нуля.

ℹ️ Отдельный плюс — тонкая настройка. Разработчики могут управлять произношением отдельных слов и фраз, добиваясь нужной подачи в диалогах, дикторских записях или игровых сценах. Для интеграции в проекты уже доступен API, а попробовать Octave 2 можно бесплатно прямо в браузере.

🔗 Попробовать: Octave 2
Please open Telegram to view this post
VIEW IN TELEGRAM
🔵 LLPlayer — видео-плеер с AI-субтитрами для языкового обучения

📌 Описание:
LLPlayer — это open-source плеер для Windows, созданный специально для тех, кто учит язык. Он отображает две дорожки субтитров одновременно и использует AI—Whisper от OpenAI для автоматической генерации текста и перевода в реальном времени.

🎯 Основные фишки:
🟢Двойные субтитры: показ двух языков сразу, с гибкими настройками размера и положения.
🟢AI-субтитры: Whisper (whisper.cpp или faster-whisper) понимает до 100 языков и работает на CUDA/Vulkan/OpenVINO для ускорения.
🟢Реальный перевод: перевод в 134 языках через Google, DeepL, Ollama, OpenAI, Claude с учетом контекста.
🟢OCR-тексты: распознаёт bitmap‑субтитры с помощью Tesseract или MS OCR.
🟢Поиск слов и панель субтитров: клик — и слово всплывает с переводом; можно искать внутри субтитров.
🟢Поддержка онлайн-видео: через yt-dlp плеер показывает видео с YouTube и сразу vчит субтитры/перевод.


⚙️ Технические детали:
🟢Написан на C#/WPF, открыт под GPL‑3.0.
🟢Бесплатный и работает локально — никакие серверы не лезут в твои субтитры.
🟢Версия 0.2.2 (май 2025) добавила поддержку LLM‑переводов (Qwen3, DeepSeek), интерфейсные улучшения и поиск по субтитрам.
🟢На VideoHelp плеер хвалят как нишевый и ценный инструмент для изучения языков.


🔗 Попробовать: LLPlayer
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1
🎨 Reve Image 1.0: когда AI понимает ваши промты

📌 Reve Image (кодовое имя Halfmoon) — это новая генеративная модель с большим акцентом на точное выполнение промтов, эстетическое качество и работу с текстом внутри картинки. Модель обучена с нуля и предназначена для авторов, дизайнеров и тех, кто хочет создавать визуальный контент без “гаданий” и лишнего хаоса в выдаче.

📌 Первые отзывы крайне позитивные: Reve хвалят за реалистичную анатомию, особенно руки и жесты, стабильную цветопередачу и способность создавать читаемый текст (логотипы, стикеры, подписи) прямо на изображении. Пользователи отмечают, что запускать Reve намного проще, чем Midjourney или Flux, и что она быстрее “догоняет” задумку без десятков уточнений.

Reve доступна в бесплатной preview-версии.

🔗 Попробовать: Reve Image 1.0
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
⭐️ Astrocade — вайб-кодинг игр с помощью ИИ

📌 Платформа Astrocade стала настоящим открытием для геймдев-сообщества: теперь создать игру можно без знания кода. Всё, что нужно — описать свою идею словами, а встроенные ИИ-агенты соберут прототип с готовой графикой, интерфейсом и базовой логикой. Такой подход получил название вайб-кодинг, потому что вместо сложных строк кода вы задаёте настроение и атмосферу будущего проекта.

📌 Astrocade умеет работать не только с текстовыми промптами, но и с референсами: можно загрузить картинку, чтобы система уловила нужный визуальный стиль. После генерации игры доступны правки — от базовых механик и параметров движения до целой структуры уровней. Благодаря командной работе ИИ-модулей результат получается гармоничным: стиль графики, интерфейс и логика органично дополняют друг друга.

🖥 На платформе уже есть большая библиотека игр, созданных другими пользователями: от аркадных платформеров до визуальных новелл. Можно взять готовый проект за основу, переработать его под себя и получить уникальный результат.

🔗 Попробовать: Astrocade
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1
🎨 MagicPath — клонирование веб-страниц в React за секунды

📌 MagicPath предлагает расширение для Chrome под названием Web Capture – HTML to React, которое позволяет захватывать любые элементы с живых сайтов и сразу превращать их в редактируемые React-компоненты.

📌 После захвата блок попадает на холст MagicPath, где можно менять цвета, шрифты, сетки и анимации — всё редактируется через визуальный редактор или текстовые подсказки с ИИ.

ℹ️ После редактирования панели можно экспортировать в код, готовый для интеграции в ваш проект, что ускоряет прототипирование и позволяет изменять реальные интерфейсы.

🔗 Попробовать: MagicPath
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍2
🖥 OmChat v2.0 13B — новый шаг в мультимодальном диалоге

📌 На Hugging Face появился OmChat v2.0 13B (single beta) от OMLab — модель с архитектурой, ориентированной на совместную работу с изображениями и текстом. Она идет под лицензией Apache-2.0 и содержит полный набор кода: от конфигурации и токенизатора до модулей для обработки изображений (image_processing_omchat.py), внимания и генерации.

📌 Модель весит около 26.4 ГБ и предоставлена в виде шести safetensors-файлов. Пользователи могут видеть исходные параметры и код модели — модификация и интеграция доступна прямо из репозитория.

🔗 Попробовать: OmChat v2.0 13B
Please open Telegram to view this post
VIEW IN TELEGRAM
1
🌐 DeepWiki — ИИ-ассистент, который превращает код в интерактивную вики

📌 DeepWiki — это инструмент, который позволяет мгновенно превратить любой публичный репозиторий на GitHub в понятную и навигируемую вики-документацию. Вы просто берёте URL вида github.com/user/repo, заменяете на deepwiki.com/user/repo, и перед вами появляется готовая структура проекта с описаниями модулей, классами, функциями и зависимостями.

📌 Под капотом система делает следующее: клонирует репозиторий, анализирует структуру папок и файлов, строит эмбеддинги кода, генерирует диаграммы (например, зависимость модулей или поток данных) и добавляет чат-ассистента, с которым можно задавать вопросы вроде «где реализована авторизация?» или «какие зависимости используются в этом сервисе?».

ℹ️ Для разработчиков и команд это значит: меньше времени на погружение в чужой код, упрощённый аудит, ускоренное onboarding-вступление и лучшее понимание сложных проектов. DeepWiki особенно полезна при работе с большими кодовыми базами с ограниченной документацией — инструмент экономит часы ручного разбора.

🔗 Попробовать: DeepWiki
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥21
📄 SmolDocling-256M — мини-модель с большими амбициями

📌 SmolDocling — это vision-language модель всего на 256 миллионов параметров, разработанная IBM и Hugging Face, которая призвана преобразовывать изображения страниц документов в структурированные форматы с сохранением макета и элементов. Она использует формат DocTags — разметку, в которой каждый элемент страницы (текст, таблицы, формулы, изображения, код) сопровождается геометрической привязкой и типом.

📌 Важное преимущество SmolDocling — это обработка целой страницы “одним заходом”, без необходимости разбивать её на фрагменты вручную. Она умеет распознавать кодовые блоки, математические формулы, таблицы и графики, сохраняя пространственные связи между элементами. На A100 средняя скорость обработки одной страницы — около 0,35 секунды.

🔗 Попробовать: SmolDocling-256M
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1🔥1🎅1