Источник КодХаб
6.3K subscribers
821 photos
80 videos
863 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
🅰️ Firefly от Adobe — креативный ИИ-генератор, уже встроенный в дизайн-workflow

📌 Firefly — это семейство генеративных инструментов от Adobe, позволяющее создавать изображения, видео, векторную графику и аудио через текстовые подсказки и AI-технологии.

📌 Одна из ключевых особенностей Firefly — «коммерческая безопасность»: Adobe утверждает, что обучает модели только на материалах, на которые у них есть права, или из общественного достояния, чтобы пользователи могли безопасно использовать изображения в своих проектах без риска нарушения авторских прав.

ℹ️ Firefly предлагает режимы «Text to Image» и «Image to Image», где вы можете описать желаемую картинку или загрузить референс, а система создаст несколько версий для выбора. Кроме того, Adobe недавно запустил мобильное приложение, чтобы генерация изображений и видео была доступна прямо с телефона.

🔗 Попробовать: Firefly
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
🌐 Rover AI - Проходите собеседования уверенно и получите работу мечты

ℹ️ Появилось идеальное приложение-помощник для собесов — Rover AI. Есть два режима: «шпаргалка» с заранее подготовленным контентом и «реши прямо на экране». Приложение работает незаметно, и всё можно подстроить под себя — от промпта и языка до шрифта и прозрачности

💳 Тарифы:
Бесплатный
Про Годовой (10 €/месяц)
Про Месячный (19 €/месяц)


🔗 Попробовать: Rover
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥2
🖥 Cognitive Kernel-Pro — фреймворк для обучения и оценки агентных ИИ-моделей

📌 Cognitive Kernel-Pro — это открытый мульти-модульный фреймворк, который предлагает полный стек для разработки и тестирования агентов, способных работать с веб-данными, файлами, кодом и общим рассуждением. Он ориентирован на демократизацию агентных моделей: чтобы исследователи могли создавать и сравнивать решения без зависимости от проприетарных APIs или закрытых систем.

📌 Ключевые идеи Cognitive Kernel-Pro включают сбор высококачественных тренировочных данных для агентов (запросы, траектории, проверяемые ответы) в четырёх доменах: веб, файлы, код и общие рассуждения. Важное отличие — внедрение техник test-time reflection (агент анализирует свои ошибки и корректирует ответы) и voting между вариантами вывода, что повышает надёжность и устойчивость модели. В экспериментальных результатах 8B-модель Cognitive Kernel-Pro превосходит открытые системы вроде WebDancer и WebSailor по стандартному бенчмарку GAIA.

ℹ️ Код фреймворка доступен в GitHub-репозитории от Tencent: Tencent/CognitiveKernel-Pro. Там можно найти инструкции по запуску и настройке модулей (веб-агент, файловый агент и др.).

🔗 Попробовать: Cognitive Kernel-Pro
Please open Telegram to view this post
VIEW IN TELEGRAM
1
😱 Octave 2 — новый уровень генерации речи от Hume AI

📌 Компания Hume AI представила Octave 2 — текст-в-речь модель, которая поднимает качество синтеза голоса на новый уровень. Это не просто TTS-движок, а полноценный инструмент для создания максимально живого звучания, в том числе на русском языке.

📌 Octave 2 умеет работать с деталями, которые раньше были недоступны: можно задать акцент, тембр, манеру речи, добавить эмоции или даже шёпот. Модель не только воспроизводит естественное произношение, но и запоминает сленг, позволяя «обучить» голос говорить в стиле конкретного человека. При этом поддерживается как клонирование голоса по образцу, так и создание нового с нуля.

ℹ️ Отдельный плюс — тонкая настройка. Разработчики могут управлять произношением отдельных слов и фраз, добиваясь нужной подачи в диалогах, дикторских записях или игровых сценах. Для интеграции в проекты уже доступен API, а попробовать Octave 2 можно бесплатно прямо в браузере.

🔗 Попробовать: Octave 2
Please open Telegram to view this post
VIEW IN TELEGRAM
🔵 LLPlayer — видео-плеер с AI-субтитрами для языкового обучения

📌 Описание:
LLPlayer — это open-source плеер для Windows, созданный специально для тех, кто учит язык. Он отображает две дорожки субтитров одновременно и использует AI—Whisper от OpenAI для автоматической генерации текста и перевода в реальном времени.

🎯 Основные фишки:
🟢Двойные субтитры: показ двух языков сразу, с гибкими настройками размера и положения.
🟢AI-субтитры: Whisper (whisper.cpp или faster-whisper) понимает до 100 языков и работает на CUDA/Vulkan/OpenVINO для ускорения.
🟢Реальный перевод: перевод в 134 языках через Google, DeepL, Ollama, OpenAI, Claude с учетом контекста.
🟢OCR-тексты: распознаёт bitmap‑субтитры с помощью Tesseract или MS OCR.
🟢Поиск слов и панель субтитров: клик — и слово всплывает с переводом; можно искать внутри субтитров.
🟢Поддержка онлайн-видео: через yt-dlp плеер показывает видео с YouTube и сразу vчит субтитры/перевод.


⚙️ Технические детали:
🟢Написан на C#/WPF, открыт под GPL‑3.0.
🟢Бесплатный и работает локально — никакие серверы не лезут в твои субтитры.
🟢Версия 0.2.2 (май 2025) добавила поддержку LLM‑переводов (Qwen3, DeepSeek), интерфейсные улучшения и поиск по субтитрам.
🟢На VideoHelp плеер хвалят как нишевый и ценный инструмент для изучения языков.


🔗 Попробовать: LLPlayer
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1
🎨 Reve Image 1.0: когда AI понимает ваши промты

📌 Reve Image (кодовое имя Halfmoon) — это новая генеративная модель с большим акцентом на точное выполнение промтов, эстетическое качество и работу с текстом внутри картинки. Модель обучена с нуля и предназначена для авторов, дизайнеров и тех, кто хочет создавать визуальный контент без “гаданий” и лишнего хаоса в выдаче.

📌 Первые отзывы крайне позитивные: Reve хвалят за реалистичную анатомию, особенно руки и жесты, стабильную цветопередачу и способность создавать читаемый текст (логотипы, стикеры, подписи) прямо на изображении. Пользователи отмечают, что запускать Reve намного проще, чем Midjourney или Flux, и что она быстрее “догоняет” задумку без десятков уточнений.

Reve доступна в бесплатной preview-версии.

🔗 Попробовать: Reve Image 1.0
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
⭐️ Astrocade — вайб-кодинг игр с помощью ИИ

📌 Платформа Astrocade стала настоящим открытием для геймдев-сообщества: теперь создать игру можно без знания кода. Всё, что нужно — описать свою идею словами, а встроенные ИИ-агенты соберут прототип с готовой графикой, интерфейсом и базовой логикой. Такой подход получил название вайб-кодинг, потому что вместо сложных строк кода вы задаёте настроение и атмосферу будущего проекта.

📌 Astrocade умеет работать не только с текстовыми промптами, но и с референсами: можно загрузить картинку, чтобы система уловила нужный визуальный стиль. После генерации игры доступны правки — от базовых механик и параметров движения до целой структуры уровней. Благодаря командной работе ИИ-модулей результат получается гармоничным: стиль графики, интерфейс и логика органично дополняют друг друга.

🖥 На платформе уже есть большая библиотека игр, созданных другими пользователями: от аркадных платформеров до визуальных новелл. Можно взять готовый проект за основу, переработать его под себя и получить уникальный результат.

🔗 Попробовать: Astrocade
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1
🎨 MagicPath — клонирование веб-страниц в React за секунды

📌 MagicPath предлагает расширение для Chrome под названием Web Capture – HTML to React, которое позволяет захватывать любые элементы с живых сайтов и сразу превращать их в редактируемые React-компоненты.

📌 После захвата блок попадает на холст MagicPath, где можно менять цвета, шрифты, сетки и анимации — всё редактируется через визуальный редактор или текстовые подсказки с ИИ.

ℹ️ После редактирования панели можно экспортировать в код, готовый для интеграции в ваш проект, что ускоряет прототипирование и позволяет изменять реальные интерфейсы.

🔗 Попробовать: MagicPath
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍2
🖥 OmChat v2.0 13B — новый шаг в мультимодальном диалоге

📌 На Hugging Face появился OmChat v2.0 13B (single beta) от OMLab — модель с архитектурой, ориентированной на совместную работу с изображениями и текстом. Она идет под лицензией Apache-2.0 и содержит полный набор кода: от конфигурации и токенизатора до модулей для обработки изображений (image_processing_omchat.py), внимания и генерации.

📌 Модель весит около 26.4 ГБ и предоставлена в виде шести safetensors-файлов. Пользователи могут видеть исходные параметры и код модели — модификация и интеграция доступна прямо из репозитория.

🔗 Попробовать: OmChat v2.0 13B
Please open Telegram to view this post
VIEW IN TELEGRAM
1
🌐 DeepWiki — ИИ-ассистент, который превращает код в интерактивную вики

📌 DeepWiki — это инструмент, который позволяет мгновенно превратить любой публичный репозиторий на GitHub в понятную и навигируемую вики-документацию. Вы просто берёте URL вида github.com/user/repo, заменяете на deepwiki.com/user/repo, и перед вами появляется готовая структура проекта с описаниями модулей, классами, функциями и зависимостями.

📌 Под капотом система делает следующее: клонирует репозиторий, анализирует структуру папок и файлов, строит эмбеддинги кода, генерирует диаграммы (например, зависимость модулей или поток данных) и добавляет чат-ассистента, с которым можно задавать вопросы вроде «где реализована авторизация?» или «какие зависимости используются в этом сервисе?».

ℹ️ Для разработчиков и команд это значит: меньше времени на погружение в чужой код, упрощённый аудит, ускоренное onboarding-вступление и лучшее понимание сложных проектов. DeepWiki особенно полезна при работе с большими кодовыми базами с ограниченной документацией — инструмент экономит часы ручного разбора.

🔗 Попробовать: DeepWiki
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥21
📄 SmolDocling-256M — мини-модель с большими амбициями

📌 SmolDocling — это vision-language модель всего на 256 миллионов параметров, разработанная IBM и Hugging Face, которая призвана преобразовывать изображения страниц документов в структурированные форматы с сохранением макета и элементов. Она использует формат DocTags — разметку, в которой каждый элемент страницы (текст, таблицы, формулы, изображения, код) сопровождается геометрической привязкой и типом.

📌 Важное преимущество SmolDocling — это обработка целой страницы “одним заходом”, без необходимости разбивать её на фрагменты вручную. Она умеет распознавать кодовые блоки, математические формулы, таблицы и графики, сохраняя пространственные связи между элементами. На A100 средняя скорость обработки одной страницы — около 0,35 секунды.

🔗 Попробовать: SmolDocling-256M
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1🔥1🎅1
🖼 Felo Slides — генератор презентаций по щелчку

📌 Felo Slides — новая функция внутри Felo AI Search, позволяющая превращать идеи, статьи, URL-ссылки, документы или просто одну фразу в готовую презентацию за считанные минуты.

📌 Платформа умеет автоматически структурировать контент: задаёшь тему, загружаешь документ или даёшь ссылку — и ИИ формирует заголовки, точки содержания, визуальные элементы, графику и кадры. Кроме того, Felo может конвертировать PDF или Word в слайды, сохраняя смысл и форматирование.

ℹ️ Инструмент бесплатен в базовом режиме: доступна генерация презентаций с ограничениями. Он поддерживает множество шаблонов, позволяя выбрать стиль, дизайн и визуальные акценты.

🔗 Попробовать: Felo Slides
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
💬 GLM-4.6: шаг вперёд в агентных моделях от Z.ai

📌 GLM-4.6 — свежий апдейт линейки от Z.ai (бывший Zhipu), который приносит заметные улучшения по нескольким направлениям. Это не просто “новая версия”, а серьёзная доработка: увеличен контекст, прокачан кодинг и встроена поддержка инструментов (tool use) прямо при инференсе.

📌 Технически, ключевое новшество — расширение окна контекста с 128 K до 200 K токенов, что позволяет обрабатывать длинные сценарии и сложные агенты. Работа с кодом также получила прирост: модель лучше показывает себя на кодинговых бенчмарках и используется в инструментах вроде Claude Code, Cline, Roo Code и др. Кроме того, GLM-4.6 стала “умнее” в рассуждениях и взаимодействии с инструментами, благодаря чему агенты на её основе работают эффективнее.

ℹ️ Интересный момент — экономичность: GLM-4.6 решает задачи, используя примерно на 15% меньше токенов, по сравнению с GLM-4.5. Модель уже доступна в инструментах Z.ai через подписку GLM Coding Plan по цене от $3/месяц, и её веса публиковались на Hugging Face. Пользователи на Reddit отмечают, что в задачах программирования GLM-4.6 “чувствуется прирост” по сравнению с Sonnet и предыдущими версиями.

🔗 Попробовать: GLM-4.6
Please open Telegram to view this post
VIEW IN TELEGRAM
👍32
🎤 Клонируем любой голос за пару секунд — бесплатный ИИ-сервис Vocloner

📌 Vocloner — это бесплатный онлайн-сервис, позволяющий мгновенно клонировать любой голос. Всё, что вам нужно, — это короткая аудиозапись (от 10 секунд), и вы сможете получить синтетическую речь, звучащую как оригинальный голос.

📌 Сервис поддерживает десятки языков, включая русский, и идеально справляется с фразами длиной 1–2 предложения. Работает прямо в браузере — ничего устанавливать не нужно. Бесплатно, но с лимитами: 1000 символов в день, 200 символов на запрос.

ℹ️ Vocloner идеально подходит для создателей контента, подкастеров, блогеров и всех, кто хочет быстро озвучить текст в нужном голосе. Попробуйте прямо сейчас на vocloner.com

🔗 Попробовать: Vocloner
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1
🧠 Fluig.cc — генерация диаграмм из текста за минуты

Fluig.cc — онлайн-сервис от Mockplus, который с помощью AI превращает текст, документы и веб-страницы в готовые диаграммы без ручной работы.

📌 Поддерживаемые форматы
🟢Mind Map — мозговые штурмы и планирование идей.
🟢Flowchart — схемы процессов и алгоритмов.
🟢Timeline — дорожные карты и планы.
🟢Kanban — управление задачами.
🟢Оргструктуры и таблицы.


⚙️ Как это работает
🟢Вставляете текст, загружаете документ или ссылку.
🟢Выбираете формат визуализации.
🟢AI анализирует материал и строит структуру за секунды.


📌 Редактирование доступно прямо в браузере — можно менять стили, добавлять иконки, а через встроенный чат давать команды, например:
🟢«Добавь этап тестирования»
🟢«Создай отдельную ветку для маркетинга»


💡 Главный плюс — гибкость. Один и тот же текст можно за секунду превратить и в mind map, и в Kanban-доску, и в таймлайн. Для бизнеса это экономия времени и быстрый переход от идеи к структурированной схеме.

🔗 Попробовать: Fluig.cc
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥1
😎 Open Lovable — опен-сорс-ускоритель веб-разработки

📌 Open Lovable — это проект под лицензией MIT, который позволяет в считанные минуты превратить любой публичный сайт в современное React-/Next.js-приложение с Tailwind и TypeScript. Вводите URL конкурента или прототипа, и система сканирует HTML, стили и структуру, формируя читаемый код с реальной архитектурой app/, components/, lib/.

📌 Под капотом Open Lovable использует несколько нейросетевых моделей и API-интеграций: Web-краулер (например, Firecrawl), выбор LLM-модели (Anthropic, OpenAI, Google Gemini или Groq) через переменные .env, и шаблон масштабируемой инфраструктуры (Next.js + TypeScript + Tailwind) для запуска на Vercel или E2B Sandbox.

ℹ️ Важно: инструмент не копирует закрытую логику или API чужих сайтов — он создаёт фронтенд-шаблон, который вы дальше настраиваете под свои сервисы. Это идеальный вариант для быстрого запуска лендинга, прототипа или интерфейса на конкурсной базе.

🔗 Попробовать: Open Lovable
Please open Telegram to view this post
VIEW IN TELEGRAM
1
🖥 ChatGPT Atlas от OpenAI — браузер с ChatGPT встроенным в ядро

📌 OpenAI представила ChatGPT Atlas — полноценный веб-браузер с интегрированным чат-ассистентом, который работает не как плагины, а как полноценная среда для серфинга, аналитики и автоматизации задач. Он доступен уже сегодня на macOS (для всех пользователей: Free, Plus, Pro, Go), версии для Windows, iOS и Android появятся позже.

📌 Основные возможности: боковая панель «Ask ChatGPT», в которой можно запросить сводку содержимого текущей страницы, сравнение продуктов, анализ данных — без переключения вкладок. А режим Agent Mode (доступен подписчикам Plus, Pro, Business) позволяет ChatGPT действовать за пользователя: бронировать билеты, оформлять покупки, заполнять формы на сайтах — всё под контролем цепочки согласований.

ℹ️ Atlas предлагает управляемую память браузера: можно разрешить или запретить сохранение истории, очистить данные, включить инкогнито-режим. Это шаг OpenAI к переосмыслению браузера как среды, где чат-ассистент не просто помогает, а становится частью интерфейса.

🔗 Попробовать: Atlas
Please open Telegram to view this post
VIEW IN TELEGRAM
1
🔵 OpenHands — платформа для AI-ассистентов, которые кодят вместо вас
OpenHands (ранее OpenDevin) — open-source фреймворк, который превращает LLM-модель в полноценного AI-инженера: редактирует код, запускает команды, работает с вебом и API, берёт примеры с StackOverflow. Всё — локально, конфиденциально и бесплатно.

📌 Почему это может быть интересно:
- Автономные агенты: могут модифицировать репозиторий, выполнять terminal-команды, браузить документацию и вызывать API.
- Быстрый старт: запускается через Docker за пару команд или работает headless в CLI режиме.
- Работает с любыми LLM: Claude 3.5 Sonnet, OpenAI GPT, Mistral и др. работают превосходно в тандеме с OpenHands.


⚙️ Техническая мощность и производительность:
- Результаты benchmark’ов: агент OpenHands CodeAct 2.1 закрывает более 50 % задач на SWE‑Bench и 41,7 % на SWE‑Bench Lite.
- OpenHands‑Versa — универсальный агент для code-editing, web browsing и multi-modal задач, улучшает результаты SWE‑Bench Multimodal и GAIA на 9+ баллов.


⁉️ Ограничения и нюансы:
- Некоторые пользователи сообщают о сложностях с установкой через Docker и проблемах с повторением операций при сложных проектах (agents могут застревать в loop'ах).
- Лучше подходит для небольших и средних репозиториев — на больших проектах возможны сбои и контекстные ограничения.


🔗 Попробовать: OpenHands
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥21
⚡️ Бесплатный Duolingo для кодеров - Coddy

Coddy превращает изучение программирования в игру с ежедневными заданиями, уровнями и рейтингами, поддерживает синхронизацию между устройствами

ℹ️ Что включает в себя Coddy:
Ежедневные задания, серии дней, уровни и рейтинги для мотивации
Писать код прямо в приложении на телефоне или ПК, всё синхронизируется
15+ языков: Python, JS, C++, Go, Rust, Lua и другие
Направления: аналитика данных, ИИ, веб-разработка


🔗 Попробовать - Coddy
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21
🎨 Stability AI — генеративный ИИ для творчества и бизнеса

📌 Технологическая база Stability AI — это не просто «изображения из текста», а сложные системы с несколькими уровнями: автокодировщики, латентные пространства, диффузионные процессы, трансформеры. В модели Stable Diffusion 3 (SD3) используется архитектура Multimodal Diffusion Transformer (MMDiT) — она разбивает обработку текста и изображения на отдельные веса/модули, затем объединяет через механизм внимания, чтобы обе модальности (текст и изображение) могли взаимодействовать.

📌 Кроме того, Stable Diffusion работает в латентном пространстве: сначала изображение кодируется в компактное представление через вариационный автокодировщик (VAE) — таким образом размерность обработки падает.

ℹ️ SD3 и сопутствующие версии используют масштабируемость моделей от ~800 млн до ~8 млрд параметров, а также потоковое обучение с “flow matching” и диффузионной трансформер-архитектурой, что улучшает качество результата (типографика, соответствие запросу) и делает процесс генерации более гибким.

🔗 Попробовать: Stability AI
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
🔵 Pandas AI — это библиотека, которая добавляет искусственный интеллект к pandas DataFrame, позволяя работать с данными с помощью естественного языка. Она генерирует и выполняет Python-код, строит графики, объясняет выводы и может анализировать данные без необходимости вручную писать код. Использует LLM (например, OpenAI, Claude, Mistral) для генерации ответов.

📌 Что умеет:
🟢Вопросы на обычном языке
🟢Автогенерация и выполнение кода
🟢Построение графиков
🟢Объяснение выводов
🟢Поддержка разных LLM


⚙️ Архитектура:
🟢SmartDataframe вместо DataFrame
🟢Конфигурация LLM (OpenAI, Claude и др.)
🟢Поддержка плагинов и кэша
🟢Интерпретатор Python-кода
🟢Интеграция с Jupyter


👍 Преимущества:
🟢Не требует знания кода
🟢Быстрый анализ
🟢Поддержка визуализации
🟢Гибкая настройка
🟢Совместимость с pandas


🔗 Попробовать: Pandas AI
Please open Telegram to view this post
VIEW IN TELEGRAM
2