Источник КодХаб
6.3K subscribers
822 photos
81 videos
865 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
⭐️ Astrocade — вайб-кодинг игр с помощью ИИ

📌 В 2025 году платформа Astrocade стала настоящим открытием для геймдев-сообщества: теперь создать игру можно без знания кода. Всё, что нужно — описать свою идею словами, а встроенные ИИ-агенты соберут прототип с готовой графикой, интерфейсом и базовой логикой. Такой подход получил название вайб-кодинг, потому что вместо сложных строк кода вы задаёте настроение и атмосферу будущего проекта.

📌 Astrocade умеет работать не только с текстовыми промптами, но и с референсами: можно загрузить картинку, чтобы система уловила нужный визуальный стиль. После генерации игры доступны правки — от базовых механик и параметров движения до целой структуры уровней. Благодаря командной работе ИИ-модулей результат получается гармоничным: стиль графики, интерфейс и логика органично дополняют друг друга.

🖥 На платформе уже есть большая библиотека игр, созданных другими пользователями: от аркадных платформеров до визуальных новелл. Можно взять готовый проект за основу, переработать его под себя и получить уникальный результат.

🔗 Попробовать: Astrocade
Please open Telegram to view this post
VIEW IN TELEGRAM
😁2👍1
🏞 Ray3 — новый уровень генерации видео от Luma AI

📌 Luma AI представила модель Ray3, которая поднимает планку качества для генеративного видео. Она умеет создавать ролики в разрешении 1080p с 16-bit HDR продолжительностью от 5 до 9 секунд, сохраняя при этом высокую детализацию и кинематографический стиль. Главное отличие Ray3 — это способность учитывать не только текстовые промпты, но и визуальные подсказки.

📌 Пользователь может прямо на кадре нарисовать стрелки или сделать обводку, чтобы задать движение объектов или направление камеры. Такая система позволяет контролировать динамику сцены и добиваться реалистичной симуляции физики, света и анимации. Благодаря этому ролики выглядят естественно и впечатляют глубиной изображения, будто сняты на профессиональную камеру.

⭐️ Попробовать Ray3 можно уже сейчас в бесплатном тесте через сервис Dream Machine. Это отличный шанс оценить, насколько мощно новая модель сочетает возможности генерации и редактирования видео в одном инструменте.

🔗 Попробовать: Ray3
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3
📢 MiMo-Audio — новая речь от Xiaomi в мире LLM

📌 Xiaomi представила MiMo-Audio — продвинутую модель для генерации и понимания речи. Она обучена на колоссальном датасете — более 100 миллионов часов аудио, что позволило ей научиться обрабатывать голосовые запросы максимально точно и гибко. В основе лежит уникальная схема токенизации, которая делает работу модели более быстрой и экономной.

📌 Обучение MiMo-Audio проходит в два этапа: сначала модель занимается реконструкцией звука, а затем — генерацией речи. Такой подход обеспечивает естественное звучание и высокую разборчивость аудио, что выводит её в один ряд с топовыми системами. В бенчмарках Xiaomi отмечает, что MiMo-Audio показывает результаты, сопоставимые с Gemini 2.5 Flash от Google, что делает её одним из самых сильных игроков в сегменте speech-to-speech и speech-to-text моделей.

🖥 Модель уже доступна исследователям и разработчикам: исходники и веса можно найти на GitHub и HuggingFace. Это открывает простор для экспериментов — от голосовых ассистентов до систем генерации аудио-контента нового поколения.

🔗 Попробовать: MiMo-Audio
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥1
🔬 Tongyi Deep Research — китайский ИИ-агент для автономных исследований

Alibaba представила Tongyi Deep Research — бесплатного исследовательского ИИ-агента с открытым кодом. Его ключевая особенность — архитектура mixture of experts: у модели есть 30 млрд параметров, но для каждого запроса используется только около 3 млрд. В итоге получается баланс мощности и скорости — как у гиганта, но с эффективностью компактной модели.

📌 В отличие от обычных чат-ботов, Tongyi умеет работать как настоящий исследователь: он разбивает сложные задачи на подэтапы, сам ищет информацию в интернете, сопоставляет данные из множества источников и выдает отчет с цитатами. Всё это в итерационном режиме, что позволяет делать глубокие обзоры и анализ. То, на что у человека уйдет час, агент выполняет за три минуты. На бенчмарках он обходит даже платные сервисы для веб-браузинга и долгосрочных исследований.

📑 Сфера применения огромна — от контент-маркетинга и бизнес-аналитики до академических обзоров и стратегической разведки. Модель уже доступна на GitHub и HuggingFace: полная версия требует GPU с 24 ГБ VRAM, а облегченная работает и на 8 ГБ. Китайцы называют Tongyi “моментом DeepSeek” для ИИ-агентов — шагом, когда корпоративные технологии становятся открытыми и бесплатными, создавая давление на весь мировой рынок.

🔗 Попробовать: Tongyi Deep Research
Please open Telegram to view this post
VIEW IN TELEGRAM
4🔥2
🔥 Suno v5 — новое дыхание музыки на базе ИИ

📌 Команда Suno только что анонсировала версию v5, теперь доступную для пользователей с планом Pro и Premier. Эта версия обещает более иммерсивное аудио, натуральные голоса и расширенный контроль над композицией — всё, чтобы генеративная музыка звучала ближе к настоящей.

📌 Что важно, Suno v5 улучшает способность смешивать музыкальные жанры и добавляет гибкость кастомизации: метатеги теперь можно применять к целым частям песни, а не прописывать перед каждой строчкой. Пользователи уже делятся примерами: вокал звучит выразительнее, атмосфера треков — пластичнее.

Хотя скидок «25% при переходе» прямо не упоминают в официальных источниках, обновление действительно доступно в бета-версии на официальном сайте Suno.

🔗 Попробовать: Suno v5
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
⚡️ VARCO-VISION-2.0-1.7B — легкая мультимодальная модель от NCSOFT

📌 Модель VARCO-VISION-2.0-1.7B — это облегчённая версия флагманской системы NCSOFT, нацеленная на задачи визуального понимания и текстового взаимодействия. Она способна обрабатывать несколько изображений одновременно, извлекать текст с их пространственными границами (layout-aware OCR) и отвечать на вопросы по визуальному контенту, при этом оставаясь компактной и пригодной для запусков на устройствах с ограниченными ресурсами.

📌 Одним из ключевых усилений VARCO-VISION-2.0 по сравнению с предыдущей версией является улучшенное понимание корейского языка и культурного контекста, более точная генерация текстов и расширенная способность работать с многокадровыми и комплексными изображениями, такими как схемы, таблицы и макеты. Также реализована оптимизация, благодаря которой модель может работать на локальных устройствах — это делает её пригодной не только для облака, но и для приложений с ограниченными ресурсами.

🔗 Попробовать: VARCO-VISION-2.0-1.7B
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥1
📄 SmolDocling-256M — мини-модель с большими амбициями

📌 SmolDocling — это vision-language модель всего на 256 миллионов параметров, разработанная IBM и Hugging Face, которая призвана преобразовывать изображения страниц документов в структурированные форматы с сохранением макета и элементов. Она использует формат DocTags — разметку, в которой каждый элемент страницы (текст, таблицы, формулы, изображения, код) сопровождается геометрической привязкой и типом.

📌 Важное преимущество SmolDocling — это обработка целой страницы “одним заходом”, без необходимости разбивать её на фрагменты вручную. Она умеет распознавать кодовые блоки, математические формулы, таблицы и графики, сохраняя пространственные связи между элементами. На A100 средняя скорость обработки одной страницы — около 0,35 секунды.

🔗 Попробовать: SmolDocling-256M
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥1
🖥 OmChat v2.0 13B — новый шаг в мультимодальном диалоге

📌 На Hugging Face появился OmChat v2.0 13B (single beta) от OMLab — модель с архитектурой, ориентированной на совместную работу с изображениями и текстом. Она идет под лицензией Apache-2.0 и содержит полный набор кода: от конфигурации и токенизатора до модулей для обработки изображений (image_processing_omchat.py), внимания и генерации.

📌 Модель весит около 26.4 ГБ и предоставлена в виде шести safetensors-файлов. Пользователи могут видеть исходные параметры и код модели — модификация и интеграция доступна прямо из репозитория.

🔗 Попробовать: OmChat v2.0 13B
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
😶 MindOmni — как модель «видит» и думает над изображениями

📌 MindOmni — это унифицированная мультимодальная модель, которая объединяет понимание изображений и генерацию визуального контента с навыками рассуждения. Она способна не просто описывать, что на картинке, но и рассуждать: делать пошаговые выводы, отвечать на сложные вопросы по сцене, редактировать изображение, сохраняя детали, и генерировать новую визуальную информацию с учётом логики композиции.

📌 Ключевой «фишкой» модели является алгоритм RGPO (Reasoning Generation Policy Optimization), который добавляет механизм обучения с подкреплением к этапам рассуждения. Благодаря этому MindOmni может лучше выстраивать цепочки рассуждений, делать логические выводы и отвечать на визуальные задачи, которые требуют “думать, а не угадывать”.

🔗 Попробовать: MindOmni
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🤖 Aimylogic — no-code платформа для умных ботов

📌 Aimylogic позволяет создавать чат-ботов и голосовых ассистентов без программирования — всё с помощью визуальных блоков и логики. Платформа интегрируется с текстовыми и голосовыми каналами, поддерживает сценарии диалога, подключение внешних API и обработку пользовательских запросов.

📌 В 2025 году Aimylogic получила обновления: добавлена интеграция с ElevenLabs TTS (озвучивание), прямое подключение LLM в телефонию и возможность вызывать функции из бота во время разговора. Это делает её гибче для бизнес-кейсов — от customer support до внутренних ассистентов.

ℹ️ Многие пользователи отмечают удобство: с Aimylogic можно построить базового чат-бота за час. Но есть и минусы — визуальный редактор иногда кривой, поддержка не всегда оперативная, и за более расширенные функции придётся заплатить.

🔗 Попробовать: Aimylogic
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
📑 Gerwin — универсальный AI для текстов и изображений

📌 Gerwin — это платформа на русском языке, которая помогает генерировать тексты, посты, описания товаров и визуальный контент без лишних усилий. Пользователи получают бесплатный стартовый пакет кредитов и набор инструментов, чтобы протестировать возможности системы.

📌 Инструмент ориентирован на маркетологов, копирайтеров и владельцев интернет-проектов: можно создавать SEO-тексты, генерацию постов для соцсетей, описания продуктов и даже изображения под промпты, всё в одном месте.

🖥 Gerwin также доступен как десктопное приложение через WebCatalog, что упрощает работу вне браузера.

🔗 Попробовать: Gerwin
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Chronicle — AI, который делает презентации сам

📌 Сервис Chronicle превращает ваши мысли в готовые слайды: вы вводите идею или текстовый набросок, а платформа генерирует дизайн, структуру и оформление презентации.

📌 В инструмент встроен AI-агент, который помогает не только с визуальным стилем, но и с содержанием, продумывая логику повествования и визуальные элементы.

🖥 Chronicle предлагает попробовать бесплатно через их веб-сайт, а также даёт возможность импортировать текст или наброски и преобразовать их в визуальный формат.

🔗 Попробовать: Chronicle
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3
🚀 Fellou: первый агентный ИИ-браузер в действии

📌 В сентябре 2025 года вышла первая полноценная версия Fellou CE — браузера, который позиционируют как «первый агентный браузер в мире». Его главная особенность в том, что это не просто инструмент для серфинга, а настоящий ИИ-агент, способный искать информацию, выполнять задания, анализировать контент и даже управлять компьютером. Основа Fellou — опенсорсный фреймворк Eko, который даёт возможность создавать агентов не только для браузера, но и для ОС, что делает его особенно перспективным.

📌 В тестах Fellou показывает себя неоднозначно: с поиском новых iPhone он справился идеально, собрав полноценный каталог с ценами и обзорами, а вот при заказе товара застрял в цикле кликов на маркетплейсах. Тем не менее, агент отлично суммаризует видео с YouTube, умеет планировать расписание, генерировать документы и даже логотипы. Его сильная сторона — исследовательские задачи и комплексный анализ информации, но на сложных сайтах с капчами и нестандартными формами он пока буксует.

🖥 Несмотря на баги, зависания и ограничения после окончания кредитов, Fellou уже сейчас выглядит как серьёзный шаг к браузерам будущего. Это инструмент, который способен заменить рутину офисных сотрудников и автоматизировать многие процессы. Да, пока он не идеален и требует VPN для работы в РФ, но сам факт выхода такой технологии в открытый доступ — мощный сигнал: эпоха агентных браузеров только начинается.

🔗 Попробовать: Fellou
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
🖥 Google Vids: офисный TikTok для бизнеса

📌 Google представила Google Vids — инструмент, который превращает текст в готовое видео с говорящим аватаром буквально за пару минут. Это похоже на магию: вы пишете текст, выбираете стиль и аватара, нажимаете кнопку — и у вас уже есть ролик, который можно встроить в презентацию, отправить коллегам или клиентам. Никаких камер, монтажа или долгих согласований, всё работает прямо в браузере.

📌 Главная идея сервиса — сделать коммуникацию в компаниях быстрой и унифицированной. Вместо разрозненных презентаций, писем и устных объяснений появляется единый формат: короткое видео, где ИИ-аватар озвучивает ваш текст. Это экономит время, упрощает процесс и даёт возможность создавать бизнес-контент буквально «за кофе-брейк». Google фактически предлагает «офисный TikTok», где вместо танцев — отчёты, инструкции и питчи для инвесторов.

ℹ️ Пока что качество аватаров не идеальное — эмоции выглядят немного пластиковыми. Но с точки зрения пользы для HR, маркетинга, обучения и продаж это может стать настоящим must-have инструментом. Google интегрирует Vids прямо в экосистему Workspace, а значит, массовое распространение — лишь вопрос времени. ИИ-аватары постепенно станут таким же привычным офисным инструментом, как электронная почта или слайды.

🔗 Попробовать: Google Vids
Please open Telegram to view this post
VIEW IN TELEGRAM
4🔥4👍3
🖥 DeepSeek V3.2-Exp — эксперимент, который может изменить правила игры

📌 DeepSeek выпустил модель V3.2-Exp, которую называют промежуточным шагом к следующему поколению их ИИ-архитектур. В основе обновления лежит новинка — DeepSeek Sparse Attention (DSA), механизм, уменьшающий вычислительные расходы при работе с длинным контекстом, но сохраняющий качество вывода.

📌 Сравнительный анализ показывает, что V3.2-Exp держит уровень V3.1-Terminus по большинству задач, но делает это быстрее и экономичнее. Одновременно DeepSeek объявил об уменьшении цен на API более чем на 50 %, что делает доступ к модели более демократичным для разработчиков.

ℹ️ Это не «революция» уровня первых версий DeepSeek, но важный шаг: Sparse Attention может стать стандартом для обработки длинных текстов без гигантских ресурсов. Если новый подход подтвердит эффективность, он может подтолкнуть всю отрасль к оптимизированным моделям.

🔗 Попробовать: DeepSeek V3.2-Exp
Please open Telegram to view this post
VIEW IN TELEGRAM
1
💻 Codex: допинг для программистов

📌 Много разговоров о том, что «ИИ убьёт программистов», но даже в OpenAI признают: пока что разработчикам ничего не угрожает. Новый Codex на базе GPT-5 позиционируется как инструмент-ускоритель, а не конкурент. Он встроен прямо в IDE, терминал и GitHub, где может мгновенно фиксить баги, переписывать подсистемы, запускать тесты и даже находить уязвимости в зависимостях. Причём модель сама определяет глубину задачи: от банальной правки запятой до серьёзной переработки архитектуры.

📌 Спрос на такие инструменты растёт взрывными темпами: Google в отчёте DORA пишет, что 90% инженеров уже применяют ИИ-ассистентов, а Udemy отмечает бум курсов по AI-кодингу. И это неудивительно — Codex уже работает в крупных компаниях. Например, Duolingo использует его для ревью Python-кода и оптимизации логики, а Virgin Atlantic — для генерации тестов и симуляции сценариев в авиасистемах. На практике это сокращает недели работы до часов и помогает инженерам сосредоточиться на ключевых задачах.

ℹ️ Но главное — метрики. Если GPT-4.5 на бенчмарке SWE-bench Verified закрывал около 38% реальных задач, то новый Codex под GPT-5 справляется уже с 62%. Это не просто ускорение, а качественный скачок. Скептики говорят, что новички будут меньше тренироваться, но OpenAI уверяет обратное: джуны быстрее учатся, сразу видя хорошие практики и эксперименты. Поэтому ИИ стоит рассматривать как допинг для мозга инженера — усиливающий инструмент, но не заменяющий живое понимание и прорывные идеи.

🔗 Попробовать: Codex
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2🔥2
🎬 Kling 2.5 Turbo: новая эра в генерации видео

📌 Kling 2.5 Turbo — это свежая версия видеомодели, которая уже успела привлечь внимание благодаря сочетанию высокой скорости, качества и доступной цены. По внутренним тестам разработчиков, модель демонстрирует более реалистичное воспроизведение движений и эмоциональной выразительности, чем её конкуренты Veo 3 Fast и Seedance. Улучшения коснулись как обработки сложных промптов, так и контроля за последовательностью событий в кадре — теперь даже длинные сцены выглядят более цельными и естественными.

📌 Одним из ключевых плюсов Kling 2.5 Turbo стала работа с референсными изображениями: стиль или визуальная атмосфера сохраняются во всех кадрах ролика, что делает инструмент удобным для креаторов, которым важна согласованность стиля. Добавьте к этому плавность динамики и стабильность даже в насыщенных сценах, и становится понятно, почему модель быстро набирает популярность. Особенно радует цена — по сравнению с конкурентами, Turbo-версия стоит дешевле, при этом предлагая более качественные результаты.

ℹ️ Попробовать Kling 2.5 Turbo можно уже сейчас на официальном сайте Kling, а также через платформу SYNTX или телеграм-бот SYNTX. Для начала работы достаточно зарегистрироваться и выбрать нужный режим — например, Image to Video с версией Turbo. Пользователи могут регулировать длительность ролика, степень креативности (от строгого следования промпту до более свободных интерпретаций), а также использовать негативные подсказки для тонкой настройки результата. Это открывает простор для экспериментов — от рекламных роликов и музыкальных клипов до коротких креативных видео для соцсетей.

🔗 Попробовать: Kling 2.5 Turbo
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Эпоха дипфейков официально наступила Sora 2

📌 OpenAI презентовали Sora 2, обновлённую модель генерации видео с аудио, и новое iOS-приложение Sora как социальную платформу для AI-видео.

📌 Sora 2 теперь может создавать видео со звуком, включая речь и эффекты, и даже вставлять себя или знакомых (через функцию Cameo) — при условии, что они дали разрешение. В ближайшее время планируется API, чтобы сторонние приложения могли интегрировать Sora 2, и приложение будет доступно на Android.

ℹ️ Будет интересно посмотреть, как OpenAI справится с вопросами этики, прав на изображение и контентной модерации — ведь с таким уровнем реализма грани между фантазией и подделкой стираются быстрее, чем когда-либо.

🔗 Попробовать: Sora 2
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥3👍2
🖥 Claude Sonnet 4.5: первый шаг к долгоживущим ИИ-агентам

📌 Anthropic представила обновлённую модель Claude Sonnet 4.5, которая умеет работать автономно до 30 часов подряд без участия человека. Для сравнения: прошлое поколение Opus 4 выдерживало около 7 часов. Такой скачок превращает Claude из ассистента и соавтора в полноценного ИИ-агента, способного брать на себя долгосрочные и комплексные задачи.

📌 Новая версия усилила навыки в программировании, математике, финансовом анализе и исследовательской работе. Также улучшилась устойчивость модели: Claude стал меньше подвержен «угождательности» и ошибочным ответам, что сближает его с образцом безопасного и «поведенчески выверенного» ИИ. Команда Anthropic подчёркивает, что каждые полгода их модели учатся решать задачи примерно вдвое более сложные, чем раньше.

🖥 Для разработчиков теперь открыт доступ к Claude Code — инфраструктуре с виртуальными машинами, управлением памятью и контекстом, что позволяет строить собственные ИИ-агенты на базе Claude. Это делает Sonnet 4.5 не просто улучшением, а шагом к целой экосистеме автономных систем, которые могут работать за человека часами и даже сутками.

🔗 Попробовать: Claude Sonnet 4.5
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥1
☁️ Ask Brave — когда поиск превращается в диалог

📌 Brave реализует функцию Answer with AI, которая преобразует поисковые запросы в полноценные ответы с пояснениями, таблицами и источниками. Вместо того чтобы просто показывать ссылки, система сама анализирует веб, синтезирует информацию и выдаёт развернутый ответ прямо в результатах.

📌 Новый режим на Brave Search поддерживает post-запросы — можно уточнять тему, задавая дополнительные вопросы к уже полученному ответу. Это создаёт эффект диалога, оставаясь внутри поиска, без перехода на сторонние сайты.

ℹ️ Особенность Brave — внимание к приватности: модель не использует данные пользователей для обучения, не создаёт профилей и не хранит логи. Ответы «привязаны» к независимому индексу Brave, а не к результатам Google или Bing.

🔗 Попробовать: Ask Brave
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1