Источник КодХаб
6.3K subscribers
822 photos
81 videos
865 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
⭐️ Astrocade — вайб-кодинг игр с помощью ИИ

📌 В 2025 году платформа Astrocade стала настоящим открытием для геймдев-сообщества: теперь создать игру можно без знания кода. Всё, что нужно — описать свою идею словами, а встроенные ИИ-агенты соберут прототип с готовой графикой, интерфейсом и базовой логикой. Такой подход получил название вайб-кодинг, потому что вместо сложных строк кода вы задаёте настроение и атмосферу будущего проекта.

📌 Astrocade умеет работать не только с текстовыми промптами, но и с референсами: можно загрузить картинку, чтобы система уловила нужный визуальный стиль. После генерации игры доступны правки — от базовых механик и параметров движения до целой структуры уровней. Благодаря командной работе ИИ-модулей результат получается гармоничным: стиль графики, интерфейс и логика органично дополняют друг друга.

🖥 На платформе уже есть большая библиотека игр, созданных другими пользователями: от аркадных платформеров до визуальных новелл. Можно взять готовый проект за основу, переработать его под себя и получить уникальный результат.

🔗 Попробовать: Astrocade
Please open Telegram to view this post
VIEW IN TELEGRAM
😁2👍1
🏞 Ray3 — новый уровень генерации видео от Luma AI

📌 Luma AI представила модель Ray3, которая поднимает планку качества для генеративного видео. Она умеет создавать ролики в разрешении 1080p с 16-bit HDR продолжительностью от 5 до 9 секунд, сохраняя при этом высокую детализацию и кинематографический стиль. Главное отличие Ray3 — это способность учитывать не только текстовые промпты, но и визуальные подсказки.

📌 Пользователь может прямо на кадре нарисовать стрелки или сделать обводку, чтобы задать движение объектов или направление камеры. Такая система позволяет контролировать динамику сцены и добиваться реалистичной симуляции физики, света и анимации. Благодаря этому ролики выглядят естественно и впечатляют глубиной изображения, будто сняты на профессиональную камеру.

⭐️ Попробовать Ray3 можно уже сейчас в бесплатном тесте через сервис Dream Machine. Это отличный шанс оценить, насколько мощно новая модель сочетает возможности генерации и редактирования видео в одном инструменте.

🔗 Попробовать: Ray3
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3
📢 MiMo-Audio — новая речь от Xiaomi в мире LLM

📌 Xiaomi представила MiMo-Audio — продвинутую модель для генерации и понимания речи. Она обучена на колоссальном датасете — более 100 миллионов часов аудио, что позволило ей научиться обрабатывать голосовые запросы максимально точно и гибко. В основе лежит уникальная схема токенизации, которая делает работу модели более быстрой и экономной.

📌 Обучение MiMo-Audio проходит в два этапа: сначала модель занимается реконструкцией звука, а затем — генерацией речи. Такой подход обеспечивает естественное звучание и высокую разборчивость аудио, что выводит её в один ряд с топовыми системами. В бенчмарках Xiaomi отмечает, что MiMo-Audio показывает результаты, сопоставимые с Gemini 2.5 Flash от Google, что делает её одним из самых сильных игроков в сегменте speech-to-speech и speech-to-text моделей.

🖥 Модель уже доступна исследователям и разработчикам: исходники и веса можно найти на GitHub и HuggingFace. Это открывает простор для экспериментов — от голосовых ассистентов до систем генерации аудио-контента нового поколения.

🔗 Попробовать: MiMo-Audio
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥1
🔬 Tongyi Deep Research — китайский ИИ-агент для автономных исследований

Alibaba представила Tongyi Deep Research — бесплатного исследовательского ИИ-агента с открытым кодом. Его ключевая особенность — архитектура mixture of experts: у модели есть 30 млрд параметров, но для каждого запроса используется только около 3 млрд. В итоге получается баланс мощности и скорости — как у гиганта, но с эффективностью компактной модели.

📌 В отличие от обычных чат-ботов, Tongyi умеет работать как настоящий исследователь: он разбивает сложные задачи на подэтапы, сам ищет информацию в интернете, сопоставляет данные из множества источников и выдает отчет с цитатами. Всё это в итерационном режиме, что позволяет делать глубокие обзоры и анализ. То, на что у человека уйдет час, агент выполняет за три минуты. На бенчмарках он обходит даже платные сервисы для веб-браузинга и долгосрочных исследований.

📑 Сфера применения огромна — от контент-маркетинга и бизнес-аналитики до академических обзоров и стратегической разведки. Модель уже доступна на GitHub и HuggingFace: полная версия требует GPU с 24 ГБ VRAM, а облегченная работает и на 8 ГБ. Китайцы называют Tongyi “моментом DeepSeek” для ИИ-агентов — шагом, когда корпоративные технологии становятся открытыми и бесплатными, создавая давление на весь мировой рынок.

🔗 Попробовать: Tongyi Deep Research
Please open Telegram to view this post
VIEW IN TELEGRAM
4🔥2
🔥 Suno v5 — новое дыхание музыки на базе ИИ

📌 Команда Suno только что анонсировала версию v5, теперь доступную для пользователей с планом Pro и Premier. Эта версия обещает более иммерсивное аудио, натуральные голоса и расширенный контроль над композицией — всё, чтобы генеративная музыка звучала ближе к настоящей.

📌 Что важно, Suno v5 улучшает способность смешивать музыкальные жанры и добавляет гибкость кастомизации: метатеги теперь можно применять к целым частям песни, а не прописывать перед каждой строчкой. Пользователи уже делятся примерами: вокал звучит выразительнее, атмосфера треков — пластичнее.

Хотя скидок «25% при переходе» прямо не упоминают в официальных источниках, обновление действительно доступно в бета-версии на официальном сайте Suno.

🔗 Попробовать: Suno v5
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
⚡️ VARCO-VISION-2.0-1.7B — легкая мультимодальная модель от NCSOFT

📌 Модель VARCO-VISION-2.0-1.7B — это облегчённая версия флагманской системы NCSOFT, нацеленная на задачи визуального понимания и текстового взаимодействия. Она способна обрабатывать несколько изображений одновременно, извлекать текст с их пространственными границами (layout-aware OCR) и отвечать на вопросы по визуальному контенту, при этом оставаясь компактной и пригодной для запусков на устройствах с ограниченными ресурсами.

📌 Одним из ключевых усилений VARCO-VISION-2.0 по сравнению с предыдущей версией является улучшенное понимание корейского языка и культурного контекста, более точная генерация текстов и расширенная способность работать с многокадровыми и комплексными изображениями, такими как схемы, таблицы и макеты. Также реализована оптимизация, благодаря которой модель может работать на локальных устройствах — это делает её пригодной не только для облака, но и для приложений с ограниченными ресурсами.

🔗 Попробовать: VARCO-VISION-2.0-1.7B
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥1
📄 SmolDocling-256M — мини-модель с большими амбициями

📌 SmolDocling — это vision-language модель всего на 256 миллионов параметров, разработанная IBM и Hugging Face, которая призвана преобразовывать изображения страниц документов в структурированные форматы с сохранением макета и элементов. Она использует формат DocTags — разметку, в которой каждый элемент страницы (текст, таблицы, формулы, изображения, код) сопровождается геометрической привязкой и типом.

📌 Важное преимущество SmolDocling — это обработка целой страницы “одним заходом”, без необходимости разбивать её на фрагменты вручную. Она умеет распознавать кодовые блоки, математические формулы, таблицы и графики, сохраняя пространственные связи между элементами. На A100 средняя скорость обработки одной страницы — около 0,35 секунды.

🔗 Попробовать: SmolDocling-256M
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥1
🖥 OmChat v2.0 13B — новый шаг в мультимодальном диалоге

📌 На Hugging Face появился OmChat v2.0 13B (single beta) от OMLab — модель с архитектурой, ориентированной на совместную работу с изображениями и текстом. Она идет под лицензией Apache-2.0 и содержит полный набор кода: от конфигурации и токенизатора до модулей для обработки изображений (image_processing_omchat.py), внимания и генерации.

📌 Модель весит около 26.4 ГБ и предоставлена в виде шести safetensors-файлов. Пользователи могут видеть исходные параметры и код модели — модификация и интеграция доступна прямо из репозитория.

🔗 Попробовать: OmChat v2.0 13B
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
😶 MindOmni — как модель «видит» и думает над изображениями

📌 MindOmni — это унифицированная мультимодальная модель, которая объединяет понимание изображений и генерацию визуального контента с навыками рассуждения. Она способна не просто описывать, что на картинке, но и рассуждать: делать пошаговые выводы, отвечать на сложные вопросы по сцене, редактировать изображение, сохраняя детали, и генерировать новую визуальную информацию с учётом логики композиции.

📌 Ключевой «фишкой» модели является алгоритм RGPO (Reasoning Generation Policy Optimization), который добавляет механизм обучения с подкреплением к этапам рассуждения. Благодаря этому MindOmni может лучше выстраивать цепочки рассуждений, делать логические выводы и отвечать на визуальные задачи, которые требуют “думать, а не угадывать”.

🔗 Попробовать: MindOmni
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🤖 Aimylogic — no-code платформа для умных ботов

📌 Aimylogic позволяет создавать чат-ботов и голосовых ассистентов без программирования — всё с помощью визуальных блоков и логики. Платформа интегрируется с текстовыми и голосовыми каналами, поддерживает сценарии диалога, подключение внешних API и обработку пользовательских запросов.

📌 В 2025 году Aimylogic получила обновления: добавлена интеграция с ElevenLabs TTS (озвучивание), прямое подключение LLM в телефонию и возможность вызывать функции из бота во время разговора. Это делает её гибче для бизнес-кейсов — от customer support до внутренних ассистентов.

ℹ️ Многие пользователи отмечают удобство: с Aimylogic можно построить базового чат-бота за час. Но есть и минусы — визуальный редактор иногда кривой, поддержка не всегда оперативная, и за более расширенные функции придётся заплатить.

🔗 Попробовать: Aimylogic
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
📑 Gerwin — универсальный AI для текстов и изображений

📌 Gerwin — это платформа на русском языке, которая помогает генерировать тексты, посты, описания товаров и визуальный контент без лишних усилий. Пользователи получают бесплатный стартовый пакет кредитов и набор инструментов, чтобы протестировать возможности системы.

📌 Инструмент ориентирован на маркетологов, копирайтеров и владельцев интернет-проектов: можно создавать SEO-тексты, генерацию постов для соцсетей, описания продуктов и даже изображения под промпты, всё в одном месте.

🖥 Gerwin также доступен как десктопное приложение через WebCatalog, что упрощает работу вне браузера.

🔗 Попробовать: Gerwin
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Chronicle — AI, который делает презентации сам

📌 Сервис Chronicle превращает ваши мысли в готовые слайды: вы вводите идею или текстовый набросок, а платформа генерирует дизайн, структуру и оформление презентации.

📌 В инструмент встроен AI-агент, который помогает не только с визуальным стилем, но и с содержанием, продумывая логику повествования и визуальные элементы.

🖥 Chronicle предлагает попробовать бесплатно через их веб-сайт, а также даёт возможность импортировать текст или наброски и преобразовать их в визуальный формат.

🔗 Попробовать: Chronicle
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥3
🚀 Fellou: первый агентный ИИ-браузер в действии

📌 В сентябре 2025 года вышла первая полноценная версия Fellou CE — браузера, который позиционируют как «первый агентный браузер в мире». Его главная особенность в том, что это не просто инструмент для серфинга, а настоящий ИИ-агент, способный искать информацию, выполнять задания, анализировать контент и даже управлять компьютером. Основа Fellou — опенсорсный фреймворк Eko, который даёт возможность создавать агентов не только для браузера, но и для ОС, что делает его особенно перспективным.

📌 В тестах Fellou показывает себя неоднозначно: с поиском новых iPhone он справился идеально, собрав полноценный каталог с ценами и обзорами, а вот при заказе товара застрял в цикле кликов на маркетплейсах. Тем не менее, агент отлично суммаризует видео с YouTube, умеет планировать расписание, генерировать документы и даже логотипы. Его сильная сторона — исследовательские задачи и комплексный анализ информации, но на сложных сайтах с капчами и нестандартными формами он пока буксует.

🖥 Несмотря на баги, зависания и ограничения после окончания кредитов, Fellou уже сейчас выглядит как серьёзный шаг к браузерам будущего. Это инструмент, который способен заменить рутину офисных сотрудников и автоматизировать многие процессы. Да, пока он не идеален и требует VPN для работы в РФ, но сам факт выхода такой технологии в открытый доступ — мощный сигнал: эпоха агентных браузеров только начинается.

🔗 Попробовать: Fellou
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
🖥 Google Vids: офисный TikTok для бизнеса

📌 Google представила Google Vids — инструмент, который превращает текст в готовое видео с говорящим аватаром буквально за пару минут. Это похоже на магию: вы пишете текст, выбираете стиль и аватара, нажимаете кнопку — и у вас уже есть ролик, который можно встроить в презентацию, отправить коллегам или клиентам. Никаких камер, монтажа или долгих согласований, всё работает прямо в браузере.

📌 Главная идея сервиса — сделать коммуникацию в компаниях быстрой и унифицированной. Вместо разрозненных презентаций, писем и устных объяснений появляется единый формат: короткое видео, где ИИ-аватар озвучивает ваш текст. Это экономит время, упрощает процесс и даёт возможность создавать бизнес-контент буквально «за кофе-брейк». Google фактически предлагает «офисный TikTok», где вместо танцев — отчёты, инструкции и питчи для инвесторов.

ℹ️ Пока что качество аватаров не идеальное — эмоции выглядят немного пластиковыми. Но с точки зрения пользы для HR, маркетинга, обучения и продаж это может стать настоящим must-have инструментом. Google интегрирует Vids прямо в экосистему Workspace, а значит, массовое распространение — лишь вопрос времени. ИИ-аватары постепенно станут таким же привычным офисным инструментом, как электронная почта или слайды.

🔗 Попробовать: Google Vids
Please open Telegram to view this post
VIEW IN TELEGRAM
4🔥4👍3
🖥 DeepSeek V3.2-Exp — эксперимент, который может изменить правила игры

📌 DeepSeek выпустил модель V3.2-Exp, которую называют промежуточным шагом к следующему поколению их ИИ-архитектур. В основе обновления лежит новинка — DeepSeek Sparse Attention (DSA), механизм, уменьшающий вычислительные расходы при работе с длинным контекстом, но сохраняющий качество вывода.

📌 Сравнительный анализ показывает, что V3.2-Exp держит уровень V3.1-Terminus по большинству задач, но делает это быстрее и экономичнее. Одновременно DeepSeek объявил об уменьшении цен на API более чем на 50 %, что делает доступ к модели более демократичным для разработчиков.

ℹ️ Это не «революция» уровня первых версий DeepSeek, но важный шаг: Sparse Attention может стать стандартом для обработки длинных текстов без гигантских ресурсов. Если новый подход подтвердит эффективность, он может подтолкнуть всю отрасль к оптимизированным моделям.

🔗 Попробовать: DeepSeek V3.2-Exp
Please open Telegram to view this post
VIEW IN TELEGRAM
1
💻 Codex: допинг для программистов

📌 Много разговоров о том, что «ИИ убьёт программистов», но даже в OpenAI признают: пока что разработчикам ничего не угрожает. Новый Codex на базе GPT-5 позиционируется как инструмент-ускоритель, а не конкурент. Он встроен прямо в IDE, терминал и GitHub, где может мгновенно фиксить баги, переписывать подсистемы, запускать тесты и даже находить уязвимости в зависимостях. Причём модель сама определяет глубину задачи: от банальной правки запятой до серьёзной переработки архитектуры.

📌 Спрос на такие инструменты растёт взрывными темпами: Google в отчёте DORA пишет, что 90% инженеров уже применяют ИИ-ассистентов, а Udemy отмечает бум курсов по AI-кодингу. И это неудивительно — Codex уже работает в крупных компаниях. Например, Duolingo использует его для ревью Python-кода и оптимизации логики, а Virgin Atlantic — для генерации тестов и симуляции сценариев в авиасистемах. На практике это сокращает недели работы до часов и помогает инженерам сосредоточиться на ключевых задачах.

ℹ️ Но главное — метрики. Если GPT-4.5 на бенчмарке SWE-bench Verified закрывал около 38% реальных задач, то новый Codex под GPT-5 справляется уже с 62%. Это не просто ускорение, а качественный скачок. Скептики говорят, что новички будут меньше тренироваться, но OpenAI уверяет обратное: джуны быстрее учатся, сразу видя хорошие практики и эксперименты. Поэтому ИИ стоит рассматривать как допинг для мозга инженера — усиливающий инструмент, но не заменяющий живое понимание и прорывные идеи.

🔗 Попробовать: Codex
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2🔥2
🎬 Kling 2.5 Turbo: новая эра в генерации видео

📌 Kling 2.5 Turbo — это свежая версия видеомодели, которая уже успела привлечь внимание благодаря сочетанию высокой скорости, качества и доступной цены. По внутренним тестам разработчиков, модель демонстрирует более реалистичное воспроизведение движений и эмоциональной выразительности, чем её конкуренты Veo 3 Fast и Seedance. Улучшения коснулись как обработки сложных промптов, так и контроля за последовательностью событий в кадре — теперь даже длинные сцены выглядят более цельными и естественными.

📌 Одним из ключевых плюсов Kling 2.5 Turbo стала работа с референсными изображениями: стиль или визуальная атмосфера сохраняются во всех кадрах ролика, что делает инструмент удобным для креаторов, которым важна согласованность стиля. Добавьте к этому плавность динамики и стабильность даже в насыщенных сценах, и становится понятно, почему модель быстро набирает популярность. Особенно радует цена — по сравнению с конкурентами, Turbo-версия стоит дешевле, при этом предлагая более качественные результаты.

ℹ️ Попробовать Kling 2.5 Turbo можно уже сейчас на официальном сайте Kling, а также через платформу SYNTX или телеграм-бот SYNTX. Для начала работы достаточно зарегистрироваться и выбрать нужный режим — например, Image to Video с версией Turbo. Пользователи могут регулировать длительность ролика, степень креативности (от строгого следования промпту до более свободных интерпретаций), а также использовать негативные подсказки для тонкой настройки результата. Это открывает простор для экспериментов — от рекламных роликов и музыкальных клипов до коротких креативных видео для соцсетей.

🔗 Попробовать: Kling 2.5 Turbo
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Эпоха дипфейков официально наступила Sora 2

📌 OpenAI презентовали Sora 2, обновлённую модель генерации видео с аудио, и новое iOS-приложение Sora как социальную платформу для AI-видео.

📌 Sora 2 теперь может создавать видео со звуком, включая речь и эффекты, и даже вставлять себя или знакомых (через функцию Cameo) — при условии, что они дали разрешение. В ближайшее время планируется API, чтобы сторонние приложения могли интегрировать Sora 2, и приложение будет доступно на Android.

ℹ️ Будет интересно посмотреть, как OpenAI справится с вопросами этики, прав на изображение и контентной модерации — ведь с таким уровнем реализма грани между фантазией и подделкой стираются быстрее, чем когда-либо.

🔗 Попробовать: Sora 2
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥3👍2
🖥 Claude Sonnet 4.5: первый шаг к долгоживущим ИИ-агентам

📌 Anthropic представила обновлённую модель Claude Sonnet 4.5, которая умеет работать автономно до 30 часов подряд без участия человека. Для сравнения: прошлое поколение Opus 4 выдерживало около 7 часов. Такой скачок превращает Claude из ассистента и соавтора в полноценного ИИ-агента, способного брать на себя долгосрочные и комплексные задачи.

📌 Новая версия усилила навыки в программировании, математике, финансовом анализе и исследовательской работе. Также улучшилась устойчивость модели: Claude стал меньше подвержен «угождательности» и ошибочным ответам, что сближает его с образцом безопасного и «поведенчески выверенного» ИИ. Команда Anthropic подчёркивает, что каждые полгода их модели учатся решать задачи примерно вдвое более сложные, чем раньше.

🖥 Для разработчиков теперь открыт доступ к Claude Code — инфраструктуре с виртуальными машинами, управлением памятью и контекстом, что позволяет строить собственные ИИ-агенты на базе Claude. Это делает Sonnet 4.5 не просто улучшением, а шагом к целой экосистеме автономных систем, которые могут работать за человека часами и даже сутками.

🔗 Попробовать: Claude Sonnet 4.5
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥1
☁️ Ask Brave — когда поиск превращается в диалог

📌 Brave реализует функцию Answer with AI, которая преобразует поисковые запросы в полноценные ответы с пояснениями, таблицами и источниками. Вместо того чтобы просто показывать ссылки, система сама анализирует веб, синтезирует информацию и выдаёт развернутый ответ прямо в результатах.

📌 Новый режим на Brave Search поддерживает post-запросы — можно уточнять тему, задавая дополнительные вопросы к уже полученному ответу. Это создаёт эффект диалога, оставаясь внутри поиска, без перехода на сторонние сайты.

ℹ️ Особенность Brave — внимание к приватности: модель не использует данные пользователей для обучения, не создаёт профилей и не хранит логи. Ответы «привязаны» к независимому индексу Brave, а не к результатам Google или Bing.

🔗 Попробовать: Ask Brave
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🖥 Jet-Nemotron: новая серия моделей NVIDIA

📌 NVIDIA представила Jet-Nemotron — линейку языковых моделей с упором на скорость генерации и снижение стоимости inference. В серии есть версии на 2 и 4 миллиарда параметров, которые показывают производительность выше большинства сопоставимых моделей.

📌 Главная особенность Jet-Nemotron — использование Post Neural Architecture Search. Эта технология позволяет автоматически перестраивать архитектуру уже после обучения, оптимизируя блоки внимания так, чтобы ускорить вывод без заметной потери качества. Благодаря этому модели достигают ускорения генерации более чем в 50 раз и заметного снижения энергопотребления.

📌 Jet-Nemotron уже позиционируется как основа для будущих GPU-оптимизированных LLM-решений. NVIDIA делает ставку на гибридность и скорость, чтобы их модели можно было применять в реальных продуктах с большими нагрузками — от чат-ботов до сервисов поиска.

🔗 Попробовать: Jet-Nemotron
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1