Источник КодХаб
6.3K subscribers
822 photos
81 videos
865 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
🌐 EmbeddingGemma — компактная многоязыковая модель поиска от Google

ℹ️ EmbeddingGemma — новая легковесная модель текстовых эмбеддингов от Google DeepMind и Gemma 3, рассчитанная на работу прямо на ноутбуке или смартфоне без облака.
Она содержит около 308 миллионов параметров и поддерживает более 100 языков.

📌 Главная фишка — Matryoshka Representation Learning: модель может выдавать векторы разного размера (от 128 до 768 измерений) в зависимости от задачи и ресурсов устройства, без необходимости переобучения.

📌 Это позволяет балансировать скорость, точность и использование памяти, делая EmbeddingGemma универсальным инструментом для локального поиска, RAG-пайплайнов и кластеризации текстов.
Google также подчёркивает, что модель работает быстро (генерация эмбеддингов менее чем за 22 мс на EdgeTPU) и требует меньше 200 МБ RAM благодаря квантованию.

📌 При этом по эффективности в задачах поиска и семантического сходства EmbeddingGemma демонстрирует лучшие показатели среди всех моделей до 500M параметров.

🔗 Попробовать: EmbeddingGemma
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1🔥1
🐈 SpikingBrain1.0 — эффективная альтернатива трансформерам

📌 SpikingBrain1.0 — это новая модель от Китайской академии наук, которая использует вдохновение из нейробиологии, чтобы решить одну из главных проблем современных больших языковых моделей: огромные требования к вычислениям и памяти при обработке длинных контекстов. Вместо классического “глобального внимания”, SpikingBrain применяет localized attention и “спайкинг-нейроны” (event-driven вычисления), которые отвечают только тогда, когда нужно — экономя ресурсы.

📌Модель доступна в двух вариантах: SpikingBrain-7B и SpikingBrain-76B. Одна из ключевых заявленных фич — скорость: на ультра-длинных контекстах SpikingBrain1.0 утверждает, что может быть 25-100× быстрее традиционных трансформеров по времени до первого токена (Time to First Token), особенно когда нужно обработать большие объёмы текста. Кроме того, модель обучается на значительно меньшем объёме данных по сравнению с аналогами (менее 2% от объёмов, которые часто используются) и работает на китайском железе MetaX вместо Nvidia-GPU.

🔗 Попробовать: SpikingBrain1.0
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1🔥1
😶 MindOmni — как модель «видит» и думает над изображениями

📌 MindOmni — это унифицированная мультимодальная модель, которая объединяет понимание изображений и генерацию визуального контента с навыками рассуждения. Она способна не просто описывать, что на картинке, но и рассуждать: делать пошаговые выводы, отвечать на сложные вопросы по сцене, редактировать изображение, сохраняя детали, и генерировать новую визуальную информацию с учётом логики композиции.

📌 Ключевой «фишкой» модели является алгоритм RGPO (Reasoning Generation Policy Optimization), который добавляет механизм обучения с подкреплением к этапам рассуждения. Благодаря этому MindOmni может лучше выстраивать цепочки рассуждений, делать логические выводы и отвечать на визуальные задачи, которые требуют “думать, а не угадывать”.

🔗 Попробовать: MindOmni
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍1🔥1
🎙 April — голосовой ассистент для бизнеса, который управляет почтой и календарём без рук

📌 April — iOS-приложение, разработанное стартапом Cosmoverse, демонстрирует, как голосовой AI может превратиться в виртуального помощника-«Джарвиса». Запущенное в рамках Y Combinator летом 2025 года, приложение позволяет обрабатывать почту, планировать события, отменять встречи и подготавливаться к звонкам — исключительно голосом, без переключения вкладок.

📌 Ассистент умеет выявлять важные письма, отправлять ответы — причём в нужном тоне и стиле, на основе вашего голоса. Он также очищает почту от спама, организует почтовые папки, сообщает контекст перед встречей и позволяет создавать или переносить события по команде. Всё это действует hands-free, при этом ваш голос заменяет десятки кликов.

📌 Приложение доступно на iPhone и iPad с трёхдневным бесплатным периодом, затем — подписка $14.99/мес. Пользователи отмечают, что April существенно ускоряет рабочий ритм, особенно по дороге на работу: "До приезда на работу я уже догнал свой график", — пишет один из тестировавших.

🔗 Попробовать: April
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🔵 Hunyuan3D от Tencent: 3D-модель из картинки за 25 секунд

📌 2-ступенчатый пайплайн: сначала Hunyuan3D-DiT создаёт геометрию по картинке, затем Hunyuan3D-Paint наносит текстуры — модель выходит детализированной и готовой к использованию. Результат за 10–25  секунд, в зависимости от версии (Turbo — быстрее).

📈 Дерзкий прогресс перед другими
🟢 Hunyuan3D 2.0 показывает лучшие показатели geometric accuracy, FID и CLIP-score — превосходит доступные аналоги.
🟢 "Turbo" модели выдают результат всего за 30 секунд — они выгодно обгоняют конкурентов.
🟢 Открытый исходник на GitHub: есть предобученные модели, код, описания и даже Blender-addon.
🟢 Модели адаптированы под Gradio, ComfyUI и даже Windows-инсталлер — все удобно для разработчиков и дизайнеров.


🔍 Что внутри?
🟢 Hunyuan3D-DiT: Генерирует неокрашенный меш (геометрию) из одной картинки
🟢 Hunyuan3D-Paint: Накладывает текстуры высокого разрешения (PBR, цвет, рельеф)
🟢 Версии Turbo & Mini: Ускоренные модели с меньшим количеством параметров и VRAM


📌 Возможности
🟢GLB, OBJ, FBX экспорт, PBR-текстуры, готовые meshes для VR/AR/игр
🟢Поддержка мультивида в 2.1/2.5 — можно качать детализацию, если есть несколько ракурсов.


🔗 Репозиторий на GitHub
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
⭐️ Lipsync-2-Pro — дипфейки голливудского уровня прямо в браузере

📌 Lipsync-2-Pro от Sync Labs — это AI-инструмент для профессионального синхронного движения губ, который работает через браузер и API, без ручной настройки.
🟢Студийное качество в минуту, а не недели: модель синхронизирует речь с видео максимально естественно, сохраняя уникальные особенности голоса и лица, включая бороду, веснушки и грим благодаря диффузионной суперрезолюции.
🟢Поддержка 4K видео и любые форматы: работает с живыми съемками, 3D-анимацией и AI-генерацией — железный инструмент для современных видеокреаторов.
🟢Доступность и гибкость: доступен в студийном и API интерфейсах. Требуется план Scale или выше для API, а в Studio доступ открыт для всех, плата только за использование.


🔗 Где можно попробовать? Все модели, включая lipsync-2-pro, доступны для тестирования по ссылке
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2😁1
This media is not supported in your browser
VIEW IN TELEGRAM
👨‍💻 Second Brain: локальный ИИ-поисковик

📌 Second Brain позволяет индексировать локальные файлы — документы, изображения, PDF и другие форматы — не только по названиям, но и по содержанию. Он объединяет семантический поиск и ключевые слова, даёт возможность искать через текст и изображения, работает офлайн с локальными моделями.

📌 ИИ индексирует всё — документы, PDF, картинки, заметки, даже текст внутри изображений. Комбинирует семантический и ключевой поиск, распознаёт контент на многих языках и форматах: .pdf, .docx, .png, .gif и др. Всё это работает прямо на устройстве, без интернета и передачи данных в облако.

🔗 Попробовать: Second Brain
Please open Telegram to view this post
VIEW IN TELEGRAM
🖥 Tweeks by NextByte — кастомизация веб-сёрфинга под себя

📌 Tweeks позволяет настроить отображение сайтов по своему усмотрению: удалять рекламу и всплывающие баннеры, скрывать куки-плашки и даже трансформировать интерфейс с помощью кратких текстовых команд.

📌 Основные особенности:
🟢 создание и применение модификаций для любых страниц с помощью ввода команд.
🟢 редактирование, включение/отключение созданных модификаций, хранение изменений локально.
🟢 поддержка всех URL-адресов, что даёт свободу настройки почти любого сайта.
🟢 политика конфиденциальности: данные страницы используются только при явном запросе генерации скрипта; генерируемые скрипты хранятся локально.


ℹ️ Инструмент будет полезен как тем, кто любит настраивать браузер под себя, так и тем, кто работает с кодом и занимается парсингом веб-страниц.

🔗 Попробовать: Tweeks
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
📢 Whisper — профессиональный speech2text сервис на базе ИИ

📌 Whisper — веб-сервис, реализующий автоматическую транскрипцию аудио- и видеозаписей через ИИ-модели (в основе — технология Whisper от OpenAI).

📌 Сервис подходит для конвертации встреч, интервью, лекций и подкастов: он работает с многоязычными аудио, распознаёт речь на разных акцентах и в шумной обстановке.

🔗 Попробовать: Whisper
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
📑 Transor AI — универсальный ИИ‑переводчик для браузера и документов

📌 Transor AI — бесплатный инструмент, который позволяет переводить сайты, документы, картинки и даже видео‑субтитры прямо в браузере или через расширение.

📌 Он поддерживает такие форматы, как веб‑страницы, PDF и изображения с OCR, работает с YouTube/Netflix‑субтитрами, и предлагает расширения для популярных браузеров.

ℹ️ Инструмент ориентирован на широкий круг задач: от быстрого перевода контента для личного пользования до обработки документов и мультимедиа без сложной настройки.

🔗 Попробовать: Transor AI
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
🌐 GPT-5.1 — новая модель от OpenAI.

📌 Модель GPT-5.1 была представлена 12 ноября 2025 года, она включает две основные версии: Instant и Thinking.

📌 В версии Instant приоритет отдан скорости, естественному разговору и улучшенному следованию инструкциям, в версии Thinking — больше времени на «обдумывание», лучшая логика и планирование.

ℹ️ Также введена маршрутизация запросов через режим Auto: система сама выбирает, какая версия лучше справится с конкретным вопросом. Добавлена настройка «тональности» ответа (Professional, Quirky, Friendly и др.) и улучшена адаптивность к стилю.

🔗 Попробовать: GPT-5.1
Please open Telegram to view this post
VIEW IN TELEGRAM
🎅31
🖥 Marble — генератор 3D-миров от World Labs

📌 World Labs запустили Marble — инструмент, который позволяет создавать полноценные 3D-сцены по тексту, фото, видео или даже 3D-макету.

📌 Система поддерживает много режимов: генерация из одного изображения или текста, мульти-изображения для большей точности, затем редактор Chisel, где можно вручную задать макет (стены, коробки, плиты) — дальше ИИ дорабатывает детали.

ℹ️ Также можно расширять миры (expansion mode) и комбинировать несколько сцен в один большой мир (composer mode) — удобно для игр, визуальных эффектов, архитектуры или виртуальной реальности.

🔗 Попробовать: Marble
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
🖥 ALLWEONE — ИИ-генератор презентаций за пару минут

📌 ALLWEONE — веб-сервис, который позволяет создавать полноценные презентации: достаточно ввести тему, выбрать язык и стиль, а слайды автоматически генерируются с картинками, графиками и готовым оформлением.

📌 Сервис поддерживает редактирование результата: можно менять оформление, переставлять слайды, добавлять новые элементы и работать с темами. Есть выбор из нескольких шаблонов и настройка стиля (например, «профессиональный» или «неформальный»).

ℹ️ ALLWEONE работает с русским языком (и другими), подходит студентам и специалистам, чьи задачи связаны с подготовкой презентаций. Базовая версия бесплатна.

🔗 Попробовать: ALLWEONE
Please open Telegram to view this post
VIEW IN TELEGRAM
3🔥1
🌐 Google NotebookLM: режим Deep Research и поддержка новых источников

📌 Google представила режим Deep Research, который позволяет ИИ-ассистенту самостоятельно планировать исследование, просматривать веб-источники и генерировать подробные отчёты с цитатами.

📌 Кроме того, Google расширила типы поддерживаемых файлов в: теперь можно добавлять Google Таблицы, PDF-файлы и ссылки из Google Диска, а также документы Microsoft Word (.docx) для анализа и синтеза.

🔗 Попробовать: Google NotebookLM
Please open Telegram to view this post
VIEW IN TELEGRAM
3
💻 Seed-Coder (8B) — модель, которая “сама себе подбирает” данные кода

📌 Seed-Coder — это серия открытых моделей кода объёмом ~8 миллиардов параметров, разработанная командой ByteDance Seed. В отличие от классического подхода, где люди вручную фильтруют и отбирают код для обучения, Seed-Coder применяет “model-centric” пайплайн: сама модель (или вспомогательные модели) оценивают качество кода и отбирают примеры для тренировки.

📌 Модель представлена в трёх вариантах: Base, Instruct и Reasoning. Base — базовая версия для генерации и автодополнения кода. Instruct — настроена под инструкции пользователя. Reasoning — усилена для сложных задач рассуждения на шаги. Seed-Coder-8B поддерживает длину контекста до 32 768 токенов в базовой версии.

ℹ️ Открытость кода и моделей — большое преимущество: все модели Seed-Coder доступны на GitHub под лицензией MIT и на Hugging Face. С помощью transformers можно загружать их прямо в проекты.

🔗 Попробовать: Seed-Coder (8B)
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥2
🎨 Recraft — ИИ-фотошоп для дизайнеров, маркетологов и иллюстраторов

📌 Recraft — веб-сервис, объединяющий генерацию изображений, векторную графику и продвинутый редактор: он поддерживает создание логотипов, иконок, мокапов, изменение фона, устранение объектов и многое другое.

📌 С помощью Recraft можно легко удалять фон, заменять его на что угодно, выделять нужные области и редактировать их. Инструмент также предлагает апскейл изображения в 2x или 4x одним кликом.

ℹ️ Платформа работает по кредитной системе: в бесплатном тарифе даётся 30 кредитов в день. Более продвинутые функции, приватность и коммерческое использование доступны на платных планах: Basic — от $10/месяц, Advanced и Pro — с большим количеством кредитов и приоритетной генерацией.

🔗 Попробовать: Recraft
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
🖥 EraseVideo — офлайн-ИИ для удаления водяных знаков из видео

📌 EraseVideo — это настольное приложение для macOS, которое позволяет удалять логотипы, текст и любые нежелательные элементы из видео полностью офлайн, без загрузки на сторонние серверы.

📌 Инструмент использует AI-алгоритмы video inpainting и frame reconstruction, чтобы покадрово восстанавливать фон там, где был водяной знак — при этом оригинальное качество видео остается без потерь.

ℹ️ Программа поддерживает работу с видео от популярных платформ: TikTok, Sora, Veo, Runway и др.; в бесплатной версии можно обрабатывать до 2 видео в день, а платные планы дают неограниченный доступ и более высокую скорость.

🔗 Попробовать: EraseVideo
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥1