Источник КодХаб
6.3K subscribers
822 photos
81 videos
865 links
⚡️Заявки принимаем моментально

Подборка AI-инструментов на любой вкус и цвет

Сотрудничество: @cmd_dark, @CMD_Vega

Ютуб: https://www.youtube.com/@ih_codee
ТикТок: https://www.tiktok.com/@ih_code
Download Telegram
🌐 AnyCrawl — опенсорсный веб-краулер для подготовки данных под LLM

📌 AnyCrawl — это инструмент на Node.js/TypeScript, который автоматически извлекает из сайтов чистый контент без меню, рекламы и навигационных элементов. Результат сохраняется в виде структурированного JSON, что упрощает анализ данных, их последующую обработку или загрузку в ML-модели.

📌 Краулер умеет парсить выдачу Google, Bing и Baidu, поддерживает работу через прокси и умеет сам регулировать лимиты запросов, чтобы обходить блокировки. Также предусмотрена многопоточность, что ускоряет сбор больших массивов данных без дополнительных настроек.

📌 Проект распространяется под MIT-лицензией и активно развивается на GitHub. AnyCrawl полезен разработчикам, SEO-специалистам и исследователям: его можно использовать как для fine-tuning языковых моделей, так и для мониторинга веб-контента. Доступен локально через npm или в облачной версии на anycrawl.dev.

🔗 Попробовать: AnyCrawl
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2🤔1
🌐 QTune: open-source студия для файнтюнинга без кода

📌 QTune — это не просто набор утилит, а полноценное десктопное приложение с графическим интерфейсом, которое превращает файнтюнинг в управляемый процесс, доступный даже новичкам. В отличие от классических пайплайнов, требующих кучи скриптов и терминальных команд, QTune разбивает всё на логические этапы: подготовка датасета, выбор модели, настройка обучения, запуск и финальная конвертация. За счёт QLoRA технология становится реально доступной на потребительских видеокартах — для задач, где раньше требовались серверные GPU.

📌 Подготовка данных реализована через "Conversation Builder" — интерактивный чат, где можно быстро собрать датасет под конкретный стиль общения. Далее пользователь выбирает базовую модель с Hugging Face и задаёт параметры обучения. Опытные разработчики получают полный контроль над QLoRA-конфигурацией (rank, alpha, dropout, выбор модулей), а новички могут просто оставить дефолтные значения. Логи обучения отображаются в реальном времени, позволяя отслеживать метрики и процесс.

📌 После обучения QTune автоматически объединяет LoRA-адаптер с базовой моделью и предлагает удобные инструменты для финальной упаковки: квантизацию в формат GGUF или прямую интеграцию с Ollama. В результате пользователь получает готовую к работе локальную модель, которую можно запустить одной командой в терминале. Таким образом, QTune превращает процесс файнтюнинга из сложного инженерного квеста в понятный и практически «одно-кнопочный» процесс.

🔗 Попробовать: QTune
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
🌐 Krea AI — мультиформатный AI-агрегатор для визуального контента

📌 Krea AI — это универсальная платформа, объединяющая модели для генерации и пошагового редактирования изображений и видео, создания 3D-сцен по текстовым запросам, а также автоматического улучшения качества визуального контента. В интерфейсе доступны вкладки как для создания и редактирования изображений, так и для анимаций, синхронизации губ, видеостиля, 3D-объектов и тренировки моделей под собственный стиль.

📌 Платформа предлагает пользователям ограниченное бесплатное использование: 13 изображений в режиме Image, один сгенерированный видеофрагмент или апгрейд изображения в режиме Enhancer каждый день. Это позволяет попробовать функционал без подписки, прежде чем переходить к платным тарифам.

📌 Интерфейс интуитивен и поддерживает множество режимов: Realtime для моментальных корректировок визуала, Edit — редактирование существующих изображений, Assets — управление проектами, Video Restyle — изменение визуального стиля, Animator — генерация коротких анимаций, Video Lipsync — синхронизация речи с движением губ, а также вкладка Train, позволяющая обучить модель на собственном стиле. Комбинация таких функций делает Krea AI мощным инструментом для креативщиков, дизайнеров и видеомейкеров.

🔗 Попробовать: Krea AI
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍2
This media is not supported in your browser
VIEW IN TELEGRAM
🎥 Agent Opus — первый AI-агент, создающий вирусные ролики на основе трендов соцсетей

⚡️ Agent Opus — это новая платформа, которая преобразует идеи любого формата — текст, скрипты или ссылки — в отточенные видеоролики для социальных сетей. Модель анализирует актуальные монтажные тренды, визуальную стилистику и ритм на основе данных из сетевой активности и создателей контента, что позволяет быстро собирать динамичные, эмоционально заряженные видео с закадровым текстом и тщательно продуманными визуальными переходами.

📌 Система работает без привязки к ручной нарезке роликов: достаточно записаться в вейтлист на официальной странице Agent Opus. Агент автоматически подбирает мемные фрагменты, создает монтаж с "СДВГ-динамикой", добавляет закадровую озвучку и генерирует целостный визуальный продукт, отвечающий требованиям вирусного видео.

🔗 Для доступа к сервису открыта регистрация в раннем доступе — подать заявку на использование можно по ссылке: opus.pro/agent
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
🔵 AlphaEvolve — AI-инструмент от DeepMind для автоматической генерации, тестирования и улучшения алгоритмов. Использует эволюционный подход и LLM (Gemini), чтобы находить решения, превосходящие человеческие.

🎯 Особенности:
🟢Автоматически пишет и улучшает алгоритмы по заданной задаче
🟢Оценивает каждое решение по множеству метрик (скорость, точность, ресурсоёмкость)
🟢Использует LLM (Gemini) для генерации вариантов и мутаций кода
🟢Уже нашёл алгоритмы, превосходящие классические (например, Strassen 1969)


⚙️ Архитектура и параметры:
🟢Состоит из контроллера, Gemini-моделей, базы вариантов и системы отбора
🟢Работает по принципу «mutation + selection» — как в генетических алгоритмах
🟢Сохраняет лучшие решения в MAP‑Elites, чтобы не терять редкие улучшения
🟢Проходит закрытое тестирование, открытый релиз ожидается позже


👍 Преимущества:
🟢Находит эффективные алгоритмы, которые сложно создать вручную
🟢Уже применён в инфраструктуре Google (ускорил FlashAttention, планирование Borg)
🟢Полезен в оптимизации ML, численных методов и научных задач
🟢Открывает новые горизонты в автоматизации программирования


🔗 Попробовать: AlphaEvolve
Please open Telegram to view this post
VIEW IN TELEGRAM
4🔥2
🌐 LFM2 от Liquid AI — быстрая и экономная on‑device модель

🗓 Дата релиза: 10 июля 2025. Liquid AI официально представили open-source серию моделей LFM2 — оптимизированную для работы прямо на устройствах и без задержек, которую уже можно протестировать в Liquid Playground, Hugging Face и через llama.cpp.

🚀 Почему это мощно
- Двойной прирост скорости: в 2 раза быстрее обработка ввода/вывода по сравнению с Qwen3 на CPU.
- Обучается в 3 раза быстрее предыдущих моделей LFM — экономит ресурсы и время .
- Компактность при высоком качестве: 350M, 700M и 1.2B параметры с результатами, сопоставимыми и лучше аналогов, включая Gemma 3 и Llama 3.2 1B.


💡 Технологии
- Гибридная архитектура: сочетание «жидких» конволюций (LIV-модули) с attention-блоками в 16 слоях — 10 конволюционных + 6 attention.
- Универсальность: модель отлично работает на CPU, GPU и NPU, подходит под мобильные устройства, ноуты, роботов.
- Свободное распространение: weights под открытой лицензией, запускаются локально, конфигурация — через Hugging Face и Liquid Playground.


📊 Результаты
- MMLU, GPQA, GSM8K и др.: модели LFM2-1.2B стабильно быстрее, чем Qwen3-1.7B и Llama 3.2 1B.
- Предпочтение оценивающими LLM: ответы LFM2-700M и 1.2B чаще признаны лучше по качеству, чем у конкурентов.


🔗 Попробовать: Hugging Face, GitHub.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🔥1
📸 Google тестирует Nano Banana — новый AI-редактор изображений с невероятной точностью

📌 Появился генератор изображений под названием Nano Banana. Это AI-инструмент, который превращает любую фотографию в точно отредактированное изображение всего по описанию на естественном языке. Он буквально "понимает" сложные запросы и сохраняет ключевые детали: лицо, фон, свет, контекст остаются неизменными, а важные элементы редактируются встраиваемо и последовательно.

📌 Первый резонанс этого инструмента появился на LMArena, где Nano Banana соревновался с другими моделями и сразу заявил о себе стабильностью, качеством и точностью. Пользователи, тестировавшие модель, отмечают фантастическую согласованность в персонажах и окружающей сцене — качества, которые часто отсутствуют в аналогичных решениях.

📌 Несмотря на волну обсуждений, официальной информации о разработчике Nano Banana нет, но существует предположение, что модель может быть связана с Google: от кодового имени («nano») до косвенных намеков в социальных сетях. Пока инструмент доступен лишь через ссылку, и его будущее масштабирование вызывает живой интерес.

🔗 Попробовать: Nano Banana
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🔵 Recon AI — инструмент от Protect AI для автоматического red teaming LLM-систем. Использует более 450 сценариев атак (jailbreak, prompt injection и др.) для тестирования безопасности AI-приложений. Поддерживает кастомные атаки, экспортирует отчёты (CSV, JSON) и интегрируется с OWASP LLM, CVSS и другими стандартами.

🎯 Особенности:
🟢450+ встроенных атак (prompt injection, jailbreak и др.)
🟢Поддержка кастомных payload’ов
🟢Экспорт отчётов (JSON, CSV)
🟢Интеграция с OWASP LLM и CVSS


⚙️ Архитектура и параметры:
🟢AI-агент с движком атак
🟢Работает через CLI и API
🟢Контекстное и семантическое тестирование
🟢Поддерживает ручной и автоматический режим


👍 Преимущества:
🟢Ускоряет поиск уязвимостей
🟢Интегрируется в DevSecOps
🟢Гибкий, настраиваемый подход


🔗 Попробовать: Recon AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥21
🐈 Le Chat от Mistral AI — мощный многозадачный помощник из Франции

📌 Le Chat — многофункциональный AI-чат от французского стартапа Mistral AI, основанного в 2023 году инженерами из DeepMind и Meta. Несмотря на запрет деятельности компании в России, Le Chat остаётся доступен здесь через веб и мобильные приложения.

📌 Бот включает агенты для анализа данных, обучения, работы с документами и кодом, способен загружать файлы, строить визуализации, генерировать изображения и управлять задачами через Canvas-режим. Le Chat поддерживает безопасную работу, быстрый ввод (до 1000 слов/сек) и интегрирован в экосистему Microsoft Azure и Google Cloud.

🔗 Попробовать: Le Chat
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥2
🔥Qoder — бесплатный AI-агент от Alibaba, создающий приложения из текста

📌 Alibaba выпустила Qoder — совершенно бесплатную платформу для кодирования, основанную на AI. Модель анализирует весь проект и ваш стиль кодирования, разбивает задачи на шаги, самостоятельно пишет спецификации и вносит изменения в код — и всё это без VPN и абсолютно бесплатно.

📌 Qoder позиционируется как инструмент нового поколения для разработчиков: он понимает вашу кодовую базу, действует в духе senior-инженера и автоматизирует сложные рабочие процессы — от планирования до ревью. Также доступна команда вейтлиста для раннего доступа.

🔗 Попробовать: Qoder
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2🔥2
🌐 DeepSeek V3.1 — гибридная нейросеть с поддержкой местных чипов и двумя режимами мышления

📌 DeepSeek представила обновлённую модель V3.1, которая впервые получила гибридную архитектуру с двумя режимами — «non-thinking» и ускоренным «thinking» (DeepThink-кнопка), позволяющая переключаться между ними гораздо быстрее, с меньшим потреблением токенов по сравнению с R1-версией. Усовершенствованы агентские навыки: улучшено обращение с инструментами, поиск и выполнение многошаговых задач (Reuters, API Docs).

📌 Кроме того, V3.1 адаптирована для китайских отечественных чипов: использует FP8 UE8M0 формат и оптимизирована под грядущие модели на китайской архитектуре. Также увеличен контекст до колоссальных 128 000 токенов, что делает её особенно ценным активом для работы с большими документами и кодами (Mexico Business News, API Docs).

📌 Модель стала превосходить Claude 4 Sonnet в тестах по науке, математике и кодингу; её веса доступны на Hugging Face, а API станет платным с 5 сентября — $0,56 за миллион входных и $1,68 за миллион выходных токенов (без разделения режимов)

🔗 Попробовать: DeepSeek V3.1
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 Comet от Perplexity — браузер, который делает работу за тебя

🔑 Почему это больше, чем просто браузер

Браузер Comet встроен с самого основания вокруг AI-помощника от Perplexity — он использует Perplexity как поисковую систему по умолчанию, переводя серфинг на уровень "говори и получай результат". Никакого копирования ссылок – просто задаёшь вопрос о том, что видишь на экране, и Comet отвечает прямо в боковой панели.

🧠 Что умеет помощник:
🟠 Сканирует текущую страницу, резюмирует её содержимое и даёт контекст.
🟠 Делает вещи за тебя: бронирует встречи, покупает товары, пишет письма — всё через диалог.
🟠 Умное управление вкладками: закрывает дубликаты, группирует, возвращает к нужным ссылкам по запросу.


⚙️ Нововведения и удобство
🟠 Визуальные действия: помощник не только кликает сам, но и показывает, что делает — прямо на экране.
🟠 Автономность: работает локально, без передачи твоей истории на серверы.
🟠 Лёгкий переход с Chrome: поддерживает расширения, импорты закладок и настроек.


Нюансы:
Пока доступен только подписчикам Perplexity Max — $200 в месяц. Остальным — по приглашениям из waitlist. Релиз для macOS и Windows, без поддержки Linux или мобильных платформ.

🔗 Попробовать - https://comet.perplexity.ai/
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2🔥2
This media is not supported in your browser
VIEW IN TELEGRAM
🆓 Google открыла бесплатный доступ к генерации видео с Veo 3 на выходные

📌 С 23 по 25 августа 2025 года в приложении Gemini доступен трёхдневный бесплатный тестовый период Veo 3 — полноценной видеомодели от Google. Бесплатным пользователям разрешено создать три ролика по 8 секунд со звуком; после этого появится предложение перейти на подписку Google AI Pro. В точности не указано, действует ли это ограничение в сутки или всего три ролика.

⭐️ Особенности Veo 3 (Fast):
🟢Модель генерирует видео в два раза быстрее базовой версии, с разрешением 720p, синхронизированной озвучкой и эффектами;
🟢Промо-акция действует до 10:00 мск 25 августа (Sunday 10 p.m. PT Friday/Sunday depending on your timezone);
🟢Опубликована как Google I/O 2025 модель, Veo 3 способна генерировать анимацию с закадровым звуком, музыкой и эффектами.


🔗 Попробовать: Veo 3
Please open Telegram to view this post
VIEW IN TELEGRAM
🔵 Nous Research — децентрализованные LLM с моделью Hermes и сетью DisTrO

📌 Что это:
Nous Research — AI-стартап из Нью-Йорка, основанный в 2023 году, строит открытую и децентрализованную AI-инфраструктуру. central в её экосистеме — Hermes 3 (быстрые 8B, 70B и 405B модели, fine‑tuned на Llama 3.1) и DisTrO — технология распределённой тренировки через интернет, без нужды в централизованных дата-центрах.

🎯 Чем интересны:
- Hermes 3 — LLM с длинным контекстом, внутренним мышлением и агентскими способностями. Поддерживает многопоточную логику и function‑calling, обучен на синтетических данных с акцентом на точность и гибкое следование инструкциям.
- DisTrO / DeMo — распределённая тренировка модели на нецентрализованных GPU (от RTX 4090 до национальных кластеров). Снижает загрузку сети в 1000-10 000×, работает даже на обычном интернете.
- Psyche Network — тестовая сеть на Solana, позволяющая координировать тренировку LLM с 40B параметрами, используя блокчейн для управления ресурсами и incentivization.

⚙️ Технологии и достижения:
- Forge API — агентная модель: Mixture of Models, Chain of Code, MCTS — решение задач сложнее, чем в обычных LLM.
- Open, прозрачный стакинг: исходники, архитектура и средства децентрализации доступны, тысячи участников, строгий контроль над данными.


📌 Где это найти:
- GitHub модели;
- Официальный сайт;
- Документация DisTrO / DeMo и Psyche.


🔗 Попробовать: Nous Research
Please open Telegram to view this post
VIEW IN TELEGRAM
3
⭐️ Yoink AI — умный AI-редактор на Mac без копипаста

📌 Yoink AI — это нативное macOS-приложение, которое интегрирует AI-редактирование прямо в текстовые поля любых приложений. Достаточно нажать ⌘ + Shift + Y, и AI "подхватит" текущий контекст (выделение, текст вокруг курсора) и сразу предложит улучшение или продолжит текст — всё прямо там, где надо, без переключений, копипасты и лишних слов от AI.

📌 Основные плюсы: работает в любых приложениях (почта, Docs, Slack, браузер), «хватает» контекст автоматически, вставляет результат на месте и работает как настоящий помощник, а не чат-бот. Поддерживается персонализация стиля написания через функцию «Voices» — просто задайте тон, и AI будет придерживаться его.

🆓 Доступно бесплатно на Mac, полноценную версию можно скачать с официального сайта Yoink AI; поддержка Windows будет доступна позже через waitlist.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍32
🖕 Wan — бесплатный генератор видео на базе Qwen от Alibaba

📌 Появился новый видеогенератор — Wan (Wan 2.2 Plus рекомендуют), разработанный в рамках Qwen-платформы от Alibaba. Он позволяет преобразовывать изображения в видео и текст в видео: достаточно загрузить картинку или ввести промт, выбрать модель, ориентацию и эффекты (вращение камеры, сжатие, распыление и т.д.) — и получить готовый видеоклип.

📌 Кроме того, Wan поддерживает режим первого и последнего кадра, создавая анимацию между ними, и режим "референсов", где можно указать фон и объект, и AI перенесёт сцену в нужный контекст — например, с ковра на море. Оружие для создателей визуального контента: можно задавать освещение, фокусное расстояние, линзу камеры и даже таймлапс.

📌 Wan 2.1 и Wan 2.2 — это не просто модели, а открытый фреймворк высокого уровня. Они отличаются доступностью на потребительских видеокартах, качеством motion и стабильностью, и всё еще открыто лицензированы — особенно Wan 2.2 с Mixture-of-Experts архитектурой и cinematic управлением стилем и освещением.

🔗 Попробовать: Wan
Please open Telegram to view this post
VIEW IN TELEGRAM
7👍2
🎙 April — голосовой ассистент для бизнеса, который управляет почтой и календарём без рук

📌 April — iOS-приложение, разработанное стартапом Cosmoverse, демонстрирует, как голосовой AI может превратиться в виртуального помощника-«Джарвиса». Запущенное в рамках Y Combinator летом 2025 года, приложение позволяет обрабатывать почту, планировать события, отменять встречи и подготавливаться к звонкам — исключительно голосом, без переключения вкладок.

📌 Ассистент умеет выявлять важные письма, отправлять ответы — причём в нужном тоне и стиле, на основе вашего голоса. Он также очищает почту от спама, организует почтовые папки, сообщает контекст перед встречей и позволяет создавать или переносить события по команде. Всё это действует hands-free, при этом ваш голос заменяет десятки кликов.

📌 Приложение доступно на iPhone и iPad с трёхдневным бесплатным периодом, затем — подписка $14.99/мес. Пользователи отмечают, что April существенно ускоряет рабочий ритм, особенно по дороге на работу: "До приезда на работу я уже догнал свой график", — пишет один из тестировавших.

🔗 Попробовать: April
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍2🔥2
🔥 VibeVoice от Microsoft: генерация подкастов на 90 минут одним запросом

📌 Microsoft представила VibeVoice — модель для генерации аудио и подкастов до полутора часов. Инструмент создаёт записи по сценарию и текстовым репликам, поддерживает до четырёх персонажей и умеет добавлять эмоции и фоновые эффекты.

В 📌 версии VibeVoice-1.5B контекстное окно до 64 тысяч токенов, длительность аудио — до 90 минут. Версия VibeVoice-7B рассчитана на 32 тысячи токенов и аудио до 45 минут. Поддерживаются английский и китайский языки.

🆓 Microsoft предоставила бесплатную демоверсию и открытый исходный код. Все результаты помечаются как сгенерированные нейросетью.

🔗 Попробовать: VibeVoice
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🔥21
🌐 Новый уровень кодинга: xAI выпустила Grok Code Fast 1 — модель с молниеносной скоростью и глубоким мышлением

📌 Grok Code Fast 1, представленная xAI, — это новая «мозговитая» модель с оптимизацией на скорость и точность. Архитектура на 314 млрд параметров с принципом Mixture-of-Experts (MoE) и контекстным окном до 256 000 токенов позволяет быстро генерировать код, устранять ошибки и строить сложные логические цепочки.

📌 До 2 сентября 2025 года модель доступна бесплатно в виде публичного превью в GitHub Copilot (Pro, Pro+, Business, Enterprise) при использовании Visual Studio Code. Дополнительно вы можете получить недельный доступ через редакторы Cursor и Kilo, а пользователям Windsurf доступ предоставлен без ограничений в премиум-планах.

📌 Тем, кто хочет интегрировать Grok Code Fast 1 в свои проекты, доступна работа через API — например, на Vercel AI Gateway (с $5 месячного бесплатного кредита) или на OpenRouter, который дает единообразный интерфейс к модели.

🔗 Попробовать: Grok Code Fast 1
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍4
🌐 Anthropic начала тестировать Claude для Chrome — браузерный AI-ассистент, который работает через расширение.

📌 Сейчас доступ открыт только для 1000 пользователей на тарифе Max ($100–200 в месяц), но компания уже открыла лист ожидания.

📌 Claude для Chrome позволяет общаться с ассистентом прямо в боковой панели браузера и даже поручать ему действия внутри вкладок — например, писать, сортировать или помогать с задачами. При этом Anthropic предупреждает: не стоит использовать его для финансовых, юридических или медицинских данных. По умолчанию Claude заблокирован на сайтах с банками, пираткой и «взрослым контентом» и всегда уточняет перед «опасными» действиями вроде публикации или покупки.

📌 Компания позиционирует это как исследовательский релиз: нужно протестировать новые риски и улучшить безопасность. Уже сейчас удалось снизить вероятность «prompt injection»-атак с 23,6% до 11,2%. Интересно, что браузеры становятся новым полем битвы для AI: Perplexity выпустила Comet, OpenAI готовит свой вариант, а Google добавила Gemini прямо в Chrome.

🔗 Попробовать: Claude
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍2🔥2