ну это же круто очень! молодцы, китайцы
Telegram
Анализ данных (Data analysis)
✨ Alibaba выпустила код и веса FantasyPortrait
Мультипортретная анимация персонажей
В комплекте Multi-Expr Dataset — первый датасет для анимации нескольких лиц с разными выражениями
🟠 Лицензия Apache 2.0
https://huggingface.co/acvlab/FantasyPortrait
…
Мультипортретная анимация персонажей
В комплекте Multi-Expr Dataset — первый датасет для анимации нескольких лиц с разными выражениями
🟠 Лицензия Apache 2.0
https://huggingface.co/acvlab/FantasyPortrait
…
Новости от Qwen. Идут постоянно, вот и сегодня - развернули модельку на 30b параметров, mixture of experts, на 3b каждый. На моей машинке не запустишь, но если докупить второй мак мини, можно было бы попробовать. Метрики отличные, только веры им мало. Вообще, по метрикам из опенсорсных моделей (все - китайские, что бы без них делали?) рейтинг такой:
Qwen 235b,
Kimi K2,
Deepseek R1,
GLM 4.5,
Minimax M1.
Qwen 30b заявляет уровень Kimi K2
Початиться с моделькой можно по ссылке:
https://chat.qwen.ai/?model=Qwen3-30B-A3B-2507
Qwen 235b,
Kimi K2,
Deepseek R1,
GLM 4.5,
Minimax M1.
Qwen 30b заявляет уровень Kimi K2
Початиться с моделькой можно по ссылке:
https://chat.qwen.ai/?model=Qwen3-30B-A3B-2507
chat.qwen.ai
Qwen Studio
Qwen Studio is an official platform from Qwen that empowers both everyday users and developers with unified access to Qwen’s series of open-source and proprietary models. It offers comprehensive functionality spanning chatbots, image and video understanding…
Qwen, кстати, имеет и хорошие модельки по работе с изображениями. Все прям как у гугла
https://chat.qwen.ai/?inputFeature=t2i
https://chat.qwen.ai/?inputFeature=t2i
chat.qwen.ai
Qwen Studio
Qwen Studio is an official platform from Qwen that empowers both everyday users and developers with unified access to Qwen’s series of open-source and proprietary models. It offers comprehensive functionality spanning chatbots, image and video understanding…
Вот тоже такие планы имею, но не дорос пока, не то, чтобы это видео на 2,5 часа отсмотрел, но 8 агентов хочу очень ))
https://t.me/vibe_coding_community/4678
https://t.me/vibe_coding_community/4678
Telegram
Алан Бигулов | in Vibe Coding Community
Сделал мультиагента на базе 8 subagents Claude Code для работы с заметками, в видео показал https://youtu.be/uNnEHUHtZZc
Микромоделька от Google - смысл в том, что создается автоматизация, которая работает на хорошей модели, отлаживается, а потом модель меняется на все меньшую, пока не начнет падать качество. Если работает и микромодель, зачем платить за большую и дорогую? В общем, берем на заметку
Telegram
Machinelearning
⚡ Google представила Gemma 3 270M — свою новую компактную модель
Модель 270 млн параметров (170M для эмбеддингов и 100M для трансформер-блоков), но с отличной способностью следовать промтпам прямо «из коробки».
🔹 Особенности
- 256k токенов
- Энергоэффективность:…
Модель 270 млн параметров (170M для эмбеддингов и 100M для трансформер-блоков), но с отличной способностью следовать промтпам прямо «из коробки».
🔹 Особенности
- 256k токенов
- Энергоэффективность:…
И наконец хоть какие-то новости от мета - DINOv3, генерация видео, компьютерное зрение. Утверждают, что SOTA
Да, кстати, это опенсорс, и весит совсем немного
Да, кстати, это опенсорс, и весит совсем немного
Meta AI
DINOv3: Self-supervised learning for vision at unprecedented scale
DINOv3 scales self-supervised learning for images to create universal vision backbones that achieve absolute state-of-the-art performance across diverse domains, including web and satellite imagery.
Imagen4 от Google - картинки от 2 рублей за штуку. Так приходишь с работы, смотришь на новые модельки, которые появились за день, и думаешь - а что ты сделал сегодня??
https://deepmind.google/models/imagen/
https://deepmind.google/models/imagen/
Google DeepMind
Nano Banana
State-of-the-art image generation and editing models
Не можете заставить себя программировать? Заведите в Claude code тамагочи!! Он будет переживать за вас, ааш код и радоваться устранению багов ))
GitHub
GitHub - Ido-Levi/claude-code-tamagotchi: Real-time behavioral enforcement for Claude Code. Monitors AI actions, detects violations…
Real-time behavioral enforcement for Claude Code. Monitors AI actions, detects violations, and interrupts misbehavior. Also has a cute pet. - Ido-Levi/claude-code-tamagotchi
❤1
very vibe coding
И наконец хоть какие-то новости от мета - DINOv3, генерация видео, компьютерное зрение. Утверждают, что SOTA Да, кстати, это опенсорс, и весит совсем немного
Как-то я не разобрался сначала, а моделька-то не про рисование картинок, а про распознавание образов. Типа нашей задачки по оценке чистоты контейнеров на площадке. И построена по новой технологии self supervised learning. Можно качать, пользоваться и дообучать. Интересненько..🤨
У Клода скоро появится подключение к zoom, teams и пр. - можно будет использовать агентов прямо по ходу ВКС..
Забавно, впрочем, ничего удивительного, - новости в Х опережают наш телеграмм на полдня. Ну и комменты тоже интересно бывает посмотреть - народ там все-таки более прокачанный. Раньше в Х неплохо подбирвали еще и новости для меня, но как только поняли, что я из России - начали лить в ленту какой-то треш. Читаю теперь только тех, на кого подписан.
Несмотря на то, что больше писал на неделе больше про всякие модельки, сам тоже понемногу занимаюсь своими задачами, в основном - погружаюсь в тему правильного промптинга. Напишу на выходных
Несмотря на то, что больше писал на неделе больше про всякие модельки, сам тоже понемногу занимаюсь своими задачами, в основном - погружаюсь в тему правильного промптинга. Напишу на выходных
А вот такие инструкции я бы закладывал в контекст моделек при подготовке с ними промптов (вы же не сами пишете промпты)?
Forwarded from Анализ данных (Data analysis)
This media is not supported in your browser
VIEW IN TELEGRAM
- Управлять любыми приложениями через язык — клики, ввод текста, навигация
- Работает локально, бесплатно и под лицензией Apache 2.0
- Поддержка Windows и macOS (Linux в разработке)
- Новое в v0.2.0 — удалённое управление компьютером и браузером (пока только для материкового Китая)
- Локальный и приватный ассистент без облака
- Полезен для RPA, автоматизации и тестирования
- Основан на визуально-языковой модели, которая распознаёт интерфейсы и взаимодействует с ними
@data_analysis_ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Креативный совет
This media is not supported in your browser
VIEW IN TELEGRAM
🎹Elevenlabs захватывает весь sound сегмент
На этот раз video2music, инстумент генерирующий музыку для вашего видео
@creadvice #elevenlabs
На этот раз video2music, инстумент генерирующий музыку для вашего видео
@creadvice #elevenlabs
❤🔥1💅1
Я в общем не очень люблю планирование планирования. Но с нейронками этот процесс выходит на некий новый уровень. Про то, как важно писать промпты, все вроде уже знают. Я в этом уже слегка поднаторел. Пишу, конечно, не сам – говорю простыми словами Клоду, что надо сделать, он пишет промпт, и потом ему же кормлю этот промпт в новом диалоге. Получается куда лучше, чем просто одна команда.
Но это полбеды. Тут пытаюсь разобраться с Claude Code и заодно на свой новый сервер (mac mini m4 16gb) ставлю всякое ПО, и поминая как мучались в прошлый раз, часами прокидывая порты, конфигурируя докеры и пр., я решил подойти к вопросу более взвешенно.
Во-первых, попросил Клода сделать скрипт для анализа текущей конфигурации. У меня их получилось целых пять – один для железа, другой для установленного софта, третий для сетевых настроек, четвертый – конфигурация сервера в Германии (для vpn) и пятый – у меня еще NAS есть. Их результаты выгружаются в текстовый файл. Дальше – пять промптов, которые на основе этих выгрузок делают описание конфигурации.
Формат – yaml. Его понимает Claude Code, он хорошо формализован. В сам Claude Code промпты будут поступать в формате markdown. Это просто текст, слегка отформатированный, собственно все нейронки едят именно текст. И еще json, xml но markdown куда проще читать человеку. Claude Code понимает и мешанину из yaml и markdown, но другие нейронки это не любят. Передавая в Claude Code информацию в yaml, я передаю ее не столько в модель, сколько в оболочку – по сути, это задает определенные настройки для работы агента. Вся эта кухня нужна для того, чтобы уменьшить фантазии нейронок и заранее избежать конфликтов в настройках.
Посмотрим, как это будет работать в жизни, но переделать формат – вообще не проблема. Не подойдет yaml, возьмем другой. Главное, теперь у меня в нескольких файлах собрана вся информация о моей системе, и при установке и настройке новых программ это должно очень сильно облегчить их запуск. Опенсорс – очень круто, я в восторге, но возиться с ним приходится много. Без нейронок я бы это не осилил.
Для начала для работы настроил себе новый vpn – поставил формат vless, который вроде бы самый продвинутый сейчас, немного повозились – работает. Активно включаю в работу свое хранилище NAS – купил его в 2013 году, но разобраться с ним как-то получается только сейчас, опять же, спасибо нейронкам.
Еще попробую Repo Prompt – как инструмент работы с промптами. Именно по его мотивам все и затеял, но пока все сделал по старинке – вместе с Клодом. Он сегодня хорошо потрудился, молодец.
Будет интересно, пишите - пришлю примеры, как это все выглядит
Но это полбеды. Тут пытаюсь разобраться с Claude Code и заодно на свой новый сервер (mac mini m4 16gb) ставлю всякое ПО, и поминая как мучались в прошлый раз, часами прокидывая порты, конфигурируя докеры и пр., я решил подойти к вопросу более взвешенно.
Во-первых, попросил Клода сделать скрипт для анализа текущей конфигурации. У меня их получилось целых пять – один для железа, другой для установленного софта, третий для сетевых настроек, четвертый – конфигурация сервера в Германии (для vpn) и пятый – у меня еще NAS есть. Их результаты выгружаются в текстовый файл. Дальше – пять промптов, которые на основе этих выгрузок делают описание конфигурации.
Формат – yaml. Его понимает Claude Code, он хорошо формализован. В сам Claude Code промпты будут поступать в формате markdown. Это просто текст, слегка отформатированный, собственно все нейронки едят именно текст. И еще json, xml но markdown куда проще читать человеку. Claude Code понимает и мешанину из yaml и markdown, но другие нейронки это не любят. Передавая в Claude Code информацию в yaml, я передаю ее не столько в модель, сколько в оболочку – по сути, это задает определенные настройки для работы агента. Вся эта кухня нужна для того, чтобы уменьшить фантазии нейронок и заранее избежать конфликтов в настройках.
Посмотрим, как это будет работать в жизни, но переделать формат – вообще не проблема. Не подойдет yaml, возьмем другой. Главное, теперь у меня в нескольких файлах собрана вся информация о моей системе, и при установке и настройке новых программ это должно очень сильно облегчить их запуск. Опенсорс – очень круто, я в восторге, но возиться с ним приходится много. Без нейронок я бы это не осилил.
Для начала для работы настроил себе новый vpn – поставил формат vless, который вроде бы самый продвинутый сейчас, немного повозились – работает. Активно включаю в работу свое хранилище NAS – купил его в 2013 году, но разобраться с ним как-то получается только сейчас, опять же, спасибо нейронкам.
Еще попробую Repo Prompt – как инструмент работы с промптами. Именно по его мотивам все и затеял, но пока все сделал по старинке – вместе с Клодом. Он сегодня хорошо потрудился, молодец.
Будет интересно, пишите - пришлю примеры, как это все выглядит
🤔1
Любопытный учебник из Станфорда по работе с информацией. Читать лень, конечно, но вот загнать его в NotebookLM и попросить пересказать отдельные куски, либо тупо идти по главам - это будет поинтереснее. Ну или в модельку передать при проектировании RAG и пр
Только я вчера написал про свою возню с промптами, как тут читаю абсолютно противоположное мнение, что возиться с этим не надо. Производители, конечно, двигаются к тому, чтобы ПО писалось с одного промпта, но мой практический опыт говорит о следующем. Без жесткого контроля и детальной информации модели дают команды, которые не работают на вашем компе, пишут бесконечный ненужный код, моментально забивают контекст, ничего не могут исправить и в процессе исправления ошибок ломают вообще все, к чему прикасаются - их в принципе не парит то, что кроме того, с чем они работают, есть и другое ПО, которое не надо трогать.
А так да, если нейронки про смысл жизни спрашивать, промпты им не нужны. В общем, если вы не задумываетесь о том, какую информацию вы грузите в нейронку и что именно она должна делать и (!) не делать, это прямой путь к большим разочарованиям. На текущем этапе развития технологии
А так да, если нейронки про смысл жизни спрашивать, промпты им не нужны. В общем, если вы не задумываетесь о том, какую информацию вы грузите в нейронку и что именно она должна делать и (!) не делать, это прямой путь к большим разочарованиям. На текущем этапе развития технологии
Telegram
Denis Sexy IT 🤖
Хочу сказать, что те кто не заморачиватся с промптами и базами промптов – правильно поступают: любой кто строит сейчас приложения на LLM, видит в аналитике, что пользователям в целом пофигу на промпт-парсултанг, поэтому, создатели аппов заранее закладывают…
В продолжение темы. собственно примерно этим я и занимаюсь, только даю прямые команды создать промпт и работаю с ним, да и у Антропика пока таких команд нет, а общаюсь я больше с Клодом
https://t.me/data_analysis_ml/4009
https://t.me/data_analysis_ml/4009
Telegram
Анализ данных (Data analysis)
🖥 Теперь писать сложные промты самому не обязательно — OpenAI выпустили генератор, который превращает даже простой запрос в подробную инструкцию для ИИ.
Принцип простой: описываете, что хотите получить, нажимаете Optimize — GPT-5 анализирует запрос и выдаёт…
Принцип простой: описываете, что хотите получить, нажимаете Optimize — GPT-5 анализирует запрос и выдаёт…
Сегодня у меня были приключения. Положил таки свой мак мини - где-то с LM-studio и gpt-oss он перегрузился и подвис. После перезагрузки перестал отвечать на какие-то бы ни было порты. Сколько кнопку не нажимай, из какого-то своего защитного режима не выходит. Чего только не пробовал - и программно, и пытался мак подключать, ноль эффекта.
В итоге смотался на Горбушку, купил монитор за 9 тыс. руб., клаву, мышку - подключил, ввел пароль - и он работает вообще как ни в чем не бывало. С одной стороны гуд, могло быть и хуже, но с другой - что же вы черти эппловские делаете? Можно было бы и через всякие кнопки сброса дать доступ к портам, чтобы наладить работу и перезагрузиться. Можно было дать возможность подключить макбук как монитор, но нет, это не наш кейс. Рассторили. А сама машинка мак мини - крутая, вопросов нет
В итоге смотался на Горбушку, купил монитор за 9 тыс. руб., клаву, мышку - подключил, ввел пароль - и он работает вообще как ни в чем не бывало. С одной стороны гуд, могло быть и хуже, но с другой - что же вы черти эппловские делаете? Можно было бы и через всякие кнопки сброса дать доступ к портам, чтобы наладить работу и перезагрузиться. Можно было дать возможность подключить макбук как монитор, но нет, это не наш кейс. Рассторили. А сама машинка мак мини - крутая, вопросов нет
👍1
NVIDIA выпустила аж две опенсорсные модельки по распознаванию речи, одна из них еще и переводит. 24 языка, включая русский, компактные, говорят, что SOTA и бьют Whisper
https://huggingface.co/nvidia/canary-1b-v2
https://huggingface.co/nvidia/parakeet-tdt-0.6b-v3
https://huggingface.co/nvidia/canary-1b-v2
https://huggingface.co/nvidia/parakeet-tdt-0.6b-v3
huggingface.co
nvidia/canary-1b-v2 · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.