Вот надо бы попробовать. С появлением агентов с новыми программами стало разбираться проще, но это обещает другой уровень взаимодействия
https://t.me/denissexy/11360
https://t.me/denissexy/11360
Telegram
Denis Sexy IT 🤖
Очередное интересное применение мультимодальных LLM – небольшая штука которая живет в системе, и помогает учиться любому софту
Наконец-то я изучу Blender (нет)
Исходный код тут
Наконец-то я изучу Blender (нет)
Исходный код тут
Forwarded from Data Secrets
Традиционно начинаем день с обновлений Anthropic: на этот раз они выкатили Advisor Strategy
Это способ получить почти топовое качество без оплаты топовой модели. Вот как работает:
– Есть две модели: Executor (исполнитель, дешевая и быстрая модель, Sonnet) и Advisor (советник, дорогая и сильная модель, Opus).
– Исполнитель делает всю основную работу. Но когда сталкивается со сложным моментом, вызывает advisor, который подсказывает, что делать дальше.
– Все происходит внутри одного запроса и вмешательства юзера не требует.
На самом деле задач, которые требуют вмешательства сильной модели, не так много. Так что на практике такой подход выходит ощутимо дешевле Opus (примерно на 10-12%) с качеством сильно выше Sonnet. Например, относительно базового Sonnet на SWE bench метрика растет почти на 3 процентных пункта.
Полезная вещь
Это способ получить почти топовое качество без оплаты топовой модели. Вот как работает:
– Есть две модели: Executor (исполнитель, дешевая и быстрая модель, Sonnet) и Advisor (советник, дорогая и сильная модель, Opus).
– Исполнитель делает всю основную работу. Но когда сталкивается со сложным моментом, вызывает advisor, который подсказывает, что делать дальше.
– Все происходит внутри одного запроса и вмешательства юзера не требует.
На самом деле задач, которые требуют вмешательства сильной модели, не так много. Так что на практике такой подход выходит ощутимо дешевле Opus (примерно на 10-12%) с качеством сильно выше Sonnet. Например, относительно базового Sonnet на SWE bench метрика растет почти на 3 процентных пункта.
Полезная вещь
Сделать себе сайт несложно. Теперь будет легче сделать сайт красиво… Просто скармливаем нейронке образцы дизайна и свои пожелания
https://github.com/VoltAgent/awesome-design-md
https://github.com/VoltAgent/awesome-design-md
GitHub
GitHub - VoltAgent/awesome-design-md: A collection of DESIGN.md files analysis by popular brand design systems. Drop one into your…
A collection of DESIGN.md files analysis by popular brand design systems. Drop one into your project and let coding agents generate a matching UI. - VoltAgent/awesome-design-md
🔥1
Forwarded from Machinelearning
This media is not supported in your browser
VIEW IN TELEGRAM
В Claude Code появилась команда
/ultraplan - она передает планирование из локального CLI в облачную сессию Claude Code on the web.Логика в том, что чтение кода и составление плана почти не зависят от локального окружения и спокойно уезжают в облако, тогда как реализация часто завязана на интерактивность и инструменты конкретной машины.
По расходу токенов и лимитам /ultraplan сопоставим с обычным plan mode (об этом отдельно уточнил инженер Anthropic Thariq в сети X).
Запустить можно 3 способами:
/ultraplan с промптом;Пока Claude разбирает репозиторий в облаке, терминал остается свободным, а статус-индикатор показывает одно из 3-х состояний: черновик пишется, требуется уточнение или план готов.
Готовый драфт открывается в браузере в отдельном review-интерфейсе. Каждая итерация порождает новую версию плана, и таких циклов может быть сколько угодно.
После согласования разработчик решает, где исполнять:
Функция доступна в режиме research preview всем, у кого подключен Claude Code на вебе, и требует CLI версии 2.1.91 или новее, но не работает поверх Amazon Bedrock, Google Vertex AI и Microsoft Foundry.
Активный Remote Control при запуске
/ultraplan отключается - оба инструмента делят один и тот же интерфейс и одновременно жить там не могут.@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Пока был на трейле в Дагестане, настроил себе Claude code через телеграмм. Отличная штука - в принципе, можно запускать всех своих агентов, ставить задачи и пр. Правда, еще активно не тестировал, но это возможность починить что-то непосредственно с телефона, если вдруг нет возможности включать комп.
Ну и несколько фоточек с забега в ленту
Ну и несколько фоточек с забега в ленту
🔥3❤2👍1
Minimax M2.7 вышла в открытом виде, и это интересно, так как модель показывает высокие бенчмарки и при этом достаточно компактна - владельцам максимальных Мак Студио можно раскатать модель на одной машинке..
huggingface.co
MiniMaxAI/MiniMax-M2.7 · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Forwarded from Анализ данных (Data analysis)
⚡️ NVIDIA раздает жирнейший набор API - почти сотка нейросетей бесплатно
Без лишнего шума: открыли доступ к 95+ моделям сразу. Внутри всё, что сейчас в топе - DeepSeek, Kimi, Mistral, Qwen, Flux, Whisper, GLM и ещё пачка инструментов под любые задачи.
Можно собирать свои продукты без вложений: озвучка, чат-боты, липсинк, генерация видео, дизайн. Всё через API, без костылей и с нормальным качеством.
Самое интересное - выкатили доступ к своим моделям. Обязательно попробуй Nemotron: отлично режет шум и вытягивает звук даже с плохого микрофона.
Забирай, пока не прикрыли.
https://build.nvidia.com/models
#NVIDIA
🎯Полезные Мл-ресурсы 🚀 Max
@data_analysis_ml
Без лишнего шума: открыли доступ к 95+ моделям сразу. Внутри всё, что сейчас в топе - DeepSeek, Kimi, Mistral, Qwen, Flux, Whisper, GLM и ещё пачка инструментов под любые задачи.
Можно собирать свои продукты без вложений: озвучка, чат-боты, липсинк, генерация видео, дизайн. Всё через API, без костылей и с нормальным качеством.
Самое интересное - выкатили доступ к своим моделям. Обязательно попробуй Nemotron: отлично режет шум и вытягивает звук даже с плохого микрофона.
Забирай, пока не прикрыли.
https://build.nvidia.com/models
#NVIDIA
🎯Полезные Мл-ресурсы 🚀 Max
@data_analysis_ml
Forwarded from Анализ данных (Data analysis)
В Claude Code добавили Routines - способ превратить разовые команды в повторяемые сценарии.
Теперь вместо ручного управления ты задаёшь поведение:
Claude сам выполняет цепочки действий под задачу.
По сути это не промпты, а воспроизводимые workflow внутри Claude Code
Что это даёт:
- автоматизация типовых задач
- меньше ручного контроля
- стабильный результат от запуска к запуску
- экономия времени на рутине
Ты один раз описываешь, как работать.
дальше Claude просто повторяет это как систему.
code.claude.com/docs/en/routines
🎯Полезные Мл-ресурсы 🚀 Max
@data_analysis_ml
Теперь вместо ручного управления ты задаёшь поведение:
Claude сам выполняет цепочки действий под задачу.
По сути это не промпты, а воспроизводимые workflow внутри Claude Code
Что это даёт:
- автоматизация типовых задач
- меньше ручного контроля
- стабильный результат от запуска к запуску
- экономия времени на рутине
Ты один раз описываешь, как работать.
дальше Claude просто повторяет это как систему.
code.claude.com/docs/en/routines
🎯Полезные Мл-ресурсы 🚀 Max
@data_analysis_ml
Forwarded from эйай ньюз
ERNIE Image — новый открытый text2image генератор от Baidu
Довольно компактная 8B моделька довольно успешно соревнуется с заметно большим Qwen Image на бенчах, а также обходит Z-image по бенчам.
УДИВИТЕЛЬНО хорошо рендерит текст, для своего размера и разрешения (1MP).
Архитектурно это single stream MM-DiT. ERNIE Image кидает токены текста и патчи изображения в один общий трансформер с самого начала — никаких параллельных веток (как у Flux), все веса общие. Это проще и компактнее, при этом качество сопоставимое. Архитектурно похоже на Z-image, но проще.
Из интересных нюансов — авторы затюнили 3B LLM для перефразирования промптов юзеров, что заметно улучшает результаты, но модель можно запускать и без него. Вместе с обычными весами выпускают Turbo версию, которой нужно всего 8 шагов для генерации.
Модель запускается на 24GB VRAM, ещё и веса под Apache 2.0 (делать можно что угодно).
Го тестить, я уже поднял ее на своей H200 и модель действительно хороша!
На H200 из коробки 8 шагов генерит за 11 сек.
Демо
Блогпост
Веса
Код
@ai_newz
Довольно компактная 8B моделька довольно успешно соревнуется с заметно большим Qwen Image на бенчах, а также обходит Z-image по бенчам.
УДИВИТЕЛЬНО хорошо рендерит текст, для своего размера и разрешения (1MP).
Архитектурно это single stream MM-DiT. ERNIE Image кидает токены текста и патчи изображения в один общий трансформер с самого начала — никаких параллельных веток (как у Flux), все веса общие. Это проще и компактнее, при этом качество сопоставимое. Архитектурно похоже на Z-image, но проще.
Из интересных нюансов — авторы затюнили 3B LLM для перефразирования промптов юзеров, что заметно улучшает результаты, но модель можно запускать и без него. Вместе с обычными весами выпускают Turbo версию, которой нужно всего 8 шагов для генерации.
Модель запускается на 24GB VRAM, ещё и веса под Apache 2.0 (делать можно что угодно).
Го тестить, я уже поднял ее на своей H200 и модель действительно хороша!
На H200 из коробки 8 шагов генерит за 11 сек.
Демо
Блогпост
Веса
Код
@ai_newz
Надо пробовать, тем более, что главного агента-программиста у меня зовут Андрей (догадайтесь, в честь кого..)
https://t.me/data_secrets/9053
https://t.me/data_secrets/9053
Telegram
Data Secrets
36к звезд за два дня набрал репозиторий с единственным файлом CLAUDE.md
Это один единственный скилл для агента, в котором автор воплотил советы по программированию от Андрея Карпаты. Скилл, кстати, так и называется в честь Андрея:
github.com/forrestchang/andrej…
Это один единственный скилл для агента, в котором автор воплотил советы по программированию от Андрея Карпаты. Скилл, кстати, так и называется в честь Андрея:
github.com/forrestchang/andrej…
👍1
Когда-то я пользовался Claude Desktop, потом перешел на терминал, дальше поставил Ghostty, затем cmux (на котором сижу сейчас). Видимо, скоро надо будет возвращаться к Claude Desktop, и судя по темпу, который набрал Антропик, надолго
https://t.me/aiwizards/423
https://t.me/aiwizards/423
Telegram
Anton Vdovitchenko — One Man Enterprise
Пишут, что на этой неделе готовится к выходу Opus 4.7, прямо, чуть ли не завтра.
Также в паре с ним обещают новый prompt-based Design Tool, скорее всего «пришли» за Figma Make / Vercel v0 / Replit / Bolt.
А ещё, сегодня запустили новый Claude Code Desktop.…
Также в паре с ним обещают новый prompt-based Design Tool, скорее всего «пришли» за Figma Make / Vercel v0 / Replit / Bolt.
А ещё, сегодня запустили новый Claude Code Desktop.…
Кстати, в телеграмме Claude работает, нормально. Может подключиться к текущим сессиям tmux (если кто еще не пробовал - это прикольная фича, запускаешь ее на удаленном компе, отключаешься, подключаешься, она в фоне работает), настроил голосовые сообщения через Sber salute, подключу на выходных к своим базам - может и не так прикольно, как OpenClaw, но более контролируемо..
Forwarded from Machinelearning
⭐️ Google DeepMind представил Gemini 3.1 Flash TTS - свою самую управляемую модель генерации речи
Главная фишка - Audio Tags.
Это текстовые команды прямо в промпте, которыми можно управлять стилем голоса, подачей и темпом речи. По сути, вы режиссируете озвучку через текст.
Что ещё важно:
— Более естественное звучание речи
— Поддержка 70+ языков (русский, японский, немецкий и др.)
— Все выходные аудио маркируются SynthID (цифровой водяной знак, чтобы отличить синтезированную речь от настоящей)
На бенчмарке Artificial Analysis TTS Arena модель заняла 2-е место с Elo-рейтингом 1211 - сразу за Inworld TTS 1.5 Max (1215) и выше ElevenLabs v3 (1179).
Где попробовать:
→ Рreview через Gemini API и Google AI Studio
→ Бизнесу -а Vertex AI
→ Всем пользователям - скоро появится в Google Vids
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-flash-tts/
@ai_machinelearning_big_data
#google `#tts
Главная фишка - Audio Tags.
Это текстовые команды прямо в промпте, которыми можно управлять стилем голоса, подачей и темпом речи. По сути, вы режиссируете озвучку через текст.
Что ещё важно:
— Более естественное звучание речи
— Поддержка 70+ языков (русский, японский, немецкий и др.)
— Все выходные аудио маркируются SynthID (цифровой водяной знак, чтобы отличить синтезированную речь от настоящей)
На бенчмарке Artificial Analysis TTS Arena модель заняла 2-е место с Elo-рейтингом 1211 - сразу за Inworld TTS 1.5 Max (1215) и выше ElevenLabs v3 (1179).
Где попробовать:
→ Рreview через Gemini API и Google AI Studio
→ Бизнесу -а Vertex AI
→ Всем пользователям - скоро появится в Google Vids
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-flash-tts/
@ai_machinelearning_big_data
#google `#tts