very vibe coding
121 subscribers
463 photos
126 videos
13 files
991 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Forwarded from Data Secrets
Традиционно начинаем день с обновлений Anthropic: на этот раз они выкатили Advisor Strategy

Это способ получить почти топовое качество без оплаты топовой модели. Вот как работает:

– Есть две модели: Executor (исполнитель, дешевая и быстрая модель, Sonnet) и Advisor (советник, дорогая и сильная модель, Opus).

– Исполнитель делает всю основную работу. Но когда сталкивается со сложным моментом, вызывает advisor, который подсказывает, что делать дальше.

– Все происходит внутри одного запроса и вмешательства юзера не требует.

На самом деле задач, которые требуют вмешательства сильной модели, не так много. Так что на практике такой подход выходит ощутимо дешевле Opus (примерно на 10-12%) с качеством сильно выше Sonnet. Например, относительно базового Sonnet на SWE bench метрика растет почти на 3 процентных пункта.

Полезная вещь
Сделать себе сайт несложно. Теперь будет легче сделать сайт красиво… Просто скармливаем нейронке образцы дизайна и свои пожелания

https://github.com/VoltAgent/awesome-design-md
🔥1
Forwarded from Machinelearning
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ Anthropic вынесла планирование Claude Code в облако.

В Claude Code появилась команда /ultraplan - она передает планирование из локального CLI в облачную сессию Claude Code on the web.

Логика в том, что чтение кода и составление плана почти не зависят от локального окружения и спокойно уезжают в облако, тогда как реализация часто завязана на интерактивность и инструменты конкретной машины.

По расходу токенов и лимитам /ultraplan сопоставим с обычным plan mode (об этом отдельно уточнил инженер Anthropic Thariq в сети X).


Запустить можно 3 способами:

🟢командой /ultraplan с промптом;

🟢ключевым словом ultraplan внутри запроса;

🟢из approval-диалога локального plan mode, выбрав «Refine with Ultraplan».

Пока Claude разбирает репозиторий в облаке, терминал остается свободным, а статус-индикатор показывает одно из 3-х состояний: черновик пишется, требуется уточнение или план готов.

Готовый драфт открывается в браузере в отдельном review-интерфейсе. Каждая итерация порождает новую версию плана, и таких циклов может быть сколько угодно.

После согласования разработчик решает, где исполнять:

🟠«Approve and start coding» оставляет работу в той же облачной сессии и доводит ее до diff и PR на вебе.

🟠«Approve and teleport back to terminal»: план возвращается в локальный CLI, где его можно влить в текущую беседу, открыть новую сессию с чистым контекстом или просто сохранить в файл на потом.

Функция доступна в режиме research preview всем, у кого подключен Claude Code на вебе, и требует CLI версии 2.1.91 или новее, но не работает поверх Amazon Bedrock, Google Vertex AI и Microsoft Foundry.

Активный Remote Control при запуске /ultraplan отключается - оба инструмента делят один и тот же интерфейс и одновременно жить там не могут.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Пока был на трейле в Дагестане, настроил себе Claude code через телеграмм. Отличная штука - в принципе, можно запускать всех своих агентов, ставить задачи и пр. Правда, еще активно не тестировал, но это возможность починить что-то непосредственно с телефона, если вдруг нет возможности включать комп.

Ну и несколько фоточек с забега в ленту
🔥3❤2👍1
Minimax M2.7 вышла в открытом виде, и это интересно, так как модель показывает высокие бенчмарки и при этом достаточно компактна - владельцам максимальных Мак Студио можно раскатать модель на одной машинке..
⚡️ NVIDIA раздает жирнейший набор API - почти сотка нейросетей бесплатно

Без лишнего шума: открыли доступ к 95+ моделям сразу. Внутри всё, что сейчас в топе - DeepSeek, Kimi, Mistral, Qwen, Flux, Whisper, GLM и ещё пачка инструментов под любые задачи.

Можно собирать свои продукты без вложений: озвучка, чат-боты, липсинк, генерация видео, дизайн. Всё через API, без костылей и с нормальным качеством.

Самое интересное - выкатили доступ к своим моделям. Обязательно попробуй Nemotron: отлично режет шум и вытягивает звук даже с плохого микрофона.
Забирай, пока не прикрыли.

https://build.nvidia.com/models

#NVIDIA

🎯Полезные Мл-ресурсы 🚀 Max

@data_analysis_ml
В Claude Code добавили Routines - способ превратить разовые команды в повторяемые сценарии.

Теперь вместо ручного управления ты задаёшь поведение:
Claude сам выполняет цепочки действий под задачу.

По сути это не промпты, а воспроизводимые workflow внутри Claude Code

Что это даёт:

- автоматизация типовых задач
- меньше ручного контроля
- стабильный результат от запуска к запуску
- экономия времени на рутине

Ты один раз описываешь, как работать.
дальше Claude просто повторяет это как систему.

code.claude.com/docs/en/routines

🎯Полезные Мл-ресурсы 🚀 Max

@data_analysis_ml
Forwarded from эйай ньюз
ERNIE Image — новый открытый text2image генератор от Baidu

Довольно компактная 8B моделька довольно успешно соревнуется с заметно большим Qwen Image на бенчах, а также обходит Z-image по бенчам.

УДИВИТЕЛЬНО хорошо рендерит текст, для своего размера и разрешения (1MP).

Архитектурно это single stream MM-DiT. ERNIE Image кидает токены текста и патчи изображения в один общий трансформер с самого начала — никаких параллельных веток (как у Flux), все веса общие. Это проще и компактнее, при этом качество сопоставимое. Архитектурно похоже на Z-image, но проще.

Из интересных нюансов — авторы затюнили 3B LLM для перефразирования промптов юзеров, что заметно улучшает результаты, но модель можно запускать и без него. Вместе с обычными весами выпускают Turbo версию, которой нужно всего 8 шагов для генерации.

Модель запускается на 24GB VRAM, ещё и веса под Apache 2.0 (делать можно что угодно).

Го тестить, я уже поднял ее на своей H200 и модель действительно хороша!

На H200 из коробки 8 шагов генерит за 11 сек.


Демо
Блогпост
Веса
Код

@ai_newz
Когда-то я пользовался Claude Desktop, потом перешел на терминал, дальше поставил Ghostty, затем cmux (на котором сижу сейчас). Видимо, скоро надо будет возвращаться к Claude Desktop, и судя по темпу, который набрал Антропик, надолго

https://t.me/aiwizards/423
Кстати, в телеграмме Claude работает, нормально. Может подключиться к текущим сессиям tmux (если кто еще не пробовал - это прикольная фича, запускаешь ее на удаленном компе, отключаешься, подключаешься, она в фоне работает), настроил голосовые сообщения через Sber salute, подключу на выходных к своим базам - может и не так прикольно, как OpenClaw, но более контролируемо..
Forwarded from Machinelearning
⭐️ Google DeepMind представил Gemini 3.1 Flash TTS - свою самую управляемую модель генерации речи

Главная фишка - Audio Tags.


Это текстовые команды прямо в промпте, которыми можно управлять стилем голоса, подачей и темпом речи. По сути, вы режиссируете озвучку через текст.

Что ещё важно:
— Более естественное звучание речи
— Поддержка 70+ языков (русский, японский, немецкий и др.)
— Все выходные аудио маркируются SynthID (цифровой водяной знак, чтобы отличить синтезированную речь от настоящей)

На бенчмарке Artificial Analysis TTS Arena модель заняла 2-е место с Elo-рейтингом 1211 - сразу за Inworld TTS 1.5 Max (1215) и выше ElevenLabs v3 (1179).

Где попробовать:
→ Рreview через Gemini API и Google AI Studio
→ Бизнесу -а Vertex AI
→ Всем пользователям - скоро появится в Google Vids

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-flash-tts/

@ai_machinelearning_big_data

#google `#tts
У нас новый лидер по генерации видео - Happy Horse от Alibaba. Пока доступа нет, только тесты проходит..
Google сделал приложение Gemini для macOS. Интересно, есть ли там что-то, чего нет в Claude Desktop? Посмотрим..