very vibe coding
122 subscribers
464 photos
126 videos
13 files
1K links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
После того, как Mistral спалили на то, что те выдавали за свою модель дистилированный DeepSeek, даже уж и не знаю как относиться к новой модельке. В свое время я им закинул на апи $5, теперь не знаю что с этим делать - правда, говорят что есть у них SOTA модель в части распознавания сканов, но после выхода библиотеки google по извлечению информации и в этом может быть мало смысла
Конкуренция - великая сила. OpenAI тоже запустил поиск информации по прошлым разговорам
OpenAI добавила выбор моделей помимо авто режима - кроме thinking и pro появились быстрый режим и 4о. Говорят, вернут о3 и еще несколько моделей. Также раскатывают, начиная с дорогих планов, интеграцию с Google male, drive, calendar.
С утречка выбрал свой лимит общения с Клодам за два (!!) обращения к Claude Opus (вернее одно обращение, которое в первый раз сорвалось из-за проблем со связью). Пяток вопросов к Sonnet до этого не в счет. Честно говоря, не знаю что и думать, но что знаю точно - Opus использовать вместе с интернетом нельзя категорически
💯1
И по поводу большого контекста для Клода я бы пока сильно не радовался - при превышении 200 тыс токенов цена генерации сильно вырастает - проплаченные лимиты будут заканчиваться моментально. Так что, придется по-прежнему экономить
Самая милая новость недели - Google сделает за вас для ребенка сказку на ночь, да еще и с картинками. Работает и на телефоне, но думаю, что идеально будет использовать айпад. Но вот промпт все-таки еще понадобится
Новости от Qwen. Идут постоянно, вот и сегодня - развернули модельку на 30b параметров, mixture of experts, на 3b каждый. На моей машинке не запустишь, но если докупить второй мак мини, можно было бы попробовать. Метрики отличные, только веры им мало. Вообще, по метрикам из опенсорсных моделей (все - китайские, что бы без них делали?) рейтинг такой:
Qwen 235b,
Kimi K2,
Deepseek R1,
GLM 4.5,
Minimax M1.
Qwen 30b заявляет уровень Kimi K2

Початиться с моделькой можно по ссылке:
https://chat.qwen.ai/?model=Qwen3-30B-A3B-2507
Вот тоже такие планы имею, но не дорос пока, не то, чтобы это видео на 2,5 часа отсмотрел, но 8 агентов хочу очень ))

https://t.me/vibe_coding_community/4678
Микромоделька от Google - смысл в том, что создается автоматизация, которая работает на хорошей модели, отлаживается, а потом модель меняется на все меньшую, пока не начнет падать качество. Если работает и микромодель, зачем платить за большую и дорогую? В общем, берем на заметку
И наконец хоть какие-то новости от мета - DINOv3, генерация видео, компьютерное зрение. Утверждают, что SOTA

Да, кстати, это опенсорс, и весит совсем немного
Imagen4 от Google - картинки от 2 рублей за штуку. Так приходишь с работы, смотришь на новые модельки, которые появились за день, и думаешь - а что ты сделал сегодня??

https://deepmind.google/models/imagen/
Не можете заставить себя программировать? Заведите в Claude code тамагочи!! Он будет переживать за вас, ааш код и радоваться устранению багов ))
❤1
very vibe coding
И наконец хоть какие-то новости от мета - DINOv3, генерация видео, компьютерное зрение. Утверждают, что SOTA Да, кстати, это опенсорс, и весит совсем немного
Как-то я не разобрался сначала, а моделька-то не про рисование картинок, а про распознавание образов. Типа нашей задачки по оценке чистоты контейнеров на площадке. И построена по новой технологии self supervised learning. Можно качать, пользоваться и дообучать. Интересненько..🤨
У Клода скоро появится подключение к zoom, teams и пр. - можно будет использовать агентов прямо по ходу ВКС..
Забавно, впрочем, ничего удивительного, - новости в Х опережают наш телеграмм на полдня. Ну и комменты тоже интересно бывает посмотреть - народ там все-таки более прокачанный. Раньше в Х неплохо подбирвали еще и новости для меня, но как только поняли, что я из России - начали лить в ленту какой-то треш. Читаю теперь только тех, на кого подписан.

Несмотря на то, что больше писал на неделе больше про всякие модельки, сам тоже понемногу занимаюсь своими задачами, в основном - погружаюсь в тему правильного промптинга. Напишу на выходных
А вот такие инструкции я бы закладывал в контекст моделек при подготовке с ними промптов (вы же не сами пишете промпты)?
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 ByteDance выкатили **UI-TARS Desktop** — опенсорсный AI-агент для управления рабочим столом

📌 Что умеет:
- Управлять любыми приложениями через язык — клики, ввод текста, навигация
- Работает локально, бесплатно и под лицензией Apache 2.0
- Поддержка Windows и macOS (Linux в разработке)
- Новое в v0.2.0 — удалённое управление компьютером и браузером (пока только для материкового Китая)

📌 Зачем нужен:
- Локальный и приватный ассистент без облака
- Полезен для RPA, автоматизации и тестирования
- Основан на визуально-языковой модели, которая распознаёт интерфейсы и взаимодействует с ними

📂 Код: github.com/bytedance/UI-TARS-desktop

@data_analysis_ml
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🎹Elevenlabs захватывает весь sound сегмент

На этот раз video2music, инстумент генерирующий музыку для вашего видео

@creadvice #elevenlabs
❤‍🔥1💅1