very vibe coding
122 subscribers
464 photos
126 videos
13 files
1K links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
OpenAI собрала все ресурсы для разработчиков в одном месте
👍2
Google выкатил MCP сервер для работы с Google Analytics. Это маркетинговое приложение для анализа поведения потребителей, работы с рекламой и пр. - все для повышения продаж. Интересна не сама программа а то, что Google начал расхваливать MCP. До этого Gemini заявлял, что это сырая технология, которая ему не интересна. Но, все-таки, видимо, сломались и решили не идти против рынка. Поддержка МСР появилась у Gemini CLI, а вот в десктопной версии ее пока нет, а жаль
Microsoft внедряет в Excel формулы, где результат пишет Copilot, при этом он додумывает значения в ячейках по содержанию заголовков таблицы. Но на Office 365 пока не раскатали, так что кто этим пользуется - неизвестно. В свое время я прошел все танцы с бубном чтобы достать офис с работающим копайлотом (это было реально очень сложно, хуже Гугла), но страшно в нем разочаровался. Потенциал огромный, а достижений - около нуля.

В то же время появляются и опенсорсные AI-таблички, в которых инфу заполняют нейронки. Не панацея, но как вариант
Qwen агрессивно разгоняет по Х инфу по новой модельке работы с изображениями - по тексту можно делать изменения в фоточках, просто генерация и пр.

С квантованием на 4 бита она влезает и на базовый мак мини м4 с 16гб оперативки. Жалко, что в изображениях работает только с 2 языками - английским и китайским. Но отзывы на нее очень даже хорошие.

Ниже ссылки на ресурсы

Try it now: chat.qwen.ai/?inputFeature=…
Hugging Face: huggingface.co/Qwen/Qwen-Imag…
ModelScope: modelscope.cn/models/Qwen/Qw…
Blog: qwenlm.github.io/blog/qwen-imag…
Github: github.com/QwenLM/Qwen-Im…
API: alibabacloud.com/help/en/model-…
😢1
Гайд по установке gpt-oss 20b с использованием llama сервера от одного из признанных авторитетов отрасли

Для apple есть отдельная библиотека mlx - совместимые с ней модели на эппловских машинах дают прибавку в скорости до 30%. Учитывайте, когда будете выбирать локальную модель для установки
❤1
Еще одна безделушка - командная строка для Клод-кода, которая показывает данные о модели, потраченных токенах, окне контекста и пр.
❤‍🔥1
Главная новость вчерашнего дня - это, конечно, выпуск DeepSeek V3.1. Уже третье место на Hugging Face.. Моделька с 685 миллиардами параметров - так что, это не про нас, как ее не квантуй. Для тех, кто хочет ее попробовать, кроме официального апи, на hugging face есть куча компаний, которые крутят опенсорсные модели на своих серверах, и можно закупать вычисления у них. Это касается практически любой опенсорсной модели.

Сама модель, как говорят, не то чтобы стала прямо сильно умнее, но при работе тратит сильно меньше токенов, что прямо очень хорошо. При этом рассуждений у нее также стало больше, хоть это и не ризонер. Ждем с нетерпением DeepSeek R2. Ну и, кстати, наверняка скоро выйдут маленькие дистилированные модели DeepSeek, сделанные на базе Qwen или что-то вроде того (это мне напоминает, как в детстве я на грушу прививал яблоню, в нейронках примерно также работает..)
С утречка поэксперементировал с установкой контейнера с n8n, используя Claude code. В лучших традициях вайбкодинга везде жал ок - не сразу, но все заработало. Отдельно буду также настраивать прокси и домен.

Из выводов - понял, что десктопный Клод пишет для агента неправильные Claude.md, и мне в целом для агента надо задать глобальные подходы к той же установке. Но в целом эксперимент можно признать удачным, продолжу
🚀 500+ AI Agents Projects — крупнейшая подборка реальных проектов с ИИ-агентами

Ashish Patel собрал коллекцию из 500+ проектов, где используются AI-агенты в самых разных сферах — от медицины до финансов и customer support.

🧠 Что внутри:

— Кейсы с открытым кодом: торговые боты, ассистенты, рекомендательные системы
— Поддержка популярных фреймворков: CrewAI, AutoGen, LangGraph и др.
— Агентные решения для анализа рынка, генерации резюме, видеопомощников, юристов и даже врачей
— Образовательные агенты, рекрутинговые, customer service и legal-tech проекты
— Указаны ссылки на репозитории, описание задач и идеи для расширения

📌 Почему это полезно:

✔️ Отличный старт для своего проекта
✔️ Удобно искать по индустрии и технологии
✔️ Много вдохновения для хакатонов, ресёрча и автоматизации
✔️ Поддержка сообщества: можно добавить свои кейсы

📌 Github

@data_analysis_ml
❤‍🔥1
Forwarded from Machinelearning
📌Скорость решает все: обзор эффективных архитектур для LLM.

Ландшафт архитектур LLM превратился в настоящий зоопарк. Почти каждую неделю появляются новые методы, обещающие меньший расход памяти и более быстрый инференс. Разобраться в этом становится все сложнее.

Большая группа исследователей выпустила подробный обзор Speed Always Wins, чтобы систематизировать все ключевые инновации в области эффективных архитектур для LLM.

Это не просто очередная статья, а попытка упорядочить и структурировать актуальные подходы, которые решают главную проблему классического трансформера - его квадратичную вычислительную сложность.

Обзор описывает 7 основных направлений.

🟡Линейное моделирование последовательностей.

Здесь авторы разбирают все подходы, которые так или иначе сводят сложность самовнимания к линейной. В эту категорию попадают 3 большие ветви: линейное внимание; линейные RNN, вроде и, конечно, модели на основе пространства состояний (SSM).

🟡Второе и третье направления посвящены идее разреженности.

Разреженное моделирование последовательностей основано на простом принципе: не каждый токен должен общаться с каждым. Здесь выделяются статические подходы (как в Longformer), где паттерны внимания заданы заранее, и динамические, где они определяются на лету в зависимости от контента.

🟡MoE.

Методика, которая уже стала мейнстримом. В МоЕ разреженность применяется не в механизме внимания, а в FFN-слоях, где для каждого токена активируется лишь небольшая часть экспертов, что позволяет наращивать число параметров без пропорционального роста вычислений.

🟡Четвёртый раздел - эффективное полное внимание.

В нем речь идет не об изменении асимптотической сложности, а об ее аппаратной оптимизации. Флагман - FlashAttention.

Есть детальный разбор, как за счет оптимизации обращений к памяти GPU удается кардинально ускорить вычисления, не прибегая к аппроксимациям. Сюда же относятся и групповые механизмы внимания: GQA и MQA.

🟡Гибридные архитектуры.

Это, пожалуй, самый горячий тренд. Его идея в том, чтобы стратегически комбинировать быстрые слои с линейной сложностью и медленные, но мощные слои с полным вниманием.

В обзоре выделяют два типа гибридизации: межслойную, как в Jamba, где разные типы слоев чередуются, и внутрислойную, где в одном слое разные головы могут использовать разные механизмы внимания.

 🟡Диффузионные LLM (DLLM) 
 
 Это неавторегрессионные модели, которые генерируют текст, постепенно восстанавливая его из шума. Их главная фишка в параллельном декодировании, что дает ощутимое ускорение инференса.
 
 В конце обзора есть анализ применения всех этих архитектур в разных модальностях - CV и аудио.


Так что, если хотите быстро разобраться в базовых методах, которые будут двигать дизайн LLM в ближайшее время, а двигаться он будет в сторону микширования алгоритмов, систем и железа, этот обзор - мастрид.


🟡Arxiv
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #LLM #Architectures
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Обнаружил за обедом на GitHub ссылочку на роутер, который позволяет Claude Code оптимально выбирать сторонние модели. Я вот планирую себе на сервак локальную модельку поставить - такой роутер в том или ином виде будет необходим.

Но тут надо быть осторожным. Читал сегодня статью о том, как модели выполняют невидимые команды, встроенные в промпты в составе метаданных. Это новый способ закладки бэкдоров, поэтому к сторонним промптам надо относиться параноидально
Традиционно - новые модельки от китайцев. Сегодня ByteDance выложила модель на 36 миллиардов параметров, которая конкурирует с gpt-oss 20b. Не скажу, что бенчмарки как-то особо впечатляют, но в полку моделек, которые можно развернуть дома, прибыло
По ссылке - один из самых популярных на GitHub туториалов по созданию агентов с подробным разбором всех необходимых составляющих.
В сети регулярно появляются стелс-модели, непонятно откуда взявшиеся, но выдающие впечатляющие результаты. Так, в работе с изображениями в топе моделька nano banana. В Cursor и Cline появилась модель Sonic.. По общему мнению - это большие компании тестируют свои модели, не выводя их сразу в широкую публику. В первом случае стрелки указывают на Google, во втором - на xAI, который готовит что-то типа Grok code.
Forwarded from Градиент обреченный (Sergei Averkiev)
🔺 Стандартизируем промпт-инженерию c POML

🔸 Если вы используете LLM и составляете более-менее сложные промпты, в которых есть

• пункты правил для оформления и стиля
• контент в виде картинок и таблиц
• переиспользуемые части типа системных промптов

🔸 Или если вы многократно тестируете промпты, заменяя составные части, то ваши эксперименты могут постепенно захламиться.

🔸 Возможно, вам просто удобней визуально видеть ваш промпт с ролями и отрисованным контентом, редактировать его в таком виде и обращаться в API.

🔸 В MS решили навести порядок и сколотили POML (Prompt Orchestration Markup Language). Собственно, это мини-фреймворк и язык для структурирования промптов и встраивания в него контента. Синтаксис уже довольно богатый, можно прописывать json схему ответа, встраивать кусочки кода, выражения, прописывать тулы и т.д.

🔸 .poml файлики — это конфиги для ваших промптов, с которыми можно работать в VS Code, в настройках расширения можно указать API, через которое можно гонять ваши запросы по ходу разработки. Есть python клиент, чтобы парсить эти файлики в коде и затем работать с готовым промптом.

Пробуем в работе

👉 Документация | GitHub | Demo | Paper
👍1
DeepSeek сможет работать по апи с Claude code. По МСР он и так это может, как я понимаю, но никакие интеграции лишними не будут. И если с текущим DeepSeek R1 это не так интересно - тут уж лучше GPT-5 подключать, то с R2, которого ждем, все может быть куда интереснее
Вот верю в то, что прогресс в маленьких моделях будет больше, чем в больших и разница в модели на 10b параметров и топовыми моделями будет сильно меньше чем сейчас. Большие модели будут делать умнее за счет использования большого количества разных дополнительных инструментов

https://t.me/data_secrets/7663
Вот про отношение к контексту на 100% согласен. Слабал себе сейчас системный промпт для Claude Code - там отдельным разделом экономию контекста сделал. Вопрос даже не в том, что токенов жалко - просто у Клода контекста банально не хватает, и растекание мыслью по древу отвлекает от задачи. Посмотрим, как будет работать

https://t.me/nobilix/146