very vibe coding
123 subscribers
463 photos
126 videos
13 files
995 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
📢 OpenAI опубликовала официальный Realtime Prompting Guide — подробное руководство по работе с новым моделью gpt-realtime для голос-голос взаимодействия в API.

🧠 В отличие от текстовых моделей, gpt-realtime требует особых техник промптинга. Вот ключевые:

● Делите системный промпт на секции: роль, тон, контекст, правила, инструменты, поток диалога, безопасность
● Чётко задавайте роль и цель, чтобы модель понимала свою задачу и критерии успеха
● Управляйте речью напрямую: длина ответа (2–3 предложения), темп речи, жёсткая языковая блокировка
● Добавляйте примеры фраз для стиля и правило вариативности, чтобы избежать повторов
● Указывайте правильные произношения сложных терминов, цифры и коды — по символам, с подтверждением
● Убирайте неоднозначности: давайте определения, устраняйте конфликты, используйте критику для улучшения промпта
● Для непонятного аудио — отвечать только на чёткий ввод, в том же языке запрашивать уточнение
● Точно описывайте работу инструментов: когда использовать, когда нет, добавляйте преамбулы или запрос подтверждения
● Если роли разделены на «мыслителя» и «отвечающего» — требуйте перефразировать мысль в короткий живой ответ для речи
● Организуйте диалог как состояния с целями, инструкциями, критериями выхода и примерами
● Для сложных сценариев используйте JSON state machine или динамические правила и списки инструментов
● Определяйте условия эскалации (например, 2 сбоя инструмента или 3 подряд «нет ввода»), при которых модель должна коротко и нейтрально передать разговор человеку

⚡️ Этот гайд даёт системный подход к промптингу в реальном времени и помогает строить надёжных голосовых ассистентов на базе gpt-realtime.

https://cookbook.openai.com/examples/realtime_prompting_guide
Forwarded from Data Secrets
Искали кино на выходные, а нашли золото: на YouTube вышла полуторачасовая документалка про Python

Фильм снят студией CultRepo и это большая история развития языка. В нем снялся сам создатель – Гвидо ван Россум. История, кстати, действительно достойна фильма:

– Проект начинался как стороннее хобби где-то в Амстердаме в 1990-х годах
– Сначала язык никто не понял, и в какой-то момент от чуть не изчез
– ... а сейчас на нем написана четверть всего публичного кода: это рекордная доля для любого языка за всё время существования программирования

А еще сейчас питон на первом месте по популярности в мире. Он несколько лет тусовался где-то на 3-5 местах, но в 2025 популярность ИИ и ML наконец вывела его в лидеры. Так что – смотрим

P.S. Русской озвучки, конечно, нет, но не забываем, что в Яндекс Браузере есть отличный нейросетевой перевод. Открываем видео, наводим на него курсор – там сразу появится кнопка с предложением озвучить на русском. Тыкаем и получаем очень ествественный перевод теми же голосами, что и в оригинале.
Рекомендации от OpenAI по промптингу GPT-5, всего одна страничка. Кстати, xml с удовольствием едят и другие модели..

И еще 7й рецепт промпта:
↳ “Say ‘I don’t know’ if you can’t find reliable evidence for your claims.
Then prompt GPT-5 to
↳ “Ask me clarifying questions until you are confident in answering.”
💅1
🔧 EXO Gym: Играемся с обучением нейросетей дома
EXO Labs (компания, которая сделпла доступным запуск больших моделей на кластере из нескольких маков) сделала инструмент, который превращает твой Mac в симулятор кластера для обучения нейросетей. Представь: вместо аренды дорогих GPU в облаке ты можешь экспериментировать с distributed training прямо на MacBook.

🎯 В чем фишка: Обычно для обучения больших моделей нужен кластер из десятков GPU. EXO Gym создает "виртуальный кластер" на одной машине - как будто у тебя 4-8 разных компьютеров, каждый со своей памятью и мощностью.

💡 Зачем это вайб-кодеру:
Тестируешь идеи distributed training без трат на облако
Экспериментируешь с новыми подходами обучения
Изучаешь как работают алгоритмы типа DiLoCo
Готовишься к работе с реальными кластерами

🖥️ Что можно делать на Mac Симулировать обучение на "псевдо-кластере" из 2-8 узлов. EXO Gym притворяется, что у каждого узла разная память - например, один "узел" с 4GB, другой с 8GB. Ты видишь как модель обучается распределенно.

📊 Практические результаты: Пользователи уже показали, что некоторые модели обучаются быстрее на симулированном кластере, чем на одном устройстве. Это открывает новые возможности даже для домашнего ML.

🔗 Ссылки: 🐙 GitHub 📚 Туториал

#VibeCoding #MachineLearning #ExperimentAtHome
Как ни странно, Apple тоже выпустил модель (даже несколько) - распознает содержание изображений и видео. Очень даже любопытно будет увидеть ее на следующем iPhone
Forwarded from Data Secrets
Плохие новости: там Google нашли фундаментальный баг в RAG

TL;DR: оказалось, что всеми любимый и привычный поиск на эмбеддингах может не всё и имеет серьёзный фундаментальный предел. При фиксированной размерности вектора таким подходом просто невозможно находить все релевантные документы из базы. В своей работе Google доказали это и теоретически, и экспериментально.

О чем вообще речь. Современный поиск и RAG часто опираются на single-vector эмбеддинги: у каждого запроса и документа – по одному вектору, похожесть меряем скалярным произведением/косинусом, дальше берем топ-k ближайших.

И тут возникает вопрос: а вообще возможно ли при фиксированной размерности векторов построить такой поиск, который всегда будет возвращать правильные топ-k документов для любых запросов? Ответ – нет. И сбой происходит уже на очень простых примерах.

Интуитивное объяснение, почему так: чем больше база знаний, тем больше разнообразных комбинаций запросов и релевантных документов нам нужно поддерживать. Но пространство поиска всегда ограничено размерностью эмбеддингов. Так вот, начиная с какого-то числа документов, расположить точки в этом пространстве так, чтобы для каждого запроса мы находили правильные доки, просто невозможно.

Математическое объяснение для любителей:
Представим матрицу A, где строки – это запросы, а столбцы – документы, и на пересечении стоит 1, если документ релевантен, и 0 – если нет. Мы хотим, чтобы поиск на эмбеддингах воспроизводил именно такую матрицу «кто кому подходит». Тогда оценки похожести будут матрицей B = UᵀV, где U и V – это векторы запросов и документов в пространстве фиксированной размерности d. Но sign-rank матрицы (2A−1) может оказаться больше d, а это значит, что никакие d-мерные эмбеддинги не смогут построить B с правильными значениями. Формально: если sign-rank(A) > d, то корректное разделение релевантных и нерелевантных пар в таком пространстве просто невозможно, каким бы мегаумным ни был ваш эмбеддер.


То есть, например, если у вас эмбеддинги размерности 512, то ваш RAG будет работать нормально, пока документов в вашей базе менее 500 тысяч (а это довольно немного). При размерности 1024 – до ~4 млн. При 4096 – примерно до 250 млн. Дальше система начнет сыпаться.

И эти расчеты Google подвели в идеальных условиях, когда векторы оптимизированы под задачу. На практике, когда вы не дообучаете эмбеддинги, пределы еще ниже.

Чтобы показать это на практике, авторы придумали специальный бенчмарк LIMIT. Он построен так, что у каждого запроса релевантны ровно два документа, но комбинаций этих пар очень много. В итоге даже лучшие современные эмбеддеры (GritLM, Qwen3, Gemini и др.) показывают на LIMIT катастрофически низкий recall – около 20% (причём даже на маленькой версии датасета с 46 документами, караул!).

Для сравнения, классический BM25 или multi-vector модели вроде ColBERT выбивают почти 100%. Фишка в том, что тут мы уже не зажаты одним вектором на документ и запрос. Например, у ColBERT стоится много векторов на документ.

Ну короче, мораль такова: поиск на одном векторе – это удобно и быстро, но у него есть жёсткий фундаментальный предел. Поэтому для серьёзных систем RAG все-таки нужны гибридные подходы: разреженный поиск, multi-vector и прочее. Иначе – потолок 😐

Полный текст: On the Theoretical Limitations of Embedding-Based Retrieval
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Антропик снижает лимиты на свои модели, которые и так были небольшими… Вчера и без использования безумно дорого Опуса, дважды уперся в ограничения где-то через 1,5 часа диалога.

Перешел на GPT-5. Другой стиль ответов, куда более сухой. И восстановил доступ к Gemini! мой немецкий сервер Гугл стал воспринимать как отечественный и забанил ((

Пришлось поставить еще один..
😢2🤡1
Прикольно, за 3 бакса в месяц можно себе в Claude Code подселить модельку GLM-4.5. Это хорошая опенсорсная модель (320b параметров - себе поставить непросто), так что, в свете ограничения лимитов на Клода, идея не выглядит такой уж глупой. Классно, что ее интегрировали с привычным уже для многих продуктом
Forwarded from Machinelearning
⚡️ Tencent дропнули Hunyuan-MT — мощные open-source модели для перевода

Что внутри:
- Доступны модели Hunyuan-MT-7B и Hunyuan-MT-Chimera-7B
- Поддержка 33 языков
- Chimera-7B — это первая в индустрии откртытая ансамблевая модель

🏆 Результаты:
- 1-е место в 30 из 31 категорий на международном конкурсе WMT25 (Workshop on Machine Translation 2025, крупнейшая в мире конференция-соревнование по машинному переводу)
- Hunyuan-MT-7B лидирует среди моделей своего размера

🟠Модели: https://huggingface.co/collections/tencent/hunyuan-mt-68b42f76d473f82798882597
🟠 Репозиторий: https://github.com/Tencent-Hunyuan/Hunyuan-MT
Demo: https://hunyuan.tencent.com/modelSquare/home/list

@ai_machinelearning_big_data


#AI #NLP #Translation #Tencent
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Machinelearning
Media is too big
VIEW IN TELEGRAM
🚀 HunyuanWorld-Voyager — AI, для генерации 3D миров

Tencent представили **HunyuanWorld-Voyager** — первый в мире open-source AI, который совмещает генерацию видео и нативную 3D-реконструкцию.

✨ Что это значит:
✅ Видео сразу превращается в полноценные 3D-сцены, без лишних инструментов
✅ Модель «помнит» пространство и сохраняет правильную геометрию под любым углом
✅ №1 в рейтинге Stanford WorldScore по видео и 3D-реконструкции

🎮 Использование: VR, игры, симуляции, 3D-проекты — управление с клавиатуры или джойстика.

🌐 Project Page: https://3d-models.hunyuan.tencent.com/world/
💻 GitHub: https://github.com/Tencent-Hunyuan/HunyuanWorld-Voyager
🤗 HuggingFace: https://huggingface.co/tencent/HunyuanWorld-Voyager
📄 PDF: https://3d-models.hunyuan.tencent.com/voyager/voyager_en/assets/HYWorld_Voyager.pdf
🏆 Leaderboard: https://huggingface.co/spaces/Howieeeee/WorldScore_Leaderboard

@ai_machinelearning_big_data


#AI #3D #VR #Gaming #OpenSource
🗣 TaDiCodec — новый токенайзер речи, который умеет экстремально сжимать звук без потери качества.

Что в нём особенного:
- ⚙️ Метод Binary Spherical Quantization (BSQ) — никакого «развала» кодбука
- 🎯 Латенты превращаются в дискретные токены через простую бинаризацию
- 📦 Кодбук на 16,384 токена
- 📉 Супернизкий битрейт: 0.0875 kbps при 24 kHz
- 🌀 Архитектура на diffusion autoencoder — без GAN’ов и сложных костылей

👉 TaDiCodec показывает: можно сжимать аудио в десятки тысяч раз и всё равно сохранять качество речи.

🟠HF: https://huggingface.co/amphion/TaDiCodec
🟠Github: https://github.com/HeCheng0625/Diffusion-Speech-Tokenizer

@data_analysis_ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Machinelearning
🚀 Mistral представили обновления для Le Chat:

- Более 20 коннекторов на базе MCP — от Databricks и Snowflake до GitHub и Asana.
- Новая функция Memories — ассистент запоминает важные взаимодействия, а пользователь может полностью управлять памятью (добавлять, редактировать, удалять).

Обновления делают Le Chat одним из самых удобных и готовых к бизнес-задачам AI-ассистентов.

Попробовать можно на сайте chat.mistral.ai или в мобильном приложении.

🟠 Подробности: https://mistral.ai/news/le-chat-mcp-connectors-memories.

@ai_machinelearning_big_data


#MistralAI #LeChat #AIassistant #MCP
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Больших новостей с утра нет, расскажу немного о своих поисках. Настраиваю сейчас американский сервер - мой немецкий Gemini воспринимать перестал. Все работает, но так как там будет стоять несколько программ, ставлю себе Caddy для обратного прокси.

Настраивал этот Caddy с Claude, GPT-5, Gemini. Опыт примерно такой:
со всеми нейронками так или иначе продвигались, но с Клодом неудачных редакций и переделок было прямо много, плюс после часа работы закончились лимиты. Вообще, они очень быстро стали утекать, особенно, если модель ходит в интернет. Антропик прямо рубит бабло, раздражает.

GPT-5 работает, тоже с ошибками, пишет суше - и этот стиль мне сильно меньше нравится.

А Gemini - мой безусловный фаворит. Во-первых, ошибок меньше, поиск проблем лучше. Во-вторых он все объясняет, что делаем. Очень помогает разобраться, а не просто решить частную задачу. Пишет что, куда и зачем, Клод тоже это делает, но хуже и ошибок больше. Прямо нравится, к тому же бесплатно. Google респект
Forwarded from Неискусственный интеллект (Oleg Salmanov)
💻 GPU вместо ипотеки: Magnetar снова надувает всех пузырь

Сегодня уже даже Сэм Альтман говорит об ИИ-пузыре. Но чтобы лопнуть любой пузырь нужна иголка, и кажется в нашем случае она найдена. Но для полноты картины нам придется мысленно вернуться в 2008 год.

Год этот был горячим: банки, страховые компании и рейтинговые агентства активно создавали ипотечный пузырь — выдавали сомнительные кредиты, перемешивали их с качественными, переводили в деривативы — и одновременно ставили против этой же пирамиды. Магнатом этой схемы стал хедж-фонд Magnetar — он не просто вложился, а фактически раскрутил механизм, заработав на обвале. Именно эти ребята придумали схему, которую так и назвали: Magnetar trade, когда финансист, раскручивая пузырь, ставит одновременно против него, страхуясь от краха.

Сегодня этот фонд вышел из вековечной тени и, кажется, повторяет ипотечную стратегию с GPU на базе компании CoreWeave. В новом инвестиционном цикле Magnetar придумали получать/выдавать деньги под залог GPU Nvidia. Именно так при участии Magnetar в прошлом году CoreWeave получили кредит от Blackstone. Эта схема открыла для AI-компаний, для которых до этого GPU были не активом, а пассивом, путь к кредитному финансированию, чтобы закупать больше процессоров у Nvidia, и снова закладывать их. Ничего не напоминает?

Magnetar вложила около $500 млн в долги и акции CoreWeave, а сегодня его доля в CoreWeave составляет 29% (!) и оценивается в более, чем $11 млрд. Хедж-фонд оказался с громадной бумажной прибылью — баснословные 56% годовых. По сути Magnetar уже не хедж фонд, вкладывающийся сбалансировано в разные истории, а венчурный капиталист. CoreWeave составляет половину от стоимости его активов. Но попытка выхода из этой позиции, чтобы зафиксировать прибыль, может привести к катастрофе, став спусковым крючком кризиса.

Дополнительную тревогу вызывает тесное переплетение интересов. Топ-менеджеры Magnetar переходят в CoreWeave, получая опционы на десятки миллионов долларов. Подобно тому, как рейтинговые агентства и банки до кризиса subprime одновременно обслуживали и создавали рынок ипотечных бумаг, здесь фонд и компания фактически оказываются «в одной лодке».

В новой «финансовой алхимии» замешана, к слову, и Nvidia. Компания получила долю в CoreWeave не за деньги, а за поставки GPU, превращая чипы в капитализацию компании. Напомним, что когда IPO пошло не слишком успешно, Nvidia выкупила за пару дней до размещения значительную часть акций — искусственно поддержав цену и поддувая пузырь дальше.

Кредиты CoreWeave (около $12,9 млрд) обеспечены именно GPU и контрактами — от Microsoft и других — и долговая нагрузка продолжает расти. В кредит все чаще строят и другие мегапроекты кампусов AI-датацентров. Это кредиты на десятки миллиардов долларов, которые будут упакованы и проданы дальше, чтобы снизить риски, а точнее — размазать их по всему рынку.

В 2008 году система рухнула, когда стало ясно, что залог стоит меньше кредита, то есть, что ипотечные кредиты не могут обслуживаться. Сегодня, кредиты под залог инфраструктуры работают только если рынку удастся доказать, что эти GPU могут зарабатывать AI-компаниям больше, чем они потратили на инфраструктуру. В случае же банкротства CoreWeave (или любой другой крупной облачной компании) банки попробуют реализовать залог, то есть получить процессоры Nvidia и продать их. И это может привести к эффекту домино, когда стоимость GPU упадет и банки потребуют довнести залог или деньги назад.

История вокруг CoreWeave и фонда Magnetar представляют пока только первый и второй акт этой трагедии: это ружье пока еще только заряжено и висит на стене. Но если оно выстрелит, то это может стать повторением subprime-кризиса 2008 года, только уже в инфраструктуре искусственного интеллекта.

@anti_agi
Please open Telegram to view this post
VIEW IN TELEGRAM