Forwarded from Метаверсище и ИИще
This media is not supported in your browser
VIEW IN TELEGRAM
Вы будете смеяцца, но у нас новый видео генератор.
И это просто конский монстр. По сравнению с ним Минимакс - это Stable Diffusion 1.5 на два килобайта.
Итак MAGI-2 Preview - открытая unified audio-video модель на 114B параметров, построенная как очень мелкозернистый MoE. Единовременно активируется около 6B параметров, то есть примерно 5% всей ёмкости модели. Sand AI называет это Ultra-Fine-Grained MoE / MagiMoE.
Модель одновременно работает с текстом, видео и аудио в одном Transformer backbone.
Сейчас заявлены T2V и I2V, причём звук генерируется совместно с изображением, а не приклеивается отдельной моделью после генерации. Выход пока жёстко ограничен 10 секундами. Референсов и редактирования нет.
Генерация двухступенчатая:
- base/preview: 512 × 896
- refiner: 1088 × 1920
- затем при необходимости output ресайзится до настоящих 1080 × 1920.
А теперь праздник: системные требования
Официальный MINIMUM(!):
8 × NVIDIA Hopper GPU.
Типа 8×H100/H200. Общий размер весов - около 307 GB:
- main preview transformer - 228 GB
- Qwen3.5-27B text encoder - 56 GB
- refiner - 14 GB
- Stable Audio Open audio VAE - 5 GB
- Wan 2.2 video VAE - 3 GB
- Turbo VAE decoder - 2 GB.
То есть полный зоопарк - особенно напрягает Stable Audio и древний ВАН.
По счастию Монстр уже есть на Artificial Analysis.
И среди open-weight video models with audio сейчас картина такая:
1. MiniMax H3 - 1192
2. MAGI-2 Preview - 1108
3. LTX-2.3 Fast - 958
Наверное можно расходиться, но впереди еще MAGI-2 distilled, которой нет.
Ну и надо подсобрать тесты, пока мало примеров.
А теперь самое главное - дешевая цена (в облаке):
MAGI-2 Preview теоретически обходится Sand.ai примерно в $0.074 за 10 секунд 1080p, но официальную пользовательскую цену API за такой ролик Sand.ai публично не раскрывает. Более того, по идее это цена за distilled модель, которой пока нет.
Cсылки:
https://platform.sand.ai/
https://platform.sand.ai/docs/api-v2
https://platform.sand.ai/app/buy-credits
https://sand.ai/blog/magi-2-preview
https://github.com/SandAI-org/MAGI-2-preview
https://huggingface.co/sand-ai/MAGI-2-preview
https://artificialanalysis.ai/video/leaderboard/image-to-video
@cgevent
И это просто конский монстр. По сравнению с ним Минимакс - это Stable Diffusion 1.5 на два килобайта.
Итак MAGI-2 Preview - открытая unified audio-video модель на 114B параметров, построенная как очень мелкозернистый MoE. Единовременно активируется около 6B параметров, то есть примерно 5% всей ёмкости модели. Sand AI называет это Ultra-Fine-Grained MoE / MagiMoE.
Модель одновременно работает с текстом, видео и аудио в одном Transformer backbone.
Главная архитектурная фишка интереснее самого числа 114B. Backbone - **40 Transformer layers**, из них средние **36 слоёв MoE**, четыре крайних dense. Hidden width 3072 разбивается на **12 независимых head по 256 dimensions**. У каждого head собственный набор из **256 экспертов**, а на токен выбираются Top-6. То есть на одном MoE-слое потенциально существует 12 × 256 = **3072 маленьких expert-блоков**, но конкретный токен использует всего 72 из них. Это позволяет хранить огромное количество специализированных параметров, не прогоняя 114B целиком на каждом diffusion step.
Сейчас заявлены T2V и I2V, причём звук генерируется совместно с изображением, а не приклеивается отдельной моделью после генерации. Выход пока жёстко ограничен 10 секундами. Референсов и редактирования нет.
Генерация двухступенчатая:
- base/preview: 512 × 896
- refiner: 1088 × 1920
- затем при необходимости output ресайзится до настоящих 1080 × 1920.
А теперь праздник: системные требования
Официальный MINIMUM(!):
8 × NVIDIA Hopper GPU.
Типа 8×H100/H200. Общий размер весов - около 307 GB:
- main preview transformer - 228 GB
- Qwen3.5-27B text encoder - 56 GB
- refiner - 14 GB
- Stable Audio Open audio VAE - 5 GB
- Wan 2.2 video VAE - 3 GB
- Turbo VAE decoder - 2 GB.
То есть полный зоопарк - особенно напрягает Stable Audio и древний ВАН.
По счастию Монстр уже есть на Artificial Analysis.
И среди open-weight video models with audio сейчас картина такая:
1. MiniMax H3 - 1192
2. MAGI-2 Preview - 1108
3. LTX-2.3 Fast - 958
Наверное можно расходиться, но впереди еще MAGI-2 distilled, которой нет.
Ну и надо подсобрать тесты, пока мало примеров.
А теперь самое главное - дешевая цена (в облаке):
MAGI-2 Preview теоретически обходится Sand.ai примерно в $0.074 за 10 секунд 1080p, но официальную пользовательскую цену API за такой ролик Sand.ai публично не раскрывает. Более того, по идее это цена за distilled модель, которой пока нет.
Cсылки:
https://platform.sand.ai/
https://platform.sand.ai/docs/api-v2
https://platform.sand.ai/app/buy-credits
https://sand.ai/blog/magi-2-preview
https://github.com/SandAI-org/MAGI-2-preview
https://huggingface.co/sand-ai/MAGI-2-preview
https://artificialanalysis.ai/video/leaderboard/image-to-video
@cgevent
This media is not supported in your browser
VIEW IN TELEGRAM
Киберпанк, который мы заслужили
Бар будущего найден
В Пекине открыли AGI Bar, где вместо бесплатного Wi-Fi гостям раздают бесплатные токены DeepSeek. Рядом с барной стойкой стоят две рабочие станции с NVIDIA, на которых локально крутится дипсик V4 Flash. Приходишь, берёшь пивчанский и спокойно кодишь без подписок.
Внутри всё тоже как положено: логотипы ИИ-компаний на стенах, вакансии нейролабораторий на экранах и фирменный коктейль AGI почти целиком из пены (шутка про пузырь вокруг ИИ).
Наконец-то нормальный коворкинг.
В Пекине открыли AGI Bar, где вместо бесплатного Wi-Fi гостям раздают бесплатные токены DeepSeek. Рядом с барной стойкой стоят две рабочие станции с NVIDIA, на которых локально крутится дипсик V4 Flash. Приходишь, берёшь пивчанский и спокойно кодишь без подписок.
Внутри всё тоже как положено: логотипы ИИ-компаний на стенах, вакансии нейролабораторий на экранах и фирменный коктейль AGI почти целиком из пены (шутка про пузырь вокруг ИИ).
Наконец-то нормальный коворкинг.
Forwarded from Метаверсошная
This media is not supported in your browser
VIEW IN TELEGRAM
На ютубе вышло очередное громкое расследование от громкого расследователя про то, что юзеры в виртуальных пространствах периодически, так сказать, любят друг друга.
Чтобы выяснить все детали, челу пришлось уволиться с работы и 500 дней тусить, бухать и заниматься виртуальным сексом с разными людьми.
Тяжелый труд!
Твиттер в полном восторге.
Чтобы выяснить все детали, челу пришлось уволиться с работы и 500 дней тусить, бухать и заниматься виртуальным сексом с разными людьми.
Тяжелый труд!
Твиттер в полном восторге.
Forwarded from Denis Sexy IT 🤖
This media is not supported in your browser
VIEW IN TELEGRAM
Увидел тут полную карту мозга мухи (FlyWire – там размечены все 139 тысяч нейронов дрозофилы) и не удержался – сделал 3D-муху, которая живёт на рабочем столе мака
Внутри настоящая карта нейронов дрозофилы (FlyWire), так что от курсора она улетает не по скрипту, а когда у неё реально загорается нейрон побега – тот же, что у живой мухи
Ещё есть окошко с её мозгом: кликаешь по зоне нейронов – муха чешется, пятится или паникует
Днём у неё сиеста, ночью она спит, а на горячем маке бегает быстрее (я не шучу, у нее какие-то евенты из MacOS прокинуты в симуляцию мозга😋 )
Исходный код тут:
https://github.com/DenisSergeevitch/desktop-fly
Получается, вечная электронная 2D жизнь в симуляции
P.S. Раздражает правда как живая,рекомендую
Внутри настоящая карта нейронов дрозофилы (FlyWire), так что от курсора она улетает не по скрипту, а когда у неё реально загорается нейрон побега – тот же, что у живой мухи
Ещё есть окошко с её мозгом: кликаешь по зоне нейронов – муха чешется, пятится или паникует
Днём у неё сиеста, ночью она спит, а на горячем маке бегает быстрее (я не шучу, у нее какие-то евенты из MacOS прокинуты в симуляцию мозга
Исходный код тут:
https://github.com/DenisSergeevitch/desktop-fly
Получается, вечная электронная 2D жизнь в симуляции
P.S. Раздражает правда как живая,
Please open Telegram to view this post
VIEW IN TELEGRAM
12 недель до Demo Day в Y Combinator, и ноль лидов в пайплайне.
У фаундеров Humoniq из батча YC S25 был крутой продукт и была одна важная дата в календаре.
Между ними всего 12 недель, и заполнить их нужно было не слайдами и теорией про будущие продажи, а реальными демо-звонками, LOI и подписанными контрактами. На Demo Day в YC смотрят не на идею и грандиозные планы, а на настоящий трекшн и живой пайплайн компаний которым нужен твой продукт.
Ситуация знакомая почти каждому B2B / IT / SaaS-стартапу: продукт есть, а стабильного канала продаж нет.
Фаундеры Humoniq пришли к Мише.
До этого Миша руководил командой продажников в лондонском офисе WP Engine (SaaS-единорог на чьих серверах крутится 10%+ сайтов планеты), а сейчас строит Go-to-Market для стартапов Y Combinator: 5 успешных кейсов с YC-командами и десятки других кейсов по всему миру.
За 12 недель, с нуля сделали 50%+ open rate, 10%+ reply rate, 60+ квалифицированных демо, 15+ сделок в пайплайне и впоследствии 3 закрытых enterprise-контракта с Delta Airlines, American Express, Expedia!
Полный разбор того, что конкретно было сделано можно глянуть вот здесь, у Миши в канале. Там он регулярно разбирает реально рабочие фреймворки лидгена в 2026 году: founder-led, signal-based, creative storytelling, AI-автоматизации и свои другие кейсы из YC.
Канал будет полезен фаундерам и командам которые строят проекты в B2B / IT / SaaS / Web3. К тому же прямо сейчас Миша ищет одного фаундера, чтобы в лайв-формате построить ему лидген с нуля. Отбор стартует уже в сентябре!
Заценить подход и кейсы Миши можно тут:
👉 Про B2B аутрич из Долины
#промо
У фаундеров Humoniq из батча YC S25 был крутой продукт и была одна важная дата в календаре.
Между ними всего 12 недель, и заполнить их нужно было не слайдами и теорией про будущие продажи, а реальными демо-звонками, LOI и подписанными контрактами. На Demo Day в YC смотрят не на идею и грандиозные планы, а на настоящий трекшн и живой пайплайн компаний которым нужен твой продукт.
Ситуация знакомая почти каждому B2B / IT / SaaS-стартапу: продукт есть, а стабильного канала продаж нет.
Фаундеры Humoniq пришли к Мише.
До этого Миша руководил командой продажников в лондонском офисе WP Engine (SaaS-единорог на чьих серверах крутится 10%+ сайтов планеты), а сейчас строит Go-to-Market для стартапов Y Combinator: 5 успешных кейсов с YC-командами и десятки других кейсов по всему миру.
За 12 недель, с нуля сделали 50%+ open rate, 10%+ reply rate, 60+ квалифицированных демо, 15+ сделок в пайплайне и впоследствии 3 закрытых enterprise-контракта с Delta Airlines, American Express, Expedia!
Полный разбор того, что конкретно было сделано можно глянуть вот здесь, у Миши в канале. Там он регулярно разбирает реально рабочие фреймворки лидгена в 2026 году: founder-led, signal-based, creative storytelling, AI-автоматизации и свои другие кейсы из YC.
Канал будет полезен фаундерам и командам которые строят проекты в B2B / IT / SaaS / Web3. К тому же прямо сейчас Миша ищет одного фаундера, чтобы в лайв-формате построить ему лидген с нуля. Отбор стартует уже в сентябре!
Заценить подход и кейсы Миши можно тут:
👉 Про B2B аутрич из Долины
#промо
Amazon на днях радостно объявил, что масштабирует доставку дронами на 500 городов США, в очередной раз расхвалив свои "умные алгоритмы для безопасного сброса посылок".
Тем временем люди уже начали показывать как выглядит безопасный сброс посылок:
Тем временем люди уже начали показывать как выглядит безопасный сброс посылок:
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Как тебе такое, Бостон Динамикс?
Forwarded from Метаверсошная
This media is not supported in your browser
VIEW IN TELEGRAM
причина, по которой они не дают нам пробовать виар в магазинах
(интересно, что это там за игра у него была)
Тем временем в Британских поликлиниках решили победить вечный ад с дозвонами пациентов на запись и КОНЕЧНО ЖЕ посадили на телефоны ИИ-секретаря по имени EMMA.
Стартаперы из QuantumLoopAI, которые и запилили это чудо, гордо заявили, что их виртуальный ассистент умеет аж в 17 языков, мгновенно проводит первичный опрос и распределяет талоны на приём не зная усталости.
И конечно же, всё пошло в итоге через жопу: выяснилось, что нейронка на 17 языках говорит без проблем, а вот вдуплить йоркширский акцент местных дедов и бабок — это задача со звёздочкой для современных кремниевых болванов. Для цифрового ассистента этот местный акцент звучал примерно как эльфийский язык.
На любые жалобы больных людей бот тупо уходил в ступор, нёс абы что или вообще молча вешал трубку.
В итоге разгневанные люди массово шлют нахер новые технологии, бросают трубки и чапают в поликлинику пешком. Не, ну а чо, технически проблема с дозвоном действительно решена же: звонить больше никто не хочет.
Стартаперы из QuantumLoopAI, которые и запилили это чудо, гордо заявили, что их виртуальный ассистент умеет аж в 17 языков, мгновенно проводит первичный опрос и распределяет талоны на приём не зная усталости.
И конечно же, всё пошло в итоге через жопу: выяснилось, что нейронка на 17 языках говорит без проблем, а вот вдуплить йоркширский акцент местных дедов и бабок — это задача со звёздочкой для современных кремниевых болванов. Для цифрового ассистента этот местный акцент звучал примерно как эльфийский язык.
На любые жалобы больных людей бот тупо уходил в ступор, нёс абы что или вообще молча вешал трубку.
В итоге разгневанные люди массово шлют нахер новые технологии, бросают трубки и чапают в поликлинику пешком. Не, ну а чо, технически проблема с дозвоном действительно решена же: звонить больше никто не хочет.
the Guardian
Frustrated GP patients hang up as Yorkshire accent baffles AI receptionist
‘Emma’ the Rotherham chatbot has 17 languages says AI firm – but health watchdog says system struggling with local ‘twangs’