Forwarded from Неискусственный интеллект (Ruslan Dz)
Товарищ Netflix
В 1930-е в СССР научились ретушировать фотографии. Попал нарком в опалу, его аккуратно стирали с групповых снимков: Ежов, Троцкий, кто-то ещё. Работали кисточкой, работали аэрографом. С фото вопрос решили.
С кино было сложнее. Фильмы приходилось класть на полку целиком или кромсать ножницами, получалось грубо, заметно, с дырами в монтаже. Инструмента не было.
Прошло 90 лет. Netflix Research опубликовал Video Object and Interaction Deletion (VOID). Фреймворк, который удаляет объекты из видео вместе со всеми физическими последствиями их присутствия в сцене.
Существующие методы умеют стирать объект и закрашивать фон за ним. Тени убрать, отражения подчистить. Но если удаленный объект с чем-то взаимодействовал (толкал, держал, ронял), результат разваливается. VOID решает именно эту задачу.
Работает так: пользователь кликает на объект. VLM (в данном случае Gemini) анализирует сцену и определяет, какие области будут затронуты удалением. Что упадет, что перестанет двигаться, что изменит траекторию. Все это кодируется в четырехзначную маску (quadmask), которая расширяет бинарную логику инпейнтинга оставить-удалить. Маска уходит в дообученную CogVideoX (открытая диффузионка от Z.ai). Та генерирует альтернативную версию событий, в которой удаленного объекта никогда не существовало.
Удалили человека, который держал гитару. Гитара естественно падает. Убрали шар из боулинга. Кегли стоят нетронутые. Стерли кота, который играл с клубком. Клубок лежит на месте.
Для обучения собрали синтетический датасет парных примеров: сцена с объектом и сцена без него с корректной физикой. Использовали Kubric от Google и HUMOTO с motion capture в Blender. Тренировали на 8 штуках A100 80GB.
Файнтюн CogVideoX на HuggingFace, статья на архиве.
Камрады плачут от зависти.
@anti_agi
В 1930-е в СССР научились ретушировать фотографии. Попал нарком в опалу, его аккуратно стирали с групповых снимков: Ежов, Троцкий, кто-то ещё. Работали кисточкой, работали аэрографом. С фото вопрос решили.
С кино было сложнее. Фильмы приходилось класть на полку целиком или кромсать ножницами, получалось грубо, заметно, с дырами в монтаже. Инструмента не было.
Прошло 90 лет. Netflix Research опубликовал Video Object and Interaction Deletion (VOID). Фреймворк, который удаляет объекты из видео вместе со всеми физическими последствиями их присутствия в сцене.
Существующие методы умеют стирать объект и закрашивать фон за ним. Тени убрать, отражения подчистить. Но если удаленный объект с чем-то взаимодействовал (толкал, держал, ронял), результат разваливается. VOID решает именно эту задачу.
Работает так: пользователь кликает на объект. VLM (в данном случае Gemini) анализирует сцену и определяет, какие области будут затронуты удалением. Что упадет, что перестанет двигаться, что изменит траекторию. Все это кодируется в четырехзначную маску (quadmask), которая расширяет бинарную логику инпейнтинга оставить-удалить. Маска уходит в дообученную CogVideoX (открытая диффузионка от Z.ai). Та генерирует альтернативную версию событий, в которой удаленного объекта никогда не существовало.
Удалили человека, который держал гитару. Гитара естественно падает. Убрали шар из боулинга. Кегли стоят нетронутые. Стерли кота, который играл с клубком. Клубок лежит на месте.
Для обучения собрали синтетический датасет парных примеров: сцена с объектом и сцена без него с корректной физикой. Использовали Kubric от Google и HUMOTO с motion capture в Blender. Тренировали на 8 штуках A100 80GB.
Файнтюн CogVideoX на HuggingFace, статья на архиве.
Камрады плачут от зависти.
@anti_agi
Forwarded from в IT и выйти
Apple вайбкодит свои приложения — разработчики случайно оставили файлы Claude .md в обновлении Apple Support.
После того, как это спалили в соцсетях, компания выпустила новую версию обновления 5.13.1. В ней следов вайбкодинга уже не было.
Вот и думайте👌
@techmedia
После того, как это спалили в соцсетях, компания выпустила новую версию обновления 5.13.1. В ней следов вайбкодинга уже не было.
Вот и думайте
@techmedia
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Nocode Live
This media is not supported in your browser
VIEW IN TELEGRAM
ИИ не понимает правил UX/UI-дизайна
Refero Styles решили эту проблему и собрали 2000 правил из популярных сервисов в одном файле. В нём поместились техники для работы с цветами, шрифтами, полями и макетами.
Подключаешь его к Claude и говоришь: «Сделай классный сайт» — всё!
Refero Styles решили эту проблему и собрали 2000 правил из популярных сервисов в одном файле. В нём поместились техники для работы с цветами, шрифтами, полями и макетами.
Подключаешь его к Claude и говоришь: «Сделай классный сайт» — всё!
Тестим
https://styles.refero.design/
Forwarded from IT головного мозга [Dunina]
Как экономить на вайбкодинге никак
Продолжим тему вайбкодинга. Мы уже поняли, что он точно убьет SAAS 🥷🏻. А еще точно удешевит разработку и прочие ваши процессы 🤖. Мы живем в прекрасную эпоху технологий - электромобили делают нашу планету чище, а вайбкодинг делает ваш бизнес более маржинальным. (если че значок "сарказм" тут, да).
MIT выяснил: 95% корпоративных AI-проектов не показали измеримого финансового результата в течение 6 месяцев. Кажется, это провал.
IBM: только 25% AI-инициатив дают ожидаемый ROI, лишь 16% масштабированы на всю компанию.
Forbes/Wharton: меньше 1% компаний получают ROI выше 20%, 53% - только 1-5%. При этом 80% компаний продолжают наращивать бюджеты.
До 2025 года Enterprise-подписка Claude включала скидки 10-15% на токены. С ноября 2025 Anthropic начал убирать эти скидки при перезаключении контрактов, с февраля 2026 - это стандарт для всех новых договоров. Для команды из 100 человек это добавляет $15 000- $40 000 к годовой стоимости по сравнению с контрактом 2025 года. С апреля 2026 агентные сессии через внешние фреймворки выведены из фиксированной подписки полностью - теперь платишь за каждый запрос к модели, а не фиксированную сумму в месяц, как раньше .
Одна сессия автономного агента за рабочий день могла стоить $1 000 - $5 000. Anthropic как полагается субсидировал на старте и вот перестал, когда вы на игле.
Uber поставил жёсткий лимит $1 500/мес на разработчика на каждый инструмент - Claude Code и Cursor считаются отдельно. Превысил - нужно разрешение. Microsoft начал отзывать корпоративные лицензии Claude Code и переводить инженеров на GitHub Copilot CLI. Эпоха "включи AI всем и пусть пользуются" - закончилась.
😐👾А кстати, вспомните еще стоимость поездок на Яндекс Такси лет 7 назад. Или посмотрите как WB выкручивает яйца своим продавцам, превратившись из прекрасной возможности заработать с нулевым входом в нормальное такое торговое рабство. Кажется история с вайбкодингом мне кое-что напоминает. Но это уже совсем другая история...
Тут нужно обозначить мою позицию четко - никакого осуждения, исключительно факты. Мы просто катимся по кривой Гартнера на дно разочарований. Но пройдет время и мы будем подниматься по склону просветления к плато продуктивности. Уверена в этом на 146%. Причем чтобы к плато ползти быстрее других - нужно, обязательно нужно экспериментировать уже сейчас. В рамках рабочих единиц, коими мы все являемся, можно действительно значительно ускориться и повысить эффективность.
А пока ставим пятничные огонечки 💥🔥💫🦄 и идем за заслуженным 🍺🍺🥂
ПОДПИСАТЬСЯ НА IT-ГОЛОВНОГО МОЗГА
Продолжим тему вайбкодинга. Мы уже поняли, что он точно убьет SAAS 🥷🏻. А еще точно удешевит разработку и прочие ваши процессы 🤖. Мы живем в прекрасную эпоху технологий - электромобили делают нашу планету чище, а вайбкодинг делает ваш бизнес более маржинальным. (если че значок "сарказм" тут, да).
Реальный экономический эффект
MIT выяснил: 95% корпоративных AI-проектов не показали измеримого финансового результата в течение 6 месяцев. Кажется, это провал.
IBM: только 25% AI-инициатив дают ожидаемый ROI, лишь 16% масштабированы на всю компанию.
Forbes/Wharton: меньше 1% компаний получают ROI выше 20%, 53% - только 1-5%. При этом 80% компаний продолжают наращивать бюджеты.
Платформы меняют модель монетизации - и это дорого
До 2025 года Enterprise-подписка Claude включала скидки 10-15% на токены. С ноября 2025 Anthropic начал убирать эти скидки при перезаключении контрактов, с февраля 2026 - это стандарт для всех новых договоров. Для команды из 100 человек это добавляет $15 000- $40 000 к годовой стоимости по сравнению с контрактом 2025 года. С апреля 2026 агентные сессии через внешние фреймворки выведены из фиксированной подписки полностью - теперь платишь за каждый запрос к модели, а не фиксированную сумму в месяц, как раньше .
Одна сессия автономного агента за рабочий день могла стоить $1 000 - $5 000. Anthropic как полагается субсидировал на старте и вот перестал, когда вы на игле.
Корпорации вводят лимиты на токены
Uber поставил жёсткий лимит $1 500/мес на разработчика на каждый инструмент - Claude Code и Cursor считаются отдельно. Превысил - нужно разрешение. Microsoft начал отзывать корпоративные лицензии Claude Code и переводить инженеров на GitHub Copilot CLI. Эпоха "включи AI всем и пусть пользуются" - закончилась.
😐👾А кстати, вспомните еще стоимость поездок на Яндекс Такси лет 7 назад. Или посмотрите как WB выкручивает яйца своим продавцам, превратившись из прекрасной возможности заработать с нулевым входом в нормальное такое торговое рабство. Кажется история с вайбкодингом мне кое-что напоминает. Но это уже совсем другая история...
Тут нужно обозначить мою позицию четко - никакого осуждения, исключительно факты. Мы просто катимся по кривой Гартнера на дно разочарований. Но пройдет время и мы будем подниматься по склону просветления к плато продуктивности. Уверена в этом на 146%. Причем чтобы к плато ползти быстрее других - нужно, обязательно нужно экспериментировать уже сейчас. В рамках рабочих единиц, коими мы все являемся, можно действительно значительно ускориться и повысить эффективность.
А пока ставим пятничные огонечки 💥🔥💫🦄 и идем за заслуженным 🍺🍺🥂
ПОДПИСАТЬСЯ НА IT-ГОЛОВНОГО МОЗГА
Forwarded from TechnoME: Multimediamind 🏴☠️
Forwarded from в IT и выйти
Стартап российских математиков залетел на главную WIRED — проект Mostik научил нейросети общаться между собой напрямую, без текста, чтобы объединять несколько моделей и экономить деньги.
Стартапу всего четыре месяца. Его основала россиянка Александра Малышева, а в команде 15 человек, почти все с PhD и опытом работы в Google, Nvidia или Perplexity.
Сама Малышева получила степень в Вышке и ещё в 2019 году взяла научную премию Яндекса за исследования мультиагентных систем.
Наши математики опять в топе😎
@techmedia
Стартапу всего четыре месяца. Его основала россиянка Александра Малышева, а в команде 15 человек, почти все с PhD и опытом работы в Google, Nvidia или Perplexity.
Сама Малышева получила степень в Вышке и ещё в 2019 году взяла научную премию Яндекса за исследования мультиагентных систем.
Наши математики опять в топе
@techmedia
Please open Telegram to view this post
VIEW IN TELEGRAM
Вот этот кусочек интересный. Ждем независимых расследований 😄
Anthropic утверждает, что Moonshot незаметно перенаправляла запросы пользователей Kimi в Claude и выдавала ответы за свои.
Forwarded from TechnoME: Multimediamind 🏴☠️
Anthropic выпустила огромный отчёт о том, как Claude пытались использовать для кибератак, шпионажа, массовой слежки и даже разработки оружия.
За восемь месяцев компания обнаружила и заблокировала целый зоопарк кейсов. В одной атаке утекли данные более 300 тысяч граждан и реестр полумиллиона компаний.
Другие хакеры с помощью AI перебрали 1,8 млн Android-приложений в поисках ключей, украли больше терабайта данных с миллионами банковских карт, добрались до систем авиакомпании с десятками миллионов пассажиров и за 34 часа вытащили около 2100 Azure-токенов более чем 40 компаний. Причём, по Anthropic, почти всю работу выполняли AI-агенты.
Отдельная глава — государственная слежка и оружие: система мониторинга примерно 25 млн SIM-карт, автоматизированный поиск диссидентов в Китае и российский проект автономного роя дронов-камикадзе.
И ещё прикол: китайские AI-компании сами использовали Claude. Anthropic утверждает, что Moonshot незаметно перенаправляла запросы пользователей Kimi в Claude и выдавала ответы за свои. Только за десять дней — почти 300 тысяч запросов через 5380 фейковых аккаунтов. Похожие схемы компания связывает с DeepSeek и другими китайскими лабораториями.
В общем, документ читается как сборник сценариев «Чёрного зеркала», только это уже threat intelligence за 2026 год.
Отчёт вышел 10 сентября 2026 года и охватывает выявленные Anthropic операции с декабря 2025-го по август 2026-го.
PDF с полными данными тыц☝️
За восемь месяцев компания обнаружила и заблокировала целый зоопарк кейсов. В одной атаке утекли данные более 300 тысяч граждан и реестр полумиллиона компаний.
Другие хакеры с помощью AI перебрали 1,8 млн Android-приложений в поисках ключей, украли больше терабайта данных с миллионами банковских карт, добрались до систем авиакомпании с десятками миллионов пассажиров и за 34 часа вытащили около 2100 Azure-токенов более чем 40 компаний. Причём, по Anthropic, почти всю работу выполняли AI-агенты.
Отдельная глава — государственная слежка и оружие: система мониторинга примерно 25 млн SIM-карт, автоматизированный поиск диссидентов в Китае и российский проект автономного роя дронов-камикадзе.
И ещё прикол: китайские AI-компании сами использовали Claude. Anthropic утверждает, что Moonshot незаметно перенаправляла запросы пользователей Kimi в Claude и выдавала ответы за свои. Только за десять дней — почти 300 тысяч запросов через 5380 фейковых аккаунтов. Похожие схемы компания связывает с DeepSeek и другими китайскими лабораториями.
В общем, документ читается как сборник сценариев «Чёрного зеркала», только это уже threat intelligence за 2026 год.
Отчёт вышел 10 сентября 2026 года и охватывает выявленные Anthropic операции с декабря 2025-го по август 2026-го.
PDF с полными данными тыц
Please open Telegram to view this post
VIEW IN TELEGRAM