Снимаем ограничения с чатботов — на GitHub вышел инструмент, который одной командой снимает цензуру и «не могу с этим помочь» в нейросетях с открытым кодом.
В тестах на нейронке Gemma отказы упали с 97 до 3 из 100.
В тестах на нейронке Gemma отказы упали с 97 до 3 из 100.
This media is not supported in your browser
VIEW IN TELEGRAM
Qwen Image Multiple Angles 3D Camera - a Hugging Face Space
Теперь можно менять угол камеры прямо в кадре: крутить объектив в 3D, закидывать за спину персонажу, наклонять вниз, менять перспективу.
https://huggingface.co/spaces/multimodalart/qwen-image-multiple-angles-3d-camera
Теперь можно менять угол камеры прямо в кадре: крутить объектив в 3D, закидывать за спину персонажу, наклонять вниз, менять перспективу.
https://huggingface.co/spaces/multimodalart/qwen-image-multiple-angles-3d-camera
Forwarded from Телега Олега
Камеры теперь понимают, что снимают
PTZOptics работют с Visual Reasoning AI — и это, честно, немного пугает.
В прошлом году я писал про PTZ камеры имы с ними работали на нескольких проектах. И это точно перспективная история. Раньше PTZ-камера была просто механикой: крутится, зумит, стримит. Она не понимала, что перед ней. Теперь — понимает.
Говоришь камере на обычном языке: «следи за спикером в красной рубашке» — и она следит. Без разметки, без обучения модели, без маркеров.
Система одновременно анализирует видео и звук. В презентации — слышит, кто говорит, и переключает камеру. На концерте — слышит конкретный инструмент и направляет объектив на музыканта.
Это то, что раньше делал режиссёр трансляции, принимая решения в долю секунды.
Что ещё умеет:
— автоматически подбирает кадрирование и говорит оператору, что поправить
— считывает счёт с физического табло на стадионе и накладывает его в эфир
— матчит цвет между несколькими камерами без ручной цветокоррекции
— управляет OBS жестами рук
Всё это опенсорс, инструменты бесплатны, сообщество разработчиков уже больше 50 команд.
Church Production Magazine
Для нашей индустрии это конкретный вопрос: сколько людей в пультовой нужно, когда камера сама понимает сцену?
Я пока не знаю ответа. Но стараюсь следить.
А ещееее… У этих систем есть открытые API и можно навайбкодить собственный тулс, который будет понимать речь спикеров, различать объекты и тд. Как бы вы приминили такое?
PTZOptics работют с Visual Reasoning AI — и это, честно, немного пугает.
В прошлом году я писал про PTZ камеры имы с ними работали на нескольких проектах. И это точно перспективная история. Раньше PTZ-камера была просто механикой: крутится, зумит, стримит. Она не понимала, что перед ней. Теперь — понимает.
Говоришь камере на обычном языке: «следи за спикером в красной рубашке» — и она следит. Без разметки, без обучения модели, без маркеров.
Система одновременно анализирует видео и звук. В презентации — слышит, кто говорит, и переключает камеру. На концерте — слышит конкретный инструмент и направляет объектив на музыканта.
Это то, что раньше делал режиссёр трансляции, принимая решения в долю секунды.
Что ещё умеет:
— автоматически подбирает кадрирование и говорит оператору, что поправить
— считывает счёт с физического табло на стадионе и накладывает его в эфир
— матчит цвет между несколькими камерами без ручной цветокоррекции
— управляет OBS жестами рук
Всё это опенсорс, инструменты бесплатны, сообщество разработчиков уже больше 50 команд.
Church Production Magazine
Для нашей индустрии это конкретный вопрос: сколько людей в пультовой нужно, когда камера сама понимает сцену?
Я пока не знаю ответа. Но стараюсь следить.
А ещееее… У этих систем есть открытые API и можно навайбкодить собственный тулс, который будет понимать речь спикеров, различать объекты и тд. Как бы вы приминили такое?
Visual Reasoning AI™
Visual Reasoning AI™ - AI-Powered PTZ Camera Control & Visual Analysis
Professional camera control platform with AI-powered visual analysis, object detection, auto-capture automation, and Zapier integration.
Forwarded from Исходный код
Мастера по переобуванию: AWS заявили, что вайбкодинг не ускоряет разработку и даже иногда замедляет команды 😳
По словам компании, узкое место программирования не в скорости написания кода, а в отладке и поддержке. Именно поэтому в AWS считают, что у каждого PR, написанного ИИ, должен быть конкретный ответственный человек. Ну, а если вы не готовы поставить под этим кодом своё имя — переделывайте.
Пара фанфактов, чтобы освежить память:
— Это те же самые ребята, которые осенью уволили 40% ИТ-штата, чтобы заменить их на нейронки;
— Затем вдруг неприлично часто роняли сервера;
— А в феврале стало известно, что их ИИ-ассистент положил AWS, удалив и переписав весь код.
Исходный код
По словам компании, узкое место программирования не в скорости написания кода, а в отладке и поддержке. Именно поэтому в AWS считают, что у каждого PR, написанного ИИ, должен быть конкретный ответственный человек. Ну, а если вы не готовы поставить под этим кодом своё имя — переделывайте.
Пара фанфактов, чтобы освежить память:
— Это те же самые ребята, которые осенью уволили 40% ИТ-штата, чтобы заменить их на нейронки;
— Затем вдруг неприлично часто роняли сервера;
— А в феврале стало известно, что их ИИ-ассистент положил AWS, удалив и переписав весь код.
Исходный код
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Дизраптор
"Дурачок Амодеи заигрался и получил по шапке от властей 😰 "
Примерно такой тезис я вижу во многих СМИ и тг-каналах, пишущих про отключение Fable. И мне очень смешно это читать. Вот почему:
1. На неделе Anthropic выкатила модель Fable 5. По сути, это та самая страшная и ужасная "ИИ-ядерка" Mythos, но в ограничительной обёртке (нельзя кибератаки делать, уязвимости искать и всё такое).
2. Позавчера Amazon (который сам крупный инвестор в Anthropic - совпадение?) позвонил в Белый дом и рассказал, что его ребята смогли через Fable 5 получить потенциально опасные данные. Потом аналогичные доносы пришли и от других компаний.
3. Сразу после этого Anthropic получает приказ от Говарда Лютника (министра торговли США, отвечает в т.ч. за export control): всем иностранцам - закрыть доступ к Fable.
4. Anthropic вырубает Fable и Mythos глобально для всех, потому что технически невозможно отфильтровать иностранцев в реальном времени.
5. Pre-IPO бумаги Anthropic тут же падают на 3,7% на суете.
6. Все пишут, что Амодеи - мальчик, который кричал "Волки!", и вообще лох. А Anthropic теперь в заднице, потому что компании не понимают, как на его моделях строить бизнес, если власти могут их выключить в один день.
Моё мнение слегка (совсем капельку) отличается от мейнстрима. ИМХО, Anthropic получил самый-самый имба-пиар, который только может выхватить разработчик новых технологий. Весь мир получил подтверждение (устами не кого-то там, а американских властей), что фронтирные модели Anthropic настолько мощны и круты, что их придётся аж закрыть! Anthropic теперь может заявлять всему миру: "OpenAI? Google? Пффф. Их не запретили, хотя мы просили контролировать всех серьёзных ребят. А вот нас да, запретили, настолько мы опасные". Точнее, им даже говорить это не нужно, индустрия отлично считает сигнал сама.
Заблокировали отдельные модели? Ничего - придумают, в каком режиме их можно использовать, и восстановят доступ. Компании-клиенты испугались? Так ведь Opus, Sonnet и весь агентский стек на них никто не трогал. На Pre-IPO падение? Ну и ладно, это краткосрочно на фоне громкой новости. Важно - какой эффект будет в долгосроке (например, в преддверии будущего IPO и сразу после).
В общем, Амодеи и ко. получили максимально сильный публичный пруф от самого Трампа, что они - абсолютно топовая ИИ-лаба прямо сейчас. Разве можно придумать более сильный пиар для tech-компании?
Дизраптор
Примерно такой тезис я вижу во многих СМИ и тг-каналах, пишущих про отключение Fable. И мне очень смешно это читать. Вот почему:
1. На неделе Anthropic выкатила модель Fable 5. По сути, это та самая страшная и ужасная "ИИ-ядерка" Mythos, но в ограничительной обёртке (нельзя кибератаки делать, уязвимости искать и всё такое).
2. Позавчера Amazon (который сам крупный инвестор в Anthropic - совпадение?) позвонил в Белый дом и рассказал, что его ребята смогли через Fable 5 получить потенциально опасные данные. Потом аналогичные доносы пришли и от других компаний.
3. Сразу после этого Anthropic получает приказ от Говарда Лютника (министра торговли США, отвечает в т.ч. за export control): всем иностранцам - закрыть доступ к Fable.
4. Anthropic вырубает Fable и Mythos глобально для всех, потому что технически невозможно отфильтровать иностранцев в реальном времени.
5. Pre-IPO бумаги Anthropic тут же падают на 3,7% на суете.
6. Все пишут, что Амодеи - мальчик, который кричал "Волки!", и вообще лох. А Anthropic теперь в заднице, потому что компании не понимают, как на его моделях строить бизнес, если власти могут их выключить в один день.
Моё мнение слегка (совсем капельку) отличается от мейнстрима. ИМХО, Anthropic получил самый-самый имба-пиар, который только может выхватить разработчик новых технологий. Весь мир получил подтверждение (устами не кого-то там, а американских властей), что фронтирные модели Anthropic настолько мощны и круты, что их придётся аж закрыть! Anthropic теперь может заявлять всему миру: "OpenAI? Google? Пффф. Их не запретили, хотя мы просили контролировать всех серьёзных ребят. А вот нас да, запретили, настолько мы опасные". Точнее, им даже говорить это не нужно, индустрия отлично считает сигнал сама.
Заблокировали отдельные модели? Ничего - придумают, в каком режиме их можно использовать, и восстановят доступ. Компании-клиенты испугались? Так ведь Opus, Sonnet и весь агентский стек на них никто не трогал. На Pre-IPO падение? Ну и ладно, это краткосрочно на фоне громкой новости. Важно - какой эффект будет в долгосроке (например, в преддверии будущего IPO и сразу после).
В общем, Амодеи и ко. получили максимально сильный публичный пруф от самого Трампа, что они - абсолютно топовая ИИ-лаба прямо сейчас. Разве можно придумать более сильный пиар для tech-компании?
Дизраптор
Please open Telegram to view this post
VIEW IN TELEGRAM