Ну что, ждем сегодня Sonnet 5? Было бы круто
Честно говоря, еще очень жду DeepSeek 4 - очень любопытно, что придумали в этот раз эти творческие китайские ребята
Честно говоря, еще очень жду DeepSeek 4 - очень любопытно, что придумали в этот раз эти творческие китайские ребята
Не могу оставаться равнодушным к теме распознавания документов - это база, которая необходима. Новая моделька подоспела
https://t.me/data_analysis_ml/4671
https://t.me/data_analysis_ml/4671
Telegram
Анализ данных (Data analysis)
⚡️ GLM-OCR 0.9B - мощный OCR для сложных документов
Модель показывает SOTA-результаты в задачах понимания документов, оставаясь компактной и быстрой.
Она справляется там, где обычный OCR ломается:
- распознавание формул
- извлечение таблиц
- структурированное…
Модель показывает SOTA-результаты в задачах понимания документов, оставаясь компактной и быстрой.
Она справляется там, где обычный OCR ломается:
- распознавание формул
- извлечение таблиц
- структурированное…
Обновленный Qwen для кодинга с очень серьезными возможностями, который можно запустить на маке с 64гб памяти.. (не забывайте, что кроме места на модель еще нужно место на контекст, на и операционка ест 6гб)
X (formerly Twitter)
Unsloth AI (@UnslothAI) on X
@Alibaba_Qwen Thank you so much for releasing an open-source LLM for fast and smart coding! 🥰
We made GGUFs so you can run Qwen3-Coder-Next locally on 46GB RAM or less: https://t.co/J6Eb8c1nKO
We made GGUFs so you can run Qwen3-Coder-Next locally on 46GB RAM or less: https://t.co/J6Eb8c1nKO
Forwarded from эйай ньюз
This media is not supported in your browser
VIEW IN TELEGRAM
Kling 3.0, Omni 3.0 и Image 3.0
В теории это значит, что теперь Kling безоговорочная SOTA — он и так составлял достойную конкуренцию Veo 3.1, обладая более широким функционалом и разрешением 1080p (не только через API). O1 была не самой лучшей в плане качества, но уже мультимодальной, а теперь на вход генерации можно подавать голос и даже видео в качестве элементов. Вдобавок они выкатили еще и Kling Image 3.0. Судя по успеху motion control, новое поколение моделей должно быть крайне удачным.
Черипики у Klinga ну просто какие-то божественные, в слепом тесте я бы никогда не отличил от реальных футажей. Но это черипики, а у них они всегда были хорошие.
Генерации теперь до 15 секунд (было 10) с выбором длительности шота с шагом в 1 секунду. Появился Multi-shot как в Sora 2, прикрутили нативный звук в OMNI модель и обновили Elements 3.0. Вроде как улучшили и текст, хотя не помню, чтобы с этим были проблемы.
А вот редактирования видео я пока не увидел, его можно подавать как элемент, причём генератор будет референсить движение в кадре, в том числе мимику актера. Кстати, про русский язык в анонсе не написано, интересно, будет ли поддержка.
И всё-таки я всё ещё не фанат элементов, какие бы крутые они ни были — сгенерировать начальный кадр сейчас гораздо проще и даёт больше контроля, а видос по-прежнему генерить дорого, и я сомневаюсь, что результат будет лучше чем у бананы. В этом плане обновление Kling Image 3.0 звучит гораздо интереснее. Там, как всегда, всё стало лучше, а из новых фич добавилась генерация сторибордов, где по одному промпту генерится серия последовательных во времени кадров. NanoBanana тоже таким хвалилась, но что-то, видимо, у них не задалось, не видел, чтобы эта фича нашла применение, так ещё и гугл во всю режут лимиты и косты на компьют.
Новая версия доступна на плане Ultra, на других должно быть скоро.
Ну что, догнали Kling флагмана от гугл, как думаете? Буржуа с подпиской ультра, прошу, скидывайте тесты в комментарии!
Анонс видео
Анонс картинок
Kling 2.6
@ai_newz
В теории это значит, что теперь Kling безоговорочная SOTA — он и так составлял достойную конкуренцию Veo 3.1, обладая более широким функционалом и разрешением 1080p (не только через API). O1 была не самой лучшей в плане качества, но уже мультимодальной, а теперь на вход генерации можно подавать голос и даже видео в качестве элементов. Вдобавок они выкатили еще и Kling Image 3.0. Судя по успеху motion control, новое поколение моделей должно быть крайне удачным.
Черипики у Klinga ну просто какие-то божественные, в слепом тесте я бы никогда не отличил от реальных футажей. Но это черипики, а у них они всегда были хорошие.
Генерации теперь до 15 секунд (было 10) с выбором длительности шота с шагом в 1 секунду. Появился Multi-shot как в Sora 2, прикрутили нативный звук в OMNI модель и обновили Elements 3.0. Вроде как улучшили и текст, хотя не помню, чтобы с этим были проблемы.
А вот редактирования видео я пока не увидел, его можно подавать как элемент, причём генератор будет референсить движение в кадре, в том числе мимику актера. Кстати, про русский язык в анонсе не написано, интересно, будет ли поддержка.
И всё-таки я всё ещё не фанат элементов, какие бы крутые они ни были — сгенерировать начальный кадр сейчас гораздо проще и даёт больше контроля, а видос по-прежнему генерить дорого, и я сомневаюсь, что результат будет лучше чем у бананы. В этом плане обновление Kling Image 3.0 звучит гораздо интереснее. Там, как всегда, всё стало лучше, а из новых фич добавилась генерация сторибордов, где по одному промпту генерится серия последовательных во времени кадров. NanoBanana тоже таким хвалилась, но что-то, видимо, у них не задалось, не видел, чтобы эта фича нашла применение, так ещё и гугл во всю режут лимиты и косты на компьют.
Новая версия доступна на плане Ultra, на других должно быть скоро.
Ну что, догнали Kling флагмана от гугл, как думаете? Буржуа с подпиской ультра, прошу, скидывайте тесты в комментарии!
Анонс видео
Анонс картинок
Kling 2.6
@ai_newz
Forwarded from Креативный совет
Media is too big
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🔥Kling 3.0 уже тут...
Модель уже можно использовать на официальном сайте (если у вас тариф Ultra) и через провайдеров (например https://higgsfield.ai/)
Подробнее про релиз раскажу в видео, а пока ловите примеры того, что может делать эта модель
@creadvice | Наш курс по ИИ Видео
Модель уже можно использовать на официальном сайте (если у вас тариф Ultra) и через провайдеров (например https://higgsfield.ai/)
Подробнее про релиз раскажу в видео, а пока ловите примеры того, что может делать эта модель
@creadvice | Наш курс по ИИ Видео
Forwarded from Denis Sexy IT 🤖
Anthropic смешно троллит OpenAI: Если помните, ChatGPT планирует встроить рекламу для бесплатных пользователей и Anthropic за это зацепился, во-первых, написали статью, что у нас рекламы в Claude никогда не будет – во вторых, «запустили ни на что не намекающие рекламы»:
– В одной парень просит составить план тренировок для пресса, указывает рост 170 см - и АИ тут же предлагает ему стельки, добавляющие рост, с промокодом «hide maxing»
– В другой девушка делится бизнес-идеей, АИ начинает составлять план и вдруг переключается на рекламу быстрых займов под 400% годовых, «потому что girl boss'ам нужны быстрые деньги»
– В третьей рекламе студентка спрашивает про своё эссе, АИ хвалит работу, замечает, что дедлайн сегодня и предлагает отметить это событие ювелирными украшениями со скидкой 10%
– В четвёртой человек спрашивает, как наладить общение с мамой, АИ даёт советы — а потом добавляет: «Если отношения не исправить, найдите эмоциональную связь на сайте знакомств Golden Encounters для любителей женщин постарше»
🤣
– В одной парень просит составить план тренировок для пресса, указывает рост 170 см - и АИ тут же предлагает ему стельки, добавляющие рост, с промокодом «hide maxing»
– В другой девушка делится бизнес-идеей, АИ начинает составлять план и вдруг переключается на рекламу быстрых займов под 400% годовых, «потому что girl boss'ам нужны быстрые деньги»
– В третьей рекламе студентка спрашивает про своё эссе, АИ хвалит работу, замечает, что дедлайн сегодня и предлагает отметить это событие ювелирными украшениями со скидкой 10%
– В четвёртой человек спрашивает, как наладить общение с мамой, АИ даёт советы — а потом добавляет: «Если отношения не исправить, найдите эмоциональную связь на сайте знакомств Golden Encounters для любителей женщин постарше»
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
В этих новостях для меня самые интересные и полезные - новости по моделям распознавания голоса от Мистраль. Полезно для нас в части распознавания записей совещаний и автоматического формирования протоколов
https://t.me/ai_machinelearning_big_data/9469
https://t.me/ai_machinelearning_big_data/9469
Telegram
Machinelearning
✔️ Anthropic принципиально отказалась от рекламы в Claude.
В компании говорят, что рекламная модель просто не вяжется с инструментом, который должен быть нейтральным пространством для размышлений, работы и решения сложных задач.
Anthropic видят огромную…
В компании говорят, что рекламная модель просто не вяжется с инструментом, который должен быть нейтральным пространством для размышлений, работы и решения сложных задач.
Anthropic видят огромную…
Forwarded from Machinelearning
Ace Studio в коллабе со StepFun обновили генератор музыки ACE-Step до версии 1.5.
Порог входа уронили до минимума: младшая модель требует меньше 6 ГБ видеопамяти, а, в зависимости от настроек think mode, генерация может занять от 2 до 10 секунд - это уже уровень коммерческих решений.
Разработчики собрали гибрид из языковой модели, которая превращает промпт в чертеж композиции: расписывает структуру, придумывает лирику и метаданные и DiT, который отвечает за звук. Логическое ядро всей этой системы базируется на Qwen3.
ACE-Step v1.5 может генерировать треки длиной от 10 секунд до 10 минут, причем до 8 штук одновременно. В базе больше 1000 инструментов, а тексты песен система понимает на 50 языках.
Авторы подготовили целый набор моделей под разный объем VRAM:
При запуске, ACE-Step v1.5 автоматически выбирает подходящую под железо модель и параметры. Подробную информацию по конфигурациям можно найти тут.
ACE-Step умеет гораздо больше, чем просто превращать текст в мелодию. Можно дать ей пример аудио, чтобы скопировать стиль, делать каверы, исправлять куски уже готовых треков или генерировать аккомпанемент к вокалу.
Самая интересная функция - возможность создавать LoRA. Чтобы скормить модели свой стиль, достаточно всего 8 треков. На 30-й серии RTX с 12 ГБ памяти этот процесс займет около часа.
С деплоем все в порядке, разработчики подготовили портабельную сборку, а для ComfyUI уже написали все необходимые ноды и воркфлоу.
@ai_machinelearning_big_data
#AI #ML #Text2Music #AceStudio #StepFun
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
О, битва гигантов - вышел Claude Opus 4.6 и тут же Codex 5.3 от OpenAI. Обычные пользователи могут этого не оценить - обе модели, прежде всего, для программирования. Честно говоря, из них мне нравятся... обе.
Я пользуюсь Claude code в основном, хотя Codex почти также хорош. Решающий фактор - то, что Антропик сделал тарифы на 20, 100 и 200 баксов, а OpenAI - за 20 и 200.
Модели за 20 баксов мне уже мало, а за 200 - жаба душит. Поэтому взял за 100, а произошло это когда Антропик выкатил Опус 4.5 и снизил цену в 3 раза (хотя ChatGPT дешевле Опуса).
Кстати, о деньгах я не пожалел - теперь высадить подписочные токены очень тяжело я тупо могу работать с лучшей моделью нон-стоп.
Чистая победа маркетологов. Но был бы тариф у OpenAI за 100, взял бы и его - 2 модели прикольно использовать.
Так что прекрасные новости, модели и были лучшими (Джемини нервно курит в сторонке), а теперь будут еще круче. Супер
Я пользуюсь Claude code в основном, хотя Codex почти также хорош. Решающий фактор - то, что Антропик сделал тарифы на 20, 100 и 200 баксов, а OpenAI - за 20 и 200.
Модели за 20 баксов мне уже мало, а за 200 - жаба душит. Поэтому взял за 100, а произошло это когда Антропик выкатил Опус 4.5 и снизил цену в 3 раза (хотя ChatGPT дешевле Опуса).
Кстати, о деньгах я не пожалел - теперь высадить подписочные токены очень тяжело я тупо могу работать с лучшей моделью нон-стоп.
Чистая победа маркетологов. Но был бы тариф у OpenAI за 100, взял бы и его - 2 модели прикольно использовать.
Так что прекрасные новости, модели и были лучшими (Джемини нервно курит в сторонке), а теперь будут еще круче. Супер