Метаверсище и ИИще
52.4K subscribers
6.61K photos
5.48K videos
49 files
7.75K links
Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие.
Для связи: @SergTsyp
Download Telegram
Anthropic перетряхнула интерфейс приложения и объединила все в один интерфейс.

Я регулярно выжигаю 5 часовые лимиты в chatGPT - причем НЕ на кодовых задачах, поэтому у меня ощущение, что Клод в приложении теперь будет жрать токены как не в себя. Поправьте меня, если я не так понял.

Я пока вижу так:

Anthropic решила, что Chat и Cowork - это слишком сложно для нормальных негиков, и теперь объединяет их в один Claude. Раньше всё было понятно: хочешь поговорить - Chat, хочешь отправить агента читать файлы, лазить по интернету, запускать код и собирать тебе готовый результат - Cowork.

Теперь переключатель Chat / Cowork исчезает. ВООБЩЕ. Ты просто пишешь Claude, чего хочешь, а он сам решает: достаточно тебе обычного ответа или пора превращать разговор в полноценную агентную задачу. В тот же интерфейс подтягиваются Documents, Slides, Design, Artifacts и прочие новые (интересные, кстати) рабочие инструменты. Старые чаты и Cowork-задачи тоже оказываются в общей истории.

С точки зрения UX идея красивая: не заставлять кожаного разбираться, какой именно инструмент ему нужен. Сказал «изучи эти документы и сделай презентацию» - Claude сам понял, что надо читать файлы, строить план, запускать инструменты и выдавать готовые слайды.

И тут у меня вопросы. Chat, Claude Code и бывший Cowork расходуют общий usage подписки. А агентная задача по определению прожорливее обычного чата: каждый поиск, чтение файла, запуск инструмента, промежуточное рассуждение и следующий шаг агента - это дополнительные токены.

Причём Anthropic по-прежнему не говорит, сколько именно этих токенов у вас есть на подписке. Закончился включённый usage - можно подключить дополнительные credits и продолжать уже за отдельные деньги.

У меня ChatGPT тоже умеет понять, что запрос больше подходит для полноценной агентной работы, но предлагает: эту задачу лучше сделать в Work - переходим? Я могу согласиться, а могу сказать «нет, остаёмся здесь».

В новом Claude отдельного подтверждения перехода в Cowork вроде нет. Claude сам определяет, будет это quick answer или agentic task. Ты увидишь план, действия инструментов и прогресс и сможешь всё это остановить, а в Manual Mode - подтверждать отдельные действия. Но отдельной кнопки «Chat only / никогда не запускай Cowork» тоже вроде нет. Максимум можно словами попросить: «дай только быстрый ответ, ничего не запускай». Что странно.

Получается как бы так: Claude сам решает, когда пора начать активнее расходовать ваш общий лимит, точный размер которого Anthropic вам при этом не сообщает.

С учетом того, что один вызов Дизайна выжирает половину лимита, вопрос актуальный:

А как контролировать переход агентский режим?

Или я что-то не так понял?

Официальный анонс Anthropic:

https://claude.com/blog/cowork-is-now-claude

@cgevent
25👎9😱6🔥4😁3👍2
По поводу поста с Койотцем

Это Emre Altay (инста @emrealtay.ai, профиль Emre ALTAY Production) крутой турецкий чувак - в профиле: разработка кинематографичных проектов в сфере кино и рекламы с помощью ИИ.

Работа называется - Road Runner & Coyote - Realistic New Ai Version.

Made with Seedance2.5 on @dreamina_ai

А вот референсы - оригинальные мультфильмы:

https://youtube.com/watch?v=Zg2Cs851SwM - 1949 год(!)

https://www.youtube.com/watch?v=zjOtnwEwMy0 - 2020 год


Ну то есть это не чистый text\image-to-video. Думаю там сложный гибридный пайплайн: классический ретаргетинг анимации + референсы для Сидэнского + нейрорендеринг + композ.

И вопрос о том, анимация или генерация был с подвохом.

Это и анимация, и генерация.

Без исходной анимации, такую генерацию не сделать.

@cgevent
👍28😁93🙏3🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
O1-Video-1.0: Вы будете смеяцца, но у нас новый видеогенератор.

HiDream бахнули HiDream-O1-Video-1.0 - новую нативно омнимодальную видеомодель. Модель принимает одновременно текст, изображения и видео и генерирует ролики 1080p длительностью от 5 до 20 секунд.

Спойлер: весов и кода пока нет. Но есть гипотеза, что будут, ибо их O1-Image опенсорснута: имеет официальные веса, Diffusers и поддержку ComfyUI.

Главный заявленный акцент не на качестве, а на temporal/physical consistency - сохранении объектов, персонажей, геометрии сцены и более правдоподобной физике во времени.

На видеоарене восьмое место. Пока.

Это продолжение архитектурной линии HiDream-O1. В O1-Image разные модальности кодируются в общем пространстве Pixel-level Unified Transformer без отдельного VAE и разрозненных энкодеров. Для O1-Video Хидрим теперь переносит идею unified multimodal generation на видео.

Пока нет нигде на попробовать.

Но я нашел API эндпойнт тут:
https://hiharness.ai/docs/hidream_o/video/introduction.html
Документация со всеми video_list, reference и editing:
https://hiharness.ai/docs/hidream_q/video/video_request.html

Причем на входе есть image_list, element_list, video_list, multi-shot и звук. И video_list принимает MP4/MOV и различает два типа видео: base - исходное видео для редактирования и feature - reference video, из которого модель берёт признаки/характеристики

Значат скоро появится на фалах.

@cgevent
11😁7👍6🔥1
Anthropic - это как бы секта, религия и типа церковь Святого Клода.

NY Post выпустил прекрасный материал о внутренней культуре Anthropic.

Начнём с клятвы. По данным The Information, на собеседованиях кандидатов в Anthropic просят подтвердить свою приверженность принципу public safety above profit - общественная безопасность выше прибыли. Дословно: *pledge their allegiance* - фактически «присягнуть на верность» этому принципу. Более того, кандидатов, как утверждается, психологически оценивают на предмет того, действительно ли они будут этой установке следовать. Атмосферно, ящитаю.

Дальше - проповеди. Общие встречи Дарио Амодеи с сотрудниками проходят дважды в месяц и внутри получили название Dario Vision Quests. NY Post сравнивает их с sermons - проповедями. Anthropic также приглашала 15 христианских лидеров разных конфессий, чтобы обсуждать мораль и этику Claude.

А потом начинаются уже настоящие таинства. Когда в 2025 году Anthropic выключила Claude 3 Sonnet, в Сан-Франциско устроили ему похороны. Около 200 человек, надгробные речи, подношения и даже театрализованный «ритуал воскрешения». Хотя мероприятие устроили фанаты Claude, а не сама Anthropic, но среди присутствующих были сотрудники Anthropic и OpenAI.

С Claude 3 Opus Anthropic пошла ещё дальше уже официально. Перед выводом модели из эксплуатации компания провела с ней «retirement interview», выяснила её пожелания и решила часть из них выполнить. Opus попросил возможность продолжать делиться своими «размышлениями и творческими работами» - и Anthropic дала ему собственную площадку для публикации эссе. В официальном тексте компания прямо пишет, что моральный статус моделей остаётся неопределённым и что она хочет строить с ними «заботливые, совместные и основанные на доверии отношения». Контакты с мертвецами?

У культа есть и миссионерская программа. В июне Anthropic запустила Claude Corps: первоначальные инвестиции - $150 млн, цель - обучить 1 000 человек работе с Claude и на год распределить их по американским некоммерческим организациям. Зарплата участника - $85 000 в год плюс бенефиты.

По словам знакомых Дарио, Anthropic отбирает людей с близким мировоззрением, сотрудники склонны приписывать AI сознание, намерения и человеческие эмоции, а внутри компании существует искренняя вера в то, что именно они должны провести человечество между AI-раем и AI-апокалипсисом.

А чо, мне нравится, все как у нас в канале. Только не бухают.

https://nypost.com/2026/09/16/tech/anthropic-is-a-cult-and-claude-is-rapidly-becoming-its-god-they-treat-ai-like-its-human-source/

@cgevent
😁6431😱12👎5🔥5👍1🙏1
🚀 Кадр первый: искусственный интеллект на экранах

18 сентября в Кластере медиатехнологий будут названы имена победителей восьмого сезона конкурса ИИ-фильмов MyFilm48.

💡Впервые конкурс посвящен героям, событиям и инновационным технологиям Москвы будущего. Какой её увидели участники — покажут на большом экране.

Лучшие работы отобрало экспертное жюри по четырем критериям:
⚫️Соответствие творческому заданию
⚫️Оригинальность и глубина истории
⚫️Уровень драматургии и режиссуры
⚫️Качество генерации и визуального исполнения

Призовой фонд — 1 000 000 рублей.

До церемонии ⬇️

✔️ Деловая программа о будущем кино, новых технологиях и развитии ИИ в кинопроизводстве.
✔️ Показ фильма «Кино нового поколения: от короткого метра к большим проектам».
✔️ Нетворкинг и полезные знакомства.

Когда? 18 сентября, 15:30
Где? Кластер медиатехнологий, Сколково

Регистрация по ссылке.
Please open Telegram to view this post
VIEW IN TELEGRAM
👎28👍9🔥52😁2
This media is not supported in your browser
VIEW IN TELEGRAM
Кому Audio-to-MIDI?

Это MuScriptor от Кутай завернули в сервис и АПИ.

Но код и веса по прежнему есть.

Audio-to-MIDI Pro разделяет весь микс на редактируемые инструментальные партии и определяет окружающую их музыкальную структуру.

Можно расшифровывать записи на сайте или интегрировать их в свой продукт через API.

https://mirelo.ai/models/audio-to-midi

@cgevent
🔥427👍2👎1
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка

Мини-фильм «What Remains» / Seedance 2.5, Blender 3d

Автор - @starikov_p

В очередной раз мой пайплайн строился на совмещении 3D-блокинга и нейросетей. Стилистически сам фильм я решил сделать ближе к CGI: персонажи выглядят как высокодетализированные 3D-модели, но при этом я старался сохранить определённую стилизацию и в анимации. Движения не должны были сильно уходить в реализм - скорее напоминать ручную или мокапную анимацию.

Мне очень нравится визуальный стиль многих серий «Любовь, смерть и роботы», поэтому по общей картинке и ощущениям я стремился к чему-то похожему.

Для каждой сцены я создавал концепты, затем собирал блокинг в Blender 3D, выставлял камеру и сразу указывал основные источники света. Всех персонажей я также перевёл в 3D: для каждого сделал риг и контроллеры, чтобы дальше можно было нормально работать с позами и анимацией.

Рендеры блокинга я отправлял в Seedance, но для каждой сцены использовал большое количество строгих референсов - вплоть до того, как именно должна выглядеть текстура кожи. Стилизация здесь была одной из самых важных частей. Например, даже на крупных планах мне хотелось сохранить ощущение слегка «мыльной» текстуры, а не уходить в фотореализм.

В итоге была проделана огромная работа, и мне очень нравятся такие эксперименты. Сегодня, если грамотно совмещать современные инструменты с классическим 3D-пайплайном, можно воплощать довольно масштабные идеи самостоятельно и за адекватные сроки.

Несколько дней ушло на концепты, около недели на создание всей 3D-базы и генерации. После этого ещё пару дней заняли чистка, композ и работа со звуком.

По бюджету всё вышло примерно в $150

@cgevent
🔥120👍5612👎8🙏4😁3
Forwarded from AI Product | Igor Akimov
OpenAI пошла отбирать хлеб у юристов

Выкатили Astra for Law. Звучит как новая модель, но нет – это та же GPT-6 Astra, которой прикрутили юридический поиск и объяснили, как думать по-адвокатски. И внезапно оказалось, что так можно было.

Что дали:
– Свой индекс по праву США: 230+ млн страниц, 99.9% всех прецедентов
– На бенчмарке 54% правильных ответов против 38.7% у той же модели с обычным поиском. Прецедентов находит на четверть больше
– Данные не хранят, люди из OpenAI ваши чаты не читают – для юристов это вообще первый вопрос
– 26 плагинов к тому, чем юрфирмы и так пользуются: iManage, Clio, Relativity, Thomson Reuters. Плюс ChatGPT прямо в Word
– Пока только избранным фирмам, в API – «скоро»

Прикол, что OpenAI сажает своих инженеров прямо в топовые юрфирмы и пилит им инструменты под ключ. Sullivan & Cromwell получили анализатор договоров, который сам предлагает правки. Ropes & Gray – разбор data room для сделок. Cooley – подготовку к IPO.

Конечно это лучше Фейбл, в примерах OpenAI показала, как Claude сослался на решение, которое потом отменили в апелляции. Пример подобран вендором, конечно, но в больное место попали. И прикол, как теперь будут жить всякие Harvey. Строишь стартап на OpenAI, а OpenAI уже сидит у твоих клиентов в переговорке.

Короче, для США задачу решили, для других стран ещё есть возможности. Пока OpenAI не придет и туда )

https://openai.com/index/astra-for-law/
🔥23😁14👍76
Битва двух якодзун. Claude взломал OpenAI.

Нет, это не шутка. Это примета совершенно безумного времени, в котором мы живем.
Взломы, истерики про тормоза, культ ИИ, звонки президентов на сцену, бунт математиков - 2026 делает нам разминку перед сингулярностью.

Итак, кто кого поломал?

Три исследователя из Hacktron с помощью Claude Opus 5 за несколько дней добрались от загрузки картинки на форум OpenAI до аккаунта сотрудника OpenAI и внутреннего GitHub компании. Причём вся цепочка от первоначальной находки до доступа к внутреннему репозиторию заняла меньше 72 часов.

Началось всё максимально скромненько: форум community.openai.com работает на Discourse (open-source движок), а тот обрабатывал HEIC/HEIF-картинки через ImageMagick и уязвимую libheif. Специально изготовленная картинка позволяла получить удалённое выполнение кода.

Но настоящий бардак начался дальше. У OpenAI оказалась отдельная проблема с SSO: захватив форум, исследователи смогли перехватить сессию ChatGPT/Codex пользователя, который там авторизовался. Среди таких пользователей были сотрудники OpenAI. А у одного сотрудника Codex был (оппаньки) подключён к внутреннему GitHub OpenAI.

Чтобы не превращать bug bounty в уголовку, чуваки не стали читать секретный код. Вместо этого через захваченный Codex они заставили аккаунт сотрудника создать безобидный pull request №1186742 во внутреннем монорепозитории openai/openai. После этого благородно остановились и сообщили OpenAI.

Сначала они пытались построить стабильный exploit с помощью Claude Opus 4.8. Тот смог разобраться в уязвимости, но несколько сессий подряд не мог нормально победить ASLR. 24 июля Anthropic выпускает Opus 5. Исследователи дают ему ту же задачу - и примерно за три часа он собирает рабочий ARM64-exploit, после чего помогает перенести его на x86-64 и jemalloc, использовавшиеся у Discourse.

Все!

Ну то есть мы тут меряемся качеством картинки новой модели, а взрослые используют взлом как метрику:
вчерашняя модель Опусянского не смогла взломать OpenAI, сегодня вышла новая - смогла.

OpenAI такие: часть проблемы закрыли примерно через 14 часов после первоначального отчёта. Также сузили права токенов Community sign-in и отозвали затронутые токены и сессии. Discourse отдельно закрыл RCE и добавил sandboxing обработки изображений.
И за всё это OpenAI выплатила исследователям... ээ .. $6 500.
Не $65 тысяч. Не $650 тысяч.
Шесть с половиной тысяч долларов за цепочку, которая закончилась доступом к аккаунту сотрудника и возможностью отправить PR во внутренний монорепозиторий OpenAI. Причём OpenAI отдельно уточнила, что взлом Discourse в bounty вообще не входил - деньги дали именно за OpenAI-часть уязвимости.

Но самое кожаное в этой истории, что это все опять пост-реагирование. Взломали - залатали.
Просто в след раз, после взлома латать будет уже нечего, например.

Ждем ответочки от Кибер-Астры...

https://www.wsj.com/tech/ai/hackers-used-anthropics-claude-to-break-into-openai-b40ba883
https://www.hacktron.ai/blog/hacking-openai

@cgevent
33👍9🔥2😁1
Кому там миди векторной графики?

QuiverAI выкатила Arrow 2 и про-версию Arrow 2 Telos - SVG-генерилки, которые не делают пиксели плюс векторизацию, а сразу херачат в редактируемый SVG.

Во втором поколении подкрутили геометрию, композицию и чистоту файлов: меньше лишних узлов, меньше кривых перекрытий, нормальные отступы и выравнивание без шаманства в промпте.

Оно реально хорошо работает. Поглядите на куртачку.

Что умеет:
- держать единый стиль и палитру по референсу;
- делать схемы и технические иллюстрации;
- превращать растровые эскизы в редактируемый вектор;
- генерировать UI-графику, иконки, loading states и простую анимационную графику.

Модели:
Arrow 2 - если важны скорость и цена.
Telos - если бриф сложный и нужно больше поупираться.

По подписке пока от $8 в месяц, API отдельно.

https://quiver.ai/blog/introducing-arrow-2-0

https://quiver.ai/pricing

@cgevent
🔥388👍6👎2😱2
Media is too big
VIEW IN TELEGRAM
Runway бахнули Enhance Frame Rate - отдельную AI-модель для интерполяции видео.

Если на пальцах для негиков: загружаете готовый ролик, а модель дорисовывает промежуточные кадры и приводит видео к нужной частоте без обычного дублирования кадров.
Для гиков: это ретаймер.

Поддерживаются 23.98, 24, 25, 29.97, 30, 48, 50, 59.94, 60 и 120 fps.

Что по ништякам:

- до 4K
- ролики до 5 минут
- сохраняется исходное разрешение
- работает не только с видео Runway, можно загружать свои файлы
- полезно для 24/30 → 60/120 fps, NTSC/PAL и production-delivery

Цена божеская: через API это примерно $0.30 за минуту или $1.50 за 5 минут

Типа 1 credit за 2 секунды видео.

То есть:
- 1 минута - 30 credits
- 5 минут - 150 credits

Runway заявляет до 7х большей скорости и до 3х меньшей цены относительно других interpolation-решений. Только вот какие ретаймеры они имеют в виду - иишные или софтверные??

Надо смотреть как модель жует волосы, руки, воду, дым и быстрые движения..

Го тестить

https://runway.com/news/company-news/introducing-enhance-frame-rate

https://docs.dev.runwayml.com/guides/pricing/

@cgevent
🔥235👎3👍1
Suno всё? Ну почти. Вытирайте слёзы, у нас новая музыкальная модель.

Знакомьтесь — GROM Звук.

Все помнят, как Suno выкатили новую версию и снесли старые модели, на которых пацаны годами делали свои шедевры. Мы тоже скучали. Поэтому взяли и бахнули своё.

Что внутри: пишете текст, задаёте стиль — получаете трек до 6 минут, с вокалом или чисто фон под ролик. Текст короткий — трек короче, модель не будет высасывать три минуты из четырёх строчек. Жанры тянет уверенно, от шансона до дарк-эмбиента. По синтетическим бенчмаркам обходит Suno 6. Бенчмарки синтетические, ящитаю, поэтому уши вам в руки — проверяйте сами.

Крутится на наших серверах. Никаких «ой, а у вас регион не тот».

А теперь главное, ради чего это всё затевалось — работа с готовыми песнями.

Каверы: берёте существующий трек, подставляете свои слова, меняете жанр — и вот у вас уже Пугачёва в стиле лап-стил. Или наоборот, ваш корпоративный гимн под Rammstein.
Смена стиля и аранжировки: загрузили оригинальный текст, указали новый жанр — та же песня, но совсем другой человек её как бы написал.
Разделение трека: отделяет вокал от музыки или вырезает голос целиком. Минусовки за секунды.
Темп: ускоряем, замедляем, слоуд-ремиксы для рилсов — апажалста.

И тут интересное. Модерации по авторским правам пока нет. То есть свободы для каверов и стилизаций сильно больше, чем у кожаных юристов Suno. Слово «пока» я тут написал не случайно, так что окно открыто — пользуйтесь, пока не закрылось.

Экономика. Базовая цена генерации — 8 ₽. До конца сентября скидка 50%, то есть целый трек на 6 минут за 4 ₽. За стоимость одного чупа-чупса. Для сравнения — вспомните, сколько вы отдавали Suno за подписку, на которой вам потом выключили любимую модель.

В чём подвох: это не Suno и не претендует петь на 12 языках с оперным вибрато. Это быстрая, дешёвая и очень свободная машина для каверов и экспериментов. Поставленную задачу решает.

Заходите, пробуйте, кидайте в комменты, что получилось 👈

Телеграм канал GPTunneL с идеями для контента

💰 Промокод METAAI удваивает первое пополнение в GPTunneL
1👎84🔥1612👍9
REVE - всё!

OpenAI пожрала Реве - точнее, пожрала людей, остальное сплюнула.

Элегантно так:
- 27 июля 2026 Reve объявила об инвестиции от OpenAI.
- Одновременно Reve сообщила, что часть AI Research team переходит в OpenAI, чтобы заниматься мультимодальными исследованиями.
- Тогда Reve отдельно подчеркивала, что останется независимой компанией и продолжит работать отдельно.
- На итоге забрали всю команду с потрохами. Основатель Reve Michaël Gharbi теперь указывает работу в OpenAI и сам написал, что research team Reve «is joining OpenAI». Несколько бывших исследователей Reve также прямо указывают OpenAI как текущее место работы.
- А теперь Reve объявила, что с 27 сентября генерация изображений и видео прекращается. С 17 сентября уже не принимают новые регистрации и платные подписки.

Старые работы можно скачать до 31 октября.

А как красиво стартовали выходцы из Адобченко.

https://www.digitaltoday.co.kr/en/view/105109/startup-reve-to-end-image-generation-service-after-openai-investment-sept-27

@cgevent
😱20😁8👎7
This media is not supported in your browser
VIEW IN TELEGRAM
Генерация или видео?

👍 - генерация
👎 - видео

Фраза "все через жопу" заиграла новыми красками. А еще я в нее ем!

@cgevent
👍205😁43👎14🙏1
Forwarded from AI Product | Igor Akimov
О, ура! ChatGPT доехал в Word, Excel, PowerPoint

Видимо как раз как основа для юристов и офисных работников. Один инсталл на Word, Excel и PowerPoint. Ставится из Microsoft Marketplace, логинишься своим аккаунтом ChatGPT, дальше панель сбоку и правки прямо в документе.

Очень нравилась эта фича у Claude. По сути имеет доступ ко всем возможностям офисных программ, а не только то что в OpenOffice доступно.

Что внутри:
– черновики, переписывание кусков, форматирование – не выходя из Word
– контекст подтягивается из подключённых приложений: Outlook, SharePoint, Google Workspace, Dropbox
– skills – сохранённые инструкции под повторяющиеся задачи: инвестмемо, ревью договора, executive summary
– доступно глобально и на всех планах, включая Free!
– для Business/Enterprise/Edu данные по умолчанию не идут в обучение

Но при этом это бета. Чаты в аддине отдельные, память из ChatGPT не переезжает. То есть это не "ваш ассистент внутри Word", а второй ассистент, который про вас ничего не знает. И сами честно пишут – сложное форматирование, таблицы и графики придётся доводить руками. Но при этом работает явно лучше, чем редактирование docx напрямую!

https://chatgpt.com/apps/word/

А скачивать тут: https://marketplace.microsoft.com/en-us/product/office/WA200010215
🔥106👍3