Светлая комната — архив
18 subscribers
92 photos
17 videos
1 file
44 links
Архивные остатки фотонов света. Перенос электромагнитного взаимодействия.
Download Telegram
Forwarded from Geometrybot
СЕНСАЦИЯ: Александр Ванг утверждает, что новая модель ИИ от Meta — под кодовым названием Watermelon — догнала OpenAI GPT-5.5.

«Watermelon использует на порядок больше вычислительных мощностей, чем Avocado», — сказал он на внутреннем совещании, ссылаясь на предыдущую модель Meta.

https://t.co/XKwQOPkFTy

🍷 @CharlesRollet1 · оригинал
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Meta Muse-image

VCPT Sim 100 initial state

Base
: Trace the trajectory of the path of the ball with a red marker and place the ball in the bucket where it will end up in.
Forwarded from Geometrybot
This media is not supported in your browser
VIEW IN TELEGRAM
Lingbot-World-2 — наша новая модель мира в реальном времени.

Более богатая интерактивность, четкая графика и продвинутое управление камерой — всё, что вы создаете, ощущается по-настоящему живым.

Доступна сегодня через API, эксклюзивно на Reactor.

Попробуйте:

🍷 @reactorworld · оригинал
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Media is too big
VIEW IN TELEGRAM
Вы играли в бильярд, но в лузы так и не попадали? Думаю, мастером по шлепкам шаров стать всё же можно.
ByteDance представила Seed Audio 1.0.

Аудиомодель, которая генерирует целую звуковую сцену одним промптом: голоса, музыку и эффекты. Заточена под озвучку, аудиокниги, подкасты и дубляж.

* Дамы и господа, сразу ложка дёгтя: с русским у модели всё плохо, мы уже проверили. Так же плохо, как у Seedance 2.5, и это до сих пор не исправили. Возможно, данных для обучения на русском у них просто нет: у всех их моделей с ним беда.

⚪️ Вся сцена за один проход. Мультиперсонажные диалоги с эмоциями, музыка и SFX в одном аудио, без мультитрекового монтажа. Голоса остаются консистентными на длинной записи.

⚪️ Тайминг реплик с точностью до 100 мс. Прямо в промпте задаётся длительность трека и момент входа каждой реплики. Подходит для дубляжа и озвучки с жёстким хронометражем.

⚪️ 20+ языков. Английский, китайский, японский, корейский, испанский, немецкий, французский, тайский и другие. Голос персонажа переносится между языками с сохранением тембра.

⚪️ Клонирование голоса по референсам. До трёх аудиоклипов подключаются к промпту как @Audio1, @Audio2, @Audio3. Вместо аудио можно дать картинку с описанием персонажа.

Карточка модели

Цена: около $0.15-0.19 / минута.
Лимит: 2 минуты аудио за генерацию, промпт до 3000 знаков

❗️ Примечание: официальный прайс BytePlus показывает только в консоли.

Модель я в соло уже протестировал:
Это что-то классное. Промпт пишите только на английском: русский промпт она толком не понимает и инструкции из него выполнять не будет. Зато на английском можно расписать голоса, характеры персонажей, тайминги и звуки, и она соберёт всё строго по промпту: музыку, реплики, эффекты. Нейросетевого призвука почти нет, и это радует, но иногда он всё же проскакивает.

Кстати на превью модель ещё смотрела видео и генерировала аудио под него, в публичную версию эту функцию пока не добавили.


Источник РЕН ТВ.
Please open Telegram to view this post
VIEW IN TELEGRAM
Пора обновлять нашего бота
like если да
👍4
Кстати, модель до сих пор уверенно отвечает, что её отсечка знаний — март 2026 года. Но сама она ничего не знает из этого.

Нам так и не удалось выяснить, что с ней. Либо её не доучили, либо она просто галлюцинирует и не хочет признавать, что в неё заложены такие знания.

В общем-то, если это так и они всё-ещё это не исправили, то в обновлении по итогу смысла то нет.
Хахаха. Эх... Сказочники гуглы.

https://console.cloud.google.com/agent-platform/studio/multimodal?model=gemini-3.6-flash

Модель уже есть в селекторе Vertex.
Впрочем ничего не поменялось. Они собираются это релизить. 🤪
Please open Telegram to view this post
VIEW IN TELEGRAM