Светлая комната — архив
18 subscribers
92 photos
17 videos
1 file
44 links
Архивные остатки фотонов света. Перенос электромагнитного взаимодействия.
Download Telegram
Там, где Opus буквально в недавнем вышедшем бенчмарке (DEEPSWE) отставал, стал выше GPT 5.5 x-high.
Интересно: gemini-3.2-flash-lite-live-preview была обнаружена в Vertex.

У Google с именами моделей в последнее время что-то не в порядке: зайдешь в описание Gemini 3.1 Flash Live, а там написано: «базирована на 3.0 Flash».
Google оказались куда увереннее в себе и решили назвать свою НОВУЮ модель не 3.2, а 3.5.

Похоже, то, что мы видели на arena.ai, не является тем, что действительно у них есть.
@Geometry91_botКидаешь ссылку на твит, и бот переводит пост из X на русский с текстом и медиа.

Он особенно подойдет админам каналов, что постят переводы твитов.

Работал над ботом потихоньку пару недель, а в последний день решил всё-таки дожать и довести до ума.

И вот — бот уходит в бета-тест, релиз через 2 часа. — Я хочу чтобы вы протестировали бота за это время и отписались о его работе прямо здесь под комментариями.


Делитесь отзывами о работе, мне правда важно.

И сразу скажу:
бот не только для меня. Он для всех желающих. Уже прямо сейчас можете добавить его в свой чат и пользоваться.
Грядут большие улушчения
👍1
Forwarded from Geometrybot
Сначала Марк явно говорил о прогрессе индустрии в области агентных возможностей в целом.

Но раз уж зашла речь: следующее обновление Muse Spark выйдет скоро. Серьёзные улучшения в кодинге и агентных способностях, чтобы быть конкурентоспособнее с другими ведущими моделями.

Не терпится дать вам это в руки — будем раскатывать на Meta AI и наше новое API!

🍷 @alexandr_wang · оригинал
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Geometrybot
Генеральный директор $META Марк Цукерберг сообщил сотрудникам на внутреннем собрании, что разработка AI-агентов за последние четыре месяца «не ускорилась так, как мы ожидали». — Reuters

🍷 @wallstengine · оригинал
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Geometrybot
СЕНСАЦИЯ: Александр Ванг утверждает, что новая модель ИИ от Meta — под кодовым названием Watermelon — догнала OpenAI GPT-5.5.

«Watermelon использует на порядок больше вычислительных мощностей, чем Avocado», — сказал он на внутреннем совещании, ссылаясь на предыдущую модель Meta.

https://t.co/XKwQOPkFTy

🍷 @CharlesRollet1 · оригинал
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Meta Muse-image

VCPT Sim 100 initial state

Base
: Trace the trajectory of the path of the ball with a red marker and place the ball in the bucket where it will end up in.
Forwarded from Geometrybot
This media is not supported in your browser
VIEW IN TELEGRAM
Lingbot-World-2 — наша новая модель мира в реальном времени.

Более богатая интерактивность, четкая графика и продвинутое управление камерой — всё, что вы создаете, ощущается по-настоящему живым.

Доступна сегодня через API, эксклюзивно на Reactor.

Попробуйте:

🍷 @reactorworld · оригинал
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Media is too big
VIEW IN TELEGRAM
Вы играли в бильярд, но в лузы так и не попадали? Думаю, мастером по шлепкам шаров стать всё же можно.
ByteDance представила Seed Audio 1.0.

Аудиомодель, которая генерирует целую звуковую сцену одним промптом: голоса, музыку и эффекты. Заточена под озвучку, аудиокниги, подкасты и дубляж.

* Дамы и господа, сразу ложка дёгтя: с русским у модели всё плохо, мы уже проверили. Так же плохо, как у Seedance 2.5, и это до сих пор не исправили. Возможно, данных для обучения на русском у них просто нет: у всех их моделей с ним беда.

⚪️ Вся сцена за один проход. Мультиперсонажные диалоги с эмоциями, музыка и SFX в одном аудио, без мультитрекового монтажа. Голоса остаются консистентными на длинной записи.

⚪️ Тайминг реплик с точностью до 100 мс. Прямо в промпте задаётся длительность трека и момент входа каждой реплики. Подходит для дубляжа и озвучки с жёстким хронометражем.

⚪️ 20+ языков. Английский, китайский, японский, корейский, испанский, немецкий, французский, тайский и другие. Голос персонажа переносится между языками с сохранением тембра.

⚪️ Клонирование голоса по референсам. До трёх аудиоклипов подключаются к промпту как @Audio1, @Audio2, @Audio3. Вместо аудио можно дать картинку с описанием персонажа.

Карточка модели

Цена: около $0.15-0.19 / минута.
Лимит: 2 минуты аудио за генерацию, промпт до 3000 знаков

❗️ Примечание: официальный прайс BytePlus показывает только в консоли.

Модель я в соло уже протестировал:
Это что-то классное. Промпт пишите только на английском: русский промпт она толком не понимает и инструкции из него выполнять не будет. Зато на английском можно расписать голоса, характеры персонажей, тайминги и звуки, и она соберёт всё строго по промпту: музыку, реплики, эффекты. Нейросетевого призвука почти нет, и это радует, но иногда он всё же проскакивает.

Кстати на превью модель ещё смотрела видео и генерировала аудио под него, в публичную версию эту функцию пока не добавили.


Источник РЕН ТВ.
Please open Telegram to view this post
VIEW IN TELEGRAM