Media is too big
VIEW IN TELEGRAM
Grok 4.7 написал игру, JEV - в нее играет.
Это что-то реально новое в развитии. Круто!
Это что-то реально новое в развитии. Круто!
Воу, Chrome добавил вертикальные вкладки, для вертикальных мониторов как у меня это удобно.
Но походу нельзя чтобы на разных окнах можно было переключаться на горизонтальные...
Но походу нельзя чтобы на разных окнах можно было переключаться на горизонтальные...
Forwarded from AI Product | Igor Akimov
Google выкатил Gemini 3.8 TTS.
Видимо все силы кинул в голос )
Моделей две:
– Gemini 3.8 Flash TTS: для творческой работы, чтобы задать характер персонажа и сыграть сцену
– Gemini 3.8 Flash-Lite TTS: для больших объёмов, когда важна цена
Что умеют:
– Голос генерируется по текстовому описанию, больше 100 языков и диалектов
– Больше 2000 готовых голосов с региональными вариантами: мексиканский испанский, квебекский французский, шотландский английский
– Клонирование голоса по 30-секундному сэмплу, с проверкой согласия и водяным знаком SynthID
– Режиссура по строкам: в сценарии пишешь ремарки обычным языком, и модель их отыгрывает
– Держат голос стабильным на часах аудио
– Нативный диалог двух спикеров
– Смех, вздохи, «ага», «угу», перебивания: всё, что раньше выдавало робота
– Скоро обещают ремикс голоса: тембр, высота, темп, акцент
По бенчмаркам:
– Hume AI Voice Design: первое место (71.4), по акцентам тоже первое (60.8)
– Hume AI Overall Quality: первое и второе места у Flash и Flash-Lite
– Voice Arena: топ по японскому, бразильскому португальскому, вьетнамскому, арабскому, мексиканскому испанскому и хинди
Доступно уже сегодня
Видос: https://youtu.be/FL6mI_Br-mc
Есть и ложка дёгтя: клонирование голоса не работает в ЕС, Великобритании, Швейцарии, Индии, Иллинойсе и Техасе.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/
Видимо все силы кинул в голос )
Моделей две:
– Gemini 3.8 Flash TTS: для творческой работы, чтобы задать характер персонажа и сыграть сцену
– Gemini 3.8 Flash-Lite TTS: для больших объёмов, когда важна цена
Что умеют:
– Голос генерируется по текстовому описанию, больше 100 языков и диалектов
– Больше 2000 готовых голосов с региональными вариантами: мексиканский испанский, квебекский французский, шотландский английский
– Клонирование голоса по 30-секундному сэмплу, с проверкой согласия и водяным знаком SynthID
– Режиссура по строкам: в сценарии пишешь ремарки обычным языком, и модель их отыгрывает
– Держат голос стабильным на часах аудио
– Нативный диалог двух спикеров
– Смех, вздохи, «ага», «угу», перебивания: всё, что раньше выдавало робота
– Скоро обещают ремикс голоса: тембр, высота, темп, акцент
По бенчмаркам:
– Hume AI Voice Design: первое место (71.4), по акцентам тоже первое (60.8)
– Hume AI Overall Quality: первое и второе места у Flash и Flash-Lite
– Voice Arena: топ по японскому, бразильскому португальскому, вьетнамскому, арабскому, мексиканскому испанскому и хинди
Доступно уже сегодня
Видос: https://youtu.be/FL6mI_Br-mc
Есть и ложка дёгтя: клонирование голоса не работает в ЕС, Великобритании, Швейцарии, Индии, Иллинойсе и Техасе.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/
YouTube
Create your own voices with Gemini 3.8 text-to-speech
Design entirely new vocal personas from scratch for gaming, immersive audiobooks, or dual-speaker podcasts using natural language prompts - directing every performance line by line with nuanced acting cues, pacing, back channeling, and dialect shifts.
Or…
Or…
CodeSpec
$500 за подписку. С этим надо свыкнуться…
В качестве благодарности за то, что вы являетесь существующим подписчиком, и за то, что вы продолжаете создавать свои самые амбициозные идеи и переход, мы также предоставляем вам одноразовый грант в размере 62 500 кредитов на использование (стоимостью 2500 долларов США). Вы увидите их в разделе «Настройки» > «Использование». Срок их действия истекает 31 декабря 2026 года, и использование кредитов регулируется Условиями предоставления услуг.
🔥3😁2❤1
Forwarded from ИИволюция 👾
Трамп решил, что "искусственный" интеллект звучит как-то несерьёзно, будто что-то фейковое, а технология ведь потрясающая. Поэтому подписал указ, по которому в госдокументах США больше нет никакого AI, теперь это Super Intelligence, сокращённо SI. Правда что это такое, в указе не написано, советнику дали 60 дней придумать определение (видимо, сначала название, потом разберёмся).
И самое забавное, что .si это доменная зона Словении.
Раньше на хайпе с .ai богател остров Ангилья, там домены приносят почти половину бюджета страны. А теперь киберсквоттеры за ночь кинулись скупать всё в .si, уже ушли openai.si, openclaw.si, hermesagent.si и куча других. Регистраций стало в день больше, чем раньше за месяц, и половину сразу выставили на перепродажу.
Словения теперь новая Ангилья?😂
И самое забавное, что .si это доменная зона Словении.
Раньше на хайпе с .ai богател остров Ангилья, там домены приносят почти половину бюджета страны. А теперь киберсквоттеры за ночь кинулись скупать всё в .si, уже ушли openai.si, openclaw.si, hermesagent.si и куча других. Регистраций стало в день больше, чем раньше за месяц, и половину сразу выставили на перепродажу.
Словения теперь новая Ангилья?
Please open Telegram to view this post
VIEW IN TELEGRAM
😁1
Forwarded from 🌱 AI системы и сайд проекты.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1
Forwarded from эйай ньюз
Что в тренде на IROS 2026: мои впечатления
Походил по постер-сессиям, поговорил с авторами и вот что на повестке дня:
1. VLA везде. Модели, которые по картинке и текстовой команде сразу выдают действия робота, — главная тема года. Только про них в программе 8 отдельных сессий.
2. Роботы учатся чувствовать. Очень много работ про силу, контакт и тактильные сенсоры. Похоже, все поняли: для работы руками одних камер мало.
3. Диффузия и flow matching теперь генерируют не картинки, а движения робота.
4. Гуманоиды. Их тут много, от ходьбы до управления всем телом, а на соревновании они сами собирают мебель из IKEA.
5. Почти все учится на данных: reinforcement learning и imitation learning - в каждой второй работе, которую я видел.
В общем, ощущение такое, что роботы сейчас примерно там, где языковые модели были пару лет назад. Модели уже умеют многое, а всё упирается в данные: реальных записей с роботов пока очень мало. Для языковых моделей есть целый интернет, а роботы пока только начинают учиться.
@ai_newz
Походил по постер-сессиям, поговорил с авторами и вот что на повестке дня:
1. VLA везде. Модели, которые по картинке и текстовой команде сразу выдают действия робота, — главная тема года. Только про них в программе 8 отдельных сессий.
2. Роботы учатся чувствовать. Очень много работ про силу, контакт и тактильные сенсоры. Похоже, все поняли: для работы руками одних камер мало.
3. Диффузия и flow matching теперь генерируют не картинки, а движения робота.
4. Гуманоиды. Их тут много, от ходьбы до управления всем телом, а на соревновании они сами собирают мебель из IKEA.
5. Почти все учится на данных: reinforcement learning и imitation learning - в каждой второй работе, которую я видел.
В общем, ощущение такое, что роботы сейчас примерно там, где языковые модели были пару лет назад. Модели уже умеют многое, а всё упирается в данные: реальных записей с роботов пока очень мало. Для языковых моделей есть целый интернет, а роботы пока только начинают учиться.
@ai_newz