CodeSpec
325 subscribers
274 photos
30 videos
2 files
236 links
Ранее в сериале:

Аудит софта для дропхантеров.
Помощь в настройке.
По всем вопросам пишите -> @SPECULARI

В следующих сериях:

Без ИИ (AI) и ни туды и ни сюды.
Download Telegram
Media is too big
VIEW IN TELEGRAM
Grok 4.7 написал игру, JEV - в нее играет.

Это что-то реально новое в развитии. Круто!
Воу, Chrome добавил вертикальные вкладки, для вертикальных мониторов как у меня это удобно.

Но походу нельзя чтобы на разных окнах можно было переключаться на горизонтальные...
Forwarded from AI Product | Igor Akimov
Google выкатил Gemini 3.8 TTS.

Видимо все силы кинул в голос )

Моделей две:
– Gemini 3.8 Flash TTS: для творческой работы, чтобы задать характер персонажа и сыграть сцену
– Gemini 3.8 Flash-Lite TTS: для больших объёмов, когда важна цена

Что умеют:
– Голос генерируется по текстовому описанию, больше 100 языков и диалектов
– Больше 2000 готовых голосов с региональными вариантами: мексиканский испанский, квебекский французский, шотландский английский
– Клонирование голоса по 30-секундному сэмплу, с проверкой согласия и водяным знаком SynthID
– Режиссура по строкам: в сценарии пишешь ремарки обычным языком, и модель их отыгрывает
– Держат голос стабильным на часах аудио
– Нативный диалог двух спикеров
– Смех, вздохи, «ага», «угу», перебивания: всё, что раньше выдавало робота
– Скоро обещают ремикс голоса: тембр, высота, темп, акцент
По бенчмаркам:
– Hume AI Voice Design: первое место (71.4), по акцентам тоже первое (60.8)
– Hume AI Overall Quality: первое и второе места у Flash и Flash-Lite
– Voice Arena: топ по японскому, бразильскому португальскому, вьетнамскому, арабскому, мексиканскому испанскому и хинди
Доступно уже сегодня

Видос: https://youtu.be/FL6mI_Br-mc

Есть и ложка дёгтя: клонирование голоса не работает в ЕС, Великобритании, Швейцарии, Индии, Иллинойсе и Техасе.

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/
$500 за подписку. С этим надо свыкнуться…
🤯1
CodeSpec
$500 за подписку. С этим надо свыкнуться…
В качестве благодарности за то, что вы являетесь существующим подписчиком, и за то, что вы продолжаете создавать свои самые амбициозные идеи и переход, мы также предоставляем вам одноразовый грант в размере 62 500 кредитов на использование (стоимостью 2500 долларов США). Вы увидите их в разделе «Настройки» > «Использование». Срок их действия истекает 31 декабря 2026 года, и использование кредитов регулируется Условиями предоставления услуг.
🔥3😁2❤1
Forwarded from ИИволюция 👾
Трамп решил, что "искусственный" интеллект звучит как-то несерьёзно, будто что-то фейковое, а технология ведь потрясающая. Поэтому подписал указ, по которому в госдокументах США больше нет никакого AI, теперь это Super Intelligence, сокращённо SI. Правда что это такое, в указе не написано, советнику дали 60 дней придумать определение (видимо, сначала название, потом разберёмся).

И самое забавное, что .si это доменная зона Словении.

Раньше на хайпе с .ai богател остров Ангилья, там домены приносят почти половину бюджета страны. А теперь киберсквоттеры за ночь кинулись скупать всё в .si, уже ушли openai.si, openclaw.si, hermesagent.si и куча других. Регистраций стало в день больше, чем раньше за месяц, и половину сразу выставили на перепродажу.

Словения теперь новая Ангилья? 😂
Please open Telegram to view this post
VIEW IN TELEGRAM
😁1
Gemini 4 - наконец то что-то интересное от Google 😱

По цене, как Sol-6.1
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1
👍3
Forwarded from эйай ньюз
Что в тренде на IROS 2026: мои впечатления

Походил по постер-сессиям, поговорил с авторами и вот что на повестке дня:

1. VLA везде. Модели, которые по картинке и текстовой команде сразу выдают действия робота, — главная тема года. Только про них в программе 8 отдельных сессий.

2. Роботы учатся чувствовать. Очень много работ про силу, контакт и тактильные сенсоры. Похоже, все поняли: для работы руками одних камер мало.

3. Диффузия и flow matching теперь генерируют не картинки, а движения робота.

4. Гуманоиды. Их тут много, от ходьбы до управления всем телом, а на соревновании они сами собирают мебель из IKEA.

5. Почти все учится на данных: reinforcement learning и imitation learning - в каждой второй работе, которую я видел.

В общем, ощущение такое, что роботы сейчас примерно там, где языковые модели были пару лет назад. Модели уже умеют многое, а всё упирается в данные: реальных записей с роботов пока очень мало. Для языковых моделей есть целый интернет, а роботы пока только начинают учиться.

@ai_newz