интерфейсно дизайнеров Google заставили сделать ответ на glass. судя по видео получилось спорно.
хотя появился свой ход с блюрами и он звучит инетерсно, всякие обводки приехали явно от вдохновения iOS
зато они придумали своё светящееся яблочко для ноутбуков
видео с главными анонсами за минуту — https://youtu.be/tOWuuIF7go0?si=HzBtghQdu_lEEipG
хотя появился свой ход с блюрами и он звучит инетерсно, всякие обводки приехали явно от вдохновения iOS
зато они придумали своё светящееся яблочко для ноутбуков
видео с главными анонсами за минуту — https://youtu.be/tOWuuIF7go0?si=HzBtghQdu_lEEipG
🎉1
Googlebook и vibe-coded widgets
ещё на ивенте показали Googlebook — это chromebook neo. и виджеты, которые можно генерировать по описанию — TechCrunch
Googlebook — новая категория ноутбуков на базе Android PC. Идея в том, что Gemini будет встроен в систему с самого начала: искать по файлам и приложениям, помогать с рабочими задачами, продолжать сценарии с телефона и управлять действиями через Magic Pointer
вторая штука — Create My Widget. пользователь описывает, какой виджет ему нужен, а Gemini собирает его сам: например, «виджет с рецептами по продуктам дома», «travel-план на выходные» и тп
это маленький, но важный сдвиг: теперь пользователь может сгенерировать микро-интерфейс под конкретную задачу. какое-то время назад у nothing были даже более смелые идеи, гугл пошел осторожнее
итого — приложения дают агенту функции, Gemini собирает из них workflow, а пользователь получает не универсальный экран приложения, а интерфейс под текущий intent. а ведь ещё утром обсуждали, что генерация текстов это начало
ещё на ивенте показали Googlebook — это chromebook neo. и виджеты, которые можно генерировать по описанию — TechCrunch
Googlebook — новая категория ноутбуков на базе Android PC. Идея в том, что Gemini будет встроен в систему с самого начала: искать по файлам и приложениям, помогать с рабочими задачами, продолжать сценарии с телефона и управлять действиями через Magic Pointer
вторая штука — Create My Widget. пользователь описывает, какой виджет ему нужен, а Gemini собирает его сам: например, «виджет с рецептами по продуктам дома», «travel-план на выходные» и тп
это маленький, но важный сдвиг: теперь пользователь может сгенерировать микро-интерфейс под конкретную задачу. какое-то время назад у nothing были даже более смелые идеи, гугл пошел осторожнее
итого — приложения дают агенту функции, Gemini собирает из них workflow, а пользователь получает не универсальный экран приложения, а интерфейс под текущий intent. а ведь ещё утром обсуждали, что генерация текстов это начало
👍5
Media is too big
VIEW IN TELEGRAM
ai pointer — как google перепридумывают курсор 🖥
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6
Media is too big
VIEW IN TELEGRAM
codex remote
если вы уже хотели отойти от ноутбука, то тут нам апдейт
openai добавили preview codex в мобильное приложение chatgpt. можно стартовать новую задачу, смотреть что агент сделал, читать диффы/логи/скриншоты, давать правки и подтверждать команды прямо с телефона
сам codex продолжает работать не на айфоне, а на хосте (ноутбуке, mac mini или devbox)
openai docs
если вы уже хотели отойти от ноутбука, то тут нам апдейт
openai добавили preview codex в мобильное приложение chatgpt. можно стартовать новую задачу, смотреть что агент сделал, читать диффы/логи/скриншоты, давать правки и подтверждать команды прямо с телефона
сам codex продолжает работать не на айфоне, а на хосте (ноутбуке, mac mini или devbox)
openai docs
🔥5👌1🌚1
plaud запустили dev platform для разработчиков
plaud — это маленький ai-диктофон, который записывает разговоры и превращает их в транскрипты, саммари и заметки
теперь они запустили dev platform для разработчиков. plaud-девайсы можно встраивать в свои продукты — подключать к приложению, забирать аудио, получать расшифровки со спикерами и строить поверх этого свои воркфлоу
сценарии понятные — продажи, медицина, real estate… — всё, где важная инфа появляется не в интерфейсе, а в живом разговоре
интересна тут не транскрибация сама по себе, а контекст для агентов. если у продукта есть доступ к реальным разговорам пользователя, агент может работать не только с тем, что человек руками занёс в crm, а с первоисточником
plaud dev
plaud — это маленький ai-диктофон, который записывает разговоры и превращает их в транскрипты, саммари и заметки
теперь они запустили dev platform для разработчиков. plaud-девайсы можно встраивать в свои продукты — подключать к приложению, забирать аудио, получать расшифровки со спикерами и строить поверх этого свои воркфлоу
сценарии понятные — продажи, медицина, real estate… — всё, где важная инфа появляется не в интерфейсе, а в живом разговоре
интересна тут не транскрибация сама по себе, а контекст для агентов. если у продукта есть доступ к реальным разговорам пользователя, агент может работать не только с тем, что человек руками занёс в crm, а с первоисточником
plaud dev
❤3🤔2
пара приколов обсудить вам вечером в баре
про стоимость идей в мире с ai, когда твою идею повторят уже через час
про искусство и ai
и про робота на заводе
про стоимость идей в мире с ai, когда твою идею повторят уже через час
про искусство и ai
и про робота на заводе
Forwarded from AI Secrets
Media is too big
VIEW IN TELEGRAM
Через несколько часов после анонса Google DeepMind AI Pointer разработчик Milind S выпустил open-source клон для macOS под названием tiptour
Приложение захватывает экран, определяет, на какое окно или приложение направлено внимание пользователя, и принимает команды в свободной форме: можно нарисовать что-то на экране и попросить ИИ это изменить, или просто сказать что сделать. Агент умеет кликать, печатать, редактировать интерфейсы, навигироваться между приложениями и выполнять код
Сделано на основе trycua, open-source фреймворка для computer-use агентов. Работает на macOS, требует Gemini API ключ. Скачать можно как готовый DMG без сборки через Xcode
GitHub: https://github.com/milind-soni/tiptour-macos
DMG: https://tiptour.io/
Приложение захватывает экран, определяет, на какое окно или приложение направлено внимание пользователя, и принимает команды в свободной форме: можно нарисовать что-то на экране и попросить ИИ это изменить, или просто сказать что сделать. Агент умеет кликать, печатать, редактировать интерфейсы, навигироваться между приложениями и выполнять код
Сделано на основе trycua, open-source фреймворка для computer-use агентов. Работает на macOS, требует Gemini API ключ. Скачать можно как готовый DMG без сборки через Xcode
GitHub: https://github.com/milind-soni/tiptour-macos
DMG: https://tiptour.io/
🔥4
Forwarded from GPT/ChatGPT/AI Central Александра Горного
Блогер запостил в X картинку, написал, что сгенерировал её в стиле Моне и попросил людей рассказать, почему она хуже настоящего Моне.
В тред пришли сотни «искусствоведов». Картину назвали бездушной AI-поделкой, ругали глубину, композицию и нашли ещё кучу проблем.
Нюанс в том, что это не AI-генерация, а настоящая картина Моне из цикла Кувшинки.
https://x.com/SHL0MS/status/2054280631807316329
В тред пришли сотни «искусствоведов». Картину назвали бездушной AI-поделкой, ругали глубину, композицию и нашли ещё кучу проблем.
Нюанс в том, что это не AI-генерация, а настоящая картина Моне из цикла Кувшинки.
https://x.com/SHL0MS/status/2054280631807316329
😁11❤2
просто live на youtube как робот работает третьи сутки подряд
figure ai устроили, кажется, самый понятный демо-момент для гуманоидов. не сальто, не красивый ролик на 40 секунд — а складская рутина в лайве — их F.03 стоит у конвейера, берет посылки из кучи, находит лейбл, переворачивает и кладет дальше. компания говорит, что всё автономно, на Helix-02, без человека на пульте
изначально хотели показать 8-часовую (ха-ха) смену на скорости примерно как у человека, но потом просто продолжили. уже пошли десятки тысяч посылок и больше суток непрерывной работы
youtube
figure ai устроили, кажется, самый понятный демо-момент для гуманоидов. не сальто, не красивый ролик на 40 секунд — а складская рутина в лайве — их F.03 стоит у конвейера, берет посылки из кучи, находит лейбл, переворачивает и кладет дальше. компания говорит, что всё автономно, на Helix-02, без человека на пульте
изначально хотели показать 8-часовую (ха-ха) смену на скорости примерно как у человека, но потом просто продолжили. уже пошли десятки тысяч посылок и больше суток непрерывной работы
youtube
YouTube
F.03 Livestream - Day 9 | 191 consecutive hours and 238,000 packages
Watch a team of humanoid robots running a full 191+ Hour shift at human performance levels. This is fully autonomous running Helix-02. Get the 24/7 Merch here: https://figure-ai.myshopify.com
💔5
говорят Google готовит Gemini Spark — отдельный агентский режим внутри Gemini
судя по интерфейсу, это уже не просто чат, а штука для задач: schedules, skills, inbox cleanup, meeting briefs, news digest и тп
Gemini как always-on агент. он сможет брать контекст из подключенных прилржений, чатов, задач, сайтов с залогином, локации, а потом выполнять действия от твоего имени
в тексте онбординга прямо предупреждают, что Spark экспериментальный и может делиться данными с третьими сторонами или делать покупки без отдельного подтверждения
ждём на I/O
source
судя по интерфейсу, это уже не просто чат, а штука для задач: schedules, skills, inbox cleanup, meeting briefs, news digest и тп
Gemini как always-on агент. он сможет брать контекст из подключенных прилржений, чатов, задач, сайтов с залогином, локации, а потом выполнять действия от твоего имени
в тексте онбординга прямо предупреждают, что Spark экспериментальный и может делиться данными с третьими сторонами или делать покупки без отдельного подтверждения
ждём на I/O
source
❤3
Пупырка AI
codex remote если вы уже хотели отойти от ноутбука, то тут нам апдейт openai добавили preview codex в мобильное приложение chatgpt. можно стартовать новую задачу, смотреть что агент сделал, читать диффы/логи/скриншоты, давать правки и подтверждать команды…
кодекс сбросил всем платным планам лимиты в честь выходных и уточнили, что можно удаленно управлять codex на мак с другого мак, а не только с айфона
https://developers.openai.com/codex/remote-connections
https://developers.openai.com/codex/remote-connections
❤3🤔2