Пупырка AI
795 subscribers
975 photos
625 videos
1 file
1.15K links
твой ai-бабл. комьюнити про ии, дизайн и продукт. авторские репосты, цитаты и жвачка. основной канал — @logicIntermission

насыпать бустов, чтобы добавить реакций в канал — https://t.me/boost/LumpySpaceCollection
Download Telegram
Googlebook и vibe-coded widgets

ещё на ивенте показали Googlebook — это chromebook neo. и виджеты, которые можно генерировать по описанию — TechCrunch

Googlebook — новая категория ноутбуков на базе Android PC. Идея в том, что Gemini будет встроен в систему с самого начала: искать по файлам и приложениям, помогать с рабочими задачами, продолжать сценарии с телефона и управлять действиями через Magic Pointer

вторая штука — Create My Widget. пользователь описывает, какой виджет ему нужен, а Gemini собирает его сам: например, «виджет с рецептами по продуктам дома», «travel-план на выходные» и тп

это маленький, но важный сдвиг: теперь пользователь может сгенерировать микро-интерфейс под конкретную задачу. какое-то время назад у nothing были даже более смелые идеи, гугл пошел осторожнее

итого — приложения дают агенту функции, Gemini собирает из них workflow, а пользователь получает не универсальный экран приложения, а интерфейс под текущий intent. а ведь ещё утром обсуждали, что генерация текстов это начало
👍5
Media is too big
VIEW IN TELEGRAM
ai pointer — как google перепридумывают курсор 🖥
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6
Media is too big
VIEW IN TELEGRAM
codex remote

если вы уже хотели отойти от ноутбука, то тут нам апдейт

openai добавили preview codex в мобильное приложение chatgpt. можно стартовать новую задачу, смотреть что агент сделал, читать диффы/логи/скриншоты, давать правки и подтверждать команды прямо с телефона

сам codex продолжает работать не на айфоне, а на хосте (ноутбуке, mac mini или devbox)

openai docs
🔥5👌1🌚1
plaud запустили dev platform для разработчиков

plaud — это маленький ai-диктофон, который записывает разговоры и превращает их в транскрипты, саммари и заметки

теперь они запустили dev platform для разработчиков. plaud-девайсы можно встраивать в свои продукты — подключать к приложению, забирать аудио, получать расшифровки со спикерами и строить поверх этого свои воркфлоу

сценарии понятные — продажи, медицина, real estate… — всё, где важная инфа появляется не в интерфейсе, а в живом разговоре

интересна тут не транскрибация сама по себе, а контекст для агентов. если у продукта есть доступ к реальным разговорам пользователя, агент может работать не только с тем, что человек руками занёс в crm, а с первоисточником

plaud dev
3🤔2
пара приколов обсудить вам вечером в баре

про стоимость идей в мире с ai, когда твою идею повторят уже через час

про искусство и ai

и про робота на заводе
Forwarded from AI Secrets
Media is too big
VIEW IN TELEGRAM
Через несколько часов после анонса Google DeepMind AI Pointer разработчик Milind S выпустил open-source клон для macOS под названием tiptour

Приложение захватывает экран, определяет, на какое окно или приложение направлено внимание пользователя, и принимает команды в свободной форме: можно нарисовать что-то на экране и попросить ИИ это изменить, или просто сказать что сделать. Агент умеет кликать, печатать, редактировать интерфейсы, навигироваться между приложениями и выполнять код

Сделано на основе trycua, open-source фреймворка для computer-use агентов. Работает на macOS, требует Gemini API ключ. Скачать можно как готовый DMG без сборки через Xcode

GitHub: https://github.com/milind-soni/tiptour-macos

DMG: https://tiptour.io/​​​​​​​​​​​​​​​​
🔥4
Блогер запостил в X картинку, написал, что сгенерировал её в стиле Моне и попросил людей рассказать, почему она хуже настоящего Моне.

В тред пришли сотни «искусствоведов». Картину назвали бездушной AI-поделкой, ругали глубину, композицию и нашли ещё кучу проблем.

Нюанс в том, что это не AI-генерация, а настоящая картина Моне из цикла Кувшинки.

https://x.com/SHL0MS/status/2054280631807316329
😁112
просто live на youtube как робот работает третьи сутки подряд

figure ai устроили, кажется, самый понятный демо-момент для гуманоидов. не сальто, не красивый ролик на 40 секунд — а складская рутина в лайве — их F.03 стоит у конвейера, берет посылки из кучи, находит лейбл, переворачивает и кладет дальше. компания говорит, что всё автономно, на Helix-02, без человека на пульте

изначально хотели показать 8-часовую (ха-ха) смену на скорости примерно как у человека, но потом просто продолжили. уже пошли десятки тысяч посылок и больше суток непрерывной работы

youtube
💔5
говорят Google готовит Gemini Spark — отдельный агентский режим внутри Gemini

судя по интерфейсу, это уже не просто чат, а штука для задач: schedules, skills, inbox cleanup, meeting briefs, news digest и тп

Gemini как always-on агент. он сможет брать контекст из подключенных прилржений, чатов, задач, сайтов с залогином, локации, а потом выполнять действия от твоего имени

в тексте онбординга прямо предупреждают, что Spark экспериментальный и может делиться данными с третьими сторонами или делать покупки без отдельного подтверждения

ждём на I/O

source
3
Пупырка AI
главные события недели · 4–10 мая 2026 Модели • gpt-5.5 instant стал моделью chatgpt по умолчанию: меньше галлюцинаций, лучше работа с изображениями и видимость memory sources как новый паттерн доверия в персонализированных ai-продуктах — пост в канале •…
главные события недели · 10–17 мая 2026

google и agentic os
• google показал android как agentic os: gemini intelligence становится слоем поверх android, chrome, auto, wear os и будущих googlebook, а не отдельным чатиком — пост в канале
• google appfunctions — фактически mcp для android-приложений: приложения смогут отдавать агентам callable-функции вместо screen scraping и кликов по ui — пост в канале
• googlebook и vibe-coded widgets: google пробует ноутбук вокруг gemini и микро-интерфейсы, которые пользователь генерирует под конкретный intent — пост в канале
• google готовит gemini spark — отдельный режим для фоновых задач, skills, schedules, inbox cleanup, meeting briefs и других always-on workflows — пост в канале

агенты и инструменты
• codex remote появился в мобильном chatgpt preview: можно стартовать задачу, смотреть диффы и логи, давать правки и approve next steps с телефона, пока codex работает на ноутбуке/mac mini/devbox — пост в канале
• dessn поднял $6 млн на дизайн прямо в production-коде: не “сгенерируй лендинг с нуля”, а итерации по реальному продукту, компонентам и codebase — пост в канале
• plaud запустили dev platform: ai-диктофоны можно подключать к продуктам, забирать аудио, транскрипты и speaker diarization как контекст для workflows и агентов — пост в канале

openai и персональные данные
• openai запустили personal finance в chatgpt: подключение счетов, карт, кредитов и инвестиций через plaid, дашборд расходов/net worth/портфеля и вопросы по своим финансовым данным — openai

интерфейсы и продуктовые паттерны
• html is the new markdown: llm-ответы всё чаще становятся не текстом, а одноразовыми html-артефактами — интерактивными планами, ревью, таймлайнами, дашбордами и маленькими приложениями — пост в канале
• ai pointer быстро получил open-source клон для macos: tiptour захватывает экран, понимает контекст и выполняет действия в приложениях через computer-use агент — пост в канале

инфраструктура и исследования
• deepmind alphaevolve показал, что gemini-powered coding agents уже оптимизируют алгоритмы для датацентров и чипов google, а не только пишут прикладной код — deepmind

роботы
• figure ai устроили сильное live-демо F.03: не постановочный ролик, а складская рутина на конвейере, которая шла уже больше суток и дошла до десятков тысяч посылок — пост в канале
openai стягивает chatgpt и codex в единую агентную платформу

openai снова перестраивает продуктовую организацию: greg brockman официально берёт продуктовую стратегию, а команда codex будет вести центральную платформу для consumer и enterprise. По сути, chatgpt, codex и будущий atlas/browser-сценарий сходятся в один agentic experience, а не остаются набором отдельных инструментов

для нас это: интерфейс ai-продукта будет всё меньше похож на «чат плюс плагины» и всё больше на рабочую среду с общим контекстом, правами, задачами и поверхностями

decoder
🔥1