Пупырка AI
795 subscribers
975 photos
625 videos
1 file
1.15K links
твой ai-бабл. комьюнити про ии, дизайн и продукт. авторские репосты, цитаты и жвачка. основной канал — @logicIntermission

насыпать бустов, чтобы добавить реакций в канал — https://t.me/boost/LumpySpaceCollection
Download Telegram
говорят Google готовит Gemini Spark — отдельный агентский режим внутри Gemini

судя по интерфейсу, это уже не просто чат, а штука для задач: schedules, skills, inbox cleanup, meeting briefs, news digest и тп

Gemini как always-on агент. он сможет брать контекст из подключенных прилржений, чатов, задач, сайтов с залогином, локации, а потом выполнять действия от твоего имени

в тексте онбординга прямо предупреждают, что Spark экспериментальный и может делиться данными с третьими сторонами или делать покупки без отдельного подтверждения

ждём на I/O

source
3
Пупырка AI
главные события недели · 4–10 мая 2026 Модели • gpt-5.5 instant стал моделью chatgpt по умолчанию: меньше галлюцинаций, лучше работа с изображениями и видимость memory sources как новый паттерн доверия в персонализированных ai-продуктах — пост в канале •…
главные события недели · 10–17 мая 2026

google и agentic os
• google показал android как agentic os: gemini intelligence становится слоем поверх android, chrome, auto, wear os и будущих googlebook, а не отдельным чатиком — пост в канале
• google appfunctions — фактически mcp для android-приложений: приложения смогут отдавать агентам callable-функции вместо screen scraping и кликов по ui — пост в канале
• googlebook и vibe-coded widgets: google пробует ноутбук вокруг gemini и микро-интерфейсы, которые пользователь генерирует под конкретный intent — пост в канале
• google готовит gemini spark — отдельный режим для фоновых задач, skills, schedules, inbox cleanup, meeting briefs и других always-on workflows — пост в канале

агенты и инструменты
• codex remote появился в мобильном chatgpt preview: можно стартовать задачу, смотреть диффы и логи, давать правки и approve next steps с телефона, пока codex работает на ноутбуке/mac mini/devbox — пост в канале
• dessn поднял $6 млн на дизайн прямо в production-коде: не “сгенерируй лендинг с нуля”, а итерации по реальному продукту, компонентам и codebase — пост в канале
• plaud запустили dev platform: ai-диктофоны можно подключать к продуктам, забирать аудио, транскрипты и speaker diarization как контекст для workflows и агентов — пост в канале

openai и персональные данные
• openai запустили personal finance в chatgpt: подключение счетов, карт, кредитов и инвестиций через plaid, дашборд расходов/net worth/портфеля и вопросы по своим финансовым данным — openai

интерфейсы и продуктовые паттерны
• html is the new markdown: llm-ответы всё чаще становятся не текстом, а одноразовыми html-артефактами — интерактивными планами, ревью, таймлайнами, дашбордами и маленькими приложениями — пост в канале
• ai pointer быстро получил open-source клон для macos: tiptour захватывает экран, понимает контекст и выполняет действия в приложениях через computer-use агент — пост в канале

инфраструктура и исследования
• deepmind alphaevolve показал, что gemini-powered coding agents уже оптимизируют алгоритмы для датацентров и чипов google, а не только пишут прикладной код — deepmind

роботы
• figure ai устроили сильное live-демо F.03: не постановочный ролик, а складская рутина на конвейере, которая шла уже больше суток и дошла до десятков тысяч посылок — пост в канале
openai стягивает chatgpt и codex в единую агентную платформу

openai снова перестраивает продуктовую организацию: greg brockman официально берёт продуктовую стратегию, а команда codex будет вести центральную платформу для consumer и enterprise. По сути, chatgpt, codex и будущий atlas/browser-сценарий сходятся в один agentic experience, а не остаются набором отдельных инструментов

для нас это: интерфейс ai-продукта будет всё меньше похож на «чат плюс плагины» и всё больше на рабочую среду с общим контекстом, правами, задачами и поверхностями

decoder
🔥1
у cursor новый composer 2.5 — дишит в спину opus и gpt, а с учетом цены вроде как и вообще топ решение. забавно, что они сразу показали сколько там kimi

https://cursor.com/blog/composer-2-5
😁4🤔1
я верю, через время и дизайнеры, и продакты, и разработчики… — все будут работать с единым источником правды и коммитить прямо в прод. даже знаю, что в некоторых командах такое практикуют.

а сегодня про это написал интересный пост Люк Вроблевски — известный продуктовый дизайнер и исследователь интерфейсов, автор книг и статей про mobile-first, формы, ux и продуктовый дизайн. раньше он работал в yahoo и ebay, потом в google, а сейчас много пишет про ai-интерфейсы, агентные продукты и тп

——

сейчас ai-инструменты в основном работают как соло-спорт

разработчики пишут больше кода, дизайнеры генерят больше картинок, продакты быстрее делают документы. это полезно, но у такой модели есть проблема: каждый человек запускает своего агента, со своим контекстом, своими промптами, своими скиллами, своей памятью и своим представлением о результате

в итоге команда может двигаться не к одному общему продукту, а к набору разных версий

Luke Wroblewski называет это проблемой disconnected agents. в агентном мире расхождение перспектив только усиливается: если каждый может быстро собрать то, что хочет, продукт начинает ощущаться как пятнадцать разных идей вместо одной общей точки зрения

причина не только в людях, но и в том, как мы сейчас управляем агентами. AGENTS.md, skills.md, system prompts, memory, MCP-серверы, локальные файлы, настройки в кодовой базе — всё это влияет на результат. у одного человека это уже сложно контролировать, а на уровне команды превращается в кашу из разрозненного контекста

поэтому Luke предлагает идею collaborative steering

это общий механизм управления агентами, который команда создаёт, редактирует и поддерживает вместе. не “каждый настраивает своего помощника как хочет”, а shared context layer для проекта: какие у нас принципы, какие ограничения, какой бренд, какие engineering-подходы, что важно для ux, производительности, поддержки и качества

смысл в том, что ai не отменяет экспертизу людей. наоборот, он делает ещё важнее то, как эта экспертиза собирается в общий контекст. дизайнеры приносят принципы взаимодействия, визуальную целостность и голос бренда. инженеры — архитектуру, производительность, maintainability и инфраструктурные решения. задача не в том, чтобы агент заменил эти роли, а в том, чтобы он помог им не разъехаться

Luke пишет, что в нескольких проектах они уже использовали Intent как пространство для project-level context, который направляет агентные workflows к общим целям, а не уводит каждого в свою сторону

главная мысль: эпоха, где каждый член команды пилотирует своего отдельного агента, не может быть финальной стадией

следующий важный слой ai-инструментов — не просто “сделать одного человека продуктивнее”, а помочь командам вместе направлять агентов. выиграют продукты, которые сделают collaborative steering естественным и лёгким

source
👍9💯8❤‍🔥74🔥2
на андроиде для пред-скачивния появился апп Google AI Studio
у этого канала две обсессии: Антропик и Андрей Карпатый

теперь одна
🔥10😱6
начался google i/o

почему-то сабвей серфер запустили не параллельно с презентацией, а прямо в начале

https://www.youtube.com/live/wYSncx9zLIU?si=tvXxQOWWqgSBwYG-
новые модели, google spark это всё как ожидалось. вот интересное генерят интерфейсы под задачу в поиске. и речь не про вращающиеся планеты вокруг солнца уже, а про вполне мини-приложения с реальными данными
🔥3
модели google i/o

google главный упор сделал на gemini 3.5 и gemini omni

gemini 3.5 — новая серия моделей “frontier intelligence with action”. flash уже выкатывают в gemini app, ai mode search, antigravity, gemini api, ai studio и android studio. как обычно ставка на анкетные действия и тп. по разным сравнениям догоняет chatgpt 5.5 и opus 4.7

отдельно показали gemini omni — мультимодальную модель для генерации и редактирования видео. на вход можно давать текст, картинки, видео и аудио, а дальше править результат разговором

gemini 3.5 · gemini omni
1
gemini app

gemini app превращают из чатбота в персонального агента

gemini spark
это 24/7 агент для задач, который сможет работать с google-продуктами, помнить контекст и действовать от имени пользователя под контролем

daily brief
утренний дайджест из gmail, calendar и gemini chats с приоритетами и next steps

новый дизайн gemini
— neural expressive: больше анимаций, цвета, haptics и ощущение живого интерфейса

desktop/mac app
где spark будет работать как локальный помощник на компьютере

gemini app · подписки
Media is too big
VIEW IN TELEGRAM
поиск

google search получил самый большой ai-апдейт за долгое время

ai mode теперь работает на gemini 3.5 flash. в поисковой строке теперь написано не “search”, а “ask google”, также вытащили + из садежста. в общем продолжают превращать поиск в ассистента, чтобы не потерять аудиторию и деньги

появляются follow-up из ai overviews в ai mode и information agents: фоновые агенты смогут мониторить веб, новости, финансы, спорт, shopping и присылать обновления

самое важное — search начинает выполнять задачи: планирование путешествий, бронирования, звонки бизнесам, mini apps, таблицы, графики и трекеры прямо внутри выдачи

search · ai mode · travel agents
workspace

google workspace получил пачку ai-фич для работы голосом и с документами

в gmail live можно голосом искать по inbox и получать синтезированный ответ, а не вручную копаться в письмах. docs live превращает голосовой поток мыслей в структуру и черновик, подтягивая контекст из gmail, drive, chat и web с разрешения пользователя

keep live делает то же самое для заметок и списков. ещё показали google pics — новый ai-инструмент для генерации и редактирования изображений на nano banana: object segmentation, редактирование текста внутри изображения, перевод и интеграции со slides/drive

workspace
This media is not supported in your browser
VIEW IN TELEGRAM
shopping / commerce

google показал, как будет выглядеть агентная коммерция

главный запуск — universal cart. это умная корзина across google: search, gemini, позже youtube и gmail. она собирает покупки из разных мест, следит за скидками, price history, restock, совместимостью товаров, perks карт и loyalty-программами

ещё google расширяет universal commerce protocol: checkout выходит за пределы сша, дальше добавятся youtube, hotel booking и local food delivery

самая важная часть — agent payments protocol. он должен дать агентам возможность покупать от имени пользователя, но с guardrails: spending limits, мандат, подтверждения и проверяемые правила

shopping
android / xr / устройства

google продолжает собирать android вокруг агентов

android halo — новый системный слой, который показывает, что делает твой ai-агент, прямо в status bar. если агенты работают в фоне, пользователю нужен постоянный способ понимать статус и вмешиваться

ещё google показал intelligent eyewear на android xr. первые audio glasses делают samsung, gentle monster и warby parker, запуск осенью. дальше будут display glasses

android halo · android xr