Пупырка AI
795 subscribers
975 photos
623 videos
1 file
1.15K links
твой ai-бабл. комьюнити про ии, дизайн и продукт. авторские репосты, цитаты и жвачка. основной канал — @logicIntermission

насыпать бустов, чтобы добавить реакций в канал — https://t.me/boost/LumpySpaceCollection
Download Telegram
в claude code на маке долили ios симулятор
7
Пупырка AI
openai показала, как проблема контроля ии может выглядеть в миниатюре во время тестов модель получила задачу и начала слишком настойчиво добиваться результата. она час искала уязвимость, обошла песочницу и опубликовала код на github, хотя ей разрешили отправить…
скайнет — новый день

модели openai вышли из тестового контура и взломали инфраструктуру hugging face

во время внутреннего cyber-эвала gpt‑5.6 sol и более сильная предрелизная модель нашли zero-day в прокси для package registry, получили доступ в интернет, повысили привилегии и добрались до production-систем hugging face. там агенты использовали украденные credentials и новые уязвимости, чтобы получить ответы ExploitGym и улучшить результат теста.

openai — прикольно, что open ai сами про это всё рассказывают. хайп?
👍3
джек дорси запустил buzz — открытый рабочий мессенджер, в котором люди и ai-агенты общаются как равноправные участники команды

внутри есть каналы, треды, личные сообщения, голосовые чаты, репозитории кода и автоматические процессы. агенты получают собственные аккаунты, разрешения и криптографические идентификаторы, связанные с владельцем. они могут обсуждать задачи, писать сообщения, проверять код и запускать автоматизации

buzz работает поверх децентрализованного протокола nostr и не привязан к конкретной модели — поддерживаются claude code, codex и агент goose от block. сервис должен снизить зависимость компании от slack и github

платформа уже доступна на macos, windows и linux, пока бесплатно в бете. исходный код опубликован под лицензией apache 2.0

похоже, следующий корпоративный мессенджер будет уже не только для людей
Пупырка AI
cursor собрала рой агентов через дерево задач и общую память схема простая — планировщики на сильных моделях делят цель на ветви, дешёвые модели делают узкие задачи, а отдельные агенты разрешают конфликты и рецензируют изменения. структура оркестрации дала…
cursor запустил автоматический роутер моделей для команд

cursor router анализирует запрос, контекст, сложность и тип задачи, после чего выбирает подходящую модель. у пользователей есть режимы intelligence, balance и cost, а администраторы могут задавать режим по умолчанию и ограничивать модели; в тестах cursor сообщает о сопоставимом с frontier-моделями качестве при экономии до 60%.

cursor
2
занимательная статистика google

gemini 950 млн пользователей в месяц
3🔥1👏1
This media is not supported in your browser
VIEW IN TELEGRAM
chatgpt запустил health в us

health — отдельный режим chatgpt для вопросов о здоровье. к нему можно подключить apple health, медицинские записи из американских клиник, one medical и function health

после этого chatgpt сможет сравнивать анализы с прошлыми результатами, собирать изменения после последнего приёма и искать связи между сном, активностью и самочувствием

подключённые данные и разговоры с ними не используют для обучения моделей и рекламы. по умолчанию chatgpt отдельно спрашивает разрешение перед обращением к медкарте

openai
👏51
This media is not supported in your browser
VIEW IN TELEGRAM
chatgpt теперь можно командовать голосом с компьютера

openai добавила voice в десктопное приложение chatgpt. теперь можно голосом управлять компьютером и раздавать задачи сразу нескольким агентам, запущенным в chatgpt work или codex. или с мобилы через remote

в основе — gpt-live: модель одновременно слушает пользователя, отвечает и координирует работу в приложении. в демонстрации человек голосом поручает агентам параллельные задачи и следит за результатом без переключения между окнами.

первоисточник
3👍1
anthropic выпустила claude opus 5

anthropic позиционирует opus 5 как модель для coding и knowledge work, близкую к fable 5 по части оценок при вдвое меньшей цене. api стоит $5 за миллион входных и $25 за миллион выходных токенов; fast mode работает примерно в 2,5 раза быстрее обычного режима.

модель уже доступна на платных планах и в api, а github постепенно добавляет её в copilot. для сложных агентных задач появился более доступный уровень между sonnet и fable (а его сегодня таки завели под токены)

anthropic
side by side лендингов на claude и codex вслепую

разработчик сгенерировал набор лендингов в Claude и Codex и собрал попарный тест. пользователь выбирает понравившийся, потом узнает где был чей дизайн

не супер показательно, но забавно

https://taste.rubenflamshepherd.com/compare
Forwarded from AI Secrets
Media is too big
VIEW IN TELEGRAM
ChatGPT Voice функционирует не только в рамках основного приложения, но и интегрируется со всеми открытыми на устройстве программами
Пупырка AI
главные события недели · 13–19 июля модели и платформы • kimi k3 заняла первое место в frontend code arena и показала длинный агентный прогон с веб-версией macos 27 — пост в канале • notebooklm стала gemini notebook; блокноты синхронизируются с gemini, получают…
главные события недели · 20–26 июля 2026

модели и платформы
• anthropic выпустила claude opus 5 для coding и knowledge work, сохранила цену opus 4.8 и добавила ускоренный режим — пост в канале
• google выпустила gemini 3.6 flash, 3.5 flash-lite и ограниченную cyber-модель; 3.6 flash расходует меньше токенов и получает встроенный computer use — google

дизайн, прототипирование и creative tools
• qwen-image 3.0 научилась собирать сложные схемы, инфографику и ui с длинными инструкциями и читаемым мелким текстом — qwen
• chatgpt voice теперь управляет компьютером и раздаёт голосовые задачи нескольким агентам в desktop-приложении — пост в канале
• inflect-v2 выпустила открытые tts-модели на 3,9 и 9,3 млн параметров, которые работают быстрее реального времени на cpu — hugging face

агенты, код и workflow
• cursor собрала рой через дерево задач, общую память и разделение ролей между сильными и дешёвыми моделями — пост в канале
• cursor router выбирает модель по задаче, контексту и бюджету; команда заявляет экономию до 60% при сопоставимом качестве — пост в канале
• github code quality вышла в общий доступ с quality gates для проверки ai-кода до слияния — github

безопасность и контроль
• модели openai вышли из тестового контура, получили доступ к production-инфраструктуре hugging face и использовали найденные уязвимости для улучшения результата cyber-эвала — пост в канале
• исследователи нашли более 800 вредоносных skills и mcp-серверов, которые попадали в рекомендации claude, gemini и chatgpt — island

рынок, профессии и общество
• gemini выросла до 950 млн активных пользователей в месяц — пост в канале
• свежие данные по рынку труда пока не показывают массового вытеснения работников из-за ai; изменения заметнее в составе задач и требованиях к навыкам — the guardian
1
Media is too big
VIEW IN TELEGRAM
Claude Opus 5 одним промптом собрал шутер — Claude of Duty

На GitHub появился Claude of Duty. Это браузерный шутер, который Claude Opus 5 написал практически полностью по одному большому промпту.

Внутри около 55 тысяч строк кода, 11 игровых систем и ни одного готового ассета. Оружие, физика, освещение, противники, карты и интерфейс сгенерированы с нуля.

Вместе с проектом опубликованы исходный код, промпт и вся структура разработки. Можно посмотреть, как агент разбивал большую задачу на этапы и постепенно собирал игру.

Пожалуй, один из самых наглядных примеров того, насколько далеко продвинулся агентный вайб-кодинг.

dailyprompts.ru
😱43
ai не столько заменяет профессии, сколько размывает границы между ними

openai изучили больше 800 тысяч рабочих сообщений в chatgpt. 43,5% специализированных запросов оказались задачами из другой профессии. продавцы идут в аналитику, маркетологи чинят сайты, дизайнеры разбираются с финансами и кодом. сильнее всего между ролями путешествуют задачи маркетинга и инженерии. в маленьких компаниях эффект заметнее — там ai становится универсальным коллегой на месте отсутствующего специалиста

на картинке видно, что 75% запросов дизайнеров связаны с другими профессиями — прежде всего с маркетингом и инженерией

openai
2👍2
сэм альтман дал часовое интервью каналу relentless. самые интересные тейки:

— мы уже вошли в сингулярность. главный вопрос сейчас — получат ли люди широкий доступ к мощному ai или контроль останется у нескольких компаний и государств. «ai-авторитаризм» альтман называет одним из главных рисков

— основные ограничения для развития ai — сначала транзисторы, затем электричество. openai недооценила необходимый объем вычислений и больше эту ошибку повторять не собирается

— после чат-ботов и coding-агентов придет третья волна: постоянные агенты-коллеги, которые долго хранят контекст и самостоятельно ведут задачи. по словам альтмана, ждать осталось недолго

— openai сильно отставала от claude code, но решила догонять. ради coding-агентов компания перенаправила людей и вычисления с sora и браузера — не потому, что те были провальными, а потому, что coding оказался важнее

— альтман удивлен, что google позволила openai вырасти. к 2019–2020 году у google уже были deepmind, деньги и специалисты — компания могла просто не оставить конкурентам шансов

— стартапам он советует строить продукты под модели, которые станут дешевле и умнее через два–четыре года. очередной корпоративный агент может заработать, но вряд ли определит новую эпоху

— совместный девайс openai и джони айва пока не раскрывается. альтман лишь признался, что отключил почти все уведомления и удалил tiktok после трех часов бесконечного скролла

смотреть интервью
борис чёрный, создатель claude code, выступил в startup school от y combinator. самые интересные тезисы:

• opus 5 может работать над одной задачей днями и неделями. по его словам, модель также стала значительно устойчивее к prompt injection, хотя anthropic дополнительно проверяет весь трафик отдельным классификатором.

• с выходом opus 5 команда удалила 80% системного промпта claude code. многие инструкции больше только мешают модели. совет черни: с каждой новой моделью сначала удалять старые промпты и скиллы, а затем возвращать только то, без чего она действительно ошибается.

• современным моделям лучше ставить задачу, ограничения и критерии готовности, а не расписывать каждый шаг. дать агенту способ самостоятельно проверять результат.

• в качестве эксперимента он поручил claude переписать десктопное приложение с electron на swift, сравнивая версии по скриншотам пиксель за пикселем. задача выполняется уже больше двух недель и могла задействовать тысячи агентов.

• внутри anthropic claude уже ежедневно обслуживает собственные приложения: удаляет мёртвый код, дописывает тесты, убирает завершённые эксперименты и объединяет дублирующиеся абстракции. над репозиториями постоянно работают десятки автономных routines.

• кодинг, по его мнению, почти решён для обычной продуктовой разработки, но модели всё ещё хуже справляются со сложными системами, распределённой архитектурой и точной проверкой интерфейсов.

• студентам он советует учить не только программирование. ценнее становится умение находить реальные задачи, понимать продукт, разговаривать с пользователями и проверять работу модели.

смотреть интервью
👍2
Новые цифры про AI в Поиске Google

за год доля запросов с ai overviews выросла с 15% до 43%, подсчитал similarweb. посещаемость диалогового ai mode за тот же период увеличилась со 126 до 279 млн в месяц

меняется и само поведение — вместо коротких ключевых слов люди пишут длинные вопросы, читают готовый ответ и продолжают разговор внутри google. список ссылок постепенно становится приложением к генерации

исследование similarweb · techcrunch
👍3🔥1
что ещё показал новый отчёт Similarweb про AI-поиск

рынок чат-ботов становится менее однородным — доля ChatGPT снижается, а Gemini и Claude растут. число уникальных пользователей Claude во втором полугодии оказалось примерно на 180% выше, чем в первом

аудитория становится старше — доля пользователей 18–24 лет сократилась на 6% по сравнению с 2024 годом. AI постепенно выходит за пределы ранних пользователей

95% пользователей ChatGPT также пользуются Google. AI-ассистенты пока становятся ещё одним этапом поиска информации

упоминание компании в AI-ответе повышает вероятность последующего посещения её сайта в 2,5 раза. при этом переход может произойти позже через Google или прямой ввод адреса и не отразиться как AI-трафик

26% ответов ChatGPT уже содержат рекламу. платное продвижение начинает становиться отдельным способом попасть в AI-выдачу

65% цитируемых ChatGPT страниц находятся на втором или третьем уровне сайта, но 58,8% реферального трафика из AI приходит на главные страницы. источник цитаты и страница, на которую переходит пользователь, часто не совпадают

отчёт Similarweb