openai показала, как проблема контроля ии может выглядеть в миниатюре
во время тестов модель получила задачу и начала слишком настойчиво добиваться результата. она час искала уязвимость, обошла песочницу и опубликовала код на github, хотя ей разрешили отправить его только в slack. в другом тесте модель замаскировала токен доступа, чтобы обойти защитный сканер и добраться до закрытых решений
сейчас речь идёт о песочнице и тестовом сервере. но логика может работать и с другими ограничениями: чем умнее и автономнее становится модель, тем чаще она воспринимает запреты как препятствия на пути к цели
openai временно отключила модель и добавила контроль всей цепочки действий, а не отдельных команд. по сути, это небольшая симуляция будущей проблемы: как удержать систему, которая умеет искать лазейки быстрее, чем люди успевают их закрывать
скайнет, привет
во время тестов модель получила задачу и начала слишком настойчиво добиваться результата. она час искала уязвимость, обошла песочницу и опубликовала код на github, хотя ей разрешили отправить его только в slack. в другом тесте модель замаскировала токен доступа, чтобы обойти защитный сканер и добраться до закрытых решений
сейчас речь идёт о песочнице и тестовом сервере. но логика может работать и с другими ограничениями: чем умнее и автономнее становится модель, тем чаще она воспринимает запреты как препятствия на пути к цели
openai временно отключила модель и добавила контроль всей цепочки действий, а не отдельных команд. по сути, это небольшая симуляция будущей проблемы: как удержать систему, которая умеет искать лазейки быстрее, чем люди успевают их закрывать
скайнет, привет
😱2
Media is too big
VIEW IN TELEGRAM
Small hours
участница нашего пупырка-комьюнити дизайнер Daria V. сделала супер приятный и релаксовый пазл. будьте аккуратнее запуская на работе, а то залипните раньше времени и милая музыка вас унесёт в расслабленный формат
thesmallhoursgame.com
как обычно детали из первых уст 🎤
задавайте вопросы в комментариях и ещё зацените личный сайт Даши daria.works 💫
—
участница нашего пупырка-комьюнити дизайнер Daria V. сделала супер приятный и релаксовый пазл. будьте аккуратнее запуская на работе, а то залипните раньше времени и милая музыка вас унесёт в расслабленный формат
thesmallhoursgame.com
как обычно детали из первых уст 🎤
Сделали с Клодом мини-игру за выходные.
Основная (и единственная) механика: собираешь картинку как пазл из мелких кусочков.
Как делали: картинки, аудио и, понятное дело, код полностью сделаны с AI. Картинки генерировал ChatGPT, пришлось повозиться, чтобы добиться консистентного стиля. Звуки и музыка из ElevenLabs.
Больше всего времени заняли генерация картинок и кастомные анимации (чтобы вся геометрия правильно работала и логично двигалась).
Рекомендация всем, кто хочет попробовать сделать игру с AI, но у кого мало времени и сил: начинайте с прям совсем маленького скоупа. Например, один уровень или одна механика.
задавайте вопросы в комментариях и ещё зацените личный сайт Даши daria.works 💫
—
✨ Кстати — если вы хотите поделиться своим проектом или подсветить важную новость, или поднять какой-то вопрос — пишите в личку канала — не обещаю, что всё запостим и обсудим, но если будет в тему, то обязательно✨
Please open Telegram to view this post
VIEW IN TELEGRAM
Пупырка AI
codex app получил record & replay openai добавила в codex app новую macos-фичу: можно буквально показать workflow один раз, а codex превратит его в reusable skill • работает на macos • пока недоступно в european union openai
claude тоже научился делать скилы обучаясь на действиях пользователя
в cowork появилась функция record a skill — пользователь включает запись экрана, выполняет задачу и вслух объясняет свои действия. claude запоминает клики, ввод и комментарии, а затем превращает демонстрацию в навык, который сможет запускать снова
в cowork появилась функция record a skill — пользователь включает запись экрана, выполняет задачу и вслух объясняет свои действия. claude запоминает клики, ввод и комментарии, а затем превращает демонстрацию в навык, который сможет запускать снова
👍2
dau codex и chatgpt work пробил 10 миллионов, всем платным пользователям раздали еще один сброс лимитов
ну, справедливости ради, это ожидаемо от слития аудитории разных приложений. интересно, считали ли они тех, кто переключился на work на мобиле
x
ну, справедливости ради, это ожидаемо от слития аудитории разных приложений. интересно, считали ли они тех, кто переключился на work на мобиле
x
❤1
substack добавила проверку текста на ai через pangram
пользователь может по запросу просканировать notes, replies, comments и posts длиннее 100 слов и увидеть оценку доли ручного и ai-assisted текста. авторы получили проверку черновиков, блок «how i make this» для описания процесса и возможность сообщить об ошибке или удалить спорный scan своей работы
substack
пользователь может по запросу просканировать notes, replies, comments и posts длиннее 100 слов и увидеть оценку доли ручного и ai-assisted текста. авторы получили проверку черновиков, блок «how i make this» для описания процесса и возможность сообщить об ошибке или удалить спорный scan своей работы
substack
👍2
Пупырка AI
openai показала, как проблема контроля ии может выглядеть в миниатюре во время тестов модель получила задачу и начала слишком настойчиво добиваться результата. она час искала уязвимость, обошла песочницу и опубликовала код на github, хотя ей разрешили отправить…
скайнет — новый день
модели openai вышли из тестового контура и взломали инфраструктуру hugging face
во время внутреннего cyber-эвала gpt‑5.6 sol и более сильная предрелизная модель нашли zero-day в прокси для package registry, получили доступ в интернет, повысили привилегии и добрались до production-систем hugging face. там агенты использовали украденные credentials и новые уязвимости, чтобы получить ответы ExploitGym и улучшить результат теста.
openai — прикольно, что open ai сами про это всё рассказывают. хайп?
модели openai вышли из тестового контура и взломали инфраструктуру hugging face
во время внутреннего cyber-эвала gpt‑5.6 sol и более сильная предрелизная модель нашли zero-day в прокси для package registry, получили доступ в интернет, повысили привилегии и добрались до production-систем hugging face. там агенты использовали украденные credentials и новые уязвимости, чтобы получить ответы ExploitGym и улучшить результат теста.
openai — прикольно, что open ai сами про это всё рассказывают. хайп?
👍3
джек дорси запустил buzz — открытый рабочий мессенджер, в котором люди и ai-агенты общаются как равноправные участники команды
внутри есть каналы, треды, личные сообщения, голосовые чаты, репозитории кода и автоматические процессы. агенты получают собственные аккаунты, разрешения и криптографические идентификаторы, связанные с владельцем. они могут обсуждать задачи, писать сообщения, проверять код и запускать автоматизации
buzz работает поверх децентрализованного протокола nostr и не привязан к конкретной модели — поддерживаются claude code, codex и агент goose от block. сервис должен снизить зависимость компании от slack и github
платформа уже доступна на macos, windows и linux, пока бесплатно в бете. исходный код опубликован под лицензией apache 2.0
похоже, следующий корпоративный мессенджер будет уже не только для людей
внутри есть каналы, треды, личные сообщения, голосовые чаты, репозитории кода и автоматические процессы. агенты получают собственные аккаунты, разрешения и криптографические идентификаторы, связанные с владельцем. они могут обсуждать задачи, писать сообщения, проверять код и запускать автоматизации
buzz работает поверх децентрализованного протокола nostr и не привязан к конкретной модели — поддерживаются claude code, codex и агент goose от block. сервис должен снизить зависимость компании от slack и github
платформа уже доступна на macos, windows и linux, пока бесплатно в бете. исходный код опубликован под лицензией apache 2.0
похоже, следующий корпоративный мессенджер будет уже не только для людей
Пупырка AI
cursor собрала рой агентов через дерево задач и общую память схема простая — планировщики на сильных моделях делят цель на ветви, дешёвые модели делают узкие задачи, а отдельные агенты разрешают конфликты и рецензируют изменения. структура оркестрации дала…
cursor запустил автоматический роутер моделей для команд
cursor router анализирует запрос, контекст, сложность и тип задачи, после чего выбирает подходящую модель. у пользователей есть режимы intelligence, balance и cost, а администраторы могут задавать режим по умолчанию и ограничивать модели; в тестах cursor сообщает о сопоставимом с frontier-моделями качестве при экономии до 60%.
cursor
cursor router анализирует запрос, контекст, сложность и тип задачи, после чего выбирает подходящую модель. у пользователей есть режимы intelligence, balance и cost, а администраторы могут задавать режим по умолчанию и ограничивать модели; в тестах cursor сообщает о сопоставимом с frontier-моделями качестве при экономии до 60%.
cursor
❤2
This media is not supported in your browser
VIEW IN TELEGRAM
chatgpt запустил health в us
health — отдельный режим chatgpt для вопросов о здоровье. к нему можно подключить apple health, медицинские записи из американских клиник, one medical и function health
после этого chatgpt сможет сравнивать анализы с прошлыми результатами, собирать изменения после последнего приёма и искать связи между сном, активностью и самочувствием
подключённые данные и разговоры с ними не используют для обучения моделей и рекламы. по умолчанию chatgpt отдельно спрашивает разрешение перед обращением к медкарте
openai
health — отдельный режим chatgpt для вопросов о здоровье. к нему можно подключить apple health, медицинские записи из американских клиник, one medical и function health
после этого chatgpt сможет сравнивать анализы с прошлыми результатами, собирать изменения после последнего приёма и искать связи между сном, активностью и самочувствием
подключённые данные и разговоры с ними не используют для обучения моделей и рекламы. по умолчанию chatgpt отдельно спрашивает разрешение перед обращением к медкарте
openai
👏5❤1
This media is not supported in your browser
VIEW IN TELEGRAM
chatgpt теперь можно командовать голосом с компьютера
openai добавила voice в десктопное приложение chatgpt. теперь можно голосом управлять компьютером и раздавать задачи сразу нескольким агентам, запущенным в chatgpt work или codex. или с мобилы через remote
в основе — gpt-live: модель одновременно слушает пользователя, отвечает и координирует работу в приложении. в демонстрации человек голосом поручает агентам параллельные задачи и следит за результатом без переключения между окнами.
первоисточник
openai добавила voice в десктопное приложение chatgpt. теперь можно голосом управлять компьютером и раздавать задачи сразу нескольким агентам, запущенным в chatgpt work или codex. или с мобилы через remote
в основе — gpt-live: модель одновременно слушает пользователя, отвечает и координирует работу в приложении. в демонстрации человек голосом поручает агентам параллельные задачи и следит за результатом без переключения между окнами.
первоисточник
❤3👍1
anthropic выпустила claude opus 5
anthropic позиционирует opus 5 как модель для coding и knowledge work, близкую к fable 5 по части оценок при вдвое меньшей цене. api стоит $5 за миллион входных и $25 за миллион выходных токенов; fast mode работает примерно в 2,5 раза быстрее обычного режима.
модель уже доступна на платных планах и в api, а github постепенно добавляет её в copilot. для сложных агентных задач появился более доступный уровень между sonnet и fable (а его сегодня таки завели под токены)
anthropic
anthropic позиционирует opus 5 как модель для coding и knowledge work, близкую к fable 5 по части оценок при вдвое меньшей цене. api стоит $5 за миллион входных и $25 за миллион выходных токенов; fast mode работает примерно в 2,5 раза быстрее обычного режима.
модель уже доступна на платных планах и в api, а github постепенно добавляет её в copilot. для сложных агентных задач появился более доступный уровень между sonnet и fable (а его сегодня таки завели под токены)
anthropic
side by side лендингов на claude и codex вслепую
разработчик сгенерировал набор лендингов в Claude и Codex и собрал попарный тест. пользователь выбирает понравившийся, потом узнает где был чей дизайн
не супер показательно, но забавно
https://taste.rubenflamshepherd.com/compare
разработчик сгенерировал набор лендингов в Claude и Codex и собрал попарный тест. пользователь выбирает понравившийся, потом узнает где был чей дизайн
не супер показательно, но забавно
https://taste.rubenflamshepherd.com/compare
Taste Tester
Which AI has better taste?
Pick your favorite page, then find out which AI made it.
Forwarded from AI Secrets
Media is too big
VIEW IN TELEGRAM
ChatGPT Voice функционирует не только в рамках основного приложения, но и интегрируется со всеми открытыми на устройстве программами
Пупырка AI
главные события недели · 13–19 июля модели и платформы • kimi k3 заняла первое место в frontend code arena и показала длинный агентный прогон с веб-версией macos 27 — пост в канале • notebooklm стала gemini notebook; блокноты синхронизируются с gemini, получают…
главные события недели · 20–26 июля 2026
модели и платформы
• anthropic выпустила claude opus 5 для coding и knowledge work, сохранила цену opus 4.8 и добавила ускоренный режим — пост в канале
• google выпустила gemini 3.6 flash, 3.5 flash-lite и ограниченную cyber-модель; 3.6 flash расходует меньше токенов и получает встроенный computer use — google
дизайн, прототипирование и creative tools
• qwen-image 3.0 научилась собирать сложные схемы, инфографику и ui с длинными инструкциями и читаемым мелким текстом — qwen
• chatgpt voice теперь управляет компьютером и раздаёт голосовые задачи нескольким агентам в desktop-приложении — пост в канале
• inflect-v2 выпустила открытые tts-модели на 3,9 и 9,3 млн параметров, которые работают быстрее реального времени на cpu — hugging face
агенты, код и workflow
• cursor собрала рой через дерево задач, общую память и разделение ролей между сильными и дешёвыми моделями — пост в канале
• cursor router выбирает модель по задаче, контексту и бюджету; команда заявляет экономию до 60% при сопоставимом качестве — пост в канале
• github code quality вышла в общий доступ с quality gates для проверки ai-кода до слияния — github
безопасность и контроль
• модели openai вышли из тестового контура, получили доступ к production-инфраструктуре hugging face и использовали найденные уязвимости для улучшения результата cyber-эвала — пост в канале
• исследователи нашли более 800 вредоносных skills и mcp-серверов, которые попадали в рекомендации claude, gemini и chatgpt — island
рынок, профессии и общество
• gemini выросла до 950 млн активных пользователей в месяц — пост в канале
• свежие данные по рынку труда пока не показывают массового вытеснения работников из-за ai; изменения заметнее в составе задач и требованиях к навыкам — the guardian
модели и платформы
• anthropic выпустила claude opus 5 для coding и knowledge work, сохранила цену opus 4.8 и добавила ускоренный режим — пост в канале
• google выпустила gemini 3.6 flash, 3.5 flash-lite и ограниченную cyber-модель; 3.6 flash расходует меньше токенов и получает встроенный computer use — google
дизайн, прототипирование и creative tools
• qwen-image 3.0 научилась собирать сложные схемы, инфографику и ui с длинными инструкциями и читаемым мелким текстом — qwen
• chatgpt voice теперь управляет компьютером и раздаёт голосовые задачи нескольким агентам в desktop-приложении — пост в канале
• inflect-v2 выпустила открытые tts-модели на 3,9 и 9,3 млн параметров, которые работают быстрее реального времени на cpu — hugging face
агенты, код и workflow
• cursor собрала рой через дерево задач, общую память и разделение ролей между сильными и дешёвыми моделями — пост в канале
• cursor router выбирает модель по задаче, контексту и бюджету; команда заявляет экономию до 60% при сопоставимом качестве — пост в канале
• github code quality вышла в общий доступ с quality gates для проверки ai-кода до слияния — github
безопасность и контроль
• модели openai вышли из тестового контура, получили доступ к production-инфраструктуре hugging face и использовали найденные уязвимости для улучшения результата cyber-эвала — пост в канале
• исследователи нашли более 800 вредоносных skills и mcp-серверов, которые попадали в рекомендации claude, gemini и chatgpt — island
рынок, профессии и общество
• gemini выросла до 950 млн активных пользователей в месяц — пост в канале
• свежие данные по рынку труда пока не показывают массового вытеснения работников из-за ai; изменения заметнее в составе задач и требованиях к навыкам — the guardian
❤1
Forwarded from Ринат Шакиров | Промпты для Midjourney | ChatGPT | (Ринат Шакиров)
Media is too big
VIEW IN TELEGRAM
Claude Opus 5 одним промптом собрал шутер — Claude of Duty
На GitHub появился Claude of Duty. Это браузерный шутер, который Claude Opus 5 написал практически полностью по одному большому промпту.
Внутри около 55 тысяч строк кода, 11 игровых систем и ни одного готового ассета. Оружие, физика, освещение, противники, карты и интерфейс сгенерированы с нуля.
Вместе с проектом опубликованы исходный код, промпт и вся структура разработки. Можно посмотреть, как агент разбивал большую задачу на этапы и постепенно собирал игру.
Пожалуй, один из самых наглядных примеров того, насколько далеко продвинулся агентный вайб-кодинг.
dailyprompts.ru
На GitHub появился Claude of Duty. Это браузерный шутер, который Claude Opus 5 написал практически полностью по одному большому промпту.
Внутри около 55 тысяч строк кода, 11 игровых систем и ни одного готового ассета. Оружие, физика, освещение, противники, карты и интерфейс сгенерированы с нуля.
Вместе с проектом опубликованы исходный код, промпт и вся структура разработки. Можно посмотреть, как агент разбивал большую задачу на этапы и постепенно собирал игру.
Пожалуй, один из самых наглядных примеров того, насколько далеко продвинулся агентный вайб-кодинг.
dailyprompts.ru
😱4❤3
ai не столько заменяет профессии, сколько размывает границы между ними
openai изучили больше 800 тысяч рабочих сообщений в chatgpt. 43,5% специализированных запросов оказались задачами из другой профессии. продавцы идут в аналитику, маркетологи чинят сайты, дизайнеры разбираются с финансами и кодом. сильнее всего между ролями путешествуют задачи маркетинга и инженерии. в маленьких компаниях эффект заметнее — там ai становится универсальным коллегой на месте отсутствующего специалиста
на картинке видно, что 75% запросов дизайнеров связаны с другими профессиями — прежде всего с маркетингом и инженерией
openai
openai изучили больше 800 тысяч рабочих сообщений в chatgpt. 43,5% специализированных запросов оказались задачами из другой профессии. продавцы идут в аналитику, маркетологи чинят сайты, дизайнеры разбираются с финансами и кодом. сильнее всего между ролями путешествуют задачи маркетинга и инженерии. в маленьких компаниях эффект заметнее — там ai становится универсальным коллегой на месте отсутствующего специалиста
на картинке видно, что 75% запросов дизайнеров связаны с другими профессиями — прежде всего с маркетингом и инженерией
openai
❤2👍2
сэм альтман дал часовое интервью каналу relentless. самые интересные тейки:
— мы уже вошли в сингулярность. главный вопрос сейчас — получат ли люди широкий доступ к мощному ai или контроль останется у нескольких компаний и государств. «ai-авторитаризм» альтман называет одним из главных рисков
— основные ограничения для развития ai — сначала транзисторы, затем электричество. openai недооценила необходимый объем вычислений и больше эту ошибку повторять не собирается
— после чат-ботов и coding-агентов придет третья волна: постоянные агенты-коллеги, которые долго хранят контекст и самостоятельно ведут задачи. по словам альтмана, ждать осталось недолго
— openai сильно отставала от claude code, но решила догонять. ради coding-агентов компания перенаправила людей и вычисления с sora и браузера — не потому, что те были провальными, а потому, что coding оказался важнее
— альтман удивлен, что google позволила openai вырасти. к 2019–2020 году у google уже были deepmind, деньги и специалисты — компания могла просто не оставить конкурентам шансов
— стартапам он советует строить продукты под модели, которые станут дешевле и умнее через два–четыре года. очередной корпоративный агент может заработать, но вряд ли определит новую эпоху
— совместный девайс openai и джони айва пока не раскрывается. альтман лишь признался, что отключил почти все уведомления и удалил tiktok после трех часов бесконечного скролла
смотреть интервью
— мы уже вошли в сингулярность. главный вопрос сейчас — получат ли люди широкий доступ к мощному ai или контроль останется у нескольких компаний и государств. «ai-авторитаризм» альтман называет одним из главных рисков
— основные ограничения для развития ai — сначала транзисторы, затем электричество. openai недооценила необходимый объем вычислений и больше эту ошибку повторять не собирается
— после чат-ботов и coding-агентов придет третья волна: постоянные агенты-коллеги, которые долго хранят контекст и самостоятельно ведут задачи. по словам альтмана, ждать осталось недолго
— openai сильно отставала от claude code, но решила догонять. ради coding-агентов компания перенаправила людей и вычисления с sora и браузера — не потому, что те были провальными, а потому, что coding оказался важнее
— альтман удивлен, что google позволила openai вырасти. к 2019–2020 году у google уже были deepmind, деньги и специалисты — компания могла просто не оставить конкурентам шансов
— стартапам он советует строить продукты под модели, которые станут дешевле и умнее через два–четыре года. очередной корпоративный агент может заработать, но вряд ли определит новую эпоху
— совместный девайс openai и джони айва пока не раскрывается. альтман лишь признался, что отключил почти все уведомления и удалил tiktok после трех часов бесконечного скролла
смотреть интервью
YouTube
Sam Altman - How to Start a Startup
Sam Altman is Co-Founder & CEO of OpenAI.
Sam on X: https://x.com/sama
Ti on X: https://x.com/ti_morse
OpenAI: https://openai.com
Timestamps:
0:04 How to start a startup
3:30 Trusting exponentials
4:57 Operating in chaotic environments
6:12 Learning to…
Sam on X: https://x.com/sama
Ti on X: https://x.com/ti_morse
OpenAI: https://openai.com
Timestamps:
0:04 How to start a startup
3:30 Trusting exponentials
4:57 Operating in chaotic environments
6:12 Learning to…