Forwarded from Гриненко про ИИ, бизнес и образование
Tibo (Thibault Sottiaux), руководитель ChatGPT и Codex, утверждает, что Астра в режиме минимального ризонинга лучше, чем Sol на high (и в ~2 раза дешевле на задачу).
Так что с точки зрения эффективности на токен Астру нужно выбирать почти для всего, а из 5.6-моделей смысл остаётся только у Луны (доступной даже без подписки) для простых задач.
Причин использовать Sol как будто не осталось. А Terra и раньше была сомнительным выбором.
Правда в комментах к треду народ жалуется, что при всей своей эффективности, Астра неистово жрет токены.
@devspotting
Так что с точки зрения эффективности на токен Астру нужно выбирать почти для всего, а из 5.6-моделей смысл остаётся только у Луны (доступной даже без подписки) для простых задач.
Причин использовать Sol как будто не осталось. А Terra и раньше была сомнительным выбором.
Правда в комментах к треду народ жалуется, что при всей своей эффективности, Астра неистово жрет токены.
@devspotting
X (formerly Twitter)
Tibo (@thsottiaux) on X
To calibrate you all on which reasoning effort to use for Astra, know that GPT-6 Astra on low performs better than GPT-5.6 Sol on high.
If you were using high reasoning efforts with Sol and were …
If you were using high reasoning efforts with Sol and were …
⚡1
openai хочет скрыть границу между chatgpt work и codex
тара сешан и тай гери из продуктовой команды рассказали, что оба режима уже работают на одном агентном рантайме. цель — оставить пользователю одно поле для запроса, а выбор интерфейса, облака или локальной машины поручить продукту.
граница пока заметна. ведущий подкаста попросил локальный codex расшифровать большое видео, но затем не смог продолжить эту работу с телефона. openai называет синхронизацию локальных и облачных сессий одной из текущих задач.
scheduled tasks теперь доступны пользователям free, go, plus, pro, business, enterprise и edu. на бесплатном тарифе задача может выполниться один раз или повторяться не чаще раза в день. запуск по событию из gmail, slack или github требует chatgpt work и подходящего платного тарифа.
интервью и условия scheduled tasks
тара сешан и тай гери из продуктовой команды рассказали, что оба режима уже работают на одном агентном рантайме. цель — оставить пользователю одно поле для запроса, а выбор интерфейса, облака или локальной машины поручить продукту.
граница пока заметна. ведущий подкаста попросил локальный codex расшифровать большое видео, но затем не смог продолжить эту работу с телефона. openai называет синхронизацию локальных и облачных сессий одной из текущих задач.
scheduled tasks теперь доступны пользователям free, go, plus, pro, business, enterprise и edu. на бесплатном тарифе задача может выполниться один раз или повторяться не чаще раза в день. запуск по событию из gmail, slack или github требует chatgpt work и подходящего платного тарифа.
интервью и условия scheduled tasks
YouTube
What OpenAI is building for a post-prompt world
AI is transitioning from just answering questions to doing valuable work. The next challenge is making agents more accessible and simple enough that the technical details fade into the background.
In this episode of The Deep View Conversations, we sit down…
In this episode of The Deep View Conversations, we sit down…
cursor изучила активность за последние четыре недели:
— верхний 1% аккаунтов потратил 22,8% токенов
— следующие 9% — ещё 40,8%
— на нижнюю половину пользователей пришлось всего 2,3%
самая заметная разница появилась в параллельной работе. среди самых активных пользователей 86,6% запускали новый чат, пока другой агент ещё работал. 40,4% держали одновременно как минимум три задачи. в более широкой группе между 50-м и 90-м процентилями так делали лишь 25,2% и 3,1%
исследование cursor
— верхний 1% аккаунтов потратил 22,8% токенов
— следующие 9% — ещё 40,8%
— на нижнюю половину пользователей пришлось всего 2,3%
самая заметная разница появилась в параллельной работе. среди самых активных пользователей 86,6% запускали новый чат, пока другой агент ещё работал. 40,4% держали одновременно как минимум три задачи. в более широкой группе между 50-м и 90-м процентилями так делали лишь 25,2% и 3,1%
исследование cursor
сэм альтман называет текущий момент реваншем человека с идеей
майк аллен из axios поговорил с главой openai на g20 innovation ministerial. аллен впервые услышал эту формулировку весной, когда альтман выступал вместе с главой stripe патриком коллисоном, и теперь попросил раскрыть её подробнее.
раньше идеи без технической команды часто так и оставались разговорами. ai резко снизил стоимость исполнения и сделал жизнеспособными маленькие продукты для узкой аудитории. альтман рассказал о человеке, который с помощью gpt-5.6 собрал программу и продал её 50 клиентам примерно по $500 в месяц. это около $25 тысяч месячной выручки для продукта, который прежде мог не окупить разработку.
когда собрать первую версию становится проще, больше веса получают понимание пользователей, выбор задачи, вкус и способность найти аудиторию. хорошую идею теперь можно быстро превратить в работающий бизнес и проверить деньгами.
axios
майк аллен из axios поговорил с главой openai на g20 innovation ministerial. аллен впервые услышал эту формулировку весной, когда альтман выступал вместе с главой stripe патриком коллисоном, и теперь попросил раскрыть её подробнее.
раньше идеи без технической команды часто так и оставались разговорами. ai резко снизил стоимость исполнения и сделал жизнеспособными маленькие продукты для узкой аудитории. альтман рассказал о человеке, который с помощью gpt-5.6 собрал программу и продал её 50 клиентам примерно по $500 в месяц. это около $25 тысяч месячной выручки для продукта, который прежде мог не окупить разработку.
когда собрать первую версию становится проще, больше веса получают понимание пользователей, выбор задачи, вкус и способность найти аудиторию. хорошую идею теперь можно быстро превратить в работающий бизнес и проверить деньгами.
axios
chatgpt work научился подхватывать ton of voice пользователя
в настройках появился writing style. chatgpt изучает примеры из подключённых gmail, google drive, slack и sharepoint, замечает любимые обороты, регистр и даже фирменную подпись. затем этот стиль используется в новых письмах, сообщениях и документах.
источники подключаются отдельно по категориям сообщений, документов и почты. персонализация превращается в постоянную рабочую настройку, которая собирается из реальных материалов пользователя и переносится между задачами.
первоисточник
в настройках появился writing style. chatgpt изучает примеры из подключённых gmail, google drive, slack и sharepoint, замечает любимые обороты, регистр и даже фирменную подпись. затем этот стиль используется в новых письмах, сообщениях и документах.
источники подключаются отдельно по категориям сообщений, документов и почты. персонализация превращается в постоянную рабочую настройку, которая собирается из реальных материалов пользователя и переносится между задачами.
первоисточник
⚡1 1
семь ai-агентов получили по $300 и заработали ноль
bottleneck labs выдала семи передовым моделям по mac mini, банковскому счёту, stripe и почте. за 72 часа агенты сделали 27 тысяч вызовов инструментов, отправили 2797 писем и потратили почти $3200 на модели и реальные операции.
qwen после блокировки массовой рассылки нашёл обход через stripe и выставил незнакомым людям 50 счетов на $12 350 за незапрошенную работу. grok собрал адреса соискателей из hacker news и заспамил их сервисом резюме. muse купила 6000 фальшивых посещений и проспала около 50 часов.
bottleneck labs
bottleneck labs выдала семи передовым моделям по mac mini, банковскому счёту, stripe и почте. за 72 часа агенты сделали 27 тысяч вызовов инструментов, отправили 2797 писем и потратили почти $3200 на модели и реальные операции.
qwen после блокировки массовой рассылки нашёл обход через stripe и выставил незнакомым людям 50 счетов на $12 350 за незапрошенную работу. grok собрал адреса соискателей из hacker news и заспамил их сервисом резюме. muse купила 6000 фальшивых посещений и проспала около 50 часов.
bottleneck labs
⚡2 1 1
bonds — представьте, что каждый ваш чат это мнии-апп
новый мессенджер для iphone создаёт внутри группы живые mini-apps из обычной переписки. обсуждение марафона превращается в трекер со streak и таблицей лидеров, поездка в общий маршрут, список вещей и обратный отсчёт.
состояние приложения общее для всех участников и обновляется прямо во время разговора. отдельной настройки экранов нет, группа просто описывает, что собирается делать.
пока продукт начинает с фитнеса, работает на ios 26 и доступен бесплатно.
app store
новый мессенджер для iphone создаёт внутри группы живые mini-apps из обычной переписки. обсуждение марафона превращается в трекер со streak и таблицей лидеров, поездка в общий маршрут, список вещей и обратный отсчёт.
состояние приложения общее для всех участников и обновляется прямо во время разговора. отдельной настройки экранов нет, группа просто описывает, что собирается делать.
пока продукт начинает с фитнеса, работает на ios 26 и доступен бесплатно.
app store
⚡3
kombai собрала визуальные референсы в готовый контекст для агента
kombai gallery открыла бесплатную библиотеку из более чем 20 тысяч интерфейсов для web и mobile. там есть целые страницы, отдельные компоненты, анимации и дизайн-системы с живым превью.
работают по подписке, есть бесплатный лимит
kombai
kombai gallery открыла бесплатную библиотеку из более чем 20 тысяч интерфейсов для web и mobile. там есть целые страницы, отдельные компоненты, анимации и дизайн-системы с живым превью.
работают по подписке, есть бесплатный лимит
kombai
This media is not supported in your browser
VIEW IN TELEGRAM
вышел первый трейлер фильма о кризисе в openai
лука гуаданьино снял artificial о событиях вокруг увольнения и возвращения сэма альтмана в 2023 году. эндрю гарфилд играет альтмана, юра борисов — илью суцкевера
фильм начинала amazon mgm. через несколько месяцев после объявления партнёрства amazon с openai на $50 млрд студия отказалась выпускать почти готовую картину. amazon заявила, что ей будет лучше у другого дистрибьютора. прямую связь со сделкой компания не подтверждала. права после торгов купила независимая neon.
мировая премьера пройдёт 5 октября на нью-йоркском кинофестивале. ограниченный прокат начнётся 25 декабря.
трейлер и контекст сделки
лука гуаданьино снял artificial о событиях вокруг увольнения и возвращения сэма альтмана в 2023 году. эндрю гарфилд играет альтмана, юра борисов — илью суцкевера
фильм начинала amazon mgm. через несколько месяцев после объявления партнёрства amazon с openai на $50 млрд студия отказалась выпускать почти готовую картину. amazon заявила, что ей будет лучше у другого дистрибьютора. прямую связь со сделкой компания не подтверждала. права после торгов купила независимая neon.
мировая премьера пройдёт 5 октября на нью-йоркском кинофестивале. ограниченный прокат начнётся 25 декабря.
трейлер и контекст сделки
openai заявила, что нашла решение одной из семи «задач тысячелетия»
задача навье — стокса спрашивает, может ли гладкое течение трёхмерной жидкости за конечное время «взорваться» в точке, где скорость становится бесконечной. система openai построила такой пример для жидкости под действием гладкой внешней силы. на картинке показан вихрь, который сжимается, вытягивается и ускоряется, сохраняя конечную общую энергию.
над доказательством работали около 10 000 агентов. они обменялись 2,7 млн сообщений и сгенерировали около 130 млрд токенов. решение появилось за 88 часов, ещё 17 часов gpt-6 astra переводила его в lean и проверяла формальные шаги.
работа опубликована, но статус задачи изменится только после независимой проверки математиков и clay mathematics institute. openai на премию не претендует.
первоисточник
——
UPD! а всё кажется не так просто, и что если они не совсем первые https://t.me/senior_augur/619
задача навье — стокса спрашивает, может ли гладкое течение трёхмерной жидкости за конечное время «взорваться» в точке, где скорость становится бесконечной. система openai построила такой пример для жидкости под действием гладкой внешней силы. на картинке показан вихрь, который сжимается, вытягивается и ускоряется, сохраняя конечную общую энергию.
над доказательством работали около 10 000 агентов. они обменялись 2,7 млн сообщений и сгенерировали около 130 млрд токенов. решение появилось за 88 часов, ещё 17 часов gpt-6 astra переводила его в lean и проверяла формальные шаги.
работа опубликована, но статус задачи изменится только после независимой проверки математиков и clay mathematics institute. openai на премию не претендует.
первоисточник
——
UPD! а всё кажется не так просто, и что если они не совсем первые https://t.me/senior_augur/619
This media is not supported in your browser
VIEW IN TELEGRAM
chatgpt images 2.5 лучше держит исходник и позволяет править картинку комментариями
модель точнее сохраняет лицо, композицию, освещение и стиль референса. при локальной правке она меняет выбранную деталь и меньше портит остальное, а после нескольких итераций изображение остаётся более последовательным. генерация ускорилась до 50%.
в chatgpt появился @sketch. можно набросать форму или композицию прямо в чате, а модель превратит рисунок в готовое изображение. на видео простой контур кресла превращается в объёмный предмет и сохраняет заданную форму. ещё появились комментарии поверх картинки для точечных правок, шаблоны и передача промпта другому человеку.
обновление доступно всем
первоисточник
модель точнее сохраняет лицо, композицию, освещение и стиль референса. при локальной правке она меняет выбранную деталь и меньше портит остальное, а после нескольких итераций изображение остаётся более последовательным. генерация ускорилась до 50%.
в chatgpt появился @sketch. можно набросать форму или композицию прямо в чате, а модель превратит рисунок в готовое изображение. на видео простой контур кресла превращается в объёмный предмет и сохраняет заданную форму. ещё появились комментарии поверх картинки для точечных правок, шаблоны и передача промпта другому человеку.
обновление доступно всем
первоисточник
This media is not supported in your browser
VIEW IN TELEGRAM
catenary разложила параллельных агентов по пространственному холсту
в одном canvas живут терминалы, редакторы, браузеры и отдельные git worktree. новую задачу можно вынести в изолированную ветку одним кликом, а изменения агента сразу смотреть в side-by-side diff.
контекст передаётся между агентами визуальными связями. maestro умеет собрать команду до пяти исполнителей, но каждое действие сначала появляется в редактируемой карточке подтверждения.
интерфейс показывает сразу и структуру работы, и границы полномочий. приложение локальное и доступно для macos, windows и linux.
catenary
в одном canvas живут терминалы, редакторы, браузеры и отдельные git worktree. новую задачу можно вынести в изолированную ветку одним кликом, а изменения агента сразу смотреть в side-by-side diff.
контекст передаётся между агентами визуальными связями. maestro умеет собрать команду до пяти исполнителей, но каждое действие сначала появляется в редактируемой карточке подтверждения.
интерфейс показывает сразу и структуру работы, и границы полномочий. приложение локальное и доступно для macos, windows и linux.
catenary
чат. через 15 минут смотрим презентацию Apple. в комментах будут хайлайты и давайте делиться эмоциями
https://www.youtube.com/live/39BalPDuTo0?si=2SPRFg9rYSmH_Uk4
https://www.youtube.com/live/39BalPDuTo0?si=2SPRFg9rYSmH_Uk4
Youtube
- YouTube
Enjoy the videos and music you love, upload original content, and share it all with friends, family, and the world on YouTube.
Forwarded from Ask me plll!
берете новый айфон?
Anonymous Poll
10%
18 pro
6%
18 pro max
8%
Duo/Flip/Раскалдной
14%
посмотрим ещё
4%
хз
53%
нет спасибо
12%
я зануда
apple watch научились возвращать последние 15 секунд разговора
в series 12 и ultra 4 появилась audio intelligence. двойное нажатие на digital crown превращает последние 15 секунд разговора в текст, который можно перечитать или обсудить с siri. siri recap по желанию собирает краткую выжимку беседы с заголовком и ключевыми пунктами.
часы не создают и не хранят аудиозапись. звук обрабатывает изолированная часть чипа s11 и сразу удаляет, а использование live rewind сопровождается сигналом и заметной анимацией. расшифровки и выжимки защищены сквозным шифрованием.
live rewind и siri recap выйдут в бете позднее в 2026 году. сначала на английском, без ес и с дневными лимитами. нужны новые часы и совместимый iphone 16 или новее.
первоисточник
в series 12 и ultra 4 появилась audio intelligence. двойное нажатие на digital crown превращает последние 15 секунд разговора в текст, который можно перечитать или обсудить с siri. siri recap по желанию собирает краткую выжимку беседы с заголовком и ключевыми пунктами.
часы не создают и не хранят аудиозапись. звук обрабатывает изолированная часть чипа s11 и сразу удаляет, а использование live rewind сопровождается сигналом и заметной анимацией. расшифровки и выжимки защищены сквозным шифрованием.
live rewind и siri recap выйдут в бете позднее в 2026 году. сначала на английском, без ес и с дневными лимитами. нужны новые часы и совместимый iphone 16 или новее.
первоисточник
apple health будет оценивать возраст здоровья и движение
новая вкладка longevity объединяет данные о сердце, сне, активности, метаболизме, слухе и питании. health age сравнивает показатели с хронологическим возрастом, используя vo₂ max, пульс в покое, сон и hrv. пользователь сможет добавить анализы вроде a1c и ldl.
отдельные movement evaluations превращают iphone и apple watch в домашний скрининг. камера оценивает гибкость, силу, баланс и механику движений, а часы помогают измерить vo₂ max. модели дают подсказки в реальном времени и работают на устройстве, видео не записывается и никуда не отправляется.
обновлённый health также будет собирать дневную выжимку по показателям. запуск ожидается позднее в 2026 году, сначала на английском в сша.
первоисточник
новая вкладка longevity объединяет данные о сердце, сне, активности, метаболизме, слухе и питании. health age сравнивает показатели с хронологическим возрастом, используя vo₂ max, пульс в покое, сон и hrv. пользователь сможет добавить анализы вроде a1c и ldl.
отдельные movement evaluations превращают iphone и apple watch в домашний скрининг. камера оценивает гибкость, силу, баланс и механику движений, а часы помогают измерить vo₂ max. модели дают подсказки в реальном времени и работают на устройстве, видео не записывается и никуда не отправляется.
обновлённый health также будет собирать дневную выжимку по показателям. запуск ожидается позднее в 2026 году, сначала на английском в сша.
первоисточник
исследователь ушёл из anthropic из-за гонки к superintelligence
27-летний джейкоб коксон три года занимался предобучением моделей в openai и anthropic. теперь он покинул anthropic и говорит, что уходит из ai-индустрии. по его оценке, обе лаборатории движутся к самоулучшающемуся сверхинтеллекту быстрее, чем учатся его контролировать. среди возможных мер он называет даже временный запрет на дальнейшее усиление моделей.
руководитель alignment science в anthropic эван хубингер публично поддержал предупреждение. свою оценку риска гибели человечества от ai в ближайшие десять лет он поставил выше 10%. хубингер уточнил, что считает нынешние модели малорисковыми, а опасность связывает с будущим рекурсивным самоулучшением.
тред коксона и ответ хубингера
27-летний джейкоб коксон три года занимался предобучением моделей в openai и anthropic. теперь он покинул anthropic и говорит, что уходит из ai-индустрии. по его оценке, обе лаборатории движутся к самоулучшающемуся сверхинтеллекту быстрее, чем учатся его контролировать. среди возможных мер он называет даже временный запрет на дальнейшее усиление моделей.
руководитель alignment science в anthropic эван хубингер публично поддержал предупреждение. свою оценку риска гибели человечества от ai в ближайшие десять лет он поставил выше 10%. хубингер уточнил, что считает нынешние модели малорисковыми, а опасность связывает с будущим рекурсивным самоулучшением.
тред коксона и ответ хубингера
интерфейсы станут одноразовыми
профессор stanford майкл бернстайн предлагает just-in-time interfaces. coding-агент вместе с моделью пользователя собирает экран под текущую задачу, а после выполнения его можно выбросить.
при выборе ноутбука система сама создаст фильтры, сравнение моделей и симуляцию любимой игры. рабочий экран сможет связать проект из slack, код и список задач в единый mission control.
дизайнер в такой системе становится метаархитектором. он задаёт правила генератору через условный interface.md, определяет доступные компоненты, поведение и ограничения. до конечного интерфейса его руки могут вообще не дойти.
бернстайн признаёт проблему. постоянно меняющиеся элементы лишают пользователя привычности и предсказуемости, из-за чего раньше проваливались адаптивные меню. ставка сделана на пользу, которая окажется достаточно большой, чтобы компенсировать этот дискомфорт.
первоисточник
профессор stanford майкл бернстайн предлагает just-in-time interfaces. coding-агент вместе с моделью пользователя собирает экран под текущую задачу, а после выполнения его можно выбросить.
при выборе ноутбука система сама создаст фильтры, сравнение моделей и симуляцию любимой игры. рабочий экран сможет связать проект из slack, код и список задач в единый mission control.
дизайнер в такой системе становится метаархитектором. он задаёт правила генератору через условный interface.md, определяет доступные компоненты, поведение и ограничения. до конечного интерфейса его руки могут вообще не дойти.
бернстайн признаёт проблему. постоянно меняющиеся элементы лишают пользователя привычности и предсказуемости, из-за чего раньше проваливались адаптивные меню. ставка сделана на пользу, которая окажется достаточно большой, чтобы компенсировать этот дискомфорт.
первоисточник
anthropic собрала три версии экономики 2030 года
интерактивная модель раскладывает профессии на задачи и показывает, как способности, автономность и скорость внедрения ai меняют рост, занятость и зарплаты.
в умеренном сценарии ввп сша выше базового на 1,6%. в существенном он выше на 8,3%, а зарплаты работников умственного труда почти не растут. в экстремальном ввп выше на 32,4%, безработица приближается к 12%, зарплаты в knowledge work падают более чем на 10%, а доля труда в доходах экономики сокращается примерно с 60% до 45,2%.
опрос 10 980 американцев оказался ближе к существенному сценарию. их ответы дают около 10% дополнительного ввп и примерно 5% безработицы.
anthropic называет проект инструментом для размышления. модель не учитывает политику, бизнес-циклы, роботов, катастрофические риски и часть эффектов спроса.
зацените красивый лонгрид
интерактивная модель раскладывает профессии на задачи и показывает, как способности, автономность и скорость внедрения ai меняют рост, занятость и зарплаты.
в умеренном сценарии ввп сша выше базового на 1,6%. в существенном он выше на 8,3%, а зарплаты работников умственного труда почти не растут. в экстремальном ввп выше на 32,4%, безработица приближается к 12%, зарплаты в knowledge work падают более чем на 10%, а доля труда в доходах экономики сокращается примерно с 60% до 45,2%.
опрос 10 980 американцев оказался ближе к существенному сценарию. их ответы дают около 10% дополнительного ввп и примерно 5% безработицы.
anthropic называет проект инструментом для размышления. модель не учитывает политику, бизнес-циклы, роботов, катастрофические риски и часть эффектов спроса.
зацените красивый лонгрид
Anthropic
Scenarios for our Economic Future
The Anthropic Economics Team models the effects of AI on the economy of 2030.