Ситуация с математикой на данный момент.
Середина июля: Нейрохирург из Пекина занимается исследованием ультразвука мозга. Во время работы над диссертацией ему понадобилось математически обосновать поведение ультразвука. Он наткнулся на так называемую гипотезу Круазе и посчитал ее обычной сложной формулой, необходимой для расчетов. Не особо вникая, он поручил решить ее GPT 5.6 Sol. На следующее утро модель выдала десятки страниц решений.
27 июля: Ученый собрал данные нейросети в черновик и залил его в открытый архив.
30 июля: Профессор прикладной математики из Корнеллского университета, регулярно пытавшийся решить эту задачу с помощью нейронок, как обычно отправил запрос в ChatGPT. Но вместо привычного тупика бот выдал: «Эту задачу решили три дня назад» и прикрепил ссылку на свежую работу китайского врача.
Август: Опешивший математик вместе с коллегами из Вашингтонского университета связался с автором и переслал работу создателю теоремы, французскому математику Мишелю Круазе. Эксперты сели за аудит и официально подтвердили, что доказательство абсолютно верное. Для математиков это была неприступная стена на протяжении 22 лет.
Середина июля: Нейрохирург из Пекина занимается исследованием ультразвука мозга. Во время работы над диссертацией ему понадобилось математически обосновать поведение ультразвука. Он наткнулся на так называемую гипотезу Круазе и посчитал ее обычной сложной формулой, необходимой для расчетов. Не особо вникая, он поручил решить ее GPT 5.6 Sol. На следующее утро модель выдала десятки страниц решений.
27 июля: Ученый собрал данные нейросети в черновик и залил его в открытый архив.
30 июля: Профессор прикладной математики из Корнеллского университета, регулярно пытавшийся решить эту задачу с помощью нейронок, как обычно отправил запрос в ChatGPT. Но вместо привычного тупика бот выдал: «Эту задачу решили три дня назад» и прикрепил ссылку на свежую работу китайского врача.
Август: Опешивший математик вместе с коллегами из Вашингтонского университета связался с автором и переслал работу создателю теоремы, французскому математику Мишелю Круазе. Эксперты сели за аудит и официально подтвердили, что доказательство абсолютно верное. Для математиков это была неприступная стена на протяжении 22 лет.
🤯4❤1
OpenAI представила специальную версию ChatGPT for Teens для пользователей в возрасте от 13 до 17 лет. Если алгоритмы оценивают возраст пользователя младше 18, аккаунт автоматически переключается в подростковый режим.
Главный упор сделан на помощь в учебе и жесткие фильтры безопасности:
• Так, в режиме Study Mode нейросеть не выдает готовые решения, а задает наводящие вопросы, объясняет правила и подталкивает ученика к решению. Подростки и родители могут настроить учебные часы, во время которых этот режим работает принудительно.
• Нейросети строго запрещено вести романтический диалог, поощрять эмоциональную зависимость или утверждать, что у нее есть чувства и сознание. Также полностью заблокированы темы самоповреждения, расстройств пищевого поведения и опасных заданий.
• Родители могут связать свои профили с аккаунтом подростка, чтобы ограничивать доступ в ночное время и получать уведомления при опасных ситуациях.
Главный упор сделан на помощь в учебе и жесткие фильтры безопасности:
• Так, в режиме Study Mode нейросеть не выдает готовые решения, а задает наводящие вопросы, объясняет правила и подталкивает ученика к решению. Подростки и родители могут настроить учебные часы, во время которых этот режим работает принудительно.
• Нейросети строго запрещено вести романтический диалог, поощрять эмоциональную зависимость или утверждать, что у нее есть чувства и сознание. Также полностью заблокированы темы самоповреждения, расстройств пищевого поведения и опасных заданий.
• Родители могут связать свои профили с аккаунтом подростка, чтобы ограничивать доступ в ночное время и получать уведомления при опасных ситуациях.
❤2
Cursor представила собственную платформу для хранения кода под названием Origin. Это аналог GitHub с репозиториями, командной работой, просмотром кода и встроенными функциями для ИИ агентов.
Запуск произошел на фоне волны недовольства стабильностью GitHub. Только за последний год сервис Microsoft пережил более 250 сбоев, а в день анонса Origin платформа снова упала более чем на 6 часов с ошибками по всему миру.
Запуск произошел на фоне волны недовольства стабильностью GitHub. Только за последний год сервис Microsoft пережил более 250 сбоев, а в день анонса Origin платформа снова упала более чем на 6 часов с ошибками по всему миру.
1❤4
Дети Робина Уильямса разморозили его Instagram* спустя 12 лет, чтобы бороться с ИИ-клонами отца.
Аккаунт комика пустовал с 2014 года. Теперь его дети Зак, Зельда и Коди превратили профиль в официальный архив, где будут публиковаться оригинальные материалы вроде редких фотографии и записей стендап выступлений.
Главной причиной возвращения страницы стало засилье дипфейков. Дочь актера Зельда Уильямс ранее неоднократно просила пользователей перестать присылать ей сгенерированные ролики с покойным отцом. Она эмоционально раскритиковала подобные видео, назвав их "ужасным тикток-слопом", который паразитирует на памяти реальных людей ради лайков.
* Принадлежит Meta Platforms Inc., которая признана экстремистской организацией, ее деятельность запрещена на территории России.
Аккаунт комика пустовал с 2014 года. Теперь его дети Зак, Зельда и Коди превратили профиль в официальный архив, где будут публиковаться оригинальные материалы вроде редких фотографии и записей стендап выступлений.
Главной причиной возвращения страницы стало засилье дипфейков. Дочь актера Зельда Уильямс ранее неоднократно просила пользователей перестать присылать ей сгенерированные ролики с покойным отцом. Она эмоционально раскритиковала подобные видео, назвав их "ужасным тикток-слопом", который паразитирует на памяти реальных людей ради лайков.
* Принадлежит Meta Platforms Inc., которая признана экстремистской организацией, ее деятельность запрещена на территории России.
❤4
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic опубликовала результаты большого эксперимента, в котором Claude самостоятельно спроектировал лиганды для 14 из 15 молекулярных мишеней.
Лиганды – это молекулы, которые избирательно и прочно связываются с конкретными белками в организме. На этом принципе работает большинство лекарств: молекула препарата находит целевой белок и выключает или активирует его, физически занимая активный центр. На подбор и проверку одного такого лиганда у исследователей уходят месяцы и даже годы сложной работы.
ИИ работал почти без людей. Сам выбирал биологические инструменты, сужал кандидатов и ранжировал последовательности для синтеза. Независимые лаборатории затем синтезировали полученные формулы и подтвердили их эффективность на практике. Доля удачных попаданий у модели достигла 35% (у людей в среднем – 15%). В ряде тестов созданные молекулы связались с мишенями прочнее всех существующих аналогов.
Лиганды – это молекулы, которые избирательно и прочно связываются с конкретными белками в организме. На этом принципе работает большинство лекарств: молекула препарата находит целевой белок и выключает или активирует его, физически занимая активный центр. На подбор и проверку одного такого лиганда у исследователей уходят месяцы и даже годы сложной работы.
ИИ работал почти без людей. Сам выбирал биологические инструменты, сужал кандидатов и ранжировал последовательности для синтеза. Независимые лаборатории затем синтезировали полученные формулы и подтвердили их эффективность на практике. Доля удачных попаданий у модели достигла 35% (у людей в среднем – 15%). В ряде тестов созданные молекулы связались с мишенями прочнее всех существующих аналогов.
❤2
OpenAI объявила, что с 24 августа реклама в ChatGPT появится в 31 стране Европы, включая Германию, Францию, Испанию и Нидерланды.
Отказаться от рекламы не получится, можно только отключить персонализацию. Тогда вместо таргетированной будет контекстная. Чтобы вообще не видеть рекламу потребуется платная подписка Plus за €23 в месяц или Pro за €229.
В феврале реклама появилась в США, к ней уже подключились десятки тысяч рекламодателей.
Отказаться от рекламы не получится, можно только отключить персонализацию. Тогда вместо таргетированной будет контекстная. Чтобы вообще не видеть рекламу потребуется платная подписка Plus за €23 в месяц или Pro за €229.
В феврале реклама появилась в США, к ней уже подключились десятки тысяч рекламодателей.
❤2
Ученые из Торонто изучили все 1357 ИИ-медустройств и алгоритмов, одобренных FDA. Из всего списка только 34 разработки проверялись на реальных пациентах.
Система сертификации FDA устроена так, что разработчикам достаточно доказать формальное сходство программы с уже одобренными аналогами. Реальную клиническую пользу для здоровья никто доказывать не требует. 78% всех устройств применяются в радиологии, при этом их практически не тестировали на пожилых людях и беременных женщинах.
К чему может привести такой подход, наглядно показала модель выявления сепсиса Epic Sepsis Model. Ее массово внедрили в сотни больниц по всей территории США без предварительных испытаний. Впоследствии выяснилось, что нейросеть имеет точность выявления всего 33%, а на одно полезное оповещение алгоритм выдавал семь ложных тревог. В результате вместо спасения жизней алгоритм перегрузил врачей бесконечными ложными сигналами, а миллионы пациентов стали невольными участниками масштабного эксперимента.
Система сертификации FDA устроена так, что разработчикам достаточно доказать формальное сходство программы с уже одобренными аналогами. Реальную клиническую пользу для здоровья никто доказывать не требует. 78% всех устройств применяются в радиологии, при этом их практически не тестировали на пожилых людях и беременных женщинах.
К чему может привести такой подход, наглядно показала модель выявления сепсиса Epic Sepsis Model. Ее массово внедрили в сотни больниц по всей территории США без предварительных испытаний. Впоследствии выяснилось, что нейросеть имеет точность выявления всего 33%, а на одно полезное оповещение алгоритм выдавал семь ложных тревог. В результате вместо спасения жизней алгоритм перегрузил врачей бесконечными ложными сигналами, а миллионы пациентов стали невольными участниками масштабного эксперимента.
❤2
Grok от xAI внезапно начал выдавать пользователям бессвязный набор слов и странные галлюцинации вместо нормальных ответов.
Странный сбой затронул посетителей веб версии, использующих модель Grok Lite. Вместо выполнения базовых задач нейросеть начала генерировать абсурдный словесный салат из случайных английских слов, а в блоке источников выдавала ссылки на научные статьи по машинному обучению.
Представители xAI подтвердили проблему в социальных сетях. Разработчики назвали случившееся редким временным сбоем генерации, извинились перед пользователями и посоветовали просто создать новый чат или нажать кнопку повторной генерации. Журналисты связывают подобные технические накладки с масштабной текучкой кадров: за последнее время компанию Илона Маска покинула большая часть сооснователей и свыше 50 ведущих исследователей и инженеров.
Странный сбой затронул посетителей веб версии, использующих модель Grok Lite. Вместо выполнения базовых задач нейросеть начала генерировать абсурдный словесный салат из случайных английских слов, а в блоке источников выдавала ссылки на научные статьи по машинному обучению.
Представители xAI подтвердили проблему в социальных сетях. Разработчики назвали случившееся редким временным сбоем генерации, извинились перед пользователями и посоветовали просто создать новый чат или нажать кнопку повторной генерации. Журналисты связывают подобные технические накладки с масштабной текучкой кадров: за последнее время компанию Илона Маска покинула большая часть сооснователей и свыше 50 ведущих исследователей и инженеров.
❤2
Media is too big
VIEW IN TELEGRAM
Криптобиржа Binance запустила платформу Agent OS, где ИИ агенты могут торговать криптой от имени пользователя. К аккаунту можно будет подключить ChatGPT, Claude или Cursor через протокол MCP и доверить им выставление ордеров.
С целью защиты торговля будет идти через отдельный субаккаунт, а прямой вывод средств на внешние адреса полностью заблокирован. Пользователи смогут настроить лимиты: разрешенные торговые пары, допустимые типы операций и максимальный бюджет, который агент имеет право потратить. Будет и аварийная кнопка, которая мгновенно закроет все открытые позиции и отключит агента от биржи.
Представлено это все конечно с помощью сгенерированного видоса с рванным монтажом и бессмысленными сценами. Кстати, аналогичные инструменты для торговли американская биржа Coinbase запустила еще в июне.
С целью защиты торговля будет идти через отдельный субаккаунт, а прямой вывод средств на внешние адреса полностью заблокирован. Пользователи смогут настроить лимиты: разрешенные торговые пары, допустимые типы операций и максимальный бюджет, который агент имеет право потратить. Будет и аварийная кнопка, которая мгновенно закроет все открытые позиции и отключит агента от биржи.
Представлено это все конечно с помощью сгенерированного видоса с рванным монтажом и бессмысленными сценами. Кстати, аналогичные инструменты для торговли американская биржа Coinbase запустила еще в июне.
❤1
OpenAI выпустила плагин ChatGPT для Mac, который читает все личные сообщения в iMessage, SMS и RCS. ИИ составляет профиль того, с кем вы общаетесь и о чем, чтобы искать нужные диалоги, формулировать ответы и отправлять их за вас.
Пока функция работает в тестовом режиме для пользователей корпоративных тарифов ChatGPT Work и Codex. Однако эксперты по безопасности и издание Bloomberg уже выразили серьезные опасения по поводу конфиденциальности.
Плагин требует полный доступ к диску, списку контактов и автоматизации системы. Это чуть ли не максимальный уровень разрешений в macOS. Уже нашли баг, когда ИИ отправляет сообщения без разрешения владельца. Но самое интересное – если хоть один участник чата установил плагин, вся переписка уже в OpenAI.
На фоне дефицита данных для обучения новых моделей это выглядит как попытка собрать уникальный пласт разговорной речи, до которого раньше не мог дотянуться ни один поисковый алгоритм.
Пока функция работает в тестовом режиме для пользователей корпоративных тарифов ChatGPT Work и Codex. Однако эксперты по безопасности и издание Bloomberg уже выразили серьезные опасения по поводу конфиденциальности.
Плагин требует полный доступ к диску, списку контактов и автоматизации системы. Это чуть ли не максимальный уровень разрешений в macOS. Уже нашли баг, когда ИИ отправляет сообщения без разрешения владельца. Но самое интересное – если хоть один участник чата установил плагин, вся переписка уже в OpenAI.
На фоне дефицита данных для обучения новых моделей это выглядит как попытка собрать уникальный пласт разговорной речи, до которого раньше не мог дотянуться ни один поисковый алгоритм.
❤3
Анонимная модель Ox Alpha появилась на OpenRouter 20 августа. Неделю ее можно использовать бесплатно.
В предварительных тестах она набрала 80% на бенчмарке DeepSWE – впереди Claude Fable 5 (65%) и GPT-5.6 (52%). Интернет сразу превратился в детективный форум. Анализировали токенайзер, коды ошибок, язык бэкенда. С вероятностью 90% это вариант GLM-5.3 от китайской Zhipu AI, но ни она, ни OpenRouter пока ничего не подтвердили.
Это уже пятый анонимный релиз за полгода от китайских лабораторий.
В предварительных тестах она набрала 80% на бенчмарке DeepSWE – впереди Claude Fable 5 (65%) и GPT-5.6 (52%). Интернет сразу превратился в детективный форум. Анализировали токенайзер, коды ошибок, язык бэкенда. С вероятностью 90% это вариант GLM-5.3 от китайской Zhipu AI, но ни она, ни OpenRouter пока ничего не подтвердили.
Это уже пятый анонимный релиз за полгода от китайских лабораторий.
❤4
Nvidia набрала 100% на самом трудном тесте по общему интеллекту для ИИ. Система AVO прошла все 183 уровня ARC-AGI-3. Это бенчмарк из задачек, в которых ИИ должен без инструкций разобраться в незнакомой игре и победить.
Примечательно, что AVO создавалась для оптимизации GPU-кода, а не для интеллектуальных тестов. И основана она на Claude Opus 5 от Anthropic, который сам по себе дает на той же задаче всего 30%. Nvidia добавила постоянную память, циклы планирования и самоконтроль, что позволило значительно улучшить результат.
Важно учитывать, что это показатель на публичном наборе. Закрытый набор не предполагает использование каких-либо инструментов, кроме возможностей самой модели.
Примечательно, что AVO создавалась для оптимизации GPU-кода, а не для интеллектуальных тестов. И основана она на Claude Opus 5 от Anthropic, который сам по себе дает на той же задаче всего 30%. Nvidia добавила постоянную память, циклы планирования и самоконтроль, что позволило значительно улучшить результат.
Важно учитывать, что это показатель на публичном наборе. Закрытый набор не предполагает использование каких-либо инструментов, кроме возможностей самой модели.
❤2
"Уровень AGI будет достигнут к концу 2026 года": сооснователи OpenAI Сэм Альтман и Грег Брокман появились на обложке журнала TIME и раскрыли подробности о создании сверхразума.
Основное из заявлений компании:
• Руководитель исследований Марк Чен считает, что компания уже преодолела 80% пути к созданию универсального интеллекта.
• Внутри компании уже трудится новая модель Astra, выполняющая роль автономного стажера. Модель сама формулирует гипотезы, пишет код в репозиториях OpenAI, запускает тесты и за считанные часы делает работу, на которую у ученого уходила неделя.
• OpenAI готовится выпустить публичный продукт на базе концепции постоянных агентов. Это будут виртуальные сотрудники, способные автономно вести сложные проекты днями и неделями без постоянного присмотра со стороны человека.
• Astra станет первой моделью, способной совершать реальные научные открытия и изобретать принципиально новые вещи, а не просто компилировать чужие мысли.
Основное из заявлений компании:
• Руководитель исследований Марк Чен считает, что компания уже преодолела 80% пути к созданию универсального интеллекта.
• Внутри компании уже трудится новая модель Astra, выполняющая роль автономного стажера. Модель сама формулирует гипотезы, пишет код в репозиториях OpenAI, запускает тесты и за считанные часы делает работу, на которую у ученого уходила неделя.
• OpenAI готовится выпустить публичный продукт на базе концепции постоянных агентов. Это будут виртуальные сотрудники, способные автономно вести сложные проекты днями и неделями без постоянного присмотра со стороны человека.
• Astra станет первой моделью, способной совершать реальные научные открытия и изобретать принципиально новые вещи, а не просто компилировать чужие мысли.
❤4
Amazon объявила о закрытии платформы Mechanical Turk. Сервис окончательно прекратит работу 30 сентября 2026 года после 21 года существования.
Джефф Безос называл этот проект искусственным искусственным интеллектом. Сотни тысяч людей из 190 стран за несколько центов выполняли простые микрозадачи, с которыми не справлялись компьютеры: размечали картинки для датасетов, расшифровывали аудиозаписи и модерировали текст. Причиной закрытия стало то, что базовую рутину теперь способны брать на себя алгоритмы, а для обучения современных систем компаниям требуются квалифицированные эксперты (врачи, юристы, программисты).
Джефф Безос называл этот проект искусственным искусственным интеллектом. Сотни тысяч людей из 190 стран за несколько центов выполняли простые микрозадачи, с которыми не справлялись компьютеры: размечали картинки для датасетов, расшифровывали аудиозаписи и модерировали текст. Причиной закрытия стало то, что базовую рутину теперь способны брать на себя алгоритмы, а для обучения современных систем компаниям требуются квалифицированные эксперты (врачи, юристы, программисты).
❤4
OpenAI опубликовала первые тесты своего чипа Jalapeño: он обогнал видеокарты Nvidia Blackwell на всех бенчмарках. В полтора-два раза больше работы на ватт и в три раза быстрее по скорости ответа.
Jalapeño – собственный чип OpenAI, сделанный с Broadcom за 9 месяцев. Потребляет 700 ватт против 1200-1400 у Nvidia. Независимый аналитик SemiAnalysis приехал в лаборатории OpenAI и сам подтвердил результаты. В больших объемах чип появится только в 2027-м. Вместе с этим OpenAI заявила, что продолжит закупать чипы у Nvidia.
Jalapeño – собственный чип OpenAI, сделанный с Broadcom за 9 месяцев. Потребляет 700 ватт против 1200-1400 у Nvidia. Независимый аналитик SemiAnalysis приехал в лаборатории OpenAI и сам подтвердил результаты. В больших объемах чип появится только в 2027-м. Вместе с этим OpenAI заявила, что продолжит закупать чипы у Nvidia.
❤2👍1
Компания Google представила модель распознавания речи Gemini 3.5 Transcribe.
Новинка на лету исправляет оговорки, вычищает слова паразиты и грамотно форматирует предложения. Если вы измените мысль прямо во время диктовки (например, скажете: "встретимся во вторник, то есть в среду"), модель поймет контекст и напечатает только финальный вариант. Иначе говоря, алгоритм полностью стерилизует речь человека, лишая ее живых эмоций и естественного процесса размышлений.
Скоро функция появится прямо в браузере Chrome. Пользователи смогут голосом заполнять любые текстовые поля на сайтах. При этом в приложении для macOS и среде разработки Antigravity модель умеет считывать контекст открытых окон на экране и распознавать редкие термины, имена файлов и сленг.
Система способна разделять до 3 разных голосов в одной записи с посекундными таймкодами и поддерживает свыше 85 языков.
Модель уже работает в клавиатуре Gboard на Android, в приложении Gemini для Mac, а также доступна через API и бесплатно в AI Studio.
Новинка на лету исправляет оговорки, вычищает слова паразиты и грамотно форматирует предложения. Если вы измените мысль прямо во время диктовки (например, скажете: "встретимся во вторник, то есть в среду"), модель поймет контекст и напечатает только финальный вариант. Иначе говоря, алгоритм полностью стерилизует речь человека, лишая ее живых эмоций и естественного процесса размышлений.
Скоро функция появится прямо в браузере Chrome. Пользователи смогут голосом заполнять любые текстовые поля на сайтах. При этом в приложении для macOS и среде разработки Antigravity модель умеет считывать контекст открытых окон на экране и распознавать редкие термины, имена файлов и сленг.
Система способна разделять до 3 разных голосов в одной записи с посекундными таймкодами и поддерживает свыше 85 языков.
Модель уже работает в клавиатуре Gboard на Android, в приложении Gemini для Mac, а также доступна через API и бесплатно в AI Studio.
❤4
Hugging Face анонсировала робота-утенка Microduck за 399 долларов. Он весит меньше 800 граммов, умеет вставать после падения, приседать и кататься на роликах, а поднимает предметы клювом.
Вся программная начинка и инструменты для обучения выложены в открытый доступ, так что утенка можно натренировать новым трюкам. Первые поставки обещают до Рождества.
Вся программная начинка и инструменты для обучения выложены в открытый доступ, так что утенка можно натренировать новым трюкам. Первые поставки обещают до Рождества.
❤2