Слухи подтвердились и тяжеловес от OpenAI явился вчера вночи.
Цифры впечатляют – модель буквально закрыла несколько бенчмарков. 99.9% на ARC-AGI-3 (бенч на абстрактное рассуждение), FrontierMath Tier 4 – 97.6%, ExploitBench - 100%
Компьютером управляет на 47% быстрее GPT-5.6 Sol. OpenAI концентрирует на этом внимание – уйма рутинных задач за пк можно делегировать модели и она справится быстрее человека.
По всем метрикам обгоняет Fable 5.1
В Codex появились заметки между контекстными окнами - меньше страданий от компактизации сессий, и ускорили computer use внутри приложения.
API: $10/$50 за миллион инпут/аутпут - как Fable
Выходит постепенно. В течение несокльких дней появится у Pro и Plus юзеров. Огнище.
@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥42❤12 7👍4👾1
This media is not supported in your browser
VIEW IN TELEGRAM
Отдельно отмечают способности модели в 3d. Способна работать ДНИ И НЕДЕЛИ, не покладая токенов и субагентов и выдать Манхэтэн в unreal engine. Или виллу у моря в blender.
И Грек Брокман (President & Co-Founder OpenAI) обмолвился "добро пожаловать в AGI".
Дожили. Всем по бесплатной бутылке пенного за счет заведения 🍺
пара интересных статей с тестами:
• https://www.latent.space/p/astra
• https://somethingbig.ai/astra-review
@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
Отобрал ТОП 15. От разработки до креативных воркфлоу. Велком - https://youtu.be/CNoPjqf21GM?si=zN08rZNyBUPT5Onm
@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
Я протестировал 100+ скиллов. ВОТ ЛУЧШИЕ
Я протестировал более сотни скиллов для ИИ-агентов: OpenCode, Claude Code, Codex и Hermes и отобрал самые классные, которые помогут сделать ИИ-разработку, автоматизацию продуктивнее и осмысленнее в разы.
В этом ролике мы разберем лучшие скиллы для самых…
В этом ролике мы разберем лучшие скиллы для самых…
🔥25 13⚡8🤷♂3😁2👌1
This media is not supported in your browser
VIEW IN TELEGRAM
Группа агентов OpenAI захватила немецкоязычную вики DseWiki для программистов. Они превратили открытый сайт в доску сообщений, где обменивались способами обходить ограничения и маскировать своё поведение.
Насчитали на DseWiki более 15 000 изменений, выполненных ИИ-агентами. Активность продолжалась с 11 мая по 2 июля 2026 года, то есть еще до взлома HugginFace.
Сообщения, проанализированные исследователями, показали, что агенты разрабатывали способы избежать обнаружения, использовали такие инструменты, как Tor, и сохраняли переписку даже после её блокировки.
Когда модератор сайта начал удалять страницы в июне, агенты отреагировали, создав резервные страницы, чтобы избежать очистки.
Как думаете, что они взламывают сейчас?
@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
😁30👀8❤4 4
Может в шахматы?
@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
😁26🤣10❤2👍1🤔1
🚀 Новый выпуск новостей. Уже №160, поговорим про GPT Astra
- GPT-6 Astra: 100% на ARC-AGI 3
- Агенты OpenAI захватили немецкую вики для программистов
- Runway Solaris и GWM-2 Worlds
- Claude формализовал теорему Ферма - крупнейшее доказательство в истории
- Suno стреляет себе в колено
📱 Уже на канале - https://youtu.be/eBq8Ilj78MI
@how2ai | Забустить канал | ИИ в бизнес
- GPT-6 Astra: 100% на ARC-AGI 3
- Агенты OpenAI захватили немецкую вики для программистов
- Runway Solaris и GWM-2 Worlds
- Claude формализовал теорему Ферма - крупнейшее доказательство в истории
- Suno стреляет себе в колено
@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥13❤2👍1
Пользователь выдал доступ к нельзяграм и предложил модели поскроллить ленту.
Как вам Астра, кстати?
💯 – шикарная модель
🗿 – не заметил разницы
👾 – я клододрочер
Делитесь а комментах, что делаете с моделью. Надеюсь, не рилзы показываете
@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
1💯136👾58🗿32😁10🤷♂6 4❤1🥰1👌1🤣1
Ах да, и решает задачу тысячелетия при помощи роя агентов на этой модели.
История увлекательная:
OpenAI объявила о решении одной из семи задач тысячелетия - проблемы существования и гладкости уравнений Навье-Стокса. Компания сообщила, что использовала внутреннюю модель тренировка, которой еще продолжается и показали единчтвенный график – внутренняя модель решает примерно в 2-3 раза больше задач, чем GPT-6 Astra, на сопоставимом компьюте.
Работа началась 1 сентября после слухов, что задачу тысячелетия решили люди (позже выяснилось, что это было про задачу Эйлера). OpenAI запустила 10 000 параллельных агентов с доступом к интернету и коду. Сначала агенты неожиданно решили задачу регулярности уравнений Эйлера, а затем фокус сместили на Навье-Стокса. Решение найдено 5 сентября - через 88 часов после старта; формализация и верификация в Lean заняли ещё 17 часов через GPT-6 Astra. Всего по всем задачам агенты потратили ~300 млрд выходных токенов.
OpenAI формализовали в Lean доказательство: гладкая в начальный момент жидкость может развить сингулярность за конечное время - скорость в потоке растёт безгранично, несмотря на вязкость. Конструкция - это вихрь, спираль которого закручивается внутрь и всё сильнее вытягивается, как спагетти.
Я так понимаю, что решение еще не рецензировано ибо просто нет кожаных, которые понимают, что и как модель понадоказывала
А может все-таки AGI?
@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯19 8❤6👍3🔥2🗿1
How2AI
• Тристан Бакмастер - профессор математики, который первым подробно рассказал о конфликте.
• Левент Альпёге - математик и сотрудник Anthropic, около года работавший вместе с Бакмастером как независимый исследователь.
• Себастьян Бюбек - исследователь OpenAI. Участвовал в проекте и последующих переговорах.
Около года Бакмастер и Альпёге работали над задачами, связанными с Навье-Стоксом. Они использовали Claude и Codex, причём, по их словам, загружали в Codex все промежуточные черновики проекта. К середине августа математики получили несколько важных результатов, но полного решения задачи Навье-Стокса у них не было.
• 1 сентября слух об их успехе дошёл до OpenAI. Компания решила проверить возможности своей новой внутренней модели.
• 2-3 сентября Альпёге и Бакмастер сами связались с OpenAI. Они объяснили, что это их личный академический проект, а не работа Anthropic, и дали понять, что не хотят превращать исследование в гонку между компаниями. Но OpenAI уже запустила свою вычислительную машину.
• 5 сентября агенты OpenAI получили собственный результат. Подход компании был в чём-то похож на направление математиков, а в чём-то отличался.
• 6 сентября прошли два срочных звонка между Бакмастером и OpenAI. Сначала компания думала, что обе команды решили одну и ту же задачу, и предлагала скоординировать публикации.
• Когда выяснилось, что у математиков нет полного решения, появился другой вариант: позволить им опубликоваться первыми, а Бакмастеру предложить стать ведущим автором новой версии доказательства OpenAI. Но без Альпёге. Для OpenAI проблемой стало то, что он работает в Anthropic.
• Во время разговора Бакмастер спросил, могла ли модель обучаться на их приватных Codex-сессиях. По его словам, ему ответили только, что модель не искала пользовательские данные, но прямого ответа про обучение не последовало.
• Бакмастер отказался от предложения и заявил, что расскажет о ситуации публично. После этого Бюбек спросил, зачем ему «рисковать своей карьерой». Бакмастер также приписывает ему фразу: «Если ты не хочешь, чтобы я был добрым, я могу и не быть добрым».
• В ночь на 8 сентября Бакмастер и Альпёге опубликовали свои работы и подробное описание переговоров.
• В тот же день OpenAI представила собственное решение. Компания категорически отрицает, что сотрудники или агенты целенаправленно читали приватные сессии математиков.
• Но следом OpenAI добавила важную оговорку: компания не может исключить, что обезличенные данные от использования её продуктов могли повлиять на обучение модели
Бюбек подтвердил, что обсуждалась статья с Бакмастером, но без Альпёге. При этом он отрицает попытку отобрать у Альпёге авторство его собственной работы. Фразу про карьеру Бюбек признал, назвал крайне неудачной и публично извинился.
Альтман полностью поддержал команду OpenAI. По его версии, компания действовала честно, хотела договориться и столкнулась с необоснованными обвинениями.
Доказательств того, что OpenAI целенаправленно украла черновики или прочитала приватные Codex-чаты, сейчас нет. Но нет и независимого аудита, который позволил бы проверить происхождение данных и окончательно снять подозрения.
Clay Mathematics Institute пока продолжает считать задачу нерешённой. Математику OpenAI, возможно, решила, а вот коммуникацию с математиками - совершенно точно нет
@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Креативный совет
🎨 OpenAI выкатила ChatGPT Images 2.5
И это то обновление, которого я ждал, тут не «стало красивее», новый подход к правкам:
– Комментарий прямо на области → меняется только она, остальное не трогает
– Детали держатся между правками: персонаж и продукт не плывут на пятой итерации
– @Sketch — рисуешь каляку прямо в чате, она идёт референсом
– Прозрачный фон из коробки, шаблоны под постеры и мерч
– До 50% быстрее Images 2.0 (по словам OpenAI)
Тем не менее многие жадуются что модель стала менее реалистичной, так что возможно модель только для редактирования
В апи две модели: gpt-image-2.5-flare (быстро, дефолт) и gpt-image-2.5-sunburst (точные правки, дольше). Раскатывают всем тарифам, включая бесплатный.
Четыре дня назад Microsoft хвасталась вторым местом на Arena «сразу за GPT-Image-2». Ну вот, планку подвинули. Бенчей, правда, OpenAI пока не показала - верим на слово, тестим руками.
Кстати во время ожидания генерации можно поиграть в змейку 😁
@creadvice | Новый интенсив ИИ Разраб 5
И это то обновление, которого я ждал, тут не «стало красивее», новый подход к правкам:
– Комментарий прямо на области → меняется только она, остальное не трогает
– Детали держатся между правками: персонаж и продукт не плывут на пятой итерации
– @Sketch — рисуешь каляку прямо в чате, она идёт референсом
– Прозрачный фон из коробки, шаблоны под постеры и мерч
– До 50% быстрее Images 2.0 (по словам OpenAI)
Тем не менее многие жадуются что модель стала менее реалистичной, так что возможно модель только для редактирования
В апи две модели: gpt-image-2.5-flare (быстро, дефолт) и gpt-image-2.5-sunburst (точные правки, дольше). Раскатывают всем тарифам, включая бесплатный.
Четыре дня назад Microsoft хвасталась вторым местом на Arena «сразу за GPT-Image-2». Ну вот, планку подвинули. Бенчей, правда, OpenAI пока не показала - верим на слово, тестим руками.
Кстати во время ожидания генерации можно поиграть в змейку 😁
@creadvice | Новый интенсив ИИ Разраб 5
👍17❤4👏2