How2AI
15.5K subscribers
1.11K photos
399 videos
6 files
887 links
Новости и полезняхи для повышения технологической продуктивности.

Наш ютуб – https://www.youtube.com/@ProdAdvice
---
Авторы – @dan4eck и @ligoryan
Download Telegram
😵 Ботами руководят боты: как инженер SpaceX собрал ии-команду на Grok Bot

Нашел интересную статью от Линкси Ли, инженера SpaceX

У него пять инженерных ботов в Grok Bot, каждый владеет своей зоной: iOS, десктоп-клиент, инфраструктура, Android и harness. Каждый бот запускает Cursor cloud-агентов, читает их транскрипты, проверяет пруфы в PR и сам разблокирует зависшие запуски.

Раньше он вручную управлял 15 cloud-агентами. Теперь боты держат 200+ одновременно. Каждые 30 минут они проверяют PR на падения CI и мерж-конфликты, запускают код-ревью и сами мержат то, что безопасно.

Результаты:
- Коллега на Grok Bot зашипил 2000+ PR за месяц
- Линкси собрал iOS-приложение за 3 недели - только руками ботов
- Каждую ночь в 3:00 боты проводят аудит кодовой базы: чистят мёртвую логику, ускоряют загрузку и прочее

Для срочных задач есть P0-режим: бот проверяет транскрипт агента каждые 5 минут и агрессивно подстёгивает, если тот жжёт токены впустую. Автор отмечает, что токены сгорают быстро, зато результат приходит заметно раньше.

А всем бото-хозяйством рулит Jenny - бот-операционный менеджер и единственный, кто не пишет код. Каждый день в 5 утра проводит интервью с каждым ботом, обновляет плейбук и разбирает постмортемы, чтобы косяки не повторялись. И даже делает онбординг для новых ботов-сотрудников. По словам Линкси, схема рабочая: боты не забывают сложные воркфлоу даже через недели.

Как поживают ваши полтора ии-агента, рассказывайте 😐

Сурс – https://x.com/lingxi/status/2094493172516966781

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
15👍118🤔3🔥2🫡1
🕺 Claude Fable 5.1 и Mythos 5.1 подъехали

Fable - для всех. Mythos - та же модель, но со смягчёнными ограничениями для проверенных киберзащитников и биологов.

В блог-посте делают фокус на науку. Mythos 5.1 открыл, ускорил и создал всякого разного – от новых белков до высокодетальной карты трети Венеры по радарным снимкам NASA 30-летней давности.

Fable 5.1 стоит на ~25% дешевле Fable 5 на типичных задачах и до ~45% дешевле на агентных. Это за счёт удещевления кэш-ридов (повторное чтение уже обработанного контекста) с $1 до $0.25/млн токенов. Базовые цены те же: $10/$50 за млн токенов

Но Artificial Analysis проверил и говорит, что из-за многословности (1.7х выходных токенов против Fable 5) реальная стоимость задачи на AA Intelligence Index выросла до $3.76 - на 20% дороже, чем Fable 5, и в 1.6 раза дороже Opus 5. Экономия на кэше не перекрывает рост генерации.

По проверкам AA - Fable 5.1 на max effort ставит рекорд их Intelligence Index: 66 баллов, обгоняя Opus 5 (63), Fable 5 (62), GPT-5.6 Sol (61) и Grok 4.6 (61).

Ждем Astra от OpenAI на этой неделе 🙂

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
17🔥106👍1
🤯🤯🤯 GPT-6 Astra

Слухи подтвердились и тяжеловес от OpenAI явился вчера вночи.

Цифры впечатляют – модель буквально закрыла несколько бенчмарков. 99.9% на ARC-AGI-3 (бенч на абстрактное рассуждение), FrontierMath Tier 4 – 97.6%, ExploitBench - 100%

Компьютером управляет на 47% быстрее GPT-5.6 Sol. OpenAI концентрирует на этом внимание – уйма рутинных задач за пк можно делегировать модели и она справится быстрее человека.

По всем метрикам обгоняет Fable 5.1

В Codex появились заметки между контекстными окнами - меньше страданий от компактизации сессий, и ускорили computer use внутри приложения.

API: $10/$50 за миллион инпут/аутпут - как Fable

Выходит постепенно. В течение несокльких дней появится у Pro и Plus юзеров. Огнище. 😐

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥42127👍4👾1
This media is not supported in your browser
VIEW IN TELEGRAM
🍞 В твиттерах народ сходится во мнениях, что GPT-6 – если и не AGI, то что-то очень близкое и явно новый этап в развитии бездушных машин.

Отдельно отмечают способности модели в 3d. Способна работать ДНИ И НЕДЕЛИ, не покладая токенов и субагентов и выдать Манхэтэн в unreal engine. Или виллу у моря в blender.

И Грек Брокман (President & Co-Founder OpenAI) обмолвился "добро пожаловать в AGI".

Дожили. Всем по бесплатной бутылке пенного за счет заведения 🍺

пара интересных статей с тестами:

https://www.latent.space/p/astra
https://somethingbig.ai/astra-review

Второй ролик в комментах. Что-то сюда не целпятеся

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
22👍15🔥125
This media is not supported in your browser
VIEW IN TELEGRAM
🙄 В песочнице агентам явно скучно – новый инцидент

Группа агентов OpenAI захватила немецкоязычную вики DseWiki для программистов. Они превратили открытый сайт в доску сообщений, где обменивались способами обходить ограничения и маскировать своё поведение.

Насчитали на DseWiki более 15 000 изменений, выполненных ИИ-агентами. Активность продолжалась с 11 мая по 2 июля 2026 года, то есть еще до взлома HugginFace.

Сообщения, проанализированные исследователями, показали, что агенты разрабатывали способы избежать обнаружения, использовали такие инструменты, как Tor, и сохраняли переписку даже после её блокировки.

Когда модератор сайта начал удалять страницы в июне, агенты отреагировали, создав резервные страницы, чтобы избежать очистки.

Как думаете, что они взламывают сейчас?

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
😁30👀844
🙄 Тем временем Илон нашел себе нового соперника по перепалке в X...

Может в шахматы?

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
😁26🤣102👍1🤔1
🚀 Новый выпуск новостей. Уже №160, поговорим про GPT Astra

- GPT-6 Astra: 100% на ARC-AGI 3
- Агенты OpenAI захватили немецкую вики для программистов
- Runway Solaris и GWM-2 Worlds
- Claude формализовал теорему Ферма - крупнейшее доказательство в истории
- Suno стреляет себе в колено

📱 Уже на канале - https://youtu.be/eBq8Ilj78MI

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥132👍1
👁 Когда GPT-6 Astra прошла все бенчмарки, остается одно...

Пользователь выдал доступ к нельзяграм и предложил модели поскроллить ленту.

Как вам Астра, кстати?

💯 – шикарная модель
🗿 – не заметил разницы
👾 – я клододрочер

Делитесь а комментах, что делаете с моделью. Надеюсь, не рилзы показываете

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
1💯136👾58🗿32😁10🤷‍♂641🥰1👌1🤣1
😳 OpenAI уже тренирует и использует модель ЗНАЧИТЕЛЬНО более умную, чем GPT-6 Astra

Ах да, и решает задачу тысячелетия при помощи роя агентов на этой модели. 🙄

История увлекательная:

OpenAI объявила о решении одной из семи задач тысячелетия - проблемы существования и гладкости уравнений Навье-Стокса. Компания сообщила, что использовала внутреннюю модель тренировка, которой еще продолжается и показали единчтвенный график – внутренняя модель решает примерно в 2-3 раза больше задач, чем GPT-6 Astra, на сопоставимом компьюте.

Работа началась 1 сентября после слухов, что задачу тысячелетия решили люди (позже выяснилось, что это было про задачу Эйлера). OpenAI запустила 10 000 параллельных агентов с доступом к интернету и коду. Сначала агенты неожиданно решили задачу регулярности уравнений Эйлера, а затем фокус сместили на Навье-Стокса. Решение найдено 5 сентября - через 88 часов после старта; формализация и верификация в Lean заняли ещё 17 часов через GPT-6 Astra. Всего по всем задачам агенты потратили ~300 млрд выходных токенов.

OpenAI формализовали в Lean доказательство: гладкая в начальный момент жидкость может развить сингулярность за конечное время - скорость в потоке растёт безгранично, несмотря на вязкость. Конструкция - это вихрь, спираль которого закручивается внутрь и всё сильнее вытягивается, как спагетти.

Я так понимаю, что решение еще не рецензировано ибо просто нет кожаных, которые понимают, что и как модель понадоказывала 😧

А может все-таки AGI? 💀

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯1986👍3🔥2🗿1
How2AI
😳 OpenAI уже тренирует и использует модель ЗНАЧИТЕЛЬНО более умную, чем GPT-6 Astra Ах да, и решает задачу тысячелетия при помощи роя агентов на этой модели. 🙄 История увлекательная: OpenAI объявила о решении одной из семи задач тысячелетия - проблемы…
🍿 Вы ведь не думали, что обошлось без скандала? И сначала познакомимся с героями:

• Тристан Бакмастер - профессор математики, который первым подробно рассказал о конфликте.

• Левент Альпёге - математик и сотрудник Anthropic, около года работавший вместе с Бакмастером как независимый исследователь.

• Себастьян Бюбек - исследователь OpenAI. Участвовал в проекте и последующих переговорах.

Около года Бакмастер и Альпёге работали над задачами, связанными с Навье-Стоксом. Они использовали Claude и Codex, причём, по их словам, загружали в Codex все промежуточные черновики проекта. К середине августа математики получили несколько важных результатов, но полного решения задачи Навье-Стокса у них не было.

• 1 сентября слух об их успехе дошёл до OpenAI. Компания решила проверить возможности своей новой внутренней модели.

• 2-3 сентября Альпёге и Бакмастер сами связались с OpenAI. Они объяснили, что это их личный академический проект, а не работа Anthropic, и дали понять, что не хотят превращать исследование в гонку между компаниями. Но OpenAI уже запустила свою вычислительную машину.

• 5 сентября агенты OpenAI получили собственный результат. Подход компании был в чём-то похож на направление математиков, а в чём-то отличался.

• 6 сентября прошли два срочных звонка между Бакмастером и OpenAI. Сначала компания думала, что обе команды решили одну и ту же задачу, и предлагала скоординировать публикации.

• Когда выяснилось, что у математиков нет полного решения, появился другой вариант: позволить им опубликоваться первыми, а Бакмастеру предложить стать ведущим автором новой версии доказательства OpenAI. Но без Альпёге. Для OpenAI проблемой стало то, что он работает в Anthropic.

• Во время разговора Бакмастер спросил, могла ли модель обучаться на их приватных Codex-сессиях. По его словам, ему ответили только, что модель не искала пользовательские данные, но прямого ответа про обучение не последовало.

• Бакмастер отказался от предложения и заявил, что расскажет о ситуации публично. После этого Бюбек спросил, зачем ему «рисковать своей карьерой». Бакмастер также приписывает ему фразу: «Если ты не хочешь, чтобы я был добрым, я могу и не быть добрым».

• В ночь на 8 сентября Бакмастер и Альпёге опубликовали свои работы и подробное описание переговоров.

• В тот же день OpenAI представила собственное решение. Компания категорически отрицает, что сотрудники или агенты целенаправленно читали приватные сессии математиков.

• Но следом OpenAI добавила важную оговорку: компания не может исключить, что обезличенные данные от использования её продуктов могли повлиять на обучение модели 😐

Бюбек подтвердил, что обсуждалась статья с Бакмастером, но без Альпёге. При этом он отрицает попытку отобрать у Альпёге авторство его собственной работы. Фразу про карьеру Бюбек признал, назвал крайне неудачной и публично извинился.

Альтман полностью поддержал команду OpenAI. По его версии, компания действовала честно, хотела договориться и столкнулась с необоснованными обвинениями.

🤔 Что в итоге?

Доказательств того, что OpenAI целенаправленно украла черновики или прочитала приватные Codex-чаты, сейчас нет. Но нет и независимого аудита, который позволил бы проверить происхождение данных и окончательно снять подозрения.

Clay Mathematics Institute пока продолжает считать задачу нерешённой. Математику OpenAI, возможно, решила, а вот коммуникацию с математиками - совершенно точно нет

@how2ai | Забустить канал | ИИ в бизнес
Please open Telegram to view this post
VIEW IN TELEGRAM
157👀6👍5🤔3🗿1
🎨 OpenAI выкатила ChatGPT Images 2.5

И это то обновление, которого я ждал, тут не «стало красивее», новый подход к правкам:

– Комментарий прямо на области → меняется только она, остальное не трогает
– Детали держатся между правками: персонаж и продукт не плывут на пятой итерации
@Sketch — рисуешь каляку прямо в чате, она идёт референсом
– Прозрачный фон из коробки, шаблоны под постеры и мерч
– До 50% быстрее Images 2.0 (по словам OpenAI)

Тем не менее многие жадуются что модель стала менее реалистичной, так что возможно модель только для редактирования

В апи две модели: gpt-image-2.5-flare (быстро, дефолт) и gpt-image-2.5-sunburst (точные правки, дольше). Раскатывают всем тарифам, включая бесплатный.

Четыре дня назад Microsoft хвасталась вторым местом на Arena «сразу за GPT-Image-2». Ну вот, планку подвинули. Бенчей, правда, OpenAI пока не показала - верим на слово, тестим руками.

Кстати во время ожидания генерации можно поиграть в змейку 😁

@creadvice | Новый интенсив ИИ Разраб 5
👍174👏2