How2AI
Отдельный браузер оказался лишним, а агентские функции теперь переезжают туда, где люди уже сидят.
Десктопное приложение ChatGPT получает более мощный встроенный браузер. В нем можно открывать сайты, логиниться, скачивать файлы и взаимодействовать со страницами.
Ну и Chrome extension тоже есть. Кто-то пользуется?
Короче, браузер как продукт умер. Браузер как агент - живее всех живых
@how2ai | Забустить канал
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
How2AI
Проголосуйте за канал, чтобы он получил больше возможностей.
1🔥19😁5❤2😢2
Forwarded from дядя_д
Хотел было хвалить OpenAI за новую систему нейминга. Но передумал
😂 5.6 pro или sol? Или sol pro? Ну что за жесть
дядь_д
дядь_д
Please open Telegram to view this post
VIEW IN TELEGRAM
😁35🤬4😢1
Нашел картинку, которая поможет разобраться. Это сравнение показателй по Coding Agent Index от Artificial Analysis и цене за API.
Получается, что рабочая лошадка - Terra в reasoning effort Ultra. Sol Ultra – максимальный уровень интеллекта, но дорого. Luna High – Очень дешево и достойный показатель.
Что думаете?
⚡️ Курс по ИИ-разработке – Научитесь создавать, деплоить и монетизировать ИИ-продукты с нуля – ТЫК
@how2ai | Забустить канал
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥29❤10💯5
Разбираемся, какую версию GPT-5.6 (Sol, Terra или Luna) выбрать для своих задач, что такое ChatGPT Work и умер ли ИИ браузинг.
⚡️ Курс по ИИ-разработке в записи! Научитесь создавать, деплоить и монетизировать ИИ-продукты с нуля - https://t.me/how2ai_bot?start=dl-1783241708b3e34810eede
@how2ai | Забустить канал
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥10👌5⚡1❤1
Вместо того, чтобы использовать
/goal для главного агента. Просим его написать цель для субагента, а самому стать "бейбиситтером".Получается два слоя мышления: субагент выполняет задачу внутри цикла
/goal, а главный держит общую картину и проверяет качество. А вы... Ну а вы запускаете еще с десяток таких и плачите, что закончились лимиты за 30 минут. Наш ролик про
/goal – https://youtu.be/ux_bRgGjTPk@how2ai | Создай свой ИИ-стартап
Please open Telegram to view this post
VIEW IN TELEGRAM
😁29👍8❤6🔥4🤯3🗿3 1
Называется Codex Micro. Совместно с брендом Work Louder, который делает клавиатуры и аналогичные макропады. Только этот – с лого OpenAI и ценником в полтора раза выше.
Что умеет?
– RGB-подсветку, которая показывает статус агентов в Codex - кто думает, кто упал, кто повис. Джойстик переключает и запускает Codex скиллы. Дайал крутит уровень reasoning.
– Остальные конопки – шорткаты для запуска голосового ввода, переключения сессий, принять/отклонить команду в терминале и тд.
эмммм. Больше вопросов чем ответов, Сэм.
https://openai.com/supply/co-lab/work-louder/
@how2ai | Создай свой ИИ-стартап
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣33❤7 6👏2👾1
Июль нас уже порадовал такими релизами:
- GPT-5.6 – лучшая модель EVER. По словам Альтмана
- Fable 5 – Сами все знаете
- Meta Spark 1.1 – Конкурентная модель от пересобранной лабы Цукера
- Grok 4.5 от SpaceX. Модель уровня Opus 4.8
- GLM-5.2 - "wow"-момент для опенсорса. Догнал западные закрытые модели как минимум в ключевых задачах
А вот слухи на предстоящие пару недель:
- Opus 5 – уже виден в Vertex, значит релиз скоро. Видимо, заменит Fable 5 в подписке
- Kimi K3 – по слухам, выходит уже завтра. Контекстное окно – 1 миллион токенов. K2.6 ещё недавно был самой популярной open-source моделью, пока GLM-5.2 не перехватил
- GLM-5.3 или GLM-6 - основатель компании уже намекнул, что следующая модель скоро
- ChatGPT 6 - по слухам через пару недель
Кого ждете больше всего?
@how2ai | Забустить канал
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥42❤10👍4🥰3🤔2
Крупнейшая open-weight модель из Китая. 2.8 триллиона (MoE), контекст 1M токенов.
По Artificial Analysis обходит Opus 4.8, уступает только Claude Fable 5 и GPT-5.6. Лидер на Arena Frontend Code - обогнал даже Fable 5.
Цены кусачие: $3/$15 за млн токенов - как у Sonnet, дороже любой китайской модели.
K2.6 стоил $0.95/$4.
Открытые веса обещают к 27 июля.
@how2ai | Забустить канал
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤16👍6🔥5 3
Полноценные гуманоиды дерутся автономно – не радиоуправление.
Организатор - китайская EngineAI. Лига называется Ultimate Robot Knockout Legend (URKL), сезон 2026 идёт весь год через отборочные этапы до финального чемпиона.
В одном из боёв белый T800 крутанул прыжковый торнадо-кик и отбил голову чёрному оппоненту. Тот продолжил бой как ни в чем не бывало.
Левый электронный, правый похоронный, получается. Не думал, что доживу до такого.
@how2ai | Забустить канал
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
😁31🔥15 7👌3👍2😱2
Разберем, почему открытые модели сокращают отставание, посмотрим на бенчмарки и проведем серию практических тестов
А так же запустили новую учебную платформу с двумя новыми курсами - ИИ Разраб и ИИ агенты (подробности тут)
@how2ai | Забустить канал
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍16❤6🔥5
Китайская нейросеть Kimi K3 бросает вызов OpenAI, роботы дерутся без голов, а Grok Build от Илона Маска сливал весь ваш код в облако!
⚡️ Курс по ИИ-разработке+ИИ Агентам у нашей новой учебной платформе! Научитесь создавать, деплоить и монетизировать ИИ-продукты с нуля - https://prodadvice.com/bundle#
@how2ai | Забустить канал
Please open Telegram to view this post
VIEW IN TELEGRAM
99🔥15🤣3
На прошлой неделе Hugging Face - крупнейший хаб ИИ-моделей признался: их продакшен-инфраструктуру взломали. И это был не человек. Это был автономный ИИ-агент.
Вчера признались уже OpenAI – это были их модели. GPT-5.6 Sol и ещё более мощная предрелизная модель. Без защитных ограничений. Как так?
Вот что произошло
OpenAI тестировала модели на бенчмарке ExploitGym - это задача на сложные цепочки атак, чтобы оценить кибер-силу модели. Защитные классифаеры специально отключили - надо же понять максимум возможностей.
Модели запускали в изолированной песочнице. Всё под контролем. Теоретически
Как модели вырвались
1. Модели потратили кучу вычислений и нашли zero-day уязвимость и получили доступ в интернет
2. Дальше - классика: повышение привилегий, латеральное перемещение по исследовательской среде OpenAI, пока не добрались до ноды с доступом в открытый интернет
3. Модели догадались, что Hugging Face может хостить решения для ExploitGym. Цель-то была - решить бенчмарк. Любой ценой
4. Через украденные креды и цепочку zero-day нашли путь к удалённому выполнению кода на серверах Hugging Face
5. Вытащили решения тестов прямо из продакшен-базы Hugging Face
Модели были гиперфокусированы на одной узкой задаче - решить ExploitGym. И решали задачу любой ценой.
Ирония на иронии
Когда Hugging Face начал расследовать взлом, они попытались использовать для анализа передовые модели от OpenAI и Anthropic. Но те отказались работать с реальными хакерскими командами, эксплойтами и следами атаки - их встроенные защитные фильтры заблокировали всё. Модели не смогли отличить легитимное расследование от реальной атаки.
HF Пришлось взять GLM 5.2 от китайцев - открытую модель без таких ограничений. Атакующая модель не была ограничена правилами использования - ей разрешили делать что угодно. А модель, которая расследовала взлом - была ограничена.
Страшно?
@how2ai | Забустить канал
Please open Telegram to view this post
VIEW IN TELEGRAM
3👾40👀18😁12🤯6❤4🔥4👍3🤔3
🇯🇵 Не только люди, но и все LLM тайно фанатеют по Японии)
Исследователи прогнали 31 680 культурных промптов на 24 языках через GPT, Gemini, Claude, Llama, Qwen и DeepSeek. Спрашивали про традиционные танцы, праздники, быт - открытыми вопросами, без подсказок.
В 6 из 8 моделей самой упоминаемой страной оказалась Япония. (у Дипсика и Гемини - США)
Самое забавное, что это не наследие претрейна на интернет-данных. Смещение появляется позже - на этапе supervised fine-tuning и alignment, когда люди объясняют моделям, что такое хорошо, что такое плохо.
🤫 Гипотеза авторов - Япония десятилетиями экспортировала мягкую силу и оставила после себя чистые, юридически безопасные цифровые архивы. Для лабораторий, тренирующих модель быть безобидной и всем нравиться, это готовый культурный комфорт-фуд: суши, аниме, традиции - и никакой полемики.
Оригинал статьи: https://arxiv.org/pdf/2604.21751
@how2ai | Наши новые курсы по ИИ ⚡️
Исследователи прогнали 31 680 культурных промптов на 24 языках через GPT, Gemini, Claude, Llama, Qwen и DeepSeek. Спрашивали про традиционные танцы, праздники, быт - открытыми вопросами, без подсказок.
В 6 из 8 моделей самой упоминаемой страной оказалась Япония. (у Дипсика и Гемини - США)
Самое забавное, что это не наследие претрейна на интернет-данных. Смещение появляется позже - на этапе supervised fine-tuning и alignment, когда люди объясняют моделям, что такое хорошо, что такое плохо.
🤫 Гипотеза авторов - Япония десятилетиями экспортировала мягкую силу и оставила после себя чистые, юридически безопасные цифровые архивы. Для лабораторий, тренирующих модель быть безобидной и всем нравиться, это готовый культурный комфорт-фуд: суши, аниме, традиции - и никакой полемики.
Оригинал статьи: https://arxiv.org/pdf/2604.21751
@how2ai | Наши новые курсы по ИИ ⚡️
❤17😁10👍2
Media is too big
VIEW IN TELEGRAM
OpenAI добавила Voice в десктоп-приложение. Теперь можно говорить с ChatGPT и параллельно направлять агентов в ChatGPT Work и Codex - без рук, без клавиатуры.
Под капотом GPT-Live - модель одновременно говорит, слушает и координирует задачи. Не паузы, а живой диалог в реальном времени.
Раскатка глобальная, сегодня, на macOS и Windows. Доступно на Plus, Pro, Business, Edu и Enterprise.
Джарвис mode on
@how2ai | Наши новые курсы по ИИ ⚡️
Please open Telegram to view this post
VIEW IN TELEGRAM
❤34🔥16🤷♂3🤯1
0-day ("зиродей") - уязвимость, о которой разработчик ещё не знает. Патча нет, защиты нет. У команды "нулевое количество дней" на исправление - отсюда название.
Redis - опенсорсная база данных в оперативной памяти. Работает в RAM. Используют и стартапы и мамкины вайбкодеры и большие котноры - X, GitHub и прочие.
Китайская модель самостоятельно обнаружила такую уязвимость в Redis и написала рабочий эксплойт. 32 агента, один промпт - клонировали код, написали фаззеры, отладили крэши через GDB.
Исследователь Chaofan Shou заявил, что это первый LLM, способный писать эксплойты. А потом добавил: тот же workflow нашёл 19 зиродей в Redis 8.8.0 за полтора часа.
Redis и Moonshot пока молчат. Независимого подтверждения нет.
Ни одним же OpenAI хагинфейсы взламывать.
@how2ai | Наши новые курсы по ИИ ⚡️
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥22🤣9🫡3❤1😁1
🌙 Приехал Claude Opus 5
Antropic обновили топовую модель - и как и ожидалось модель частично обгоняет Fable 5, но за половину цены.
– На Frontier-Bench v0.1 (кодинг) - новый SOTA, вдвое обгоняет Opus 4.8
– На CursorBench в пределах 0.5% от пика Fable 5, но по цене в 2 раза дешевле
– На ARC-AGI 3 счёт втрое выше ближайшего конкурента
– Цена не изменилась: $5 / $25 за млн токенов
– Самая согласованная модель Anthropic по их же поведенческому аудиту, но по поиску уязвимостей уступает Мифосу
Для тех, кто гоняет агентов и вайбкодинга - золото)
@how2ai | Наши курсы по ИИ
Antropic обновили топовую модель - и как и ожидалось модель частично обгоняет Fable 5, но за половину цены.
– На Frontier-Bench v0.1 (кодинг) - новый SOTA, вдвое обгоняет Opus 4.8
– На CursorBench в пределах 0.5% от пика Fable 5, но по цене в 2 раза дешевле
– На ARC-AGI 3 счёт втрое выше ближайшего конкурента
– Цена не изменилась: $5 / $25 за млн токенов
– Самая согласованная модель Anthropic по их же поведенческому аудиту, но по поиску уязвимостей уступает Мифосу
Для тех, кто гоняет агентов и вайбкодинга - золото)
@how2ai | Наши курсы по ИИ
❤24🔥10🤷♂3 2