Tencent выпустила Hy4 Preview — новую модель с открытыми весами под лицензией Apache 2.0.
Это флагманская модель нового поколения на архитектуре смеси экспертов.
У неё 770 млрд параметров, 49 млрд активных, контекстное окно на 1 млн токенов.
Из интересного — Tencent утверждает, что Hy4 смогла параллельно координировать несколько сессий Codex, оценивать их результаты и на основе этого менять направление исследования. В таком режиме модель обошла Codex, работающий в одиночку, сразу на восьми тестах.
Hy4 нацелена на длинные задачи по программированию, работу с несколькими файлами и научные исследования.
Ещё несколько месяцев назад такая модель выглядела бы абсолютным передовым уровнем.
https://hy.tencent.ai/research/hy4-preview
Это флагманская модель нового поколения на архитектуре смеси экспертов.
У неё 770 млрд параметров, 49 млрд активных, контекстное окно на 1 млн токенов.
Из интересного — Tencent утверждает, что Hy4 смогла параллельно координировать несколько сессий Codex, оценивать их результаты и на основе этого менять направление исследования. В таком режиме модель обошла Codex, работающий в одиночку, сразу на восьми тестах.
Hy4 нацелена на длинные задачи по программированию, работу с несколькими файлами и научные исследования.
Ещё несколько месяцев назад такая модель выглядела бы абсолютным передовым уровнем.
https://hy.tencent.ai/research/hy4-preview
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic выпустила предварительную версию Model Hardware Standard, общего стандарта, который позволяет ИИ агентам безопасно управлять физическими устройствами.
Пока доступ открыт исследовательским организациям и компаниям из передового производства.
MHS позволяет агентам параллельно управлять микроскопами, дозаторами жидкостей, роботизированными манипуляторами и другим лабораторным и промышленным оборудованием.
Речь идёт о задачах от рутинных экспериментов по поиску лекарств до калибровки лазеров для квантовых компьютеров.
Раньше подключение нового оборудования в лаборатории занимало недели или даже месяцы. С MHS это можно сократить до часов или минут.
Управлять оборудованием можно через MCP, командную строку или API. Несколькими устройствами сразу можно управлять буквально одной строкой кода.
Причём MHS не привязан к Claude. Подключиться сможет любой агентный фреймворк. Anthropic надеется, что со временем MHS станет открытым стандартом для управления физическим оборудованием с помощью ИИ.
Во время тестирования обнаружилась особенно интересная вещь.
Claude начинает действовать буквально как исследователь. Немного корректирует лазер, смотрит через камеру, как изменился луч, снова меняет настройки и повторяет процесс.
Когда находит рабочий вариант, сам превращает полученный опыт в детерминированный скрипт, чтобы в следующий раз выполнить всю калибровку одной командой.
Скоро ИИ-агенты смогут управлять вообще всем. Скайнет уже где-то рядом😆
Пока доступ открыт исследовательским организациям и компаниям из передового производства.
MHS позволяет агентам параллельно управлять микроскопами, дозаторами жидкостей, роботизированными манипуляторами и другим лабораторным и промышленным оборудованием.
Речь идёт о задачах от рутинных экспериментов по поиску лекарств до калибровки лазеров для квантовых компьютеров.
Раньше подключение нового оборудования в лаборатории занимало недели или даже месяцы. С MHS это можно сократить до часов или минут.
Управлять оборудованием можно через MCP, командную строку или API. Несколькими устройствами сразу можно управлять буквально одной строкой кода.
Причём MHS не привязан к Claude. Подключиться сможет любой агентный фреймворк. Anthropic надеется, что со временем MHS станет открытым стандартом для управления физическим оборудованием с помощью ИИ.
Во время тестирования обнаружилась особенно интересная вещь.
Claude начинает действовать буквально как исследователь. Немного корректирует лазер, смотрит через камеру, как изменился луч, снова меняет настройки и повторяет процесс.
Когда находит рабочий вариант, сам превращает полученный опыт в детерминированный скрипт, чтобы в следующий раз выполнить всю калибровку одной командой.
Скоро ИИ-агенты смогут управлять вообще всем. Скайнет уже где-то рядом
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Нашёл очень удобное расширение Google Chrome для проверки адаптивности сайтов.
Главная фишка — можно одновременно посмотреть, как страница выглядит сразу на нескольких размерах экрана.
Есть куча настроек, а прокрутку можно синхронизировать между всеми устройствами одновременно.
Полезно для фронтендеров, дизайнеров и вайбкодеров😎
Главная фишка — можно одновременно посмотреть, как страница выглядит сразу на нескольких размерах экрана.
Есть куча настроек, а прокрутку можно синхронизировать между всеми устройствами одновременно.
Полезно для фронтендеров, дизайнеров и вайбкодеров
Please open Telegram to view this post
VIEW IN TELEGRAM
4
Вышел Goldie — генератор скриншотов для App Store, созданный для кодинг-агентов.
Вы просите своего любимого кодинг-агента сделать скриншоты для App Store, а Goldie с помощью Argent сам управляет приложением, делает нужные кадры и оформляет их в маркетинговые материалы.
В комплекте также есть удобная Studio, где дизайн можно вручную подправить.
Goldie бесплатный и с открытым исходным кодом. Он построен поверх Argent от Software Mansion.
Goldie работает как CLI и как навык для агентов.🥹
Вы просите своего любимого кодинг-агента сделать скриншоты для App Store, а Goldie с помощью Argent сам управляет приложением, делает нужные кадры и оформляет их в маркетинговые материалы.
В комплекте также есть удобная Studio, где дизайн можно вручную подправить.
Goldie бесплатный и с открытым исходным кодом. Он построен поверх Argent от Software Mansion.
Goldie работает как CLI и как навык для агентов.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Топовую модель с открытыми весами теперь можно запустить дома — по цене подержанного автомобиля.
Zhipu официально опубликовала полные веса GLM-5.3.
🤗 : https://huggingface.co/zai-org/GLM-5.3
Zhipu официально опубликовала полные веса GLM-5.3.
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenAI объявила, что прекращает партнёрство с Cursor и планирует перестать предоставлять им модели серии GPT начиная с 12 ноября.
Причина в том, что Cursor недавно была приобретена SpaceX Илона Маска за $60 млрд.
В контракте OpenAI с Cursor есть пункт о "смене контроля", который позволяет OpenAI расторгнуть соглашение в течение определённого периода после приобретения Cursor другой компанией.
На этот раз OpenAI напрямую воспользовалась этим правом.
Но действительно интересно то, как OpenAI объяснила своё решение.
Компания заявила, что, исходя из прошлого опыта работы с компаниями Илона Маска, она не может быть уверена, что SpaceX будет использовать эти модели в соответствии с условиями OpenAI. При этом OpenAI напрямую упомянула прошлые случаи нарушения контрактов компаниями Маска.
При этом сам Cursor даже не обвиняли в нарушении договора.
Сооснователь Cursor Майкл Труэлл публично ответил OpenAI, напомнив, что Cursor был одним из самых ранних клиентов компании, они сотрудничали много лет и всё это время воспринимали OpenAI как нейтрального поставщика инфраструктуры.
И отдельно уточнил:
Причина в том, что Cursor недавно была приобретена SpaceX Илона Маска за $60 млрд.
В контракте OpenAI с Cursor есть пункт о "смене контроля", который позволяет OpenAI расторгнуть соглашение в течение определённого периода после приобретения Cursor другой компанией.
На этот раз OpenAI напрямую воспользовалась этим правом.
Но действительно интересно то, как OpenAI объяснила своё решение.
Компания заявила, что, исходя из прошлого опыта работы с компаниями Илона Маска, она не может быть уверена, что SpaceX будет использовать эти модели в соответствии с условиями OpenAI. При этом OpenAI напрямую упомянула прошлые случаи нарушения контрактов компаниями Маска.
При этом сам Cursor даже не обвиняли в нарушении договора.
Сооснователь Cursor Майкл Труэлл публично ответил OpenAI, напомнив, что Cursor был одним из самых ранних клиентов компании, они сотрудничали много лет и всё это время воспринимали OpenAI как нейтрального поставщика инфраструктуры.
И отдельно уточнил:
на модели OpenAI сейчас приходится лишь около 5% пользовательского трафика Cursor.
Начиная с 14 сентября Антропик навсегда увеличивает стандартные недельные лимиты в Claude Code на 25%.
Сейчас действует временное увеличение на 50%. Оно закончится 13 сентября, а с 14 сентября останется постоянное увеличение на 25% относительно обычного лимита.
Это означает, что недельный лимит Claude Code фактически снизится примерно на 17% относительно того, что доступно пользователям сейчас.
Тем временем OpenAI: сбрасывают использование для всех платных пользователей Codex и ChatGPT Work, а ещё исправили несколько ошибок, которые зря съедали лимиты. Теперь того же объёма должно хватать на 10–50% дольше.
Сейчас действует временное увеличение на 50%. Оно закончится 13 сентября, а с 14 сентября останется постоянное увеличение на 25% относительно обычного лимита.
Это означает, что недельный лимит Claude Code фактически снизится примерно на 17% относительно того, что доступно пользователям сейчас.
Тем временем OpenAI: сбрасывают использование для всех платных пользователей Codex и ChatGPT Work, а ещё исправили несколько ошибок, которые зря съедали лимиты. Теперь того же объёма должно хватать на 10–50% дольше.
Многим нравится интерфейс Codex Desktop, но при этом далеко не все хотят пользоваться только Codex.
Теперь кто-то превратил его в единый интерфейс сразу для нескольких кодовых агентов.
Поддерживаются Codex, Pi, Claude, DeepSeek Harness, Grok и Oh My Pi.
Один интерфейс, несколько агентов. Просто переключаешься на нужного и продолжаешь работать.
https://github.com/BytePioneer-AI/codex-host
Теперь кто-то превратил его в единый интерфейс сразу для нескольких кодовых агентов.
Поддерживаются Codex, Pi, Claude, DeepSeek Harness, Grok и Oh My Pi.
Один интерфейс, несколько агентов. Просто переключаешься на нужного и продолжаешь работать.
https://github.com/BytePioneer-AI/codex-host
3
Если у вас Mac и вы хотите запускать ИИ локально, стоит попробовать oMLX. Это альтернатива Ollama и LM Studio.
✓ Оптимизирован под Apple Silicon
✓ KV-кэш хранится на SSD
✓ Совместим с Claude Code и Cursor
✓ Оптимизирован под Qwen3.8
https://github.com/jundot/omlx
✓ Оптимизирован под Apple Silicon
✓ KV-кэш хранится на SSD
✓ Совместим с Claude Code и Cursor
✓ Оптимизирован под Qwen3.8
https://github.com/jundot/omlx
За рубежом сейчас активно обсуждают этот инструмент, который называют почти безлимитным способом использовать Codex:
https://github.com/miuuyy/codex-chatgpt-web
Инструмент оставляет интерфейс Codex без изменений, но фактически получает ответы с сайта ChatGPT.
По сути, это мост между Codex и веб-версией ChatGPT.
У него есть собственное приложение, которое открывает встроенный браузер и передаёт работу в вашу уже авторизованную сессию ChatGPT.
Встроенный в Codex ИИ-агент напрямую управляет этим браузером.
Поэтому, как утверждается, по сравнению с существующим самодельным подходом через MCP сессии работают стабильнее, а рабочий контекст между шагами переносится более естественно.
Если вы оформили Codex Max за $200 и постоянно упираетесь в лимиты использования, с этим инструментом можно пользоваться им почти без ограничений, не переживая о недельных квотах.🐸
https://github.com/miuuyy/codex-chatgpt-web
Инструмент оставляет интерфейс Codex без изменений, но фактически получает ответы с сайта ChatGPT.
По сути, это мост между Codex и веб-версией ChatGPT.
У него есть собственное приложение, которое открывает встроенный браузер и передаёт работу в вашу уже авторизованную сессию ChatGPT.
Встроенный в Codex ИИ-агент напрямую управляет этим браузером.
Поэтому, как утверждается, по сравнению с существующим самодельным подходом через MCP сессии работают стабильнее, а рабочий контекст между шагами переносится более естественно.
Если вы оформили Codex Max за $200 и постоянно упираетесь в лимиты использования, с этим инструментом можно пользоваться им почти без ограничений, не переживая о недельных квотах.
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Джордан Нанос из SemiAnalysis рассказал, что инженеры OpenAI, которые вместе с ними пролистывали код собственного ядра, сами не понимали построчно, что именно он делает. И это не имело значения, потому что ИИ понимал.
«Это не мусорный код, потому что он работает. Но по сути это буквально сгенерированный ИИ ассемблер, который просто вывален в Gluon — низкоуровневый язык программирования ядер, который они построили поверх Triton и который использует очень интересную модель программирования».
«Суть в том, что парни, которые вместе с нами пролистывали этот код, явно очень хорошо разбирались в железе, очень хорошо понимали концепции всей системы, но при этом вообще не представляли, что конкретно делает это MLA-ядро для DeepSeek, которое они нам показывали».
«Можно идти по коду строка за строкой, и там буквально: нет, не знаю, не знаю».
«Но это не имеет значения. ИИ его понимает, ИИ его тестирует, и результат виден. Он генерирует корректные ядра, которые работают действительно очень хорошо».
«И я думаю, это просто ещё один признак того, что нас ждёт дальше».
«Сам по себе код уже не обязательно должен быть чем-то, что человек обязан глубоко понимать и разбирать, если ИИ знает, как управлять перемещением данных и вычислительными элементами на том железе, которое вы ему дали».
Cerebras начнёт хостить Qwen 3.8 27B с 3 сентября.
На Cerebras она, скорее всего, будет работать на скорости 2000+ токенов в секунду. Разрыв огромный.
Для сравнения, ChatGPT обычно выдаёт около 50–100 токенов в секунду, а быстрый режим Codex — примерно 150–200.
То есть Qwen на Cerebras потенциально сможет работать примерно в 10 раз быстрее быстрого режима Codex..🥹
На Cerebras она, скорее всего, будет работать на скорости 2000+ токенов в секунду. Разрыв огромный.
Для сравнения, ChatGPT обычно выдаёт около 50–100 токенов в секунду, а быстрый режим Codex — примерно 150–200.
То есть Qwen на Cerebras потенциально сможет работать примерно в 10 раз быстрее быстрого режима Codex..
Please open Telegram to view this post
VIEW IN TELEGRAM
ЛОЛ, чел отменил Claude Max за $200 в месяц после того, как нейронка обиделась на «fuck you» 🍿
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
51
Архитектура Apple Silicon оказалась почти идеальной для запуска больших языковых моделей.
Всё благодаря сочетанию быстрой памяти, высокой пропускной способности и единой архитектуры памяти.
Mac Studio M5 Ultra с 512 ГБ памяти и пропускной способностью 1,2 ТБ/с способен целиком уместить GLM-5.3-Flash на 320 млрд параметров в FP8 и выдавать около 60 токенов в секунду локально, прямо на рабочем столе.
Альтернатива на ПК?
Примерно 10 RTX 5090 стоимостью более $20 000 и своя небольшая электростанция.
Полная версия GLM-5.3-Flash на 320 млрд параметров в FP8 весит около 306 ГБ.
У одной RTX 5090 всего 32 ГБ видеопамяти. Поэтому только для размещения весов модели понадобится минимум 10 видеокарт.
10 × 32 ГБ = 320 ГБ.
Mac Studio решает эту проблему за счёт единого пула памяти объёмом до 512 ГБ с пропускной способностью 1,2 ТБ/с.
Вместо того чтобы собирать ПК-кластер из множества видеокарт, бороться с задержками шины PCIe и энергопотреблением в районе 5000 Вт, можно загрузить всю модель объёмом 306 ГБ вместе с огромным контекстом и KV-кэшем в один настольный компьютер.
Всё благодаря сочетанию быстрой памяти, высокой пропускной способности и единой архитектуры памяти.
Mac Studio M5 Ultra с 512 ГБ памяти и пропускной способностью 1,2 ТБ/с способен целиком уместить GLM-5.3-Flash на 320 млрд параметров в FP8 и выдавать около 60 токенов в секунду локально, прямо на рабочем столе.
Альтернатива на ПК?
Примерно 10 RTX 5090 стоимостью более $20 000 и своя небольшая электростанция.
Полная версия GLM-5.3-Flash на 320 млрд параметров в FP8 весит около 306 ГБ.
У одной RTX 5090 всего 32 ГБ видеопамяти. Поэтому только для размещения весов модели понадобится минимум 10 видеокарт.
10 × 32 ГБ = 320 ГБ.
Mac Studio решает эту проблему за счёт единого пула памяти объёмом до 512 ГБ с пропускной способностью 1,2 ТБ/с.
Вместо того чтобы собирать ПК-кластер из множества видеокарт, бороться с задержками шины PCIe и энергопотреблением в районе 5000 Вт, можно загрузить всю модель объёмом 306 ГБ вместе с огромным контекстом и KV-кэшем в один настольный компьютер.
2
Релиз Fable 5.1 уже совсем близко. ЕЁ уже зарегистрировали в API AWS Bedrock.
Инсайдер обнаружил, что запрос к её идентификатору возвращает
Для сравнения, Opus 5.1 и заведомо несуществующие идентификаторы вроде
Обычно такая смена ответа происходит за несколько дней или часов до релиза.☕️
Инсайдер обнаружил, что запрос к её идентификатору возвращает
404 Model not found, а не 400 The provided model identifier is invalid.Для сравнения, Opus 5.1 и заведомо несуществующие идентификаторы вроде
us.anthropic.banana всё ещё возвращают 400.Обычно такая смена ответа происходит за несколько дней или часов до релиза.
Please open Telegram to view this post
VIEW IN TELEGRAM
Офигеть. Hyper3D выпустила свою модель генерации миров WorldGen.
В отличие от других интерактивных моделей мира, WorldGen может взять всего одно 2D-изображение и на его основе построить полноценную 3D-сцену со встроенными физическими правилами.
Каждый объект независим. Столы, стулья и небольшие предметы в сцене можно отдельно извлекать, разбивать на самостоятельные 3D-модели, перемещать, заменять или дорабатывать.
Физика встроена прямо в сцену. Модель понимает пространственное расположение объектов и автоматически определяет такие свойства, как столкновения, масса, трение и другие параметры.
Плюс всё это напрямую встраивается в рабочий процесс. Сгенерированные ассеты можно импортировать в Blender, Unity или Unreal Engine и сразу использовать для создания игровых уровней, кинопроизводства, XR-контента и симуляций для обучения роботов и роботизированных манипуляторов.
Ещё сильнее впечатляет то, что WorldGen может выстраивать полноценный ИИ-конвейер вместе с моделями генерации видео вроде Seedance 2.5.
Сначала WorldGen формирует 3D-сцену с независимыми друг от друга ассетами и чёткой пространственной структурой.
Затем в связке с моделями генерации видео вроде Seedance 2.5 можно добавлять конкретную игру персонажей, прорабатывать материалы, освещение, тени и общий визуальный стиль, превращая белые модели или базовые рендеры в динамичные фрагменты, которые уже приближаются к кинематографическому качеству.
В отличие от других интерактивных моделей мира, WorldGen может взять всего одно 2D-изображение и на его основе построить полноценную 3D-сцену со встроенными физическими правилами.
Каждый объект независим. Столы, стулья и небольшие предметы в сцене можно отдельно извлекать, разбивать на самостоятельные 3D-модели, перемещать, заменять или дорабатывать.
Физика встроена прямо в сцену. Модель понимает пространственное расположение объектов и автоматически определяет такие свойства, как столкновения, масса, трение и другие параметры.
Плюс всё это напрямую встраивается в рабочий процесс. Сгенерированные ассеты можно импортировать в Blender, Unity или Unreal Engine и сразу использовать для создания игровых уровней, кинопроизводства, XR-контента и симуляций для обучения роботов и роботизированных манипуляторов.
Ещё сильнее впечатляет то, что WorldGen может выстраивать полноценный ИИ-конвейер вместе с моделями генерации видео вроде Seedance 2.5.
Сначала WorldGen формирует 3D-сцену с независимыми друг от друга ассетами и чёткой пространственной структурой.
Затем в связке с моделями генерации видео вроде Seedance 2.5 можно добавлять конкретную игру персонажей, прорабатывать материалы, освещение, тени и общий визуальный стиль, превращая белые модели или базовые рендеры в динамичные фрагменты, которые уже приближаются к кинематографическому качеству.
2