🔥 Z.ai раскрыла, как GLM-5.3 участвовала в оптимизации собственной inference-инфраструктуры.
Для GLM-5.3-Flash компания развернула serving stack на крупном кластере китайских AI-ускорителей и использовала Infra Agent на базе GLM-5.3 для работы с kernels, bottleneck’ами, операторами и настройкой inference engine.
Стек построен поверх SGLang и использует Encode-Prefill–Decode disaggregation, quantization и аппаратно-зависимые оптимизации.
По данным Z.ai, после серии таких оптимизаций end-to-end производительность выросла примерно в 3 раза относительно исходного baseline на том же железе.
https://z.ai/blog/glm-built-its-inference-infrastructure
Для GLM-5.3-Flash компания развернула serving stack на крупном кластере китайских AI-ускорителей и использовала Infra Agent на базе GLM-5.3 для работы с kernels, bottleneck’ами, операторами и настройкой inference engine.
Стек построен поверх SGLang и использует Encode-Prefill–Decode disaggregation, quantization и аппаратно-зависимые оптимизации.
По данным Z.ai, после серии таких оптимизаций end-to-end производительность выросла примерно в 3 раза относительно исходного baseline на том же железе.
https://z.ai/blog/glm-built-its-inference-infrastructure
❤8👍5🔥2
Robo Drive Party: закрытый ивент для тех, кто меняет мир технологий! ⚡️
21 сентября, Сбер.Среда — именно здесь соберутся топовые инженеры, которые создают роботов и проектируют архитектуру.
В программе тусовки:
✔️ Прямой диалог с инженерами и руководителями команд Центра робототехники — без формальностей и стресса.
✔️ Реальный шанс заглянуть в текущие проекты Сбера, обсудить инженерные задачи и главное — потенциальное сотрудничество.
Если ты работаешь в Physical AI, ML, RL, Cyber Security и мечтаешь создавать реальных роботов, а не экспериментальные прототипы,— регистрируйся на Robo Drive Party!
Тебя ждут польза, драйв и, если всё сложится, люди, с которыми ты будешь в одной команде! 😉
21 сентября, Сбер.Среда — именно здесь соберутся топовые инженеры, которые создают роботов и проектируют архитектуру.
В программе тусовки:
✔️ Прямой диалог с инженерами и руководителями команд Центра робототехники — без формальностей и стресса.
✔️ Реальный шанс заглянуть в текущие проекты Сбера, обсудить инженерные задачи и главное — потенциальное сотрудничество.
Если ты работаешь в Physical AI, ML, RL, Cyber Security и мечтаешь создавать реальных роботов, а не экспериментальные прототипы,— регистрируйся на Robo Drive Party!
Тебя ждут польза, драйв и, если всё сложится, люди, с которыми ты будешь в одной команде! 😉
👍6❤4❤🔥2🤨1
🦀 GitHub переписал runtime GitHub Copilot на Rust — с помощью самого Copilot
Изначально runtime был написан на TypeScript, работал поверх Node.js и V8.
Теперь это:
- более 800 000 строк production-кода на Rust
- крупная миграция работающей системы, а не экспериментальный прототип
- Copilot использовался прямо в процессе переноса и рефакторинга
Интересный момент: инструмент для генерации кода помог переписать собственную инфраструктуру на язык, ориентированный на производительность, контроль памяти и предсказуемость runtime.
Хороший пример того, куда движется разработка: AI всё чаще используется не только для написания отдельных функций, а для миграции больших production-систем между технологическими стеками.
https://github.blog/ai-and-ml/generative-ai/migrating-the-github-copilot-runtime-to-rust-using-copilot/
Изначально runtime был написан на TypeScript, работал поверх Node.js и V8.
Теперь это:
- более 800 000 строк production-кода на Rust
- крупная миграция работающей системы, а не экспериментальный прототип
- Copilot использовался прямо в процессе переноса и рефакторинга
Интересный момент: инструмент для генерации кода помог переписать собственную инфраструктуру на язык, ориентированный на производительность, контроль памяти и предсказуемость runtime.
Хороший пример того, куда движется разработка: AI всё чаще используется не только для написания отдельных функций, а для миграции больших production-систем между технологическими стеками.
https://github.blog/ai-and-ml/generative-ai/migrating-the-github-copilot-runtime-to-rust-using-copilot/
❤13👍6😁3🕊1
Сегодня последний день регистрации на КосмоХакатон
18–20 сентября, Петербург, Красноярск или онлайн из любой точки страны. Четыре задачи на выбор: снабжение орбитального топливного узла и безопасность космонавта в открытом космосе в Петербурге (фонд 1,2 млн ₽), мониторинг лесных пожаров и верификация углеродных кредитов по спутниковым снимкам в Красноярске (600 тыс. ₽). Есть и для тех, кто про данные и ML, и для тех, кто про стратегию и экономику.
Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.
Команду можно собрать на платформе.
Подробности и регистрация
18–20 сентября, Петербург, Красноярск или онлайн из любой точки страны. Четыре задачи на выбор: снабжение орбитального топливного узла и безопасность космонавта в открытом космосе в Петербурге (фонд 1,2 млн ₽), мониторинг лесных пожаров и верификация углеродных кредитов по спутниковым снимкам в Красноярске (600 тыс. ₽). Есть и для тех, кто про данные и ML, и для тех, кто про стратегию и экономику.
Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.
Команду можно собрать на платформе.
Подробности и регистрация
❤2👍2
🔐 GPT-6 Astra предложила расшифровку немецкой радиограммы 1918 года
Автор эксперимента под ником prinz сообщил, что модель прочитала сообщение из 170 символов, которое, насколько ему известно, ранее оставалось нерасшифрованным.
В исходном вирусном посте перепутали детали: радиограмма датирована 27 ноября 1918 года и использует ADFGVX. Упоминания Enigma и 1941 года ошибочны.
По описанию автора, Astra:
* использовала ключ TRUPPENVERSCHIEBUNG, сохранившийся в исторических материалах;
* восстановила перестановку символов и получила немецкий текст;
* сопоставила содержание с журналами британского флота.
Сообщение рассказывало о прибытии английского крейсера в Севастополь и следующей за ним союзной эскадры. Детали совпали с историческими записями о событиях 24 и 26 ноября.
Ключ уже был в архиве, а отдельные символы расшифровки остаются неоднозначными. Независимого подтверждения, что это первое правильное решение, пока нет.
https://www.prinzai.com/p/gpt-6-astra-solves-a-wwi-german-radio
Автор эксперимента под ником prinz сообщил, что модель прочитала сообщение из 170 символов, которое, насколько ему известно, ранее оставалось нерасшифрованным.
В исходном вирусном посте перепутали детали: радиограмма датирована 27 ноября 1918 года и использует ADFGVX. Упоминания Enigma и 1941 года ошибочны.
По описанию автора, Astra:
* использовала ключ TRUPPENVERSCHIEBUNG, сохранившийся в исторических материалах;
* восстановила перестановку символов и получила немецкий текст;
* сопоставила содержание с журналами британского флота.
Сообщение рассказывало о прибытии английского крейсера в Севастополь и следующей за ним союзной эскадры. Детали совпали с историческими записями о событиях 24 и 26 ноября.
Ключ уже был в архиве, а отдельные символы расшифровки остаются неоднозначными. Независимого подтверждения, что это первое правильное решение, пока нет.
https://www.prinzai.com/p/gpt-6-astra-solves-a-wwi-german-radio
👍16❤3🥱3
This media is not supported in your browser
VIEW IN TELEGRAM
17 сентября в Москве прошла AI R&D DAY — конференция для исследовательских команд и создателей ИИ-систем.
Более 600 участников на одной площадке, 20+ докладов — концентрат практического опыта, знаний и инструментов, готовых к внедрению сразу по возвращению в офис.
Обсудили альтернативные архитектуры, обучение моделей и AI-агентов, долгосрочную мультимодальную память, новые модальности и коммуникации, а также бенчмаркинг и стандарты качества AI.
Среди спикеров — эксперты Сбера (Sber AI, Kandinsky Lab, Центра «ИИ для науки», Центра практического ИИ, Центра робототехники), института AIRI, Лондонского института практических наук, Национального суперкомпьютерного центра в Цзинане и другие создатели ИИ-систем.
Видеозаписи докладов уже доступны в наших соцсетях.
А если вы хотите стать частью исследовательского коммьюнити Сбера, то переходите по ссылке
#реклама
О рекламодателе
Более 600 участников на одной площадке, 20+ докладов — концентрат практического опыта, знаний и инструментов, готовых к внедрению сразу по возвращению в офис.
Обсудили альтернативные архитектуры, обучение моделей и AI-агентов, долгосрочную мультимодальную память, новые модальности и коммуникации, а также бенчмаркинг и стандарты качества AI.
Среди спикеров — эксперты Сбера (Sber AI, Kandinsky Lab, Центра «ИИ для науки», Центра практического ИИ, Центра робототехники), института AIRI, Лондонского института практических наук, Национального суперкомпьютерного центра в Цзинане и другие создатели ИИ-систем.
Видеозаписи докладов уже доступны в наших соцсетях.
А если вы хотите стать частью исследовательского коммьюнити Сбера, то переходите по ссылке
#реклама
О рекламодателе
👍5❤1
💰 Инвесторы допускают оценку Anthropic в $4 трлн после IPO, но дешёвые модели усиливают давление на бизнес.
По данным FT, в июле выручка компании в годовом пересчёте достигла $65 млрд. Ранние инвесторы ожидают более $120 млрд к концу года - речь о темпе выручки, а не сумме за год.
Клиентам всё проще менять поставщиков и распределять задачи между моделями. Ramp заявила, что такой подход сократил её расходы на ИИ на 40%.
Удержание пользователей пока лучше у Anthropic: по данным OpenRouter, через год остаются 22,5% против 13,2% у OpenAI. Эти показатели относятся к аудитории платформы.
По данным FT, в июле выручка компании в годовом пересчёте достигла $65 млрд. Ранние инвесторы ожидают более $120 млрд к концу года - речь о темпе выручки, а не сумме за год.
Клиентам всё проще менять поставщиков и распределять задачи между моделями. Ramp заявила, что такой подход сократил её расходы на ИИ на 40%.
Удержание пользователей пока лучше у Anthropic: по данным OpenRouter, через год остаются 22,5% против 13,2% у OpenAI. Эти показатели относятся к аудитории платформы.
👍9🔥4❤3😁2
🔥 Hemmingway-1 - открытая модель, которая пытается писать как человек
Модель построена на базе Qwen3.8-27B и настроена для повседневных текстов: сообщений, писем, ответов и историй — без шаблонных вступлений, лишних вариантов и характерного «ИИ-стиля».
Главное:
— 27 млрд параметров
— контекст до 262 тысяч токенов
— открытые веса и лицензия Apache 2.0
— запуск через Transformers, vLLM или SGLang
— в первую очередь оптимизирована для английского языка
Создатели утверждают, что на их собственных тестах модель обошла ряд значительно более крупных систем. Но результаты пока не независимые, поэтому Hemmingway-1 интереснее всего проверить самостоятельно.
Модель на Hugging Face: https://huggingface.co/Altworld/Hemmingway-1
Модель построена на базе Qwen3.8-27B и настроена для повседневных текстов: сообщений, писем, ответов и историй — без шаблонных вступлений, лишних вариантов и характерного «ИИ-стиля».
Главное:
— 27 млрд параметров
— контекст до 262 тысяч токенов
— открытые веса и лицензия Apache 2.0
— запуск через Transformers, vLLM или SGLang
— в первую очередь оптимизирована для английского языка
Создатели утверждают, что на их собственных тестах модель обошла ряд значительно более крупных систем. Но результаты пока не независимые, поэтому Hemmingway-1 интереснее всего проверить самостоятельно.
Модель на Hugging Face: https://huggingface.co/Altworld/Hemmingway-1
👍8🔥7❤4
Один вечер — много возможностей! ⚡️
25 сентября у тебя будет шанс познакомиться сразу с четырьмя технологическими командами, которые строят GigaChat изнутри: от данных и поиска до платформы AI-агентов и backend-сервисов массового продукта.
Ты сможешь заглянуть в текущие проекты Сбера, понетворкать, а еще — обменяться контактами с лидерами ключевых backend-команд GigaChat
Регистрируйся по ссылке — встречаемся 25 сентября в 19:00 по адресу: Москва, «Оригинал», Земляной Вал, 9А!
25 сентября у тебя будет шанс познакомиться сразу с четырьмя технологическими командами, которые строят GigaChat изнутри: от данных и поиска до платформы AI-агентов и backend-сервисов массового продукта.
Ты сможешь заглянуть в текущие проекты Сбера, понетворкать, а еще — обменяться контактами с лидерами ключевых backend-команд GigaChat
Регистрируйся по ссылке — встречаемся 25 сентября в 19:00 по адресу: Москва, «Оригинал», Земляной Вал, 9А!
👍3
SoftBank привлекает более $11 млрд ради новой инвестиции в OpenAI 🚨
SoftBank запустила размещение облигаций на $10 млрд и ещё €1 млрд перед очередным платежом OpenAI, запланированным на 1 октября.
Долларовые облигации выпустят со сроками погашения 3,5, 5,5 и 7,5 года, европейские - на 4 и 6 лет. Размещение должно заменить ранее привлечённую кредитную линию на $10 млрд.
Ожидаемые даты:
- 24 сентября — определение цены;
- 29 сентября — расчёты по сделке;
- 1 октября — платёж OpenAI.
Организаторами выступают Citigroup и JPMorgan. Если размещение завершится в заявленном объёме, оно станет крупнейшим выпуском облигаций нефинансовой компании в Азиатско-Тихоокеанском регионе.
🔗 https://www.reuters.com/business/media-telecom/softbank-group-launches-over-10-billion-bonds-openai-investment-term-sheet-shows-2026-09-21/
SoftBank запустила размещение облигаций на $10 млрд и ещё €1 млрд перед очередным платежом OpenAI, запланированным на 1 октября.
Долларовые облигации выпустят со сроками погашения 3,5, 5,5 и 7,5 года, европейские - на 4 и 6 лет. Размещение должно заменить ранее привлечённую кредитную линию на $10 млрд.
Ожидаемые даты:
- 24 сентября — определение цены;
- 29 сентября — расчёты по сделке;
- 1 октября — платёж OpenAI.
Организаторами выступают Citigroup и JPMorgan. Если размещение завершится в заявленном объёме, оно станет крупнейшим выпуском облигаций нефинансовой компании в Азиатско-Тихоокеанском регионе.
🔗 https://www.reuters.com/business/media-telecom/softbank-group-launches-over-10-billion-bonds-openai-investment-term-sheet-shows-2026-09-21/
👍2🙈2🤔1