Servercore News
2.15K subscribers
238 photos
1 video
200 links
Servercore — международный провайдер инфраструктуры с локальным присутствием. Мы работаем в Узбекистане, Казахстане и Кении.

https://servercore.com/ru
https://servercore.kz
Download Telegram
🇺🇿 Бизнес-ужин Servercore в Ташкенте: практика внедрения AI для бизнеса

Приглашаем на бизнес-ужин от Servercore 23 сентября в Ташкенте — закрытую встречу для IT-специалистов, разработчиков и руководителей бизнеса.

Поговорим о том, как компании Узбекистана внедряют AI на практике: какую архитектуру выбирают, где теряют ресурсы и с чем сталкиваются при масштабировании.


Что будет в программе:

▪️ Реальные кейсы компаний Узбекистана, которые разворачивают AI-сервисы на инфраструктуре Servercore
▪️ Как выбирать архитектуру под реалии местного рынка
▪️ Где бизнес теряет ресурсы и как их оптимизировать
▪️ Подводные камни при масштабировании AI-проектов
▪️ QA-сессия с ML-специалистами Servercore и нетворкинг за ужином

🎤 Спикер: Наталья Крушатина, директор по развитию продуктов

🔗 Зарегистрироваться
9👍1
Weekly-дайджест IT-новостей — собрали главные события недели в одном посте:

1️⃣ Alibaba Cloud планирует активнее использовать свои чипы T-Head в дата-центрах. Компания рассчитывает повысить прибыльность и валовую маржу. По словам CEO, доля собственных процессоров будет расти по мере замещения коммерчески закупаемых решений. Заявление прозвучало на фоне значительного роста расходов Alibaba на ИИ-инфраструктуру: капитальные затраты за квартал достигли $10,07 млрд, увеличившись на 75% год к году. При этом чистая прибыль компании сократилась на те же 75%, а операционная маржа снизилась до 6% против 14% годом ранее.

2️⃣ Cerebras представила вычислительную систему CS-4 на базе собственного Wafer-Scale процессора WSE-3 Turbo. По данным компании, процессор содержит около 4 трлн транзисторов и обеспечивает до 125 PFLOPS вычислительной мощности на одном процессоре (250 PFLOPS с учетом разреженности) при пропускной способности памяти до 43,2 ПБ/с и 44 ГБ встроенной SRAM. WSE-3 Turbo использует 44 ГБ встроенной SRAM. Cerebras заявляет, что CS-4 выполняет за одну секунду задачи, на которые традиционной GPU-стойке требуется около 30 секунд.

3️⃣ Micron вложит до $10 млрд в течение десятилетия в новый исследовательский институт Micron Research Labs в Айдахо (США). Центр займется технологиями памяти за пределами текущих планов развития отрасли, продвинутыми архитектурами памяти и вычислений, упаковкой и будущим производством чипов. Эти инвестиции отдельны от более чем $250 млрд, которые Micron ранее обязалась направить на производство и R&D в США. Строительство кампуса в Бойсе планируется начать в 2027 году, он рассчитан на сотни исследователей.
71👍1
🇺🇿 HighFreq Line: облачные серверы на высоких частотах в Ташкенте

Фиксированные конфигурации HighFreq Line доступны к заказу в пуле uz-2a региона Ташкент.

Это готовые сборки на процессорах с высокой тактовой частотой: выбираете подходящую и разворачиваете сервер за пару минут, без сборки конфигурации вручную.

Что в линейке:

▪️ Процессоры AMD EPYC 9554 с частотой до 3,6 ГГц и локальный диск
▪️ 12 готовых конфигураций — от 1 vCPU и 2 ГБ RAM до 8 vCPU и 64 ГБ RAM
▪️ Аренда на час, сутки или месяц с оплатой по факту потребления в сумах
▪️ SLA 99,98% с финансовой гарантией, 3 ТБ внешнего трафика и техподдержка 24/7 в стоимости
▪️ Соответствие ISO/IEC 27001, PCI DSS и ЗРУ-547-сон, данные хранятся в Узбекистане

Высокая тактовая частота дает выигрыш там, где важна скорость одного потока: базы данных, бэкенды с синхронными запросами, обработка транзакций.


Стоимость — от 235,59 UZS в час.

🔗 Арендовать сервер
👍73🔥1
Weekly-дайджест IT-новостей — собрали главные события недели в одном посте:

1️⃣ Amazon планирует развернуть до 3 млн ИИ-ускорителей Nvidia в глобальной инфраструктуре AWS. Мощности будут использовать для задач агентного ИИ, автоматизации, физического ИИ и других вычислительных приложений. Объем соглашения втрое превышает первоначальные планы Amazon по закупке 1 млн GPU Nvidia. Кроме того, AWS начнет использовать процессоры Nvidia Vera, чтобы предложить клиентам более широкий набор вычислительных решений.

2️⃣ Nvidia запускает массовое производство ИИ-чипов Groq 3 LPX, предназначенных для ускорения инференса и генерации токенов в Vera Rubin. В компании заявляют, что связка Vera Rubin NVL72 с Groq 3 LPX способна достигать скорости генерации до 3400 токенов в секунду, что обеспечивает существенный прирост производительности для агентных ИИ-систем. Выход Groq 3 LPX в полноценное производство последовал за началом массового выпуска процессоров Vera и серверных систем Vera Rubin.

3️⃣ IBM представила архитектуру процессора нового поколения с первым в мире ядром Dual-ISA. Оно сочетает две системы команд (ISA) в одном ядре, что позволяет нативно выполнять программы для платформ Z и Arm одновременно. Это не эмуляция и не два отдельных ядра на чипе, а интеграция Arm-архитектуры прямо в мейнфреймовые ядра — объединение экосистемы Arm-софта с сильными сторонами мейнфреймов (надежность, безопасность, масштабируемость). Решение предназначено для будущих поколений систем IBM Z и LinuxONE. Проект уже близок к передаче дизайна в производство.
4👍2
📊 Серия обзоров GPU: как выбрать карту под ИИ-задачи

Объем памяти и терафлопсы указаны в спецификации. Чего в ней нет — сколько на самом деле займет ваша модель вместе с контекстом и кэшем, сколько запросов карта выдержит под нагрузкой и во что обойдется обработка миллиона токенов.

Мы опубликовали серию статей, чтобы на эти вопросы можно было ответить до аренды или закупки GPU. Разобрали семь ускорителей NVIDIA и рассказали, какие характеристики решают в конкретных задачах, а какие ни на что не влияют.

▪️Обзор NVIDIA RTX PRO 6000
Единственная настольная карта NVIDIA с 96 ГБ видеопамяти. Показываем на тестах, что происходит, когда модель перестает помещаться в память: Llama 3.3 70B выдала 29 токенов в секунду против 3 у потребительской RTX 5090.


▪️ Обзор NVIDIA A100
Карту сняли с производства, но она по-прежнему закрывает большинство задач машинного обучения и научных расчетов. Сравниваем ее с V100, H100, L40S и A30, чтобы понять, где A100 достаточно, а где стоит переплатить.


▪️ Обзор NVIDIA H200
У H200 и H100 один и тот же графический процессор и одинаковая вычислительная производительность, все различие — в памяти. Разбираем, почему для языковых моделей этого хватает для заметного прироста, а в части проектов переход не окупится.


▪️ Сравнение RTX A5000 и RTX 4090
У карт одинаковые 24 ГБ видеопамяти, но 4090 втрое быстрее в вычислениях. При этом A5000 умеет то, чего игровая карта не умеет вовсе: ECC, NVLink и виртуальные рабочие столы.


▪️ Сравнение H100, A100 и V100
Материал для тех, у кого модель уже обучена и осталось запустить ее в работу. Приводим формулу стоимости миллиона токенов и показываем, почему дорогая карта при высокой загрузке обходится дешевле бюджетной.


Проверить сценарий на реальной карте можно без закупки оборудования — в облачных серверах с GPU Servercore. Развертывание от двух минут, почасовая оплата, дата-центры в Алматы и Ташкенте.

🔗 Арендовать сервер с GPU
6👍3🔥3
🇰🇿 Как сократить расходы на IT-инфраструктуру на 26% и ускорить отклик сервисов в 6 раз

В DigitalBusiness разобрали опыт миграции финтех-компании PayLink в облако Servercore. В статье:

▪️ Что тормозит рост финтех-продукта: нестабильность сервисов, непрозрачная экономика ресурсов и требования регуляторов к хранению платежных данных.

▪️ Как прошла миграция 15 виртуальных машин за 2 дня без простоев и какие сервисы развернули на новых мощностях.

▪️ Почему выбор конфигурации с долей ядра (10%, 20% или 50%) дал PayLink экономию на IT-инфраструктуре.

▪️ Чеклист из 5 пунктов для компаний, которые планируют перенос своих технических мощностей.

В материале Сергей Бобко, директор по региональному развитию Servercore в Казахстане, рассказал о программе поддержки миграции на облачные сервисы: ее участники получают грант в размере 1 млн тенге на построение инфраструктуры и подключение сервисов платформы.


🔗 Читать статью полностью
3
Weekly-дайджест IT-новостей — собрали главные события недели в одном посте:

1️⃣ Nvidia договорилась о покупке платформы Hugging Face за $12,93 млрд — сделка объявлена, но ещё подлежит регуляторному одобрению. Компания рассчитывает усилить позиции в инфраструктуре для запуска ИИ-моделей: Hugging Face — ключевой слой дистрибуции open-weight моделей и потенциальная основа для сервисов инференса на мощностях Nvidia. На платформе зарегистрировано более 18 млн разработчиков, исследователей и создателей, размещено свыше 3 млн моделей и около 500 тысяч наборов данных, а пользуются ею более 200 тысяч компаний. Для Nvidia это расширение контроля над ИИ-экосистемой за пределы аппаратного обеспечения.

2️⃣ Google извлекает модули DDR4 из списанных серверов и повторно использует их в новых ИИ-системах. Компания фактически формирует внутреннюю цепочку переработки серверного оборудования, чтобы компенсировать нехватку DRAM. По словам старшего директора Google по инфраструктуре цепочек поставок, отрасль уже перешла от дефицита вычислительных мощностей к дефициту памяти. При этом высокопроизводительная память сейчас составляет около 75% стоимости компонентов типичного ИИ-сервера.
👍311
🇰🇿 IT-беш от Servercore в Астане 1 октября

Приглашаем на IT-беш в Астане — наше флагманское мероприятие для разработчиков, IT-специалистов и руководителей бизнеса.

Поговорим о том, как компании Казахстана решают задачи машинного обучения и разворачивают AI-сервисы на наших мощностях.


Что будет в программе:

▪️ Какую архитектуру выбирают под реалии рынка и почему
▪️ Как оптимизировать ресурсы и не переплачивать за простаивающие GPU
▪️ Какие ошибки чаще всего всплывают при масштабировании AI-проектов
▪️ Что учесть на старте, чтобы потом не переделывать инфраструктуру
▪️ QA-сессия с ML-специалистами Servercore и нетворкинг за ужином

🎤 Спикер: Наталья Крушатина, директор по развитию продуктов

🔗 Зарегистрироваться
🔥52
Weekly-дайджест IT-новостей — собрали главные события недели в одном посте:

1️⃣ Amazon сможет закупить до $60 млрд ИИ-чипов и компонентов Qualcomm для дата-центров в рамках долгосрочного партнёрства. Соглашение охватывает процессоры для ИИ-инференса и оптические технологии передачи данных со скоростью до 1,6 Тбит/с. Qualcomm также выдала Amazon варранты на ~$4 млрд — право приобрести её акции по $161,26 за штуку по мере закупок. Так Qualcomm наращивает присутствие на рынке дата-центров, предлагая облачным провайдерам специализированные ИИ-чипы как альтернативу решениям Nvidia — на фоне ожидаемой потери модемного бизнеса Apple и ослабления спроса на смартфоны.

2️⃣ Китайская SMIC увеличила выручку на 20% год к году во втором квартале и обошла GlobalFoundries. Компания стала третьим крупнейшим контрактным производителем чипов в мире (по данным TrendForce). Рост обеспечил спрос со стороны потребительской электроники и сетевых продуктов для дата-центров. Лидером рынка остаётся TSMC с долей 72,5%, но темпы роста SMIC оказались выше, чем у конкурентов, — китайский производитель сократил разрыв с Samsung Foundry.
3🔥1🤔1
🇺🇿 Новая зона доступности uz-1b в Ташкенте

Регион uz-1 стал мультизональным: к сегменту uz-1a добавился uz-1b на отдельной площадке. Вместе с uz-2 в Ташкенте теперь три зоны доступности, а всего в Servercore — пять зон в трех странах.

Что дает мультизональный uz-1:

▪️ Единая сеть между uz-1a и uz-1b с задержкой менее 1 мс — можно строить кластеры, растянутые между зонами, без заметной потери производительности.

▪️ Растянутые кластеры баз данных и Managed Kubernetes: узлы размещаются в двух сегментах, отказ одной площадки не останавливает кластер целиком, а балансировщик распределяет трафик между обеими зонами.

▪️ Гибкое резервирование: инфраструктуру можно распределить между сегментами uz-1, между пулами uz-1 и uz-2 или между облаком и собственной площадкой — связность обеспечивает глобальный роутер (L3VPN).

▪️ Только новое оборудование: на старте в uz-1b доступны конфигурации на AMD EPYC 9554 и 9754 с памятью DDR5. Переезд в новую зону — это одновременно апгрейд железа.

Важно: отказоустойчивость не появляется автоматически при переезде в новую зону. Чтобы ее получить, нужно разнести экземпляры приложения между сегментами, настроить балансировку и репликацию. Мы помогаем с архитектурой и бесплатно переносим инфраструктуру.


🔗 Обсудить перенос инфраструктуры
🔥7👍3
Weekly-дайджест IT-новостей — собрали главные события недели в одном посте:

1️⃣ На Huawei Connect 2026 компания представила обновлённую дорожную карту ИИ-ускорителей Ascend (960DT/PR, 970, 980) с ускоренными сроками — первый чип серии, Ascend 960, выйдет уже в 2027 году. Но главное — система Atlas 960E SuperPod: по заявлению Huawei, это первое в отрасли решение с near-package optics (оптика рядом с корпусом чипа), объединяющее 4096 ускорителей и 256 ТБ общей памяти. Компания заявляет до 2,3x прироста в обучении и до 2,5x в инференсе против предыдущего поколения. Несколько таких систем можно связать в кластеры до 512 тысяч и более ускорителей. Это часть стратегии Huawei по развитию собственных AI-систем как альтернативы решениям на рынке.

2️⃣ Micron представила модуль DDR5 ёмкостью 512 ГБ с максимальной скоростью 9200 MT/s. Память предназначена для серверов следующего поколения и нагрузок ИИ. Новый модуль использует технологию вертикальной компоновки, при которой кристаллы DRAM размещаются друг над другом и соединяются через TSV. По данным компании, это позволяет значительно увеличить плотность памяти без расширения числа слотов. В результате двухсокетный сервер с 24 слотами сможет получить до 12 ТБ DDR5-памяти. Решение ориентировано на растущие требования агентного ИИ и других ресурсоёмких рабочих нагрузок к объёму и пропускной способности оперативной памяти.
👍1