👀 На Hugging Face вышла модель Qwen 3.5-35B-A3B без цензуры
Модель генерирует абсолютно все, что вы скажете, без отказов вне зависимости от контекста запроса — иногда может чуть-чуть почитать морали из-за особенностей базовой модели, но можно и потерпеть, верно? Модель мультимодальна, так что текстом можно не ограничиваться.
Доступен широкий набор квантизаций от IQ2_M (11 ГБ) до BF16 (65 ГБ), благодаря чему нейронку можно развернуть даже на железе потребительского уровня. В остальном это все та же Qwen 3.5-35B-A3B. Успейте скачать, пока не удалили.
😅 Канал Serverflow в MAX: Подписаться
Модель генерирует абсолютно все, что вы скажете, без отказов вне зависимости от контекста запроса — иногда может чуть-чуть почитать морали из-за особенностей базовой модели, но можно и потерпеть, верно? Модель мультимодальна, так что текстом можно не ограничиваться.
Доступен широкий набор квантизаций от IQ2_M (11 ГБ) до BF16 (65 ГБ), благодаря чему нейронку можно развернуть даже на железе потребительского уровня. В остальном это все та же Qwen 3.5-35B-A3B. Успейте скачать, пока не удалили.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4🤯1 1
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня у нас обзор Intel Arc Pro B50 - проводим локальные тесты в нейронках и ComfyUI!
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
🤖 Смотреть: https://youtu.be/vG0pl4NA4ws
😅 Канал Serverflow в MAX: Подписаться
Сегодня у нас обзор Intel Arc Pro B50 - проводим локальные тесты в нейронках и ComfyUI!
- Тесты в ComfyUI и других AI сценариях
- Скорость работы, стабильность и потребление видеопамяти
- Сравнение результатов с решениями от NVIDIA
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
INTEL ARC PRO B50 против NVIDIA - тесты в нейронках и ComfyUI.
В данном ролике рассмотрим Intel Arc Pro B50 - профессиональную видеокарту, которую протестируем в задачах, связанных с нейросетями, генерацией изображений и локальным запуском инструментов для ИИ.
Проведем тесты в ComfyUI и других сценариях, посмотрим на…
Проведем тесты в ComfyUI и других сценариях, посмотрим на…
3👍6🍾3 1 1
🤖 NAS для локального ИИ: Minisforum готовит N5 Max на Strix Halo с готовой OpenClaw
Minisforum показала сетевое хранилище Minisforum N5 Max AI NAS, рассчитанное на запуск локальных языковых моделей. В основе — флагманский APU AMD Ryzen AI Max+ 395. Цена и дата выхода пока не объявлены.
Фишка системы — предустановленная платформа OpenClaw, который выступает как оркестратор ИИ-агентов, что в совокупности с возможностями масштабирования пула памяти NAS позволяет запускать целый рой агентов с минимальными задержками для решения широкого спектра задач.
😅 Канал Serverflow в MAX: Подписаться
Minisforum показала сетевое хранилище Minisforum N5 Max AI NAS, рассчитанное на запуск локальных языковых моделей. В основе — флагманский APU AMD Ryzen AI Max+ 395. Цена и дата выхода пока не объявлены.
Процессор дает 16 ядер Zen 5 с частотой до 5,1 ГГц, встроенную графику Radeon 8060S с 40 CU и NPU XDNA 2. Объем памяти может доходить до 128 ГБ, что важно для локального запуска LLM. По конфигурации хранения используется шасси серии N5: до 5 HDD и 3 слотов M.2, где часть поддерживает U.2-накопители. В общем, это тот же мини-ПК для ИИ MS-S1 MAX, но в корпусе NAS.
Фишка системы — предустановленная платформа OpenClaw, который выступает как оркестратор ИИ-агентов, что в совокупности с возможностями масштабирования пула памяти NAS позволяет запускать целый рой агентов с минимальными задержками для решения широкого спектра задач.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1 5🤯1🍾1
🔐 Intel показала ASIC-чип для вычислений на зашифрованных данных — до 5 000× быстрее CPU
Intel представила экспериментальный ускоритель Intel Heracles для полностью гомоморфного шифрования — метода криптографии, который позволяет выполнять вычисления с зашифрованными данными без их предварительной расшифровки. По данным Intel, новый чип выполняет ключевые операции FHE до ~5 000 раз быстрее, чем на серверных CPU.
На тесте приватного запроса к защищенной базе (пример с проверкой бюллетеней) один запрос занял ~14 мс — примерно как на Intel Xeon. Но в массовом сценарии разница огромная: обработка 100 млн записей заняла бы около 23 минут на Heracles против более чем 17 дней на CPU.
😅 Канал Serverflow в MAX: Подписаться
Intel представила экспериментальный ускоритель Intel Heracles для полностью гомоморфного шифрования — метода криптографии, который позволяет выполнять вычисления с зашифрованными данными без их предварительной расшифровки. По данным Intel, новый чип выполняет ключевые операции FHE до ~5 000 раз быстрее, чем на серверных CPU.
Кристалл выполнен по 3-нм FinFET и использует 64 вычислительных тайла (8×8), работающих как SIMD-движки для операций. Они соединены 2D-mesh-сетью с шинами по 512-байт. Чип работает на ~1,2 ГГц и комплектуется 48 ГБ HBM (два стека по 24 ГБ) с пропускной способностью около 819 ГБ/с, а внутричиповый обмен данными достигает ~9,6 ТБ/с.
На тесте приватного запроса к защищенной базе (пример с проверкой бюллетеней) один запрос занял ~14 мс — примерно как на Intel Xeon. Но в массовом сценарии разница огромная: обработка 100 млн записей заняла бы около 23 минут на Heracles против более чем 17 дней на CPU.
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍3🤯2 2
🎉 GeForce породил ИИ: Jensen Huang напомнил, откуда все началось
Дженсен Хуанг заявил, что без линейки GeForce современной индустрии ИИ просто не было бы. Он сделал это во время обсуждения 25-летия видеокарты GeForce 3, которую внутри компании считают ключевой точкой перехода к программируемым GPU.
Именно эта архитектурная идея позже легла в основу GPU-вычислений. Сначала появились платформы вроде CUDA, затем — тензорные ядра и ускорители для нейросетей. В итоге те же принципы, которые изначально создавались для реалистичной графики в играх, стали фундаментом современной индустрии машинного обучения и дата-центров.
😅 Канал Serverflow в MAX: Подписаться
Дженсен Хуанг заявил, что без линейки GeForce современной индустрии ИИ просто не было бы. Он сделал это во время обсуждения 25-летия видеокарты GeForce 3, которую внутри компании считают ключевой точкой перехода к программируемым GPU.
GeForce 3 в 2001 году стала одной из первых массовых видеокарт с программируемыми шейдерами. До нее GPU работали как фиксированные графические ускорители, где разработчики почти не могли менять логику рендеринга. С появлением vertex и pixel шейдеров графический процессор превратился в программируемый параллельный вычислитель.
Именно эта архитектурная идея позже легла в основу GPU-вычислений. Сначала появились платформы вроде CUDA, затем — тензорные ядра и ускорители для нейросетей. В итоге те же принципы, которые изначально создавались для реалистичной графики в играх, стали фундаментом современной индустрии машинного обучения и дата-центров.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3 2🤯1
👀 RISC-V ИИ-станция за $9 999: Tenstorrent показала TT-QuietBox 2
Tenstorrent представила рабочую станцию Tenstorrent TT‑QuietBox 2 — настольную систему для локального запуска ИИ-моделей. Устройство построено полностью на архитектуре RISC‑V, оснащено жидкостным охлаждением и стартует с цены около $9 999 (как NVIDIA RTX Pro 6000 Blackwell Server Edition)
В полной комплектации система дает 480 Tensix-ядер и 64 RISC-V-ядра, а также около 720 МБ SRAM внутри чипов. Память ускорителей объединяется в общий пул и используется для локального запуска моделей до ~120 млрд параметров. При этом система поставляется с открытым ПО стеком.
😅 Канал Serverflow в MAX: Подписаться
Tenstorrent представила рабочую станцию Tenstorrent TT‑QuietBox 2 — настольную систему для локального запуска ИИ-моделей. Устройство построено полностью на архитектуре RISC‑V, оснащено жидкостным охлаждением и стартует с цены около $9 999 (как NVIDIA RTX Pro 6000 Blackwell Server Edition)
Система базируется на четырех ИИ-ускорителях Tenstorrent Blackhole. Каждый из них включает 16 больших RISC-V-ядер SiFive x280 для общих вычислений, 120 ядер Tensix для ИИ-инференса и до 32 ГБ памяти GDDR6, а в максимальной конфигурации обеспечивают 128 ГБ видеопамяти. Дополнительно в системе установлено около 256 ГБ оперативной памяти DDR5.
В полной комплектации система дает 480 Tensix-ядер и 64 RISC-V-ядра, а также около 720 МБ SRAM внутри чипов. Память ускорителей объединяется в общий пул и используется для локального запуска моделей до ~120 млрд параметров. При этом система поставляется с открытым ПО стеком.
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍6🤯1 1
После недавней реддиторской тряски вкруг недостающих блоков ROP в профессиональной видеокарте RTX PRO 5000 Blackwell, Nvidia все-же решила дать официальное объяснение ситуации.
На самом деле, в RTX PRO 5000 Blackwell не 176 блоков ROP, как ранее утверждали многие источники, а 160 блоков, и это соответствует официальной спецификации на сайте компании.
Забавно, но на релизе RTX 5090 происходила ровно такая же ситуация, только она оказалась правдой — в некоторых бракованных кристаллах топовой потребительской видеокарты действительно было 168 активных блоков ROP вместо положенных 176 блоков. В этот раз, по всей видимости, “авторитетные” источники решили, что раз обе видюхи основаны на одном GPU GB202, то и количество активных блоков у них должно быть одинаковым, но реальность оказалась совсем другой.
😅 Канал Serverflow в MAX: Подписаться
На самом деле, в RTX PRO 5000 Blackwell не 176 блоков ROP, как ранее утверждали многие источники, а 160 блоков, и это соответствует официальной спецификации на сайте компании.
Забавно, но на релизе RTX 5090 происходила ровно такая же ситуация, только она оказалась правдой — в некоторых бракованных кристаллах топовой потребительской видеокарты действительно было 168 активных блоков ROP вместо положенных 176 блоков. В этот раз, по всей видимости, “авторитетные” источники решили, что раз обе видюхи основаны на одном GPU GB202, то и количество активных блоков у них должно быть одинаковым, но реальность оказалась совсем другой.
Please open Telegram to view this post
VIEW IN TELEGRAM
1 3💩1 1
Когда-нибудь видели такой слот? Это интерфейс HyperTransport (HTX), изначально созданный компанией AMD.
В отличие от стандартных слотов PCIe, которые общаются с процессором через чипсет (северный или южный мост), слот HTX обеспечивает прямое соединение “точка-точка” с одним из каналов HyperTransport центрального процессора, обеспечивая минимальные задержки в передаче данных
Компания Cray взяла эту технологию в разработку и активно использовала ее для проектирования своих передовых HPC-нод Cray XT3 и XT4 на базе процессоров AMD Opteron, которые подключались к специализированным чипам связи Cray SeaStar напрямую через HyperTransport.
Интересно, но технология HTX поразительно схожа по своей природе с интерконнектом Nvidia NVLink, который также минует чипсет и позволяет передавать данные напрямую без посредников, обеспечивая минимальные задержки.
В отличие от стандартных слотов PCIe, которые общаются с процессором через чипсет (северный или южный мост), слот HTX обеспечивает прямое соединение “точка-точка” с одним из каналов HyperTransport центрального процессора, обеспечивая минимальные задержки в передаче данных
Компания Cray взяла эту технологию в разработку и активно использовала ее для проектирования своих передовых HPC-нод Cray XT3 и XT4 на базе процессоров AMD Opteron, которые подключались к специализированным чипам связи Cray SeaStar напрямую через HyperTransport.
Интересно, но технология HTX поразительно схожа по своей природе с интерконнектом Nvidia NVLink, который также минует чипсет и позволяет передавать данные напрямую без посредников, обеспечивая минимальные задержки.
1👍6 1 1
Трампли Электроникс получила первые инженерные образцы CPU Иртыш С616 на 16 ядер и С632 на 32 ядра с доработанной китайской архитектурой LongArch.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍6🤯1 1
Категорически приветствую всех присутствующих в данном телеграм-канале. Я – Никита, один из авторов статей Serverflow.
Совсем недавно мне довелось протестировать новоиспечённый "ИИ-ускоритель" от компании AMD – RADEON AI PRO R9700, в исполнении Gigabyte AI TOP. В своём обзоре я осветил достоинства и недостатки этой видеокарты, а также взглянул на её результаты в популярных LLM.
Буду чрезвычайно рад вашим комментариям, замечаниям и предложениям. Ссылка на результат моей деятельности: https://serverflow.ru/blog/stati/radeon-ai-pro-r9700-ai-top-32gb-obzor-i-testy-videokarty-dlya-neyrosetey-ot-amd-v-ispolnenii-gigabyt/
😅 Канал Serverflow в MAX: Подписаться
Совсем недавно мне довелось протестировать новоиспечённый "ИИ-ускоритель" от компании AMD – RADEON AI PRO R9700, в исполнении Gigabyte AI TOP. В своём обзоре я осветил достоинства и недостатки этой видеокарты, а также взглянул на её результаты в популярных LLM.
Буду чрезвычайно рад вашим комментариям, замечаниям и предложениям. Ссылка на результат моей деятельности: https://serverflow.ru/blog/stati/radeon-ai-pro-r9700-ai-top-32gb-obzor-i-testy-videokarty-dlya-neyrosetey-ot-amd-v-ispolnenii-gigabyt/
Please open Telegram to view this post
VIEW IN TELEGRAM
ServerFlow
Radeon AI PRO R9700 AI TOP 32GB: обзор и тесты видеокарты для нейросетей от AMD в исполнении GIGABYTE | Блог Serverflow
3👍6 4🌭3
🔥 Китайский GPU 7G106: LisuanTech показала игровую Extreme и рабочую серию LX
LisuanTech анонсировала первые видеокарты на собственном GPU Lisuan 7G106. Линейка включает игровую Lisuan Extreme и 3 профессиональные карты LX — LX MAX, PRO и Ultra.
GPU построен на архитектуре TrueGPU и выпускается по TSMC N6. Extreme получила 12 ГБ GDDR6 с 192-битной шиной, PCIe 4.0 x16, 192 текстурных блока и 96 ROP. Заявленный TDP около 225 Вт. Производительность достигает ~24 TFLOPS FP32. По графике карта сопоставима с NVIDIA RTX 4060. Старт продаж уже 18 июня.
Есть четыре DisplayPort 1.4a с HDR и поддержкой до 8K/60, поддерживается кодирование AV1 4K/30 и HEVC 8K/30, декодирование AV1/HEVC до 8K/60. Поддерживаются API DirectX 12, Vulkan 1.3, OpenGL 4.6 и OpenCL 3.0.
Профессиональная серия LX использует тот же GPU 7G106. LX Ultra и LX PRO имеют 24 ГБ GDDR6, а LX MAX — 12 ГБ. Для ИИ-нагрузок заявлено до 192 TOPS INT8 и около 48 TFLOPS FP16. ПО экосистема строится вокруг стека Musheng с поддержкой PyTorch и TensorFlow.
😅 Канал Serverflow в MAX: Подписаться
LisuanTech анонсировала первые видеокарты на собственном GPU Lisuan 7G106. Линейка включает игровую Lisuan Extreme и 3 профессиональные карты LX — LX MAX, PRO и Ultra.
GPU построен на архитектуре TrueGPU и выпускается по TSMC N6. Extreme получила 12 ГБ GDDR6 с 192-битной шиной, PCIe 4.0 x16, 192 текстурных блока и 96 ROP. Заявленный TDP около 225 Вт. Производительность достигает ~24 TFLOPS FP32. По графике карта сопоставима с NVIDIA RTX 4060. Старт продаж уже 18 июня.
Есть четыре DisplayPort 1.4a с HDR и поддержкой до 8K/60, поддерживается кодирование AV1 4K/30 и HEVC 8K/30, декодирование AV1/HEVC до 8K/60. Поддерживаются API DirectX 12, Vulkan 1.3, OpenGL 4.6 и OpenCL 3.0.
Профессиональная серия LX использует тот же GPU 7G106. LX Ultra и LX PRO имеют 24 ГБ GDDR6, а LX MAX — 12 ГБ. Для ИИ-нагрузок заявлено до 192 TOPS INT8 и около 48 TFLOPS FP16. ПО экосистема строится вокруг стека Musheng с поддержкой PyTorch и TensorFlow.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3🤯1🍾1
ServerFlow | Новости и Железо 💾
🔥 Китайский GPU 7G106: LisuanTech показала игровую Extreme и рабочую серию LX LisuanTech анонсировала первые видеокарты на собственном GPU Lisuan 7G106. Линейка включает игровую Lisuan Extreme и 3 профессиональные карты LX — LX MAX, PRO и Ultra. GPU построен…
Если вы подумали, что видюхи на рендерах выглядят как-то странно, то вам не показалось — похоже, что GPU-стартап LisuanTech использует нейронки для генерации промо-материалов. Воспринимать это можно по разному, будем надеяться, что генеративную нейронку запускали на Lisuan Extreme 🤣
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2🤯2👍1🍾1