⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня потестим новую диффузионную модель от Google - Diffusion Gemma
Это и многое другое вы узнаете в новом видео!
🤖 Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/UiqsIrdcxEk
Канал Serverflow в MAX: Подписаться
Сегодня потестим новую диффузионную модель от Google - Diffusion Gemma
- Сравнили скорость генерации токенов с моделью Gemma4-26B-A4B
- Протестировали диффузионную модель на наших агентских бенчмарках
- Показали процесс "денойзинга" диффузионной модели
Это и многое другое вы узнаете в новом видео!
🤖 Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/UiqsIrdcxEk
Канал Serverflow в MAX: Подписаться
YouTube
1000 TPS на Nvidia H100? локальные тесты Diffusion Gemma
В этом ролике тестируем DiffusionGemma - диффузионную языковую модель Google на базе Gemma 4 26B-A4B.
Проверяем, как diffusion LLM генерирует текст. Запускаем модель локально через vllm и llama.cpp на NVIDIA H100.Сравниваем DiffusionGemma с обычной Gemma…
Проверяем, как diffusion LLM генерирует текст. Запускаем модель локально через vllm и llama.cpp на NVIDIA H100.Сравниваем DiffusionGemma с обычной Gemma…
🤯7👍4🍾1
Очередные ноунеймы покусились на трон Хуанга.
Американский стартап Tensordyne сообщил о старте производства 3-нм ускорителя Napier для ИИ-инференса. Компания заявляет до 13 раз более высокой пропускной способности по токенам и до 17 раз лучшей энергоэффективности по сравнению со стойками NVIDIA Blackwell, а также работу с мультитриллионными моделями со скоростью 1000 токенов в секунду.
Чип содержит 138 млрд транзисторов, имеет 144 ГБ HBM3E + 256 МБ SRAM-памяти и, по словам компании, обеспечивает 2,1 PFLOPS ИИ-производительность в режиме FP8 при TDP всего 300 Вт.
Основой платформы стала логарифмическая математика вместо традиционных вычислений, что должно заметно снизить энергозатраты, а также знакомая нам по ИИ-чипам Groq связка быстрой HBM и сверхбыстрой SRAM. В одну ИИ-стойку помещается 288 ускорителей Napier с суммарными 42 ТБ HBM3E и производительностью до 608 PFLOPS FP8.
Все тесты ИИ-чипов проведены самой Tensordyne, так что полагается верить наслово.
😅 Канал Serverflow в MAX: Подписаться
Американский стартап Tensordyne сообщил о старте производства 3-нм ускорителя Napier для ИИ-инференса. Компания заявляет до 13 раз более высокой пропускной способности по токенам и до 17 раз лучшей энергоэффективности по сравнению со стойками NVIDIA Blackwell, а также работу с мультитриллионными моделями со скоростью 1000 токенов в секунду.
Чип содержит 138 млрд транзисторов, имеет 144 ГБ HBM3E + 256 МБ SRAM-памяти и, по словам компании, обеспечивает 2,1 PFLOPS ИИ-производительность в режиме FP8 при TDP всего 300 Вт.
Основой платформы стала логарифмическая математика вместо традиционных вычислений, что должно заметно снизить энергозатраты, а также знакомая нам по ИИ-чипам Groq связка быстрой HBM и сверхбыстрой SRAM. В одну ИИ-стойку помещается 288 ускорителей Napier с суммарными 42 ТБ HBM3E и производительностью до 608 PFLOPS FP8.
Все тесты ИИ-чипов проведены самой Tensordyne, так что полагается верить наслово.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🍾4
Аналитики Aletheia Capital прогнозируют, что цены на HBM вырастут вдвое к 2027 году, а доля памяти в стоимости ИИ-серверов увеличится с 40% в 2025 году до более чем 70% в 2027 году. Рост касается не только HBM. Aletheia ожидает, что средние цены на серверную DRAM в третьем квартале 2026 года поднимутся примерно на 30%, а затем продолжат рост и в четвертом квартале этого года.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4 1
SpaceX приобретает Cursor за $60 миллиардов в рамках сделки по обмену акциями. Может, хотя бы теперь Grok наконец-то станет полезной моделью для кодинга?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1 5💅4🤯2
Сокет Intel LGA9324 для серверных процессоров Diamond Rapids, обнаруженный на выставке Computex 2026 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯10
А вот и его собрат из лагеря AMD — Socket SP7 для серверных процессоров EPYC Venice 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1💅8
Mistral добавила “толстого кота” в свой веб-интерфейс Vibe. Похоже, что релиз Le Chaton Fat пройдет со дня на день...ну, или французы просто прикалываются над твиттерскими.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍7
Noctua после многих лет доминирования в сегменте воздушных кулеров решила выйти за рамки обжитого рынка, причем, сразу в премиальный сегмент, представив NL-LC1 — свою первую линейку жидкостных систем охлаждения, состоящую из 3 моделей. Системы NL-LC1 на базируются на насосной платформе Asetek Emma V2, а сама Noctua добавил собственную акустическую оптимизацию, включая трехслойную изоляцию насосного блока и демпфирование вибраций, чтобы снизить шум от помпы и передачу вибраций на корпус. Доступны три режима работы насоса: Manual, Quiet и Balanced.
Младшая NL-LC1-24 ($219) получила радиатор 240 мм и два вентилятора NF-A12x25 G2. Версия NL-LC1-36 ($249) использует радиатор 360 мм с тремя такими же вентиляторами, а топовая NL-LC1-42 ($279) оснащена огромным 420-мм радиатором и тремя вентиляторами NF-A14x25 G2. Все системы совместимы с сокетами AMD AM5 и Intel LGA1700/LGA1851 и предназначены для интеграции в топовые ПК/рабочие станции премиального уровня.
😅 Канал Serverflow в MAX: Подписаться
Младшая NL-LC1-24 ($219) получила радиатор 240 мм и два вентилятора NF-A12x25 G2. Версия NL-LC1-36 ($249) использует радиатор 360 мм с тремя такими же вентиляторами, а топовая NL-LC1-42 ($279) оснащена огромным 420-мм радиатором и тремя вентиляторами NF-A14x25 G2. Все системы совместимы с сокетами AMD AM5 и Intel LGA1700/LGA1851 и предназначены для интеграции в топовые ПК/рабочие станции премиального уровня.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🤯1 1
Microsoft рассматривает возможность использования ИИ-моделей DeepSeek вместо OpenAI и Anthropic, поскольку Copilot Cowork переходит на другой способ оплаты, который будет невыгоден для пользователей при использовании американских нейронок.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM