Оказывается, что технология 3D-V кэша в чипах AMD Ryzen — это буквально стероиды для RAG-систем, ускоряя векторный поиск (100K запросов) на 88% в сравнении с обычными CPU. Дело в том, что RAG-пайплайны активно нагружают CPU через поиск по графам (например, HNSW), и здесь решает именно объем и латентность кэша. У X3D-чипов L3-кэш сильно увеличен за счет вертикального стека (3D V-Cache), поэтому больше данных остается рядом с ядрами и реже уходит в более медленную RAM. Это напрямую снижает задержки и радикально ускоряет задачи RAG.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
SK hynix запустила массовое производство модулей SOCAMM2 объемом 192 ГБ, которые будут использоваться в ИИ-системах NVIDIA Vera Rubin. Первые поставки новейших ускорителей начнутся во второй половине 2026 года, а в цепочке будут также участвовать Samsung и Micron для масштабирования выпуска SOCAMM2
SOCAMM2 дает более чем x2 пропускной способности и ~+75% к энергоэффективности относительно классических RDIMM. SOCAMM2 будет выступать в роли промежуточного буфера между HBM и медленной DRAM, снижая задержки и нагрузку на стойки.
😅 Канал Serverflow в MAX: Подписаться
SOCAMM2 дает более чем x2 пропускной способности и ~+75% к энергоэффективности относительно классических RDIMM. SOCAMM2 будет выступать в роли промежуточного буфера между HBM и медленной DRAM, снижая задержки и нагрузку на стойки.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
ServerFlow | Новости и Железо 💾
Intel, ASRock и Teamgroup продвигают новый стандарт памяти HUDIMM, который может помочь снизить стоимость DDR5 для бюджетных сборок. На самом деле, ничего инновационного в нем нет: в HUDIMM вместо привычной схемы каналов 2×32-бит у модуля остается один субканал…
Оказалось, что новые “анти-дефицитные” модули DRAM HUDIMM от Intel, ASRock и Teamgroup режут пропускную способность практически вдвое относительно DDR5 🫠
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Облачные нейронки ChatGPT, Claude и Gemini одновременно упали. Похоже, у Cloudflare опять сбой.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3 1
Alibaba выпустила новую облачную модель Qwen3.6-Max-Preview. Нейронка значительно прибавила эффективность в таких областях, как кодинг, агентские задачи и следование инструкциям. Прирост виден как на бенчмарках, так и в реальных пользовательских тестах — юзеры отмечают, что Qwen3.6-Max-Preview работает на уровне проприетарных аналогов, а также превосходит флагманские открытые LLM, такие как GLM 5.1 и MiniMax M2.7. Модель доступна в API и Alibaba Cloud Model Studio.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Одна из кожанок Хуанга стоит аж 7490 евро — это примерно как 2 RTX 5090 (3800 евро) 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Тим Кук покидает пост генерального директора Apple спустя 15 лет на посту. Теперь он станет главой совета директоров, а его место займет Джон Тернус — вице-президент Apple по аппаратным разработкам. 🫡
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯2
MS-DOS TUI начала 90-х годов. Эстетика, которую больше не вернуть 😢
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍9
Неизвестный разработчик совершенно не иронично заявляет, что он создал “самую мощную” ИИ-модель MOG-1 на собственной архитектуре, и даже привел результаты бенчмарков, где она обходит все ведущие облачные нейронки. Стоимость использования частного API MOG-1, со слов разраба, составляет $30 за миллион выходных токенов и $150 за миллион выходных токенов. Похоже, кто-то слегка опоздал на первое апреля…но твиттерские все равно поверили.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1 7
Юзеры сообщают, что OpenAI без лишнего шума выкатила GPT Image V2, и активно тестят новую нейронку в веб-приложении компании. Видно, что модель значительно прибавила в эффективности и спокойно справляется с генерацией текста, сложных веб-страниц и прочего визуального контента. Ждем официальный релиз от OpenAI.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯4👍2
ServerFlow | Новости и Железо 💾
Юзеры сообщают, что OpenAI без лишнего шума выкатила GPT Image V2, и активно тестят новую нейронку в веб-приложении компании. Видно, что модель значительно прибавила в эффективности и спокойно справляется с генерацией текста, сложных веб-страниц и прочего…
Не успела GPT Image V2 выйти в продакшн, как интернет наводнили высококачественные фейки 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4
ServerFlow | Новости и Железо 💾
🧪 Домашний чип-фаб? Энтузиаст собрал “чистую комнату” ISO 5 прямо в сарае Инженер-энтузиаст превратил свой садовый сарай в мини-лабораторию для полупроводников. Внутри удалось создать “чистую комнату” класса 100 (ISO 5) — уровень, где допускается около 100…
Media is too big
VIEW IN TELEGRAM
Помните энтузиаста, который собрал "чистую комнату" у себя в сарае? Теперь он собирается воспользоваться своим домашним чип-фабом для производства оперативной памяти.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍6
Please open Telegram to view this post
VIEW IN TELEGRAM