OpenAI объявила о создании своего первого ИИ-чипа “Jalapeño”, разработанного при сотрудничестве с Broadcom. Подробности пока не раскрываются, но уже известно, что Jalapeño будет работать в инфраструктуре компании и обслуживать инфраструктуру ChatGPT, Codex, OpenAI API.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
SemiAnalysis заявляют, что в корпоративных драйверах Nvidia для топовых ИИ-ускорителей есть серьезные проблемы. Из-за недоработки прошивки, ИИ-стойки GB300 NVL72 необходимо перезагружать каждые 66 дней. Аналитики также отметили, что среди всех конкурентов, программное обеспечение Nvidia имеет самое низкое качество после подключения ИИ-агентов к разработке ПО.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5 5
ServerFlow | Новости и Железо 💾
OpenAI объявила о создании своего первого ИИ-чипа “Jalapeño”, разработанного при сотрудничестве с Broadcom. Подробности пока не раскрываются, но уже известно, что Jalapeño будет работать в инфраструктуре компании и обслуживать инфраструктуру ChatGPT, Codex…
ИИ-ускоритель Jalapeño от OpenAI вблизи. На фото видно, что чип имеет 8 стэков памяти, предположительно, HBM3E. Почти точная копия Nvidia H100 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6
Аналитики Aletheia Capital считают, что цены на DRAM могут взлететь до 50% только за 3 квартал 2026 года, в в 4 квартале прайсы поднимутся еще на 30-40% 🫠
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯6
В Claude Code v2.1.190 добавили несколько изменений, которые намекают на подготовку к возвращению флагманской модели Claude Fable 5. Нейронка будет включена в подписки с еженедельным использованием, появятся уведомления “вы использовали Fable 5 на этой неделе”, а оповещения “приобретено отдельно от вашего плана” теперь удалены.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3💩2 2
ServerFlow | Новости и Железо 💾
В Claude Code v2.1.190 добавили несколько изменений, которые намекают на подготовку к возвращению флагманской модели Claude Fable 5. Нейронка будет включена в подписки с еженедельным использованием, появятся уведомления “вы использовали Fable 5 на этой неделе”…
Claude Fable 5 появилась в каталоге моделей Amazon Bedrock. Намечается грандиозное возвращение?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭2
Вчера самый популярный рейтинг мощнейших суперкомпьютеров TOP500 обновился спустя полгода после ноябрьского апдейта. Большинство HPC-кластеров, входящих в топ-10, не вылетели из рейтинга, однако произошло то, чего никто не ожидал — самым высокопроизводительным суперкомпьютером стал…китайский кластер LineShine от Национального суперкомпьютерного центра в Шэньчжэне.
Гении из поднебесной смогли выжать аж 2,198 EFLOPS в режиме FP64, при этом теоретический пик кластера достигает 2,736 EFLOPS, что позволило обойти предыдущего лидера TOP500 в лице El Capitan с производительностью 1,809 EFLOPS и теоретическим пиком под 2,800 EFLOPS. Система жрет колоссальные 42,2 МВт — не мало, но для такой производительности это приемлемый уровень.
Интересно, такой эффективности LineShine достигает с помощью CPU-only архитектуры — в кластере трудятся 13,79 миллионов ядер от 304-ядерных центральных процессоров LX2 с частотой 1,55 ГГц на архитектуре ARMv9. Каждый CPU имеет 32 ГБ HBM3 с пропускной способностью 1,6 ТБ/с, что и позволило кластеру отказаться от GPU-ускорителей. Узлы кластера LingKun объединены интерконнектом LingQi собственной разработки Китая, а в качестве ОС используется отечественная платформа Kylin.
Конечно, в ИИ-задачах по бенчмарку HPL-MxP кластер LineShine лишь на 6 место, но в науке и аналитике ему нет равных, так что теперь Китай официально стал лидером HPC-индустрии.
😅 Канал Serverflow в MAX: Подписаться
Гении из поднебесной смогли выжать аж 2,198 EFLOPS в режиме FP64, при этом теоретический пик кластера достигает 2,736 EFLOPS, что позволило обойти предыдущего лидера TOP500 в лице El Capitan с производительностью 1,809 EFLOPS и теоретическим пиком под 2,800 EFLOPS. Система жрет колоссальные 42,2 МВт — не мало, но для такой производительности это приемлемый уровень.
Интересно, такой эффективности LineShine достигает с помощью CPU-only архитектуры — в кластере трудятся 13,79 миллионов ядер от 304-ядерных центральных процессоров LX2 с частотой 1,55 ГГц на архитектуре ARMv9. Каждый CPU имеет 32 ГБ HBM3 с пропускной способностью 1,6 ТБ/с, что и позволило кластеру отказаться от GPU-ускорителей. Узлы кластера LingKun объединены интерконнектом LingQi собственной разработки Китая, а в качестве ОС используется отечественная платформа Kylin.
Конечно, в ИИ-задачах по бенчмарку HPL-MxP кластер LineShine лишь на 6 место, но в науке и аналитике ему нет равных, так что теперь Китай официально стал лидером HPC-индустрии.
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾5🤯2🌭1
Тематический портал Business Insider заявляет, что выпуск новой флагманской ИИ-модели Google Gemini 3.5 Pro отложен до июля. Перенос связан с тем, что компания потеряла двух ведущих ИИ-исследователей и активно вкладывает ресурсы в разработку собственных ИИ-ускорителей, а выпуск собственных нейросетей уходит на второй план.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾3
Anthropic утверждает, что Alibaba продолжает массово использовать Claude для обучения Qwen, с намеком на то, что китайский ИИ-гигант дистиллирует данные из топовой ИИ-модели Fable 5. По данным Anthropic, в период с апреля по июнь 2026 года Alibaba выполнила более 28,8 миллионов операций извлечения информации из Claude, особенно по тематике агентного моделирования и разработки программного обеспечения. Похоже, что Qwen 3.8 будет очень мощной нейронкой.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12🤯7
ServerFlow | Новости и Железо 💾
Тематический портал Business Insider заявляет, что выпуск новой флагманской ИИ-модели Google Gemini 3.5 Pro отложен до июля. Перенос связан с тем, что компания потеряла двух ведущих ИИ-исследователей и активно вкладывает ресурсы в разработку собственных ИИ…
По сообщению Bloomberg, еще двое сотрудников Google DeepMind, Джонас Адлер и Александр Притцель, переходят из Google в Anthropic, не говоря уже о двух других сотрудниках, которые недавно уволились. Похоже, что Gemini 3.5 Pro нас ой как не обрадует…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯8
В коде веб-интерфейса OpenAI появилось упоминание модели GPT-5.6-Preview 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅4
Пока индустрия пытается нарастить выпуск дорогой и дефицитной HBM-памяти, Qualcomm предлагает альтернативный путь. Компания представила архитектуру High Bandwidth Compute (HBC) — гибрид DRAM-памяти и вычислительного блока, который использует многослойную LPDDR вместо классической HBM.
Технология представляет из себя несколько кристаллов LPDDR, прошитых с помощью TSV-каналов, а прямо под ними располагается отдельный вычислительный кристалл, выполняющий обработку данных непосредственно рядом с памятью, снижая нагрузку на основной ИИ-ускоритель и сокращая объем передаваемых данных. По сути, часть ИИ-вычислений будут переносится внутрь самой подсистемы памяти, реализуя концепцию in-memory-computing.
По заявлениям Qualcomm, первый ИИ-ускоритель AI250 на базе чипов памяти HBC Gen 1 (выйдет в 2027) сможет обеспечить до 133 ТБ/с пропускной способности, что примерно в 18 раз выше, чем у LPDDR5X в текущем AI200. Еще более впечатляющей выглядит энергоэффективность: компания заявляет о 6-кратном преимуществе по пропускной способности на ватт по сравнению с современными решениями класса HBM.
😅 Канал Serverflow в MAX: Подписаться
Технология представляет из себя несколько кристаллов LPDDR, прошитых с помощью TSV-каналов, а прямо под ними располагается отдельный вычислительный кристалл, выполняющий обработку данных непосредственно рядом с памятью, снижая нагрузку на основной ИИ-ускоритель и сокращая объем передаваемых данных. По сути, часть ИИ-вычислений будут переносится внутрь самой подсистемы памяти, реализуя концепцию in-memory-computing.
По заявлениям Qualcomm, первый ИИ-ускоритель AI250 на базе чипов памяти HBC Gen 1 (выйдет в 2027) сможет обеспечить до 133 ТБ/с пропускной способности, что примерно в 18 раз выше, чем у LPDDR5X в текущем AI200. Еще более впечатляющей выглядит энергоэффективность: компания заявляет о 6-кратном преимуществе по пропускной способности на ватт по сравнению с современными решениями класса HBM.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7
На Hugging Face есть страница, на которой можно рассчитать текущую вычислительную мощность любого выбранного оборудования или устройств вашей ситеме. Для теста нужно залогиниться 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7
Друзья, в начале следующей недели на канале выйдет новый ролик.
Пока не будем раскрывать все подробности, но немного заспойлерим: в нём нам пришлось провести несколько экспериментов с системами охлаждения. 👀
А пока предлагаем вам небольшой интерактив.
На фотографиях пять разных переходников, которые приняли участие в тестировании.
👇 Голосуйте в опросе, а после выхода ролика узнаем, насколько ваши предположения совпали с реальными результатами тестов.
Пока не будем раскрывать все подробности, но немного заспойлерим: в нём нам пришлось провести несколько экспериментов с системами охлаждения. 👀
А пока предлагаем вам небольшой интерактив.
На фотографиях пять разных переходников, которые приняли участие в тестировании.
🤔 Попробуйте угадать, какой из них показал лучший результат.
👇 Голосуйте в опросе, а после выхода ролика узнаем, насколько ваши предположения совпали с реальными результатами тестов.
👍3