ServerFlow | Новости и Железо 💾
По данным инсайдеров, Google при сотрудничестве с Mediatek активно ведет разработку новых ИИ-ускорителей TPUv9 Triggerfish, ориентированных на инференс ИИ-агентов и обучение с подкреплением. Судя по всему, чипы получат увеличенный объем SRAM-памяти, перейдут…
Инсайдеры заявляют, что Google отменила разработку TPU Pumafish, который создавался при сотрудничестве с Broadcom — вместо него компания перейдет сразу на следующие поколения TPU Humufish (вместо v9) и Icefish (v10), которые будут разрабатываться вместе с MediaTek. Массовое производство Humufish планируется начать в третьем квартале 2027 года, а Triggerfish — в четвертом квартале 2027 года.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🌭1
Японский ИИ-стартап Sakana AI, основанный выходцами из Google Дэвидом Ха и Лайоном Джонсом, выпустили Fugu Ultra — передовую нейронку, производительность которой эквивалентна или даже превосходит флагманскую ИИ-модель Anthropic Claude Fable 5.
В бенчмарках Fugu Ultra обходит Opus 4.8 на LiveCodeBench, на GPQA-Diamond она выходит на уровень Mythos Preview, однако на SWE-Bench Pro и Humanity's Last Exam впереди все еще Fable 5.
Но прикол в том, что Fugu Ultra — это не LLM вовсе, а ИИ-оркестратор, вызывающий другие нейронки на помощь, если задача слишком сложна. Fugu Ultra может вызывать собственные копии, модели Gemini 3.1 Pro, Claude Opus 4.8 и GPT-5.5. Из-за этого увеличивается время ответа, однако повышается качество выполнения задач. Есть как базовая версия Fugu с более высокой скоростью ответов, так и флагманская Fugu Ultra
Топовая нейронка Fugu Ultra доступна в API по цене $5.00 за 1 млн входных токенов и $30.00 за 1 млн выходных токенов.
😅 Канал Serverflow в MAX: Подписаться
В бенчмарках Fugu Ultra обходит Opus 4.8 на LiveCodeBench, на GPQA-Diamond она выходит на уровень Mythos Preview, однако на SWE-Bench Pro и Humanity's Last Exam впереди все еще Fable 5.
Но прикол в том, что Fugu Ultra — это не LLM вовсе, а ИИ-оркестратор, вызывающий другие нейронки на помощь, если задача слишком сложна. Fugu Ultra может вызывать собственные копии, модели Gemini 3.1 Pro, Claude Opus 4.8 и GPT-5.5. Из-за этого увеличивается время ответа, однако повышается качество выполнения задач. Есть как базовая версия Fugu с более высокой скоростью ответов, так и флагманская Fugu Ultra
Топовая нейронка Fugu Ultra доступна в API по цене $5.00 за 1 млн входных токенов и $30.00 за 1 млн выходных токенов.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5 1
Аналитики SemiAnalysis считают, что к 2027 году выручка китайского производителя памяти CXMT удвоится и достигнет $100-$110 миллиардов, если компания выйдет на IPO к этому времени, а уже в этом году доход компании будет составлять $55 миллиардов. Деньги начали течь рекой благодаря началу поставок чипов DDR5 и масштабированию производства отечественной HBM.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍6
Акции SpaceX начали падать спустя 11 дней после громкого IPO — на пике ценные бумаги компании стоили $255, а сейчас акции торгуются на уровне $160. Из-за этого капитал Маска само собой тоже упал — из триллионера он перевоплотился обратно в миллиардера.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🤯3🍾1 1
ИИ-исследователь из команды Alibaba Сюаньмин Чжан заявляет, что компания готовит к релизу семейство ИИ-моделей Qwen 3.7 с открытым исходным кодом.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾15
Вчера OpenAI представила свой ответ на Claude Mythos 5 — новую ИИ-модель GPT-5.5-Cyber для задач кибербезопасности. По словам компании, нейронка отлично справляется с отслеживанием уязвимостей в коде, помогает с разработкой и вычиткой кода, а также собирает доказательную базу о косяках программистов. В ключевом кибербез-бенчмарке CyberGym новая нейронка на 1,8% превзошла флагманскую ИИ-модель Anthropic Mythos 5.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
Южнокорейские СМИ заявляют, что SK Hynix откладывает планы по масштабному ускорению наращивания производственных мощностей для HBM3E на HBM4 и постепенно переходит на выпуск DDR5 и LPDDR5X, чтобы закрыть дефицит чипов и укрепиться в нише потребительской памяти, пока конкуренты продолжают клепать HBM для ИИ-ускорителей и серверов.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11 1
Mistral AI представила новую ИИ-модель Mistral OCR 4. Нейронка для распознавания текста поддерживает работу с таблицами, диаграммами, рукописными текстами, умеет классифицировать данные и выстраивать их по логическим/графическим блокам. Поддерживает 170 языков, включая русский! Цена в API — всего $4 за 1000 страниц.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7
SK Hynix подала документы по форме F-1 для выхода на IPO в Комиссию по ценным бумагам и биржам США 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4 4
Samsung представила новый стандарт флеш-памяти UFS 5.0, который выводит мобильные накопители на уровень настольных SSD. Новый интерфейс обеспечивает до 10,8 ГБ/с на чтение и 9,5 ГБ/с на запись, что более чем в 2 раза быстрее по сравнению с предыдущим стандартом UFS 4.1, при этом поддерживает емкость до 1 ТБ. При этом Samsung заявляет о росте энергоэффективности примерно на 40%.
Главная цель такого скачка — сделать смартфоны и бюджетные ноутбуки более пригодными для инференса легких моделей искусственного интеллекта. По данным инсайдеров, поддержку нового стандарта уже получили будущие флагманские платформы Qualcomm Snapdragon 8 Elite Gen 6 и Snapdragon 8 Elite Gen 6 Pro. Вероятно, совместимость также появится у следующих поколений MediaTek Dimensity и Samsung Exynos.
😅 Канал Serverflow в MAX: Подписаться
Главная цель такого скачка — сделать смартфоны и бюджетные ноутбуки более пригодными для инференса легких моделей искусственного интеллекта. По данным инсайдеров, поддержку нового стандарта уже получили будущие флагманские платформы Qualcomm Snapdragon 8 Elite Gen 6 и Snapdragon 8 Elite Gen 6 Pro. Вероятно, совместимость также появится у следующих поколений MediaTek Dimensity и Samsung Exynos.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3💩3
OpenAI объявила о создании своего первого ИИ-чипа “Jalapeño”, разработанного при сотрудничестве с Broadcom. Подробности пока не раскрываются, но уже известно, что Jalapeño будет работать в инфраструктуре компании и обслуживать инфраструктуру ChatGPT, Codex, OpenAI API.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
SemiAnalysis заявляют, что в корпоративных драйверах Nvidia для топовых ИИ-ускорителей есть серьезные проблемы. Из-за недоработки прошивки, ИИ-стойки GB300 NVL72 необходимо перезагружать каждые 66 дней. Аналитики также отметили, что среди всех конкурентов, программное обеспечение Nvidia имеет самое низкое качество после подключения ИИ-агентов к разработке ПО.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5 5
ServerFlow | Новости и Железо 💾
OpenAI объявила о создании своего первого ИИ-чипа “Jalapeño”, разработанного при сотрудничестве с Broadcom. Подробности пока не раскрываются, но уже известно, что Jalapeño будет работать в инфраструктуре компании и обслуживать инфраструктуру ChatGPT, Codex…
ИИ-ускоритель Jalapeño от OpenAI вблизи. На фото видно, что чип имеет 8 стэков памяти, предположительно, HBM3E. Почти точная копия Nvidia H100 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6
Аналитики Aletheia Capital считают, что цены на DRAM могут взлететь до 50% только за 3 квартал 2026 года, в в 4 квартале прайсы поднимутся еще на 30-40% 🫠
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯6
В Claude Code v2.1.190 добавили несколько изменений, которые намекают на подготовку к возвращению флагманской модели Claude Fable 5. Нейронка будет включена в подписки с еженедельным использованием, появятся уведомления “вы использовали Fable 5 на этой неделе”, а оповещения “приобретено отдельно от вашего плана” теперь удалены.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3💩2 2
ServerFlow | Новости и Железо 💾
В Claude Code v2.1.190 добавили несколько изменений, которые намекают на подготовку к возвращению флагманской модели Claude Fable 5. Нейронка будет включена в подписки с еженедельным использованием, появятся уведомления “вы использовали Fable 5 на этой неделе”…
Claude Fable 5 появилась в каталоге моделей Amazon Bedrock. Намечается грандиозное возвращение?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭2
Вчера самый популярный рейтинг мощнейших суперкомпьютеров TOP500 обновился спустя полгода после ноябрьского апдейта. Большинство HPC-кластеров, входящих в топ-10, не вылетели из рейтинга, однако произошло то, чего никто не ожидал — самым высокопроизводительным суперкомпьютером стал…китайский кластер LineShine от Национального суперкомпьютерного центра в Шэньчжэне.
Гении из поднебесной смогли выжать аж 2,198 EFLOPS в режиме FP64, при этом теоретический пик кластера достигает 2,736 EFLOPS, что позволило обойти предыдущего лидера TOP500 в лице El Capitan с производительностью 1,809 EFLOPS и теоретическим пиком под 2,800 EFLOPS. Система жрет колоссальные 42,2 МВт — не мало, но для такой производительности это приемлемый уровень.
Интересно, такой эффективности LineShine достигает с помощью CPU-only архитектуры — в кластере трудятся 13,79 миллионов ядер от 304-ядерных центральных процессоров LX2 с частотой 1,55 ГГц на архитектуре ARMv9. Каждый CPU имеет 32 ГБ HBM3 с пропускной способностью 1,6 ТБ/с, что и позволило кластеру отказаться от GPU-ускорителей. Узлы кластера LingKun объединены интерконнектом LingQi собственной разработки Китая, а в качестве ОС используется отечественная платформа Kylin.
Конечно, в ИИ-задачах по бенчмарку HPL-MxP кластер LineShine лишь на 6 место, но в науке и аналитике ему нет равных, так что теперь Китай официально стал лидером HPC-индустрии.
😅 Канал Serverflow в MAX: Подписаться
Гении из поднебесной смогли выжать аж 2,198 EFLOPS в режиме FP64, при этом теоретический пик кластера достигает 2,736 EFLOPS, что позволило обойти предыдущего лидера TOP500 в лице El Capitan с производительностью 1,809 EFLOPS и теоретическим пиком под 2,800 EFLOPS. Система жрет колоссальные 42,2 МВт — не мало, но для такой производительности это приемлемый уровень.
Интересно, такой эффективности LineShine достигает с помощью CPU-only архитектуры — в кластере трудятся 13,79 миллионов ядер от 304-ядерных центральных процессоров LX2 с частотой 1,55 ГГц на архитектуре ARMv9. Каждый CPU имеет 32 ГБ HBM3 с пропускной способностью 1,6 ТБ/с, что и позволило кластеру отказаться от GPU-ускорителей. Узлы кластера LingKun объединены интерконнектом LingQi собственной разработки Китая, а в качестве ОС используется отечественная платформа Kylin.
Конечно, в ИИ-задачах по бенчмарку HPL-MxP кластер LineShine лишь на 6 место, но в науке и аналитике ему нет равных, так что теперь Китай официально стал лидером HPC-индустрии.
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾5🤯2🌭1
Тематический портал Business Insider заявляет, что выпуск новой флагманской ИИ-модели Google Gemini 3.5 Pro отложен до июля. Перенос связан с тем, что компания потеряла двух ведущих ИИ-исследователей и активно вкладывает ресурсы в разработку собственных ИИ-ускорителей, а выпуск собственных нейросетей уходит на второй план.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾3