По данным инсайдеров, новая ИИ-модель Claude Sonnet 5 от Anthropic может выйти уже сегодня. По слухам, нейронка приблизится к производительности Fable 5, при этом будет проходить ограничения американских регуляторов за счет усиленных алгоритмов безопасности.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩5 4
В логах Google засветился анонс Nano Banana 2 и Gemini Omni Flash 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Компания Anthropic встроила в Claude Code скрытый код (что-то вроде шпионского ПО), которое отслеживает китайски пользователей. Так компания пытается бороться с китайскими юзерами, которые используют мощности Claude для дистилляции открытых LLM. Claude Code отслеживает информацию часовом поясе, прокси-сервере и возможных связях с крупными ИИ-лабораториями КНР. Это, кстати, серьезное нарушение пользовательского соглашения 🫠
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
😡12💩2👍1
Еще одно упоминание Sonnet 5 коде селектора моделей Claude Code 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Новый ролик на основном канале! Остужаем серверные комплектующие нестандартными методами.
Получилось ли превратить серверное железо в систему, которую можно спокойно поставить в офис?
😅 Канал Serverflow в MAX: Подписаться
Новый ролик на основном канале! Остужаем серверные комплектующие нестандартными методами.
Получилось ли превратить серверное железо в систему, которую можно спокойно поставить в офис?
В видео ⚙️:Это и многое другое вы узнаете в новом видео!
-Собираем сервер на платформе Supermicro H13SSL-i
-Тестируем несколько вариантов охлаждения пассивной NVIDIA A100
-Сравниваем температуры и уровень шума разных решений
-Запускаем Qwen 3.6 27B и проверяем скорость работы в реальных задачах 💻
😅 Канал Serverflow в MAX: Подписаться
👍5🌭3🍾2💅2
AMD анонсировала Versal Premium Gen 2 — новые адаптивные SoC-чипы для периферии с технологией MoP (Memory on Package), с помощью которой удалось разместить до 32 ГБ памяти LPDDR5X 9000 MT/s в одном корпусе с кристаллом. Такой подход обеспечивает пропускную способность до 288 ГБ/с, сокращает задержки и позволяет уменьшить площадь платы периферийной системы аж на 60%, прокладывая путь к инференсу легких ИИ-моделей в сегменте IoT, промышленной инфраструктуры и автоматики.
При этом новые SoC поддерживают интерфейсы PCIe 6.0 и CXL 3.1 со скоростью 64 Гбит/с, что позволяет подключать Versal Premium Gen 2 к внешним модулям расширения памяти, что еще больше расширит ИИ-возможности периферийных чипов AMD ассортимент доступных к развертыванию LLM. Так как решения ориентированы именно на Edge-сегмент, они рассчитаны на температурный диапазон от −40 до +110 °C и будут поддерживаться компанией более 15 лет.
Первые образцы Versal Premium Gen 2 MoP появятся в конце 2026 года, а серийное производство запланировано на вторую половину 2027 года. Подробные характеристики и цены пока не разглашаются, однако с учетом дефицита и приписки “Premium”, стоить они будут явно не мало. Энтузиасты, а вы бы купили такую необычную платформу от AMD?
😅 Канал Serverflow в MAX: Подписаться
При этом новые SoC поддерживают интерфейсы PCIe 6.0 и CXL 3.1 со скоростью 64 Гбит/с, что позволяет подключать Versal Premium Gen 2 к внешним модулям расширения памяти, что еще больше расширит ИИ-возможности периферийных чипов AMD ассортимент доступных к развертыванию LLM. Так как решения ориентированы именно на Edge-сегмент, они рассчитаны на температурный диапазон от −40 до +110 °C и будут поддерживаться компанией более 15 лет.
Первые образцы Versal Premium Gen 2 MoP появятся в конце 2026 года, а серийное производство запланировано на вторую половину 2027 года. Подробные характеристики и цены пока не разглашаются, однако с учетом дефицита и приписки “Premium”, стоить они будут явно не мало. Энтузиасты, а вы бы купили такую необычную платформу от AMD?
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾4👍2🌭2
ServerFlow | Новости и Железо 💾
🔥 RTX 5060 может получить 12 ГБ VRAM По данным инсайдера Moore’s Law Is Dead, Nvidia рассматривает выпуск версии RTX 5060 с 12 ГБ памяти. Сначала ожидается релиз RTX 5050 с 9 ГБ, затем выпуск мобильной RTX 5070 на 12 ГБ, и уже после этого представят десктопную…
Спустя более чем 3 месяца после появления слухов о выходе RTX 5050 с 9 ГБ VRAM GDDR7. на 96-битной шине, Nvidia так и не выпустила самую младшую видеокарту во флагманском семействе. По данным Videocardz, производители GPU не получали от компании никаких сведений об RTX 5050, поэтому можно предположить, что выход видюхи либо отложен на неопределенный срок, либо вовсе отменен.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯2👍1🍾1
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic представила Sonnet 5 — новую флагманскую нейронку с производительностью на уровне Opus 4.8, но с вдвое меньшими ценами за токены. На SWE-bench Pro модель набрала 63,2% против 58,1% у Sonnet 4.6 (Opus 4.8 — 69,2%). В TerminalBench 2.1 результат вырос до 80,4% против 67,0% (Opus — 82,7%). В Humanity's Last Exam Sonnet 5 получила 43,2% без инструментов и 57,4% с инструментами, практически сравнявшись с Opus 4.8 (57,9%).
До 31 августа 2026 года Sonnet 5 доступна по стоимости $2 за 1 миллион входных и $10 за 1 миллион выходных токенов. С 1 сентября цена вырастет до $3 и $15 соответственно. Для сравнения, Opus 4.8 стоит $5 долларов за 1 миллион входных и $25 долларов за 1 миллион выходных токенов
Модель уже доступна во всех тарифных планах — Free, Pro, Max, Team и Enterprise, а также в Claude Code и на веб-платформе Claude.
😅 Канал Serverflow в MAX: Подписаться
До 31 августа 2026 года Sonnet 5 доступна по стоимости $2 за 1 миллион входных и $10 за 1 миллион выходных токенов. С 1 сентября цена вырастет до $3 и $15 соответственно. Для сравнения, Opus 4.8 стоит $5 долларов за 1 миллион входных и $25 долларов за 1 миллион выходных токенов
Модель уже доступна во всех тарифных планах — Free, Pro, Max, Team и Enterprise, а также в Claude Code и на веб-платформе Claude.
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭5🍾4🤯3💩1
This media is not supported in your browser
VIEW IN TELEGRAM
Помимо Sonnet 5, вчерашний день порадовал еще одним ИИ-релизом, а если точнее, то сразу двумя — Google представила Nano Banana 2 Lite и Gemini Omni Flash, самые быстрые генеративные модели компании для создания изображений и видео.
Nano Banana 2 Lite ориентирована на максимально скорость и дешевую генерацию изображений: одно изображение создается примерно за 4 секунды, что в 5 раз быстрее предыдущей версии. Стоимость также снизилась — до $0,034 за 1000 изображений. API обойдется в $0,25 за 1 млн входных и $1,50 за 1 млн выходных токенов. Несмотря на упрощенную архитектуру и ограничение разрешением 1K, в рейтинге Arena Text-to-Image новинка даже немного опередила Nano Banana Pro.
Gemini Omni Flash предназначена для создания и редактирования видео по бюджетному прайсу. Модель умеет генерировать 10-секундные ролики с синхронизированным звуком, менять персонажей, освещение, стиль и ракурсы, сохраняя оригинальные аудио- и видеодорожки. Сейчас сервис поддерживает видео в 720p по цене $0,10 за секунду.
Обе модели уже начали внедрять в Gemini, AI Studio, Google Photos, AI Mode в поиске и другие сервисы Google.
😅 Канал Serverflow в MAX: Подписаться
Nano Banana 2 Lite ориентирована на максимально скорость и дешевую генерацию изображений: одно изображение создается примерно за 4 секунды, что в 5 раз быстрее предыдущей версии. Стоимость также снизилась — до $0,034 за 1000 изображений. API обойдется в $0,25 за 1 млн входных и $1,50 за 1 млн выходных токенов. Несмотря на упрощенную архитектуру и ограничение разрешением 1K, в рейтинге Arena Text-to-Image новинка даже немного опередила Nano Banana Pro.
Gemini Omni Flash предназначена для создания и редактирования видео по бюджетному прайсу. Модель умеет генерировать 10-секундные ролики с синхронизированным звуком, менять персонажей, освещение, стиль и ракурсы, сохраняя оригинальные аудио- и видеодорожки. Сейчас сервис поддерживает видео в 720p по цене $0,10 за секунду.
Обе модели уже начали внедрять в Gemini, AI Studio, Google Photos, AI Mode в поиске и другие сервисы Google.
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭3👍1💅1
ServerFlow | Новости и Железо 💾
Anthropic представила Sonnet 5 — новую флагманскую нейронку с производительностью на уровне Opus 4.8, но с вдвое меньшими ценами за токены. На SWE-bench Pro модель набрала 63,2% против 58,1% у Sonnet 4.6 (Opus 4.8 — 69,2%). В TerminalBench 2.1 результат вырос…
Всего через 5 часов после релиза Sonnet 5, ИИ-энтузиасты смогли довести новую модель Anthropic до “джеилбрейка”. Похоже, что как бы компании ни пытались напичкать нейронку алгоритмами безопасности, удержать ее в узде не получится никогда. Будем надеяться, что Sonnet 5 не забанят из-за этого…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯5💅2👍1
Tesla наняла Гэри Цзяна, ветерана производства полупроводников, проработавшего почти 18 лет в Intel, на должность директора проекта по производству чипов на фабрике Terafab в Остине. Гэри Цзян был одним из ключевых разработчиков техпроцесса Intel 18A.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4💅2🌭1
ServerFlow | Новости и Железо 💾
Anthropic представила Sonnet 5 — новую флагманскую нейронку с производительностью на уровне Opus 4.8, но с вдвое меньшими ценами за токены. На SWE-bench Pro модель набрала 63,2% против 58,1% у Sonnet 4.6 (Opus 4.8 — 69,2%). В TerminalBench 2.1 результат вырос…
Кстати, “бюджетный” Sonnet 5 оказался в 1,2 раза дороже Opus 4.8 Max и в 2 раза дороже GPT-5.5-xhigh при расчете цены токенов на решенную задачу. Кроме того, многие пользователи жалуются, что модель не показывает высокой производительности в агентных задачах и программировании, и даже заявляют, что открытая GLM-5.2 выглядит на фоне флагмана Anthropic в разы лучше.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🌭1💅1
Google отчиталась о запуске Gemma 4 31B на вычислительных мощностях чипов Cerebras WSE-3. Получилось добиться феноменальной скорости вывода в 1800 токенов/с. Нейронка уже доступна для предварительного тестирования в облаке Cerebras ⚡️
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🌭2💅1
Anthropic наконец-то перевыпустила свою флагманскую нейронку Fable 5! С сегодняшнего дня модель доступна для всех юзеров, а в качестве моральной компенсации, компания снизила ограничения по недельным лимитам на 50% до 7 июля. Чтобы удовлетворить надзорные органы США, в нейрону зашили еще больше алгоритмов безопасности, так что принудительных переключений на Claude Opus 4.8 будет больше.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6💩3🌭2🍾2
Команда OGS установила новый рекорд разгона, первой преодолев отметку 4 ГГц на GALAX GeForce RTX 5090D HOF OC Lab с 36-фазной VRM, двумя 16-контактными разъемами питания и охлаждением жидким азотом. В тесте GPUPI 3.3 (32B) видеокарта достигла 4002 МГц, заняв первое место в рейтинге HWBOT.
Для достижения рекорда оверклокеры заменили штатный 27-МГц генератор на внешнюю плату Elmor ECB, подняв базовую частоту до 28,7 МГц (+6,3%). Это позволило увеличить частоты не только GPU, но и памяти GDDR7 — до 1860 МГц (около 30 Гбит/с против штатных 28 Гбит/с). По словам команды, с использованием ECB память можно разгонять вплоть до 2400 МГц (38,4 Гбит/с).
Предыдущий максимум для Blackwell составлял около 3,88 ГГц. Абсолютный рекорд частоты GPU по-прежнему принадлежит AMD — 4,769 ГГц, установленный ранее на Radeon RX 9060 XT.
😅 Канал Serverflow в MAX: Подписаться
Для достижения рекорда оверклокеры заменили штатный 27-МГц генератор на внешнюю плату Elmor ECB, подняв базовую частоту до 28,7 МГц (+6,3%). Это позволило увеличить частоты не только GPU, но и памяти GDDR7 — до 1860 МГц (около 30 Гбит/с против штатных 28 Гбит/с). По словам команды, с использованием ECB память можно разгонять вплоть до 2400 МГц (38,4 Гбит/с).
Предыдущий максимум для Blackwell составлял около 3,88 ГГц. Абсолютный рекорд частоты GPU по-прежнему принадлежит AMD — 4,769 ГГц, установленный ранее на Radeon RX 9060 XT.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🤯1💅1