Илон Маск показал первые фотографии Tesla A15, объявив разработку новейшего ИИ-чипа завершенной. На фото видно, что процессор окружен 12 чипами памяти LPDDR5 от SK Hynix — предположительно, общий объем оперативки составит 144 ГБ. Ожидается, что сам чип будет обеспечивать ИИ-производительность на уровне 2500 TFLOPS.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭4👍3
ServerFlow | Новости и Железо 💾
Илон Маск показал первые фотографии Tesla A15, объявив разработку новейшего ИИ-чипа завершенной. На фото видно, что процессор окружен 12 чипами памяти LPDDR5 от SK Hynix — предположительно, общий объем оперативки составит 144 ГБ. Ожидается, что сам чип будет…
К слову, нельзя не отметить сходство нового ИИ-чипа Tesla с CPU от PlayStation 5 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenAI выпустила GPT-5.4-Cyber — специализированную модель для задач кибербезопасности. По данным компании, нейронка умеет анализировать скомпилированные бинарники без исходного кода, искать вредоносные компоненты и потенциальные уязвимости — да-да, OpenAI просто решила повторить успех Claude Mythos, при этом сделав свою кибербез-нейронку доступной с первого дня. В обычный ChatGPT модель, конечно же, пока не попадет: доступ дают только верифицированным специалистам через программу Trusted Access for Cyber (видимо, из-за соображений безопасности 🫠). По данным компании, GPT-5.4-Cyber через Codex Security уже закрыла более 3 000 критических и серьезных уязвимостей, а результаты на CTF-задачах выросли с 27% до 76%.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾6👍1
На локальном мероприятии Cursor меню традиционно оформляют в формате JSON 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
По данным Board Channels, NVIDIA на две недели остановит поставки GeForce RTX 5060 Ti 8 ГБ в конце апреля. Это именно временная пауза для AIC-партнеров, после которой отгрузки возобновятся уже в первой половине мая. И дело даже не в дефиците, а скорее наоборот — Nvidia отгрузила слишком много GeForce RTX 5060 Ti и теперь пытается выровнять складские остатки, тем самым удерживая рынок от падения цен на младшую видеокарту серии RTX 5000.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Пользователи сообщают, что в некоторых регионах для оформления подписки на Claude требуется подтверждение личности 🫠
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯3🌭3💩1
This media is not supported in your browser
VIEW IN TELEGRAM
Google выпустила Gemini 3.1 Flash TTS —новейшую модель преобразования текста в речь. Нейронка поддерживает настройку уровня громкости, генерацию фоновых шумов, аудиотеги, широкий спектр тембров, голосов, интонаций и более 70 языков (включая русский). Модель доступна в отдельном аудиоразделе в Google AI Studio и в API Gemini.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6
Оказывается, что самые прибыльные акции 2025 года были у Sandisk — ценные бумаги компании прибавили в стоимости аж 2 850,77%. Конечно же, все благодаря дефициту памяти.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
По данным VideoCardz, Intel активно ведет разработку новой графической архитектуры Xe3P, которая будет использоваться исключительно в корпоративном и профессиональном сегменте — в потребительских видеокартах Intel Arc она не появится. Xe3P уже фигурирует в дорожной карте компании — она будет лежать в основе ИИ-ускорителей инференса Crescent Island. При этом обычный Xe3 останется в потребительском сегменте.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Claude Opus 4.7 замечен на Vertex AI. Возможно, релиз уже сегодня!
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4
This media is not supported in your browser
VIEW IN TELEGRAM
Сколько Вт может потреблять один серверный вентилятор в современном GPU шасси?
Ответ может шокировать неподготовленную публику...
374W 😱
(Именно в этом сервере не больше 240W)
😅 Канал Serverflow в MAX: Подписаться
Ответ может шокировать неподготовленную публику...
(Именно в этом сервере не больше 240W)
Please open Telegram to view this post
VIEW IN TELEGRAM
1 6🌭3👍2🤯1
Пустой M.2 теперь можно превратить в мини-LLM-ускоритель — компания Unigen показала компактные NPU-модуль Amaretti для инференса в формате формата M.2 / E1.S. Заявлены до 60 TOPS, 32 ГБ памяти LPDDR4X, 20 МБ SRAM и возможность крутить модели до 20 млрд параметров при энергопотреблении около 10 Вт. Для задач вроде RAG, агентных рабочих процессов, инференса на периферии и мобильных устройствах решение выглядит более чем достойно, а для более тяжелых ИИ-задач в системе остается полноценный слот PCIe x16 под GPU. Цены на решение пока не разглашают.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9 2
По данным утечки с Board Channels, которую подхватили Gazlog и профильные инсайдеры, NVIDIA может выпустить версии GeForce RTX 5060 и 5060 Ti с 9 ГБ памяти уже в мае-июне, вероятно ближе к Computex 2026. Видеокарты будут иметь три чипа GDDR7 по 3 ГБ на 96-битной шине, обеспечивая 9 ГБ VRAM и пропускную способность порядка 336 ГБ/с. Так Nvidia пытается решить 2 задачи: дать пользователям чуть больше видеопамяти для бюджетного сегмента и сократить себестоимость производства за счет перехода со 128-битной шины на 96-битную.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭2
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня проверим маленькие локальные LLM в агентских задачах ⚙️
Это и многое другое вы узнаете в новом видео!
🤖 Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/YI7Ps8z5d8k?si=G-zyzv45E-11hxj_
😅 Канал Serverflow в MAX: Подписаться
Сегодня проверим маленькие локальные LLM в агентских задачах ⚙️
- Реальный проект в OpenCode
- Web search и работа с JSON
- Benchmark на tool calling для локальных моделей
Это и многое другое вы узнаете в новом видео!
Смотреть: https://youtu.be/YI7Ps8z5d8k?si=G-zyzv45E-11hxj_
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
Маленькие LLM как агенты - тест локальных моделей до 8B
В этом видео тестирую маленькие локальные модели в реальных агентских задачах. Все модели запускаются через llama.cpp в GGUF и работают в OpenCode с одинаковым контекстом 64k, чтобы сравнение было максимально честным.
В тестах участвуют модели от 3B до 9B…
В тестах участвуют модели от 3B до 9B…
2🤯4
Anthropic официально представила Claude Opus 4.7 — апдейт не столько в производительности, сколько в агентной эффективности благодаря точному следованию инструкциям и стабильности на длинных контекстах.
Модель получила улучшенную мультимодальность с обработкой изображений до 2 576 px по длинной стороне, новый уровень размышления xhigh между high и max, а также обновленный токенизатор с приростом экономии токенов до 1,35× в зависимости от типа контента.
При этом цена API на Claude Opus 4.7 не изменилась в сравнении с Opus 4.6: $5 за 1 млн входных токенов и $25 за 1 млн выходных.
😅 Канал Serverflow в MAX: Подписаться
Модель получила улучшенную мультимодальность с обработкой изображений до 2 576 px по длинной стороне, новый уровень размышления xhigh между high и max, а также обновленный токенизатор с приростом экономии токенов до 1,35× в зависимости от типа контента.
Самое интересное — безопасность. Opus 4.7 стала первой публичной моделью Anthropic, где открыто применяются механизмы ограничения кибервозможностей, протестированные после анонса Mythos / Project Glasswing. Компания обкатывает защитные механизмы на более массовой модели, прежде чем двигать в публичный доступ системы Mythos-класса.
При этом цена API на Claude Opus 4.7 не изменилась в сравнении с Opus 4.6: $5 за 1 млн входных токенов и $25 за 1 млн выходных.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Проблема интернета будущего решена. Инженерный совет Интернета (IETF) представил новую концепцию протокола IP — IPv8. Ключевая особенность состоит в полной совместимости с адресами IPv4, он работает как склейка: первые 4 числа от 0 до 255 выступают идентификатором сети или оператора, а вторые 4 числа являются личным адресом устройства. В случае, если заменить первые идентификаторы на нули, то IP-адрес станет стандартным IPv4 и будет работать без изменений. В перспективе IPv8 может увеличить адресное пространство на 18 квинтиллионов уникальных айпишников, что навсегда решит вопрос дефицита адресов. И еще одна изюминка — IPv8 не требует поддержки со стороны оборудования, он работает на всем, что поддерживает IPv4, чего не скажешь про IPv6.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9