Media is too big
VIEW IN TELEGRAM
Nvidia выпустила Ising — первое в мире семейство открытых ИИ-моделей, которые можно запускать на квантовых компьютерах. В ассортимент входит MoE-модель с 35 миллиардами общих и 3 миллиардами активных параметров, а также модель-декодер и модель-калибровщик.
Передовые нейронки обеспечивают в 2,5 раза более быстрое и в 3 раза более точное декодирование с исправлением квантовых ошибок декогеренции, а также обеспечивают полную автоматизацию процесса калибровки, что позволяет сократить время настройки сложнейших QPU-систем с нескольких дней до нескольких часов.
😅 Канал Serverflow в MAX: Подписаться
Передовые нейронки обеспечивают в 2,5 раза более быстрое и в 3 раза более точное декодирование с исправлением квантовых ошибок декогеренции, а также обеспечивают полную автоматизацию процесса калибровки, что позволяет сократить время настройки сложнейших QPU-систем с нескольких дней до нескольких часов.
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭4👍3
Apple разрабатывает новый мини-ПК Mac Neo бюджетного класса. По данным инсайдеров, устройство базируется на чипе A19 Pro, который также используется в iPhone 17 Pro, и будет иметь 12 ГБ оперативной памяти LPDDR. Энергопотребление составит 35 Вт. Стоить столь необычное решение будет от $300 до $400.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7 3💩1
Илон Маск показал первые фотографии Tesla A15, объявив разработку новейшего ИИ-чипа завершенной. На фото видно, что процессор окружен 12 чипами памяти LPDDR5 от SK Hynix — предположительно, общий объем оперативки составит 144 ГБ. Ожидается, что сам чип будет обеспечивать ИИ-производительность на уровне 2500 TFLOPS.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭4👍3
ServerFlow | Новости и Железо 💾
Илон Маск показал первые фотографии Tesla A15, объявив разработку новейшего ИИ-чипа завершенной. На фото видно, что процессор окружен 12 чипами памяти LPDDR5 от SK Hynix — предположительно, общий объем оперативки составит 144 ГБ. Ожидается, что сам чип будет…
К слову, нельзя не отметить сходство нового ИИ-чипа Tesla с CPU от PlayStation 5 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenAI выпустила GPT-5.4-Cyber — специализированную модель для задач кибербезопасности. По данным компании, нейронка умеет анализировать скомпилированные бинарники без исходного кода, искать вредоносные компоненты и потенциальные уязвимости — да-да, OpenAI просто решила повторить успех Claude Mythos, при этом сделав свою кибербез-нейронку доступной с первого дня. В обычный ChatGPT модель, конечно же, пока не попадет: доступ дают только верифицированным специалистам через программу Trusted Access for Cyber (видимо, из-за соображений безопасности 🫠). По данным компании, GPT-5.4-Cyber через Codex Security уже закрыла более 3 000 критических и серьезных уязвимостей, а результаты на CTF-задачах выросли с 27% до 76%.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾6👍1
На локальном мероприятии Cursor меню традиционно оформляют в формате JSON 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
По данным Board Channels, NVIDIA на две недели остановит поставки GeForce RTX 5060 Ti 8 ГБ в конце апреля. Это именно временная пауза для AIC-партнеров, после которой отгрузки возобновятся уже в первой половине мая. И дело даже не в дефиците, а скорее наоборот — Nvidia отгрузила слишком много GeForce RTX 5060 Ti и теперь пытается выровнять складские остатки, тем самым удерживая рынок от падения цен на младшую видеокарту серии RTX 5000.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Пользователи сообщают, что в некоторых регионах для оформления подписки на Claude требуется подтверждение личности 🫠
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯3🌭3💩1
This media is not supported in your browser
VIEW IN TELEGRAM
Google выпустила Gemini 3.1 Flash TTS —новейшую модель преобразования текста в речь. Нейронка поддерживает настройку уровня громкости, генерацию фоновых шумов, аудиотеги, широкий спектр тембров, голосов, интонаций и более 70 языков (включая русский). Модель доступна в отдельном аудиоразделе в Google AI Studio и в API Gemini.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6
Оказывается, что самые прибыльные акции 2025 года были у Sandisk — ценные бумаги компании прибавили в стоимости аж 2 850,77%. Конечно же, все благодаря дефициту памяти.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
По данным VideoCardz, Intel активно ведет разработку новой графической архитектуры Xe3P, которая будет использоваться исключительно в корпоративном и профессиональном сегменте — в потребительских видеокартах Intel Arc она не появится. Xe3P уже фигурирует в дорожной карте компании — она будет лежать в основе ИИ-ускорителей инференса Crescent Island. При этом обычный Xe3 останется в потребительском сегменте.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Claude Opus 4.7 замечен на Vertex AI. Возможно, релиз уже сегодня!
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4
This media is not supported in your browser
VIEW IN TELEGRAM
Сколько Вт может потреблять один серверный вентилятор в современном GPU шасси?
Ответ может шокировать неподготовленную публику...
374W 😱
(Именно в этом сервере не больше 240W)
😅 Канал Serverflow в MAX: Подписаться
Ответ может шокировать неподготовленную публику...
(Именно в этом сервере не больше 240W)
Please open Telegram to view this post
VIEW IN TELEGRAM
1 6🌭3👍2🤯1
Пустой M.2 теперь можно превратить в мини-LLM-ускоритель — компания Unigen показала компактные NPU-модуль Amaretti для инференса в формате формата M.2 / E1.S. Заявлены до 60 TOPS, 32 ГБ памяти LPDDR4X, 20 МБ SRAM и возможность крутить модели до 20 млрд параметров при энергопотреблении около 10 Вт. Для задач вроде RAG, агентных рабочих процессов, инференса на периферии и мобильных устройствах решение выглядит более чем достойно, а для более тяжелых ИИ-задач в системе остается полноценный слот PCIe x16 под GPU. Цены на решение пока не разглашают.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9 2
По данным утечки с Board Channels, которую подхватили Gazlog и профильные инсайдеры, NVIDIA может выпустить версии GeForce RTX 5060 и 5060 Ti с 9 ГБ памяти уже в мае-июне, вероятно ближе к Computex 2026. Видеокарты будут иметь три чипа GDDR7 по 3 ГБ на 96-битной шине, обеспечивая 9 ГБ VRAM и пропускную способность порядка 336 ГБ/с. Так Nvidia пытается решить 2 задачи: дать пользователям чуть больше видеопамяти для бюджетного сегмента и сократить себестоимость производства за счет перехода со 128-битной шины на 96-битную.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭2
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня проверим маленькие локальные LLM в агентских задачах ⚙️
Это и многое другое вы узнаете в новом видео!
🤖 Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/YI7Ps8z5d8k?si=G-zyzv45E-11hxj_
😅 Канал Serverflow в MAX: Подписаться
Сегодня проверим маленькие локальные LLM в агентских задачах ⚙️
- Реальный проект в OpenCode
- Web search и работа с JSON
- Benchmark на tool calling для локальных моделей
Это и многое другое вы узнаете в новом видео!
Смотреть: https://youtu.be/YI7Ps8z5d8k?si=G-zyzv45E-11hxj_
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
Маленькие LLM как агенты - тест локальных моделей до 8B
В этом видео тестирую маленькие локальные модели в реальных агентских задачах. Все модели запускаются через llama.cpp в GGUF и работают в OpenCode с одинаковым контекстом 64k, чтобы сравнение было максимально честным.
В тестах участвуют модели от 3B до 9B…
В тестах участвуют модели от 3B до 9B…
2🤯4
Anthropic официально представила Claude Opus 4.7 — апдейт не столько в производительности, сколько в агентной эффективности благодаря точному следованию инструкциям и стабильности на длинных контекстах.
Модель получила улучшенную мультимодальность с обработкой изображений до 2 576 px по длинной стороне, новый уровень размышления xhigh между high и max, а также обновленный токенизатор с приростом экономии токенов до 1,35× в зависимости от типа контента.
При этом цена API на Claude Opus 4.7 не изменилась в сравнении с Opus 4.6: $5 за 1 млн входных токенов и $25 за 1 млн выходных.
😅 Канал Serverflow в MAX: Подписаться
Модель получила улучшенную мультимодальность с обработкой изображений до 2 576 px по длинной стороне, новый уровень размышления xhigh между high и max, а также обновленный токенизатор с приростом экономии токенов до 1,35× в зависимости от типа контента.
Самое интересное — безопасность. Opus 4.7 стала первой публичной моделью Anthropic, где открыто применяются механизмы ограничения кибервозможностей, протестированные после анонса Mythos / Project Glasswing. Компания обкатывает защитные механизмы на более массовой модели, прежде чем двигать в публичный доступ системы Mythos-класса.
При этом цена API на Claude Opus 4.7 не изменилась в сравнении с Opus 4.6: $5 за 1 млн входных токенов и $25 за 1 млн выходных.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM