На деле Alibaba выкатила Qwen3.8-Flash-Next — мультимодальную MoE, на которой обкатывают архитектуру будущей четвёрки. Веса уже в открытом доступе, в API модель обещают скоро, с совместимостью по формату OpenAI и Anthropic.
{
// ЧТО ВНУТРИ
├─ "ПАРАМЕТРЫ": 180 млрд всего, на токен работают 6
├─ "КОНТЕКСТ": 262144 токена, через "YaRN" тянется до 1000000
├─ "СКОРОСТЬ": на миллионе запрос быстрее в 7.6 раза, ответ в 4.9
├─ "ПАМЯТЬ": 51 млрд параметров живут в "оперативке", а не в "VRAM"
├─ "ОБУЧЕНИЕ": в 9 раз дешевле Qwen3.7-Plus за счёт "FP8" и "Muon"
└─ "ЦЕНА": 0.16 за миллион входных токенов и 0.47 за выходные
}По заявленным бенчам — 58,7 на DeepSWE 1.1 и 62,5 на SWE-bench Pro. Независимых прогонов пока нет.
Ссылки
├─ [Hugging Face]
└─ [ModelScope]
#новости #qwen #модели
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Речь про GLM-5.3-Flash — ту самую анонимную Ox Alpha, что месяц шифровалась на OpenRouter. Z.ai выложила веса под MIT, забирать может кто угодно.
{
// ЧТО ЗА МОДЕЛЬ
├─ "РАЗМЕР": 320 млрд параметров, активных 18 млрд, контекст до 1000000
├─ "ЗРЕНИЕ": первая нативно мультимодальная в серии — смотрит на отрендеренный интерфейс и сама правит код
├─ "КОДИНГ": 63.4 на "DeepSWE" против 58.0 у "Opus 4.8" и 46.2 у прошлой "GLM-5.2"
├─ "ЦЕНА": 0.15 за вход, 0.50 за выход, 0.03 за кэшированный вход
└─ "ЛОКАЛЬНО": запуск через "SGLang", "vLLM", "TokenSpeed" или "KTransformers"
}За шесть дней бесплатного доступа на OpenCode модель прожевала 42 трлн токенов и вышла на первое место по использованию. На OpenRouter — крупнейший запуск в истории площадки.
#новости #glm #модели
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👀1
Anthropic слила память чата и Cowork в одну. Обсудил проект в переписке — агент берётся за задачу уже с этим контекстом, объяснять заново не надо.
▾ Как устроено ▾
▸ память лежит темами — список файлов в настройках, каждый читается, правится и удаляется
▸ пишется на ходу, а не пересказом после чата: сказал про сдвиг дедлайна — следующий разговор уже в курсе
▸ чувствительное по умолчанию не сохраняется — здоровье, вера, политика, гендер; включается вручную
▸ часть не пишется никогда — номера документов, судимости, миграционный статус
▸ включено на Free, Pro и Max, а в Team и Enterprise рубильник у админа
Поправил в одном файле старое название конторы — и оно больше не всплывёт ни в одном разговоре.
#новости #claude #anthropic
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔1
Уилл Смит с макаронами отработал своё, теперь модели проверяют на толпе, сыплющейся с высоты. 20-секундный ролик собран в FLUX 3, восьмисекундный — в MiniMax H3.
У FLUX местами вышла готовая сцена для бюджетного хоррора.
#юмор #нейросети #видео
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤡1👀1
Claude Academy переехала в отдельный пункт меню. Внутри официальные курсы, туториалы и разборы кейсов — те же, по которым в конторе натаскивают своих сотрудников.
▾ Что внутри ▾
▸ треки по продуктам — Claude.ai, Cowork, Claude Code, Agent Skills, MCP и платформа
▸ квизы и бейджи за прохождение, дальше система сама подкидывает следующий курс
▸ читать можно без регистрации — вход нужен только чтобы сохранялся прогресс
▸ всё на английском — русской версии нет, переключателя языка тоже
▸ бесплатно, но часть курсов требует платный план самого продукта
Самое полезное там — не про кнопки, а про то, как резать задачу между агентами и не топить контекст.
Ссылки
└─ [Сайт]
#курсы #anthropic #халява
Please open Telegram to view this post
VIEW IN TELEGRAM
Сумму набираем сами, получателю прилетает ссылка на активацию. Дарить может подписка Plus или Pro, а вот принять подарок вправе любой личный аккаунт, включая бесплатный.
▾ Что учесть ▾
▸ валюта должна совпадать — аккаунт получателя обязан работать в той же, иначе подарок не примут
▸ не забрали за 30 дней — ссылка сгорает, деньги автоматом возвращаются на карту
▸ активированные кредиты живут год и не переносятся дальше
▸ после активации возврата нет — покупка становится окончательной
▸ подарок одноразовый: забрал один аккаунт — второму уже не достанется
Заодно способ закинуть кредиты себе же на другой аккаунт — правилами это прямо разрешено.
#новости #openai #chatgpt
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2🤔1
Пользователи заметили, что у Fable 5 сдвинулась дата обучения: модель знает то, чего по паспорту знать не должна. Отсюда и вывод, что часть запросов молча уводят на следующую версию.
Anthropic ничего не подтверждала — ни в каталоге моделей, ни в релиз-нотах, ни в прайсе строки про 5.1 нет. Слухи ходят с июля: называли август и ту же цену, что у пятёрки.
Так обычно и выглядит подготовка к запуску: сначала тихо подменяют движок, потом выкатывают анонс.
#новости #claude #слухи
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👀1
Весь метод: перечислить игры, которые нравятся, а потом сказать модели, что она сделала херню и пусть переделывает.
Так теперь выглядит элитная разработка. Сеньоры, вы всё это время просто были детьми с ипотекой.
#юмор #вайбкодинг #нейросети
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣1
Шлюз AIHubMix раздаёт бесплатный доступ к моделям через один ключ и один OpenAI-совместимый адрес. Регистрация по почте, платёжку никто не спрашивает.
▾ Что дают ▾
▸ полсотни моделей в бесплатном списке — Kimi K3, GLM 5.2, Gemini 3.7 Flash, MiniMax M3, Xiaomi MiMo и прочие
▸ миллион токенов контекста у Kimi K3 и Gemini — целые репозитории лезут целиком
▸ лимит на аккаунт — 5 запросов в минуту, 500 в сутки, миллион токенов в день на все бесплатные модели разом
▸ подхватывается везде, где принимают ключ OpenAI: Cline, Cursor, свои скрипты
▸ бесплатно, но за стабильность никто не ручается — на пике ловим 429
Base URL: https://aihubmix.com/v1
Площадка китайская и без КВН может не открыться — тогда пробуем запасной адрес api.inferera.com.
Ссылки
└─ [Сайт]
#халява #api #модели
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2❤1
Jalapeño прогнали на публичном бенче InferenceX против GB200 и GB300 — и он выиграл разом по скорости ответа и по работе на ватт.
{
// ЧТО ЗА ЧИП
├─ "ЖЕЛЕЗО": 216 гигабайт "HBM4" на чип, до 13.4 PFLOP/s в "mxfp4", паспортные 700 Вт
├─ "ПРОТИВ GB200": в 1.9 раза больше токенов на киловатт, задержка ниже в 1.7 раза
├─ "ПРОТИВ GB300": на "DeepSeek R1" задержка ниже в 3.6 раза при вдвое меньшем аппетите
├─ "СРОКИ": от эскиза до тейпаута 9 месяцев, первые чипы приехали в мае
└─ "ПЛАНЫ": разворачивают у себя до конца года, второе поколение уже в работе
}Чип проектировали с помощью своих же моделей, и на отдельных блоках GPT-OSS машинный код обошёл написанный живыми инженерами в 1.5–1.8 раза.
😱 — Nvidia напряглась
🤔 — на своих бенчах все чемпионы
#новости #openai #железо
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1😭1