Gemini X Pro (moonbow)
Вчера на внутренних серверах DeepMind появился новый чек-поинт модели Gemini с кодовым именем «moonbow».
Доп. инфы нет — это очень свежая инфа.
Источник Leo - как всегда.
Вчера на внутренних серверах DeepMind появился новый чек-поинт модели Gemini с кодовым именем «moonbow».
Доп. инфы нет — это очень свежая инфа.
Источник Leo - как всегда.
Мои предположения: это может быть начальная стадия обучения следующей версии. Ранее я уже говорил, что Gemini 3.2 тоже не стоит исключать.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Сегодня выходит Gemma 4. Судя по утечкам, будут доступны две основные версии для локального запуска.
Разбор версий:
➕ Gemma-4-26b (MoE 4B) — 26 млрд параметров, но активны только 4 млрд. Дает интеллект большой модели при скорости маленькой. Работает на смартфонах с
➕ Gemma-4-31b-it (Dense) — Классическая модель, где все 31 млрд параметров работают одновременно. Точная, но требует
Я конечно не уверен, что будут именно эти. Могут быть и 2b и 4-6b с фулл активными, но Gemma-4-26b с 4 активными — это очень реальный исход.
Разбор версий:
~8–12 ГБ RAM.~24 ГБ RAM, иначе будет тормозить или вылетать.Я конечно не уверен, что будут именно эти. Могут быть и 2b и 4-6b с фулл активными, но Gemma-4-26b с 4 активными — это очень реальный исход.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Сегодня выходит Gemma 4. Судя по утечкам, будут доступны две основные версии для локального запуска. Разбор версий: ➕ Gemma-4-26b (MoE 4B) — 26 млрд параметров, но активны только 4 млрд. Дает интеллект большой модели при скорости маленькой. Работает на смартфонах…
Telegram
Светлый Уголок / Чат
Поделился dzdsa33
Светлый Уголок | ии
Сегодня выходит Gemma 4. Судя по утечкам, будут доступны две основные версии для локального запуска. Разбор версий: ➕ Gemma-4-26b (MoE 4B) — 26 млрд параметров, но активны только 4 млрд. Дает интеллект большой модели при скорости маленькой. Работает на смартфонах…
Несмотря на это, геммы там очень крутые, возможно это результат одной из них.
Forwarded from ✨AI Watchtower✨ (Arena Overseer)
🆕 New Google AI models available:
• gemma-4-26b-a4b-it
• gemma-4-31b-it
• gemma-4-26b-a4b-it
• gemma-4-31b-it
Светлый Уголок | ии
Сегодня выходит Gemma 4. Судя по утечкам, будут доступны две основные версии для локального запуска. Разбор версий: ➕ Gemma-4-26b (MoE 4B) — 26 млрд параметров, но активны только 4 млрд. Дает интеллект большой модели при скорости маленькой. Работает на смартфонах…
Думаю в течении некоторого времени нам так же будут доступны:
Gemma 4 ~120b
И более...
Gemma 4 ~120b
И более...
https://huggingface.co/collections/google/gemma-4
➕ gemma-4-31B-it — Большая
➕ gemma-4-31B — Большая
➕ gemma-4-26B-A4B-it — Большая
➕ gemma-4-26B-A4B — Большая
➕ gemma-4-E4B-it — Маленькая
➕ gemma-4-E4B — Маленькая
➕ gemma-4-E2B-it — Маленькая
➕ gemma-4-E2B — Маленькая
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
huggingface.co
Gemma 4 - a google Collection
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
❤🔥1
+ gemma-4-31b-it ИМЕЕТ ВСТРОЕННЫЙ ПОИСК! Это ещё лучше, интересно как она с ним справляется.
🤔7 1
Не могу поверить, что Gemma 4 31b (MoE) теперь числится как почти самая лучшая модель среди всех Open-Source нейронок на сегодняшний день. Примечательно, что ребята смогли выпустить не только 2 версии, а оказались ещё несколько, вплоть до
Давайте посмотрим простые общие бенчмарки именно Gemma 4 31b. Запомните важное: модель имеет 31 миллиард активных параметров, а также она думающая.
Давайте глянем на оригинальный небольшой график, который нам предоставила Google в сравнении с другими моделями. Посмотрите на общий ELO модели на картинке. По сути ELO — это рейтинг, который показывает силу модели на основе её побед и поражений в тестах с другими нейронками.
GPT OSS сразу отлетает. DeepSeek 3.2 thinking с 685 миллиардами параметров на последнем месте. Qwen 397 миллиардов параметров (MoE) с активными 17 миллиардами мог бы обогнать нашу маленькую модель, если бы сделали 30+ активных параметров. Но вот заметьте: у этой модели такие большие веса, и несмотря на маленькие активные параметры, имеет такой себе скор в Elo как и все из этого сравнения.
Дальше идет одна гемма 4, которую мы пропустим, потом идут мощные модели GLM 5 и KIMI K2.5, которые по идее должны соревноваться с Opus 4.5 хотя бы.
Посмотрим на текстовую арену. Вообще, их арена меня не всегда цепляет, люди могут по-разному тыкать на ответы из-за своей предвзятости к модели. Но всё равно ТЕКСТ ELO Open-Source Скор: НА 3 МЕСТЕ, уступая только
Я уже протестировал модель: 31b умная, хороший русский текст, неплохо понимает некоторые мемы, в стихах хороша (сойдет). Ленивая модель? Ленивая. Да фиг его знает, почему гуглы допускают такое. Но если попросить выводить больше, то следует инструкциям и выводит.
Дальше лучше. По крайней мере, SVG-контроллеры она выводит круто, на уровне примерно той же Gemini 3.0 Flash (НЕ 3.1 LITE!).
Artificial Analysis тестируют модель, и по некоторым данным Gemma 4 31B (Reasoning) является очень крутой и эффективной моделью по GPQA Diamond в использовании токенов.
Gemma 4-31b и Gemma 4-26b-a4b, в отличие от
Отличная агентная маленькая моделька, умная, ровная, пойдет на ваши телефоны. ЭТО СЕНСАЦИЯ. А если вы будете начинать с нее обучение своих будущих моделей, то, будучи перерожденным в китайца, вы обязательно дистиллируете её на Opus 5 и получите AGI.
2b моделек. Давайте посмотрим простые общие бенчмарки именно Gemma 4 31b. Запомните важное: модель имеет 31 миллиард активных параметров, а также она думающая.
Давайте глянем на оригинальный небольшой график, который нам предоставила Google в сравнении с другими моделями. Посмотрите на общий ELO модели на картинке. По сути ELO — это рейтинг, который показывает силу модели на основе её побед и поражений в тестах с другими нейронками.
GPT OSS сразу отлетает. DeepSeek 3.2 thinking с 685 миллиардами параметров на последнем месте. Qwen 397 миллиардов параметров (MoE) с активными 17 миллиардами мог бы обогнать нашу маленькую модель, если бы сделали 30+ активных параметров. Но вот заметьте: у этой модели такие большие веса, и несмотря на маленькие активные параметры, имеет такой себе скор в Elo как и все из этого сравнения.
Дальше идет одна гемма 4, которую мы пропустим, потом идут мощные модели GLM 5 и KIMI K2.5, которые по идее должны соревноваться с Opus 4.5 хотя бы.
Но учтите, в кодинге модель Gemma-4 и рядом не стояла с гигантами как GLM 5, QWEN или KIMI moonshot. Codeforces в 2150 баллов (Gemini 3.1 Pro — 2887 баллов). Это уровень программирования Master, но не очень солидно, таких параметров не хватает для больших кодовых баз. Но как агент, имба.
Посмотрим на текстовую арену. Вообще, их арена меня не всегда цепляет, люди могут по-разному тыкать на ответы из-за своей предвзятости к модели. Но всё равно ТЕКСТ ELO Open-Source Скор: НА 3 МЕСТЕ, уступая только
kimi-k2.5-thinking (которая больше на миллиарды параметров) и glm-5 754B. В русском языке вообще ПЕРВОЕ МЕСТО! Но опять же, предвзятость у людей разная, так что как считаются ответы, пока не очень важно.Если кому-то интересно, что за приписки IT у этих моделей, это Instruction-Tuned (дополнительно обучена следовать инструкциям). То есть модель была очень хорошо обучена, а значит, что то типа RL-обучения у команды Google хотя бы для маленьких моделей работает.
Я уже протестировал модель: 31b умная, хороший русский текст, неплохо понимает некоторые мемы, в стихах хороша (сойдет). Ленивая модель? Ленивая. Да фиг его знает, почему гуглы допускают такое. Но если попросить выводить больше, то следует инструкциям и выводит.
Дальше лучше. По крайней мере, SVG-контроллеры она выводит круто, на уровне примерно той же Gemini 3.0 Flash (НЕ 3.1 LITE!).
Artificial Analysis тестируют модель, и по некоторым данным Gemma 4 31B (Reasoning) является очень крутой и эффективной моделью по GPQA Diamond в использовании токенов.
Gemma 4-31b и Gemma 4-26b-a4b, в отличие от
2b или 4b, не имеют аудиовхода. Не знаю почему, но модель не способна принимать аудио. Картинки же принимать могут все четверки. Gemma 4-31b и Gemma 4-26b-a4b, на мой взгляд, самый идеальный вариант для старта разработки своей модели. Только вдумайтесь, на старте она выдает такие неплохие результаты, а логические выводы просто топ. Даже GPT 5.4 thinking в вебе не всегда может правильно с первого раза ответить на вопрос «Сколько лап у козла», сказав, что у козла ИМЕННО ЛАПЫ, а не ноги, в отличие от чистой Gemma 4-31b.
Отличная агентная маленькая моделька, умная, ровная, пойдет на ваши телефоны. ЭТО СЕНСАЦИЯ. А если вы будете начинать с нее обучение своих будущих моделей, то, будучи перерожденным в китайца, вы обязательно дистиллируете её на Opus 5 и получите AGI.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
GEMMA 4-124B (MoE) Подтверждена.
Там он упомянул про Gemma 4 с 124 миллиардами параметров с МоЕ.
Нас ждёт более крупная.💎
Jeff Dean, (Главный научный сотрудник Google DeepMind и Google Research), опубликовал пост, который был отредактирован/удален сразу после публикации.
Там он упомянул про Gemma 4 с 124 миллиардами параметров с МоЕ.
Нас ждёт более крупная.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥2
Светлый Уголок | ии
Прекрасно помню, что они готовятся выпустить отдельное приложение ChatGPT, в котором будет уже всё сразу: Codex, GPT Atlas Browser и другие
инструменты в одной вещи. Это будет очень крутое отличие от тех же Google и Anthropic — они буквально вырвутся вперед в данном плане.
инструменты в одной вещи. Это будет очень крутое отличие от тех же Google и Anthropic — они буквально вырвутся вперед в данном плане.
Codex V2?
Tibo (глав. Разработчик Codex) уже намекает на новый Codex v2. Однако мне же кажется, что они cooked нечто больше, чем новый Codex.
Ждём GPT Super App от OpenAi.
Tibo (глав. Разработчик Codex) уже намекает на новый Codex v2. Однако мне же кажется, что они cooked нечто больше, чем новый Codex.
Ждём GPT Super App от OpenAi.
❤🔥3
Светлый Уголок | ии
Ждете Grok Imagine 1.5? — Я да. Мне зашла эта модель. Маск снова сказал: «Следующий релиз @Grok Imagine будет эпическим. Мы удваиваем усилия». Значит ли это, что в ближайшее время мы увидим ещё более качественную версию модели? Видео-версию пока так и…
Илон Маск фактически подтвердил отмену версии Grok imagine 1.5.
Команда приступает к разработке версии Grok Imagine 2.0, для завершения проекта потребуется ещё несколько недель обучения.
Команда приступает к разработке версии Grok Imagine 2.0, для завершения проекта потребуется ещё несколько недель обучения.