Светлый Уголок | ии
Примеры работы текущей версии из Vertex:
Но в приложении Gemini у некоторых появилось кое-что покруче. Там стоит немного другая Gemini 3.1.
В комментариях покажу сравнение этих двух версий.
#Новости
Автор — @Geometry90
Но в приложении Gemini у некоторых появилось кое-что покруче. Там стоит немного другая Gemini 3.1.
В комментариях покажу сравнение этих двух версий.
#Новости
Автор — @Geometry90
Светлый Уголок | ии
Media is too big
VIEW IN TELEGRAM
Вот вам World of Tanks в 2д формате.
Это просто нечто!
Во время разработки проще всего было заставить его писать больше кода. Иногда он сокращал его, иногда делал ошибки, но он очень хорошо исправлял всё!
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥6👍3
Светлый Уголок | ии
Media is too big
VIEW IN TELEGRAM
Офигеть... Это не то что бы ваншот, это какой то прорыв...
Работа не моя, чувак поделился в одном из чатов.
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Идите проверяйте, пробуйте, разрабатывайте!
#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥1
Бенчмарки Gemini 3.1 pro
#Стрим
Автор — @Geometry90
Обратите внимание на:
— Прошла hle на 44.4%
— ARC-AGI-2 77.1% – это большой отрыв
— SWE-Bench 80.6%, что хуже чем у последней Opus на 0.2%
— LiveCodeBench Pro — 2887
#Стрим
Автор — @Geometry90
👍3
В рейтинге Artificial Analysis новая Gemini 3.1 Pro Preview набрала 57 баллов и заняла первое место.
Отрыв от конкурентов небольшой,
но уверенный.
#Стрим
Автор — @Geometry90
Отрыв от конкурентов небольшой,
но уверенный.
#Стрим
Автор — @Geometry90
Судя по графику (Omniscience Hallucination Rate), уровень галлюцинаций у новой модели заметно снизился.
Отличный результат!
#Стрим
Автор — @Geometry90
Отличный результат!
#Стрим
Автор — @Geometry90
👍6
А вот на Chatbot Arena в категории работы с текстом (Text Arena) Gemini 3.1 Pro Preview пока стартует только с 3-го места.
#Стрим
Автор — @Geometry90
#Стрим
Автор — @Geometry90
В категории кодинга (Code Arena / Agentic Webdev) она вообще оказалась на 6-м месте. Получается, новая Gemini доминирует далеко не везде.
Как так-то?😱
#Стрим
Автор — @Geometry90
Как так-то?
#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Зато бенчмарк ARC-AGI-1 новая Gemini 3.1 Pro порвала!
Тест пройден практически полностью. (96%)
Там модель бьётся в потолок, выжимать из этого бенчмарка буквально больше нечего. Пока-пока arc agi 1.
#Стрим
Автор — @Geometry90
Тест пройден практически полностью. (96%)
Там модель бьётся в потолок, выжимать из этого бенчмарка буквально больше нечего. Пока-пока arc agi 1.
#Стрим
Автор — @Geometry90
🍓4🤔1
Gemini 3.1 Pro стала менее эмоциональной и креативной, чем 3.0 Pro.
В некоторых случаях даже хуже 2.5 pro.
Этому поспособствовало снижение количества галлюцинаций.
Некоторые пользователи отмечают, что текст стал ужасным и однообразным.
#Новости
Автор — @Geometry90
В некоторых случаях даже хуже 2.5 pro.
Этому поспособствовало снижение количества галлюцинаций.
Некоторые пользователи отмечают, что текст стал ужасным и однообразным.
#Новости
Автор — @Geometry90
Сегодня выходит тот самый апдейт для Google AI studio + antigravity.
По крайней мере только для ai.dev
Если Logan Kirkpatrick написал это у себя, (а написал он это впервые), то значит, что будет что-то масштабное.
P.s — что-то долго не выходит.
#Новости
Автор — @Geometry90
По крайней мере только для ai.dev
Если Logan Kirkpatrick написал это у себя, (а написал он это впервые), то значит, что будет что-то масштабное.
P.s — что-то долго не выходит.
#Новости
Автор — @Geometry90
❤🔥2
Forwarded from Светлая комната — архив
Gemini 3.1 стала хуже в математике.
Буквально:
У меня уже возникла проблема, когда я попросил модель решить задачку уровня 7-го класса — она не смогла решить её правильно.
Вдобавок:
Если попросить модель сложить
9+10, то в некоторых случаях она будет выдавать ТОЛЬКО 21. Дожили.
Это единичный случай, видимо, проблема в том, что она считает, что ты спрашиваешь про какой-то там мем «21».
А вчера она выдала мне 2 + 2 = 5 спустя 3–4 запроса. Я обсуждал с ней другой новый мем и решил уточнить, сколько будет 2 + 2, на что она ответила: «5». Когда я спросил «почему?», она заявила, что просто "подыгрывала", "ну мы же ведь шутили".
AGI, не иначе!
Буквально:
У меня уже возникла проблема, когда я попросил модель решить задачку уровня 7-го класса — она не смогла решить её правильно.
Вдобавок:
Если попросить модель сложить
9+10, то в некоторых случаях она будет выдавать ТОЛЬКО 21. Дожили.
Это единичный случай, видимо, проблема в том, что она считает, что ты спрашиваешь про какой-то там мем «21».
А вчера она выдала мне 2 + 2 = 5 спустя 3–4 запроса. Я обсуждал с ней другой новый мем и решил уточнить, сколько будет 2 + 2, на что она ответила: «5». Когда я спросил «почему?», она заявила, что просто "подыгрывала", "ну мы же ведь шутили".
AGI, не иначе!
🤔3
Светлая комната — архив
Gemini 3.1 стала хуже в математике. Буквально: У меня уже возникла проблема, когда я попросил модель решить задачку уровня 7-го класса — она не смогла решить её правильно. Вдобавок: Если попросить модель сложить 9+10, то в некоторых случаях она будет выдавать…
Юзайте эту модельку, не бросайте сразу. Найдите ей применение.
Она уникальна и отлично сбалансирована. Лично я ставлю её сразу после Claude 4.6 Opus, тупо потому что она бесплатная и доступна везде, и опять же уникальна в SVG.
Нынешние скачки качества — это плата за стабильность. Реальные улучшения мы увидим со следующим апдейтом (по секрету: уже в этом месяце).
Пока же Google слишком медленно шли к Gemini 3.1 Pro, ииии, прогресс мизерный короче, поэтому это лишь версия «3.1».
Моё мнение: модели Gemini мощные, но концептуально неудачные.
А теперь, когда упёрлись в потолок, им приходится мириться с тем, что их модель вообще нигде не на первом месте. И сотрудников DeepMind это реально бесит, я понял это, когда Logan оправдывался в X.
Но, вероятно, они всё же пилят что-то новое. Вспомните осенний претрейн: аналитики из Artificial Analysis заметили, что Google не просто тюнит старое, а создает новую базу. Возможно, конечно же, там было именно RL-дообучение, (для этого требуется запускать что-то вроде специальных агентов. Это мощно), и сделало ту же Gemini 3 Flash такой сильной.
Google буквально дышит в спину ChatGPT, ещё немного — и могли бы порвать всех. Но конкуренция жестока. А вообще, я знаю в каком направлении идут модели Gemini – это очень сильно продвигает к AGI. Но об этом позже.
Гуглу пора задушить свою бюрократию, начать развивать продукты и нанять нормальных спецов, а не геев идиотов, которые пишут тупые промпты для Gemini App и безнадёжно сливают конкурентам по функционалу. Это просто ужасно.
Я ещё плотно потестирую модель и найду все её "проёбы". И тогда мы решим: стоит ли дальше фанатеть от уникальности Google? Особенно когда Claude 4.6 Opus ВДРУГ уделывает их в математике вместе с GPT-X High, а обновленный Sonnet 4.6 неплох, и уже не уровне gemini 3 во фронтенд-дизайне. Если Гугл не проснётся, вердикт будет таким: их нейронка годится только для разовых запросов. Никаких долгих диалогов и глубокой работы — просто крутая бесплатная игрушка на один раз, и всё.
И это ЛИШЬ половина моих мыслей. Обязательно выкачу полноценный обзор, ведь я всё-таки остаюсь фанатом Gemini.🤫
#Мысли
Автор — @Geometry90
Она уникальна и отлично сбалансирована. Лично я ставлю её сразу после Claude 4.6 Opus, тупо потому что она бесплатная и доступна везде, и опять же уникальна в SVG.
Нынешние скачки качества — это плата за стабильность. Реальные улучшения мы увидим со следующим апдейтом (по секрету: уже в этом месяце).
Пока же Google слишком медленно шли к Gemini 3.1 Pro, ииии, прогресс мизерный короче, поэтому это лишь версия «3.1».
Моё мнение: модели Gemini мощные, но концептуально неудачные.
Кажется, после версии 2.0 они забили на новую архитектуру и просто заливали версии 2.5, 3.0 и 3.1 сырыми вычислительными мощностями.
А теперь, когда упёрлись в потолок, им приходится мириться с тем, что их модель вообще нигде не на первом месте. И сотрудников DeepMind это реально бесит, я понял это, когда Logan оправдывался в X.
Но, вероятно, они всё же пилят что-то новое. Вспомните осенний претрейн: аналитики из Artificial Analysis заметили, что Google не просто тюнит старое, а создает новую базу. Возможно, конечно же, там было именно RL-дообучение, (для этого требуется запускать что-то вроде специальных агентов. Это мощно), и сделало ту же Gemini 3 Flash такой сильной.
Google буквально дышит в спину ChatGPT, ещё немного — и могли бы порвать всех. Но конкуренция жестока. А вообще, я знаю в каком направлении идут модели Gemini – это очень сильно продвигает к AGI. Но об этом позже.
Гуглу пора задушить свою бюрократию, начать развивать продукты и нанять нормальных спецов, а не геев идиотов, которые пишут тупые промпты для Gemini App и безнадёжно сливают конкурентам по функционалу. Это просто ужасно.
Я ещё плотно потестирую модель и найду все её "проёбы". И тогда мы решим: стоит ли дальше фанатеть от уникальности Google? Особенно когда Claude 4.6 Opus ВДРУГ уделывает их в математике вместе с GPT-X High, а обновленный Sonnet 4.6 неплох, и уже не уровне gemini 3 во фронтенд-дизайне. Если Гугл не проснётся, вердикт будет таким: их нейронка годится только для разовых запросов. Никаких долгих диалогов и глубокой работы — просто крутая бесплатная игрушка на один раз, и всё.
И это ЛИШЬ половина моих мыслей. Обязательно выкачу полноценный обзор, ведь я всё-таки остаюсь фанатом Gemini.
#Мысли
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥5 1
Я знаю, что знают те ребята. Так что эти намёки действительно оправданы.
#Новости
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
Во-первых: Демис Хассабис, когда был в Индии на днях, заявил о скором выпуске новой модели Gemma: «...Мы работаем над собственной моделью с открытым исходным кодом, Gemma, и скоро выпустим новую версию, которая будет очень мощной для периферийных устройств».
Во-вторых, скоро релиз Open-source гиганта — deepseek v4. По-моему, им всегда было пофиг, но не в этот раз.
Хоть какие то намёки хотя бы есть.
Значит скоро. Интересно, после gemini 3 на что вы надеетесь с Gemma 4?
Источник
#Новости / #Инсайд
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥3 2👍1