Please open Telegram to view this post
VIEW IN TELEGRAM
Правда, раскатка странная — у меня её, например, нет.
Короче, чекайте у себя: выбирайте режим Pro, пробуйте что-то сгенерить и сравните ответы с версией из AI Studio.
P.S. — Судя по последней инфе, Google вообще откатил её обратно и прикрыл лавочку.
#Стрим #Инсайд
Please open Telegram to view this post
VIEW IN TELEGRAM
Сундар Пичаи, Александр Ванг, Сэм Альтман и Дарио Амодей (там еще и Демис был).
Конкретно на этой картинке мы видим этих мальчиков: с Моди за ручки встали Сэм Альтман и Сундар Пичаи.
Но как же смешно, что Сэм наотрез отказался браться за ручки с Дарио Амодеем, хахаха! Вы просто посмотрите на это видео, смех да и только.
А вообще там много чего интересного рассказали, я вам обязательно распишу, что да как.
Саммит
Их Ютуб
#Новости
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
😁4 1
Начну с неприятного. Очевидно, Gemini 3 Pro намеренно ослабили, чтобы на фоне 3.1 была видна разница. Это некрасиво. Можно, конечно, списать на «нехватку мощностей, пришлось так сделать».
Теперь к хорошему. Похоже, саму 3.1 ослаблять не стали. Модель получила очень серьёзное улучшение даже по сравнению с лучшими контрольными точками вроде x28 и ECP. Это заслуженный плюс.
В SVG — модель делает их очень хорошо. Но тут всё завязано на промт. Она может выдать либо что-то неудовлетворительное, либо результат, который ваншотает всех и вся. Проблема в том, что хочется стабильности, чтобы ваншоты были всегда.
И знаете. У Claude это есть. У Gemini — пока нет.
Про агентные способности. Тут модель оказалась сильной и вполне может стать настоящим соперником Claude Opus 4.6 и GPT 5.3. Галлюцинации остались, но и снизились — и это уже хорошо.
По первым впечатлениям в опыте. Попробовал сделать симулятор танков в HTML. Поначалу модель вела себя очень лениво. Но через 3–4 промта я добился результата, который вам сейчас никакая другая нейронка не выдаст. В агентных задачах она вам точно понравится. Но точно ли он будет хорош в них? Неизвестно.
Но. Она всё ещё несовершенна — как и новый DeepThink. В некоторых задачах проигрывает ChatGPT 5.2, которая вам так всем зашла в логических задачах.
Итог — очень хорошая модель.
#Мысли / #Новости
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥5
Переходите по ссылке и пробуйте.
Напомню, что модель всё ещё не вышла и бенчмарков, по крайней мере «настоящих», пока что нет, ожидаем в ближайшие 2-3 часа.
P.s — По тестам, это даже не похоже на gemini 3.1. Так что лучше не используйте ничего там.
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Примеры работы текущей версии из Vertex:
Но в приложении Gemini у некоторых появилось кое-что покруче. Там стоит немного другая Gemini 3.1.
В комментариях покажу сравнение этих двух версий.
#Новости
Автор — @Geometry90
Но в приложении Gemini у некоторых появилось кое-что покруче. Там стоит немного другая Gemini 3.1.
В комментариях покажу сравнение этих двух версий.
#Новости
Автор — @Geometry90
Светлый Уголок | ии
Media is too big
VIEW IN TELEGRAM
Вот вам World of Tanks в 2д формате.
Это просто нечто!
Во время разработки проще всего было заставить его писать больше кода. Иногда он сокращал его, иногда делал ошибки, но он очень хорошо исправлял всё!
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥6👍3
Светлый Уголок | ии
Media is too big
VIEW IN TELEGRAM
Офигеть... Это не то что бы ваншот, это какой то прорыв...
Работа не моя, чувак поделился в одном из чатов.
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Идите проверяйте, пробуйте, разрабатывайте!
#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥1
Бенчмарки Gemini 3.1 pro
#Стрим
Автор — @Geometry90
Обратите внимание на:
— Прошла hle на 44.4%
— ARC-AGI-2 77.1% – это большой отрыв
— SWE-Bench 80.6%, что хуже чем у последней Opus на 0.2%
— LiveCodeBench Pro — 2887
#Стрим
Автор — @Geometry90
👍3
В рейтинге Artificial Analysis новая Gemini 3.1 Pro Preview набрала 57 баллов и заняла первое место.
Отрыв от конкурентов небольшой,
но уверенный.
#Стрим
Автор — @Geometry90
Отрыв от конкурентов небольшой,
но уверенный.
#Стрим
Автор — @Geometry90
Судя по графику (Omniscience Hallucination Rate), уровень галлюцинаций у новой модели заметно снизился.
Отличный результат!
#Стрим
Автор — @Geometry90
Отличный результат!
#Стрим
Автор — @Geometry90
👍6
А вот на Chatbot Arena в категории работы с текстом (Text Arena) Gemini 3.1 Pro Preview пока стартует только с 3-го места.
#Стрим
Автор — @Geometry90
#Стрим
Автор — @Geometry90
В категории кодинга (Code Arena / Agentic Webdev) она вообще оказалась на 6-м месте. Получается, новая Gemini доминирует далеко не везде.
Как так-то?😱
#Стрим
Автор — @Geometry90
Как так-то?
#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Зато бенчмарк ARC-AGI-1 новая Gemini 3.1 Pro порвала!
Тест пройден практически полностью. (96%)
Там модель бьётся в потолок, выжимать из этого бенчмарка буквально больше нечего. Пока-пока arc agi 1.
#Стрим
Автор — @Geometry90
Тест пройден практически полностью. (96%)
Там модель бьётся в потолок, выжимать из этого бенчмарка буквально больше нечего. Пока-пока arc agi 1.
#Стрим
Автор — @Geometry90
🍓4🤔1