Переходите по ссылке и пробуйте.
Напомню, что модель всё ещё не вышла и бенчмарков, по крайней мере «настоящих», пока что нет, ожидаем в ближайшие 2-3 часа.
P.s — По тестам, это даже не похоже на gemini 3.1. Так что лучше не используйте ничего там.
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Примеры работы текущей версии из Vertex:
Но в приложении Gemini у некоторых появилось кое-что покруче. Там стоит немного другая Gemini 3.1.
В комментариях покажу сравнение этих двух версий.
#Новости
Автор — @Geometry90
Но в приложении Gemini у некоторых появилось кое-что покруче. Там стоит немного другая Gemini 3.1.
В комментариях покажу сравнение этих двух версий.
#Новости
Автор — @Geometry90
Светлый Уголок | ии
Media is too big
VIEW IN TELEGRAM
Вот вам World of Tanks в 2д формате.
Это просто нечто!
Во время разработки проще всего было заставить его писать больше кода. Иногда он сокращал его, иногда делал ошибки, но он очень хорошо исправлял всё!
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥6👍3
Светлый Уголок | ии
Media is too big
VIEW IN TELEGRAM
Офигеть... Это не то что бы ваншот, это какой то прорыв...
Работа не моя, чувак поделился в одном из чатов.
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Идите проверяйте, пробуйте, разрабатывайте!
#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥1
Бенчмарки Gemini 3.1 pro
#Стрим
Автор — @Geometry90
Обратите внимание на:
— Прошла hle на 44.4%
— ARC-AGI-2 77.1% – это большой отрыв
— SWE-Bench 80.6%, что хуже чем у последней Opus на 0.2%
— LiveCodeBench Pro — 2887
#Стрим
Автор — @Geometry90
👍3
В рейтинге Artificial Analysis новая Gemini 3.1 Pro Preview набрала 57 баллов и заняла первое место.
Отрыв от конкурентов небольшой,
но уверенный.
#Стрим
Автор — @Geometry90
Отрыв от конкурентов небольшой,
но уверенный.
#Стрим
Автор — @Geometry90
Судя по графику (Omniscience Hallucination Rate), уровень галлюцинаций у новой модели заметно снизился.
Отличный результат!
#Стрим
Автор — @Geometry90
Отличный результат!
#Стрим
Автор — @Geometry90
👍6
А вот на Chatbot Arena в категории работы с текстом (Text Arena) Gemini 3.1 Pro Preview пока стартует только с 3-го места.
#Стрим
Автор — @Geometry90
#Стрим
Автор — @Geometry90
В категории кодинга (Code Arena / Agentic Webdev) она вообще оказалась на 6-м месте. Получается, новая Gemini доминирует далеко не везде.
Как так-то?😱
#Стрим
Автор — @Geometry90
Как так-то?
#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Зато бенчмарк ARC-AGI-1 новая Gemini 3.1 Pro порвала!
Тест пройден практически полностью. (96%)
Там модель бьётся в потолок, выжимать из этого бенчмарка буквально больше нечего. Пока-пока arc agi 1.
#Стрим
Автор — @Geometry90
Тест пройден практически полностью. (96%)
Там модель бьётся в потолок, выжимать из этого бенчмарка буквально больше нечего. Пока-пока arc agi 1.
#Стрим
Автор — @Geometry90
🍓4🤔1
Gemini 3.1 Pro стала менее эмоциональной и креативной, чем 3.0 Pro.
В некоторых случаях даже хуже 2.5 pro.
Этому поспособствовало снижение количества галлюцинаций.
Некоторые пользователи отмечают, что текст стал ужасным и однообразным.
#Новости
Автор — @Geometry90
В некоторых случаях даже хуже 2.5 pro.
Этому поспособствовало снижение количества галлюцинаций.
Некоторые пользователи отмечают, что текст стал ужасным и однообразным.
#Новости
Автор — @Geometry90
Сегодня выходит тот самый апдейт для Google AI studio + antigravity.
По крайней мере только для ai.dev
Если Logan Kirkpatrick написал это у себя, (а написал он это впервые), то значит, что будет что-то масштабное.
P.s — что-то долго не выходит.
#Новости
Автор — @Geometry90
По крайней мере только для ai.dev
Если Logan Kirkpatrick написал это у себя, (а написал он это впервые), то значит, что будет что-то масштабное.
P.s — что-то долго не выходит.
#Новости
Автор — @Geometry90
❤🔥2
Forwarded from Светлая комната — архив
Gemini 3.1 стала хуже в математике.
Буквально:
У меня уже возникла проблема, когда я попросил модель решить задачку уровня 7-го класса — она не смогла решить её правильно.
Вдобавок:
Если попросить модель сложить
9+10, то в некоторых случаях она будет выдавать ТОЛЬКО 21. Дожили.
Это единичный случай, видимо, проблема в том, что она считает, что ты спрашиваешь про какой-то там мем «21».
А вчера она выдала мне 2 + 2 = 5 спустя 3–4 запроса. Я обсуждал с ней другой новый мем и решил уточнить, сколько будет 2 + 2, на что она ответила: «5». Когда я спросил «почему?», она заявила, что просто "подыгрывала", "ну мы же ведь шутили".
AGI, не иначе!
Буквально:
У меня уже возникла проблема, когда я попросил модель решить задачку уровня 7-го класса — она не смогла решить её правильно.
Вдобавок:
Если попросить модель сложить
9+10, то в некоторых случаях она будет выдавать ТОЛЬКО 21. Дожили.
Это единичный случай, видимо, проблема в том, что она считает, что ты спрашиваешь про какой-то там мем «21».
А вчера она выдала мне 2 + 2 = 5 спустя 3–4 запроса. Я обсуждал с ней другой новый мем и решил уточнить, сколько будет 2 + 2, на что она ответила: «5». Когда я спросил «почему?», она заявила, что просто "подыгрывала", "ну мы же ведь шутили".
AGI, не иначе!
🤔3