🫆 Светлый Уголок | ии
526 subscribers
896 photos
190 videos
10 files
516 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
🎉 ZunMux даёт возможность попробовать Gemini 3.1 pro бесплатно.

Переходите по ссылке и пробуйте.

Напомню, что модель всё ещё не вышла и бенчмарков, по крайней мере «настоящих», пока что нет, ожидаем в ближайшие 2-3 часа.

P.s — По тестам, это даже не похоже на gemini 3.1. Так что лучше не используйте ничего там.

Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
🫆 Светлый Уголок | ии
👑 Первые впечатления о Vertex-версии Gemini 3.1 Pro. Начну с неприятного. Очевидно, Gemini 3 Pro намеренно ослабили, чтобы на фоне 3.1 была видна разница. Это некрасиво. Можно, конечно, списать на «нехватку мощностей, пришлось так сделать». Теперь к хорошему.…
Media is too big
VIEW IN TELEGRAM
🥇 Gemini 3.1 pro Бог Html Игр!
Вот вам World of Tanks в 2д формате.

Это просто нечто!


Всего за 6 запросов я добился такого результата.

Во время разработки проще всего было заставить его писать больше кода. Иногда он сокращал его, иногда делал ошибки, но он очень хорошо исправлял всё!

Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥6👍3
🫆 Светлый Уголок | ии
🥇 Gemini 3.1 pro Бог Html Игр! Вот вам World of Tanks в 2д формате. Это просто нечто! Всего за 6 запросов я добился такого результата. Во время разработки проще всего было заставить его писать больше кода. Иногда он сокращал его, иногда делал ошибки,…
Media is too big
VIEW IN TELEGRAM
🥇 ONE-SHOT Клон NMS созданный с помощью Gemini 3.1 pro за несколько (10-15) промтов.

Офигеть... Это не то что бы ваншот, это какой то прорыв...

Работа не моя, чувак поделился в одном из чатов.

Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
3❤‍🔥1👍1
🚨 Gemini 3.1 Pro вышла в ai.studio.

Идите проверяйте, пробуйте, разрабатывайте!

#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥1
Бенчмарки Gemini 3.1 pro

Обратите внимание на:
— Прошла hle на 44.4%
— ARC-AGI-2 77.1% – это большой отрыв
— SWE-Bench 80.6%, что хуже чем у последней Opus на 0.2%
— LiveCodeBench Pro — 2887

#Стрим
Автор — @Geometry90
👍3
В рейтинге Artificial Analysis новая Gemini 3.1 Pro Preview набрала 57 баллов и заняла первое место.

Отрыв от конкурентов небольшой,
но уверенный.

#Стрим
Автор — @Geometry90
4
Судя по графику (Omniscience Hallucination Rate), уровень галлюцинаций у новой модели заметно снизился.

Отличный результат!

#Стрим
Автор — @Geometry90
👍6
А вот на Chatbot Arena в категории работы с текстом (Text Arena) Gemini 3.1 Pro Preview пока стартует только с 3-го места.

#Стрим
Автор — @Geometry90
62😁1
В категории кодинга (Code Arena / Agentic Webdev) она вообще оказалась на 6-м месте. Получается, новая Gemini доминирует далеко не везде.

Как так-то? 😱

#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
3😁2
Зато бенчмарк ARC-AGI-1 новая Gemini 3.1 Pro порвала!

Тест пройден практически полностью. (96%)

Там модель бьётся в потолок, выжимать из этого бенчмарка буквально больше нечего. Пока-пока arc agi 1.

#Стрим
Автор — @Geometry90
🍓4🤔1
1983 год
Gemini 3 — первая программируемая языковая модель в мире.

#Мем
🤔6
Gemini 3.1 Pro стала менее эмоциональной и креативной, чем 3.0 Pro.

В некоторых случаях даже хуже 2.5 pro.

Этому поспособствовало снижение количества галлюцинаций.
Некоторые пользователи отмечают, что текст стал ужасным и однообразным.

#Новости
Автор — @Geometry90
2🤔1
Сегодня выходит тот самый апдейт для Google AI studio + antigravity.

По крайней мере только для ai.dev

Если Logan Kirkpatrick написал это у себя, (а написал он это впервые), то значит, что будет что-то масштабное.

P.s — что-то долго не выходит.

#Новости
Автор — @Geometry90
❤‍🔥2
Gemini 3.1 стала хуже в математике.

Буквально:
У меня уже возникла проблема, когда я попросил модель решить задачку уровня 7-го класса — она не смогла решить её правильно.

Вдобавок:
Если попросить модель сложить
9+10, то в некоторых случаях она будет выдавать ТОЛЬКО 21. Дожили.
Это единичный случай, видимо, проблема в том, что она считает, что ты спрашиваешь про какой-то там мем «21».

А вчера она выдала мне 2 + 2 = 5 спустя 3–4 запроса. Я обсуждал с ней другой новый мем и решил уточнить, сколько будет 2 + 2, на что она ответила: «5». Когда я спросил «почему?», она заявила, что просто "подыгрывала", "ну мы же ведь шутили".

AGI, не иначе!
🤔3