🫆 Светлый Уголок | ии
526 subscribers
896 photos
190 videos
10 files
516 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
🫆 Светлый Уголок | ии
👑 Первые впечатления о Vertex-версии Gemini 3.1 Pro. Начну с неприятного. Очевидно, Gemini 3 Pro намеренно ослабили, чтобы на фоне 3.1 была видна разница. Это некрасиво. Можно, конечно, списать на «нехватку мощностей, пришлось так сделать». Теперь к хорошему.…
Media is too big
VIEW IN TELEGRAM
🥇 Gemini 3.1 pro Бог Html Игр!
Вот вам World of Tanks в 2д формате.

Это просто нечто!


Всего за 6 запросов я добился такого результата.

Во время разработки проще всего было заставить его писать больше кода. Иногда он сокращал его, иногда делал ошибки, но он очень хорошо исправлял всё!

Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥6👍3
🫆 Светлый Уголок | ии
🥇 Gemini 3.1 pro Бог Html Игр! Вот вам World of Tanks в 2д формате. Это просто нечто! Всего за 6 запросов я добился такого результата. Во время разработки проще всего было заставить его писать больше кода. Иногда он сокращал его, иногда делал ошибки,…
Media is too big
VIEW IN TELEGRAM
🥇 ONE-SHOT Клон NMS созданный с помощью Gemini 3.1 pro за несколько (10-15) промтов.

Офигеть... Это не то что бы ваншот, это какой то прорыв...

Работа не моя, чувак поделился в одном из чатов.

Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
3❤‍🔥1👍1
🚨 Gemini 3.1 Pro вышла в ai.studio.

Идите проверяйте, пробуйте, разрабатывайте!

#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥1
Бенчмарки Gemini 3.1 pro

Обратите внимание на:
— Прошла hle на 44.4%
— ARC-AGI-2 77.1% – это большой отрыв
— SWE-Bench 80.6%, что хуже чем у последней Opus на 0.2%
— LiveCodeBench Pro — 2887

#Стрим
Автор — @Geometry90
👍3
В рейтинге Artificial Analysis новая Gemini 3.1 Pro Preview набрала 57 баллов и заняла первое место.

Отрыв от конкурентов небольшой,
но уверенный.

#Стрим
Автор — @Geometry90
4
Судя по графику (Omniscience Hallucination Rate), уровень галлюцинаций у новой модели заметно снизился.

Отличный результат!

#Стрим
Автор — @Geometry90
👍6
А вот на Chatbot Arena в категории работы с текстом (Text Arena) Gemini 3.1 Pro Preview пока стартует только с 3-го места.

#Стрим
Автор — @Geometry90
62😁1
В категории кодинга (Code Arena / Agentic Webdev) она вообще оказалась на 6-м месте. Получается, новая Gemini доминирует далеко не везде.

Как так-то? 😱

#Стрим
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
3😁2
Зато бенчмарк ARC-AGI-1 новая Gemini 3.1 Pro порвала!

Тест пройден практически полностью. (96%)

Там модель бьётся в потолок, выжимать из этого бенчмарка буквально больше нечего. Пока-пока arc agi 1.

#Стрим
Автор — @Geometry90
🍓4🤔1
1983 год
Gemini 3 — первая программируемая языковая модель в мире.

#Мем
🤔6
Gemini 3.1 Pro стала менее эмоциональной и креативной, чем 3.0 Pro.

В некоторых случаях даже хуже 2.5 pro.

Этому поспособствовало снижение количества галлюцинаций.
Некоторые пользователи отмечают, что текст стал ужасным и однообразным.

#Новости
Автор — @Geometry90
2🤔1
Сегодня выходит тот самый апдейт для Google AI studio + antigravity.

По крайней мере только для ai.dev

Если Logan Kirkpatrick написал это у себя, (а написал он это впервые), то значит, что будет что-то масштабное.

P.s — что-то долго не выходит.

#Новости
Автор — @Geometry90
❤‍🔥2
Gemini 3.1 стала хуже в математике.

Буквально:
У меня уже возникла проблема, когда я попросил модель решить задачку уровня 7-го класса — она не смогла решить её правильно.

Вдобавок:
Если попросить модель сложить
9+10, то в некоторых случаях она будет выдавать ТОЛЬКО 21. Дожили.
Это единичный случай, видимо, проблема в том, что она считает, что ты спрашиваешь про какой-то там мем «21».

А вчера она выдала мне 2 + 2 = 5 спустя 3–4 запроса. Я обсуждал с ней другой новый мем и решил уточнить, сколько будет 2 + 2, на что она ответила: «5». Когда я спросил «почему?», она заявила, что просто "подыгрывала", "ну мы же ведь шутили".

AGI, не иначе!
🤔3
Светлая комната — архив
Gemini 3.1 стала хуже в математике. Буквально: У меня уже возникла проблема, когда я попросил модель решить задачку уровня 7-го класса — она не смогла решить её правильно. Вдобавок: Если попросить модель сложить 9+10, то в некоторых случаях она будет выдавать…
Юзайте эту модельку, не бросайте сразу. Найдите ей применение.

Она уникальна и отлично сбалансирована. Лично я ставлю её сразу после Claude 4.6 Opus, тупо потому что она бесплатная и доступна везде, и опять же уникальна в SVG.

Нынешние скачки качества — это плата за стабильность. Реальные улучшения мы увидим со следующим апдейтом (по секрету: уже в этом месяце).

Пока же Google слишком медленно шли к Gemini 3.1 Pro, ииии, прогресс мизерный короче, поэтому это лишь версия «3.1».

Моё мнение: модели Gemini мощные, но концептуально неудачные.
Кажется, после версии 2.0 они забили на новую архитектуру и просто заливали версии 2.5, 3.0 и 3.1 сырыми вычислительными мощностями.

А теперь, когда упёрлись в потолок, им приходится мириться с тем, что их модель вообще нигде не на первом месте. И сотрудников DeepMind это реально бесит, я понял это, когда Logan оправдывался в X.

Но, вероятно, они всё же пилят что-то новое. Вспомните осенний претрейн: аналитики из Artificial Analysis заметили, что Google не просто тюнит старое, а создает новую базу. Возможно, конечно же, там было именно RL-дообучение, (для этого требуется запускать что-то вроде специальных агентов. Это мощно), и сделало ту же Gemini 3 Flash такой сильной.

Google буквально дышит в спину ChatGPT, ещё немного — и могли бы порвать всех. Но конкуренция жестока. А вообще, я знаю в каком направлении идут модели Gemini – это очень сильно продвигает к AGI. Но об этом позже.

Гуглу пора задушить свою бюрократию, начать развивать продукты и нанять нормальных спецов, а не геев идиотов, которые пишут тупые промпты для Gemini App и безнадёжно сливают конкурентам по функционалу. Это просто ужасно.

Я ещё плотно потестирую модель и найду все её "проёбы". И тогда мы решим: стоит ли дальше фанатеть от уникальности Google? Особенно когда Claude 4.6 Opus ВДРУГ уделывает их в математике вместе с GPT-X High, а обновленный Sonnet 4.6 неплох, и уже не уровне gemini 3 во фронтенд-дизайне. Если Гугл не проснётся, вердикт будет таким: их нейронка годится только для разовых запросов. Никаких долгих диалогов и глубокой работы — просто крутая бесплатная игрушка на один раз, и всё.

И это ЛИШЬ половина моих мыслей. Обязательно выкачу полноценный обзор, ведь я всё-таки остаюсь фанатом Gemini. 🤫

#Мысли
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥51
✴️ Скоро полноценный релиз Deepseek v4.

Я знаю, что знают те ребята. Так что эти намёки действительно оправданы.

#Новости
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
🤫 Gemma 4 может выйти уже в этом месяце.

Во-первых: Демис Хассабис, когда был в Индии на днях, заявил о скором выпуске новой модели Gemma: «...Мы работаем над собственной моделью с открытым исходным кодом, Gemma, и скоро выпустим новую версию, которая будет очень мощной для периферийных устройств».

Во-вторых, скоро релиз Open-source гиганта — deepseek v4. По-моему, им всегда было пофиг, но не в этот раз.

Хоть какие то намёки хотя бы есть.

Значит скоро. Интересно, после gemini 3 на что вы надеетесь с Gemma 4?
Источник

#Новости / #Инсайд
Автор — @Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥32👍1