🫆 Светлый Уголок | ии
526 subscribers
896 photos
190 videos
10 files
516 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
Это мощь!!! Вот даты выхода Seedance 2, там ещё PRO-версия будет!

Оказывается, всё это время (и это подтвердилось) мы использовали обычную версию Seedance 2.0.

Никто даже не знает, на что реально способна Seedance 2.0 Pro и какие крутые штуки на ней уже успели наворотить...

Это жесть...
График релизов:

• 14 февраля: Seed-2.0-mini
• 24 февраля: Seedance-2.0-pro
• 24 февраля: Seedance-2.0-pro-fast
• 24 февраля: Seedream-5.0

#Новости
Подписаться: t.me/Geometry90
👍2
Сначала я посмотрел на этот пост и подумал: ха-ха, они прикалываются?

Зашёл в Gemini app, дал промт «Create a pelican on a bike svg» и получил это...

Эмм... Ну бля, вы понимаете, да? Вам на подписке Pro не Pro, а втирают ебаную, извините меня, дичь.

Вы понимаете, на что готовы пойти Google? Я не вдупляю, в чем прикол, но вы должны обратить внимание: в Gemini app сейчас засунули максимально кастрированные Gemini 3 Pro и Flash. Это просто пиздец...

Теория о том, что Google может ослаблять свои модели теперь официально доказана.

#Мысли / #Новости
🤔1
Forwarded from AI Watchtower (Arena Overseer)
✏️ Name updates on Arena:
• glm-4.7 → glm-5
❤‍🔥1
Google решила выпустить свою "исправленную" модель именно такой.

Мы на 0.1 ближе к Gemini 3.5)
🚨 Gemini 3.1 Pro Preview — замечена

На сайте Artificial Analysis засветилось упоминание Gemini 3.1 Preview.

Хм.
Это реально первый раз, когда Google выкатывает промежуточную «x.1» в таком формате. Раньше такого не было. Выглядит как попытка закрыть дыры в репутации после того, как 3 Pro так и не вышла из превью нормально.

И тут есть мысль. Gemini 3 Pro в последнее время стала работать заметно слабее. Совпадение? Возможно нет. Ослабили старую, чтобы новая 3.1 выглядела как серьёзный апгрейд. Вопросы есть. 💬

☝️ В комментах сделал сравнение Gemini 3 на релизе и сейчас. Сами увидите.
Источник

#Новости / #Инсайд
Подписаться: t.me/Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥3
Возможно Gemini 3.1 pro уже сегодня.
См. картинку.

#Инсайд
Подписаться: t.me/Geometry90
❤‍🔥3
А если быть честным, то модель уже замечена в продуктах Google.

Это будет быстрое внедрение. Если не сегодня, то завтра, но это случится уже на этой неделе.
Источник

Также OpenAI тоже должна выпустить свой продукт — это либо GPT-5.3, либо музыкальная модель. Но Google тоже припасла свою собственную модель, про которую все забыли — Lyria 2/3.

#Новости
Подписаться: t.me/Geometry90
Извините, я не много не успеваю, поэтому заново опубликую некоторые посты сегодня, что бы улучшить качество поставки новостей.
👌3
📈 Улучшаем контент вместе
https://t.me/Geometry903/3

Создал временную группу.
https://t.me/Geometry903
https://t.me/Geometry903
https://t.me/Geometry903


Там выложу свежие посты, которые ещё нигде не публиковались — у каждого два варианта. Надо выбрать, какой заходит лучше. 👀

Зачем?Адаптация.

Хочу понять, как вам удобнее читать — развёрнуто с моими мыслями или коротко по фактам. Ваши голоса реально повлияют на формат ЭТОГО канала.

Как это работает:
🔜 Заходите в группу
🔜 Читаете оба варианта поста
🔜 Голосуете в опросе

Вы оцениваете так, как вам хочется. Ну, думаю вы поймёте в чем суть этих 2 постов.

🔜 Через 48 часов группа удаляется, статистика будет собрана. Спасибо вам.

После этого все посты выйдут здесь в основном канале. Но один важный пост выложу сегодня сюда отдельно — не пропустите.

#Щитпост
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
⭐️ Посмотрите на отрыв.

IMO-ProofBench Advanced — самый жёсткий тест.

Я всегда говорил — у Google есть модели помощнее. Они либо экономили, либо делали кое-что другое. Пока OpenAI выкатывали версию за версией и набирали по 7%... 28%... 35%... — DeepMind тихо собирали агентную систему, которая выдала 92% и попутно решила несколько открытых задач Эрдёша. Задач, которые люди не могли закрыть годами.

Три месяца между GPT-5.1 (7%) и Aletheia (92%). Это не конкуренция — это демонстрация того, что Google просто ждали момента. И дождались.

Источники:
— Официальный релиз DeepMind
— Мой пост с тем инсайдом
Источник

#Новости
Подписаться: t.me/Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥3
🎉 MiniMax M2.5 официально вышел. Веса пока не выложили, но модель уже можно потрогать. Бенчмарки на картинке.

Важная иформация о модели:
• Скорость: 50–100 tps
• SWE-Bench Verified: 80.2
• Фронтенд: отлично / Бэкенд: удовлетворительно
• Заточена под агенты, кодинг, поиск, tool use.


Честно:
По бенчмаркам она обходит кучу топовых моделей. На бумаге — уровень Claude 4.5 Opus. Но на практике уступает, и это нормально, потому что бенчмарки и реальные задачи это две разные вещи. Зато дешевле в 10–20 раз. А для многих задач этого хватает с головой!!!

Источники:
Юзать официально.
Официальный релиз: пост от @MiniMax_AI.
Первый спот: где её заметили до анонса.
Мини критика и сравнение с GLM-5

Моё мнение по китайским моделям в целом: Догоняют, местами обгоняют, и темп у них бешеный. Но пока не хватает стабильности на длинных задачах и репутации. Большие компании всё ещё боятся ставить на них в проде, и их можно понять.

Но если так пойдёт дальше — через полгода разговор будет уже другой.

Кто пробовал через их агент? Как ощущения на реальных задачах? Пишите в комменты.

#Новости
Подписаться: t.me/Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥1111
🔍 Google DeepMind подтвердили инсайд про Aletheia и репозиторий superhuman.

Помните, я писал про «истину» и папку в репозитории? Теперь всё официально — они представили Aletheia.

Цифры и механика (для вашей осведомленности):
• 91.9% на IMO-ProofBench Advanced — новый рекорд. Один из самых жёстких тестов на доказательства в стиле Межнара по математике.
• Движок — Gemini Deep Think. Решение строится в три этапа: генерация → верификация → корректировка.
• При этом работает лучше и дешевле, чем сама Gemini Deep Think Advanced в чистом виде. Агентная обвязка тут реально даёт выигрыш, а не просто обёртка.


Что уже сделала помимо бенчмарков:
— Решила 4 открытых задачи из списка Эрдеша (Эпштейна). Одна из них вообще не была закрыта ни в какой литературе до этого.
— Автономно написала статью с правильными математическими результатами.
— Помогала реальным математикам в написании не-игрушечных научных работ.

Моё мнение:
Google подчёркивают, что Aletheia — пруф того, что законы масштабирования всё ещё работают. Даже на доказательной математике качество растёт не за счёт тупого наращивания параметров, а за счёт архитектуры рассуждений. Умнее агент — лучше результат за меньшие деньги.

Помните папку Aletheia в репозитории superhuman? Я писал, что ждём мощный анонс. Ну вот он.

P.s — Позже сегодня на том же движке вышла обновлённая Gemini 3 Deep Think — набрала 84.6% на ARC-AGI-2, лучший результат на данный момент.

Источники:
— Официальный релиз DeepMind
— Мой пост с инсайдом про superhuman

Кто верил, что задачи Эрдеша закроют настолько быстро? Пишите в комменты.

#Новости
Подписаться: t.me/Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2222
It's all over, Gemini.
🤯2111
Итак, тест ARC-AGI-2 пройден Gemini 3 Deep Think

Франсуа Шолле, создатель тестов ARC-AGI, говорит, что уже работает над версией 4. Всего будет около 7 версий.

ARC-AGI-3 выйдет в марте.

ARC-AGI-4 будет связан с играми.

ARC-AGI-5 уже в планах.

ARC-AGI-6 и 7, вероятно, последние версии

Человеки: создают тест на AGI
ИИ: проходит тест
Человеки: создают новый более сложный тест
ИИ: проходит тест
Человеки: да когда же уже AGI?!

#news
❤‍🔥1
Нейронавт | Нейросети в творчестве
Итак, тест ARC-AGI-2 пройден Gemini 3 Deep Think Франсуа Шолле, создатель тестов ARC-AGI, говорит, что уже работает над версией 4. Всего будет около 7 версий. ARC-AGI-3 выйдет в марте. ARC-AGI-4 будет связан с играми. ARC-AGI-5 уже в планах. ARC-AGI…
Шолле планирует 7 версий ARC-AGI.
По сути, человек публично признаёт: чтобы доказать отсутствие AGI, ему нужно ещё минимум 5 попыток. Темп, с которым модели ломают эти бенчмарки, растёт быстрее, чем темп их создания. Математика тут не на стороне скептиков.

Кстати, настоящий ARC-AGI-3 можно попробовать здесь.
Только представьте, что ближе к Марту модели уже смогут проходить его на 20-30% при старте.

Хроники AGI:
ИИ: проходит невозможный тест
Люди: срочно придумывают тест еще сложнее.
Также люди: «Ну тупы-ы-ые!»

А что думаете вы?

#Новости
Подписаться: t.me/Geometry90
1
Я просто в шоке от Gemini 3.1 DeepThink и того что она творит 😱

Посмотрите на ASCII арты. Не одна модель не справляется с этим, эта же, просто прекрасно понимает как это делать.
❤‍🔥53
🚨 Страница, посвященная ChatGPT 5.3, была запущена, а затем удалена.

Возможно, они вносят последние корректировки, ожидается, что и Gemini 3.1, и ChatGPT5.3 выйдут на следующей неделе.

А что вы больше всего ждёте?

#Инсайд
Подписаться: t.me/Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥521