🫆 Светлый Уголок | ии
526 subscribers
896 photos
190 videos
10 files
516 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
Вчера был на этом саммите. Запечатлел очередной повторяющийся случай.
🤔6
🫆 Светлый Уголок | ии
Пообещал, что исправит всякие проблемы с галлюцинациями. Ну, по крайней мере, они долго молчали. Насчёт того, сдержит слово или нет, — не знаю, но сам факт того, что хоть кто-то ответил на это, уже даёт знак.
Логан Килпатрик объяснил ошибки 503 в Gemini API глобальными пиками трафика.

Google наращивает мощности TPU, но пока в часы пиковой нагрузки приходится сокращать трафик.


Непонятно, как они собираются это решать. Остается только гадать, как сильно они будут «сокращать» доступ и насколько сознательно убивают юзабельность свою продуктов, жертвуя репутацией. Похоже, на данном этапе они делают это специально.

Geometry90
🤔1
Интересно!
🫆 Светлый Уголок | ии
Интересно!
Но на самом деле это не так интересно как новые модели GPT-5.4 Mini и Nano.

Модели Mini и Nano в линейке GPT меня никогда не интересовали, как например тот же Gemini Flash.

OpenAI тут не разочаровали — модель делали не ради бенчмарков, а под конкретные рабочие задачи.

Моделька лучше работает с инструментами, лучше справляется с кодовыми базами, и контекст у GPT 5.4 Mini — 1м токенов. Вот тут ей точно найдут отличное применение, в отличие от прошлых GPT Nano / Mini.

Думаю модель будет отлично слушаться.

Geometry90
2
Ой...
🤔7
Gemini App для macOS и Windows со своими плюшками выйдет совсем скоро!

Инсайдеры говорят, что в Desktop приложении появятся функция рабочей области и даже поддержка MCP.

Источник.
Geometry90
41
Вышел MiniMax M2.7. По бенчам всё на картинке, но там есть деталь поинтереснее.

Они закинули модель в автономное плавание решать ML-задачки (уровня MLE-Bench Lite). Суть в том, что она сутки сама себя улучшала вообще без участия человека. Сама пишет код, чекает ошибки, запоминает косяки и на некст итерации делает лучше.

В итоге за 24 часа забрала 66.6% медалей. Для понимания — это уровень Gemini 3.1. Выше сейчас только Opus 4.6 и GPT-5.4.

Китайцы потихоньку заставляют ИИ писать апдейты самому себе.

Пощупать агента можно тут: agent.minimax.io.
Сам пока не ковырял, кто затестит — отпишитесь как оно.
Geometry90
6
Уже завтра выйдет обновление в Ai.studio.

На это обновление команда Логана Килпатрика потратила целых 4 месяца.

Ожидается что то крутое в роде вайб-кодинга.

Geometry90
🤔4
🫆 Светлый Уголок | ии
Уже завтра выйдет обновление в Ai.studio. На это обновление команда Логана Килпатрика потратила целых 4 месяца. Ожидается что то крутое в роде вайб-кодинга. Geometry90
Зато я знаю чем вас порадовать, подписчики. Я приготовил кое-что интересное для вас. Но это будет даже не настолько крутым как то, что будет ждать вас в начале следующего месяца.

Я возвращаю эру своих "продуктов", но теперь в более качественном формате.
5❤‍🔥1
Veo 3.1 получит обновление.
Вместе с основной моделью выходит Veo 3.1 Lite (быстрая версия, заменившая прежний Fast).

Благодаря новым инструментам, Veo 3.1 теперь поддерживает работу с видео-референсами, умеет клонировать голос для озвучки персонажей и продлевать видео, сохраняя физику и детализацию.
Geometry90
❤‍🔥32
Не верь в мою веру в тебя. И не верь в свою веру в меня. Верь в себя! В свою веру в себя!

8 Ep.
❤‍🔥2🤔1
Каждую неделю выходит куча новых нейросетей, особенно китайских — их стало просто завалом.

Из свежего: зарелизили Cursor Composer 2 — на мой взгляд лёгкая модель, но есть бенчмарки, где она может обходить Claude opus 4.6 в code задачах.

Qwen 3.5 Max — Причем Qwen даже без полноценного thinking-режима, который делают только через месяц, сходу залетел на 4 место в Text Arena. Правда, вряд ли он там задержится: Grok 4.20 недавно тоже занимал эту строчку, а за последнюю неделю отлетел на 8 позицию.

Помните Xiaomi Mimo 2 Flash? У них уже вышли версии Pro и Omni, а заодно Mimo TTS, которая умеет петь песенки на китайском.

Плюс на подходе GLM-5-Code и обновленная Kimi-2.5.

Отдельно стоит отметить Minimax 2.7. — На самом деле это жалкая модель)

Вышла GPT 5.4 Nano — оказалась на удивление умной и прямо сейчас бодается за лидерство с Gemini 3.0 Flash и Claude Sonnet 4.6.

Вот и всё.

А да, Microsoft все ещё пытается стать независимым, выпустив новую imagen модель MAI‑Image‑2. Про нее сделаем обзор.

— MAI‑Image‑2.
— Mimo 2 TTS.

Geometry90
🤔2
Делаю кое что крутое для вас
🤔11
🫆 Светлый Уголок | ии
Делаю кое что крутое для вас
Я бы мог хорошо сотрудничать с вами, чтобы создавать что-то вместе.
4
Ответ Gemini
Привет! Без проблем, брат, всё сделаем. Я убрал весь лишний мусор, исправил ошибки и перевел суть на отличный английский. Никаких упоминаний откуда это взято — выглядит как твоя личная мысль для поста.

Вот твой готовый текст на английском:

"Thought I'd post something today, friends. Given what modern LLMs can do (e.g., in math, but also in pretty much everything else), their obvious limitations are quite puzzling. What is currently preventing them from high-quality, fully autonomous work?"

И на всякий случай вот исправленный и причесанный русский вариант (если понадобится):

"Сегодня решил кое-что запостить, друзья. Учитывая то, на что способны современные LLM (например, в математике, да и во многом другом), их очевидные ограничения кажутся довольно загадочными. Что именно сейчас препятствует их высококачественной, полностью автономной работе?"

Хочешь, сделаем английский вариант еще более неформальным или наоборот — добавим умных терминов?
🤔52
Supermemory почти дошли до 99% на LongMemEval. Речь не о новой ИИ-модели, а о системе памяти для ИИ-ассистентов.

Supermemory показали новые сборки своей системы памяти для ИИ, и на свежем сравнении результаты у них почти дошли до 99%.

Supermemory (8-Variant Ensemble)98.60%
Supermemory (12-Variant Forest)97.20%

Важно, что речь идет не о новой языковой модели, а именно о системе памяти для ИИ-ассистентов. Такие системы нужны, чтобы ИИ лучше помнил факты о пользователе, обновления данных, длинную историю общения и временную последовательность событий.

Почти 99% здесь относятся не к базовой версии Supermemory, а к новым сборкам. Исходная версия, Supermemory Initial, на этом же графике показывает 85.20%. То есть скачок у них действительно очень большой.

Главный смысл новости не в том, что появилась новая модель, а в том, что Supermemory очень сильно прокачали именно память.


Сам LongMemEval проверяет самые сложные для памяти сценарии: обновление знаний, временную логику и работу через несколько сессий. Именно на таких вещах подобные системы чаще всего и начинают ломаться.

Отдельно интересно и то, что Supermemory идут в сторону открытости. Базовый код и benchmark-инфраструктура у них уже публичны, а если они отдельно выложат и свежие memory-сборки, это может заметно ускорить развитие систем памяти для ИИ.

Небольшое пояснение:


LongMemEval — тест на долгую память ИИ в длинной истории общения.
Ensemble — несколько вариантов системы, работающих вместе ради более точного результата.

Supermemory Research
А подробнее можно прочитать здесь

🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
41