Светлый Уголок | ии
Уже завтра выйдет обновление в Ai.studio. На это обновление команда Логана Килпатрика потратила целых 4 месяца. Ожидается что то крутое в роде вайб-кодинга. Geometry90
Зато я знаю чем вас порадовать, подписчики. Я приготовил кое-что интересное для вас. Но это будет даже не настолько крутым как то, что будет ждать вас в начале следующего месяца.
Я возвращаю эру своих "продуктов", но теперь в более качественном формате.
Я возвращаю эру своих "продуктов", но теперь в более качественном формате.
Veo 3.1 получит обновление.
Вместе с основной моделью выходит Veo 3.1 Lite (быстрая версия, заменившая прежний Fast).
Благодаря новым инструментам, Veo 3.1 теперь поддерживает работу с видео-референсами, умеет клонировать голос для озвучки персонажей и продлевать видео, сохраняя физику и детализацию.
Вместе с основной моделью выходит Veo 3.1 Lite (быстрая версия, заменившая прежний Fast).
Благодаря новым инструментам, Veo 3.1 теперь поддерживает работу с видео-референсами, умеет клонировать голос для озвучки персонажей и продлевать видео, сохраняя физику и детализацию.
Geometry90
❤🔥3 2
Не верь в мою веру в тебя. И не верь в свою веру в меня. Верь в себя! В свою веру в себя!
8 Ep.
8 Ep.
❤🔥2🤔1
Каждую неделю выходит куча новых нейросетей, особенно китайских — их стало просто завалом.
Из свежего: зарелизили Cursor Composer 2 — на мой взгляд лёгкая модель, но есть бенчмарки, где она может обходить Claude opus 4.6 в code задачах.
Qwen 3.5 Max — Причем Qwen даже без полноценного thinking-режима, который делают только через месяц, сходу залетел на 4 место в Text Arena. Правда, вряд ли он там задержится: Grok 4.20 недавно тоже занимал эту строчку, а за последнюю неделю отлетел на 8 позицию.
Помните Xiaomi Mimo 2 Flash? У них уже вышли версии Pro и Omni, а заодно Mimo TTS, которая умеет петь песенки на китайском.
Плюс на подходе GLM-5-Code и обновленная Kimi-2.5.
Отдельно стоит отметить Minimax 2.7. — На самом деле это жалкая модель)
Вышла GPT 5.4 Nano — оказалась на удивление умной и прямо сейчас бодается за лидерство с Gemini 3.0 Flash и Claude Sonnet 4.6.
Вот и всё.
А да, Microsoft все ещё пытается стать независимым, выпустив новую imagen модель MAI‑Image‑2. Про нее сделаем обзор.
— MAI‑Image‑2.
— Mimo 2 TTS.
Из свежего: зарелизили Cursor Composer 2 — на мой взгляд лёгкая модель, но есть бенчмарки, где она может обходить Claude opus 4.6 в code задачах.
Qwen 3.5 Max — Причем Qwen даже без полноценного thinking-режима, который делают только через месяц, сходу залетел на 4 место в Text Arena. Правда, вряд ли он там задержится: Grok 4.20 недавно тоже занимал эту строчку, а за последнюю неделю отлетел на 8 позицию.
Помните Xiaomi Mimo 2 Flash? У них уже вышли версии Pro и Omni, а заодно Mimo TTS, которая умеет петь песенки на китайском.
Плюс на подходе GLM-5-Code и обновленная Kimi-2.5.
Отдельно стоит отметить Minimax 2.7. — На самом деле это жалкая модель)
Вышла GPT 5.4 Nano — оказалась на удивление умной и прямо сейчас бодается за лидерство с Gemini 3.0 Flash и Claude Sonnet 4.6.
Вот и всё.
А да, Microsoft все ещё пытается стать независимым, выпустив новую imagen модель MAI‑Image‑2. Про нее сделаем обзор.
— MAI‑Image‑2.
— Mimo 2 TTS.
Geometry90
🤔2
Светлый Уголок | ии
Делаю кое что крутое для вас
Я бы мог хорошо сотрудничать с вами, чтобы создавать что-то вместе.
Ответ Gemini
Привет! Без проблем, брат, всё сделаем. Я убрал весь лишний мусор, исправил ошибки и перевел суть на отличный английский. Никаких упоминаний откуда это взято — выглядит как твоя личная мысль для поста.
Вот твой готовый текст на английском:
"Thought I'd post something today, friends. Given what modern LLMs can do (e.g., in math, but also in pretty much everything else), their obvious limitations are quite puzzling. What is currently preventing them from high-quality, fully autonomous work?"
И на всякий случай вот исправленный и причесанный русский вариант (если понадобится):
"Сегодня решил кое-что запостить, друзья. Учитывая то, на что способны современные LLM (например, в математике, да и во многом другом), их очевидные ограничения кажутся довольно загадочными. Что именно сейчас препятствует их высококачественной, полностью автономной работе?"
Хочешь, сделаем английский вариант еще более неформальным или наоборот — добавим умных терминов?
Привет! Без проблем, брат, всё сделаем. Я убрал весь лишний мусор, исправил ошибки и перевел суть на отличный английский. Никаких упоминаний откуда это взято — выглядит как твоя личная мысль для поста.
Вот твой готовый текст на английском:
"Thought I'd post something today, friends. Given what modern LLMs can do (e.g., in math, but also in pretty much everything else), their obvious limitations are quite puzzling. What is currently preventing them from high-quality, fully autonomous work?"
И на всякий случай вот исправленный и причесанный русский вариант (если понадобится):
"Сегодня решил кое-что запостить, друзья. Учитывая то, на что способны современные LLM (например, в математике, да и во многом другом), их очевидные ограничения кажутся довольно загадочными. Что именно сейчас препятствует их высококачественной, полностью автономной работе?"
Хочешь, сделаем английский вариант еще более неформальным или наоборот — добавим умных терминов?
🤔5 2
Supermemory почти дошли до 99% на LongMemEval. Речь не о новой ИИ-модели, а о системе памяти для ИИ-ассистентов.
Supermemory показали новые сборки своей системы памяти для ИИ, и на свежем сравнении результаты у них почти дошли до 99%.
➕ Supermemory (8-Variant Ensemble) — 98.60%
➕ Supermemory (12-Variant Forest) — 97.20%
Важно, что речь идет не о новой языковой модели, а именно о системе памяти для ИИ-ассистентов. Такие системы нужны, чтобы ИИ лучше помнил факты о пользователе, обновления данных, длинную историю общения и временную последовательность событий.
Почти 99% здесь относятся не к базовой версии Supermemory, а к новым сборкам. Исходная версия,
Сам LongMemEval проверяет самые сложные для памяти сценарии: обновление знаний, временную логику и работу через несколько сессий. Именно на таких вещах подобные системы чаще всего и начинают ломаться.
Отдельно интересно и то, что Supermemory идут в сторону открытости. Базовый код и benchmark-инфраструктура у них уже публичны, а если они отдельно выложат и свежие memory-сборки, это может заметно ускорить развитие систем памяти для ИИ.
Небольшое пояснение:
LongMemEval — тест на долгую память ИИ в длинной истории общения.
Ensemble — несколько вариантов системы, работающих вместе ради более точного результата.
Supermemory Research
А подробнее можно прочитать здесь
Supermemory показали новые сборки своей системы памяти для ИИ, и на свежем сравнении результаты у них почти дошли до 99%.
Важно, что речь идет не о новой языковой модели, а именно о системе памяти для ИИ-ассистентов. Такие системы нужны, чтобы ИИ лучше помнил факты о пользователе, обновления данных, длинную историю общения и временную последовательность событий.
Почти 99% здесь относятся не к базовой версии Supermemory, а к новым сборкам. Исходная версия,
Supermemory Initial, на этом же графике показывает 85.20%. То есть скачок у них действительно очень большой.Главный смысл новости не в том, что появилась новая модель, а в том, что Supermemory очень сильно прокачали именно память.
Сам LongMemEval проверяет самые сложные для памяти сценарии: обновление знаний, временную логику и работу через несколько сессий. Именно на таких вещах подобные системы чаще всего и начинают ломаться.
Отдельно интересно и то, что Supermemory идут в сторону открытости. Базовый код и benchmark-инфраструктура у них уже публичны, а если они отдельно выложат и свежие memory-сборки, это может заметно ускорить развитие систем памяти для ИИ.
Небольшое пояснение:
LongMemEval — тест на долгую память ИИ в длинной истории общения.
Ensemble — несколько вариантов системы, работающих вместе ради более точного результата.
Supermemory Research
А подробнее можно прочитать здесь
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Подробности позже.
Сегодня модель была добавлена в рейтинги Artificial Analytics и заняла заслуженное 1-е место!
Seedance 2.0 становится доступной по всему миру на платформах Dreamina, Capcut и других сервисах компании ByteDance. К слову, API пока не выпущен.
Источник.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Grok 4.20 — полный отстой. Вновь мои жалобы.
Самая худшая модель, у которой больше всего галлюцинаций.
Не следует инструкциям.
Не понимает контекст.
Обзывается без причины.
Это ненормальная модель, не способная конкурировать с текущими Gemini, Claude, GPT и другими.
Сколько же людей подкупают, как же много создаётся иллюзий, что их модель — самая лучшая.
Эти люди прекрасно понимают, насколько модель неюзабельна.
Но им все равно надо подстать под Илона Маска.
По моим наблюдениям после 2-3 обновлений произошла сильная регрессия.
Самая худшая модель, у которой больше всего галлюцинаций.
Не следует инструкциям.
Не понимает контекст.
Обзывается без причины.
Это ненормальная модель, не способная конкурировать с текущими Gemini, Claude, GPT и другими.
Сколько же людей подкупают, как же много создаётся иллюзий, что их модель — самая лучшая.
Эти люди прекрасно понимают, насколько модель неюзабельна.
Но им все равно надо подстать под Илона Маска.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥4 3
Please open Telegram to view this post
VIEW IN TELEGRAM
Больше подробностей позже.
Испытать её можно здесь.
Uni-1 отлично понимает культурный контекст, стили и юмор.
Я прямо сейчас начну тестировать эту модель.
Перед этим отмечу, что же она всё-таки может:
— Это мультимодальная модель для создания и редактирования изображений.
— Она обладает встроенным мышлением (reasoning).
Справляется с логикой гораздо лучше, чем Nano Banana Pro, на мой взгляд.
— Понимает культурный контекст.
Мемы, юмор, тонкости языка (включая мультиязычность и глобальные эстетики).
— Визуальных стилей — ощутимо больше и точнее, чем у Nano Banana Pro. Официально показывают 76+ стилей, но по факту миллионы в понимании.
Думаю, это уже не просто конкурент, который где-то там догоняет Nano Banana 2 / Pro от Google.
Luma реально превзошли почти всех — особенно в том, что сейчас важнее всего: в reasoning, логическом редактировании и понимании сложных сцен. Всё намного лучше.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Photo
Уже пошли первые сравнения между uni-1 и nano banana 2.
Можете посмотреть картинки сравнений в комментариях.
Эта модель даёт какую-то смесь с Nano banana и Midjourney.
Картики получаются очень крутыми.
Можете посмотреть картинки сравнений в комментариях.
Эта модель даёт какую-то смесь с Nano banana и Midjourney.
Картики получаются очень крутыми.