Ответ Gemini
Привет! Без проблем, брат, всё сделаем. Я убрал весь лишний мусор, исправил ошибки и перевел суть на отличный английский. Никаких упоминаний откуда это взято — выглядит как твоя личная мысль для поста.
Вот твой готовый текст на английском:
"Thought I'd post something today, friends. Given what modern LLMs can do (e.g., in math, but also in pretty much everything else), their obvious limitations are quite puzzling. What is currently preventing them from high-quality, fully autonomous work?"
И на всякий случай вот исправленный и причесанный русский вариант (если понадобится):
"Сегодня решил кое-что запостить, друзья. Учитывая то, на что способны современные LLM (например, в математике, да и во многом другом), их очевидные ограничения кажутся довольно загадочными. Что именно сейчас препятствует их высококачественной, полностью автономной работе?"
Хочешь, сделаем английский вариант еще более неформальным или наоборот — добавим умных терминов?
Привет! Без проблем, брат, всё сделаем. Я убрал весь лишний мусор, исправил ошибки и перевел суть на отличный английский. Никаких упоминаний откуда это взято — выглядит как твоя личная мысль для поста.
Вот твой готовый текст на английском:
"Thought I'd post something today, friends. Given what modern LLMs can do (e.g., in math, but also in pretty much everything else), their obvious limitations are quite puzzling. What is currently preventing them from high-quality, fully autonomous work?"
И на всякий случай вот исправленный и причесанный русский вариант (если понадобится):
"Сегодня решил кое-что запостить, друзья. Учитывая то, на что способны современные LLM (например, в математике, да и во многом другом), их очевидные ограничения кажутся довольно загадочными. Что именно сейчас препятствует их высококачественной, полностью автономной работе?"
Хочешь, сделаем английский вариант еще более неформальным или наоборот — добавим умных терминов?
🤔5 2
Supermemory почти дошли до 99% на LongMemEval. Речь не о новой ИИ-модели, а о системе памяти для ИИ-ассистентов.
Supermemory показали новые сборки своей системы памяти для ИИ, и на свежем сравнении результаты у них почти дошли до 99%.
➕ Supermemory (8-Variant Ensemble) — 98.60%
➕ Supermemory (12-Variant Forest) — 97.20%
Важно, что речь идет не о новой языковой модели, а именно о системе памяти для ИИ-ассистентов. Такие системы нужны, чтобы ИИ лучше помнил факты о пользователе, обновления данных, длинную историю общения и временную последовательность событий.
Почти 99% здесь относятся не к базовой версии Supermemory, а к новым сборкам. Исходная версия,
Сам LongMemEval проверяет самые сложные для памяти сценарии: обновление знаний, временную логику и работу через несколько сессий. Именно на таких вещах подобные системы чаще всего и начинают ломаться.
Отдельно интересно и то, что Supermemory идут в сторону открытости. Базовый код и benchmark-инфраструктура у них уже публичны, а если они отдельно выложат и свежие memory-сборки, это может заметно ускорить развитие систем памяти для ИИ.
Небольшое пояснение:
LongMemEval — тест на долгую память ИИ в длинной истории общения.
Ensemble — несколько вариантов системы, работающих вместе ради более точного результата.
Supermemory Research
А подробнее можно прочитать здесь
Supermemory показали новые сборки своей системы памяти для ИИ, и на свежем сравнении результаты у них почти дошли до 99%.
Важно, что речь идет не о новой языковой модели, а именно о системе памяти для ИИ-ассистентов. Такие системы нужны, чтобы ИИ лучше помнил факты о пользователе, обновления данных, длинную историю общения и временную последовательность событий.
Почти 99% здесь относятся не к базовой версии Supermemory, а к новым сборкам. Исходная версия,
Supermemory Initial, на этом же графике показывает 85.20%. То есть скачок у них действительно очень большой.Главный смысл новости не в том, что появилась новая модель, а в том, что Supermemory очень сильно прокачали именно память.
Сам LongMemEval проверяет самые сложные для памяти сценарии: обновление знаний, временную логику и работу через несколько сессий. Именно на таких вещах подобные системы чаще всего и начинают ломаться.
Отдельно интересно и то, что Supermemory идут в сторону открытости. Базовый код и benchmark-инфраструктура у них уже публичны, а если они отдельно выложат и свежие memory-сборки, это может заметно ускорить развитие систем памяти для ИИ.
Небольшое пояснение:
LongMemEval — тест на долгую память ИИ в длинной истории общения.
Ensemble — несколько вариантов системы, работающих вместе ради более точного результата.
Supermemory Research
А подробнее можно прочитать здесь
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Подробности позже.
Сегодня модель была добавлена в рейтинги Artificial Analytics и заняла заслуженное 1-е место!
Seedance 2.0 становится доступной по всему миру на платформах Dreamina, Capcut и других сервисах компании ByteDance. К слову, API пока не выпущен.
Источник.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Grok 4.20 — полный отстой. Вновь мои жалобы.
Самая худшая модель, у которой больше всего галлюцинаций.
Не следует инструкциям.
Не понимает контекст.
Обзывается без причины.
Это ненормальная модель, не способная конкурировать с текущими Gemini, Claude, GPT и другими.
Сколько же людей подкупают, как же много создаётся иллюзий, что их модель — самая лучшая.
Эти люди прекрасно понимают, насколько модель неюзабельна.
Но им все равно надо подстать под Илона Маска.
По моим наблюдениям после 2-3 обновлений произошла сильная регрессия.
Самая худшая модель, у которой больше всего галлюцинаций.
Не следует инструкциям.
Не понимает контекст.
Обзывается без причины.
Это ненормальная модель, не способная конкурировать с текущими Gemini, Claude, GPT и другими.
Сколько же людей подкупают, как же много создаётся иллюзий, что их модель — самая лучшая.
Эти люди прекрасно понимают, насколько модель неюзабельна.
Но им все равно надо подстать под Илона Маска.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥4 3
Please open Telegram to view this post
VIEW IN TELEGRAM
Больше подробностей позже.
Испытать её можно здесь.
Uni-1 отлично понимает культурный контекст, стили и юмор.
Я прямо сейчас начну тестировать эту модель.
Перед этим отмечу, что же она всё-таки может:
— Это мультимодальная модель для создания и редактирования изображений.
— Она обладает встроенным мышлением (reasoning).
Справляется с логикой гораздо лучше, чем Nano Banana Pro, на мой взгляд.
— Понимает культурный контекст.
Мемы, юмор, тонкости языка (включая мультиязычность и глобальные эстетики).
— Визуальных стилей — ощутимо больше и точнее, чем у Nano Banana Pro. Официально показывают 76+ стилей, но по факту миллионы в понимании.
Думаю, это уже не просто конкурент, который где-то там догоняет Nano Banana 2 / Pro от Google.
Luma реально превзошли почти всех — особенно в том, что сейчас важнее всего: в reasoning, логическом редактировании и понимании сложных сцен. Всё намного лучше.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Photo
Уже пошли первые сравнения между uni-1 и nano banana 2.
Можете посмотреть картинки сравнений в комментариях.
Эта модель даёт какую-то смесь с Nano banana и Midjourney.
Картики получаются очень крутыми.
Можете посмотреть картинки сравнений в комментариях.
Эта модель даёт какую-то смесь с Nano banana и Midjourney.
Картики получаются очень крутыми.
Это скорее Midjourney, но на новом уровне — это обалдеть как классно!
По данным TestingCatalog, нейросеть скоро сможет самостоятельно совершать звонки и выполнять задачи прямо на смартфоне.
До этого компания уже выпустила управление компьютером (пока тестируется только на macOS).
Со временем Claude будет иметь возможность полноценно работать с интерфейсом, открывать файлы и запускать программы на всех устройствах.
Недавно ещё добавили такую штуку: вы отдаете команду со смартфона, а агент выполняет ее на десктопе.
Кстати, аналогичный функционал уже разрабатывался и был готов для будущих обновлений Gemini Live.
Но, похоже, Google снова упустит первенство из-за своей "бюрократии" и "дисциплины".
Источник.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Ещё вчера были намеки на это, но я решил подождать.
На Arena.ai появилась новая модель jumbo-dungeness.
По сравнению с Grok Imagine 1.0, Grok Imagine 1.5 получит большой прирост в качестве изображений и знаниях о мире. Также, скорее всего, данная модель будет не диффузионной, а совершенно новой: она будет рисовать изображения по пикселям (токенам).
Это отличие от диффузионных работает так: Модель предсказывает и собирает изображение шаг за шагом — точно так же, как языковая модель пишет текст, слово за словом.
Источник.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥1
Светлый Уголок | ии
Grok image imagine 1.5 Модель имеет глубокие знания о мире! Может создавать вот такие вот подобные сайты как NB pro / NB 2
Вот ещё примеры, потом удалю все равно что бы не засорять.