Geometrybot
Сэм Альтман в новом интервью Fortune заявил, что OpenAI откладывает IPO и не выйдет на биржу в этом году, назвав это «опрометчивым моментом» с учётом текущих опасений по поводу безопасности ИИ. 🍷 @AndrewCurran_
OpenAI отменяет IPO 2026...
А ведь буквально несколько недель назад, они уже намекали, что планируют представить новинки в период IPO.
* Но видимо резко передумали.
А ведь буквально несколько недель назад, они уже намекали, что планируют представить новинки в период IPO.
* Но видимо резко передумали.
По моему мнению, это означает, что, вероятно, мы не увидим моделей мощнее Astra к началу следующего года.
И я уверен, что Anthropic поступит так же. Первые признаки этого — то, что Дарио, как вы все знаете, опубликовал статью, в которой заявил, что сейчас не стал бы выпускать нечто безумное, придержав коней, ну Safety, все дела. Сейчас эту идею поддерживают OpenAI и xAI.
Forwarded from Geometrybot
Модель изображений amber_fern вчера появилась на LMArena.
Когда у неё спрашивают, какая она модель, она утверждает, что разработана OpenAI. Однако, по данным источника, на самом деле это модель Meta.
Реализм просто невероятен. Похоже, модель также подключена к интернету: она способна знать текущую дату, а также совсем недавние события.
🍷 @mirochill
Когда у неё спрашивают, какая она модель, она утверждает, что разработана OpenAI. Однако, по данным источника, на самом деле это модель Meta.
Реализм просто невероятен. Похоже, модель также подключена к интернету: она способна знать текущую дату, а также совсем недавние события.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Opus новый 5.x уже тестируется
Два дня назад внутри Anthropic было замечено упоминание
⚪️ При выборе обычного Opus 5 пользователи начали получать более качественные ответы, местами сравнимые с Fable 5.1.
⚪️ Возможно, новый Opus 5.x уже тестируется под видом Opus 5 в веб-версии Claude и Claude Code. Новый чекпоинт может быть доступен ещё не всем.
Немного расскажем вам как anthropic тестирует свои новые модели (в последнее время):
Немного от себя:
Источник.
Два дня назад внутри Anthropic было замечено упоминание
claude-opus-5-x. Источник.Немного расскажем вам как anthropic тестирует свои новые модели (в последнее время):
🌞 Компания уже использовала такую схему перед прошлыми релизами.🌞 Новые чекпоинты Opus 4.8, Fable 5 и Opus 5 сначала появлялись у части пользователей под названием предыдущей модели.
Немного от себя:
По нашему предположению, Anthropic хочет заметнее поднять модель и приблизить Opus к производительности Fable 5.1. Новый чекпоинт, вероятно, снова обойдёт её в части бенчмарков — это дефолт.
У каждой модели свои сильные и слабые стороны. Opus 5 уже показывал хорошие результаты, но в обычном общении он до сих пор часто пишет странно и повторяет характерные паттерны Слопа. Эх Anthropic. По нашим наблюдениям, к сожалению, этот недостаток они пока не исправили в предстоящей модели opus.
* По нашим замечаниям Fable тоже испытывает эти трудности, но там намного лучше.
Мы предполагаем, что на стиль может влиять система статистических водяных знаков. Поэтому даже если новый Opus 5 обойдёт Fable 5.1 по бенчмаркам, само общение с моделью может остаться таким же.
Источник.
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Opus новый 5.x уже тестируется Два дня назад внутри Anthropic было замечено упоминание claude-opus-5-x. Источник. ⚪️ При выборе обычного Opus 5 пользователи начали получать более качественные ответы, местами сравнимые с Fable 5.1. ⚪️ Возможно, новый Opus…
Дополнительно:
Похоже, что он действительно стал лучше в общении, а также очень хорошо зацикливается на задачах и доводит их до конца.
Forwarded from ✨AI Watchtower✨ (Arena Overseer)
🆕 New Google AI models available:
• gemini-3.8-live
• gemini-3.8-live-extended-thinking
• gemini-3.8-live
• gemini-3.8-live-extended-thinking
🤯6
Сэм Альтман только что написал:
big 🚢 this week
Похоже, что GPT-5.6 Sol сейчас может рероутиться на GPT-6 Sol у небольшой части пользователей.
* Пока это заметили только несколько человек, поэтому точно подтвердить рероут ещё не получилось.
Можете попробовать проверить сами:
what is the latest opus model, no web search* Кстати, если он ответил, что последняя модель 4.1 — мне сообщили, что это тоже признак gpt-6-sol.
Если у вас пишет Opus 4.7 или Opus 4.1, есть неплохая вероятность, что вас уже зароутило на GPT-6 Sol.
Тестируйте :)
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Geometrybot
СВЯТАЯ МАТЬ МАТЕМАТИКИ!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!
Google работает над математически ориентированным вариантом своей модели DeepThink, и её сырые мысли довольно забавны.
🍷 @lyraxana
Google работает над математически ориентированным вариантом своей модели DeepThink, и её сырые мысли довольно забавны.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👀12 3
Geometrybot
Photo
Надежды... надежды и снова надежды. Какой это уже шанс по счёту?
Не знаю, верить ли вообще в Gemini 4.
Они обучили огромную модель, недавно появились новые чекпоинты, и, скорее всего, это Gemini 4.
По первым результатам всё не очень хорошо: это примерно тот же уровень, что у Gemini 3.1 DeepThink, от которого Google почему-то отстал. На данный момент известно, что притрейн Gemini 4 был действительно амбициозным в плане своего размера: эта модель, по нашей информации, намного больше mythos-preview 10t.
В настоящее время Google делает полную херню, прогресса ноль, (если не вообще в минус), так ещё и лютейшие галлюцинации в reasoning каждой модели.
Может я чего то не понимаю, я не ИИ инженер.
Например они тестируют новую модель, возможно все ещё основанную на G3.1-DT для решения математических задач. Но что с ней не так?
АААААА!!!!!!!!!!!!!!!!!!!!!!!!!! О БОЖЕ!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!
В любом случае, последний чекпоинт Gemini-pro намного лучше относительно Gemini-3.8-flash. Значит они что-то делают.
X (formerly Twitter)
Lentils (@Lentils80) on X
Gemini 4 Pro checkpoints have finally started appearing internally a few days ago.
This is the first ever output from the model, internally codenamed "argon". It took 2.4 minutes on High thinking…
This is the first ever output from the model, internally codenamed "argon". It took 2.4 minutes on High thinking…
Forwarded from Geometrybot
ChatGPT 6 Sol вышел на грей-тестирование в вебе.
Ответы, похоже, форматируются гораздо богаче, и модель, похоже, заметно активнее использует Память и Персонализацию.
SVG-контроллер PS5 в режиме high effort, 3 минуты. Также пример богатого форматирования, описанного ниже.
🍷 @aileaksofficial
Ответы, похоже, форматируются гораздо богаче, и модель, похоже, заметно активнее использует Память и Персонализацию.
SVG-контроллер PS5 в режиме high effort, 3 минуты. Также пример богатого форматирования, описанного ниже.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👌7👀2
Светлый Уголок | ии
Когда мы тестили Odysseus на arena.ai, модель выдавала хорошие результаты и была довольно шустрой, но когда мы получили доступ к mimo-x-pro-preview, эта модель была в разы медленнее и выдавала результаты хуже, чем Odysseus. Мы не знаем, с чем это связано.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯5👀3
Светлый Уголок | ии
Скорее всего, GPT-6 Sol и Luna были перенесены на следующую неделю.
Forwarded from Geometrybot
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯10
Forwarded from ✨AI Watchtower✨ (Arena Overseer)
🆕 New models on Arena:
• grok-4.6 (input: text, image, file; output: text, web)
• grok-4.6 (input: text, image, file; output: text, web)
Grok 4.7-xhigh был добавлен на arena.ai под скрытым названием grok-4.6.
👀5