Не кажется ли вам, что все модели становятся хуже после релиза?
Элита получает лучшие модели, а крестьяне объедки.
Это как начало технологического феодализма. Это к вам господа:🤖 ,🤖 ,🤖 и🤖 .
Элита получает лучшие модели, а крестьяне объедки.
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from 🚨 AI News | TestingCatalog (Alexey)
BREAKING 🚨: Meta updated its Meta AI app with a slightly new design as well as its underlying model.
“I am Meta AI, powered by Muse Spark from the Muse model family.”
It constantly refers to the Muse model family and responses seem to be a bit different from earlier tested Avocado models.
Stealth launch 👀
“I am Meta AI, powered by Muse Spark from the Muse model family.”
It constantly refers to the Muse model family and responses seem to be a bit different from earlier tested Avocado models.
Stealth launch 👀
🚨 AI News | TestingCatalog
Photo
Я и ещё несколько человек, и даже Chetas (тот, что из X) уже протестировали эту модель на нескольких задачах.
Модель, хоть и маленькая, но показывает крутые способности в рассуждениях и мыслит очень здраво. Не хуже чем Opus 4.6.
(Нет, это не значит, что она во всём лучше него, читайте внимательнее, на всякий случай.)
Также у модели наблюдаются отличные способности в визуальных рассуждениях: она хорошо видит.
В другом задачах ещё не тестировали.
Модель, хоть и маленькая, но показывает крутые способности в рассуждениях и мыслит очень здраво. Не хуже чем Opus 4.6.
(Нет, это не значит, что она во всём лучше него, читайте внимательнее, на всякий случай.)
Также у модели наблюдаются отличные способности в визуальных рассуждениях: она хорошо видит.
В другом задачах ещё не тестировали.
Светлый Уголок | ии
Я и ещё несколько человек, и даже Chetas (тот, что из X) уже протестировали эту модель на нескольких задачах. Модель, хоть и маленькая, но показывает крутые способности в рассуждениях и мыслит очень здраво. Не хуже чем Opus 4.6. (Нет, это не значит, что…
Компания Meta анонсирует Muse Spark, первую модель MSL, и новый режим размышлений Muse Spark.
Режим размышлений Muse Spark продемонстрировал результат 58,4% в тесте HLE с использованием инструментов.
В коддинге эта модель не показывает хорошие результаты, зато модель достаточно умная.
Источник.
Meta* — признана экстремистской организацией, деятельность которой запрещена на территории Российской Федерации.
Режим размышлений Muse Spark продемонстрировал результат 58,4% в тесте HLE с использованием инструментов.
В коддинге эта модель не показывает хорошие результаты, зато модель достаточно умная.
Источник.
Meta* — признана экстремистской организацией, деятельность которой запрещена на территории Российской Федерации.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
— Axios
Так же, как и Anthropic с Mythos.
Однако лично у меня большие сомнения насчёт этого.
Please open Telegram to view this post
VIEW IN TELEGRAM
Axios
Scoop: OpenAI plans new product for cybersecurity use
Model-makers are now so worried about the havoc their own tools could cause that they're reluctant to release them into the wild.
Светлый Уголок | ии
Статья была опубликована, но потом сразу же удалена. Хотя, open ai когда-то уже делала так ранее.
🤔1
Кстати, ребята, сегодня ничего не выйдет, в принципе на этой неделе ничего не выйдет.
Gpt image 2 ещё в начале недели стал появляться у некоторых людей.
Хотяяя... Я дейсвительно писал, что GPT Image может выйти на этой неделе — да. Но в начале это было неясно, поэтому я думал так.
OpenAI хотят создать супер-мультимодальную модель, которая будет генерировать видео...
Так что ваша Sora 2, будет перенесена в GPT-модель. (Это мой инсайд, пока не многие имеют понятия, откуда я это взял, и нет, не тот самый Leo).
На мой взгляд, это ответ Gemin Veo4, которая вот-вот могла бы... Блин, стать первой моделью, аналогичной Nano Banana, но с генерацией видео. Но нет. OpenAI явно хочет поторопиться обойти Google.
Так что для Sora 2 потом перенесут свою дату отключения, и естественно, её полностью заменит другая, более умная видео-модель от OpenAI.
Отличной вам недели.🤣
Ну а если выйдет, то я прогадал, но всё равно впринципе очевидно, что не выйдет, не было особых намёков "на сегодня", да и сам сотрудник из OpenAI уже намекнул на релизы на следующих неделях, а не на этой.
Gpt image 2 ещё в начале недели стал появляться у некоторых людей.
(то что сейчас в вебе это v3, на Lm arena индикатор был v5, в a/b тестах - это v3 и v5, но, думаю, что у них есть ещё более новые варианты)
Хотяяя... Я дейсвительно писал, что GPT Image может выйти на этой неделе — да. Но в начале это было неясно, поэтому я думал так.
OpenAI хотят создать супер-мультимодальную модель, которая будет генерировать видео...
Так что ваша Sora 2, будет перенесена в GPT-модель. (Это мой инсайд, пока не многие имеют понятия, откуда я это взял, и нет, не тот самый Leo).
На мой взгляд, это ответ Gemin Veo4, которая вот-вот могла бы... Блин, стать первой моделью, аналогичной Nano Banana, но с генерацией видео. Но нет. OpenAI явно хочет поторопиться обойти Google.
Так что для Sora 2 потом перенесут свою дату отключения, и естественно, её полностью заменит другая, более умная видео-модель от OpenAI.
Отличной вам недели.
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Кстати, ребята, сегодня ничего не выйдет, в принципе на этой неделе ничего не выйдет. Ну а если выйдет, то я прогадал, но всё равно впринципе очевидно, что не выйдет, не было особых намёков "на сегодня", да и сам сотрудник из OpenAI уже намекнул на релизы…
Ну... Не вышла же ведь. 🤷♂
🤔1
Meta's Muse Spark обошла Gemini 3.1 pro на aren.ai.
Первые впечатления от данной модели следующие:
– Отличный текст. Неплохо пишет стихи. Текст не выглядит нагенренным в стиле ИИ, в отличие от Gemini и Chat GPT.
– Умная. В логических задачах столь же умна и максимально универсальна.
– Крутое зрение. Я попробовал её в распознавании изображений. Ей удалось определить, из какого мультфильма персонаж на картинке. Gemini 3.1 pro не смогла понять, кто это, ни с первого, ни со второго раза.
– Код бессмысленный. Уровень фронтенда соответствует Claude Sonnet 3.7. Навыки кодирования этой модели находятся примерно на уровне начала 2025 года; по сравнению с другими моделями это слабо.
Meta* — запрещена в рф.
Повторяю вам: Meta's Muse Spark — не самая мощная модель Meta, которая у них есть внутри, и уже сейчас она показывает неплохие результаты. Они смогут вернуться в гонку, если усилят навыки кодирования, где сейчас очень высокий спрос и огромная конкуренция.
Первые впечатления от данной модели следующие:
– Отличный текст. Неплохо пишет стихи. Текст не выглядит нагенренным в стиле ИИ, в отличие от Gemini и Chat GPT.
– Умная. В логических задачах столь же умна и максимально универсальна.
– Крутое зрение. Я попробовал её в распознавании изображений. Ей удалось определить, из какого мультфильма персонаж на картинке. Gemini 3.1 pro не смогла понять, кто это, ни с первого, ни со второго раза.
– Код бессмысленный. Уровень фронтенда соответствует Claude Sonnet 3.7. Навыки кодирования этой модели находятся примерно на уровне начала 2025 года; по сравнению с другими моделями это слабо.
Meta* — запрещена в рф.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Возможно ли, что GPT Super App будет представлен со следующими новыми моделями уже на следующей неделе? Как вы думаете?
В нём как правило будет начальная комбинация CHAT GPT+ CODEX.
Ещё на следующей неделе ожидается GPT IMAGE 2.0 и GPT 5.5 / 5o (тут неизвестно).
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Все уже знают, что GPT Image сейчас тестируется в веб-версии ChatGPT.
А во вкладке Network всегда можно подсмотреть, какая именно версия вам выпала.
Чаще всего это A/B-тест GPT-1.5 img против GPT-2 img, но иногда попадаются и две разные сборки GPT-2 img.
И мне попадалось несколько:
▎ig2(img2)-37p-50ir0324-90p-step1600-ev3
▎lg2(img2)-37p-50ir0328-95p-step1600-ev5
▎ig2(img2)-37p-50ir0328-105p-step1600-ev4
И это не всё.
Вчера доступ выдали случайно. Утром зашёл через VPN Северной Кореи, хотел половить A/B-тест, а картинки и так идеальные. У некоторых его тогда и вовсе забрали.
Я посмотрел индикатор и, как и я догадывался, всем избранным алгоритмами, кому выпадала новая версия GPT Image, досталась именно V3.
А во вкладке Network всегда можно подсмотреть, какая именно версия вам выпала.
Чаще всего это A/B-тест GPT-1.5 img против GPT-2 img, но иногда попадаются и две разные сборки GPT-2 img.
И мне попадалось несколько:
▎ig2(img2)-37p-50ir0324-90p-step1600-ev3
▎lg2(img2)-37p-50ir0328-95p-step1600-ev5
▎ig2(img2)-37p-50ir0328-105p-step1600-ev4
И это не всё.
Вчера доступ выдали случайно. Утром зашёл через VPN Северной Кореи, хотел половить A/B-тест, а картинки и так идеальные. У некоторых его тогда и вовсе забрали.
Я посмотрел индикатор и, как и я догадывался, всем избранным алгоритмами, кому выпадала новая версия GPT Image, досталась именно V3.
Нам даже в качестве основной базы дают далеко не самую свежую версию, но при этом всё равно прогоняют через A/B-тесты. И даже с такими вводными результаты выглядят очень круто.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM