— Axios
Так же, как и Anthropic с Mythos.
Однако лично у меня большие сомнения насчёт этого.
Please open Telegram to view this post
VIEW IN TELEGRAM
Axios
Scoop: OpenAI plans new product for cybersecurity use
Model-makers are now so worried about the havoc their own tools could cause that they're reluctant to release them into the wild.
Светлый Уголок | ии
Статья была опубликована, но потом сразу же удалена. Хотя, open ai когда-то уже делала так ранее.
🤔1
Кстати, ребята, сегодня ничего не выйдет, в принципе на этой неделе ничего не выйдет.
Gpt image 2 ещё в начале недели стал появляться у некоторых людей.
Хотяяя... Я дейсвительно писал, что GPT Image может выйти на этой неделе — да. Но в начале это было неясно, поэтому я думал так.
OpenAI хотят создать супер-мультимодальную модель, которая будет генерировать видео...
Так что ваша Sora 2, будет перенесена в GPT-модель. (Это мой инсайд, пока не многие имеют понятия, откуда я это взял, и нет, не тот самый Leo).
На мой взгляд, это ответ Gemin Veo4, которая вот-вот могла бы... Блин, стать первой моделью, аналогичной Nano Banana, но с генерацией видео. Но нет. OpenAI явно хочет поторопиться обойти Google.
Так что для Sora 2 потом перенесут свою дату отключения, и естественно, её полностью заменит другая, более умная видео-модель от OpenAI.
Отличной вам недели.🤣
Ну а если выйдет, то я прогадал, но всё равно впринципе очевидно, что не выйдет, не было особых намёков "на сегодня", да и сам сотрудник из OpenAI уже намекнул на релизы на следующих неделях, а не на этой.
Gpt image 2 ещё в начале недели стал появляться у некоторых людей.
(то что сейчас в вебе это v3, на Lm arena индикатор был v5, в a/b тестах - это v3 и v5, но, думаю, что у них есть ещё более новые варианты)
Хотяяя... Я дейсвительно писал, что GPT Image может выйти на этой неделе — да. Но в начале это было неясно, поэтому я думал так.
OpenAI хотят создать супер-мультимодальную модель, которая будет генерировать видео...
Так что ваша Sora 2, будет перенесена в GPT-модель. (Это мой инсайд, пока не многие имеют понятия, откуда я это взял, и нет, не тот самый Leo).
На мой взгляд, это ответ Gemin Veo4, которая вот-вот могла бы... Блин, стать первой моделью, аналогичной Nano Banana, но с генерацией видео. Но нет. OpenAI явно хочет поторопиться обойти Google.
Так что для Sora 2 потом перенесут свою дату отключения, и естественно, её полностью заменит другая, более умная видео-модель от OpenAI.
Отличной вам недели.
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Кстати, ребята, сегодня ничего не выйдет, в принципе на этой неделе ничего не выйдет. Ну а если выйдет, то я прогадал, но всё равно впринципе очевидно, что не выйдет, не было особых намёков "на сегодня", да и сам сотрудник из OpenAI уже намекнул на релизы…
Ну... Не вышла же ведь. 🤷♂
🤔1
Meta's Muse Spark обошла Gemini 3.1 pro на aren.ai.
Первые впечатления от данной модели следующие:
– Отличный текст. Неплохо пишет стихи. Текст не выглядит нагенренным в стиле ИИ, в отличие от Gemini и Chat GPT.
– Умная. В логических задачах столь же умна и максимально универсальна.
– Крутое зрение. Я попробовал её в распознавании изображений. Ей удалось определить, из какого мультфильма персонаж на картинке. Gemini 3.1 pro не смогла понять, кто это, ни с первого, ни со второго раза.
– Код бессмысленный. Уровень фронтенда соответствует Claude Sonnet 3.7. Навыки кодирования этой модели находятся примерно на уровне начала 2025 года; по сравнению с другими моделями это слабо.
Meta* — запрещена в рф.
Повторяю вам: Meta's Muse Spark — не самая мощная модель Meta, которая у них есть внутри, и уже сейчас она показывает неплохие результаты. Они смогут вернуться в гонку, если усилят навыки кодирования, где сейчас очень высокий спрос и огромная конкуренция.
Первые впечатления от данной модели следующие:
– Отличный текст. Неплохо пишет стихи. Текст не выглядит нагенренным в стиле ИИ, в отличие от Gemini и Chat GPT.
– Умная. В логических задачах столь же умна и максимально универсальна.
– Крутое зрение. Я попробовал её в распознавании изображений. Ей удалось определить, из какого мультфильма персонаж на картинке. Gemini 3.1 pro не смогла понять, кто это, ни с первого, ни со второго раза.
– Код бессмысленный. Уровень фронтенда соответствует Claude Sonnet 3.7. Навыки кодирования этой модели находятся примерно на уровне начала 2025 года; по сравнению с другими моделями это слабо.
Meta* — запрещена в рф.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Возможно ли, что GPT Super App будет представлен со следующими новыми моделями уже на следующей неделе? Как вы думаете?
В нём как правило будет начальная комбинация CHAT GPT+ CODEX.
Ещё на следующей неделе ожидается GPT IMAGE 2.0 и GPT 5.5 / 5o (тут неизвестно).
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Все уже знают, что GPT Image сейчас тестируется в веб-версии ChatGPT.
А во вкладке Network всегда можно подсмотреть, какая именно версия вам выпала.
Чаще всего это A/B-тест GPT-1.5 img против GPT-2 img, но иногда попадаются и две разные сборки GPT-2 img.
И мне попадалось несколько:
▎ig2(img2)-37p-50ir0324-90p-step1600-ev3
▎lg2(img2)-37p-50ir0328-95p-step1600-ev5
▎ig2(img2)-37p-50ir0328-105p-step1600-ev4
И это не всё.
Вчера доступ выдали случайно. Утром зашёл через VPN Северной Кореи, хотел половить A/B-тест, а картинки и так идеальные. У некоторых его тогда и вовсе забрали.
Я посмотрел индикатор и, как и я догадывался, всем избранным алгоритмами, кому выпадала новая версия GPT Image, досталась именно V3.
А во вкладке Network всегда можно подсмотреть, какая именно версия вам выпала.
Чаще всего это A/B-тест GPT-1.5 img против GPT-2 img, но иногда попадаются и две разные сборки GPT-2 img.
И мне попадалось несколько:
▎ig2(img2)-37p-50ir0324-90p-step1600-ev3
▎lg2(img2)-37p-50ir0328-95p-step1600-ev5
▎ig2(img2)-37p-50ir0328-105p-step1600-ev4
И это не всё.
Вчера доступ выдали случайно. Утром зашёл через VPN Северной Кореи, хотел половить A/B-тест, а картинки и так идеальные. У некоторых его тогда и вовсе забрали.
Я посмотрел индикатор и, как и я догадывался, всем избранным алгоритмами, кому выпадала новая версия GPT Image, досталась именно V3.
Нам даже в качестве основной базы дают далеко не самую свежую версию, но при этом всё равно прогоняют через A/B-тесты. И даже с такими вводными результаты выглядят очень круто.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Всех причастных к делу с праздником.
Поздравить вас могу)
Христос воскресе!👋
Поздравить вас могу)
Христос воскресе!
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥11
Opus 4.6 сильно ослабили.
Зацените обложку от gpt 2 image.😀
Я решил сделать этот пост, так как стал часто натыкаться на жалобы в X.
Я заметил это еще в феврале, когда прилетел домой после отпуска, тогда я много вайб-кодил и строил "свой проект" (который там уже скоро когда-то).
Тогдашний Claude 4.6 Opus реально впечатлял. Но уже через неделю я поймал даунгрейд: он стал делать примерно на 10% меньше, чем мог. Это было заметно. Это был один из лучших провайдеров, так что дело не в нём, не подумайте там.
Я всегда говорю, что модели тихо ослабляют.
После официального анонса Claude Mythos, Claude 4.6 будто окончательно подрезали. Последние недели я почти не вайбкодил и Клодом не пользовался, но сейчас лента полна жалоб, и я понимаю почему. Вот пример: Источник.
Bridgebench.ai от ребят BridgeMind подтвердил, что у Opus 4.6 реально снизили уровень рассуждений, модель ослаблена.
Люди, которые постоянно гоняют модели на своем бенчмарке, прогнали Opus 4.6 заново:
▎На прошлой неделе Claude Opus 4.6 был на #2 с точностью 83,3%.
▎Сегодня тот же Claude Opus 4.6 упал на #10 с точностью 68,3%. Ещё и рост галлюцинаций: теперь она имеет #87.6%.
И как тут не согласиться? Это же очевидно. Сам факт, что они втихаря режут модель, уже всё объясняет. Это уже как будто агрессивная компания, которая готова на всё ради экономии. Хотя так делают все, хах.
Они выпустили Mythos, но что показали в итоге? Кроме одного неофициального svg (это реально был mythos) и некоторых отчетов о его способностях анализа кода, ничего больше не показали вообще. Это лишь слова и какие-то подтверждения от людей. Ровно как Google со своей Gemini 2.5 Deep Think, которую 4 (вроде) месяца держали для закрытого круга.
BridgeBench, насколько я понимаю, оценивает именно кодинг и прикладные скиллы модели, а не общие способности модели. Это не универсальный бенчмарк.
Простите, что без подробного разбора, что это за штука, хотел просто привести пример. По большому счету, идеальность тут не главное: бенчмарк делают живые люди, и ценен именно их практический опыт. Я регулярно слежу за их работой и вижу, что их недовольства и отчеты часто совпадают с нашим мнением, с мнением нашего сообщества.
Хорошо, что есть такие бенчмарки, где это можно поймать за руку. Opus 4.6 еще можно юзать, он многое умеет, но будьте бдительны, он теперь будет галлюцинировать сильнее.
И главное. Никто не будет перемерять модели заново. Ни LM Arena, ни Artificial Analysis. Никто из них не будет этого делать, потому что им это выгодно.
Вот такой у нас лживый мир.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Opus 4.6 сильно ослабили. Зацените обложку от gpt 2 image. 😀 Я решил сделать этот пост, так как стал часто натыкаться на жалобы в X. Я заметил это еще в феврале, когда прилетел домой после отпуска, тогда я много вайб-кодил и строил "свой проект" (который…
Ребята, простите, что так безответственно отнесся к написанию этого поста.
Я вообще тестирую некоторые вещи, и поэтому решил, что просто накидаю в черновик и скину нейронке, пусть решает, что и как улучшить. И знаете, вышло ужасно: весь текст написала только она — я лишь прочел его. Мне пришлось сейчас перерабатывать его самому. В общем-то, я просто переписал его и сделал своим. Прочтите заново, если сами того желаете.
Я вообще тестирую некоторые вещи, и поэтому решил, что просто накидаю в черновик и скину нейронке, пусть решает, что и как улучшить. И знаете, вышло ужасно: весь текст написала только она — я лишь прочел его. Мне пришлось сейчас перерабатывать его самому. В общем-то, я просто переписал его и сделал своим. Прочтите заново, если сами того желаете.
❤🔥4
«Генеральный директор OpenAI Сэм Олтман не имеет ни малейшего представления, как работает технология искусственного интеллекта его собственной компании»
Это забавно. Если думал об этом, то пожалуй так и полагал, когда думал.
Истоник.
Это забавно. Если думал об этом, то пожалуй так и полагал, когда думал.
Истоник.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔2
Энтони Моррис, сотрудник Anthropic AI, заявил, что новая версия Claude Code выйдет на следующей неделе и будет намного лучше.
Вообще, почитав его комментарии под этим постом, я понял, что он КЛОУН.
Заметно оправдывается, отвечает на недоброжелательные комментарии и хамит. Крутой сотрудник. Да.
Лично меня это не волнует, но вот вам новость на всякий случай.
Вообще, почитав его комментарии под этим постом, я понял, что он КЛОУН.
Заметно оправдывается, отвечает на недоброжелательные комментарии и хамит. Крутой сотрудник. Да.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Энтони Моррис, сотрудник Anthropic AI, заявил, что новая версия Claude Code выйдет на следующей неделе и будет намного лучше. Лично меня это не волнует, но вот вам новость на всякий случай. Вообще, почитав его комментарии под этим постом, я понял, что он…
Ещё, судя по намёкам сотрудников OpenAI, они явно уже готовятся выпустить Super App или что-то вроде обновлённого Codex v2 уже на этой неделе.
Так что сомнений, что на этой неделе ничего от них не выйдет, нет.
Так что сомнений, что на этой неделе ничего от них не выйдет, нет.
Да уж. Круто, когда сотрудники разных компаний всё равно так часто коммуницируют между собой. Мне жаль Google. Их заставляют молчать, я не вижу их обсуждений в X и так далее. Единственный, кому дают право голоса о том, что якобы в этот день релиз, — это Логан Килпатрик.
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Эта модель очень крута в создании инфографики. Просто посмотрите на это изображение.
Промт был: Создай изображение что такое модель Nano banana / pro от google ? что она умеет покажи всё.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥12
Вот все доступные скриншоты ранней версии. Можете посмотреть изменения, которые нас ждут.
Я уверен, что это пока что всё, что они выпустят в Super app. Чтобы интегрировать полноценный ChatGPT или, например, Altas, понадобится ещё достаточно не мало времени.
Источники:
— 1
— 2
🌌 Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM