Модель доступна всем на API, под названием
deepseek-v4.1-flash-expires-on-0910.Снова подробно поднимать историю с рероутами не будем. Но ещё со дня запуска DeepSeek Harness мы замечали поведение, похожее на перенаправление запросов к моделям Anthropic при определённых конфигурациях и плагинах. Подозреваем рероуты на Opus 5 на low и Fable 5.
* По нашей версии, это может быть связано со сбором ответов для улучшения собственных моделей. Сам рероут пока окончательно не подтвержден.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀9 2
Светлый Уголок | ии
Модель очень быстрая сейчас и достигает 400tps
🤯18
Forwarded from Geometrybot
🚨 ЭКСКЛЮЗИВ: Anthropic планирует выпустить преемника Fable 5.1 до своего IPO в конце сентября, потенциально в начале октября, если сроки немного сдвинутся
Эта модель станет первым новым претрейном Anthropic для линейки Fable, и они уверены, что она свергнет Astra. Общее настроение среди тех, с кем я говорил в Anthropic, было таким: Astra впечатляет, но из-за неё они не теряют сон
Какой сумасшедший месяц
🍷 @synthwavedd
Эта модель станет первым новым претрейном Anthropic для линейки Fable, и они уверены, что она свергнет Astra. Общее настроение среди тех, с кем я говорил в Anthropic, было таким: Astra впечатляет, но из-за неё они не теряют сон
Какой сумасшедший месяц
Please open Telegram to view this post
VIEW IN TELEGRAM
👀11
Geometrybot
🚨 ЭКСКЛЮЗИВ: Anthropic планирует выпустить преемника Fable 5.1 до своего IPO в конце сентября, потенциально в начале октября, если сроки немного сдвинутся Эта модель станет первым новым претрейном Anthropic для линейки Fable, и они уверены, что она свергнет…
Ребят, небольшое объявление про канал
Сейчас нас два редактора. Мы постоянно собираем информацию о моделях, релизах и внутренних тестированиях, стараемся быстро замечать интересное и рассказывать вам. Спасибо, что цените эту скорость.
Хочу отдельно пояснить момент с датами. Мы внимательно относимся к источникам, но даже достоверная информация о планах компании не гарантирует релиз в названный день. Сроки могут сдвинуться уже после публикации.
Последний пост Leo про преемника Fable 5.1 как раз такой пример. Информация о подготовке новой сильной модели Anthropic поступила к нам ещё в день выхода Astra, но мы пока об этом не писали. По нашему мнению, рассчитывать на релиз уже к концу сентября рано. Начало октября тоже пока только предполагаемый срок. Подтверждённых дат выхода модели и IPO Anthropic у нас нет.
Понимаю, что вы читаете такие новости, надеетесь и ждёте. Мы сами такие же ждуны, нам тоже хочется поскорее попробовать новые модели. Это наша с вами суть такая.
Часть информации мы получаем от своих источников, часть находим в открытых публикациях, документации и новых записях о моделях. Собственные инсайды появляются реже обычных новостей. Иногда между публикацией источника и её появлением здесь проходят буквально секунды.
В последнее время оформление немного сбилось, стало больше коротких пересылок через бота @Geometry91_bot. Он сразу показывает перевод текстом, чтобы вам не приходилось ждать загрузки скриншота. Особенно сейчас, когда у части читателей в России Telegram и медиа загружаются плохо даже с VPN.
Но в таком потоке не всегда сразу понятно, где компания уже объявила о выпуске, где инсайдер рассказал о планах, а где мы сами предполагаем, что происходит, по найденным признакам.
Хотим яснее разделять эти вещи в постах. Например, коротко отмечать: "официально", "по информации источника", "наше предположение". А рядом с неподтверждённой датой прямо писать, что это ожидаемый срок.
Как вам удобнее: такие подписи в тексте или отдельный значок для каждого типа информации? Может, есть вариант лучше? Предложите в комментариях, хочется сделать подачу понятнее и не перегрузить посты.
Сейчас нас два редактора. Мы постоянно собираем информацию о моделях, релизах и внутренних тестированиях, стараемся быстро замечать интересное и рассказывать вам. Спасибо, что цените эту скорость.
Хочу отдельно пояснить момент с датами. Мы внимательно относимся к источникам, но даже достоверная информация о планах компании не гарантирует релиз в названный день. Сроки могут сдвинуться уже после публикации.
Последний пост Leo про преемника Fable 5.1 как раз такой пример. Информация о подготовке новой сильной модели Anthropic поступила к нам ещё в день выхода Astra, но мы пока об этом не писали. По нашему мнению, рассчитывать на релиз уже к концу сентября рано. Начало октября тоже пока только предполагаемый срок. Подтверждённых дат выхода модели и IPO Anthropic у нас нет.
Понимаю, что вы читаете такие новости, надеетесь и ждёте. Мы сами такие же ждуны, нам тоже хочется поскорее попробовать новые модели. Это наша с вами суть такая.
Часть информации мы получаем от своих источников, часть находим в открытых публикациях, документации и новых записях о моделях. Собственные инсайды появляются реже обычных новостей. Иногда между публикацией источника и её появлением здесь проходят буквально секунды.
В последнее время оформление немного сбилось, стало больше коротких пересылок через бота @Geometry91_bot. Он сразу показывает перевод текстом, чтобы вам не приходилось ждать загрузки скриншота. Особенно сейчас, когда у части читателей в России Telegram и медиа загружаются плохо даже с VPN.
@Geometry91_bot Лучший бот для пересылок постов из X в Telegram! (будет обновляться и улучшаться).
Но в таком потоке не всегда сразу понятно, где компания уже объявила о выпуске, где инсайдер рассказал о планах, а где мы сами предполагаем, что происходит, по найденным признакам.
Хотим яснее разделять эти вещи в постах. Например, коротко отмечать: "официально", "по информации источника", "наше предположение". А рядом с неподтверждённой датой прямо писать, что это ожидаемый срок.
Как вам удобнее: такие подписи в тексте или отдельный значок для каждого типа информации? Может, есть вариант лучше? Предложите в комментариях, хочется сделать подачу понятнее и не перегрузить посты.
👌13👀4 1
Светлый Уголок | ии
Бенчи GPT-6 Astra (она набрала 61 в AA??)
https://openai.com/index/navier-stokes-solution/
Please open Telegram to view this post
VIEW IN TELEGRAM
👀6
Forwarded from Geometrybot
Мы делимся решением проблемы Навье-Стокса, одной из задач тысячелетия, одной из глубочайших проблем на переднем крае математики.
Доказательство было получено группой агентов с использованием модели нового поколения от OpenAI, значительно превосходящей по возможностям GPT-6 Astra.
Проблема касается того, может ли описание гладкого трехмерного движения жидкости, моделируемого уравнениями Навье-Стокса, нарушиться. Она остается нерешенной примерно 90 лет.
🍷 @OpenAI
Доказательство было получено группой агентов с использованием модели нового поколения от OpenAI, значительно превосходящей по возможностям GPT-6 Astra.
Проблема касается того, может ли описание гладкого трехмерного движения жидкости, моделируемого уравнениями Навье-Стокса, нарушиться. Она остается нерешенной примерно 90 лет.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀9🤯4
Светлый Уголок | ии
GPT‑Image‑2.5 Flare привносит в API те же улучшения качества, возможностей редактирования и скорости. Это выбор по умолчанию для большинства приложений: модель создает изображения более высокого качества по сравнению с GPT‑Image‑2, а время отклика (задержка) снижено на 50%. Она отлично подходит для самых разных задач — от авторского контента и публикаций для соцсетей до визуализации продуктов, визуального поиска, быстрого прототипирования изображений и их массовой генерации.
GPT‑Image‑2.5 Sunburst создана для профессиональной работы с визуалом, где требуется более точный контроль над процессом редактирования. Используйте эту модель для творческих задач и сложной обработки — например, при создании готовых креативов для рекламных кампаний или безупречных изображений продуктов.
🤯7👀2👌1
Мда, шум остался, артефакты остались, и странный паттерн у листвы остался.
Ну хотя бы редактирование улучшили.
Ну хотя бы редактирование улучшили.
Forwarded from watcharena #rip
✏️ Name updates
lina-alpha ➡️ gpt-image-2.5-flare
displayName:lina-alpha ➡️ gpt-image-2.5-flare
name:null ➡️ lina-alpha-y6hr
organization:null ➡️ openai
provider:null ➡️ customOpenai
lina-f-alpha ➡️ gpt-image-2.5-sunburst
displayName:lina-f-alpha ➡️ gpt-image-2.5-sunburst
name:null ➡️ lina-f-alpha-wyi7
organization:null ➡️ openai
provider:null ➡️ customOpenai
lina-alpha ➡️ gpt-image-2.5-flare
01a02110-7a8a-71a9-9458-709effe0b3a3displayName:
name:
organization:
provider:
lina-f-alpha ➡️ gpt-image-2.5-sunburst
01a03537-4cb0-7842-9e06-b5af8474bf60displayName:
name:
organization:
provider:
👀7 3
watcharena #rip
✏️ Name updates lina-alpha ➡️ gpt-image-2.5-flare 01a02110-7a8a-71a9-9458-709effe0b3a3 displayName: lina-alpha ➡️ gpt-image-2.5-flare name: null ➡️ lina-alpha-y6hr organization: null ➡️ openai provider: null ➡️ customOpenai lina-f-alpha ➡️ gpt-image-2.5-sunburst…
OpenAI выбрала самые худшие контрольные точки GPT Image 2.5, которые, кстати, очень очень, очень ужасные и хуже GPT Image 2.0 в генерации изображений. Я настоятельно рекомендую вам оставаться на GPT Image 2.0.
GPT Image 2.5 будет хуже во всех аспектах: в генерации стилей, в качестве отрисовки, и он будет делать больше слопа — это все наши наблюдения и тесты на притяжении долгого времени.
У них была сильная контрольная точка
GPT Image 2.5 будет хуже во всех аспектах: в генерации стилей, в качестве отрисовки, и он будет делать больше слопа — это все наши наблюдения и тесты на притяжении долгого времени.
У них была сильная контрольная точка
luna-lisa-alpha но они в итоге отказались от нее и решили запустить самый хреновый чекпоинт из всех.
Светлый Уголок | ии
OpenAI выбрала самые худшие контрольные точки GPT Image 2.5, которые, кстати, очень очень, очень ужасные и хуже GPT Image 2.0 в генерации изображений. Я настоятельно рекомендую вам оставаться на GPT Image 2.0. GPT Image 2.5 будет хуже во всех аспектах: в…
Пример ухудшения.
Хотя, кстати, по API у этих моделей шума немного меньше, а в arena.ai его и вовсе нет сейчас. Но в любом случае текущий чекпоинт генерирует slop ещё больше, чем самый лучший за последнее время.
Хотя, кстати, по API у этих моделей шума немного меньше, а в arena.ai его и вовсе нет сейчас. Но в любом случае текущий чекпоинт генерирует slop ещё больше, чем самый лучший за последнее время.
Светлый Уголок | ии
Пример ухудшения. Хотя, кстати, по API у этих моделей шума немного меньше, а в arena.ai его и вовсе нет сейчас. Но в любом случае текущий чекпоинт генерирует slop ещё больше, чем самый лучший за последнее время.
Самое главное изменение: Sunburst и flare поддерживают
Итоговая цена одной картинки зависит от того, сколько output image tokens съест выбранное качество.
Похоже, теперь там используется модель с рассуждениями, которая на
low, medium, high, xhigh, max, auto. То есть появились xhigh и max.Итоговая цена одной картинки зависит от того, сколько output image tokens съест выбранное качество.
Похоже, теперь там используется модель с рассуждениями, которая на
max может переписывать ваш промпт. Если что, переписывание промптов это не всегда хорошо: результаты от этого далеко не обязательно становятся лучше, наоборот чаще хуже.👀8
Forwarded from Geometrybot
Новый GPT Image 2.5, похоже, потерял часть своей креативности и понимания некоторых стилей.
Я провел наглядное сравнение: даже GPT Image 2.0 в веб-версии на (Med) 1K выдал лучший результат, чем GPT Image 2.5 Sunburst на MAX 2K.
Честно говоря, это смешно для «апгрейда»👍
🍷 @Waguri_Kaoruko8
Я провел наглядное сравнение: даже GPT Image 2.0 в веб-версии на (Med) 1K выдал лучший результат, чем GPT Image 2.5 Sunburst на MAX 2K.
Честно говоря, это смешно для «апгрейда»👍
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Geometrybot
- Теряет согласованность стиля в сложных сценах.
- С трудом воспроизводит определенные стили по сравнению с GPT Image 2.0.
- Излишне обрабатывает изображения: слишком яркие, перенасыщенные, с чрезмерным визуальным шумом.
🍷 @Waguri_Kaoruko8
- С трудом воспроизводит определенные стили по сравнению с GPT Image 2.0.
- Излишне обрабатывает изображения: слишком яркие, перенасыщенные, с чрезмерным визуальным шумом.
Please open Telegram to view this post
VIEW IN TELEGRAM
Также с 10 сентября DeepSeek API ждут такие изменения:
Цена кэша с 0,22$ до 0,149$ (-33%)
Цена чтения кэша с 0,007$ до 0,003$ (-60%)
Цена аутпута с 0,66$ до 0,596$ (-11%)
Цены во время нагрузки остаются также 2x.
По сути, цены вернулись к старым.
* если не учитывать цену на аутпут и 2x
По нашим тестам, модель довольно-таки неплохая в WebDev, но потребляет очень много токенов и любит оставлять маленькие недочёты в своих аутпутах. Также она иногда тупит и не может пофиксить один баг, тратя на это 5-10 минут.
Please open Telegram to view this post
VIEW IN TELEGRAM
В arena.ai добавили nano banana 2.5 flash lite.
Эта модель тестируется под кодовым названием
Эта модель тестируется под кодовым названием
spicy-mayo.👀11 3
Светлый Уголок | ии
Deepseek v4.1 flash вышел. Бенчмарки.