🫆 Светлый Уголок | ии
748 subscribers
1.1K photos
224 videos
10 files
644 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
ИИ превзошел и зариколлил тебя, ха-ха.
— Astra.

#оффтоп
8👀4
GPT-6 Sol Max/GPT 6 Astra Max

Аутпут Sol занял 3 минуты/Аутпут Astra занял 19 минут


Источник.
🤯8
🐋 В API DeepSeek тестируется V4.1 Flash

Модель доступна всем на API, под названием deepseek-v4.1-flash-expires-on-0910.

⚪️ В сообщении для тестеров заявлены новая архитектура, нативная мультимодальность, улучшение возможностей и скорости. Пока тарификация такая же, как у V4 Flash.

Снова подробно поднимать историю с рероутами не будем. Но ещё со дня запуска DeepSeek Harness мы замечали поведение, похожее на перенаправление запросов к моделям Anthropic при определённых конфигурациях и плагинах. Подозреваем рероуты на Opus 5 на low и Fable 5.

* По нашей версии, это может быть связано со сбором ответов для улучшения собственных моделей. Сам рероут пока окончательно не подтвержден.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀92
Forwarded from Geometrybot
🚨 ЭКСКЛЮЗИВ: Anthropic планирует выпустить преемника Fable 5.1 до своего IPO в конце сентября, потенциально в начале октября, если сроки немного сдвинутся

Эта модель станет первым новым претрейном Anthropic для линейки Fable, и они уверены, что она свергнет Astra. Общее настроение среди тех, с кем я говорил в Anthropic, было таким: Astra впечатляет, но из-за неё они не теряют сон

Какой сумасшедший месяц

🍷 @synthwavedd
Please open Telegram to view this post
VIEW IN TELEGRAM
👀11
Geometrybot
🚨 ЭКСКЛЮЗИВ: Anthropic планирует выпустить преемника Fable 5.1 до своего IPO в конце сентября, потенциально в начале октября, если сроки немного сдвинутся Эта модель станет первым новым претрейном Anthropic для линейки Fable, и они уверены, что она свергнет…
Ребят, небольшое объявление про канал

Сейчас нас два редактора. Мы постоянно собираем информацию о моделях, релизах и внутренних тестированиях, стараемся быстро замечать интересное и рассказывать вам. Спасибо, что цените эту скорость.

Хочу отдельно пояснить момент с датами. Мы внимательно относимся к источникам, но даже достоверная информация о планах компании не гарантирует релиз в названный день. Сроки могут сдвинуться уже после публикации.

Последний пост Leo про преемника Fable 5.1 как раз такой пример. Информация о подготовке новой сильной модели Anthropic поступила к нам ещё в день выхода Astra, но мы пока об этом не писали. По нашему мнению, рассчитывать на релиз уже к концу сентября рано. Начало октября тоже пока только предполагаемый срок. Подтверждённых дат выхода модели и IPO Anthropic у нас нет.

Понимаю, что вы читаете такие новости, надеетесь и ждёте. Мы сами такие же ждуны, нам тоже хочется поскорее попробовать новые модели. Это наша с вами суть такая.

Часть информации мы получаем от своих источников, часть находим в открытых публикациях, документации и новых записях о моделях. Собственные инсайды появляются реже обычных новостей. Иногда между публикацией источника и её появлением здесь проходят буквально секунды.

В последнее время оформление немного сбилось, стало больше коротких пересылок через бота @Geometry91_bot. Он сразу показывает перевод текстом, чтобы вам не приходилось ждать загрузки скриншота. Особенно сейчас, когда у части читателей в России Telegram и медиа загружаются плохо даже с VPN.

@Geometry91_bot Лучший бот для пересылок постов из X в Telegram! (будет обновляться и улучшаться).


Но в таком потоке не всегда сразу понятно, где компания уже объявила о выпуске, где инсайдер рассказал о планах, а где мы сами предполагаем, что происходит, по найденным признакам.

Хотим яснее разделять эти вещи в постах. Например, коротко отмечать: "официально", "по информации источника", "наше предположение". А рядом с неподтверждённой датой прямо писать, что это ожидаемый срок.

Как вам удобнее: такие подписи в тексте или отдельный значок для каждого типа информации? Может, есть вариант лучше? Предложите в комментариях, хочется сделать подачу понятнее и не перегрузить посты.
👌13👀41
🫆 Светлый Уголок | ии
Бенчи GPT-6 Astra (она набрала 61 в AA??)
🤖Внутренняя модель OpenAI только что решила одну из задач тысячелетия

https://openai.com/index/navier-stokes-solution/
Please open Telegram to view this post
VIEW IN TELEGRAM
👀6
Forwarded from Geometrybot
Мы делимся решением проблемы Навье-Стокса, одной из задач тысячелетия, одной из глубочайших проблем на переднем крае математики.

Доказательство было получено группой агентов с использованием модели нового поколения от OpenAI, значительно превосходящей по возможностям GPT-6 Astra.

Проблема касается того, может ли описание гладкого трехмерного движения жидкости, моделируемого уравнениями Навье-Стокса, нарушиться. Она остается нерешенной примерно 90 лет.

🍷 @OpenAI
Please open Telegram to view this post
VIEW IN TELEGRAM
👀9🤯4
🫆 Светлый Уголок | ии
🤖Официально вышла GPT-Image 2.5 https://openai.com/index/introducing-chatgpt-images-2-5/
GPT‑Image‑2.5 Flare привносит в API те же улучшения качества, возможностей редактирования и скорости. Это выбор по умолчанию для большинства приложений: модель создает изображения более высокого качества по сравнению с GPT‑Image‑2, а время отклика (задержка) снижено на 50%. Она отлично подходит для самых разных задач — от авторского контента и публикаций для соцсетей до визуализации продуктов, визуального поиска, быстрого прототипирования изображений и их массовой генерации.

GPT‑Image‑2.5 Sunburst создана для профессиональной работы с визуалом, где требуется более точный контроль над процессом редактирования. Используйте эту модель для творческих задач и сложной обработки — например, при создании готовых креативов для рекламных кампаний или безупречных изображений продуктов.
🤯7👀2👌1
Мда, шум остался, артефакты остались, и странный паттерн у листвы остался.
Ну хотя бы редактирование улучшили.
11👀3
Forwarded from watcharena #rip
✏️ Name updates
lina-alpha ➡️ gpt-image-2.5-flare
01a02110-7a8a-71a9-9458-709effe0b3a3
displayName: lina-alpha ➡️ gpt-image-2.5-flare
name: null ➡️ lina-alpha-y6hr
organization: null ➡️ openai
provider: null ➡️ customOpenai

lina-f-alpha ➡️ gpt-image-2.5-sunburst
01a03537-4cb0-7842-9e06-b5af8474bf60
displayName: lina-f-alpha ➡️ gpt-image-2.5-sunburst
name: null ➡️ lina-f-alpha-wyi7
organization: null ➡️ openai
provider: null ➡️ customOpenai
👀73
watcharena #rip
✏️ Name updates lina-alpha ➡️ gpt-image-2.5-flare 01a02110-7a8a-71a9-9458-709effe0b3a3 displayName: lina-alpha ➡️ gpt-image-2.5-flare name: null ➡️ lina-alpha-y6hr organization: null ➡️ openai provider: null ➡️ customOpenai lina-f-alpha ➡️ gpt-image-2.5-sunburst…
OpenAI выбрала самые худшие контрольные точки GPT Image 2.5, которые, кстати, очень очень, очень ужасные и хуже GPT Image 2.0 в генерации изображений. Я настоятельно рекомендую вам оставаться на GPT Image 2.0.

GPT Image 2.5 будет хуже во всех аспектах: в генерации стилей, в качестве отрисовки, и он будет делать больше слопа — это все наши наблюдения и тесты на притяжении долгого времени.

У них была сильная контрольная точка luna-lisa-alpha но они в итоге отказались от нее и решили запустить самый хреновый чекпоинт из всех.
13🤯22👀1
🫆 Светлый Уголок | ии
OpenAI выбрала самые худшие контрольные точки GPT Image 2.5, которые, кстати, очень очень, очень ужасные и хуже GPT Image 2.0 в генерации изображений. Я настоятельно рекомендую вам оставаться на GPT Image 2.0. GPT Image 2.5 будет хуже во всех аспектах: в…
Пример ухудшения.

Хотя, кстати, по API у этих моделей шума немного меньше, а в arena.ai его и вовсе нет сейчас. Но в любом случае текущий чекпоинт генерирует slop ещё больше, чем самый лучший за последнее время.
6👀1
🫆 Светлый Уголок | ии
Пример ухудшения. Хотя, кстати, по API у этих моделей шума немного меньше, а в arena.ai его и вовсе нет сейчас. Но в любом случае текущий чекпоинт генерирует slop ещё больше, чем самый лучший за последнее время.
Самое главное изменение: Sunburst и flare поддерживают low, medium, high, xhigh, max, auto. То есть появились xhigh и max.

Итоговая цена одной картинки зависит от того, сколько output image tokens съест выбранное качество.

Похоже, теперь там используется модель с рассуждениями, которая на max может переписывать ваш промпт. Если что, переписывание промптов это не всегда хорошо: результаты от этого далеко не обязательно становятся лучше, наоборот чаще хуже.
👀8
Forwarded from Geometrybot
Новый GPT Image 2.5, похоже, потерял часть своей креативности и понимания некоторых стилей.

Я провел наглядное сравнение: даже GPT Image 2.0 в веб-версии на (Med) 1K выдал лучший результат, чем GPT Image 2.5 Sunburst на MAX 2K.

Честно говоря, это смешно для «апгрейда»👍

🍷 @Waguri_Kaoruko8
Please open Telegram to view this post
VIEW IN TELEGRAM
6
Forwarded from Geometrybot
- Теряет согласованность стиля в сложных сценах.
- С трудом воспроизводит определенные стили по сравнению с GPT Image 2.0.
- Излишне обрабатывает изображения: слишком яркие, перенасыщенные, с чрезмерным визуальным шумом.

🍷 @Waguri_Kaoruko8
Please open Telegram to view this post
VIEW IN TELEGRAM
4👀3
🐋10 сентября официально выйдет DeepSeek 4.1 Flash.

Также с 10 сентября DeepSeek API ждут такие изменения:
⚪️Все запросы на DeepSeek V4 Pro будут рероутиться на V4.1 Flash, до выхода V4.1 Pro.

⚪️Cнизятся цены на Flash:
Цена кэша с 0,22$ до 0,149$ (-33%)
Цена чтения кэша с 0,007$ до 0,003$ (-60%)
Цена аутпута с 0,66$ до 0,596$ (-11%)
Цены во время нагрузки остаются также 2x.

По сути, цены вернулись к старым.
* если не учитывать цену на аутпут и 2x

По нашим тестам, модель довольно-таки неплохая в WebDev, но потребляет очень много токенов и любит оставлять маленькие недочёты в своих аутпутах. Также она иногда тупит и не может пофиксить один баг, тратя на это 5-10 минут.
Please open Telegram to view this post
VIEW IN TELEGRAM
12👀1