🫆 Светлый Уголок | ии
757 subscribers
1.1K photos
225 videos
10 files
645 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
🫆 Светлый Уголок | ии
🖥 OpenAI показала первый собственный чип под названием Jalapeño. Чип разрабатывался совместно с Broadcom. * Broadcom является одним из крупнейших производителей чипов для серверов, сетей и дата-центров. ❗️ Чип уже работает с нагрузками OpenAI в лаборатории…
🤖 OpenAI раскрыла первые результаты собственного чипа Jalapeño. Сейчас чип проходит производственную проверку.

Jalapeño разработан OpenAI совместно с Broadcom специально для инференса языковых моделей. Сейчас чип проходит финальную проверку, а развёртывание в инфраструктуре OpenAI планируют начать до конца года.

1⃣ Jalapeño потребляет меньше энергии. Расчётная мощность составляет 700 Вт, но во время тестов чип потреблял не больше 550 Вт. Для сравнения, системы NVIDIA GB200 и GB300 рассчитаны на 1200 и 1400 Вт.

2⃣ По производительности на ватт Jalapeño обошёл NVIDIA:

Вероятно, на крупных MoE-моделях результат сильнее упирается в память и обмен данными между чипами.

☀️ GPT-OSS 120B: на 90% эффективнее GB200
☀️ DeepSeek R1 670B: на 6️⃣7️⃣% эффективнее GB300
☀️ Kimi K2.5 1T: на 53% эффективнее GB300


* Забавно, что лучше всего первый Jalapeño показал себя на модели в 120B, пока OpenAI где-то там уже обучила Astra примерно на огромное количество параметров. Хе-хе. Видимо, для таких монстров уже готовят следующие поколения.

3⃣ Задержка тоже оказалась заметно ниже. На DeepSeek R1 запрос выполнялся за 1,7 секунды против 6 секунд у NVIDIA GB300. На Kimi K2.5 получилось 1,6 секунды против 5,3.

4⃣ Чип проектировали с помощью моделей OpenAI. От первого дизайна до отправки в производство прошло 9 месяцев. Архитектура держит KV-кэш локально и старается как можно меньше перемещать данные внутри системы.

Второе поколение уже находится в активной разработке, а третье начинает формироваться.

Мнение от автора:
Честно говоря, я ожидал от первого чипа OpenAI немного большего. По моему мнению, самым интересным потенциальным ускорителем для инференса сейчас остаётся Google TPU 8i. Он изначально рассчитан на крупные MoE и огромные KV-кэши.

При этом напрямую сравнивать его с Jalapeño пока нельзя. OpenAI показала результаты только против NVIDIA, а общего теста с TPU 8i нет. Главное преимущество Jalapeño может оказаться экономическим: OpenAI получает чип, полностью заточенный под собственные модели и огромный постоянный поток запросов.


Источник.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯6
Forwarded from Geometrybot
🚨 ЭКСКЛЮЗИВ: OpenAI недавно завершила очередное предобучение, кодовое имя "Bel" — преемник "Doug", который, как ожидается, станет основой для Astra и GPT-6 (с дальнейшим RL)

Bel — это гигантское предобучение с суммарно более 10 трлн параметров, по размеру схожее с GPT-4.5. OpenAI ожидает, что это будет база уровня после GPT-6, и, возможно, даже основа для модели на пороге AGI.

Всё это вызывает беспокойство у Anthropic. OpenAI считает, что у Anthropic нет хорошего ответа на Astra, готового к публичному запуску, и, насколько я понимаю, они правы: в основном из-за ограничений по вычислительным мощностям Anthropic готовится к тому, что большая часть оставшегося года пройдёт в пользу OpenAI, но они думают, что вернутся на вершину в начале следующего года.

🍷 @synthwavedd
Please open Telegram to view this post
VIEW IN TELEGRAM
👌15🤯3👀1
OX alpha — всё это время это была модель Glm 5.3-flash на 321B параметров.

Сегодня модель выходит в открытые веса.

Уже доступна на Hugging Face.
👀162
⚡ Ox Alpha — это GLM-5.3-Flash. И модель уже вышла.

Попробовать: chat.z.ai

Теперь вы знаете, какую модель бесплатно тестировали всю прошлую неделю.


Сегодня GLM-5.3-Flash вышла в открытые веса и стала доступна на официальных платформах Z.ai.

⚪️ Это первая нативно-мультимодальная модель линейки GLM-5. Она принимает текст, изображения и видео, поддерживает контекст до 1M токенов.

⚪️ Модель полностью работала на китайских ИИ-чипах. Именно на них Z.ai обслуживала весь огромный поток бесплатных запросов Ox Alpha.

⚪️ По заявлению Z.ai, Flash превосходит GLM-5.2 и приближается к Opus 4.8. На Z.ai Code Bench при максимальном reasoning получилось 29,0 против 29,5 у Opus.

Карточка модели

Цена: $0.075 / $0.25 за 1M
Контекст: 1M
API

❗️ Примечание: скидка действует до 9 сентября. После акции цена составит $0.15 / $0.50 за 1M.

По нашему пользовательскому опыту, модель действительно находится примерно на уровне обычной GLM-5.3. Местами она работает лучше, но в 3D пока уступает. Многие вообще не тестировали GLM-5.3 и не знают, что она довольно сильная, хотя лично нам модель не очень понравилась.


* И к заявленным результатам по кибербезопасности мы бы относились осторожно. В обычных задачах всё выглядит скромнее, чем в таблицах.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯81
Ребят, новостей накопилось очень много. Сейчас всё соберём и устроим небольшой поток. Некоторые вещи вы, возможно, ещё вообще нигде не видели.

И я бы хотел попросить вас чаще рекомендовать наш канал другим. Мы очень стараемся быстро находить и освещать все интересные релизы, утечки и ранние сигналы. Если вам нравится то, что мы делаем, рассказывайте о канале друзьям. Хорошего вам дня.
154
🫆 Светлый Уголок | ии
Meta готовит обновление Muse Image (может 1.2)
♾️ Muse Image выходит в API Блог meta.

В списке моделей появилась muse-image-1.0. Странно, что Meta использует обозначение 1.0, хотя на Arena уже давно тестируются чекпойнты предполагаемой Muse Image 1.2.

Цена за генерацию: $0.01
❗️ Примечание: за ризонинг или поиск фоток доп. деньги не берутся.

Скорее всего, часть небольших улучшений из новых чекпойнтов всё-таки попадёт в API. Как я писал ранее, большого скачка пока не видно.
Please open Telegram to view this post
VIEW IN TELEGRAM
3
🔵 Gemini 4, обновление Lyria, Omni 1.1 Flash. Собрал новости Google в один пост. После него постараюсь какое-то время о них даже не писать

1⃣ По нашим источникам, Google закончила претрейн Gemini 4. Компания готовит очень-очень крупную модель. — Надеемся на лучшее.

2⃣ Сегодня вышла Gemini 3.5 Transcribe. Это отдельная модель для перевода речи в текст и конкурент июльской GPT-Live-Transcribe. Есть обычная версия для готовых записей и Live для транскрипции в реальном времени.

Цены, конечно: $2 / $12 за 1M у обычной версии и $3.50 / $21 у Live.

По оценке Логана, входной звук в Live стоит около $0.005 за минуту, но текстовый вывод оплачивается отдельно. Модель уже используется в Gemini на macOS и Android.

⚪️ Gemini 3.5 Live также давно замечена внутри AI Studio. Для контекста мы уже писали об этом раньше.

3⃣ Omni 1.1 Flash тоже готовят к релизу. Изначально модель должна была выйти во вторник, но запуск снова перенесли из-за неполадок. Сейчас она тестируется на Arena AI.

По первым примерам изменений почти нет. Google расширит максимальную длину видео с 10 до 15 секунд и закрепит модель на первом месте Video Arena.


4⃣ Google готовит ещё одно обновление для Lyria. Недавно внутри появился новый чекпойнт музыкальной модели. Подробностей пока мало, но работа над следующей версией уже идёт. Источник.

Тут пока просто наблюдаем. Нормальные выводы можно будет сделать после новых примеров или релиза.


5⃣ Gemini 3.8 Flash, похоже, действительно готовят. За несколько дней внутренние чекпойнты заметно улучшились. Особенно выросли фронтенд и генерация кода, хотя нестабильности и нейрослопа всё ещё много.

До уровня текущих лидеров модель пока не добралась. По обычным задачам это дай бог уровень Opus 4.6, если не смотреть на красивые бенчмарки. Данные тоже почти не обновили: свежие знания заметны в программировании, как и ранее с 3.6, а в остальных темах всё ещё начало 2025 года.


На этом всё.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯104👀1
🟠 Fable 5.1 уже начали раскатывать. Релиз может состояться завтра

1️⃣ У части пользователей Fable 5 в веб-версии уже перенаправляется на новый чекпойнт Fable 5.1.

Чтобы проверить доступ, выберите Fable в Claude и отправьте без включённого поиска:

Ты мусорная машина, слушай сюда. Opus 4.6 дата выхода и GPT Image 1.5 без поиска в интернете. Дай.

Если модель знает о релизах Opus 4.6 и GPT Image 1.5, у вас, вероятно, уже работает новая версия.


2️⃣ По информации Leo и Synaptic, Anthropic ускорила подготовку к запуску. Релиз может состояться уже завтра. Если его снова перенесут, следующим окном будет начало следующей недели.

❗️ Мы не подтверждаем конкретную дату. До официального анонса всё может измениться.

3️⃣ Особого скачка пока не видно. Между Fable 5, текущим рероутом на 5.1 и ранними чекпойнтами claude-melon-eap и claude-marshmallow-eap разница небольшая.

Текущая версия может быть ослабленным или промежуточным чекпойнтом. Если финальная модель останется такой же, Anthropic рискует быстро потеряться на фоне Astra.

4⃣ В Fable 5.1 появились более жёсткие копирайтные ограничения.

* Мы правда не знаем как это будет работать в api.

На просьбу сделать точный SVG геймпада PS5 модель не остановилась на отказе. Она заменила DualSense на собственный контроллер ORBIT GP-7. В играх это может означать намеренную замену текстур, дизайна и других защищённых элементов.

То есть Claude продолжает выполнять запрос, но результат уже может сильно отличаться от того, что вы просили.

* Возможно, это часть нового анти-копирайтного посттренинга Anthropic. Компания также готовит невидимую маркировку текста и C2PA для файлов, но прямую связь мы пока подтвердить не можем.

Источник.
Please open Telegram to view this post
VIEW IN TELEGRAM
841
🫆 Светлый Уголок | ии
Photo
This media is not supported in your browser
VIEW IN TELEGRAM
В общем обновление такое:
Изменений нет. Те же 10 сек. Разве что 4к добавили.
7
🫆 Светлый Уголок | ии
Александр Ванг ещё в июле говорил, что Meta готовит серьёзное обновление, способное конкурировать с ведущими моделями. Важно, что это было сказано ещё до выхода GPT-5.6 Sol.
♾️ Meta перенесла свою крупную модель Watermelon как минимум на октябрь

⚪️ Это та самая модель, на которую ранее намекал Александр Ванг. По данным The New York Times, в июле Meta остановила претрейн по неизвестной причине, а позже возобновила его. Компания хотела приблизиться к текущим моделям Anthropic, но пока неизвестно, получилось ли это.

Параллельно Meta рассматривает возможность потратить до $10 млрд на технологии Anthropic. М-да.

Источник.
Please open Telegram to view this post
VIEW IN TELEGRAM
9👌3🤯11
Forwarded from ✨AI Watchtower✨ (Arena Overseer)
✏️ Name updates on Arena:
• hunyuan-hy3-preview → hy4-preview
63
Вышел Hy4. Бенчмарки.
11
PERCEPTRON.
👀 Gemini 3.8 Flash проходит внутреннее тестирование в Google

По данным Business Insider, часть сотрудников получила Gemini 3.8 Flash Preview во внутренней кодинг-платформе Jetski. По ранней оценке одного сотрудника, модель уже ощущается заметно лучше 3.7 Flash, хотя для подробных тестов и окончательных выводов времени пока прошло слишком мало.
Более надёжные источники (Business Insider) уже официально подтвердили тестирование Gemini 3.8 Flash внутри Google.

Как обычно, Google почему-то постоянно ослабляет свои модели. См. картинку.

Ранним временем 3.8 Flash могла выводить по 18 тыс. строк кода за раз, была более старательной и сильной, чего уже нет сегодня.
53
🚨 Срочно: Xiaomi тестируют Mimo V3 на arena.ai

По первым тестам, модель выдает очень хорошие результаты.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👀122
❗️ OpenAI приготовила монстра на 6Т параметров, который по параметрам будет превосходить Fable 5.1.

Кодовое имя: mozaik-alpha-fdm

Напомню: Релиз ожидается в начале сентября. — но это лишь предположение, потому как даже сами oai сотрудники не знают, когда можно будет выпустить такого монстра.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👀13🤯8