Светлый Уголок | ии
Кими K3 отстаёт только от GPT-5.6 Sol и Fable-5 в оценках бенчмарков — источник карточка модели.
* Веса будут выпущены в ближайшие дни
* Веса будут выпущены в ближайшие дни
Бенчмарки Kimi k3. Не полные.
По ним уже можно увидеть, что модель превосходит всех (и возможно вообще во всем), кроме GPT-5.6, Sol и Fable-5.
Источник.
По ним уже можно увидеть, что модель превосходит всех (и возможно вообще во всем), кроме GPT-5.6, Sol и Fable-5.
Источник.
🤯8
Forwarded from Geometrybot
Большая новость: Kimi-K3 от @Kimi_Moonshot теперь #1 в Frontend Code Arena с 1679 баллами, обогнав Claude Fable 5.
Это прыжок на 17 позиций с Kimi-k2.6 (#18 -> #1).
Во Frontend Kimi-K3 занял #1 в 6 из 7 доменов: Brand & Marketing, Reference-Based Design, Data & Analytics, Consumer Product, Simulations и Content Creation Tools, оказавшись #2 только в Gaming, уступив Fable 5.
Полные веса модели будут выпущены до 27 июля.
Поздравляем команду @Kimi_Moonshot с этим важным достижением!
🍷 @arena · оригинал
Это прыжок на 17 позиций с Kimi-k2.6 (#18 -> #1).
Во Frontend Kimi-K3 занял #1 в 6 из 7 доменов: Brand & Marketing, Reference-Based Design, Data & Analytics, Consumer Product, Simulations и Content Creation Tools, оказавшись #2 только в Gaming, уступив Fable 5.
Полные веса модели будут выпущены до 27 июля.
Поздравляем команду @Kimi_Moonshot с этим важным достижением!
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Kimi K3 теперь доступна в Arena.ai
Админ Arena.ai сказал, что Kimi K3 была добавлена в Direct Mode по случайности, и что она будет только в Battle Mode
Неужели она настолько дорогая даже для них?
Неужели она настолько дорогая даже для них?
Возможно, завтра представят приложение ai.studio или же Gemini 3.5 Flash Lite. Черт его знает, пофиг на них.
Официально: Gemini 3.5 Pro откладывается. — Bloomberg.
* Я понимаю что говорю об этом много, но теперь заключительно сообщу в связи с этой новостью.
Google отстаёт от графика на несколько месяцев, и главная причина в кодинге.
Наш инсайд из прошлых постов подтвердился. Источник
⚪️ Модель должна была выйти 17 июля.
⚪️ В конце июня Google обновила данные Gemini для обучения, чтобы подтянуть навыки программирования. Результаты разочаровали: старые галлюцинации никуда не делись, модель не может признать события 2025 и 2026 годов.
⚪️ Внутри всё упирается в мощности и инструменты. Инженеры сталкиваются с ограничениями по ёмкости, сейчас идёт объединение внутренних ИИ-инструментов для программирования.
⚪️ Google пытается удержать сотрудников DeepMind. Люди разочарованы ситуацией и собираются уходить. Внутри боятся, что компания теряет позиции на фоне Anthropic и OpenAI.
* Я понимаю что говорю об этом много, но теперь заключительно сообщу в связи с этой новостью.
Google отстаёт от графика на несколько месяцев, и главная причина в кодинге.
Наш инсайд из прошлых постов подтвердился. Источник
Главное, что они не сдаются, и это видно. Обычно после подобных неудач Google возвращается с более-менее хорошими результатами.
Наше расчётное время релиза: август-сентябрь. Это можно понять по их текущим контрольным точкам, что они выдают тестерам, а мы их видим и проверяем. Они пока-что очень далеко от Ant и oAI.
Please open Telegram to view this post
VIEW IN TELEGRAM
❗️Fable 5 внезапно пропала из подписок.
Модель исчезла у всех и везде: в Claude Code и в приложении, на всех планах.
Anthropic так со своими пользователями не договаривалась: отключение было запланировано на 19 июля.
Неужели внеплановое отключение? Достоверный источник сообщил нам, что Opus 5 сегодня точно не выйдет. Так что на скорый релиз это не списать.
* Мы уже писали, что Fable 5 должна уйти из подписок, но ждали этого ближе к выходу Opus 5.
Следим за ситуацией.
UPD: Модель вернули в подписки, это была ошибка на стороне серверов.
Модель исчезла у всех и везде: в Claude Code и в приложении, на всех планах.
Anthropic так со своими пользователями не договаривалась: отключение было запланировано на 19 июля.
Неужели внеплановое отключение? Достоверный источник сообщил нам, что Opus 5 сегодня точно не выйдет. Так что на скорый релиз это не списать.
* Мы уже писали, что Fable 5 должна уйти из подписок, но ждали этого ближе к выходу Opus 5.
Следим за ситуацией.
UPD: Модель вернули в подписки, это была ошибка на стороне серверов.
👀3
Seedance 2.5, как обстоят дела? Что там по улучшениям?
От себя отмечу:
Главные заметки по наблюдениям:
⚪️ Русский язык лучше не стал. Если ждали, что версия 2.5 исправит кальки с произношением русской речи, то нет.
⚪️ Но есть моменты, где она реально хороша. Раскадровка стала немного лучше, экспозицию модель подбирает круче. Реализм, похоже, тоже чуть подрос.
⚪️ Очень долгая раскатка. Они уже всех задрали своими обещаниями. В общем, полноценный релиз мы, вероятно, получим только в конце июля-месяца.
На этом всё. Прикрепил пару примеров.
От себя отмечу:
Сейчас мы, похоже, получили расширение роликов до 30 секунд, не больше. Кажется, они даже не запускали новое обучение — просто усилили для неё compute.
Главные заметки по наблюдениям:
На этом всё. Прикрепил пару примеров.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👌5
Forwarded from Geometrybot
Начиная с 20 июля Claude Fable 5 будет включён во все планы Max и Team Premium, но с 50% от лимитов.
Пользователи Pro и Team Standard продолжат получать доступ к Fable через кредиты на использование — им начислят единоразовый кредит в $100.
Спрос на Fable было сложно предсказать, поэтому мы внедряли его в подписные планы поэтапно и несколько раз расширяли доступ по мере появления дополнительных мощностей.
🍷 @claudeai · оригинал
Пользователи Pro и Team Standard продолжат получать доступ к Fable через кредиты на использование — им начислят единоразовый кредит в $100.
Спрос на Fable было сложно предсказать, поэтому мы внедряли его в подписные планы поэтапно и несколько раз расширяли доступ по мере появления дополнительных мощностей.
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Geometrybot
🚨 DeepSeek V4 NEW (GA) уже тестируется. Они явно нацелились на Claude Fable.
Первые результаты ставят его на уровень Opus 4.8. Это прямой ответ DeepSeek на Kimi K3 — и цены, скорее всего, останутся прежними.
— Лучшее агентное поведение и уверенный код
— Значительно сильнее в 3D, чем Opus 4.8
Большой респект команде DeepSeek за оптимизированную архитектуру. Именно она — основа, которая делает возможными такие мощные модели.
🍷 @Waguri_Kaoruko8 · оригинал
Первые результаты ставят его на уровень Opus 4.8. Это прямой ответ DeepSeek на Kimi K3 — и цены, скорее всего, останутся прежними.
— Лучшее агентное поведение и уверенный код
— Значительно сильнее в 3D, чем Opus 4.8
Большой респект команде DeepSeek за оптимизированную архитектуру. Именно она — основа, которая делает возможными такие мощные модели.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯10 2
За эту неделю на канале вышло около 32 постов. Мы стараемся сообщать всё сразу, как только узнаём.
Anonymous Poll
83%
Оставляйте как есть: быстро и много постов
17%
Лучше собраннее: меньше постов, но полнее, пусть и позже на час-два
Please open Telegram to view this post
VIEW IN TELEGRAM