Срочно: Google начал работу над своей моделью Gemini live bidi (voice2voice), готовя её к ответу на gpt-live-1.
Источник.
Источник.
🤯9👌4 2
Мы протестировали эту модель, и пришли к выводу что она обходит не только GPT-5.6 Sol но и Fable 5 low в разработке игр, дизайне, и 3д.
Нам кажется что эта модель и вправду очень большая, по слухам она в районе ~3T.
Минус прежний: долгая и неэкономная по токенам мышления. Одного аутпута приходится ждать 15-30 минут.
В комментариях скинули ссылки на все аутпуты данной модели, многие из них были сделаны one-shot.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯12
Модель уже начала появляться у некоторых пользователей из Китая в селекторе приложения. Источник.
Для китайцев это огромная победа.
Когда вы начнёте делать на Kimi K3 свои one-shot игры, сами поймёте, почему мы так её хвалили. По ощущениям это почти mini Fable от китайцев.
Но полностью ставить её выше Opus 4.8 я бы пока не стал.
По моему опыту, Kimi K3 делает ошибки в 2 раза чаще, чем opus и исправить с 1 раза она не может. В 3D, дизайне и разработке игр она действительно способна оказаться сильнее, но по надёжности рассуждений Opus пока выглядит лучше.
Теперь Kimi K3 задаёт новый стандарт для китайских моделей. Остальным придётся уже не догонять американцев, а сначала обойти её. И это только первая версия. Даже небольшие обновления вроде K3.1 могут заметно сократить оставшийся разрыв.
Представьте, насколько близко они уже подобрались.
Редактор 1.
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Kimi K3 насчитывает 2.8 триллиона параметров.
Появился более точный показатель: 2.8T.
Это почти втрое больше Kimi K2 и заметно больше DeepSeek V4 Pro с её 1.6T.
Kimi K3 стала крупнейшей китайской моделью по общему числу параметров.
Источник.
Появился более точный показатель: 2.8T.
Это почти втрое больше Kimi K2 и заметно больше DeepSeek V4 Pro с её 1.6T.
Kimi K3 стала крупнейшей китайской моделью по общему числу параметров.
Источник.
Светлый Уголок | ии
Kimi K3 насчитывает 2.8 триллиона параметров. Появился более точный показатель: 2.8T. Это почти втрое больше Kimi K2 и заметно больше DeepSeek V4 Pro с её 1.6T. Kimi K3 стала крупнейшей китайской моделью по общему числу параметров. Источник.
По цене модель Kimi k3 дороже Claude Sonnet 5.
А ещё она тратит много токенов на мышление.
Карточка модели
Цена: $3 / $15 за 1M
Контекст: 1М токенов
Знания: Январь 2025
❗️ Примечание: входные токены из кеша стоят $0,30 за 1M. API уже доступен, полные веса модели и технический отчёт опубликуют позднее.
А ещё она тратит много токенов на мышление.
Карточка модели
Цена: $3 / $15 за 1M
Контекст: 1М токенов
Знания: Январь 2025
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Кими K3 отстаёт только от GPT-5.6 Sol и Fable-5 в оценках бенчмарков — источник карточка модели.
* Веса будут выпущены в ближайшие дни
* Веса будут выпущены в ближайшие дни
Бенчмарки Kimi k3. Не полные.
По ним уже можно увидеть, что модель превосходит всех (и возможно вообще во всем), кроме GPT-5.6, Sol и Fable-5.
Источник.
По ним уже можно увидеть, что модель превосходит всех (и возможно вообще во всем), кроме GPT-5.6, Sol и Fable-5.
Источник.
🤯8
Forwarded from Geometrybot
Большая новость: Kimi-K3 от @Kimi_Moonshot теперь #1 в Frontend Code Arena с 1679 баллами, обогнав Claude Fable 5.
Это прыжок на 17 позиций с Kimi-k2.6 (#18 -> #1).
Во Frontend Kimi-K3 занял #1 в 6 из 7 доменов: Brand & Marketing, Reference-Based Design, Data & Analytics, Consumer Product, Simulations и Content Creation Tools, оказавшись #2 только в Gaming, уступив Fable 5.
Полные веса модели будут выпущены до 27 июля.
Поздравляем команду @Kimi_Moonshot с этим важным достижением!
🍷 @arena · оригинал
Это прыжок на 17 позиций с Kimi-k2.6 (#18 -> #1).
Во Frontend Kimi-K3 занял #1 в 6 из 7 доменов: Brand & Marketing, Reference-Based Design, Data & Analytics, Consumer Product, Simulations и Content Creation Tools, оказавшись #2 только в Gaming, уступив Fable 5.
Полные веса модели будут выпущены до 27 июля.
Поздравляем команду @Kimi_Moonshot с этим важным достижением!
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Kimi K3 теперь доступна в Arena.ai
Админ Arena.ai сказал, что Kimi K3 была добавлена в Direct Mode по случайности, и что она будет только в Battle Mode
Неужели она настолько дорогая даже для них?
Неужели она настолько дорогая даже для них?
Возможно, завтра представят приложение ai.studio или же Gemini 3.5 Flash Lite. Черт его знает, пофиг на них.
Официально: Gemini 3.5 Pro откладывается. — Bloomberg.
* Я понимаю что говорю об этом много, но теперь заключительно сообщу в связи с этой новостью.
Google отстаёт от графика на несколько месяцев, и главная причина в кодинге.
Наш инсайд из прошлых постов подтвердился. Источник
⚪️ Модель должна была выйти 17 июля.
⚪️ В конце июня Google обновила данные Gemini для обучения, чтобы подтянуть навыки программирования. Результаты разочаровали: старые галлюцинации никуда не делись, модель не может признать события 2025 и 2026 годов.
⚪️ Внутри всё упирается в мощности и инструменты. Инженеры сталкиваются с ограничениями по ёмкости, сейчас идёт объединение внутренних ИИ-инструментов для программирования.
⚪️ Google пытается удержать сотрудников DeepMind. Люди разочарованы ситуацией и собираются уходить. Внутри боятся, что компания теряет позиции на фоне Anthropic и OpenAI.
* Я понимаю что говорю об этом много, но теперь заключительно сообщу в связи с этой новостью.
Google отстаёт от графика на несколько месяцев, и главная причина в кодинге.
Наш инсайд из прошлых постов подтвердился. Источник
Главное, что они не сдаются, и это видно. Обычно после подобных неудач Google возвращается с более-менее хорошими результатами.
Наше расчётное время релиза: август-сентябрь. Это можно понять по их текущим контрольным точкам, что они выдают тестерам, а мы их видим и проверяем. Они пока-что очень далеко от Ant и oAI.
Please open Telegram to view this post
VIEW IN TELEGRAM
❗️Fable 5 внезапно пропала из подписок.
Модель исчезла у всех и везде: в Claude Code и в приложении, на всех планах.
Anthropic так со своими пользователями не договаривалась: отключение было запланировано на 19 июля.
Неужели внеплановое отключение? Достоверный источник сообщил нам, что Opus 5 сегодня точно не выйдет. Так что на скорый релиз это не списать.
* Мы уже писали, что Fable 5 должна уйти из подписок, но ждали этого ближе к выходу Opus 5.
Следим за ситуацией.
UPD: Модель вернули в подписки, это была ошибка на стороне серверов.
Модель исчезла у всех и везде: в Claude Code и в приложении, на всех планах.
Anthropic так со своими пользователями не договаривалась: отключение было запланировано на 19 июля.
Неужели внеплановое отключение? Достоверный источник сообщил нам, что Opus 5 сегодня точно не выйдет. Так что на скорый релиз это не списать.
* Мы уже писали, что Fable 5 должна уйти из подписок, но ждали этого ближе к выходу Opus 5.
Следим за ситуацией.
UPD: Модель вернули в подписки, это была ошибка на стороне серверов.
👀3