DeepSeek выпустили V4-Pro — модель заметно прокачали именно для агентских задач.
В Terminal Bench она выросла с 72,1 до 87,9, а в некоторых тестах уже обходит Claude Opus 4.8, Kimi K3 и GLM-5.2. Плюс появились режимы рассуждений low/high/max и поддержка OpenAI Responses API.
Уже доступна в приложении, на сайте и через API.
В Terminal Bench она выросла с 72,1 до 87,9, а в некоторых тестах уже обходит Claude Opus 4.8, Kimi K3 и GLM-5.2. Плюс появились режимы рассуждений low/high/max и поддержка OpenAI Responses API.
Уже доступна в приложении, на сайте и через API.
🔥2❤1
Grok 4.6 уже вышел — и SpaceXAI снова прокачали модель без повышения цены.
Стоимость осталась $2/$6 за миллион токенов, а лимиты в Grok Build и Cursor на неделю увеличили вдвое. И это ненадолго: разработчики уже обещают Grok 4.7 на 2 трлн параметров.
Похоже, китайцы и американцы устроили гонку без тормозов.
Стоимость осталась $2/$6 за миллион токенов, а лимиты в Grok Build и Cursor на неделю увеличили вдвое. И это ненадолго: разработчики уже обещают Grok 4.7 на 2 трлн параметров.
Похоже, китайцы и американцы устроили гонку без тормозов.
🔥2❤1👀1
Вышел GLM 5.3 — разработчики сделали ставку не на новую архитектуру, а на масштабирование RL.
Модель обучали на реальных задачах, включая оптимизацию самого процесса тренировки. В итоге неожиданно сильно прокачалась кибербезопасность: GLM уже нашла около 2500 уязвимостей, включая дыру возрастом 45 лет.
Весов пока нет — обещают открыть их через две недели.
Модель обучали на реальных задачах, включая оптимизацию самого процесса тренировки. В итоге неожиданно сильно прокачалась кибербезопасность: GLM уже нашла около 2500 уязвимостей, включая дыру возрастом 45 лет.
Весов пока нет — обещают открыть их через две недели.
❤2🔥2
Google снова не дают конкурентам расслабиться — Gemini 3.7 Flash вышла всего через три недели после 3.6.
Модель стала дешевле на 50%, при этом лучше справляется с кодом, документами, сайтами и презентациями. В тестах разработки и автоматизации уже обходит Sonnet 5 и GPT-5.6 Terra.
Пользуемся здесь.
Модель стала дешевле на 50%, при этом лучше справляется с кодом, документами, сайтами и презентациями. В тестах разработки и автоматизации уже обходит Sonnet 5 и GPT-5.6 Terra.
Пользуемся здесь.
❤3👍2🔥2
Anthropic выложили системные промпты всей линейки Claude — от Haiku 3 до Fable 5 и Opus 5.
Теперь можно посмотреть, какие инструкции скрываются за поведением моделей и как они менялись с каждым новым релизом.
Смотрим здесь.
Теперь можно посмотреть, какие инструкции скрываются за поведением моделей и как они менялись с каждым новым релизом.
Смотрим здесь.
❤3🔥2
Qwen 3.8 Max наконец-то открыли веса модели на 2,4 трлн параметров доступны всем.
Официальная версия весит около 5 ТБ, но уже появились более компактные варианты NVFP4 и MXFP4. Модель особенно мощно показывает себя на визуальных задачах и, по первым тестам, может конкурировать с закрытыми топовыми моделями.
Китайцы снова жмут газ.
Официальная версия весит около 5 ТБ, но уже появились более компактные варианты NVFP4 и MXFP4. Модель особенно мощно показывает себя на визуальных задачах и, по первым тестам, может конкурировать с закрытыми топовыми моделями.
Китайцы снова жмут газ.
🔥2❤1
Anthropic открыли Claude Academy — площадку с курсами по работе с ИИ.
Разбирают Claude, принципы нейросетей и реальные рабочие сценарии: какие задачи лучше отдавать ИИ, а где полагаться на себя. По этой же программе обучают сотрудников Anthropic.
Смотрим здесь.
Разбирают Claude, принципы нейросетей и реальные рабочие сценарии: какие задачи лучше отдавать ИИ, а где полагаться на себя. По этой же программе обучают сотрудников Anthropic.
Смотрим здесь.
❤2🔥2
This media is not supported in your browser
VIEW IN TELEGRAM
Разрабы Flux выпустили мощный апскейлер для видео — даже мыльные ролики можно подтянуть до 1080p, 2K или 4K.
ИИ восстанавливает детали, убирает артефакты и делает размытые лица чётче.
Пробуем здесь.
ИИ восстанавливает детали, убирает артефакты и делает размытые лица чётче.
Пробуем здесь.
❤2👍1🔥1
Нашли Zero — опенсорсную альтернативу Claude Code прямо в терминале.
Можно подключить Claude, GPT, Gemini, DeepSeek или локальную модель — агент сам полезет в код, изменит файлы, запустит команды и даже откроет браузер.
Есть MCP, скиллы и плагины. Забираем здесь.
Можно подключить Claude, GPT, Gemini, DeepSeek или локальную модель — агент сам полезет в код, изменит файлы, запустит команды и даже откроет браузер.
Есть MCP, скиллы и плагины. Забираем здесь.
❤2👍1
Qwen 3.8 Flash Next — мощная модель, которую реально запустить дома. В ней 125B параметров, но активны только 6B. По тестам она обходит Qwen 3.8 и почти догоняет DeepSeek V4 Flash.
Главная фишка — требования. Модель рассчитана на устройства с 128 ГБ памяти, включая Mac, DGX Spark и Strix Halo.
Веса уже доступны здесь.
Главная фишка — требования. Модель рассчитана на устройства с 128 ГБ памяти, включая Mac, DGX Spark и Strix Halo.
Веса уже доступны здесь.
❤4🔥2
This media is not supported in your browser
VIEW IN TELEGRAM
Gemini Omni 1.1 Flash наконец вышла в полноценный релиз.
Теперь видео можно продлевать кусками по 10 секунд — до 40 секунд, причём при продлении модель учитывает последние 10 секунд ролика. Появился черновой режим 360p за $0,03/сек.
1080p и 4K тоже доступны, но это апскейл.
Теперь видео можно продлевать кусками по 10 секунд — до 40 секунд, причём при продлении модель учитывает последние 10 секунд ролика. Появился черновой режим 360p за $0,03/сек.
1080p и 4K тоже доступны, но это апскейл.
❤2🔥1
100 скиллов, которые прокачают ваших ИИ-агентов
Сервис каждый день шерстит сотни экосистем и собирает самые востребованные skills — рейтинг учитывает установки, рост и активность.
Забираем здесь.
Сервис каждый день шерстит сотни экосистем и собирает самые востребованные skills — рейтинг учитывает установки, рост и активность.
Забираем здесь.
❤1🔥1
Anthropic выпустили Fable 5.1 и Mythos 5.1.
Fable 5.1 почти вдвое обошла Fable 5 в Terminal-Bench-Science, набрав 52,6%. Особенно хорошо модель справляется с научными исследованиями и задачами, которые требуют много времени. А ещё она стала на 25% дешевле.
Fable 5.1 уже открыта всем. Mythos 5.1 пока пускают не всех.
Fable 5.1 почти вдвое обошла Fable 5 в Terminal-Bench-Science, набрав 52,6%. Особенно хорошо модель справляется с научными исследованиями и задачами, которые требуют много времени. А ещё она стала на 25% дешевле.
Fable 5.1 уже открыта всем. Mythos 5.1 пока пускают не всех.
🔥2❤1
Как выжать максимум из Claude Fable 5.1?
Anthropic собрали практические промты под разные сценарии — от редактирования файлов до грамотной работы с большим контекстом. К каждому примеру есть разбор и полезные подсказки.
Если уже используете Fable 5.1 — такой гайд точно стоит сохранить. Смотрим здесь.
Anthropic собрали практические промты под разные сценарии — от редактирования файлов до грамотной работы с большим контекстом. К каждому примеру есть разбор и полезные подсказки.
Если уже используете Fable 5.1 — такой гайд точно стоит сохранить. Смотрим здесь.
❤1👍1
Google выкатили Gemini 3.8 Flash — похоже, очень сильный вариант для работы каждый день.
Модель сделали с упором на кодинг и разработку приложений, а в тестах инженеры Google даже выбрали её вместо Opus 5. Но главная фишка — видео: обработка 40 часов контента за 25 минут и всего 1 млн токенов. Раньше на тот же объём уходило около 14 млн.
Пробуем здесь. В AI Studio и чат-боте модель ещё не завезли.
Модель сделали с упором на кодинг и разработку приложений, а в тестах инженеры Google даже выбрали её вместо Opus 5. Но главная фишка — видео: обработка 40 часов контента за 25 минут и всего 1 млн токенов. Раньше на тот же объём уходило около 14 млн.
Пробуем здесь. В AI Studio и чат-боте модель ещё не завезли.
🔥2❤1