Moonshot только что выпустила крупнейшую в истории опенсорс-модель — KIMI K3.
> 2,8 трлн параметров
>MoE-архитектура с 896 экспертами, из которых 16 активны
>Контекстное окно на 1 млн токенов
>Нативное понимание изображений
>Новая архитектура Kimi Delta Attention + Attention Residuals
>Примерно в 2,5 раза выше эффективность масштабирования по сравнению с K2
>Третья по уровню интеллекта модель после Fable 5 и GPT-5.6
>Превосходит Opus 4.8 MAX в реальных задачах, связанных с интеллектуальной работой и знаниями, по бенчмарку GDPval
>Новый SOTA-результат — 91,2 балла в BrowseComp без трюков с контекстом
Kimi заявляет, что K3 конкурирует с Opus, и выставляет соответствующую цену: $3,00 за 1 млн входных токенов. $15,00 за 1 млн выходных токенов.
Полные открытые веса модели опубликуют через несколько дней.😐
https://www.kimi.com/
> 2,8 трлн параметров
>MoE-архитектура с 896 экспертами, из которых 16 активны
>Контекстное окно на 1 млн токенов
>Нативное понимание изображений
>Новая архитектура Kimi Delta Attention + Attention Residuals
>Примерно в 2,5 раза выше эффективность масштабирования по сравнению с K2
>Третья по уровню интеллекта модель после Fable 5 и GPT-5.6
>Превосходит Opus 4.8 MAX в реальных задачах, связанных с интеллектуальной работой и знаниями, по бенчмарку GDPval
>Новый SOTA-результат — 91,2 балла в BrowseComp без трюков с контекстом
Kimi заявляет, что K3 конкурирует с Opus, и выставляет соответствующую цену: $3,00 за 1 млн входных токенов. $15,00 за 1 млн выходных токенов.
Полные открытые веса модели опубликуют через несколько дней.
https://www.kimi.com/
Please open Telegram to view this post
VIEW IN TELEGRAM
В
На низком уровне
Компромисс выбираете вы.
Раньше
На низком уровне выполняется один проход по diff. Это достаточно быстро и дешево, чтобы запускать проверку перед каждым push-ем.
На среднем уровне измененный код анализируется в контексте, затем выполняется несколько проходов поиска проблем с разных сторон, после чего каждая найденная проблема проверяется перед тем, как попасть в итоговый отчет.
На высоком уровне агенты поиска и проверки запускаются как сабагенты с чистым контекстом, поэтому они не привязаны к рассуждениям агента, который только что написал код. На уровне
Есть еще один уровень выше
В Anthropic запускают этот уровень для каждого PR.
https://code.claude.com/docs/en/ultrareview🎉
/code-review от Claude Code теперь доступны уровни глубины анализа, причем для каждого уровня процесс ревью был переработан.На низком уровне
/code-review выявляет больше проблем, чем другие инструменты код-ревью, при значительно меньших затратах токенов. Высокий уровень обеспечивает заметно более высокий recall, когда нужен более глубокий анализ.Компромисс выбираете вы.
Раньше
/code-review использовал один фиксированный промпт независимо от выбранного уровня глубины. Теперь для каждого уровня применяется отдельная стратегия ревью. Команда автоматически использует уровень глубины, заданный для текущей сессии, либо его можно указать явно, например: /code-review high.На низком уровне выполняется один проход по diff. Это достаточно быстро и дешево, чтобы запускать проверку перед каждым push-ем.
На среднем уровне измененный код анализируется в контексте, затем выполняется несколько проходов поиска проблем с разных сторон, после чего каждая найденная проблема проверяется перед тем, как попасть в итоговый отчет.
На высоком уровне агенты поиска и проверки запускаются как сабагенты с чистым контекстом, поэтому они не привязаны к рассуждениям агента, который только что написал код. На уровне
x-high проверка идет еще глубже и охватывает возможное влияние изменений на код за пределами самого diff.Есть еще один уровень выше
high: /code-review ultra. Он запускает целую группу агентов-ревьюеров и независимо воспроизводит каждую найденную проблему. Покрытие критичных проблем остается таким же, как на уровне high, но ложных срабатываний становится значительно меньше.В Anthropic запускают этот уровень для каждого PR.
https://code.claude.com/docs/en/ultrareview
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Этот скилл для Codex находит вероятные баги, подтверждает их тестами и показывает точную первопричину. 🍆
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Вышла NVIDIA DeepStream 9.1 с 13 агентными скиллами для создания пайплайнов видеоаналитики.
Вместо того чтобы вручную собирать пайплайн компьютерного зрения с нуля, достаточно описать нужный результат обычным естественным языком. Эти скиллы можно использовать вместе с Claude Code или Codex, чтобы упростить настройку окружения, конфигурацию и запуск.
Среди новых скиллов — Multi-View 3D Tracking (MV3DT) для отслеживания объектов по данным с нескольких камер и AutoMagicCalib для автоматической калибровки сети камер.
В этом релизе также появилась поддержка NVIDIA JetPack 7.2 для edge-развёртывания на Jetson Orin и Thor. Всё опубликовано в открытом исходном коде на GitHub — подробнее здесь: https://nvda.ws/4vxQ6Yk💰
Вместо того чтобы вручную собирать пайплайн компьютерного зрения с нуля, достаточно описать нужный результат обычным естественным языком. Эти скиллы можно использовать вместе с Claude Code или Codex, чтобы упростить настройку окружения, конфигурацию и запуск.
Среди новых скиллов — Multi-View 3D Tracking (MV3DT) для отслеживания объектов по данным с нескольких камер и AutoMagicCalib для автоматической калибровки сети камер.
В этом релизе также появилась поддержка NVIDIA JetPack 7.2 для edge-развёртывания на Jetson Orin и Thor. Всё опубликовано в открытом исходном коде на GitHub — подробнее здесь: https://nvda.ws/4vxQ6Yk
Please open Telegram to view this post
VIEW IN TELEGRAM
Вайб-кодинг
Вышла NVIDIA DeepStream 9.1 с 13 агентными скиллами для создания пайплайнов видеоаналитики. Вместо того чтобы вручную собирать пайплайн компьютерного зрения с нуля, достаточно описать нужный результат обычным естественным языком. Эти скиллы можно использовать…
Также вчера они выпустили Nemotron 3 Embed 8B, и он занял первое место в общем рейтинге RTEB 🏆
RTEB оценивает точность поиска по реальным задачам. Чем лучше retrieval, тем более релевантный контекст получают агенты, что помогает повысить точность их ответов.
RTEB оценивает точность поиска по реальным задачам. Чем лучше retrieval, тем более релевантный контекст получают агенты, что помогает повысить точность их ответов.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Теперь с помощью одного плагина можно оркестрировать Fable 5, Sol и любую другую модель внутри Codex.
Он называется Codex-Orchestration.
Назначьте Fable 5 советником, Sol — исполнителем или распределите любые модели по любым ролям. Затем задайте порядок их работы. Codex возьмёт маршрутизацию на себя.
Чувак протестировал связку Fable 5 High в роли планировщика и GPT-5.6 Sol Extra High в роли исполнителя на наборе задач, с которыми Opus и GPT-5.5 регулярно испытывали сложности:
> всё было готово за 30 минут;
> на 40% меньше срабатываний лимитов;
> реализация в 2 раза быстрее.
Для установки вставьте в Codex:
Затем назначьте модели:
Открытый исходный код. Настраивайте маршрутизацию как угодно.
Он называется Codex-Orchestration.
Назначьте Fable 5 советником, Sol — исполнителем или распределите любые модели по любым ролям. Затем задайте порядок их работы. Codex возьмёт маршрутизацию на себя.
Чувак протестировал связку Fable 5 High в роли планировщика и GPT-5.6 Sol Extra High в роли исполнителя на наборе задач, с которыми Opus и GPT-5.5 регулярно испытывали сложности:
> всё было готово за 30 минут;
> на 40% меньше срабатываний лимитов;
> реализация в 2 раза быстрее.
Для установки вставьте в Codex:
"Install Codex Orchestration:
codex plugin marketplace add Cjbuilds/Codex-Orchestration codex plugin add
codex-orchestration@codex-orchestration
Verify the installation, then tell me to start a new task."
Затем назначьте модели:
@ codex-orchestration advisor:
Claude Fable 5 High, Executor: GPT-5.6 Sol High
Открытый исходный код. Настраивайте маршрутизацию как угодно.
This media is not supported in your browser
VIEW IN TELEGRAM
Если вы используете Hermes Agent, это единственный список скиллов, который вам понадобится. 271 бесплатный скилл, готовый к установке.
85 встроенных, 101 опциональный и 85 от сообщества. У каждого скилла указан статус и команда для установки.
Работает с Claude Code, OpenClaw, Cursor и Windsurf.
Полностью бесплатно.🔈
85 встроенных, 101 опциональный и 85 от сообщества. У каждого скилла указан статус и команда для установки.
Работает с Claude Code, OpenClaw, Cursor и Windsurf.
Полностью бесплатно.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
WTF: кто-то буквально с нуля выложил в открытый доступ целую программу обучения по AI engineering 🤯
В ней 503 урока, разбитых на 20 последовательных этапов: от линейной алгебры до LLM, RAG, AI-агентов и автономных систем. На всём протяжении курса есть код, который можно запускать.
Если хочется глубоко разобраться в основах ИИ, это один из самых структурированных бесплатных ресурсов, которые можно найти.
Совет: если что-то покажется непонятным, вставьте урок в NotebookLM и попросите объяснить концепции или превратить материал в подкаст, который можно послушать :)
В ней 503 урока, разбитых на 20 последовательных этапов: от линейной алгебры до LLM, RAG, AI-агентов и автономных систем. На всём протяжении курса есть код, который можно запускать.
Если хочется глубоко разобраться в основах ИИ, это один из самых структурированных бесплатных ресурсов, которые можно найти.
Совет: если что-то покажется непонятным, вставьте урок в NotebookLM и попросите объяснить концепции или превратить материал в подкаст, который можно послушать :)
Please open Telegram to view this post
VIEW IN TELEGRAM
Kimi творит чудеса: парень поручил рою агентов Kimi K3 Max воссоздать macOS 27 в виде веб-приложения.
Результат получился настолько реалистичным, что легко забыть, что перед вами не настоящий Mac, а интерфейс, целиком работающий в браузере.🎉
https://macos27.kimi.page/
Результат получился настолько реалистичным, что легко забыть, что перед вами не настоящий Mac, а интерфейс, целиком работающий в браузере.
https://macos27.kimi.page/
This media is not supported in your browser
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Настоятельно рекомендую этот обзор самообучающихся агентных систем.
Самоулучшающиеся агенты постепенно переходят от исследовательских демонстраций к реальным внедрённым системам.
В этом обзоре современный агент рассматривается как фундаментальная модель, дополненная рабочей обвязкой.
Самоулучшение формализуется как оператор, который по результатам собственной работы вносит изменения либо в саму модель, либо в окружающую её систему управления.
Статья: https://arxiv.org/abs/2607.13104
Самоулучшающиеся агенты постепенно переходят от исследовательских демонстраций к реальным внедрённым системам.
В этом обзоре современный агент рассматривается как фундаментальная модель, дополненная рабочей обвязкой.
Самоулучшение формализуется как оператор, который по результатам собственной работы вносит изменения либо в саму модель, либо в окружающую её систему управления.
Статья: https://arxiv.org/abs/2607.13104
Жизнь после ИИ ❤️
This media is not supported in your browser
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Инженер Google Кормак Брик объяснил, как дообучить крошечную LLM прямо на телефоне и повысить её точность с 46% до 90%.
Схема такая:
1. Выбрать Gemma 270M.
2. Сгенерировать синтетические данные для своей задачи.
3. Дообучить модель с помощью LoRA.
4. Квантизировать её до int4.
5. Развернуть на Pixel и получить скорость до 2000 токенов в секунду.
Именно благодаря такому циклу модель на 270 млн параметров может превзойти модель на 70 млрд параметров в конкретной задаче - при этом полностью работать офлайн прямо у вас в кармане.
> ютуб
Схема такая:
1. Выбрать Gemma 270M.
2. Сгенерировать синтетические данные для своей задачи.
3. Дообучить модель с помощью LoRA.
4. Квантизировать её до int4.
5. Развернуть на Pixel и получить скорость до 2000 токенов в секунду.
Именно благодаря такому циклу модель на 270 млн параметров может превзойти модель на 70 млрд параметров в конкретной задаче - при этом полностью работать офлайн прямо у вас в кармане.
> ютуб
5
Официально: прощайте, Vercel, AWS и дорогие серверные провайдеры. 🙄
Появилась полностью независимая опенсорс-альтернатива — OpenShip.
OpenShip это универсальная платформа, которая позволяет создавать, развёртывать и запускать приложения на собственной инфраструктуре и собственных серверах.
Всё в рамках одной платформы со 100% открытым исходным кодом.
При этом управлять деплоями можно и через Claude Code или Cursor, просто подключите их к OpenShip MCP
OpenShip поддерживает детально настраиваемые разрешения для MCP и персональных токенов доступа, поэтому агенту можно открыть доступ только к конкретным ресурсам.
Всё это доступно и в self-hosted-версии.
Появилась полностью независимая опенсорс-альтернатива — OpenShip.
OpenShip это универсальная платформа, которая позволяет создавать, развёртывать и запускать приложения на собственной инфраструктуре и собственных серверах.
Всё в рамках одной платформы со 100% открытым исходным кодом.
При этом управлять деплоями можно и через Claude Code или Cursor, просто подключите их к OpenShip MCP
OpenShip поддерживает детально настраиваемые разрешения для MCP и персональных токенов доступа, поэтому агенту можно открыть доступ только к конкретным ресурсам.
Всё это доступно и в self-hosted-версии.
Please open Telegram to view this post
VIEW IN TELEGRAM
Стратегический руководитель OpenAI Дин У. Болл заявил, что Kimi K3 — очень сильная модель.
По его словам, в агентном программировании её возможности уже приблизились к уровню лучших публично доступных моделей первого квартала 2026 года. И такой результат нельзя просто объяснить дистилляцией.
Но говорит он об этом не только ради похвалы Kimi K3. По его словам, «мир, в котором доминируют модели с открытыми весами, — это настоящий ИИ-коммунизм».
Он также прогнозирует, что правительство США со временем найдёт способы не допустить китайские модели в американские компании. Для этого достаточно сформировать недоверие к таким моделям, даже если для него нет веских оснований. Прямой запрет не нужен, достаточно создать страх, чтобы компании не спешили внедрять такие модели, но при этом не подтолкнуть всех разработчиков к зарубежным провайдерам, которых ещё сложнее регулировать.
Вот это поворот.👌
По его словам, в агентном программировании её возможности уже приблизились к уровню лучших публично доступных моделей первого квартала 2026 года. И такой результат нельзя просто объяснить дистилляцией.
Но говорит он об этом не только ради похвалы Kimi K3. По его словам, «мир, в котором доминируют модели с открытыми весами, — это настоящий ИИ-коммунизм».
Он также прогнозирует, что правительство США со временем найдёт способы не допустить китайские модели в американские компании. Для этого достаточно сформировать недоверие к таким моделям, даже если для него нет веских оснований. Прямой запрет не нужен, достаточно создать страх, чтобы компании не спешили внедрять такие модели, но при этом не подтолкнуть всех разработчиков к зарубежным провайдерам, которых ещё сложнее регулировать.
Вот это поворот.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Кстати, у Kimi K3 есть CLI для работы с ним.
Он с открытым исходным кодом, который поддерживает Moonshot — та же лаборатория, что стоит за K3.
И у него есть фичи, которых нет в Claude Code:
> Можно просто отправить запись экрана прямо в чат в качестве входных данных.
> MCP-серверы настраиваются в диалоге через
> Встроенные субагенты
CLI поддерживает Agent Client Protocol, поэтому Zed и JetBrains могут напрямую управлять сессией.
Настройка занимает три шага:
1. Запустите установочный скрипт:
2. Запустите CLI командой
3. Авторизуйтесь через
Сам CLI бесплатный🫡
Он с открытым исходным кодом, который поддерживает Moonshot — та же лаборатория, что стоит за K3.
И у него есть фичи, которых нет в Claude Code:
> Можно просто отправить запись экрана прямо в чат в качестве входных данных.
> MCP-серверы настраиваются в диалоге через
/mcp-config, без ручного редактирования JSON.> Встроенные субагенты
coder, explore и plan работают каждый в собственном изолированном контексте, поэтому основной диалог остаётся чистым.CLI поддерживает Agent Client Protocol, поэтому Zed и JetBrains могут напрямую управлять сессией.
Настройка занимает три шага:
1. Запустите установочный скрипт:
curl -LsSf https://code.kimi.com/install.sh | bash2. Запустите CLI командой
kimi3. Авторизуйтесь через
/login — и всё готово Сам CLI бесплатный
Please open Telegram to view this post
VIEW IN TELEGRAM
Разрыв между американскими закрытыми моделями и китайским опенсорс продолжает сокращаться, друзья. Alibaba готовит к релизу Qwen 3.8.
По их словам, она обходит GPT-5.6 и лишь немного уступает Fable 5🤔
> 2,4 трлн параметров
> Open Source / Open Weights
При этом ждать полноценного релиза для тестирования уже не нужно — Qwen3.8-Max-Preview появилась в Alibaba Token Plan, Qoder и QoderWork.
С каждым днём всё становится напряжённее, и GLM тоже скоро выпустит новую модель.
Международная версия:
https://qwencloud.com/pricing/token-plan
Китай:
https://platform.qianwenai.com/pricing/token-plan
По их словам, она обходит GPT-5.6 и лишь немного уступает Fable 5
> 2,4 трлн параметров
> Open Source / Open Weights
При этом ждать полноценного релиза для тестирования уже не нужно — Qwen3.8-Max-Preview появилась в Alibaba Token Plan, Qoder и QoderWork.
С каждым днём всё становится напряжённее, и GLM тоже скоро выпустит новую модель.
Международная версия:
https://qwencloud.com/pricing/token-plan
Китай:
https://platform.qianwenai.com/pricing/token-plan
Please open Telegram to view this post
VIEW IN TELEGRAM
Этот скилл
https://github.com/emilkowalski/skills/blob/main/skills/apple-design/SKILL.md
Он адаптирует и переносит дизайн-принципы Apple с WWDC на веб-платформу. Всего в нём собрано 17 основных принципов, и каждый сопровождается примерами кода.
Причём эти принципы действительно стоит внимательно изучить. Это не очередной скилл с подборкой разных визуальных эффектов, а серия концентрированных дизайн-подходов, которые имеет смысл разбирать системно.
/apple-design точно стоит сохранить каждому:https://github.com/emilkowalski/skills/blob/main/skills/apple-design/SKILL.md
Он адаптирует и переносит дизайн-принципы Apple с WWDC на веб-платформу. Всего в нём собрано 17 основных принципов, и каждый сопровождается примерами кода.
Причём эти принципы действительно стоит внимательно изучить. Это не очередной скилл с подборкой разных визуальных эффектов, а серия концентрированных дизайн-подходов, которые имеет смысл разбирать системно.
GitHub
skills/skills/apple-design/SKILL.md at main · emilkowalski/skills
Skills for Design Engineers. Contribute to emilkowalski/skills development by creating an account on GitHub.
3