Настоятельно рекомендую этот обзор самообучающихся агентных систем.
Самоулучшающиеся агенты постепенно переходят от исследовательских демонстраций к реальным внедрённым системам.
В этом обзоре современный агент рассматривается как фундаментальная модель, дополненная рабочей обвязкой.
Самоулучшение формализуется как оператор, который по результатам собственной работы вносит изменения либо в саму модель, либо в окружающую её систему управления.
Статья: https://arxiv.org/abs/2607.13104
Самоулучшающиеся агенты постепенно переходят от исследовательских демонстраций к реальным внедрённым системам.
В этом обзоре современный агент рассматривается как фундаментальная модель, дополненная рабочей обвязкой.
Самоулучшение формализуется как оператор, который по результатам собственной работы вносит изменения либо в саму модель, либо в окружающую её систему управления.
Статья: https://arxiv.org/abs/2607.13104
Жизнь после ИИ ❤️
This media is not supported in your browser
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Инженер Google Кормак Брик объяснил, как дообучить крошечную LLM прямо на телефоне и повысить её точность с 46% до 90%.
Схема такая:
1. Выбрать Gemma 270M.
2. Сгенерировать синтетические данные для своей задачи.
3. Дообучить модель с помощью LoRA.
4. Квантизировать её до int4.
5. Развернуть на Pixel и получить скорость до 2000 токенов в секунду.
Именно благодаря такому циклу модель на 270 млн параметров может превзойти модель на 70 млрд параметров в конкретной задаче - при этом полностью работать офлайн прямо у вас в кармане.
> ютуб
Схема такая:
1. Выбрать Gemma 270M.
2. Сгенерировать синтетические данные для своей задачи.
3. Дообучить модель с помощью LoRA.
4. Квантизировать её до int4.
5. Развернуть на Pixel и получить скорость до 2000 токенов в секунду.
Именно благодаря такому циклу модель на 270 млн параметров может превзойти модель на 70 млрд параметров в конкретной задаче - при этом полностью работать офлайн прямо у вас в кармане.
> ютуб
5
Официально: прощайте, Vercel, AWS и дорогие серверные провайдеры. 🙄
Появилась полностью независимая опенсорс-альтернатива — OpenShip.
OpenShip это универсальная платформа, которая позволяет создавать, развёртывать и запускать приложения на собственной инфраструктуре и собственных серверах.
Всё в рамках одной платформы со 100% открытым исходным кодом.
При этом управлять деплоями можно и через Claude Code или Cursor, просто подключите их к OpenShip MCP
OpenShip поддерживает детально настраиваемые разрешения для MCP и персональных токенов доступа, поэтому агенту можно открыть доступ только к конкретным ресурсам.
Всё это доступно и в self-hosted-версии.
Появилась полностью независимая опенсорс-альтернатива — OpenShip.
OpenShip это универсальная платформа, которая позволяет создавать, развёртывать и запускать приложения на собственной инфраструктуре и собственных серверах.
Всё в рамках одной платформы со 100% открытым исходным кодом.
При этом управлять деплоями можно и через Claude Code или Cursor, просто подключите их к OpenShip MCP
OpenShip поддерживает детально настраиваемые разрешения для MCP и персональных токенов доступа, поэтому агенту можно открыть доступ только к конкретным ресурсам.
Всё это доступно и в self-hosted-версии.
Please open Telegram to view this post
VIEW IN TELEGRAM
Стратегический руководитель OpenAI Дин У. Болл заявил, что Kimi K3 — очень сильная модель.
По его словам, в агентном программировании её возможности уже приблизились к уровню лучших публично доступных моделей первого квартала 2026 года. И такой результат нельзя просто объяснить дистилляцией.
Но говорит он об этом не только ради похвалы Kimi K3. По его словам, «мир, в котором доминируют модели с открытыми весами, — это настоящий ИИ-коммунизм».
Он также прогнозирует, что правительство США со временем найдёт способы не допустить китайские модели в американские компании. Для этого достаточно сформировать недоверие к таким моделям, даже если для него нет веских оснований. Прямой запрет не нужен, достаточно создать страх, чтобы компании не спешили внедрять такие модели, но при этом не подтолкнуть всех разработчиков к зарубежным провайдерам, которых ещё сложнее регулировать.
Вот это поворот.👌
По его словам, в агентном программировании её возможности уже приблизились к уровню лучших публично доступных моделей первого квартала 2026 года. И такой результат нельзя просто объяснить дистилляцией.
Но говорит он об этом не только ради похвалы Kimi K3. По его словам, «мир, в котором доминируют модели с открытыми весами, — это настоящий ИИ-коммунизм».
Он также прогнозирует, что правительство США со временем найдёт способы не допустить китайские модели в американские компании. Для этого достаточно сформировать недоверие к таким моделям, даже если для него нет веских оснований. Прямой запрет не нужен, достаточно создать страх, чтобы компании не спешили внедрять такие модели, но при этом не подтолкнуть всех разработчиков к зарубежным провайдерам, которых ещё сложнее регулировать.
Вот это поворот.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Кстати, у Kimi K3 есть CLI для работы с ним.
Он с открытым исходным кодом, который поддерживает Moonshot — та же лаборатория, что стоит за K3.
И у него есть фичи, которых нет в Claude Code:
> Можно просто отправить запись экрана прямо в чат в качестве входных данных.
> MCP-серверы настраиваются в диалоге через
> Встроенные субагенты
CLI поддерживает Agent Client Protocol, поэтому Zed и JetBrains могут напрямую управлять сессией.
Настройка занимает три шага:
1. Запустите установочный скрипт:
2. Запустите CLI командой
3. Авторизуйтесь через
Сам CLI бесплатный🫡
Он с открытым исходным кодом, который поддерживает Moonshot — та же лаборатория, что стоит за K3.
И у него есть фичи, которых нет в Claude Code:
> Можно просто отправить запись экрана прямо в чат в качестве входных данных.
> MCP-серверы настраиваются в диалоге через
/mcp-config, без ручного редактирования JSON.> Встроенные субагенты
coder, explore и plan работают каждый в собственном изолированном контексте, поэтому основной диалог остаётся чистым.CLI поддерживает Agent Client Protocol, поэтому Zed и JetBrains могут напрямую управлять сессией.
Настройка занимает три шага:
1. Запустите установочный скрипт:
curl -LsSf https://code.kimi.com/install.sh | bash2. Запустите CLI командой
kimi3. Авторизуйтесь через
/login — и всё готово Сам CLI бесплатный
Please open Telegram to view this post
VIEW IN TELEGRAM
Разрыв между американскими закрытыми моделями и китайским опенсорс продолжает сокращаться, друзья. Alibaba готовит к релизу Qwen 3.8.
По их словам, она обходит GPT-5.6 и лишь немного уступает Fable 5🤔
> 2,4 трлн параметров
> Open Source / Open Weights
При этом ждать полноценного релиза для тестирования уже не нужно — Qwen3.8-Max-Preview появилась в Alibaba Token Plan, Qoder и QoderWork.
С каждым днём всё становится напряжённее, и GLM тоже скоро выпустит новую модель.
Международная версия:
https://qwencloud.com/pricing/token-plan
Китай:
https://platform.qianwenai.com/pricing/token-plan
По их словам, она обходит GPT-5.6 и лишь немного уступает Fable 5
> 2,4 трлн параметров
> Open Source / Open Weights
При этом ждать полноценного релиза для тестирования уже не нужно — Qwen3.8-Max-Preview появилась в Alibaba Token Plan, Qoder и QoderWork.
С каждым днём всё становится напряжённее, и GLM тоже скоро выпустит новую модель.
Международная версия:
https://qwencloud.com/pricing/token-plan
Китай:
https://platform.qianwenai.com/pricing/token-plan
Please open Telegram to view this post
VIEW IN TELEGRAM
Этот скилл
https://github.com/emilkowalski/skills/blob/main/skills/apple-design/SKILL.md
Он адаптирует и переносит дизайн-принципы Apple с WWDC на веб-платформу. Всего в нём собрано 17 основных принципов, и каждый сопровождается примерами кода.
Причём эти принципы действительно стоит внимательно изучить. Это не очередной скилл с подборкой разных визуальных эффектов, а серия концентрированных дизайн-подходов, которые имеет смысл разбирать системно.
/apple-design точно стоит сохранить каждому:https://github.com/emilkowalski/skills/blob/main/skills/apple-design/SKILL.md
Он адаптирует и переносит дизайн-принципы Apple с WWDC на веб-платформу. Всего в нём собрано 17 основных принципов, и каждый сопровождается примерами кода.
Причём эти принципы действительно стоит внимательно изучить. Это не очередной скилл с подборкой разных визуальных эффектов, а серия концентрированных дизайн-подходов, которые имеет смысл разбирать системно.
GitHub
skills/skills/apple-design/SKILL.md at main · emilkowalski/skills
Skills for Design Engineers. Contribute to emilkowalski/skills development by creating an account on GitHub.
3
Media is too big
VIEW IN TELEGRAM
Основатель Kimi Ян Чжилинь, о том, как на самом деле создаются передовые ИИ-модели: смотреть 💪
Please open Telegram to view this post
VIEW IN TELEGRAM
Рынок ИИ-моделей сейчас:
This media is not supported in your browser
VIEW IN TELEGRAM
Как LLM может переключаться между низким, средним и высоким уровнем вычислительных усилий при рассуждении? И как LLM учится рассуждать более или менее глубоко?
Cебастьян Рашка подготовил небольшую статью, в которой объяснил, как эти уровни усилий реализуются во время инференса и обучения.
Cебастьян Рашка подготовил небольшую статью, в которой объяснил, как эти уровни усилий реализуются во время инференса и обучения.
При обновлении резюме можно наткнуться на его старую версию из времён, когда гордо указывали: «уверенный пользователь ПК, MS Office» 😄 А ведь, сейчас этим уже никого не удивишь
Времена меняются, и теперь «уверенный пользователь ПК» все больше про умение работать с ИИ. И как бы нам не хотелось этого принимать, но это не временный тренд, а реальность рынка. ИИ-грамотность уже становится базовым навыком. Плюс рынок всё больше ценит системное мышление и скорость принятия решений, а цена ошибки очень быстро растёт.
Один из способов прокачать этот навык — магистратура «Управление внедрением ИИ в бизнес» от МИФИ и «Школы 21».
Вы научитесь:
— работать с данными, Python, ML и нейросетями
— запускать и развивать ИИ-продукты от идеи до MVP
— управлять командами и цифровыми продуктами
Что дает обучение:
— онлайн-формат с регулярными очными интенсивами;
— студенческий билет, льготы и доступ к инфраструктуре «Школы 21»;
— отсрочка от срочной службы;
— и самое главное: диплом государственного образца МИФИ – одного из ведущих технических университетов страны
Подать заявку и узнать все подробности можно здесь.
Реклама. Рекламодатель АНО «Школа 21». ИНН 7736316133
Времена меняются, и теперь «уверенный пользователь ПК» все больше про умение работать с ИИ. И как бы нам не хотелось этого принимать, но это не временный тренд, а реальность рынка. ИИ-грамотность уже становится базовым навыком. Плюс рынок всё больше ценит системное мышление и скорость принятия решений, а цена ошибки очень быстро растёт.
Один из способов прокачать этот навык — магистратура «Управление внедрением ИИ в бизнес» от МИФИ и «Школы 21».
Вы научитесь:
— работать с данными, Python, ML и нейросетями
— запускать и развивать ИИ-продукты от идеи до MVP
— управлять командами и цифровыми продуктами
Что дает обучение:
— онлайн-формат с регулярными очными интенсивами;
— студенческий билет, льготы и доступ к инфраструктуре «Школы 21»;
— отсрочка от срочной службы;
— и самое главное: диплом государственного образца МИФИ – одного из ведущих технических университетов страны
Подать заявку и узнать все подробности можно здесь.
Реклама. Рекламодатель АНО «Школа 21». ИНН 7736316133
NVIDIA релизнули Cosmos 3 Edge — их открытую фронтир-модель мира, созданную для локального запуска на устройствах.
Cosmos 3 Edge помогает роботам обучаться и действовать, автономным автомобилям понимать дорожные сцены и предсказывать намерения участников движения, а ИИ-агентам компьютерного зрения — рассуждать на основе видеопотока в реальном времени для задач умной инфраструктуры.
Модель насчитывает 4 млрд параметров и включает reasoner на 2 млрд параметров на базе Nemotron. Её можно запускать на DGX Spark, NVIDIA Jetson и других устройствах.
Cosmos 3 Edge объединяет авторегрессионный и диффузионный transformer-блоки через общий механизм мультимодального внимания, связывая понимание, прогнозирование, симуляцию и действия в рамках одной модели.
Среди открытых моделей сопоставимого размера Cosmos 3 Edge занимает первое место в VANTAGE-Bench по анализу визуальных данных.
Как и всегда, Cosmos 3 Edge полностью открыта. Доступны веса модели, рецепты постобучения и код.
Модель уже доступна на🤗
Cosmos 3 Edge помогает роботам обучаться и действовать, автономным автомобилям понимать дорожные сцены и предсказывать намерения участников движения, а ИИ-агентам компьютерного зрения — рассуждать на основе видеопотока в реальном времени для задач умной инфраструктуры.
Модель насчитывает 4 млрд параметров и включает reasoner на 2 млрд параметров на базе Nemotron. Её можно запускать на DGX Spark, NVIDIA Jetson и других устройствах.
Cosmos 3 Edge объединяет авторегрессионный и диффузионный transformer-блоки через общий механизм мультимодального внимания, связывая понимание, прогнозирование, симуляцию и действия в рамках одной модели.
Среди открытых моделей сопоставимого размера Cosmos 3 Edge занимает первое место в VANTAGE-Bench по анализу визуальных данных.
Как и всегда, Cosmos 3 Edge полностью открыта. Доступны веса модели, рецепты постобучения и код.
Модель уже доступна на
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
ОГО: в Китае построили ИИ-дата-центр мощностью 1 ГВт без единого чипа Nvidia.
По данным Bloomberg:
Сообщается, что zAI завершила строительство объекта и уже частично ввела его в эксплуатацию. Дата-центр полностью работает на чипах китайского производства и будет использоваться для разработки передовых моделей GLM компании.
Кроме того, zAI построила или эксплуатирует несколько вычислительных кластеров, каждый из которых включает более 10 000 чипов.
Это намного значительнее, чем выход очередной фронтир-модели. Важность независимости от США в сфере производства чипов сложно переоценить.
По данным Bloomberg:
Сообщается, что zAI завершила строительство объекта и уже частично ввела его в эксплуатацию. Дата-центр полностью работает на чипах китайского производства и будет использоваться для разработки передовых моделей GLM компании.
Кроме того, zAI построила или эксплуатирует несколько вычислительных кластеров, каждый из которых включает более 10 000 чипов.
Это намного значительнее, чем выход очередной фронтир-модели. Важность независимости от США в сфере производства чипов сложно переоценить.