CLI-Anything: как дать AI-агентам руки для обычных приложений
Идея простая: CLI-Anything генерирует командные интерфейсы для реального софта, чтобы агент мог не «тыкать мышкой», а вызывать понятные команды.
Так можно управлять CAD-инструментами, 3D-редакторами, редакторами субтитров, браузером, Blender, FreeCAD, GIMP, Inkscape, Obsidian, Kdenlive, OBS и другими приложениями. В репозитории уже есть десятки agent-harness’ов под разные программы.
Как это выглядит:
* агент получает задачу
* вызывает CLI
* приложение делает работу
* результат можно проверить и повторить
Есть и CLI-Hub: установка через
GitHub: https://github.com/HKUDS/CLI-Anything
Идея простая: CLI-Anything генерирует командные интерфейсы для реального софта, чтобы агент мог не «тыкать мышкой», а вызывать понятные команды.
Так можно управлять CAD-инструментами, 3D-редакторами, редакторами субтитров, браузером, Blender, FreeCAD, GIMP, Inkscape, Obsidian, Kdenlive, OBS и другими приложениями. В репозитории уже есть десятки agent-harness’ов под разные программы.
Как это выглядит:
* агент получает задачу
* вызывает CLI
* приложение делает работу
* результат можно проверить и повторить
Есть и CLI-Hub: установка через
pip install cli-anything-hub, дальше можно ставить готовые CLI через cli-hub install <name>.GitHub: https://github.com/HKUDS/CLI-Anything
🔥8👍4❤3
🔥 За одну неделю вышло сразу 6 интересных open-weight моделей
Пока все ждут веса Kimi K3 и Ling 3.0, в LLM Architecture Gallery Себастьяна Расчки появилось несколько свежих архитектур.
1. Nanbeige 4.2 3B
Всего 3B non-embedding параметров, но используется Looped Transformer: один и тот же стек слоёв проходит дважды. Больше эффективной глубины без удвоения весов.
https://huggingface.co/Nanbeige/Nanbeige4.2-3B
2. Laguna S 2.1
118B MoE, только 8B активных параметров, 48 слоёв и контекст 1M токенов. Сделана Poolside с упором на coding agents и длинные задачи.
https://huggingface.co/poolside/Laguna-S-2.1
3. Motif-3-Beta
Огромный 314B-A13B MoE: 384 routed experts, 8 активируются на токен, контекст 256K.
https://huggingface.co/Motif-Technologies/Motif-3-Beta
4. Solar Open 2
250B-A15B MoE от Upstage с 1M контекстом. Архитектура чередует три linear-attention слоя с одним обычным softmax-attention слоем. Модель рассчитана на длинные agentic workflows.
https://www.upstage.ai/blog/en/solar-open-2
5. Antares 1B
Компактная security-модель Cisco для анализа репозиториев и поиска потенциально уязвимого кода. Основана на Granite и дообучена под agentic terminal workflows.
https://huggingface.co/fdtn-ai/antares-1b
6. BTL-3
Rank-32 LoRA для Qwen3.6-27B, заточенная под coding agents и tool calling. Авторы заявляют 95,1% HumanEval и 88,5% BFCL v4 AST.
https://huggingface.co/badtheorylabs/BTL-3
Полная галерея архитектур:
https://sebastianraschka.com/llm-architecture-gallery/
Пока все ждут веса Kimi K3 и Ling 3.0, в LLM Architecture Gallery Себастьяна Расчки появилось несколько свежих архитектур.
1. Nanbeige 4.2 3B
Всего 3B non-embedding параметров, но используется Looped Transformer: один и тот же стек слоёв проходит дважды. Больше эффективной глубины без удвоения весов.
https://huggingface.co/Nanbeige/Nanbeige4.2-3B
2. Laguna S 2.1
118B MoE, только 8B активных параметров, 48 слоёв и контекст 1M токенов. Сделана Poolside с упором на coding agents и длинные задачи.
https://huggingface.co/poolside/Laguna-S-2.1
3. Motif-3-Beta
Огромный 314B-A13B MoE: 384 routed experts, 8 активируются на токен, контекст 256K.
https://huggingface.co/Motif-Technologies/Motif-3-Beta
4. Solar Open 2
250B-A15B MoE от Upstage с 1M контекстом. Архитектура чередует три linear-attention слоя с одним обычным softmax-attention слоем. Модель рассчитана на длинные agentic workflows.
https://www.upstage.ai/blog/en/solar-open-2
5. Antares 1B
Компактная security-модель Cisco для анализа репозиториев и поиска потенциально уязвимого кода. Основана на Granite и дообучена под agentic terminal workflows.
https://huggingface.co/fdtn-ai/antares-1b
6. BTL-3
Rank-32 LoRA для Qwen3.6-27B, заточенная под coding agents и tool calling. Авторы заявляют 95,1% HumanEval и 88,5% BFCL v4 AST.
https://huggingface.co/badtheorylabs/BTL-3
Полная галерея архитектур:
https://sebastianraschka.com/llm-architecture-gallery/
👍6❤4🔥4
ProtoLink - лёгкий Python-фреймворк для мультиагентных систем с A2A в основе
ProtoLink строит архитектуру вокруг самих агентов, а не цепочек вызовов LLM. Каждый агент имеет собственные capabilities, tools, lifecycle и может напрямую передавать задачи другим агентам через Agent-to-Agent (A2A).
Что есть внутри:
* OpenAI, Anthropic, Gemini, DeepSeek, Ollama, llama.cpp и другие модели;
* native Python tools и MCP;
* HTTP, SSE, WebSocket и gRPC;
* SQLite state и хранение запусков;
* telemetry через Langfuse и LangSmith;
* auth, policies, approvals, budgets и replay;
*
Фреймворк local-first: можно поднять агента вообще без API-ключа и облачной модели, а затем подключить Ollama или другой backend без переписывания tools и логики взаимодействия. Базовый пакет зависит только от Pydantic.
GitHub:
https://github.com/nMaroulis/protolink
Лицензия: MIT.
ProtoLink строит архитектуру вокруг самих агентов, а не цепочек вызовов LLM. Каждый агент имеет собственные capabilities, tools, lifecycle и может напрямую передавать задачи другим агентам через Agent-to-Agent (A2A).
Что есть внутри:
* OpenAI, Anthropic, Gemini, DeepSeek, Ollama, llama.cpp и другие модели;
* native Python tools и MCP;
* HTTP, SSE, WebSocket и gRPC;
* SQLite state и хранение запусков;
* telemetry через Langfuse и LangSmith;
* auth, policies, approvals, budgets и replay;
*
Pipeline, Parallel, Router и Graph для детерминированных workflow.Фреймворк local-first: можно поднять агента вообще без API-ключа и облачной модели, а затем подключить Ollama или другой backend без переписывания tools и логики взаимодействия. Базовый пакет зависит только от Pydantic.
GitHub:
https://github.com/nMaroulis/protolink
Лицензия: MIT.
🔥6❤4👍4
Сложный индустриальный ML, работа с генеративными подсказками, уровни дообучения и агентский Cotype — на E-CODE 2026 трек ML&DS снова впечатляет.
Программа ещё пополняется. Но уже сейчас понятно, что успевшая заслужить высокоранговую славу конференция Ozon Tech снова станет одним из ключевых событий в индустрии.
Осталось только пройти модерацию, чтобы убедиться лично: https://ecode.ozon.tech/. Ну, и дать огня на вечеринках, конечно!
Программа ещё пополняется. Но уже сейчас понятно, что успевшая заслужить высокоранговую славу конференция Ozon Tech снова станет одним из ключевых событий в индустрии.
Осталось только пройти модерацию, чтобы убедиться лично: https://ecode.ozon.tech/. Ну, и дать огня на вечеринках, конечно!
🔥4👍3😢1🎉1
🔥 `Agents-cli` от Google - полный конвейер разработки AI-агентов из терминала
Инструмент добавляет coding-агентам вроде Claude Code, Codex и Antigravity CLI готовые навыки для работы с Google ADK и облачной инфраструктурой. Сам
Что умеет:
• создавать каркас агентного проекта
• запускать агента локально
• генерировать датасеты для eval
• оценивать и сравнивать трассы
• находить типичные причины ошибок
• автоматически оптимизировать промпты
• добавлять RAG, CI/CD и observability
• деплоить в Cloud Run, GKE или Agent Runtime
• публиковать агента в Gemini Enterprise
Для локальной разработки Google Cloud необязателен — достаточно Gemini API через AI Studio. Для облачного деплоя уже потребуется собственный проект Google Cloud.
Установка:
Можно установить только skills:
Лицензия Apache 2.0.
🔗 https://github.com/google/agents-cli
Инструмент добавляет coding-агентам вроде Claude Code, Codex и Antigravity CLI готовые навыки для работы с Google ADK и облачной инфраструктурой. Сам
agents-cli моделью или отдельным coding-агентом не является.Что умеет:
• создавать каркас агентного проекта
• запускать агента локально
• генерировать датасеты для eval
• оценивать и сравнивать трассы
• находить типичные причины ошибок
• автоматически оптимизировать промпты
• добавлять RAG, CI/CD и observability
• деплоить в Cloud Run, GKE или Agent Runtime
• публиковать агента в Gemini Enterprise
Для локальной разработки Google Cloud необязателен — достаточно Gemini API через AI Studio. Для облачного деплоя уже потребуется собственный проект Google Cloud.
Установка:
uvx google-agents-cli setup
Можно установить только skills:
npx skills add google/agents-cli
Лицензия Apache 2.0.
🔗 https://github.com/google/agents-cli
👍5🔥5❤2
One Day Offer: заходи в команду, которая двигает финансы на терабайтах данных! 🔥
На связи блок «Финансы» в Сбере! Мы строим системы, которые автоматизируют казначейство, риск‑менеджмент, отчётность — и добавляем AI для точных прогнозов.
На One Day Offer мы хотим найти коллег сразу в 3 продуктовые команды. Базовый стек и уровень задач одинаковы — выбирай направление по душе:
✔️ BigData: Spark (batch+streaming), сложные SQL‑оптимизации, DWH/Data Lake.
✔️ Микросервисы: Python (FastAPI/Django), API, интеграции с системами.
От тебя ждём: Python от 5 лет, экспертный SQL, PySpark, SOLID/asyncio, HDFS/Kafka.
👉 Регистрируйся по ссылке. Встречаемся 8 августа!
На связи блок «Финансы» в Сбере! Мы строим системы, которые автоматизируют казначейство, риск‑менеджмент, отчётность — и добавляем AI для точных прогнозов.
На One Day Offer мы хотим найти коллег сразу в 3 продуктовые команды. Базовый стек и уровень задач одинаковы — выбирай направление по душе:
✔️ BigData: Spark (batch+streaming), сложные SQL‑оптимизации, DWH/Data Lake.
✔️ Микросервисы: Python (FastAPI/Django), API, интеграции с системами.
От тебя ждём: Python от 5 лет, экспертный SQL, PySpark, SOLID/asyncio, HDFS/Kafka.
👉 Регистрируйся по ссылке. Встречаемся 8 августа!
🔥3❤1🎉1
🎙 Kyutai открыла готовый стек для потоковых голосовых агентов
Delayed Streams Modeling — репозиторий с моделями и примерами для streaming STT и TTS. Аудио обрабатывается частями: агент начинает распознавать речь и генерировать ответ, не дожидаясь окончания записи.
Что внутри:
• потоковая транскрибация с временными метками для каждого слова
• модель 1B EN/FR с задержкой около 0,5 секунды и semantic VAD
• английская модель 2.6B с задержкой около 2,5 секунды
• PyTorch-ноутбуки для экспериментов
• Rust-сервер с WebSocket для продакшена
• MLX-реализация для Mac и iPhone
• streaming TTS, который принимает текст и сразу выдаёт звук частями.
На H100 разработчики заявляют обработку до 400 одновременных STT-потоков, а Rust-сервер на L40S обслуживает 64 подключения быстрее реального времени.
Лицензии разделены по компонентам: Python и web — MIT, Rust backend — Apache 2.0, веса STT — CC BY 4.0.
🔗 https://github.com/kyutai-labs/delayed-streams-modeling
Delayed Streams Modeling — репозиторий с моделями и примерами для streaming STT и TTS. Аудио обрабатывается частями: агент начинает распознавать речь и генерировать ответ, не дожидаясь окончания записи.
Что внутри:
• потоковая транскрибация с временными метками для каждого слова
• модель 1B EN/FR с задержкой около 0,5 секунды и semantic VAD
• английская модель 2.6B с задержкой около 2,5 секунды
• PyTorch-ноутбуки для экспериментов
• Rust-сервер с WebSocket для продакшена
• MLX-реализация для Mac и iPhone
• streaming TTS, который принимает текст и сразу выдаёт звук частями.
На H100 разработчики заявляют обработку до 400 одновременных STT-потоков, а Rust-сервер на L40S обслуживает 64 подключения быстрее реального времени.
Лицензии разделены по компонентам: Python и web — MIT, Rust backend — Apache 2.0, веса STT — CC BY 4.0.
🔗 https://github.com/kyutai-labs/delayed-streams-modeling
🔥3❤2👍2
🐍 collections.Counter: больше, чем подсчёт частот
Большинство используют Counter только ради most_common(), хотя у него есть куда более интересные возможности.
Можно складывать и вычитать частоты:
Пересечение и объединение счётчиков:
Удалить элементы с нулевой и отрицательной частотой:
Получить общее число элементов:
Развернуть счётчик обратно в последовательность:
Особенно удобно для анализа логов, событий, токенов, категорий и любых данных, где важна частота появления.
#Python #Collections #Backend
Большинство используют Counter только ради most_common(), хотя у него есть куда более интересные возможности.
from collections import Counter
a = Counter("abracadabra")
b = Counter("barbecue")
Можно складывать и вычитать частоты:
a + b
a - b
Пересечение и объединение счётчиков:
a & b # минимальные значения
a | b # максимальные значения
Удалить элементы с нулевой и отрицательной частотой:
clean = +a
Получить общее число элементов:
a.total()
Развернуть счётчик обратно в последовательность:
list(a.elements())
Особенно удобно для анализа логов, событий, токенов, категорий и любых данных, где важна частота появления.
#Python #Collections #Backend
❤8👍5🔥4
This media is not supported in your browser
VIEW IN TELEGRAM
Управляй реальными устройствами с помощью кода.
Попробуй себя в треке по программированию роботов на True Tech Champ 2026 и поборись за 7 500 000 руб.
Начать проще, чем кажется: зарегистрируйся, собери команду или объединись с другими участниками на платформе и пройди квалификационный этап до 13 сентября. В онлайн-симуляторе тебе предстоит запрограммировать робособаку и робота-манипулятора для доставки груза через полосу препятствий. Количество попыток не ограничено, а еще тебя будет ждать серия обучающих вебинаров.
Лучшие команды пройдут в финал и будут программировать реальных роботов на офлайн-полигоне 22 октября на большой сцене.
Масштабный финал объединит борьбу за призовой фонд в 7 500 000 руб., выступления хедлайнеров, доклады спикеров и активности для всех гостей мероприятия.
Успей зарегистрироваться и пройти квалификацию до 13 сентября.
Реклама. ООО "МВС". ИНН 7707767501. erid: 2W5zFJomh13
Попробуй себя в треке по программированию роботов на True Tech Champ 2026 и поборись за 7 500 000 руб.
Начать проще, чем кажется: зарегистрируйся, собери команду или объединись с другими участниками на платформе и пройди квалификационный этап до 13 сентября. В онлайн-симуляторе тебе предстоит запрограммировать робособаку и робота-манипулятора для доставки груза через полосу препятствий. Количество попыток не ограничено, а еще тебя будет ждать серия обучающих вебинаров.
Лучшие команды пройдут в финал и будут программировать реальных роботов на офлайн-полигоне 22 октября на большой сцене.
Масштабный финал объединит борьбу за призовой фонд в 7 500 000 руб., выступления хедлайнеров, доклады спикеров и активности для всех гостей мероприятия.
Успей зарегистрироваться и пройти квалификацию до 13 сентября.
Реклама. ООО "МВС". ИНН 7707767501. erid: 2W5zFJomh13
👍5❤2🎉1
🚀 NVIDIA открыла единый фреймворк для обучения и запуска world models
Cosmos Framework объединяет полный цикл работы с моделями Cosmos 3: обучение, дообучение, инференс и онлайн-сервинг.
Что внутри:
• распределённое обучение через FSDP, TP, CP и PP
• импорт и экспорт Hugging Face
• поддержка JSONL, WebDataset и LeRobot
• инференс через Diffusers, Transformers и vLLM
• batch-генерация и сервер на Ray + Gradio
• готовые Agent Skills для Claude Code, Codex CLI и Cursor
Cosmos 3 работает с текстом, изображениями, видео, аудио и последовательностями действий. Фреймворк рассчитан на разработку моделей для робототехники, автономных систем и симуляции физического мира.
Примеры обучения протестированы на 8× H100 80 ГБ, а облегчённую Cosmos3-Nano можно запускать на одной GPU.
🔗 https://github.com/NVIDIA/cosmos-framework
Cosmos Framework объединяет полный цикл работы с моделями Cosmos 3: обучение, дообучение, инференс и онлайн-сервинг.
Что внутри:
• распределённое обучение через FSDP, TP, CP и PP
• импорт и экспорт Hugging Face
safetensors • поддержка JSONL, WebDataset и LeRobot
• инференс через Diffusers, Transformers и vLLM
• batch-генерация и сервер на Ray + Gradio
• готовые Agent Skills для Claude Code, Codex CLI и Cursor
Cosmos 3 работает с текстом, изображениями, видео, аудио и последовательностями действий. Фреймворк рассчитан на разработку моделей для робототехники, автономных систем и симуляции физического мира.
Примеры обучения протестированы на 8× H100 80 ГБ, а облегчённую Cosmos3-Nano можно запускать на одной GPU.
🔗 https://github.com/NVIDIA/cosmos-framework
❤4🔥3👍2🎉2
One Day Offer для Python-разработчиков!💚
15 августа открываем двери в команду Agent Execution Framework ⚡️
Коллеги создают платформу для GenAI‑агентов в банке — делают так, чтобы ИИ реально работал в серьёзных финпроцессах: с безопасностью, нагрузкой и пользой.
Чем предстоит заниматься:
✔️ развивать backend на Python
✔️ подключать LLM, инструменты, базы знаний и RAG
✔️ строить пайплайны оценки качества агентов
✔️ участвовать в архитектуре и ревью кода
Встречаемся 15 августа онлайн.
Регистрируйся по ссылке
15 августа открываем двери в команду Agent Execution Framework ⚡️
Коллеги создают платформу для GenAI‑агентов в банке — делают так, чтобы ИИ реально работал в серьёзных финпроцессах: с безопасностью, нагрузкой и пользой.
Чем предстоит заниматься:
✔️ развивать backend на Python
✔️ подключать LLM, инструменты, базы знаний и RAG
✔️ строить пайплайны оценки качества агентов
✔️ участвовать в архитектуре и ревью кода
Встречаемся 15 августа онлайн.
Регистрируйся по ссылке
❤1🎉1
🐍 Python-совет: как объединить списки разной длины и не потерять данные
Обычный zip() останавливается на самом коротком списке:
Элементы 4 и 5 просто исчезнут. Чтобы сохранить их, используйте zip_longest():
Результат:
А когда списки обязаны иметь одинаковую длину, в Python 3.10+ лучше включить проверку:
Вместо тихой потери данных Python сразу выбросит ValueError.
Полезно при обработке таблиц, CSV, результатов API и параллельных наборов данных.
#Python #Programming #PythonTips
Обычный zip() останавливается на самом коротком списке:
numbers = [1, 2, 3, 4, 5]
letters = ["a", "b", "c"]
print(list(zip(numbers, letters)))
# [(1, 'a'), (2, 'b'), (3, 'c')]
Элементы 4 и 5 просто исчезнут. Чтобы сохранить их, используйте zip_longest():
from itertools import zip_longest
result = zip_longest(
numbers,
letters,
fillvalue="нет значения",
)
print(list(result))
Результат:
[
(1, "a"),
(2, "b"),
(3, "c"),
(4, "нет значения"),
(5, "нет значения"),
]
А когда списки обязаны иметь одинаковую длину, в Python 3.10+ лучше включить проверку:
zip(numbers, letters, strict=True)
Вместо тихой потери данных Python сразу выбросит ValueError.
Полезно при обработке таблиц, CSV, результатов API и параллельных наборов данных.
#Python #Programming #PythonTips
🔥6❤4👍3