GitHub
GitHub - Dicklesworthstone/destructive_command_guard: The Destructive Command Guard (dcg) is for blocking dangerous git and shell…
The Destructive Command Guard (dcg) is for blocking dangerous git and shell commands from being executed by agents. - Dicklesworthstone/destructive_command_guard
Rust утилита перехватывает shell-команды агента (Claude Code, Codex CLI, Cursor, Gemini CLI и других) через хук
PreToolUse и блокирует выполнение команд вроде git reset --hard, rm -rf, DROP TABLE и подобных до запуска, а не после.Из коробки включены только пакеты
core.filesystem, core.git и system.disk — самые катастрофичные и невосстановимые. Всё остальное (Docker, Kubernetes, облака, базы данных, S3) — опционально, настраивается через конфиг:[packs]
enabled = ["database.postgresql", "containers.docker", "cloud.aws"]
Нюанс, о котором в README не кричат: дизайн fail-open. Если анализ команды не укладывается в таймаут или парсинг падает, поведение по умолчанию — пропустить команду, а не заблокировать. Это осознанный компромисс, чтобы хук не тормозил работу, но это не полноценный security-барьер, а именно страховка от типичных ошибок агентов.
Если вы работаете с Claude Code и хотите подстраховаться от
git reset --hard в 3 часа ночи, утилита устанавливается одной командой, но сразу включайте пакеты под свой стек, так как защита по умолчанию узкая.#AI #ClaudeCode #AIDev
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11👎7
Claude AI Dev Broadcast
⚡️ SpaceXAI выпустила Grok 4.5 и это уже стоящий конкурент Claude Code с Sonnet/Opus Модель доступна уже сегодня в Grok Build, во всех тарифах Cursor и в консоли SpaceXAI. Цена: $2/млн входных токенов, $6/млн выходных — заметно дешевле Opus $5/$25 Главный…
😮 Так ли хорошо Grok 4.5 как про него говорит Маск?
Сразу после разбора сел с ним делать задачи и в целом он неплохо проявил себя. Решил дать не самую сложную, но и не самую простую задачу - миграция DI в многомодульном Android проекте. В целом справился, но без но не обошлось. Буду тестировать дальше и рассказывать про итоги.
🪙 Демо и мои впечатления в видео на Boosty
#AI #Grok #Android
Сразу после разбора сел с ним делать задачи и в целом он неплохо проявил себя. Решил дать не самую сложную, но и не самую простую задачу - миграция DI в многомодульном Android проекте. В целом справился, но без но не обошлось. Буду тестировать дальше и рассказывать про итоги.
#AI #Grok #Android
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12👎6
Почему самая маленькая квантизированная модель оказалась медленнее — разбор на бенчмарках
Chris Merrick прогнал MobileNetV2 в трёх квантизациях (FP32/INT8/INT4) на Pixel 10. Результат - самая лёгкая по весу INT4 на CPU оказалась медленнее INT8. Вывод: размер файла не главный критерий быстродействия.
Полезно, если делаешь on-device inference и оптимизируешь модели под мобилки.
#AI #Android #OnDeviceAI
Chris Merrick прогнал MobileNetV2 в трёх квантизациях (FP32/INT8/INT4) на Pixel 10. Результат - самая лёгкая по весу INT4 на CPU оказалась медленнее INT8. Вывод: размер файла не главный критерий быстродействия.
Полезно, если делаешь on-device inference и оптимизируешь модели под мобилки.
#AI #Android #OnDeviceAI
👍6👎5
От гонки OpenAI и Anthropic выигрвают пользователи - ночью с 15 на 16 июля снова сбросили лимиты!
#Claude
#Claude
👍15👎4
Практически все там - обычная GitHub-рутина, которую любая команда и так закрыла себе через Actions и скрипты (CI, PR, конфликты, статус работы). Если у вас это уже настроено, открытий тут не будет.
Но пара штук реально цепляет:
✅ verify-this: агент не пишет "готово", а доказывает результат на паре baseline/treatment. Дисциплина вместо доверия на слово, принцип стоит утащить к себе независимо от Cursor.
⚠️ deslop: самое интересное название, но полез смотреть реальный файл скилла, там пять пунктов и три гардрейла, ни одного примера до/после. Без конкретики агент может резать не то что нужно, перед тем как тащить к себе, погоняйте на своём коде и проверьте.
Чего-то сокровенного вы не узнаете из наработок, это срез того, как команда Cursor вообще мыслит про то, что заворачивать в скилл. Смотреть как источник вдохновения.
#AI #Cursor #AIAgents #DevTools
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6👎4
Forwarded from Nek.12 | Сбросы лимитов OpenAI [RU]
Вышла Kimi K3 - опенсорсная китайская модель которая
• Сильнейшая в мире по фронтенд-дизайну
• Стоит как Sonnet, а по уровню превосходит Opus 4.8 во всём (который стоит втрое дороже)
• По уровню чуть ниже Fable, в ~половине бенчмарков побеждает 5.6 Sol
• На 20% меньше токенов тратит чем 2.6
• Контекстное окно 1М токенов
Это удар по антропик невероятного масштаба... Домашний Fable за 1/10 цены с открытыми весами и на своей инфре. Я хз как они от этого оправятся, если в реальном пользовании модель будет такая же, как по бенчам. Дистилляция не прошла даром.
• Сильнейшая в мире по фронтенд-дизайну
• Стоит как Sonnet, а по уровню превосходит Opus 4.8 во всём (который стоит втрое дороже)
• По уровню чуть ниже Fable, в ~половине бенчмарков побеждает 5.6 Sol
• На 20% меньше токенов тратит чем 2.6
• Контекстное окно 1М токенов
Это удар по антропик невероятного масштаба... Домашний Fable за 1/10 цены с открытыми весами и на своей инфре. Я хз как они от этого оправятся, если в реальном пользовании модель будет такая же, как по бенчам. Дистилляция не прошла даром.
👍23👎2
Страх перед GPT 5.6 и KIMI K3 дает о себе знать. На мой взгляд, компания теряет уверенность в своих силах и подходах
#Claude #Anthropic #Fable5
Please open Telegram to view this post
VIEW IN TELEGRAM
👍18👎3
3.6 Flash — рабочая лошадка линейки. По данным Google на 17% меньше выходных токенов на задачу, чем у 3.5 Flash.
3.5 Flash-Lite — самая быстрая и предзначена для тех кому нужен быстрый ответ: 350 токенов в секунду. По собственным бенчам Google, по качеству обгоняет даже 3 Flash на части агентных задач.
⚠️ 3.5 Flash Cyber (поиск и патч уязвимостей) публично не доступна только правительствам и «доверенным партнёрам» в закрытом пилоте, что уже становится трендом. И это не разовая история — у крупных вендоров всё чаще самые мощные и специализированные модели закрываются от обычных разработчиков сразу на старте, а не спустя время после релиза. Тенденция, за которой стоит следить отдельно от самих моделей.
Бенчмаркам на анонсе я доверяю слабо в принципе, и это касается не только Google: любой вендор на релизе подбирает цифры так, чтобы показать себя с лучшей стороны.
Главный вопрос качество/цена работы а не цена за токены в отрыве от скорости и качества.
Я это уже проходил с GLM 5.2 недавно: дешёвый токен ничего не гарантирует, если модель тратит их в разы больше на ту же задачу, и итоговая стоимость решения оказывается выше, чем у дорогой, но эффективной модели. Смотреть надо на стоимость выполнения задачи целиком, а не на прайс-лист за 1M токенов.
3.6 Flash и Flash-Lite уже можно пробовать в Android Studio через Gemini API и оценить на ваших задачах.
#AI #Gemini #LLM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5👎4
#Claude #iOS #ClaudeCode #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4👎1
Регайтесь в KIMI Code пока совсем не закрыли всё. Доступ по API токенам дешевый и вполне подъемный.
👎17👍2