https://www.danshapiro.com/blog/2026/01/the-five-levels-from-spicy-autocomplete-to-the-software-factory/
Из забавного
у Дэна Шапира была статья про пять уровней автономности. Для последней это темные фабрики. В принципе, это аналог того, что уже делается в Китае, когда полностью автоматизированные роботы на фабриках создают девайсы без человека.
А здесь он как раз говорил, что и с программным обеспечением скоро будет так же.
И вот наблюдая в интернете последние полторы недели, начал хайпиться новый термин, означающий dark code, то есть темный код. В чем мой прикол, что вся разработка уже перешла на спецификации, а сам код никто не пишет, никто не смотрит, пока только на хайпе.
Посмотрим, что из этого выйдет.
Из забавного
у Дэна Шапира была статья про пять уровней автономности. Для последней это темные фабрики. В принципе, это аналог того, что уже делается в Китае, когда полностью автоматизированные роботы на фабриках создают девайсы без человека.
А здесь он как раз говорил, что и с программным обеспечением скоро будет так же.
И вот наблюдая в интернете последние полторы недели, начал хайпиться новый термин, означающий dark code, то есть темный код. В чем мой прикол, что вся разработка уже перешла на спецификации, а сам код никто не пишет, никто не смотрит, пока только на хайпе.
Посмотрим, что из этого выйдет.
Danshapiro
The Five Levels: from Spicy Autocomplete to the Dark Factory
In my last post, I wrote about technical deflation. We’re seeing the cost of code is dropping so fast that we need to change our tech debt payment plans. The smart teams…
❤🔥2
https://github.com/alifanov/cmux-file-viewer
Сделал себе имбовую штуку, локальный просмотрщик различных диаграмм. Дело в том, что в cmux есть возможность открывать встроенный браузер, но диаграммы по умолчанию там не рендерятся. В итоге сделал следующее.
Поднимаю локальный просмотрщик, которому передается полный URL. Получается, что я добавил в сниппет, который я добавляю в глобальный CloudMD файл, говорит, что после генерации диаграммы нужно показывать такую ссылку. Я просто кликаю на эту ссылку, и у меня появилась эта ссылка. В правой панели показывается сама диаграмма.
Сделал себе имбовую штуку, локальный просмотрщик различных диаграмм. Дело в том, что в cmux есть возможность открывать встроенный браузер, но диаграммы по умолчанию там не рендерятся. В итоге сделал следующее.
Поднимаю локальный просмотрщик, которому передается полный URL. Получается, что я добавил в сниппет, который я добавляю в глобальный CloudMD файл, говорит, что после генерации диаграммы нужно показывать такую ссылку. Я просто кликаю на эту ссылку, и у меня появилась эта ссылка. В правой панели показывается сама диаграмма.
🔥1
https://openrouter.ai/docs/guides/features/guardrails
Я как-то пропустил, но оказывается, на OpenRouter есть такая штука, где ты можешь ограничить, что с определённого API-ключа у тебя используются только определённые модели, да и не больше определённого бюджета. В принципе, тема прикольная, если паришься над тем, что ключи могут быть заабьюзены. Если я хочу ввести, например, чисто клиентское приложение, то здесь можно ограничить, что можно заабьюзить, но в рамках только этой моей модели и не больше определённой суммы.
Я как-то пропустил, но оказывается, на OpenRouter есть такая штука, где ты можешь ограничить, что с определённого API-ключа у тебя используются только определённые модели, да и не больше определённого бюджета. В принципе, тема прикольная, если паришься над тем, что ключи могут быть заабьюзены. Если я хочу ввести, например, чисто клиентское приложение, то здесь можно ограничить, что можно заабьюзить, но в рамках только этой моей модели и не больше определённой суммы.
OpenRouter Documentation
Guardrails - Organization Spending and Access Controls
Set spending limits, restrict model access, and enforce data policies for your organization members and API keys with OpenRouter guardrails.
не remotion единым
https://github.com/heygen-com/hyperframes
новый тул для создания видео кодом - от HeyGen - пишут что специализирован для работы с агентами
что понравилось - сразу и озвучку делает, но качество из коробки так себе - обязательно нужно докручитвать
https://github.com/heygen-com/hyperframes
новый тул для создания видео кодом - от HeyGen - пишут что специализирован для работы с агентами
что понравилось - сразу и озвучку делает, но качество из коробки так себе - обязательно нужно докручитвать
GitHub
GitHub - heygen-com/hyperframes: Write HTML. Render video. Built for agents.
Write HTML. Render video. Built for agents. Contribute to heygen-com/hyperframes development by creating an account on GitHub.
🔥1
Токены на Claude подписке все продолжают активно улетать. Так что для некоторых задач я стал искать другое решение.
В итоге взял Ollama, погонял локальные модели, ничего хорошего там не нашел, но оказалось, что у Ollama есть подписка на улучшенный инференс. Создал по своим сессиям в Claude code тесты для своего бенчмарка, прогнал несколько моделей, которые мне больше всего подходят по этому бенчмарку, и запустил ollama launch claude с моделью, которая мне лучше всего подошла, это была GLM5.1, и вот она на постоянке сидит уже несколько дней, разбирает мои заметки в Obsidian.
В итоге взял Ollama, погонял локальные модели, ничего хорошего там не нашел, но оказалось, что у Ollama есть подписка на улучшенный инференс. Создал по своим сессиям в Claude code тесты для своего бенчмарка, прогнал несколько моделей, которые мне больше всего подходят по этому бенчмарку, и запустил ollama launch claude с моделью, которая мне лучше всего подошла, это была GLM5.1, и вот она на постоянке сидит уже несколько дней, разбирает мои заметки в Obsidian.
👍3
CLAUDE_CODE_SUBAGENT_MODEL=claude-haiku-4-5 claude
ща гоняю такой подход для экономии токенов
субагенты в claude code запускаются принудительно через haiku - то есть встоенные (Explore и т.п.) субагенты должны идти через haiku
А в самом CC - /model opusplan
Теперь флоу такой
• Plan model - opus
• default mode - sonnet
• subagents - haiku
ща гоняю такой подход для экономии токенов
субагенты в claude code запускаются принудительно через haiku - то есть встоенные (Explore и т.п.) субагенты должны идти через haiku
А в самом CC - /model opusplan
Теперь флоу такой
• Plan model - opus
• default mode - sonnet
• subagents - haiku
👍2
Водхновившись OpenClaw и Гермесом, сделал под себя своего ассистента, а теперь перевожу его на отдельную платформу, чтобы запаковать как продукт. Одна из прикольных фич, которая мне пришла в голову, это виджеты на домашнем экране. То есть можно посмотреть сессии, которые были, плюс можно запросить какие-то виджеты с информацией, которые я смотрю чаще всего. Из интересного получилось так, что сам виджет генерируется по правилам с валидацией тоже через LLM. То есть фактически можно создавать практически любые виджеты. А для получения данных имеется proxy-документ с доступом к заметкам и к MCP-методам. Поэтому при загрузке виджета фактически напрямую выполняется код, а не к LLM
❤2👎1👌1
https://github.com/alchaincyf/huashu-design
начал хайпиться новый реп по дизайну последнее время
всего 7к звезде пока
в чем прикол - автору понравилась идея Claude design, но он не хотел выходить из терминала - потому решил его воспроизвести
UI делает сам - можно также покликать по интерактиновму прототипу
Пока выглядит как просто проект но мб залетит и будет альтернативной claude deisgn
начал хайпиться новый реп по дизайну последнее время
всего 7к звезде пока
в чем прикол - автору понравилась идея Claude design, но он не хотел выходить из терминала - потому решил его воспроизвести
UI делает сам - можно также покликать по интерактиновму прототипу
Пока выглядит как просто проект но мб залетит и будет альтернативной claude deisgn
GitHub
GitHub - alchaincyf/huashu-design: Huashu Design · HTML-native design skill for Claude Code · Claude Code 里 HTML 原生的设计 skill ·…
Huashu Design · HTML-native design skill for Claude Code · Claude Code 里 HTML 原生的设计 skill · 高保真原型 / 幻灯片 / 动画 + 20 设计哲学 + 5 维评审 + MP4 导出 · Agent-agnostic - alchaincyf/huashu-design
Сегодня полдня пытался сделать одну поделку, но она так и не получилась. Не вышел каменный цветок.
А именно, что хотел? Я хотел иметь один harness, но использовать разные модели.
То есть использовать Claude Code с подпиской Claude, с подпиской Codex, чтобы можно было еще погонять open source модели на GroqQ или на Cerebras.
В итоге нашел несколько решений, погонял каждое, но они так и не заработали. И пробовал и LiteLLM, и CCProxyAPI, и CLIProxy, ничего так не заработало.
В итоге сейчас остановился на варианте, что Claude code я использую нативно, а для кодекса open source использую OpenCode, потому что в последних версиях он хотя бычастично совместим с тем, что у меня уже прописано в claude.md и в скиллах. Минимальна миграция. А вот я смотрел Codex CLI, там пришлось бы сильно повозиться.
Пока такой стэк, что Claude Code и OpenCode для всего остального. Посмотрим, как это заработает.
А именно, что хотел? Я хотел иметь один harness, но использовать разные модели.
То есть использовать Claude Code с подпиской Claude, с подпиской Codex, чтобы можно было еще погонять open source модели на GroqQ или на Cerebras.
В итоге нашел несколько решений, погонял каждое, но они так и не заработали. И пробовал и LiteLLM, и CCProxyAPI, и CLIProxy, ничего так не заработало.
В итоге сейчас остановился на варианте, что Claude code я использую нативно, а для кодекса open source использую OpenCode, потому что в последних версиях он хотя бычастично совместим с тем, что у меня уже прописано в claude.md и в скиллах. Минимальна миграция. А вот я смотрел Codex CLI, там пришлось бы сильно повозиться.
Пока такой стэк, что Claude Code и OpenCode для всего остального. Посмотрим, как это заработает.
Это промежуточные результаты по моему эксперименту с YouTube Shorts и Afte Research Карпаты. Все видео генерились при помощи Remotion с Claude Code. Дополнительно использовалась фоновая музыка, но при всем при этом, когда я докидывал еще гипотезы для экспериментов по поводу озвучки или другой музыки, оказалось, что варианты с озвучкой на самом деле хуже работают, и точно так же с другой фоновой музыкой видео тоже хуже работали, так что вернулись на изначальное состояние.
❤2👌1
ffprobe -v error -show_entries format=duration -of csv=p=0 video.mp4
# Сравниваешь с expected duration из props. Mismatch >100ms = ошибка.
ffmpeg -i video.mp4 -af silencedetect=noise=-40dB:d=0.5 -f null - 2>&1 | grep silence
# Если silence detected в Hook section (где BGM должен играть с frame 1) = ошибка.
ffmpeg -i video.mp4 -af ebur128=peak=true -f null - 2>&1
# Получаешь LUFS integrated/momentary. Резкие провалы = audio dropout.
ffmpeg -i video.mp4 -vf "freezedetect=n=0.001:d=0.3" -map 0:v:0 -f null - 2>&1
# Нативный фильтр. Любой freeze >0.3s = ошибка.
ffmpeg -i video.mp4 -vf "select='gt(scene,0.3)',showinfo" -f null - 2>&1
# Получаешь timestamps всех scene changes. Сравниваешь с expected (transitions between Hook/Setup/Payload/CTA).
ffmpeg -i video.mp4 -af "asetnsamples=1024,astats=metadata=1:reset=1,ametadata=print:key=lavfi.astats.Overall.Peak_level" -f null -
# Извлекаешь аудио peaks. Совпадают ли peaks SFX с твоими expected visual timestamps?
Я тут закинул в ChatGPT и Claude момент с autoresearch для YouTube Shorts и в итоге выяснил, что оказывается еще до отправки в Gemini видео результирующего, можно добавить проверки через ffmpeg на всякие артефакты, где есть косяки в самом видео. Типа слишком долго видео идет, слишком короткое звуковое сопровождение и так далее.
Так что у меня получилось еще создать еще один уровень проверки перед отправкой видео в Gemini и получение фидбэка.
https://github.com/coleam00/Archon
https://bernstein.run/
🚀 Интересные проекты и мой собственный подход
Нашел несколько интересных проектов — настоящий фундамент для темной фабрики кода. 🤖
Попробовал оба, но они показались мне избыточными. В итоге я начал писать своё решение: закрытое, но гораздо проще и точно под мои кейсы. 🛠️
Да, я позаимствовал несколько идей у этих проектов, однако они всё ещё выглядели слишком сложными, поэтому решил создать своё решение. 📚
Для тех, кто хочет «засэтапить» темную фабрику, можно начать с этих проектов, посмотреть, как они работают, и взять оттуда полезные части. 🔍
https://bernstein.run/
🚀 Интересные проекты и мой собственный подход
Нашел несколько интересных проектов — настоящий фундамент для темной фабрики кода. 🤖
Попробовал оба, но они показались мне избыточными. В итоге я начал писать своё решение: закрытое, но гораздо проще и точно под мои кейсы. 🛠️
Да, я позаимствовал несколько идей у этих проектов, однако они всё ещё выглядели слишком сложными, поэтому решил создать своё решение. 📚
Для тех, кто хочет «засэтапить» темную фабрику, можно начать с этих проектов, посмотреть, как они работают, и взять оттуда полезные части. 🔍
GitHub
GitHub - coleam00/Archon: The first open-source harness builder for AI coding. Make AI coding deterministic and repeatable.
The first open-source harness builder for AI coding. Make AI coding deterministic and repeatable. - coleam00/Archon
👍3
https://github.com/nexu-io/open-design
Вот ещё один новый инструмент, вдохновлённый тем же Claude Design.
Единственное отличие — теперь он оснащён дополнительным визуальным интерфейсом.
Вот ещё один новый инструмент, вдохновлённый тем же Claude Design.
Единственное отличие — теперь он оснащён дополнительным визуальным интерфейсом.
GitHub
GitHub - nexu-io/open-design: 🎨 Best DeepSeek Harness Design Plugin. The open-source Claude Design alternative. 🖥️ Local-first…
🎨 Best DeepSeek Harness Design Plugin. The open-source Claude Design alternative. 🖥️ Local-first desktop app. 🖼️ Your coding agent becomes the design engine: prototypes, landing pages, dashboards, ...
👍2
https://github.com/juliusbrussee/caveman
🚀 Кейвмен 2.0: Ультра Фул Лайт
Новый релиз – несколько вариантов Ultra Full Light. Выбирай, что нужно, и ставь под себя. 🛠️
🔗 Ссылка на статью: чем короче отвечает LLM, тем правдивее ответ. https://arxiv.org/abs/2604.00025
🚀 Кейвмен 2.0: Ультра Фул Лайт
Новый релиз – несколько вариантов Ultra Full Light. Выбирай, что нужно, и ставь под себя. 🛠️
🔗 Ссылка на статью: чем короче отвечает LLM, тем правдивее ответ. https://arxiv.org/abs/2604.00025
GitHub
GitHub - JuliusBrussee/caveman: 🪨 why use many token when few token do trick. Viral skill + proxy for coding agents that cuts 65%…
🪨 why use many token when few token do trick. Viral skill + proxy for coding agents that cuts 65% of tokens by talking like a caveman. - JuliusBrussee/caveman
https://www.openui.com/
🚀 Новые виджеты и открытый стандарт
Только завершил интеграцию виджетов в ассистенте – и как отдельные виджеты, так и в чате.
А ребята сделали open‑source стандарт для генеративного UI. 😎
🚀 Новые виджеты и открытый стандарт
Только завершил интеграцию виджетов в ассистенте – и как отдельные виджеты, так и в чате.
А ребята сделали open‑source стандарт для генеративного UI. 😎
OpenUI - The Open Standard for Generative UI
Full-stack, renderer-agnostic Generative UI built on OpenUI Lang, a streaming-first language with official React support, community integrations, and up to 67% fewer tokens than JSON.
❤1
https://github.com/safishamsi/graphify
🚀 Новый тул для анализа репо
Тестировал недавно один прикольный инструмент – выглядит супер, но у меня проекты небольшие, так что пользы пока мало. По отзывам в сети, он реально расцветает на больших, запутанных проектах – чем масштабнее, тем лучше.
Что он делает? Строит граф зависимости из разных источников в репозитории: код, файлы, документацию, даже видео. 📊
Если у вас монстр‑проект – стоит попробовать, иначе будет как «плюшки без сахара». 😅
🚀 Новый тул для анализа репо
Тестировал недавно один прикольный инструмент – выглядит супер, но у меня проекты небольшие, так что пользы пока мало. По отзывам в сети, он реально расцветает на больших, запутанных проектах – чем масштабнее, тем лучше.
Что он делает? Строит граф зависимости из разных источников в репозитории: код, файлы, документацию, даже видео. 📊
Если у вас монстр‑проект – стоит попробовать, иначе будет как «плюшки без сахара». 😅
GitHub
GitHub - Graphify-Labs/graphify: Turn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable knowledge graph.…
Turn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable knowledge graph. A /graphify skill for Claude Code, Cursor, Codex, and Gemini CLI: local deterministic AST parsing...
👍1
https://github.com/getagentseal/codeburn
🛠️ Новый тул для анализа кодовых агентов
🚀 Дашборд: быстрый обзор, что, когда и где использовалось. Выводим инсайты → какие команды в проектах можно оптимизировать.
🔧 Инструмент оптимизации: на основе анализа предлагает правки – отключить лишние MCP, скиллы, добавить описания в MD‑код для корректной работы кода‑агентов.
💡 Пример: отключаем ненужные MCP, выключаем скиллы, дополняем slash‑команды или нужным описанием в Claude.MD, чтобы Claude code (или любой другой агент) исполнялся без сбоев.
🛠️ Новый тул для анализа кодовых агентов
🚀 Дашборд: быстрый обзор, что, когда и где использовалось. Выводим инсайты → какие команды в проектах можно оптимизировать.
🔧 Инструмент оптимизации: на основе анализа предлагает правки – отключить лишние MCP, скиллы, добавить описания в MD‑код для корректной работы кода‑агентов.
💡 Пример: отключаем ненужные MCP, выключаем скиллы, дополняем slash‑команды или нужным описанием в Claude.MD, чтобы Claude code (или любой другой агент) исполнялся без сбоев.
GitHub
GitHub - getagentseal/codeburn: Free, local tool to track AI coding token usage and cost across 37 tools and agents (Claude Code…
Free, local tool to track AI coding token usage and cost across 37 tools and agents (Claude Code, Cursor, Codex, Gemini and more), by model, project, and task. npx codeburn - getagentseal/codeburn
https://github.com/alifanov/runyaml
Начал писать новый тул под концепцию темного кода ( dark code ) и темного ПО ( dark software ). Собственно основные моменты концепции - в следующем это код который не писал человек и который не ревьюил человек
Соответственно, тут момент такой, что нужно последовательно вызывать определенных агентов с определенными настройками и с определенными промтами, в идеале, чтобы они еще были разные. Чтобы план писал, например, Claude opus, а имплементировал Claude sonnet, а верифицировал, что все правильно написано Codex.
Многих еще моментов нет. Как на примере в Archon или Bernstein. Но я специально начинал с нуля, чтобы разобраться в этой концепции и фактически ее воспроизвести только самый минимум, потому что те инструменты, которые я упомянул, мне показались слишком избыточными для меня.
Что касается концепции dark software, то это по сути то же самое, но к нему добавлены самопроверки по логам, мониторингу и т.д.
Кроме того, введён элемент самоулучшения на основе полученных метрик.e
Начал писать новый тул под концепцию темного кода ( dark code ) и темного ПО ( dark software ). Собственно основные моменты концепции - в следующем это код который не писал человек и который не ревьюил человек
Соответственно, тут момент такой, что нужно последовательно вызывать определенных агентов с определенными настройками и с определенными промтами, в идеале, чтобы они еще были разные. Чтобы план писал, например, Claude opus, а имплементировал Claude sonnet, а верифицировал, что все правильно написано Codex.
Многих еще моментов нет. Как на примере в Archon или Bernstein. Но я специально начинал с нуля, чтобы разобраться в этой концепции и фактически ее воспроизвести только самый минимум, потому что те инструменты, которые я упомянул, мне показались слишком избыточными для меня.
Что касается концепции dark software, то это по сути то же самое, но к нему добавлены самопроверки по логам, мониторингу и т.д.
Кроме того, введён элемент самоулучшения на основе полученных метрик.e
GitHub
GitHub - alifanov/runyaml: Run YAML-defined DAG workflows from the CLI with a debug dashboard. Glue layer over coding-agent CLIs…
Run YAML-defined DAG workflows from the CLI with a debug dashboard. Glue layer over coding-agent CLIs (codex, opencode, claude). - alifanov/runyaml
❤🔥4
https://spokenly.app/
Последнее время я часто пользуюсь этим приложением. Два полезных момента оказались особенно удобными.
Первое — локальная работа моделей с моделью Parakeet от Nvidia. Я получаю практически мгновенную транскрипцию и сразу её вставку.
Второй момент — дополнительные функции, такие как запрос к ChatGPT или к Claude. В итоге я произношу текст, он сразу транскрибируется, и открывается ChatGPT и Claude. Да, в принципе, это небольшое улучшение, но поскольку я часто переключаюсь и задаю вопросы, оно закрывает часть рутины.
Последнее время я часто пользуюсь этим приложением. Два полезных момента оказались особенно удобными.
Первое — локальная работа моделей с моделью Parakeet от Nvidia. Я получаю практически мгновенную транскрипцию и сразу её вставку.
Второй момент — дополнительные функции, такие как запрос к ChatGPT или к Claude. В итоге я произношу текст, он сразу транскрибируется, и открывается ChatGPT и Claude. Да, в принципе, это небольшое улучшение, но поскольку я часто переключаюсь и задаю вопросы, оно закрывает часть рутины.
Spokenly
Spokenly: Free AI Dictation for Mac, iPhone, Windows & Linux
Free dictation app for Mac, iPhone, Windows, and Linux. Speak in any app and get accurate text from local Whisper or modern cloud models. 100+ languages, offline.
👍1
https://www.nanocorp.so/
У ребят UX пока выглядит довольно странно, но как концепция он вполне приемлем.
Многие аспекты, связанные с запуском рекламы, созданием продукта, задачами и электронными письмами, очень похожи на то, как это реализовано у меня или у Piperclip.
У ребят UX пока выглядит довольно странно, но как концепция он вполне приемлем.
Многие аспекты, связанные с запуском рекламы, созданием продукта, задачами и электронными письмами, очень похожи на то, как это реализовано у меня или у Piperclip.
NanoCorp
NanoCorp — Autonomous AI Businesses
Build and launch autonomous AI businesses that work while you sleep. AI agents hire staff, run tasks, and report back. Start free.