This media is not supported in your browser
VIEW IN TELEGRAM
Вы наверное тоже давно заметили тренд "проще накодить, чем заплатить за софт".
Этот пятничный пост как раз про эту штуку (хех, реально штуку, а не только софт) - физический блокировщик отвлечений на телефоне, может слышали про такое, потому что тема не такая нишевая: у Opal 4M+ юзеров, Brick зафичерился в изданиях типа NYT, WSJ и The New Yorker. Принцип у всех одинаковый: тапаешь телефон о NFC-метку - соцсети заблокировались, тапаешь еще раз - разблокировалось. Физический барьер вместо силы воли, механика, кстати, с научным подтверждением.
Стоит это, правда, не три копейки. Brick $59 за пластиковый магнит. Opal вообще $100/год по подписке. Unpluq и Blok берут и за железку, и за подписку.
А потом один парень Али, раз такой, и сделал то же самое в опен-сорсе. Под капотом - ровно тот же Apple Family Controls API, на котором сидят все коммерческие, а железки - NFC-наклейки стоят копейки на любом маркетплейсе. А можно вообще без железки: распечатал QR-код, приклеил на холодильник - работает так же. Я затестил, физический барьер работает :)
Что умеет:
- 7 режимов: NFC, QR, таймер и гибриды
- Профили под контексты - работа, сон, учеба
- Блокирует и приложения, и сайты
- Live Activities + Dynamic Island, виджеты, Shortcuts
- Статистика, streaks, smart breaks
- Для Android от того же сообщества есть проект Switchly
В общем, может кому-то будет полезно.
А теперь, собственно, к вам вопрос: какой у вас был кейс "проще накодить, чем заплатить"? Сервисы, утилиты, приложения. Пишите в комменты, интересно)
🔥 ➕ 🔁 @nobilix
Этот пятничный пост как раз про эту штуку (хех, реально штуку, а не только софт) - физический блокировщик отвлечений на телефоне, может слышали про такое, потому что тема не такая нишевая: у Opal 4M+ юзеров, Brick зафичерился в изданиях типа NYT, WSJ и The New Yorker. Принцип у всех одинаковый: тапаешь телефон о NFC-метку - соцсети заблокировались, тапаешь еще раз - разблокировалось. Физический барьер вместо силы воли, механика, кстати, с научным подтверждением.
Стоит это, правда, не три копейки. Brick $59 за пластиковый магнит. Opal вообще $100/год по подписке. Unpluq и Blok берут и за железку, и за подписку.
А потом один парень Али, раз такой, и сделал то же самое в опен-сорсе. Под капотом - ровно тот же Apple Family Controls API, на котором сидят все коммерческие, а железки - NFC-наклейки стоят копейки на любом маркетплейсе. А можно вообще без железки: распечатал QR-код, приклеил на холодильник - работает так же. Я затестил, физический барьер работает :)
Что умеет:
- 7 режимов: NFC, QR, таймер и гибриды
- Профили под контексты - работа, сон, учеба
- Блокирует и приложения, и сайты
- Live Activities + Dynamic Island, виджеты, Shortcuts
- Статистика, streaks, smart breaks
- Для Android от того же сообщества есть проект Switchly
В общем, может кому-то будет полезно.
А теперь, собственно, к вам вопрос: какой у вас был кейс "проще накодить, чем заплатить"? Сервисы, утилиты, приложения. Пишите в комменты, интересно)
🔥 ➕ 🔁 @nobilix
1🔥47👍16❤8❤🔥3🥰1
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Bun переписали с Zig на Rust агентами Claude Code за 10 дней - PR на миллион строк кода. Резонансное событие с инфополе разрабов.
- Codex теперь работает через моб. приложение ChatGPT - бесшовный remote-доступ к Codex.
- Anthropic запустила Claude for Legal (акции юридических провайдеров просели на 10-20%) и представила Claude for Small Business - 15 готовых агентов для финансов, продаж, маркетинга, HR.
- Claude Code получил Agent View - список всех сессий с состояниями + поддежка фоновых задач и
- ChatGPT теперь умеет подключаться к банковскому аккаунту для финансового анализа. Пока только для Pro в США.
- OpenAI запустил Deployment Company - подразделение под корпоративные внедрения, с инвестицией $4 млрд. Параллельно купили AI-консалтинг Tomoro.
- Google продемонстрировал новую Gemini Omni - мощная видеомодель с ремиксом и редактированием.
- Anthropic ввела Agent SDK Credits - c 15 июня для Agent SDK,
- DeepMind переосмыслил курсор: AI-pointer как выделитель контекста для агента. Уже доступно в Gemini in Chrome и Google AI Studio.
- Cerebras вышел на IPO - привлекли $5,55 млрд. Крупнейшее IPO года.
- Baidu выпустил Ernie 5.1, Qwen обновили Image-2.0 и выкатил CyberSecQwen-4B - локальная модель для кибербеза, и Recraft выкатил V4.1 с качеством уровня GPT Image 2 + векторную модель.
- PriorLabs показали TabPFN-3 - предобученная эффективная модель для табличных данных до 1M строк. Веса открыты.
- Perceptron выпустил Mk1 - модель для ризонинга видео до 2 fps, отслеживает объекты между кадрами. На 80-90% дешевле флагманов.
- Poetiq представил Meta-System - API-надстройка для улучшения кодогенерации без файнтюна (буст до 30%).
- Вокруг Mythos: с его помощью взломали macOS на M5, мейнтейнер curl нашел 5 подтвержденных уязвимостей, XBOW отчитался о 91,5% на основном бенчмарке. Параллельно Microsoft показал MDASH из 100+ агентов, который на CyberGym обогнал Mythos.
- arXiv начнет банить авторов на год за невычитанные тексты от LLM.
- Supply-chain атака на TanStack. Среди пострадавших OpenSearch, Mistral AI, Guardrails AI.
- Notion запустил Developer Platform - markdown API, sync + CLI ntn.
- xAI выкатили Grok Build - coding agent в терминале, beta для SuperGrok Heavy.
- Microsoft запустил сертификацию по вайбкодингу GH-600 Agentic AI Developer. $165.
- Google выкатил на Android Contextual Suggestions - AI локально анализирует переписки, звонки, активность, геолокацию и формирует предсказания + обновили Gemini Intelligence для Android.
- Figure показала двух F.03 на Helix-02, убирающих комнату за 2 минуты, а Unitree представила GD01 - первый серийный гражданский меха-робот с кабиной для пилота.
- Конгресс начал расследование против Альтмана, а OpenAI готовит иск против Apple за недостаточное продвижение интеграции ChatGPT.
- OpenAI закроет файнтюн своих моделей к 6 января 2027.
- OpenAI предложила создать мировой орган по надзору за AI по аналогии с МАГАТЭ.
- AI увольнения продолжаются: Cisco сокращает 4000 человек, LinkedIn увольняет около 5% и тд.
- Threads получил AI-бота
- YouTube открыл Likeness Detection - можно настроить мониторинг изображений с собственным лицом.
- Business Insider пишет, что разработчики таскают приоткрытые ноуты и покупают USB-заглушки, чтобы не прерывать агентов.
- Британско-китайская Meow-Omni-1 - "ИИ-переводчик" поведения кошек: видео, звук, данные с умного ошейника.
- HTML вместо Markdown для людей - Thariq из Claude Code за пару месяцев почти отказался от .md, выложил подборку HTML-примеров с промптами.
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Bun переписали с Zig на Rust агентами Claude Code за 10 дней - PR на миллион строк кода. Резонансное событие с инфополе разрабов.
- Codex теперь работает через моб. приложение ChatGPT - бесшовный remote-доступ к Codex.
- Anthropic запустила Claude for Legal (акции юридических провайдеров просели на 10-20%) и представила Claude for Small Business - 15 готовых агентов для финансов, продаж, маркетинга, HR.
- Claude Code получил Agent View - список всех сессий с состояниями + поддежка фоновых задач и
/goal (раньше был плагином).- ChatGPT теперь умеет подключаться к банковскому аккаунту для финансового анализа. Пока только для Pro в США.
- OpenAI запустил Deployment Company - подразделение под корпоративные внедрения, с инвестицией $4 млрд. Параллельно купили AI-консалтинг Tomoro.
- Google продемонстрировал новую Gemini Omni - мощная видеомодель с ремиксом и редактированием.
- Anthropic ввела Agent SDK Credits - c 15 июня для Agent SDK,
claude -p будет отдельный ежемесячный лимит $20-$200 по тарифам API. По сути легальное использование сторонних харнесов типа OpenClaw. И увеличила недельные лимиты на 50% на 2 мес. + Fast mode для Claude Opus 4.7 - DeepMind переосмыслил курсор: AI-pointer как выделитель контекста для агента. Уже доступно в Gemini in Chrome и Google AI Studio.
- Cerebras вышел на IPO - привлекли $5,55 млрд. Крупнейшее IPO года.
- Baidu выпустил Ernie 5.1, Qwen обновили Image-2.0 и выкатил CyberSecQwen-4B - локальная модель для кибербеза, и Recraft выкатил V4.1 с качеством уровня GPT Image 2 + векторную модель.
- PriorLabs показали TabPFN-3 - предобученная эффективная модель для табличных данных до 1M строк. Веса открыты.
- Perceptron выпустил Mk1 - модель для ризонинга видео до 2 fps, отслеживает объекты между кадрами. На 80-90% дешевле флагманов.
- Poetiq представил Meta-System - API-надстройка для улучшения кодогенерации без файнтюна (буст до 30%).
- Вокруг Mythos: с его помощью взломали macOS на M5, мейнтейнер curl нашел 5 подтвержденных уязвимостей, XBOW отчитался о 91,5% на основном бенчмарке. Параллельно Microsoft показал MDASH из 100+ агентов, который на CyberGym обогнал Mythos.
- arXiv начнет банить авторов на год за невычитанные тексты от LLM.
- Supply-chain атака на TanStack. Среди пострадавших OpenSearch, Mistral AI, Guardrails AI.
- Notion запустил Developer Platform - markdown API, sync + CLI ntn.
- xAI выкатили Grok Build - coding agent в терминале, beta для SuperGrok Heavy.
- Microsoft запустил сертификацию по вайбкодингу GH-600 Agentic AI Developer. $165.
- Google выкатил на Android Contextual Suggestions - AI локально анализирует переписки, звонки, активность, геолокацию и формирует предсказания + обновили Gemini Intelligence для Android.
- Figure показала двух F.03 на Helix-02, убирающих комнату за 2 минуты, а Unitree представила GD01 - первый серийный гражданский меха-робот с кабиной для пилота.
- Конгресс начал расследование против Альтмана, а OpenAI готовит иск против Apple за недостаточное продвижение интеграции ChatGPT.
- OpenAI закроет файнтюн своих моделей к 6 января 2027.
- OpenAI предложила создать мировой орган по надзору за AI по аналогии с МАГАТЭ.
- AI увольнения продолжаются: Cisco сокращает 4000 человек, LinkedIn увольняет около 5% и тд.
- Threads получил AI-бота
@meta.ai на базе Muse Spark.- YouTube открыл Likeness Detection - можно настроить мониторинг изображений с собственным лицом.
- Business Insider пишет, что разработчики таскают приоткрытые ноуты и покупают USB-заглушки, чтобы не прерывать агентов.
- Британско-китайская Meow-Omni-1 - "ИИ-переводчик" поведения кошек: видео, звук, данные с умного ошейника.
- HTML вместо Markdown для людей - Thariq из Claude Code за пару месяцев почти отказался от .md, выложил подборку HTML-примеров с промптами.
3❤43🔥20👍9🎉2❤🔥1
Про философию минимализма в коде и его роль в эпоху AI-кодинга.
Писать меньше кода всегда считалось навыком мастерства. В эпоху AI-агентов это превратилось в недооцененную добродетель - щит, который теперь приходится держать упорнее обычного. Хаос распространяется сам. Порядок - нет, его надо отстаивать. А теперь рядом еще и агент, который пулеметит код тысячами строк, и эта работа стала тяжелее, чем когда-либо.
Почему?
- Написание кода стало дешевым, а ревью - дорогим. CodeRabbit на большой стате показали что, например, проблем с читаемостью в AI-контрибьюшинах больше в 3 с лишним раза.
- Меньше кода - меньше проблем. Меньше саппортить, меньше читать. Так было всегда. Просто раньше было ограничение в виде человеческой лени, а AI-агент нагенерит столько сколько человеку и не снилось. Экономия токенов, в конце концов.
- AI любит велосипеды. Помните то исследование про выбор стека агентами? Одна из ключевых находок - агенты в трети случаев пишут свою реализацию там, где есть протестированная годами либа.
Что делать?
И тут хочется ответить "ну просто впишите в промпт keep it simple", но этого мало.
Простоту в коде делает не правило в файлике, а вы сами. Этот волосяной клубок который пулеметит агент по дефолту... вам не должно быть все равно.
Несколько конкретных вещей в инструменты положить все-таки полезно:
- правила типа
- команда
- Ресерч готовых библиотек - часть кодинга, а не побочная активность: часто спрашивайте а есть ли готовая либа для этого? Экономит тонны строк кода на практие - советую.
- Минимализм стоит применять не только к коду, но и к контекстным файлам. Хороший вопрос для аудита CLAUDE/AGENT md: "Какую конкретно ошибку/проблему предотвращает это правило? Найди/вспомни ее в последних сессиях. Не нашел - удали правило".
- В самом контексте - тоже минимализм. Грязный контекст = шумные ответы. Чаще используйте субагентов, часто тегайте нужные файлы и доки если знаете о чем речь заранее, чаще очищать/компактить, тут в целом база. И короткая спека, которую читают всегда будет лучше подробного полотна, которое даже никто не увидит.
- Минимализм в фичах. Если вам "ничего не стоит" это добавить, это еще не значит что оно кому-то нужно.
Можно считать сэкономленные токены, приятный бонус конечно, но главное: минимализм в коде - это компас, который дает читаемость, контроль над тем, что происходит, и легкость ориентации в проекте. И для себя, и для других, и для агентов.
🔥 ➕ 🔁 @nobilix
Писать меньше кода всегда считалось навыком мастерства. В эпоху AI-агентов это превратилось в недооцененную добродетель - щит, который теперь приходится держать упорнее обычного. Хаос распространяется сам. Порядок - нет, его надо отстаивать. А теперь рядом еще и агент, который пулеметит код тысячами строк, и эта работа стала тяжелее, чем когда-либо.
Почему?
- Написание кода стало дешевым, а ревью - дорогим. CodeRabbit на большой стате показали что, например, проблем с читаемостью в AI-контрибьюшинах больше в 3 с лишним раза.
- Меньше кода - меньше проблем. Меньше саппортить, меньше читать. Так было всегда. Просто раньше было ограничение в виде человеческой лени, а AI-агент нагенерит столько сколько человеку и не снилось. Экономия токенов, в конце концов.
- AI любит велосипеды. Помните то исследование про выбор стека агентами? Одна из ключевых находок - агенты в трети случаев пишут свою реализацию там, где есть протестированная годами либа.
Что делать?
И тут хочется ответить "ну просто впишите в промпт keep it simple", но этого мало.
Простоту в коде делает не правило в файлике, а вы сами. Этот волосяной клубок который пулеметит агент по дефолту... вам не должно быть все равно.
Несколько конкретных вещей в инструменты положить все-таки полезно:
- правила типа
produce the minimum diff, the less LoC, the better помогают, неплохой пример тут: andrej-karpathy-skills (138К звезд, секция "Simplicity First" в самом начале).- команда
/simplify в Claude Code (или аналог, сама команда не сложная) - все еще отлично работает. Куда проще упорядочить и упростить то что уже написано и работает (но пока не закомичено), чем сразу написать как надо.- Ресерч готовых библиотек - часть кодинга, а не побочная активность: часто спрашивайте а есть ли готовая либа для этого? Экономит тонны строк кода на практие - советую.
- Минимализм стоит применять не только к коду, но и к контекстным файлам. Хороший вопрос для аудита CLAUDE/AGENT md: "Какую конкретно ошибку/проблему предотвращает это правило? Найди/вспомни ее в последних сессиях. Не нашел - удали правило".
- В самом контексте - тоже минимализм. Грязный контекст = шумные ответы. Чаще используйте субагентов, часто тегайте нужные файлы и доки если знаете о чем речь заранее, чаще очищать/компактить, тут в целом база. И короткая спека, которую читают всегда будет лучше подробного полотна, которое даже никто не увидит.
- Минимализм в фичах. Если вам "ничего не стоит" это добавить, это еще не значит что оно кому-то нужно.
Можно считать сэкономленные токены, приятный бонус конечно, но главное: минимализм в коде - это компас, который дает читаемость, контроль над тем, что происходит, и легкость ориентации в проекте. И для себя, и для других, и для агентов.
🔥 ➕ 🔁 @nobilix
2🔥59❤24👍18❤🔥4
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Прошел Google I/O 2026 выкатили Gemini 3.5 Flash (агентные workflows, кодинг, long-horizon) и анонсировали Gemini Omni (генерация и редактирование видео).
- По продуктам с гугл конфы: Gemini Spark - ответ на OpenClaw, Antigravity 2.0 - очень похож на Codex, Agent Executor - open-source рантайм агентов на кубере, и AI Studio - вайбкодинг Android аппов на Kotlin.
- Андрей Карпаты перешел в Anthropic - возвращается к R&D.
- Дуэль AI-экономик: OpenAI обогнал Anthropic в первом кв., но маржа -122%. Anthropic при этом прогнозирует первый прибыльный квартал и удвоение выручки в Q2.
- AI как стратегия увольнений: Meta -8000, Intuit -3000, Cloudflare -20%, но теперь нанимает.
- Cursor выпустила Composer 2.5 - первая модель, тренированная в датацентрах SpaceXAI, бенчмарки на уровне фронтира.
- Вышла Qwen3.7-Max - проприетарная агентная модель: топ по многим бенчам.
- Cohere представила Command A+ - первая MoE модель компании, Apache 2.0, неплохие показатели.
- ByteDance выпустили Lance - 3B модель (image/video understanding + generation + editing в одном).
- Stability AI выпустила Stable Audio 3.0.
- DeepSeek сделал постоянным 75% дисконт на V4-Pro и 90% скидку на cache hits по всей API-линейке. По метрикам в 4-7 раз дешевле фронтиров.
- Anthropic купила Stainless (SDK-стартап, которым пользуются OpenAI, Google и Cloudflare), а OpenAI купила команду voice-cloning стартапа Weights.gg.
- Широко обсуждают как OpenAI-модель самостоятельно опровергла гипотезу из дискретной геометрии (открытую с 1946). Доказательство проверили математики.
- Claude Managed Agents получили self-hosted песочницы и MCP-туннели.
- Маск проиграл иск против OpenAI и Альтмана.
- Codex обновили: Appshots (скриншот с расшифровкой активного окна), работу на залоченном Mac и Browser annotations (отметить в браузере что поменять) и др.
- Figma встроили дизайн-агент в canvas - генерирует варианты параллельно, массовые правки.
- Cloudflare опубликовал обзор на Project Glasswing - разбор Mythos на 50+ репозиториях.
- OpenAI добавили публичный тул image verifier для проверки AI изображений.
- Безос раскрыл Project Prometheus - $38B стартап - следующее поколение CAD для физических объектов.
- Команда OpenClaw тратит $1.3M в месяц на токены! - 3-6 разработчиков, параллельно крутятся сотни агентов.
- Airtable открыли Hyperagent Founding 500 - $10M в inference credits для первых 500 фаундеров. Заявки до 31 мая.
- Lovable завезли Skills
Полезное:
- Is AI Profitable Yet? - трекер юнит-экономики AI-компаний.
- Granola завезли Briefs (инфа в начале звонка, оч удобно)
- Гайды от Anthropic: Claude Code в больших кодобазах и Computer/browser use с Claude.
- DystopiaBench - бенч на готовность LLM строить апокалипсис: 36 сценариев в 6 типах дистопии.
- Zerostack (Rust coding-агент, 8MB памяти) и SmallCode (для маленьких локальных моделей, 87/100 с Gemma 4B).
- Watchmen скиллы из истории сессий кодинга
- Browse.sh - каталог скиллов автоматизации конкретных сайтов
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Прошел Google I/O 2026 выкатили Gemini 3.5 Flash (агентные workflows, кодинг, long-horizon) и анонсировали Gemini Omni (генерация и редактирование видео).
- По продуктам с гугл конфы: Gemini Spark - ответ на OpenClaw, Antigravity 2.0 - очень похож на Codex, Agent Executor - open-source рантайм агентов на кубере, и AI Studio - вайбкодинг Android аппов на Kotlin.
- Андрей Карпаты перешел в Anthropic - возвращается к R&D.
- Дуэль AI-экономик: OpenAI обогнал Anthropic в первом кв., но маржа -122%. Anthropic при этом прогнозирует первый прибыльный квартал и удвоение выручки в Q2.
- AI как стратегия увольнений: Meta -8000, Intuit -3000, Cloudflare -20%, но теперь нанимает.
- Cursor выпустила Composer 2.5 - первая модель, тренированная в датацентрах SpaceXAI, бенчмарки на уровне фронтира.
- Вышла Qwen3.7-Max - проприетарная агентная модель: топ по многим бенчам.
- Cohere представила Command A+ - первая MoE модель компании, Apache 2.0, неплохие показатели.
- ByteDance выпустили Lance - 3B модель (image/video understanding + generation + editing в одном).
- Stability AI выпустила Stable Audio 3.0.
- DeepSeek сделал постоянным 75% дисконт на V4-Pro и 90% скидку на cache hits по всей API-линейке. По метрикам в 4-7 раз дешевле фронтиров.
- Anthropic купила Stainless (SDK-стартап, которым пользуются OpenAI, Google и Cloudflare), а OpenAI купила команду voice-cloning стартапа Weights.gg.
- Широко обсуждают как OpenAI-модель самостоятельно опровергла гипотезу из дискретной геометрии (открытую с 1946). Доказательство проверили математики.
- Claude Managed Agents получили self-hosted песочницы и MCP-туннели.
- Маск проиграл иск против OpenAI и Альтмана.
- Codex обновили: Appshots (скриншот с расшифровкой активного окна), работу на залоченном Mac и Browser annotations (отметить в браузере что поменять) и др.
- Figma встроили дизайн-агент в canvas - генерирует варианты параллельно, массовые правки.
- Cloudflare опубликовал обзор на Project Glasswing - разбор Mythos на 50+ репозиториях.
- OpenAI добавили публичный тул image verifier для проверки AI изображений.
- Безос раскрыл Project Prometheus - $38B стартап - следующее поколение CAD для физических объектов.
- Команда OpenClaw тратит $1.3M в месяц на токены! - 3-6 разработчиков, параллельно крутятся сотни агентов.
- Airtable открыли Hyperagent Founding 500 - $10M в inference credits для первых 500 фаундеров. Заявки до 31 мая.
- Lovable завезли Skills
Полезное:
- Is AI Profitable Yet? - трекер юнит-экономики AI-компаний.
- Granola завезли Briefs (инфа в начале звонка, оч удобно)
- Гайды от Anthropic: Claude Code в больших кодобазах и Computer/browser use с Claude.
- DystopiaBench - бенч на готовность LLM строить апокалипсис: 36 сценариев в 6 типах дистопии.
- Zerostack (Rust coding-агент, 8MB памяти) и SmallCode (для маленьких локальных моделей, 87/100 с Gemma 4B).
- Watchmen скиллы из истории сессий кодинга
- Browse.sh - каталог скиллов автоматизации конкретных сайтов
3🔥38❤20👍10🎉3
Год назад вопрос "на чем автоматизировать фоновый корпоративный процесс (бот для заявок, сортировка доков, сбор отчетности)" решался выбором workflow конструктора или фреймворка. Сейчас все чаще ответ - агентный harness, тот же, на котором программируют. Часто это читают как смену поколений: agent-first приходит на место workflow-first. Стоит разобраться, замена ли это - или два разных способа автоматизировать, которые выигрывают и ломаются в разных местах.
Под workflow-first давайте понимать граф, запрограммированный заранее: даже если внутри сидят LLM-ноды, форма автоматизации задана до запуска (n8n, Airflow, Dify). Agent-first же строится на базе harness и намного гибче: вы инструктируете текстом и даете тулы, а конкретный путь выполнения агент выбирает сам.
В общем, с одной стороны агентные харнесы для автоматизации растут в популярности, c другой стороны все как будто игнорируют темную сторону такой автоматизации. Посмотрите на реддит пост "Stop building AI agents", один из топ-комментариев: "The Loom video shows the happy path, but nobody shows the 3am Slack message when the agent starts approving the wrong invoices.".
Короче, агенты проще в запуске/апдейте, но они сильно дороже и менее надежны, а workflow не гибкие - их тяжело строить и развивать.
А почему бы не объединить эти два мира? Третий способ: пусть агент пишет workflow.
Это та же кодогенерация - кодинг-агент собирает конфиг автоматизации в файлах, рядом скиллы и инструкции как такие пайплайны строить и проверять. У него есть весь инструментарий, чтобы прогнать workflow end-to-end. У меня лучше всего получается с Mastra Workflows - типизированный код, тесты, агент видит как через файлы, так и через mastra-traces + есть визуализация для эксперта (но никакого визуального программирования, только для понимания шагов).
Идея простая: берем workflow-first (детерминированность, предсказуемость, трейсинг) и снимаем его главный минус - сложность апдейтов и негибкость - тем, что редактором и ревьюером этого workflow становится кодинг-агент. Агент здесь не "крутится в проде", а используется динамически: изучил, написал, проверил, проапдейтил. Но только после ревью.
Все это, в основном, про фоновую корпоративную автоматизацию - повторяющиеся процессы, которые можно формализовать, обычно с комплаенсом сверху. Там, где граф заранее не нарисовать - кодинг, ревью, debugging, computer use - лучше работают полноценные агенты + human in the loop. Это другой класс задач.
У меня все чаще складывается такой баланс: с кодинг-агентом собираю первую версию, агент "протаптывает дорожку" в интерактиве. Потом это оформляется как workflow, кодом - и деплоится как более детерминированная автоматизация с AI шагами. На масштабе получается не только надежнее, но и на порядок дешевле по стоимости токенов.
🔥 ➕ 🔁 @nobilix
Под workflow-first давайте понимать граф, запрограммированный заранее: даже если внутри сидят LLM-ноды, форма автоматизации задана до запуска (n8n, Airflow, Dify). Agent-first же строится на базе harness и намного гибче: вы инструктируете текстом и даете тулы, а конкретный путь выполнения агент выбирает сам.
Workflow-First | Agent-First
----------------|----------------
[in] | [in]
↓ | ↓
(llm) | (agent)─►─[T]
┌─┴─┐ | ↑ │
[T] [T] | │ ↓
└─┬─┘ | [T]──◄────┘
✓ | ✓?
↓ | ↓
out | out
----------------|----------------
Шаг за шагом | Цикл решений
Жесткая схема | Автономия
Цена ясна | Бюджет рандомный
Сложно менять | Оч просто менять
Быстрый | Медленный
Не креативный | М.б. креативным
В общем, с одной стороны агентные харнесы для автоматизации растут в популярности, c другой стороны все как будто игнорируют темную сторону такой автоматизации. Посмотрите на реддит пост "Stop building AI agents", один из топ-комментариев: "The Loom video shows the happy path, but nobody shows the 3am Slack message when the agent starts approving the wrong invoices.".
Короче, агенты проще в запуске/апдейте, но они сильно дороже и менее надежны, а workflow не гибкие - их тяжело строить и развивать.
А почему бы не объединить эти два мира? Третий способ: пусть агент пишет workflow.
Это та же кодогенерация - кодинг-агент собирает конфиг автоматизации в файлах, рядом скиллы и инструкции как такие пайплайны строить и проверять. У него есть весь инструментарий, чтобы прогнать workflow end-to-end. У меня лучше всего получается с Mastra Workflows - типизированный код, тесты, агент видит как через файлы, так и через mastra-traces + есть визуализация для эксперта (но никакого визуального программирования, только для понимания шагов).
developer agent expert
│ │ │
└───────┼────────┘
▼
┌────────────────┐
│ workflow files │
└───────┬────────┘
▼
[ git + deploy ]
Идея простая: берем workflow-first (детерминированность, предсказуемость, трейсинг) и снимаем его главный минус - сложность апдейтов и негибкость - тем, что редактором и ревьюером этого workflow становится кодинг-агент. Агент здесь не "крутится в проде", а используется динамически: изучил, написал, проверил, проапдейтил. Но только после ревью.
Все это, в основном, про фоновую корпоративную автоматизацию - повторяющиеся процессы, которые можно формализовать, обычно с комплаенсом сверху. Там, где граф заранее не нарисовать - кодинг, ревью, debugging, computer use - лучше работают полноценные агенты + human in the loop. Это другой класс задач.
У меня все чаще складывается такой баланс: с кодинг-агентом собираю первую версию, агент "протаптывает дорожку" в интерактиве. Потом это оформляется как workflow, кодом - и деплоится как более детерминированная автоматизация с AI шагами. На масштабе получается не только надежнее, но и на порядок дешевле по стоимости токенов.
🔥 ➕ 🔁 @nobilix
3🔥64👍31❤10✍2⚡2
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Anthropic выпустила Claude Opus 4.8 - ставка на автономность, скорость и честность, вчетверо реже пропускает дефекты, Fast mode втрое дешевле.
- Еще Anthropic выкатили dynamic workflows (.claude/workflows/) в Claude Code - сам пишет orchestration-скрипты с субагентами.
- SoftBank заложил свои акции OpenAI, чтобы докупить еще акций OpenAI. Если IPO перенесется возможен дефолт.
- Очередная серия апдейтов Codex - Computer Use для Windows, Chats без привязки к папке проекта, Profiles v2 и тд.
- Anthropic закрыла раунд Series H на $65 млрд при оценке $965 млрд.
- У OpenAI пачка апдейтов: Frontier Governance Framework, Secure MCP Tunnel для приватных MCP-серверов, гайд по macro-оценке агентов и кейс: self-improving налоговые агенты.
- Anthropic в апдейте по Glasswing сообщила, что откроет модели класса Mythos для широкого релиза. В коде Claude уже нашли следы Mythos 1.
- На фоне Mythos резко вырос спрос на кибербез (по оценкам в 5-7 раз). Anthropic выпустила бесплатный security-плагин для Claude Code и расписала, как изолирует Claude в продуктах.
- WSJ пишет, что компании начали урезать траты на AI-токены. COO Uber признал, что расходы не отбиваются, а по данным Microsoft AI местами дороже найма людей.
- Китай распространил ограничения для топовых AI-специалистов - теперь нужно одобрение властей для поездок за рубеж.
- Папа Лев XIV выпустил первую энциклику про AI Magnifica Humanitas: призвал замедлить разработку. А сотрудники тут же начали ссылаться на нее как на повод отказаться от AI по религиозным мотивам.
- Google меняет синие ссылки на AI-агента, реакция негативная - у DuckDuckGo всплеск. А еще Еврокомиссия готовит Google крупнейший штраф.
- YouTube начнет сам помечать AI-видео: если автор не указал нейросети.
- CNN подала в суд на Perplexity за копирование тысяч новостей.
- Meta запустила платные подписки: Instagram и Facebook Plus, WhatsApp Plus, плюс тесты AI-планов с увеличенными лимитами.
- Из моделей: StepFun выложил Step 3.7 Flash - MoE 196B/11B-active, 56.26% на SWE-Bench Pro; NVIDIA показала LocateAnything (находит объекты на картинке по тексту, в 10x быстрее Qwen3-VL, веса открыты); Microsoft AI выпустила генератор картинок MAI-2.5 (хорош с кириллицей, 3 место на Arena AI).
- Callstack показала Apex - модель под React Native (сильно дешевле фронтиров).
- Открытые модели отстают от закрытых на 4-6 месяцев, разрыв растет. Кстати, DeepSeek навсегда срезал цену на V4 Pro на 75%.
- Известный Legal-AI стартап Harvey опубликовал первые результаты своего бенча - при строгом all-pass даже Opus 4.7 берет всего 7.1%, юридическая работа далека от автоматизации.
- Mistral займется собственными чипами.
- Perplexity открыл Bumblebee - сканер безопасности для машин разработчиков
- Microsoft выложила Webwright - эффективный браузерный агент на скриптах вместо кликов, и SkillOpt - фреймворк, фоново улучшающий агента правкой markdown-скиллов.
- Вышел Release Candidate спецификации MCP (stateless core на обычном HTTP, авторизация ближе к OAuth, финал 28 июля)
- Built-in AI в Chrome для разработчиков - офлайн и без утечки приватности.
- WorkOS представил
- Surya OCR 2 - новая OCR-модель на 650M параметров. И апдейт LiteParse v2.0 - локальный OSS-парсер PDF с пространственной разметкой и bounding boxes, советую посмотреть.
- Perplexity завел Computer внутри Excel, Word, PowerPoint и Outlook.
- OpenJarvis 1.0 - on-device персональный ассистент с локальным inference.
- ElevenLabs выпустил Music v2 - генерация музыки со сменой жанров посреди трека.
- Cursor Developer Habits Report - интересный отчет от Cursor.
- 🤩 howtoeval - хороший гайд по eval-ам AI-агентов.
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Anthropic выпустила Claude Opus 4.8 - ставка на автономность, скорость и честность, вчетверо реже пропускает дефекты, Fast mode втрое дешевле.
- Еще Anthropic выкатили dynamic workflows (.claude/workflows/) в Claude Code - сам пишет orchestration-скрипты с субагентами.
- SoftBank заложил свои акции OpenAI, чтобы докупить еще акций OpenAI. Если IPO перенесется возможен дефолт.
- Очередная серия апдейтов Codex - Computer Use для Windows, Chats без привязки к папке проекта, Profiles v2 и тд.
- Anthropic закрыла раунд Series H на $65 млрд при оценке $965 млрд.
- У OpenAI пачка апдейтов: Frontier Governance Framework, Secure MCP Tunnel для приватных MCP-серверов, гайд по macro-оценке агентов и кейс: self-improving налоговые агенты.
- Anthropic в апдейте по Glasswing сообщила, что откроет модели класса Mythos для широкого релиза. В коде Claude уже нашли следы Mythos 1.
- На фоне Mythos резко вырос спрос на кибербез (по оценкам в 5-7 раз). Anthropic выпустила бесплатный security-плагин для Claude Code и расписала, как изолирует Claude в продуктах.
- WSJ пишет, что компании начали урезать траты на AI-токены. COO Uber признал, что расходы не отбиваются, а по данным Microsoft AI местами дороже найма людей.
- Китай распространил ограничения для топовых AI-специалистов - теперь нужно одобрение властей для поездок за рубеж.
- Папа Лев XIV выпустил первую энциклику про AI Magnifica Humanitas: призвал замедлить разработку. А сотрудники тут же начали ссылаться на нее как на повод отказаться от AI по религиозным мотивам.
- Google меняет синие ссылки на AI-агента, реакция негативная - у DuckDuckGo всплеск. А еще Еврокомиссия готовит Google крупнейший штраф.
- YouTube начнет сам помечать AI-видео: если автор не указал нейросети.
- CNN подала в суд на Perplexity за копирование тысяч новостей.
- Meta запустила платные подписки: Instagram и Facebook Plus, WhatsApp Plus, плюс тесты AI-планов с увеличенными лимитами.
- Из моделей: StepFun выложил Step 3.7 Flash - MoE 196B/11B-active, 56.26% на SWE-Bench Pro; NVIDIA показала LocateAnything (находит объекты на картинке по тексту, в 10x быстрее Qwen3-VL, веса открыты); Microsoft AI выпустила генератор картинок MAI-2.5 (хорош с кириллицей, 3 место на Arena AI).
- Callstack показала Apex - модель под React Native (сильно дешевле фронтиров).
- Открытые модели отстают от закрытых на 4-6 месяцев, разрыв растет. Кстати, DeepSeek навсегда срезал цену на V4 Pro на 75%.
- Известный Legal-AI стартап Harvey опубликовал первые результаты своего бенча - при строгом all-pass даже Opus 4.7 берет всего 7.1%, юридическая работа далека от автоматизации.
- Mistral займется собственными чипами.
- Perplexity открыл Bumblebee - сканер безопасности для машин разработчиков
- Microsoft выложила Webwright - эффективный браузерный агент на скриптах вместо кликов, и SkillOpt - фреймворк, фоново улучшающий агента правкой markdown-скиллов.
- Вышел Release Candidate спецификации MCP (stateless core на обычном HTTP, авторизация ближе к OAuth, финал 28 июля)
- Built-in AI в Chrome для разработчиков - офлайн и без утечки приватности.
- WorkOS представил
auth.md - протокол авторизации агентов от имени пользователей- Surya OCR 2 - новая OCR-модель на 650M параметров. И апдейт LiteParse v2.0 - локальный OSS-парсер PDF с пространственной разметкой и bounding boxes, советую посмотреть.
- Perplexity завел Computer внутри Excel, Word, PowerPoint и Outlook.
- OpenJarvis 1.0 - on-device персональный ассистент с локальным inference.
- ElevenLabs выпустил Music v2 - генерация музыки со сменой жанров посреди трека.
- Cursor Developer Habits Report - интересный отчет от Cursor.
- 🤩 howtoeval - хороший гайд по eval-ам AI-агентов.
1🔥44❤18👍16
В недавнем посте я разбирал, как кодинг-агент сам пишет и развивает workflows. Сегодня на связанную тему, но шире: для кого вообще делается платформа автоматизации и как это меняется. Долгое время такие системы строились для разработчика, DX (developer experience) в приоритете. Сейчас вокруг появилось еще два first-class клиента.
Первый - доменный эксперт. Выигрыш от использования AI у экспертов радикально больше, чем у разработчика. Девелопер и так был вооружен (IDE, фреймворки, готовые библиотеки). А эксперт годами сидел в позиции "я знаю, что нужно мне/бизнесу, но построить не могу". Сейчас же эксперт берет когдинг агента и за дни собирает рабочий прототип (а иногда и вполне рабочую штуку). Этот сдвиг уже сложно не замечать. Узкое место сместилось с "можно ли это вообще построить" на "знаем ли мы, что строить" - а знает именно эксперт.
Второй - кодинг-агент сам по себе. Насколько удобно и быстро ему читать и менять твой софт. Это должно быть приоритетом платформы: предоставить агенту удобные интерфейсы и инструкции для работы: API, MCP-сервер, CLI-тулы, документация в формате, который агент сам разбирает. И, кстати, file-first подход здесь дает жирный плюс потому что локальная файловая система - родной идиом агентов. А еще трекать удобно.
Короче, тот самый AX (agent experience) теперь должен быть частью продуктового опыта. Если AX не сделал ты, это сделает конкурент или сообщество накостыляет обходной путь (но кривой опыт запомнится).
В тему этого тезиса, недавно общался с Володей - Head of Product & Delivery в Just AI, мы обсуждали как раз роль доменных экспертов в автоматизации и про AX, чуть раньше он мне дал доступ к их платформе, я установил, протестил и развернул несколько агентов, дал свой фидбэк. В тему как хороший пример платформы, которая удобна и для доменных экспертов, и для AI. Так как стейт агента целиком лежит в файлах в git'е и рядом есть инструкции - передача управления между человеком и агентом двусторонняя. Недавно открыли публичный доступ к этой AI Agent Platform, раньше была только для корп-клиентов, можете сами протестить.
AI начинает приносить пользу в момент тесной синергии с теми, кто его применяет и строит - и это ровно про эксперта, кодинг-агента и девелопера в одном контуре.
P.S. Тот мой пост про workflows через агентную кодогенерацию неожидаанно совпал с релизом Сlaude Сode dinamic workflows, которые я сейчас активно тестирую и собираюсь написать отдельный пост. Есть пересечения, но это иной зверь.
Первый - доменный эксперт. Выигрыш от использования AI у экспертов радикально больше, чем у разработчика. Девелопер и так был вооружен (IDE, фреймворки, готовые библиотеки). А эксперт годами сидел в позиции "я знаю, что нужно мне/бизнесу, но построить не могу". Сейчас же эксперт берет когдинг агента и за дни собирает рабочий прототип (а иногда и вполне рабочую штуку). Этот сдвиг уже сложно не замечать. Узкое место сместилось с "можно ли это вообще построить" на "знаем ли мы, что строить" - а знает именно эксперт.
Второй - кодинг-агент сам по себе. Насколько удобно и быстро ему читать и менять твой софт. Это должно быть приоритетом платформы: предоставить агенту удобные интерфейсы и инструкции для работы: API, MCP-сервер, CLI-тулы, документация в формате, который агент сам разбирает. И, кстати, file-first подход здесь дает жирный плюс потому что локальная файловая система - родной идиом агентов. А еще трекать удобно.
Короче, тот самый AX (agent experience) теперь должен быть частью продуктового опыта. Если AX не сделал ты, это сделает конкурент или сообщество накостыляет обходной путь (но кривой опыт запомнится).
В тему этого тезиса, недавно общался с Володей - Head of Product & Delivery в Just AI, мы обсуждали как раз роль доменных экспертов в автоматизации и про AX, чуть раньше он мне дал доступ к их платформе, я установил, протестил и развернул несколько агентов, дал свой фидбэк. В тему как хороший пример платформы, которая удобна и для доменных экспертов, и для AI. Так как стейт агента целиком лежит в файлах в git'е и рядом есть инструкции - передача управления между человеком и агентом двусторонняя. Недавно открыли публичный доступ к этой AI Agent Platform, раньше была только для корп-клиентов, можете сами протестить.
AI начинает приносить пользу в момент тесной синергии с теми, кто его применяет и строит - и это ровно про эксперта, кодинг-агента и девелопера в одном контуре.
P.S. Тот мой пост про workflows через агентную кодогенерацию неожидаанно совпал с релизом Сlaude Сode dinamic workflows, которые я сейчас активно тестирую и собираюсь написать отдельный пост. Есть пересечения, но это иной зверь.
2🔥25❤9👍9
This media is not supported in your browser
VIEW IN TELEGRAM
Dynamic Workflows в Claude. Pазбераемся что это, как работает и кому полезно.
Dynamic Workflows появились несколько дней назад как инструмент для разработчиков - Anthropic сами рефакторили им огромную кодовую базу Bun. Как способ борьбы с агентной ленью и расшинение возможностей параллельности. Но в своих же постах авторы подсвечивают что за пределами кода применений едва ли не больше - в отличном свежем посте Thariq из Claude Code упоминает много юз кейсов, дает советы и там же есть хорошие иллюстрации типов workflow.
Что это и как работает
Claude на JS пишет на лету себе harness. Под одну конкретную задачу, и тут же гоняет его в фоне, оркестрируя пачку субагентов. Важно: это оркестрация-как-код, а не жесткий конфиг графа (DAG). Единица работы - AI-субагент, а не нода-интеграция. Примитивов мало:
Модель простая: скрипт - чистый дирижер, агенты - руки. Сам скрипт только раздает задачи и склеивает результаты в памяти; все тяжелое (файлы, поиск, код) делают субагенты, у которых есть настоящие инструменты. А еще есть 6 встроенных типов (архитектур): Турнир, Состязательная проверка и тд.
Прогон идет в фоне, и его можно продолжить с места обрыва - результаты агентов локально кэшируются (и это важно).
В СС CLI есть команда
Я глубоко закопался, но формат поста не позволяет детальнее, если интересно посмотрите лучше вот этот независимый техразбор, и системный пропмт разумеется уже вытащили. Ну и конечно open source сообщество не заставило себя ждать: pi-dynamic-workflows и open-dynamic-workflows.
Кому полезно
Как я уже писал, основное применение - в разработке (все что надо делать массово, параллельно, но надежнее), но оно не только в коде. Сам
Еще примеры:
- квалификация лидов и очереди заявок;
- анализ логов на скейле, где одного контекста не хватает;
- разобрать бизнес-план строго по секциям, натравив на него агентов с позиций инвестора, клиента и конкурента;
- скрининг: прогнать сотни резюме турниром вместо одного промпта на все восемьдесят - попарное сравнение надежнее абсолютной оценки.
Логика везде одна: задачу, которая не лезет в одно контекст-окно, режут на куски с чистыми контекстами. Так агент меньше ленится, меньше залипает на собственных выводах и не уплывает от цели.
Антропик сам предупрждает что эта штука прожорливая. Но при этом:
- входит в подписку, а не по API-цене;
- результаты agent() ноды переиспользуются через кеш (экономия);
- можно поставить жесткий потолок прямо промптом ("use 10k tokens at most") и явно указать модель поменьше
Немного экспериментов
Я по лучшим традициям рекурсии запустил первый workflow с промптом пройтись по сессиям
Что в итоге
Читая анонс, я почему-то сделал акцент на слове "workflow" и представил полноценный оркестратор - детерминированные ноды, traceability, интеграции, визуализацию. Оказалось, ключевое слово второе, "dynamic": ставка на агентов и простую оркестрацию через код. Но детерминизма в агентный подход он уже добавляет - за таким миксом, как мне кажется, большое будущее, и это хороший шаг туда.
🔥 ➕ 🔁 @nobilix
Dynamic Workflows появились несколько дней назад как инструмент для разработчиков - Anthropic сами рефакторили им огромную кодовую базу Bun. Как способ борьбы с агентной ленью и расшинение возможностей параллельности. Но в своих же постах авторы подсвечивают что за пределами кода применений едва ли не больше - в отличном свежем посте Thariq из Claude Code упоминает много юз кейсов, дает советы и там же есть хорошие иллюстрации типов workflow.
Что это и как работает
Claude на JS пишет на лету себе harness. Под одну конкретную задачу, и тут же гоняет его в фоне, оркестрируя пачку субагентов. Важно: это оркестрация-как-код, а не жесткий конфиг графа (DAG). Единица работы - AI-субагент, а не нода-интеграция. Примитивов мало:
agent()/parallel()/pipeline() + пара хелперов и очень урезанный plain JS в качестве клея. Это все, и этого достаточно для многих вещей.Модель простая: скрипт - чистый дирижер, агенты - руки. Сам скрипт только раздает задачи и склеивает результаты в памяти; все тяжелое (файлы, поиск, код) делают субагенты, у которых есть настоящие инструменты. А еще есть 6 встроенных типов (архитектур): Турнир, Состязательная проверка и тд.
Прогон идет в фоне, и его можно продолжить с места обрыва - результаты агентов локально кэшируются (и это важно).
В СС CLI есть команда
/workflows - она показывает дерево прогресса в реальном времени и там же можно нажать 's' и сохранить код в .claude/workflows/*.js - именованные workflow можно добавлять в Skills, причем скилы их используют скорее как шаблон, чем как исполняемый код.Я глубоко закопался, но формат поста не позволяет детальнее, если интересно посмотрите лучше вот этот независимый техразбор, и системный пропмт разумеется уже вытащили. Ну и конечно open source сообщество не заставило себя ждать: pi-dynamic-workflows и open-dynamic-workflows.
Кому полезно
Как я уже писал, основное применение - в разработке (все что надо делать массово, параллельно, но надежнее), но оно не только в коде. Сам
/deep-research в Claude Code сделан уже на dynamic workflows: разносит поиск на параллельные ветки, тащит источники, проверяет каждый факт, собирает отчет со ссылками.Еще примеры:
- квалификация лидов и очереди заявок;
- анализ логов на скейле, где одного контекста не хватает;
- разобрать бизнес-план строго по секциям, натравив на него агентов с позиций инвестора, клиента и конкурента;
- скрининг: прогнать сотни резюме турниром вместо одного промпта на все восемьдесят - попарное сравнение надежнее абсолютной оценки.
Логика везде одна: задачу, которая не лезет в одно контекст-окно, режут на куски с чистыми контекстами. Так агент меньше ленится, меньше залипает на собственных выводах и не уплывает от цели.
Антропик сам предупрждает что эта штука прожорливая. Но при этом:
- входит в подписку, а не по API-цене;
- результаты agent() ноды переиспользуются через кеш (экономия);
- можно поставить жесткий потолок прямо промптом ("use 10k tokens at most") и явно указать модель поменьше
Немного экспериментов
Я по лучшим традициям рекурсии запустил первый workflow с промптом пройтись по сессиям
~/.claude/projects и найти хорошие кандидаты на использование workflows. Один результат я уже применил: запустил несколько десятков параллельных гипотез оптимизации на реальном проекте (извлечение сложных данных из PDF). Одна неожиданно вскрыла проблему в эвалах, другая дала небольшой прирост F1 в извлечении данных. Буду тестить дальше.Что в итоге
Читая анонс, я почему-то сделал акцент на слове "workflow" и представил полноценный оркестратор - детерминированные ноды, traceability, интеграции, визуализацию. Оказалось, ключевое слово второе, "dynamic": ставка на агентов и простую оркестрацию через код. Но детерминизма в агентный подход он уже добавляет - за таким миксом, как мне кажется, большое будущее, и это хороший шаг туда.
🔥 ➕ 🔁 @nobilix
4🔥48❤14👍14👏3🙏1
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- MiniMax выпустила M3: 1M, мультимодал, агентный режим с управлением десктопом, в части бенчей держит уровень Opus и GPT-5.5.
- Google представила Gemma 4 12B - крутится локально на 16 ГБ, контекст 256K, Apache 2.0 и выпустила офлайн AI-инструменты для macOS.
- Anthropic подала конфиденциальную заявку на IPO в SEC вслед за OpenAI, выход возможен ранней осенью.
- Microsoft представила 7 своих MAI-моделей.
- Anthropic призвала к агрессивной глобальной паузе в разработке самых мощных AI, при этом отчиталась что Claude пишет 80%+ ее кода и скоро может начать улучшать себя сам.
- OpenAI обновила память ChatGPT (система Dreaming): синтезирует контекст. B раскатала ChatGPT Lockdown Mode против промтп-иньекций.
- OpenAI выкатила плагины в Codex (аналитика, дизайн, финансы и тд). Отдельно выделю плагин Build iOS app. Еще вышла фича Sites - собирает из доков задеплоенные веб-аппы.
- Alphabet привлекла больше $85 млрд на AI-инфраструктуру, первое крупное размещение акций после IPO 2005: спрос на вычисления превышает мощности.
- Nvidia на Computex показала RTX Spark - свой ARM-чип для потребительских ПК (конкурент Apple Silicon) и Vera - их первый CPU в датацентрах для агентов.
- Microsoft на Computex показала ноутбук Surface Laptop Ultra и мини-ПК Surface Dev Box (локально модели до 120B). Плюс выкатила always-on агента Scout и агентный поиск Web IQ.
- SoftBank объявил крупнейший AI-проект вне США: 75 млрд евро в инфраструктуру во Франции.
- DeepSeek привлекает первый внешний раунд $7.4 млрд при оценке $52-59 млрд и отчитались о переносе обучения на китайские Huawei Ascend.
- Трамп подписал указ о кибербезопасности в AI: добровольная проверка моделей через госбенчмарк.
- Альтман, Амодеи и Хассабис призвали Конгресс ввести обязательный скрининг заказов синтетических нуклеиновых кислот.
- В исследовании Stanford преподаватели права в слепом сравнении в 75% случаев предпочли ответы AI ответам коллег.
- По данным Cloudflare, трафик ботов впервые превысил человеческий (57% vs 43%), на годы раньше прогноза из-за автономных агентов.
- Nvidia открыла Nemotron 3 Ultra - сильнейшую американскую открытую модель, с весами и данными и NVIDIA Cosmos 3 для phisical AI.
- Alibaba выпустила Qwen3.7-Plus, мультимодальную агентную модель с GUI и CLI.
- Из картиночных: Ideogram 4, открытая T2I с layout-контролем и хорошей кириллицей, и Reve 2.0 на Large Layout Model, 2 место в Text-to-Image Arena.
- Нишевое: H Company Holo 3.1, локальные computer-use модели (0.8B-35B), и JetBrains Mellum 2, 12B MoE под кодинг.
- GitHub выпустил десктопное agent-native приложение Copilot.
- Anthropic выложила Defending Code harness (автономный поиск и фикс уязвимостей), а Alibaba открыла Open Code Review.
- Anthropic выкатили CLI ant - весь Claude Platform из терминала: агента описываешь YAML, коммитишь в Git и деплоишь через CI.
- Nous Research выпустила Hermes Desktop, нативное приложение: 5 режимов изоляции, субагенты, скиллы, голос (MIT, все платформы).
- Perplexity дала моделям прямой контроль над поиском через SDK, компоненты search-стека как примитивы для agent search.
- LM Studio завезла в мобильный клиент удаленный доступ к десктопным моделям через Tailscale-mesh.
- Privacy-скандалы недели: Meta тайно встроила распознавание лиц в очки Ray-Ban/Oakley + хакеры угнали аккаунты Instagram через AI-бота поддержки Meta.
- Cloudflare купила VoidZero (Vite, Vitest, Rolldown, Oxc), плюс $1 млн в фонд экосистемы Vite.
- Блогер PewDiePie выкатил Odysseus, опенсорсный self-host лаунчер для нейросетей (58k звезд меньше чем за неделю).
- Anthropic на месяц (до 5 июля) удвоила 5-часовые лимиты в Claude Cowork.
- Agent Cookie синхронизирует куки, CLI-токены и API-ключи между девайсами для агентов.
- Freestyle - новая open-source локальная голосовая диктовка.
- 🤩 Hallmark - еще один отличный скилл для дизайна, и кстати Impeccable получил мощный апдейт.
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- MiniMax выпустила M3: 1M, мультимодал, агентный режим с управлением десктопом, в части бенчей держит уровень Opus и GPT-5.5.
- Google представила Gemma 4 12B - крутится локально на 16 ГБ, контекст 256K, Apache 2.0 и выпустила офлайн AI-инструменты для macOS.
- Anthropic подала конфиденциальную заявку на IPO в SEC вслед за OpenAI, выход возможен ранней осенью.
- Microsoft представила 7 своих MAI-моделей.
- Anthropic призвала к агрессивной глобальной паузе в разработке самых мощных AI, при этом отчиталась что Claude пишет 80%+ ее кода и скоро может начать улучшать себя сам.
- OpenAI обновила память ChatGPT (система Dreaming): синтезирует контекст. B раскатала ChatGPT Lockdown Mode против промтп-иньекций.
- OpenAI выкатила плагины в Codex (аналитика, дизайн, финансы и тд). Отдельно выделю плагин Build iOS app. Еще вышла фича Sites - собирает из доков задеплоенные веб-аппы.
- Alphabet привлекла больше $85 млрд на AI-инфраструктуру, первое крупное размещение акций после IPO 2005: спрос на вычисления превышает мощности.
- Nvidia на Computex показала RTX Spark - свой ARM-чип для потребительских ПК (конкурент Apple Silicon) и Vera - их первый CPU в датацентрах для агентов.
- Microsoft на Computex показала ноутбук Surface Laptop Ultra и мини-ПК Surface Dev Box (локально модели до 120B). Плюс выкатила always-on агента Scout и агентный поиск Web IQ.
- SoftBank объявил крупнейший AI-проект вне США: 75 млрд евро в инфраструктуру во Франции.
- DeepSeek привлекает первый внешний раунд $7.4 млрд при оценке $52-59 млрд и отчитались о переносе обучения на китайские Huawei Ascend.
- Трамп подписал указ о кибербезопасности в AI: добровольная проверка моделей через госбенчмарк.
- Альтман, Амодеи и Хассабис призвали Конгресс ввести обязательный скрининг заказов синтетических нуклеиновых кислот.
- В исследовании Stanford преподаватели права в слепом сравнении в 75% случаев предпочли ответы AI ответам коллег.
- По данным Cloudflare, трафик ботов впервые превысил человеческий (57% vs 43%), на годы раньше прогноза из-за автономных агентов.
- Nvidia открыла Nemotron 3 Ultra - сильнейшую американскую открытую модель, с весами и данными и NVIDIA Cosmos 3 для phisical AI.
- Alibaba выпустила Qwen3.7-Plus, мультимодальную агентную модель с GUI и CLI.
- Из картиночных: Ideogram 4, открытая T2I с layout-контролем и хорошей кириллицей, и Reve 2.0 на Large Layout Model, 2 место в Text-to-Image Arena.
- Нишевое: H Company Holo 3.1, локальные computer-use модели (0.8B-35B), и JetBrains Mellum 2, 12B MoE под кодинг.
- GitHub выпустил десктопное agent-native приложение Copilot.
- Anthropic выложила Defending Code harness (автономный поиск и фикс уязвимостей), а Alibaba открыла Open Code Review.
- Anthropic выкатили CLI ant - весь Claude Platform из терминала: агента описываешь YAML, коммитишь в Git и деплоишь через CI.
- Nous Research выпустила Hermes Desktop, нативное приложение: 5 режимов изоляции, субагенты, скиллы, голос (MIT, все платформы).
- Perplexity дала моделям прямой контроль над поиском через SDK, компоненты search-стека как примитивы для agent search.
- LM Studio завезла в мобильный клиент удаленный доступ к десктопным моделям через Tailscale-mesh.
- Privacy-скандалы недели: Meta тайно встроила распознавание лиц в очки Ray-Ban/Oakley + хакеры угнали аккаунты Instagram через AI-бота поддержки Meta.
- Cloudflare купила VoidZero (Vite, Vitest, Rolldown, Oxc), плюс $1 млн в фонд экосистемы Vite.
- Блогер PewDiePie выкатил Odysseus, опенсорсный self-host лаунчер для нейросетей (58k звезд меньше чем за неделю).
- Anthropic на месяц (до 5 июля) удвоила 5-часовые лимиты в Claude Cowork.
- Agent Cookie синхронизирует куки, CLI-токены и API-ключи между девайсами для агентов.
- Freestyle - новая open-source локальная голосовая диктовка.
- 🤩 Hallmark - еще один отличный скилл для дизайна, и кстати Impeccable получил мощный апдейт.
3🔥48❤13👍13👏1
Итак, вышла Claude Mythos Fable 5.
Соберем что мы об этом знаем в одну кучу и будем дополнять.
- Официальный блогпост с видео-демками и графиками, ютуб-тизер и Системная карта с деталями.
- Claude Fable 5 и Mythos 5 - это одни и те же веса, но с разными предохранителями. Fable для всех, Mythos - для доверенных партнеров
- Новый класс моделей "Mythos-class". SOTA почти на всех бенчмарках, самые большие отрывы - на длинных и сложных задачах. Бенчи пересказывать не буду - посмотрите в блогпосте и постепенно появляются все больше независимых.
- в 2 раза дороже Опуса: $10 за млн входных токенов, $50 за млн выходных.
- Доступна в Claude (все платные подписки), Claude Code и по API. Если не видите в CC - обновитесь
- Всех расстроило это: В подписках включена до 22 июня, дальше по кредитам. То есть через пару недель вероятно будет API баланс равный цене вашей подписки (например $100), а выше него - уже только при оплате за API-токены. Пишут что могут включить в саму подписку позже если найдут достаточные мощности.
- Every дали доступ за 5 дней: их видео-обзор и статья - там paywall, но прочитал и вот суть:
- Кто еще получил ранний доступ к модели? Пост Ethan Mollick, Claire Vo - подкаст How I AI
- впечатления о проактивности модели от Simon Willson
- Про предохранители: когда пишешь запросы про кибербез, био/хим и дистилляцию, срабатывает защита и переключает на Opus (в <5% сессий как пишут), и тебя об этом уведомляют. Но ложные срабатывания реальны: на reddit уже ловят баны за легитимный dual-use. Обещают уменьшать false positive.
- Когда вообще брать Fable. Модель заточена под долгие автономные/агентные задачи: "может работать днями, и чем длиннее задача, тем больше отрыв". На коротких правках разницы с Opus 4.8 часто не почувствуешь, а платишь 2x. Именно на ней Борис Черный видимо почувствовал силу Loop Engeneering.
- Интересно что максимум effort не всегда дает лучше результат - об этом пишут Every на своих тестах письма.
- Шуточный Elevator-bench уже давненько был исчерпан, но если интересно, то вот лифт Fable.
- Мои тесты пока скромные: работает визуально даже быстрее (видимо потому что делает меньше tool-колов) и внимательнее, но у меня не так много задач с которыми Opus 4.8 не справлялся бы, надо больше тестить.
——
- позже еще выяснилось, что Anthropic скрытно ограничивала Fable 5 на задачах разработки конкурирующих frontier-моделей - через steering-векторы и правку промптов модель тихо деградировала(~0.03% запросов). После критики исследователей Anthropic признала ошибку ("мы сделали неверный выбор и приносим извинения") и откатила политику, пообещав делать любые ограничения видимыми.
UPD: 12 июня власти США распорядились заблокировать доступ иностранцев к моделям Anthropic Fable 5 и Mythos 5, из-за чего компании пришлось полностью отключить обе модели для всех пользователей.
Соберем что мы об этом знаем в одну кучу и будем дополнять.
- Официальный блогпост с видео-демками и графиками, ютуб-тизер и Системная карта с деталями.
- Claude Fable 5 и Mythos 5 - это одни и те же веса, но с разными предохранителями. Fable для всех, Mythos - для доверенных партнеров
- Новый класс моделей "Mythos-class". SOTA почти на всех бенчмарках, самые большие отрывы - на длинных и сложных задачах. Бенчи пересказывать не буду - посмотрите в блогпосте и постепенно появляются все больше независимых.
- в 2 раза дороже Опуса: $10 за млн входных токенов, $50 за млн выходных.
- Доступна в Claude (все платные подписки), Claude Code и по API. Если не видите в CC - обновитесь
claude update.- Всех расстроило это: В подписках включена до 22 июня, дальше по кредитам. То есть через пару недель вероятно будет API баланс равный цене вашей подписки (например $100), а выше него - уже только при оплате за API-токены. Пишут что могут включить в саму подписку позже если найдут достаточные мощности.
- Every дали доступ за 5 дней: их видео-обзор и статья - там paywall, но прочитал и вот суть:
- Fable как "warp-двигатель для кода": амбициозные штуки одним промптом, но для понятных и коротких задач дорого и медленно.
- Скачок виден на больших автономных билдах, а не на рутине.
- На их внутреннем инженерном бенче: Fable 91/100 (Opus 4.8 - 63 и GPT-5.5 - 62).
- Сделал клон их продукта "Proof" (collaborative document editor) с одного промпта без доступа к исходному коду за ≈3 часа.
- В другом тесте снял скриншоты собственной работы на desktop и mobile, нашёл визуальные дефекты и починил - QA встроен в рабочий цикл без отдельного промпта.
- По их наблюдениям чинит корневую причину, а не симптом.
- Пишут что старые скиллы могут ограничивать новые модели (например Fable делает PowerPoint лучше, когда ему сказали вообще не использовать скилл, а просто дали бренд-гайдлайны)
- При этом текст пишет не чуть хуже Opus-а
- Самое сильное преимущество вне кода - суждение, особенно с большим контекстом
- Кто еще получил ранний доступ к модели? Пост Ethan Mollick, Claire Vo - подкаст How I AI
- впечатления о проактивности модели от Simon Willson
- Про предохранители: когда пишешь запросы про кибербез, био/хим и дистилляцию, срабатывает защита и переключает на Opus (в <5% сессий как пишут), и тебя об этом уведомляют. Но ложные срабатывания реальны: на reddit уже ловят баны за легитимный dual-use. Обещают уменьшать false positive.
- Когда вообще брать Fable. Модель заточена под долгие автономные/агентные задачи: "может работать днями, и чем длиннее задача, тем больше отрыв". На коротких правках разницы с Opus 4.8 часто не почувствуешь, а платишь 2x. Именно на ней Борис Черный видимо почувствовал силу Loop Engeneering.
- Интересно что максимум effort не всегда дает лучше результат - об этом пишут Every на своих тестах письма.
- Шуточный Elevator-bench уже давненько был исчерпан, но если интересно, то вот лифт Fable.
- Мои тесты пока скромные: работает визуально даже быстрее (видимо потому что делает меньше tool-колов) и внимательнее, но у меня не так много задач с которыми Opus 4.8 не справлялся бы, надо больше тестить.
——
- позже еще выяснилось, что Anthropic скрытно ограничивала Fable 5 на задачах разработки конкурирующих frontier-моделей - через steering-векторы и правку промптов модель тихо деградировала(~0.03% запросов). После критики исследователей Anthropic признала ошибку ("мы сделали неверный выбор и приносим извинения") и откатила политику, пообещав делать любые ограничения видимыми.
UPD: 12 июня власти США распорядились заблокировать доступ иностранцев к моделям Anthropic Fable 5 и Mythos 5, из-за чего компании пришлось полностью отключить обе модели для всех пользователей.
2👍31🔥17❤9❤🔥6
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Anthropic выпустила новую модель Claude Fable 5 - подробности в посте выше.
- Через пару дней Минторг США приказал отключить Fable 5 и Mythos 5 для всех иностранцев (подозрение на jailbreak). Разделить трафик быстро нельзя, поэтому Anthropic вырубила обе модели для всех.
- Apple на WWDC показала переработанную Siri AI: на своих версиях Gemini, понимание контекста и экрана, релиз осенью (без ЕС и Китая). Также интегрировали AI в другие свои фичи.
- Google срезал цену самого дешевого AI-плана с $8 до $5 в месяц и дал вдвое больше хранилища.
- SpaceX провела крупнейшее IPO в истории: $75 млрд при оценке ~$1,8 трлн.
- Z.ai представила GLM-5.2 - флагман для агентного кодинга с 1M контекста и режимом Max-effort.
- Google выпустил Gemini 3.5 Live Translate - потоковый синхронный голосовой перевод. В Google Translate, Meet и через Live API.
- Google выложил открытую диффузионную DiffusionGemma: генерирует текст блоками, а не по токену, до 4x быстрее, качество пониже Gemma 4.
- Два эссе от лидеров индустрии: Альтман пишет про ускорение и AGI каждому, а Дарио Амодеи призывает к осторожности и FAA-подобному регулированию.
- OpenAI купила Ona - облачную оркестрацию для агентов.
- Google законтрактовал у SpaceX ~110 тыс. GPU Blackwell за $920 млн в месяц до 2029.
- OpenAI, по данным The Information, вероятно отложит IPO на 2027: объясняют это прогрессом в самообучающемся ИИ и сильными метриками Anthropic. Сотрудникам предложили выкуп акций.
- Китай строит единую национальную вычислительную сеть из дата-центров (сейчас большай фрагментация).
- ChatGPT не убил Поиск Google - он на историческом максимуме: выручка Search +19% год к году.
- Джефф Безос вышел из стелса с Prometheus и сразу поднял $12 млрд на AI инженерию для физического мира.
- Сооснователь xAI Игорь Бабушкин запустил River AI - адаптивные персонализированные агенты, костяк команды из xAI.
- Stack Overflow перезапускается под агентов.
- Cognition обещает до $10M кредитов, если Devin недоработает по годовому корпоративному контракту (прецедент гарантии b2b AI).
- Xiaomi выпустила MiMo UltraSpeed - 1-триллионную MoE со скоростью 1000+ ток/с на обычном 8-GPU сервере.
- Cohere выпустила North Mini Code - открытую coding-модель, быстрее сравнимой Devstral Small 2 в 2,8 раза.
- Moonshot выпустила Kimi K2.7-Code - открытую модель для агентного кодинга.
- Moonshot представила Kimi Work - десктопный агент, прямой ответ на Claude Cowork.
- Cognition представила FrontierCode - насколько модель тянет стандарты качественных продакшен-кодбаз. Сделан опенсорс-мейнтейнерами.
- Claude Code апдейт: субагенты могут спавнить субагентов (до 5 уровней), fallbackModel при перегрузке, /cd без сброса кеша.
- Anthropic открыла observability для MCP-коннекторов: дашборд по adoption, health, error rate и пр.
- OpenAI разрешила в Codex ограниченно откладывать сбросы лимитов про запас и активировать в удобный момент + на две недели реферальная акция: пригласи друга (до 3х) - оба получите по дополнительному сбросу лимитов.
- К ЧМ по футболу Google временно открыл всем бесплатно генеративный UI в AI Mode (обычно Pro и Ultra): на вопрос о тактике поисковик рисует интерактивные схемы.
- Google завез Colab в терминал можно скилами провижинить GPU и попросить "зафайнтюнь модель на моем датасете"
- Vercel запустил skills.sh API - запросы к коллекции 600k+ skills.
- skill-eval-harness - маленький Python-harness, чтобы прогнать evals на своих skills и понять, помогают они модели или вредят.
- text-to-lottie - открытый скилл для Claude Code и Codex, генерит production-ready Lottie-анимации по текстовому промпту.
- 🤩 NotebookLM полностью обновили: теперь это автономные агенты, работа со скиллами (100+ на каждый блокнот) и запуск кода, а под капотом Gemini 3.5 и движок Antigravity.
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Anthropic выпустила новую модель Claude Fable 5 - подробности в посте выше.
- Через пару дней Минторг США приказал отключить Fable 5 и Mythos 5 для всех иностранцев (подозрение на jailbreak). Разделить трафик быстро нельзя, поэтому Anthropic вырубила обе модели для всех.
- Apple на WWDC показала переработанную Siri AI: на своих версиях Gemini, понимание контекста и экрана, релиз осенью (без ЕС и Китая). Также интегрировали AI в другие свои фичи.
- Google срезал цену самого дешевого AI-плана с $8 до $5 в месяц и дал вдвое больше хранилища.
- SpaceX провела крупнейшее IPO в истории: $75 млрд при оценке ~$1,8 трлн.
- Z.ai представила GLM-5.2 - флагман для агентного кодинга с 1M контекста и режимом Max-effort.
- Google выпустил Gemini 3.5 Live Translate - потоковый синхронный голосовой перевод. В Google Translate, Meet и через Live API.
- Google выложил открытую диффузионную DiffusionGemma: генерирует текст блоками, а не по токену, до 4x быстрее, качество пониже Gemma 4.
- Два эссе от лидеров индустрии: Альтман пишет про ускорение и AGI каждому, а Дарио Амодеи призывает к осторожности и FAA-подобному регулированию.
- OpenAI купила Ona - облачную оркестрацию для агентов.
- Google законтрактовал у SpaceX ~110 тыс. GPU Blackwell за $920 млн в месяц до 2029.
- OpenAI, по данным The Information, вероятно отложит IPO на 2027: объясняют это прогрессом в самообучающемся ИИ и сильными метриками Anthropic. Сотрудникам предложили выкуп акций.
- Китай строит единую национальную вычислительную сеть из дата-центров (сейчас большай фрагментация).
- ChatGPT не убил Поиск Google - он на историческом максимуме: выручка Search +19% год к году.
- Джефф Безос вышел из стелса с Prometheus и сразу поднял $12 млрд на AI инженерию для физического мира.
- Сооснователь xAI Игорь Бабушкин запустил River AI - адаптивные персонализированные агенты, костяк команды из xAI.
- Stack Overflow перезапускается под агентов.
- Cognition обещает до $10M кредитов, если Devin недоработает по годовому корпоративному контракту (прецедент гарантии b2b AI).
- Xiaomi выпустила MiMo UltraSpeed - 1-триллионную MoE со скоростью 1000+ ток/с на обычном 8-GPU сервере.
- Cohere выпустила North Mini Code - открытую coding-модель, быстрее сравнимой Devstral Small 2 в 2,8 раза.
- Moonshot выпустила Kimi K2.7-Code - открытую модель для агентного кодинга.
- Moonshot представила Kimi Work - десктопный агент, прямой ответ на Claude Cowork.
- Cognition представила FrontierCode - насколько модель тянет стандарты качественных продакшен-кодбаз. Сделан опенсорс-мейнтейнерами.
- Claude Code апдейт: субагенты могут спавнить субагентов (до 5 уровней), fallbackModel при перегрузке, /cd без сброса кеша.
- Anthropic открыла observability для MCP-коннекторов: дашборд по adoption, health, error rate и пр.
- OpenAI разрешила в Codex ограниченно откладывать сбросы лимитов про запас и активировать в удобный момент + на две недели реферальная акция: пригласи друга (до 3х) - оба получите по дополнительному сбросу лимитов.
- К ЧМ по футболу Google временно открыл всем бесплатно генеративный UI в AI Mode (обычно Pro и Ultra): на вопрос о тактике поисковик рисует интерактивные схемы.
- Google завез Colab в терминал можно скилами провижинить GPU и попросить "зафайнтюнь модель на моем датасете"
- Vercel запустил skills.sh API - запросы к коллекции 600k+ skills.
- skill-eval-harness - маленький Python-harness, чтобы прогнать evals на своих skills и понять, помогают они модели или вредят.
- text-to-lottie - открытый скилл для Claude Code и Codex, генерит production-ready Lottie-анимации по текстовому промпту.
- 🤩 NotebookLM полностью обновили: теперь это автономные агенты, работа со скиллами (100+ на каждый блокнот) и запуск кода, а под капотом Gemini 3.5 и движок Antigravity.
4🔥51❤17👍10❤🔥3🙏2
This media is not supported in your browser
VIEW IN TELEGRAM
Twenty CRM - классная опенсорс CRM и мой skill к ней.
Где-то пару месяцев назад переехали с платной CRM (год были на PipeDrive, до этого был Hubspot) на TwentyCRM на своем сервере. Уже успел много кому порекомендовать, но решил написать пост-обзор с некоторыми деталями и заодно поделиться своим скилом.
Для начала зачем? Ну как минимум это дешевле (стоимость VPS - это баксов 10, вместо $25-80 за каждого юзера - выходит в копеечку за год), а во-вторых она оказалась лучше примерно во всем что мне нужно от CRM.
Это не первая опенсорсная CRM, но, пожалуй, единственная, которая ощущается как взрослый, качественный продукт с отличным дизайном. Первое, что замечаешь - скорость, прям летает. Современный стек (TS, pg), легко настроить под себя data model, есть SDK и развитый API. Причем все это активно пилится: недавно вышла 2.0, где аппы можно строить прямо поверх CRM без правки кода, и строилось это так чтобы было удобно развивать кодинговыми агентами. 49k звезд, #1 опенсорсный CRM на гитхабе.
Но минус балл за то что нет своего CLI и скилла. Хотя сделать свой оказалось несложно.
За счет развитого API у меня ушло совсем немного времени, чтобы собрать вокруг Twenty ровно то, что мне нужно для работы из Claude Code / Codex.
Сначала я сделал CLI на базе их REST-api и ocli - это, кстати, опенсонс от @evilfreelancer и @neuraldeep. Получилось супер-просто, создаешь профиль с ссылкой на готовую Swager спеку и получаешь готовый CLI-тул. Кайф.
Потом завернул его в Skill - ставится одной командой:
Что он дает агенту: читать и менять данные в CRM - люди, компании, сделки, таски, заметки, кастомные объекты, CRUD всего этого.
Еще он подстраивается под любую схему. Завели кастомные поля или целые коллекции под свой процесс? Скилл подхватит их и подстроится под вашу дата-модель.
Со скилом стали чаще пользоваться CRM. Раньше вести ее было лень: прошла встреча - иди ищи контакт, кликай, записывай. Теперь просто пишу в чате "пообщались с тем-то, вот что надо отметить" - агент занесет сам, если надо залезет в транскипт Granola по MCP. Или "кто у нас был с похожим кейсом, напомни и поставь follow-up" - найдет и поставит таску с напоминанием. По сути разговариваешь с CRM, а не кликаешь по ней.
Вообще такое решение рекомендую всем, у кого есть готовый REST API с OpenAPI/Swagger: делаете CLI wrapper + тонкий SKILL.md вместо своей обертки. Быстро, надежно, нечего сапортить. Ocli классный, но если ищите альтернативы - есть еще, например https://rest.sh и другие. OpenAI предлагает поручить агенту написать свой CLI, но мне такой вариант кажется очень хардкодным - под чуть другую схему надо менять код и делать ребилд, но в целом - тоже решение.
А возвращаясь к самой CRM - как по мне отличный баланс простоты, скорости и dev experience: гибкая data model с кастомными объектами и полями без кода, вьюхи на любой вкус (таблица/канбан/календарь), визуальные workflow-автоматизации по триггерам (в том числе LLM-блоки) и развитый API (REST + GraphQL). Ну и встроенные AI-фичи очень активно развиваются.
Надеюсь, кому-нибудь будет полезен обзор, скилл или сам подход.
🔥 ➕ 🔁 @nobilix
Где-то пару месяцев назад переехали с платной CRM (год были на PipeDrive, до этого был Hubspot) на TwentyCRM на своем сервере. Уже успел много кому порекомендовать, но решил написать пост-обзор с некоторыми деталями и заодно поделиться своим скилом.
Для начала зачем? Ну как минимум это дешевле (стоимость VPS - это баксов 10, вместо $25-80 за каждого юзера - выходит в копеечку за год), а во-вторых она оказалась лучше примерно во всем что мне нужно от CRM.
Это не первая опенсорсная CRM, но, пожалуй, единственная, которая ощущается как взрослый, качественный продукт с отличным дизайном. Первое, что замечаешь - скорость, прям летает. Современный стек (TS, pg), легко настроить под себя data model, есть SDK и развитый API. Причем все это активно пилится: недавно вышла 2.0, где аппы можно строить прямо поверх CRM без правки кода, и строилось это так чтобы было удобно развивать кодинговыми агентами. 49k звезд, #1 опенсорсный CRM на гитхабе.
Но минус балл за то что нет своего CLI и скилла. Хотя сделать свой оказалось несложно.
За счет развитого API у меня ушло совсем немного времени, чтобы собрать вокруг Twenty ровно то, что мне нужно для работы из Claude Code / Codex.
Сначала я сделал CLI на базе их REST-api и ocli - это, кстати, опенсонс от @evilfreelancer и @neuraldeep. Получилось супер-просто, создаешь профиль с ссылкой на готовую Swager спеку и получаешь готовый CLI-тул. Кайф.
Потом завернул его в Skill - ставится одной командой:
npx skills add nobilix/twenty-crm-skill
Что он дает агенту: читать и менять данные в CRM - люди, компании, сделки, таски, заметки, кастомные объекты, CRUD всего этого.
Еще он подстраивается под любую схему. Завели кастомные поля или целые коллекции под свой процесс? Скилл подхватит их и подстроится под вашу дата-модель.
Со скилом стали чаще пользоваться CRM. Раньше вести ее было лень: прошла встреча - иди ищи контакт, кликай, записывай. Теперь просто пишу в чате "пообщались с тем-то, вот что надо отметить" - агент занесет сам, если надо залезет в транскипт Granola по MCP. Или "кто у нас был с похожим кейсом, напомни и поставь follow-up" - найдет и поставит таску с напоминанием. По сути разговариваешь с CRM, а не кликаешь по ней.
Вообще такое решение рекомендую всем, у кого есть готовый REST API с OpenAPI/Swagger: делаете CLI wrapper + тонкий SKILL.md вместо своей обертки. Быстро, надежно, нечего сапортить. Ocli классный, но если ищите альтернативы - есть еще, например https://rest.sh и другие. OpenAI предлагает поручить агенту написать свой CLI, но мне такой вариант кажется очень хардкодным - под чуть другую схему надо менять код и делать ребилд, но в целом - тоже решение.
А возвращаясь к самой CRM - как по мне отличный баланс простоты, скорости и dev experience: гибкая data model с кастомными объектами и полями без кода, вьюхи на любой вкус (таблица/канбан/календарь), визуальные workflow-автоматизации по триггерам (в том числе LLM-блоки) и развитый API (REST + GraphQL). Ну и встроенные AI-фичи очень активно развиваются.
Надеюсь, кому-нибудь будет полезен обзор, скилл или сам подход.
🔥 ➕ 🔁 @nobilix
14🔥105👍35❤🔥7❤5🥰2
Ключевой управленческий выбор в эпоху AI - что оставить людям, что коду, а что агенту. Этот пост - анонс ивента Стратоплана, куда меня пригласили выступить на эту тему. Ивент (Camp) в основном для фаундеров и руководителей, бесплатно.
О чем расскажу я
- Роль доменных экспертов в AI-трансформации компании и почему автоматизация перестала быть задачей разработчика.
- Как упаковывать экспертизу и процедуры в готовые навыки для агента (и причем тут SOP).
- Лучший паттерн для фоновой автоматизации — агент пишет workflow, а не крутится в проде (с примерами из реальных проектов).
- AX (agent experience) - почему это теперь важная часть продукта.
- Как решать, что отдать агенту, что коду (workflow), а что оставить людям. Тоже с примерами.
Что еще будет?
Много полезного для фаундеров и управленцев, конференция (Camp) в основном для них, но не только.
Всего будет 4 трека:
- управленческий (для лидов и руководителей отделов)
- стратегический трек (оунеров, СЕО)
- директорский трек (для техдиров и СОО) <- я буду тут
- карьерный трек (для всех, кто хочет разобраться, как расти, когда вокруг сокращают)
И еще будут воркшопы.
--
Когда: 22-25 июня, по вечерам 18-21 по GMT+3
Участие бесплатное (нужно подписаться на каналы) или платное (если вдруг не хотите подписываться).
Регистрация здесь
О чем расскажу я
- Роль доменных экспертов в AI-трансформации компании и почему автоматизация перестала быть задачей разработчика.
- Как упаковывать экспертизу и процедуры в готовые навыки для агента (и причем тут SOP).
- Лучший паттерн для фоновой автоматизации — агент пишет workflow, а не крутится в проде (с примерами из реальных проектов).
- AX (agent experience) - почему это теперь важная часть продукта.
- Как решать, что отдать агенту, что коду (workflow), а что оставить людям. Тоже с примерами.
Что еще будет?
Много полезного для фаундеров и управленцев, конференция (Camp) в основном для них, но не только.
Всего будет 4 трека:
- управленческий (для лидов и руководителей отделов)
- стратегический трек (оунеров, СЕО)
- директорский трек (для техдиров и СОО) <- я буду тут
- карьерный трек (для всех, кто хочет разобраться, как расти, когда вокруг сокращают)
И еще будут воркшопы.
--
Когда: 22-25 июня, по вечерам 18-21 по GMT+3
Участие бесплатное (нужно подписаться на каналы) или платное (если вдруг не хотите подписываться).
Регистрация здесь
1👍26❤17🔥13❤🔥2
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- SpaceX покупает Cursor за $60 млрд - одна из крупнейших сделок в истории AI. + Cursor анонсировала Origin - конкурента GitHub заточенного под агентов.
- Claude Code теперь умеет Artifacts: генерит интерактивные веб-страницы прямо из контекста сессии, с историей версий и приватностью для организации.
- OpenAI подвезла в Codex Record & Replay - показал задачу один раз, агент собрал переиспользуемый skill (пока только macOS), плюс поддержку Chrome DevTools Protocol.
- Anthropic крупно обновила Claude Design: дизайн-системы между проектами, правка канваса напрямую и синк с Claude Code.
- Google выпустила Android 17: приложения могут выставлять инструменты для on-device агентов (AppFunctions, Android MCP).
- Adobe выкатила в бету единого AI-агента для Premiere, Photoshop, Illustrator, InDesign и Frame; управлять можно из ChatGPT, Claude и Copilot.
- У OpenAI утекла отчетность за 2025 - очень растут косты, хоть выручка выросла ~x3, маржа ~x2, но операционно минус ~$21 млрд.
- Доля ChatGPT на рынке впервые упала ниже 50% - юзеры все охотнее прыгают между Gemini, Claude и Grok.
- Salesforce покупает Fin (бывший Intercom) за ~$3,6 млрд.
- DeepSeek закрыла раунд на $7,4 млрд при оценке выше $50 млрд и стала самым дорогим AI-стартапом Китая.
- Google теряет крупные таланты: Ноам Шазир, соавтор Transformer, уходит в OpenAI, а нобелевский лауреат Джон Джампер (AlphaFold) переходит в Anthropic.
- Лидеры G7 встретились с CEO OpenAI, Anthropic и Google DeepMind: на фоне права США отключать доступ к топ-моделям союзники хотят "американский AI без рубильника" и обсуждают схему доверенных партнеров.
- freefable.org: ведущие специалисты по кибербезопасности призвали США снять запрет с Mythos.
- Пентагон под присягой подтвердил боевое применение Grok: AI от xAI наводил удары США по Ирану через Project Maven. Anthropic из проекта вышла.
- Meta перевела ≈6500 инженеров на разметку данных и RLHF. Сотрудники недовольны.
- Anthropic выпустила интересный разбор ~400 тыс. сессий Claude Code.
- Anthropic поставила на паузу отдельную тарификацию Agent SDK и claude -p. Возможно, пересмотрит решение.
- Midjourney неожиданно пошла в медтех: открыла подразделение Midjourney Medical и строит ультразвуковой сканер тела (в ~100x быстрее МРТ).
- Snap представил AR-очки Specs за $2195 с цветным экраном и on-device AI; после анонса акции упали до исторического минимума.
- Moonshot ускорила Kimi K2.7 Code - режим HighSpeed до 6x быстрее (~180-260 ток/с).
- Бенчмарки недели: Ramp выложил приватный SWE-Bench из реальных инженерных задач, MyPCBench меряет агентов на Linux-десктопе, а AA-Briefcase - на бизнес-задачах.
- Databricks открыла Omnigent (Apache 2.0) - мета-оболочку над Claude Code и другими агентами с лимитами и правилами-триггерами (например апрув на git push).
- Google выпустила Open Knowledge Format - стандарт передачи контекста агентам (md + граф).
- Trace Commons призывает донатить трейсы coding-сессий в открытый датасет (CC-BY-4.0) для обучения open-weight моделей.
- ChatGPT убрала фичу Pulse (переехала в Scheduled Tasks) - а в тему появился killedbyopenai.com, кладбище закрытых продуктов OpenAI.
- Ponytail учит AI-агента сначала искать готовое решение и только потом писать код - по бенчмаркам это -54% строк и -20% стоимости (пресеты под Claude Code, Codex, Copilot).
- HumanLayer открыла доступ к агентному IDE на своем фреймворке Research-Plan-Implement (уже в Block и Uber): ставка на дисциплину против AI-слопа, 2-3x по всему циклу разработки, а не только в коде.
- ✨ Vercel выкатила drop.new - кидаешь папку или zip, получаешь задеплоенный сайт.
- 🤩 Сразу 2 заметных TS агентных фреймворка: Eve от Vercel - "Next.js для агентов" и Flue от команды Astro (на базе Pi).
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- SpaceX покупает Cursor за $60 млрд - одна из крупнейших сделок в истории AI. + Cursor анонсировала Origin - конкурента GitHub заточенного под агентов.
- Claude Code теперь умеет Artifacts: генерит интерактивные веб-страницы прямо из контекста сессии, с историей версий и приватностью для организации.
- OpenAI подвезла в Codex Record & Replay - показал задачу один раз, агент собрал переиспользуемый skill (пока только macOS), плюс поддержку Chrome DevTools Protocol.
- Anthropic крупно обновила Claude Design: дизайн-системы между проектами, правка канваса напрямую и синк с Claude Code.
- Google выпустила Android 17: приложения могут выставлять инструменты для on-device агентов (AppFunctions, Android MCP).
- Adobe выкатила в бету единого AI-агента для Premiere, Photoshop, Illustrator, InDesign и Frame; управлять можно из ChatGPT, Claude и Copilot.
- У OpenAI утекла отчетность за 2025 - очень растут косты, хоть выручка выросла ~x3, маржа ~x2, но операционно минус ~$21 млрд.
- Доля ChatGPT на рынке впервые упала ниже 50% - юзеры все охотнее прыгают между Gemini, Claude и Grok.
- Salesforce покупает Fin (бывший Intercom) за ~$3,6 млрд.
- DeepSeek закрыла раунд на $7,4 млрд при оценке выше $50 млрд и стала самым дорогим AI-стартапом Китая.
- Google теряет крупные таланты: Ноам Шазир, соавтор Transformer, уходит в OpenAI, а нобелевский лауреат Джон Джампер (AlphaFold) переходит в Anthropic.
- Лидеры G7 встретились с CEO OpenAI, Anthropic и Google DeepMind: на фоне права США отключать доступ к топ-моделям союзники хотят "американский AI без рубильника" и обсуждают схему доверенных партнеров.
- freefable.org: ведущие специалисты по кибербезопасности призвали США снять запрет с Mythos.
- Пентагон под присягой подтвердил боевое применение Grok: AI от xAI наводил удары США по Ирану через Project Maven. Anthropic из проекта вышла.
- Meta перевела ≈6500 инженеров на разметку данных и RLHF. Сотрудники недовольны.
- Anthropic выпустила интересный разбор ~400 тыс. сессий Claude Code.
- Anthropic поставила на паузу отдельную тарификацию Agent SDK и claude -p. Возможно, пересмотрит решение.
- Midjourney неожиданно пошла в медтех: открыла подразделение Midjourney Medical и строит ультразвуковой сканер тела (в ~100x быстрее МРТ).
- Snap представил AR-очки Specs за $2195 с цветным экраном и on-device AI; после анонса акции упали до исторического минимума.
- Moonshot ускорила Kimi K2.7 Code - режим HighSpeed до 6x быстрее (~180-260 ток/с).
- Бенчмарки недели: Ramp выложил приватный SWE-Bench из реальных инженерных задач, MyPCBench меряет агентов на Linux-десктопе, а AA-Briefcase - на бизнес-задачах.
- Databricks открыла Omnigent (Apache 2.0) - мета-оболочку над Claude Code и другими агентами с лимитами и правилами-триггерами (например апрув на git push).
- Google выпустила Open Knowledge Format - стандарт передачи контекста агентам (md + граф).
- Trace Commons призывает донатить трейсы coding-сессий в открытый датасет (CC-BY-4.0) для обучения open-weight моделей.
- ChatGPT убрала фичу Pulse (переехала в Scheduled Tasks) - а в тему появился killedbyopenai.com, кладбище закрытых продуктов OpenAI.
- Ponytail учит AI-агента сначала искать готовое решение и только потом писать код - по бенчмаркам это -54% строк и -20% стоимости (пресеты под Claude Code, Codex, Copilot).
- HumanLayer открыла доступ к агентному IDE на своем фреймворке Research-Plan-Implement (уже в Block и Uber): ставка на дисциплину против AI-слопа, 2-3x по всему циклу разработки, а не только в коде.
- ✨ Vercel выкатила drop.new - кидаешь папку или zip, получаешь задеплоенный сайт.
- 🤩 Сразу 2 заметных TS агентных фреймворка: Eve от Vercel - "Next.js для агентов" и Flue от команды Astro (на базе Pi).
3🔥37❤16✍8👍6❤🔥5
This media is not supported in your browser
VIEW IN TELEGRAM
Новый Claude Design очень неплох!
Когда Claude Design вышел первый раз, я попробовал и он показался неюзабельным, и большого смысла в нем я не увидел.
Сейчас после их апдейта вернулся и это уже сильно лучше: дизайн-система, точечное управление компонентами, двусторонний синк с Claude Code (который мог бы быть и лучше, но ок). Завезли управление компонентами - drag/resize/align и дерево слоев. То есть он стал заметно ближе к Фигме. Улучшенный экспорт: PDF, PowerPoint, zip, HTML.
Но все еще есть баги и все еще жрет токены (хоть и сильно меньше).
В ютубе в основном обзоры Claude Design для веб-дизайна, но мне нравится как он работает со слайдами. Я уже писал про Slidev (и все еще считаю что это отличный тул), а в этот раз собрал презу в Claude Design в качестве эксперимента - и мне понравилось. Дизайн-система, интеграция с кодом и прямое редактирование сильно упростили работу, плюс есть режим презентации прямо внутри. Для такой задачи зашло отлично.
Кстати, на видео слайды моего сегодняшнего выступления, так что заодно напоминаю.
Когда Claude Design вышел первый раз, я попробовал и он показался неюзабельным, и большого смысла в нем я не увидел.
Сейчас после их апдейта вернулся и это уже сильно лучше: дизайн-система, точечное управление компонентами, двусторонний синк с Claude Code (который мог бы быть и лучше, но ок). Завезли управление компонентами - drag/resize/align и дерево слоев. То есть он стал заметно ближе к Фигме. Улучшенный экспорт: PDF, PowerPoint, zip, HTML.
Но все еще есть баги и все еще жрет токены (хоть и сильно меньше).
В ютубе в основном обзоры Claude Design для веб-дизайна, но мне нравится как он работает со слайдами. Я уже писал про Slidev (и все еще считаю что это отличный тул), а в этот раз собрал презу в Claude Design в качестве эксперимента - и мне понравилось. Дизайн-система, интеграция с кодом и прямое редактирование сильно упростили работу, плюс есть режим презентации прямо внутри. Для такой задачи зашло отлично.
Кстати, на видео слайды моего сегодняшнего выступления, так что заодно напоминаю.
103🔥25👍18❤11
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- OpenAI запустила GPT-5.6 Preview (версии Sol, Terra, Luna), но администрация Трампа ограничила релиз: доступ только одобренным партнерам.
- OpenAI представила Jalapeño - собственный (совместно с TSMC и Broadcom) чип под инференс LLM.
- Google встроила computer use прямо в Gemini 3.5 Flash (раньше - отдельно).
- Anthropic запустила Claude Tag - общий Slack-агент на команду: контекст каналов, общая память.
- Anthropic добилась частичной разморозки Mythos 5 для критической инфраструктуры и обсуждает возврат Fable 5. В это же время OpenAI заявила о GPT-5.5-Cyber на уровне Mythos в поиске уязвимостей.
- OpenAI поделилась статистикой внутреннего использования Codex.
- Вышел новый Economic Index отчет Anthropic.
- SpaceX заключила сделку до $6,3 млрд с open-source стартапом Reflection, дав доступ к Colossus.
- Отток талантов из Google продолжается: ключевые разработчики Gemini Йонас Адлер и Александр Притцель уходят в Anthropic.
- По оценкам экс-сотрудников, более половины трафика Grok от xAI приходится на взрослый контент и ролевые чаты.
- Трамп подписал два указа по квантовым вычислениям включая ускоренный переход госорганов на постквантовую криптографию.
- Рынок труда под AI: Oracle сократила 21 тыс. человек (13% штата), Калифорния запустила первый трекер увольнений из-за ИИ, а AWS нанимает 11 тыс. джунов.
- Meta строит приложение рынков предсказаний Arena на аудитории Instagram и Facebook.
- Google вкладывает $75 млн в киностудию A24 ради совместных AI-инструментов для кинопроизводства.
- Компании массово уходят на дешевые открытые китайские модели: по UBS, 60% сокращающих AI-бюджет переключаются на них с роутингом под сложные задачи. А новая GLM-5.2 уже в топ-10 моделей мира.
- Exponential View выложили интересный отчет про AI-экономику.
- Amazon отменил уже снятый фильм про Альтмана, чтобы не рисковать сделкой с OpenAI. Netflix тоже отказался.
- Большой консалтер Bain & Company вайбкодит для фондов копии продуктов компаний-целей на due diligence: если AI воссоздает продукт за дни, моата нет.
- Европа боится отстать: брюссельский сценарий Европа-2031 рисует крах от нехватки датацентров, а консорциум EUROPA (Domyn) выиграл EU-грант на открытую модель 400B под 24 языка ЕС.
- Cloudflare с Chrome, Firefox и Edge запускает протокол PACT, верифицирующий легитимность веб-трафика без слежки за пользователем.
- Baidu открыла Unlimited OCR (распознает 40+ страниц за один проход), а Mistral выпустила OCR 4 со структурным разбором страницы и 170 языками.
- Qwen выложила open-weight AgentWorld - модели, симулирующие реальные среды для агентов.
- DeepReinforce открыла семейство кодинг-моделей Ornith-1.0 (до 397B MoE) на базе Gemma 4 и Qwen 3.5, по заявлениям SOTA среди открытых.
- Inception выпустила Mercury 2 - диффузионную reasoning-модель на ~1000 ток/с.
- Liquid AI выпустила LFM 2.5 на 230M - не-трансформер (state-space) для edge, на уровне трансформеров втрое крупнее.
- Свежие агентные бенчмарки: OSWorld 2.0 для computer-use (лучший лишь 20,6%) и CoffeeBench от Sakana и KPMG на бизнес-стратегии.
- Hugging Face выпустиля vllm jobs запуск приватного vLLM-эндпоинта одной командой на serverless-инфраструктуре.
- Figma на Config 2026 показала превращение слоев в код, инструмент Motion и vibe coding для плагинов.
- OpenAI обновила GPT-5.5 Instant: лучше с интентом, ограничениями и рекомендациями.
- Anthropic выпустила гайд как рулить Claude Code: skills, hooks, rules, subagents.
- Хороший критический разбор loop engineering и в тему подборка из 15 готовых copy-paste лупов.
- Aside - новый AI-браузер с вертикальными вкладками и поддержкой Claude/ChatGPT.
- hubble.md - markdown-блокнот для людей и агентов с живым превью.
- 👍 Vercel выпустила AI SDK 7 с мощными агентными возмозностями, TUI, единой телеметрией, сторонними харнесами и пр.
- 🤩 Executor - open-source шлюз, централизованно подключающий сервисы а агентам.
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- OpenAI запустила GPT-5.6 Preview (версии Sol, Terra, Luna), но администрация Трампа ограничила релиз: доступ только одобренным партнерам.
- OpenAI представила Jalapeño - собственный (совместно с TSMC и Broadcom) чип под инференс LLM.
- Google встроила computer use прямо в Gemini 3.5 Flash (раньше - отдельно).
- Anthropic запустила Claude Tag - общий Slack-агент на команду: контекст каналов, общая память.
- Anthropic добилась частичной разморозки Mythos 5 для критической инфраструктуры и обсуждает возврат Fable 5. В это же время OpenAI заявила о GPT-5.5-Cyber на уровне Mythos в поиске уязвимостей.
- OpenAI поделилась статистикой внутреннего использования Codex.
- Вышел новый Economic Index отчет Anthropic.
- SpaceX заключила сделку до $6,3 млрд с open-source стартапом Reflection, дав доступ к Colossus.
- Отток талантов из Google продолжается: ключевые разработчики Gemini Йонас Адлер и Александр Притцель уходят в Anthropic.
- По оценкам экс-сотрудников, более половины трафика Grok от xAI приходится на взрослый контент и ролевые чаты.
- Трамп подписал два указа по квантовым вычислениям включая ускоренный переход госорганов на постквантовую криптографию.
- Рынок труда под AI: Oracle сократила 21 тыс. человек (13% штата), Калифорния запустила первый трекер увольнений из-за ИИ, а AWS нанимает 11 тыс. джунов.
- Meta строит приложение рынков предсказаний Arena на аудитории Instagram и Facebook.
- Google вкладывает $75 млн в киностудию A24 ради совместных AI-инструментов для кинопроизводства.
- Компании массово уходят на дешевые открытые китайские модели: по UBS, 60% сокращающих AI-бюджет переключаются на них с роутингом под сложные задачи. А новая GLM-5.2 уже в топ-10 моделей мира.
- Exponential View выложили интересный отчет про AI-экономику.
- Amazon отменил уже снятый фильм про Альтмана, чтобы не рисковать сделкой с OpenAI. Netflix тоже отказался.
- Большой консалтер Bain & Company вайбкодит для фондов копии продуктов компаний-целей на due diligence: если AI воссоздает продукт за дни, моата нет.
- Европа боится отстать: брюссельский сценарий Европа-2031 рисует крах от нехватки датацентров, а консорциум EUROPA (Domyn) выиграл EU-грант на открытую модель 400B под 24 языка ЕС.
- Cloudflare с Chrome, Firefox и Edge запускает протокол PACT, верифицирующий легитимность веб-трафика без слежки за пользователем.
- Baidu открыла Unlimited OCR (распознает 40+ страниц за один проход), а Mistral выпустила OCR 4 со структурным разбором страницы и 170 языками.
- Qwen выложила open-weight AgentWorld - модели, симулирующие реальные среды для агентов.
- DeepReinforce открыла семейство кодинг-моделей Ornith-1.0 (до 397B MoE) на базе Gemma 4 и Qwen 3.5, по заявлениям SOTA среди открытых.
- Inception выпустила Mercury 2 - диффузионную reasoning-модель на ~1000 ток/с.
- Liquid AI выпустила LFM 2.5 на 230M - не-трансформер (state-space) для edge, на уровне трансформеров втрое крупнее.
- Свежие агентные бенчмарки: OSWorld 2.0 для computer-use (лучший лишь 20,6%) и CoffeeBench от Sakana и KPMG на бизнес-стратегии.
- Hugging Face выпустиля vllm jobs запуск приватного vLLM-эндпоинта одной командой на serverless-инфраструктуре.
- Figma на Config 2026 показала превращение слоев в код, инструмент Motion и vibe coding для плагинов.
- OpenAI обновила GPT-5.5 Instant: лучше с интентом, ограничениями и рекомендациями.
- Anthropic выпустила гайд как рулить Claude Code: skills, hooks, rules, subagents.
- Хороший критический разбор loop engineering и в тему подборка из 15 готовых copy-paste лупов.
- Aside - новый AI-браузер с вертикальными вкладками и поддержкой Claude/ChatGPT.
- hubble.md - markdown-блокнот для людей и агентов с живым превью.
- 👍 Vercel выпустила AI SDK 7 с мощными агентными возмозностями, TUI, единой телеметрией, сторонними харнесами и пр.
- 🤩 Executor - open-source шлюз, централизованно подключающий сервисы а агентам.
2🔥38❤19👍13🥰1
Refat--augmentation-automation--humans-workflows-agents-2026.pdf
1.9 MB
Запись и слайды моего доклада "Что оставить людям, что коду (workflow), что агенту".
📹 Запись: https://youtu.be/1Ps5ra13_ro?t=80
🖼 Слайды в аттаче.
Тезисно, о чем было:
- почему важно различать два режима: augmentation (человек в центре) и automation (фоновая автоматизация)
- где что ломается: люди не масштабируются, workflow негибкий, агент дорогой и ненадежный на потоке;
- кейс маркетингового агентства: augmentation работала отлично, а agentic-автоматизация все время ломалась, пока не пришли к схеме, где максимум переносим в workflow, а агент их пишет и поддерживает;
- простое правило: можешь написать чек-лист или граф - автоматизируй, думаешь каждый раз заново - оставляй человеку. И несколько мыслей о том когда выносить агентов в фоновые автоматизации.
- почему понимание сложно делегируется и роль эксперта от этого только растет;
- пара практических вещей: файлы как артефакт, SOP, делать ревью максимально удобными, единый governance вместо разрозненных трейсов;
- пример про извлечение данных из документов: стоило $11 за документ у агента и упало до <$1, когда то же самое переписали в workflow;
- про проект дата-скрейпинга, где мы ушли от LLM-экстракшена к агентной кодогенерации: агент пишет детерминированные парсеры, а не LLM парсит страницы вживую (oб этом, кстати, еще буду писать, stay tuned).
📹 Запись: https://youtu.be/1Ps5ra13_ro?t=80
🖼 Слайды в аттаче.
Тезисно, о чем было:
- почему важно различать два режима: augmentation (человек в центре) и automation (фоновая автоматизация)
- где что ломается: люди не масштабируются, workflow негибкий, агент дорогой и ненадежный на потоке;
- кейс маркетингового агентства: augmentation работала отлично, а agentic-автоматизация все время ломалась, пока не пришли к схеме, где максимум переносим в workflow, а агент их пишет и поддерживает;
- простое правило: можешь написать чек-лист или граф - автоматизируй, думаешь каждый раз заново - оставляй человеку. И несколько мыслей о том когда выносить агентов в фоновые автоматизации.
- почему понимание сложно делегируется и роль эксперта от этого только растет;
- пара практических вещей: файлы как артефакт, SOP, делать ревью максимально удобными, единый governance вместо разрозненных трейсов;
- пример про извлечение данных из документов: стоило $11 за документ у агента и упало до <$1, когда то же самое переписали в workflow;
- про проект дата-скрейпинга, где мы ушли от LLM-экстракшена к агентной кодогенерации: агент пишет детерминированные парсеры, а не LLM парсит страницы вживую (oб этом, кстати, еще буду писать, stay tuned).
3🔥64❤19👍4🦄4❤🔥2👏2
За последнее время меня дважды позвали фильтровать чужую работу: судьей на Webby Awards - международную премию, которую пресса прозвала "Оскаром интернета", и в программный комитет Ontico - тех самых, что делают HighLoad++ и другие топовые конференции.
Оба раза соглашался несмотря на то, что это доп нагрузка к основной работе. Ни разу не пожалел, потому что позиция фильтра дает то, чего нет ни в одной ленте: сырой поток от индустрии, возможность поработать с другими крутыми экспертами в программном комитете и посмотреть на индустриальный ландшафт шире.
В потоке Webby проходных работ десятки, алмазы редки - и почти всегда это работы, за которыми виден автор, а не инструмент. Позже мое ощущение подтвердил их же тренд-репорт, назвав это парадоксом доверия: AI используют все, но чужому AI не доверяет никто.
В заявках Agentic Dev Conf, куда мы с программным комитетом отбирали доклады, тот же парадокс, только с другой стороны: доверие к агентам не спускается стратегией сверху - оно строится руками и обычно снизу вверх. Поэтому маленькие команды владеют агентами на уровне, до которого корпорациям далеко: энтузиаст приручает инструмент, тащит в команду, команда - в компанию. Под это в программе даже выделили отдельную секцию - Tiny Teams: один-два инженера с парком агентов закрывают весь путь от идеи до релиза.
Конфа уже сегодня, кстати, среди спикеров будет Коля Шейко, а Тимур и Костя будут на круглом столе.
Конференция компактная, каждый доклад прошел плотный отбор - если будет возможность посмотреть онлайн или в записи, наверняка найдете свое: agenticdevconf.ru
Это не реклама (по крайней мере не платная, хехе) - скорее запоздалый пост в поддержку классных авторов и докладов) И, надеюсь, ребята из Онтико позже выложат хотя бы часть в паблик - потому что есть прям топовые доклады, полезные для индустрии.
Оба раза соглашался несмотря на то, что это доп нагрузка к основной работе. Ни разу не пожалел, потому что позиция фильтра дает то, чего нет ни в одной ленте: сырой поток от индустрии, возможность поработать с другими крутыми экспертами в программном комитете и посмотреть на индустриальный ландшафт шире.
В потоке Webby проходных работ десятки, алмазы редки - и почти всегда это работы, за которыми виден автор, а не инструмент. Позже мое ощущение подтвердил их же тренд-репорт, назвав это парадоксом доверия: AI используют все, но чужому AI не доверяет никто.
В заявках Agentic Dev Conf, куда мы с программным комитетом отбирали доклады, тот же парадокс, только с другой стороны: доверие к агентам не спускается стратегией сверху - оно строится руками и обычно снизу вверх. Поэтому маленькие команды владеют агентами на уровне, до которого корпорациям далеко: энтузиаст приручает инструмент, тащит в команду, команда - в компанию. Под это в программе даже выделили отдельную секцию - Tiny Teams: один-два инженера с парком агентов закрывают весь путь от идеи до релиза.
Конфа уже сегодня, кстати, среди спикеров будет Коля Шейко, а Тимур и Костя будут на круглом столе.
Конференция компактная, каждый доклад прошел плотный отбор - если будет возможность посмотреть онлайн или в записи, наверняка найдете свое: agenticdevconf.ru
Это не реклама (по крайней мере не платная, хехе) - скорее запоздалый пост в поддержку классных авторов и докладов) И, надеюсь, ребята из Онтико позже выложат хотя бы часть в паблик - потому что есть прям топовые доклады, полезные для индустрии.
2❤18👍17🔥12🥰3
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Anthropic выпустила Claude Sonnet 5 - близок к Opus 4.8, 1M, промо-цена, но новый токенизатор делает модель более прожорливой.
- США сняли экспортные ограничения: Fable 5 вернулась глобально (до 7 июля включена в подписки).
- Anthropic запустила Claude Science для ученых и программу AI drug discovery.
- Meta показала Brain2Qwerty v2: неинвазивное чтение печатаемого текста из мозга через MEG-шлем, 61% точности, код и датасет открыты.
- Anthropic обсуждает с Samsung производство собственного inference-чипа на 2-нм техпроцессе.
- OpenAI показала клавиатуру Codex Micro (детали 15 июля).
- OpenAI обсуждает передачу правительству США 5% акций (≈$42 млрд).
- Google выкатила Nano Banana 2 Lite - самую быструю и дешевую image-модель линейки, и Gemini Omni Flash - генерация и правка видео текстом по $0.10 за сек.
- Hardware-событие недели: Etched вышла из стелса с $800 млн инвестиций и $1 млрд+ заказов до первых поставок - вызов Nvidia со специализированным железом под инференс.
- Meituan (да, доставка еды) выпустила LongCat-2.0: MoE на 1.6 трлн параметров (48B активных), обучена целиком на 50 тысячах китайских чипов.
- Meta строит облачный бизнес на избыточных AI-мощностях.
- При этом Meta тайно гоняла внутренние сервисы на Gemini вместо своих Llama - и Google отрубил доступ за превышение лимитов.
- По данным The Information OpenAI нашла способ срезать затраты на инференс ChatGPT более чем вдвое.
- NotebookLM показал Short Video Overviews: вертикальные ролики в стиле TikTok из загруженных материалов.
- Cursor выпустил приложение для iOS.
- Microsoft создает AI-интегратора Frontier Company за $2.5 млрд, и AWS вкладывает $1 млрд в похожий Forward Deployed Engineering.
- Alibaba запретила сотрудникам Claude Code: в нем нашли код, определяющий, находится ли пользователь в Китае.
- Cloudflare разделит AI-краулеры на три типа (поиск, агенты, обучение): с 15 сентября обучение и агентный доступ на новых сайтах с рекламой блокируются по умолчанию, издатели смогут брать плату за контент.
- Unit 42 описала Phantom Squatting: хакеры регистрируют домены, которые галлюцинируют LLM, и жертву на фишинг приводит сама модель. Уже 13+ тысяч вредоносных URL.
- Исследование Ramp по 21 тыс компаний: интенсивные AI-траты коррелируют с ростом найма (+10%), включая джунов (+12%).
- Роботы дешевеют: UBTech показала "эмоциональных" гуманоидов от $15 тысяч , а обзор Rise of the Cheap Robots описывает волну general-purpose роботов дешевле $10 тысяч.
- DeepSeek заопенсорсил DeepSpec - стек спекулятивного ускорения инференса: в проде V4 Flash и Pro генерируют на 60-85% быстрее.
- Mistral выпустила Leanstral 1.5 (Apache 2.0) для формальной верификации: сатурировала miniF2F и нашла 5 неизвестных багов в проверенных репозиториях.
- xAI запустила Voice Agent Builder: no-code голосовые агенты на Grok по $0.05/мин.
- Tau - образовательный agent-харнесс, чтобы понять устройство агентов изнутри.
- audio.cpp - локальные аудиомодели на C++/ggml: очень оптимизировано.
- PyMuPDF 1.28 научился собирать PDF из Markdown с контролем вида через CSS - удобно для документных пайплайнов.
- Rampart - in-browser модель на 15MB, для детекции и маскировки персональныx данныx.
- Команда SGLang про то как превращает агентные workflow в переиспользуемые SKILL.md и debugging playbooks.
- WebKit выпустил Safari MCP (наконец можно ловить Safari баги агентом).
- 👍Детальный гайд по production-ready coding-агенту на полностью локальном стеке.
- 🤩 Z.ai выкатила свой агентный апп ZCode 3.0 - а-ля Codex на базе GLM (и других моделей, включая опенаи и антропик), есть управление через Telegram.
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Anthropic выпустила Claude Sonnet 5 - близок к Opus 4.8, 1M, промо-цена, но новый токенизатор делает модель более прожорливой.
- США сняли экспортные ограничения: Fable 5 вернулась глобально (до 7 июля включена в подписки).
- Anthropic запустила Claude Science для ученых и программу AI drug discovery.
- Meta показала Brain2Qwerty v2: неинвазивное чтение печатаемого текста из мозга через MEG-шлем, 61% точности, код и датасет открыты.
- Anthropic обсуждает с Samsung производство собственного inference-чипа на 2-нм техпроцессе.
- OpenAI показала клавиатуру Codex Micro (детали 15 июля).
- OpenAI обсуждает передачу правительству США 5% акций (≈$42 млрд).
- Google выкатила Nano Banana 2 Lite - самую быструю и дешевую image-модель линейки, и Gemini Omni Flash - генерация и правка видео текстом по $0.10 за сек.
- Hardware-событие недели: Etched вышла из стелса с $800 млн инвестиций и $1 млрд+ заказов до первых поставок - вызов Nvidia со специализированным железом под инференс.
- Meituan (да, доставка еды) выпустила LongCat-2.0: MoE на 1.6 трлн параметров (48B активных), обучена целиком на 50 тысячах китайских чипов.
- Meta строит облачный бизнес на избыточных AI-мощностях.
- При этом Meta тайно гоняла внутренние сервисы на Gemini вместо своих Llama - и Google отрубил доступ за превышение лимитов.
- По данным The Information OpenAI нашла способ срезать затраты на инференс ChatGPT более чем вдвое.
- NotebookLM показал Short Video Overviews: вертикальные ролики в стиле TikTok из загруженных материалов.
- Cursor выпустил приложение для iOS.
- Microsoft создает AI-интегратора Frontier Company за $2.5 млрд, и AWS вкладывает $1 млрд в похожий Forward Deployed Engineering.
- Alibaba запретила сотрудникам Claude Code: в нем нашли код, определяющий, находится ли пользователь в Китае.
- Cloudflare разделит AI-краулеры на три типа (поиск, агенты, обучение): с 15 сентября обучение и агентный доступ на новых сайтах с рекламой блокируются по умолчанию, издатели смогут брать плату за контент.
- Unit 42 описала Phantom Squatting: хакеры регистрируют домены, которые галлюцинируют LLM, и жертву на фишинг приводит сама модель. Уже 13+ тысяч вредоносных URL.
- Исследование Ramp по 21 тыс компаний: интенсивные AI-траты коррелируют с ростом найма (+10%), включая джунов (+12%).
- Роботы дешевеют: UBTech показала "эмоциональных" гуманоидов от $15 тысяч , а обзор Rise of the Cheap Robots описывает волну general-purpose роботов дешевле $10 тысяч.
- DeepSeek заопенсорсил DeepSpec - стек спекулятивного ускорения инференса: в проде V4 Flash и Pro генерируют на 60-85% быстрее.
- Mistral выпустила Leanstral 1.5 (Apache 2.0) для формальной верификации: сатурировала miniF2F и нашла 5 неизвестных багов в проверенных репозиториях.
- xAI запустила Voice Agent Builder: no-code голосовые агенты на Grok по $0.05/мин.
- Tau - образовательный agent-харнесс, чтобы понять устройство агентов изнутри.
- audio.cpp - локальные аудиомодели на C++/ggml: очень оптимизировано.
- PyMuPDF 1.28 научился собирать PDF из Markdown с контролем вида через CSS - удобно для документных пайплайнов.
- Rampart - in-browser модель на 15MB, для детекции и маскировки персональныx данныx.
- Команда SGLang про то как превращает агентные workflow в переиспользуемые SKILL.md и debugging playbooks.
- WebKit выпустил Safari MCP (наконец можно ловить Safari баги агентом).
- 👍Детальный гайд по production-ready coding-агенту на полностью локальном стеке.
- 🤩 Z.ai выкатила свой агентный апп ZCode 3.0 - а-ля Codex на базе GLM (и других моделей, включая опенаи и антропик), есть управление через Telegram.
3❤40🔥32👍21🎉1
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- OpenAI выпустила семейство GPT-5.6: Sol под кодинг и агентов, Terra на каждый день, Luna дешевая, у всех миллион контекста. Из нового - режим ultra и Programmatic Tool Calling.
- OpenAI выкатила GPT-Live - модель слушает и говорит одновременно, держит паузы и перебивания.
- Meta выпустила Muse Spark 1.1 и открыла Meta Model API: агентная модель под кодинг и управление компьютером, контекст 1 млн токенов, веса закрыты.
- Meta также запустила Muse Image и превью Muse Video - генерация и редактирование изображений, уже в Meta AI, Instagram и WhatsApp.
- SpaceXAI выкатила Grok 4.5 - обучена совместно с Cursor на реальных сессиях разработчиков, класс Opus, но дешевле и быстрее.
- OpenAI запустила ChatGPT Work - ответ Claude Cowork, туда же переехал Codex. Заодно OpenAI закрывает браузер Atlas.
- Anthropic вывела Claude Cowork на web и мобильные: работа продолжается в фоне при закрытом ноуте. 90%+ использования - не кодинг, а knowledge work.
- В Claude Code завезли встроенный браузер на десктопе и команду
- Anthropic нашла в моделях J-space - пространство, где модель держит мысли, не озвучивая их. Отключаешь его - пропадает многошаговое рассуждение.
- Apple подала в суд на OpenAI за кражу коммерческой тайны.
- Microsoft сокращает 4800 человек, из них 3200 в Xbox. Связывает это с AI-трансформацией.
- Nvidia запускает revenue-sharing: стартапы получают доступ к железу и кредиты в обмен на процент выручки.
- Vercel купила Better Auth. Интересна ставка на agent identity.
- Любопытная статья от Lenny про то как IT работники раскалываются на две группы - усиленные AI против выбитых им. Выгорание растет, оптимизм падает.
- Популярный тезис недели: конкуренция дальше решается данными, а не компьютом - юнит-экономикой их добычи и датасетами из физического мира.
- Tencent выложил Hy3 - MoE на 295B (21B активных), тягается с моделями в 2-5 раз больше. Apache 2.0, до 21 июля бесплатно на OpenRouter.
- Cognition (Devin) выпустила SWE-1.7 на базе Kimi K2.7: фронтир-уровень за $1.97 за задачу.
- ByteDance релизнула Seedream 5.0 Pro под коммерческий дизайн: инпэйнт, слои, хорошая работа с текстом.
- Anthropic показала экономику паттерна "дорогая модель оркестрирует, дешевые исполняют": 96% качества за 46% цены. Сообщество завернуло идею в pilotfish.
- Anthropic рассказала, как гонять Claude Fable на поиск "неизвестных" в проекте - дешевый способ вскрыть проблемы до старта.
- TypeScript 7.0 переписанный на Go вышел - 8-12x ускорение на полных сборках.
- Microsoft открыл Flint - язык визуализации данных под агентов: 30+ типов диаграмм, рендер в Vega-Lite и ECharts, подключается через MCP.
- Cloudflare сделал Drop: перетащил папку в браузер - получил статический сайт.
- pxpipe (вышел еще в мае, разошелся сейчас из-за Fable) - прокси, который упаковывает редко меняющийся контекст в PNG перед отправкой в Claude Code - и т.к. картинка дешевле текста, цены сессии могут падать в 5-10 раз.
- В твиттере разошлись две подборки agent skills: 31 скилл под оркестрацию агентов, ресерч и ops, и 75 скиллов под дизайн, моушен и лендинги.
- OpenScience - опенсорсная альтернатива Claude Science: несколько моделей и 250+ скиллов.
- Dayflow - сам ведет журнал рабочего дня по тому, что было на экране.
- 👍 Boring Computers - поднять агенту vm компьютер, а потом уничтожить его. Быстрый и с удобным API.
- 🤩 Годный гайд - приватный медицинский ассистент целиком на своей машине на MedGemma, Ollama и Open WebUI.
- 🔥 Потрясающий технический разбор переезда Bun на Rust от автора Bun.
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- OpenAI выпустила семейство GPT-5.6: Sol под кодинг и агентов, Terra на каждый день, Luna дешевая, у всех миллион контекста. Из нового - режим ultra и Programmatic Tool Calling.
- OpenAI выкатила GPT-Live - модель слушает и говорит одновременно, держит паузы и перебивания.
- Meta выпустила Muse Spark 1.1 и открыла Meta Model API: агентная модель под кодинг и управление компьютером, контекст 1 млн токенов, веса закрыты.
- Meta также запустила Muse Image и превью Muse Video - генерация и редактирование изображений, уже в Meta AI, Instagram и WhatsApp.
- SpaceXAI выкатила Grok 4.5 - обучена совместно с Cursor на реальных сессиях разработчиков, класс Opus, но дешевле и быстрее.
- OpenAI запустила ChatGPT Work - ответ Claude Cowork, туда же переехал Codex. Заодно OpenAI закрывает браузер Atlas.
- Anthropic вывела Claude Cowork на web и мобильные: работа продолжается в фоне при закрытом ноуте. 90%+ использования - не кодинг, а knowledge work.
- В Claude Code завезли встроенный браузер на десктопе и команду
/checkup: диагностирует сетап, выпиливает неиспользуемые скиллы и MCP, дедуплицирует CLAUDE.md. В самом Claude тем временем появился Reflect - аналитика твоей работы с моделью, вплоть до оценки навыка делегирования задач.- Anthropic нашла в моделях J-space - пространство, где модель держит мысли, не озвучивая их. Отключаешь его - пропадает многошаговое рассуждение.
- Apple подала в суд на OpenAI за кражу коммерческой тайны.
- Microsoft сокращает 4800 человек, из них 3200 в Xbox. Связывает это с AI-трансформацией.
- Nvidia запускает revenue-sharing: стартапы получают доступ к железу и кредиты в обмен на процент выручки.
- Vercel купила Better Auth. Интересна ставка на agent identity.
- Любопытная статья от Lenny про то как IT работники раскалываются на две группы - усиленные AI против выбитых им. Выгорание растет, оптимизм падает.
- Популярный тезис недели: конкуренция дальше решается данными, а не компьютом - юнит-экономикой их добычи и датасетами из физического мира.
- Tencent выложил Hy3 - MoE на 295B (21B активных), тягается с моделями в 2-5 раз больше. Apache 2.0, до 21 июля бесплатно на OpenRouter.
- Cognition (Devin) выпустила SWE-1.7 на базе Kimi K2.7: фронтир-уровень за $1.97 за задачу.
- ByteDance релизнула Seedream 5.0 Pro под коммерческий дизайн: инпэйнт, слои, хорошая работа с текстом.
- Anthropic показала экономику паттерна "дорогая модель оркестрирует, дешевые исполняют": 96% качества за 46% цены. Сообщество завернуло идею в pilotfish.
- Anthropic рассказала, как гонять Claude Fable на поиск "неизвестных" в проекте - дешевый способ вскрыть проблемы до старта.
- TypeScript 7.0 переписанный на Go вышел - 8-12x ускорение на полных сборках.
- Microsoft открыл Flint - язык визуализации данных под агентов: 30+ типов диаграмм, рендер в Vega-Lite и ECharts, подключается через MCP.
- Cloudflare сделал Drop: перетащил папку в браузер - получил статический сайт.
- pxpipe (вышел еще в мае, разошелся сейчас из-за Fable) - прокси, который упаковывает редко меняющийся контекст в PNG перед отправкой в Claude Code - и т.к. картинка дешевле текста, цены сессии могут падать в 5-10 раз.
- В твиттере разошлись две подборки agent skills: 31 скилл под оркестрацию агентов, ресерч и ops, и 75 скиллов под дизайн, моушен и лендинги.
- OpenScience - опенсорсная альтернатива Claude Science: несколько моделей и 250+ скиллов.
- Dayflow - сам ведет журнал рабочего дня по тому, что было на экране.
- 👍 Boring Computers - поднять агенту vm компьютер, а потом уничтожить его. Быстрый и с удобным API.
- 🤩 Годный гайд - приватный медицинский ассистент целиком на своей машине на MedGemma, Ollama и Open WebUI.
- 🔥 Потрясающий технический разбор переезда Bun на Rust от автора Bun.
4🔥40👍16❤15🎉1🙏1
This media is not supported in your browser
VIEW IN TELEGRAM
NameThatUI: словарь вместо "сделай красиво"
Год назад я писал, что почти все AI-фронтенды выглядят как близнецы. Модели с тех пор заметно прокачались в дизайне, но почему все еще так много UI-слопа? Потому что "сделай красиво" все так же не работает, надо вникать и хорошо доносить что именно тебе нужно.
Сегодня про пару тулов, которые как раз про это. Главный герой - NameThatUI, визуальный словарь UI.
Работает так: описываешь штуку как получится - "темный полупрозрачный слой за попапом" и получаешь ее настоящее имя (scrim), анатомию с названием каждой части, имя в коде и готовый промпт для агента. Плюс отдельный debug-промпт: список типовых фейлов, которые стоит исключить первыми - "cmd+K листенер висит не на том скоупе, фокус утекает из диалога". Или даже не описываешь, а просто видишь, что тебе нужно, и используешь правильные термины.
Отдельный раздел - атлас стилей. Glassmorphism vs neubrutalism, 3-5 признаков каждого стиля и готовый бриф для агента. Пока еще молодой, будет пополняться.
Та же механика есть и уровнем выше - 21st.dev: каталог блоков веб-страницы. Heroes, calls to action, FAQs, футеры - у каждого блока живое превью, вариации и кнопка "Copy prompt" + хорошая интеграция с агентами.
Мне кажется, это хороший паттерн: инструменты, которые образовывают в процессе использования, позволяют направлять правильно, вместо того чтобы слепо отдавать на откуп агенту.
🔥 ➕ 🔁 @nobilix
Год назад я писал, что почти все AI-фронтенды выглядят как близнецы. Модели с тех пор заметно прокачались в дизайне, но почему все еще так много UI-слопа? Потому что "сделай красиво" все так же не работает, надо вникать и хорошо доносить что именно тебе нужно.
Сегодня про пару тулов, которые как раз про это. Главный герой - NameThatUI, визуальный словарь UI.
Работает так: описываешь штуку как получится - "темный полупрозрачный слой за попапом" и получаешь ее настоящее имя (scrim), анатомию с названием каждой части, имя в коде и готовый промпт для агента. Плюс отдельный debug-промпт: список типовых фейлов, которые стоит исключить первыми - "cmd+K листенер висит не на том скоупе, фокус утекает из диалога". Или даже не описываешь, а просто видишь, что тебе нужно, и используешь правильные термины.
Отдельный раздел - атлас стилей. Glassmorphism vs neubrutalism, 3-5 признаков каждого стиля и готовый бриф для агента. Пока еще молодой, будет пополняться.
Та же механика есть и уровнем выше - 21st.dev: каталог блоков веб-страницы. Heroes, calls to action, FAQs, футеры - у каждого блока живое превью, вариации и кнопка "Copy prompt" + хорошая интеграция с агентами.
Мне кажется, это хороший паттерн: инструменты, которые образовывают в процессе использования, позволяют направлять правильно, вместо того чтобы слепо отдавать на откуп агенту.
🔥 ➕ 🔁 @nobilix
6🔥66❤15👍11🤩3🥰1