Боб Мартин, автор «Чистого кода», уже несколько месяцев не проверяет код за агентами.
Объяснял он это тем, что умеет в автоматические ограничения и проверки: спеки, линтеры, измерение цикломатической сложности, разные виды автотестов, вот это вот всё.
Теперь он засомневался, нужны ли современным агентам такие строгие ограничения вообще. Говорит, модели стали астрономически лучше.
Если уже и дядя Боб (вслед за Андреем Мелиховым) движется от SDD к вайбкодингу, не пора ли готовиться к тому, что через полгодика будем разбирать мультиагентные пайплайны, которые сейчас многие активно строят?
@devspotting
Объяснял он это тем, что умеет в автоматические ограничения и проверки: спеки, линтеры, измерение цикломатической сложности, разные виды автотестов, вот это вот всё.
Теперь он засомневался, нужны ли современным агентам такие строгие ограничения вообще. Говорит, модели стали астрономически лучше.
Если уже и дядя Боб (вслед за Андреем Мелиховым) движется от SDD к вайбкодингу, не пора ли готовиться к тому, что через полгодика будем разбирать мультиагентные пайплайны, которые сейчас многие активно строят?
@devspotting
X (formerly Twitter)
Uncle Bob Martin (@unclebobmartin) on X
I’m significantly older than you. I started coding in the late 60s. My current strategy is to not read any of the code written by my agents. That’s the only way I can take advantage of their produ…
👍17
OpenAI дропнули новенькую ChatGPT Images 2.5
Лучше сохраняет исходники (например, лица людей), лучшее умеет в логотипы и прочий дизайн, а заодно в 4 раза быстрее.
Ну что, дизайнеры, добро пожаловать в клуб? :)
@devspotting
Лучше сохраняет исходники (например, лица людей), лучшее умеет в логотипы и прочий дизайн, а заодно в 4 раза быстрее.
Ну что, дизайнеры, добро пожаловать в клуб? :)
@devspotting
OpenAI
The new ChatGPT Images is here
The new ChatGPT Images is powered by our flagship image generation model, delivering more precise edits, consistent details, and image generation up to 4× faster. The upgraded model is rolling out to all ChatGPT users today and is also available in the API…
🔥12😁3❤1
В новом выпуске «ИИ — не новостей» с Сергеем @veged Бережным разбирались, как так вышло, что исследователи ИИ-агентов приходят к противоположным выводам (и почему оба правы).
А еще:
— Почему одна и та же нейронка сначала уверенно говорит, что задача не решается, а потом сама чинит её за 20 минут — и почему иногда «сделай хорошо» работает лучше подробной инструкции?
— Когда высокий reasoning помогает, а когда модель начинает сомневаться, ходить кругами и просто жечь токены?
— Почему AI-разработку почти невозможно нормально забенчмаркать и как работать в мире, где сегодняшняя best practice через две недели может оказаться анти-паттерном?
— И заодно: неужели нейронки всё-таки научились шутить?
Поставьте лайк, поделитесь видео с друзьями!
Приятного просмотра (или прослушивания, если вы слушаете нас на вашем любимом стриминге)!
@devspotting
А еще:
— Почему одна и та же нейронка сначала уверенно говорит, что задача не решается, а потом сама чинит её за 20 минут — и почему иногда «сделай хорошо» работает лучше подробной инструкции?
— Когда высокий reasoning помогает, а когда модель начинает сомневаться, ходить кругами и просто жечь токены?
— Почему AI-разработку почти невозможно нормально забенчмаркать и как работать в мире, где сегодняшняя best practice через две недели может оказаться анти-паттерном?
— И заодно: неужели нейронки всё-таки научились шутить?
Поставьте лайк, поделитесь видео с друзьями!
Приятного просмотра (или прослушивания, если вы слушаете нас на вашем любимом стриминге)!
@devspotting
YouTube
AI-агенты: почему лучшие практики противоречат друг другу | ИИ — не новости
— Почему одна и та же нейронка сначала уверенно говорит, что задача не решается, а потом сама чинит её за 20 минут — и почему иногда «сделай хорошо» работает лучше подробной инструкции?
— Одна дорогая модель или умный оркестратор и рой дешёвых агентов: как…
— Одна дорогая модель или умный оркестратор и рой дешёвых агентов: как…
👍12🔥4
Разработка будущего
15 октября выступаю в Питере на Разработке будущего (отдельный день в рамках Joker).
Расскажу, как заставить агентов создавать интерфейсы по гайдам, как разработать дизайн-систему, если в команде нет дизайнера и как сохранить консистентность на больших проектах.
Организаторы констатируют, что эпоха конференций про «лучшие практики» закончилась и перепридумывают подход. Мы как раз обсуждали это с Лешей Федеровым в свежем выпуске «Гриненко про».
Состав участников получился достаточно непохожим на конференции, где я обычно выступаю — см. скриншот в посте.
Конференция платная, но ребята подогнали промокод на персональные билеты для читателей моего канала:
Так что определенно будет интересно, буду рад встретиться!
@devspotting
15 октября выступаю в Питере на Разработке будущего (отдельный день в рамках Joker).
Расскажу, как заставить агентов создавать интерфейсы по гайдам, как разработать дизайн-систему, если в команде нет дизайнера и как сохранить консистентность на больших проектах.
Организаторы констатируют, что эпоха конференций про «лучшие практики» закончилась и перепридумывают подход. Мы как раз обсуждали это с Лешей Федеровым в свежем выпуске «Гриненко про».
Разработка будущего — это конференция для тех, кто уже прошёл восторг от агентов и понял, что узкое место не в моделях и не тулинге вокруг них, а в человеке по эту сторону промпта.
Состав участников получился достаточно непохожим на конференции, где я обычно выступаю — см. скриншот в посте.
Конференция платная, но ребята подогнали промокод на персональные билеты для читателей моего канала:
devspottingТак что определенно будет интересно, буду рад встретиться!
@devspotting
👍13🔥5
Недавно рассказывал, что указание агенту задавать недостающие вопросы может сильно повысить эффективность работы со спецификациями.
Но тут вышла статья IdeaAMBIG: Benchmarking Implementation-Critical Gaps in Research-Idea Specifications, где исследователи проверили способность моделей устранять критичные неоднозначности.
TL;DR для тех, кто не пойдет читать статью: пока что LLM с этим справляются так себе.
Агент может бесконечно задавать вопросы (иногда очень хорошие), но плохо понимает, какие из них действительно важны. Тогда как устранение неопределенностей принципиально влияет на результат — доля готовых к реализации спецификаций растет с 14% до 98% (в статье есть еще несколько подтверждающих тезис метрик).
Поэтому там, где важно получить полную спеку, есть смысл вместо «если постановка неоднозначна — сначала задай уточняющий вопрос» использовать что-то в духе:
И, возможно, стоит выделять на эту проверку отдельную роль рисерчера, чтобы избежать байаса у агента-исполнителя.
@devspotting
Но тут вышла статья IdeaAMBIG: Benchmarking Implementation-Critical Gaps in Research-Idea Specifications, где исследователи проверили способность моделей устранять критичные неоднозначности.
TL;DR для тех, кто не пойдет читать статью: пока что LLM с этим справляются так себе.
Агент может бесконечно задавать вопросы (иногда очень хорошие), но плохо понимает, какие из них действительно важны. Тогда как устранение неопределенностей принципиально влияет на результат — доля готовых к реализации спецификаций растет с 14% до 98% (в статье есть еще несколько подтверждающих тезис метрик).
Поэтому там, где важно получить полную спеку, есть смысл вместо «если постановка неоднозначна — сначала задай уточняющий вопрос» использовать что-то в духе:
Перечисли методологические решения, которые придётся принять при реализации. Для каждого укажи, следует ли решение однозначно из доступных требований. Если нет — укажи, какой информации не хватает и каким вопросом или поиском её можно получить. Не приступай к реализации, пока все пробелы не устранены.
И, возможно, стоит выделять на эту проверку отдельную роль рисерчера, чтобы избежать байаса у агента-исполнителя.
@devspotting
1👍13🔥4❤2
But I'm likely human after all
I'm likely human after all
Don't put your blame on me
Don't put your blame on me
@devspotting
I'm likely human after all
Don't put your blame on me
Don't put your blame on me
@devspotting
😁9👍6❤3
Шестой выпуск «ИИ — не новостей» уже на Ютубе (или на ваших любимых стримингах).
На этот раз мы с Сергеем @veged_and_code Бережным разбирались с нейродизайном.
Обсудили:
— как обеспечить консистентность генеренки через ограничения
— почему старый-добрый компонентный подход все еще рулит
— как избавиться от слопа с помощью мудбордов и ImageGen
и что такое Spec-Driven Development для дизайнеров.
Поставьте лайк, поделитесь видео с друзьями и сами не забывайте подписаться, чтобы не пропустить новые не новости!
@devspotting
На этот раз мы с Сергеем @veged_and_code Бережным разбирались с нейродизайном.
Обсудили:
— как обеспечить консистентность генеренки через ограничения
— почему старый-добрый компонентный подход все еще рулит
— как избавиться от слопа с помощью мудбордов и ImageGen
и что такое Spec-Driven Development для дизайнеров.
Поставьте лайк, поделитесь видео с друзьями и сами не забывайте подписаться, чтобы не пропустить новые не новости!
@devspotting
YouTube
AI-дизайн без нейрослопа: Pixel Perfect, скиллы и дизайн-системы | ИИ — не новости
Обсуждаем дизайн через ограничения вместо промптов, компоненты в мире дешёвой генерации кода, мудборды и ImageGen, консистентность AI-графики и то, нужен ли дизайну собственный Spec-Driven Development.
— Почему топовые AI-модели уже способны сделать вполне…
— Почему топовые AI-модели уже способны сделать вполне…
👍9🔥2
На OpenRouter очередная бесплатная стелс-модель — Union Alpha.
UPD: лавочка закрылась, модель оказалась роутером над неизвестным набором чужих моделей.
Заточена под агентную разработку, понимает картинки на вход.
Результаты неофициальных прогонов Terminal-Bench лучше GPT-5.6 Sol и очень близки к Claude Opus 5 (но верить им пока рановато).
Вероятно, очередная Kimi или GLM.
Традиционно для стелс-моделей инференс медленный, а провайдер может сохранять запросы. Если это не пугает — есть смысл попробовать.
@devspotting
UPD: лавочка закрылась, модель оказалась роутером над неизвестным набором чужих моделей.
Заточена под агентную разработку, понимает картинки на вход.
Результаты неофициальных прогонов Terminal-Bench лучше GPT-5.6 Sol и очень близки к Claude Opus 5 (но верить им пока рановато).
Вероятно, очередная Kimi или GLM.
Традиционно для стелс-моделей инференс медленный, а провайдер может сохранять запросы. Если это не пугает — есть смысл попробовать.
@devspotting
openrouter.ai
Union Alpha - API Pricing & Providers
Union Alpha is a multimodal model built for research, coding, and agentic workflows, while delivering frontier-level performance across a broad range of general-purpose tasks. 262,144 token context window.
🔥6❤4👍3
Аркадий, а что мы ускорили?
Помните Аркадия, которого мы просили убрать руки с клавиатуры?
Допустим, Аркадий справился. Перестал лично вайбкодить каждую задачу, выдал команде агентов и теперь смотрит на результаты: пулл-реквестов стало больше, однако фичи до пользователей быстрее не доезжают.
Как же так-то? А задача три дня ждала уточнения требований, потом неделю лежала на ревью, а потом выяснилось, что смежники вообще планировали другое.
Зато код сгенерили, пока играли в падел.
Как раз про это будет Avito.Tech.Conf 26 сентября, о которой я уже рассказывал: как меняется сетап команды с AI-агентами и как на практике расти без роста штата.
Можно прийти со своей историей про «код ускорили, а дальше что?» — на конференции будет мастермайнд с разбором управленческих проблем.
Участие бесплатное, офлайн в Москве в AG Loft или онлайн с трансляцией докладов. Если узнали в Аркадии себя или свою команду — регистрация здесь.
@devspotting
Помните Аркадия, которого мы просили убрать руки с клавиатуры?
Допустим, Аркадий справился. Перестал лично вайбкодить каждую задачу, выдал команде агентов и теперь смотрит на результаты: пулл-реквестов стало больше, однако фичи до пользователей быстрее не доезжают.
Как же так-то? А задача три дня ждала уточнения требований, потом неделю лежала на ревью, а потом выяснилось, что смежники вообще планировали другое.
Зато код сгенерили, пока играли в падел.
Как раз про это будет Avito.Tech.Conf 26 сентября, о которой я уже рассказывал: как меняется сетап команды с AI-агентами и как на практике расти без роста штата.
Можно прийти со своей историей про «код ускорили, а дальше что?» — на конференции будет мастермайнд с разбором управленческих проблем.
Участие бесплатное, офлайн в Москве в AG Loft или онлайн с трансляцией докладов. Если узнали в Аркадии себя или свою команду — регистрация здесь.
@devspotting
👍6🔥3❤2👌2
#ГриненкоПро №25 с Анастасией Бианко, руководителем отдела подбора персонала в Циан
https://www.youtube.com/watch?v=i2fExyLLke4
Обсудили что происходит на рынке IT, судьбу джунов, фальсификации опыта, автоматизацию найма, AI-интервью и что повышает шансы кандидата.
В выпуске:
— почему кандидатов стало так много, а дефицит сильных специалистов при этом никуда не исчез
— как работодатели распознают накрученный и полностью выдуманный опыт
— почему рекомендации, профессиональная репутация и прямой контакт с компанией снова важны
— что произошло с наймом джунов и почему от студентов теперь ждут гораздо большего
— нужно ли указывать конкретный стек, если с нейронкой можно быстро освоить новую технологию
— как Циан использует ИИ для фильтрации резюме и интервью со стажёрами
— какие AI-навыки уже стали гигиеническим минимумом для кандидата
— заменит ли ИИ рекрутеров и как может выглядеть автоматизированный найм ближайшего будущего
— почему компании пока продолжают нанимать роли, а не «универсальных продуктовых инженеров»
— чем культура найма в Циан отличается от Яндекса
Ставьте лайки, делитесь с друзьями, приходите обсудить в чате сообщества: @grinenko_pro
Приятного просмотра!
@devspotting
https://www.youtube.com/watch?v=i2fExyLLke4
Обсудили что происходит на рынке IT, судьбу джунов, фальсификации опыта, автоматизацию найма, AI-интервью и что повышает шансы кандидата.
В выпуске:
— почему кандидатов стало так много, а дефицит сильных специалистов при этом никуда не исчез
— как работодатели распознают накрученный и полностью выдуманный опыт
— почему рекомендации, профессиональная репутация и прямой контакт с компанией снова важны
— что произошло с наймом джунов и почему от студентов теперь ждут гораздо большего
— нужно ли указывать конкретный стек, если с нейронкой можно быстро освоить новую технологию
— как Циан использует ИИ для фильтрации резюме и интервью со стажёрами
— какие AI-навыки уже стали гигиеническим минимумом для кандидата
— заменит ли ИИ рекрутеров и как может выглядеть автоматизированный найм ближайшего будущего
— почему компании пока продолжают нанимать роли, а не «универсальных продуктовых инженеров»
— чем культура найма в Циан отличается от Яндекса
Ставьте лайки, делитесь с друзьями, приходите обсудить в чате сообщества: @grinenko_pro
Приятного просмотра!
@devspotting
YouTube
Как найти работу в IT в 2026 | Анастасия Бианко, руководитель отдела подбора персонала в Циан
Telegram-канал — https://t.me/devspotting
Чат сообщества — https://t.me/grinenko_pro
Рынок IT сегодня: на вакансии приходят десятки и сотни откликов, кандидаты генерируют резюме и проходят интервью с нейронками, а работодатели отвечают AI-скринингом и а…
Чат сообщества — https://t.me/grinenko_pro
Рынок IT сегодня: на вакансии приходят десятки и сотни откликов, кандидаты генерируют резюме и проходят интервью с нейронками, а работодатели отвечают AI-скринингом и а…
❤6🔥3👍2👎1👏1