AI Makes Me Hate
567 subscribers
81 photos
11 videos
4 files
92 links
AI systems engineer и скептический практик, который проверяет и внедряет AI на реальных задачах разработки
Download Telegram
Нейроревью

С ним у нас прям проблема. Вот мы сделали харнессы, скиллы и тп для генерации кода. А как проверять и ревьють код? С ревью вот список:
- много конфликтных нейроревью роботов
- мало экспертизы в сервисах
- много "мусорных" комментов от залетных ревьюеров

Из идей конечно делать больше нейроревью разгружая рутину с плеч разрабов.

Например:
- Если нейроревьюер поставил ок, обращаться к любому доступному ревьюеру с просьбой поставить шип.
- Разрешить стики шпи, но сделать обязательной проверку в кубике, подтверждающую запуск ревью-скилла.
- Перед установкой стики шипа проверять, что нейроревью пройдено с помощью скилла

Из еще одних идей это давать больше осмысленности описанию реквеста. Чтобы ревьюерам было проще погружаться в контекст. Ребята дали вот пост с рабочей методикой.

Поделитесь как у вас меняется подход в эру агентов?
Forwarded from Laconic
❤2
так, в следующую пятницу буду давать урок по азам нейросетей для школьников. И наверное неправильно будет навязывать чатгпт и клауд в гос учреждении

о каких китайских моделях не стыдно говорить? и вообще дешевые ли они все еще?
👎11
Если бы вы выступали перед школьниками, то какой главный совет бы дали для эффективного обучения в ит?
👎4
кстати у яндекса есть два бесплатных топовых курса

1️⃣ «ИИ и промптинг для студенческих проектов» если у вас есть дети, младшие братья/сестра
2️⃣ «ИИ и промптинг для научных руководителей» если у вас есть родственники преподы

Ваше наличие доступов к разным образовательным программам - это супер возможность прокачиваться быстрее. Когда-нибудь расскажу как у нас коллабятся с разными вузами чтоб ты рос быстрее.
👎9👍2
Forwarded from AI for Devs
⚡️ OpenClaw удалили 400 тысяч строк тестов, которые ничего не проверяли

Мы уже разбирали Caveman, rtk и Ponytail скиллы из серии статей от JetBrains. Первые два не дали обещанной экономии, а Ponytail действительно сократил и код, и расходы.

Нашёлся ещё один полезный скилл: test-audit от создателя OpenClaw Питера Штайнбергера.

Питер рассказал, что из проекта удалили около 400 тысяч строк тестов, а покрытие почти не изменилось. По его словам, модели любят писать тест на каждое мелкое изменение, даже когда пользы от него нет.


test-audit просит агента перед каждым новым тестом объяснить, какое поведение тот защищает, какую ошибку поймает и почему существующих проверок недостаточно.

@ai_for_devs
👍7
Вайбкодер дал агенту задачу проверить UX/UI модуля - но Codex чуть чуть перестарался, запустив 826 автономных агентов.

Итог - 2,1 триллиона токенов и $78,000 к оплате.

а вы спрашиваете зачем харнессы нужны?

https://news.ycombinator.com/item?id=49861047
😁5
😁5
Верите в CodeSpeak?

Инженеру-разработчику нужно понимать фундаментальные вещи про компьютеры и построение сложных систем. Думаю, что при обучении ещё долго будет полезно изучать программирование «вручную», чтобы формировалось более глубокое понимание того, как всё устроено. Так ещё совсем недавно многим студентам преподавали C, хотя очень малая доля из них сталкивалась потом с этим языком на работе.


https://education.yandex.ru/journal/codespeak
👎4😁4❤1👍1
Подборка полезных AI-инструментов, которые советуют

Продолжаем формировать аи насмотренность

1️⃣ Loop-режим в Claude Code

создатель Claude Code, показал /loop — агента внутри текущей сессии, который повторно запускает промпт по расписанию, проверяет состояние задачи и продолжает работать, пока не выполнится нужное условие.

Теперь можно поручить ему следить за PR: чинить CI, делать rebase и снова проверять статус. Сам Черни также использует лупы для борьбы с flaky-тестами и регулярной кластеризации фидбека.

2️⃣ mattpocock/skills

Коллекция из примерно 20 скилов от Мэтта Покока, автора Total TypeScript. Есть решения для TDD, спецификаций, доменного моделирования, код-ревью и «прожарки» плана

3️⃣ caveman

Скил с очень простой идеей: заставить Claude говорить максимально коротко. Он убирает вежливость, филлеры, артикли и лишние оговорки, но не трогает код и тексты ошибок.

Авторы заявляют экономию около 65 % выходных токенов, хотя в независимом тесте JetBrains выигрыш в агентных задачах оказался заметно скромнее — около 8,5 %.

4️⃣ archify

Инструмент превращает процессы, сценарии, код и автоматизации в графы. Полезно, когда нужно за пару минут объяснить команде, что происходит внутри сложного пайплайна — или показать окружающим, что именно вы навайбкодили.
👍1