Антоха Разраб про AI
389 subscribers
101 photos
5 videos
123 links
AI в реальной разработке. (ex. Android dev)
Агенты, тулзы, бенчмарки, архитектура, процессы и личные заметки из продакшена
3–5 постов в неделю от @Lamprof
Download Telegram
Отбирают работу даже у LoFI-girl!
❤3
Антоха Разраб про AI
К разговору о малых моделях. Пару недель назад гугл выложил Gemma 4 в открытый доступ и на малых весах <4b она афигенно работает на мобилках. Особенно, если у вас флагман. Гугл в своем стиле запихнул это в свежую приложеньку, где технарям можно потыкать-понастраивать…
Наверно из всех релизов этот самый удачный. Какое то ебически огромное количество инсталлов за первый же день. Фиксы первого дня все еще в пути ревью. Получил фидбек от первых пользователей о кривых отступах и первых проблемах

https://play.google.com/store/apps/details?id=com.lamprof.ai
🔥8
Антоха Разраб про AI
Я недавно пересел на opencode go, как дешевую альтернативу (за 5 баксов куча китайских моделек в любом harness + fallback для моего openclaw). Но то как часто кодекс сбрасывает лимиты конечно поражает
5 баксов подписки дает вам 60 баксов в токенах. Высадил я их бодро за 2 недели вообще без проблем. Треть всадил в https://github.com/code-yeongyu/oh-my-openagent. По сути CDD под капотом.

Качество на выходе хорошее даже на наборе из слабых китайских моделей. Локальная модель не встраивается вообще никак (слишком малое окно контекста)
👍3
Google обновляет Android Auto

Затаскивает большой патч и по чуть чуть раскатывает. Выглядит свежо, у меня MINI U25 и старая версия Android Auto выглядела как прямоугольник вписанный в круг, теперь растянут на весь экран хотя бы карту. Уже кайф

2026 год и AI функции даже в моей машине. Некоторые юзабельные - саджест что отправить в смске, например адрес куда едешь
Некоторые полная чушь: Спрашивать через gemini влезет ли очередной стол IKEA в мой багажник. (Конечно не влезет)
🔥6🤯1
Новые рекорды по скорости сжигания деняк. OpenClaw тратит ~$1.3M в месяц на AI токены (а их, блин, всего 6 человек)

Нахера?
“Как выглядела бы разработка ПО, если бы стоимость токенов почти не имела значения?”

Peter (разраб OpenClaw) в твиттере ответил:
👉 ~100 AI-агентов постоянно крутятся вокруг репозитория
👉 каждый PR автоматически ревьюится несколькими AI
👉 каждый commit проверяется на security/regressions
👉 AI ищет дубликаты issues и объединяет их
👉 AI находит старые баги, которые фиксит новый PR, и сам закрывает issue
👉 агенты поднимают временные VM, воспроизводят баги и записывают before/after видео
👉 AI слушает митинги и может начать делать PR прямо во время обсуждения фичи
👉 отдельные агенты мониторят perf benchmark’и и кидают алерты в Discord

попытка построить AI-native engineering organization, где AI не помогает писать код, а становится постоянным слоем поверх всего SDLC

Кажется, что индустрия реально движется именно туда.
Не “один умный чатик”, а десятки специализированных агентов, постоянно работающих вокруг проекта
🔥4👍1
Антоха Разраб про AI
Нашел удобную сеттилку SKILLS и конкретный скилл для Android https://skills.sh/alinaqi/claude-bootstrap/android-kotlin Зачем нужны эти скиллы в AI? - проактивное применение правил. Вам не надо переживать что вы забыли указать в контексте или в запросе информацию…
Большой разбор SKILLS из vas3k клуба. Пост публичный
Если вы все еще теряетесь зачем вам скилы, какие скилы добавить в проект - велкомен

👉 Глобальные скилы - только база типа как читать тот или иной файл
👉 Пишем маленькие атомарные скилы, а не гигантских монстров по всему проекту сразу
👉 Юзаем skill-creator, но ревьювим за ним. Вслепую получается фигня
👉 Оформляйте документацию как скилл
👉 Давайте SKILLS эволюционировать, закладывайте саморедактирование ибо ваш проект меняется, а значит должны меняться и скилы
👉 Не пихайте весь awesome-* репозиторий к себе в проект, получится пупа, съевшая контекст

Ну и лучшая рекомендация из статьи:

Если вы всё ещё читаете и до сих пор не поняли, что вам сейчас делать, — просто начните с малого.

Возьмите свой AGENTS.md, CLAUDE.md или папку с заметками по проекту и попросите skill-creator разложить это на несколько маленьких скиллов. Не «один скилл на всё», а отдельные навыки под конкретные действия: ревью, тесты, миграции, деплой, работу с API, оформление changelog.

Потом попробуйте автоматизировать одну рутину, которая бесит вас чаще всего. Не самую сложную. Самую повторяющуюся.
❤3👍1🔥1
State of AI 2026

Очевидно в этом году все больше людей использует AI. Все больше людей доверяет ему задачки по-объемнее. Много людей называют основным страхом, связанным с AI - Job displacement. Military use of AI и AI slop takeover на 2 и 4 месте

К сожалению, JB проебывает все полимеры в плане AI. Хотя больше людей подсаживаются на дорогие подписки.

Проблема качества кода с выходом мощных моделей ушла на второй план, а главная боль теперь - галлюцинации и неточности. На 4 месте ценник

Выводы?
It's the best of times, it’s the worst of times.


Антоха Разраб про AI
🔥3
Показали новую модельку от Google - Gemini 3.5 Flash

По бенчам уделывает Pro, а по цене в 3 раза выше прошлого Flash. Типо быстрая как вся линейка Flash моделей, но теперь и умная

Никто не обращает внимание на Knowledge cutoff - Jan 2025, значит полагаться на тулинг придется
👍4🔥2
Тут все жужжат по поводу copilot и нового прайсинга. В защиту GitHub скажу, что прошлые расценки были невероятно щедрыми. 3 токена за opus 4.6, при месячном лимите в 300(19$) и и 1000(39$) - буквально разадача деняк. Харнесс даже подтянули до приличного, что еще надо?

Раздача закончилась, но я думаю что бизнесы все-равно останутся на подписке с GitHub. Уж слишком много в экосистеме и лишняя 20ка на токены для своей команды - не велика потеря. В целом, тулз остается удобным fallback'ом, когда вы высадили почасовые лимиты в других подписках или нужна модель поменьше

Все еще единственное адекватное решение для кодревью и нормально интегрированный агент прям в вашу репу. Не с точки зрения разработки, а с точки зрения бизнеса и комплайенса
👍4
Гугл показывает Gemma 4 12b

Мелкая моделька, которая будет работать даже у вас на лаптопе. 16гб, говорят, достаточно 😏

Зачем? Ну тут и сам гугл теряется - просто потому что можно :)

Для кодинга она слишком слаба, для простого whisper/переводчика слишком умна. Можно взять модели меньше/шустрее.

Как бесплатная обучалка нейросетям? Хороший кейс, но использовать API, какого-нибудь Deepseek v4 lite будет куда более продуктивнее

Наиболее вероятный сценарий как по мне - computer use, но доверили бы вы ему свои файлы без песочницы?

Само направление Gemma у гугла мне нравится, мелкую модельку я использую под капотом в своем приложении, что кмк очень оптимизировано!
❤4👍2
Антоха Разраб про AI
Тут все жужжат по поводу copilot и нового прайсинга. В защиту GitHub скажу, что прошлые расценки были невероятно щедрыми. 3 токена за opus 4.6, при месячном лимите в 300(19$) и и 1000(39$) - буквально разадача деняк. Харнесс даже подтянули до приличного, что…
Вести с полей или как в компании, где я работаю решили эту проблему. От кодревью не отказаться - значит копайлот остается, но топтир модельки мы вырубили. Вместо этого увеличили лимиты на Claude и оставили Antigravity/Gemini как бекап опция

Copilot сделали много афигенных интеграций для своего AI продукта, но ценник неподъемный. Claude нынче мастхев, да и делает много на b2b рынке

Из того что использует наша команда и то куда мы дружно сливаем токены - OpenSpec. Мы побили их оригинальный флоу на шаги поменьше, чтоб отловить галюны на ранней стадии. Стандартное кодревью от copilot и связку dependabot + фиксы миграции от копайлот агента. Работает на удивление хорошо!
❤2👍2🔥1
Хелоу!

ИИшка теперь и в стикерах! Мой бывший коллега сделал бота для генерации стикеров. Какую милоту можно получить промтом: "Маленькая корги с зелёными глазами"

Попробовать бота можно тут с бесплатными генерациями по промокоду ANDROIDRAFT

Скидывайте в комменты что получилось у вас, я начну:
🔥5👍2
This media is not supported in your browser
VIEW IN TELEGRAM
👍6
Новая моделька от Claude - Fable 5. Что интересного:

👉 Оверхайпед Mythos с ограничениями, который напряг всех секурити специалистов и нашел тьму уязвимостей. Однако, Fable 5 пересылает некоторые топики в 4.8 (предположу что секурити)
👉 Будет в подписке какое то время даж за 20 баксов, потом только API
👉 Прайс, кстати, х2 от Opus 4.8. Дорого-богато, но бенчи проходит лучше, чем предыдущий. Завтра будет пост про бенчмарки, кста

System card для Fable 5 и Mythos 5
🔥4👍2
Cognition, выкатили FrontierCode - новый бенч для кодинг-агентов. Я не в силах тестить все топтир и фритир модельки, да и не в финансах, поэтому ориентируюсь как раз на такие замеры

Фокус этого бенча не на написал ли код, а на том, можно ли этот PR реально смерджить: тесты, стиль репозитория, комментарии, отсутствие хаков и нормальное качество кода. Кароч все то, что определяет энтерпрайзный проект от моего пет проекта

По результатам: Opus 4.8 xHigh сильно впереди, GPT-5.5-medium чуть выше Opus 4.7, open-source пока не всплывает

За какими еще следим:
👉 FrontierCode
👉 SWE-rebench База, как мне кажется. сюда в первую очередь
👉 Android bench Тут гугл манипулирует данными как может, но хоть какая то статистика
👉 Terminal-Bench Тут много агентов которые тюнятся на прохождение, надо аккуратнее
👉 SWE Marathon и DeepSWE меряют на сколько долго задачки может решать
🔥2
Ну и вчера был релиз Fable 5, антропики отдельно прогнали бенч, что показать на сколько все похорошело на этом же бенчмарке
👍2