🔺 Вопрос к вайбкодерам с пятилетним стажем. Есть кучка подзадач, с которыми агент справляется нормально, править надо процентов 10.
Хочется оптимизировать дальше и запустить этот беклог в один прогон, чтобы не прогонять/править по одной задаче. Какие есть варианты и как лучше представить беклог?
Задача со звездочкой, если куски кода, который правится разными агентами, зависят друг от друга и блокируют (но пока можно запустить последовательно в нужном порядке).
Я вот думаю, что можно костыльно
- Описать в файлике структуру проекта и где что лежит
- Описать беклог в отдельных файлах
- Добавить скриншоты, если делается какой-то UI
- Запустить в цикле какой-то консольный клиент, тот же Gemini или Cursor, чтобы он читал файлик с задачей вместе в описанием проекта, подсасывал скриншот, если надо, и начинал работать. И может быть, написал какие-нибудь тесты для приличия.
Какие еще есть варианты?
Хочется оптимизировать дальше и запустить этот беклог в один прогон, чтобы не прогонять/править по одной задаче. Какие есть варианты и как лучше представить беклог?
Задача со звездочкой, если куски кода, который правится разными агентами, зависят друг от друга и блокируют (но пока можно запустить последовательно в нужном порядке).
Я вот думаю, что можно костыльно
- Описать в файлике структуру проекта и где что лежит
- Описать беклог в отдельных файлах
- Добавить скриншоты, если делается какой-то UI
- Запустить в цикле какой-то консольный клиент, тот же Gemini или Cursor, чтобы он читал файлик с задачей вместе в описанием проекта, подсасывал скриншот, если надо, и начинал работать. И может быть, написал какие-нибудь тесты для приличия.
Какие еще есть варианты?
✍13⚡3😁3👀2
Коллеги, ну вы молодцы. В обсуждении вырисовался такой вариант:
🔸Стандартная доска в вебе, на которую докидываются задачи из беклога.
🔸 Задачи описаны максимально подробно, по сути это подробное ТЗ.
🔸 У задач есть приоритеты, есть parent и child-задачи, возможно, что есть какие-то альтернативные варианты для одной таски. Дополнительные опции, типа доступных инструментов, API, данных, выбора модели и т.д.
🔸 Под этим всем сервис с пуллом агентов и доступом к кодовой базе, например, на гитхабе, а лучше локально.
🔸 Сервис может управлять состоянием задач, прикреплять ссылки на пулл реквесты. Доска все это отображает в реальном времени. В обратную сторону тоже работает — если подредактировать ТЗ и передвинуть обратно в in progress, то задача переделается.
А я пока пойду нарежу файлики и запущу консоль в цикле.
🔸Стандартная доска в вебе, на которую докидываются задачи из беклога.
🔸 Задачи описаны максимально подробно, по сути это подробное ТЗ.
🔸 У задач есть приоритеты, есть parent и child-задачи, возможно, что есть какие-то альтернативные варианты для одной таски. Дополнительные опции, типа доступных инструментов, API, данных, выбора модели и т.д.
🔸 Под этим всем сервис с пуллом агентов и доступом к кодовой базе, например, на гитхабе, а лучше локально.
🔸 Сервис может управлять состоянием задач, прикреплять ссылки на пулл реквесты. Доска все это отображает в реальном времени. В обратную сторону тоже работает — если подредактировать ТЗ и передвинуть обратно в in progress, то задача переделается.
А я пока пойду нарежу файлики и запущу консоль в цикле.
❤11✍6👍5🤣2 1
🔺 LLM и бинари
Недавно писал, что наткнулся на доклад про анализ бинарей (без отладочных символов и другой инфы) при помощи языковых моделей. Звучало очень любопытно. Автор в лице Дарьи Ситниковой нашелся и поделился ссылками на видео и слайды.
🔸 Посмотрел по-быстрому. Если вкратце, то после декомпиляции пытаются упростить данные для анализа, упрощая граф вызовов. Потом идут по графу вверх, описывая текущую функцию моделью и передавая предыдущие описания в контекст.
🔸 Самое верхнее описание считаем за описание всей программы. Метрику считаем в виде близости эмбеддингов результата и эталонного описания. Экспертными глазами проверили результат на 30 штуках, получили 0.87 на Claude и Llama. Видимо, на 3.5 Haiku и 3.3 70B ламе, судя по другому слайду.
🔸 В целом прикольно, но финальный отчет выглядит довольно просто, не совсем понятно, зачем он нужен на практике (или я прослушал). Определять вредоносы или другие классы программ, наверное, проще и быстрее какими-то существующими эвристиками.
Скорее будет полезно на уровне описаний конкретных функций, когда специалист копает какой-то декомпилированный код. Но тут спецам виднее, конечно.
В целом доклад хороший, посмотрите. Девушка на позитиве в отличие от большинства безопасников.
👉 Видео | Слайды
Недавно писал, что наткнулся на доклад про анализ бинарей (без отладочных символов и другой инфы) при помощи языковых моделей. Звучало очень любопытно. Автор в лице Дарьи Ситниковой нашелся и поделился ссылками на видео и слайды.
🔸 Посмотрел по-быстрому. Если вкратце, то после декомпиляции пытаются упростить данные для анализа, упрощая граф вызовов. Потом идут по графу вверх, описывая текущую функцию моделью и передавая предыдущие описания в контекст.
🔸 Самое верхнее описание считаем за описание всей программы. Метрику считаем в виде близости эмбеддингов результата и эталонного описания. Экспертными глазами проверили результат на 30 штуках, получили 0.87 на Claude и Llama. Видимо, на 3.5 Haiku и 3.3 70B ламе, судя по другому слайду.
🔸 В целом прикольно, но финальный отчет выглядит довольно просто, не совсем понятно, зачем он нужен на практике (или я прослушал). Определять вредоносы или другие классы программ, наверное, проще и быстрее какими-то существующими эвристиками.
Скорее будет полезно на уровне описаний конкретных функций, когда специалист копает какой-то декомпилированный код. Но тут спецам виднее, конечно.
В целом доклад хороший, посмотрите. Девушка на позитиве в отличие от большинства безопасников.
👉 Видео | Слайды
VK Видео
Дарья Ситникова. Что LLM могут сказать о бинарных файлах
Как научить LLM понимать бинарный код без исходников? В докладе будет представлен новый подход, который решает эту задачу. Спикер разберет главные трудности — отсутствие отладочной информации и огромные объемы данных — и покажет, как метод иерархической обработки…
❤9👍5✍4😁4
OpenAI выложили статистику использования ChatGPT
🔸 ~2,6 миллиарда запросов в день на июль 2025 против ~0,4 миллиарда годом ранее.
🔸 Считали на семпле с мая 2024 по июнь 2025 (Free, Plus и Pro планы).
🔸 70% — запросы не по работе, было 50%.
🔸 80% всех запросов попадают в 3 категории — Practical Guidance (обучение, советы по любым темам), Seeking Information (замена ваб- поиска), Writing (перевод, обработка документов и писем, редактура и т.д.).
🔸 Количество пользователей-девушек растет, с ~20% при запуске до ~52% на сегодня.
🔸 Интересно поделили на Asking («как приручить дракона?») — 49%, Doing («нарисуй мне дракона») — 40% и Expressing («аааа, дракон!») — 11%.
🔸 В аппендиксе есть промпты для классификации, таймлайн запуска моделей, есть, кстати, и глава про то, что такое ChatGPT.
Вообще в отчете есть еще много интересных цифр и графиков во времени, например, как пользователи оценивают диалог следующим сообщением.
👉 Ссылка
🔸 ~2,6 миллиарда запросов в день на июль 2025 против ~0,4 миллиарда годом ранее.
🔸 Считали на семпле с мая 2024 по июнь 2025 (Free, Plus и Pro планы).
🔸 70% — запросы не по работе, было 50%.
🔸 80% всех запросов попадают в 3 категории — Practical Guidance (обучение, советы по любым темам), Seeking Information (замена ваб- поиска), Writing (перевод, обработка документов и писем, редактура и т.д.).
🔸 Количество пользователей-девушек растет, с ~20% при запуске до ~52% на сегодня.
🔸 Интересно поделили на Asking («как приручить дракона?») — 49%, Doing («нарисуй мне дракона») — 40% и Expressing («аааа, дракон!») — 11%.
🔸 В аппендиксе есть промпты для классификации, таймлайн запуска моделей, есть, кстати, и глава про то, что такое ChatGPT.
Вообще в отчете есть еще много интересных цифр и графиков во времени, например, как пользователи оценивают диалог следующим сообщением.
👉 Ссылка
👍14🔥4👀3👾1
Пишут, что в американских библиотеках учащаются запросы от читателей на несуществующие книги, которые нагаллюцинировал им чат-бот.
Ну тупыые Пойду в Некрасова, спрошу третий том «Муму» Довлатова.
https://www.404media.co/librarians-are-being-asked-to-find-ai-hallucinated-books/
Ну тупыые
https://www.404media.co/librarians-are-being-asked-to-find-ai-hallucinated-books/
404 Media
Librarians Are Being Asked to Find AI-Hallucinated Books
It’s a trippy time to have a library card.
😁31❤3💅2🤡1
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣60🔥18⚡6🗿6👍2
Долистал новую книжку Сергея Николенко про машинное обучение. Вдумчиво, конечно, надо читать подольше, так как это материалы курса СПбГУ, а материала там достаточно.
Тот, кто осилит, тот точно поймет основы ML со статистикой и вообще контекст ИИ в современном мире (первые главы). Часть из этой теории вполне можно услышать на собесах.
👉 Книжка клёвая, но дорогая (~2000р). Мне её подарило издательство Питер (не, ну молодцы ведь) и я, в свою очередь, хочу подарить её кому-нибудь из подписчиков. Пишите в комменты, кто хочет книжку, выберем счастливчика.
Upd. Завтра разыграем
Upd2. Все, 28 человек есть, сейчас накидаю код для определения победителя
Тот, кто осилит, тот точно поймет основы ML со статистикой и вообще контекст ИИ в современном мире (первые главы). Часть из этой теории вполне можно услышать на собесах.
👉 Книжка клёвая, но дорогая (~2000р). Мне её подарило издательство Питер (не, ну молодцы ведь) и я, в свою очередь, хочу подарить её кому-нибудь из подписчиков. Пишите в комменты, кто хочет книжку, выберем счастливчика.
Upd. Завтра разыграем
Upd2. Все, 28 человек есть, сейчас накидаю код для определения победителя
Telegram
Градиент обреченный
Подружился тут с издательством Питер. Будем, говорят, дарить вам книжки... (дальше я не вслушивался).
Книжки мы любим, поэтому выбрал почитать и рассказать про новую книгу Сергея Николенко «Машинное обучение». Вчера только доставили, но уже бросаются в глаза…
Книжки мы любим, поэтому выбрал почитать и рассказать про новую книгу Сергея Николенко «Машинное обучение». Вчера только доставили, но уже бросаются в глаза…
🔥25❤12🆒5🎄2
Друзья, подавил в себе желание отдать книжку подписчице, которая живет в том же доме (!) и накидал код, который генерит случайные числа от 1 до 28 (по количеству участников) k раз и рисует гистограммку с частотами.
🎉 Победил 13-й, а это @olegGerbylev! Поздравляем! Администрация канала с вами свяжется.
🎉 Победил 13-й, а это @olegGerbylev! Поздравляем! Администрация канала с вами свяжется.
👍17🏆7❤5❤🔥2😁2
This media is not supported in your browser
VIEW IN TELEGRAM
Блин, Neuralink реально крутая вещь
😁33🤣20👍3🍓2💊2 2❤1🦄1
Видели, наверное, что вышел новый Claude 4.5. Пишут, что стал лучше во всем, но по старой цене, так что как минимум можно переключить свои проекты на него, если используете.
🔸 Наш сайт с обзорами статей hfday.ru уже на него перевел.
🔸 Обновили SDK для создания агентов (теперь это Claude Agent SDK), на базе которого работает Claude Code консоль. Соответственно, можно использовать те же фичи, если хотите сделать своего агента, — запускать тулы, шариться по файловой системе, искать в интеренете, запускать субагентов и т.д.
🔸 Сам Claude Code тоже обновился до второй версии.
🔸 В Курсор новую модельку уже добавили, работает отлично.
🔸 Наш сайт с обзорами статей hfday.ru уже на него перевел.
🔸 Обновили SDK для создания агентов (теперь это Claude Agent SDK), на базе которого работает Claude Code консоль. Соответственно, можно использовать те же фичи, если хотите сделать своего агента, — запускать тулы, шариться по файловой системе, искать в интеренете, запускать субагентов и т.д.
🔸 Сам Claude Code тоже обновился до второй версии.
🔸 В Курсор новую модельку уже добавили, работает отлично.
🔥9👍7❤4👾1
Посидел неделю в Comet, новом браузере от Perplexity (браузер + LLM панелька + веб-агент).
Как браузер тут ничего особенного, более интересен показался UX.
🟢 Есть панелька Assistant, по сути просто страничка Perplexity с текущей вкладкой в качестве контекста. Соответственно можно суммаризировать, нажав на кнопочку, спрашивать какие-то вещи, типа терминов, примеров и чего угодно.
🟢 На панельке есть кнопка со скриншотом, то есть можно выделить что-то на страничке и это добавится в контекст. Подумал сначала, что прикольно и можно выделять лица и спрашивать кто это (а оно само поищется), но так не работает.
🟢 Можно сделать ежедневные задачи по обзору рынков, новостей и т.д. с отсылкой результатов на почту.
🟢 Из удобного, в настройках можно задавать шорткаты, типа "/10 = суммаризируй страничку, напиши 10 коротких пунктов и больше ничего" и потом писать "/10" в ассистенте. Для каждого шортката можно задать свою модель (gpt-5, claude и т.д.)
🟢 Есть встроенный веб-агент, довольно неплохой. Всякие баннеры и всплывающие попапы его не смущают. Есть встроенный пример с построением маршрута от Парижа до Барселоны через 3 живописных городка в Гугл картах.
🟢 Пример как будто игрушечный, поэтому дал задание построить живописный маршрут по району Коптево на Яндекс картах. Ожидал, что он выдаст полную дичь, потому что походу работы он нашел какие-то храмы в центре Москвы и другие дальние точки. Но потом оно одумалось, нашло нужные контролы и действительно построило плюс-минус адекватный маршрут по району.
В общем, пока не понятно, зачем менять на него свой любимый браузер.
Всякие таски на почту отсылать удобно, но это и без браузера работает. Веб-агент каждый день не особо нужен, по крайней мере пока. Делать выжимки из статей для беглого ознакомления — тут, наверное, да, если много читаете, со встроенным функционалом это поудобней.
Короче, будем ждать киллер-фичи
Как браузер тут ничего особенного, более интересен показался UX.
В общем, пока не понятно, зачем менять на него свой любимый браузер.
Всякие таски на почту отсылать удобно, но это и без браузера работает. Веб-агент каждый день не особо нужен, по крайней мере пока. Делать выжимки из статей для беглого ознакомления — тут, наверное, да, если много читаете, со встроенным функционалом это поудобней.
Короче, будем ждать киллер-фичи
Please open Telegram to view this post
VIEW IN TELEGRAM
❤13👀7👍5🔥4
Если что, у Игоря в канале люди делятся инвайтами в Sora 2. Ввести один код можно несколько раз, поэтому там ещё есть рабочие.
Вот мой.JNTEC7
Вот мой.
❤🔥9❤4⚡2🤝1
Forwarded from Сиолошная
Если вдруг пропустили — под этим тредом продолжается раздача инвайтов. Огромное спасибо всем, кто взял один и отдал обратно 4, позволив большему количеству людей попробовать генерацию. Каждый инвайт можно ввести 4 раза! Поэтому не забывайте пробовать те, что скинули в чат совсем недавно.
Напомню, что всё работает в браузере на sora.com + американском VPN.
OpenAI уточнили, что сейчас лимит составляет 100 генераций в сутки, что гораздо больше того, что я ожидал. Не знаю, как им хватает мощностей — но пока не ясны масштабы, сколько людей пользуется, стало ли приложение вирусным или ещё нет. Sora 2 Pro ещё не выкатили, ждём.
Функция Камео, позволяющая перенести образ любого друга / публичной личности (которые дали согласие и отсканировали себя) — это бомба с точки зрения социальных взаимодействий. Кто придумал это — гений; у Google хорошая генерация видео уже была сколько-то времени, и они не выкатили это.
Кажется, с точки зрения маркетинга не сделали очевидную вещь: не собрали 10-20 звёзд и не заплатили им за то, чтобы они дали право использовать свою внешность. Хотя может быть пытались, но цифры запросили космические, тут хз.
Услышано в интернете:
«Клянусь богом, через 3 месяца обычные люди не будут знать, кто такой Сэм Альтман, но они на 100% узнают в нём sora boy»
Напомню, что всё работает в браузере на sora.com + американском VPN.
OpenAI уточнили, что сейчас лимит составляет 100 генераций в сутки, что гораздо больше того, что я ожидал. Не знаю, как им хватает мощностей — но пока не ясны масштабы, сколько людей пользуется, стало ли приложение вирусным или ещё нет. Sora 2 Pro ещё не выкатили, ждём.
Функция Камео, позволяющая перенести образ любого друга / публичной личности (которые дали согласие и отсканировали себя) — это бомба с точки зрения социальных взаимодействий. Кто придумал это — гений; у Google хорошая генерация видео уже была сколько-то времени, и они не выкатили это.
Кажется, с точки зрения маркетинга не сделали очевидную вещь: не собрали 10-20 звёзд и не заплатили им за то, чтобы они дали право использовать свою внешность. Хотя может быть пытались, но цифры запросили космические, тут хз.
Услышано в интернете:
«Клянусь богом, через 3 месяца обычные люди не будут знать, кто такой Сэм Альтман, но они на 100% узнают в нём sora boy»
👍6❤3🔥3🦄2💘1 1
Читал недавно книжку «В начале было кофе», хорошая вещь. Понравилась глава про лингвофриков, которые по разным причинам несут в массы некие «сакральные» знания про язык — буквицу, блины комам и прочий бред.
Еще прикольно пишет про систематические изменения ударений и родов в словах, таких изменений за сто лет набирается куча и широкие массы это никак не задевает (приводятся примеры). Но есть несколько слов типа «договор» и «кофе», за которые люди держатся, стараясь сохранить какую-то одну их форму использования.
«Я пил мелкими глотками огненное кофе».
В. Набоков, «Отчаяние», 1936 г.
«Кофе в чашке стояло на письменном столе».
М. А. Булгаков, «Записки покойника», 1936–1937 гг.
«Но кофе горячо и крепко, день наступает ясный, морозный».
И. А. Бунин, «Нобелевские дни», 1933 г.
Еще прикольно пишет про систематические изменения ударений и родов в словах, таких изменений за сто лет набирается куча и широкие массы это никак не задевает (приводятся примеры). Но есть несколько слов типа «договор» и «кофе», за которые люди держатся, стараясь сохранить какую-то одну их форму использования.
«Я пил мелкими глотками огненное кофе».
В. Набоков, «Отчаяние», 1936 г.
«Кофе в чашке стояло на письменном столе».
М. А. Булгаков, «Записки покойника», 1936–1937 гг.
«Но кофе горячо и крепко, день наступает ясный, морозный».
И. А. Бунин, «Нобелевские дни», 1933 г.
🔥22❤15👍8✍2❤🔥1🤡1