Vibe Coders UA
154 subscribers
7 photos
42 links
Все про вайб кодінг, LLM та рішення на базі Generative AI
Download Telegram
Agent Skills від Anthropic - це спроба дати агентам можливість виконувати конкретні інструкції для виконання конкретної задачі.
Навичка (skill) - це не монолітна інструкція, а набір знань і процедур, які не засмічують контекст кожної сесії. Для розробників, що практикують вайб‑кодінг і тісно спілкуються з моделлю під час роботи, ця ідея звучить практично: менше тягнути в промпт наперед, більше читати й виконувати по мірі потреби. Виходить прозоріше, дешевше, стабільніше. І це помітно вже з перших ітерацій.

Механіка використання проста: навичка живе у окремій папці зі SKILL.md, де на старті агент бачить лише назву і стислий опис. Цього достатньо, щоб модель пам’ятала, коли й навіщо звертатися до вмісту глибше, не витрачаючи контекст на «все й одразу». Коли з’являється завдання, агент дочитує повний файл і додаткові матеріали, тримаючи трафік токенів під контролем. Це і є «ліниве завантаження» знань.
Для девелопера це означає, що контекст використовується меньше і грошей витрачати теж будемо меньше.

Економія проявляється на всіх етапах. Кожен зайвий абзац у промпті - це токени, за які ви платите, і затримка, яку ви відчуваєте. Коли інструкції не тягнуться в кожен запит, а викликаються за потреби, латентність падає, а вартість епізоду обчислень стає передбачуванішою. У вайб‑кодінгу це особливо помітно: розробник швидко змінює напрямок і не тягне у кожну взаємодію величезний claude.md.

Ще одна корисна опція - описувати навички не обовʼязково текстом. Навички підтримують можливість виконуваний код, який агент викликає замість багатослівних описів кроків. Коли процес краще зловити функцією, а не абзацом, код дає надійність і повторюваність.

Але в який раз нагадую про те що ви дбаєте про свою безпеку самостійно. Обмеження мережевих викликів і прозоре логування операцій це база. Якщо додаєте сторонню навичку в свій процес вайб‑кодінгу, перевіряйте її так само уважно, як бібліотеку у продакшн‑сервісі. Тоді «ліниве завантаження» не перетвориться на «ліниву перевірку», і ви не отримаєте сюрпризів у найменш вдалий момент.

Оригінал можна подивитись тут: https://www.anthropic.com/engineering/equipping-agents-for-the-real-world-with-agent-skills
👍2
https://www.youtube.com/shorts/aIvHf8vsWBM

один з ярчайших людей у сучасному ШІ. Ілля Суцкевер. Про vibe coding і причини чому агенти пропонують фікс до однієї проблеми і в ньому повертаються до іншої.

https://www.youtube.com/watch?v=aR20FWCCjAs

повне інтервью тут і я вважаю що саме такі інтервʼю як і інші фундаментальні роботи якнайкраще заставляють замислитись щодо того які проблеми ми бачимо, куди рухається ШІ світ і де ми будемо за 3-5 років.
2
https://mistral.ai/news/mistral-3

а тим часом містраль все ж таки випустив нові моделі %)

тож прошу дивитись і насолоджуватись! %)

як на мене моделі дуже цікаві. enjoy! 😉

містраль намагається робити невеликі сфокусовані моделі які досягають дуже гарного cost / benefits співвідношення.

тож ви не отримаєте супер високої якості від аналітичних здібностей моделей, але для кодінгу воно працює дуже непогано
А тим часом кодекс вже почав (поки що в експериментальному режимі) підтримувати скіли. Що це означає: меньше проблем з менеджментом контексту та більше токенів для контексту який ми самі створимо замість забитого MCP. Дешевші взаємодії з ллм. І меньше часу на генерацію відповідей.
https://share.google/A06J4BucP6BeEB5pV

Оригінал ідеї скілів тут
https://share.google/6y4UV7gIol3EqrkKo
3
Здається і на нашій вулиці свято!

https://openrouter.ai/docs/guides/guides/claude-code-integration

У опенраутер занесли інтеграцію з Claude Code.

У великому відсотку випадків я все ще вважаю що це найкращий тул для агнетного кодінгу. Окрім випадків коли вам потрібно бачити або контролювати до останньої коми код який ви пишете.
З цікавого в claude code нещодавна занесли LSP. Що це означає?
що пошук символів в CLI based тулах буде знаходити всі "entries" як це зараз робить ваша IDE. Це суттєво пришвидшить якість рефакторингу і покращить роботу з наприклад оверрайдами методів. Тож в наступному році нас чекає ще більше цікавих прикладів використання і все більше інструментів для написання коду який ми вже пишемо.

Якщо комусь цікаві новини вайб кодінгу - слідкуйте за
https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
https://developers.openai.com/codex/changelog/
та
https://geminicli.com/docs/changelogs/
👍3🔥1
доречі вже доволі довгий час тестую ось цю штуку і вважаю її дуже корисною. сам вирішуєш коли записувати і коли ні. куди вставляти результат запису і як цим користуватися

https://wisprflow.ai/r?MAKSYM77

поки що доступна лише для мака, але якість роботи моделей дуже велика, і враховуючи, що я зараз це диктую українською, якість розпізнавання дуже - дуже гарна
👍5🔥3
Доречі, вважаю що в цій роботі дуже гарно розкладені причини чому ж моделі галюцінують

https://arxiv.org/html/2504.14764v1

Мова як інструмент несе дуже багато невизначеності. Більш того, моделі навчають досягати мети, а як можна досягти мети наприклад "будь гарним хлопцем?"
Тож питання якості роботи агентів мусить бути хоча б вимірюваним для того щоб зрозуміти чи вони відповідають очикуваному рівню якості.

У роботі приводяться три острови:
- острів специфікації
- острів розуміння
- острів генералізації

Перший - про те наскільки специфікована задача.
Другий - про розуміння. бо в безлічі задач виникають corner cases які не можна описати заздалегідь
Третій про те чи достатньо наведених прикладів щоб зробити рішення яке може бути використаним для великої кількості інпутів і чи буде досягнута мета для всіх цих випадків.
1
Цікавий паттерн роботи з консольними тулами для вайб кодінгу. З наступного тижня будемо розбирати на курсі! З нуля для тих хто не дивився у бік технологій що воно таке та як використовувати. Крок за кроком.
🔥3
Нещодавно вийшов новий Claude Code 2.1, а днями, якщо довіряти чуткам виходить Claude 4.7...

2.1 буквально за два тижні викатили до фіга апдейтів до

Навичок та Слеш-команд
Хуків
Дозволів
Фонових Завдань
Агентів та Субагентів
Управління Сесіями
Обробки Зображень
Інтеграції LSP
Система Плагінів та маркетплейсів
Конфігурація та Налаштування
Мультитенантної Архітектури

я вважаю що список просто неймовіний і здається що темп релізів просто неймовірний.
Багато з цього вже працювало в тому самому курсорі, але дещо лише заїжджає і туди. І багато ідей заходить з одних тулів в інші за декілька тижнів.

Такого протистояння майже ніколи не було в комерційних тулах... Тому дуже цікаво наблюдати як може виглядати так звана RAD (швидка розробка аплікації)
5
А тим часом адопшн клод кода зростає з шаленою швидкістю. 4.5 вже на першому місці на лідерборді опенраутері.

https://x.com/i/status/2011823610386600009
👍1
а ви знаєте що xml останнім часом використовується все більше?!

https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/use-xml-tags

мовні моделі і їх промптінг все ще не дають 100% гарантії результату.
більше того... скоріш за все з трансформерами і не дадуть.
втім промпт інженери намагаються знайти всі можливі способи для того щоб від 50%-70% вірогідності досягти до 90% або навіть вище.
більш за те, моделі не завжди знають як їм виявити чи закінчила людина свою думку чи ні?

використання xml - саме такий спосіб.
можливість розбити (указати) що інструкція, що робити, який формат очикується від моделі або агента дуже гарно структуруються за допомогою тегів.

як це виглядає:

<команда>
знайди інформацію про...
</команда>

<додатковий контекст>
шукати необхідно тут, там і ще десь
</додатковий контекст>

<формат>
- рік у форматі РРР-м-д
- ПІБ
- розмір одягу
</формат>
1👍1🔥1
У MiniMax підвезли підтримку MLX
Що це означає? Що тепер його можна ранати на Маках використовуючи залізо на повну.

https://github.com/MiniMax-AI/MiniMax-M2.1

Як то кажуть... enjoy! 😉
👍1
Оце так новина. Для мене це було критерієм важкого програмування...
Довгий час агенти не могли впоратися з цією задачею... Але здається зараз рахунок іде на дні і години...
https://search.app/YuQZk
Якщо хтось цікавиться безпековим аспектом розробки на базі вмм - необхідно розуміти що головний аспект будь якої безпечної системи с системності.
Системній ідентифікації потенційних вразливостей, аналізі можливих векторів атаки і т. ін.
Найбільший каталог проблем з яким я стикався наразі це мітре

MITRE ATLAS https://share.google/MT1GeizgoCPuvAUyR

Але можна почати і з оваспу для ші

OWASP Top 10 for Large Language Model Applications | OWASP Foundation https://share.google/EoDJDilVWIGFhhDOW

Головне - це системність
👍2
Антропік заопенсорсив свою бібліотеку плагінів для роботи з знаннями і інформацією.

https://github.com/anthropics/knowledge-work-plugins

Там дійсно багато корисного. Створення візуалізацій і дашбордів. Анализ даних і валідація, біологічні навчання (clinical trial protocol)

А ми вчора на закритому курсі розбирали інформацію про те як застосовувати та будувати свої самовалідуючіся скіли на закритому курсі.

Програму курсу можна побачити тут
https://aigensa.com/learning.html
1
Тільки сьогодні про нього згадував...
Channel photo updated
Доречі, статус і проблеми з foundational models можна дивитись тут

Open AI
https://status.openai.com/

Anthropic Claude
https://status.claude.com/

Google Gemini
https://aistudio.google.com/status
👍21