Agent Skills від Anthropic - це спроба дати агентам можливість виконувати конкретні інструкції для виконання конкретної задачі.
Навичка (skill) - це не монолітна інструкція, а набір знань і процедур, які не засмічують контекст кожної сесії. Для розробників, що практикують вайб‑кодінг і тісно спілкуються з моделлю під час роботи, ця ідея звучить практично: менше тягнути в промпт наперед, більше читати й виконувати по мірі потреби. Виходить прозоріше, дешевше, стабільніше. І це помітно вже з перших ітерацій.
Механіка використання проста: навичка живе у окремій папці зі SKILL.md, де на старті агент бачить лише назву і стислий опис. Цього достатньо, щоб модель пам’ятала, коли й навіщо звертатися до вмісту глибше, не витрачаючи контекст на «все й одразу». Коли з’являється завдання, агент дочитує повний файл і додаткові матеріали, тримаючи трафік токенів під контролем. Це і є «ліниве завантаження» знань.
Для девелопера це означає, що контекст використовується меньше і грошей витрачати теж будемо меньше.
Економія проявляється на всіх етапах. Кожен зайвий абзац у промпті - це токени, за які ви платите, і затримка, яку ви відчуваєте. Коли інструкції не тягнуться в кожен запит, а викликаються за потреби, латентність падає, а вартість епізоду обчислень стає передбачуванішою. У вайб‑кодінгу це особливо помітно: розробник швидко змінює напрямок і не тягне у кожну взаємодію величезний claude.md.
Ще одна корисна опція - описувати навички не обовʼязково текстом. Навички підтримують можливість виконуваний код, який агент викликає замість багатослівних описів кроків. Коли процес краще зловити функцією, а не абзацом, код дає надійність і повторюваність.
Але в який раз нагадую про те що ви дбаєте про свою безпеку самостійно. Обмеження мережевих викликів і прозоре логування операцій це база. Якщо додаєте сторонню навичку в свій процес вайб‑кодінгу, перевіряйте її так само уважно, як бібліотеку у продакшн‑сервісі. Тоді «ліниве завантаження» не перетвориться на «ліниву перевірку», і ви не отримаєте сюрпризів у найменш вдалий момент.
Оригінал можна подивитись тут: https://www.anthropic.com/engineering/equipping-agents-for-the-real-world-with-agent-skills
Навичка (skill) - це не монолітна інструкція, а набір знань і процедур, які не засмічують контекст кожної сесії. Для розробників, що практикують вайб‑кодінг і тісно спілкуються з моделлю під час роботи, ця ідея звучить практично: менше тягнути в промпт наперед, більше читати й виконувати по мірі потреби. Виходить прозоріше, дешевше, стабільніше. І це помітно вже з перших ітерацій.
Механіка використання проста: навичка живе у окремій папці зі SKILL.md, де на старті агент бачить лише назву і стислий опис. Цього достатньо, щоб модель пам’ятала, коли й навіщо звертатися до вмісту глибше, не витрачаючи контекст на «все й одразу». Коли з’являється завдання, агент дочитує повний файл і додаткові матеріали, тримаючи трафік токенів під контролем. Це і є «ліниве завантаження» знань.
Для девелопера це означає, що контекст використовується меньше і грошей витрачати теж будемо меньше.
Економія проявляється на всіх етапах. Кожен зайвий абзац у промпті - це токени, за які ви платите, і затримка, яку ви відчуваєте. Коли інструкції не тягнуться в кожен запит, а викликаються за потреби, латентність падає, а вартість епізоду обчислень стає передбачуванішою. У вайб‑кодінгу це особливо помітно: розробник швидко змінює напрямок і не тягне у кожну взаємодію величезний claude.md.
Ще одна корисна опція - описувати навички не обовʼязково текстом. Навички підтримують можливість виконуваний код, який агент викликає замість багатослівних описів кроків. Коли процес краще зловити функцією, а не абзацом, код дає надійність і повторюваність.
Але в який раз нагадую про те що ви дбаєте про свою безпеку самостійно. Обмеження мережевих викликів і прозоре логування операцій це база. Якщо додаєте сторонню навичку в свій процес вайб‑кодінгу, перевіряйте її так само уважно, як бібліотеку у продакшн‑сервісі. Тоді «ліниве завантаження» не перетвориться на «ліниву перевірку», і ви не отримаєте сюрпризів у найменш вдалий момент.
Оригінал можна подивитись тут: https://www.anthropic.com/engineering/equipping-agents-for-the-real-world-with-agent-skills
Anthropic
Equipping agents for the real world with Agent Skills
Discover how Anthropic builds AI agents with practical capabilities through modular skills, enabling them to handle complex real-world tasks more effectively and reliably.
👍2
https://www.youtube.com/shorts/aIvHf8vsWBM
один з ярчайших людей у сучасному ШІ. Ілля Суцкевер. Про vibe coding і причини чому агенти пропонують фікс до однієї проблеми і в ньому повертаються до іншої.
https://www.youtube.com/watch?v=aR20FWCCjAs
повне інтервью тут і я вважаю що саме такі інтервʼю як і інші фундаментальні роботи якнайкраще заставляють замислитись щодо того які проблеми ми бачимо, куди рухається ШІ світ і де ми будемо за 3-5 років.
один з ярчайших людей у сучасному ШІ. Ілля Суцкевер. Про vibe coding і причини чому агенти пропонують фікс до однієї проблеми і в ньому повертаються до іншої.
https://www.youtube.com/watch?v=aR20FWCCjAs
повне інтервью тут і я вважаю що саме такі інтервʼю як і інші фундаментальні роботи якнайкраще заставляють замислитись щодо того які проблеми ми бачимо, куди рухається ШІ світ і де ми будемо за 3-5 років.
YouTube
Why Vibe Coding Fails - Ilya Sutskever
Enjoy the videos and music you love, upload original content, and share it all with friends, family, and the world on YouTube.
❤2
https://mistral.ai/news/mistral-3
а тим часом містраль все ж таки випустив нові моделі %)
тож прошу дивитись і насолоджуватись! %)
як на мене моделі дуже цікаві. enjoy! 😉
містраль намагається робити невеликі сфокусовані моделі які досягають дуже гарного cost / benefits співвідношення.
тож ви не отримаєте супер високої якості від аналітичних здібностей моделей, але для кодінгу воно працює дуже непогано
а тим часом містраль все ж таки випустив нові моделі %)
тож прошу дивитись і насолоджуватись! %)
як на мене моделі дуже цікаві. enjoy! 😉
містраль намагається робити невеликі сфокусовані моделі які досягають дуже гарного cost / benefits співвідношення.
тож ви не отримаєте супер високої якості від аналітичних здібностей моделей, але для кодінгу воно працює дуже непогано
Mistral AI
Introducing Mistral 3 | Mistral AI
The most powerful AI platform for enterprises. Customize, fine-tune, and deploy AI assistants, autonomous agents, and multimodal AI with open models.
А тим часом кодекс вже почав (поки що в експериментальному режимі) підтримувати скіли. Що це означає: меньше проблем з менеджментом контексту та більше токенів для контексту який ми самі створимо замість забитого MCP. Дешевші взаємодії з ллм. І меньше часу на генерацію відповідей.
https://share.google/A06J4BucP6BeEB5pV
Оригінал ідеї скілів тут
https://share.google/6y4UV7gIol3EqrkKo
https://share.google/A06J4BucP6BeEB5pV
Оригінал ідеї скілів тут
https://share.google/6y4UV7gIol3EqrkKo
OpenAI Developer Community
Skills for Codex: Experimental support starting today
I have seen this feature request for Codex quite a few times and now it’s actually coming: Here is a link to the rough documentation. And an explanation what skills are and why you may want to use them. Happy building and please remember that this is…
❤3
Здається і на нашій вулиці свято!
https://openrouter.ai/docs/guides/guides/claude-code-integration
У опенраутер занесли інтеграцію з Claude Code.
У великому відсотку випадків я все ще вважаю що це найкращий тул для агнетного кодінгу. Окрім випадків коли вам потрібно бачити або контролювати до останньої коми код який ви пишете.
https://openrouter.ai/docs/guides/guides/claude-code-integration
У опенраутер занесли інтеграцію з Claude Code.
У великому відсотку випадків я все ще вважаю що це найкращий тул для агнетного кодінгу. Окрім випадків коли вам потрібно бачити або контролювати до останньої коми код який ви пишете.
З цікавого в claude code нещодавна занесли LSP. Що це означає?
що пошук символів в CLI based тулах буде знаходити всі "entries" як це зараз робить ваша IDE. Це суттєво пришвидшить якість рефакторингу і покращить роботу з наприклад оверрайдами методів. Тож в наступному році нас чекає ще більше цікавих прикладів використання і все більше інструментів для написання коду який ми вже пишемо.
Якщо комусь цікаві новини вайб кодінгу - слідкуйте за
https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
https://developers.openai.com/codex/changelog/
та
https://geminicli.com/docs/changelogs/
що пошук символів в CLI based тулах буде знаходити всі "entries" як це зараз робить ваша IDE. Це суттєво пришвидшить якість рефакторингу і покращить роботу з наприклад оверрайдами методів. Тож в наступному році нас чекає ще більше цікавих прикладів використання і все більше інструментів для написання коду який ми вже пишемо.
Якщо комусь цікаві новини вайб кодінгу - слідкуйте за
https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
https://developers.openai.com/codex/changelog/
та
https://geminicli.com/docs/changelogs/
GitHub
claude-code/CHANGELOG.md at main · anthropics/claude-code
Claude Code is an agentic coding tool that lives in your terminal, understands your codebase, and helps you code faster by executing routine tasks, explaining complex code, and handling git workflo...
👍3🔥1
доречі вже доволі довгий час тестую ось цю штуку і вважаю її дуже корисною. сам вирішуєш коли записувати і коли ні. куди вставляти результат запису і як цим користуватися
https://wisprflow.ai/r?MAKSYM77
поки що доступна лише для мака, але якість роботи моделей дуже велика, і враховуючи, що я зараз це диктую українською, якість розпізнавання дуже - дуже гарна
https://wisprflow.ai/r?MAKSYM77
поки що доступна лише для мака, але якість роботи моделей дуже велика, і враховуючи, що я зараз це диктую українською, якість розпізнавання дуже - дуже гарна
wisprflow.ai
You have been invited to Flow | Wispr Flow
Flow makes writing quick and clear with seamless voice dictation. It is the fastest, smartest way to type with your voice.
👍5🔥3
Доречі, вважаю що в цій роботі дуже гарно розкладені причини чому ж моделі галюцінують
https://arxiv.org/html/2504.14764v1
Мова як інструмент несе дуже багато невизначеності. Більш того, моделі навчають досягати мети, а як можна досягти мети наприклад "будь гарним хлопцем?"
Тож питання якості роботи агентів мусить бути хоча б вимірюваним для того щоб зрозуміти чи вони відповідають очикуваному рівню якості.
У роботі приводяться три острови:
- острів специфікації
- острів розуміння
- острів генералізації
Перший - про те наскільки специфікована задача.
Другий - про розуміння. бо в безлічі задач виникають corner cases які не можна описати заздалегідь
Третій про те чи достатньо наведених прикладів щоб зробити рішення яке може бути використаним для великої кількості інпутів і чи буде досягнута мета для всіх цих випадків.
https://arxiv.org/html/2504.14764v1
Мова як інструмент несе дуже багато невизначеності. Більш того, моделі навчають досягати мети, а як можна досягти мети наприклад "будь гарним хлопцем?"
Тож питання якості роботи агентів мусить бути хоча б вимірюваним для того щоб зрозуміти чи вони відповідають очикуваному рівню якості.
У роботі приводяться три острови:
- острів специфікації
- острів розуміння
- острів генералізації
Перший - про те наскільки специфікована задача.
Другий - про розуміння. бо в безлічі задач виникають corner cases які не можна описати заздалегідь
Третій про те чи достатньо наведених прикладів щоб зробити рішення яке може бути використаним для великої кількості інпутів і чи буде досягнута мета для всіх цих випадків.
❤1
Read “Ralph Wiggum, explained: the Claude Code loop that keeps going“ by JP Caparas on Medium: https://jpcaparas.medium.com/ralph-wiggum-explained-the-claude-code-loop-that-keeps-going-3250dcc30809
Medium
Ralph Wiggum, explained: the Claude Code loop that keeps going
(chuckles) I'm inside Claude Code.
Цікавий паттерн роботи з консольними тулами для вайб кодінгу. З наступного тижня будемо розбирати на курсі! З нуля для тих хто не дивився у бік технологій що воно таке та як використовувати. Крок за кроком.
🔥3
Нещодавно вийшов новий Claude Code 2.1, а днями, якщо довіряти чуткам виходить Claude 4.7...
2.1 буквально за два тижні викатили до фіга апдейтів до
Навичок та Слеш-команд
Хуків
Дозволів
Фонових Завдань
Агентів та Субагентів
Управління Сесіями
Обробки Зображень
Інтеграції LSP
Система Плагінів та маркетплейсів
Конфігурація та Налаштування
Мультитенантної Архітектури
я вважаю що список просто неймовіний і здається що темп релізів просто неймовірний.
Багато з цього вже працювало в тому самому курсорі, але дещо лише заїжджає і туди. І багато ідей заходить з одних тулів в інші за декілька тижнів.
Такого протистояння майже ніколи не було в комерційних тулах... Тому дуже цікаво наблюдати як може виглядати так звана RAD (швидка розробка аплікації)
2.1 буквально за два тижні викатили до фіга апдейтів до
Навичок та Слеш-команд
Хуків
Дозволів
Фонових Завдань
Агентів та Субагентів
Управління Сесіями
Обробки Зображень
Інтеграції LSP
Система Плагінів та маркетплейсів
Конфігурація та Налаштування
Мультитенантної Архітектури
я вважаю що список просто неймовіний і здається що темп релізів просто неймовірний.
Багато з цього вже працювало в тому самому курсорі, але дещо лише заїжджає і туди. І багато ідей заходить з одних тулів в інші за декілька тижнів.
Такого протистояння майже ніколи не було в комерційних тулах... Тому дуже цікаво наблюдати як може виглядати так звана RAD (швидка розробка аплікації)
❤5
А тим часом адопшн клод кода зростає з шаленою швидкістю. 4.5 вже на першому місці на лідерборді опенраутері.
https://x.com/i/status/2011823610386600009
https://x.com/i/status/2011823610386600009
👍1
а ви знаєте що xml останнім часом використовується все більше?!
https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/use-xml-tags
мовні моделі і їх промптінг все ще не дають 100% гарантії результату.
більше того... скоріш за все з трансформерами і не дадуть.
втім промпт інженери намагаються знайти всі можливі способи для того щоб від 50%-70% вірогідності досягти до 90% або навіть вище.
більш за те, моделі не завжди знають як їм виявити чи закінчила людина свою думку чи ні?
використання xml - саме такий спосіб.
можливість розбити (указати) що інструкція, що робити, який формат очикується від моделі або агента дуже гарно структуруються за допомогою тегів.
як це виглядає:
<команда>
знайди інформацію про...
</команда>
<додатковий контекст>
шукати необхідно тут, там і ще десь
</додатковий контекст>
<формат>
- рік у форматі РРР-м-д
- ПІБ
- розмір одягу
</формат>
https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/use-xml-tags
мовні моделі і їх промптінг все ще не дають 100% гарантії результату.
більше того... скоріш за все з трансформерами і не дадуть.
втім промпт інженери намагаються знайти всі можливі способи для того щоб від 50%-70% вірогідності досягти до 90% або навіть вище.
більш за те, моделі не завжди знають як їм виявити чи закінчила людина свою думку чи ні?
використання xml - саме такий спосіб.
можливість розбити (указати) що інструкція, що робити, який формат очикується від моделі або агента дуже гарно структуруються за допомогою тегів.
як це виглядає:
<команда>
знайди інформацію про...
</команда>
<додатковий контекст>
шукати необхідно тут, там і ще десь
</додатковий контекст>
<формат>
- рік у форматі РРР-м-д
- ПІБ
- розмір одягу
</формат>
Claude Platform Docs
Prompting best practices
Comprehensive guide to prompt engineering techniques for Claude's latest models, covering clarity, examples, XML structuring, thinking, and agentic systems.
❤1👍1🔥1
У MiniMax підвезли підтримку MLX
Що це означає? Що тепер його можна ранати на Маках використовуючи залізо на повну.
https://github.com/MiniMax-AI/MiniMax-M2.1
Як то кажуть... enjoy! 😉
Що це означає? Що тепер його можна ранати на Маках використовуючи залізо на повну.
https://github.com/MiniMax-AI/MiniMax-M2.1
Як то кажуть... enjoy! 😉
GitHub
GitHub - MiniMax-AI/MiniMax-M2.1: MiniMax M2.1, a SOTA model for real-world dev & agents.
MiniMax M2.1, a SOTA model for real-world dev & agents. - MiniMax-AI/MiniMax-M2.1
👍1
Оце так новина. Для мене це було критерієм важкого програмування...
Довгий час агенти не могли впоратися з цією задачею... Але здається зараз рахунок іде на дні і години...
https://search.app/YuQZk
Довгий час агенти не могли впоратися з цією задачею... Але здається зараз рахунок іде на дні і години...
https://search.app/YuQZk
Якщо хтось цікавиться безпековим аспектом розробки на базі вмм - необхідно розуміти що головний аспект будь якої безпечної системи с системності.
Системній ідентифікації потенційних вразливостей, аналізі можливих векторів атаки і т. ін.
Найбільший каталог проблем з яким я стикався наразі це мітре
MITRE ATLAS™ https://share.google/MT1GeizgoCPuvAUyR
Але можна почати і з оваспу для ші
OWASP Top 10 for Large Language Model Applications | OWASP Foundation https://share.google/EoDJDilVWIGFhhDOW
Головне - це системність
Системній ідентифікації потенційних вразливостей, аналізі можливих векторів атаки і т. ін.
Найбільший каталог проблем з яким я стикався наразі це мітре
MITRE ATLAS™ https://share.google/MT1GeizgoCPuvAUyR
Але можна почати і з оваспу для ші
OWASP Top 10 for Large Language Model Applications | OWASP Foundation https://share.google/EoDJDilVWIGFhhDOW
Головне - це системність
owasp.org
OWASP Top 10 for Large Language Model Applications | OWASP Foundation
Aims to educate developers, designers, architects, managers, and organizations about the potential security risks when deploying and managing Large Language Models (LLMs)
👍2
а тим часом вайб кодін дістався до марсу :)))
https://x.com/AnthropicAI/status/2017313347918561635
Антропік виклали у своєму твіторі що путь на марсі прокладали за допомогою антропіка
https://x.com/AnthropicAI/status/2017313347918561635
Антропік виклали у своєму твіторі що путь на марсі прокладали за допомогою антропіка
X (formerly Twitter)
Anthropic (@AnthropicAI) on X
Engineers at @NASAJPL used Claude to plot out the route for Perseverance to navigate an approximately four-hundred-meter path on the Martian surface.
Read the full story on our microsite, and see real imagery and footage from Claude’s drive: https://t.co/KHwvxPN0eU
Read the full story on our microsite, and see real imagery and footage from Claude’s drive: https://t.co/KHwvxPN0eU
Антропік заопенсорсив свою бібліотеку плагінів для роботи з знаннями і інформацією.
https://github.com/anthropics/knowledge-work-plugins
Там дійсно багато корисного. Створення візуалізацій і дашбордів. Анализ даних і валідація, біологічні навчання (clinical trial protocol)
А ми вчора на закритому курсі розбирали інформацію про те як застосовувати та будувати свої самовалідуючіся скіли на закритому курсі.
Програму курсу можна побачити тут
https://aigensa.com/learning.html
https://github.com/anthropics/knowledge-work-plugins
Там дійсно багато корисного. Створення візуалізацій і дашбордів. Анализ даних і валідація, біологічні навчання (clinical trial protocol)
А ми вчора на закритому курсі розбирали інформацію про те як застосовувати та будувати свої самовалідуючіся скіли на закритому курсі.
Програму курсу можна побачити тут
https://aigensa.com/learning.html
GitHub
GitHub - anthropics/knowledge-work-plugins: Open source repository of plugins primarily intended for knowledge workers to use in…
Open source repository of plugins primarily intended for knowledge workers to use in Claude Cowork - anthropics/knowledge-work-plugins
❤1
Доречі, статус і проблеми з foundational models можна дивитись тут
Open AI
https://status.openai.com/
Anthropic Claude
https://status.claude.com/
Google Gemini
https://aistudio.google.com/status
Open AI
https://status.openai.com/
Anthropic Claude
https://status.claude.com/
Google Gemini
https://aistudio.google.com/status
Claude
Claude Status
Welcome to Claude's home for real-time and historical data on system performance.
👍2❤1
