Vibe Coders UA
154 subscribers
7 photos
42 links
Все про вайб кодінг, LLM та рішення на базі Generative AI
Download Telegram
доречі вже доволі довгий час тестую ось цю штуку і вважаю її дуже корисною. сам вирішуєш коли записувати і коли ні. куди вставляти результат запису і як цим користуватися

https://wisprflow.ai/r?MAKSYM77

поки що доступна лише для мака, але якість роботи моделей дуже велика, і враховуючи, що я зараз це диктую українською, якість розпізнавання дуже - дуже гарна
👍5🔥3
Доречі, вважаю що в цій роботі дуже гарно розкладені причини чому ж моделі галюцінують

https://arxiv.org/html/2504.14764v1

Мова як інструмент несе дуже багато невизначеності. Більш того, моделі навчають досягати мети, а як можна досягти мети наприклад "будь гарним хлопцем?"
Тож питання якості роботи агентів мусить бути хоча б вимірюваним для того щоб зрозуміти чи вони відповідають очикуваному рівню якості.

У роботі приводяться три острови:
- острів специфікації
- острів розуміння
- острів генералізації

Перший - про те наскільки специфікована задача.
Другий - про розуміння. бо в безлічі задач виникають corner cases які не можна описати заздалегідь
Третій про те чи достатньо наведених прикладів щоб зробити рішення яке може бути використаним для великої кількості інпутів і чи буде досягнута мета для всіх цих випадків.
1
Цікавий паттерн роботи з консольними тулами для вайб кодінгу. З наступного тижня будемо розбирати на курсі! З нуля для тих хто не дивився у бік технологій що воно таке та як використовувати. Крок за кроком.
🔥3
Нещодавно вийшов новий Claude Code 2.1, а днями, якщо довіряти чуткам виходить Claude 4.7...

2.1 буквально за два тижні викатили до фіга апдейтів до

Навичок та Слеш-команд
Хуків
Дозволів
Фонових Завдань
Агентів та Субагентів
Управління Сесіями
Обробки Зображень
Інтеграції LSP
Система Плагінів та маркетплейсів
Конфігурація та Налаштування
Мультитенантної Архітектури

я вважаю що список просто неймовіний і здається що темп релізів просто неймовірний.
Багато з цього вже працювало в тому самому курсорі, але дещо лише заїжджає і туди. І багато ідей заходить з одних тулів в інші за декілька тижнів.

Такого протистояння майже ніколи не було в комерційних тулах... Тому дуже цікаво наблюдати як може виглядати так звана RAD (швидка розробка аплікації)
5
А тим часом адопшн клод кода зростає з шаленою швидкістю. 4.5 вже на першому місці на лідерборді опенраутері.

https://x.com/i/status/2011823610386600009
👍1
а ви знаєте що xml останнім часом використовується все більше?!

https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/use-xml-tags

мовні моделі і їх промптінг все ще не дають 100% гарантії результату.
більше того... скоріш за все з трансформерами і не дадуть.
втім промпт інженери намагаються знайти всі можливі способи для того щоб від 50%-70% вірогідності досягти до 90% або навіть вище.
більш за те, моделі не завжди знають як їм виявити чи закінчила людина свою думку чи ні?

використання xml - саме такий спосіб.
можливість розбити (указати) що інструкція, що робити, який формат очикується від моделі або агента дуже гарно структуруються за допомогою тегів.

як це виглядає:

<команда>
знайди інформацію про...
</команда>

<додатковий контекст>
шукати необхідно тут, там і ще десь
</додатковий контекст>

<формат>
- рік у форматі РРР-м-д
- ПІБ
- розмір одягу
</формат>
1👍1🔥1
У MiniMax підвезли підтримку MLX
Що це означає? Що тепер його можна ранати на Маках використовуючи залізо на повну.

https://github.com/MiniMax-AI/MiniMax-M2.1

Як то кажуть... enjoy! 😉
👍1
Оце так новина. Для мене це було критерієм важкого програмування...
Довгий час агенти не могли впоратися з цією задачею... Але здається зараз рахунок іде на дні і години...
https://search.app/YuQZk
Якщо хтось цікавиться безпековим аспектом розробки на базі вмм - необхідно розуміти що головний аспект будь якої безпечної системи с системності.
Системній ідентифікації потенційних вразливостей, аналізі можливих векторів атаки і т. ін.
Найбільший каталог проблем з яким я стикався наразі це мітре

MITRE ATLAS https://share.google/MT1GeizgoCPuvAUyR

Але можна почати і з оваспу для ші

OWASP Top 10 for Large Language Model Applications | OWASP Foundation https://share.google/EoDJDilVWIGFhhDOW

Головне - це системність
👍2
Антропік заопенсорсив свою бібліотеку плагінів для роботи з знаннями і інформацією.

https://github.com/anthropics/knowledge-work-plugins

Там дійсно багато корисного. Створення візуалізацій і дашбордів. Анализ даних і валідація, біологічні навчання (clinical trial protocol)

А ми вчора на закритому курсі розбирали інформацію про те як застосовувати та будувати свої самовалідуючіся скіли на закритому курсі.

Програму курсу можна побачити тут
https://aigensa.com/learning.html
1
Тільки сьогодні про нього згадував...
Channel photo updated
Доречі, статус і проблеми з foundational models можна дивитись тут

Open AI
https://status.openai.com/

Anthropic Claude
https://status.claude.com/

Google Gemini
https://aistudio.google.com/status
👍21
Скоро буде щось цікаве!
1
Forwarded from Dev Jungles (Podkolzin Andrii)
Є велика новина.
На цьому тижні буде БАГАТО контенту на каналі, бо на ньому пройде аж ціла конференція.

Субота: https://youtube.com/live/o3OlvfQCJoM
Неділя: https://youtube.com/live/6a1HiBALXXg

2 дня, 8 доповідей
День 1 - здебільшого про трюки і досвід використання ШІ
День 2 - дотНет, інфра

Моя доповідь буде закривати 2й день конференції.

Подробиці на Dou: https://dou.ua/calendar/56492
6👍1
https://cs.stanford.edu/~knuth/papers/claude-cycles.pdf

Ну що... Один з відоміших професорів у Computer Science щойно сказав публічно що йому необхідно переосмислити своє бачення генеративного штучного інтелекту.
Дуже поважаю професора...
А ви вже почали переосмислювати? І які проблеми ШІ вже вирішує для (і за) вас?
5
А ви знаєте що клод код by default віджерає 33К а може і більше токенів для автокомпакту.
Що тако доволі суттєво впливає на перфоманс вашого агенту і набагато частіше наближає вас до "стелі".
Цю фічу можна відключити за допомогою команди /config.
Тоді вам буде доступним набагато більше контексту.
Який можна менеджити все тими ж командами /compact або /clear
🔥5👍1