доречі вже доволі довгий час тестую ось цю штуку і вважаю її дуже корисною. сам вирішуєш коли записувати і коли ні. куди вставляти результат запису і як цим користуватися
https://wisprflow.ai/r?MAKSYM77
поки що доступна лише для мака, але якість роботи моделей дуже велика, і враховуючи, що я зараз це диктую українською, якість розпізнавання дуже - дуже гарна
https://wisprflow.ai/r?MAKSYM77
поки що доступна лише для мака, але якість роботи моделей дуже велика, і враховуючи, що я зараз це диктую українською, якість розпізнавання дуже - дуже гарна
wisprflow.ai
You have been invited to Flow | Wispr Flow
Flow makes writing quick and clear with seamless voice dictation. It is the fastest, smartest way to type with your voice.
👍5🔥3
Доречі, вважаю що в цій роботі дуже гарно розкладені причини чому ж моделі галюцінують
https://arxiv.org/html/2504.14764v1
Мова як інструмент несе дуже багато невизначеності. Більш того, моделі навчають досягати мети, а як можна досягти мети наприклад "будь гарним хлопцем?"
Тож питання якості роботи агентів мусить бути хоча б вимірюваним для того щоб зрозуміти чи вони відповідають очикуваному рівню якості.
У роботі приводяться три острови:
- острів специфікації
- острів розуміння
- острів генералізації
Перший - про те наскільки специфікована задача.
Другий - про розуміння. бо в безлічі задач виникають corner cases які не можна описати заздалегідь
Третій про те чи достатньо наведених прикладів щоб зробити рішення яке може бути використаним для великої кількості інпутів і чи буде досягнута мета для всіх цих випадків.
https://arxiv.org/html/2504.14764v1
Мова як інструмент несе дуже багато невизначеності. Більш того, моделі навчають досягати мети, а як можна досягти мети наприклад "будь гарним хлопцем?"
Тож питання якості роботи агентів мусить бути хоча б вимірюваним для того щоб зрозуміти чи вони відповідають очикуваному рівню якості.
У роботі приводяться три острови:
- острів специфікації
- острів розуміння
- острів генералізації
Перший - про те наскільки специфікована задача.
Другий - про розуміння. бо в безлічі задач виникають corner cases які не можна описати заздалегідь
Третій про те чи достатньо наведених прикладів щоб зробити рішення яке може бути використаним для великої кількості інпутів і чи буде досягнута мета для всіх цих випадків.
❤1
Read “Ralph Wiggum, explained: the Claude Code loop that keeps going“ by JP Caparas on Medium: https://jpcaparas.medium.com/ralph-wiggum-explained-the-claude-code-loop-that-keeps-going-3250dcc30809
Medium
Ralph Wiggum, explained: the Claude Code loop that keeps going
(chuckles) I'm inside Claude Code.
Цікавий паттерн роботи з консольними тулами для вайб кодінгу. З наступного тижня будемо розбирати на курсі! З нуля для тих хто не дивився у бік технологій що воно таке та як використовувати. Крок за кроком.
🔥3
Нещодавно вийшов новий Claude Code 2.1, а днями, якщо довіряти чуткам виходить Claude 4.7...
2.1 буквально за два тижні викатили до фіга апдейтів до
Навичок та Слеш-команд
Хуків
Дозволів
Фонових Завдань
Агентів та Субагентів
Управління Сесіями
Обробки Зображень
Інтеграції LSP
Система Плагінів та маркетплейсів
Конфігурація та Налаштування
Мультитенантної Архітектури
я вважаю що список просто неймовіний і здається що темп релізів просто неймовірний.
Багато з цього вже працювало в тому самому курсорі, але дещо лише заїжджає і туди. І багато ідей заходить з одних тулів в інші за декілька тижнів.
Такого протистояння майже ніколи не було в комерційних тулах... Тому дуже цікаво наблюдати як може виглядати так звана RAD (швидка розробка аплікації)
2.1 буквально за два тижні викатили до фіга апдейтів до
Навичок та Слеш-команд
Хуків
Дозволів
Фонових Завдань
Агентів та Субагентів
Управління Сесіями
Обробки Зображень
Інтеграції LSP
Система Плагінів та маркетплейсів
Конфігурація та Налаштування
Мультитенантної Архітектури
я вважаю що список просто неймовіний і здається що темп релізів просто неймовірний.
Багато з цього вже працювало в тому самому курсорі, але дещо лише заїжджає і туди. І багато ідей заходить з одних тулів в інші за декілька тижнів.
Такого протистояння майже ніколи не було в комерційних тулах... Тому дуже цікаво наблюдати як може виглядати так звана RAD (швидка розробка аплікації)
❤5
А тим часом адопшн клод кода зростає з шаленою швидкістю. 4.5 вже на першому місці на лідерборді опенраутері.
https://x.com/i/status/2011823610386600009
https://x.com/i/status/2011823610386600009
👍1
а ви знаєте що xml останнім часом використовується все більше?!
https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/use-xml-tags
мовні моделі і їх промптінг все ще не дають 100% гарантії результату.
більше того... скоріш за все з трансформерами і не дадуть.
втім промпт інженери намагаються знайти всі можливі способи для того щоб від 50%-70% вірогідності досягти до 90% або навіть вище.
більш за те, моделі не завжди знають як їм виявити чи закінчила людина свою думку чи ні?
використання xml - саме такий спосіб.
можливість розбити (указати) що інструкція, що робити, який формат очикується від моделі або агента дуже гарно структуруються за допомогою тегів.
як це виглядає:
<команда>
знайди інформацію про...
</команда>
<додатковий контекст>
шукати необхідно тут, там і ще десь
</додатковий контекст>
<формат>
- рік у форматі РРР-м-д
- ПІБ
- розмір одягу
</формат>
https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/use-xml-tags
мовні моделі і їх промптінг все ще не дають 100% гарантії результату.
більше того... скоріш за все з трансформерами і не дадуть.
втім промпт інженери намагаються знайти всі можливі способи для того щоб від 50%-70% вірогідності досягти до 90% або навіть вище.
більш за те, моделі не завжди знають як їм виявити чи закінчила людина свою думку чи ні?
використання xml - саме такий спосіб.
можливість розбити (указати) що інструкція, що робити, який формат очикується від моделі або агента дуже гарно структуруються за допомогою тегів.
як це виглядає:
<команда>
знайди інформацію про...
</команда>
<додатковий контекст>
шукати необхідно тут, там і ще десь
</додатковий контекст>
<формат>
- рік у форматі РРР-м-д
- ПІБ
- розмір одягу
</формат>
Claude Platform Docs
Prompting best practices
Comprehensive guide to prompt engineering techniques for Claude's latest models, covering clarity, examples, XML structuring, thinking, and agentic systems.
❤1👍1🔥1
У MiniMax підвезли підтримку MLX
Що це означає? Що тепер його можна ранати на Маках використовуючи залізо на повну.
https://github.com/MiniMax-AI/MiniMax-M2.1
Як то кажуть... enjoy! 😉
Що це означає? Що тепер його можна ранати на Маках використовуючи залізо на повну.
https://github.com/MiniMax-AI/MiniMax-M2.1
Як то кажуть... enjoy! 😉
GitHub
GitHub - MiniMax-AI/MiniMax-M2.1: MiniMax M2.1, a SOTA model for real-world dev & agents.
MiniMax M2.1, a SOTA model for real-world dev & agents. - MiniMax-AI/MiniMax-M2.1
👍1
Оце так новина. Для мене це було критерієм важкого програмування...
Довгий час агенти не могли впоратися з цією задачею... Але здається зараз рахунок іде на дні і години...
https://search.app/YuQZk
Довгий час агенти не могли впоратися з цією задачею... Але здається зараз рахунок іде на дні і години...
https://search.app/YuQZk
Якщо хтось цікавиться безпековим аспектом розробки на базі вмм - необхідно розуміти що головний аспект будь якої безпечної системи с системності.
Системній ідентифікації потенційних вразливостей, аналізі можливих векторів атаки і т. ін.
Найбільший каталог проблем з яким я стикався наразі це мітре
MITRE ATLAS™ https://share.google/MT1GeizgoCPuvAUyR
Але можна почати і з оваспу для ші
OWASP Top 10 for Large Language Model Applications | OWASP Foundation https://share.google/EoDJDilVWIGFhhDOW
Головне - це системність
Системній ідентифікації потенційних вразливостей, аналізі можливих векторів атаки і т. ін.
Найбільший каталог проблем з яким я стикався наразі це мітре
MITRE ATLAS™ https://share.google/MT1GeizgoCPuvAUyR
Але можна почати і з оваспу для ші
OWASP Top 10 for Large Language Model Applications | OWASP Foundation https://share.google/EoDJDilVWIGFhhDOW
Головне - це системність
owasp.org
OWASP Top 10 for Large Language Model Applications | OWASP Foundation
Aims to educate developers, designers, architects, managers, and organizations about the potential security risks when deploying and managing Large Language Models (LLMs)
👍2
а тим часом вайб кодін дістався до марсу :)))
https://x.com/AnthropicAI/status/2017313347918561635
Антропік виклали у своєму твіторі що путь на марсі прокладали за допомогою антропіка
https://x.com/AnthropicAI/status/2017313347918561635
Антропік виклали у своєму твіторі що путь на марсі прокладали за допомогою антропіка
X (formerly Twitter)
Anthropic (@AnthropicAI) on X
Engineers at @NASAJPL used Claude to plot out the route for Perseverance to navigate an approximately four-hundred-meter path on the Martian surface.
Read the full story on our microsite, and see real imagery and footage from Claude’s drive: https://t.co/KHwvxPN0eU
Read the full story on our microsite, and see real imagery and footage from Claude’s drive: https://t.co/KHwvxPN0eU
Антропік заопенсорсив свою бібліотеку плагінів для роботи з знаннями і інформацією.
https://github.com/anthropics/knowledge-work-plugins
Там дійсно багато корисного. Створення візуалізацій і дашбордів. Анализ даних і валідація, біологічні навчання (clinical trial protocol)
А ми вчора на закритому курсі розбирали інформацію про те як застосовувати та будувати свої самовалідуючіся скіли на закритому курсі.
Програму курсу можна побачити тут
https://aigensa.com/learning.html
https://github.com/anthropics/knowledge-work-plugins
Там дійсно багато корисного. Створення візуалізацій і дашбордів. Анализ даних і валідація, біологічні навчання (clinical trial protocol)
А ми вчора на закритому курсі розбирали інформацію про те як застосовувати та будувати свої самовалідуючіся скіли на закритому курсі.
Програму курсу можна побачити тут
https://aigensa.com/learning.html
GitHub
GitHub - anthropics/knowledge-work-plugins: Open source repository of plugins primarily intended for knowledge workers to use in…
Open source repository of plugins primarily intended for knowledge workers to use in Claude Cowork - anthropics/knowledge-work-plugins
❤1
Доречі, статус і проблеми з foundational models можна дивитись тут
Open AI
https://status.openai.com/
Anthropic Claude
https://status.claude.com/
Google Gemini
https://aistudio.google.com/status
Open AI
https://status.openai.com/
Anthropic Claude
https://status.claude.com/
Google Gemini
https://aistudio.google.com/status
Claude
Claude Status
Welcome to Claude's home for real-time and historical data on system performance.
👍2❤1
Forwarded from Dev Jungles (Podkolzin Andrii)
Є велика новина.
На цьому тижні буде БАГАТО контенту на каналі, бо на ньому пройде аж ціла конференція.
Субота: https://youtube.com/live/o3OlvfQCJoM
Неділя: https://youtube.com/live/6a1HiBALXXg
2 дня, 8 доповідей
День 1 - здебільшого про трюки і досвід використання ШІ
День 2 - дотНет, інфра
Моя доповідь буде закривати 2й день конференції.
Подробиці на Dou: https://dou.ua/calendar/56492
На цьому тижні буде БАГАТО контенту на каналі, бо на ньому пройде аж ціла конференція.
Субота: https://youtube.com/live/o3OlvfQCJoM
Неділя: https://youtube.com/live/6a1HiBALXXg
2 дня, 8 доповідей
День 1 - здебільшого про трюки і досвід використання ШІ
День 2 - дотНет, інфра
Моя доповідь буде закривати 2й день конференції.
Подробиці на Dou: https://dou.ua/calendar/56492
YouTube
AI/.NET Tech Conf. День 1: Рефакторінг, довіра, RTS гра і SDLC за допомогою AI
День 1:
14:00–15:00
👤 Меньшаков Федiр
CTO dovirai, Head of Development inbulk
🎤 Рефакторинг проєкту з 1 млн рядків коду з використанням ШІ
Інженерний досвід + інструменти ШІ + системний підхід = 5 днів замість 5 тижнів.
На прикладі рефакторингу великого…
14:00–15:00
👤 Меньшаков Федiр
CTO dovirai, Head of Development inbulk
🎤 Рефакторинг проєкту з 1 млн рядків коду з використанням ШІ
Інженерний досвід + інструменти ШІ + системний підхід = 5 днів замість 5 тижнів.
На прикладі рефакторингу великого…
❤6👍1
https://cs.stanford.edu/~knuth/papers/claude-cycles.pdf
Ну що... Один з відоміших професорів у Computer Science щойно сказав публічно що йому необхідно переосмислити своє бачення генеративного штучного інтелекту.
Дуже поважаю професора...
А ви вже почали переосмислювати? І які проблеми ШІ вже вирішує для (і за) вас?
Ну що... Один з відоміших професорів у Computer Science щойно сказав публічно що йому необхідно переосмислити своє бачення генеративного штучного інтелекту.
Дуже поважаю професора...
А ви вже почали переосмислювати? І які проблеми ШІ вже вирішує для (і за) вас?
❤5
А ви знаєте що клод код by default віджерає 33К а може і більше токенів для автокомпакту.
Що тако доволі суттєво впливає на перфоманс вашого агенту і набагато частіше наближає вас до "стелі".
Цю фічу можна відключити за допомогою команди /config.
Тоді вам буде доступним набагато більше контексту.
Який можна менеджити все тими ж командами /compact або /clear
Що тако доволі суттєво впливає на перфоманс вашого агенту і набагато частіше наближає вас до "стелі".
Цю фічу можна відключити за допомогою команди /config.
Тоді вам буде доступним набагато більше контексту.
Який можна менеджити все тими ж командами /compact або /clear
🔥5👍1
