https://mistral.ai/news/mistral-3
а тим часом містраль все ж таки випустив нові моделі %)
тож прошу дивитись і насолоджуватись! %)
як на мене моделі дуже цікаві. enjoy! 😉
містраль намагається робити невеликі сфокусовані моделі які досягають дуже гарного cost / benefits співвідношення.
тож ви не отримаєте супер високої якості від аналітичних здібностей моделей, але для кодінгу воно працює дуже непогано
а тим часом містраль все ж таки випустив нові моделі %)
тож прошу дивитись і насолоджуватись! %)
як на мене моделі дуже цікаві. enjoy! 😉
містраль намагається робити невеликі сфокусовані моделі які досягають дуже гарного cost / benefits співвідношення.
тож ви не отримаєте супер високої якості від аналітичних здібностей моделей, але для кодінгу воно працює дуже непогано
Mistral AI
Introducing Mistral 3 | Mistral AI
The most powerful AI platform for enterprises. Customize, fine-tune, and deploy AI assistants, autonomous agents, and multimodal AI with open models.
А тим часом кодекс вже почав (поки що в експериментальному режимі) підтримувати скіли. Що це означає: меньше проблем з менеджментом контексту та більше токенів для контексту який ми самі створимо замість забитого MCP. Дешевші взаємодії з ллм. І меньше часу на генерацію відповідей.
https://share.google/A06J4BucP6BeEB5pV
Оригінал ідеї скілів тут
https://share.google/6y4UV7gIol3EqrkKo
https://share.google/A06J4BucP6BeEB5pV
Оригінал ідеї скілів тут
https://share.google/6y4UV7gIol3EqrkKo
OpenAI Developer Community
Skills for Codex: Experimental support starting today
I have seen this feature request for Codex quite a few times and now it’s actually coming: Here is a link to the rough documentation. And an explanation what skills are and why you may want to use them. Happy building and please remember that this is…
❤3
Здається і на нашій вулиці свято!
https://openrouter.ai/docs/guides/guides/claude-code-integration
У опенраутер занесли інтеграцію з Claude Code.
У великому відсотку випадків я все ще вважаю що це найкращий тул для агнетного кодінгу. Окрім випадків коли вам потрібно бачити або контролювати до останньої коми код який ви пишете.
https://openrouter.ai/docs/guides/guides/claude-code-integration
У опенраутер занесли інтеграцію з Claude Code.
У великому відсотку випадків я все ще вважаю що це найкращий тул для агнетного кодінгу. Окрім випадків коли вам потрібно бачити або контролювати до останньої коми код який ви пишете.
З цікавого в claude code нещодавна занесли LSP. Що це означає?
що пошук символів в CLI based тулах буде знаходити всі "entries" як це зараз робить ваша IDE. Це суттєво пришвидшить якість рефакторингу і покращить роботу з наприклад оверрайдами методів. Тож в наступному році нас чекає ще більше цікавих прикладів використання і все більше інструментів для написання коду який ми вже пишемо.
Якщо комусь цікаві новини вайб кодінгу - слідкуйте за
https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
https://developers.openai.com/codex/changelog/
та
https://geminicli.com/docs/changelogs/
що пошук символів в CLI based тулах буде знаходити всі "entries" як це зараз робить ваша IDE. Це суттєво пришвидшить якість рефакторингу і покращить роботу з наприклад оверрайдами методів. Тож в наступному році нас чекає ще більше цікавих прикладів використання і все більше інструментів для написання коду який ми вже пишемо.
Якщо комусь цікаві новини вайб кодінгу - слідкуйте за
https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
https://developers.openai.com/codex/changelog/
та
https://geminicli.com/docs/changelogs/
GitHub
claude-code/CHANGELOG.md at main · anthropics/claude-code
Claude Code is an agentic coding tool that lives in your terminal, understands your codebase, and helps you code faster by executing routine tasks, explaining complex code, and handling git workflo...
👍3🔥1
доречі вже доволі довгий час тестую ось цю штуку і вважаю її дуже корисною. сам вирішуєш коли записувати і коли ні. куди вставляти результат запису і як цим користуватися
https://wisprflow.ai/r?MAKSYM77
поки що доступна лише для мака, але якість роботи моделей дуже велика, і враховуючи, що я зараз це диктую українською, якість розпізнавання дуже - дуже гарна
https://wisprflow.ai/r?MAKSYM77
поки що доступна лише для мака, але якість роботи моделей дуже велика, і враховуючи, що я зараз це диктую українською, якість розпізнавання дуже - дуже гарна
wisprflow.ai
You have been invited to Flow | Wispr Flow
Flow makes writing quick and clear with seamless voice dictation. It is the fastest, smartest way to type with your voice.
👍5🔥3
Доречі, вважаю що в цій роботі дуже гарно розкладені причини чому ж моделі галюцінують
https://arxiv.org/html/2504.14764v1
Мова як інструмент несе дуже багато невизначеності. Більш того, моделі навчають досягати мети, а як можна досягти мети наприклад "будь гарним хлопцем?"
Тож питання якості роботи агентів мусить бути хоча б вимірюваним для того щоб зрозуміти чи вони відповідають очикуваному рівню якості.
У роботі приводяться три острови:
- острів специфікації
- острів розуміння
- острів генералізації
Перший - про те наскільки специфікована задача.
Другий - про розуміння. бо в безлічі задач виникають corner cases які не можна описати заздалегідь
Третій про те чи достатньо наведених прикладів щоб зробити рішення яке може бути використаним для великої кількості інпутів і чи буде досягнута мета для всіх цих випадків.
https://arxiv.org/html/2504.14764v1
Мова як інструмент несе дуже багато невизначеності. Більш того, моделі навчають досягати мети, а як можна досягти мети наприклад "будь гарним хлопцем?"
Тож питання якості роботи агентів мусить бути хоча б вимірюваним для того щоб зрозуміти чи вони відповідають очикуваному рівню якості.
У роботі приводяться три острови:
- острів специфікації
- острів розуміння
- острів генералізації
Перший - про те наскільки специфікована задача.
Другий - про розуміння. бо в безлічі задач виникають corner cases які не можна описати заздалегідь
Третій про те чи достатньо наведених прикладів щоб зробити рішення яке може бути використаним для великої кількості інпутів і чи буде досягнута мета для всіх цих випадків.
❤1
Read “Ralph Wiggum, explained: the Claude Code loop that keeps going“ by JP Caparas on Medium: https://jpcaparas.medium.com/ralph-wiggum-explained-the-claude-code-loop-that-keeps-going-3250dcc30809
Medium
Ralph Wiggum, explained: the Claude Code loop that keeps going
(chuckles) I'm inside Claude Code.
Цікавий паттерн роботи з консольними тулами для вайб кодінгу. З наступного тижня будемо розбирати на курсі! З нуля для тих хто не дивився у бік технологій що воно таке та як використовувати. Крок за кроком.
🔥3
Нещодавно вийшов новий Claude Code 2.1, а днями, якщо довіряти чуткам виходить Claude 4.7...
2.1 буквально за два тижні викатили до фіга апдейтів до
Навичок та Слеш-команд
Хуків
Дозволів
Фонових Завдань
Агентів та Субагентів
Управління Сесіями
Обробки Зображень
Інтеграції LSP
Система Плагінів та маркетплейсів
Конфігурація та Налаштування
Мультитенантної Архітектури
я вважаю що список просто неймовіний і здається що темп релізів просто неймовірний.
Багато з цього вже працювало в тому самому курсорі, але дещо лише заїжджає і туди. І багато ідей заходить з одних тулів в інші за декілька тижнів.
Такого протистояння майже ніколи не було в комерційних тулах... Тому дуже цікаво наблюдати як може виглядати так звана RAD (швидка розробка аплікації)
2.1 буквально за два тижні викатили до фіга апдейтів до
Навичок та Слеш-команд
Хуків
Дозволів
Фонових Завдань
Агентів та Субагентів
Управління Сесіями
Обробки Зображень
Інтеграції LSP
Система Плагінів та маркетплейсів
Конфігурація та Налаштування
Мультитенантної Архітектури
я вважаю що список просто неймовіний і здається що темп релізів просто неймовірний.
Багато з цього вже працювало в тому самому курсорі, але дещо лише заїжджає і туди. І багато ідей заходить з одних тулів в інші за декілька тижнів.
Такого протистояння майже ніколи не було в комерційних тулах... Тому дуже цікаво наблюдати як може виглядати так звана RAD (швидка розробка аплікації)
❤5
А тим часом адопшн клод кода зростає з шаленою швидкістю. 4.5 вже на першому місці на лідерборді опенраутері.
https://x.com/i/status/2011823610386600009
https://x.com/i/status/2011823610386600009
👍1
а ви знаєте що xml останнім часом використовується все більше?!
https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/use-xml-tags
мовні моделі і їх промптінг все ще не дають 100% гарантії результату.
більше того... скоріш за все з трансформерами і не дадуть.
втім промпт інженери намагаються знайти всі можливі способи для того щоб від 50%-70% вірогідності досягти до 90% або навіть вище.
більш за те, моделі не завжди знають як їм виявити чи закінчила людина свою думку чи ні?
використання xml - саме такий спосіб.
можливість розбити (указати) що інструкція, що робити, який формат очикується від моделі або агента дуже гарно структуруються за допомогою тегів.
як це виглядає:
<команда>
знайди інформацію про...
</команда>
<додатковий контекст>
шукати необхідно тут, там і ще десь
</додатковий контекст>
<формат>
- рік у форматі РРР-м-д
- ПІБ
- розмір одягу
</формат>
https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/use-xml-tags
мовні моделі і їх промптінг все ще не дають 100% гарантії результату.
більше того... скоріш за все з трансформерами і не дадуть.
втім промпт інженери намагаються знайти всі можливі способи для того щоб від 50%-70% вірогідності досягти до 90% або навіть вище.
більш за те, моделі не завжди знають як їм виявити чи закінчила людина свою думку чи ні?
використання xml - саме такий спосіб.
можливість розбити (указати) що інструкція, що робити, який формат очикується від моделі або агента дуже гарно структуруються за допомогою тегів.
як це виглядає:
<команда>
знайди інформацію про...
</команда>
<додатковий контекст>
шукати необхідно тут, там і ще десь
</додатковий контекст>
<формат>
- рік у форматі РРР-м-д
- ПІБ
- розмір одягу
</формат>
Claude Platform Docs
Prompting best practices
Comprehensive guide to prompt engineering techniques for Claude's latest models, covering clarity, examples, XML structuring, thinking, and agentic systems.
❤1👍1🔥1
У MiniMax підвезли підтримку MLX
Що це означає? Що тепер його можна ранати на Маках використовуючи залізо на повну.
https://github.com/MiniMax-AI/MiniMax-M2.1
Як то кажуть... enjoy! 😉
Що це означає? Що тепер його можна ранати на Маках використовуючи залізо на повну.
https://github.com/MiniMax-AI/MiniMax-M2.1
Як то кажуть... enjoy! 😉
GitHub
GitHub - MiniMax-AI/MiniMax-M2.1: MiniMax M2.1, a SOTA model for real-world dev & agents.
MiniMax M2.1, a SOTA model for real-world dev & agents. - MiniMax-AI/MiniMax-M2.1
👍1
Оце так новина. Для мене це було критерієм важкого програмування...
Довгий час агенти не могли впоратися з цією задачею... Але здається зараз рахунок іде на дні і години...
https://search.app/YuQZk
Довгий час агенти не могли впоратися з цією задачею... Але здається зараз рахунок іде на дні і години...
https://search.app/YuQZk
Якщо хтось цікавиться безпековим аспектом розробки на базі вмм - необхідно розуміти що головний аспект будь якої безпечної системи с системності.
Системній ідентифікації потенційних вразливостей, аналізі можливих векторів атаки і т. ін.
Найбільший каталог проблем з яким я стикався наразі це мітре
MITRE ATLAS™ https://share.google/MT1GeizgoCPuvAUyR
Але можна почати і з оваспу для ші
OWASP Top 10 for Large Language Model Applications | OWASP Foundation https://share.google/EoDJDilVWIGFhhDOW
Головне - це системність
Системній ідентифікації потенційних вразливостей, аналізі можливих векторів атаки і т. ін.
Найбільший каталог проблем з яким я стикався наразі це мітре
MITRE ATLAS™ https://share.google/MT1GeizgoCPuvAUyR
Але можна почати і з оваспу для ші
OWASP Top 10 for Large Language Model Applications | OWASP Foundation https://share.google/EoDJDilVWIGFhhDOW
Головне - це системність
owasp.org
OWASP Top 10 for Large Language Model Applications | OWASP Foundation
Aims to educate developers, designers, architects, managers, and organizations about the potential security risks when deploying and managing Large Language Models (LLMs)
👍2
а тим часом вайб кодін дістався до марсу :)))
https://x.com/AnthropicAI/status/2017313347918561635
Антропік виклали у своєму твіторі що путь на марсі прокладали за допомогою антропіка
https://x.com/AnthropicAI/status/2017313347918561635
Антропік виклали у своєму твіторі що путь на марсі прокладали за допомогою антропіка
X (formerly Twitter)
Anthropic (@AnthropicAI) on X
Engineers at @NASAJPL used Claude to plot out the route for Perseverance to navigate an approximately four-hundred-meter path on the Martian surface.
Read the full story on our microsite, and see real imagery and footage from Claude’s drive: https://t.co/KHwvxPN0eU
Read the full story on our microsite, and see real imagery and footage from Claude’s drive: https://t.co/KHwvxPN0eU
Антропік заопенсорсив свою бібліотеку плагінів для роботи з знаннями і інформацією.
https://github.com/anthropics/knowledge-work-plugins
Там дійсно багато корисного. Створення візуалізацій і дашбордів. Анализ даних і валідація, біологічні навчання (clinical trial protocol)
А ми вчора на закритому курсі розбирали інформацію про те як застосовувати та будувати свої самовалідуючіся скіли на закритому курсі.
Програму курсу можна побачити тут
https://aigensa.com/learning.html
https://github.com/anthropics/knowledge-work-plugins
Там дійсно багато корисного. Створення візуалізацій і дашбордів. Анализ даних і валідація, біологічні навчання (clinical trial protocol)
А ми вчора на закритому курсі розбирали інформацію про те як застосовувати та будувати свої самовалідуючіся скіли на закритому курсі.
Програму курсу можна побачити тут
https://aigensa.com/learning.html
GitHub
GitHub - anthropics/knowledge-work-plugins: Open source repository of plugins primarily intended for knowledge workers to use in…
Open source repository of plugins primarily intended for knowledge workers to use in Claude Cowork - anthropics/knowledge-work-plugins
❤1
Доречі, статус і проблеми з foundational models можна дивитись тут
Open AI
https://status.openai.com/
Anthropic Claude
https://status.claude.com/
Google Gemini
https://aistudio.google.com/status
Open AI
https://status.openai.com/
Anthropic Claude
https://status.claude.com/
Google Gemini
https://aistudio.google.com/status
Claude
Claude Status
Welcome to Claude's home for real-time and historical data on system performance.
👍2❤1
