Большая модель Google пока не вышла, посмотрим, на что способна малая. Здесь, правда, скажу, что и Антропик и ОпенЭйАй далеко ушли в обвязке моделей своими продуктами - посмотрим, как с этим справится Гугл. Терминальный агент у них, честно говоря, так себе. Одной хорошей модели уже мало, нужна еще и ее обвязка
https://t.me/ai_machinelearning_big_data/10171
https://t.me/ai_machinelearning_big_data/10171
Telegram
Machinelearning
Google выкатили сразу два больших релиза: Gemini Omni и Gemini 3.5 Flash
Похоже, Google снова пытается перехватить повестку в ИИ.
Первый релиз - Gemini Omni. Это семейство мультимодальных моделей, которые работают почти со всем сразу: текстом, кодом, изображениями…
Похоже, Google снова пытается перехватить повестку в ИИ.
Первый релиз - Gemini Omni. Это семейство мультимодальных моделей, которые работают почти со всем сразу: текстом, кодом, изображениями…
Потратил с командой /goal 70% недельных токенов за 2 дня - и вот OpenAI обнуляет лимиты. Не рассчитывал, но надеюсь. Пожалуй, поставлю на ночь что-нибудь тяжелое погонять...
Forwarded from КПД
Пока все обсуждают новую Гемини Флэш, NVIDIA тихонько выкатили серию гибридных авторегрессионно-диффузионных моделей Nemotron-Labs-Diffusion.
В коллекции 6 чисто языковых моделей - 3B, 8B, 14B LM-ки с алайнментом и их базовые модели, и еще 8B диффузионная VLM.
Модели имеют 3 режима работы:
🤓 Авторегрессионную генерацию
🚀 Диффузионную генерацию
🧙♂️ Спекулятивную генерацию с набрасыванием чернового варианта диффузией и AR самопроверкой
По качеству оно типа немного лучше Qwen-3-8B, но по скорости в самоспекулятивном режиме обходит Qwen3-8B-Eagle3 в 3 раза. Правда, вышел уже Qwen 3.5 ...
[Техрепорт]
В коллекции 6 чисто языковых моделей - 3B, 8B, 14B LM-ки с алайнментом и их базовые модели, и еще 8B диффузионная VLM.
Модели имеют 3 режима работы:
🤓 Авторегрессионную генерацию
🚀 Диффузионную генерацию
🧙♂️ Спекулятивную генерацию с набрасыванием чернового варианта диффузией и AR самопроверкой
По качеству оно типа немного лучше Qwen-3-8B, но по скорости в самоспекулятивном режиме обходит Qwen3-8B-Eagle3 в 3 раза. Правда, вышел уже Qwen 3.5 ...
[Техрепорт]
Google меняет Gemini CLI на Antigravity CLI - и пока кто-то в твиттерах радуется, я скажу, что это жесть. Во-первых у меня не работает, так как Google продолжает блокировать меня исходя из того, что я живу в стране-изгое (модель, кстати, дает. Настройки аккаунта и канадский телефон не помогают). Ну так еще и протокол acp по подключению агентов не будет работать в Антигравити. Ну и зачем такие обновления?
Можно, конечно, поплясать с бубном и попробовать прикрутить Gemini к оппнсорсному Claude code или OpenCode, но вот даже не знаю, оно мне надо?
Можно, конечно, поплясать с бубном и попробовать прикрутить Gemini к оппнсорсному Claude code или OpenCode, но вот даже не знаю, оно мне надо?
Forwarded from Data Secrets
Создатель механизма внимания Йошуа Бенджио предложил новую архитектуру для нейросетей
Вместе с исследователями из лабы KAIST и Нью-Йоркского университета он анонсировал GRAM – Generative Recursive reAsoning Models.
Ученые уже давно экспериментируют с так называемыми Recursive Reasoning Models. Идея в том, что в отличие от привычных ризонинг моделей они рассуждают не с помощью генерации дополнительных токенов, а как бы про себя, в пространстве внутренних состояний, которые итеративно уточняются, улучшая ответ.
Преимущество в теории очевидно: можно делать сотни шагов рассуждения без раздувания контекста. Но до этой работы такие модели были детерминированы, то есть при одинаковом входе всегда шли по одному и тому же пути и приходили к единственному ответу.
Почему это проблема? Потому что случайность – это источник креативного рассуждения самого по себе. В обычных ризонерах она есть, и это открывает путь к исследованию альтернатив и масштабированию через параллельный перебор. Нет случайности – нет возможности попробовать иначе, и это тупиковое развитие.
Заслуга GRAM как раз в том, что это первая в своем классе стохастичная модель. На каждом шаге рекурсии модель вычисляет детерминированный шаг – куда двигаться дальше – и добавляет к нему стохастический сдвиг. Среднее этого сдвига задает направление, а дисперсия – степень исследования. Чем сложнее задача, тем шире модель разбрасывает траектории. Затем из множества таких траекторий с помощью реворд модели выбирается лучшая.
На ARC-AGI GRAM набирает 52%, это примерно уровень GPT-5.2. А еще модель просто отлично играет в судоку.
https://ahn-ml.github.io/gram-website/
Вместе с исследователями из лабы KAIST и Нью-Йоркского университета он анонсировал GRAM – Generative Recursive reAsoning Models.
Ученые уже давно экспериментируют с так называемыми Recursive Reasoning Models. Идея в том, что в отличие от привычных ризонинг моделей они рассуждают не с помощью генерации дополнительных токенов, а как бы про себя, в пространстве внутренних состояний, которые итеративно уточняются, улучшая ответ.
Преимущество в теории очевидно: можно делать сотни шагов рассуждения без раздувания контекста. Но до этой работы такие модели были детерминированы, то есть при одинаковом входе всегда шли по одному и тому же пути и приходили к единственному ответу.
Почему это проблема? Потому что случайность – это источник креативного рассуждения самого по себе. В обычных ризонерах она есть, и это открывает путь к исследованию альтернатив и масштабированию через параллельный перебор. Нет случайности – нет возможности попробовать иначе, и это тупиковое развитие.
Заслуга GRAM как раз в том, что это первая в своем классе стохастичная модель. На каждом шаге рекурсии модель вычисляет детерминированный шаг – куда двигаться дальше – и добавляет к нему стохастический сдвиг. Среднее этого сдвига задает направление, а дисперсия – степень исследования. Чем сложнее задача, тем шире модель разбрасывает траектории. Затем из множества таких траекторий с помощью реворд модели выбирается лучшая.
На ARC-AGI GRAM набирает 52%, это примерно уровень GPT-5.2. А еще модель просто отлично играет в судоку.
https://ahn-ml.github.io/gram-website/
Ходит мнение, что новость про решение задачи Эрдеша - это прогрев перед запуском GPT-5.6.
https://t.me/ai_machinelearning_big_data/10180
https://t.me/ai_machinelearning_big_data/10180
Telegram
Machinelearning
📌 OpenAI показала редкий для ИИ результат: внутренняя модель самостоятельно нашла контрпример к известной задаче из дискретной геометрии, которую Пал Эрдёш сформулировал ещё в 1946 году.
Суть задачи простая: есть n точек на плоскости. Нужно понять, сколько…
Суть задачи простая: есть n точек на плоскости. Нужно понять, сколько…
Forwarded from Анализ данных (Data analysis)
Qwen выкатила Qwen3.7-Max: модель под агентов.
Alibaba показала Qwen3.7-Max - новый флагман семейства, который явно целят не в «ответь на вопрос», а в полноценную агентную работу.
Главный акцент - кодинг и long-horizon задачи. Модель обещают как основу для агентов, которые умеют не только писать куски кода, но и вести задачу end-to-end: собирать фронтенд-прототипы, делать многофайловые рефакторы, дебажить реальные проблемы и работать через инструменты.
Самая громкая заявка - 35 часов автономной работы над задачей по оптимизации kernel. Больше 1000 tool calls и без постоянного ручного контроля. Если это стабильно повторяется не только в демо, это уже другой класс агентных сценариев.
Что ещё заявляют:
- coding agent для реальной разработки, а не игрушечных сниппетов
- офисный ассистент через MCP-интеграции
- multi-agent orchestration для сложных рабочих процессов
- совместимость с разными агентными оболочками
- работа через Claude Code, OpenClaw, Qwen Code или свой стек
- доступ через Alibaba Model Studio и Qwen Studio
📖 Blog: https://qwen.ai/blog?id=qwen3.7
✅ Qwen Studio: https://chat.qwen.ai/?models=qwen3.7-max
⚡️ API:https://modelstudio.console.alibabacloud.com/ap-southeast-1?tab=doc#/doc/?type=model&url=2840914_2&modelId=qwen3.7-max&serviceSite=international
@data_analysis_ml
Alibaba показала Qwen3.7-Max - новый флагман семейства, который явно целят не в «ответь на вопрос», а в полноценную агентную работу.
Главный акцент - кодинг и long-horizon задачи. Модель обещают как основу для агентов, которые умеют не только писать куски кода, но и вести задачу end-to-end: собирать фронтенд-прототипы, делать многофайловые рефакторы, дебажить реальные проблемы и работать через инструменты.
Самая громкая заявка - 35 часов автономной работы над задачей по оптимизации kernel. Больше 1000 tool calls и без постоянного ручного контроля. Если это стабильно повторяется не только в демо, это уже другой класс агентных сценариев.
Что ещё заявляют:
- coding agent для реальной разработки, а не игрушечных сниппетов
- офисный ассистент через MCP-интеграции
- multi-agent orchestration для сложных рабочих процессов
- совместимость с разными агентными оболочками
- работа через Claude Code, OpenClaw, Qwen Code или свой стек
- доступ через Alibaba Model Studio и Qwen Studio
📖 Blog: https://qwen.ai/blog?id=qwen3.7
✅ Qwen Studio: https://chat.qwen.ai/?models=qwen3.7-max
⚡️ API:https://modelstudio.console.alibabacloud.com/ap-southeast-1?tab=doc#/doc/?type=model&url=2840914_2&modelId=qwen3.7-max&serviceSite=international
@data_analysis_ml
🔥2
Forwarded from Dealer.AI
This media is not supported in your browser
VIEW IN TELEGRAM
Google Search an agent🔋
Вот оно закономерное и долгожданное обновление всего поиска. Google недавно объявил о самом масштабном редизайне поиска за 25 лет, и это не просто новая поисковая строка. Это переход от поисковика к агентной платформе.😜
Вот что важно понимать прямо сейчас:
1. AI Mode уже 1 млрд пользователей в месяц, статистика за год. Запросы удваиваются каждый квартал. Люди перестают искать ключевыми словами - они начинают разговаривать с поиском. И я уже говорил, что будет нативный диалог в поиске и рекомендациях , как удобный канал связи с юзером.
2. Новая поисковая строка - не строка, а диалоговое окно.Логичное следствие из п1. Оно динамически расширяется, понимает изображения, видео, файлы, вкладки Chrome. AI подсказывает, как сформулировать вопрос - не автодополнение, а мышление вместе с пользователем. 🤙
3. Поисковые агенты работают 24/7. Задали критерии поиска квартиры? Агент сам сканирует объявления и пишет, когда появился подходящий вариант. Следите за дропами кроссовок? Агент мониторит соцсети и новости. Работает в фоне, пока вы живёте жизнь. Вот для чего мы делаем свой GEO и MCP😜
4. Google теперь ваш дворецкий/консьерж: звонит за вас в "бронирование караоке" , делает запись к мастеру по маникюру, вызов сантехника. Крч, Search может позвонить в бизнес от вашего имени, правда только в США и уже этим летом.🤔
5. Antigravity и поиск генерирует приложения. Нужен трекер фитнеса? Search кодирует его прямо в окне браузера, подтягивая реальные данные: погоду, карты, отзывы. Интерактивные симуляции, графики, дашборды все это на лету, бесплатно,ну это пока 👍
6. Personal Intelligence стал бесплатным 200 стран, 98 языков, без подписки. Подключаете Gmail, Photos, Calendar, и Search знает ваш контекст. Но контроль остаётся у вас.🪨
Модель по умолчанию - Gemini 3.5 Flash. Сделана именно для агентов и кодинга.
Что это значит для рынка?
Google не догоняет ChatGPT. Google превращает поиск, экономику, UX/CJM в операционную систему поверх интернета (не только уже поиск). Конкуренция теперь не за запросы - а за задачи, в текущем случае, ещё и подкрепленные мощным поиском, а значит более доверенные. Кто выполнит всю работу от идеи до результата, и вырастит доверие к выдаче, пусть через поиск, тот и заберет пользователя.
И да, самые мощные агенты информационные + кастомные мини-приложения, пока за подпиской Pro/Ultra.🚬
Что думаете - убьёт ли это классические сайты-агрегаторы? Или превратит их в API для Google? Пишите в комментариях.
👇 👇 👇 👇 👇
Вот оно закономерное и долгожданное обновление всего поиска. Google недавно объявил о самом масштабном редизайне поиска за 25 лет, и это не просто новая поисковая строка. Это переход от поисковика к агентной платформе.
Вот что важно понимать прямо сейчас:
1. AI Mode уже 1 млрд пользователей в месяц, статистика за год. Запросы удваиваются каждый квартал. Люди перестают искать ключевыми словами - они начинают разговаривать с поиском. И я уже говорил, что будет нативный диалог в поиске и рекомендациях , как удобный канал связи с юзером.
2. Новая поисковая строка - не строка, а диалоговое окно.
3. Поисковые агенты работают 24/7. Задали критерии поиска квартиры? Агент сам сканирует объявления и пишет, когда появился подходящий вариант. Следите за дропами кроссовок? Агент мониторит соцсети и новости. Работает в фоне, пока вы живёте жизнь. Вот для чего мы делаем свой GEO и MCP
4. Google теперь ваш дворецкий/консьерж: звонит за вас в "бронирование караоке" , делает запись к мастеру по маникюру, вызов сантехника. Крч, Search может позвонить в бизнес от вашего имени, правда только в США и уже этим летом.
5. Antigravity и поиск генерирует приложения. Нужен трекер фитнеса? Search кодирует его прямо в окне браузера, подтягивая реальные данные: погоду, карты, отзывы. Интерактивные симуляции, графики, дашборды все это на лету, бесплатно,
6. Personal Intelligence стал бесплатным 200 стран, 98 языков, без подписки. Подключаете Gmail, Photos, Calendar, и Search знает ваш контекст. Но контроль остаётся у вас.
Модель по умолчанию - Gemini 3.5 Flash. Сделана именно для агентов и кодинга.
Что это значит для рынка?
Google не догоняет ChatGPT. Google превращает поиск, экономику, UX/CJM в операционную систему поверх интернета (не только уже поиск). Конкуренция теперь не за запросы - а за задачи, в текущем случае, ещё и подкрепленные мощным поиском, а значит более доверенные. Кто выполнит всю работу от идеи до результата, и вырастит доверие к выдаче, пусть через поиск, тот и заберет пользователя.
И да, самые мощные агенты информационные + кастомные мини-приложения, пока за подпиской Pro/Ultra.
Что думаете - убьёт ли это классические сайты-агрегаторы? Или превратит их в API для Google? Пишите в комментариях.
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Love. Death. Transformers.
У меня давно был скептицизм касательно гугловых моделей, в целом - ничего не поменялось
🕊1
Love. Death. Transformers.
У меня давно был скептицизм касательно гугловых моделей, в целом - ничего не поменялось
Таких прям проблем у меня с Google не было, но с точки зрения поиска ошибок в коде она сильно уступает Claude и GPT. C кодом у GPT получше, но по человечески - модель сильно бесит по сравнению с Клодом. Он как-то понятнее пишет...
Forwarded from Tips AI | IT & AI
This media is not supported in your browser
VIEW IN TELEGRAM
Мне вчера понравилась обнова в Codex, а именно:
• Appshots для macos — жмёшь хоткей и Codex получает скриншот и расшифровку активного окна, удобно чтобы передать ошибку или фрагмент документа без копирования
• Locked Computer Use — будет работать даже на залоченном Mac, как раз для тех самых с приоткрытыми ноутами
• Browser annotations — режим когда во встроенном браузере отмечаешь что поменять: шрифт, цвет, отступы и тд
По мелочи еще улучшили расширение для Chrome, добавили /goal в десктопное приложение, и дали возможность делиться плагинами с командой внутри workspace
Очень крутой и удобный Codex именно в десктопе. В отличии от клодовского приложения.
Настолько, что даже Antigravity превратился в Codex😏
@tips_ai #news
• Appshots для macos — жмёшь хоткей и Codex получает скриншот и расшифровку активного окна, удобно чтобы передать ошибку или фрагмент документа без копирования
• Locked Computer Use — будет работать даже на залоченном Mac, как раз для тех самых с приоткрытыми ноутами
• Browser annotations — режим когда во встроенном браузере отмечаешь что поменять: шрифт, цвет, отступы и тд
По мелочи еще улучшили расширение для Chrome, добавили /goal в десктопное приложение, и дали возможность делиться плагинами с командой внутри workspace
Очень крутой и удобный Codex именно в десктопе. В отличии от клодовского приложения.
Настолько, что даже Antigravity превратился в Codex
@tips_ai #news
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
Набор скилов для Codex - можно не ставить себе все сразу, просто качать при необходимости.
Ну и дополнительно - скилы от создателя OpenClaw. Тоже для Codex.
Ну и дополнительно - скилы от создателя OpenClaw. Тоже для Codex.
GitHub
GitHub - openai/skills: Skills Catalog for Codex
Skills Catalog for Codex. Contribute to openai/skills development by creating an account on GitHub.
Google выпустил новые классные обновления - модели, агенты для работы с ними и пр. Как результат, подписку на гугл я отменил.
Просто в новых подписках меня жестко банят по стране эккаунта, и поменять страну мне тоже не дали.
Ну ок, буду платить OpenAI и Антропику. В крайнем случае, DeepSeek - у них нет подписок, но есть дешевый апи, и хотял слухи, что китайцы пишут для него свой Claude code. Вот жду и с удовольствием попробую.
Просто в новых подписках меня жестко банят по стране эккаунта, и поменять страну мне тоже не дали.
Ну ок, буду платить OpenAI и Антропику. В крайнем случае, DeepSeek - у них нет подписок, но есть дешевый апи, и хотял слухи, что китайцы пишут для него свой Claude code. Вот жду и с удовольствием попробую.
Идея хороша - вайбокодеры пытаются вогнать в правильные рамки агентов, но ИИ используют, чтобы вогнать в рамки самих вайбкодеров. Похоже, надо ставить...
https://t.me/vibecoding_tg/3189
https://t.me/vibecoding_tg/3189
Telegram
Вайб-кодинг
Microsoft открыли исходники AI Engineer Coach.
Это расширение для VS Code (также работает в Cursor и Antigravity), которое анализирует, как ты используешь AI-агентов для кодинга.
Оно читает локальные логи сессий из GitHub Copilot, Claude Code, Codex CLI…
Это расширение для VS Code (также работает в Cursor и Antigravity), которое анализирует, как ты используешь AI-агентов для кодинга.
Оно читает локальные логи сессий из GitHub Copilot, Claude Code, Codex CLI…
Кстати, в отличие от Claude code, Codex является опенсорсным агентом
https://github.com/openai/codex
https://github.com/openai/codex
GitHub
GitHub - openai/codex: Lightweight coding agent that runs in your terminal
Lightweight coding agent that runs in your terminal - openai/codex
HuggingFace публикует не только открытые модели. Но, например, и макеты роботов - можно собрать из доступных запчастей и деталей, напечатанных на 3D принтере. Стоит примерно 2,5 тыс. баксов.
https://huggingface.co/blog/VirgileBatto/lerobot-humanoid
https://huggingface.co/blog/VirgileBatto/lerobot-humanoid
huggingface.co
LeRobot Humanoid: An Open, Low-Cost, 3D-Printed Humanoid for Robot Learning
A Blog post by Virgile BATTO on Hugging Face
Тут у меня заканчивались недельные лимиты на Клода, решил настроить Claude Design - плагин в веб-версии клода, который позволяет делать презентации. На обучение Клода корпоративному стилю в лимит прошлой недели не уложился. Потратил еще и лимит этой недели.
Зато сделали шаблон для подготовки презентаций в стилистике моей конторы. Пример презентации прилагается. Не все идеально, но решил, что докручу в следующий раз.
Презентации всегда были слабым местом нейронок, но похоже, что мы близки к решению. Сама мысль о том, что можно сделать презу за 5 минут, и она будет иметь дизайн промышленного качества, вдохновляет. И заставляет задуматься о возвращении к дорогой подписке с большими лимитами.
Из интересного - преза верстается в html, потом, при необходимости, переводится в power point. Есть ощущение и надежда, что скоро паверпойнт отомрет и станет лишним - все проблемы с кривыми презентациями от него.
Вообще интерактивную страничку сейчас проще и дешевле сделать, чем презентацию - может, так и надо поступать.
Но если подвести итог, от Claude Design я под большим впечатлением. Офигенно
Зато сделали шаблон для подготовки презентаций в стилистике моей конторы. Пример презентации прилагается. Не все идеально, но решил, что докручу в следующий раз.
Презентации всегда были слабым местом нейронок, но похоже, что мы близки к решению. Сама мысль о том, что можно сделать презу за 5 минут, и она будет иметь дизайн промышленного качества, вдохновляет. И заставляет задуматься о возвращении к дорогой подписке с большими лимитами.
Из интересного - преза верстается в html, потом, при необходимости, переводится в power point. Есть ощущение и надежда, что скоро паверпойнт отомрет и станет лишним - все проблемы с кривыми презентациями от него.
Вообще интерактивную страничку сейчас проще и дешевле сделать, чем презентацию - может, так и надо поступать.
Но если подвести итог, от Claude Design я под большим впечатлением. Офигенно
Когда я смотрю на очередного человекоподобного робота, я вспоминаю, как косячат нейронки у меня на компе, казалось бы, в самых очевидных местах. А здесь и модель на робота большую не поставишь, и время реакции ограничено.
В ближайшие годы универсальные роботы будут сплошным факапом.
А вот специализированные - мусор сортировать, боеприпасы на передовую таскать или что-то монотонное делать, почему бы и нет?
https://t.me/ai_machinelearning_big_data/10210
В ближайшие годы универсальные роботы будут сплошным факапом.
А вот специализированные - мусор сортировать, боеприпасы на передовую таскать или что-то монотонное делать, почему бы и нет?
https://t.me/ai_machinelearning_big_data/10210
Telegram
Machinelearning
✔️ В Ухане презентован домашний гуманоидный робот Shiguang S1
20 мая в технопарке Уханя прошла презентация гуманоидного робота Shiguang S1, которого называют первым в КНР роботом для семейного быта.
Машину разработала компания Hubei Jijia Shijie Robotics…
20 мая в технопарке Уханя прошла презентация гуманоидного робота Shiguang S1, которого называют первым в КНР роботом для семейного быта.
Машину разработала компания Hubei Jijia Shijie Robotics…
Forwarded from Вайб-кодинг
Анатомия идеального файла
Он находится в самом начале системного промпта. До памяти, до скиллов и до инструментов. Именно он определяет, кем является агент, когда начинает работу.
Час, потраченный на этот файл, влияет на каждое последующее взаимодействие. Большинство остальных слоёв обновляются автоматически. Этот слой принадлежит вам.
Как выглядит действительно работающий файл
вот 8 разделов, которые имеют значение:
Обычно многие пишут что-то вроде🫣
Это ничего не меняет. Любая модель уже по умолчанию старается быть полезной и профессиональной.
Агенты, которые действительно становятся лучше со временем, имеют файлы
Хороший
Сохраните себе эту шпаргалку. Когда будете создавать своего первого агента, она вам понадобится.
Вот также подробный гайд по Hermes Agent, в котором разбираются слой
SOUL.md для AI-агентов.SOUL.md это единственный файл, который вы пишете для AI-агента самостоятельно.Он находится в самом начале системного промпта. До памяти, до скиллов и до инструментов. Именно он определяет, кем является агент, когда начинает работу.
Час, потраченный на этот файл, влияет на каждое последующее взаимодействие. Большинство остальных слоёв обновляются автоматически. Этот слой принадлежит вам.
Как выглядит действительно работающий файл
SOUL.md?вот 8 разделов, которые имеют значение:
→ identity - одно предложение о том, кто агент, а не что он делает
→ core truths - базовые принципы в повелительной форме, каждый с кратким пояснением в одну строку
→ worldview - выраженные взгляды по разным областям, достаточно конкретные, чтобы по ним можно было предсказать поведение агента
→ voice - конкретные правила общения агента, а не набор прилагательных
→ expertise - основная область компетенции, инструменты, которыми агент владеет свободно, и ситуации, где он передаёт задачу другому специалисту
→ boundaries - явные ограничения и вещи, которые агент делать не будет, без расплывчатых формулировок
→ memory policy - правила того, что сохраняется в памяти, а что остаётся приватным
→ pet peeves - фразы, речевые обороты и тон общения, которые агент никогда не использует
Обычно многие пишут что-то вроде
«будь полезным и профессиональным» и на этом заканчивают. Это ничего не меняет. Любая модель уже по умолчанию старается быть полезной и профессиональной.
Агенты, которые действительно становятся лучше со временем, имеют файлы
SOUL.md с реальными взглядами, ограничениями и стилем общения, который можно предсказать ещё до прочтения ответа.Хороший
SOUL.md обычно занимает от 30 до 80 строк. Конкретика важнее полноты охвата.Сохраните себе эту шпаргалку. Когда будете создавать своего первого агента, она вам понадобится.
Вот также подробный гайд по Hermes Agent, в котором разбираются слой
SOUL.md, трёхуровневая система памяти, цикл саморазвивающихся навыков и запуск трёх специализированных агентов на своём компьютере в режиме 24/7.Please open Telegram to view this post
VIEW IN TELEGRAM
👍1