Когда я смотрю на очередного человекоподобного робота, я вспоминаю, как косячат нейронки у меня на компе, казалось бы, в самых очевидных местах. А здесь и модель на робота большую не поставишь, и время реакции ограничено.
В ближайшие годы универсальные роботы будут сплошным факапом.
А вот специализированные - мусор сортировать, боеприпасы на передовую таскать или что-то монотонное делать, почему бы и нет?
https://t.me/ai_machinelearning_big_data/10210
В ближайшие годы универсальные роботы будут сплошным факапом.
А вот специализированные - мусор сортировать, боеприпасы на передовую таскать или что-то монотонное делать, почему бы и нет?
https://t.me/ai_machinelearning_big_data/10210
Telegram
Machinelearning
✔️ В Ухане презентован домашний гуманоидный робот Shiguang S1
20 мая в технопарке Уханя прошла презентация гуманоидного робота Shiguang S1, которого называют первым в КНР роботом для семейного быта.
Машину разработала компания Hubei Jijia Shijie Robotics…
20 мая в технопарке Уханя прошла презентация гуманоидного робота Shiguang S1, которого называют первым в КНР роботом для семейного быта.
Машину разработала компания Hubei Jijia Shijie Robotics…
Forwarded from Вайб-кодинг
Анатомия идеального файла
Он находится в самом начале системного промпта. До памяти, до скиллов и до инструментов. Именно он определяет, кем является агент, когда начинает работу.
Час, потраченный на этот файл, влияет на каждое последующее взаимодействие. Большинство остальных слоёв обновляются автоматически. Этот слой принадлежит вам.
Как выглядит действительно работающий файл
вот 8 разделов, которые имеют значение:
Обычно многие пишут что-то вроде🫣
Это ничего не меняет. Любая модель уже по умолчанию старается быть полезной и профессиональной.
Агенты, которые действительно становятся лучше со временем, имеют файлы
Хороший
Сохраните себе эту шпаргалку. Когда будете создавать своего первого агента, она вам понадобится.
Вот также подробный гайд по Hermes Agent, в котором разбираются слой
SOUL.md для AI-агентов.SOUL.md это единственный файл, который вы пишете для AI-агента самостоятельно.Он находится в самом начале системного промпта. До памяти, до скиллов и до инструментов. Именно он определяет, кем является агент, когда начинает работу.
Час, потраченный на этот файл, влияет на каждое последующее взаимодействие. Большинство остальных слоёв обновляются автоматически. Этот слой принадлежит вам.
Как выглядит действительно работающий файл
SOUL.md?вот 8 разделов, которые имеют значение:
→ identity - одно предложение о том, кто агент, а не что он делает
→ core truths - базовые принципы в повелительной форме, каждый с кратким пояснением в одну строку
→ worldview - выраженные взгляды по разным областям, достаточно конкретные, чтобы по ним можно было предсказать поведение агента
→ voice - конкретные правила общения агента, а не набор прилагательных
→ expertise - основная область компетенции, инструменты, которыми агент владеет свободно, и ситуации, где он передаёт задачу другому специалисту
→ boundaries - явные ограничения и вещи, которые агент делать не будет, без расплывчатых формулировок
→ memory policy - правила того, что сохраняется в памяти, а что остаётся приватным
→ pet peeves - фразы, речевые обороты и тон общения, которые агент никогда не использует
Обычно многие пишут что-то вроде
«будь полезным и профессиональным» и на этом заканчивают. Это ничего не меняет. Любая модель уже по умолчанию старается быть полезной и профессиональной.
Агенты, которые действительно становятся лучше со временем, имеют файлы
SOUL.md с реальными взглядами, ограничениями и стилем общения, который можно предсказать ещё до прочтения ответа.Хороший
SOUL.md обычно занимает от 30 до 80 строк. Конкретика важнее полноты охвата.Сохраните себе эту шпаргалку. Когда будете создавать своего первого агента, она вам понадобится.
Вот также подробный гайд по Hermes Agent, в котором разбираются слой
SOUL.md, трёхуровневая система памяти, цикл саморазвивающихся навыков и запуск трёх специализированных агентов на своём компьютере в режиме 24/7.Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Самая умная малышка весом 1В
Telegram
Machinelearning
MiniCPM5-1B теперь полностью open source: открыты веса, обучающие данные и код для деплоя. 🚀
1B параметров, первое место на Artificial Analysis среди всех открытых моделей меньше 2B параметров - 17.9 балла.
Обходит Qwen3.5-2B, у которой 16.3 балла, при…
1B параметров, первое место на Artificial Analysis среди всех открытых моделей меньше 2B параметров - 17.9 балла.
Обходит Qwen3.5-2B, у которой 16.3 балла, при…
Учитывая происходящее с интернетом, отдельными замминистрами и наличие передового опыта друзей из Китая, ждем отечественных аналогов в ближайшее время.
https://t.me/antidigital/11702
https://t.me/antidigital/11702
Telegram
Нецифровая экономика
Дипсиковский централ
Ветер в серверной
ЧипОв из Малайзии
Завезли немеряно...
А вывезти ни себя, ни чипы теперь уже не дадут. Пока мы спали, в Китае решили заново изобрести выездные визы — теперь и для дорогих ИИ-специалистов. Ограничения впервые коснулись…
Ветер в серверной
ЧипОв из Малайзии
Завезли немеряно...
А вывезти ни себя, ни чипы теперь уже не дадут. Пока мы спали, в Китае решили заново изобрести выездные визы — теперь и для дорогих ИИ-специалистов. Ограничения впервые коснулись…
Forwarded from Вайб-кодинг
У Hermes Agent наконец-то появился десктопный GUI клиент: hermes-desktop ☺️
При первом запуске мастер установки автоматически запускает официальный скрипт установки, разворачивает Hermes в
Развёртывание тоже максимально простое: в разделе Releases доступны установщики для всех основных платформ.
- macOS —
- Windows —
- Linux —
Скачал, дважды кликнул, и можно работать
При первом запуске мастер установки автоматически запускает официальный скрипт установки, разворачивает Hermes в
~/.hermes и помогает через графический интерфейс настроить все 11 LLM-провайдеров и 16 платформ для обмена сообщениямиРазвёртывание тоже максимально простое: в разделе Releases доступны установщики для всех основных платформ.
- macOS —
.dmg- Windows —
.exe- Linux —
AppImageСкачал, дважды кликнул, и можно работать
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Мучаюсь тут в одном проекте с playwright, так что самое время протестить новую фишку
Telegram
Tips AI | IT & AI
Увидел что команда ресерчеров Microsoft в своем GitHub выложила экспериментальный проект Webwright
Это браузерный агент построенный поверх playwright, который меняет подход взаимодействия агентов с браузером
Тут идея в том, что агент не кликает кнопки через…
Это браузерный агент построенный поверх playwright, который меняет подход взаимодействия агентов с браузером
Тут идея в том, что агент не кликает кнопки через…
Как минимум, бонус в том, что запустится на минимальном Mac mini
https://t.me/ai_machinelearning_big_data/10221
https://t.me/ai_machinelearning_big_data/10221
Telegram
Machinelearning
🌟 Lance: мультимодальная модель от ByteDance
Лаба Intelligent Creation компании ByteDance выложила Lance - модель, которая в единой архитектуре выполняет понимание, генерацию и редактирование изображений и видео.
При небольшом объёме параметров (6 млрд…
Лаба Intelligent Creation компании ByteDance выложила Lance - модель, которая в единой архитектуре выполняет понимание, генерацию и редактирование изображений и видео.
При небольшом объёме параметров (6 млрд…
Forwarded from Tips AI | IT & AI
Еще один тул привлек мое внимание — CodeGraph
Мы привыкли, что Claude Code или Codex в каждом новом чате заново разбирается в структуре проекта, вручную ищет строчки через grep и read и каждый раз тратит на это наши драгоценные токены и время.
CodeGraph может решить эту проблему индексацией: один раз сканирует проект на компьютере, запоминает где какой кусок кода лежит и как куски связаны между собой, и отдаёт эту карту агенту.
После этого агент может обратиться напрямую к графу, вместо своего обхода файлов и знать кто какую функцию вызывает, что сломается если поменять.
Я сам еще не пробовал, но в авторском бенче CodeGraph обещает экономить 57% токенов и 46% времени на tools вызовы.
Да и звезды летят неплохо, что подкупает попробовать после отпуска👀
github.com/colbymchenry/codegraph
@tips_ai #tools
Мы привыкли, что Claude Code или Codex в каждом новом чате заново разбирается в структуре проекта, вручную ищет строчки через grep и read и каждый раз тратит на это наши драгоценные токены и время.
CodeGraph может решить эту проблему индексацией: один раз сканирует проект на компьютере, запоминает где какой кусок кода лежит и как куски связаны между собой, и отдаёт эту карту агенту.
После этого агент может обратиться напрямую к графу, вместо своего обхода файлов и знать кто какую функцию вызывает, что сломается если поменять.
Я сам еще не пробовал, но в авторском бенче CodeGraph обещает экономить 57% токенов и 46% времени на tools вызовы.
Да и звезды летят неплохо, что подкупает попробовать после отпуска
github.com/colbymchenry/codegraph
@tips_ai #tools
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from эйай ньюз
Bonsai Image 4B — чудеса квантизации
Стартап PrismML, специализирующийся на экстремальном сжатии моделек, сделал квантизированную до одного бита FLUX.2 Klein 4B, вышло на удивление достойно. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер настолько же сильно ужать не удалось, поэтому весь комплект весит ~3.5 гига.
Такая квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативки. На генерацию 512x512 картинки на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо если учитывать факт офлоадинга. Ждём моделек побольше, для локального деплоймента.
Инференс в браузере
Веса
@ai_newz
Стартап PrismML, специализирующийся на экстремальном сжатии моделек, сделал квантизированную до одного бита FLUX.2 Klein 4B, вышло на удивление достойно. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер настолько же сильно ужать не удалось, поэтому весь комплект весит ~3.5 гига.
Такая квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативки. На генерацию 512x512 картинки на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо если учитывать факт офлоадинга. Ждём моделек побольше, для локального деплоймента.
Инференс в браузере
Веса
@ai_newz
Claude code выпустил плагин для проверки безопасности кода. Не Mythos, но хотя бы так…
Claude Code Docs
Catch security issues as Claude writes code - Claude Code Docs
Install the security-guidance plugin to have Claude review its own code changes for vulnerabilities and fix them in the same session.
Ну, кстати, немного поясню, почему вернулся к дорогой подписке на Антропик.
Во-первых, потому что могу - с другого эккаунта, но платежи проходят. Дорого, но тут уж как наркоману отказаться от такой дозы?
Во-вторых, все-таки Клод гораздо понятнее пишет. Вроде ChatGPT и старается, но иногда пишет так, что я реально ничего не понимаю. Клод как-то даже жаргон понятнее применяет.
В-третьих, я и подписку ChatGPT стал высаживать легко и непринужденно. Дошел до того, что поставил себе OpenCode с DeepSeek - подключил за базу даже не основную модель, а флеш. Кстати, интерфейс опенкода прямо понравился. Основное ощущение от дипсика - медленный. Но стоит копейки, за сегодня потратил с ним 15 рублей... Пожалуй, буду использовать его как агента для экономии токенов у Клода и ГПТ.
Кстати, продолжаю использовать и OpenClaw - в основном, в таком режиме: закидываю ему новость, а он мне подробно рассказывает что почем.
Ах, да. Еще тестирую работу не в терминале, а с десктопными приложениями Codex и Claude. Ну, симпатично, но прямо плюшек каких-то нет. А недостаток в том, что вся работа с десктопом у меня пишется в память, а с приложениями - нет. Серьезный недостаток, видимо, вернусь в терминал.
Все, пошел жечь токены
Во-первых, потому что могу - с другого эккаунта, но платежи проходят. Дорого, но тут уж как наркоману отказаться от такой дозы?
Во-вторых, все-таки Клод гораздо понятнее пишет. Вроде ChatGPT и старается, но иногда пишет так, что я реально ничего не понимаю. Клод как-то даже жаргон понятнее применяет.
В-третьих, я и подписку ChatGPT стал высаживать легко и непринужденно. Дошел до того, что поставил себе OpenCode с DeepSeek - подключил за базу даже не основную модель, а флеш. Кстати, интерфейс опенкода прямо понравился. Основное ощущение от дипсика - медленный. Но стоит копейки, за сегодня потратил с ним 15 рублей... Пожалуй, буду использовать его как агента для экономии токенов у Клода и ГПТ.
Кстати, продолжаю использовать и OpenClaw - в основном, в таком режиме: закидываю ему новость, а он мне подробно рассказывает что почем.
Ах, да. Еще тестирую работу не в терминале, а с десктопными приложениями Codex и Claude. Ну, симпатично, но прямо плюшек каких-то нет. А недостаток в том, что вся работа с десктопом у меня пишется в память, а с приложениями - нет. Серьезный недостаток, видимо, вернусь в терминал.
Все, пошел жечь токены