Поговорил с Глебом про то куда сейчас идут World Models для роботов:
https://youtu.be/_acRtKuupP8
Мне было ужасно интересно. Глеб создал одно из немногих открытых комьюнити где достаточно регулярно походят онлайн семинары по тому как такие модели устроены, люди рассказывают свой экспирианс + то что у них получилось/не получилось.
Собственно поговорили и про комьюнити, и про модели, и про то как это пускать на реальном железе
https://youtu.be/_acRtKuupP8
Мне было ужасно интересно. Глеб создал одно из немногих открытых комьюнити где достаточно регулярно походят онлайн семинары по тому как такие модели устроены, люди рассказывают свой экспирианс + то что у них получилось/не получилось.
Собственно поговорили и про комьюнити, и про модели, и про то как это пускать на реальном железе
YouTube
World models, VLAs: performance, accuracy and perspective
Gleb - https://www.linkedin.com/in/zaringleb/
Robot Learning Collective discord - https://discord.gg/rkutH2UVj3
Robot Learning Collective publications - https://robot-learning-collective.github.io/
00:00:00 - Intro
00:00:35 - Robot Learning Collective
00:05:10…
Robot Learning Collective discord - https://discord.gg/rkutH2UVj3
Robot Learning Collective publications - https://robot-learning-collective.github.io/
00:00:00 - Intro
00:00:35 - Robot Learning Collective
00:05:10…
🔥39💩1
This media is not supported in your browser
VIEW IN TELEGRAM
Меня достаточно давно спрашивали про RDK S100. И наконец я его добыл и забенчмаркал. Надо сказать что тренд очень позитивный. Когда уже и LeRobot из коробки работат. Но пока что чувствуются огрехи экпорта, пайплайны не идеальны.
Но в ребят много веры. На их базе много чего интересного уже видел.
Видео - https://youtu.be/WHAEl05g8Xk
Статья - https://medium.com/@zlodeibaal/rdk-s100-review-80-tops-robotic-board-d9ad0f464942
Но в ребят много веры. На их базе много чего интересного уже видел.
Видео - https://youtu.be/WHAEl05g8Xk
Статья - https://medium.com/@zlodeibaal/rdk-s100-review-80-tops-robotic-board-d9ad0f464942
🔥14💩2❤1
Я в какой-то момент увидел в рекламе приложение Chatty. Подумал что идея неплоха, можно использовать при обучении. Посмотрел что у них с ценовой политикой и не согласился :)
Они там по 15 баксов в месяц хотят. Что на мой взгляд перебор для такого.
Короче за пол часа собрал себе вот эту поделку - https://github.com/ZlodeiBaal/TG_bot_language . Если кому надо:
1) Создайте бота и получите токен через @BotFather
2) Создайте на OpenRouter под него токен
3) Положите креды в .key_example и переименуйте его в .key
По цене за первые дни пока тестил слил 0.14 бакса. В качестве модели я использую GPT Audio Mini. На один ответ пришлось 2 запроса делать, в один не справился. Наверное можно в один, но я не понял как.
Сейчас из языков добавил немецкий (я сейчас учу) и ещё пару языков которые друзья учат (норвежский, испанский, англ).
Короче, у меня стойкое ощущение что весь софт потихоньку туда движется. Теперь тебе вместо приложения нужен рецепт что оно делает.
Они там по 15 баксов в месяц хотят. Что на мой взгляд перебор для такого.
Короче за пол часа собрал себе вот эту поделку - https://github.com/ZlodeiBaal/TG_bot_language . Если кому надо:
1) Создайте бота и получите токен через @BotFather
2) Создайте на OpenRouter под него токен
3) Положите креды в .key_example и переименуйте его в .key
По цене за первые дни пока тестил слил 0.14 бакса. В качестве модели я использую GPT Audio Mini. На один ответ пришлось 2 запроса делать, в один не справился. Наверное можно в один, но я не понял как.
Сейчас из языков добавил немецкий (я сейчас учу) и ещё пару языков которые друзья учат (норвежский, испанский, англ).
Короче, у меня стойкое ощущение что весь софт потихоньку туда движется. Теперь тебе вместо приложения нужен рецепт что оно делает.
🔥32😱6❤3💩1
Сергей - фаундер прикольного стартапа Phail.ai - они измеряют насколько все эти новомодные модельки реально эффективны. Недавно Сергей проезжал через Берлин - и я решили поговорить с ним поглубже на эту тему и обсудить как в реальности можно забенчмаркать сложные события. Ну и про то как это вообще сегодня работает. Когда есть бесчисленное число рук, гриперов и вычислителей.
https://youtu.be/mo6mpvFdjVw
***
Канал Сергея в телеграмме - https://t.me/the_things_i_liked
https://youtu.be/mo6mpvFdjVw
***
Канал Сергея в телеграмме - https://t.me/the_things_i_liked
YouTube
Robotics: how to measure efficiency
Positronic Robotics - https://phail.ai/
Sergey - https://www.linkedin.com/in/sergeyarkhangelskiy/
----------------------------------------------------------
Time Codes:
00:00:00 - Intro
00:00:23 - Positronic Robotics and Phail AI
00:05:26 - Are there any…
Sergey - https://www.linkedin.com/in/sergeyarkhangelskiy/
----------------------------------------------------------
Time Codes:
00:00:00 - Intro
00:00:23 - Positronic Robotics and Phail AI
00:05:26 - Are there any…
🔥30💩2
Сегодня потестил DeepSeek Harness — оказалось интереснее, чем я ожидал.
Ещё пару месяцев назад я пытался найти что-то готовое, похожее на агента Codex или Claude, но с удобным визуальным интерфейсом. Ничего полноценного тогда не нашлось: где-то не подключался поиск, где-то нормально не подключались другие функции, а где-то было неудобно переключаться между моделями.
Здесь почти всё есть прямо из коробки. Настройка занимает пару минут, и в целом система работает. Чтобы настроить что-то сложное (роутинг задач по сложности между разными моделями - надо запариться).
Конечно, если у вас есть нормальная подписка на Codex, использовать Harness, скорее всего, нет особого смысла. Для сравнения я дал системам простую задачу: реализовать быстрое преобразование Фурье и отладить код.
▪️Codex справился за 51 секунду, причём расход лимитов я даже не заметил.
▪️DeepSeek Hadness с подключённой Kimi K3 решил задачу примерно за пять минут — и всё работало. Цена была ~30 центов
▪️DeepSeek Hadness с локальной Qwen 3.8 выполнение заняло почти час.
Но... Это уже работает!
Есть встроенный поиск, можно независимо подключать разных поисковых провайдеров и модели. Возможно, выбранный мной провайдер поиска был не лучшим, поэтому здесь ещё есть что настраивать.
Структура управления агентами/скорости и инструментариев пока слабее — примерно на уровне ChatGPT годичной давности.
Я задал поисковый запрос достаточно сложный. Очевидно что надо было его в какой-то момент стопать, но он кажется нажёг на 3 USD Kimi K3 и ещё 20 поисковых центов. Хотя 99% этого времени не имели смысла.
Тем не менее отставание уже не выглядит катастрофическим. Для разработки такую систему вполне можно использовать в отдельных сценариях — например, если модель хостится локально, или хватает простой модели с OpenRouter.
В общем, проект интересный. Теперь хочется потестить Kimi Code, выход которого недавно анонсировали.
А что вы из нестандартных агентов используете?
Ещё пару месяцев назад я пытался найти что-то готовое, похожее на агента Codex или Claude, но с удобным визуальным интерфейсом. Ничего полноценного тогда не нашлось: где-то не подключался поиск, где-то нормально не подключались другие функции, а где-то было неудобно переключаться между моделями.
Здесь почти всё есть прямо из коробки. Настройка занимает пару минут, и в целом система работает. Чтобы настроить что-то сложное (роутинг задач по сложности между разными моделями - надо запариться).
Конечно, если у вас есть нормальная подписка на Codex, использовать Harness, скорее всего, нет особого смысла. Для сравнения я дал системам простую задачу: реализовать быстрое преобразование Фурье и отладить код.
▪️Codex справился за 51 секунду, причём расход лимитов я даже не заметил.
▪️DeepSeek Hadness с подключённой Kimi K3 решил задачу примерно за пять минут — и всё работало. Цена была ~30 центов
▪️DeepSeek Hadness с локальной Qwen 3.8 выполнение заняло почти час.
Но... Это уже работает!
Есть встроенный поиск, можно независимо подключать разных поисковых провайдеров и модели. Возможно, выбранный мной провайдер поиска был не лучшим, поэтому здесь ещё есть что настраивать.
Структура управления агентами/скорости и инструментариев пока слабее — примерно на уровне ChatGPT годичной давности.
Я задал поисковый запрос достаточно сложный. Очевидно что надо было его в какой-то момент стопать, но он кажется нажёг на 3 USD Kimi K3 и ещё 20 поисковых центов. Хотя 99% этого времени не имели смысла.
Тем не менее отставание уже не выглядит катастрофическим. Для разработки такую систему вполне можно использовать в отдельных сценариях — например, если модель хостится локально, или хватает простой модели с OpenRouter.
В общем, проект интересный. Теперь хочется потестить Kimi Code, выход которого недавно анонсировали.
А что вы из нестандартных агентов используете?
🔥39❤16
Так. Давно видео не было. И переезжал, и август был загруженный, и отдохнуть немного хотелось 😁
Последние пару месяцев всё что в этом видео было - проговаривал людям сам. Подумал что раз так часто - то надо делать видео.
Расскажу о разных способах сбора датасетов для тренировки.
Я не рассказывают тут про сбор данных с "головы" когда человек работает. Это скорее надо для претрейна, а не для конечного обучения.
https://youtu.be/zlLymNdF_hk
Последние пару месяцев всё что в этом видео было - проговаривал людям сам. Подумал что раз так часто - то надо делать видео.
Расскажу о разных способах сбора датасетов для тренировки.
Я не рассказывают тут про сбор данных с "головы" когда человек работает. Это скорее надо для претрейна, а не для конечного обучения.
https://youtu.be/zlLymNdF_hk
YouTube
Data collection for robotics
00:00:00 - Intro
00:00:50 - Train by hands
00:01:31 - Copy of the robot
00:02:18 - GELLO
00:03:05 - Harply, Microfactory, Elephant Robotics
00:04:35 - Force feedback
00:05:30 - Universal Manipulation Interface
00:06:20 - Quest, Vive, etc.
00:06:20 -…
00:00:50 - Train by hands
00:01:31 - Copy of the robot
00:02:18 - GELLO
00:03:05 - Harply, Microfactory, Elephant Robotics
00:04:35 - Force feedback
00:05:30 - Universal Manipulation Interface
00:06:20 - Quest, Vive, etc.
00:06:20 -…
❤21💩3🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
Короче. Я тут подумал. А давай-ка направлю камеру на балкон и мне GPT-6 Astra соберёт решение чтобы птичек детектит. Иии...
Хрен там. Даже не рядом.
https://youtu.be/zHJ7ST_EV2A
Хрен там. Даже не рядом.
https://youtu.be/zHJ7ST_EV2A
❤16🔥13💔7
А вы тоже заметили, что в последнее время налетела очередная волна хайпа вокруг искусственного интеллекта? Причём идёт она из совершенно разных мест.
Подобные обсуждения стали появляться во многих каналах и на YouTube, причём преимущественно там, где раньше не особо говорили о нейронках и AI. Внезапно появилось множество людей, которые стали считать себя экспертами и рассказывать, как нам срочно нужно всё заблокировать, ввести побольше ограничений, как OpenAI взломал Hugging Face и всё в таком духе. Я боюсь в 90% они даже не знают что такое Hugging Face. И в чем разница с его взломом и с " взломом" модельками форума, когда они тупо в чате общались.
Хороший пример - вот этот канал. Но, помимо него, я знаю ещё с пяток мест, где позиция за последнее время резко поменялась.
Более того, ко мне недавно подходили несколько друзей и спрашивали, когда они останутся без работы, насколько быстро AI заменит людей и вообще сколько нам всем лет жить осталось. Причём раньше за ними подобных переживаний не водилось. Сегодня один математик жаловался что на конференциях по математике депрессуха.
У меня есть стойкое ощущение, что конкретно эта волна хайпа — очевидный прогрев перед IPO. И то, что мы видим с условно сворованным Навье - Стоксом, и десятки других подобных историй — всё это части одной и той же кампании.
Безусловно, нейронки стали лучше. Безусловно, они уже существенно изменили рабочие процессы, и в будущем нас ждут ещё более серьёзные изменения.
Но, похоже, именно эта последняя волна рекламы вокруг OpenAI и Anthropic сумела по-настоящему зацепить людей, которые раньше всей этой темой особо не интересовались. И параноя какая-то недобрая.
Кажется только Иван Ямщиков что-то более менее адекватное в русскоязычном поле гонит.
Так к чему я это. А что вы думаете? Всё пропало? Или таки IPO?:)
Подобные обсуждения стали появляться во многих каналах и на YouTube, причём преимущественно там, где раньше не особо говорили о нейронках и AI. Внезапно появилось множество людей, которые стали считать себя экспертами и рассказывать, как нам срочно нужно всё заблокировать, ввести побольше ограничений, как OpenAI взломал Hugging Face и всё в таком духе. Я боюсь в 90% они даже не знают что такое Hugging Face. И в чем разница с его взломом и с " взломом" модельками форума, когда они тупо в чате общались.
Хороший пример - вот этот канал. Но, помимо него, я знаю ещё с пяток мест, где позиция за последнее время резко поменялась.
Более того, ко мне недавно подходили несколько друзей и спрашивали, когда они останутся без работы, насколько быстро AI заменит людей и вообще сколько нам всем лет жить осталось. Причём раньше за ними подобных переживаний не водилось. Сегодня один математик жаловался что на конференциях по математике депрессуха.
У меня есть стойкое ощущение, что конкретно эта волна хайпа — очевидный прогрев перед IPO. И то, что мы видим с условно сворованным Навье - Стоксом, и десятки других подобных историй — всё это части одной и той же кампании.
Безусловно, нейронки стали лучше. Безусловно, они уже существенно изменили рабочие процессы, и в будущем нас ждут ещё более серьёзные изменения.
Но, похоже, именно эта последняя волна рекламы вокруг OpenAI и Anthropic сумела по-настоящему зацепить людей, которые раньше всей этой темой особо не интересовались. И параноя какая-то недобрая.
Кажется только Иван Ямщиков что-то более менее адекватное в русскоязычном поле гонит.
Так к чему я это. А что вы думаете? Всё пропало? Или таки IPO?:)
❤36💩17😱4
This media is not supported in your browser
VIEW IN TELEGRAM
Надо скзать что софт в эдж девайсах просто летит с какой-то суперсветовой скоростью. Я тут понял что в Qualcomm добавили поддержку моделей для роботов на NPU даже на дешевый/средний класс устройств.
Просто вау.
Изначально хотел проверить а можно ли VLM запускать на OAK4, а нашёл что там уже можно и VLA достаточно сложные. Короче вместо меди оказалось что-то поинтереснее.
https://youtu.be/Lyif8HH0Dn0
Теперь надо понять где это использовать:)
Просто вау.
Изначально хотел проверить а можно ли VLM запускать на OAK4, а нашёл что там уже можно и VLA достаточно сложные. Короче вместо меди оказалось что-то поинтереснее.
https://youtu.be/Lyif8HH0Dn0
Теперь надо понять где это использовать:)
🔥34❤4😱1
Media is too big
VIEW IN TELEGRAM
Тут вышло у Осетинской интервью с Humanoid. Эта компания которой я не понимаю. Если тут вдруг есть оттуда сотрудники - может расскажете что у вас происходит?
Я не понимаю как они с этим подняли 152 ляма (оценка больше ярда).
Их робот 10х медленнее чем наша станция (я уж не буду говорить на сколько порядков у нас меньше оценка и на сколько порядков меньше сотрудников). При этом у нас больше клиентов чем у них (из того что они анонсируют).
И стоимость нашего робота очевидно значительно меньше.
😭😭😭
Их оценка в 2 раза меньше Generalist. Там и станция выглядит на порядки лучше для рассматриваемых задач. И алгоритмы на несопоставимом уровне.
Это как оценка у Rhoda ai. Но насколько Рода лучше выглядит чем humanoid.
У меня есть 2 гипотезы:
1) Изначально в компанию было вложено 100м. После 100м вложений 152м инвестиций - это бридж. По сути это медленный рост.
2) Компания стала институциональной (Neura, Axelera) - и Европа вкладывает в это как в компанию для тех. защиты
Но они всё плохо объясняют
Я не понимаю как они с этим подняли 152 ляма (оценка больше ярда).
Их робот 10х медленнее чем наша станция (я уж не буду говорить на сколько порядков у нас меньше оценка и на сколько порядков меньше сотрудников). При этом у нас больше клиентов чем у них (из того что они анонсируют).
И стоимость нашего робота очевидно значительно меньше.
😭😭😭
Их оценка в 2 раза меньше Generalist. Там и станция выглядит на порядки лучше для рассматриваемых задач. И алгоритмы на несопоставимом уровне.
Это как оценка у Rhoda ai. Но насколько Рода лучше выглядит чем humanoid.
У меня есть 2 гипотезы:
1) Изначально в компанию было вложено 100м. После 100м вложений 152м инвестиций - это бридж. По сути это медленный рост.
2) Компания стала институциональной (Neura, Axelera) - и Европа вкладывает в это как в компанию для тех. защиты
Но они всё плохо объясняют
🔥12❤2💩2
Заметки Computer Vision инженера
Сергей - фаундер прикольного стартапа Phail.ai - они измеряют насколько все эти новомодные модельки реально эффективны. Недавно Сергей проезжал через Берлин - и я решили поговорить с ним поглубже на эту тему и обсудить как в реальности можно забенчмаркать…
Зато Сергей с которым было интервью ~ два месяца назад поднял 2м, с чем его и поздравляем 🔥🔥🔥
Вот тут у меня нет ни малейших вопросов что и почему.
Вот тут у меня нет ни малейших вопросов что и почему.
🔥21❤2💩1