Forwarded from Банки, деньги, два офшора
Новая нейронка Google за полчаса сделала сайт стоимостью 3,5 млн рублей. Модель вышла всего пару дней назад. Если раньше для создания таких сайтов требовалась команда людей, то теперь — один человек и промпт. Эксперты считают, что волна подобных проектов накроет рынок в ближайшие месяцы, из-за чего часть веб-студий и фрилансеров обанкротятся. @bankrollo
👏2
Gaperton's Tech Corner
А вот в Китае вместо обещаний оставить студентов без работы Компартия надеется компенсировать роботизацией демографический спад. 🇨🇳 За 10 лет гуманоидные роботы смогут заменить до 37 млн рабочих мест в Китае Китай может массово заменить людей гуманоидными…
This media is not supported in your browser
VIEW IN TELEGRAM
🇨🇳 Ниче особенного, просто китайский боевой полицейский робот.
🔥4👏1
В роботе оказалось AI приложение, построенное на Dify. И это первая вещь, про которую они рассказывают в своем учебном курсе.
Неожиданно. И наверное очень полезно, в том числе вне контекста робототехники. Давно хотел с этими тулами разобраться.
Dify — это самая популярная платформа этого типа в Азии.
Dify — это платформа с открытым исходным кодом для создания рабочих процессов с использованием агентов. Она позволяет визуально описывать процессы, подключать имеющиеся инструменты и источники данных, а также развертывать приложения на базе искусственного интеллекта, которые решают реальные задачи.
Неожиданно. И наверное очень полезно, в том числе вне контекста робототехники. Давно хотел с этими тулами разобраться.
Dify — это самая популярная платформа этого типа в Азии.
❤1
Gaperton's Tech Corner
В роботе оказалось AI приложение, построенное на Dify. И это первая вещь, про которую они рассказывают в своем учебном курсе. Dify — это платформа с открытым исходным кодом для создания рабочих процессов с использованием агентов. Она позволяет визуально…
Да, еще там надо завести аккаунт в Qwen. Я завел.
Qwen3.7-Max очень, очень хороша. Неотличима от фронтира к которому все привыкли, в хорошем смысле.
Если кому интересно — там же можно Qwen3.6-27B бесплатно попробовать, которую можно локально завести.
Qwen3.7-Max очень, очень хороша. Неотличима от фронтира к которому все привыкли, в хорошем смысле.
Если кому интересно — там же можно Qwen3.6-27B бесплатно попробовать, которую можно локально завести.
А это текущая стоимость моделей.
Китайские модели дешевле при прочих равных. Интеллекта который есть сейчас хватает для большинства приложений. "Суперинтеллект" для того чтобы разбирать excel файлы не нужен. Не нужен он и чтобы управлять роботом-газонокосилкой.
Да, Амодей продает олигархам уолл-стрит их мечту — избавиться наконец от этих умников, от которых они зависят и которых искренне ненавидят. Весь мир идет другой дорогой, и решает другие задачи.
Китайские модели дешевле при прочих равных. Интеллекта который есть сейчас хватает для большинства приложений. "Суперинтеллект" для того чтобы разбирать excel файлы не нужен. Не нужен он и чтобы управлять роботом-газонокосилкой.
Да, Амодей продает олигархам уолл-стрит их мечту — избавиться наконец от этих умников, от которых они зависят и которых искренне ненавидят. Весь мир идет другой дорогой, и решает другие задачи.
👍6
Gaperton's Tech Corner
А это текущая стоимость моделей. Китайские модели дешевле при прочих равных. Интеллекта который есть сейчас хватает для большинства приложений. "Суперинтеллект" для того чтобы разбирать excel файлы не нужен. Не нужен он и чтобы управлять роботом-газонокосилкой.…
Метаверс помните? Цук на него 73 миллиарда потратил и компанию под него переименовал.
Он честно, искренне думал что люди захотят реальность на это убожество поменять.
Он честно, искренне думал что люди захотят реальность на это убожество поменять.
❤2
https://x.com/kirillk_web3/status/2057528102368977328?s=20
Интересно, что в США компаниями руководят мошенники вроде Амодеев с Альтманами, главный талант которых дурачить людей ("визионеры"), а Китае — инженеры, которые понимают что их компания делает и зачем.
Это называется "меритократия". Возможность продвигаться вверх пропорционально усилиям и заслугам. Положение человека определяется его способностями, достижениями, компетентностью и вкладом, а не происхождением, связями или статусом.
Причём она не бинарна: в разных обществах она выражена сильнее или слабее. Забавно, что в авторитарном Китае социальные лифты в ряде сфер могут работать эффективнее, чем в современной «свободной» Америке.
В Китае почти нет демократической традиции в западном смысле, зато есть очень глубокая традиция меритократической бюрократии, уходящая корнями в конфуцианство. На протяжении веков продвижение чиновников там было завязано на систему сложных государственных экзаменов. Университеты там появились не науки ради, а как центры подготовки к этим экзаменам. И за обман на экзамене бывало больно (китайцы всегды были изобретательны в части наказаний).
Такое, в общем. Не демократией единой.
Please open Telegram to view this post
VIEW IN TELEGRAM
X (formerly Twitter)
Kirill (@kirillk_web3) on X
instead of watching 2 hours of Netflix tonight, watch this 40-minute masterclass from the founder of a $20B China AI company
it's the clearest explanation I've seen of how Agent Swarms and AI sys…
it's the clearest explanation I've seen of how Agent Swarms and AI sys…
🔥1
Интересно, что я и мои друзья наоборот — перестали полагаться на ИИ пару месяцев назад в серьезных вопросах.
Эта блядь галлюцинирует определенность в местах где есть неопределенность (и с ней надо работать), и, что еще хуже — галлюцинирует общие выводы вместо нормального обобщения, там где надо обобщать, не читая материал. Я говорю о поведении фронтир моделей два месяца назад.
Это наверное можно поправить промптом. Но я просто отставил ИИ в сторону когда налетел на проблемы в важных вопросах. Думать надо своей головой. ИИ для другого — это просто тул для обработки текста.
Эта блядь галлюцинирует определенность в местах где есть неопределенность (и с ней надо работать), и, что еще хуже — галлюцинирует общие выводы вместо нормального обобщения, там где надо обобщать, не читая материал. Я говорю о поведении фронтир моделей два месяца назад.
Это наверное можно поправить промптом. Но я просто отставил ИИ в сторону когда налетел на проблемы в важных вопросах. Думать надо своей головой. ИИ для другого — это просто тул для обработки текста.
😁2
Ну вот, началось то, что и должно было начаться. Опус всем нравится. А вот счета за него — почему-то никому. Он не приносит пользы соразмерной этим деньгам, и честно говоря — в целом приносит ее так мало, что можно относительно легко обойтись вообще без него.
Догадываетесь что будет с дурачками, кто выстроил вокруг доступности Опуса целые стратегии, в которых они с удовольствием срут на головы своим программистам?
https://x.com/Ric_RTP/status/2058546401483653236?s=20
Шесть месяцев назад Microsoft предоставила тысячам инженеров доступ к Claude Code и поощряла их использовать эту платформу.
Инженерам она очень понравилась, и ее популярность резко возросла. Но затем пришли счета.
Ценообразование на основе токенов означает, что каждый запрос, каждый ревью кода, каждая сессия отладки стоит денег. При масштабе в 100 000 инженеров суммы стали настолько большими, что Microsoft издала внутренний приказ отменить почти все лицензии на Claude Code к концу июня и заставить всех перейти на собственный, более дешевый инструмент.
Догадываетесь что будет с дурачками, кто выстроил вокруг доступности Опуса целые стратегии, в которых они с удовольствием срут на головы своим программистам?
https://x.com/Ric_RTP/status/2058546401483653236?s=20
X (formerly Twitter)
Ricardo (@Ric_RTP) on X
Microsoft just banned its own engineers from using AI.
The tool was literally costing MORE than the humans it was supposed to replace.
They lied to you about AI adoption and now the whole narrative is blowing up:
Microsoft gave thousands of engineers access…
The tool was literally costing MORE than the humans it was supposed to replace.
They lied to you about AI adoption and now the whole narrative is blowing up:
Microsoft gave thousands of engineers access…
👍1
Media is too big
VIEW IN TELEGRAM
...а теперь Карпатый.
Есть те кто умеет красиво пиздеть. Есть реально умные. А есть те, кто умеет делать так, что оно реально работает.
В общем, Карпатый точно не третье. И люди это знают.
Есть те кто умеет красиво пиздеть. Есть реально умные. А есть те, кто умеет делать так, что оно реально работает.
В общем, Карпатый точно не третье. И люди это знают.
🔥5
Gaperton's Tech Corner
В роботе оказалось AI приложение, построенное на Dify. И это первая вещь, про которую они рассказывают в своем учебном курсе. Dify — это платформа с открытым исходным кодом для создания рабочих процессов с использованием агентов. Она позволяет визуально…
🤖 RAG и роботы
После разбирательства с роботом выяснилось, что RAG внутри используют не столько для поиска по большим текстам, сколько для сборки точных промптов под конкретные ситуации — из небольшой базы заранее подготовленных правил.
И это оказалось вполне реальной альтернативой файнтюнингу. Причём работает оно неожиданно хорошо.
По сути, под RAG кладут список условных рефлексов: “если ситуация такая, надо действовать так-то и так-то”. База небольшая, но RAG вытягивает из неё нужный фрагмент под текущий контекст и точечно дополняет промпт. Получается что-то очень похожее на ассоциативную память у человека.
С этим пониманием я решил сделать из агента Hermes в моём роботе настоящего специалиста по самому роботу. Сейчас собираю RAG-поиск по учебным материалам и курсам для Rosmaster.
Требования к поиску очень простые:
1. Никаких сервисов: всё должно работать на файлах и скриптах командной строки.
2. Система должна работать поверх папки с множеством Markdown-файлов.
3. При построении индекса нужно учитывать структуру Markdown: заголовки, секции, абзацы.
4. Поиск должен быть гибридным: и по смыслу, и по ключевым словам.
Сейчас сравниваю два варианта: простые скрипты поверх SQLite и отдельное решение на LanceDB.
Честно говоря, я меньше всего ожидал, что первым серьёзным шагом в робототехнике окажется разбирательство с RAG. Но мне нравится этот поворот. Я всё равно давно хотел этим заняться, а тут появился идеальный повод.
После разбирательства с роботом выяснилось, что RAG внутри используют не столько для поиска по большим текстам, сколько для сборки точных промптов под конкретные ситуации — из небольшой базы заранее подготовленных правил.
И это оказалось вполне реальной альтернативой файнтюнингу. Причём работает оно неожиданно хорошо.
По сути, под RAG кладут список условных рефлексов: “если ситуация такая, надо действовать так-то и так-то”. База небольшая, но RAG вытягивает из неё нужный фрагмент под текущий контекст и точечно дополняет промпт. Получается что-то очень похожее на ассоциативную память у человека.
С этим пониманием я решил сделать из агента Hermes в моём роботе настоящего специалиста по самому роботу. Сейчас собираю RAG-поиск по учебным материалам и курсам для Rosmaster.
Требования к поиску очень простые:
1. Никаких сервисов: всё должно работать на файлах и скриптах командной строки.
2. Система должна работать поверх папки с множеством Markdown-файлов.
3. При построении индекса нужно учитывать структуру Markdown: заголовки, секции, абзацы.
4. Поиск должен быть гибридным: и по смыслу, и по ключевым словам.
Сейчас сравниваю два варианта: простые скрипты поверх SQLite и отдельное решение на LanceDB.
Честно говоря, я меньше всего ожидал, что первым серьёзным шагом в робототехнике окажется разбирательство с RAG. Но мне нравится этот поворот. Я всё равно давно хотел этим заняться, а тут появился идеальный повод.
👍11❤3
Gaperton's Tech Corner
🤖 RAG и роботы После разбирательства с роботом выяснилось, что RAG внутри используют не столько для поиска по большим текстам, сколько для сборки точных промптов под конкретные ситуации — из небольшой базы заранее подготовленных правил. И это оказалось вполне…
Результаты первого этапа экспериментов с RAG
https://github.com/gaperton/ROSMASTER-M3PRO
1. Все руководства переведены из pdf в markdown. Это необходимый первый шаг. Я наконец научился делать это хорошо не руками а автоматически.
2. Написана базовая версия поиска RAG с sqlite. Использованы лучшие стандартные рекомендации, чтобы избежать совсем глупых ошибок. Это гибридный поиск, который объединяет результаты семантического поиска и поиска по ключевым словам. Чанки нарезаются осмысленным образом c cохранением структуры markdown. В общем, реализованы все стандартные советы, минимальная база.
3. Было сделано то же самое при помощи специализированной базы данных LanceDB.
А вот дальше началось интересное. В тесте на поиск LanceDB просрал sqlite. Сильно. Вскрытие показало, что причиной был паршивый алгоритм ранжирования гибридного поиска LanceDB. Прямолинейное ранжирование, которое я сделал руками в sqlite оказалось лучше. И вообще, sqlite оказался лучше примерно всем. По крайней мере, на этом маленьком детасете.
4. Поэтому я отключил встроенное ранжирование LanceDB. И сделал его снаружи, ровно, как сделано в sqlite. Что вдвое замедлило LanceDB. Зато он перестал давать паршивые результаты.
Такого я не ожидал, поэтому решил попробовать другой эксперимент. В котором, по советам бывалых, LanceDB должен был играючи обойти sqlite. Ну должна же специализированная база данных быть в чем-то круче, чем наколенная поделка. cross-encoder's re-scoring и reranker.
Opus был уверен, что это сильно поможет. Это оказалось полным фиаско. После очень жесткой ебли BGE-reranker таки показал лучший результат на размытых запросах. Но испортил простые запросы.
5. Cross-encoder's re-scoring не дал ожидаемых результатов.
В общем, результат первого этапа такой. Контрольный образец из говна и палок с sqlite порвал специализированную базу на кровавые ошметки в каждой категории. На малом датасете. Но все равно это совершенно не то, чего я ожидал.
Поэтому надо все обдумать и будем делать второй этап. А результаты первого описаны в README. Там внутри в репозитории, если кому интересны детали.
https://github.com/gaperton/ROSMASTER-M3PRO
1. Все руководства переведены из pdf в markdown. Это необходимый первый шаг. Я наконец научился делать это хорошо не руками а автоматически.
2. Написана базовая версия поиска RAG с sqlite. Использованы лучшие стандартные рекомендации, чтобы избежать совсем глупых ошибок. Это гибридный поиск, который объединяет результаты семантического поиска и поиска по ключевым словам. Чанки нарезаются осмысленным образом c cохранением структуры markdown. В общем, реализованы все стандартные советы, минимальная база.
3. Было сделано то же самое при помощи специализированной базы данных LanceDB.
А вот дальше началось интересное. В тесте на поиск LanceDB просрал sqlite. Сильно. Вскрытие показало, что причиной был паршивый алгоритм ранжирования гибридного поиска LanceDB. Прямолинейное ранжирование, которое я сделал руками в sqlite оказалось лучше. И вообще, sqlite оказался лучше примерно всем. По крайней мере, на этом маленьком детасете.
4. Поэтому я отключил встроенное ранжирование LanceDB. И сделал его снаружи, ровно, как сделано в sqlite. Что вдвое замедлило LanceDB. Зато он перестал давать паршивые результаты.
Такого я не ожидал, поэтому решил попробовать другой эксперимент. В котором, по советам бывалых, LanceDB должен был играючи обойти sqlite. Ну должна же специализированная база данных быть в чем-то круче, чем наколенная поделка. cross-encoder's re-scoring и reranker.
Opus был уверен, что это сильно поможет. Это оказалось полным фиаско. После очень жесткой ебли BGE-reranker таки показал лучший результат на размытых запросах. Но испортил простые запросы.
5. Cross-encoder's re-scoring не дал ожидаемых результатов.
В общем, результат первого этапа такой. Контрольный образец из говна и палок с sqlite порвал специализированную базу на кровавые ошметки в каждой категории. На малом датасете. Но все равно это совершенно не то, чего я ожидал.
Поэтому надо все обдумать и будем делать второй этап. А результаты первого описаны в README. Там внутри в репозитории, если кому интересны детали.
GitHub
GitHub - gaperton/ROSMASTER-M3PRO: ROSMASTER M3 Pro ROS2 Robot for Jetson NANO B01/Orin NX SUPER/Orin NANO SUPER/RPi 5
ROSMASTER M3 Pro ROS2 Robot for Jetson NANO B01/Orin NX SUPER/Orin NANO SUPER/RPi 5 - gaperton/ROSMASTER-M3PRO
🔥6👍3
Gaperton's Tech Corner
Результаты первого этапа экспериментов с RAG https://github.com/gaperton/ROSMASTER-M3PRO 1. Все руководства переведены из pdf в markdown. Это необходимый первый шаг. Я наконец научился делать это хорошо не руками а автоматически. 2. Написана базовая версия…
👨🔬 А жена, посмотрев на все это, сказала, что она не ожидала, что ее муж превратится в безумного ученого из "назад в будущее". Но ит из вот ит из.
🌧 Я же ответил, что газон не пострижен не поэтому, а потому, что дождь идет второй день. Что я могу поделать?
🌧 Я же ответил, что газон не пострижен не поэтому, а потому, что дождь идет второй день. Что я могу поделать?
😁7❤5🤷♂1🤝1
Gaperton's Tech Corner
👨🔬 А жена, посмотрев на все это, сказала, что она не ожидала, что ее муж превратится в безумного ученого из "назад в будущее". Но ит из вот ит из. 🌧 Я же ответил, что газон не пострижен не поэтому, а потому, что дождь идет второй день. Что я могу поделать?
This media is not supported in your browser
VIEW IN TELEGRAM
https://github.com/gaperton/ROSMASTER-M3PRO/blob/main/PS-LEDGER.md
Состояние эксперимента, формат для людей и ИИ.
Этот файлик помогает и мне и ИИ помнить что и зачем мы делаем.
Состояние эксперимента, формат для людей и ИИ.
Этот файлик помогает и мне и ИИ помнить что и зачем мы делаем.
Gaperton's Tech Corner
Результаты первого этапа экспериментов с RAG https://github.com/gaperton/ROSMASTER-M3PRO 1. Все руководства переведены из pdf в markdown. Это необходимый первый шаг. Я наконец научился делать это хорошо не руками а автоматически. 2. Написана базовая версия…
Локальный RAG поиск учебному курсу Rosmaster M3 Pro
Фаза 1: Поиск из командной строки
Аннотация
Этот репозиторий представляет собой доступное для поиска офлайн-зеркало учебной документации Yahboom по ROSMASTER M3 Pro и контролируемое исследование качества поиска по этому корпусу. Практический исследовательский вопрос был таким: для фиксированного набора Markdown-руководств, преобразованных с помощью Marker, какая локальная архитектура поиска дает новичкам наиболее релевантные фрагменты источников без использования сетевого сервиса во время запроса?
Итоговая система использует гибридный поиск по 247 Markdown-файлам: эмбеддинги BGE-small, ключевой поиск BM25/FTS, хлебные крошки заголовков, доступные обоим поисковым каналам, Reciprocal Rank Fusion и узкий детерминированный слой повышения рейтинга маршрутов для предсказуемых запросов новичков. На размеченном бенчмарке и sqlite-vec, и LanceDB достигают file MRR 1.000. Chunk MRR составляет 0.613 для sqlite-rag и 0.562 для lance-db-rag. Оставшиеся слабые ответы в основном связаны с ограничениями покрытия корпуса, а не с ошибками ретривера.
Исследовательский вопрос
Может ли полностью локальный RAG-ретривер надежно находить фрагменты, содержащие ответ, для естественно-языковых вопросов новичков по небольшому техническому корпусу материалов по робототехнике, и существенно ли влияет выбранный движок хранения на качество поиска?
https://github.com/gaperton/ROSMASTER-M3PRO
* * *
В общем, эта работа разъебала об стенку несколько мифов. Ряд результатов про которые пишут не удалось повторить.
Теперь берем вариант с sqlite, и делаем на его основе скилл для Гермес — знание о роботе.
И вторая фаза будет — глубокая обработка текста, с созданием онтологии и вики. Это, строго говоря, пост-процессинг материалов и к RAG не относится.
Фаза 1: Поиск из командной строки
Аннотация
Этот репозиторий представляет собой доступное для поиска офлайн-зеркало учебной документации Yahboom по ROSMASTER M3 Pro и контролируемое исследование качества поиска по этому корпусу. Практический исследовательский вопрос был таким: для фиксированного набора Markdown-руководств, преобразованных с помощью Marker, какая локальная архитектура поиска дает новичкам наиболее релевантные фрагменты источников без использования сетевого сервиса во время запроса?
Итоговая система использует гибридный поиск по 247 Markdown-файлам: эмбеддинги BGE-small, ключевой поиск BM25/FTS, хлебные крошки заголовков, доступные обоим поисковым каналам, Reciprocal Rank Fusion и узкий детерминированный слой повышения рейтинга маршрутов для предсказуемых запросов новичков. На размеченном бенчмарке и sqlite-vec, и LanceDB достигают file MRR 1.000. Chunk MRR составляет 0.613 для sqlite-rag и 0.562 для lance-db-rag. Оставшиеся слабые ответы в основном связаны с ограничениями покрытия корпуса, а не с ошибками ретривера.
Исследовательский вопрос
Может ли полностью локальный RAG-ретривер надежно находить фрагменты, содержащие ответ, для естественно-языковых вопросов новичков по небольшому техническому корпусу материалов по робототехнике, и существенно ли влияет выбранный движок хранения на качество поиска?
https://github.com/gaperton/ROSMASTER-M3PRO
* * *
В общем, эта работа разъебала об стенку несколько мифов. Ряд результатов про которые пишут не удалось повторить.
Теперь берем вариант с sqlite, и делаем на его основе скилл для Гермес — знание о роботе.
И вторая фаза будет — глубокая обработка текста, с созданием онтологии и вики. Это, строго говоря, пост-процессинг материалов и к RAG не относится.
GitHub
GitHub - gaperton/ROSMASTER-M3PRO: ROSMASTER M3 Pro ROS2 Robot for Jetson NANO B01/Orin NX SUPER/Orin NANO SUPER/RPi 5
ROSMASTER M3 Pro ROS2 Robot for Jetson NANO B01/Orin NX SUPER/Orin NANO SUPER/RPi 5 - gaperton/ROSMASTER-M3PRO
👏2
Занимательная задачка. Состоит из двух частей — первая простая, вторая сложная.
Вот это — первая.
Разделить фигуру на четыре равных части. Не обязательно по границам клеток, можно рисовать где угодно.
Кто решил — отпишитесь. После этого покажем вторую, сложную.
Правильный ответ не говорить, просто зарегистрироваться в комментах для второго этапа. Тем кто знает в чем финальное западло — не раскрывать.
Вот это — первая.
Разделить фигуру на четыре равных части. Не обязательно по границам клеток, можно рисовать где угодно.
Кто решил — отпишитесь. После этого покажем вторую, сложную.
Правильный ответ не говорить, просто зарегистрироваться в комментах для второго этапа. Тем кто знает в чем финальное западло — не раскрывать.