Data Portal | DS & ML
8.4K subscribers
491 photos
136 videos
5 files
681 links
Всё самое интересное из мира LLM, Data Science и машинного обучения

adds: @devmangx
Автор: @ScienceLLM
Download Telegram
Напоминание: для веб-поиска, который используют AI-агенты, не обязательно нужен платный API-ключ.

Есть CLI-инструмент для самостоятельного хостинга и MCP-навык для AI-агентов, построенный на базе SearxNG.
Он даёт локальным агентам доступ к поиску в интернете, отправляя запросы через собственный экземпляр SearxNG и возвращая результаты в удобном виде для OpenClaw, Claude Code, Antigravity и т.п.

В основе инструмента лежит SearxNG — метапоисковая система с самостоятельным хостингом, которая агрегирует результаты из Google, Bing, DuckDuckGo, Brave и более чем 70 других источников. Основной способ работы через терминал: достаточно выполнить команду ask-search "запрос", при необходимости указав количество результатов, категорию новостей, языковые фильтры, вывод только URL-адресов или результатов в формате JSON.

Берём на вооружение 🚬
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
NVIDIA открыла исходный код ARDY — новой ИИ-модели для интерактивной генерации движений людей в реальном времени.

Вы просто описываете, что должен делать персонаж, и он это делает. Прямо во время движения. Можно изменить текстовую команду на ходу, указать новую точку маршрута или добавить ключевые кадры и система мгновенно перестроит движение. Без предварительного просчёта и ожидания.

И на этот раз NVIDIA выпустила всё сразу:

- исходный код;
- веса модели;
- рабочее демо.

Система полностью готова к локальному запуску. При этом модели достаточно 20–24 ГБ VRAM.

Особенно интересно, что эта технология создавалась не только для анимации - в её основе лежат те же исследования, которые NVIDIA использует в разработке человекоподобных роботов.
This media is not supported in your browser
VIEW IN TELEGRAM
Вышла NVIDIA DeepStream 9.1 с 13 агентными скиллами для создания пайплайнов видеоаналитики.

Вместо того чтобы вручную собирать пайплайн компьютерного зрения с нуля, достаточно описать нужный результат обычным естественным языком. Эти скиллы можно использовать вместе с Claude Code или Codex, чтобы упростить настройку окружения, конфигурацию и запуск.

Среди новых скиллов — Multi-View 3D Tracking (MV3DT) для отслеживания объектов по данным с нескольких камер и AutoMagicCalib для автоматической калибровки сети камер.

В этом релизе также появилась поддержка NVIDIA JetPack 7.2 для edge-развёртывания на Jetson Orin и Thor. Всё опубликовано в открытом исходном коде на GitHub — подробнее здесь: https://nvda.ws/4vxQ6Yk
Локальный запуск 1-битной LLM не должен требовать полной пересборки inference-стека с нуля.

bitnet.cpp — это фреймворк для инференса, предназначенный для инженеров, которые хотят локально запускать 1,58-битные LLM.

Он помогает подготовить и запустить поддерживаемые модели, объединяя в одной кодовой базе конвертацию в GGUF, квантизацию, оптимизированные ядра и инференс через командную строку. В результате вы получаете единый задокументированный путь от чекпоинта модели до локальной генерации и измерения производительности на конкретном оборудовании.

Ключевые возможности:

• Инференс на CPU — оптимизированные ядра I2_S для x86-64 и ARM.
• Поддержка GPU — кастомные CUDA-ядра W2A8 для BitNet-b1.58-2B-4T.
• Работа с моделями — загрузка поддерживаемых чекпоинтов из Hugging Face и их конвертация в GGUF.
• Готовый CLI — управление промптом, количеством потоков, размером контекста, температурой и режимом чата.
• Инструменты для бенчмаркинга — измерение скорости обработки промпта и генерации токенов с помощью встроенных скриптов.

https://github.com/microsoft/BitNet
«How to Scale Your LLM Model» — техническая книга об основах и системах, лежащих в основе больших языковых моделей.

В ней рассматриваются вычислительные ресурсы, память, параллелизм, шардинг, обучение, инференс, KV-кеш, задержка, пропускная способность, JAX, XLA и ключевые концепции, необходимые для понимания и оптимизации производительности моделей.

https://jax-ml.github.io/scaling-book/
Создание reasoning-модели и без того достаточно сложная задача — даже без необходимости восстанавливать пайплайн данных, обучения и оценки по разрозненным заметкам.

SkyThought — это open-source-набор инструментов и коллекция рецептов для разработчиков, которые обучают и оценивают reasoning-модели.

Он помогает воспроизводить и адаптировать workflow Sky-T1 с помощью задокументированных этапов подготовки данных, кода для обучения и Python-пакета для оценки.

Ключевые возможности:

• Рецепты моделей — стратегии подготовки данных и обучения для моделей Sky-T1 Preview, Flash и 7B.
• CLI для оценки — оценка моделей, генерация ответов и скоринг сохранённых генераций из командной строки.
• Набор бенчмарков — готовые конфигурации для оценки по математике, естественным наукам и программированию, включая AIME, GPQA Diamond, APPS и LiveCodeBench.
• Гибкие бэкенды — локальный vLLM, Ray с vLLM или endpoint, совместимый с OpenAI API.
• Ресурсы для RL — код reinforcement learning и примеры обучения, использованные для Sky-T1-7B и Sky-T1-mini.

https://github.com/NovaSky-AI/SkyThought
Практическое руководство по созданию поддерживаемых систем машинного обучения, охватывающее всё — от зависимостей в данных до инструментов MLOps.

Книга Чип Хуен посвящена ключевым архитектурным решениям, необходимым для разработки готовых к промышленной эксплуатации ML-систем, способных работать и масштабироваться под реальной нагрузкой.
Ghost Downloader — третий по популярности репозиторий дня на GitHub, хотя большинство о нём даже не слышало.

Ускоренное с помощью ИИ разбиение на чанки, TLS-фингерпринты реального браузера и обход антибот-защиты
Отдельные парсеры для YouTube, Bilibili, Hugging Face и релизов GitHub
Полноценная Android-версия, расширение для браузера и RPC, совместимый с aria2


174 тыс. загрузок. 5,8 тыс. звёзд. Версия 4.1.1.
IDM конец.

Репозиторий на GitHub: http://github.com/XiaoYouChR/Ghost-Downloader-3
Media is too big
VIEW IN TELEGRAM
Инженер Google объяснил, как дообучить крошечную LLM прямо на телефоне и повысить её точность с 46% до 90% всего за 21 минуту

Схема такая:

1. Выбрать Gemma 270M.
2. Сгенерировать синтетические данные для своей задачи.
3. Дообучить модель с помощью LoRA.
4. Квантизировать её до int4.
5. Развернуть на Pixel и получить скорость до 2000 токенов в секунду.

Именно благодаря такому циклу модель на 270 млн параметров может превзойти модель на 70 млрд параметров в конкретной задаче — при этом полностью работать офлайн прямо у вас в кармане.

Gemma 270M + синтетические данные + LoRA + int4-квантизация + on-device runtime — вот весь стек.

Посмотрите, сохраните и попробуйте уже сегодня дообучить собственного компактного AI-агента.

вот статья
Please open Telegram to view this post
VIEW IN TELEGRAM
«Probability on Trees and Networks» Рассела Лайонса и Юваля Переса — свободно доступная книга издательства Cambridge University Press, которая связывает теорию вероятностей с теорией графов и наукой о сетях.

В книге рассматриваются случайные блуждания, электрические сети, остовные деревья, ветвящиеся процессы, перколяция и ряд других ключевых тем современной теории вероятностей.

Объём книги превышает 700 страниц, поэтому это серьёзный и подробный материал. Особенно она подойдёт студентам и читателям, которые хотят выйти за рамки вводного курса и глубже изучить вероятностные методы на дискретных структурах.

Книга также будет полезна студентам, изучающим информатику и компьютерную инженерию, поскольку графы и сетевые структуры играют важную роль в обеих областях.
https://rdlyons.pages.iu.edu/prbtree/book_online.pdf
1
Вот как Борис Черный действительно масштабирует свою работу с Claude Code.

Разница в том, что вы смещаете время в сторону того, что важнее всего:
→ лучше формулируете промпты, больше планируете, больше ревьюите и меньше печатаете код вручную.

Рабочий процесс такой:
используется плагин, который распределяет каждую задачу между 5 агентами:

> один занимается брейнштормингом
> другой проектирует технический план
> третий реализует
> четвёртый проводит ревью
> пятый проверяет проект с разных сторон

Всё документируется в Markdown.

Такой подход медленнее, ожидания больше, но качество растёт, потому что у каждого агента есть чёткая роль.

А затем появляется настоящий мультипликатор:
→ git worktrees

Если Claude Code уже ускоряет вашу работу, то worktrees позволяют запускать несколько сессий параллельно, и каждая будет работать над своей задачей.

Их команда одновременно запускает от 4 до 8 сессий Claude Code.

Новый инженерный навык — умение управлять несколькими агентами, не теряя контроль над системой.

> ютуб
Media is too big
VIEW IN TELEGRAM
Полноценная программа для самостоятельного изучения компьютерных наук, составленная исключительно из лучших открытых университетских курсов.

- Продуманная последовательность курсов от MIT, Stanford, Berkeley и других ведущих университетов
- Охватывает математику, системное программирование, искусственный интеллект и практическую разработку более чем на 10 языках программирования
- Включает реальные проекты с кодовой базой в тысячи строк
- Полностью открыта и доступна для бесплатного чтения онлайн
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Лаборатория Университета Цинхуа выложила на GitHub проект, который заменяет стойку с H100 стоимостью $400 000 одной видеокартой с 24 ГБ памяти.

Он называется ktransformers, а идея почти до смешного проста: эксперты, которые реально используются, остаются на GPU, а остальные находятся на CPU до тех пор, пока не понадобятся.

/ DeepSeek-V3 и R1 с контекстом 139K на 24 ГБ VRAM
/ ускорение до 28 раз по сравнению со стандартной конфигурацией
/ дообучение DeepSeek-V3 на четырёх RTX 4090 вместо дата-центра
/ проект создан лабораторией MADSys Университета Цинхуа, а не стартапом с лендингом

Лицензия Apache 2.0, а на GitHub уже больше 17 000 звёзд.

http://github.com/kvcache-ai/ktransformers
Путаетесь в разных типах ИИ-агентов?

Понимание типов агентов важно для проектирования интеллектуальных систем, способных эффективно реагировать, планировать и обучаться.

Вот простое описание пяти основных типов ИИ-агентов и принципов их работы.

1. Простые рефлексивные агенты

Такие агенты действуют только на основе текущих входных данных, используя простые правила вида «условие — действие».

Они не обучаются и не запоминают прошлые состояния, поэтому работают быстро, но обладают ограниченными возможностями.

2. Рефлексивные агенты с моделью

Эти агенты используют внутреннюю модель, чтобы отслеживать текущее состояние окружающего мира.

Они способны работать в частично наблюдаемых средах, поскольку запоминают предыдущие входные данные и обновляют своё внутреннее состояние.

3. Целевые агенты

Вместо того чтобы просто реагировать на события, такие агенты планируют действия для достижения конкретной цели.

Они оценивают возможные последствия и выбирают действия, которые приближают их к нужному результату.

4. Агенты на основе полезности

Такие агенты не ограничиваются достижением цели, а стремятся максимизировать полезность результата.

Они сравнивают разные варианты и выбирают тот, который даёт наилучший результат в соответствии с заданной функцией полезности.

5. Обучающиеся агенты

Эти агенты развиваются со временем.

Они учатся на обратной связи, улучшают качество работы и исследуют новые способы действовать эффективнее в будущих ситуациях.
«Basic Algebra» Энтони У. Кнаппа — полезный справочник для студентов старших курсов бакалавриата и первого года магистратуры, которые хотят получить широкое представление о современной алгебре. Должен сказать, мне эта книга особенно нравится.

На более чем 700 страницах рассматриваются целые числа и многочлены, матрицы, векторные пространства, пространства со скалярным произведением, группы и действия групп, линейные преобразования, многолинейная алгебра, кольца, модули, расширения полей, теория Галуа, категории, функторы и многие другие ключевые темы алгебры.

В книге также собрано большое количество задач, многие из которых снабжены подсказками или полными решениями. Изложение строгое, поэтому книга особенно хорошо подойдёт читателям, уже имеющим некоторый опыт работы с математическими доказательствами.

https://math.stonybrook.edu/~aknapp/download/b2-alg-coverandinside.pdf
«Understanding Machine Learning: From Theory to Algorithms» — это фундаментальная книга о математических основах машинного обучения.

Она издана Cambridge University Press и рассматривает такие темы, как минимизация эмпирического риска, переобучение, PAC-обучение, равномерная сходимость, компромисс между смещением и сложностью, VC-размерность, теорема No Free Lunch, неравномерная обучаемость, линейные модели, бустинг и AdaBoost, выбор и валидация моделей, выпуклые задачи обучения, регуляризация, устойчивость и многие другие математические аспекты машинного обучения.

Книга доступна онлайн для личного использования. Авторы отдельно просят не распространять PDF и не давать прямую ссылку на файл, поэтому я делюсь официальной страницей книги. Ссылка Download находится в боковой панели.
http://cs.huji.ac.il/~shais/UnderstandingMachineLearning
Японские исследователи создали систему, которая моделирует целый город, генерируя до 1 миллиона виртуальных жителей, чьё поведение с помощью LLM имитирует человеческое.

И она с пугающей точностью предсказала реальные события.

Они разработали городской симулятор под названием CitySim, который заселяет цифровой двойник Токио автономными AI-агентами — их может быть до 1 миллиона.

Каждый виртуальный житель работает на базе LLM и обладает:

• личными воспоминаниями;
• долгосрочными целями;
• желаниями, похожими на человеческие: голод, усталость, потребность в социальном взаимодействии;
• пространственным восприятием и способностью ориентироваться.

Большинство городских симуляций основаны на правилах, заданных вручную: если происходит A, за ним следует B.

CitySim устроен иначе. Он работает на основе ценностей. У агентов есть собственная субъектность. Они самостоятельно составляют расписание, исходя из личных привычек, текущих потребностей и изменений окружающей среды.

Когда исследователи запустили симуляцию для Токио, результаты оказались пугающе точными.

Сценарии поездок на работу по будням, досуга по выходным и покупательского поведения почти идеально совпали со статистическими данными правительства Японии.

Система даже смогла предсказать распределение толпы в Сибуе и определить, какие магазины действительно станут популярными, за несколько месяцев до появления соответствующих данных из реального мира.

Для городского планирования это открывает огромные возможности.

Теперь можно безопасно и с меньшими затратами тестировать готовность к стихийным бедствиям, выбирать места для коммерческих объектов и оценивать модернизацию общественной инфраструктуры, не перемещая ни одного живого человека.

Но дело не только в планировании.

Исследователи уже рассматривают возможность добавить агентам более высокоуровневые человеческие стремления, например «самоактуализацию», чтобы посмотреть, как они будут развиваться.

Статья была опубликована на arXiv в июне 2025 года, но за пределами сообщества специалистов по вычислительным социальным наукам её почти никто не прочитал.
Foundations of Applied Mathematics — это бесплатная серия из четырёх учебников, созданная для программы по прикладной и вычислительной математике в Университете Бригама Янга.

В неё входят четыре тома:
Математический анализ
Алгоритмы, аппроксимация и оптимизация
Неопределённость и данные
Динамика и управление

Серия подходит студентам старших курсов бакалавриата и начальных курсов магистратуры. К ней также прилагаются лабораторные работы на Python и практические задания, поэтому математическая теория связана с численными вычислениями, алгоритмами, анализом данных и научными приложениями.

Особенно мне нравится, что это не только теоретические учебники. Сопутствующие материалы на Python помогают увидеть, как эти концепции применяются к реальным вычислительным задачам.
https://foundations-of-applied-mathematics.github.io
Я недавно откопал эту подборку университетских курсов по Computer Science с полноценными видеолекциями, разбитыми по темам для самостоятельного изучения.

https://github.com/Developer-Y/cs-video-courses

• Более 30 категорий: от введения в Computer Science до квантовых вычислений
• Ссылки на реальные плейлисты курсов от UNSW, UC Berkeley и других университетов
• Без MOOC, базовых туториалов и рекламного контента
• Есть разделы по системному программированию, ИИ, математике, безопасности и блокчейну