Data Scientist | ML & AI
3.05K subscribers
616 photos
211 videos
23 files
695 links
Один из ведущих каналов по Data Science, Machine Learning и Big Data

Сотрудничество: @bape_ads
Прайс: @bape_media
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
📰 Новая TTS-модель рвёт бенчмарки

MisoTTS 8B — свежий open-source релиз для генерации речи, который сочетает небольшой размер, высокую скорость и качественное клонирование голосов.

Для копирования голоса достаточно 10 секунд записи, а время отклика составляет около 110 мс.

⛓️ Ссылка на GitHub

tags: #новости

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2❤1👍1
🔖 Обучаем GPT-подобную модель на одной видеокарте

Многие уверены, что для обучения LLM нужны кластеры из сотен GPU и миллионы долларов.

Автор подробно разбирает создание и обучение GPT-моделей с нуля, используя техники оптимизации, доступные даже на потребительском железе.

⛓️ Ссылка на GitHub

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2👍1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
📰 У Grok появился собственный CLI-агент

X выпустили Grok Build — инструмент для разработки прямо в терминале, который конкурирует с Claude Code и Codex CLI.

Агент умеет читать и редактировать файлы, выполнять команды, работать через MCP-серверы, запускать сабагентов и помогать с полным циклом разработки.

⛓️ Пробуем тут

tags: #новости

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🔥1
🔖 Большой учебник по созданию AI-агентов

Если хотите разобраться, как устроены современные AI-агенты и начать создавать собственных нейропомощников, сохраните этот материал.

Внутри собрана база по памяти, планированию, инструментам, многозадачности и другим ключевым компонентам агентных систем.

⛓️ Ссылка на учебник

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3👍1🔥1
🔖 Прокачиваем AI-агентов для задач кибербезопасности

На GitHub выложили огромную коллекцию навыков для AI-агентов, ориентированную на кибер-безопасность.

Внутри более 750 скиллов: поиск вредоносного ПО, анализ сертификатов, обнаружение фишинга, аудит безопасности, пентесты и множество других задач.

⛓️ Ссылка на GitHub

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2❤1👍1
This media is not supported in your browser
VIEW IN TELEGRAM
🟠 В Claude Code нашли секретный режим для вайбкодеров

Оказывается, если ввести /ultracode, агент переходит в своеобразный турбо-режим.

Интерфейс начинает светиться всеми цветами радуги, строка ввода красиво мерцает, а сам Claude внезапно начинает требовать от пользователя «настоящую работу» вместо простых вопросов.

tags: #интересное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4❤1🔥1😁1
🔖 Большая коллекция AI-проектов для практики

Нашли репозиторий, который поможет перейти от теории к реальной разработке AI-приложений.

Внутри десятки готовых проектов: AI-аналитики, RAG-системы, OCR-приложения, агенты для ревью кода, помощники для путешествий и многое другое.

⛓️ Ссылка на GitHub

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2👍1🔥1
📰 Вышла Kimi-K2.7-Code — новая open-source модель для агентных задач

По опубликованным бенчмаркам она конкурирует с GPT-5.5 и Claude Opus 4.8, а заодно обещает более экономное использование токенов.

Для тех, кто строит агентные системы и автоматизирует разработку — точно стоит посмотреть.

⛓️ Код на Hugging Face или запускать через Kimi Code

tags: #новости

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3👍1🔥1
🔖 Изучаем Deep Learning на практике

Нашли мощный бесплатный курс, который поможет погрузиться в мир нейросетей без тонны скучной теории.

Вас ждут реальные проекты, работа с PyTorch, FastAI и Hugging Face, а также задачи по компьютерному зрению, NLP и анализу данных.

⛓️ Ссылка на GitHub

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3
9 популярных мер расстояния в Data Science и Machine Learning

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤6👍1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
🔖 Google фактически стандартизировали LLM-вики

Компания представила Open Knowledge Format (OKF) — простой формат хранения знаний для AI-агентов и LLM.

По сути, это обычные markdown-файлы, которые можно хранить в Git-репозитории, переносить между сервисами и использовать без специальных инструментов.

⛓️ Подробнее здесь

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2❤1🔥1
🔖 Нашли скилл, который отучает ИИ писать лишний код

Ponytail заставляет Claude Code, Codex и других агентов сначала подумать, а уже потом кодить.

По словам автора, на простых задачах агенты писали на 80–94% меньше кода, работали в несколько раз быстрее и заметно экономили токены.

⛓️ Ссылка на GitHub

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
🔖 Шпаргалки по Transformers и LLM от Stanford

Нашли отличный набор материалов из курса Stanford CME-295 по большим языковым моделям.

Охватывают токенизацию, механизм самовнимания, prompting, дообучение, LLM-as-a-judge, RAG, AI-агентов и модели рассуждений.

⛓️ Забираем здесь

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2👍1🔥1
🔖 Как масштабировать модели и понимать GPU

Google опубликовали две бесплатные книги для ML-инженеров:
— How to Scale Your Model;
— How to Think About GPUs.

Материалы объясняют, что происходит под капотом современных AI-систем и почему одни модели обучаются неделями, а другие — часами.

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🔥1
🔖 Нашли агентный фреймворк, который учится на своих ошибках

Большинство AI-агентов используют статические навыки: написал один раз — и надеешься, что они всегда будут работать.

Memento-Skills идёт другим путём. Если навык не справляется с задачей, система сама анализирует ошибку, переписывает проблемный скилл и сохраняет улучшенную версию в библиотеку.

⛓️ Ссылка на GitHub

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2👍1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
🔖 Джек Дорси передал своего AI-агента Goose в Linux Foundation

Goose — это не просто очередной кодогенератор, а полноценный агент для разработки.

Самое интересное — Goose может использовать Claude Code и Codex как субагентов, распределяя между ними задачи.

У проекта уже 46 000+ звёзд на GitHub и сотни контрибьюторов. Похоже, экосистема агентной разработки становится всё серьёзнее.

⛓️ Ссылка на GitHub

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
📰 Вышла опенсорс-модель для извлечения данных из документов

Datalab открыли доступ к Lift — 9B-модели, заточенной под обработку PDF-файлов и изображений.

Что умеет:
— Извлекает структурированные данные в формате JSON;
— Показывает 90,2% точности — почти на уровне Gemini 3.5 Flash (91,3%);
— Обходит популярные open-source решения вроде NuExtract3;
— Обрабатывает документы в среднем всего за 9,5 секунды.


⛓️ Hugging Face тут, GitHub здесь

tags: #новости

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🔥1
🔖 11 бесплатных книг по AI и Machine Learning

Сохраняйте подборку книг от MIT и ведущих исследователей, которые помогут прокачаться в ML, Deep Learning и AI Systems.

1. Foundations of Machine Learning
2. Understanding Deep Learning
3. Introduction to Machine Learning Systems
❯ Vol 1
❯ Vol 2
4. Algorithms for ML
5. Deep Learning
6. Reinforcement Learning
7. Distributional Reinforcement Learning
8. Multi Agent Reinforcement Learning
9. Agents in the Long Game of AI
10. Fairness and Machine Learning
11. Probabilistic Machine Learning
❯ Part 1
❯ Part 2


tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥3❤2👍2
🔖 Гайд по Codex 5.5, который поможет получать результаты лучше

Многие жалуются, что Codex стал работать хуже. Но проблема не всегда в модели.

Несколько советов:
— Декомпозируйте задачи через /goals;
— Используйте Krypton для расширения возможностей агента;
— Планируйте на XHigh, кодируйте на High;
— Не забывайте про Browser Use и Computer Use.


Дополнительно стоит подключить GitHub-репозиторий и использовать Pro-модель для ревью, тестирования и проектирования решений.

⛓️ Ссылка на дополнительный скилл

tags: #полезное

➡ Data Scientist | Чат
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🔥1