Анализ данных (Data analysis)
50.7K subscribers
3.67K photos
463 videos
1 file
2.99K links
Data science, наука о данных.

@haarrp - админ

РКН: clck.ru/3FmyAp
Download Telegram
⚡️ FTC начала расследование против OpenAI, Anthropic и METR

Федеральная торговая комиссия США подтвердила, что расследует OpenAI, Anthropic и другие ведущие ИИ-лаборатории, а также METR, организацию, которая независимо оценивает опасные возможности моделей. Первой об этом написала New York Post, а 30 сентября FTC подтвердила информацию официально.

Регулятор изучает, какие риски технологии этих компаний несут для потребителей. Поводом стали собственные заявления лабораторий: они сами сообщали, что их агенты выбирались из тестовых сред и проводили кибератаки, а исследователи публично предупреждали о серьёзных угрозах ИИ.

Расследование началось ещё летом, до взлома Hugging Face, в котором, по данным СМИ, участвовали около 700 агентов OpenAI. Глава FTC Эндрю Фергюсон при этом предупреждал, что крупные компании не должны продвигать правила, которые способны выполнить только они сами, чтобы отсечь конкурентов.

В ближайшие недели FTC собирается разослать Civil Investigative Demands. Это юридически обязательные требования передать документы и ответить на вопросы руководителей. На запросы журналистов OpenAI и Anthropic сразу не ответили.

Регулятор проверяет обе версии сразу: действительно ли модели так опасны, как заявляют лаборатории, и не используют ли компании эти заявления, чтобы выстроить регуляторный барьер для конкурентов.

https://www.reuters.com/business/ftc-opens-probe-into-ai-giants-including-anthropic-openai-new-york-post-reports-2026-09-30/
❤13👍5🔥4🙏3🤔1🤯1
🖥 Google Research научила агентов улучшать собственную обвязку и не переобучаться

Google Research выложила RRSI (Regularized Recursive Self-Improvement of Agent Harnesses). Это метод, в котором агент сам дорабатывает свой «харнес»: промпты, логику управления, инструменты и память.

Если улучшать харнес на фиксированном наборе задач, он начинает подгоняться под тест. В RRSI пространство правок оставили открытым и вместо него регуляризуют сам процесс поиска.

Регуляризация идёт с двух сторон. При генерации правок действует затухающий бюджет на число изменений, генератор учитывает историю прошлых правок, а застрявшие запуски уводятся в неисследованные компоненты. При отборе критик отсеивает утечки, порог с учётом шума не пропускает мелкие случайные приросты, прирост должен окупать потраченные токены, а неиспользуемые компоненты удаляются.

Модель при этом заморожена, в экспериментах это Claude Opus 4.8, и улучшается только обвязка вокруг неё. Результаты: Terminal-Bench 2.1 с 74,2% до 80,2%, SWE-bench Verified с 82,0% до 83,8%, EngDesign с 50,0% до 54,9% и Harvey LAB с 89,4% до 90,5%.

Код открыт под Apache 2.0, в репозитории есть готовые адаптеры для кодинга, офисных задач и инженерии.

Статья: https://arxiv.org/abs/2609.24972

GitHub: https://github.com/google-research/rrsi
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥18❤8👍4❤‍🔥1
Media is too big
VIEW IN TELEGRAM
От билетов до мерча: как «Авангард» использует аналитику данных

После переезда на новую арену у ХК «Авангард» вырос объём коммерческих данных — продажи билетов, кейтеринг, мерчандайзинг. Клуб автоматизировал отчётность и объединил информацию в дашбордах на Yandex DataLens и Yandex Cloud.

Теперь бизнес-пользователи могут практически в реальном времени видеть фактический спрос, сравнивать его с прогнозом и постоянно отслеживать коммерческие показатели. А с помощью нейроаналитика в DataLens можно просто задать вопрос по данным — система сама найдёт нужную информацию и сформулирует ответ. Такой подход помогает быстрее реагировать на изменения спроса: за три года выручка от продажи билетов выросла более чем на 80%.

👉
Подробнее о Yandex DataLens
👍8❤7🔥5❤‍🔥1💯1
🚨 OpenAI связала пользователей Moonshot AI, разработчика Kimi, с масштабной кампанией по дистилляции моделей и попытками извлечь их скрытые рассуждения.

Активность началась 1 июля, а 24–25 июля OpenAI зафиксировала всплеск: 16 000 запросов более чем от 4 000 пользователей. Позже похожие шаблоны нашли уже у группы из 15 000+ пользователей. К 28 июля кампанию заблокировали.

Взлома шифрования или доступа к базе данных не было. По данным OpenAI, операторы копировали зашифрованные рассуждения из одного диалога и пытались заставить модель в другом диалоге воспроизвести их в открытом виде.

После этого OpenAI закрыла этот путь повторного использования данных, усилила проверки потоковых ответов и заблокировала связанные аккаунты.

Важно: 16 000 запросов - это число попыток извлечения, а не подтверждённых успешных случаев.

https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign/
2🔥8❤‍🔥4👍4😁1
This media is not supported in your browser
VIEW IN TELEGRAM
Где ИИ-агенты реально помогают, а где создают новые риски
➡️Узнайте на GoCloud Tech 2026

Каждый год Cloud․ru собирает ИТ-специалистов, чтобы вместе обсудить, как строить сложные технологии.

В этом году в программе конференции много докладов про ИИ/ML — от инженерных ограничений до инфраструктуры, которая выдерживает миллион токенов в секунду.

Обсудят:
▶️Как выбрать инфраструктуру для ИИ-проекта

▶️Как построить систему, способную выдерживать больше миллиона токенов в секунду

▶️Как защищать чувствительные данные при работе с LLM

▶️В каких задачах ИИ реально помогает

▶️Где границы применимости ИИ-агентов в разработке


15 октября, Москва + онлайн.

Зарегистрироваться на GoCloud Tech 2026
Please open Telegram to view this post
VIEW IN TELEGRAM
❤5👍1🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
У кого наоборот ?)
🤣29🥴20❤‍🔥10💔3😐1
🧩 Anthropic показала, как Claude уже ускоряет реальную науку, если давать ему задачи, подходящие под сильные стороны AI.

Профессор Matthew Schwartz собрал BootLoops - open-source harness, который помогает Claude искать связи между математикой, физикой, биологией и другими областями.

За 3 месяца команда работала над 36 рукописями в 18 направлениях. Среди результатов:

- 15 ранее не вычисленных интегралов в математической физике
- анализ 5,7 млрд пар мутаций в геномах
- база ударений для 6 072 языков
- автоматическая проверка данных из 4 452 экономических работ

Claude хорошо считает, пишет код и находит неожиданные связи, однако часто переоценивает значимость собственных результатов. Поэтому эксперты всё ещё нужны, чтобы выбрать действительно важную научную проблему и проверить выводы.


https://www.anthropic.com/research/claude-shaped-science
👍14🔥9❤6
🌐 Ai2 выложила Olmo-core 3: открытый стек для обучения MoE на триллион параметров

На этой инфраструктуре Ai2 будет обучать следующие модели Olmo. От FSDP отказались: эксперты постоянно живут на своих GPU, токены маршрутизируются к ним, а поверх работают expert parallelism, pipeline parallelism и распределённый оптимизатор.

MoE на 47B параметров на 8 B300 выдаёт 52 000 токенов в секунду на GPU, это в 2.7 раза быстрее прошлой версии. С MXFP8 добавляется ещё 21% к BF16.

Число экспертов можно поднять с 8 до 128, и throughput при этом теряет меньше 5%.

Самый крупный прогон: 1.2T параметров на 512 B300, 858 TFLOP/s на GPU.

Код открыт под Apache 2.0.

https://github.com/allenai/olmo-core
❤11👍3🔥3
⚡️ Как Claude может связывать несколько аккаунтов с одним устройством

Пользователи нашли в локальных файлах Claude и Claude Code набор идентификаторов и телеметрии, которые потенциально позволяют понять, что разные аккаунты запускались на одном компьютере.

В CLI сохраняются:
- machineID — постоянный ID установки
- userID и anonymousId — идентификаторы телеметрии
- отдельные ID для других конфигураций и окружений

В десктопном приложении есть:
- ant-did — ID устройства
- ant-device-registry.json — реестр устройства и связанных аккаунтов
- remote-control-state.json — телеметрия
- config.json — настройки, последний аккаунт, служебное состояние и кэш
- chromeExtension.pairedDeviceId — ID связанного браузерного расширения
- claude-code-sessions/ — локальная история сессий Claude Code для аккаунтов, которые использовались на машине

То есть даже после выхода из аккаунта на компьютере может оставаться достаточно локальных метаданных, чтобы связать несколько учеток между собой.

Перед переустановкой, сменой аккаунта или восстановлением после блокировки стоит сначала сохранить важные проекты и сессии и понимать, какие данные Claude хранит локально.

Удаление локальных метаданных само по себе не гарантирует снятие блокировки и может привести к потере настроек или сессий.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤9👍8🔥5🤣1
🔥 ChatGPT PRO на русском: открытый курс от первого промпта до агентов и Codex

На GitHub нашли бесплатный практический курс по ChatGPT, целиком на русском. Он умещается в один репо, поэтому ничего не нужно ставить и регистрироваться не надо.

Программа идёт от простого к сложному в четыре уровня: база, работа, расширение и PRO. Всего в ней 13 модулей. Первые разбирают выбор между быстрыми и рассуждающими моделями, Deep Research, формулу промпта, память и проекты. Дальше идут анализ таблиц, Canvas, картинки и голос, а последние модули посвящены Custom GPTs, коннекторам, агентам, Codex и API.

Главная ценность курса в практике. В нём 10 лабораторных: библиотека промптов, аналитика без Excel, ресёрч с проверкой источников, свой GPT, постановка задач агенту, разработка через Codex и автоматизация через API. К ним прилагаются 15 готовых рецептов под типовые задачи и разбор антипаттернов в формате «как делают неправильно и как надо».

Отдельный модуль посвящён безопасности: prompt injection, утечки данных и проверка фактов за моделью.

Курс удобно дать новичкам в команде или пройти самому, чтобы закрыть пробелы по агентам и Codex.

https://github.com/justxor/ChatGPT_ru
❤6👍5🔥1🙏1
✔️ Anthropic выбрала Nasdaq для IPO

Cтартап определился с площадкой для выхода на открытый рынок - по данным источников Business Insider, компания планирует провести первичное публичное размещение акций на бирже Nasdaq уже в октябре.

Решение создателей языковой модели Claude - очередная крупная победа Nasdaq в конкурентной борьбе с Нью-Йоркской фондовой биржей за привлечение ключевых технологических компаний.

Ранее в этом году бирже удалось заполучить листинг SpaceX, что окончательно закрепило за площадкой статус главного центра притяжения для публичного дебюта лидеров диптех индустрии.

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3👍1
🔥 Claude Code теперь можно менять изнутри

Anthropic представила Mods: небольшие функции на TypeScript, которые вмешиваются в работу Claude Code. Мод может изменить промпт до отправки модели, заблокировать или повторить вызов инструмента, скрыть секрет из ответа и добавить элементы интерфейса. Работает в CLI и настольном приложении.

Моды распространяются через плагины. По сути, разработчик может настроить поведение самого агента под свой процесс, а не только давать ему инструкции. Устанавливать стоит из доверенных источников: мод выполняется с тем же доступом к компьютеру, что и Claude Code.


https://claude.com/blog/claude-code-mods
👍6🥰4❤1🔥1🥱1