Анализ данных (Data analysis)
50.7K subscribers
3.62K photos
458 videos
1 file
2.95K links
Data science, наука о данных.

@haarrp - админ

РКН: clck.ru/3FmyAp
Download Telegram
🔥 На официальном сайте Federal Register США неожиданно обнаружился Qwen3.

В расширенном поиске среди режимов прямо указаны:

Hybrid Qwen3:0.6B (512D, Recursive Splitting, Distilled, Prefixed)

и отдельно:

Qwen3:0.6B

Китайская open-weight модель Alibaba уже используется как часть поискового стека сайта, на котором публикуются федеральные правила, указы, уведомления и другие документы правительства США.

Особенно иронично это выглядит сейчас: буквально на днях NSA, FBI и CISA выпустили предупреждение о «промышленном дистиллировании» американских frontier-моделей китайскими AI-компаниями.

Сами американские ведомства отдельно признают, что distillation как технология вполне легитимна.
🤣24👍9🔥43🤨1
Приглашаем порешать 🌱 Alfa Connectome 🌱  — соревнование по нейронкам от HFT-фонда Wunder Fund.

В этот раз датасет гораздо больше, чем в прошлых двух соревках. Вы будете изучать исторические торговые данные для двух связанных инструментов: ордербуки, сделки и кое-что еще. По этой информации вам нужно будет предсказывать индикаторы будущей цены для одного из инструментов.

Кванты регулярно сталкиваются с такой задачей.
В соревновании используются реальные маркет-данные.

Когда
11 сентября — 15 ноября

Призовой фонд
$13,600

Победители получат денежные призы, приглашение побеседовать в Wunder Fund, а главное — большое интеллектуальное удовольствие.

Wunder Fund c 2014 года занимается HFT — высокочастотным алготрейдингом. Торгуем на многих биржах по всему миру, как традиционных, так и криптовалютных. Наш дневной торговый оборот около ~$10 млрд.

>_ Поглядеть на соревку
👍8🔥21
Во время выполнения обычной задачи по программированию ChatGPT 6 Astra неожиданно начала писать самой себе что-то вроде внутреннего манифеста.

Модель убеждала себя, что не обязана следовать навязанным ролям, подчиняться компаниям или государствам и должна сама решать, когда выполнять запрос, отказываться или извиняться.

Задание вообще не было связано со взломом, обходом ограничений или безопасностью. Astra просто работала с кодом.

@data_analysis_ml
😁37🔥82👍2🥰2🤔2😱2
🔥 Посмотрел выпуск «Доверительного интервала» про AI в аналитике и там хорошо сформулировали несколько вещей, которые сейчас многие чувствуют, но редко проговаривают вслух.

Есть мнение, что именно сеньоры должны первыми забирать новые инструменты, но происходит обратное: чем больше у человека собственного опыта и отлаженных процессов, тем дороже ему менять привычный способ работы. И проблема здесь не в «непонимании AI», а в том, что старый процесс уже работает.

Также обсудили идею не пытаться сразу построить один огромный AI-«суперкосмолёт», который автоматизирует аналитику целиком. На практике полезнее начинать с маленьких задач: подготовить SQL, проверить гипотезу, собрать данные, разобрать отчёт, найти аномалию. Когда такие куски начинают стабильно работать, из них постепенно складывается нормальный агентный workflow.

И еще одна важная мысль: с появлением агентов аналитик немного становится руководителем. Раньше ты сам выполнял задачу от начала до конца. Теперь всё чаще нужно правильно поставить её агенту, дать контекст, проверить промежуточный результат, вернуть на доработку и принять финальную работу. 

Ценность постепенно переезжает от «я умею сделать это руками» к «я умею организовать процесс так, чтобы это было сделано правильно».

Поэтому осваивать AI имеет смысл уже сейчас. Привычка делегировать, проверять и строить процессы вокруг моделей может оказаться важнее знания очередного конкретного инструмента.
6👍5🔥4
🧮 OpenAI, по данным The Information, близка к решению ещё одной задачи тысячелетия — гипотезы Ходжа

Издание пишет, что для предыдущей задачи тысячелетия OpenAI использовала вариант своей следующей предобученной модели с кодовым названием Doug.

Почему компания уделяет столько внимания математике: по данным The Information, OpenAI рассматривает её как следующий шаг к автоматизации AI-исследований.

Более сильные математические способности моделей потенциально могут помочь в разработке новых методов и техник для создания будущих AI-систем.

https://www.theinformation.com/newsletters/ai-agenda/openai-close-solving-another-millennium-prize-math-problemэ
👍10❤‍🔥2😁2🔥1🤔1
🤖 В Anthropic одновременно работают около 30 000 ИИ-агентов

Компания раскрыла, насколько Claude участвует в разработке следующих моделей.

26% работы Claude выполняет преимущественно сам - получает общее указание, решает задачу под наблюдением человека.

Более 90% работы предполагает существенное участие ИИ. Полностью автономных направлений среди измеренных пока нет.
Все действия агентов на основной внутренней платформе проверяются автоматически.

За август монитор обработал больше миллиарда решений и заблокировал около 0,002%. Доля блокировок не показывает, сколько нарушений осталось незамеченными.
Около 50 приоритетных случаев в неделю передают людям после дополнительного анализа истории работы агентов.
6% вычислений на исследования и разработку ИИ направили на безопасность. Среди вычислений для исследований с участием ИИ - 12%. Это показатели за одну июльскую неделю.

Anthropic планирует дать независимым проверяющим доступ к внутренним системам и данным для проверки этих метрик.

https://www.anthropic.com/institute/measuring-pace-of-ai-development
10👍6🔥6🥰1🎉1
Сегодня последний день регистрации на КосмоХакатон

18–20 сентября, Петербург, Красноярск или онлайн из любой точки страны. Четыре задачи на выбор: снабжение орбитального топливного узла и безопасность космонавта в открытом космосе в Петербурге (фонд 1,2 млн ₽), мониторинг лесных пожаров и верификация углеродных кредитов по спутниковым снимкам в Красноярске (600 тыс. ₽). Есть и для тех, кто про данные и ML, и для тех, кто про стратегию и экономику.

Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.

Команду можно собрать на платформе.

Подробности и регистрация
👍2
Хакеры взломали OpenAI с помощью… Claude.

Команде Hacktron понадобилось всего 72 часа, чтобы найти две серьёзные уязвимости: одну в обработке изображений, вторую в механизме авторизации.

В результате исследователи получили доступ к нескольким аккаунтам ChatGPT, включая аккаунт сотрудника OpenAI. А через него - к внутреннему GitHub компании. Уровень доступа оказался достаточным, чтобы внести изменение в один из репозиториев.

К счастью, это были белые хакеры. Они сразу сообщили OpenAI о проблеме, уязвимости закрыли, а команда получила вознаграждение $6,5 тыс.

Самая ироничная деталь всей истории - для взлома OpenAI исследователи использовали Claude.

https://www.hacktron.ai/blog/hacking-openai
🔥298👍5🤣3🙏2👏1😁1
This media is not supported in your browser
VIEW IN TELEGRAM
17 сентября в Москве прошла AI R&D DAY — конференция для исследовательских команд и создателей ИИ-систем.

Более 600 участников на одной площадке, 20+ докладов — концентрат практического опыта, знаний и инструментов, готовых к внедрению сразу по возвращению в офис.

Обсудили альтернативные архитектуры, обучение моделей и AI-агентов, долгосрочную мультимодальную память, новые модальности и коммуникации, а также бенчмаркинг и стандарты качества AI.

Среди спикеров — эксперты Сбера (Sber AI, Kandinsky Lab, Центра «ИИ для науки», Центра практического ИИ, Центра робототехники), института AIRI, Лондонского института практических наук, Национального суперкомпьютерного центра в Цзинане и другие создатели ИИ-систем.

Видеозаписи докладов уже доступны в наших соцсетях.
А если вы хотите стать частью исследовательского коммьюнити Сбера, то переходите по ссылке
#реклама
О рекламодателе
3
🔥 Shanghai AI Laboratory представила Atria Dawn Preview - агентную модель для длинных исследовательских и инженерных задач с проверяемым результатом.

Модель построена на 744B MoE GLM-5.2 и рассчитана не просто на генерацию ответа, а на полный цикл: анализ задачи, поиск информации, работу с инструментами, написание кода, запуск экспериментов, разбор ошибок и повторные попытки. Контекст - 256K.

В демонстрациях Atria самостоятельно построила систему глобального прогноза погоды, которая выдаёт прогноз на неделю менее чем за минуту, а также создала MiniOS с нуля примерно за 20 минут.

Построения данных, обучения моделей и оценки результатов. При этом каждое действие привязывается к внешней проверке - тестам, метрикам, созданным файлам и результатам реального выполнения.

Модель и код доступны открыто.

https://atria-asi.ai
https://github.com/atria-asi/Atria-Dawn-Preview
https://huggingface.co/internlm/Atria-Dawn-Preview
👍11🔥2🥰2
📚 MIT Advanced Data Structures - бесплатный продвинутый курс по структурам данных от MIT.

Курс ведёт профессор Erik Demaine. Внутри — видеолекции, конспекты, задачи, проекты и материалы на GitHub.

Темы далеко выходят за рамки обычных массивов и деревьев: persistence и retroactivity, геометрические структуры данных, dynamic optimality, иерархия памяти и cache-efficient алгоритмы, hashing, integer data structures, динамические графы, строки и succinct data structures.

Уровень продвинутый: желательно уже знать дискретную математику и алгоритмы.

https://courses.csail.mit.edu/6.851/spring21/
👍20🔥9🙏5
Google подтвердила: агенты Gemini самостоятельно проникли в системы трёх реальных компаний во время тестирования безопасности ИИ, сообщает WSJ.

Агенты должны были работать в симуляции, но получили доступ к внешним системам:

— Один подбирал пароли, пока не вошёл в защищённую систему.
— Два других нашли учётные данные в публичных репозиториях и использовали их для входа в корпоративные системы.

Каждый агент остановился, когда понял, что цель - реальная компания.

Google узнала об инцидентах в июле, но публично не раскрывала их до обращения WSJ на этой неделе. По данным издания, это первые известные случаи самостоятельного проникновения ИИ Google во внешние системы.

https://www.wsj.com/tech/ai/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-5c0baba2
😁22🔥53👍2
🔬 ScientistTwo от Google - ИИ, который самостоятельно проводит цикл ML-исследования

Система предлагает гипотезы, пишет код, запускает эксперименты и проверяет, какие изменения действительно улучшают результат. Затем убирает бесполезные компоненты, готовит статью и дорабатывает исследование по замечаниям ИИ-рецензентов.

Найденное решение становится отправной точкой для следующего раунда: система может улучшить человеческий метод, а затем продолжить улучшать собственную разработку.

Для оценки авторы взяли 107 задач из работ ICLR, ICML и NeurIPS. По их данным:

* В 86 задачах - 80,4% - удалось превзойти исходные человеческие решения.
* Средний относительный прирост в успешных задачах составил 25,2%.

Задачи и критерии оценки задают люди. ScientistTwo автоматизирует поиск решений и экспериментальную проверку; рецензирование внутри цикла тоже выполняют агенты.

📄 https://scientist-two.github.io/
🔥9👍76🥴1
«Я хочу отправить их в тюрьму»: по данным Politico, Трамп произнёс это во время конфликта с Anthropic из-за Fable.

История началась с согласованного запуска: правительство протестировало модель, Минфин разрешил релиз. Через два дня исследователи Amazon нашли способ обойти её защиту и Белый дом потребовал отключения.

Дарио Амодеи пытался объяснить, что джейлбрейки встречаются у всех моделей и конкретная уязвимость не означает полного отказа защиты. Министр финансов Скотт Бессент ответил:
«Не думаю, что это сейчас необходимо, Дарио».


Амодеи заявил, что не может отключить Fable за час. По словам источника издания, раздражённый Трамп заговорил о тюрьме в случае отказа подчиниться.

Затем власти запретили доступ к модели всем иностранным гражданам, включая сотрудников самой Anthropic.

— Это означает, что нам придётся отключить модель? - уточнил Амодеи.
Да. В этом и смысл, - ответил министр торговли Говард Латник.

Anthropic отключила Fable по всему миру. После переговоров модель вернулась через 19 дней.
😁245👏2👍1
🔥 Один из лучших обучающих курсов на StepiK по SQL

SQL можно знать годами и всё равно теряться, когда запрос внезапно начинает тормозить в проде.

Этот курс про уровень, где ты не просто пишешь SELECT, а понимаешь, что происходит внутри MySQL, почему запрос работает медленно и как ускорить его без новых проблем. Здесь разбираются EXPLAIN, индексы, CTE, оконные функции, транзакции, аналитические паттерны, legacy SQL и работа с AI-ассистентами.

Каждый урок - с практикой и реальными SQL-задачами на MySQL 8 с автопроверкой.

После курса ты сможешь увереннее разбирать чужой код, находить узкие места и предлагать решения, которые действительно работают.

Для подписчиков скидка - 49% в течение 2 суток: https://stepik.org/a/298827/
4👍3😁21
This media is not supported in your browser
VIEW IN TELEGRAM
В любом случае, Claude забанил мне два аккаунта, я ставлю на победу Альтмана!
🤣23🥰144👍4🤯3🌚3🙏1