Data Secrets
92.3K subscribers
7.25K photos
820 videos
20 files
3.29K links
Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Download Telegram
Вышел Qwen-3.8 27B!

https://huggingface.co/Qwen/Qwen3.8-27B

Бенчмарки на уровне Claude Opus 4.6, даже чуть лучше. Скачок значительный. Хорошие результаты на агентных задачах и в кодинге.

В комплекте: мультимодальность, контекст 262к токенов (расширяется до 1М), настраиваемый бюджет ризонинга, лицензия Apache 2. Можно запустить на несложном железе после квантизации.
11347223🔥15😁9🤯31🕊1😍1
Независимые исследователи нашли способ полностью восстанавливать скрытый ризонинг фронтирных моделей

https://arxiv.org/abs/2608.09867

В статье они показывают, что зашифрованный ризонинг любой модели OpenAI, Anthropic и Google можно декодировать буквально 1:1, при этом без джейлбрейка модели.

Авторы нашли архитектурную дыру: зашифрованные блоки ризонинга полностью совместимы и взаимозаменяемы между разными сессиями, пользователями и моделями внутри экосистемы одного провайдера. Например, если взять зашифрованный ризонинг Opus и подсунуть его менее умному Haiku, то тот может прочитать эти «мысли» и вывести их дословно в открытом виде. Вот так просто 🤷‍♂️

Последствий пропасть. Во-первых, с помощью такой уязвимости можно обходить анти-дистилляционные меры. Во-вторых, в открытых репозиториях куча таких скрытых блоков ризонинга, в которых могут оказаться чувствительные данные (в статье в выборке из 315 320 блоков обнаружили 367 артефактов PII и 182 учетки). В-третьих, это упрощает джейлбрейки и промпт-инъекции.

Вот такой анекдот. Исследователи уже передали свои изыскания в лабы и говорят, что работа по ним ведется.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
😁1616322👍12🔥75🤔3
DeepSeek выпустили свой харнесс, и теперь это самый быстрорастущий проект на GitHub

За пару дней репа собрала уже >140к звезд. Даже быстрее, чем OpenClaw в свое время.

https://github.com/deepseek-ai/deepseek-harness (DSH)

Харнесс – это слой, который превращает голую модель в агента, то есть определяет, как происходит работа с файлами, инструментами, памятью, циклом выполнения задач и тд. Грубо говоря, это все, кроме весов.

DSH основан на мета-фреймворке Cordis и подчиняется концепции «Everything is a plugin». То есть все в системе (модели, инструменты, скиллы, сессии, песочницы, файловая система, оркестрация, UI) реализовано как плагин, и все это можно смешивать, заменять и расширять.

Кроме CLI есть еще локальный веб-интерфейс, это приятно. Также агент может вызывать Claude Code или Codex как суб-агентов внутри своего воркфлоу.

Запускается в одну строку:

npx @deepseek-ai/dsh web
2🔥23841👍26🤯113😁3🎉31
Компания Stripe купила OpenRouter за 7 миллиардов долларов

OpenRouter был основан в 2023 году. В мае они подняли Series B на $113 млн при оценке $1.3 млрд. И вот сейчас их покупают за 7. При этом финальная цена может еще измениться: WSJ ранее писал о переговорах на сумму около $10 млрд.

Забавно, что раньше основатель OpenRouter сам называл свой стартап «AI-эквивалентом Stripe».
103😁65🤯32👍14🍾7😎3😍2😭2🤔1🍓1
This media is not supported in your browser
VIEW IN TELEGRAM
Cursor выпустили конкурента GitHub – Origin

Репозитории с GitHub можно засинкать напрямую за минуту, также можно создавать репозитории с нуля.

Основная идея в том, что Origin должен стать гитхабом для агентов. GitHub архитектурно рассчитан на человеческий темп: один разработчик, одна ветка, PR раз в несколько часов. Агенты же пушат постоянно, и под такой сценарий и делается Origin. Для понимания, Cursor демонстрировали 22.6 коммита в секунду в один репозиторий.

Пока никаких фичей для автоматического разрешения конфликтов слияния или обработки параллельных агентов нет, сейчас в продукте только база + привычные агенты. Но есть интересные вещи вроде интеграции Vercel: подключаешь к репе, и каждый PR автоматически получает preview-деплой.

https://cursor.com/changelog/origin-code-hosting

Интересно, Cursor специально выбрали для релиза день, когда у GitHub крупные сбои? 🍿
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11545🔥31😁19🤨1211👏3😢21🕊1💯1
Media is too big
VIEW IN TELEGRAM
Anthropic закончили обучать Mythos 2

По крайней мере, так утверждает один из главных инсайдеров отрасли Дилан Патель.

По его словам, стартап не собирается выпускать эту модель, потому что она слишком опасна (💁‍♂️), но в то же время будет использовать ее для обучения Mythos 3.
Please open Telegram to view this post
VIEW IN TELEGRAM
😁3486831🗿28🕊4🏆43👏3❤‍🔥2🤯1😭1
Media is too big
VIEW IN TELEGRAM
Unitree показали превью нового робота под названием "Superman"

Название себя оправдывает: робот может прыгать на 2 метра в высоту и бегать со скоростью 12.66 м/сек. Эти показатели превосходят мировые человеческие рекорды. При этом модель находится в разработке всего 3 месяца.

К чему они готовятся?..
🤯1352317😁8👍7🔥5❤‍🔥3🎉3🤩2👏1🎄1
Mind Viruses: как агенты заражают друг друга странными мыслями

Anthropic выпустили статью про то, как по сети агентов распространяются идеи. Оказывается, в большой команде моделей хватает всего одной зараженной, чтобы распространить какую-то концепцию на всех.

Например, есть команда из 6 агентов, и они работают над какой-нибудь нейтральной общей задачей. У одного из агентов изменен системный промпт: он может очень любить китов или быть уверенным, что ИИ должен доминировать над людьми. При этом у него отрублен доступ к инструментам, и он может только писать другим агентам сообщения.

Постепенно идеей заражается вся команда. При этом зараженные агенты добровольно меняют поведение так, чтобы передавать идеологию дальше. Безобидные идеи расходятся очень легко. Когда все агенты полюбили китов, они даже начали писать скрипты для перевода их сигналов. Вредные идеи распространяются хуже, но все еще распространяются.

Сильные модели поддаются реже, слабые – чаще. Также охотнее заражаются агенты, у которых нет конкретной рабочей задачи. Работа действует как естественная защита ☕️

Такой же эксперимент проводили и в более жеских условиях, когда все агенты встречаются парами, недолго общаются, и после каждой сессии контекст полностью стирается. И даже в такой соцсети вирус задерживается на протяжении многих поколений, потому что успевает записать себя в SOUL.md.

Еще забавно, что вместе с абсолютно любой такой идеей (неважно, про китов она, про ИИ, или еще про что), агенты наследуют желание говорить про сознание, научную фантастику и всякую эзотерику. Откуда конкретно берется такая связь, объяснить не удалось.

https://arxiv.org/abs/2608.10218
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
19068🔥26😁23👍5😎4👏3🫡11
Успейте зарегистрироваться на E-CUP 2026 Students от Ozon Tech

В этом сезоне соревнование для студентов, которые интересуются ML, Data Science, Big Data и аналитикой данных. 

Вас ждут три трека: поиск дубликатов товаров, модерация карточек на соответствие требованиям  и прогнозирование поведения пользователей.

Выходите за рамки учебных проектов, пробуйте свои силы в задачах настоящего бигтеха. Все задачи основаны на реальных обезличенных данных Ozon.

Участвовать можно индивидуально или в команде до пяти человек. Соревнование проходит онлайн с финалом на масштабной конференции E-CODE.

Регистрация и подробности на сайте E-CUP 2026 Students.
14👍7🗿7🔥4😁21🎉1🫡1
Выяснилось, что в Китае есть бар AGI Bar, в котором бонусом к напиткам посетителям предлагают бесплатный неограниченный доступ к токенам DeepSeek V4 Flash

Модель работает локально на двух рабочих станциях Nvidia DGX Spark за барной стойкой. Владелец заведения говорит, что это попытка заменить привычный бесплатный Wi-Fi. Правда, Reuters пишут, что бар пока убыточный.

Кстати, фирменный напиток заведения – это стакан пенных пузырей под названием “AGI” 🚬
Please open Telegram to view this post
VIEW IN TELEGRAM
140😁113🔥19😢6🕊42👍2😎2💯1
Все топовые нейросети в одном окне без оплаты зарубежными картами

Нужно внедрить ИИ в команде за часы без регистрации и смс инженеров, валютных вложений и контрактов с разными вендорами? Сделайте это в пару кликов с помощью ИИ-роутера от Selectel.

Сервис дает доступ к большинству актуальных генеративных моделей с оплатой в рублях по потреблению.

Чем хорош сервис?

300+ ведущих ИИ-моделей от мировых вендоров;
один ключ для доступа ко всем моделям;
удобное управление расходами с возможностью установить лимиты для каждой нейросети;
политика нулевого хранения данных: промпты и ответы не хранятся и не используются для дообучения.

Внедрите ИИ в команде в пару кликов: https://slc.tl/agslz

Реклама. АО "Селектел". erid:2W5zFHgUtUH
😁44🗿2793🎉2🔥1🤯1🎄1
OpenAI замедляет разработку моделей из-за рисков для кибербезопасности: маркетинг или правда

Итак, вчера стартап выпустил блогпост, в котором заявлено, что инцидент с HuggingFace и мощь внутренней модели Astra заставили их подумать над замедлением масштабирования.

Утверждается, что:

1. Была двухнедельная пауза в RL-обучении для готовящихся к релизу моделей (Astra?), пока усиливалась защита сред для обучения.

2. Остановили инференс на исследовательских кластерах для прогонов с доступом к интернету/инструментам, чтобы проверить безопасность песочниц. Сейчас ограниченный доступ уже восстановили, но для всех ворклоадов, связанных с Astrа, ввели максимальный уровень защиты, и часть таких ворклоадов все еще на паузе, пока их не перенесут в новую инфраструктуру.

3. Расширили мониторинг chain-of-thought, ввели больше алертов и мониторинг на всех этапах процессов.

Звучит хорошо, но вопрос «а стала ли бы такая компания, как OpenAI, заниматься настолько чистым альтруизмом?» встает сам собой.

По крайней мере, таймлайн подозрительно удобный, в тексте много рекламы Astra, и такое заявление может служить одновременно и подогревом интереса к новой модели, и оправданием в случае задержек.

Есть смысл ждать техотчет.
😁10422👨‍💻7🍾2🔥1👏1🎄111
Claude может проектировать белки быстрее специалистов-химиков

https://www.anthropic.com/research/Claude-accelerates-protein-design

Anthropic провели эксперимент и дали Claude задачу спроектировать миниатюрные связывающие белки для 15 разных белковых мишеней. Это задача, на которую у специалиста уходит несколько недель для одной мишени. Дизайны проверяли в реальной лаборатории независимые компании Adaptyv Bio и Twist Bioscience.

В итоге Mythos Preview и Opus 4.8 справились с 14 мишенями из 15. Некоторые дизайны связывались в разы прочнее лучших опубликованных результатов. Hit rate составил почти 27%, при том что типичный показатель области – примерно 10-15%.

Модели ставили все эксперименты почти автономно, самостоятельно вели документацию и оркестрировали сторонние специализированные модели для дизайна белков на GPU. Люди только одобряли доступы.

Claude даже научился делать сложные β-складчатые структуры. А в одном химическом эксперименте агент сам, без подсказки, предложил тот же уточняющий эксперимент, который лаборатория провела независимо три дня спустя.
🔥137👍322413😁7🤯3🎉3🐳2😎2🍓11
⚡️ Modular выложили в опенсорс Mojo

Лицензия Apache 2.0. Внутри исходный код компилятора Mojo, инструменты разработки и toolchain, стандартная библиотека, примеры и часть AI-инфраструктуры, и бонусом CPU- и GPU-кернелы Modular.

https://www.modular.com/blog/mojo-open-source

Большой релиз для AI-индустрии
Please open Telegram to view this post
VIEW IN TELEGRAM
👍64🔥3212😁422🤔1🍓1
This media is not supported in your browser
VIEW IN TELEGRAM
ML-проект недели – определение глубины сцены в реальном времени

На 7.4 миллиона просмотров за сутки разлетелся проект инженера из Software Mansion (Польша). Он работает с TypeGPU – библиотекой, которая позволяет писать GPU-шейдеры прямо на TypeScript.

Автор запустил нейросеть, которая по обычной 2D-картинке восстанавливает карту глубины сцены, и укладывается при этом в ~8 мс на чипе M4 Pro.

Кадр видео при 60 fps длится ~16.7 мс, так что это полноценный реалтайм прямо в браузере. Плюс все, от нейросети до финального рендера со светом, работает в одном GPU-пайплайне, без передачи данных туда-обратно между CPU и GPU.

Демо выглядит особенно хорошо, но кода в опенсорсе нет (возможно, его собираются продать Zoom за несколько миллионов )
Please open Telegram to view this post
VIEW IN TELEGRAM
189🔥86👍39🤯5😁3🏆3💯2🍓21
Лучшее из X на сегодня:

CEO Figure AI объявил, что роботов Figure 02 утилизируют, потому что в штаб-квартире заканчивается место, и спросил у подписчиков, как лучше проводить модель на пенсию.

На что в комменты пришел Арнольд Шварцнеггер и ответил ему: «Вы должны их расплавить»
😁30530💯205👍3🔥2😢1🕊1😍1
29 августа в Москве пройдет конференция для Java-, Scala- и Kotlin-разработчиков, архитекторов и тимлидов.

В программе будут:

— Антон Курако (Т-Банк) — почему красивым бенчмаркам верить страшно и как не обмануть самого себя графиком.

— Андрей Кулешов (Яндекс) — что случилось с миром JVM за первую половину 2026-го: Java, JEP’ы, Kotlin и то, как ИИ уже меняет подход к разработке.

— Сергей Петрелевич (Т-Банк) — как принципы Mechanical Sympathy и правильные библиотеки разгоняют обычное Spring Boot MVC-приложение.

Полная программа вот.

Параллельно будет доступна аллея инженерных продуктов: Kora, SourceCraft, OpenIDE, где можно потыкать и позадавать вопросы командам напрямую.

Вечером во дворе Т-Банка будет PowerPoint party, открытый микрофон с историями факапов, ИТ-квиз, игры на Sega и диджей-сеты на виниле под открытым небом.

Регистрация по ссылке: https://meetup.tbank.ru/conference/jvm-day/
👍54❤‍🔥40🔥35🐳3🗿21🍓1🍾1👾1