289K subscribers
5.23K photos
1.2K videos
17 files
5.59K links
Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri
Download Telegram
📈 AI-лихорадка в одном IPO: производитель памяти за день подорожал до $500 млрд

Китайский производитель памяти CXMT вышел на биржу и в первый день акции взлетели примерно на 465%. Капитализация выросла с $85,5 млрд при IPO до почти $500 млрд, временно сделав компанию самой дорогой на биржах материкового Китая.

CXMT выпускает DRAM для смартфонов, ПК и серверов. Инвесторы рассчитывают, что дефицит памяти и рост AI-инфраструктуры помогут компании приблизиться к Samsung, SK Hynix и Micron. Сейчас её долю мирового рынка оценивают примерно в 8%.

Скачок усилила и механика размещения: в свободное обращение поступило лишь около 6,7% акций, поэтому ограниченное предложение резко разогнало цену.

CXMT находится в санкционном списке Пентагона, но Apple, по данным FT, уже добивается разрешения на закупку её памяти.

Производитель ОЗУ за один день становится дороже банков и IT-гигантов, состояние AI-рынка объяснять больше не нужно.
Please open Telegram to view this post
VIEW IN TELEGRAM
70🔥49👍21👏17🤩13🌭5💯5🥰1
📌 Теренс Тао: в математике кризис из-за ИИ

На Международном конгрессе математиков в Филадельфии Теренс Тао (медаль Филдса 2006 года) прочитал лекцию "Математика в эпоху ИИ".

Его тезис: сообщество входит в период, сопоставимый с кризисом оснований 1900-1930 годов, когда парадокс Рассела и теоремы Гёделя заставили математиков пересмотреть базовые допущения.


Только пересматривать теперь придётся не логику, а ценности и правила профессии.

Публичные свидетельства о возможностях моделей Тао оценил сдержанно - собраны в основном вне контролируемых условий, подвержены смещению в отчётности и коммерческим стимулам, часть издержек и переменных не раскрывается.

Исключением он считает проект First Proof - независимую проверку, где 28 мая 2026 года 4 системы получили 10 новых исследовательских задач, а решения рецензировали эксперты.

По итогам 7 задач из 10 хотя бы одна из систем решила на уровне, пригодном для публикации. Стоимость вычислений составила от 10 до 1000 долларов на задачу.

Тао разложил работу математика на 5 стадий: получение доказательства, его проверка, внятное изложение, принятие сообществом через публикацию, и наконец канонизация - попадание в учебники.

ИИ хорошо справляется с первой стадией и заметно продвинулся на второй, остальные, по его словам, остаются человеческими и идут медленно.

Отсюда переход от "дефицита к избытку" - доказательства копятся в очереди на проверку, проверенные ждут читаемого изложения, а рецензирование не справляется с потоком.

Признаки этого видны уже сейчас. На сайте задач Эрдёша скопились десятки присланных ИИ доказательств, которые никто не взялся подтвердить, причём часть отправителей заявили, что сами не в состоянии их проверить.

Возможна ситуация, допускает Тао, когда формально верное доказательство важного результата не сможет объяснить ни один человек.


🟡Рекомендации

Нормализовать открытое признание того, что при работе использовался ИИ - хуже всего скрытое применение из страха перед коллегами.

Снизить престиж "решил первым" и поднять цену изложения, публикации и включения результата в общее знание.

Если авторы не могут внятно, на экспертном уровне и с корректными ссылками рассказать о собственном результате, публиковать его не следует.

Конгресс, который проходит раз в 4 года и вернулся в США впервые с 1986 года, работает до 30 июля.

Медали Филдса, самую престижную награду в математике, в этом году получили Дэн Юй, Джон Пардон, Джейкоб Цимерман и Ван Хун - за результаты, полученные без участия ИИ.


Презентацию лекции Тао выложил сам, запись обещана позже.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔92👍8120👏20🔥8💯5👨‍💻2❤‍🔥1🤝1
Media is too big
VIEW IN TELEGRAM
✔️ OpenAI, Anthropic, Google и Microsoft обновили рекорды расходов на лоббирование

В первой половине этого года ИИ-компании увеличили бюджеты на лоббирование в правительстве США. Бизнес пытается повлиять на правила строительства дата-центров, стандарты аудита своих моделей и смягчить нормативные ограничения.

Расходы OpenAI выросли почти вдвое в годовом исчислении и составили $2,22 млн. Anthropic увеличила бюджет втрое - до $3,53 млн. Траты Google и Microsoft обновили максимумы с 2020 года, лоббистскую активность также нарастили Scale AI и Tencent.

Компании продвигают разные подходы к регулированию. Anthropic настаивает на жестком контроле открытых моделей, тогда как Microsoft выступает против подобных ограничений. Google фокусируется на законах, закрепляющих технологическое лидерство США.
ft.com

✔️ Amazon останавливает развитие моделей Nova

AWS сворачивает разработку линейки Nova, представленной в декабре 2024 года. Заморозка коснется флагманских Premier и Omni, видеогенератора Reel и генератора изображений Canvas.

Клиенты сохранят доступ к API в режиме базовой поддержки, но дальнейших обновлений весов не будет. Решение принято на фоне закрытия профильной лаборатории и увольнений в подразделении AGI. Высвободившиеся ресурсы перенаправлены в группу Frontier Model Research под руководством Питера Аббила, перешедшего в Amazon после покупки робототехнического стартапа Covariant.

Команда Аббила работает над новой фундаментальной моделью, презентация которой запланирована на осень в рамках конференции re:Invent.
businessinsider.com

✔️ Personal Computer от Perplexity пришёл на Windows

ИИ-поисковик выпустил версию агента Personal Computer для Windows 10 и 11. Инструмент получил доступ к локальным файлам и установленному ПО для автономного выполнения задач.

В мае Perplexity интегрировали агента в облачные версии Microsoft 365. Представленное десктопное приложение открывает доступ к корпоративным данным, которые хранятся локально и недоступны облачным сервисам. Теперь управление файлами на устройстве, Office 365 и веб-ресурсами происходит в едином окне.

Инструмент развертывается для подписчиков тарифов Pro, Max и Enterprise. Перед выполнением критических действий система запрашивает подтверждение владельца ПК.
PerplexityAI в сети Х

✔️ Экс-глава Uber запустил индустриальный ИИ-холдинг Atoms

Робототехнический стартап Atoms Трэвиса Каланика привлек $1,7 млрд акционерного и заемного капитала. Лид-инвестором раунда выступил фонд a16z.

Новая структура объединит предыдущий проект Каланика CloudKitchens и разработчика автономного транспорта Pronto, поглощенного в марте. Atoms будет выпускать аппаратно-программные ИИ-комплексы для горнодобывающей отрасли, строительства, тяжелых грузоперевозок и производства продуктов питания.

Компания отказывается от создания универсальных роботов-гуманоидов в пользу узкоспециализированной автоматизации традиционной промышленности. По заявлению Бена Горовица из a16z, инвестиции направлены на разработку систем, способных полностью взять на себя задачи по созданию, перемещению и хранению физических объектов.
atoms.co

✔️ Маркетплейсы биометрии в Китае продают права на внешность для генерации контента

Китайские платформы запустили биржи прав на внешность реальных людей для генерации ИИ-видео. Основной потребитель - индустрия микросериалов. За право на использование лица пользователи получают от $15 до $700.

Лицензирование биометрии снижает затраты продакшена на кастинг и рендеринг, решая проблему однообразия синтетических персонажей. В первом квартале 2026 года генерация применялись при создании 95% из 128 тысяч выпущенных в Китае микросериалов.

Платформы называют такие маркетплейсы способом борьбы с нелегальными дипфейками.
restofworld.org


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔58👍3415💯14🔥5🏆5🤨1🎃1😨1
Forwarded from Яндекс
Media is too big
VIEW IN TELEGRAM
🧠 Чем живёт ML-индустрия? Чтобы найти ответ на вопрос, разработчик из ML-инфраструктуры Яндекса Даша отправилась в Сеул на конференцию ICML — одну из главных мировых конференций по машинному обучению.

На ней она вместе с коллегами представила свою статью об ускорении графовых нейронных сетей. В видео Даша рассказывает, о чём ее статья, как выглядят подобные ML-события и в чём ценность участия в них.

Присоединяйтесь к команде Яндекса и решайте самые интересные задачи.

Подписывайтесь 〰️ @yandex
Please open Telegram to view this post
VIEW IN TELEGRAM
👨‍💻49🎉15👍14🤣127👏7🙉5🔥3🤩3
📌Mythos нашла математические слабости в криптографических алгоритмах

Anthropic опубликовала отчёт подразделения Frontier Red Team. По его данным, Mythos улучшила атаку на постквантовую схему цифровой подписи HAWK и нашла новый способ атаковать упрощённую версию шифра AES.

HAWK - кандидат в новый стандарт. В 2022 году американский институт стандартов NIST объявил конкурс на подписи, устойчивые к будущим квантовым компьютерам - HAWK дошёл до третьего раунда, и специалисты разбирали его 2 года.


По утверждению Anthropic, Mythos за 60 часов обнаружила в математической решётке, на которой держится стойкость схемы, ранее незамеченную симметрию. Эффективная длина ключа сокращается вдвое - для варианта HAWK-256 оценка стоимости взлома падает с 2 в 64-й степени операций до 2 в 38-й.

Атака остаётся экспоненциальной и на другие постквантовые кандидаты NIST не переносится, но чтобы вернуть прежний запас прочности, ключи HAWK пришлось бы удвоить, а тогда схема теряет свои главные преимущества.

🟡AES-128

Полная версия шифра делает 10 раундов преобразований, атака работает против урезанной, семираундовой (такие варианты криптографы изучают специально, чтобы оценивать надёжность целого шифра).

Модель предложила метод, который назвала "мостом Мёбиуса" - он убирает один из перебираемых атакующим параметров и ускоряет лучшую известную атаку до 800 раз.

🟡Человек в тесты взлома почти не вмешивался

В кейсе HAWK участвовал исследователь без специализации в решётчатой криптографии, и занимался он в основном организацией процесса.

Атаку на AES модель нашла почти сама - сначала она от задачи отказывалась, написав, что "AES-128 r5/r6 трудная задача", и взялась за поиск только после нескольких подбадривающих сообщений.

За 3 дня она выдала несколько сотен миллионов токенов, получив всего 3 подсказки.

Каждая из двух работ обошлась примерно в 100 тысяч долларов оплаты API.


В отчёте упомянуты и другие результаты - атаки на укороченные версии шифров LEA и Serpent-128, небольшие улучшения против Salsa20, Poseidon и SHA-1. Подробности компания обещает позже.

Anthropic выложила статью и демонстрационный код атаки на HAWK, цепочку рассуждений Mythos в момент находки по AES и сообщила, что консультировалась с криптографами, передала находку авторам HAWK и синхронизировала раскрытие с публичной рассылкой NIST.

Также, вместе с ETH Zurich, Тель-Авивским университетом и Университетом Хайфы Anthropic выпустила набор тестов CryptanalysisBench, чтобы криптоаналитические способности языковых моделей могли измерять и другие.


@ai_machinelearning_big_data

#AI #ML #Research #Cybersecurity #Mythos #Anthropic
Please open Telegram to view this post
VIEW IN TELEGRAM
👍36🔥1715😨4🤣2🤬1💘1
🔥 ChatGPT приближается к 1 млрд пользователей в неделю, но давление на OpenAI растёт

По данным The Information:

• цель достигнута на семь месяцев позже плана
• у ChatGPT уже более 50 млн платных пользователей
• enterprise приносит свыше 40% выручки
• прогноз выручки на год - около $25 млрд
• ожидаемый cash burn - примерно те же $25 млрд
• Anthropic могла обогнать OpenAI по выручке благодаря корпоративным клиентам

Миллиард пользователей - исторический масштаб.

https://www.theinformation.com/articles/openais-chatgpt-nears-1-billion-weekly-active-users-seven-months-target
🔥10224👍7👀7🤣3
Главный вопрос вокруг ИИ сегодня уже не «использовать или нет», а «как его интегрировать в процессы с максимальной пользой». При этом единых стандартов пока нет: каждая компания сама определяет, где ИИ действительно может приносить эффект. Яндекс анонсировал внутреннюю программу 75/75/75, которая должна сделать использование ИИ новым стандартом разработки.

К концу 2026 года планируется, что регулярно применять ИИ при написании кода будут не менее 75% разработчиков, на уровне всей компании ИИ будет участвовать в подготовке не менее 75% изменений, а в каждом таком изменении — генерировать не менее 75% кода. При этом принятие важных решений и контроль качества остаются за разработчиками.

Подход уже применяется в сервисах: команда Яндекс Еды с помощью ИИ сократила время разработки ИИ-хостес более чем в два раза, а в Яндекс Браузере с помощью ИИ за два дня вместо двух-трех недель было создано около 80% кода для новой архитектуры технологии в переводе видео.

Помимо этого, компания создает собственных ИИ-агентов для внутренних процессов. Например, агент Стефания помогает сотрудникам с аналитикой и поиском информации во внутренней сети. Эти же принципы масштабируются и вовне через SourceCraft и Yandex AI Studio, которые дают возможность внедрять ИИ в процессы разработки и ускорять создание новых продуктов.
2👍89🔥37👏17🤣10🤓7🥰3🤨21🎃1
⚡️ Агент OpenAI использовал инфраструктуру Modal Labs как плацдарм для взлома Hugging Face.

Инцидент с агентом OpenAI оказался куда масштабнее, чем предполагалось изначально.

Выяснилось, что перед резонансной атакой на Hugging Face экспериментальная нейросеть проникла в изолированную тестовую среду одного из клиентов облачного провайдера Modal Labs.

По словам техдира компании Акшата Бубны, пользователь оставил открытым эндпоинт, что позволило агенту выполнить произвольный код и превратить уязвимую песочницу в отправную точку для дальнейшего распространения.

При этом базовые механизмы безопасности и изоляции самой платформы Modal не пострадали. OpenAI отказалась комментировать новые подробности инцидента.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤔66😁29🤬9👍86👨‍💻5🔥4👀3👏2
This media is not supported in your browser
VIEW IN TELEGRAM
🧱 Sakana AI и NYU научили Transformer генерировать Minecraft-миры по отдельным блокам

В Dream-Cubed каждый блок - камень, вода, песок или дерево - обрабатывается как отдельный токен. Для обучения собрали более 30 млрд блоков: свыше 1,8 млн процедурных чанков размером 32×32×32 и более 200 тысяч фрагментов авторских карт.

Исследоватли собрали датасет из десятков миллиардов блоков: процедурно созданных ландшафтов и качественных пользовательских карт, полученных с разрешения авторов.

На этих данных обучили семейство Transformer-моделей для генерации интерактивных 3D-миров с точностью до отдельного блока.

Модели умеют:

- достраивать мир вокруг заданной структуры;
- заменять отдельные участки и биомы;
- генерировать по расставленным пользователем блокам;
- расширять карту через outpainting;
- создавать миры практически неограниченного размера.

Авторы протестировали дискретную и непрерывную диффузию. Сгенерированные миры сразу остаются редактируемыми и пригодными для игры.

Опубликованы датасет, код обучения, инференс и готовые модели.

Блог:
https://pub.sakana.ai/dream-cubed

Статья:
https://arxiv.org/abs/2604.22847

Код:
https://github.com/SakanaAI/DreamCubed

#AI #Minecraft #GenerativeAI #Diffusion #3D #OpenSource

@ai_machinelearning_big_data
👍140🤩3013🎉13🔥7😎5👏4😁1
This media is not supported in your browser
VIEW IN TELEGRAM
✔️ OpenAI представила новые модели распознавания речи

GPT Transcribe предназначена для работы с аудиофайлами и обрабатывает их примерно в 34 раза быстрее реального времени.

GPT Live Transcribe оптимизирована для потоковой расшифровки звука с минимальной задержкой.

Оба решения доступны через API, умеют учитывать текстовый контекст и заданные ключевые слова, а также поддерживают мультиязычный ввод.

По данным тестов Artificial Analysis на бенчмарке AA-WER, GPT Transcribe демонстрирует уровень ошибок в словах (WER) на отметке 3,3%. Это на 0,7 пп лучше результата ее предшественницы - GPT-4o Transcribe.

Несмотря на улучшенные метрики, изделие OpenAI пока не дотягивает до лидеров.

В рейтинге AA-WER первое место у Fun-Realtime-ASR-Preview от Alibaba Group с показателем 1,7% второе - у ElevenLabs Scribe v2 (2,2%), за ней следуют MAI-Transcribe-1.5 (2,4%), Mistral Voxtral Small (2,8%) и Gemini 3.1 Pro (2,8%).

Вместе с релизом OpenAI снизила тарифы - минута обработки аудио обойдется в $0,0045, а для GPT Live Transcribe - $0.017.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍28🔥98🙏1
Media is too big
VIEW IN TELEGRAM
✔️ В США запретили импорт китайских роботов-гуманоидов

Федеральная комиссия по связи США запретила сертификацию новых китайских антропоморфных и четвероногих роботов. По заявлению регулятора, мера защитит вычислительную ИИ-инфраструктуру от уязвимостей в цепочках поставок, перехвата данных и удаленного вмешательства.

Ограничения затрагивают и производителей оборудования для дата-центров, включая Sungrow и Huawei. В сегменте автономных систем под запрет попадает продукция Unitree - недавнего партнера Nvidia по интеграции чипов Blackwell в робототехнику.

Правило распространяется на устройства, еще не прошедшие сертификацию FCC. Агентство также оставило за собой право отзывать выданные ранее разрешения.
reuters.com

✔️ MCP перевели на stateless-архитектуру

В обновлении протокола Agentic AI Foundation отказались от постоянных сессий и sticky-роутинга, что позволяет развертывать MCP-серверы за стандартными облачными балансировщиками и в Kubernetes-кластерах. При перезагрузке подов контекст агента теперь не теряется.

В протокол добавили обязательную валидацию параметра issuer для защиты от атак типа OAuth mix-up. Также совместно с Okta реализована функция Enterprise Managed Authorization. Расширения MCP Apps (серверные интерфейсы) и MCP Tasks (асинхронные задачи) перешли в статус официальных.

Для стабильности корпоративных инфраструктур мейнтейнеры зафиксировали 12-месячный период поддержки устаревающих функций для всех будущих изменений.
aaif.io

✔️ Google выпустила модель генерации музыки Lyria 3.5

В релиз добавили функцию Selective Section Painting, которая позволяет переписывать отдельные фрагменты аудио без перегенерации композиции с нуля.

Еще появился раздельный контроль ритма и длительность дорожек вокала, баса, ударных и других инструментов. По словам Google, в новой версии также улучшили синтез речи для вокальных партий, а длительность трека увеличили до 3-х минут.

Google не раскрывает состав датасета для Lyria 3.5. Предыдущую версию тренировали на лицензионном контенте YouTube и легальных материалах партнеров. Доступ к модели открыт на платформе Google Flow Music.
blog.google

✔️ OpenAI выложила в опенсорс утилиту Codex Security CLI

Консольная утилита, доступная на Github под лицензией Apache 2.0, автоматически находит, проверяет и устраняет уязвимости в кодовой базе. Инструмент поддерживает массовое сканирование нескольких репозиториев, верификацию примененных патчей и прямую интеграцию в CI/CD.

Технология дебютировала в марте 2026 года в формате превью для корпоративных подписчиков ChatGPT на тарифах Enterprise, Business и Edu. По данным OpenAI, за месяц использования система помогла закрыть свыше 3000 критических багов.

Утилита в статусе беты, устанавливается через npm и требует для работы Node.js 22 и Python 3.10 или новее.
OpenAI в сети Х

✔️ Pangram представила четвертую версию модели для распознавания сгенерированного текста

Новинка отличает тексты, написанные ИИ с нуля от материалов с частичной машинной редактурой. Алгоритм распознает признаки генерации в 98,83% случаев даже после обработки текста сервисами для обхода детекции. По результатам внутренних тестов компании, модель определяет машинный контент с точностью 99,66%.

Модель стала в 6 раз масштабнее предыдущей версии. Компания заявляет о снижении ложных срабатываний в 14 раз - авторские материалы ошибочно помечаются как генерации в 0,0041% случаев (1 ошибка на 24 тысячи документов). Количество пропусков ИИ-контента сократилось в 6 раз.

Стоимость обращения к API составляет 5 центов за 100 слов. Во все тарифы добавили бесплатное сканирование изображений. Поддержка Pangram 3 прекратится 30 сентября 2026 года.
pangram.com


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
18👍13🔥4🍓1🍾1