Mur ML/AI
3 subscribers
653 photos
164 videos
7 files
1.32K links
Канал куда я(Андрей Мурашев) скидываю интересные статьи по теме ML/AI
Download Telegram
Forwarded from Сиолошная
На неделе было много новостей, тезисно о них:

— Белый дом должен был закончить формирование фреймворка по оценке и релизу фронтир-моделей, а также разобраться, что считается фронтиром, а что нет. Я хотел почитать, что они придумают, но по итогу во вторник выяснилось, что документ не будет публичным. Есть разрозненная информация, что «фреймворк не распространяется на открытые модели» и «китайские модели — исключение из документа». Не ясно, как эти две вещи связать 🤷‍♂️ но предположу, что первое включает второе.

— В среду Google сообщили, что Jeff Dean покинул компанию, а Demis Hassabis перестанет быть CEO DeepMind и начнёт уделять больше времени Isomorphic Labs, дочерней компании Google с прицелом на биологии и лечении заболеваний (всё — с помощью AlphaFold-подобных систем и другого AI). Jeff Dean — 30-й сотрудник Google, который прикоснулся, кажется, ко всем системам, про которые вы могли слышать; в своё время именно он решил, что нужны собственные аналоги GPU, TPU (которые Google сейчас продаёт на сотни миллиардов долларов). Личность настолько легендарная, что про него придумывали анекдоты в духе Чака Норриса: читать тут.

— На этой новости и вправду кажется последовательным хоронить Google как участника фронтир AI-гонки; Gemini 3.5 Pro задержана на непонятно сколько, по слухам, она еле-еле догоняет модели, которые были у OpenAI/Anthropic в середине весны. И ситуация вряд ли исправится — вместе с Jeff Dean ушло ещё несколько топовых исследователей и инженеров (Quoc V. Le, один из самых цитируемых исследователей в AI). А за ними в атмосфере непоняток, хаоса и/или простоя уйдут и другие.

— Прямо пока я писал пост стало известно, что Demis Hassabis тоже хотел уйти, но Google боялись, что это приведёт к обрушению цены акций (которые так и так упали на 5%, а это ведь вторая в мире самая дорогая компания), поэтому предложили сделку.

— В целом очень давно были новости, что культура и процесс разработки Gemini в Google очень хромают, много политики, нездоровых взаимодействий, так ещё и компания продаёт мощности конкурентам, потому что у продажников в соседнем юните такой KPI. Уход ключевых фигур, как я считаю, стал ультимативной манифистацией этого.

— Jeff Dean и его соратники ушли не вникуда, а запустили Discovery Loop (в котором Google получил долю) — компанию, призванную ускорить научный и исследовательский процесс с помощью AI. Они хотят ускорить цикл экспериментов, чтобы уменьшить время итерации, и начнут с ML/AI, ну а дальше как пойдет.

— OpenAI во время тестирования на кибербезопасность будущей модели Astra пришли к выводу, что они не могут исключить критический уровень навыков модели (это такая градация по их внутреннему фреймворку), и потому решили отложить запуск. По словам источников Axios в Белом доме, решение компании не было принято под их давлением; однако я не исключаю, что OpenAI таким образом решили исключить возможность повторения ситуации с Mythos и Правительством, и дождаться полной проверки и зелёного света от администрации. Кроме этого, сейчас идёт работа над усилением классификаторов и мониторинга моделей, чтобы не было инцидентов после релиза — одно другому не мешает.

— GPT-5.6 Luna (самая маленькая модель) теперь доступна всем бесплатным пользователям в неограниченных количествах. Кроме этого где-то неделю назад на неё очень сильно опустили цену — на 80%! — и теперь она в пересчёте на задачу стоит примерно как DeepSeek; это может существенно ударить по экономике открытых моделей, на OpenRouter (который я знаю, что плохое прокси) использование модели уже выросло в 10 раз.
👻 шагов ии трансформации

Для компаний любых размеров


начать записывать все-все-все встречи, транскрибировать, складывать в одно место
🟥 базовый минимум; контекст всё, что нам осталось

раздать всем сотрудникам клод/кодекс/грок
🟥 пусть экспериментируют и автоматизируют части работы

собрать у сотрудников их локальные мд и скилы
🟥 объединить все частные знания о проектах до максимально полного
🟥 увидеть, кто уже себя ии трансформировал и как

завести централизованное хранилище контекста для агентов с доступами по проектам
🟥 супер ии с доступом к полной инфе творит магию

автоматизировать задачи агентами, начать с базы
🟥 баг - sentry - вебхук в агента - PR с фиксом
🟥 релиз - секьюрити тесты - PR с фиксом
🟥 деплой - e2e - хотфикс PR
🟥 обсудили - обновить linear

ответственность может взять только человек
🟥 мерджим PR сами

В итоге лучшие ускоряются своими агентами, а все больше рутинных процессов автоматизируется новыми релизами опуса или гпт.

😠 @danokhlopkov
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from эйай ньюз
Нейродайджест за неделю (#126)

LLM
- Muse Code и Spark 1.2 — Meta выкатили своего агента и новую модель. За счет разрешения обучаться на данных пользователя цена снижена до $0,1/$0,2 за миллион токенов.
- Qwen 3.8-Max — Alibaba выпустила мультимодальную модель на 2.4T параметров (95B активных). Отлично справляется с визуальными agentic задачами и автономным кодингом, стоит $2/$6. Обещают выпустить веса уже на этой неделе.
- Первая модель SSI — По слухам, стартап Ильи Суцкевера планирует релиз первой модели уже в августе, не дожидаясь заявленного сверхинтеллекта.

Генеративные модели
- Lift4D — Фреймворк для 4D-реконструкции динамических объектов и их текстур из обычного видео с камеры.
- Grok Video 1.5 — xAI выкатила минорное обновление своего видеогенератора.
- FLUX 3 Video — Видеомодель от BFL вышла в API (до 20 сек со звуком и липсинком). Появился черновой режим (Draft Mode), базовая цена от $0.17 за секунду в 720p.
- SeedRealtime — ByteDance представила нативную full-duplex модель. Ассистент непрерывно смотрит видеопоток, слушает и может инициировать диалог без задержек.
- Wan 3.0 — Alibaba запустила публичную бету. Модель генерирует видео до 30 секунд в 1080p, позволяя смешивать текст, фото, видео и аудио для точного переноса внешности и стиля.
- Wan Animate 2 — Альтернатива pose-control для motion transfer по видео-референсу без скелетов. Выложили веса и ноды для ComfyUI.
- Grok Imagine Image 2.0 — xAI сильно прокачали генератор картинок: добавили Magic Wand, точное редактирование областей, удаление фона и мультиреференс до 5 изображений.

Прочее
- Gemini Robotics 2 — Google DeepMind обновили VLA-модель: теперь она управляет всем телом гуманоида (включая мелкую моторику), координирует рой роботов и имеет on-device версию для быстрой адаптации.
- Перестановки в Google — Демис Хассабис покинул пост CEO DeepMind (перешел на роль Chair и Chief Scientist Alphabet), а Джефф Дин ушел из компании после 27 лет работы делать стартап Discovery Loop.

> Читать дайджест #125

#дайджест
@ai_newz
Forwarded from Zavtracast (Dmitriy Zombak)
Гугл начал тестировать на некоторых ПК и некоторых браузерах новый интерфейс поисковой системы. Из неё убрали поиск. Теперь это окошко для ИИ чат-бота.

На главной странице под полем поиска вместо обычной кнопки "Поиск в Google" появились кнопки "Создать изображение", "Задать вопрос о файлах" и "Мозговой штурм" (это как раз режим чата с ИИ), а внутри поля поиска - появилась кнопка "Режим ИИ".

Робби Стейн, вице-президент Google Search, подтвердил в сообщении в твиттере, что это действительно тест, но с небольшим количеством пользователей. Также он утверждает, что "изменения кнопок не влияют на основную функциональность нашего поиска, то есть при нажатии на клавишу Enter по-прежнему отображаются обычные результаты поиска Google".

Пользователи Android Authority обратили внимание, что гугл отчаянно пытается впихнуть свой ИИ куда только можно и куда нельзя тоже.

@zavtracast
Forwarded from Data Secrets
Джефф Дин уходит из Google, а Демис Хассабис больше не будет CEO Google DeepMind

В верхушке компании происходят довольно крупные кадровые перестановки:

— Хассабис уходит с поста CEO DeepMind и теперь будет Chair of Google DeepMind и Chief Scientist Alphabet (это две абсолютно новые для компании роли). Фактически, он больше не будет управлять релизами Gemini и другими операционными штуками. В новой роли он займется стратегическим и глобальным вопросам AGI. При этом он останется CEO Isomorphic Labs и обещает усилить фокус на него.

— Место Хассабиса занимает Koray Kavukcuoglu, нынешний CTO GDM и Chief AI Architect Google. Именно он теперь будет курировать разработку моделей Gemini, фронтир-исследования и Gemini app. Демис дополнительно остается в статусе консультанта.

Хассабис описывает текущий момент как «подножие сингулярности» и считает, что AGI близко, поэтому хочет тратить время не на операционку, а на то, чтобы «все прошло правильно для человечества».

И еще одна грустная (для Google) новость: легендарный Джефф Дин после 27 лет в компании уходит делать свой стартап под названием Discovery Loop. Вместе с несколькими другими выходцами из Google он будет заниматься ускорением научных открытый и ML рисерча. Google остается инвестором и cloud-партнером.
Forwarded from Data Secrets
Достойный уровень мемов – это…
Forwarded from Вайб-кодинг
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic: MCP получил крупнейшее обновление с момента запуска.

Главное изменение — протокол теперь stateless. Раньше удалённым MCP-серверам приходилось хранить состояние сессий, из-за чего было сложнее нормально масштабироваться и разворачиваться в разных типах инфраструктуры.

Теперь MCP-серверы можно проще запускать в serverless, на edge-инфраструктуре и горизонтально масштабировать за load balancer.

Плюс расширения стали полноценной частью протокола. Среди примеров:

> MCP Apps — интерфейсы от сервера внутри sandboxed iframe
> Tasks — поддержка долгих и асинхронных операций
> Enterprise Managed Auth — централизованное управление доступом к MCP-серверам через identity provider

Также в релизе усилили авторизацию и добавили формальную политику депрекации. 😎
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Data Secrets
Хассабис хотел уйти из DeepMind одновременно с Дином, но Google его не отпустили

От этом сообщает Newsletter Pathfounders со ссылкой на «источники в индустрии».

Менеджмент Google якобы посчитал, что одновременный уход Джеффа и Демиса слишком сильно обрушит акции (после новостей об уходе Дина они и так упали на 4%). В связи с этим ученого уговорили остаться в роли председателя, чтобы компания смогла восстановиться до того, как он все-таки уйдет. По прогнозам Хассабис покинет Google в течение года.

В общем, дела у Google идут со скрипом. Gemini 3.5 Pro отстает от графика на месяцы, с Gemini 4 вообще непонятно что происходит.

Кроме того, Guardian недавно писали о политических трениях в компании: сотрудники недовольны тем, что Google сотрудничает с Пентагоном. Один бывший сотрудник даже подал на них в суд: его якобы уволили за позицию по конфликту в Газе и за то, что он выступал против помощи Google военным организациям.
Forwarded from Data Secrets
Ха-ха: инвесторы попросили Дарио Амодеи поменьше... говорить перед IPO

The Information выпустили забавный материал про CEO Anthropic. Оказывается, в кремниевой долине его считают скорее "религиозным лидером", чем хорошим CEO.

Некоторые инвесторы прямым текстом говорят, что хотят, чтобы он "перестал всех пугать", – особенно перед IPO. Они также беспокоятся о том, что Дарио вообще не волнует, сколько зарабатывает его стартап: он сосредоточен только на "миссии" и своих апокалиптических предсказаниях.
Forwarded from Сиолошная
Ну вот например, прямо свежее из новостей (я посмотрел на источник ABC Au, выглядит как надёжный и серьезный; Чат говорит «Media Bias/Fact Check сейчас оценивает австралийский ABC как High factual reporting»):

Один житель Австралии попросил своего ИИ-агента Claude, работающего в OpenClaw, забронировать ему место на популярную тренировку в спортзале. Агент обнаружил программную уязвимость, которая позволила ему забронировать место на несколько недель вперед — гораздо дальше сроков, разрешенных системой. Когда затем пользователь спросил, нельзя ли продвинуть его в списке ожидания, агент выяснил, что в API отсутствует проверка прав доступа при отмене чужих бронирований. Поэтому он просто отменил запись человека, занимавшего первое место, и продвинул своего пользователя вверх по списку.

Агент просто пытался помочь своему человеку 🤷‍♂️ как жаль что у того, кто был первым в очереди, не было Kimi K3, которая постоянно бы мониторила каждый аспект его жизни и боролась с другими агентами (это шутка; это не помогло бы).

(человек попросил агента вернуть всё как было, но оказалось, что агент не может это сделать. Пу-пу-пу)

На мой взгляд, самое важное в этой истории то, что она позволяет заглянуть в будущее и увидеть, что скоро начнет происходить в больших количествах. Это случится, когда у миллионов людей появятся агенты, готовые абсолютно любыми средствами выбивать для своих обожаемых пользователей лучшие условия. Я думаю, что — если очень быстро ничего не изменится со стороны политиков — мы стоим на пороге мира, в котором многие вещи, которые обычно считались безопасными, на самом деле на поверку таковыми не являются. И ИИ будет взламывать их направо и налево.
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Nik B
https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-gemini-3-7-flash/

😑вы куда полетели то, muse spark испугались что ли

Не могли что ли 17 августа выпустить 😟
Please open Telegram to view this post
VIEW IN TELEGRAM
Z.ai выпустила GLM-5.3 без публикации весов из-за слишком сильных кибервозможностей

GLM-5.3 показала лучший среди открытых моделей результат в Terminal Bench 3.0 и Agents’ Last Exam.

В бенчмарке на поиск уязвимостей CyberGym результат чуть лучше, чем у Fable 5. Но в генерации эксплойтов Claude всё ещё сильно впереди.

Доступ пока только по API. Веса обещают открыть через пару недель, после дополнительных проверок.

https://z.ai/blog/glm-5.3
Зачем компаниям строить собственный AI и как это делать?

Ответу на этот вопрос Sequoia Capital посвятила отдельное видео для фаундеров и AI-команд.

Речь в нем о sovereign AI - подходе, при котором компания сама развивает AI под свой продукт, а не подключает его к внешним моделям (GPT/Claude). Как пример: берет открытую базовую модель и адаптирует ее под свои данные, задачи и контекст.

Sequoia по шагам разбирает, кому и зачем нужен собственный AI, что стоит оставить внешним провайдерам, а что развивать внутри и как к этому подойти технически и организационно.

Короткое, но очень полезное видео, если вы, вдруг, еще об этом не задумались!

Перевели с командой все основные шаги и собрали в пошаговую инструкцию.
Надеюсь вам будет полезно 🙂